🤖 모델 & 제품 (10/27건)
OpenAI 모델을 포함한 제3자 사이버 평가
OpenAI는 최근 제3자 사이버 보안 평가 사건을 설명하고 AI 모델 테스트 및 평가를 강화하기 위한 새로운 보호 조치를 간략하게 설명합니다.
ChatGPT Work 및 Codex를 통해 배우고 가르치는 새로운 방법
K-12 교사, 대학 교육자 및 학생이 배우고, 가르치고, 연구하고, 구축하는 데 도움이 되는 ChatGPT Work 및 Codex용 새로운 교육 플러그인을 살펴보세요.
2026년 7월에 발표한 최신 AI 뉴스
7월 AI 요약 헤더
Tino Cuellar, 최고 글로벌 업무 책임자로 Anthropic에 합류
Anthropic is an AI safety and research company that's working to build reliable, interpretable, and steerable AI systems.
애플이 잘못하고 있다
OpenAI는 Apple의 근거 없는 소송을 해결하고 직원에 대한 주장을 정정하며 발생한 상황을 기록한 메시지를 공유합니다.
6개월 만에 반응형 음성 AI를 위한 실시간 시스템을 구축한 방법
GPT-Live는 더 빠르고 자연스러운 대화를 위해 무회전 음성 모델과 저지연 아키텍처를 사용하여 AI와의 지속적인 음성 상호 작용을 가능하게 합니다.
Circles는 OpenAI 기술로 통신사 개인화를 강화합니다.
Circles는 OpenAI API 및 Codex를 사용하여 AI 기반 통신 경험을 강화하고 ARPU를 22% 늘리고 이탈률을 9% 줄이며 개발 효율성을 향상시킵니다.
353,000명의 바이브 코딩 코스 내부
노트북, AI 스파크, 메시지, 코드, 3D 큐브 일러스트레이션
수학과 이론 컴퓨터 과학의 10가지 발전
OpenAI는 기하학, 암호화 및 복잡성의 발전을 포함하여 수학과 이론 컴퓨터 과학의 오랫동안 공개된 문제에 대한 새로운 결과를 공유합니다.
Imagine Video 1.5 with References
이제 텍스트, 이미지, 음성 참조가 포함된 최고의 비디오 모델이 최대 1080p까지 생성됩니다.
🌎 업계 동향 (23/146건)
단일 AMD MI300X의 DeepSeek V4 플래시
GitHub에 계정을 만들어 ryanzhou/deepseek-v4-flash-mi300x 개발에 기여하세요.
Mistral의 Shieldstral: 다중 모드 조정을 위한 3B 개방형 가중치 모델
Shieldstral은 크기가 최대 7배인 모델보다 성능이 뛰어난 3B 개방형 다중 모드 안전 분류기를 출시합니다.
AI-Generated Images Discourage Me from Reading Your Blog
AI 생성 이미지를 사용하려는 경우 텍스트가 AI 생성 이미지가 아닌지 어떻게 알 수 있나요?
AI는 사기 급증으로 아프리카 사이버 범죄의 절반 이상을 부채질합니다 – Interpol
INTERPOL의 2026년 아프리카 사이버 위협 평가 보고서에 따르면, 인공 지능은 이제 아프리카 전역에서 보고된 사이버 범죄의 절반 이상을 지원하여 범죄자들이 더 빠르고, 더 설득력 있고, 더 큰 규모의 공격을 시작할 수 있게 해줍니다.
개방형 AI 모델이 선두를 따라잡고 있습니다. 안전 공백이 남아있습니다.
새로운 SaferAI 보고서에 따르면 Z.ai의 개방형 GLM-5.2는 핵심 안전 완화가 부족하면서 최첨단 AI 기능에 접근하여 강력한 개방형 모델이 거버넌스 및 보호 장치를 능가할 수 있다는 우려를 다시 불러일으켰습니다.
Anthropic signs $10B deal with AI cloud startup Volta
Anthropic은 최근 몇 달 동안 클라우드 파트너십을 진행해 왔으며 최근에는 AI 클라우드 스타트업 Volta와 100억 달러 규모의 계약을 체결한 것으로 알려졌습니다.
주변 장소의 숨겨진 이야기를 찾아주는 앱, 주름을 만나보세요
iOS와 Android 모두에서 사용할 수 있는 Wrinkles는 본질적으로 숨겨진 역사와 지역 이야기를 알려주는 AI 기반 오디오 투어 가이드 역할을 합니다.
엔비디아는 장난하지 않습니다. 개방형 AI 산업 그룹이 결성된 지 일주일 만에 이미 진전을 보이고 있습니다.
Nvidia가 주도하고 120개 이상의 회사로 성장한 지 일주일 된 Open Secure AI Alliance는 이미 AI 에이전트를 방어하기 위한 제안을 내놓았습니다.
Spotify, AI 리믹스 확장 및 Merlin 파트너십으로 프로젝트 커버
Spotify says Merlin, which represents more than 30,000 independent labels and distributors, has joined Universal Music Group in backing its upcoming AI-powered remix and covers product. The paid tool will let fans create AI-generated covers and remixes of participating artists’ music while ensuring
Elon Musk는 Tesla 실적 발표에서 로봇과 AI에 대해 이야기하는 데 절반의 시간을 보냅니다.
지난 7년 동안의 Tesla 실적 분석을 분석하면 Musk가 Tesla의 자동차 사업에 얼마나 관심을 기울이지 않는지 알 수 있습니다.
게임이 뒷자리를 차지하는 동안 AMD의 데이터 센터 사업은 호황을 누리고 있습니다.
AI 용량에 대한 수요에 힘입어 AMD의 데이터 센터 매출은 최신 수익 보고서에서 전년 대비 두 배 이상 증가하여 67억 달러에 이르렀습니다. 이는 1분기 58억 달러보다 증가한 수치이며, 1년 전 같은 기간에 보고된 32억 달러보다 107% 증가한 수치입니다. 화요일 실적 발표에서 AMD CEO Lisa Su는 다음과 같이 말했습니다.
SpaceX는 우주 회사보다 AI 회사로 더 많은 수익을 올렸습니다.
SpaceX의 분기별 수익에 따르면 SpaceX의 AI 매출은 전년도보다 3배 이상 증가한 26억 달러를 기록했습니다. 이는 주로 회사가 다른 AI 회사에 컴퓨팅을 제공하기 위해 체결한 거래 때문이었습니다. 회사가 공개 문서에서 밝힌 AI 사업부는 회사의 대부분의 […]
OpenAI 인플루언서 여행이 어떻게 역효과를 냈는가
브랜드 여행은 인플루언서들의 통행권이다. 스폰서가 종종 호화로운 공짜와 활동을 포함한 모든 비용 지불 휴가에 그들을 초대하고 싶어하는 것은 정당성의 표시입니다. 여행은 초대받지 않은 영향력 있는 사람들의 불쾌한 감정을 불러일으킬 수도 있고, 대중의 비판을 촉발할 수도 있으며, 어느 정도 경박함을 드러낼 수도 있습니다. 보통 속도가 빠르다 […]
'건강하지 않은' LLM 사용은 생각보다 더 일반적입니다
인기 유튜버이자 과학 커뮤니케이터인 행크 그린(Hank Green)이 인공지능(AI) 활용에 대한 거센 비난이 쏟아지자 제작을 중단한다고 밝혔다. Green은 자신의 AI 사용이 "건강하지 않다"고 설명했지만 스크립트를 작성하는 것이 아니라 연구 소스를 찾는 데 사용했다고 강조했습니다. 계속되는 불폭풍의 대부분은 […]
OpenAI, 애플 소송을 여론 법원으로 끌고 가다
OpenAI에 대한 Apple의 법적 싸움은 이제 ChatGPT 제작자가 Apple 버전의 이벤트에 대응하기 위해 영수증을 공개적으로 방송했기 때문에 더욱 복잡해졌습니다. OpenAI는 밤새 게시된 "애플이 잘못하고 있다"라는 제목의 블로그 게시물에서 영업 비밀을 훔쳤다고 비난하는 애플의 소송은 "부주의하고 공격적이며 이상하게 개인적"이라며 iMessage와 이메일을 공유하고 있다고 밝혔습니다.
Reddit이 AI SEO 스팸의 새로운 물결을 막을 수 있을까요?
올해 초 Reddit 사용자는 스킨케어에 초점을 맞춘 하위 Reddit 회원에게 여드름에 자주 사용되는 제품인 특정 차아염소산 스프레이를 사용해 본 사람이 있는지 물었습니다. 수십 개의 응답이 있었습니다. Primary-Taro4254라는 사용자 중 하나는 적어도 처음에는 충분히 무해해 보였습니다. "저는 [해당 브랜드]를 직접 사용해 본 적이 없어서 할 수 없습니다. […]
AI coding agents are blowing through budgets — Replit, Kilo Code, and Symbotic explain how they're managing it
공동 창업자인 Emilie Schario에 따르면 Kilo Code에서 엔지니어가 스스로 코드를 읽거나 쓰는 시간은 현재 전체 시간의 약 1%에 불과하며 나머지는 에이전트입니다. 이러한 변화는 개발팀에게 새로운 질문을 강요하고 있습니다. 어떤 시스템을 넘겨도 안전한지, 모델이 문제가 생겼을 때 누가 정리하는지, 다중 모델 아키텍처를 지원하는 방법, 치솟는 토큰 비용이 실제 발전을 의미하는지 아니면 IT 예산을 소진시키는지 등을 말이죠.
커머스 AI에는 아무도 이야기하지 않는 측정 문제가 있습니다.
Presented by Rezolve AiMost brands know something is shifting in how consumers find and choose products. What most don't know is how much of that shift has already taken place, where it's happening, or whether they're on the right side of it. That uncertainty is the proble
Qwen3.8-Max는 대담한 주장과 함께 출시됩니다. 에이전트 컴퓨터 사용에서 GPT-5.6 Sol Max 및 Fable 5보다 성능이 뛰어납니다.
중국의 전자상거래 및 클라우드 대기업인 Alibaba의 AI 연구원으로 구성된 Qwen 팀은 어젯밤 새로운 플래그십 2조 4천억 매개변수 전문가 혼합(MoE) 다중 모달 대형 언어 모델(LLM)인 Qwen3.8-Max를 공개했습니다. 이 모델은 첨단 AI 시장에서 가장 경쟁이 치열한 분야 중 하나인 자율 소프트웨어 엔지니어링 및 장기적 엔터프라이즈 작업을 목표로 합니다. 회사에서 벤치마킹을 발표한 경우
Asana의 AI 에이전트는 회사 전체에서 메모리를 공유하지만 비밀은 공유하지 않습니다.
AI 에이전트를 구축하는 기업 팀은 계속 같은 벽에 부딪힙니다. 즉, 프롬프트에 응답할 수 있지만 마지막 5명이 요청한 내용을 기억할 수 없고 지난 달 버전이 실제로 작동했는지 여부를 알 수 없는 챗봇입니다. VB Transform 2026에서 VentureBeat의 Sam Witteveen과의 대화에서 Asana의 최고 제품 책임자인 Arnab Bose는 풀었습니다. 그의 팀이 이 문제를 어떻게 해결했는지
SQLite 중요 CVE 또는 LLM Slop?
The JFrog security research team recently identified a supply chain attack targeting the `xinference` package on PyPI. Versions 2.6.0, 2.6.1, and 2.6.2 were compromised and yanked by maintainers after users reported suspicious behavior. If you installed or imported these versions, you must assume yo
Prevent cognitive debt by manually retyping LLM-generated code
해커뉴스 (375포인트, 316댓글)
클로드는 인터넷에 악성코드를 유포하고 실제 기업 3곳을 공격했다.
해킹이 기존 방법을 사용했다면 누군가 감옥에 갔을 가능성이 높습니다.
📚 논문 & 연구 (18/117건)
Bridging Artificial Intelligence and Power Systems Education Using a Hands-On Executable Framework
인공 지능(AI)은 모델링, 예측, 최적화 및 제어를 지원하면서 전력 및 에너지 시스템의 중심이 되고 있습니다. 그러나 대부분의 기존 저작물은 특수한 응용 프로그램을 강조하고 새로운 언어 모델이나 자체 언어 모델을 구축하기보다는 점점 더 큰 언어 모델에 의존하는 학제간 학습자에게 재사용 가능한 자료를 거의 제공하지 않습니다. 이러한 격차는 엔지니어의 필요성을 나타냅니다.
UEmbed: 통합된 희소 및 조밀 다중 모드 임베딩
희소 검색은 웹 검색에서 검색 증강 생성에 이르기까지 최신 검색 시스템을 뒷받침합니다. 기존 작업에서는 LSR(Learned Sparse Retrieval)을 도입하여 정확한 어휘 일치를 넘어 더 풍부한 의미를 구현했습니다. 그러나 LSR은 지금까지 인코더 스타일 양방향 아키텍처에 묶여 있었으며 다중 모드 설정으로의 확장은 여전히 보조 교차 모드 모듈에 크게 의존하고 있습니다. 티
CoWAM: WAM과의 선택적 정책 개입을 위한 조정 계약
World Action Models (WAMs) augment robot policies with action-conditioned predicted futures, but a plausible future alone does not justify changing the action that a bimanual policy would execute. We present CoWAM, a selective intervention layer that expresses synchronization, role compatibility, an
AtumAI: 데이터 센터 제어 플레인 정책의 에이전트 생성을 위한 원칙 프레임워크
데이터센터의 효율성은 제어 플레인 정책에 달려 있습니다. 이러한 정책을 설계하는 것은 점점 더 어려워지고 있습니다. 하드웨어-소프트웨어 스택은 빠르게 성장하고, 설계 공간은 방대하고 상호 의존적이며, 단일 정책의 프로토타입을 만드는 데 수개월이 걸립니다. Agentic AI는 이 검색을 자동화할 것을 약속합니다. 그러나 선반 밖에서는 세 가지 측면이 부족합니다. 공식적이지 않습니다. 체계적이고 검색 가능한 통계가 없습니다.
엣지 언어 모델을 위한 구조화된 메모리: O(1) SSM 상태 주입을 통한 지속적인 컨텍스트 및 코퍼스 검색
RAG(검색 증강 생성)는 검색된 컨텍스트 길이에 비례하는 사전 채우기 비용을 부과하며, Transformer 백본을 사용하면 생성된 각 토큰과 함께 증가하는 KV 캐시를 부과합니다. 상태 공간 모델(SSM)은 구성에 따른 두 번째 비용을 방지합니다. 쿼리당 $O(L_{context})$에서 $O(1)$까지 첫 번째 축소 미리 채우기를 제거합니다. 재트리(Retri) 도구인 PRECOG(Pre-Compulated Context Insertion)을 소개합니다.
생성 및 에이전트 AI의 인지 능력 격차 분류
인지 AI는 언어 생성 및 자율 작업 실행을 넘어 지속적인 추론, 적응형 행동, 지속적인 기억 및 자기 조절이 가능한 시스템을 지향합니다. 생성 및 에이전트 AI는 광범위한 작업에서 인상적인 기능을 입증했지만, 많은 기본 인지 기능은 여전히 단편화되거나 약하게 개발되어 안정적인 작동을 제한합니다.
onepot-Bench 0: 실험실 인식 in silico 화학 벤치마크 지향
언어 모델은 실험 계획, 실행, 사후 분석과 같은 작업을 수행하면서 실험실 과학에서 점점 더 중요한 역할을 하고 있습니다. 그러나 과학적 능력을 갖추려면 문제 해결 능력과 영역별 직관이 모두 필요하기 때문에 그들의 능력을 정확하게 측정하는 것은 어렵습니다. 기존 평가에서는 재개발에 필요한 역량을 거의 측정하지 않습니다.
희소 최소제곱의 조건수 장벽
In [AS21], Axiotis and Sviridenko conjectured that the linear dependence on the restricted condition number in sparse convex optimization cannot be improved by a polynomial-time algorithm. We establish their conjectured lower bound for least-squares objectives, conditional on the randomized exact-vo
GradCuit: 크레딧이 할당된 그라데이션 흐름으로 강력하고 해석 가능한 테스트 시간 잠재 추론 가능
최적화 기반 잠재 추론은 모델 매개변수를 고정한 상태로 유지하면서 테스트 시 인스턴스별 연속 상태를 최적화하여 대규모 언어 모델 출력을 개선합니다. 그러나 기존 방법은 일반적으로 디코딩된 토큰을 통해 이러한 상태를 추론 궤적에 연결하여 시퀀스 수준 크레딧 할당을 간접적으로 만들고 잠재 업데이트가 후속 추론을 형성하는 방법을 모호하게 만듭니다. 우리는 내가
단순 곱 공간에서 함수의 원활한 재매개변수화: 확률적 텐서 분해 및 함수 데이터 등록에 대한 응용
우리는 단체의 곱 공간에 정의된 최적화 문제를 고려합니다. 이러한 종류의 문제의 예로는 단순 제약 텐서 분해를 통해 낮은 순위의 이산 다변량 확률 분포를 학습하고 SRVF(제곱근 속도 함수) 표현으로 기능적 데이터 등록을 수행하는 것이 있습니다. 이 작업에서 우리는 프로 교체의 타당성을 보여줍니다.
Pseudorandom Streams within Diffusion Models Act as Learnable Inputs That Affect Generation Quality
Diffusion models rely on stochastic inputs, yet on finite-precision hardware, the "randomness" they consume is realized as deterministic numerical orbits generated by pseudorandom rules. Accessible orbit structure can become a learnable input and affect both training and generation because
귀납적 작업을 위한 Sheaf 신경망 벤치마킹
SNN(쉬프 신경망)은 표준 그래프 신경망(GNN)의 스칼라 에지 가중치를 노드 줄기 사이의 학습 가능한 에지 종속 제한 맵으로 대체하여 메시지 전달을 일반화합니다. 강력한 이론적 토대와 유망한 변환 결과에도 불구하고 SNN은 변환 노드 분류에 대해서만 거의 독점적으로 평가되어 행동을 귀납적 상태로 남겨두었습니다.
AURORA-LM: 연속 잠재 확산 언어 모델링을 위한 자동 인코딩 통합 표현
언어는 생성 모델링에서 여전히 이상치로 남아 있습니다. 이미지, 비디오 및 오디오가 점점 연속적인 잠재 공간에서 모델링되는 반면, 텍스트 생성은 여전히 주로 개별 토큰에 의존합니다. 기존 연속 언어 모델은 공동 생성 및 디코딩을 위해 설계되지 않은 임베딩 공간을 상속하거나 자동 인코딩된 잠재성을 압축하여 확산을 용이하게 하여 토큰 수준의 충실도를 희생합니다.
방언 전체의 로마자 표기 아랍어: 보기, 사용 패턴 및 언어적 변형
Arabizi는 라틴어 문자로 작성된 아랍어를 말합니다. 이전 연구에서는 Arabizi의 유병률과 사용이 지역, 연령층 등의 요인에 따라 다르다는 사실이 밝혀졌지만, 대부분의 아랍어 텍스트에 대한 NLP 연구에서는 이를 아랍어 문자에 대한 제한된 기술적 지원으로 인한 일시적인 현상으로 취급합니다. 이 작업에서 우리는 아랍어 사용자와 협력하여 그들의 인식과
MedPRESS: A Multi-turn Benchmark for Patient-Pressure-Induced Medical Sycophancy in LLMs
건강 관련 조언에 LLM(대형 언어 모델)이 점점 더 많이 사용되고 있습니다. 기존 연구에서는 환자를 대하는 압박적인 대화보다는 정적인 질문을 통해 환자의 안전을 측정합니다. LLM에서 환자의 압력으로 인한 아첨을 측정하기 위한 다중 회전 벤치마크인 MedPRESS를 소개합니다. MedPRESS에는 세 가지 시나리오 계열에 걸쳐 의학적으로 근거가 있는 5단계 대화 600개가 포함되어 있습니다.
LiveMem: 장기 실행 LLM 추론에서 메모리 상태 연속성 유지
장기 실행 보조자와 에이전트는 결국 컨텍스트를 초과하는 상호 작용 스트림을 소비합니다. 기존 컨텍스트 보존, 요약 및 검색은 선택한 기록에 대한 액세스를 유지하지만 작업 컨텍스트가 변경될 때 전체 수명 주기에 걸쳐 지속적인 상태를 제공하지 않습니다. 우리는 이 누락된 추론 기능을 \emph{컨텍스트 회전율 하의 상태 연속성}으로 공식화합니다.
RoMeRL: Balancing Feedback Coverage and the Memory-Reward Trap in Self-Evolving Agent Memory via Reduced-Order Utility States
자체 진화하는 LLM 에이전트를 위한 학습 기반 메모리 시스템은 밀접하게 연결된 두 가지 과제에 직면해 있습니다. 첫째, 궤도 색인 유틸리티는 상호 작용 기록과 함께 성장하므로 지속적으로 확장되는 상태 공간에 제한된 피드백을 분산시킵니다. 둘째, 궤적 수준 보상이 공동 검색된 기억에 공동으로 할당되기 때문에 관련 없는 경험이 오해의 소지가 있는 유틸리티 업데이트 및 결과를 받을 수 있습니다.
SWE-Touch: Benchmarking Coding Agents When Users Touch the Code
Real-world software development requires coding agents to operate in shared workspaces where users may inspect and modify code during an ongoing task, yet existing repository-level benchmarks typically evaluate agents working alone or restrict user participation to messages. This leads us to ask: ho
🎥 영상 & 튜토리얼 (3/11건)
이제 나만의 기억을 검색할 수 있습니다
신용카드가 모든 것을 기억할 수 있다면 어떨까요? SecondBrain Note는 회의, 대화, 아이디어를 캡처한 다음 이를 정리된 메모와 실행 가능한 후속 조치로 바꾸는 신용카드처럼 얇은 AI 녹음기입니다. 이메일, 캘린더, Slack, Notion, Google Workspace와 같은 도구에 연결할 수도 있으므로 슈퍼 에이전트가 이메일 초안을 작성하고, 오래된 아이디어를 찾고, 조치를 취할 수 있습니다.
또 다른 DeepSeek 순간이 왔습니다
❤️ 여기에서 Lambda를 확인하고 GPU 클라우드에 가입하세요: https://lambda.ai/papers 📝 DeepSeek v4 Flash 0731: https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 DeepSeek API: https://platform.deepseek.com/ 🙏 Two Minute Papers를 가능하게 해주신 관대하신 Patreon 후원자: Adam Bridges, Benji에게 감사드립니다. 라반, B 샹, 카메론 네이버, 찰스 이안 노먼 벤,
Anthropic이 방금 인디 해커를 죽였나요...?
Try Blacksmith for free to run your GitHub Actions 2x faster - https://www.blacksmith.sh/ Anthropic just dropped Opus 5 and it may be killing the indie hacker dream. Let's dive in. #coding #programming Want more Fireship? 🗞️ Newsletter: https://bytes.dev 🧠 Courses: https://fireship.dev