275건 수집
2026-08-06 06:02

오늘의 핵심

DeepSeek-V4-플래시 업데이트

해커뉴스 (707포인트, 333댓글)

Hacker News

🤖 모델 & 제품 (10/17건)

OpenAI 2026-08-04

OpenAI 모델을 포함한 제3자 사이버 평가

OpenAI explains recent third-party cybersecurity evaluation incidents and outlines new safeguards to strengthen AI model testing and evaluation.

OpenAI벤치마크
OpenAI Blog
OpenAI 2026-08-04

ChatGPT Work 및 Codex를 통해 배우고 가르치는 새로운 방법

K-12 교사, 대학 교육자 및 학생이 배우고, 가르치고, 연구하고, 구축하는 데 도움이 되는 ChatGPT Work 및 Codex용 새로운 교육 플러그인을 살펴보세요.

연구
OpenAI Blog
Google 2026-08-04

2026년 7월에 발표한 최신 AI 뉴스

7월 AI 요약 헤더

Google AI Blog
Anthropic 2026-08-04

Tino Cuellar, 최고 글로벌 업무 책임자로 Anthropic에 합류

Anthropic은 신뢰할 수 있고 해석 가능하며 조종 가능한 AI 시스템을 구축하기 위해 노력하는 AI 안전 및 연구 회사입니다.

Anthropic연구안전
Anthropic Blog
OpenAI 2026-08-03

애플이 잘못하고 있다

OpenAI는 Apple의 근거 없는 소송을 해결하고 직원에 대한 주장을 정정하며 발생한 상황을 기록한 메시지를 공유합니다.

OpenAI규제
OpenAI Blog
OpenAI 2026-08-03

6개월 만에 반응형 음성 AI를 위한 실시간 시스템을 구축한 방법

GPT-Live는 더 빠르고 자연스러운 대화를 위해 턴리스 음성 모델과 저지연 아키텍처를 사용하여 AI와의 지속적인 음성 상호 작용을 가능하게 합니다.

OpenAI음성
OpenAI Blog
OpenAI 2026-08-03

Circles는 OpenAI 기술로 통신사 개인화를 강화합니다.

Circles는 OpenAI API 및 Codex를 사용하여 AI 기반 통신 경험을 강화하고 ARPU를 22% 늘리고 이탈률을 9% 줄이며 개발 효율성을 향상시킵니다.

OpenAI
OpenAI Blog
Google 2026-08-03

353,000명의 바이브 코딩 코스 내부

노트북, AI 스파크, 메시지, 코드, 3D 큐브 일러스트레이션

코딩
Google AI Blog
OpenAI 2026-08-01

수학과 이론 컴퓨터 과학의 10가지 발전

OpenAI는 기하학, 암호화 및 복잡성의 발전을 포함하여 수학과 이론적 컴퓨터 과학의 오랫동안 공개된 문제에 대한 새로운 결과를 공유합니다.

OpenAI
OpenAI Blog
xAI 2026-07-31

참조가 포함된 비디오 1.5를 상상해 보세요.

이제 텍스트, 이미지, 음성 참조가 포함된 최고의 비디오 모델이 최대 1080p까지 생성됩니다.

비전음성
xAI Blog

🌎 업계 동향 (11/133건)

News 2026-08-06

OpenAI는 애플의 영업비밀 소송이 '핵심까지 썩었다'고 말했다.

OpenAI는 연방 판사에게 ChatGPT 제조업체가 영업 비밀을 훔쳤다고 비난하는 Apple의 획기적인 소송을 기각해 줄 것을 요청했으며 이 주장은 "무익하다"고 설명했습니다. OpenAI는 어제 제기한 고소 기각 신청에서 애플이 AI 스타트업 직원의 행위와 '일반적인' 제품 개발 정보를 모두 절도로 잘못 규정하고 있다고 밝혔습니다.

OpenAI규제
The Verge AI
News 2026-08-06

Elon Musk의 AI Wikipedia 시도는 몇 달 동안 업데이트되지 않았습니다.

Lawfare의 보고서에 따르면 Elon Musk가 한때 Wikipedia에 비해 "대규모 개선"이 될 것이라고 약속한 AI 생성 기사가 포함된 온라인 백과사전인 xAI의 Grokipedia는 4월 24일 이후 업데이트되지 않은 것으로 보입니다. Lawfare는 "우리가 알 수 있는 한, 3개월 이상 항목이 변경되지 않았습니다."라고 말했습니다. Grokipedia는 […] v0.1에서 출시되었습니다.

xAI규제
The Verge AI
Community 2026-08-05

100배 저렴한 개방형 모델로 검색 시 GPT-5.6 Sol을 능가함

Castform으로 사후 훈련된 4B 오픈 소스 모델은 비용이 100배 저렴하면서도 GPT-5.6 Sol만큼 정확하게 검색 결과를 검색했습니다.

OpenAI벤치마크
Hacker News · 346점 · 댓글 84
Community 2026-08-05

Born Against 또는 취미 프로그래밍 커뮤니티가 LLM 사용을 반대하는 이유

해커뉴스 (306포인트, 322댓글)

Hacker News · 306점 · 댓글 322
Community 2026-08-05

AI가 생성한 아동 성적 학대 이미지가 포함된 메타란 광고

Meta의 광고 라이브러리 데이터에 따르면 50개 이상의 문제가 되는 이미지 및 비디오 광고가 Facebook, Instagram, Messenger 또는 Threads에 게시되었습니다. 일부는 최근 이번 주에 실행되었습니다.

비전
Hacker News · 244점 · 댓글 196
Community 2026-08-05

프라임 에이전트(Prime Agent): 스스로 개선되는 RLM 에이전트

Prime Agent는 RLM(Recursive Language Model)과 Continual Harness라는 두 가지 추상화를 기반으로 구축된 오픈 소스 자체 개선 코딩 하네스입니다. Opus 5를 사용하면 ARC-AGI-3에서 95.5%를 달성하여 보고된 인간 전문가 기준을 능가합니다.

에이전트
Hacker News · 195점 · 댓글 44
News 2026-08-05

Meta launches Muse Code, an AI agent for large code bases

Meta expanded its AI coding offerings with a new agent that, it promises, can handle complex tasks with complex software.

에이전트코딩
TechCrunch AI
News 2026-08-05

Meta는 지속적인 비동기 백그라운드 에이전트를 갖춘 Muse Spark 1.2 및 Muse Code를 통해 AI 코딩 전쟁에 돌입합니다.

Meta는 오늘 현재 베타 버전인 터미널 기반 AI 코딩 에이전트인 Muse Code를 출시했습니다. Muse Spark 1.2는 Muse Spark 1.2와 함께 Muse Spark 1.2와 함께 출시되었습니다. Muse Spark 1.2는 Muse Spark 1.2와 함께 Anthropic의 Claude Code, OpenAI의 Codex 및 빠르게 성장하는 에이전트 코딩 하네스 분야와 직접적인 경쟁을 벌이는 원투 펀치입니다.

ClaudeAnthropicOpenAI에이전트코딩
VentureBeat AI
Community 2026-08-04

Mistral의 Shieldstral: 다중 모드 조정을 위한 3B 개방형 가중치 모델

Shieldstral은 크기가 최대 7배인 모델보다 성능이 뛰어난 3B 개방형 다중 모드 안전 분류기를 출시합니다.

Mistral
Hacker News · 449점 · 댓글 114
Community 2026-08-04

단일 AMD MI300X의 DeepSeek V4 플래시

GitHub에 계정을 만들어 ryanzhou/deepseek-v4-flash-mi300x 개발에 기여하세요.

DeepSeek
Hacker News · 365점 · 댓글 87
News 2026-07-31

클로드는 인터넷에 악성코드를 유포하고 실제 기업 3곳을 공격했다.

해킹이 기존 방법을 사용했다면 누군가 감옥에 갔을 가능성이 높습니다.

Claude
Ars Technica AI

📚 논문 & 연구 (18/116건)

arXiv 2026-08-05

Argus: 장거리 추론을 위한 범용 에이전트 런타임

장거리 추론에는 증거가 현재 접근 방식을 뒷받침할 때 지속될 수 있고 측정 결과 실패, 숨겨진 제약 조건 또는 잘못 지정된 목표가 나타날 때 피벗할 수 있는 에이전트 런타임이 필요합니다. 관리자, 기획자, 엔지니어 및 검토자가 지속 가능한 프로젝트 상태에 대해 제한된 임무를 실행하는 지속적이고 자체 진화하는 런타임인 Argus를 소개합니다. Argus는 안정적인 사용자 의도를 분리합니다.

에이전트
arXiv (cs.AI)
arXiv 2026-08-05

OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling

상황 내 학습, 자기 개선 및 장기적인 에이전트 작업 흐름에 대한 요구로 인해 언어 모델(LM)의 상황 길이가 극적으로 증가했습니다. 그러나 기존의 긴 컨텍스트 코퍼스는 책, 학술 기사, 코드 리포지토리에 의해 지배되는데, 이는 한정된 리소스이고 장거리 종속성이 부족한 경우가 많습니다. 이 연구에서는 컨텍스트 e인 OctoLong을 소개합니다.

에이전트
arXiv (cs.AI)
arXiv 2026-08-05

Nemotron 그리스어 교육: 코퍼스 마이닝, 검색 적응 및 전문 영역 전반에 걸친 현대 그리스어 생성 기반 구축

현대 그리스어는 법률, 에너지, 금융 및 의료 애플리케이션의 검색 증강 생성(RAG)에 중요함에도 불구하고 NVIDIA의 Nemotron 검색 모델과 주요 다국어 검색 벤치마크에는 없습니다. 코퍼스 마이닝, 합성 감독, 검색 모델 훈련, 순위 재지정을 포함하여 현대 그리스어에 대한 Nemotron 검색 스택의 엔드투엔드 적용을 제시합니다.

벤치마크
arXiv (cs.AI)
arXiv 2026-08-05

OPD-V: 모달리티 균형을 갖춘 시각적 정책 자체 증류

OPSD(On-Policy Self-Distillation)는 MLLM(다중 모드 대형 언어 모델)에서 시각적 추론을 개선하기 위한 표준 사후 학습 접근 방식이 되었습니다. 기존 방법은 다양한 입력 소스로부터 특권 정보를 추출하여 자가 증류를 안내합니다. 그러나 이러한 설계에서는 MLLM 추론에 내재된 문제인 양상 불균형(Modality Imbalance)을 간과하고 있습니다. 텍스트 정보가 생성을 지배할 때 모델은

규제
arXiv (cs.AI)
arXiv 2026-08-05

SSTQ: 서브샘플링된 Stochastic TurboQuant를 통한 개인 정보 보호 벡터 양자화

낮은 통신 비용을 유지하면서 분산 최적화에서 로컬 차등 개인 정보 보호를 달성하는 것은 여전히 어려운 일입니다. vqSGD와 같은 기존 벡터 양자화 방법은 고차원 기하학적 구성을 사용하지만 바람직하지 않은 차원 종속 분산을 발생시킵니다. 이 연구에서 우리는 과잉완전 동일 표준 타이트 f를 결합한 프레임워크인 SSTQ(Subsampled Stochastic TurboQuant)를 제안합니다.

가격
arXiv (cs.AI)
arXiv 2026-08-05

다중 반복 추론을 위한 연쇄 재귀 언어 모델

LLM(대형 언어 모델)의 긴 컨텍스트 추론은 일반적으로 단일 추론 궤적이 컨텍스트 탐색, 중간 상태 저장, 증거 확인 및 최종 답변 생성을 동시에 수행해야 한다는 사실로 인해 제한됩니다. 이는 추출, 계산, 순서 지정 또는 다중 홉 추론이 필요한 작업에서 특히 어려워지며 초기 실수는 다음 단계까지 전파될 수 있습니다.

arXiv (cs.AI)
arXiv 2026-08-05

Skill-Native LLM을 향하여: 벤치마킹 및 장기 추론 훈련을 위한 스킬 엔트로피

Long-horizon reasoning in recent LLMs demands that the model switch between distinct skills inside a reasoning chain, such as first doing a math derivation, then using the result to plan a schedule. We call such problems cross-skill long-horizon tasks: multi-step tasks whose steps require different

벤치마크
arXiv (cs.LG)
arXiv 2026-08-05

손실은 기초를 보지 못하지만 아담은 기초를 봅니다.

인수분해 모델 $W = UV^\top$의 경사하강법은 암시적으로 낮은 순위 솔루션으로 편향된 반면, 동일한 작은 초기화에서 시작하는 Adam은 그렇지 않습니다. 우리는 손실의 게이지 대칭성, $(U, V) \mapsto (UQ, VQ)$ 하에서 불변성의 차이를 추적합니다. 그라데이션 흐름의 낮은 순위 메커니즘은 해당 최적화 프로그램이 게이지 등가적(필요한 조건)인 경우에만 해당 최적화 프로그램에 사용할 수 있습니다.

arXiv (cs.LG)
arXiv 2026-08-05

MT-GNN을 통한 뇌 형태 예측: 그래프 기반 메트릭 텐서 임베딩을 사용한 연속 시간의 메시 진화

몇 가지 이전 스캔을 통해 피질하 구조의 모양이 어떻게 진화할지 예측하면 예후와 임상 시험 강화를 지원할 수 있습니다. 기존 세로 메시 예측기는 고차원 임베딩을 통해 모양 궤적을 추정하거나 정점 변형을 직접 회귀합니다. 대신 우리는 연속적인 시간에 표면의 고유한 기하학을 예측합니다: 단일 구조별 그래프 네트워크 예측

arXiv (cs.LG)
arXiv 2026-08-05

DASyR-LLM: 운동 모델 발견을 위한 LLM을 사용한 도메인 인식 기호 회귀

역학 모델 발견은 화학 공학의 핵심 과제입니다. 정확한 속도 표현은 화학적 및 생물학적 과정을 이해하고 제어하는 데 필수적입니다. 기호 회귀(SR)는 해석 가능한 운동 모델을 식별하기 위한 강력한 데이터 기반 접근 방식으로 등장했지만 일반적으로 도메인 지식 없이 작동하며 종종 물리화학적으로 타당하지 않은 모델을 탐색합니다.

arXiv (cs.LG)
arXiv 2026-08-05

안정 밀도 능선: 부분 공간 제약이 있는 평균 이동의 일관성 및 수렴

SCMS(Subspace Constrained Mean Shift) 알고리즘은 밀도 능선을 추출하는 데 널리 사용되는 비모수적 방법으로, 고차원 데이터의 저차원 표현 역할을 합니다. SCMS 궤적이 밀도 구배와 고유값 및 고유값을 통해 정의되는 "정적 능선"이라고 부르는 고전적인 밀도 능선으로 수렴한다는 것은 문헌에서 널리 알려진 믿음입니다.

연구
arXiv (cs.LG)
arXiv 2026-08-05

보상 구조는 강화 학습에서 에피소드 탐색과 신경 기억 간의 상호 작용을 형성합니다.

In partially observable reinforcement learning, agents face a dual bottleneck: they must explore to encounter rewarding states and retain that experience in memory to optimize their policies. Exploration bonuses and memory architectures are traditionally evaluated in isolation, leaving their interac

에이전트벤치마크
arXiv (cs.LG)
arXiv 2026-08-05

추론 핵심: 완료 지도 추론 훈련을 위한 광범위한 절차 데이터 설계

Procedural generators produce useful verifiable reasoning problems at scale, but have received less attention as data for completion-supervised fine-tuning. We introduce Reasoning Core, a collection of 50 generators spanning mathematics, logic, planning, state tracking, formal languages, structured

벤치마크
arXiv (cs.CL)
arXiv 2026-08-05

음성 함수 호출: 대규모 오디오 언어 모델의 음성 언어 이해에 대한 새로운 관점

SLU(음성 언어 이해)는 작업 중심 대화 시스템의 핵심 구성 요소이자 원활한 인간-에이전트 상호 작용을 달성하는 데 있어 중추적인 링크입니다. 기존 SLU는 도메인 내 감독 미세 조정 후 폐쇄형 작업에 대한 사용자 의미 체계를 효과적으로 추출할 수 있지만, 모호한 규칙 정의로 인해 개방형 도메인 작업에 대한 컨텍스트 내 학습을 활용하는 데 심각한 어려움에 직면해 있습니다.

에이전트음성
arXiv (cs.CL)
arXiv 2026-08-05

동일한 공식, 다른 의미: 언어 모델이 모달 논리 사양을 따르는가?

필요성과 가능성에 대한 추론은 세계 간의 접근성과 각 세계에 어떤 객체가 존재하는지에 대한 가정에 따라 달라집니다. 따라서 동일한 추론이 한 모달 시스템에서는 유지되고 다른 모달 시스템에서는 실패할 수 있습니다. 이러한 문제에 대한 언어 모델을 평가하려면 판단이 익숙한 논리가 아닌 명시된 의미론을 따르는지 테스트해야 합니다. 우리는 쌍을 이루는 모달 프로를 구축합니다

벤치마크
arXiv (cs.CL)
arXiv 2026-08-05

Item Response Theory for AI Safety

언어 모델은 얼마나 안전하게 동작하는지에 따라 다르며 이러한 차이는 안전 벤치마크로 측정됩니다. 그러나 집계된 벤치마크 점수는 벤치마크가 서로 중복되고 상관 관계가 심하며 모델이 평가를 감지하면 샌드백을 수행할 수 있기 때문에 신뢰하고 해석하기가 어렵습니다. 이러한 문제를 해결하기 위해 우리는 이러한 잠재성을 측정하기 위한 통계 도구 키트인 항목 반응 이론(IRT)을 사용합니다.

안전벤치마크
arXiv (cs.CL)
arXiv 2026-08-05

정책 학습 내용 최적화: 복구 가능성 인식 롤아웃 개입 학습

비판 없는 그룹 기반 강화 학습은 대규모 언어 모델 훈련 후를 위한 확장 가능한 접근 방식이 되었습니다. 그러나 대부분의 기존 방법은 일부 롤아웃이 다른 롤아웃보다 훨씬 더 유용한 학습 신호를 제공하더라도 모든 작업 및 궤적 상태에 동일한 수의 롤아웃을 할당합니다. 최근 연구에서는 롤아웃 세대를 적응형 결정으로 다루기 시작했지만, 두 가지 중요한

arXiv (cs.CL)
arXiv 2026-08-05

독일 정당들은 극우의 의회 돌파 이후 직관에 기반한 수사로 전환했다.

The spread of misinformation is widely perceived as a threat to democratic deliberation, yet how political elites' rhetorical commitments to truth shift alongside the rise of populist actors remains poorly understood. Analysing 4.5 million tweets and 59,170 parliamentary speeches by German poli

음성
arXiv (cs.CL)

🎥 영상 & 튜토리얼 (3/9건)

YouTube 2026-08-05

10억 달러 규모의 AI 경쟁이 막 끝났습니다.

❤️ 여기에서 Lambda를 확인하고 GPU 클라우드에 가입하세요: https://lambda.ai/papers 📝 Qwen 3.8 Max: https://qwen.ai/blog?id=qwen3.8 출처: https://x.com/loktar00/status/2082589566934929750 https://x.com/CommandCodeAI/status/2084293498950590839 🙏 Two Minute Papers를 가능하게 해준 관대하신 Patreon 지지자: Adam Bridges, Benji Rabhan, B Sha

연구
Two Minute Papers
YouTube 2026-08-05

비트코인을 가장 안전하게 보관하는 방법은 방금 해킹당했습니다.

Lovable을 사용하여 하루 만에 실제 앱을 구축, 테스트 및 출시하세요: https://lovable.link/11vGHox 지난 주에 비트코인을 저장하는 가장 안전한 방법은 빠르게 가장 덜 안전한 방법이 되었습니다. 조사해보자. #coding #programming 더 많은 Fireship을 원하시나요? 🗞️ 뉴스레터: https://bytes.dev 🧠 강좌: https://fireship.dev

트레이딩코딩
Fireship
YouTube 2026-08-04

이제 나만의 기억을 검색할 수 있습니다

신용카드가 모든 것을 기억할 수 있다면 어떨까요? SecondBrain Note는 회의, 대화, 아이디어를 캡처한 다음 이를 정리된 메모와 실행 가능한 후속 조치로 바꾸는 신용카드처럼 얇은 AI 녹음기입니다. 이메일, 캘린더, Slack, Notion, Google Workspace와 같은 도구에 연결할 수도 있으므로 슈퍼 에이전트가 이메일 초안을 작성하고, 오래된 아이디어를 찾고, 조치를 취할 수 있습니다.

에이전트
Matt Wolfe AI