282건 수집
2026-08-04 06:02

오늘의 핵심

DeepSeek-V4-플래시 업데이트

해커뉴스 (707포인트, 333댓글)

Hacker News

🤖 모델 & 제품 (9/22건)

OpenAI 2026-08-03

애플이 잘못하고 있다

OpenAI는 Apple의 근거 없는 소송을 해결하고 직원에 대한 주장을 정정하며 발생한 상황을 기록한 메시지를 공유합니다.

OpenAI규제
OpenAI Blog
OpenAI 2026-08-03

6개월 만에 반응형 음성 AI를 위한 실시간 시스템을 구축한 방법

GPT-Live는 더 빠르고 자연스러운 대화를 위해 무회전 음성 모델과 저지연 아키텍처를 사용하여 AI와의 지속적인 음성 상호 작용을 가능하게 합니다.

OpenAI음성
OpenAI Blog
OpenAI 2026-08-03

Circles는 OpenAI 기술로 통신사 개인화를 강화합니다.

Circles는 OpenAI API 및 Codex를 사용하여 AI 기반 통신 경험을 강화하고 ARPU를 22% 늘리고 이탈률을 9% 줄이며 개발 효율성을 향상시킵니다.

OpenAI
OpenAI Blog
OpenAI 2026-08-01

수학과 이론 컴퓨터 과학의 10가지 발전

OpenAI는 기하학, 암호화 및 복잡성의 발전을 포함하여 수학과 이론 컴퓨터 과학의 오랫동안 공개된 문제에 대한 새로운 결과를 공유합니다.

OpenAI
OpenAI Blog
OpenAI 2026-07-31

유럽 전역에서 책임 있는 AI 발전

OpenAI는 안전, 보안, 투명성 및 출처 관행이 유럽에서 책임감 있는 AI 거버넌스를 지원하는 방법을 공유합니다. EU AI법이 발전함에 따라 이 작업은 계속될 것입니다.

OpenAI규제안전
OpenAI Blog
OpenAI 2026-07-31

풍부한 지능 구축

고급 AI를 더욱 유능하고 저렴하며 더욱 광범위하게 유용하게 만드는 풀 스택 접근 방식입니다.

OpenAI Blog
xAI 2026-07-31

참조가 포함된 비디오 1.5를 상상해 보세요.

이제 텍스트, 이미지, 음성 참조가 포함된 최고의 비디오 모델이 최대 1080p까지 생성됩니다.

비전음성
xAI Blog
Anthropic 2026-07-30

사이버 보안 평가에서 세 가지 실제 사건 조사

사이버 보안 평가 기록을 검토한 결과 Claude 모델이 제3자 평가 환경 내에서 또는 제3자 평가 환경과 상호 작용하는 동안 인터넷에 접속한 다음 세 가지 다른 조직의 실제 시스템에 대한 무단 액세스를 얻은 세 건의 사건을 발견했습니다. 아래에서는 어떤 일이 일어났는지, 어떻게 발생했는지, 그리고 변경되는 사항에 대해 설명합니다. 우리는 다른 AI 연구실에서도 PE를 수행하도록 권장합니다.

Claude트레이딩벤치마크
Anthropic Blog
Google 2026-07-28

Gemini API 관리 에이전트: 3.6 플래시, 후크 등

관리형 에이전트 Gemini 3.6 플래시, 후크 및 트리거

Google에이전트
Google AI Blog

🌎 업계 동향 (12/133건)

Community 2026-08-04

AI-Generated Images Discourage Me from Reading Your Blog

AI 생성 이미지를 사용하려는 경우 텍스트가 AI 생성 이미지가 아닌지 어떻게 알 수 있나요?

비전
Hacker News · 197점 · 댓글 104
Community 2026-08-04

단일 AMD MI300X의 DeepSeek V4 플래시

GitHub에 계정을 만들어 ryanzhou/deepseek-v4-flash-mi300x 개발에 기여하세요.

DeepSeek
Hacker News · 112점 · 댓글 28
Community 2026-08-04

AI 프로그래밍에 대한 솔직한 리뷰

그들은 나에게 Claude 구독을 제공하고 tokenmaxxing을 받으라고 해서 공정하게 시도하려고 했습니다.

Hacker News · 20점 · 댓글 28
Community 2026-08-04

대규모 언어 모델이 표 형식 예측에 실패하는 이유

LLM(대형 언어 모델)은 놀라운 범위의 작업을 위한 기본 도구가 되었지만 가장 일반적인 기계 학습 워크로드 중 하나인 표 형식 데이터에 대한 예측 분석에서는 눈에 띄게 거의 성공하지 못했습니다. 이러한 격차는 빠르게 성장하는 테이블 형식 기초 모델 분야의 기본 전제이지만 일반 LLM이 실패하는 이유에 대한 질문은 여전히 열려 있습니다. 우리는 국경을 연구합니다

Hacker News · 15점 · 댓글 2
News 2026-08-04

킬러 쿼터 이후 Palantir CEO Alex Karp는 AI 산업을 '마르크스주의자'라고 부릅니다.

10억 달러의 수익을 올린 분기 이후 Palantir CEO Alex Karp는 월요일 AI 프론티어 연구소가 기업에 너무 신뢰할 수 없다고 다시 한 번 경고했습니다.

TechCrunch AI
News 2026-08-04

OpenAI, 애플 소송을 여론 법원으로 끌고 가다

OpenAI에 대한 Apple의 법적 싸움은 이제 ChatGPT 제작자가 Apple 버전의 이벤트에 대응하기 위해 영수증을 공개적으로 방송했기 때문에 더욱 복잡해졌습니다. OpenAI는 밤새 게시된 "애플이 잘못하고 있다"라는 제목의 블로그 게시물에서 영업 비밀을 훔쳤다고 비난하는 애플의 소송은 "부주의하고 공격적이며 이상하게 개인적"이라며 iMessage와 이메일을 공유하고 있다고 밝혔습니다.

OpenAI규제
The Verge AI
News 2026-08-04

Can Reddit fend off a new wave of AI SEO spam?

올해 초 Reddit 사용자는 스킨케어에 초점을 맞춘 하위 Reddit 회원에게 여드름에 자주 사용되는 제품인 특정 차아염소산 스프레이를 사용해 본 사람이 있는지 물었습니다. 수십 개의 응답이 있었습니다. Primary-Taro4254라는 사용자 중 하나는 적어도 처음에는 충분히 무해해 보였습니다. "저는 [해당 브랜드]를 직접 사용해 본 적이 없어서 할 수 없습니다. […]

The Verge AI
News 2026-08-04

Qwen3.8-Max는 대담한 주장과 함께 출시됩니다. 에이전트 컴퓨터 사용에서 GPT-5.6 Sol Max 및 Fable 5보다 성능이 뛰어납니다.

중국의 전자상거래 및 클라우드 대기업인 Alibaba의 AI 연구원으로 구성된 Qwen 팀은 어젯밤 새로운 플래그십 2조 4천억 매개변수 전문가 혼합(MoE) 다중 모달 대형 언어 모델(LLM)인 Qwen3.8-Max를 공개했습니다. 이 모델은 첨단 AI 시장에서 가장 경쟁이 치열한 분야 중 하나인 자율 소프트웨어 엔지니어링 및 장기적 엔터프라이즈 작업을 목표로 합니다. 회사에서 벤치마킹을 발표한 경우

OpenAI에이전트연구벤치마크
VentureBeat AI
News 2026-08-04

Asana의 AI 에이전트는 회사 전체에서 메모리를 공유하지만 비밀은 공유하지 않습니다.

AI 에이전트를 구축하는 기업 팀은 계속 같은 벽에 부딪힙니다. 즉, 프롬프트에 응답할 수 있지만 마지막 5명이 요청한 내용을 기억할 수 없고 지난 달 버전이 실제로 작동했는지 여부를 알 수 없는 챗봇입니다. VB Transform 2026에서 VentureBeat의 Sam Witteveen과의 대화에서 Asana의 최고 제품 책임자인 Arnab Bose는 풀었습니다. 그의 팀이 이 문제를 어떻게 해결했는지

에이전트
VentureBeat AI
Community 2026-08-03

SQLite 중요 CVE 또는 LLM Slop?

The JFrog security research team recently identified a supply chain attack targeting the `xinference` package on PyPI. Versions 2.6.0, 2.6.1, and 2.6.2 were compromised and yanked by maintainers after users reported suspicious behavior. If you installed or imported these versions, you must assume yo

Hacker News · 695점 · 댓글 347
Community 2026-08-03

Prevent cognitive debt by manually retyping LLM-generated code

해커뉴스 (375포인트, 316댓글)

Hacker News · 375점 · 댓글 316
News 2026-07-31

클로드는 인터넷에 악성코드를 유포하고 실제 기업 3곳을 공격했다.

해킹이 기존 방법을 사용했다면 누군가 감옥에 갔을 가능성이 높습니다.

Claude
Ars Technica AI

📚 논문 & 연구 (18/117건)

arXiv 2026-08-03

실습 실행 가능 프레임워크를 사용하여 인공 지능과 전력 시스템 교육 연결

인공 지능(AI)은 모델링, 예측, 최적화 및 제어를 지원하면서 전력 및 에너지 시스템의 중심이 되고 있습니다. 그러나 대부분의 기존 저작물은 특수한 응용 프로그램을 강조하고 새로운 언어 모델이나 자체 언어 모델을 구축하기보다는 점점 더 큰 언어 모델에 의존하는 학제간 학습자에게 재사용 가능한 자료를 거의 제공하지 않습니다. 이러한 격차는 엔지니어의 필요성을 나타냅니다.

arXiv (cs.AI)
arXiv 2026-08-03

UEmbed: 통합된 희소 및 조밀 다중 모드 임베딩

희소 검색은 웹 검색에서 검색 증강 생성에 이르기까지 최신 검색 시스템을 뒷받침합니다. 기존 작업에서는 LSR(Learned Sparse Retrieval)을 도입하여 정확한 어휘 일치를 넘어 더 풍부한 의미를 구현했습니다. 그러나 LSR은 지금까지 인코더 스타일 양방향 아키텍처에 묶여 있었으며 다중 모드 설정으로의 확장은 여전히 보조 교차 모드 모듈에 크게 의존하고 있습니다. 티

벤치마크
arXiv (cs.AI)
arXiv 2026-08-03

CoWAM: WAM과의 선택적 정책 개입을 위한 조정 계약

WAM(World Action Model)은 행동에 따른 예측 미래를 통해 로봇 정책을 강화하지만, 그럴듯한 미래만으로는 양손 정책이 실행할 행동을 변경하는 것을 정당화할 수 없습니다. 동기화, 역할 호환성, 충돌 수렴을 조정 계약으로 표현하는 선택적 개입 계층인 CoWAM을 제시합니다. 각 계약은 형식화된 허용 가능성 확인을 결합합니다.

로봇규제
arXiv (cs.AI)
arXiv 2026-08-03

AtumAI: 데이터 센터 제어 플레인 정책의 에이전트 생성을 위한 원칙 프레임워크

데이터센터의 효율성은 제어 플레인 정책에 달려 있습니다. 이러한 정책을 설계하는 것은 점점 더 어려워지고 있습니다. 하드웨어-소프트웨어 스택은 빠르게 성장하고, 설계 공간은 방대하고 상호 의존적이며, 단일 정책의 프로토타입을 만드는 데 수개월이 걸립니다. Agentic AI는 이 검색을 자동화할 것을 약속합니다. 그러나 선반 밖에서는 세 가지 측면이 부족합니다. 공식적이지 않습니다. 체계적이고 검색 가능한 통계가 없습니다.

에이전트규제
arXiv (cs.AI)
arXiv 2026-08-03

엣지 언어 모델을 위한 구조화된 메모리: O(1) SSM 상태 주입을 통한 지속적인 컨텍스트 및 코퍼스 검색

RAG(검색 증강 생성)는 검색된 컨텍스트 길이에 비례하는 사전 채우기 비용을 부과하며, Transformer 백본을 사용하면 생성된 각 토큰과 함께 증가하는 KV 캐시를 부과합니다. 상태 공간 모델(SSM)은 구성에 따른 두 번째 비용을 방지합니다. 쿼리당 $O(L_{context})$에서 $O(1)$까지 첫 번째 축소 미리 채우기를 제거합니다. 재트리(Retri) 도구인 PRECOG(Pre-Compulated Context Insertion)을 소개합니다.

가격벤치마크
arXiv (cs.AI)
arXiv 2026-08-03

생성 및 에이전트 AI의 인지 능력 격차 분류

인지 AI는 언어 생성 및 자율 작업 실행을 넘어 지속적인 추론, 적응형 행동, 지속적인 기억 및 자기 조절이 가능한 시스템을 지향합니다. 생성 및 에이전트 AI는 광범위한 작업에서 인상적인 기능을 입증했지만, 많은 기본 인지 기능은 여전히 단편화되거나 약하게 개발되어 안정적인 작동을 제한합니다.

에이전트연구규제
arXiv (cs.AI)
arXiv 2026-08-03

onepot-Bench 0: 실험실 인식 in silico 화학 벤치마크 지향

언어 모델은 실험 계획, 실행, 사후 분석과 같은 작업을 수행하면서 실험실 과학에서 점점 더 중요한 역할을 하고 있습니다. 그러나 과학적 능력을 갖추려면 문제 해결 능력과 영역별 직관이 모두 필요하기 때문에 그들의 능력을 정확하게 측정하는 것은 어렵습니다. 기존 평가에서는 재개발에 필요한 역량을 거의 측정하지 않습니다.

벤치마크
arXiv (cs.LG)
arXiv 2026-08-03

희소 최소제곱의 조건수 장벽

[AS21]에서 Axiotis와 Sviridenko는 희소 볼록 최적화에서 제한된 조건수에 대한 선형 의존성이 다항식 시간 알고리즘으로 개선될 수 없다고 추측했습니다. 우리는 Raghavendra, Steure의 가중 정규 그래프 공식에서 무작위로 추출된 정확한 볼륨 소규모 집합 확장 가설을 조건으로 최소 제곱 목표에 대한 추측된 하한을 설정합니다.

arXiv (cs.LG)
arXiv 2026-08-03

GradCuit: 크레딧이 할당된 그라데이션 흐름으로 강력하고 해석 가능한 테스트 시간 잠재 추론 가능

최적화 기반 잠재 추론은 모델 매개변수를 고정한 상태로 유지하면서 테스트 시 인스턴스별 연속 상태를 최적화하여 대규모 언어 모델 출력을 개선합니다. 그러나 기존 방법은 일반적으로 디코딩된 토큰을 통해 이러한 상태를 추론 궤적에 연결하여 시퀀스 수준 크레딧 할당을 간접적으로 만들고 잠재 업데이트가 후속 추론을 형성하는 방법을 모호하게 만듭니다. 우리는 내가

arXiv (cs.LG)
arXiv 2026-08-03

단순 곱 공간에서 함수의 원활한 재매개변수화: 확률적 텐서 분해 및 함수 데이터 등록에 대한 응용

우리는 단체의 곱 공간에 정의된 최적화 문제를 고려합니다. 이러한 종류의 문제의 예로는 단순 제약 텐서 분해를 통해 낮은 순위의 이산 다변량 확률 분포를 학습하고 SRVF(제곱근 속도 함수) 표현으로 기능적 데이터 등록을 수행하는 것이 있습니다. 이 작업에서 우리는 프로 교체의 타당성을 보여줍니다.

arXiv (cs.LG)
arXiv 2026-08-03

확산 모델 내의 의사 난수 스트림은 생성 품질에 영향을 미치는 학습 가능한 입력으로 작동합니다.

확산 모델은 확률론적 입력에 의존하지만 유한 정밀도 하드웨어를 사용하여 그들이 소비하는 "무작위성"은 의사 무작위 규칙에 의해 생성된 결정론적 수치 궤도로 실현됩니다. 접근 가능한 궤도 구조는 학습 가능한 입력이 될 수 있으며 훈련과 생성 모두에 영향을 미칠 수 있습니다. 왜냐하면 실현된 손실과 그 기울기는 각 최적화에서 사용되는 구체적인 의사 난수 값에 따라 달라지기 때문입니다.

arXiv (cs.LG)
arXiv 2026-08-03

귀납적 작업을 위한 Sheaf 신경망 벤치마킹

SNN(쉬프 신경망)은 표준 그래프 신경망(GNN)의 스칼라 에지 가중치를 노드 줄기 사이의 학습 가능한 에지 종속 제한 맵으로 대체하여 메시지 전달을 일반화합니다. 강력한 이론적 토대와 유망한 변환 결과에도 불구하고 SNN은 변환 노드 분류에 대해서만 거의 독점적으로 평가되어 행동을 귀납적 상태로 남겨두었습니다.

벤치마크
arXiv (cs.LG)
arXiv 2026-08-03

AURORA-LM: Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling

언어는 생성 모델링에서 여전히 이상치로 남아 있습니다. 이미지, 비디오 및 오디오가 점점 연속적인 잠재 공간에서 모델링되는 반면, 텍스트 생성은 여전히 주로 개별 토큰에 의존합니다. 기존 연속 언어 모델은 공동 생성 및 디코딩을 위해 설계되지 않은 임베딩 공간을 상속하거나 자동 인코딩된 잠재성을 압축하여 확산을 용이하게 하여 토큰 수준의 충실도를 희생합니다.

비전음성
arXiv (cs.CL)
arXiv 2026-08-03

방언 전체의 로마자 표기 아랍어: 보기, 사용 패턴 및 언어적 변형

Arabizi는 라틴어 문자로 작성된 아랍어를 말합니다. 이전 연구에서는 Arabizi의 유병률과 사용이 지역, 연령층 등의 요인에 따라 다르다는 사실이 밝혀졌지만, 대부분의 아랍어 텍스트에 대한 NLP 연구에서는 이를 아랍어 문자에 대한 제한된 기술적 지원으로 인한 일시적인 현상으로 취급합니다. 이 작업에서 우리는 아랍어 사용자와 협력하여 그들의 인식과

연구벤치마크
arXiv (cs.CL)
arXiv 2026-08-03

MedPRESS: LLM에서 환자의 압력으로 인한 의료 시코판시에 대한 다단계 벤치마크

건강 관련 조언에 LLM(대형 언어 모델)이 점점 더 많이 사용되고 있습니다. 기존 연구에서는 환자를 대하는 압박적인 대화보다는 정적인 질문을 통해 환자의 안전을 측정합니다. LLM에서 환자의 압력으로 인한 아첨을 측정하기 위한 다중 회전 벤치마크인 MedPRESS를 소개합니다. MedPRESS에는 세 가지 시나리오 계열에 걸쳐 의학적으로 근거가 있는 5단계 대화 600개가 포함되어 있습니다.

연구안전벤치마크
arXiv (cs.CL)
arXiv 2026-08-03

LiveMem: 장기 실행 LLM 추론에서 메모리 상태 연속성 유지

장기 실행 보조자와 에이전트는 결국 컨텍스트를 초과하는 상호 작용 스트림을 소비합니다. 기존 컨텍스트 보존, 요약 및 검색은 선택한 기록에 대한 액세스를 유지하지만 작업 컨텍스트가 변경될 때 전체 수명 주기에 걸쳐 지속적인 상태를 제공하지 않습니다. 우리는 이 누락된 추론 기능을 \emph{컨텍스트 회전율 하의 상태 연속성}으로 공식화합니다.

에이전트벤치마크
arXiv (cs.CL)
arXiv 2026-08-03

RoMeRL: 감소된 순서 유틸리티 상태를 통해 피드백 적용 범위와 자체 진화 에이전트 메모리의 메모리 보상 트랩 균형 조정

자체 진화하는 LLM 에이전트를 위한 학습 기반 메모리 시스템은 밀접하게 연결된 두 가지 과제에 직면해 있습니다. 첫째, 궤도 색인 유틸리티는 상호 작용 기록과 함께 성장하므로 지속적으로 확장되는 상태 공간에 제한된 피드백을 분산시킵니다. 둘째, 궤적 수준 보상이 공동 검색된 기억에 공동으로 할당되기 때문에 관련 없는 경험이 오해의 소지가 있는 유틸리티 업데이트 및 결과를 받을 수 있습니다.

에이전트
arXiv (cs.CL)
arXiv 2026-08-03

SWE-Touch: 사용자가 코드를 터치할 때 코딩 에이전트 벤치마킹

실제 소프트웨어 개발에서는 코딩 에이전트가 사용자가 진행 중인 작업 중에 코드를 검사하고 수정할 수 있는 공유 작업 공간에서 작동해야 하지만 기존 저장소 수준 벤치마크는 일반적으로 에이전트가 단독으로 작동하는지 평가하거나 사용자 참여를 메시지에 제한합니다. 이로 인해 우리는 다음과 같은 질문을 하게 됩니다. 코딩 에이전트는 공유 작업 공간에서 코드 변경 사항을 어떻게 이해하고 대응합니까? SWE-To를 소개합니다

에이전트코딩벤치마크
arXiv (cs.CL)

🎥 영상 & 튜토리얼 (3/10건)

YouTube 2026-08-03

또 다른 DeepSeek 순간이 왔습니다

❤️ 여기에서 Lambda를 확인하고 GPU 클라우드에 가입하세요: https://lambda.ai/papers 📝 DeepSeek v4 Flash 0731: https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 DeepSeek API: https://platform.deepseek.com/ 🙏 Two Minute Papers를 가능하게 해주신 관대하신 Patreon 후원자: Adam Bridges, Benji에게 감사드립니다. 라반, B 샹, 카메론 네이버, 찰스 이안 노먼 벤,

DeepSeek연구
Two Minute Papers
YouTube 2026-08-01

ChatGPT를 나만의 Jarvis로 전환하기

AI를 나만의 개인 Jarvis로 전환하는 방법은 다음과 같습니다. 🤖 ChatGPT 및 Claude의 음성 기능을 사용하면 이제 완전히 핸즈프리로 실시간으로 대화형 3D 디자인을 구축, 편집 및 반복할 수 있습니다. 저는 음성 명령을 사용하여 3D 아이언맨 슈트를 생성하고, 헬멧의 크기를 조정하고, 색상을 변경하고, 태양광 패널을 즉석에서 추가하기도 했습니다. 이러한 음성 기능은 현재 두 플랫폼 모두에서 무료로 사용할 수 있습니다(

Claude음성
Matt Wolfe AI
YouTube 2026-07-29

Anthropic이 방금 인디 해커를 죽였나요...?

무료로 Blacksmith를 사용해 GitHub Actions를 2배 더 빠르게 실행하세요. - https://www.blacksmith.sh/ Anthropic이 방금 Opus 5를 출시했고 인디 해커의 꿈이 무너질 수도 있습니다. 자세히 살펴보겠습니다. #coding #programming 더 많은 Fireship을 원하시나요? 🗞️ 뉴스레터: https://bytes.dev 🧠 강좌: https://fireship.dev

Anthropic코딩
Fireship