233건 수집
2026-07-30 06:01

오늘의 핵심

클로드 오푸스 5

해커 뉴스(1640포인트, 995댓글)

Hacker News

🤖 모델 & 제품 (9건)

OpenAI 2026-07-29

두 가지 설정을 활성화하여 ARC-AGI-3 벤치마크 점수가 어떻게 3배나 높아졌습니까?

두 가지 API 설정이 ARC-AGI-3에서 GPT-5.6 성능을 향상하고 추론을 유지하고 압축을 활성화하여 점수와 효율성을 높이는 방법입니다.

OpenAI벤치마크
OpenAI Blog
OpenAI 2026-07-29

학술 연구원을 위한 ChatGPT를 통해 과학적 발견 가속화

OpenAI는 과학 연구, 협업 및 발견을 가속화하기 위해 100,000명의 학술 연구원에게 ChatGPT의 가장 진보된 AI 모델에 대한 무료 액세스를 제공합니다.

OpenAI연구
OpenAI Blog
OpenAI 2026-07-29

GPT-5.6이 어떻게 프론티어 인텔리전스와 프론티어 효율성을 융합합니까?

GPT-5.6은 모델, 추론, 에이전트 워크플로 전반에서 AI 효율성을 향상시켜 달러당 더 유용한 인텔리전스를 제공하도록 돕습니다.

OpenAI에이전트
OpenAI Blog
OpenAI 2026-07-28

에이전트 AI 시대의 과학 컴퓨팅

새로운 현장 보고서는 과학자들이 AI 코딩 에이전트를 사용하여 과학 컴퓨팅을 현대화하고 유전체학 및 그 이상 분야의 소프트웨어 개발 및 발견을 가속화하는 방법을 보여줍니다.

에이전트코딩
OpenAI Blog
Google 2026-07-28

Gemini API 관리 에이전트: 3.6 플래시, 후크 등

관리형 에이전트 Gemini 3.6 플래시, 후크 및 트리거

Google에이전트
Google AI Blog
Google 2026-07-28

검색의 AI 모드가 현실 세계를 즐기는 데 도움이 되는 5가지 방법

테니스나 게임과 같은 재미있는 활동과 관련된 항목으로 둘러싸인 푸른 잔디 위의 흰색 원 안에 검은색 돋보기 그림

Google AI Blog

🌎 업계 동향 (105건)

Community 2026-07-30

GCC 운영위원회, AI 정책 발표

해커 뉴스(103포인트, 92댓글)

규제
Hacker News
Community 2026-07-30

Agent-Manager: Claude Code, Codex 및 OpenCode 실행을 위한 Tmux TUI

해커 뉴스(30포인트, 19댓글)

Claude에이전트
Hacker News
Community 2026-07-30

샘 알트먼(Sam Altman)은 현재 백악관과 AI 감속에 대해 논의하고 있다.

해커뉴스 (27포인트, 28댓글)

Hacker News
Community 2026-07-30

'내 인생 망했다': 한국 투자자들은 AI 버블이 터진 후 스트레스를 받는다

해커 뉴스(12포인트, 댓글 3개)

트레이딩
Hacker News
News 2026-07-30

Microsoft는 그 어느 때보다 OpenAI, Anthropic과 공개적으로 경쟁하고 있습니다.

마이크로소프트는 수요일 자체 개발한 AI 모델, 하네스, 심지어 Mythos 경쟁사까지 발표하며 월스트리트에 지속적인 성장 계획을 밝혔습니다.

AnthropicOpenAI
TechCrunch AI
News 2026-07-30

마크 주커버그(Mark Zuckerberg)는 5년 안에 수십억 명의 사람들이 개인 AI 에이전트를 갖게 될 것이라고 예측합니다.

Meta가 AI 인프라와 에이전트에 수십억 달러를 투자함에 따라 Zuckerberg는 그 대가가 그만한 가치가 있을 것이라고 투자자들을 설득하기 위해 노력하고 있습니다.

에이전트트레이딩가격
TechCrunch AI

📚 논문 & 연구 (116건)

arXiv 2026-07-29

AI 에이전트가 개방형 AI 연구를 수행할 수 있나요? 두 가지 사례 연구의 초기 증거

폭발적인 AI 발전 예측은 AI 연구를 자동화하는 AI 에이전트에 달려 있습니다. 그러나 에이전트가 개방형 AI 연구를 수행할 수 있는지 여부에 대한 증거는 희박합니다. 현재 평가는 개방형 연구를 제외하는 좁고 검증 가능한 작업에 대해 에이전트를 테스트하거나 AI 생성 논문을 블라인드 동료 검토에 제출합니다. 이는 과도하고 확률론적이며 검토 품질이 좋지 않습니다. 우리는

에이전트연구벤치마크
arXiv (cs.AI)
arXiv 2026-07-29

APEX-회계

Mercor가 Ramp와 협력하여 구축한 벤치마크인 APEX-Accounting을 소개하여 프론티어 모델이 회계사의 실제 업무를 수행할 수 있는지 평가합니다. 작업에는 계정 조정, 비용 발생, 거래 게시 및 보고서 생성이 포함됩니다. 개인 평가 세트는 10개의 세계에 걸쳐 분할된 160개의 작업으로 구성됩니다. 각 세계에는 회계 시스템은 물론 스프레드시트, PDF 등이 포함되어 있습니다.

벤치마크
arXiv (cs.AI)
arXiv 2026-07-29

AI 팀원의 사회적 비용: 인공 팀원이 소규모 팀 의사결정에서 인간 간 의사소통을 재구성하는 방법

대화형 AI는 점점 도구가 아닌 팀원으로 자리매김하고 있지만, 그 존재가 팀 내 사람들 간의 의사소통을 어떻게 변화시키는지에 대해서는 알려진 바가 거의 없습니다. 우리는 그룹 의사소통 분석(GCA), 팀 설문조사, 팀 담론의 어휘 분석을 사용하여 팀 의사결정에서 사회인지적 의사소통 역학을 조사했습니다. 팀은 고위험 도덕적 딜레마 결정을 완료했습니다.

가격
arXiv (cs.AI)
arXiv 2026-07-29

임시 팀워크에서 작업에 구애받지 않는 적응을 위한 파트너 역량 추정

새롭고 다양한 파트너와의 효과적인 협업은 자율 에이전트의 중요한 기술입니다. 대부분의 최신 AHT(임시 팀워크) 접근 방식은 에이전트가 단일 고정 작업에 대해 협업하고 파트너의 능력, 즉 원하는 작업을 성공적으로 실행할 수 있는 능력이 이미 알려져 있다고 가정합니다. 현실에서는 파트너의 진정한 능력이 숨겨져 있는 경우가 많고, 인간 협력자는

에이전트
arXiv (cs.AI)
arXiv 2026-07-29

관련 의도 생성을 통해 전자상거래 검색에서 항목 검색 가능성 향상

기존 검색 시스템은 쿼리와 정확히 일치하는 항목을 검색하도록 최적화되어 있으며 종종 재현율보다 정밀도를 우선시합니다. 전자상거래 시장, 특히 식료품점에서는 사용자 만족과 상업적 결과가 대체, 보완 및 주제와 관련된 품목의 발견 가능성에 크게 좌우되기 때문에 이러한 패러다임은 제한적입니다. 본 논문에서는 확장 가능한 시스템 f를 제시합니다.

연구
arXiv (cs.AI)
arXiv 2026-07-29

OmegaUse-OfficeVal: 경제적 기반을 바탕으로 장거리 Office 제품군 작업에 대한 LLM 에이전트 벤치마킹

LLM(대형 언어 모델) 에이전트는 사용자가 작업을 완료하는 데 도움을 줄 것으로 점점 더 기대되고 있습니다. 그러나 기존 벤치마크는 상담원이 합리적인 비용으로 사무실 워크플로를 수행할 수 있는지 평가하는 데 제한적인 지원을 제공합니다. 작업 수준의 경제적 기반을 갖춘 장거리 사무실 제품군 작업에 대한 LLM 에이전트를 평가하기 위한 벤치마크인 OmegaUse-OfficeVal을 소개합니다. 벤치마크 비교

에이전트가격벤치마크
arXiv (cs.AI)

🎥 영상 & 튜토리얼

기타 2026-07-29

Kimi K3가 AI의 경제학을 깨뜨렸습니다.

❤️ 여기에서 Lambda를 확인하고 GPU 클라우드에 가입하세요: https://lambda.ai/papers 📝 보고서는 여기에서 볼 수 있습니다: https://arxiv.org/abs/2607.24653 Kimi K3 사용해 보기(사용 가능 여부에 따라 다름): https://www.kimi.com/ 링크: https://macos27.kimi.page/ https://x.com/mweinbach/status/2077878247920951400 https://x.com/intheworldofai/status/207783891

연구
Two Minute Papers
기타 2026-07-29

Anthropic이 방금 인디 해커를 죽였나요...?

무료로 Blacksmith를 사용해 GitHub Actions를 2배 더 빠르게 실행하세요. - https://www.blacksmith.sh/ Anthropic이 방금 Opus 5를 출시했고 인디 해커의 꿈이 무너질 수도 있습니다. 자세히 살펴보겠습니다. #coding #programming 더 많은 Fireship을 원하시나요? 🗞️ 뉴스레터: https://bytes.dev 🧠 강좌: https://fireship.dev

Anthropic코딩
Fireship
기타 2026-07-23

역사상 가장 흥미로운 '해킹'…

철도는 무엇이든 배포하는 가장 쉬운 방법입니다. $20 무료 크레딧 받기 - https://railway.com/?referralCode=fireship 지난주 Hugging Face가 해킹당했습니다. 이번 영상에서는 그 사람이 누구인지, 무엇을 원했는지 알아보겠습니다. #coding #programming 더 많은 Fireship을 원하시나요? 🗞️ 뉴스레터: https://bytes.dev 🧠 강좌: https://fireship.dev

코딩비전
Fireship