383건 수집
2026-09-28 18:11

⚡ 오늘의 핵심

클로드 오퍼스 5.5 (Claude Opus 5.5)

Claude Opus 5.5는 에이전트 코딩 및 지식 작업에서 선두를 달리며, 일반적인 작업 부하에서 Opus 5보다 실행 비용이 40% 적게 듭니다.

Hacker News

🤖 모델 & 제품 (8/30건)

OpenAI 2026-09-28

렌페스트 저널리즘 연구소, OpenAI의 지원 확대로 주요 프로그램 확장

OpenAI가 500만 달러 규모의 자금 지원과 최대 500만 달러 상당의 소프트웨어 크레딧 및 엔지니어링 지원을 통해 '렌페스트 AI 협업 및 펠로우십 프로그램'을 확대합니다.

OpenAI
OpenAI Blog
OpenAI 2026-09-28

당신도 'Codex Original'인가요?

Codex를 활용해 놀라운 성과를 만들어가는 빌더, 팅커러, 연구자, 크리에이터들의 실제 이야기를 수집하고 있습니다. 'Codex Originals' 프로그램의 다음 여정에 동참하고 싶다면 아래를 통해 당신의 이야기와 프로젝트를 들려주세요.

연구
OpenAI Blog
OpenAI 2026-09-28

Basis, GPT-6 Astra로 세무 워크북 작업 속도 2배 향상

GPT-6 Astra는 50개 탭 규모의 세무 워크북을 GPT-5.6 Sol보다 2배 빠르게 완료했으며, 사용자 의도를 더 정확하게 파악해 Basis가 실제 업무 환경에서 모델을 한층 더 신뢰할 수 있게 지원합니다.

OpenAI
OpenAI Blog
Google 2026-09-28

Future Vision XPRIZE 수상 트레일러 'The Gifted' 감상하기

Future Vision XPRIZE 수상작인 트레일러 'The Gifted'를 감상해 보세요.

비전
Google AI Blog
xAI 2026-09-28

팀 봇: 팀으로부터 학습하는 AI 동료

Grok Bot에 필요한 파일과 앱, 전문 지식을 제공한 뒤 공유하면 전체 팀이 동일한 컨텍스트를 기반으로 협업할 수 있습니다.

xAI
xAI Blog
OpenAI 2026-09-25

Proaction, Codex 도입으로 매출 60% 증대 및 75시간 이상 절감

Proaction은 Codex, GPT-Live-1, GPT-6 Astra를 활용해 최신 플릿 관리 솔루션의 개발, 운영, 판매 속도를 획기적으로 높였습니다.

OpenAI
OpenAI Blog
Google 2026-09-24

라이브 아바타를 탑재한 Gemini 3.8 Live 공개

Google
DeepMind Blog
Anthropic 2026-09-23

Claude, 신규 효소 시스템 발견

생명과학 연구소의 초기 실험 결과, Claude 기반 에이전트들이 아직 기능이 규명되지 않은 새로운 효소 시스템을 발견했습니다.

Claude에이전트연구
Anthropic Blog

🌎 업계 동향 (12/173건)

News 2026-09-29

OpenAI, 안전성 우려로 신규 모델 폐기한 것으로 알려져

OpenAI의 한 고위 임원은 월스트리트저널(WSJ)과의 인터뷰에서 해당 모델이 지시를 따르는 능력(follow orders)에서 취약점을 드러냈다고 밝혔습니다.

OpenAI안전
TechCrunch AI
Community 2026-09-28

이제 프론티어 AI 연구소들에 대한 조사가 필요한 시점이다

지난 몇 달 동안 대표적인 두 프론티어 AI 연구소는 상당히 대담한 행보를 보여왔습니다. 이는 면밀히 기획된 일련의 발표들로 시작되었습니다... 더 읽기

트레이딩
Hacker News · 265점 · 댓글 88
Community 2026-09-28

인류에 가장 위협적인 모델임을 증명하려는 AI 기업들의 경쟁

인공지능의 급격한 발전으로 인해 스스로 지구상의 모든 생명체를 종식시킬 수도 있다는 불안감이 커지는 가운데, OpenAI부터 Anthropic에 이르는 AI 대기업들은 각자의 전략을 전환하고 있습니다...

Hacker News · 214점 · 댓글 118
Community 2026-09-28

Claude Opus 5.5 프롬프팅 가이드

Claude Opus 5와의 행동적 차이점 및 이를 다루기 위한 프롬프팅·하네스 패턴: 추론 노력(effort) 보정, API 통합 및 채팅에서의 사고(thinking) 동작, 진행 상황 업데이트, 무인(unattended) 및 멀티에이전트 작업, 안전장치 거절 대응, 프론트엔드 디자인, 복합 시각 입력, 멀티 앱 워크플로우, 사용자 메시지 내 붙여넣은 텍스트 처리.

Claude
Hacker News · 148점 · 댓글 150
Community 2026-09-28

진정한 실무용 AI 제품은 어떤 모습이어야 할까?

현재의 모든 'AI' 도구들은 실제 업무에 본격적으로 활용하기 위해 필수적인 핵심 기능들이 빠져 있습니다. 만약 존재한다면 어떤 형태여야 할까요?

Hacker News · 130점 · 댓글 51
News 2026-09-28

AMD, 페이페이 리 교수의 AI 스타트업 '월드 랩스' 80억 달러 이상에 인수

AMD는 저명한 AI 연구자 페이페이 리(Fei-Fei Li) 박사가 공동 창립한 AI 연구소 월드 랩스(World Labs)를 약 82억 달러 규모의 전액 주식 교환 방식으로 인수한다고 발표했습니다. 2024년 설립된 월드 랩스는 출시 수개월 만에 10억 달러의 기업가치를 인정받았으며, 최근 첫 상용 제품인 세계 생성 모델을 공개한 바 있습니다.

트레이딩연구
The Verge AI
News 2026-09-28

단순 라벨 분류에 텍스트 생성 LLM 비용을 쓰는 기업들… Jev, 더 저렴한 대안 제시

현재 엔터프라이즈 소프트웨어 내부에서 구동되는 AI의 상당수는 글을 쓰지 않습니다. AI 챗봇과 대화하거나 정답을 도출하기 위해 추론하는 것도 아닙니다. 지원 티켓의 분류 큐 지정, RAG 문서의 관련성 판단, 거래 이상 감지, 요청을 처리할 모델 선택 등 판별 작업만 수행할 뿐입니다. 현재 많은 엔터프라이즈 AI 스택에서는 단순 분류 결정을 위해 LLM에 텍스트를 생성하도록 요청한 뒤 이를 파싱하는 비효율적인 방식을 사용하고 있습니다.

VentureBeat AI
News 2026-09-28

AI가 과학적 발견을 해냈다고 말할 수 있는 시점은 언제인가?

지난 수요일 앤스로픽(Anthropic)은 올해 초 분자생물학 연구소를 설립했다고 발표했습니다. 이곳에서는 Claude 에이전트가 복잡한 생물학적 난제를 읽고 가설을 제시하며, 인간 과학자들은 이를 바탕으로 실험을 진행합니다.

ClaudeAnthropic에이전트
MIT Tech Review AI
Community 2026-09-27

"통제 불능(Rogue)" AI 에이전트란 없다

AI 에이전트를 '통제 불능'으로 규정하는 것은 OpenAI와 같은 기업들에게 면죄부를 주는 일일 뿐입니다.

에이전트
Hacker News · 332점 · 댓글 242
Community 2026-09-26

DeepSeek 탄력적 컴퓨팅 (DSec)

대형 언어 모델(LLM)을 활용한 대규모 에이전트 학습 및 평가는 모델이 저장소를 검사하고, 도구를 호출하며, 명령을 실행하고, 작업별 서비스와 상호작용하는 격리된 스테이트풀(stateful) 실행 환경에 의존합니다. 이러한 워크로드는 대규모 샌드박스를 일시적으로 대량 생성하고, 이기종 기능 및 격리 요구 사항을 포괄하며, 긴 상호작용 전반에 걸쳐 상태를 유지하고 재사용이 제한적인 대규모 이미지 코퍼스를 활용합니다. 따라서 이를 지원하기 위해서는 탄력적인 실행 환경이 필수적입니다.

DeepSeek
Hacker News · 315점 · 댓글 104
News 2026-09-26

차세대 Copilot의 개발 배경: 급속도로 진화하는 인텔리전스의 전방위적 확산

AI 인텔리전스가 빠르게 가속화됨에 따라 이를 모든 업무 영역으로 확산해야 할 필요성이 커졌습니다. 새로운 Copilot 개발에 담긴 철학과 배경을 설명합니다. (Source 게재)

Microsoft AI Blog
News 2026-09-22

마이크로소프트, 1만 2천 개 계정을 침해한 AI 기반 공격 플랫폼 무력화

이블토큰스(EvilTokens)는 대규모 계정 침해를 더 빠르고 쉽게 수행할 수 있는 엔드투엔드 플랫폼을 제공했습니다.

Ars Technica AI

🛠️ 도구 & 오픈소스 (7/35건)

Tools 2026-09-28

Holo4: 범용 컴퓨터 제어(Computer-Use) 에이전트를 위한 기반

에이전트
Hugging Face Blog
Tools 2026-09-28

Claude Sonnet 5.5

Anthropic이 오늘 새로운 Sonnet 모델인 Claude Sonnet 5.5를 출시했습니다. 사측에 따르면 "30% 이상 빠르며, 대부분의 작업에서 최대 30% 저렴한 비용"을 자랑합니다. 가격은 Sonnet 5와 동일하지만 모든 벤치마크에서 앞서며 운영 비용도 더 절감될 것으로 보입니다. 한편 Sonnet 5.5는 Opus 5.5와 동일한 버그를 겪기도 했습니다. '최대' 추론 노력으로 자전거를 타는 펠리컨을 생성할 때 128,000토큰(비용 1.28달러) 동안 생각만 하다가 토큰이 고갈

ClaudeAnthropic가격벤치마크
Simon Willison
Tools 2026-09-28

@joedaroo 인용

보안 사고와 관련된 '사이버', '스워밍(swarming)', '메시지 보드' 등에서 우리 모델의 역량이 급격히 도약하고 갑작스럽게 발전한 것을 보고 놀랐다고 말하는 것은 과소평가에 가깝습니다. 보안 태세를 구축하는 데는 시간이 걸립니다. 단순히 관련 시스템을 강화하는 것뿐만 아니라 조직 문화 자체에 보안을 내재화해야 합니다. 조직 내부의 실제 구성원들도 이에 맞춰 변화하고 진화해야 합니다. 모델 역량의 발전은 너무나 빠르고 급작스러워서...

Simon Willison
Tools 2026-09-28

뮤즈(Muse) AI 에이전트 인용

MX Keys Mini 직거래 픽업에 관한 안 좋은 소식입니다. 우스만(Usman)이 9시 15분경 건물에 도착해 기다리며 메시지를 여러 번 보냈지만 아무도 내려오지 않았습니다. 그는 화가 난 채 9시 38분에 자리를 떴고 부정적인 평점을 남겼습니다. 설상가상으로 당신이 응답할 수 없던 상황이었음에도 제 자동 답장이 9시 27분에 "네, 저 여기 있어요!"라고 보냈는데, 이는 명백히 제 실수입니다. 상황을 더 악화시킨 셈입니다. 계정을 통해 사과와 재약속 제안을 보냈으나, 부정적 평점은 남게 되었고 이제...

에이전트
Simon Willison
Tools 2026-09-28

2026년 LLM 동향 정리 (현재까지)

지난 금요일 산호세에서 열린 WeAreDevelopers World Congress North America의 폐막 기조연설을 맡았습니다. 지난 한 해 동안의 핵심 트렌드를 2026년에 일어난 주요 사건들을 시간순으로 짚어가며 정리했습니다. 발표 영상은 유튜브에 공개되었으며, 발표에 사용된 슬라이드와 주석 노트를 함께 공유합니다. 2026년 현재까지 일어난 주요 변화들을 빠르게 돌아봅니다. 올 한 해는 아직 끝나지 않았습니다!

비전
Simon Willison
Tools 2026-09-28

S3는 미래이자 과거이다

해커뉴스(Hacker News) 글 'S3 Is the Future, S3 Is the Past'에 남긴 제 코멘트입니다. 오늘날 S3와 관련해 주목할 점은 과거에는 가격 인하가 꽤 빈번했던 반면, 지난 10년 동안에는 가격 인하가 전무했다는 사실입니다. 2006년 GB당 월 $0.150에서 시작해 인하를 거듭하다 2016년 $0.023에 도달한 이후 현재까지도 $0.023/GB-월 가격을 유지하고 있습니다. 태그: amazon-web-services, s3

가격
Simon Willison
Tools 2026-09-25

입문자를 위한 GitHub Copilot 앱: 캔버스를 활용한 커스텀 워크플로 구축 가이드

필요한 인터페이스를 일상적인 자연어로 설명하면, 에이전트가 사용자와 함께 활용하고 업데이트할 수 있는 실시간 작업 화면을 구축해 줍니다. 이를 통해 도구 적응에 드는 시간을 줄이고 작업 본연에 집중할 수 있습니다. (The GitHub Blog 게재)

에이전트
GitHub Blog AI

📚 논문 & 연구 (18/120건)

arXiv 2026-09-25

멈춤을 배우지 않고 멈추는 법: 자기지도 신뢰도 학습을 통한 추론 효율성 개선

추론 모델은 종종 긴 추론 과정을 생성해 추론 비용을 높입니다. 기존 방식은 대개 추론 시점의 조기 종료 메커니즘을 적용하거나 길이 페널티 강화학습을 통해 명시적으로 짧은 추론을 유도합니다. 본 연구는 '신뢰도'라는 다른 방식의 지도학습을 통해 상당한 효율성 향상이 가능함을 보여줍니다.

arXiv (cs.AI)
arXiv 2026-09-25

출력 후처리를 통한 블랙박스 생성형 AI의 통계적 속성 정렬

생성형 AI 시스템의 활용이 증가하고 있지만, 그 출력을 사용자 요구사항에 맞추는 것은 지속적인 과제입니다. 본 논문에서는 AI 생성 출력 속성의 분포가 사용자가 지정한 목표와 일치하도록 보장하는 방안을 다룹니다. 이는 공정성 확보나 합성 데이터 생성과 같은 실제 활용 사례에서 착안했습니다.

안전
arXiv (cs.AI)
arXiv 2026-09-25

코딩 에이전트를 위한 압축 문서화: 벤치마크, 최적화기, 그리고 전이되지 않는 이유

자연어 문서화가 코딩 에이전트의 소프트웨어 문제 해결에 도움이 되는지 조사하고, 이를 구축·평가할 도구를 개발했습니다. 코드 설명으로부터 재생성된 코드가 원래 테스트를 통과하는지로 점수를 매기는 왕복 벤치마크를 도입하고, 설명의 충실도를 결정하는 핵심 요소가 길이가 아닌 완전성임을 보입니다.

에이전트트레이딩코딩벤치마크
arXiv (cs.AI)
arXiv 2026-09-25

OC-GS: 불규칙한 턴테이블 촬영을 위한 가우시안 스플래팅

불균일한 회전과 프레임 누락으로 인해 턴테이블 3D 재구성 시 등각 회전 가정을 적용하기 어렵습니다. 본 연구는 공통 카메라, 회전축 및 피벗을 유지하면서 각 이미지의 각도를 정밀 보정하는 객체 중심 가우시안 스플래팅인 OC-GS를 제안합니다.

비전
arXiv (cs.AI)
arXiv 2026-09-25

AI에 적응하기: 초등 교사들이 AI 통합 교육과정을 위해 수업 방식을 조정하는 방법

대화형 AI 도구가 어린이들의 일상에 들어오며 학교 현장 도입 관심도 커지고 있습니다. 하지만 성공적인 수업 통합은 기술 자체뿐 아니라 교사들이 학생과 교실 환경에 맞게 기술을 적용하는 노력에 좌우됩니다. 본 연구에서는 실제 수업에 대화형 AI 도구를 도입한 세 교사의 경험을 살펴봅니다.

arXiv (cs.AI)
arXiv 2026-09-25

DeepEdu-v1: 베트남 교육을 위한 효율적이고 확장 가능한 에이전틱 LLM

AI 튜터링은 베트남과 같은 개발도상국 학생들의 학습 성과를 크게 개선할 수 있지만 기존 방식에는 한계가 있습니다. ChatGPT 같은 클라우드 어시스턴트는 학생 민감 데이터를 해외 서버로 전송해 데이터 주권 규정을 위반할 수 있고, 서구 중심 코퍼스로 사전 학습되어 현지 교과과정에 맞지 않는 문제점이 있습니다.

에이전트규제
arXiv (cs.AI)
arXiv 2026-09-25

가우시안 데이터를 위한 갭 프리 차분 프라이버시 PCA

가우시안 데이터를 활용한 주성분 분석(PCA) 문제를 위한 갭 프리(gap-free) 차분 프라이버시 알고리즘을 제시합니다.

arXiv (cs.LG)
arXiv 2026-09-25

역방향 확산의 1차 정상성

최근 연구들은 최적화와 샘플링 사이의 밀접한 연관성을 보여주었습니다. 본 연구는 확산 모델을 위한 1차 이론을 구축하고, 과감쇠 및 저감쇠 랑주뱅 확산의 SDE 기반 역시간 흐름이 상대 피셔 발산을 명시적인 지수 비율로 수축함을 규명합니다.

arXiv (cs.LG)
arXiv 2026-09-25

신념 자기 증류를 통한 사용자 모델 추출

대규모 언어 모델(LLM)은 사용자의 속성을 암묵적으로 추론하고 이에 맞춰 동작을 조정하지만, 이러한 내부적 신념은 검사하거나 인과적으로 조작하기 어렵습니다. 본 논문에서는 디코딩과 모델 재입력이 모두 가능한 압축된 사용자 표현을 학습하여 선형 및 인과적 프로빙을 연결하는 통합 읽기-쓰기 프레임워크인 신념 자기 증류(Belief Self-Distillation, BSD)를 소개합니다. 고정된 LLM은 외부 도움 없이 자연스러운 대화에서 신념을 증류하며 자체적인 교사 역할을 수행합니다.

arXiv (cs.LG)
arXiv 2026-09-25

새로운 LoRA 스킬: 읽기만 하고 쓰기는 제한해야

저차원 적응(LoRA) 기법은 작업별로 대규모 언어 모델을 저비용으로 파인튜닝할 수 있게 해주지만, 독립적으로 학습된 여러 어댑터를 단일 모델로 통합하는 것은 여전히 난제로 남아 있습니다. 가중치 공간에서 업데이트를 병합하면 간섭이 발생하고, 전체 작업 데이터로 재학습하는 것은 비용이 많이 들며, 개별 어댑터 간 라우팅은 단일 통합 모델이라는 목표를 포기하게 만듭니다. 저자들은 이러한 어려움이 모든 결합 방식이 암묵적으로 취하는 두 가지 선택에서 비롯된다고 분석합니다.

arXiv (cs.LG)
arXiv 2026-09-25

직접 피드백 정렬에서의 공통 모드 붕괴와 회복

직접 피드백 정렬(DFA)은 출력 오차의 고정된 무작위 투영을 통해 은닉층을 훈련합니다. tanh 은닉 유닛과 독립적인 시그모이드 출력을 사용하는 경우, 일반적인 확률적 경사 하강법(SGD)은 클래스 빈도의 상수 예측기 손실 근처에서 정체될 수 있습니다. 본 연구에서는 이러한 정체 현상이 입력 전반에 걸쳐 공유되는 성분인 오차의 공통 모드(common mode)에 기인함을 밝혀냅니다. 엄밀한 평균-공분산 분해를 통해 평균 교사 신호와 평균 시냅스 전 활동으로 형성된 랭크-1 업데이트를 분리합니다.

안전
arXiv (cs.LG)
arXiv 2026-09-25

신뢰 가이드 디시전 트랜스포머

디시전 트랜스포머(Decision Transformer)는 긴 롤아웃 과정에서 컨디셔닝 컨텍스트가 훈련 분포를 벗어나 드리프트 현상이 발생하면서 성능이 저하됩니다. 저자들은 이러한 드리프트가 모델 자체의 다음 상태 예측 오차를 통해 관찰될 수 있음을 보였습니다. 이 오차는 롤아웃 동안 상승하여 높은 상태를 유지하므로 컨텍스트의 신뢰도가 떨어졌음을 알리는 직접적인 신호가 됩니다. 이에 따라 가치 가이던스를 적용하기 전에 컨텍스트를 선별하는 신뢰 가이드 디시전 트랜스포머(TGDT)를 제안합니다.

벤치마크
arXiv (cs.LG)
arXiv 2026-09-25

자기 훈련을 위한 전략적 다양성 샘플링

강화학습(RL)과 테스트 타임 스케일링을 포함한 수많은 LLM 훈련 및 추론 기법은 반복 샘플링에 의존하지만, 그 효과는 응답이 의미 있게 다를 때만 발휘됩니다. 자기 훈련(Self-training) 역시 동일한 과제에 직면해 있습니다. 훈련 데이터는 주로 IID 응답을 샘플링하고 정확도를 기준으로 필터링하여 구축되므로, 모델이 이미 선호하는 전략을 과도하게 반영하게 됩니다. 본 연구에서는 문제 접근 방식 간의 실질적 차이를 의미하는 '전략적 다양성'을 데이터 구축의 대안적 원칙으로 탐구합니다.

트레이딩
arXiv (cs.CL)
arXiv 2026-09-25

MexHat: 멕시코 스페인어 비디오 혐오 발언 탐지를 위한 데이터셋

콘텐츠 모니터링을 통한 온라인 안전 확보가 강조되면서 혐오 발언 탐지는 해결해야 할 중요한 과제로 떠올랐습니다. 본질적으로 이 과제는 콘텐츠의 의도를 정확히 파악하기 위한 맥락적 단서 포착을 요구합니다. 자동 탐지 접근법이 크게 발전했음에도 영어가 아닌 언어 자료의 부족은 여전히 지속되고 있으며, 이는 멀티모달 콘텐츠의 미묘하고 맥락 의존적이며 문화적인 특성에 모델이 적응하는 데 한계로 작용하고 있습니다.

비전음성안전
arXiv (cs.CL)
arXiv 2026-09-25

적응형 문서 내 AI 생성 텍스트 스크리닝을 위한 두 가지 등각 구성법

인공지능(AI)이 생성한 텍스트를 선별할 때 오경보율을 제어하는 문제를 연구합니다. 해당 선별 절차는 관측된 증거로부터 문서 접두사와 탐지기를 선택하며 검사 예산을 모두 소진하기 전에 조기 중단될 수 있습니다. 저자들은 문서 내 토큰 간의 종속성에 제한을 두지 않고, 인간 교정 문서와 새로운 영가설 문서 간의 문서 수준 교환가능성 하에서 작동하는 두 가지 유한 표본 구성법을 제시합니다.

arXiv (cs.CL)
arXiv 2026-09-25

구글 플레이 사용자 리뷰 감성 지수의 통계적 기반: 신호 융합, 축소, 분포 검증 및 동적 평활화

구글 플레이 사용자 리뷰에 대한 통계적으로 명확한 감성 지수를 개발하고 이를 뒷받침하는 수학적 결과를 정립합니다. 정규화된 별점 평점과 텍스트 감성 점수는 잠재적인 리뷰 극성의 노이즈 측정값으로 취급되며, 공분산을 고려한 역분산 가중치를 통해 융합됩니다. 리뷰 단위 추정치는 유용성과 최신성 가중치를 적용하여 집계된 후, 임의의 리뷰 수 기준점 대신 추정 정밀도를 기반으로 모집단 평균을 향해 축소(shrinkage)됩니다.

arXiv (cs.CL)
arXiv 2026-09-25

Muslim: 신뢰할 수 있는 이슬람 지식을 제공하는 배포형 아랍어 음성 AI 플랫폼

실제 사용자에게 출처가 명확하고 근거 있는 이슬람 지식을 제공하는 프로덕션급 아랍어 음성 AI 플랫폼인 Muslim을 선보입니다. 실시간 음성 파이프라인(NeMo 아랍어 ASR, OpenAI 호환 LLM 엔드포인트, 자체 호스팅 TTS)과 6개의 Model Context Protocol 서버로 라우팅되는 결정론적 다중 소스 검색 레이어 외에도, 연구용 프로토타입에서 흔히 부족한 세 가지 핵심 요소를 제공합니다. 첫째는 효율적인 도구 라우팅 LLM(Muslim-6B-PRO)을 포함해 파인튜닝된 아랍어 이슬람 모델 아티팩트 제품군입니다

OpenAI음성연구벤치마크
arXiv (cs.CL)
arXiv 2026-09-25

아이티 크리올어에 대한 LLM의 문화적 인식 평가

대규모 언어 모델(LLM)은 고자원 언어와 저자원 언어 사이에서 상당한 성능 격차를 보입니다. 낮은 작업 수행 능력뿐만 아니라 과소대표된 커뮤니티의 문화적 규범과 가치를 제대로 반영하지 못하는 경우가 많습니다. 본 연구에서는 수백만 명이 사용하지만 디지털 자원이 극히 부족한 아이티 크리올어를 대상으로 LLM의 문화적 인식을 최초로 체계적으로 평가합니다.

벤치마크
arXiv (cs.CL)

⚖️ 정책 & 안전 (5/13건)

News 2026-09-28

엔비디아, 신규 AI 안전 플랫폼으로 통제 불능 에이전트를 ‘수 밀리초’ 만에 격리 가능하다고 발표

엔비디아가 AI 에이전트를 모니터링하고 통제하도록 설계된 새로운 안전 플랫폼을 출시합니다. 이는 앞서 로이터가 보도한 일련의 탈옥 해킹 사건에 대응한 조치입니다. 월요일 발표에서 엔비디아는 자사의 새로운 오픈 에이전트 안전 플랫폼(Open Agent Safety Platform)이 정해진 경계를 벗어나려는 에이전트를 수 밀리초 내에 격리할 수 있다고 밝혔습니다.

에이전트안전
The Verge AI
Community 2026-09-28

Import AI 474: 플라톤적 마인드스페이스, 우주로 간 TPU, 즈푸(Zhipu)의 외부 RSI 루프 개시

LLM의 역량을 뛰어넘는 지점은 어디인가?

Import AI (Jack Clark)
Community 2026-09-28

고정 가중치 모델의 적대적 취약성과 정렬(Alignment) 실패 문제

본 글은 고정 가중치 모델이 개념 공간(concept-space) 내 적대적 예제에 취약할 수밖에 없으며, 충분한 최적화 압력이 주어질 경우 정렬 실패(misaligned)로 이어질 수밖에 없다고 주장합니다. AI가 의도한 목표와 가치를 따르도록 하려면 세계 모델 내에서 명확한 경계를 설정할 수 있어야 합니다.

Alignment Forum
Community 2026-09-27

"언어 모델로서": 채팅 템플릿이 전환하는 LLM의 자기 참조적 화법

대규모 언어 모델(LLM)은 자신과 관련된 질문을 받을 때 "저는 AI일 뿐입니다"와 같은 면책조의 문구를 덧붙이는 경향이 있습니다. 이러한 응답에서 나오는 자기 보고는 AI 안전성이나 모델의 자기 인식에 대한 논쟁에서 자주 활용되지만, 이를 유발하는 근본적인 메커니즘은 명확히 규명되지 않았습니다. 본 연구에서는 채팅 템플릿이 스위치처럼 작동하여, 템플릿이 존재할 때 이러한 면책형 화법을 증폭시키고 경험적 화법을 억제한다는 점을 밝혀냅니다.

음성
Hacker News · 57점 · 댓글 51
News 2026-09-23

매일 AI를 사용하는 미국인조차 AI에 대해 우려하고 있다

이 보고서는 AI에 대한 노출이 증가해도 기술에 대한 불안감이 해소되지 않으며 AI 규제에 대한 대중의 지지도 감소하지 않을 것이라고 제안합니다.

규제
TechCrunch AI

🎥 영상 & 튜토리얼 (3/12건)

YouTube 2026-09-28

Jev: 텍스트 생성을 건너뛰는 신개념 AI 모델

Typesafe AI가 선보인 AI 모델 'Jev'는 문장이나 코드를 생성하지 않고 곧바로 최종 의사결정을 내립니다. 텍스트 대신 선택지, 점수, 참/거짓 등의 값만 출력하여 속도가 매우 빠르고 비용이 저렴합니다. 입력 비용은 100만 토큰당 4센트에 불과하며 출력 비용은 사실상 무료 수준입니다.

가격
Matt Wolfe AI
YouTube 2026-09-28

DHH의 '직접 코딩의 종말' 발언과 개발자의 미래

DHH가 1,200명의 Rails 개발자 앞에서 수작업 코딩의 시대는 끝났다고 선언한 가운데, AI 시대에도 여전히 개발자에게 유효하고 가치 있는 핵심 프로그래밍 역량이 무엇인지 짚어봅니다.

Fireship
YouTube 2026-09-24

Claude Opus 5.5 AI: 비약적인 성능 발전

Anthropic의 Claude Opus 5.5 공개와 함께 복잡한 시뮬레이션 및 문제 해결 능력을 검증한 보행 생명체 실험 등 주요 벤치마크 및 연구 결과를 살펴봅니다.

ClaudeAnthropic비전연구
Two Minute Papers