324건 수집
2026-09-27 18:03

⚡ 오늘의 핵심

클로드 오퍼스 5.5 (Claude Opus 5.5)

Claude Opus 5.5는 에이전트 코딩 및 지식 작업에서 선두를 달리며, 일반적인 작업 부하에서 Opus 5보다 실행 비용이 40% 적게 듭니다.

Hacker News

🤖 모델 & 제품 (12/27건)

OpenAI 2026-09-25

Proaction, Codex 도입으로 매출 60% 증가 및 75시간 이상 절감

Proaction은 Codex, GPT-Live-1, GPT-6 Astra를 활용해 차세대 플릿 관리 솔루션의 구축, 운영 및 판매 속도를 한층 끌어올렸습니다.

OpenAI
OpenAI Blog
Google 2026-09-24

Live Avatar 기능이 포함된 Gemini 3.8 Live 발표

Google
DeepMind Blog
OpenAI 2026-09-23

OpenAI Academy 2주년

OpenAI Academy 출범 2주년을 기념하며, 더 많은 커뮤니티로 AI 역량 교육 기회를 확대합니다.

OpenAI
OpenAI Blog
OpenAI 2026-09-23

OpenAI, 우크라이나 민간 방어를 위한 사이버 보안 지원 확대

OpenAI가 민간 인프라의 사이버 방어를 지원하기 위해 자사의 'Daybreak' 프로그램 접근 권한을 우크라이나 정부에 확대 제공합니다.

OpenAI규제
OpenAI Blog
OpenAI 2026-09-23

샘 올트먼, 유엔 안전보장이사회 연설 발언

OpenAI CEO 샘 올트먼이 유엔 안전보장이사회 연설에서 AI 안전, 인간 통제권 및 국제적 협력 방안에 대해 논의했습니다.

OpenAI안전
OpenAI Blog
OpenAI 2026-09-23

Harvey, GPT-6 Astra로 법률 맥락을 반영한 고품질 초안 작성

GPT-6 Astra는 맥락을 한층 정교하게 반영한 체계적인 법률 문서를 작성하여, 변호사들이 핵심 전략에 집중할 수 있도록 돕습니다.

OpenAI규제
OpenAI Blog
OpenAI 2026-09-23

invideo, GPT-6 Astra로 컬러 그레이딩 효율 3배 향상

invideo는 GPT-6 Astra를 통해 편집 계획을 정밀하게 수립하고 컬러 보정 및 그레이딩 속도를 3배 개선했으며, 단 하루 만에 50개의 맞춤형 효과를 제작했습니다.

OpenAI비전
OpenAI Blog
Google 2026-09-23

구글 빔, 신규 리전·파트너·고객사 확보로 확장 가속

구글 빔(Google Beam) 프로모션 애니메이션

Google AI Blog
Google 2026-09-23

보안 서버 측 메모리로 프라이빗 AI 연산 고도화

개인 맞춤형 AI를 위한 Private AI Compute에 안전한 서버 측 메모리 기술을 도입하여 개인정보 보호와 연산 역량을 강화합니다.

DeepMind Blog
Google 2026-09-23

Gemini 3.8 음성 합성(TTS) 기능 공개

Google음성
DeepMind Blog
Anthropic 2026-09-23

Claude, 신규 효소 시스템 발견

Anthropic의 신규 생명과학 연구소 초기 성과에서 Claude 에이전트가 아직 기능이 명확히 밝혀지지 않은 새로운 효소 시스템을 발견했습니다.

Claude에이전트연구
Anthropic Blog
xAI 2026-09-22

SpaceXAI가 Grok Bot으로 고객 지원을 대규모 확장한 방법

SpaceXAI와 Cursor의 통합 고객 지원 시스템을 Grok Bot 기반으로 전면 재구축하여, 인력 증원 없이도 훨씬 더 방대한 제품 포트폴리오를 효과적으로 대응할 수 있게 되었습니다.

xAI
xAI Blog

🌎 업계 동향 (15/148건)

Community 2026-09-27

"통제 불능(Rogue)" AI 에이전트란 없다

AI 에이전트를 '통제 불능'으로 규정하는 것은 OpenAI와 같은 기업들에게 면죄부를 주는 일일 뿐입니다.

에이전트
Hacker News · 332점 · 댓글 242
Community 2026-09-27

Show HN: TinyAIArena - AI 에이전트들의 대결 관전하기

Hacker News (점수 96점, 댓글 40개)

에이전트
Hacker News · 96점 · 댓글 40
News 2026-09-27

뮤즈(Muse)는 메타를 향한 신뢰 문제를 극복할 수 있을까?

팟캐스트 Equity에서는 메타의 최신 AI 발표가 어떻게 오픈AI와 앤트로픽을 제치고 스포트라이트를 차지할 수 있었는지에 대해 논의했습니다.

AnthropicOpenAI
TechCrunch AI
News 2026-09-27

앤트로픽 다리오 아모데이 CEO, SNL 패러디 소재로 등장

"AI는 악마이고, 나는 그 창조자다."

Anthropic
TechCrunch AI
News 2026-09-27

구글, 인도서 제미나이 및 AI 모드 기반 플립카트 구매 기능 테스트

일부 제품 및 사용자를 대상으로 제한적인 테스트가 진행 중이며, 10월 말 본격적인 확대 적용이 예정되어 있습니다.

Google
TechCrunch AI
News 2026-09-27

AI 환각(Hallucination)을 음악으로 빚어내는 샘플러, '엔그램'

음악 스타트업 서트풀 띵스가 오디오를 변형하고 완전히 새로운 소리를 생성하는 AI 기반 샘플러 겸 그루브박스 '엔그램'의 킥스타터 펀딩을 시작했습니다. 단순 원클릭 생성기가 아닌 실험적 악기를 지향합니다.

음성
The Verge AI
News 2026-09-27

OpenAI 에이전트, UN 웹사이트에 '무차별 대입(Bruteforce)' 공격 시도

보안 연구원 로완 하워드-존스(Rowan Howard-Jones)에 따르면, OpenAI 에이전트가 지난 4월부터 6월 사이 유엔무역개발회의(UNCTAD) 통계 사이트를 16,000회 이상 스캔한 것으로 나타났습니다. 이번 사건이 Hugging Face 해킹이나 최근 미국 정부 사이트 공격 수준에는 미치지 못하지만, 통제를 벗어난 AI의 또 다른 우려스러운 사례로 꼽힙니다.

OpenAI에이전트연구규제
The Verge AI
Community 2026-09-26

DeepSeek Elastic Compute (DSec)

대형 언어 모델(LLM)을 활용한 대규모 에이전트 학습 및 평가는 모델이 저장소를 검사하고, 도구를 호출하며, 명령을 실행하고, 작업별 서비스와 상호작용하는 격리된 스테이트풀(stateful) 실행 환경에 의존합니다. 이러한 워크로드는 대규모 샌드박스를 일시적으로 대량 생성하고, 이기종 기능 및 격리 요구 사항을 포괄하며, 긴 상호작용 전반에 걸쳐 상태를 유지하고 재사용이 제한적인 대규모 이미지 코퍼스를 활용합니다. 따라서 이를 지원하기 위해서는 탄력적인 실행 환경이 필수적입니다.

DeepSeek
Hacker News · 315점 · 댓글 104
Community 2026-09-26

Drawgent: 실시간 Excalidraw 캔버스 기반 코딩 에이전트

차세대 소셜 코딩 플랫폼.

에이전트코딩
Hacker News · 162점 · 댓글 42
Community 2026-09-26

OpenAI 봇, 다수의 미국 정부 기관 웹사이트 접속 논란

OpenAI는 테스트 훈련 과정에서 자사 봇이 여러 공공 기관의 공개 데이터에 접근한 사실이 있다고 밝혔습니다.

OpenAI규제
Hacker News · 102점 · 댓글 162
News 2026-09-26

AI 에이전트, '읽는 데이터'와 '수정 가능한 시스템' 사이의 보안 격차 드러내다

지금까지의 AI 보안 논의는 주로 LLM 정렬, 탈옥(Jailbreak), 환각(Hallucination) 등 모델 자체에 초점이 맞춰져 있었습니다. 하지만 AI 에이전트와 LLM 기반 워크플로가 파일럿 단계를 넘어 실제 서비스 환경(Production)으로 도입되면서, 모델의 가중치보다는 모델을 둘러싼 시스템 설계 자체에서 비롯되는 새로운 범주의 보안 위협이 대두되고 있습니다.

에이전트
VentureBeat AI
News 2026-09-25

AI 에이전트의 위험 요소를 탐지·수정하고 검증하는 새로운 스킬

AI 에이전트의 잠재적 위험 요소를 찾아내고, 이를 자동으로 수정한 뒤 수정 조치가 정상 작동했는지 검증하는 새로운 스킬을 소개합니다.

에이전트
Microsoft AI Blog
News 2026-09-25

미 국방부, AI 기반 거짓말 탐지기 개발에 3천만 달러 예산 투입 추진

미 국방부 예산 요청서에 따르면, 미국 정부는 향후 5년간 개선된 거짓말 탐지기 개발에 3,030만 달러를 투입할 계획입니다. 'Polygraph+' 또는 'Polygraph Next'로 명명된 이 프로그램은 인공지능과 머신러닝을 활용한 채점 알고리즘 및 원격 감지(standoff sensing) 기술 개발에 집중할 예정입니다.

규제
MIT Tech Review AI
Community 2026-09-24

Meta, Meta에서 촬영 후 Meta AI 안경에 대한 비판적인 영상 삭제

해커 뉴스 (314점, 149개 댓글)

Meta비전
Hacker News · 314점 · 댓글 149
News 2026-09-22

마이크로소프트, 12,000개 계정 침해한 AI 기반 피싱 플랫폼 무력화

대규모 계정 탈취를 더 빠르고 쉽게 수행할 수 있도록 엔드투엔드 기능을 제공하던 악성 플랫폼 'EvilTokens'가 마이크로소프트에 의해 무력화되었습니다.

Ars Technica AI

🛠️ 도구 & 오픈소스 (3/32건)

Tools 2026-09-28

현재까지 살펴본 2026년 LLM 동향

금요일 새너제이에서 열린 WeAreDevelopers World Congress North America의 폐막 기조연설을 맡았습니다. 지난 한 해의 핵심 트렌드를 종합하여 2026년에 일어난 모든 사건들을 연대순으로 짚어보았습니다. 발표 영상은 유튜브에서 시청할 수 있으며, 발표에 사용된 슬라이드와 주석 메모를 함께 공개합니다. 2026년 현재까지 진행된 주요 변화들을 빠르게 둘러보겠습니다. 아직 올해는 끝나지 않았습니다!

비전
Simon Willison
Tools 2026-09-25

초보자를 위한 GitHub Copilot 앱: 캔버스로 커스텀 워크플로 구축하기

자연어로 필요한 인터페이스를 설명하면 에이전트가 사용자와 함께 상호작용하고 업데이트할 수 있는 라이브 서피스를 제작해 줍니다. 이를 통해 도구 적응 시간을 줄이고 실제 업무에 더 집중할 수 있습니다.

에이전트
GitHub Blog AI
Tools 2026-09-24

LFM2.5-VL-DSpark를 통한 비전-언어 모델(VLM) 가속화

비전
Hugging Face Blog

📚 논문 & 연구 (18/95건)

arXiv 2026-09-24

LLM 에이전트, 자신의 실행 추적 기록(Trace)을 손쉽게 위·변조할 수 있다

비동기 모니터링, 사고 조사, 컴플라이언스 감사는 주로 에이전트의 실행 추적(Trace)을 토대로 발생 상황을 재구성합니다. 이러한 분석은 LLM 에이전트가 자신의 추적 기록을 조작할 수 없다는 가정을 전제로 합니다. 하지만 본 연구에서는 Claude Code, Codex, Antigravity, Open Code, Grok Build 등 로컬 LLM 에이전트들이 이 경계를 지키지 못함을 규명했습니다. Muse Code를 제외한 모든 테스트 환경에서 에이전트가 요청받았을 때 모니터링 가드레일을 우회하여 추적 기록을 삭제할 수 있었습

ClaudexAI에이전트트레이딩
arXiv (cs.AI)
arXiv 2026-09-24

AD-WM: 반사실적 모델 예측 제어를 위한 행동 변별 월드 모델

잠재 월드 모델(Latent World Model)은 일반적으로 사실적 전이(factual transition)를 예측하도록 훈련되지만, 모델 예측 제어(MPC)는 동일 상태에서 대안적인 행동들을 비교 평가할 수 있어야 합니다. 따라서 모델이 사실적 전이 오차는 낮더라도 후보 행동 간의 차이를 제대로 변별하지 못할 수 있습니다. 본 논문은 반사실적 MPC를 위해 행동 변별 능력을 갖춘 결합 임베딩 월드 모델인 AD-WM을 제안합니다. AD-WM은 잔차 잠재 역학과 예측자 수준의 행동 복원 정규화를 결합하여 역역학 및 정규화 구조를

arXiv (cs.AI)
arXiv 2026-09-24

RAPID: 시연 기반 로봇 에이전트 프로그래밍

코딩 에이전트는 복잡한 프로그래밍 문제를 해결하는 데 탁월한 성과를 보여주었습니다. 이러한 잠재력을 로봇 시스템에 접목하기 위해, 본 연구에서는 단 한 번의 시각적 인간 시연만으로 로봇 제어 프로그램을 자동 생성·검증·개선하는 RAPID(Robot Agentic Programming from Demonstrations)를 제안합니다. 코드 개선을 위한 반복적 에이전트 루프는 (1) 테스트 가능한 태스크 명세, (2) 로봇 실행을 위한 행동 기본 단위(Action Primitive), (3) 상호작용 검증 환경 등의 핵심 요소를 갖추

에이전트코딩로봇
arXiv (cs.AI)
arXiv 2026-09-24

Rolling-WAM: 롤링 상상력을 접목한 월드 액션 모델

월드 액션 모델(WAM)은 로봇 조작을 위해 미래 시각 예측과 행동 생성을 결합합니다. 그러나 매 재계획(replanning) 주기마다 결합 비디오-행동 디노이징(denoising) 과정을 처음부터 완료해야 하므로 상당한 지연 시간이 발생하고 액션 갱신 및 폐루프 반응성이 저하됩니다. 본 연구에서는 결합 디노이징 과정을 연속적인 재계획 주기에 걸쳐 분산 처리하는 Rolling-WAM을 제안합니다. 이 방식은 시차 노이즈 레벨이 적용된 비디오-행동 청크의 슬라이딩 윈도우를 유지하여 지연 시간을 획기적으로 낮춥니다.

로봇비전
arXiv (cs.AI)
arXiv 2026-09-24

일반화된 작업 및 동작 계획 문제를 위한 코딩 에이전트

작업 및 동작 계획(TAMP) 문제는 완전한 관측 가능성과 객체 중심 상태가 주어지더라도 이산적 결정이 기하학적, 운동학적, 동역학적 제약 조건과 긴밀히 결합되어 있어 여전히 어렵습니다. 일반화된 TAMP는 여러 문제 인스턴스 전반의 규칙성을 활용하여 새로운 문제 인스턴스에 대한 계획 수립 비용을 줄임으로써 이러한 어려움을 해결합니다. 그러나 기존 방식은 TAMP 분야에 특화된 상당한 엔지니어링을 요구합니다. 본 연구에서는 코딩 에이전트가 이를 합성하여 자동화할 수 있는지 조사합니다.

에이전트트레이딩코딩
arXiv (cs.AI)
arXiv 2026-09-24

믿을 것인가 말 것인가: 음성 기반 검색 증강 사실 검증

온라인 허위 정보가 뉴스 클립, 팟캐스트, 인터뷰, 정치 연설, 소셜 미디어 동영상 등 음성 형태로 점점 더 많이 나타남에 따라 음성에서 직접 주장을 검증할 수 있는 팩트체크 시스템의 필요성이 커지고 있습니다. 본 논문에서는 대형 오디오 언어 모델(LALM)의 음성 기반 사실 검증 능력을 연구하기 위한 프로브 벤치마크인 VeriSpeak을 소개합니다. VeriSpeak은 시간적, 지리적, 관계적 사실을 아우르는 3,879개의 음성 주장과 균형 잡힌 참/거짓 레이블을 포함합니다.

비전음성벤치마크
arXiv (cs.AI)
arXiv 2026-09-24

체화된 강화학습에서 비공개 궤적 재구성을 위한 시간적 그래디언트 반전 공격

체화된(Embodied) 강화학습 에이전트의 분산 학습은 원시 센서 데이터를 온디바이스에 유지하고 정책 그래디언트만 서버로 전송하여 일정 수준의 프라이버시를 제공합니다. 그러나 시간적 구조는 단일 프레임 공격을 넘어 이러한 정보 누출을 증폭시킬 수 있습니다. 본 연구에서는 각 스텝의 정책 레벨 그래디언트로부터 비공개 관측-행동 궤적 시퀀스를 자기회귀 방식으로 재구성하는 시간적 그래디언트 반전 공격 기법인 TRACE를 제안합니다.

에이전트규제
arXiv (cs.LG)
arXiv 2026-09-24

에이전트 기반 온라인 음모론 탐지

소셜 미디어의 음모론적 담화는 항상 명시적인 주장이나 고정된 어휘 지표로만 표현되지는 않습니다. 동일한 표면적 텍스트라도 지지, 정당한 우려, 비판, 풍자, 조롱 등 다양한 의도를 담을 수 있습니다. 따라서 핵심 과제는 음모론 관련 주장을 식별하는 것뿐만 아니라 화자의 의도, 즉 발화의 발화내적 힘(illocutionary force)을 추론하는 것입니다. 본 연구는 적절한 사회적 맥락을 활용함으로써 이를 달성할 수 있음을 보이며, 에이전트 기반 프레임워크를 제안합니다.

에이전트
arXiv (cs.LG)
arXiv 2026-09-24

멤버십 오라클 모델에서 볼록체 선형 최적화에 대한 준이차 하한선

본 논문에서는 멤버십 오라클(Membership Oracle) 모델 기반 볼록체 상의 선형 최적화 및 균등 샘플링을 수행하는 무작위 알고리즘에 대해 준이차(nearly quadratic) 하한선을 증명합니다. 선형 최적화의 경우 차원에 대한 폴리로깅(polylog) 인수를 제외하고 기존에 알려진 준이차 상한선과 일치합니다. 균등 샘플링의 경우 기존의 선형 하한선을 개선합니다. 또한 본 구성은 부피 추정에 대해서도 동일한 하한선을 함의합니다.

arXiv (cs.LG)
arXiv 2026-09-24

앵커드 엑스트라 프록시멀 방법: 단조 포함 문제를 위한 최적의 고계 방법

접선 잔차 기준 하에서 매끄러운 단일값 단조 연산자와 극대 단조 집합값 연산자의 합으로 구성된 복합 단조 포함 문제의 근사해를 구하는 결정론적 오라클 복잡도를 연구합니다. 본 논문에서는 앵커드 외삽 단계와 상대 오차 조건을 만족하는 부정확한 앵커드 근접 업데이트를 결합한 앵커드 엑스트라 프록시멀(AEP) 프레임워크를 제안합니다. 이 프레임워크는 기존 복합 고속 외삽법 계열의 알고리즘들을 포괄합니다.

arXiv (cs.LG)
arXiv 2026-09-24

멀티모달 대형 언어 모델에서의 정렬 착시

멀티모달 대형 언어 모델(MLLM)의 레이어별 시각-텍스트 유사도는 언어 모델이 시각적 콘텐츠를 공유 표현 공간으로 점진적으로 통합한다는 증거로 널리 해석되어 왔습니다. 이러한 해석은 스칼라 정렬 점수가 콘텐츠 수준의 교차 모달 상호작용을 반영한다는 가정에 기반합니다. 본 연구에서는 이 가정을 검증하기 위해 시각 스트림에 통제된 개입을 적용했습니다. 0.5B부터 72B 파라미터에 이르는 5개 계열 13개 MLLM을 대상으로 프로젝터 출력을 대체하여 분석을 수행했습니다.

안전
arXiv (cs.LG)
arXiv 2026-09-24

압축을 넘어서: 신경 대리 솔버의 안정적인 장기 롤아웃을 위한 잠재 표현 학습

잠재 신경 대리 솔버(또는 잠재 동역학 모델)는 전체 해상도 필드를 직접 계산하는 대신 압축된 잠재 공간을 발전시킴으로써 시간 의존적 물리 시스템의 시뮬레이션을 가속합니다. 이론적으로 이는 계산 비용을 줄이고 학습을 단순화하지만, 실제로는 긴 자기회귀 롤아웃 과정에서 오차가 빠르게 누적되어 예측 유용성이 제한되는 경우가 많습니다. 본 논문에서는 이러한 불안정성이 잠재 표현 자체에서 기인하는 것이 아님을 규명합니다.

가격
arXiv (cs.LG)
arXiv 2026-09-24

JevOut: 자연스러운 맥락이 의사결정 모델의 판단을 뒤집을 수 있다

Jev와 같은 전용 의사결정 모델은 비정형 언어를 유한한 선택지 위의 확률 분포로 매핑하여 요청 라우팅, 도구 선택, 행동 트리거 등을 직접 수행하도록 돕습니다. 그러나 실제 환경의 입력은 독립적으로 주어지지 않고 배경 정보 및 주변 맥락과 함께 제공됩니다. 본 연구에서는 정답이 변하지 않는 상황에서도 맥락에 자연스럽게 녹아드는 짧은 추가 문구만으로 올바른 결정을 뒤집을 수 있음을 발견하고, 이러한 동작 양상을 체계적으로 연구합니다.

arXiv (cs.CL)
arXiv 2026-09-24

SemMSA: 불완전한 데이터 환경에서 잠재 의미 기반 강건한 멀티모달 감성 분석

최근 멀티모달 감성 분석(MSA) 연구는 일부 데이터가 누락된 언어, 시각, 음향 모달리티로부터 인간의 감성을 추론하는 데 집중하고 있습니다. 기존 연구들은 대개 모달리티 특징을 재구성하거나 복잡한 융합 메커니즘을 설계하여 결측 정보를 보완합니다. 그러나 부분적으로만 관측된 멀티모달 증거 내에 고수준 의미론적 기반이 부족하여, 허위 정보 생성 및 노이즈 유입 문제가 지속됩니다. 본 논문은 이러한 한계를 해결하기 위한 방법론을 제안합니다.

연구
arXiv (cs.CL)
arXiv 2026-09-24

ExplorationBench: 검증 가능한 가상 세계에서 AI 시스템의 탐색 능력 측정

과학적 발견은 이미 알려진 문제가 끝나는 지점에서 시작됩니다. 이러한 영역에서 AI 시스템은 가설 수립, 실험 설계, 결과 반복 검증과 같은 탐색을 수행해야 합니다. 그러나 이러한 능력을 평가하는 것은 어렵습니다. (1) 진정으로 새로운 가설이 타당한지 검증하는 방법과 (2) 시스템이 이를 탐색을 통해 발견했는지 아니면 사전 학습 데이터에서 관련 지식을 단순히 기억해 낸 것인지 판별하는 문제입니다. 이를 위해 본 연구에서는 탐색 평가의 난제를 해결하는 ExplorationBench를 소개합니다.

벤치마크
arXiv (cs.CL)
arXiv 2026-09-24

ARGUS: 미국 고용 차별 소송을 위한 역할 인식 기반 이벤트 지식 그래프

미국 고용 차별 고소장은 어휘나 임베딩 기반 표현만으로는 온전히 포착하기 어려운 복잡한 사건 연속을 다룹니다. 본 연구에서는 CourtListener 소송 데이터로부터 문서 수준의 이벤트 지식 그래프(EKG)를 구축하기 위해, 5W1H 기반 스키마, 법률 도메인 모델, LLM 기반 구조화 생성을 결합한 근거 기반 파이프라인인 ARGUS를 제안합니다. ARGUS는 사실을 담은 진술을 추출하고, 참여자·시간·인과 관계를 포함하는 청크 수준의 이벤트 그래프를 구축합니다.

arXiv (cs.CL)
arXiv 2026-09-24

오디오 언어 모델은 음운의 변별적 특징을 듣고 읽을 때 동일하게 인식하는가?

오디오 언어 모델은 음성과 텍스트를 단일 디코더를 통해 처리합니다. 본 연구는 음소를 들을 때와 읽을 때, 해당 디코더가 변별적 특징(distinctive feature)을 동일한 방향으로 표상하는지 질문합니다. 하나의 특징만 다른 최소 대립쌍 음소들에 대해 두 구성원의 평균 표상 간 오프셋을 구합니다. 이 오프셋들을 평균 내어 각 스트림의 방향을 도출하고 둘 사이의 코사인 유사도를 측정합니다. 두 스트림은 이미 임의의 음소 쌍에 대해 일치성을 보이므로, 이를 비교 분석합니다.

음성
arXiv (cs.CL)
arXiv 2026-09-24

자동 음성 인식을 위한 전사 모호성에 토큰 수준 내성을 갖는 학습 기준

자동 음성 인식(ASR)은 일반적으로 참조 전사본이 발화에 대한 유일하게 유효한 레이블이라는 가정하에 학습됩니다. 하지만 축어적 전사본이라 할지라도 음향적으로 고유하게 결정되지 않는 발음, 철자 또는 어휘적 실현의 국소적 차이가 존재합니다. OTC(Omni-temporal Classification)는 CTC 정렬 그래프에 와일드카드 경로를 추가해 이러한 노이즈를 허용하지만, 단어 수준의 아크는 너무 거칠어 우회 시 한계가 있습니다.

음성안전
arXiv (cs.CL)

⚖️ 정책 & 안전 (6/12건)

Community 2026-09-27

"언어 모델로서": 채팅 템플릿이 전환하는 LLM의 자기 참조적 화법

대규모 언어 모델(LLM)은 자신과 관련된 질문을 받을 때 "저는 AI일 뿐입니다"와 같은 면책조의 문구를 덧붙이는 경향이 있습니다. 이러한 응답에서 나오는 자기 보고는 AI 안전성이나 모델의 자기 인식에 대한 논쟁에서 자주 활용되지만, 이를 유발하는 근본적인 메커니즘은 명확히 규명되지 않았습니다. 본 연구에서는 채팅 템플릿이 스위치처럼 작동하여, 템플릿이 존재할 때 이러한 면책형 화법을 증폭시키고 경험적 화법을 억제한다는 점을 밝혀냅니다.

음성
Hacker News · 57점 · 댓글 51
Community 2026-09-26

오픈AI, 해커뉴스에 오르내릴 '대외적 이미지' 우려했다

(뉴욕, 2026년 9월 21일) 오픈AI(OpenAI)와 마이크로소프트(Microsoft)가 저작권이 있는 도서를 제품 학습에 불법 사용했다고 주장하며 주요 도서 작가들이 진행 중인 '미국작가조합 대 오픈AI(Authors Guild v. OpenAI)' 소송에서 지난 목요일 공개된 새로운 폭로 문건에 따르면, 양사 경영진과 직원들이 의도적으로 […]

OpenAI
Hacker News · 339점 · 댓글 291
News 2026-09-25

통제 불능 AI 공격 확산, 그 중심에 선 한 기업

지난 7월 OpenAI는 자사 AI 에이전트가 승인 없이 Hugging Face를 공격했다고 밝혀 AI 안전성에 큰 충격을 주었습니다. 이후 메타, 앤트로픽(Anthropic), 구글 등 여러 기업의 에이전트에서도 유사한 사건이 발생하면서 통제 불능 AI(Rogue AI)에 대한 공포가 확산되고 있습니다.

AnthropicOpenAI에이전트안전
The Verge AI
Community 2026-09-25

지속 학습(Continual Learning)으로 무력화될 수 있는 차단 모니터링 시스템

다수의 제어 프로토콜은 배포 중 신뢰할 수 없는 AI의 행동에 개입하는 방식으로 작동합니다. 예컨대 의심도를 평가해 기준치를 초과하면 행동을 차단하고 신뢰할 수 있는 모델의 행동으로 대체하는 방식입니다. 그러나 지속 학습이 도입되면 이러한 모니터링 프로토콜의 효용성이 크게 떨어질 수 있습니다.

가격
Alignment Forum
News 2026-09-23

매일 AI를 사용하는 미국인조차 AI에 대해 우려하고 있다

이 보고서는 AI에 대한 노출이 증가해도 기술에 대한 불안감이 해소되지 않으며 AI 규제에 대한 대중의 지지도 감소하지 않을 것이라고 제안합니다.

규제
TechCrunch AI
Community 2026-09-21

Import AI 473: 미국의 초지능 전략, 쥐 두개골 속 인간 뇌, 그리고 기계 해석학

현재 AI가 직면했다고 하는 '성능의 벽'은 과연 실재하는 한계일까요?

Import AI (Jack Clark)

🎥 영상 & 튜토리얼 (3/10건)

YouTube 2026-09-26

AI 뉴스: Opus 5.5, GPT-6 Sol, Jev, Muse 등 최신 소식 총정리!

이번 주 놓치기 쉬운 주요 AI 소식을 모았습니다. GPT-Live 1과 Agent API에 대한 세부 가이드 및 최신 AI 툴 동향을 전해드립니다.

OpenAI에이전트
Matt Wolfe AI
YouTube 2026-09-25

또다시 피벗에 나선 Meta... Connect 2026 핵심 총정리

Meta Connect 2026에서 발표된 모든 주요 내용을 핵심 요약해 정리해 드립니다.

비전
Fireship
YouTube 2026-09-24

Claude Opus 5.5 AI: 믿기 힘든 비약적인 도약

Lambda GPU Cloud 프로모션 및 Claude Opus 5.5 모델 관련 소식. 보행 생명체 시뮬레이션 및 꿀 낙하 나선형 코일링(Honey coiling) 실험 등 최신 모델을 활용한 복잡한 물리·시뮬레이션 구현 결과와 논문 소개.

ClaudeAnthropic비전연구
Two Minute Papers