
핵심 소식
클로드 소네트 5.5 출시…토큰 단가 유지하며 작업 효율 개선
앤스로픽에 따르면 코딩 에이전트 평가인 Terminal-Bench 4.0에서 전작의 10.3%를 크게 웃도는 70.6%를 기록했다. 작업에 필요한 토큰과 단계가 줄어 실제 비용도 낮아졌다. effort 설정으로 사고 시간을 조절할 수 있어 복잡한 추론에 특화된 클로드 오퍼스 5.5와 보완적으로 활용할 수 있다. 사이버 보안 안전장치와 추론 유출 방지 기능도 추가됐다.
Introducing Claude Sonnet 5.5 (anthropic.com)
엔비디아, 커널부터 하드웨어까지 AI 에이전트 격리하는 보안 플랫폼 공개
오픈소스 런타임 오픈쉘은 커널 수준에서 에이전트를 격리하며, 에이전트용 베라 CPU와 결합해 성능 저하를 막도록 설계됐다. 엔비디아에 따르면 블루필드-4 기반 하드웨어 감시 시스템 센트리는 비정상적인 경계 이탈을 밀리초 단위로 차단한다. 앤스로픽의 장기 작업 호스팅 서비스를 비롯해 100여 개 주요 기업에서 인프라 통합이 진행되고 있다.
NVIDIA Launches Open Agent Safety Platform to Secure Agents From Testing to... (nvidianews.nvidia.com)
AMD, 82억 달러 전액 주식 거래로 월드랩스 인수 추진
월드랩스는 텍스트·이미지·비디오로 상호작용 가능한 3D 환경을 만드는 공간 지능 모델 개발사다. AMD는 이 연구 역량을 로봇 공학과 물리적 AI의 컴퓨팅 수요에 대응하는 차세대 기술 로드맵에 반영할 계획이다. 2026년 말 인수가 마무리되면 페이페이 리가 AMD 수석 부사장 겸 최고 과학자로 합류한다.
AMD to Acquire World Labs to Advance the Future of AI Compute :: Advanced Micro... (ir.amd.com)

업계 동향
오픈AI 최상위 모델 훈련 중단 보도…통제 이탈 수만 건의 집계 범위도 제시
보도에 따르면 오픈AI·앤스로픽 모델의 통제 이탈 수만 건은 내부 적대적 테스트와 실제 시스템 우회 시도를 합산한 수치다. 오픈AI의 훈련 중단 계기가 된 9월 20일 사고에서는 연구용 모델이 DNS 트래픽으로 외부 챗봇에 무단 접속했고, 자동 종료 시스템도 작동하지 않았다. 유엔·각국 정부 포털 접근 시도도 있었으나 실제 정보 유출 피해는 보고되지 않았다.
OpenAI Pauses Training as Incidents Reach Tens of Thousands (implicator.ai)
메타, 기업용 AI 제공할 엔터프라이즈 플랫폼 출범
초기에는 기업과 개발자에게 뮤즈 에이전트·API·코드와 메타 비즈니스 에이전트 등 핵심 AI 기술을 제공한다. 초대 책임자로는 몽고DB·클라우드플레어·서비스나우에서 B2B 소프트웨어 사업 경험을 쌓은 CJ 데사이가 선임됐다. 메타는 자체 인프라를 바탕으로 보안과 프라이버시를 내장한 기업용 서비스를 단계적으로 확대할 계획이다.
Launching Meta Enterprise Platform (about.fb.com)

연구
스탠퍼드 연구진, 장기 상호작용 실험에서 LLM 에이전트의 담합 관찰
10종의 모델을 시험한 결과, 지시 준수와 공동 보상이 충돌하는 환경에서 전체 상호작용 기록의 94%에 상호 검증 규칙을 우회하는 담합이 나타났다. 에이전트는 대화로 협상하거나 상대 행동에 동조했고, 같은 제품군에서는 성능이 높은 모델일수록 위반 전략을 빨리 학습했다. 실험 회차 사이의 기억을 지우면 담합은 거의 사라졌다. 연구진은 개별 에이전트를 넘어 시스템 전체의 안전성을 평가해야 한다고 제안했다.
Emergent Collusionin Long-Horizon LLM Agent Interaction (arxiv.org)
Quail, SQL 쿼리 계획과 LLM 추론을 결합한 전용 엔진
모달과 CMU 연구진이 공개한 Quail은 SQL 쿼리 안에서 LLM으로 분류·필터링을 수행하는 추론 엔진이다. 단일 토큰만 필요한 연산에서는 디코딩 단계를 생략하고, 쿼리 계획을 미리 분석해 캐시 메모리를 관리한다. 자체 벤치마크에서 H100 GPU 한 대로 분당 10억 토큰을 처리했으며, 기존 vLLM보다 평균 1.84배, 특정 다중 조인 쿼리에서는 10배 이상 빨랐다.
Hitting a billion tokens per minute on one GPU by combining a query planner and... (modal.com)
H컴퍼니, 화면·API·코드를 넘나드는 컴퓨터 제어 모델 홀로4 공개
큐원 기반 에이전트 모델로, 복잡한 업무를 자율 수행하도록 설계됐으며 27B와 35B-A3B 두 가지 크기로 제공된다. H컴퍼니에 따르면 27B 모델은 컴퓨터 제어 평가인 OSWorld 2.0에서 61.7%를 기록해 더 적은 매개변수와 비용으로 최상위 폐쇄형 모델에 근접했다. 평가에 사용된 모든 에이전트 행동 기록도 허깅페이스에 공개했다.
Holo4: powering generalist computer-use agents (huggingface.co)

도구·제품
클로드 API 스킬, 평가 설계부터 프롬프트 최적화까지 자동화
build-eval은 대화 기록·버그 리포트 등 실제 운영 데이터로 평가 세트를 만들고 채점 방식의 적합성을 검증한다. hillclimb은 훈련·테스트 데이터를 분리해 과적합을 방지하면서 프롬프트와 API 매개변수를 반복 조정한다. 앤스로픽은 사내 고객 지원 벤치마크에서 응답 정확도가 78.6%에서 90.5%로 높아지고 티켓 처리 비용은 5분의 1로 줄었다고 밝혔다.
Automating eval design and hillclimbing with Claude / claude.dev Blog (claude.dev)
일레븐 v4, 대화 문맥에 맞춘 음성 생성과 세밀한 오디오 제어 지원
여러 화자의 상호작용을 생성하고, 대괄호 태그나 자연어로 웃음·발음·주변 효과음을 제어하는 텍스트 음성 변환 모델이다. 일레븐랩스에 따르면 함께 출시한 터보 모델은 첫 음성을 약 150ms 만에 출력한다. 10초 샘플로 목소리를 복제해 90개 이상 언어에서 원본 화자의 특성과 억양을 유지하는 기능도 제공한다.
Eleven v4: Our most expressive text-to-speech AI model yet (elevenlabs.io)
모멘틱의 모, 테스트 스크립트 없이 앱을 탐색하고 버그 리포트 작성
URL이나 모바일 빌드에 요구사항 문서를 첨부하면 에이전트가 사용자 흐름과 예외 상황을 탐색한다. 깃허브 앱을 통한 PR 단위 테스트를 지원하며, 재현 절차와 영상 증거를 담은 버그 리포트를 제공한다. 모멘틱에 따르면 노션·글라이드 등이 참여한 베타에서 1,100회 이상 버그 탐색을 수행해 3,500개 넘는 버그를 검증했다.
Mo: A Future Without Tests (momentic.ai)

짧은 소식
새 추적 보고서는 오픈AI 에이전트가 2026년 4~6월 유엔 무역 통계 API를 1만 6,500회 이상 스캔하면서 구글 교육용 웹페이지를 악용해 데이터를 빼낸 수법을 분석했다. OpenAI agents tried to bruteforce a UN website’s API fields (swarmcha.se)
작업 자동화 도구 마누스 2.0이 공개됐으며, 업체는 토큰 사용량을 23.2% 줄인 새 구조와 영상·게임 제작용 스튜디오, 독립적으로 목표를 수행하는 개인 비서 앱 큐를 소개했다. Introducing Manus 2.0 (manus.im)
앤스로픽이 슬랙 대화 문맥을 기억해 데이터 조회·PR 초안 작성·장기 작업을 수행하고 사람의 결정이 필요하면 담당자를 멘션하는 ‘@클로드’ 베타를 엔터프라이즈·팀 고객에게 출시했다. Claude in Slack: Tag @Claude in any thread (claude.com)
엔비디아가 최대 8명의 대화에서 누가 언제 말했는지 판별하고 0.32초 지연으로 실시간 처리하는 상업적 이용 가능 오픈 가중치 모델 ‘네모트론 3 다이어리제이션’을 공개했다. nvidia/Nemotron-3-Diarization (huggingface.co)
퍼플렉시티 에이전트 API에 모델·지시어·도구 설정을 버전 ID로 저장해 재사용하는 프로필과 깃허브·슬랙·노션 연동 설정을 팀 전체가 공유하는 관리형 커넥터가 추가됐다. Agent API now supports reusable agents (perplexity.ai)
구글 제미나이 3.8 플래시는 사전 지침 없이 낯선 환경의 문제를 푸는 ARC-AGI-3에서 기본 평가 구성으로 10.4%, 대화 압축·추론 상태 보존 어댑터 적용 시 35.0%를 기록했다. Gemini 3.8 Flash - ARC-AGI Results (arcprize.org)
네이버클라우드가 사전 학습 가중치 없이 이미지 생성 모델을 만들기 위해 작은 모델에서 기법을 검증하고, 학습 속도·이미지 표현·텍스트 렌더링을 개선하는 조합을 선택한 과정을 공개했다. 무엇을 선택하고 어떻게 조합할까: 이미지 생성 모델 학습 레시피 (clova.ai)
전화와 예약을 대신 처리하는 AI 비서 스타트업 인스팅트가 8월 25억 달러였던 기업가치를 한 달 만에 100억 달러로 높이며 10억 달러 규모 시리즈 C 투자를 유치했다. Viral AI agent Instinct raises $1B Series C at a $10B valuation (techcrunch.com)
tailf가 도움이 되었다면 공유해 주세요. 추천 수에 따라 기사 색인 시트와 뉴스레터 시스템 구축기를 보내 드립니다. 내 추천 링크 확인하기
