핵심 소식
클로드 페이블 5, 저렴한 대안에 밀려 기업 시장 확산 부진
결제 플랫폼 램프(Ramp) 데이터 기준, 출시 두 달 만에 앤스로픽 전체 기업 지출에서 클로드 페이블 5가 차지하는 비중은 11%에 불과하다. 고난도 작업에만 프리미엄 모델을 투입하고 일상 워크플로에는 클로드 오퍼스 4.8이나 딥시크 같은 가성비 모델을 혼용하는 기업이 대다수다. 오픈AI마저 GPT-5.6 루나 이용료를 80% 인하한 가운데, 기업의 AI 도입 기준이 절대 성능에서 총소유비용 최적화로 뚜렷하게 이동하고 있다.
Subscribe to read (ft.com)
엔비디아, GPU 수요 둔화에 대비해 Poolside에 70억 달러 투자
기술 라이선스와 핵심 인력 영입에 60억 달러, 지분 투자에 10억 달러를 배분하며 코딩 에이전트 개발사의 역량을 통째로 흡수했다. 확보된 역량은 자체 오픈 웨이트 모델 Nemotron의 에이전트 구동 능력 강화에 집중 투입되며, 오픈AI·앤스로픽과 직접 경쟁하는 모델 생태계 구축이 목표다. 샘 알트먼 역시 AI의 경제적 파급 속도가 예상보다 느릴 것이라 시인하면서 수요 둔화에 대비하는 이번 행보에 설득력을 더했다.
NVIDIA Becomes A Buyer Of Last Resort For Its Own GPUs By Earmarking $7 Billion... (wccftech.com)
허깅페이스, 130억 달러 이상 가치로 매각 타진
투자 은행을 통해 잠재적 인수자의 관심을 파악하는 초기 단계로, 확정된 계약은 아직 없다. 300만 개 이상의 AI 모델과 100만 개 이상의 데이터셋을 호스팅하는 이 플랫폼을 인수하면 개발자 워크플로에 직접 접근할 수 있지만, 구글·아마존·엔비디아 등 경쟁사가 투자자로 참여해 온 생태계 중립성이 변수다. 최근 스트라이프의 오픈라우터 80억 달러 인수에 이어 AI 인프라 중간 계층 기업의 몸값이 가파르게 오르고 있다.
Hugging Face explores a $13B sale, nearly triple its 2023 valuation (runtimewire.com)
업계 동향
메타, 수익화 겨냥한 AI 에이전트 플랫폼 ‘Hatch’ 출시 예고
디 인포메이션이 입수한 내부 문서에 따르면, 수주 내 공개될 Hatch는 OpenClaw 기반으로 DoorDash·Reddit·마이크로소프트 Outlook 등 외부 서비스와 직접 상호작용하도록 훈련되었다. WhatsApp 내에서 서드파티 AI 에이전트를 연결하는 기능도 소규모 테스트에 착수했다. 메타는 10월 신규 모델 ‘Watermelon’까지 잇달아 공개하며 AI 수익화에 속도를 낼 계획이다.
Meta Reportedly Set To Roll Out ‘Hatch’ AI Agent Platform And New ‘Watermelon’... (stocktwits.com)
알리바바·텐센트, 2분기 AI 인프라에 약 25조 원 집중 투자
알리바바의 2분기 자본 지출은 컴퓨팅 자원 확장과 칩 단가 상승 여파로 전년 동기 대비 75% 급증한 약 14조 원을 기록했다. 우융밍 CEO는 AI 컴퓨팅 부족이 장기화할 것으로 보며 알리바바 클라우드 투자금을 3년 내 회수할 수 있다고 전망했다. 대규모 지출로 양사의 잉여현금흐름이 나란히 적자로 돌아섰지만, 텐센트 역시 컴퓨팅 자원 임대의 명확한 수익성을 강조하며 투자를 지속할 방침이다.
Alibaba, Tencent Pour $18 Billion Into AI in Second Quarter - Seoul Economic... (en.sedaily.com)
딥시크 등 오픈소스 AI 악용한 중국 해커 조직, 사이버 공격 2배 이상 확대
대만 보안 기업 팀T5에 따르면, 중국 정부 지원 해킹 그룹이 AI로 단순 작업을 자동화하고 고급 악성 소프트웨어를 개발하면서 공격 건수가 2배 이상 증가했다. 사용된 모델을 항상 특정할 수 있는 것은 아니나, 높은 성능과 맞춤 설정 기능 덕분에 딥시크가 특히 널리 활용되는 것으로 파악된다. 기본적인 오픈소스 AI 도구만으로도 국가 지원 사이버 위협의 범위가 빠르게 확장될 수 있음을 보여주는 사례다.
China’s Hackers Use DeepSeek for Attacks, Researchers Say (bloomberg.com)
연구
FreeToken: 개인용 기기에서 대규모 AI 모델을 구동하는 엣지 서빙 시스템
데이터센터에 의존하던 수백억~수천억 매개변수 규모 모델의 추론을 일반 노트북과 게이밍 데스크톱 환경으로 가져왔다. PCIe 전송과 CPU 연산을 자동 조율하는 대역폭 적응형 실행과, 자주 참조되는 문맥을 의미 단위로 재활용하는 캐싱을 도입해 에이전트 워크로드에서도 쾌적한 속도를 유지한다. 기존 엣지 시스템 대비 디코드 처리량을 최대 2.3배 높였으며, 단일 워크스테이션 GPU로 753B 규모 GLM-5.2 모델 구동에 성공했다.
FreeToken: Efficient Edge-Native MoE Serving with Bandwidth-Adaptive Execution (arxiv.org)
톰슨 로이터 ‘톰슨 LLM’, 최상위 범용 모델의 사실성 한계를 넘다
임페리얼 칼리지 런던과 메타 FAIR가 공동 개발한 오픈 가중치 모델을 기반으로, 175년치 독점 법률 데이터 중 10% 미만을 선별해 지속 사전 학습에 투입했다. 도메인 특화 과정에서 범용 지시 수행 능력이 저하되지 않도록 설계한 점이 핵심이며, 사내 법률 전문가가 엄격한 평가 기준과 선호도 데이터를 직접 구축했다. 그 결과 클로드 오퍼스 4.8과 GPT-5.5를 제치고 월등히 높은 출처 사실성 점수를 달성했다.
How we built Thomson - Thomson Reuters Institute (thomsonreuters.com)
117억 토큰 규모 보안 벤치마크에서 폐쇄형 모델을 압도한 딥시크
최근 공개된 32개의 실제 코드 취약점을 대상으로 딥시크 V4 Pro는 3회 반복 탐색을 통해 28개를 찾아내며 최고 성적을 거두었다. Qwen·Kimi·GLM-5.3 등 다른 오픈소스 모델도 주요 폐쇄형 모델보다 더 많은 취약점을 발견했다. 딥시크 V4 Pro의 3회 탐색 비용은 약 295달러로 효율적이었지만, 오픈소스 모델 전반에서 오탐지가 더 많이 발생하는 단점도 확인되었다. 단일 탐색보다 다중 반복 실행이 취약점 발견율을 극대화하는 핵심 전략임을 시사한다.
We burned 11.7bn tokens to find the best cyber AI model (aikido.dev)
도구·제품
Flux TTS, 대화 전체 문맥을 파악하는 초저지연 음성 합성 모델
최소 80ms 응답 속도로 대화 시작부터 끝까지 문맥을 이어가며 일관된 목소리를 유지한다. API가 상태 머신으로 작동해 별도 개발 없이 사용자의 대화 개입(barge-in)을 자체 처리한다. 약 1만 4천 건의 블라인드 평가에서 카르테시아, 제미나이 2.5 플래시, 오픈AI GPT Realtime을 제치고 음성 품질·표현력 1위를 차지했으며, 2026년 9월 12일까지 최대 45개 동시 스트리밍을 무료로 제공한다.
Deepgram Flux TTS: Conversation-Aware Text-to-Speech (deepgram.com)
Is Agentic, 웹사이트의 AI 에이전트 친화도를 점수화하는 진단 도구
서버 렌더링 콘텐츠, 문서 구조, API, MCP 서버 지원 여부 등을 종합 검사한다. 테스트 에이전트가 사이트 탐색 중 겪은 마찰 구간과 구체적인 해결책을 진단 보고서로 제공하며, 결과는 마크다운·JSON API·전용 MCP 서버 형태로도 출력되어 자동화 워크플로에 바로 통합할 수 있다.
Is Agentic: AI Agent Readiness Score for your Site and App (is-agentic.com)
USB, 16개 에이전트 런타임을 지원하는 범용 스킬 포맷
클로드 코드의 스킬이나 커서의 룰처럼 런타임마다 다르게 작성해야 하던 기능을 단일 마크다운 문서로 통합하고, 대상 환경의 네이티브 포맷으로 자동 컴파일한다. 500개 이상의 스킬 카탈로그를 CLI로 검색·설치할 수 있으며, 외부 스크립트 실행 전 SHA-256 해시 검증으로 보안성을 높였다.
PeepSick/usb: USB - Universal Skill Bridge: one portable skill format,... (github.com)
짧은 소식
앤스로픽이 AI로 코딩 단계가 단축되면서 기획·리뷰·배포가 새로운 병목이 된 현실에 맞춰, SDLC 전반을 에이전트 중심으로 재편하는 실무 가이드를 공개했다. The AI-Native SDLC playbook (claude.com)
엔비디아가 에이전트 환경에서 50% 향상된 성능을 내세운 차세대 커스텀 CPU 베라를 공개했으며, 오픈AI가 이번 분기부터 대량 도입할 예정이다. Nvidia details next-generation Vera CPU, in challenge to AMD and Intel (cnbc.com)
앤스로픽이 사이버 방어 모델 ‘클로드 Mythos 5’를 엔터프라이즈 플랫폼에 통합하고, 오픈소스 보안 강화를 위한 3,500만 달러 규모의 디펜더 어드밴티지 펀드를 출범했다. Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders (claude.com)
오픈AI GPT-5.6 제품군이 AWS의 에이전트 기반 개발 환경 Kiro에 탑재되어, 터미널 벤치 2.1 테스트에서 비용을 약 82% 절감하면서도 작업을 성공적으로 완수했다. Advancing price-performance for developers with GPT‑5.6 in Kiro (openai.com)
캘리포니아주에서 AI의 단독 해고·징계를 금지하고 반드시 인간의 검토를 거치도록 의무화하는 ‘로보 보스 방지법(SB 947)’이 재발의되었다. McNerney Introduces No Robo Bosses Act of 2026 to Ensure Human Oversight of AI... (sd05.senate.ca.gov)
익명 모델 Ox Alpha가 코딩 에이전트 오픈코드를 통한 무료 프리뷰에서 4일 만에 26조 토큰을 처리하며 오픈라우터 역대 최대 출시 기록을 경신했다. Anonymous Ox Alpha processes 26T tokens on OpenCode, breaks OpenRouter launch... (runtimewire.com)





