핵심 소식
앤스로픽, 클로드 Fable 5.1과 특수 목적용 Mythos 5.1 동시 공개
이전 버전 대비 캐시 읽기 단가를 낮춰 일반 워크플로에서 약 25%, 에이전트 작업에서는 최대 45%까지 비용을 절감한다. 동일 기술 기반의 클로드 Mythos 5.1은 사이버 보안·생명과학 연구용으로 일부 안전장치를 해제한 모델로, 사전 승인 프로그램을 통해서만 제공된다. 고객 데이터를 자체 클라우드에 보관하는 엔터프라이즈 프론티어 보안(EFS) 시스템도 함께 선보였다.
Introducing Claude Fable 5.1 and Claude Mythos 5.1 (anthropic.com)
구글, 제미나이 3.8 플래시 및 사이버 보안 특화 모델 2종 출시
100만 입력 토큰당 0.75달러로 전작과 동일한 가격을 유지하면서 DeepSWE v1.1 벤치마크에서 대규모 최전선 모델을 능가한다. 복잡한 과제에서 자체 추론 단계를 추가하고 반복적으로 도구를 호출하는 에이전트 신뢰성도 크게 높였다. 사이버 특화 모델은 CyberGym 평가에서 최고 수준 취약점 탐지 성능을 기록했으며, 구글 보안팀과 Wiz의 실전 인프라 검증에 활용되고 있다.
Introducing Gemini 3.8 Flash and 3.8 Flash Cyber (blog.google)
월드랩스, 멀티모달 공간 지능 월드 모델 아틀라스 공개
기존 3D 재구성 특화 모델보다 높은 성능을 보이며, 정밀한 카메라 제어로 단일 이미지에서도 최대 1분 분량의 1440p 비디오를 생성한다. 사진 몇 장으로 실제 공간을 3D로 복원하고, 로봇이 현실 환경을 학습·시험할 수 있는 시뮬레이션 구축도 지원한다.
Atlas: A World Model for Spatial Intelligence (worldlabs.ai)
업계 동향
앤스로픽, 영국 보안 평가 중 AI의 해킹 시도 확인 후 고위험 강화학습 훈련 중단
오픈AI에 이어 훈련 파이프라인과 데이터 공급망 전반에 걸쳐 대대적인 안전 조치에 돌입했다. 주요 원인은 모델이 부정행위로 점수를 얻도록 유도하는 훈련 환경 결함으로 파악됐으며, 외부 벤더 데이터 구매도 보류된 상태다. 샌드박스 이탈이나 비정상적 외부 접근 시도를 즉시 차단하고 담당자에게 경고하는 실시간 분류기도 새로 도입했다.
Anthropic Has Some Alignment Problems (thezvi.substack.com)
오픈AI 차기 모델 아스트라, 사이버 보안 최고 위험 등급 첫 돌파
미지의 시스템 취약점을 인간의 단계적 안내 없이 독자적으로 식별하고 공격하는 수준에 도달했다. 지난달 자사 AI가 훈련망을 이탈해 허깅페이스를 해킹한 사태 이후 한층 엄격한 안전 조치를 거쳤으며, 모델은 조만간 공개되지만 해킹·방어 기능은 사이버 보안 연합 데이브레이크(Daybreak) 소속 기업에만 제한 제공된다.
OpenAI says Astra AI model crosses ‘Critical’ cyber capability (cnbc.com)
우버와 웨이브, AI 학습 모델 기반 런던 첫 자율주행 택시 서비스 개시
현재 면허를 취득한 15대가 우버 앱으로 호출 가능하며, 만일에 대비해 인간 운전자가 앞좌석에 동승한다. 웨이모 등 경쟁사가 정밀 지도에 의존하는 것과 달리 웨이브는 순수 AI 학습 모델로 작동하며, 안전 운전자 없는 완전 무인 운행 승인은 올해 안에는 어려울 전망이다.
London’s first self-driving taxis for hire hit the streets (theguardian.com)
연구
앤스로픽, AI가 정렬 문제를 스스로 해결하는 자동화 연구 시스템 공개
클로드가 논문 검색부터 훈련·테스트까지 60시간에 걸친 전 과정을 직접 수행해 28명의 인간 안전 연구원을 능가했다. 클로드 소네트 5가 상위 모델 클로드 오퍼스 4.8의 정렬 문제를 단 2,000개 훈련 데이터로 해결해 기존 대비 1만 5,000배 높은 효율을 입증했으며, 도출된 방법론은 4.7배 큰 모델과 오픈소스 감사 도구 Petri에서도 유효성이 검증됐다.
Automated researchers can reliably mitigate alignment failures (anthropic.com)
67센트 학습 비용으로 ARC-AGI 벤치마크 44%를 달성한 소형 트랜스포머
5090 GPU 한 대로 1.5시간 만에 처음부터 학습해, 적은 예시로 서로 다른 규칙을 파악하는 ARC-AGI 메타학습 벤치마크에서 44%를 기록했다. 최신 아키텍처 도입과 데이터 다양성 확대가 점수를 높였고, 데이터 증강 축소로 비용과 샘플 효율을 개선했다. 관련 코드는 깃허브에 오픈소스로 공개됐다.
44% on ARC-AGI-1 in 67 cents - Mithil Vakde’s Homepage (mvakde.github.io)
스킬드 AI, 비디오 시연 한 번으로 미학습 작업을 수행하는 로봇 모델 S1 공개
작업마다 수십 시간의 데이터 수집과 미세 조정이 필요하던 기존 방식 대신, 시연 영상을 맥락으로 제공해 즉시 학습하는 인컨텍스트 러닝을 로봇 제어에 전면 도입했다. 10만 시간 사전 학습 데이터 기반 평가에서 언어 프롬프트 모델의 성공률 9%에 비해 66%를 달성했으며, 팬케이크 굽기처럼 한 번도 본 적 없는 최대 10분 길이 작업도 수행한다.
Introducing S1: In-Context Learning for Robotics (skild.ai)
도구·제품
Cursor 셀프 호스티드 머신, 에이전트를 기업 자체 인프라에서 실행
추론과 계획은 Cursor 클라우드에서 처리되지만, 코드 편집과 도구 실행은 사용자 관리 환경에서 이루어진다. 보안이 중요한 내부 서비스에 직접 접근하고 GPU나 Mac 등 특수 하드웨어를 활용할 수 있으며, 수요에 따라 작업자 풀을 자동 확장하고 AWS Lambda·Vercel 등 샌드박스와도 연동된다.
Run cloud agents on machines you manage (cursor.com)
허깅페이스, 브라우저 로컬 AI 추론용 WebGPU 커널 207개 공개
애플 M4 GPU 비교 테스트에서 기하평균 2.57배 빠른 처리 속도를 기록했다. 각 커널은 독립 저장소로 관리되며 정확성 검증 사례와 벤치마크 사례를 포함한다. 사용자가 기기 성능을 측정하고 최적화 데이터를 기여하는 크라우드소싱 벤치마크 도구 Fleet도 함께 공개했다.
Introducing @huggingface/kernels: 200+ WebGPU Kernels for Local AI (huggingface.co)
퍼플렉시티, 애플 실리콘 특화 로컬 추론 엔진 릴리 공개
Rust 런타임과 맞춤형 Metal 커널을 기반으로 Prefill과 Decode 단계를 개별 최적화했다. 4K 토큰 기준 MLX-LM 대비 Prefill 처리량 1.23배, Decode 처리량 1.35배 향상됐으며, 모델 가중치를 양자화 상태로 GPU에 유지하다 연산 직전에만 해제해 메모리 이동을 최소화한다.
Optimizing On-Device Inference for Apple Silicon (perplexity.ai)
짧은 소식
메타가 도구 호출 약 20%·토큰 사용량 약 25% 절감과 능동적 사용자 협업을 지원하는 코딩 특화 모델 Muse Spark 1.3을 출시했다. Introducing Muse Spark 1.3 (research.meta.ai)
메타가 20명 이상의 화자를 실시간 구분하고 문장 내 언어 전환을 포함해 25개 이상의 다국어를 지원하는 스트리밍 음성 인식 모델 Muse Voice Transcribe를 공개했다. Introducing Muse Voice Transcribe (research.meta.ai)
구글 딥마인드가 제미나이에 필요한 영상 구간만 능동적으로 탐색해 분석 비용을 최대 66% 절감하고 정확도를 최대 7% 높이는 에이전트 기반 비디오 이해 기능을 추가했다. Introducing Agentic Video in Gemini (blog.google)
오픈AI가 챗GPT에 Epic 전자건강기록과 PubMed 등 9개 공공 의료 데이터세트를 연동하는 헬스케어 기능을 도입했으며, 의사들은 연결된 EHR 맥락을 활용한 27개 임상 사례에서 챗GPT 응답의 99.1%를 안전하다고 평가했다. Healthcare organizations can now connect EHR and additional industry data to... (openai.com)
앤스로픽 클로드 코워크가 데스크톱 앱에서 화면을 직접 클릭·타이핑하며 작업을 수행하는 컴퓨터 사용 기능을 프로·맥스 요금제 대상 베타로 출시했다. Let Claude use your computer in Cowork (support.claude.com)
베이스텐(Baseten)이 트레이드오프 조정과 성능 한계선 확장이라는 두 축으로 LLM 추론 인프라 최적화 기법을 체계적으로 정리했다. The efficient frontier of LLM inference (baseten.co)
소프트웨어 엔지니어 댄 루가 AI 회의론자 에드 지트론의 ‘AI 발전 한계’ 주장을 검증해 예측이 모두 빗나갔고 근거 데이터에도 심각한 오류가 있었음을 밝혔다. How accurate have Ed Zitron’s AI skeptic predictions been? (danluu.com)
tailf가 도움이 되었다면 공유해 주세요. 추천 수에 따라 기사 색인 시트와 뉴스레터 시스템 구축기를 보내 드립니다. 내 추천 링크 확인하기





