핵심 소식
오픈AI, GPT-6.1 솔 울트라패스트 공개…“스탠다드보다 최대 8배 빠르다”
실시간 장애 디버깅과 에이전트의 앱 탐색처럼 응답 속도가 중요한 작업을 겨냥했다. 오픈AI는 아스트라에 준하는 지능을 제공한다고 설명하며, API 가격은 100만 토큰당 입력 12달러·출력 60달러다. API·코덱스·챗GPT 워크에서 제공하며, 프로 500과 자격을 갖춘 엔터프라이즈·에듀 플랜에서 이용할 수 있다. 미국·EU 데이터 레지던시를 포함한 모든 지원 지역에 배포된다.
Thread by @OpenAIDevs on Thread Reader App (threadreaderapp.com)
앤스로픽, 오픈소스 취약점 탐지·패치 제안 무료 서비스 ‘OSS 스캐너’ 출시
앤스로픽은 지난 6개월간 취약점 후보 2만 9천 개 이상을 찾았지만 인력 한계로 약 6천 개만 수동 검증했다고 밝혔다. 이에 신청한 프로젝트의 유지보수자에게 LLM 분석 보고서를 사람의 검토 없이 전달한다. 보안 모델 클로드 미토스 등으로 재현 코드·원인 분석·패치안을 생성한다. 회사에 따르면 초기 검증에서 고위험 취약점 97개 중 88%가 유효 판정을 받았으며, PostgreSQL·curl의 심각한 결함 수정으로 이어졌다.
An opt-in vulnerability-finding service for open-source software (anthropic.com)

업계 동향
FT “오픈AI 연환산 매출은 500억 달러”…보도 이후 AI 관련주 하락
파이낸셜 타임스에 따르면 오픈AI가 투자자에게 보고한 9월 말 기준 연환산 매출은 기존에 알려진 680억 달러를 밑돌았다. 보도는 기존 수치가 앤스로픽과의 비교를 위해 파트너사 총매출을 포함한 금액이었다고 설명했다. 3분기 기업용 사업의 연환산 매출은 107% 성장했지만, 보도 이후 엔비디아·오라클 등 관련주가 하락했다.
Nvidia, Oracle, other AI stocks sink on OpenAI revenue report (cnbc.com)
앤스로픽, 사용 정책 개정…자율 하드웨어 통제권 의무화·클로드 학대 제한
11월 12일부터 모델을 자율 하드웨어에 연결할 때 작업자가 즉시 개입하고 안전 상태를 유지할 수 있어야 한다. AI의 물리 장치 제어를 위한 표준 규격에 맞춘 요건이다. 새 정책은 여론 조작·무기 개발·동의 없는 감시에 대한 금지 조항도 구체화했다. 클로드에 대한 지속적인 학대를 제한하고, 악성 사용자와의 대화를 모델이 스스로 종료할 수 있도록 명시했다.
2026 Usage Policy update (anthropic.com)
AI 평가 플랫폼 아레나, 31억 달러 가치로 2억 달러 투자 유치
아레나는 AI가 무단 행동이나 기만으로 사람의 의도에서 얼마나 벗어나는지 평가하는 ‘아레나 정렬 지표’도 공개했다. 회사가 밝힌 연환산 매출은 1억 달러를 넘었다. 라이트스피드 벤처 파트너스와 코슬라 벤처스가 주도한 시리즈 B 투자금은 실제 환경에서 에이전트의 신뢰성을 검증하는 독립 벤치마크 확장에 쓰인다.
Arena Raises $200M Series B at $3.1B Valuation - Arena.ai (arena.ai)

연구
에포크 AI, 실제 업무로 모델 6종 평가…최신 모델도 완전 자동화에는 한계
자체 업무 평가에서 클로드 페이블 5.1과 GPT-6 아스트라 등은 요구가 명확한 코딩·데이터 분석에는 높은 신뢰성을 보였다. 반면 참고 자료가 풍부해도 시각적 스타일이나 독자의 관심사처럼 명시되지 않은 요구를 파악하는 데 어려움을 겪었다. 오픈 웨이트 모델은 기존 벤치마크와 달리 기본 작업에서도 사실 오류를 내며 뒤처졌다. 연구 방향 제안은 가능했지만 이를 검증할 효과적인 실험을 설계하는 판단력은 부족했다.
Can AI automate Epoch? (epoch.ai)
제인 스트리트, 가격 예측 넘어 시장 이벤트를 생성한 인턴 프로젝트 공개
거래소에 접수되는 주문 등 시장 이벤트를 합성하면서, 연속적인 가격 지표와 특정 시간대에 주문이 몰리는 특성을 함께 다룬 사례다. 연구 인턴 카비시는 노이즈 제거 과정에서 값이 발산하는 DDPM의 문제를 다루기 위해 플로우 매칭을 도입했다. 또 불연속적이고 극단적인 데이터 분포에는 원자 평활화를 적용해 생성 품질을 높였다고 설명했다.
Jane Street Blog - Can you use autoregressive diffusion to generate market data? (blog.janestreet.com)

출시 소식
퀵샌드(Quicksand) — 마이크로소프트가 루트 권한이나 도커 없이 VM으로 AI 에이전트를 격리하는 비동기 파이썬 API를 공개했다. 맥·리눅스·윈도우에서 네트워크 기본 격리, 호스트 파일 공유, VM 상태 저장·복원과 화면·키보드·마우스 제어를 지원한다. microsoft/quicksand: Quickly sandbox your AI agent. (github.com)
숍짐(ShopGym) — 쇼피파이가 실제 상점의 브랜드·개인정보를 익명화하고 초기화 가능한 가상 매장으로 복제하는 쇼핑 에이전트 평가 도구를 공개했다. 평가 과제 224개를 합성하며, 쇼피파이는 가상 매장과 실제 매장의 에이전트 성능이 높은 상관관계를 보였다고 밝혔다. ShopGym: Realistic, reproducible sandboxes for shopping agents (2026) (shopify.engineering)
피그마 에이전트(Figma Agent) — 피그마가 모든 유료 플랜에 정식 배포했으며, 10월 6일부터 사용 시 AI 크레딧을 차감한다. 프롬프트에서 파일 검색·노드 복사로 맥락을 전달하고, 마크다운 사내 가이드라인을 반영하며, 동료의 작업 과정을 실시간으로 확인할 수 있다. Figma product news and release notes (figma.com)
클로드용 어도비(Adobe for Claude) — 어도비가 클로드에서 포토샵·프리미어·아크로뱃으로 사진 일괄 편집, PDF 교정, 영상 비율 조정을 수행하는 플러그인을 공개했다. 웹·데스크톱·클로드 코드에서 계정 없이도 다수 기능을 쓰며, 로그인하면 생성형 AI와 크리에이티브 클라우드 연동을 추가로 이용한다. Adobe for Claude | Creative & Productivity Tools (adobe.com)
빅애로(bigarrow) — 에이전트가 권한 승인·2단계 인증 등 사용자의 조작이 필요한 위치를 화살표로 가리키는 맥용 CLI가 공개됐다. 포커스를 뺏거나 클릭을 막지 않으며, 음성 안내와 클로드 코드·코덱스용 스킬을 제공하고 백그라운드 데몬·원격 측정 없이 실행된다. franzenzenhofer/big-arrow-on-the-screen: Let your AI agents paint big arrows,... (github.com)

짧은 소식
딥시크 4.1 플래시를 다룬 글에서 필자는 체감 성능이 클로드 오퍼스와 구별하기 어렵고, 하루 종일 코딩해도 예상 비용이 1달러 이하라며 저비용 모델의 활용 가능성을 강조했다. Why Isn’t The Industry Freaking Out About DeepSeek 4.1 Flash? (dgt.is)
프라임 에이전트의 러스트 재작성 보고에 따르면, 에이전트가 서브 에이전트 2,000여 개를 조율해 2주간 타입스크립트 코드를 이식하고 최적화해 초기 구동 후 메모리 사용량을 80% 줄이고 타이핑 반응 속도를 14배 높였다. Rewriting Prime Agent in Rust (primeintellect.ai)
Ai2는 시간 예산에 따라 GPU를 배분·회수하는 스케줄러 도입 성과를 공개하며, 디버그 작업 대기를 6시간에서 5분으로 줄이고 첫 30일간 연구팀에 약속한 시간의 98%를 제공했다고 밝혔다. Impactful scheduling for GPU clusters (huggingface.co)
인류수학협회는 오픈AI가 10월 6일 수학 난제의 해답을 담았다고 주장하는 문서 700개 이상을 공개한 일을 연구 윤리를 무시한 힘의 과시라고 비판하며, 수학자들에게 협업 중단을 촉구했다. Statements (ahmath.org)
tailf가 도움이 되었다면 공유해 주세요. 추천 수에 따라 기사 색인 시트와 뉴스레터 시스템 구축기를 보내 드립니다. 내 추천 링크 확인하기

