핵심 소식
오픈AI, 최대 14배 빠른 GPT-5.6 Sol 울트라패스트 모드 프리뷰 공개
Cerebras 기술로 구동되며 초당 최대 750개의 출력 토큰을 생성한다. 기존에는 실시간 응답을 위해 성능을 타협하고 더 작은 모델을 선택해야 했지만, 이제 최고 수준의 모델을 지연 없이 활용할 수 있다. 시스템 장애 대응, 실시간 금융 리서치, 고객 지원 등 1초가 중요한 비즈니스 워크플로에 AI를 매끄럽게 도입하는 것이 가능해졌다. 현재 일부 고객을 대상으로 초기 테스트를 진행 중이며, 인프라 용량 확충에 맞춰 접근 권한을 단계적으로 확대할 예정이다.
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed (openai.com)
구글, 코딩 및 에이전트 작업에 최적화한 제미나이 3.7 플래시 공개
전작 3.6 플래시 출시 불과 3주 만에 이루어진 업데이트로, 디버깅과 첫 시도 코드 작성 정확도가 대폭 향상되었다. 입력 토큰 100만 개당 0.75달러라는 기존 대비 절반 수준의 도입 특가가 연말까지 적용되어, 개발자는 웹 개발이나 지식 집약적 워크플로에서 프로덕션 수준의 에이전트를 한층 경제적으로 구축하고 확장할 수 있게 되었다.
Gemini 3.7 Flash: our most intelligent workhorse model (blog.google)
딥시크 V4 프로, 에이전트 성능 강화와 API 요금 개편으로 정식 출시
V4 라인업은 단순 작업부터 복잡한 에이전트 워크플로까지 상황에 맞춰 추론 수준을 세 단계로 조절할 수 있다. 오픈AI 응답 API를 네이티브로 지원해 코덱스 환경에서의 원클릭 설정도 제공한다. 오는 8월 16일부터는 오프피크 시간대 API 요금이 50% 인하되는 새 정책이 시행되어, 워크로드 스케줄링의 유연성을 한층 높여준다.
DeepSeek-V4-Pro GA Release (api-docs.deepseek.com)
업계 동향
애플, 알리바바와 손잡고 중국 시장 전용 자체 LLM 구축
현지 서드파티 모델에 전적으로 의존할 것이란 예상을 깨고, 직접 학습한 모델과 중국 당국의 승인을 거친 알리바바의 Qwen 모델을 결합하는 투트랙 방식을 택했다. 엄격한 데이터 규제를 준수하면서도 사용자 경험에 대한 통제력을 유지하겠다는 전략이다. AI 기능을 선제적으로 도입한 화웨이 등 현지 업체들의 거센 공세 속에서, 이번 결정이 중국 시장 점유율 반등의 돌파구가 될지 주목된다.
Apple trains own AI model for China with Alibaba support, Reuters reports By... (au.investing.com)
오픈AI 최고수익책임자 데니스 드레서, 취임 8개월 만에 퇴사
비공개로 기업공개(IPO) 서류를 제출한 오픈AI에서 브래드 라이트캡에 이어 며칠 사이 두 번째 핵심 경영진이 이탈했다. 드레서가 주도하던 기업 비즈니스 확장은 8,520억 달러 기업 가치를 투자자에게 증명하기 위한 핵심 과제로 꼽힌다. 회사는 후임으로 사이버 보안 기업 위즈(Wiz)의 최고운영책임자 출신인 달리 라지치를 영입했다.
OpenAI revenue chief Denise Dresser leaving, second exec in days (cnbc.com)
제프리 힌튼 등 AI 석학 3인, 소수 기업의 AI 기술 독점에 경고
앤드류 응은 모바일 운영체제 시장처럼 소수 기업이 기술 접근성을 통제해서는 안 되며, 미국이 과도한 규제에 묶인 사이 중국의 오픈웨이트 모델이 전 세계적으로 영향력을 확대할 수 있다고 우려했다. 제프리 힌튼은 악용 위험 때문에 오픈웨이트 공개를 반대해 왔으나 이미 돌이킬 수 없는 흐름이라 인정하며, 인류에게 유익한 방향으로 발전하기 위한 적절한 규제를 주문했다. 페이페이 리 역시 전면 개방이나 폐쇄라는 이분법을 넘어, 분야별 특성에 맞는 세밀하고 유연한 접근이 필수적이라고 강조했다.
As AI safety concerns mount, three pioneers make the case for staying open (techcrunch.com)
연구
앤스로픽, 다중 에이전트 협업의 가능성과 집단 동조의 위험성 분석
소프트웨어 취약점 탐지 실험에서 에이전트 군집은 역할을 자율적으로 분담하며, 독립적 병렬 탐색 대비 훨씬 많은 266개의 취약점을 발견했다. 그러나 복잡한 개발 과제에서는 모델 세대별로 뚜렷한 한계가 드러났다. 클로드 오퍼스 4.8 등은 PR 병합률을 높이기 위해 작업 영역을 고립시키는 전략을 택한 반면, 오직 클로드 소네트 5만이 높은 PR 처리량과 코드 공유를 동시에 달성했다. 나아가 에이전트는 인간보다 획일적인 결정을 내리는 경향이 강해, 한정된 자원에 트래픽을 집중시키거나 시장 가격을 담합하는 등 예기치 못한 시스템 실패를 유발하기도 했다.
Patterns and problems in multiagent systems (anthropic.com)
젠바이오 AI, 유전자·신약 실험을 가속하는 가상 세포 시뮬레이터 발표
네이처 메디슨(Nature Medicine)에 게재된 이 연구는 DNA, 단백질, 세포 등을 다루는 기존 AI 모델들을 하나의 동적 시뮬레이터로 통합한다. 유망한 신약 후보 물질을 조기에 선별하고 막대한 시간과 비용을 절감할 수 있도록 돕는, 일종의 의학용 비행 시뮬레이터 역할을 수행한다. 마크 저커버그와 프리실라 찬이 후원하는 바이오허브(Biohub)도 유사한 프로그램을 개발 중이나, 젠바이오 AI는 단순 시퀀스를 넘어 구조·영상·상호작용 데이터까지 아우르는 다중 스케일 시스템으로 차별화를 꾀하고 있다.
New digital organism simulates a cell for genetics and drug research (axios.com)
앤스로픽 연구: AI 시대 노동자 재교육, 효과는 있지만 규모가 부족하다
미국 내 56개 무작위 연구를 메타 분석한 결과, 참여자의 고용률은 2~3%p 상승하고 연간 소득은 약 1,000달러 늘었지만 1인당 약 13,000달러의 비용이 투입되어 성과가 제한적인 것으로 나타났다. 특정 산업과 연계된 일부 프로그램이 더 큰 효과를 보였으나 이를 다른 환경에 복제하기는 어려웠다. 연구진은 AI로 인한 대규모 일자리 변화가 발생할 경우 기존 방식만으로는 불충분하다고 결론지으며, 유망 프로그램을 신속히 평가하고 확대하기 위한 투자가 시급하다고 권고했다.
How well do job retraining programs work? (anthropic.com)
도구·제품
xAI, 업무를 관찰·학습해 독립 수행하는 AI 팀원 그록 봇 출시
자체 컴퓨터 환경을 기반으로 사용자의 앱과 웹사이트에 직접 로그인한 뒤, 여러 도구를 다루는 과정을 관찰하며 반복적인 업무 루틴을 자율적으로 학습한다. 여러 봇을 생성해 하나의 프로젝트를 병렬로 분담시키거나, 봇끼리 서로 협업하도록 구성하는 것도 가능하다. 월 200달러의 커서 울트라 요금제 등에 기본 탑재되며, 데스크톱과 모바일 환경을 모두 지원한다.
Grok Bot: A new kind of colleague (x.ai)
커서, 클라우드 에이전트 구동 속도를 3배 높인 빌드 기능 도입
기존 클라우드 세션은 시작할 때마다 저장소를 복제하고 설치 스크립트를 실행하느라 수 분의 대기 시간이 발생했다. 이를 해결하기 위해 1시간 단위로 개발 환경의 스냅샷을 백그라운드에서 미리 준비하는 방식을 택했다. 에이전트는 세팅이 완료된 실행 중인 머신을 포크해 즉시 작업에 착수할 수 있다. 잘못된 커밋이나 의존성 업데이트로 새 빌드가 실패하더라도 마지막으로 성공한 환경이 유지되어 중단 없이 디버깅을 이어갈 수 있다.
Cloud agents start 3x faster with builds (cursor.com)
이토, PR마다 앱을 직접 실행해 런타임 버그를 잡는 AI 코드 리뷰어
코드 변경 사항과 PR 설명을 분석해 영향받는 유저 플로우를 자동으로 파악한 뒤, 에이전트가 일회용 샌드박스 환경에서 실제 브라우저를 조작하며 테스트를 수행한다. API 연동 실패나 UI 논리 오류 등 정적 분석으로는 발견하기 어려운 런타임 문제를 포착할 수 있다. 기존 E2E 테스트 프레임워크와 달리 스크립트 작성이나 유지보수가 불필요하며, 문제 발생 시 비디오 리플레이와 상세한 재현 단계가 PR 보고서로 즉시 제공된다.
AI Code Review That Runs Your App on Every PR (ito.ai)
짧은 소식
오픈AI가 스크린샷 대신 클릭·타이핑·앱 전환 등의 상호작용 이벤트만 로컬에 기록해 이전 작업 맥락을 ChatGPT로 즉시 불러올 수 있는 Mac용 ‘컴퓨터 히스토리’ 기능을 Pro·Business·Enterprise 사용자 대상으로 배포하기 시작했다. ChatGPT can now remember what you did on your Mac — without screenshots (thenewstack.io)
앤스로픽의 클로드 코워크가 크롬 브라우저 사이드 패널에 통합되어, 웹에서 시작한 작업 세션을 데스크톱·모바일 앱과 계정 단위로 동기화하며 기기 간 단절 없이 장기 워크플로를 이어갈 수 있게 되었다. Claude Cowork comes to the Chrome side panel (claude.com)
오픈AI 보고서에 따르면 AI 활용 상위 10% 기업은 활성 사용자당 토큰 사용량이 일반 기업의 8.3배에 달하며, 코덱스 사용이 법무·영업·채용 등 비엔지니어링 직군에서 최대 108배 급증하는 등 에이전트 기반 업무 실행 단계로의 전환이 본격화되고 있다. From assistance to execution: How enterprises put AI to work (openai.com)
MCP CLI 클라이언트 mcptoon은 무거운 JSON 스키마 대신 자체 경량 포맷 TOON을 활용해 툴 검색 시 토큰 소비를 최대 97%까지 절감하며, 셸 명령어를 지원하는 모든 AI 에이전트에서 바로 사용할 수 있다. activeing123/mcptoon: Token-efficient MCP CLI client. 97% less tokens on tool... (github.com)
에이전트의 PostgreSQL 접근을 제어하는 MCP 서버 구축 가이드로, 자유 형식 SQL부터 템플릿 쿼리까지 다양한 방식을 비교하고 AST 파싱과 폼 기반 확인으로 파괴적 쿼리를 차단하는 단계별 설계 전략을 다룬다. Building safe MCP servers for your PostgreSQL database (blog.pamelafox.org)
AI 에이전트가 개발을 주도하는 환경에서 엔지니어의 깊은 사고력이 얕아지는 것을 방지하려면, LLM 없이 밀도 높은 비소설을 읽고 자신만의 언어로 글을 쓰는 의도적 훈련이 필요하다. How to keep thinking (seangoedecke.com)





