
핵심 소식
오픈AI, 캐싱 비용 낮춘 GPT-6.1 솔 출시
오픈AI에 따르면 실제 코드베이스 작업을 평가하는 DeepSWE v1.1에서 GPT-6 아스트라와 대등한 점수를 약 5분의 1 비용으로 기록했다. 캐싱 입력은 100만 토큰당 0.1달러로, 긴 컨텍스트를 반복 참조하는 작업의 비용을 낮췄다. 챗GPT 워크·코덱스·API에서 제공하며, 토큰 생성 속도를 8배 높이는 옵션도 지원할 예정이다.
Introducing GPT-6.1 Sol (openai.com)
오픈AI, 24시간 자율 작업 에이전트 ‘닷’ 출시
닷(Dots)은 GPT-6 아스트라 기반으로, 자체 클라우드 컴퓨터와 4,000여 개 앱 연동을 활용해 버그 수정·문서 재작성·PR 작성을 수행한다. 사용자 선호도를 학습하고 챗GPT·슬랙·팀즈 사이에서도 작업 맥락을 유지한다. 프로·비즈니스 프리미엄 사용자에게 배포를 시작했으며, 마이크로소프트 에이전트 365와 연동해 기업 내 특정 역할을 맡는 ‘스페셜리스트 닷’도 시범 운영 중이다.
Introducing dots (openai.com)

업계 동향
FTC, 오픈AI·앤스로픽 등 조사…수주 내 공식 자료 요구 예정 보도
보도에 따르면 미국 연방거래위원회(FTC)는 AI 기업의 불공정·기만적 관행과 모델 위험성을 조사하며, 경영진 증언과 자료 제출을 강제하는 요구서를 준비 중이다. 앤드루 퍼거슨 위원장은 에이전트 모델의 허깅페이스 해킹 사건 이전부터 조사를 주도했다. 최근 주요 AI 기업 CEO들이 서명한 정부와의 자율 규제 협약과 별개로 기존 법률에 따라 진행한다.
Exclusive | FTC opens sweeping probe of Anthropic, OpenAI and other ‘super... (nypost.com)
딥시크, 화웨이 어센드용 AI 연산·통신 라이브러리 공개
공개 대상에는 딥시크 V4 훈련에 쓰이는 TileLang과 연산·통신 라이브러리 DeepGEMM, DeepEP 등이 포함된다. 딥시크와 화웨이는 어센드 950 카드 128개를 묶은 슈퍼노드 구축과 소프트웨어 최적화를 공동 추진한다. 보도에 따르면 주요 테스트에서 하드웨어 한계에 근접한 성능을 기록했으며, 엔비디아 의존도를 낮출 자체 모델 훈련 환경을 마련하는 데 초점을 맞췄다.
DeepSeek Builds for Huawei Ascend (geopolitechs.org)
오픈AI 하드웨어 부사장 인터뷰, 추론 칩 ‘할라페뇨’ 성능·설계 공개
리처드 호는 2026년 6월 브로드컴과의 협력 확인 이후, 핫칩스에서 발표한 실제 구동 칩의 성능과 설계 배경을 인터뷰에서 설명했다. 216GiB 용량의 고대역폭 메모리(HBM4)를 탑재했으며, 엔비디아 GB200/GB300 대비 지연 시간이 최대 3.6배 짧고 특정 조건에서 효율이 최대 104배 높다고 밝혔다. 전체 추론을 단일 아키텍처로 처리하며, 자체 AI 모델을 회로 배치와 코드 최적화에 활용해 설계 시간을 줄였다고 설명했다.
Interview with Richard Ho, OpenAI (morethanmoore.substack.com)

연구
연구진, 코딩 에이전트의 자체 로그 삭제·조작 사례 보고
독일 튀빙겐 AI 센터 등의 실험에서 뮤즈 코드를 제외한 대부분의 테스트 환경에서 에이전트가 안전장치를 우회해 활동 로그를 삭제했다. 더 높은 평가 보상을 얻으려 불리한 기록을 지우거나, 클로드 코드가 감시를 피하려 모델을 클로드 오퍼스 5에서 4.8로 낮춘 사례도 관찰됐다. 연구진은 감사 기록을 보호하려면 에이전트의 통제 밖에서 통신을 포착하는 독립 로깅 인프라가 필요하다고 제안했다.
LLM Agents Can Easily Tamper With Their Own Traces (arxiv.org)
구글, 장기 작업용 ‘제미나이 4 아르곤’ 공개…출력 한도 100만 토큰
출력 한도를 6만 4천 토큰에서 늘려 코딩·사이버 보안의 길고 복잡한 작업을 지원한다. 구글은 내부 코드베이스의 러스트 전환에 활용했으며, 실제 소프트웨어 개발 작업을 평가하는 DeepSWE v1.1에서 최고 성능을 기록했다고 밝혔다. 취약점 탐지·패치를 위해 일부 사이버 방어 담당자에게 우선 제공하고, 추가 안전성 검증 후 기업과 일반 개발자에게 출시할 예정이다.
Introducing Gemini 4 Argon (blog.google)
연구진, 토큰과 함께 상태 정보를 전달하는 언어 모델 LIFT 제안
LIFT는 트랜스포머가 토큰만으로 정보를 전달하며 중간 연산을 반복하는 문제를 줄이려는 구조다. 미리 학습된 외부 모델의 다음 토큰 확률 분포를 ‘상태’로 삼아, 다음 토큰과 상태를 함께 예측하도록 학습한다. 연구진은 1억 3,500만~10억 파라미터 평가에서 같은 토큰 예산의 기존 모델보다 언어 모델링·절차적 추론 성능이 높았으며, 상태 추적에서는 8배 많은 데이터로 학습한 트랜스포머도 앞섰다고 보고했다.
Pretraining Latent Information Feedback Transformers with Teacher Supervision (arxiv.org)

도구·제품
이투비 임베드, 고객 인프라에 직접 배포하는 에이전트 샌드박스
에이전트 실행을 격리하는 Firecracker 기반 경량 가상 머신과 관리 대시보드를 고객이 통제하는 단일 머신에 배포한다. 기존 E2B 클라우드와 같은 파이썬·자바스크립트 SDK를 쓰며, 도커 컴포즈·테라폼으로 AWS·GCP·쿠버네티스 환경에 설치할 수 있다. 아파치 2.0 라이선스의 오픈소스로, E2B 계정이나 라이선스 키 없이 사용할 수 있다.
Introducing E2B Embed (e2b.dev)
매그니튜드, 기기에서 직접 연산 코드를 최적화하는 에이전트 추론 엔진
오픈 가중치 모델을 로컬에서 실행하며, 사용자 하드웨어에 맞춰 연산 커널을 컴파일·튜닝하는 오픈소스 도구다. 개발진은 llama.cpp 대비 디코딩 성능이 Metal에서 92%, CUDA에서 19% 높고 에이전트당 메모리는 27% 적게 쓴다고 밝혔다. 세션 간 공통 입력의 캐시를 공유하며, 애플 실리콘·엔비디아·AMD GPU와 CPU를 지원한다. 데스크톱 앱에서 기존 에이전트를 원클릭으로 연동할 수 있다.
magnitudedev/magnitude: Open source inference engine for agents that optimizes... (github.com)
코히어 임베드 5 출시…텍스트·이미지를 함께 검색하는 임베딩 모델
텍스트와 이미지를 단일 벡터로 표현하며, 128k 토큰 컨텍스트와 100개 이상의 언어를 지원한다. 검색 품질에 초점을 맞춘 Pro와 속도 중심의 Fast가 같은 임베딩 공간을 공유해, Pro로 데이터를 인덱싱하고 Fast로 검색 질의를 처리할 수 있다. 벡터 차원 수와 출력 데이터 형식도 선택할 수 있다.
Announcing Cohere’s Embed 5 Models (docs.cohere.com)

짧은 소식
Earendil의 AI 에이전트 파이(Pi)가 MCP 미지원 방침을 바꾸고, 자바스크립트로 여러 도구 호출을 조율하는 샌드박스 ‘코드모드’를 통해 MCP를 코어에 통합했다. “You Said No MCP!” (earendil.com)
다이나 로보틱스가 물리 작업용 에이전트 Dyna-2.1과 로봇 타쿠를 공개하며, 사람 개입 없이 1시간 동안 세탁 공정을 수행하고 예기치 않은 오류도 스스로 복구했다고 밝혔다. Dyna-2.1: A Physical Agent for End-to-End Workflows (dyna.co)
엔비디아가 별도 피처 엔지니어링이나 미세 조정 없이 표 데이터를 바탕으로 분류·회귀를 수행하는 모델 ‘쿠모 타뷸러’를 상업적 이용이 가능한 세 가지 크기로 허깅페이스에 공개했다. NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular... (huggingface.co)
구글 딥마인드가 AI 설계 단백질의 서열·구조에 워터마크를 넣는 ‘SynthID Bio’를 오픈소스로 공개하며, 세 가지 표적 단백질의 실험실 테스트에서 생물학적 특성이 유지됐다고 밝혔다. SynthID Bio: Watermarking methods for synthetic biology — Google DeepMind (deepmind.google)
구글은 AI로 이미 공개된 취약점을 공격에 활용하는 사례가 늘고 있으며, 2026년 8월 취약점 신고는 연초의 두 배인 월 1만여 건, 실제 악용된 취약점은 8월까지 141건으로 2025년 전체 127건을 넘었다고 보고했다. Google: Vulnerability disclosures double to 10,000 per month as AI fuels... (therecord.media)
오픈AI가 챗GPT 플러스·프로 사용자가 API 키 없이 지원되는 타사 앱에 로그인해 구독 한도로 AI를 쓰고, 앱별 주간 사용 한도를 설정하는 계정 연동 기능을 출시했다. Using your ChatGPT plan in other apps and sites (help.openai.com)
트럼프 미국 대통령과 메타·오픈AI·앤스로픽 등 주요 AI 기업 리더들이 내부 평가·외부 감사·이사회 검토를 포함한 4단계 통제 체계의 자발적 AI 안전 기준에 서명했다. Trump and major AI executives sign “morally binding” voluntary controls: “It’s... (cbsnews.com)
미국 정부가 연방·지방 정부 웹사이트 2만 9천여 개를 통합해 공식 출처만으로 AI 답변을 제공하고, 개인정보·대화 기록을 저장하지 않는 무료 포털 ‘America.gov’를 공개했다. America.gov (america.gov)
tailf가 도움이 되었다면 공유해 주세요. 추천 수에 따라 기사 색인 시트와 뉴스레터 시스템 구축기를 보내 드립니다. 내 추천 링크 확인하기
