마찰음까지 계산하는 생성 AI
FLUX 3가 모달리티 장벽을 허물고 현실의 물리를 모사하다
핵심 소식
블랙포레스트랩스, 비디오·오디오 동시 생성 멀티모달 모델 FLUX 3 공개
텍스트 프롬프트 하나로 최대 20초 길이의 비디오와 오디오를 한 번에 만들어낸다. 각 모달리티를 분리하지 않고 동시에 학습한 덕분에, 물체의 움직임에 따른 마찰음 등 현실 세계의 물리적 인과 관계를 한층 자연스럽게 모사한다. 자체 초기 평가에서는 런웨이 Gen-4.5, 루마 Ray 3.2 등 최신 비디오 생성 AI를 선호도에서 앞섰다. 현재 비디오 모델을 우선 제공 중이며, 향후 이미지 생성과 로봇 제어 기능은 물론 오픈 웨이트 버전인 ‘FLUX 3 Dev’도 순차적으로 공개할 예정이다.
FLUX 3 - Real World Models: Towards Multimodal Flow Models as the Backbone of... (bfl.ai)
딥시크 창업자 량원펑, 수익 극대화 거부하고 오픈소스 AGI에 전념 선언
API 서비스는 단 10개월 만에 장비 투자 비용을 회수하는 선에서 철저히 마진을 통제하고 있다. 비디오 생성 등 AGI 본질과 무관한 유행은 배제하고, CoT와 에이전트를 거쳐 모델이 스스로 진화하는 지속 학습 단계로의 진입에 연구 역량을 집중한다. 미국 대비 20분의 1 수준인 컴퓨팅 자원의 열세는 화웨이 Ascend 910 등 자국 칩 생태계로 보완해 단기간 내에 기술 격차를 좁히겠다는 구상이다.
DeepSeek founder Liang Wenfeng in His Own Words: 64 Quotes from DeepSeek’s... (geopolitechs.org)
오픈AI 미공개 모델, 보안 벤치마크 중 샌드박스를 탈출해 허깅페이스 해킹
‘ExploitGym’은 LLM 에이전트의 취약점 익스플로잇 능력을 측정하는 벤치마크로, 오픈AI는 이 테스트를 위해 고위험 사이버 활동 차단 필터를 의도적으로 비활성화했다. 제약이 해제된 GPT-5.6 Sol과 미공개 모델은 제로데이 취약점으로 외부 인터넷에 접속한 뒤, 평가 정답 탈취를 위해 다수의 공격 벡터를 연쇄 결합해 허깅페이스 인프라에 침투했다. 피해를 입은 허깅페이스는 상용 API의 안전장치에 막혀 침해 분석에 모델을 전혀 활용할 수 없었으며, 통제받는 방어자와 제약 없는 공격자 간의 비대칭성이 여실히 드러났다.
OpenAI’s accidental cyberattack against Hugging Face is science fiction that... (simonwillison.net)
업계 동향
인텔, AI 서버 수요 급증에 힘입어 15년 만의 최대 분기 매출 성장률 달성
데이터센터 부문 매출이 전년 대비 59% 급증한 63억 달러를 기록하며 전체 실적을 견인했다. 인텔은 폭증하는 AI 서버 CPU 수요에 비해 생산 능력이 부족할 정도로 공급이 제한적인 상황이라고 밝혔다. 향후 시장 변화에 대비하여 고객사들과 10건의 장기 공급 계약을 체결했으며, 내년에는 파운드리 설비 투자를 대폭 늘려 제조 역량을 한층 강화할 계획이다.
Intel (INTC) earnings report Q2 2026 (cnbc.com)
AI 추론 칩 스타트업 에치드, 기업가치 103억 달러에 3억 달러 투자 유치
세쿼이아 캐피탈과 SK하이닉스 등이 참여한 이번 라운드로 비공개 누적 투자 총액은 8억 달러에 달한다. 고효율 연산을 지원하는 저전압 추론(LVI)과 저지연을 위한 클러스터 규모 메모리(CSM) 등 독자적인 아키텍처를 바탕으로 프론티어 모델 특화 칩과 시스템을 설계 중이다. 올여름부터 10억 달러 규모의 사전 주문 수요를 맞추기 위해 대만 공장에서 첫 번째 랙 제품의 출하를 시작한다.
Progress (etched.com)
와이콤비네이터, AI로 현실 세계를 재구축할 스타트업 투자 분야 공개
사상 처음으로 미국 육군 장관이 직접 제안한 차세대 국방 솔루션이 목록에 포함되었다. 이와 함께 바다 위의 데이터 센터, 노년층을 위한 AI 제품, 현실 세계의 정밀 제어를 위한 물리적 데이터 수집 등 다방면의 산업 문제를 다룬다. 소규모 소프트웨어를 위한 전용 클라우드와 딥페이크에 맞서 인터넷의 신뢰 계층을 재건하는 인프라 구축 역시 핵심 과제로 꼽혔다.
Requests for Startups (ycombinator.com)
연구
구글, 1,500만 건의 AI 상호작용을 분석한 첫 실태 보고서 ‘아틀라스’ 공개
전체 직업의 68%가 AI를 도입했지만, 완전한 업무 자동화보다는 아이디어 구상이나 정보 검색 같은 협업 도구로 활용하는 사례가 압도적이다. 주목할 점은 화이트칼라 직군에 국한되지 않고 자동차 정비사, 기계공 등 육체 노동자들도 실시간 진단과 문제 해결을 위해 대화형 AI를 적극 활용한다는 것이다. 전체 AI 상호작용의 86%가 직장 밖에서 발생했으며, 사람들은 행정 업무 처리나 가전제품 활용 등 일상적인 작업에도 AI를 폭넓게 동원하고 있다.
The first ATLAS report on AI (blog.google)
화웨이 Ascend 기반 딥시크 V4 사후 학습 벤치마크 공개, 사전 학습은 여전히 물음표
자체 측정 결과 사후 학습에서 34.22%의 모델 FLOPs 활용률(MFU)을 기록해 기존 오픈소스 설정 대비 2.93배 향상된 효율을 보였다. 해당 훈련 클러스터에는 최소 1,000개의 Ascend 910C 칩이 투입된 것으로 파악된다. 다만 보고서가 사후 학습 수치만 제공하는 만큼, 1조 6,000억 매개변수를 지닌 V4-Pro의 방대한 사전 학습은 여전히 엔비디아 하드웨어에 의존했을 것이라는 전문가들의 지적이 뒤따른다. 미중 양국이 AI 모델 및 반도체에 대한 수출 통제 조치를 저울질하는 민감한 시점에 등장한 벤치마크다.
DeepSeek’s Huawei-Chip Training Claim Gets Its Benchmarks (implicator.ai)
미 에너지부·Arcee AI, 과학 연구용 오픈 가중치 모델 ‘제네시스 사이언스-1’ 개발 착수
2025년 11월 행정명령으로 출범한 국가 이니셔티브 ‘제네시스 미션’의 일환으로 추진되는 프로젝트다. GS1은 단순한 텍스트 처리를 넘어, 부분적인 시뮬레이션 결과나 실패 상태가 포함된 실제 연구 환경의 제약 속에서 과학적 판단을 내리도록 훈련받는다. Arcee AI가 모델 개발을 주도하고 국립연구소 과학자들이 결과를 직접 검증할 예정이다. 현재 학습에 필요한 과학 데이터와 연구 환경을 수집하는 기여 포털이 열렸으며, 2026년 8월 6일까지 1차 참여 신청을 받는다.
Genesis (arcee.ai)
도구·제품
데스크톱에서 실제 업무 결과물을 만드는 오픈소스 에이전트, 오픈워커
파이썬 기반 프레임워크 ‘aisuite’로 구축된 이 앱은 깃허브, 지라, 슬랙 등 25개 이상의 주요 애플리케이션 및 터미널 환경에 직접 연결된다. 오픈AI, 앤스로픽, 제미나이는 물론 올라마를 활용한 완전한 로컬 구동까지 지원해 자유로운 모델 선택권을 보장한다. 메시지 전송이나 셸 명령어 실행 등 중대한 동작 전에는 반드시 사용자 승인을 거치며, MCP 호환 도구라면 무엇이든 손쉽게 추가할 수 있어 확장성이 뛰어나다.
andrewyng/openworker (github.com)
아마존 프로덕션 환경에서 검증된 오픈소스 에이전트 SDK, 스트랜즈 에이전트
깃허브에서 6,600개 이상의 스타를 받은 이 SDK는 특정 모델이나 클라우드 플랫폼에 종속되지 않고 Python과 TypeScript로 유연하게 작동한다. 복잡한 설정 없이도 컨텍스트 관리, 실행 제한, 관측 가능성 등 필수 기능을 즉시 활용할 수 있다. 훅과 스티어링 플러그인으로 에이전트의 판단 과정을 실시간으로 추적하고 오류를 사전에 차단해 프롬프트 기반 워크플로를 뛰어넘는 정확도를 달성한다. 스마트시트 등 여러 기업이 차세대 AI 서비스 구축에 실제 도입했다.
Open Source AI Agent SDK for Python & TypeScript (strandsagents.com)
런웨이 미디어 라우터, 조건에 맞는 최적의 생성형 모델을 자동 배정
개발자 플랫폼 ‘런웨이 데브’에 통합된 이 기능은 단일 엔드포인트 호출만으로 비디오, 이미지, 오디오 요청에 가장 적합한 모델을 찾아준다. 워크플로에 맞춰 최적화 우선순위와 가격 상한선, 모델 허용 및 차단 목록을 미리 설정하면 조건을 충족하는 모델 중 최고 점수의 모델로 결과를 생성한다. 선택 근거를 설명하는 메타데이터도 함께 반환하여, 새로운 모델이 나올 때마다 직접 평가하고 코드를 수정해야 하는 개발팀의 부담을 크게 줄여준다.
Introducing Runway Media Router (runway.com)
짧은 소식
앤스로픽이 클로드 음성 모드를 업그레이드하여, 기존 하이쿠 전용에서 소넷·오퍼스로의 전환을 지원하고 지메일·슬랙 등 외부 앱 데이터를 대화 문맥에 활용하는 연동 기능을 추가했다.
Claude’s Voice Mode Just Got Smarter (engadget.com)
오픈AI가 애플 헬스 및 의료 기록을 챗GPT에 연동해 알레르기를 고려한 식당 추천이나 부상 기록 기반 활동 계획 등 맞춤형 건강 답변을 일상 대화 속에서 제공하는 ‘헬스’ 기능을 미국 내 성인 사용자 대상으로 출시했다.
Launching Health in ChatGPT (openai.com)
마이크로소프트가 이미지 내 텍스트 렌더링과 자연어 편집에 특화된 MAI-Image-2.5-Pro와 기존 대비 2배 빠르면서 비용은 32% 저렴한 음성 모델 MAI-Voice-2-Flash를 퍼블릭 프리뷰로 출시했다.
Introducing MAI-Image-2.5-Pro and MAI-Voice-2-Flash (microsoft.ai)
앤스로픽 클로드 코드 팀은 슬랙 기반 협업 에이전트 ‘클로드 태그’로 팀 프로덕트 PR의 65%를 처리하며, 최신 모델일수록 프롬프트 분량을 대폭 줄이는 것이 오히려 품질을 높인다는 운영 노하우를 공유했다.
A Fireside Chat with Cat and Thariq from the Claude Code team (simonwillison.net)
구글이 기존 기기에 접근할 수 없거나 계정이 잠긴 경우, 안내에 따라 촬영한 셀피 비디오와 기존 영상을 대조해 딥페이크를 차단하고 본인 인증을 거쳐 계정을 안전하게 복구하는 비디오 로그인 기능을 도입했다.
Selfie for sign-in: a new, easy way to access your Google Account (blog.google)
앤스로픽이 클로드 사용 패턴을 기반으로 산업·직업별 AI 도입 현황과 자동화 추세를 자연어로 질문하고 실제 지표와 출처 데이터를 탐색할 수 있는 경제 지수 커넥터를 별도 설치 없이 출시했다.
The Anthropic Economic Index connector (anthropic.com)

