🔥 주목
xAI, Grok 4.6 출시 및 Grok Bot 에이전트 공개 : xAI가 Grok 4.6 모델을 공식 출시하며, 500K 컨텍스트와 멀티모달 입력을 지원한다. 이 모델은 AA 지능 지수에서 61점을 기록해 GPT-5.6 Sol과 동률을 이루었으며, 실제 업무 평가인 GDPVal-AA v2에서 1753 Elo로 2위를 차지했다. API 가격은 100만 토큰당 입력 2달러, 출력 6달러로 책정되어 경쟁 제품보다 60% 이상 저렴하다. 동시에 출시된 Grok Bot은 멀티 에이전트 협업 및 클라우드 독립 실행을 지원하며, 제3자 애플리케이션에 자동으로 로그인하고 사용자의 워크플로우를 학습할 수 있다. (출처: xAI)

DeepSeek V4 Pro 정식 버전 출시 및 Harness 프레임워크 오픈소스화 : DeepSeek가 V4 Pro 정식 버전(0813)을 출시했다. 이 모델은 1.6T 매개변수의 MoE 아키텍처를 채택하고 1M 컨텍스트 및 이미지 입력을 지원한다. Agent 능력이 대폭 향상되어 DeepSWE 벤치마크에서 프리뷰 버전의 12.8점에서 62.7점으로 급등했다. 동시에 Cordis 마이크로커널 기반의 DeepSeek Harness v0.1 에이전트 프레임워크를 오픈소스로 공개하여 모델, 도구, 샌드박스를 플러그인 형태로 유연하게 조립할 수 있도록 지원한다. (출처: DeepSeek)
.jpg)
알리바바, 2.4조 매개변수 거대 모델 Qwen3.8-Max 오픈소스 공개 : 알리바바 Qwen 팀이 Qwen3.8-2.4T-A95B(Qwen3.8-Max)의 모델 가중치를 오픈소스로 공개했다. 활성화 매개변수는 95B에 달하며, 기본적으로 262K 컨텍스트를 지원한다. 이 모델은 PaperBench에서 93점을 획득하고 OSWorld 등 에이전트 작업에서 우수한 성능을 보였다. Unsloth는 1-bit 양자화 기술을 이용해 모델 크기를 91% 압축한 397GB로 줄여 로컬 배포를 가능하게 했다. (출처: Hugging Face)
Google DeepMind, 수어-텍스트 변환 모델 SL2T 출시 : Google DeepMind가 수어-텍스트 변환 모델 SL2T를 출시하고, Pixel 11의 Gboard 및 Live Transcribe에 적용했다. 이 모델은 FLEURS-ASL 번역 벤치마크에서 70 BLEURT라는 높은 제로샷 점수를 기록했다. 개인정보 보호를 위해 시스템은 MediaPipe Holistic을 사용하여 로컬에서 인체 포즈 좌표를 추출하고, 기하학적 데이터만 클라우드로 전송하여 ASL에서 영어로의 실시간 번역을 완료한다. (출처: Google DeepMind)
Ilya의 SSI, 최초의 TTT 기반 추론 모델 포착 : Ilya Sutskever가 설립한 SSI가 테스트 시 학습(TTT) 기반의 소형 추론 엔진을 개발 중이라는 소식이 커뮤니티를 통해 전해졌다. 이 모델은 추론 시 경사하강법을 통해 일부 가중치를 실시간으로 업데이트하여 분포 외 데이터에 적응함으로써, 정적 컨텍스트 창의 한계에서 벗어나 샘플 효율적인 지속 학습을 구현한다. 이를 통해 훨씬 더 큰 규모의 모델과 경쟁할 수 있는 성능을 낸다. (출처: X)

🎯 동향
Dyna Robotics, 100만 시간 분량의 egocentric 비디오로 사전 학습된 Dyna-2 모델 발표 : Dyna Robotics가 로봇 조작을 위한 세계 행동 모델 Dyna-2를 발표했다. 이 모델은 100만 시간 이상의 인간 1인칭 시점(egocentric) 비디오로 사전 학습되었으며, 이전에 보지 못한 로봇 데이터에서 Scaling Law의 교차 신체(cross-body) 일반화 능력을 최초로 검증했다. 실험에 따르면 비디오 예측과 행동 디노이징의 공동 학습이 일반화 달성의 핵심인 것으로 나타났다. (출처: Dyna Robotics)
샤오홍슈 및 상하이교통대, 연속 자기회귀 음성 합성 모델 dots.tts 오픈소스 공개 : 이 모델은 20억 개의 매개변수를 가지며, 연속적인 잠재 공간(latent space)에서 자기회귀 방식으로 블록 단위 모델링을 직접 수행하여 이산적인 음향 토큰으로 인한 정보 손실을 방지한다. Seed-TTS-Eval 벤치마크에서 평균 화자 유사도와 콘텐츠 정확도 모두 SOTA를 달성했으며, 스트리밍 출력 및 이중 스트림 상호작용 모드를 지원한다. (출처: JiQizhixin)
.jpg)
Microsoft, MAI-Code-1.1-Flash 출시 및 가격 대폭 인하 : Microsoft가 자사 코드 모델을 업데이트하고 MAI-Code-1.1-Flash를 출시하여 CLI 및 에이전트 작업의 토큰 소비를 최적화했다. 이와 함께 Microsoft는 GitHub의 API 가격을 75% 인하(입력 100만 토큰당 0.2달러, 출력 1.2달러)하여 Anthropic이 주도하는 코딩 시장에서 경쟁력을 유지하고자 한다. (출처: AI Business)

알리바바 보안 팀, 멀티모달 보안 기반 모델 Yuvion VL 발표 : 알리바바 보안 팀이 AI 및 콘텐츠 보안에 초점을 맞춘 Yuvion VL 시리즈 모델을 출시했다. 이 모델은 혼동 대립 미세조정(C2FT) 대조 학습 프레임워크를 도입하여 혼동하기 쉬운 어려운 음성 샘플을 동적으로 발굴한다. 평가 결과, 8B 버전은 여러 보안 작업에서 매개변수 크기가 50배 더 큰 GPT-5.4 등 상용 거대 모델을 능가하는 성능을 보였다. (출처: arXiv)
옥스퍼드대 및 싱가포르국립대, ‘마음 세계 모델’ MWM 프레임워크 제안 : 공동 연구팀이 에이전트의 신념, 목표, 감정 등 마음 변수를 전역 세계 상태에 통합하는 마음 세계 모델링(MWM) 프레임워크를 제안했다. 레퍼런스 시스템 MENTIS를 통한 테스트 결과, 순수 물리적 세계 모델에 비해 마음 상태를 명시적으로 모델링하는 것이 인간의 의사결정 예측 F1 점수를 크게 향상시키는 것으로 나타났다. (출처: arXiv)
.jpg)
베이징대 등 연구팀, AF3 접촉 확률 기반 유전자 편집기 최적화 프레임워크 ContactSeek 제안 : 공동 연구팀이 《Nature》에 논문을 발표하고, AlphaFold3가 예측한 접촉 확률(CP)을 활용하여 유전자 편집기의 특이성을 최적화하는 AI 프레임워크 ContactSeek을 제안했다. 이 프레임워크는 Cas 단백질과 DNA/RNA 상호작용의 핵심 접촉 잔기를 성공적으로 식별하여 고정밀 염기 편집기 변이체를 설계해냈다. (출처: Nature)
.jpg)
LiteLLM, 대규모 공급망 공격으로 수 테라바이트 규모의 자격 증명 유출 : 보안 기관의 발표에 따르면, 오픈소스 AI 개발 도구인 LiteLLM이 지난 3월 공급망 공격을 받았다. 해커들은 공식 PyPI 소스의 악성 버전을 통해 40분 만에 Microsoft, Amazon, Salesforce 등 2,500개 기업의 클라우드 키, API Token 및 SSH 개인 키를 탈취했으며, 유출된 데이터는 195TB에 달한다. (출처: Ars Technica)
Apple, Siri의 AI 뉴스 서비스 개선을 위해 뉴스 출판사에 비용 지불 협상 중 : 보도에 따르면 Apple이 여러 주요 뉴스 출판사와 협상을 진행 중이며, Siri가 사용자의 질문에 답변하거나 요약을 생성할 때 출판사의 뉴스 콘텐츠를 사용하는 것에 대해 비용을 지불하는 방안을 제안했다. 이번 조치는 규정을 준수하는 실시간 고품질 데이터를 확보하여 Siri의 지능형 비서 경험을 향상시키기 위한 것이다. (출처: The Wall Street Journal)
Google, Pixel 11 시리즈 발표 및 Gemini AI 기능 전면 업그레이드 : Google이 Made by Google ‘26 행사에서 Pixel 11 시리즈 스마트폰을 발표했다. 신제품은 Tensor G6 프로세서를 탑재하고 Gemini를 깊이 있게 통합했다. 새로운 기능으로는 ASL 수어 실시간 텍스트 변환 지원, 구어체 표현을 이해하는 Rambler 음성 입력, Pixel Watch 5와의 건강 데이터 연동 등이 포함된다. (출처: TechCrunch)

iFLYTEK, 7대 핵심 시나리오를 아우르는 기업 서비스 에이전트 매트릭스 발표 : iFLYTEK이 스마트 관리, 프로세스 IT, 공급망 거래 등 7대 시나리오를 아우르는 에이전트 매트릭스를 출시하며, 기업 AI가 ‘단일 작업 완료’에서 ‘비즈니스 결과 인도’로 나아가도록 추진한다. 제품에는 구매 감독을 지원하는 규정 준수 심사 에이전트와 초인격적 상호작용을 제공하는 SparkOS 에이전트가 포함된다. (출처: QbitAI)

전 바이트댄스 로봇 책임자 콩타오, 샤오미 합류해 Embodied AI 및 응용 부서 책임자 취임 : 바이트댄스의 전 로봇 팀 책임자였던 콩타오(Kong Tao)가 최근 샤오미에 합류하여 신설된 ‘Embodied AI 및 응용 부서’의 책임자를 맡게 되었다. 스마트 자동차 제조 등 샤오미의 ‘사람-차-집 전체 생태계’ 내 실제 물리적 시나리오가 이 칭화대 컴퓨터공학 박사를 영입하는 데 결정적인 요인으로 작용한 것으로 분석된다. (출처: 36Kr)
Canva, 높은 AI 연산 비용으로 인해 매출 성장 전망치 3분의 1 축소 : 디자인 소프트웨어 유니콘 기업 Canva가 예상 매출 성장률을 20%로 하향 조정했다. CEO Melanie Perkins는 AI 기능에 대한 사용자 수요가 예상을 훨씬 뛰어넘어 연산 비용이 급증했다고 밝혔다. 이에 따라 회사는 일부 AI 기능의 보급 속도를 늦추고, 단일 작업당 토큰 비용을 낮추기 위해 기본 아키텍처를 재구축하기로 결정했다. (출처: Reddit)

🧰 도구
LlamaIndex, ExtractBench 및 LlamaExtract Agentic Plus 발표 : LlamaIndex가 기업 문서 정보 추출 평가 데이터셋인 ExtractBench를 출시했다. 장문 문서 추출 시 최첨단 VLM의 재현율(recall)이 급감하는 문제를 해결하기 위해, 이들은 장문 문서를 세그먼트별로 반복 처리하는 LlamaExtract Agentic Plus를 출시하여 긴 리스트 추출 작업에서 96.1%의 F1 점수를 달성했다. (출처: LlamaIndex)
OpenAI, ChatGPT Work 기업용 워크스페이스 및 Sites 웹페이지 생성 도구 출시 : 이 도구는 기업의 Google Drive 문서, NetSuite의 재무 실적, Slack의 팀 토론을 원활하게 통합할 수 있다. 사용자는 자연어 명령을 통해 복잡한 분기별 재무 감사 및 예측 데이터 분석을 자동으로 완료하고, 클릭 한 번으로 대화형 Sites 데이터 대시보드를 생성할 수 있다. (출처: OpenAI)

Automattic의 인맥 관리 도구 Mesh, Android 플랫폼 출시 : 개인 인맥 관리 및 CRM 도구인 Mesh(구 Clay)가 Android 버전을 출시했다. 이 앱은 분할 화면 및 팝업 뷰를 지원하며, Beeper 등 다중 플랫폼 메시징 소프트웨어와 연동할 수 있다. 내장된 Nexus AI를 통해 사용자는 자연어 쿼리로 인맥 네트워크 내의 업계 전문가나 특정 도시의 연락처를 검색할 수 있다. (출처: TechCrunch)

📚 학습
DeepLearning.AI, JetBrains와 공동으로 ‘AI 코딩 워크플로우: 클라우드에서 로컬까지’ 단기 과정 개설 : 이 과정은 JetBrains의 개발자 옹호자(Developer Advocate)인 Paul Everitt이 진행하며, 수강생들이 클라우드, 하이브리드 및 완전 로컬 환경에서 Python 애플리케이션을 구축하도록 지도한다. 교육 과정은 하위 에이전트를 사용한 작업 분할 방법, 모델 라우팅을 통한 비용 절감 방법, 로컬에서 오픈소스 코딩 에이전트를 구성하는 방법 등을 다룬다. (출처: DeepLearning.AI)
IIT 봄베이 및 Adobe Research, LLM 프롬프트 역추출을 위한 PTP 방법 제안 : 공동 연구팀이 논문을 발표하여 이전 토큰 예측(PTP)이라 불리는 역추출 방법을 소개했다. 이 방법은 대상 LLM의 합성 출력물로 역방향 모델을 학습시킴으로써, 모델 가중치에 접근하지 않고도 거대 모델의 시스템 프롬프트와 사용자 개인정보 데이터를 매우 높은 정확도로 복원할 수 있다. (출처: arXiv)

OpenMOSS 팀, Embodied RL 제어를 위한 WCM 세계 크리틱 모델 오픈소스 공개 : 공동 연구팀이 WCM 프레임워크를 오픈소스로 공개했다. 로봇 제어의 부분 관측 가능성(partial observability) 문제를 해결하기 위해, WCM은 상태 가치를 추정하는 동시에 행동을 실행한 후 다음 시점의 잠재 상태를 예측한다. 실험 결과, 미래 상태 예측을 도입함으로써 실제 로봇 강화학습(RL)에서 VLA 모델의 효율성이 크게 향상되는 것으로 나타났다. (출처: arXiv)
.jpg)
오픈소스 데이터셋 OpenWALDO, 안전하고 투명한 AI 학습 데이터 소스 제공 목표 : 오픈소스 모델 학습 데이터의 불투명성 문제를 해결하기 위해 CentOS 창립자인 Gregory Kurtzer가 OpenWALDO 프로젝트를 시작했다. 이 프로젝트는 완전히 공개되고 감사 가능한 AI 학습 데이터셋 구축을 목표로 하며, 현재 퍼블릭 도메인 문헌 및 학술 논문에서 유래한 1,673억 개의 참조 토큰을 포함하고 있다. (출처: The Register)
💼 비즈니스
노코드 소프트웨어 개발 플랫폼 Lovable, 4억 달러 규모 시리즈 C 투자 유치 : 스웨덴의 ‘비주얼 프로그래밍’ 스타트업 Lovable이 Menlo Ventures의 주도로 텐센트 등이 참여한 4억 달러 규모의 시리즈 C 투자를 유치했다고 발표했다. 기업 가치는 7개월 만에 두 배인 133억 달러로 뛰었다. 회사의 ARR은 이미 6억 달러에 달하며, 사용자는 플랫폼에서 애플리케이션 구상부터 실제 서비스 운영까지 전 과정을 직접 완료할 수 있다. (출처: TechCrunch)

Thrive Holdings, 20억 달러 투자 유치… 전통 산업 내 OpenAI 모델 도입 가속화 : AI 도입에 초점을 맞춘 사모펀드 Thrive Holdings가 기업 가치 120억 달러로 20억 달러의 신규 자금을 조달했다고 발표했다. 이 회사는 회계 및 IT 등 전통 기업을 인수하고 OpenAI 모델을 직접 내장하여 워크플로우를 최적화한다. 신규 자금은 물리적 자산 감독 등 새로운 비즈니스 영역을 개척하는 데 사용될 예정이다. (출처: TechCrunch)
IBM, Together AI와 2.4억 달러 규모의 Nvidia Blackwell 클러스터 임대 계약 체결 : IBM과 Together AI가 2억 4천만 달러 규모의 다년 협력 계약을 체결했다. Together AI는 IBM Cloud에 2,000개의 Nvidia B300(Blackwell) 칩을 포함하는 AI 연산 클러스터를 배포하여 DeepSeek, Kimi 등 오픈소스 거대 모델에 효율적인 클라우드 추론 서비스를 제공할 예정이다. (출처: IBM)

🌟 커뮤니티
커뮤니티, Fable 5의 저조한 상용 도입률과 기업 AI 지출 한계에 대해 뜨거운 논의 : 금융 서비스 기업 Ramp의 데이터에 따르면, Fable 5는 출시 첫 달 Anthropic 모델에 대한 기업 총 지출의 11.4%만을 차지했다. 분석에 따르면 100만 토큰 출력당 50달러라는 높은 가격이 기업 AI 지출의 한계에 도달했으며, ROI를 정량화할 수 없는 상황에서 기업들이 가성비가 더 높은 오픈소스나 중소형 모델로 선회하고 있는 것으로 나타났다. (출처: Ramp)

개발자들, AI 코딩 도구 내 ‘하네스’(Harness)와 모델 능력의 경계에 대해 논의 : Opus 5가 269개의 프로그램을 자율적으로 작성하여 ARC-AGI-3를 통과한 후, 개발자들 사이에서는 모델의 추론 능력이 향상됨에 따라 과도하게 설계된 프롬프트와 복잡한 외부 Agent 프레임워크(Harness)가 오히려 모델의 역량 발휘를 제한하는 ‘밧줄’이 되고 있으며, 향후에는 극도로 단순화된 환경 인터페이스가 트렌드가 될 것이라는 의견이 오갔다. (출처: 36Kr)
영국 왕립통계학회 AI 워킹그룹, AI 규제에 통계학적 원칙 도입 촉구 : 영국 왕립통계학회(RSS)는 보고서를 통해 AI 모델이 배포 후 환경에 따라 동적으로 진화하기 때문에 기존의 정적인 규정 준수 심사로는 위험을 효과적으로 방지할 수 없다고 지적했다. 워킹그룹은 규제 기관이 통계적 평가 역량을 구축하여 실제 비즈니스 시나리오에서 AI Agent의 행동을 지속적으로 감사할 것을 촉구했다. (출처: RSS)

AI 환각으로 인한 농업 피해, 자동화된 의사결정의 경계에 대한 논의 촉발 : AI의 조언을 맹신하여 25에이커 규모의 작물이 파괴된 사건이 커뮤니티에서 뜨거운 화제가 되었다. 해당 AI 애플리케이션은 잡초와 작물을 모두 죽이는 화학 약품을 잘못 추천했다. 네티즌들은 물리적 세계와 관련된 의사결정에서 인간의 검증 없이 AI의 자동화된 제안을 맹신하는 것은 심각한 결과를 초래할 수 있다고 지적했다. (출처: X)
💡 기타
Kellanova, 지멘스 디지털 트윈 기술 활용해 감자칩 생산 라인 최적화 : 제과 분야 대기업 Kellanova가 500만 달러를 투자해 폴란드 공장에 으깬 감자 실시간 디지털 트윈 시스템을 구축했다. 센서가 매 밀리초마다 200개의 데이터 포인트를 수집하여 머신러닝 모델에 입력하고 레시피를 자동으로 미세 조정함으로써, 생산 라인의 폐기물을 13% 줄이고 에너지 소비를 7% 절감했다. (출처: X)
유니트리 로보틱스(Unitree), IPO 청약에 1,000만 명 가까이 몰려… 과창판 배정률 사상 최저치 경신 : 유니트리 로보틱스(Unitree)의 A주 IPO 온라인 청약 계좌 수가 978만 개를 초과했으며, 배정률은 0.018%에 불과해 과창판 역사상 최저치를 기록했다. 상장 시가총액은 610억 위안에 달한다. 또한, 인공지능 기업 DeepSeek이 전략적 투자자로 배정에 참여하기로 확정했으며, 양사는 Embodied AI 및 거대 모델을 중심으로 공동 연구개발을 진행할 예정이다. (출처: 36Kr)
Suno, BMG와 파트너십 체결… 그러나 디지털 워터마크로 인한 창작자들의 우려 확산 : 음악 생성 플랫폼 Suno가 인간 창작자를 AI 음악 생태계의 중심에 두기 위해 BMG와 글로벌 파트너십을 체결했다고 발표했다. 그러나 Suno가 오디오 트랙에 강제로 삽입하는 비가역적 디지털 워터마크가 커뮤니티의 반발을 불러일으켰으며, 창작자들은 이것이 음반사와 플랫폼이 저작권을 모니터링하고 콘텐츠를 삭제 및 차단하는 도구로 악용될 것을 우려하고 있다. (출처: Suno)