🔥 포커스
Hugging Face, 130억 달러 이상의 기업가치로 매각 모색 보도 : 세계 최대의 오픈소스 AI 모델 및 데이터셋 호스팅 플랫폼인 Hugging Face가 투자은행과 협력하여 잠재적 인수자의 인수 의향을 타진하고 있으며, 기업가치는 130억 달러 이상에 달할 수 있어 2023년 45억 달러 평가 대비 크게 상승했습니다. 커뮤니티와 분석가들은 모델 레이어의 경쟁이 치열해짐에 따라 개발자 진입 경로이자 모델 배포의 허브인 인프라 자산의 전략적 가치가 급증하고 있으나, 특정 빅테크 기업에 인수될 경우 플랫폼의 중립성과 오픈소스 생태계의 독립성이 심각한 시험대에 오를 수 있다고 지적합니다 (출처: TechCrunch, 36氪)
Alibaba, 비디오 생성 파운데이션 모델 Wan 3.0 공식 출시 및 공개 테스트 진행 : Alibaba의 비디오 생성 대형 모델 Wan 3.0이 공식 출시되어 Alibaba Cloud Model Studio(百炼), Tongyi Qianwen(千问) 및 여러 생태계 플랫폼에서 동시 오픈되었습니다. 이 모델은 한 번에 최대 30초 길이의 연속적인 비디오 생성을 기본 지원하며, PDF, PPT, 표, 웹페이지 등 멀티모달 참조 입력을 최초로 지원합니다. 또한 장시간 카메라 워킹, 조명 및 물리 법칙, 사실적인 인물 질감에서 ‘AI 특유의 인위적인 느낌’을 크게 줄였으며, 현재 숏폼 드라마, 광고, e커머스 제작 등 상업용 워크플로우에 전면 적용되었습니다 (출처: 量子位, The Verge)

IBM, Arm 및 Z 듀얼 아키텍처를 지원하는 최초의 메인프레임 칩과 Spyre AI 가속기 발표 : IBM이 Hot Chips 컨퍼런스에서 차세대 메인프레임 프로세서 아키텍처를 공개했습니다. 각 코어는 나노초 단위로 동적 전환하여 IBM 네이티브 Z 명령어 세트와 Arm64 아키텍처를 실행할 수 있어, 기업이 핵심 트랜잭션 시스템 옆에서 오버헤드 없이 방대한 최신 Arm 및 Linux AI 생태계를 운영할 수 있게 합니다. 이와 함께 IBM은 엔터프라이즈급 대형 모델 추론 및 Agent 워크플로우를 지원하기 위해 고대역폭 메모리를 탑재한 차세대 Spyre AI 보조 프로세서를 프리뷰 공개했습니다 (출처: VentureBeat)
OpenAI, Instant 팀 인수 및 Codex 크레딧 이상 소모에 따른 전액 리셋 단행 : OpenAI가 Agent의 멀티스레드 협업, 오프라인 캐싱, 지속적 상태 관리 부문의 핵심 취약점을 보완하기 위해 ‘AI 버전의 Firebase’로 불리는 YC 유망 스타트업 Instant 팀을 전격 인수한다고 발표했습니다. 같은 날, 유저들의 크레딧 빠른 소모 이슈에 대해 Codex 책임자는 긴 대화의 이미지 압축, Computer History 및 자동 대화 네이밍 기능에 과도한 소모 버그가 있었음을 인정하고, 모든 유료 구독자를 대상으로 사용량 크레딧을 전량 리셋했습니다 (출처: 36氪, WeChat)
하버드 및 Anthropic 연구진, Claude를 활용해 78년 수학 난제 해결: 6차원 구면의 복소구조 존재 증명 : 하버드 대학교 연구원 Levent Alpöge와 Claude의 협업을 통해 108페이지 분량의 논문에서 6차원 구면($S^6$) 상의 콤팩트 복소 다양체 구조를 사상 최초로 명시적으로 구성하고, 위상수학 및 미분기하학 검증을 완료했습니다. 1948년 제기된 이래 약 80년간 수학계를 괴롭혀온 이 난제의 해결은, 대형 모델이 복잡한 수학적 대상을 바닥부터 구성하고 이종 분야 도구를 종합하는 심층 추론 잠재력을 입증한 성과입니다 (출처: 36氪, X @teortaxesTex)
🎯 동향
Anthropic 내부 테스트 코드명 유출, 플래그십 Fable 5의 엔터프라이즈 침투율 저조 : 개발자들이 Anthropic API에서 “claude-marshmallow-eap”와 “claude-melon-eap”라는 두 개의 새로운 내부 테스트 모델 코드명을 발견했으며, 이는 Opus 5.1 또는 차세대 Sonnet 계열일 것으로 추정됩니다. 한편, 결제 서비스 기업 Ramp의 데이터에 따르면 플래그십 모델 Fable 5는 높은 단가로 인해 기업 고객의 Anthropic 총지출 중 11.4%에 불과했으며, 가성비가 높은 Opus 5가 출시된 이후 실제 호출량과 지출 면에서 상위 모델을 빠르게 앞지른 것으로 나타났습니다 (출처: 机器之心, Financial Times)
Xiaomi, 자체 개발 AI 칩 Xuanjie O3, O100, D100 3종 공개 : Xiaomi가 기술 설명회에서 3종의 칩을 공개했습니다. TSMC 3nm 공정과 올인원 AI 유닛을 통합한 플래그십 스마트폰 SoC Xuanjie(玄戒) O3, 3D 웨이퍼 레벨 하이브리드 본딩 기술과 1.22TB/s 메모리 대역폭을 갖춘 온디바이스 AI 가속 칩 Xuanjie O100, 그리고 중국 최초의 3nm 고성능 자율주행 칩 Xuanjie D100을 발표했으며, 이 3개 칩을 탑재해 로컬 환경에서 오프라인으로 100억 파라미터급 대형 모델을 구동할 수 있는 AI Cube 프로토타입도 선보였습니다 (출처: 机器之心)
.jpg)
Tencent ARC Lab, 비디오 DiT용 광선 공간 위치 인코딩 SCoPE 오픈소스 공개 : 기존 비디오 DiT가 그리드 좌표를 사용하여 카메라 이동 시 기하학적 표현이 왜곡되는 문제를 해결하기 위해, Tencent가 홍콩대, 홍콩과기대와 협력하여 SCoPE를 제안했습니다. 이 방식은 Attention 메커니즘에 카메라 Plücker 광선 좌표를 직접 주입함으로써 극히 적은 파라미터 추가만으로 단일 이미지 입력 기반의 자유 시점 탐색, 정밀한 카메라 궤적 제어, 폐루프 시점 일관성 복원을 실현했습니다 (출처: 机器之心)
.jpg)
Alibaba DAMO Academy의 간암 진단 모델 DAMO LiON, 《Nature Medicine》 게재 : DAMO Academy가 성징병원(盛京医院)과 공동 개발한 간암 진단 AI 모델 DAMO LiON은 다중 위상 CT 영상을 반복적으로 융합하여 미세한 픽셀 단위 차이를 포착함으로써, 복잡한 조직 간섭 속에서도 1cm 내외의 원발성 및 전이성 미세 병변을 정밀하게 검출합니다. 1만 명의 환자를 대상으로 한 전향적 임상시험에서 오진 위기였던 15건을 구제하는 데 성공했으며, 의사의 판독 시간을 27% 단축시켰습니다 (출처: 量子位)
Cerebras, 차세대 CS-4 랙 스케일 AI 가속 시스템 발표 : Cerebras가 Hot Chips에서 5nm WSE-3 웨이퍼 스케일 칩 기반의 CS-4 랙 스케일 시스템을 출시했습니다. 전원 공급 및 냉각 개선을 통해 클럭 주파수를 높였으며, 단일 캐비닛에 완전한 웨이퍼 3개를 탑재해 단일 유저 추론 처리량이 최대 4400 tokens/s에 달합니다. 공식 발표에 따르면 특정 대형 모델 추론 작업에서 기존 GPU 솔루션 대비 최대 30배의 성능을 발휘합니다 (출처: THE DECODER)
Ant Group과 샤먼 대학교, 의료 팩트체크 시스템 MedGuard 공동 발표 : 《npj Digital Medicine》에 게재된 이 연구는 온라인 진료 시의 사실적 위험에 초점을 맞췄습니다. MedGuard는 복잡한 다중 턴 의사-환자 대화를 독립적으로 검증 가능한 원자적 의료 진술로 분해하고, 불확실성 기반의 외부 가이드라인 근거 검증 루프를 도입하여 세분화된 대화 위험 식별 F1 스코어에서 범용 LLM 베이스라인 대비 22.1% 향상된 성능을 기록했습니다 (출처: 机器之心)
HiDream.ai, 네이티브 올모달 인터랙티브 월드 모델 HiDream-O1-World 출시 : HiDream.ai가 독자 개발한 UiT 아키텍처 기반의 인터랙티브 월드 모델을 출시했습니다. 텍스트, 이미지, 실시간 컨트롤 명령어 입력을 지원하며, 장기 시공간 일관성과 물리 법칙 추론 능력을 갖추어 WBench 벤치마크 Navi 부문 1위를 차지했습니다. AI 인터랙티브 게임/영상, Embodied AI 가상 훈련 및 고화질 3D 공간 생성을 위한 인프라를 제공합니다 (출처: 量子位)
🧰 도구
claude-obsidian: Claude Code 기반의 로컬 자동화 지식 베이스 시스템 : Andrej Karpathy의 LLM Wiki 디자인 패러다임을 차용한 이 오픈소스 프로젝트는 Claude Code를 Obsidian 로컬 지식 베이스에 깊이 통합합니다. 자료 수집, 주장 사실 확인, 자동 교차 참조 및 양방향 링크 생성을 포괄하는 15개의 Agent Skills를 포함하며, 외부 네트워크 유출이 전혀 없는 완전한 로컬 환경에서 자가 발전하는 개인 지식 그래프를 구축합니다 (출처: GitHub Trending)

Flare: 코드 의존성 토폴로지 그래프 기반의 Agentic 데스크톱 IDE : Coding Agent 협업을 위해 특화 설계된 오픈소스 데스크톱 IDE(Electron 기반)입니다. 시스템 메인 화면에 코드베이스의 호출 관계 그래프를 실시간으로 렌더링하며, Claude나 Codex 같은 Agent가 코드를 편집하거나 테스트를 실행할 때 해당 파일 노드가 영향 범위 및 변경 확산 과정을 동적으로 하이라이트 표시합니다. 또한 Git과 분리된 실시간 변경 취소 및 태스크 칸반 메커니즘을 제공합니다 (출처: Reddit r/ArtificialInteligence)

MongoDB, Claude Code 및 Cursor를 위한 공식 Agent Skills 출시 : MongoDB가 스키마 디자인, 인덱스 최적화 제안, 복잡한 쿼리 작성 및 커넥션 풀 관리 모범 사례를 통합한 공식 Agent 전용 툴킷을 출시했습니다. 개발자는 MCP 또는 플러그인 형태로 주요 코딩 Agent에 이를 주입할 수 있으며, Agent가 데이터베이스 코드를 생성하거나 아키텍처를 리팩터링할 때 공식 프로덕션 사양을 엄격히 준수하도록 지원합니다 (출처: TheTuringPost)

Anthropic, Claude Tag 업그레이드: Slack Agent에 능동적 대화 탐색 및 개입 능력 부여 : Anthropic이 엔터프라이즈 협업 앱인 Claude Tag를 업데이트하여 개별 메시지 단위의 분류기를 없애고 Claude가 단체 채팅의 전체 컨텍스트와 히스토리 메모리를 파악할 수 있도록 했습니다. 시스템은 현재 채널에서 바로 답장할지, 별도의 트러블슈팅 스레드를 열지, 아니면 조용히 지켜볼지를 자율적으로 판단하며, 다자간 협업 장애 대응 등의 환경에서 명령 없는 능동적 개입의 유효성을 30% 향상시켰습니다 (출처: VentureBeat)
📚 연구 및 학습
칭화대 및 와튼스쿨 연구진, GPT-5.6 활용해 40년 묵은 경사하강법 수렴 한계 가설 증명 : 칭화대학교 마젠하오(Jianhao Ma)와 유펜 와튼스쿨 천위신(Yuxin Chen) 교수가 GPT-5.6 Sol Pro를 활용해 적대적 오라클 기하학적 구조를 제안하고, 순수 스텝 사이즈 스케줄링 경사하강법에 넘을 수 없는 수렴 하한 $\Omega(T^{-1.9319})$이 존재함을 최초로 증명하여 스텝 사이즈 수열만으로 Nesterov 가속의 이론적 한계를 따라잡을 수 있는지에 대한 오랜 가설을 완전히 종식시켰습니다. 이 증명은 이후 Codex를 통해 Lean 4 코드로 전량 변환되어 오류 없는 정형 검증을 통과했습니다 (출처: 36氪)

지린대 및 샤먼대 등, ‘그래프 엔지니어링(Graph Engineering)’ 시스템 지능 패러다임 제시 : 단일 Agent가 복잡하고 장기적인 과제에서 겪는 조직화 능력의 한계에 대응하여, 15개 연구기관이 동적 진화 그래프 중심의 Agent 엔지니어링 체계를 체계적으로 종합했습니다. 본 논문은 작업 목표 분해, 이종 Agent 간 협업 분업, 런타임 상태 관리를 그래프 구조로 통일하여 모델링함으로써, 대형 모델 시스템이 ‘개체 지능’에서 감사 가능하고 자가 진화하는 ‘시스템 지능’으로 나아가기 위한 방법론적 프레임워크를 정립했습니다 (출처: HuggingFace Daily Papers, 36氪)
칭화대 자오밍궈 팀, 《Science Robotics》에 비전 기반 이족보행 로봇 축구 제어 프레임워크 발표 : 연구팀은 엔드투엔드 통합 감각-운동 강화학습 프레임워크를 제안하고, 인코더-디코더를 활용해 과거 시계열 관측을 압축하는 동시에 적대적 모션 사전 정보를 보완하여, 실제 로봇(Booster 플랫폼)에서 온보드 카메라에만 의존한 동적 공 탐색, 보행 적응형 미세 조정 및 50Hz 연속 슈팅 반응을 구현했습니다. 움직이는 목표물에 대해서도 높은 성공률을 유지했습니다 (출처: 机器之心)
.jpg)
DAIR.AI, 코딩 Agent 개발 행동 및 컨텍스트 읽기 선호도 실증 연구 발표 : 연구팀이 3.3만 개의 Agent 생성 Pull Request와 557회의 장기 과제 개발 세션을 추적 분석한 결과, 지침 파일(AGENTS.md/CLAUDE.md)과 임시 메모가 Agent 전체 읽기량의 60.5%를 차지한 반면, 기존 API 문서는 1.3%에 불과한 것으로 나타났습니다. Agent가 문서를 너무 이른 시점에 빈번하게 검색하도록 하면 즉각적인 테스트 검증 빈도가 크게 낮아지는 것으로 확인되었습니다 (출처: dair_ai)
강화학습 종합 튜토리얼: 정책 경사(Policy Gradient)부터 최신 LLM 사후 학습까지 : 머신러닝 연구원 Cameron Wolfe가 LLM 강화학습 시스템에 대한 장문의 가이드를 발표했습니다. 마르코프 결정 과정 유도부터 시작하여 Vanilla Policy Gradient, PPO, GRPO 및 최신 변형 기법(Dr. GRPO, DAPO)의 기술적 세부사항을 체계적으로 분석하고, LLM 정렬에서 Critic 없는 아키텍처가 갖는 VRAM 및 연산 효율성 측면의 이점을 중점적으로 다루었습니다 (출처: cwolferesearch)
💼 비즈니스
Anthropic 기업 서비스 합작사 Ode, Casper Studios 인수 : Anthropic이 Blackstone, Hellman & Friedman 등의 투자사와 공동 설립한 엔터프라이즈 AI 서비스 법인 Ode가 첫 인수를 완료했다고 발표했습니다. 샌프란시스코의 AI 인티그레이터 Casper Studios 팀을 영입하여 대형 전통 기업의 복잡한 IT 및 규제 준수 워크플로우에 Claude Code 및 맞춤형 Agent 솔루션을 신속히 도입할 계획입니다 (출처: AI Business)

Unitree Robotics, 상장 첫 주 시가총액 40% 이상 급락 : 커촹반(科创板) ‘휴머노이드 로봇 1호주’로 상장한 Unitree Robotics(宇树科技)가 첫날 시가총액 4,400억 위안을 돌파한 뒤 연이어 조정을 받으며 최근 2,400억 위안 구간으로 하락했습니다. 시장 분석가들은 초기 유통 물량이 극히 적어 밸류에이션 프리미엄이 높게 형성되었으나, 현재 높은 PER과 매출의 70% 이상이 여전히 대학/연구기관 구매에 의존하고 있는 현실로 인해 2차 시장이 양산 인도 품질과 실제 산업 재구매율을 기준으로 합리적인 재평가에 들어갔다고 보고 있습니다 (출처: 36氪)
온디바이스 AI 인프라 스타트업 Silicon Token, 수억 위안 규모 멀티 라운드 투자 유치 : Silicon Token(硅基词元)이 ZhenFund(真知创投)가 주도하는 멀티 라운드 투자를 유치하며 기업가치가 20억 위안에 육박했다고 발표했습니다. 이 회사는 데스크톱급 온디바이스 AI 워크스테이션과 이기종 스케줄링 시스템을 주력으로 하며, VRAM을 스트리밍 채널로 전환하는 기술을 통해 단일 16GB 소비자용 그래픽 카드로도 120GB 가중치가 필요한 고밀도 비디오 생성 모델을 풀 구동할 수 있게 하여 저비용 로컬 콘텐츠 제작을 지원합니다 (출처: 36氪)
🌟 커뮤니티
OpenAI, ChatGPT 내 협박성 대화로 사용자 체포된 사례 공유… AI 프라이버시 경계 논란 촉발 : 미국 플로리다주의 전직 분석가가 ChatGPT 대화창에 전 여자친구에 대한 구체적인 살해 계획을 입력했다가 시스템 보안 리스크 감지에 걸려 OpenAI가 FBI에 인계하면서 최종 체포되었습니다. 이 사건은 커뮤니티에서 뜨거운 논쟁을 불러일으켰습니다. 신속한 개입으로 강력 범죄를 막았다는 찬성 의견이 있는 반면, 수색영장 없이 플랫폼이 선제적으로 모니터링하는 메커니즘이 사용자 프라이버시를 침해하고 새로운 ‘타라소프(Tarasoff) 경고 의무’ 딜레마를 초래할 수 있다는 개발자 및 법학자들의 우려도 제기되고 있습니다 (출처: 36氪)
Vercel Gateway의 오픈소스 모델 토큰 점유율 62%로 역전, 독점 폐쇄형 모델 추월 : Vercel 창립자 Guillermo Rauch 및 투자 기관이 공개한 데이터에 따르면, Vercel AI Gateway에서 오픈소스 가중치 모델의 토큰 소비 비율이 최근 2개월간 28.4%에서 62%로 급증하며 사상 처음으로 시장 주류 자리에 올랐습니다. 커뮤니티에서는 멀티 에이전트 협업 아키텍처에서 하위 에이전트의 작업 수행이 비용에 극도로 민감하기 때문에, 방대한 토큰 사용량이 비싼 폐쇄형 플래그십에서 가성비 높은 오픈소스 모델로 이동한 결과라고 분석했습니다 (출처: X @GavinSBaker, 36氪)
개발자들 사이에서 온디바이스 초저비트 양자화 및 450M 전용 비전 모델 활용 방안 주목 : LocalLLaMA 커뮤니티에서는 450M 크기의 소형 비전 언어 모델(LFM2.5-VL)을 5만 장의 브라우저 스크린샷으로 특화 파인튜닝한 실험이 공유되었으며, 웹페이지 상태 구조화 추출 정확도에서 4B 범용 모델에 근접하는 성과를 보였습니다. 동시에 Llama 3.2를 위한 2.7-bit ARM CPU 초저비트 양자화 프레임워크도 주목받으며, 온디바이스 Agent 분야에서 ‘특화 전용 소형 모델’의 엔지니어링 잠재력을 입증했습니다 (출처: Reddit r/LocalLLaMA, HuggingFace Daily Papers)
💡 기타
2026년 ‘과학탐색상’ 수상자 명단 발표: 정보전자 분야에 황가오, 류쉬안저 등 선정 : 2026년 과학탐색상(Xplorer Prize)이 공식 발표되었습니다. 칭화대학교 황가오(Gao Huang, 기초 신경망 아키텍처 및 확산 언어 모델), 베이징대학교 류쉬안저(Xuanzhe Liu, 분산 대형 모델 및 지능형 컴퓨팅 센터 시스템 소프트웨어), 칭화대학교 첸쉐하이(Xuehai Qian) 등 젊은 과학자들이 정보전자 분야에 선정되어 AI 프론티어 알고리즘, 고효율 추론 프레임워크 및 컴퓨팅 하드웨어-소프트웨어 협업 분야의 탄탄한 역량을 입증했습니다 (출처: 机器之心)
.jpg)
비영리단체 조사, 주요 AI 챗봇이 민감 상담 시 입장 미공개 지적 : AlgorithmWatch가 ChatGPT, Gemini, Claude, Grok을 대상으로 진행한 다국가 실측 조사 결과에 따르면, 미성년자 및 계획되지 않은 임신 등 민감한 상담을 처리할 때 모델들이 이념적 배경을 명시하지 않은 채 특정 입장을 가진 비공식 상담 기관을 추천할 확률이 25%를 초과하는 것으로 나타났습니다. 이는 정보 게이트키퍼로서의 생성형 AI에 대한 사실적 투명성 및 법적 규제 준수 우려를 낳고 있습니다 (출처: THE DECODER)

Pew 조사: ChatGPT 출시 이후 신규 웹페이지의 1/3 이상에 AI 생성 콘텐츠 포함 : 퓨 리서치 센터(Pew Research Center)의 최신 데이터에 따르면, 2022년 말 대형 모델 보급 이후 오픈 웹에 새로 추가된 영문 웹페이지의 1/3 이상이 AI로 생성되었거나 심층 편집된 것으로 나타났습니다. 콘텐츠 생성의 가치가 크게 하락함에 따라 검색 엔진, 데이터 정제 도구, 평가 프레임워크 등에서 합성 텍스트에 대한 보다 엄격한 필터링 및 출처 추적 메커니즘 구축이 불가피해지고 있습니다 (출처: The Verge)