🔥 주목할 뉴스
Moderna와 Merck의 맞춤형 mRNA 암 백신 임상 3상 역사적 성공, AI 알고리즘으로 신항원 정밀 타깃팅 : 글로벌 mRNA 거두 Moderna와 Merck가 공동 개발한 최초의 맞춤형 mRNA 암 치료제 intismeran autogene(mRNA-4157)과 KEYTRUDA 병용 요법이 고위험 흑색종 대상 글로벌 임상 3상 시험(INTerpath-001)에서 역사적 돌파구를 마련하며, 무재발 생존기간(RFS)과 무원격전이 생존기간(DMFS)이라는 두 가지 핵심 1차 평가변수를 모두 충족했습니다. 해당 치료제는 설계 단계에서 딥러닝 통합 AI 알고리즘이 종양 유전자 시퀀싱 데이터로부터 면역원성이 가장 뛰어난 독자적 신항원을 최대 34개까지 평가 및 선별하고, 45일 이내에 환자 맞춤형 mRNA 제작을 완료합니다. 임상 데이터에 따르면 재발 또는 사망 위험을 49% 대폭 낮추었으며, 이는 “AI 타깃 선별 + 맞춤형 mRNA” 종양 면역 치료가 공식적으로 임상 3상 검증 및 상용화 단계에 진입했음을 의미합니다.(출처:MIT Technology Review)

범용 Embodied AI 스타트업 Generalist, GEN-1.5 모델 공개… 로봇의 단 1회 시연으로 파인튜닝 없는 온더플라이 학습 구현 : 범용 Embodied AI 스타트업 Generalist가 물리 세계 기초 모델 GEN-1.5를 공식 발표했습니다. 방대한 실제 물리 상호작용 데이터에 대해 8개월 이상 대규모 사전 학습을 진행한 GEN-1.5는 강력한 물리적 In-Context Learning 및 Physical Prompting 능력을 선사합니다. 사용자는 로봇에게 3초에서 12초 분량의 인간 시연 비디오를 Physical Prompt로 제공하기만 하면, 로봇이 어떠한 파인튜닝 없이도 병뚜껑 열기, 휴지 뽑기, 도구 조작 등 새로운 태스크를 즉시 일반화하여 수행할 수 있습니다. 테스트 결과, 제로 파인튜닝 단 1회 시연 성공률은 59%에 달하며, 5분 간의 데이터 파인튜닝 후에는 83%까지 향상되어 업계에서는 이를 Embodied Robot 분야의 “GPT-3 모멘트”로 평가하고 있습니다.(출처:Generalist AI)

Nvidia Vera Rubin 아키텍처 첫 연산 랙, OpenAI에 공식 인도… 차세대 프론티어 모델 사전 학습 지원 : OpenAI와 Nvidia가 두 회사의 연산 협력에 있어 중요한 이정표를 발표했습니다. 첫 Nvidia Vera Rubin 아키텍처 연산 랙이 OpenAI에 공식 전달되어 조립을 마치고 기본 학습 스택에 성공적으로 연결되었습니다. 해당 랙은 OpenAI 차세대 프론티어 AI 대형 모델의 사전 학습 연산 풀 확장에 직접 투입되며, Nvidia의 차세대 가속 컴퓨팅 플랫폼이 전 세계 최첨단 대형 모델의 실운용 환경에 공식 투입되었음을 의미합니다.(출처:Nvidia News)

Slack, “다인원 그룹 채팅 코딩” 지원하는 Slack Code 출시… Anthropic, Devin 및 GitHub 등 Agent 연동 : Salesforce 산하 Slack이 Slack Code를 공식 출시하여, AI 코딩 Agent를 기존의 단일 사용자 터미널 및 IDE에서 기업 협업 그룹 채팅으로 확장했습니다. 팀원들은 Slack 채널 내에서 Agent를 직접 @호출하여 전용 Code Channel을 자동 생성할 수 있으며, 이를 통해 인간 개발자, 제품 매니저(PM)가 Devin, Claude Code, GitHub Copilot, ChatGPT 등 AI Agent와 동일 채널에서 실시간 협업 및 코드 리뷰를 진행할 수 있습니다. Agent는 Slack의 기존 보안 정책과 권한 체계를 상속받으며, 고위험 작업 실행 시에는 반드시 인간 전문가의 2차 승인을 거쳐야 하므로 AI 코딩 툴이 다인원 그룹 채팅 협업 플랫폼으로 패러다임 전환을 이루었음을 보여줍니다.(출처:Salesforce / Slack)

🎯 동향
오픈소스 대형 모델 Ornith-1.5 출시, 엔드투엔드 자가 진화 노선 주력 : 오픈소스 대형 모델 팀 Ornith가 9B Dense, 35B MoE, 397B MoE 3가지 아키텍처로 구성된 Ornith-1.5 시리즈 모델을 공식 발표했으며, MIT 라이선스를 적용했습니다. 해당 모델은 스스로 새로운 태스크를 제안하고 스캐폴딩을 자동 구축하며, 자가 대국(Self-Play)으로 솔루션을 생성하는 강화 학습을 수행하여 SWE-bench Verified(86점) 및 Terminal-Bench 2.1(86.1점) 등 벤치마크에서 동급 규모 오픈소스 최고 수준을 기록했습니다. 이미 vLLM 및 Ollama 생태계에 네이티브하게 통합되었습니다.(출처:Ornith AI)

DeepSeek Harness v0.1.0-rc.8 프리릴리즈 버전 공개… 멀티모달 및 서브 Agent 오케스트레이션 대폭 강화 : DeepSeek이 자사의 오픈소스 Agent 프레임워크 DeepSeek Harness를 rc.8 버전으로 업그레이드했습니다. 새 버전에서는 DeepSeek 모델 어댑터에 네이티브 이미지 요청 지원이 추가되어 /goal 및 /plan 명령어에서 텍스트와 이미지를 혼합 입력할 수 있습니다. 동시에 Claude Code 및 Codex가 서브 Agent 체계에 더욱 깊이 통합되어 Profile Bundle 형태로 필요에 따라 설치 및 다중 인스턴스 동시 실행을 지원하며, Windows PTY 터미널 및 web_search 동시 실행 경험이 대폭 최적화되었습니다.(출처:DeepSeek Release)
.jpg)
Liquid AI, LFM2.5-DSpark 증류 드래프트 모델 출시… 추론 속도 최대 3.2배 향상 : Liquid AI가 자사의 LFM2.5-1.2B, 2.6B 및 8B-A1B 모델을 겨냥해 약 300M 파라미터 규모의 DSpark 추측 샘플링(Speculative Sampling) 드래프트 모델을 선보였습니다. 이 모델은 병렬 백본 네트워크, 마르코프 연속 헤드, 신뢰도 프루닝을 결합하여 타깃 모델의 그리디 디코딩 출력과 100% 동일한 품질을 유지하면서도 H100 및 MacBook 로컬 온디바이스 추론 속도를 2.1배에서 3.18배까지 끌어올렸습니다. 이를 통해 Tool-calling 지연 시간을 현저히 줄였으며, llama.cpp 및 SGLang 지원도 동시 완료했습니다.(출처:Liquid AI Blog)

Meta, Meta AI Mac 독립 데스크톱 버전 출시… 시스템 수준 음성 받아쓰기 및 교차 앱 화면 인지 지원 : Meta가 Muse Spark 모델 기반의 Mac용 Meta AI 데스크톱 앱을 출시했습니다. 전역 Fn 단축키를 통해 애플리케이션을 넘나드는 실시간 고정밀 음성 받아쓰기를 지원하며, 사용자가 현재 화면 창을 공유하여 AI가 실시간으로 인지하고 코칭하도록 허용합니다. 해당 앱은 Google Workspace 및 Instagram/Facebook 비즈니스 관리자와 연결하여 마케팅 효과 진단 및 문서 자동 생성도 진행할 수 있습니다.(출처:TechCrunch)

OpenAI, ChatGPT 데스크톱용 Apple Messages 플러그인 출시 및 “Private Safety Processing” 메커니즘 예고 : ChatGPT 데스크톱 및 Codex에 Apple Messages 플러그인이 새롭게 추가되어, 로컬 권한 부여 하에 사용자가 자연어로 과거 문자 메시지를 검색, 요약하고 답장을 초안 작성할 수 있게 되었습니다. 동시에 OpenAI는 제로 데이터 보존(ZDR)을 유지하는 전제 하에 암호화된 보안 신호를 통해 세션 간 고위험 오남용 행위를 식별하는 “Private Safety Processing” 기술을 예고했습니다.(출처:OpenAI News)

🧰 도구
Superwhisper, 온디바이스 텍스트 정규화 모델 S1-mini 오픈소스 공개… 462MB로 음성 전사 초고속 오동작 수정 : Superwhisper가 음성 인식 후처리에 특화된 텍스트 정규화 모델 S1-mini를 오픈소스로 공개했습니다. Qwen3-0.6B 기반으로 파인튜닝된 이 모델은 크기가 462MB(Q4_K_M GGUF)에 불과하여 Mac/PC 로컬 CPU에서 완벽히 동작합니다. 구어체 추임새 제거, 말실수 교정, 문장 부호 보완, 숫자·이메일·날짜 형식 정규화를 자동으로 수행하며, 토큰 정확도는 94.8%에 달합니다.(출처:Superwhisper / Hugging Face)

Chroma, “Foundation” 메모리 엔진 출시… Agent를 위한 자가 진화 장기 기억 구축 : Chroma가 Agent의 장기 세션 대화를 위한 자가 진화 메모리 솔루션인 Foundation을 공식 출시했습니다. 이 엔진은 Agent의 과거 실행 Trace에서 구조화된 경험, 전략 선호도, 컨텍스트 연관성을 자동으로 추출하고, 이후 세션에서 이를 동적으로 불러오고 업데이트하여 Agent의 세션 간 기억 상실 및 패턴 고착화 문제를 효과적으로 해결합니다.(출처:Chroma)

Tencent, AI Red Teaming 플랫폼 AI-Infra-Guard (A.I.G) 오픈소스 공개 : Tencent Zhuque Lab이 풀스택 AI 레드티밍 안전 평가 플랫폼 A.I.G를 오픈소스로 공개했습니다. Agent Scan, Skills Scan, MCP Server Scan 및 AI 인프라 취약점 스캔(2,000개 이상의 CVE 규칙 및 130개 이상의 컴포넌트 포함)을 통합하였으며, 내장된 Agent 스킬 보안 벤치마크인 SkillTrustBench를 통해 기업이 Agent의 권한 남용, 지시 하이재킹 및 공급망 취약점을 감지하도록 지원합니다.(출처:Tencent / GitHub)

📚 학습 및 연구
Terence Tao, ICM 2026 기고문 발표: AI 시대 수학 연구의 5단계 “문제-해결 파이프라인”과 인지 위기 : 필즈상 수상자인 Terence Tao가 최신 논문을 발표하며, AI의 대규모 수학 연구 참여가 괴델 시대 이후 가장 큰 가치 위기를 불러올 것이라고 지적했습니다. 그는 수학 문제 풀이를 “생성 – 검증 – 해석 – 공동체 수용 – 이론 규범화”의 5단계로 해체하고, AI가 올바른 증명을 제시하는 것만으로는 수학적 작업이 완료된 것이 아니며, 인간 수학자가 증명 해석 및 이론 규범화라는 대체 불가능한 책무를 맡아야 한다고 강조했습니다.(출처:THE DECODER)

Zhipu AI Tang Jie, 포스트 트레이닝 Scaling Law 공유: 파라미터 수가 더 이상 지능 측정의 유일한 잣대는 아니다 : Zhipu 공동 창업자인 Tang Jie가 GLM-5.3의 바탕이 된 포스트 트레이닝 scaling에 관한 견해를 상세히 설명했습니다. GLM-5.3은 743B 기반 모델(활성화 40B)을 교체하지 않은 상태에서, 순수 장기 환경 강화 학습만으로 코딩 능력을 50% 향상시켰습니다. 그는 모델 능력이 베이스 크기, 데이터 양, 순방향 계산량 및 포스트 트레이닝에 의해 공동 결정되며, 현 단계에서는 유효 깊이와 추론 체인 길이를 끌어올리는 포스트 트레이닝이 엄청난 잠재력을 지니고 있다고 제안했습니다.(출처:dotey / Zhipu AI)

Google과 DeepMind, Recirculation 메커니즘 제안: 재학습 없이 Transformer의 심층 활성화 재순환 구현 : 논문에서는 사전 학습된 모델의 그래디언트를 수정하지 않고 추론 단계에서 심층 표현을 얕은 층으로 되돌리는 재순환 루프 메커니즘(Recirculation)을 제안했습니다. 아담한 MLP를 통해 재순환 계수를 동적으로 예측함으로써 Gemma3는 9개 언어 모델링 데이터셋에서 펄플렉서티(Perplexity)를 23.0% 낮춰 풀 파인튜닝 성과를 역전시켰으며, GSM8K 정확도를 약 21% 향상시켰습니다.(출처:DeepMind / 机器之心)

Tsinghua 및 Microsoft 등 연구팀, SPADE 제안: 실행 가능한 환경 셀프 플레이 기반의 장기 Agent 자가 진화 프레임워크 : 논문에서는 동일한 LLM이 각각 환경 디자이너(Environment Designer)와 추론 Agent(Reasoning Agent) 역할을 나누어 수행하는 SPADE 프레임워크를 제안했습니다. 환경 디자이너가 Gym 인터페이스가 포함된 실행 가능한 대리 환경과 점진적으로 난이도가 높아지는 태스크를 스스로 작성하고, 프롬프트 후회도 신호를 통해 강화 학습을 구동함으로써 인간의 개입 없이 개방형 자율 학습 향상을 달성합니다.(출처:HuggingFace Daily Papers)

💼 비즈니스
Nvidia, Poolside와 60억 달러 규모 기술 라이선스 계약 체결 및 10억 달러 추가 투자 : 코드 대형 모델 전문 AI 스타트업 Poolside가 Nvidia와 60억 달러 규모의 비독점 기술 라이선스 계약을 체결했으며, Nvidia는 동시에 10억 달러를 추가 투자하여 Poolside의 투자 전 기업 가치를 120억 달러로 끌어올렸습니다. 해당 계약에는 Poolside 직원 109명에 대한 Nvidia의 입사 제안도 포함되어 있어 반도체 및 AI 분야에서 또 하나의 대형 거래 기록을 세웠습니다.(출처:Techmeme / Newcomer)

Simile, 3억 달러 투자 유치하며 기업 가치 20억 달러 달성… 전 계층 합성 시뮬레이션 주력 : 스탠퍼드 Smallville(25개 AI Agent 마을 실험) 연구진이 설립한 Simile이 설립 6개월이 채 되지 않아 3억 달러 이상의 투자를 유치하고 기업 가치가 20억 달러로 치솟았습니다. 이 회사는 방대한 실제 데이터 인터뷰를 기반으로 합성 인구를 구축하여, 제품 출시, 가격 정책, 정부 정책 발표 전 시장 반응을 미리 예측하는 솔루션을 제공합니다.(출처:The Turing Post)

Ramp, AI 모델 라우팅 서비스 “Router” 출시… OpenRouter 및 Stripe와 정면 대결 : 기업 지출 관리 거두 Ramp가 자체 AI 모델 라우팅 서비스인 Router.com을 공식 출시했습니다. OpenAI, Anthropic, DeepSeek, Moonshot, xAI 등 다양한 모델의 단일 API 접근을 제공하며, 비용, 지연 시간, 사용자 지정 벤치마크 지표를 기반으로 동적 라우팅 전략을 지원해 기업의 AI Token 지출 관리에 직접 개입합니다.(출처:TechCrunch / Ramp)

🌟 커뮤니티
개발자 커뮤니티, AT&T 등 대기업의 “프론티어 모델 탈피” 열의: 기업 AI 트래픽 40%가 오픈소스 모델로 전환되며 비용 56% 절감 : 커뮤니티에서는 AT&T 등 대기업이 직원 AI 트래픽의 40%(향후 60-70%까지 확대 계획)를 오픈소스 모델로 라우팅하여 품질 저하는 2%에 불과하면서 코딩 비용을 56% 절감(일평균 450억 토큰 처리)하고 있는 현상이 뜨거운 화제입니다. 이는 최상위 연구소들이 가장 우려하던 트렌드, 즉 기업들이 비핵심 태스크를 가성비 높은 오픈소스 모델로 대거 전환하고 있음을 입증합니다.(출처:TheZachMueller)

Grok Bot, “15초 만에 앱 제작” 열풍 일으키며 AI 시대의 또 다른 “Claude Code 모멘트”로 평가 : 실리콘밸리 투자자들과 개발자들이 Grok Bot 사용 후기를 잇달아 공유하며, “제로 설정 클라우드 VM + 멀티 Agent 협업” 경험이 생산성을 100배 끌어올렸다고 칭찬하고 있습니다. 사용자는 단 몇 줄의 자연어만으로 15초 만에 독립 도메인을 가진 완전한 작동 앱을 생성할 수 있어 “1인 기업”과 Agent 네이티브 워크플로에 대한 활발한 논의를 불러일으키고 있습니다.(출처:grok)

OpenAI와 Anthropic, 데이터 미보관/프라이빗 처리 정책 연이어 출시… 기업급 프라이버시·보안 우려 해소 : 프론티어 모델의 프라이버시 및 컴플라이언스에 대한 기업들의 우려에 대응하여, OpenAI는 Private Safety Processing을 발표했고, Anthropic 역시 올가을 Mythos급 고급 모델을 대상으로 제로 데이터 보존(ZDR) 및 고객 자율 제어 데이터 정책을 출시하겠다고 밝히며 기업 고객 확보를 위한 프라이버시 보호 경쟁을 본격화했습니다.(출처:Bloomberg / OpenAI)

미국 여러 주 정치가들, “데이터 센터 전력망 및 수자원 분쟁”으로 유권자 반발에 부딪혀… AI 인프라, 지역 정치적 난관 직면 : 미국 공화당 상원위원회가 내부 경고를 통해 데이터 센터 건설로 인한 전력·수자원 분쟁과 전기 요금 인상이 오하이오, 텍사스 등지에서 강력한 대중적 반발을 일으키고 있으며, 텍사스에서는 무려 1,800개에 달하는 데이터 센터 프로젝트가 중단되는 등 AI 인프라 구축이 선거철 가장 민감한 지역 이슈로 떠올랐다고 지적했습니다.(출처:EERandomness / MIT Technology Review)

💡 기타
Anthropic, 무료 Claude Academy 학습 플랫폼 오픈 : IPO를 앞두고 Anthropic이 대중을 위한 무료 학습 플랫폼 Claude Academy(academy.claude.com)를 공식 오픈했습니다. AI 기초 개념부터 고급 Prompt 엔지니어링 및 Claude Code 사용법에 이르는 전 과정 교육과 수료 인증서를 제공합니다.(출처: Claude)

Cloudflare, Workers 플랫폼 내 취약한 원격 Spectre 사이드 채널 취약점 패치 : Cloudflare 보안 팀이 Cloudflare Workers 엣지 컴퓨팅 플랫폼에 존재하던 원격 Spectre 사이드 채널 취약점을 공개하고 패치했습니다. 해당 취약점은 공격자가 테넌트 간 메모리 데이터를 읽을 수 있게 만들 위험이 있었으나, 현재까지 실제 악용 사례는 발견되지 않았습니다.(출처: Cloudflare)
Gemma 오픈소스 대형 모델 패밀리, 전 세계 누적 다운로드 10억 회 돌파 : Google DeepMind 팀이 오픈소스 모델 Gemma 시리즈의 전 세계 누적 다운로드 수가 10억 회를 돌파했다고 발표했습니다. 커뮤니티 파생 파인튜닝 변형 모델만 10만 개 이상 생성되었으며, 위성 엣지 컴퓨팅부터 오프라인 모바일 기기에 이르기까지 다양한 분야에서 활용되고 있습니다.(출처: Google DeepMind / Ollama)
