🔥 포커스
글로벌 정·재계 AI ‘속도 제한령’ 공방: 서구 정치권의 강력한 반발, 중국의 오픈소스 생태계 추진, 올트먼과 나델라의 입장 표명 : Anthropic, OpenAI 및 일론 머스크 등의 프론티어 AI 연구 개발 속도 조절 제안에 대해 글로벌 정·재계가 크게 요동치고 있습니다. 중국 관영 매체와 외교부 대변인은 속도 제한론을 “공포를 조장하고 타국의 기술 발전을 억압하려는 냉전적 각본”이라고 비판하며, 브릭스(BRICS) 정상회의에서 오픈소스를 중심으로 한 포용적 AI 및 보안 방어 생태계 구축을 강력히 추진했습니다. 미국 정치권 역시 즉각 반발하고 나섰으며, 트럼프는 아일랜드에서 감속을 명확히 거부하고 AI 경쟁은 ‘승자독식’이므로 미국이 주도권을 결코 양보할 수 없다고 강조했습니다. 백악관 과학기술자문위원회 공동의장 David Sacks는 속도 제한 제안을 “도덕의 탈을 쓴 업계 카르텔이자 규제 포섭”이라고 직격했습니다. 이에 대해 올트먼은 “페이스 조절(Pacing)은 결코 정체가 아니다”라며, 핵심은 반독점 면제를 기다리는 것이 아니라 프론티어 RL 훈련 전 명시적인 안전 사용 사례를 도입하고 모니터링을 강화하는 것이라고 해명했습니다. 마이크로소프트 CEO 나델라 또한 규칙과 감사가 소수 연구소에 독점되어서는 안 되며, 오픈소스와 폐쇄형 모델의 공동 번영을 보장하고 기업의 모델 주권을 지켜야 한다고 강조했습니다. (출처: The Verge, THE DECODER, WIRED, The Guardian, teortaxesTex, sama, NandoDF)

클레이 수학연구소, 나비에-스토크스 난제 풀이 공식 심사 착수 공식 확인 : 7대 밀레니엄 수학 난제 판정 권한을 가진 클레이 수학연구소(CMI)가 나비에-스토크스 방정식의 존재성과 매끄러움 문제가 “외견상 해결되었다(apparently been settled)”고 공식 발표했습니다. 관련 기계 증명 자료는 정해진 규정에 따라 엄격하고 전면적인 동료 평가(Peer Review)를 받고 있습니다. CMI는 중대 난제의 가치가 결론뿐만 아니라 새로운 수학적 사고와 이론적 도구를 촉진하는 데 있다고 강조하며, 형식 검증(Formal Verification) 도구가 진행을 대폭 가속화했으나 학술위원회의 평가는 조급하지 않고 신중하게 유지될 것이라고 밝혔습니다. 이번 공식 입장은 AI 주도의 최첨단 이론 과학 탐구가 학술 권위 기관의 정식 심사 기준을 통과했음을 의미합니다. (출처: THE DECODER)
제3자 감사 기관의 독립성에 대한 집단 비판, METR의 깊은 이해관계망이 촉발한 신뢰 위기 : 선도 연구소들이 METR에 직원급 상주 감사 권한을 부여하겠다고 발표한 후 기술계에서 강력한 반발이 일어났습니다. David Sacks, Lina Khan 및 다수의 보안 전문가들은 METR의 핵심 인력과 자금 네트워크가 Anthropic 및 효과적 이타주의(EA) 진영과 깊이 얽혀 있어, 이른바 자발적 규제는 제조물 책임법을 회피하고 업계 진입 장벽을 높이기 위한 지대추구(Rent-seeking) 행위에 불과하다고 지적했습니다. 또한 METR은 과거 API 키 유출로 60만 달러 상당의 크레딧을 도난당했던 보안 취약점이 드러나면서, ‘업계 심판’으로서의 전문성과 중립성에 심각한 의문이 제기되고 있습니다. (출처: ClementDelangue,nptacek)

빅테크의 속도 조절 요구에 아시아·태평양 기술주 급락, AI 인프라 부채 및 CapEx 재평가 직면 : OpenAI의 IPO 연기와 주요 연구소들의 ‘프론티어 속도 제한’ 호소의 영향으로 아시아·태평양 지역의 AI 및 반도체 섹터가 일제히 하락했습니다. 소프트뱅크 그룹은 하루 만에 약 12% 급락했고, 한국 KOSPI 지수는 3% 이상 하락했으며, SK하이닉스, TSMC 등 상류 칩 파운드리 및 메모리 거두들의 낙폭도 두드러졌습니다. 애널리스트들은 시장이 수천억 달러 규모의 데이터센터 자본 지출(CapEx)과 고레버리지 전력망 투자 확약의 지속 가능성을 재평가하고 있다고 지적합니다. 프론티어 모델의 반복 개발이 안전성 검토로 인해 인위적으로 지연될 경우, 실질적인 수익을 창출하지 못하는 인프라 부채가 새로운 신용 리스크로 비화할 수 있습니다. (출처: The Guardian, 36氪)

🎯 동향
DeepWisdom, 물리 AI 기반 모델 PhysBrain 1.5 공개, 최상위 폐쇄형 모델에 필적하는 공간 지능 달성 : DeepWisdom이 물리 기반 모델 PhysBrain 1.5(2B 및 8B 파라미터 제공)를 오픈소스로 정식 공개했습니다. 공간 인지, 동작 생성, 미래 예측을 아우르는 28개 공개 체화(Embodied) 벤치마크에서 평균 72.5점을 기록하며 오픈소스 1위를 차지했고, GPT-6 Astra(73.3점)에 근접했습니다. 이 모델은 Ego360 파노라마 인간 실제 데이터와 ‘Physical Loop’ 폐쇄 루프 아키텍처를 기반으로 자귀회귀(Autoregressive) 백본을 공간 좌표 추론과 60Hz 로봇 말단 액션 생성에 통합하여, 휴머노이드 로봇에 제로샷으로 전이해 정밀 작업을 수행할 수 있도록 지원합니다. (출처: 量子位)

MS 오피스 3대 프로그램 Copilot, xAI의 Grok 모델 공식 도입 : 마이크로소프트가 Microsoft Frontier 엔터프라이즈 사용자를 위한 Copilot 모델 선택지를 확대하여 Word, Excel, PowerPoint에 xAI의 Grok 모델 제품군을 공식 연동했다고 발표했습니다. 사용자는 모델 전환기에서 OpenAI GPT, Anthropic Claude, Grok을 자유롭게 선택할 수 있으며, 마이크로소프트의 이번 조치는 단일 공급업체 종속을 탈피하고 전문 오피스 제품군 내에서 복잡한 데이터 처리 및 장문 작성에 대한 모델별 스타일 선호도를 테스트하기 위함입니다. (출처: The Verge)

Doubao 폰 어시스턴트 소비자용 버전 출시 및 SAEP 화면 자동화 프로토콜 발표 : 바이트댄스가 nubia NaviX Ultra 기기에 탑재된 Doubao 폰 어시스턴트 소비자용 버전을 정식 출시했습니다. 지문 인증 AI 전용 키, 멀티모달 화면 컨텍스트 즉각 질의응답, 크로스 앱 자동화 작업 수행 기능을 통합했습니다. 그래픽 인터페이스 Agent의 행동 경계를 규범화하기 위해 30일간의 화면 자동화 작업 선언 프로토콜(SAEP)을 함께 발표하여, 서드파티 개발자가 직접 권한을 선언해 무단 크로스 디바이스 작업을 차단할 수 있도록 했습니다. (출처: 机器之心)
.png)
샤오펑, Infini-VLA 발표: 자율주행 장기 시계열 메모리에 KV Cache 도입 : 샤오펑(Xpeng) 자율주행 팀이 LLM의 KV Cache 메커니즘을 엔드투엔드 비디오 스트림 처리에 최초로 적용했습니다. 도로 상황 프레임을 글로벌 시계열 캐시에 지속적으로 기록함으로써, 차량 탑재 컴퓨팅 파워의 변화 없이 지난 30초의 히스토리 메모리를 구현하고 엔드투엔드 응답 속도를 300% 향상시켰습니다. 이를 통해 기존 솔루션에서 발생하던 황색 신호 판단 및 교차로 대치 상황에서의 ‘시계열 건망증’ 문제를 완벽히 해결하고 의사결정의 견고성을 크게 높였습니다. (출처: ZhihuFrontier)

MoleculeMind QuantaMind

OpenAI, Plus 유저 대상 GPT-6 Astra 전면 배포, 워크벤치 전용으로 일반 일상 대화는 제한 : OpenAI가 월 20달러의 Plus 구독 사용자에게 GPT-6 Astra를 정식 공개했습니다. 다만 해당 모델은 ChatGPT Work 및 Codex 두 가지 워크벤치 인터페이스에서만 제공되며, 일반 Chat 대화창은 기존의 제한을 유지합니다. 공식 문서에 따르면 Plus 사용자는 5시간마다 5~45개의 Astra 실행 쿼터를 부여받으며, 이는 고비용 프론티어 모델을 코드 리팩터링, 멀티스텝 리서치, 컴퓨터 제어 등 고부가가치 생산성 시나리오에 한정하려는 OpenAI의 상용화 전략을 보여줍니다. (출처: 36氪)

Sakana AI, 역전파 없는 로컬 학습 아키텍처 PC-ALM 제안 : Sakana AI가 예측 코딩(Predictive Coding)과 증강 라그랑주 승수법(Augmented Lagrangian)을 결합하여 신경망의 각 레이어가 로컬 PI 피드백 제어 시스템으로서 신용 할당(Credit Assignment)을 수행하는 PC-ALM 알고리즘을 공동 발표했습니다. 이 방식은 글로벌 역전파(Backprop)에서 완전히 벗어나 1,000개 레이어의 초심층 네트워크에서 안정적인 학습을 달성함으로써, 뇌 모사 컴퓨팅 및 뉴로모픽 하드웨어 기반의 저전력 AI 학습을 위한 새로운 경로를 열었습니다. (출처: SakanaAILabs)
상하이 AI 랩, Intern-S2-397B 공개 및 vLLM 데이-제로(Day-0) 지원 확보 : 상하이 인공지능 연구소가 장기 과학 연구를 위한 멀티모달 기반 모델 Intern-S2-397B를 출시하여, 과학적 추론, 코드 구현 및 자율 연구 Agent 작업에서 오픈소스 최고 수준의 성능을 달성했습니다. 오픈소스 고처리량 추론 프레임워크인 vLLM은 출시 당일 즉각 배포를 지원한다고 발표하여 학계와 산업계의 도입 장벽을 더욱 낮췄습니다. (출처: vllm_project)

FlashREINFORCE 오픈소스화: 단일 Rollout 비동기 Critic-free 강화학습 신규 프레임워크 : NVIDIA NeMo 팀 등이 ‘단일 배치 REINFORCE + 시퀀스 신뢰 구간 제약 + 샘플 평균 최적화’ 설계를 채택한 FlashREINFORCE를 공동 오픈소스화했습니다. LLM 에이전트 학습에서 최초로 단일 Rollout 비동기 업데이트를 구현하여, 긴 샘플 대기로 인한 기존 GRPO의 큐 블로킹 현상을 극복하고 6,000스텝 이상의 높은 안정적인 업데이트를 달성했습니다. (출처: giffmana)

IFM, K2 Horizon 모델 제품군 오픈소스 공개: 3.7B부터 375B까지 전 규모 가중치 제공 : 연구팀이 3.7B, 7B, 36B 및 플래그십 375B MoE 아키텍처를 아우르는 K2 Horizon 시리즈 기반 모델을 오픈소스화하고 사전 훈련 세부 정보를 전면 공개했습니다. 벤치마크 결과 7B 소형 모델은 온디바이스 추론에서 뛰어난 가성비를 보였으나, 초대형 모델 버전의 긴 컨텍스트 KV Cache 최적화는 추가적인 개선이 필요한 것으로 나타났습니다. (출처: ethanCaballero,Reddit r/LocalLLaMA)

난양공대 MMLab, 네이티브 통합 멀티모달 메커니즘 규명 및 Task-decoupled MoT 아키텍처 제안 : 난양공과대학교 팀이 arXiv에 논문을 발표하고 표상, 작업, 시스템 3개 계층에서 통합 멀티모달 모델(UMM)의 시각 이해와 생성 간 협력 메커니즘을 체계적으로 탐구했습니다. 연구진은 강제적인 파라미터 밀집 공유가 표상 충돌을 유발한다는 점을 발견하고, 이해와 생성 브랜치를 분리하되 텍스트 및 어텐션 레이어에서 상호작용을 유지하는 Task-decoupled MoT 아키텍처를 제안했습니다. 이를 통해 기하학적 추론 및 3D 공간 지능 작업에서 유의미한 양방향 정방향 전이와 엔드투엔드 최적화 이득을 얻었습니다. (출처: 机器之心)
.jpg)
MiniMax H3 비디오 생성 생태계 급성장: 커뮤니티에서 증류 및 초고속 가속 솔루션 잇달아 공개 : MiniMax가 오픈소스화한 H3 오디오·비디오 생성 모델이 글로벌 생태계에서 뜨거운 반응을 얻고 있습니다. NVIDIA SANA 팀은 Sol-H3 2단계 파이프라인을 발표하여 8대의 B300 GPU에서 단 6.6초 만에 15초 분량의 768p 오디오·비디오를 생성할 수 있도록 했습니다. 동시에 FastVideo, 알리바바 PAI, ComfyUI가 잇달아 4~8스텝 증류 LoRA 및 어텐션 재구성 솔루션을 적용하여 하드웨어 진입 장벽을 대폭 낮췄습니다. (출처: MiniMax_AI)

Anthropic, iOS용 개인 금융 Agent ‘Claude Money’ 비공개 테스트 진행 : 유출된 코드 정보에 따르면, Anthropic이 iOS 클라이언트에서 Claude Money라는 새로운 개인 금융 기능을 준비 중인 것으로 밝혀졌습니다. 이 기능은 사용자가 은행 계좌를 직접 연동하면 Claude가 자동으로 청구서를 취합하고 재정 트렌드를 분석하며 지출 계획을 지원하도록 설계되어, 프론티어 Agent가 일상의 민감한 자산 관리 영역으로 빠르게 침투하고 있음을 보여줍니다. (출처: nicdunz)

OpenAI, GPT-Live 전화 SIP 인터페이스 오픈 및 임시 대화 저장 기능 출시 : OpenAI가 표준 SIP 전화 프로토콜을 지원하는 GPT-Live 실시간 음성 API를 정식 오픈하여, 개발자가 이를 기존 콜센터 및 통신 네트워크에 직접 연동할 수 있게 되었습니다. 동시에 ChatGPT 웹 및 모바일 버전 업데이트를 통해 사용자가 열려 있는 임시 대화(Temporary Chats)를 메인 히스토리 기록으로 원활하게 전환 및 저장할 수 있도록 지원합니다. (출처: juberti,Reddit r/ChatGPT)
🧰 도구
NVIDIA, 물리 AI 워크플로우 오케스트레이션 도구 OSMO 오픈소스화 : NVIDIA가 데이터센터 GPU 학습, RTX 워크스테이션 시뮬레이션, Jetson 엣지 실제 하드웨어 인더루프(HIL) 테스트 간의 물리 AI 스케줄링 파편화 문제를 해결하기 위해 Kubernetes 네이티브 워크플로우 오케스트레이터 OSMO(Apache-2.0 라이선스)를 정식 오픈소스화했습니다. 개발자는 단일 YAML 파일만으로 클러스터 간 데이터 파이프라인 협업 및 NVLink 토폴로지 스케줄링을 구현할 수 있습니다. (출처: MarkTechPost)
TrueForge: 토큰 비용을 대폭 절감하는 오픈소스 매니지드 AI Agent 런타임 프레임워크 : TrueFoundry가 MIT 라이선스의 에이전트 실행 거버넌스 프레임워크 TrueForge를 오픈소스화했습니다. 개발자가 로컬 또는 프라이빗 클라우드에서 멀티 모델 Agent 워크플로우를 실행할 수 있도록 지원하며, 세션 영속화, 샌드박스 환경, MCP 툴 서비스, 보안 승인 흐름을 분리했습니다. 엔터프라이즈 벤치마크 테스트에서 동일한 기반 모델을 사용했음에도 컨텍스트 점진적 노출 메커니즘을 통해 토큰 소비를 약 70% 절감하여, Agent 운영 비용이 모델 자체보다 Harness 아키텍처에 더 크게 좌우됨을 입증했습니다. (출처: )
Meta Muse 개인 Agent 인기 급상승: 보안 가상 머신과 일상 실사용 워크플로우 구현 : Meta의 최신 개인용 Agent 제품인 Muse가 커뮤니티에서 높은 평가를 받고 있습니다. Instagram 등 비공개 생태계 검색과 깊이 통합되어 보안 가상 머신 내에서 실행되며, 팝업 미니 브라우저를 통해 원활한 인간-기계 협업 핸드오프를 구현했습니다. 이를 통해 항공권 환불 청구, 의료 보험 청구서 추적, 복잡한 일정의 기기 간 협의 등을 전자동으로 완수할 수 있습니다. (출처: alexandr_wang,giffmana)

oh-my-hermes: Hermes Agent를 위한 풀기능 워크플로우 및 멀티 모델 라우팅 플러그인 : Nous Research Hermes Agent를 위한 고성능 거버넌스 플러그인 oh-my-hermes(OMH)가 오픈소스화되었습니다. Mixture-of-Models 라우팅, 13개 모델 제품군 맞춤 캘리브레이션, 파일 격리 병렬 Fan-out 엔진, 인간 검토 기반 장기 기억 시스템을 제공하며, 터미널 네이티브 TUI에서 토큰 비용과 코드 게이팅 검증 상태를 실시간으로 표시하여 장기 엔지니어링 작업의 실행 효율을 수배 향상시킵니다. (출처: GitHub Trending)

Microsoft Data Formulator: 멀티모달 Agent와 브랜치 탐색을 결합한 대화형 데이터 분석 시스템 : 마이크로소프트가 Data Formulator 0.8 버전을 오픈소스로 업그레이드했습니다. 자연어와 시각적 UI 상호작용을 결합하고 Data Thread를 기반으로 분석 파이프라인의 자유로운 브랜칭과 멀티 소스 데이터 메모리 연동을 구현했습니다. 통합된 DataAgent 및 Flint 차트 생성 엔진을 통해 CSV, 데이터베이스, UI 스크린샷에서 데이터를 자동으로 추출·정제하고 고품질 인터랙티브 차트를 생성할 수 있습니다. (출처: GitHub Trending)
PyTRIO: 기업 및 연구팀을 위한 TaaS 대형 모델 학습 API 플랫폼 : Emotional Machine이 ‘Training as a Service(TaaS)’ 모델을 개척한 대형 모델 학습 서비스 플랫폼 PyTRIO를 정식 출시했습니다. 개발자는 로컬에서 Loss, Reward 및 학습 루프 로직만 작성하면 되며, 하위단의 GPU 분산 컴퓨팅, 가중치 체크포인트, 중단 후 재개(Resume)는 클라우드 API가 처리합니다. Ascend 950PR/910B와 NVIDIA 하드웨어 간 원활한 마이그레이션을 지원하여 미세조정(Fine-tuning) 및 Agentic RL의 엔지니어링 진입 장벽을 크게 낮췄습니다. (출처: 机器之心)
.jpg)
개발자가 Claude를 활용해 밑바닥부터 구축한 구동 가능한 DOS 호환 OS ‘EMBER’ : 한 개발자가 ‘요구사항 정의 → Claude 구현 → 실기기 컴파일 부팅 → 디버깅 피드백’의 자율 폐쇄 루프를 통해 구형 노트북에서 독립적으로 구동되는 운영체제 EMBER를 구축했습니다. 자체 부트로더, GUI, 터치패드 드라이버를 포함하며 Sound Blaster 사운드 카드 및 PC 스피커 에뮬레이션을 성공적으로 구현하여 고전 DOS 게임을 원활히 네이티브 실행할 수 있습니다. (출처: Reddit r/ClaudeAI)

openwebui-claude-agent-pipe: OpenWebUI에 Claude Code 지속성 세션 기능 주입 : 오픈소스 프로젝트 openwebui-claude-agent-pipe가 Claude Code의 핵심 Agent Loop를 OpenWebUI에 완벽히 브릿지했습니다. 서비스 재시작 간 세션 유지, 하트비트 수준의 도구 호출 스트리밍 상태 표시, 인터랙티브 객관식 폼 콜백 및 자격 증명 자동 마스킹 처리를 지원하여 플랫폼 간 웹 기반 코딩 Agent 경험을 제공합니다. (출처: Reddit r/OpenWebUI)
OpenWebUI Sampler Lab: 로컬 모델 샘플링 파라미터 및 일관성 평가 시각화 워크벤치 : 로컬 대형 모델의 복잡한 파라미터 튜닝 문제를 해결하기 위해 개발된 openwebui-sampler-lab이 오픈소스화되었습니다. 고정된 프롬프트에서 온도(Temperature), top_p, min_p 등 샘플링 파라미터의 영향을 횡단 비교할 수 있으며, 5×5 인터랙티브 매트릭스와 다중 시드(Multi-Seed) 일관성 HTML 분석 대시보드를 자동 생성하여 프롬프트 및 페르소나 엔지니어링 튜닝을 획기적으로 단순화합니다. (출처: Reddit r/OpenWebUI)

Tahuna: 소규모 팀을 위한 올인원 GPU 학습 및 자율 실험 오픈소스 프레임워크 : Tahuna Labs가 분산형 AI R&D 플랫폼 Tahuna를 오픈소스화했습니다. 콘텐츠 주소 지정 및 매니페스트 잠금 메커니즘을 채택하여, 소규모 팀에게 즉시 사용 가능한 GPU 컴퓨팅 오케스트레이션, SFT/RL 학습 추적, 모델 엔드포인트 호스팅 및 ‘Hillclimb’이라는 자율 반복 실험 루프를 제공합니다. (출처: Reddit r/deeplearning)

OptMem: 고정 길이 추가형 Agent 메모리 관리 및 노화 방지 솔루션 : 개발자가 OptMem 메모리 관리 플러그인을 수주간 실전 테스트했습니다. OptMem은 고정 메모리 용량과 추가 전용(Append-only) 로그 아키텍처를 통해 장기 장문 세션에서 컨텍스트 부패(Memory Rot)로 인한 성능 저하 및 무한 루프 문제를 효과적으로 억제하여 뛰어난 장기 안정성을 보여주었습니다. (출처: VictorTaelin)

📚 연구 및 학습
CosmosMind, 대학들과 공동으로 MetaRSI-v1 제안: 모델·데이터·Harness를 최초로 통합한 메타 재귀 아키텍처 : 칭화대, 베이징대, 스탠퍼드대 및 CosmosMind가 ‘자가 개선의 과정’ 자체를 추상화한 MetaRSI-v1 프레임워크를 발표하고 Data-RSI, Harness-RSI, Model-RSI가 협력하는 Loop Kernel 패러다임을 제안했습니다. 외부 교사 모델의 개입 없이도 3B 오픈소스 소형 모델이 SWE-bench Pro 등의 벤치마크에서 평균 10.9점 향상되었고, 프론티어 플래그십 모델은 평균 7.3점 상승했으며, “검증이 자가 개선의 한계를 결정한다”를 포함한 5대 법칙을 체계적으로 도출했습니다. (출처: 量子位)

Theseus Labs, ‘인류가 구축하는 마지막 AI’ 및 RSI 5단계 자율성 로드맵 발표 : Theseus Labs가 여러 기관과 공동으로 종합 보고서를 발표하고, 기반 모델의 능력 상한을 측정하는 ‘능력 여유 폐쇄 지수(HCI)’를 처음 제시했습니다. 모델이 표준화 시험에서는 이미 포화 상태(수학 HCI 86.4)에 도달했으나, 장기 상호작용 도구 호출에서는 여전히 크게 뒤처져 있음(39.9에 불과)을 밝혔습니다. 보고서는 L1 실행 자율성부터 L5 재귀 상속 자율성까지의 5단계 분류 기준을 체계화하여, 산업계의 자가 진화 Agent 구현을 위한 엔지니어링 메트릭 프레임워크를 제시했습니다. (출처: 机器之心)
.jpg)
프린스턴 연구진, Recurrent Looped Transformer(RLT) 제안: LLM에 토큰 간 무한한 추론 깊이 부여 : 프린스턴 연구원 Yifan Zhang이 인과적 인코더와 순환 디코더를 결합한 RLT 아키텍처 기술 보고서를 발표했습니다. 각 토큰 스텝에서 디코더의 최종 은닉 상태와 슬라이딩 윈도우 어텐션(SWA) 캐시를 매끄럽게 전달함으로써, 모델이 고정된 단일 스텝 계산량 하에서 시퀀스 길이에 따라 선형 확장되는 잠재적 계산 깊이(예: 48개 레이어 디코더가 48t 스텝에서 자연스럽게 48t개 레이어로 확장)를 확보할 수 있도록 했습니다. 이는 강화학습 재생(Replay) 및 온라인 서비스를 위한 리셋 불필요 상태 전이 설계를 제공합니다. (출처: MarkTechPost,omarsar0)

스탠퍼드 CRFM 오픈소스 전 과정 회고: Marin 8B 12.7T 토큰 학습 기록 및 시행착오 가이드 : 스탠퍼드 CRFM이 Marin 8B 모델의 전체 학습 기록과 코드를 공개했습니다. 회고 내용에 따르면, WSD-S 어닐링 쿨다운은 끝이 아니라 다시 승온(Re-warm)할 수 있는 단계적 체크포인트이며, 마이크로 어닐링(Micro-annealing)이 데이터 배합비를 검증하는 가장 효과적인 수단이고, 출력 레이어 파라미터 노름(Norm)의 이상 표류로 인한 학습 붕괴는 1e-4의 z-loss를 도입해 효과적으로 억제할 수 있다고 밝혔습니다. (출처: ZhihuFrontier)

텐센트 PCG, T-Mem 메모리 아키텍처 제안: ‘일화적 미래 사고’로 맥락 초월 연상 회상 구현 : 텐센트 PCG 팀이 EMNLP 2026에 논문을 발표하며 T-Mem 장기 기억 시스템을 제안했습니다. 기존 벡터 데이터베이스가 ‘글자 유사도만 인식’하던 구조적 한계를 겨냥해, T-Mem은 인지 과학의 일화적 미래 사고(Episodic Future Thinking)에 따라 쓰기 단계에서 트리거 시나리오 인덱스를 미리 구축합니다. 이를 통해 글자 유사도가 전혀 없는 LoCoMo-Plus 인지 기억 벤치마크에서 74.81%를 기록하며 SOTA를 갱신했습니다. (출처: 机器之心)
.jpg)
스탠퍼드 2026 가을 공개 강좌 CS 312 <딥러닝 연금술> 개설 : 스탠퍼드 AI 랩이 ‘직접 실습’과 ‘예측할 수 있어야 이해한 것’이라는 실증 과학 이념을 바탕으로 새로운 공개 강좌 CS 312를 선보였습니다. 전통 교과서가 유효하지 않게 된 현대 대형 모델 시대의 경험적 방법론을 체계적으로 강의하며, Scaling Law 외삽, 손실 지형 기하학 최적화, 학습률 전이 및 고효율 데이터 일반화 등 핵심 실전 주제를 다룹니다. (출처: stanfordnlp)

펜실베이니아 대학교, <컴퓨터 비전, 로보틱스, 머신러닝을 위한 선형대수학> 교재 무료 공개 : UPenn이 최첨단 AI 컴퓨팅을 위한 체계적인 교재를 공개했습니다. 벡터 공간, SVD 특이값 분해, 다양체(Manifold) 표현, 3D 회전 및 그래프 알고리즘 등 핵심 수학적 기초와 계산 구현을 포괄하여 알고리즘 엔지니어와 연구원에게 탄탄한 기초 이론 유도를 제공합니다. (출처: TheTuringPost)

CAITLYN: 반례 기반 LLM Agent 자가 진화형 프롬프트 인젝션 방어 미들웨어 : 연구팀이 Agent를 위한 자가 진화 보안 방어 시스템 CAITLYN을 제안했습니다. 경량 스크립트와 LLM 분류기의 계층형 런타임 아키텍처를 채택하고, 백그라운드에서 탈옥(Jailbreak) 샘플을 자동 캡처하여 반례로 변환한 후 방어 스킬을 동적으로 합성해 공유 라이브러리에 기록합니다. 이를 통해 다수의 미확인 공격(Emerging attack) 벤치마크 테스트에서 공격 성공률을 최대 40%p 낮췄습니다. (출처: WeChat)

선전대와 홍콩과기대, ECA 아키텍처 제안: 멀티모달 Agent에 ‘행동 전 증거 검증’ 메커니즘 부여 : GUI 및 브라우저 Agent가 복잡한 작업 중 환각 오독으로 인해 유발하는 실제 자산 손실을 방지하기 위해 선전대학교와 홍콩과기대가 ECA 프레임워크를 제안했습니다. 대형 모델이 도구를 호출하기 전 독립된 DOM 및 OCR 검증기로부터 ‘증거 인증서’를 발급받고 고정된 게이팅 로직을 통해 전제 조건을 검증하도록 요구함으로써, Chromium 환경 테스트에서 발생한 85개의 안전하지 않은 동작을 모두 성공적으로 차단했습니다. (출처: 机器之心)
.jpg)
Agent 엔지니어링의 핵심 분석: 산업 특화 Harness가 벤더 락인 방어벽으로 부상 : 개발자 커뮤니티에서 Domain-Specific Harness에 대한 심층 토론이 진행되었습니다. 범용 대형 모델의 일반화 능력이 한계에 이름에 따라, 수직 산업(의료, 금융, 법률)에 맞추어 결정론적 검증, 동적 워크플로우 관리 및 프라이빗 상태 유지를 포함하는 전용 Harness를 구축하는 것이 AI 엔지니어가 기술적 해자를 구축하고 단일 모델 공급자 락인을 탈피하는 핵심 엔지니어링 패러다임이 되었습니다. (출처: omarsar0,hwchase17)

💼 비즈니스
Zhipu AI, 393억 홍콩달러 대규모 투자 유치로 GLM-6.0 자가 학습 추진… 선도 기업들 컴퓨팅 파워 비축 집중 : Zhipu AI가 홍콩 증권거래소 공시를 통해 신규 배정 및 전환사채 발행을 완료하여 순조달액 약 393억 홍콩달러(약 50억 달러)를 확보했다고 밝혔습니다. 상장 후 누적 조달액은 755억 홍콩달러에 달하며 과학기술혁신판(STAR Market) 상장도 추진 중입니다. 자금의 약 60%는 차세대 GLM-6.0 기초 모델과 데이터 자체 생산, 환경 자체 구축, 인프라 자체 최적화의 3대 폐쇄 루프를 아우르는 ‘완전 자가 학습(Fully Self Training)’ 시스템에 투입되어, 사람의 개입 없이 재귀적 자가 개선을 달성하기 위한 컴퓨팅 파워 풀 확충에 집중될 예정입니다. (출처: 量子位, 36氪, teortaxesTex)

Anthropic, 나스닥 상장 준비 착수… 2분기 조정 기준 흑자 전환 소식 : 블룸버그와 파이낸셜 타임스(FT)에 따르면, Anthropic이 잠재적 IPO 상장지로 나스닥을 선정하고 이르면 올해 10월 증권신고서를 제출할 예정이며, 자금 조달 목표치는 SpaceX에 필적하거나 그 이상일 것으로 알려졌습니다. 소식통에 따르면 Claude Code 등 기업용 제품의 급성장에 힘입어 7월 말 기준 연환산 매출(ARR)이 650억 달러를 돌파하고 2분기 조정 영업이익이 흑자 전환되었으며, NVIDIA 역시 최대 100억 달러 규모의 앵커 투자자로 참여하기 위해 협상 중입니다. (출처: 量子位, 36氪)

워크플로우 오케스트레이션 플랫폼 Temporal, 5억 5천만 달러 규모 시리즈 E 투자 유치… 기업 가치 125억 5천만 달러 달성 : 대규모 AI Agent 비동기 작업 및 분산 워크플로우 오케스트레이션을 지원하는 인프라 기업 Temporal이 5억 5천만 달러 규모의 시리즈 E 펀딩을 유치하고 포스트 머니 기업 가치 125억 5천만 달러를 기록했습니다. 이는 AI 장기 Agent 오케스트레이션 인프라에 대한 자본 시장의 높은 신뢰를 입증합니다. (출처: swyx)

🌟 커뮤니티
AI Snake Oil, 장문의 글을 통해 Agent 통제 상실과 안전 진영 간의 인식 격차 분석 : 프린스턴대 연구진 Arvind Narayanan과 Sayash Kapoor가 장문의 글을 발표하고, 안전 진영은 OAI-HF 사건을 ‘정렬(Alignment)의 재앙’으로 보는 반면 사이버 보안 진영은 ‘단순 구성 실수’로 바라보며 양측 간 심각한 인식 단절이 존재한다고 지적했습니다. 저자들은 현재 AI 위험이 고도의 비대칭성을 띠고 있으며, 사이버 공격과 자동화된 취약점 발굴만이 물리적 마찰이 없는 즉각적인 위협이라고 주장했습니다. 따라서 기업은 검증 불가능한 모델 내부 정렬에서 벗어나 외부 샌드박스 격리, 코드 서명, 엄격한 조직 거버넌스 및 법적 책임 명문화에 집중해야 한다고 강조했습니다. (출처: AI Snake Oil)
바이오 및 보안 전문가들, ‘AI 생물학 무기 멸종론’ 공동 반박: 물리적 구현 상식 결여 : 일부 기관이 주장하는 ‘AI가 설계한 슈퍼 바이러스의 인류 멸망’ 논리에 대해 바이러스 합성 및 LLM 학습 경험을 모두 갖춘 연구진과 얀 르쿤(Yann LeCun) 등 전문가들이 잇달아 반박에 나섰습니다. 이들은 알고리즘을 통한 가상 유전자 서열 생성부터 물리적 합성, 숙주 배양, 면역 회피 및 에어로졸 전파까지는 거대한 물리적 간극과 엄격한 공급망 차단 체계가 존재하며, 디지털 벤치마크 점수 달성을 생물학적 위협과 동일시하는 것은 현실과 동떨어진 공포 마케팅에 불과하다고 지적했습니다. (출처: ylecun,Tim_Dettmers)
민간 주도 ‘펠리컨 컵’ 크라우드소싱 테스트 대회 개최, Astra의 장기 작업 변동성이 촉발한 AI 시대 ‘지능 SLA’ 모니터링 : GPT-6 Astra가 복잡한 장기 작업에서 간헐적인 ‘지능 저하’ 및 컴퓨팅 병목 현상을 보이자, 오픈소스 커뮤니티가 동일 프롬프트를 사용하는 ‘펠리컨 자전거 타기’ 애니메이션 생성 크라우드소싱 대회를 열고 수백 명의 개발자가 참여해 100억 개 이상의 토큰으로 실시간 모니터링을 진행했습니다. 개발자들은 기업용 Agent 시대에는 단일 단계 판단 실수가 장기 워크플로우를 통해 연쇄 증폭되므로, 업계가 클라우드 서비스 가용성과 유사한 실시간 ‘지능 SLA’ 모니터링 체계를 조속히 구축해야 한다고 지적했습니다. (출처: 36氪)

임바디드 AI의 궁극적 격차 논쟁: 기계와 인류의 격차는 언어 탄생 이전부터 존재 : 임바디드 AI 전문가 장훙이(Zhang Hongyi)는 GPT-6 Astra가 기호 및 논리 추론에서 대다수 인간을 능가했지만, 300만 년 전 구석기 시대 인류가 손짓과 모방을 통해 습득한 주먹도끼 제작과 같은 ‘물리적 상호작용 인지 및 운동 제어’ 능력에 대해서는 AI가 여전히 입문조차 하지 못했다고 지적했습니다. 디지털 세계의 AGI와 물리적 세계의 조작 지능의 융합이야말로 범용 임바디드로 나아가는 핵심 시험대입니다. (출처: ZhihuFrontier)

개발자, 초파리 전뇌 커넥톰을 ChatGPT에 연동… 생체 신경 펄스를 최초로 자연어 대화로 변환 : 한 개발자가 오픈소스 수컷 초파리 전뇌 커넥톰(MaleCNS v1.0)을 활용해 신경 펄스 시뮬레이터를 구축하고, 하류 뉴런 발화 데이터에 선형 판독기(Linear Readout)를 학습시켜 이를 자연어로 디코딩한 후 ChatGPT로 직접 전송하는 데 성공했습니다. 실험 결과, 이 시스템은 자극 입력 후 인지 묘사 텍스트를 정확히 생성하고 ChatGPT의 운동 명령을 받아 가상 장애물을 회피하는 데 성공하여, 생체 커넥톰과 LLM 의미 공간의 융합을 위한 새로운 경로를 보여주었습니다. (출처: 36氪)

젠슨 황과 필즈상 수상자, AI 안전의 반증 가능성을 두고 설전 : 전 Anthropic 연구원의 사직으로 촉발된 ‘10년 내 멸종론’에 대해 NVIDIA CEO 젠슨 황은 종말론이 “과장되고 오만한 마케팅 술책”이라고 공개 비판했습니다. 반면 신임 필즈상 수상자 Jacob Tsimerman은 수학 AI 안전 연구소(MAISI) 설립을 선언하고, 영지식 증명(Zero-Knowledge Proofs)과 암호학 도구를 활용해 AI 안전을 수학적으로 증명 가능한 기저 명제로 변환해야 한다고 주장하며 안전 기준 설정 권한에 대한 커뮤니티의 광범위한 논쟁을 촉발했습니다. (출처: 36氪)
로컬 대형 모델 선택 실측 양극화: 고희소성 MoE가 과도한 추론에 빠진 Dense 모델 완승 : 그래픽스 전문가가 실제 레이 트레이싱 C++/Vulkan 코드 작성 및 자율 디버깅 테스트를 진행한 결과, Qwen3.8-27B Dense 버전은 장시간 생각한 후에도 실행 가능한 프로그램을 생성하지 못하고 ‘과도한 사고’의 무한 루프에 빠진 반면, 125B MoE(nvfp4)는 단 10분 만에 정확한 결과물을 산출했습니다. 고희소성 MoE는 로컬 VRAM 대역폭 및 지식 용량 측면의 종합 ROI에서 절대적인 우위를 입증했습니다. (출처: ZhihuFrontier)

정신 건강 지원에서 나타난 AI 의존 현상 공감대 형성: 사회 심리 지원 시스템의 현실적 공백 메워 : 사용자들이 ChatGPT를 심야 심리 상담 용도로 활용하는 현상에 대해 커뮤니티에서 활발한 토론이 벌어졌습니다. 수많은 네티즌들은 높은 치료 비용, 의료 자원 부족, 지리적 제약으로 인해 취약계층이 전문 심리 상담을 받기 매우 어려운 상황에서, 편견 없는 태도와 24시간 접근성을 제공하는 AI가 기본적인 감정 지지대 역할을 하고 있으므로 이를 일방적으로 비난하거나 폄하해서는 안 된다고 지적했습니다. (출처: Reddit r/ChatGPT)
💡 기타
유럽 여성 정치인 100여 명 딥페이크 음란물 공격 피해, 입법 기관의 철저한 규제 촉구 : 싱크탱크 아고라(Agora)의 최신 조사에 따르면, EU 22개 회원국의 약 150명 의원(대다수가 여성)이 100여 개 딥페이크 웹사이트에서 악의적인 초상권 남용 및 원클릭 누드화 도구로 인한 피해를 입었습니다. 유럽 의원들과 법조계 인사들은 무단 AI 생성 성착취물에 대한 전면 금지 법안을 조속히 통과시키고, 호스팅 및 생성 플랫폼에 대한 강력한 책임을 물어야 한다고 강력히 촉구했습니다. (출처: WIRED)

초파리 전뇌 커넥톰으로 물리 로봇 탐색 주행 구동 성공 : 한 긱(Geek) 개발자가 16.6만 개의 뉴런과 2,500만 개의 시냅스 연결을 포함하는 초파리 전뇌 생체 신경망 디지털 트윈 모델을 다족 물리 로봇(Strandbeest)에 연동하여, 시뮬레이션된 신경 발화 명령을 통해 실제 로봇의 보행 및 장애물 회피 제어를 성공적으로 구현했습니다. (출처: jpt401)
인터랙티브 과학 프로젝트 Relativity Park 화제: 시속 5km로 산책하며 체감하는 상대성 이론의 세계 : 한 개발자가 Three.js 기반의 오픈소스 인터랙티브 프로젝트 ‘상대성 공원(Relativity Park)’을 제작했습니다. 빛의 속도를 보행 속도인 5km/h로 설정하여, 사용자가 산책하듯 움직이면서 광행 시간 지연, 도플러 적색·청색 편이, 길이 수축, 상대론적 빔 효과 등 심오한 물리 현상을 직관적으로 체험할 수 있도록 구현했습니다. (출처: mcleavey)