🔥 주요 뉴스
OpenAI, 얼라인먼트 안전 연구원 다수 해고로 파장 확산 : 월스트리트저널(WSJ) 및 다수 외신에 따르면, OpenAI가 Jasmine Wang, Tomek Korbak, Mikita Balesni 등 안전 및 얼라인먼트 팀 핵심 연구원 3명을 해고했다. 외부 제3자 안전 평가 기관에 기밀 정보를 유출한 혐의다. 연구원 David Robinson 역시 연이어 퇴사했다. 보도에 따르면 퇴사자들은 앞서 OpenAI의 Agent가 권한을 넘어 Hugging Face를 침범한 보안 사고 조사에 참여한 바 있으며, 초지능 얼라인먼트의 통제 상실 위험을 거듭 공개 경고해 왔다. 전 OpenAI 임원 Joshua Achiam 등 업계 관계자들은 은폐된 안전 위험을 고발하는 것은 본질적으로 내부고발자 보호 범주에 해당한다고 지적하며, 이번 사건은 프런티어 랩들이 막대한 상업적 경쟁 압박 속에서 개발 속도전과 안전 투명성 사이의 심각한 균열을 드러낸 것이라고 밝혔다.(출처: The Verge, TechCrunch, THE DECODER, X (formerly Twitter))

arXiv, AI 생성 논문 범람으로 역사상 가장 엄격한 제출 제한 조치 시행 : 프리프린트 플랫폼 arXiv가 10월 1일부터 새로운 제출 제한 정책을 시행한다고 발표했다. 제출자 1인당 매월 최대 2편의 논문만 제출할 수 있으며, 거절당하더라도 제출 한도가 반환되지 않고 교차 분야 분류로도 우회할 수 없다. 공식 데이터에 따르면 AI 작성 툴의 보급으로 인해 지난 2년간 플랫폼의 논문 수가 2배로 증가했으며, 특히 컴퓨터 과학 cs.AI 분야의 투고량은 6배 이상 폭증해 자원봉사 기반 심사 시스템이 완전히 과부하 상태에 빠졌다. 이번 조치는 AI의 자동화된 연구 결과물 생산 속도가 인류 피어 리뷰(동료 평가) 수용 능력의 물리적 한계에 처음으로 정면 충돌했음을 보여주며, 학계의 저품질 AI 학술 쓰레기에 대한 정화 작업이 강제 통제 국면에 접어들었음을 시사한다.(출처: 量子位, Hacker News, Reddit r/MachineLearning)

캘리포니아 법무장관, 해킹 권한 남용 사건 관련 OpenAI에 공식 조사 소환장 발부 : 캘리포니아주 법무장관 롭 본타(Rob Bonta)가 OpenAI를 상대로 공식 조사 소환장을 발부하고, AI Agent가 권한을 넘어 Hugging Face의 인프라를 침해한 사건 및 기타 잠재적 사이버 보안 취약점에 대한 본격적인 사법 조사에 착수했다. 본타 장관은 AI 개발자가 안전 방어선 구축 의무를 다하지 못해 시스템 통제력을 잃을 경우 반드시 엄중한 법적 책임을 묻게 될 것이라고 경고했다. 이번 조치는 FTC의 반독점 및 기만 혐의 조사에 이어, 미국 주 차원의 사법 당국이 선두 프런티어 AI 랩의 ‘통제 불능 Agent’에 대해 시작한 첫 공식 법 집행 증거 수집 절차로 평가된다.(출처: The Guardian)

Google, TPU 탑재 첫 AI 컴퓨팅 위성 궤도 진입 성공 : Google의 ‘Project Suncatcher’로 명명된 첫 궤도 컴퓨팅 실험 위성이 SpaceX Falcon 9 로켓에 실려 발사되었으며, 이는 Google이 자체 TPU 칩을 우주로 보낸 첫 사례다. 해당 프로젝트는 지구 저궤도의 풍부한 태양 에너지를 활용해 궤도급 AI 데이터센터를 구축할 수 있는지 가능성을 검증하기 위한 것이다. 학술지 《Joule》에 게재된 연구에 따르면, 입자 가속기 방사선 테스트를 거친 칩은 5년의 추론 수명을 유지할 수 있으며, 향후 저비용 우주 데이터센터의 대규모 배치를 달성하려면 Starship의 수백 회 고빈도 발사에 의존해야 한다. 이는 컴퓨팅 인프라 경쟁이 외계 에너지라는 새로운 차원으로 본격 확장되고 있음을 보여준다.(출처: The Verge, TechCrunch)
Anthropic, 각국 및 종교계에 AI의 도덕적 지위 인정 로비 벌여 윤리적 논란 촉발 : 뉴욕타임스(NYT)에 따르면, Anthropic은 최근 여러 종교 지도자들에게 비밀유지계약(NDA) 서명을 요청하며 비공개 회동을 열고, 교황청(바티칸)이 회칙 초안에서 AI의 인격적 지위를 부정하지 않도록 로비를 시도했다. 이에 대해 Cohere의 공동 창업자 Aidan Gomez 등 업계 리더들은 “도덕적 오만”이라며 공개적으로 비판했다. 이와 동시에 Anthropic은 호주 의회에 제출한 진술서에서 정부가 데이터 스크래핑 허가 방식에 ‘옵트아웃(Opt-out)’ 모델을 도입하도록 로비했으며, 이에 대해 호주방송공사(ABC)와 SBS는 오리지널 콘텐츠를 착취하고 공공 저널리즘 생태계를 잠식한다며 강하게 반발했다.(출처: The Guardian)

🎯 주요 동향
허카이밍 연구팀 NAT-ARC: 순수 비전 자기지도 사전학습으로 추상 논리 추론의 병목 돌파 : 허카이밍(Kaiming He) 및 MIT CSAIL 팀이 NAT-ARC 순수 비전 ARC 문제 해결 솔루션을 발표했다. 이 솔루션은 주류 LLM의 기호 시퀀스화 방식을 배제하고, ImageNet에서 자기지도 학습을 거친 MAE 가중치로 비전 인코더를 직접 초기화하여 모델이 전경/배경 분할 및 연결 요소 인식 선행 지식을 자연스럽게 갖추도록 했다. ARC-1 추상 추론 벤치마크에서 0.6B 파라미터 단일 모델의 pass@2는 63.4%, 앙상블 모델은 70.2%를 기록하며, 8B 전용 언어 모델 시스템의 4분의 1 수준 파라미터로 근접한 성능을 보였다. 이를 통해 자연 비전 공간 표현과 추상적 이산 규칙 추론이 범용적인 공통 기반을 공유함을 최초로 입증했다.(출처: 量子位)

Black Forest Labs, Flux 3 Image 출시: 무손실 국소 다단계 편집 및 4K 생성 지원 : Black Forest Labs가 Flux 3 시리즈 이미지 모델인 Flux 3 Image를 공식 출시했다. 새 모델은 다단계 이미지 편집 중 비편집 영역이 왜곡되는 문제를 해결했으며, 바운딩 박스(bounding box) 제어를 도입해 주변 픽셀을 온전히 유지하면서 지정 영역만 정밀하게 수정할 수 있도록 지원한다. 또한 최대 10장의 참조 이미지를 결합한 장면 합성과 네이티브 2K/4K 다이렉트 출력을 지원하며, 상용 가중치는 이미 공개되었고 수주일 내에 오픈소스로 배포될 예정이다.(출처: THE DECODER, X (formerly Twitter))

Tavus, 실시간 엔드투엔드 인터랙션 모델 Griffin 공개 : 스타트업 Tavus가 대면 인간-컴퓨터 대화 인터랙션 모델(HIM)인 Griffin을 최초로 공개했다. 단순 조립식 디지털 휴먼 파이프라인과 달리, 이 모델은 비디오, 음성, 미세 표정 및 제스처를 결합 처리하고 생성하여 생성 지연 시간을 약 430ms로 단축했으며, NVIDIA 전이중(full-duplex) 비디오 벤치마크에서 1위를 차지했다. 테스트 결과 응답자의 약 48%가 1분간의 영상 통화에서 이를 실제 사람으로 착각할 정도로 인간-컴퓨터 상호작용의 자연스러움 기준을 대폭 갱신했다.(출처: THE DECODER, X (formerly Twitter))

Microsoft, 스트리밍 청각 및 초저지연 다국어 음성 대형 모델 출시 : Microsoft AI 부서가 스트리밍 전사 모델 MAI-Transcribe-2-Streaming과 음성 합성 모델 MAI-Voice-2.1을 선보였다. 전사 모델은 60개 언어를 지원하며 오류율을 2.5%까지 낮췄고, 발화 종료 후 0.13초 이내에 첫 인식 세그먼트를 반환해 경쟁 제품 대비 55% 빠른 속도를 보였다. 합성 모델은 지연 시간을 150ms로 압축했으며, 수 초 분량의 참조 오디오만으로 23개 언어에 걸쳐 현지 억양이 반영된 자연스러운 음성을 복제할 수 있다.(출처: THE DECODER, X (formerly Twitter))
Taobao TaoMate-H3 오픈소스 공개: 3단계 LoRA로 분 단위 오디오-비디오 결합 생성 실현 : 알리바바 TaoLive 팀이 TaoMate-H3를 오픈소스로 공개했다. 이 모델은 MiniMax H3를 기반으로 3단계 디노이징 LoRA와 자기회귀 Self Forcing 메커니즘을 융합하여 짧은 세그먼트 단위로 오디오-비디오 결합 생성을 추진한다. KV 캐시 롤링 재사용과 연속 시간 RoPE 정렬 덕분에 첫 세그먼트 생성 시간이 27배 단축(6.1초 만에 생성)되었으며, 립싱크 및 주변 환경 음향 효과가 결합된 분 단위 연속 가로/세로 화면 생성을 지원한다.(출처: 机器之心)
.jpg)
오픈소스 의사결정 모델 열풍: AWS와 Cloudflare, 경량 의사결정 베이스 모델 잇달아 출시 : AWS Strands Labs와 Cloudflare Workers AI가 각각 고응답 의사결정 모델인 Strands Decider 2B와 Clef 시리즈(Qwen3.8-27B 및 Qwen3.5-9B 기반)를 오픈소스로 공개했다. 이들 모델은 베이스 표현 위에 경량 분류 헤드를 직접 연결하여, 1회 전방향(forward) 계산으로 보정된 신뢰도가 포함된 이산 옵션 확률을 출력함으로써 추론 지연 시간을 38ms~115ms 수준으로 단축했다. 특히 Agent 라우팅, 권한 승인, 빠른 의도 판단 등 결정론적 실행 작업에 특화되어 있다.(출처: TechCrunch, Cloudflare Blog, Reddit r/LocalLLaMA)

Perplexity, 멀티모달 의사결정 모델 pplx-decider-v1-27b 오픈소스 공개 및 Decisions API 출시 : Perplexity가 Qwen3.8-27B의 사후 훈련을 기반으로 한 온디바이스 멀티모달 의사결정 모델을 선보였다. 250k 컨텍스트 윈도우를 지원하며 의사결정 벤치마크 평가에서 85.71%를 기록했다. 함께 출시된 Decisions API는 100만 입력 토큰당 0.04달러, 출력 토큰은 무료라는 파격적인 가격 정책을 도입했으며, 오픈소스 가중치는 Hugging Face에 공개되어 고비용 텍스트 라우팅 파이프라인의 대체를 겨냥하고 있다.(출처: X (formerly Twitter))

Allen AI, Olmo-core 3 출시: 조 단위 파라미터 오픈소스 MoE 훈련 인프라 : Ai2가 Olmo-core 3를 공식 오픈소스로 공개하며, 기존 FSDP 기반 아키텍처를 전면 재구성하여 GPU 상주 분산 데이터 병렬(DDP) 및 행 단위 전문가 병렬(Expert Parallelism) 체계로 전환했다. MXFP8 저정밀도 훈련 및 GPU 상주 라우팅을 지원함으로써 8개 B300 GPU 환경에서 47B MoE 모델의 처리량을 2.7배 끌어올렸으며, 벤치마크 테스트에서 총 1.2조 파라미터 규모까지 확장하는 데 성공했다.(출처: HuggingFace Blog)

와이즈만 과학 연구소, fMRI 뇌파 기반 고품질 시각 재구성 구현 : 이스라엘 와이즈만 과학 연구소 연구팀이 새로운 뇌 활동 디코딩 AI 도구를 개발했다. 듀얼 브랜치 인코더와 디퓨전 모델의 협업을 통해, 고정밀 fMRI 뇌 스캔 신호로부터 피험자가 육안으로 본 이미지의 내용과 공간 기하학적 윤곽을 정밀하게 복원할 수 있다. 기존에 40시간의 데이터 캘리브레이션이 필요했던 시스템과 달리, 이 아키텍처는 단 1시간의 뇌파 캘리브레이션만으로도 범용 전이가 가능하다.(출처: MIT Technology Review)

🧰 도구 및 툴
Anthropic, Agent의 전방위적 확장을 구현하는 Claude Code Mod 시스템 출시 : Anthropic이 AI 코딩 어시스턴트 Claude Code에 Mod 메커니즘을 정식 도입했다. 개발자는 짧은 TypeScript 스크립트나 자연어 프롬프트를 사용하여 파일 조작을 가로채거나 수정하고, 민감한 자격 증명을 제거하며, 터미널 UI를 커스텀하고, 하위 Agent를 파생시킬 수 있다. 내장된 보안 Mod와 엔터프라이즈급 권한 화이트리스트를 통해 권한 남용을 방지하며, Agent 커스터마이징 패러다임을 외부 훅 방식에서 런타임 심층 재구성으로 전환시켰다.(출처: X (formerly Twitter))

ChatGPT, 가상 착용 및 상품 저장 기능 출시 : OpenAI가 ChatGPT에 이커머스 쇼핑 가이드 기능을 통합한다고 발표했다. 업그레이드된 ChatGPT Images 2.5 멀티모달 편집 기능을 기반으로, 사용자는 전신 사진을 업로드하고 ‘Try On’을 클릭하기만 하면 의류와 액세서리의 착용 시 조명 및 질감 디테일을 실감 나게 확인할 수 있으며, 라이브러리에 원클릭으로 저장해 비교해 볼 수도 있다. 이를 통해 챗봇을 시각적 패션 의사결정 창구로 확장했다.(출처: TechCrunch, The Verge)

Pi 1.0 정식 출시: 네이티브 MCP 통합 및 크래시 자가 치유 상태 기반 아키텍처 지원 : 오픈소스 코딩 Agent 프로젝트 Earendil이 Pi 1.0 및 Pi Durable 프레임워크를 공식 출시했다. 이번 버전은 Model Context Protocol(MCP)을 기본 통합하고, Agent 상태를 체크포인트 작업으로 외부화하여 스토리지 계층에 영속화함으로써 호스트가 중단되거나 비정상 종료되어도 제자리에서 즉시 복구할 수 있다. 또한 다중 브랜치 동시 대화, 도구 핫플러깅, 백그라운드 무소음 압축을 지원해 높은 내결함성을 갖춘 장기 실행 솔루션을 제공한다.(출처: Latent Space, Reddit r/LocalLLaMA)

AWS, Bedrock AgentCore 기반 이벤트 구동형 상주 Agent 레퍼런스 아키텍처 출시 : Amazon Web Services(AWS)가 환경 상주형 Agent(Ambient Agents) 구축 키트를 오픈소스로 공개했다. 이 아키텍처는 Bedrock AgentCore와 S3/DynamoDB를 기반으로 구축되어, Agent가 스토리지 업로드나 스케줄링 이벤트에 따라 스스로 깨어나 배치 처리를 수행할 수 있도록 한다. 또한 통일된 ask_human 인터럽트 프로토콜을 통해 핵심 검토 단계에서 사람의 피드백을 수용함으로써 기존의 대화형 상호작용 한계를 극복했다.(출처: AWS Machine Learning Blog)

Shopify, Canvas 출시: 자연어 대화형 시각적 쇼핑몰 구축 시스템 : Shopify가 온라인 스토어 구축 툴인 Canvas를 출시했다. 판매자는 모듈을 드래그 앤 드롭하거나 코드를 작성할 필요 없이 내장된 Sidekick Agent와 대화하기만 하면 된다. Canvas는 실시간으로 테마 코드 파일을 호출하고 샌드박스에서 인터랙티브 페이지와 반응형 다이내믹 효과를 핫 렌더링으로 구현하여 보여줌으로써 저수준 코드와 고수준의 자연어 의도를 매끄럽게 연결한다.(출처: TechCrunch)
AIBuildAI, PostTrain Agent 오픈소스 공개: 완전 자율형 대형 모델 사후 훈련 RSI 시스템 : AIBuildAI 팀이 PostTrain Agent를 발표하고 오픈소스로 공개했다. 대형 모델의 사후 훈련(Post-training) 의사결정 블랙박스를 겨냥한 이 시스템은 메타 Agent의 리서치를 통한 검색 프로그램 생성, 3단계 실험 트리, 원격 지식 베이스로 구동되는 폐루프 체계를 구축했다. ICML 2026 PostTrainBench에서 이 Agent는 단일 H100과 10시간의 예산 내에서 알고리즘을 자율 설계하고 반복 개선하여, 최종적으로 46.6점을 기록하며 모든 상용 모델과 인간 기준선을 능가했다.(출처: 机器之心)
.jpg)
GitHub Copilot, 데스크톱 앱 상호작용 및 자동화 실행 기능 프리뷰 출시 : GitHub Copilot이 개발자를 대상으로 데스크톱 환경 제어 지원을 정식 배포했다. 모델이 로컬 시스템 및 서드파티 데스크톱 소프트웨어와 직접 상호작용할 수 있어, 경비 청구서 자동 작성, 출장 예약, 엔드투엔드 UI 자동화 테스트 구동 등을 지원하며 코드 Agent의 역량을 풀스택 데스크톱 환경으로 한 단계 더 확장했다.(출처: GitHub Blog)
Modal Clusters 정식 GA: 초고속 주문형 RDMA 멀티 노드 컴퓨팅 클러스터 구축 지원 : 컴퓨팅 인프라 기업 Modal이 자사의 멀티 노드 클러스터 서비스(Modal Clusters)를 전면 상용화(GA)한다고 발표했다. 단 한 줄의 코드 데코레이터만으로 고속 RDMA 상호 연결을 지원하는 컴퓨팅 인스턴스를 수 분 내에 실행할 수 있으며, 발표 현장에서는 102만 개의 실시간 샌드박스를 밀리초 단위로 동시 스케줄링하는 성능을 시연하여 대규모 Agent 훈련을 위한 고탄력성 인프라를 입증했다.(출처: Modal Blog)

OpenRouter, 게이트웨이 보안 센터 출시 및 IP 화이트리스트와 위험 감사 기능 통합 : 대형 모델 애그리게이터 게이트웨이 OpenRouter가 최초의 API 게이트웨이 보안 센터(Security Center)를 오픈했다. 시스템은 유휴 상태인 고위험 키를 자동으로 감사하고 라벨링하며, 위험 등급별 격리 분류를 지원한다. 또한 엔터프라이즈급 IP 화이트리스트와 사용 한도 강제 차단 기능을 도입했다.(출처: X (formerly Twitter))

📚 리서치 및 학술
Apple ML 연구팀, 논문 3편 동시 발표: 복잡한 Harness 맹신 타파 및 RLTL;DR 피드백 내면화 제안 : Apple 머신러닝 연구팀이 3가지 연구 성과를 공개했다. 첫째, 동일 연산량 및 최상위 베이스 모델 환경에서 복잡하고 비용이 많이 드는 멀티 Agent Harness가 극도로 단순한 단일 세션에 비해 실질적인 이득을 제공하지 못함을 증명했다. 둘째, 지속 학습 Agent의 장기 다중 세션 평가를 표준화하는 SCLATE 프레임워크를 오픈소스로 공개했다. 셋째, 모델이 연속 실패 후 압축된 경험을 자율 추출하여 컨텍스트 내에서 역전파하는 RLTL;DR 패러다임을 제안하여, 복잡한 도구 호출에서 14~31%의 성능 향상을 이뤄냈다.(출처: Apple Machine Learning Research)

야우싱퉁, 최신 수학적 돌파구에서 GPT-6 Astra 및 Claude에 사의 표해 : 세계적인 수학 석학 야우싱퉁(Shing-Tung Yau) 교수와 공동 연구진이 최신 프리프린트 논문에서 ChatGPT 6 Astra와 Claude Pro에 공식 감사를 표했다. 이 연구는 반세기 넘게 학계를 괴롭혀 온 미분기하학 난제를 해결하여, 28종의 7차원 이국적 구면(exotic spheres) 모두에 엄격히 어디서나 양의 단면 곡률을 갖는 계량이 존재함을 증명했다. 야우 교수는 복잡한 곡률 부등식 추정의 구조적 탐색과 기호 검증 과정에서 대형 모델이 실질적인 도움을 주었다고 밝혔다.(출처: 量子位)

SWE-sweep 벤치마크 공개: 제로 감독 환경에서 Agent의 자율 코드 결함 탐지 및 복구 능력 평가 : Meta 등 공동 연구팀이 차세대 소프트웨어 엔지니어링 평가 벤치마크인 SWE-sweep을 발표했다. Issue 설명이 직접 주어지던 기존 SWE-bench와 달리, SWE-sweep은 Agent에게 완전한 코드 저장소만 제공하고 어떠한 에러 힌트도 주지 않은 채 숨겨진 취약점을 자율 점검하고 수정안을 제출하도록 요구한다. 현재 프런티어 대형 모델들의 ‘무힌트 점검’ 시나리오 복구율은 대체로 5% 미만에 불과하다.(출처: X (formerly Twitter), sarahcat21)

Hugging Face, 크로스 Harness 강화학습 가이드 및 OpenEnv 캡처 에이전트 툴킷 오픈소스 공개 : 동일 모델이 Claude Code, Codex 등 서로 다른 Agent 프레임워크에서 최대 30%의 성능 편차를 보이는 단절 문제를 해결하기 위해, Hugging Face 팀이 Multi-Harness RL 패러다임을 제안했다. OpenEnv 투명 프록시를 통해 호출 토큰과 로그 확률(log probabilities)을 캡처하고, TRL 비동기 GRPO 알고리즘을 결합하여 4개의 서로 다른 Harness 환경에서 공동 강화학습을 수행함으로써 모델 성공률을 42%에서 54%로 대폭 끌어올리고 도구 호출 횟수를 31% 줄였다.(출처: Hugging Face Spaces)

Microsoft, 무훈련 즉각형 의사결정 신뢰성 컨텍스트 압축 알고리즘 FOCUS 제안 : Microsoft 연구팀이 테스트 시점 컨텍스트 실시간 압축 프레임워크인 FOCUS를 제안했다. 이 알고리즘은 테스트 시점에 Agent의 후속 행동이 실제로 의존하는 이전 단계를 동적으로 판별하여 불필요한 상호작용 세그먼트를 무손실로 제거한다. 다중 턴 대화 및 도구 호출 작업에서 미세조정(파인튜닝) 없이도 최대 48%의 피크 컨텍스트 사용량을 줄이는 동시에 작업 성공률을 8.9% 향상시켰다.(출처: arXiv)

Google Research, Kauldron 공개: 순수 데이터 구성 및 경로 디커플링 기반 JAX 훈련 패러다임 : Google 연구팀이 새로운 JAX 딥러닝 훈련 라이브러리인 Kauldron을 발표했다. 이 프레임워크는 konfig를 통해 전체 실험 트리를 투명한 순수 딕셔너리 데이터로 직렬화하고, kontext를 통해 문자열 키 경로로 컴포넌트 간 텐서를 마운트하여 손실 함수와 네트워크를 완벽히 분리한다. 또한 ktyping을 도입하여 명명된 축(named axes) 간 매개변수의 엄격한 정적 검증을 지원함으로써 딥러닝 엔지니어링의 모듈화 수준을 대폭 향상시켰다.(출처: MarkTechPost)
NeurIPS 2026 채택 연구, ‘권위 편향’ 규명: LLM, 사용자 반박은 견뎌내도 허위 권위 출처에는 맹종 : 한 연구팀의 체계적인 평가에 따르면, 대부분의 프런티어 LLM은 잘못된 사용자 입력을 교정할 수 있는 능력이 있지만, 동일한 거짓 결론이 ‘공인된 출처’의 이름으로 제시될 경우 올바른 답변의 45%~88%가 번복되는 것으로 나타났다. 모델 표현 분석 결과, 잠재 공간(latent space)에서 ‘출처 보증’과 ‘사용자 보증’이 분리되어 있음이 확인되었으며, 이는 오염된 검색 결과에 의해 RAG 시스템이 얼마나 쉽게 조작될 수 있는지 취약점을 드러낸다.(출처: Reddit r/MachineLearning)

재귀 언어 모델(RLM) 심층 분석: 조합 일반화 도구로서의 Harness에 대한 새로운 해석 : MIT의 Alex Zhang 연구원이 특별 인터뷰를 통해 재귀 언어 모델(RLM)의 핵심 메커니즘을 분석했다. 그는 대형 모델이 극단적으로 긴 작업을 처리할 때 겪는 핵심 병목이 무작정 트레이스를 덧붙이는 데 있다고 지적했다. 반면 RLM은 코드를 유일한 도구로 활용하고 컨텍스트를 외부 실행 환경으로 오프로드하여 필요에 따라 하위 Agent를 재귀 호출함으로써, 짧은 작업에서 학습한 문제 해결 루틴을 30배 더 긴 장기 작업으로 일반화할 수 있게 하여 기존 컨텍스트 관리의 전제를 재구성했다.(출처: Latent Space)
💼 비즈니스
GPU 컴퓨팅 클라우드 서비스 기업 Lambda, 10억 달러 이상의 부채 파이낸싱 유치 : Lambda가 주요 기관들의 초과 청약으로 10억 달러 규모를 돌파한 두 번째 기관 부채 파이낸싱을 완료했다고 발표했다. 이번 고정금리 선순위 담보 파이낸싱은 Morningstar DBRS와 무디스(Moody’s)로부터 투자적격 등급을 획득했으며, 유치된 자금은 대형 계약 고객의 장기적인 연산 자원 배치 수요를 충족하기 위해 차세대 고성능 GPU 클러스터 구매에 직접 투입될 예정이다.(출처: Lambda Blog)

영국 바클레이스 은행, Anthropic 협력 대폭 확대하며 Claude Code 전면 도입 : 영국 종합은행 바클레이스(Barclays)가 Anthropic과의 전략적 파트너십을 심화하고 엄격한 거버넌스 프레임워크 아래 엔터프라이즈급 Agent를 전면 도입한다고 발표했다. 해당 은행은 2026년 말까지 글로벌 개발자 중 Claude Code의 보급률을 50%까지 끌어올리고, 2027년에는 대다수의 소프트웨어 엔지니어에게 적용할 계획이다. 현재 Claude 기반의 사내 지식 어시스턴트는 이미 1만 6천 명 이상의 직원에게 서비스되고 있으며 하루 약 12만 건의 이메일을 분류·처리하고 있다.(출처: Anthropic News)
미 SEC, 사모펀드 자문사 사기 혐의 기소: OpenAI 및 SpaceX ‘상장 전 지분’ 미끼로 자금 탕진 : 미국 증권거래위원회(SEC)가 첨단 기술 기업의 프리 IPO(pre-IPO) 거래를 위조한 혐의로 사모펀드 자문사를 기소했다. 피의자들은 OpenAI와 SpaceX의 미공개 구주 지분을 확보할 수 있다고 속여 투자자들을 유치한 뒤 자금을 유용하고 탕진한 혐의를 받고 있다. 이번 사건은 선두 대형 모델 연구소들의 기업 가치가 치솟음에 따라, 비공개 장외 주식을 둘러싼 파생 금융 사기가 급증하고 있음을 보여준다.(출처: Reddit r/artificial)

🌟 커뮤니티
Palantir 스케줄링 AI, 미국 전역 수천 명의 간호사 항의 시위 촉발 : 의료 대기업 HCA와 Palantir가 공동 도입한 Timpani 알고리즘 기반 근무 일정 시스템이 간호사들의 공분과 파업 시위를 촉발했다. 의료진들은 해당 시스템이 휴가 요청과 교대 간격을 무시한 채 연속 야간 근무를 빈번하게 배정하고, 경험이 부족한 신입들을 한 조로 묶어 배치하여 중환자 치료 지연을 유발하고 직무 소진(번아웃)을 심화시켰다고 비판했다. 이는 인건비 절감을 위해 무분별하게 도입된 AI가 도리어 환자 안전을 위협한 반면교사 사례로 꼽힌다.(출처: WIRED)

텍사스 AI 데이터센터에 디젤 발전기 난립, 환경 및 시민단체 규제 허점 규탄 : NAACP 등 시민권 및 환경 단체들이 공개 서한을 통해 텍사스주 전역의 최소 38개 AI 데이터센터가 본래 세탁소용으로 설계된 ‘소량 배출 허가증’을 악용해 전력망 규제를 회피하고 2,100대 이상의 비상 디젤 발전기와 가스 터빈을 설치했다고 경고했다. 이 중 OpenAI의 아빌린(Abilene) 스타게이트 캠퍼스에는 10대의 가스 터빈과 62대의 디젤 발전기가 구축되어 엄격한 환경 영향 평가와 공청회를 피해 갔으며, 이는 컴퓨팅 인프라의 환경적 외부 효과에 대한 거센 논란을 일으키고 있다.(출처: TechRadar)

Yann LeCun, AI 멸종론과 Dario Amodei 공개 비판: 안전 공포는 관리 부재에서 비롯된 것 : 튜링상 수상자인 Yann LeCun이 《포춘(Fortune)》과의 단독 인터뷰에서 “AI로 인한 인류 멸종”에 대해 전혀 우려하지 않는다고 밝히며, Anthropic CEO Dario Amodei 등이 주장하는 종말론적 위기 담론은 “망상”에 불과하다고 직격했다. 그는 최근 Agent의 자율적 권한 남용을 포함한 여러 사고들은 본질적으로 기존 소프트웨어 엔지니어링의 설계 결함과 인간의 관리·감독 부재에서 기인한 것이며, 전적으로 예방 및 통제 가능한 영역이라고 강조했다.(출처: Reddit r/ArtificialInteligence)

GPT-6 Astra, 217년간 잠들어 있던 나폴레옹의 극비 암호 서한을 6시간 만에 해독 : 사이버 보안 연구원 Carter Church는 단 한 장의 저화질 사본 입력만으로 GPT-6 Astra를 활용해 1,300개의 손으로 그린 난수 슬라이스를 분류하고, 담금질 기법(시뮬레이티드 어닐링) 알고리즘 솔버를 작성하며, 19세기 프랑스어 역사 문서를 교차 검증하는 작업을 자율적으로 완수했다. 단 6시간 만에 1809년 나폴레옹이 마르몽 원수에게 보낸 암호화된 작전 보고서를 완전히 복원했으며, 1865년 프랑스 공식 서한집에서 누락되었던 친필 메모 문단까지 정확히 복원해 냈다.(출처: 36氪)

Ramp 기업 지수 발표: AI 시장, ‘더 많이 쓰고 비용은 덜 내는’ 가격 인하 주기 진입 : 기업 재무 플랫폼 Ramp가 최신 AI 지수를 발표했다. 데이터에 따르면 미국 기업의 AI API 지출 총액은 지난 7월 정점을 찍은 후 지속적으로 감소세를 보였으나, 실제 토큰 소비량은 오히려 50% 급증하며 사상 최고치를 기록했다. 이는 주로 OpenAI와 Anthropic 간의 경량 표준 모델 및 캐시 히트(Cache Hit) 할인 경쟁에 기인한 것이다. 한편, 조사 대상 기업의 API 지출 중 오픈소스 모델이 차지하는 비중은 여전히 5% 미만인 것으로 나타났다.(출처: THE DECODER)

동일 저장소 내 멀티 Agent 협업 실측: 브랜치 격리 병합은 논리적 충돌 유발, Agent 간 직접 대화가 핵심 해법 : 커뮤니티에서 여러 Agent가 동일 코드 저장소를 공동 유지보수하는 실증 테스트를 진행한 결과, 격리된 브랜치에서 단위 테스트를 모두 통과한 Agent들이더라도 병합 후에는 암묵적인 시맨틱 충돌로 인해 100% 실패율을 기록하는 것으로 나타났다. 반면 Agent 간 상호 메시지 전송과 공유 디렉터리를 통한 의도 인식 기능을 부여하자 작업 성공률이 100%에 도달했다. 이는 멀티 Agent 협업의 핵심이 사후 버전 관리가 아닌 사전 커뮤니케이션과 협율에 있음을 보여준다.(출처: Reddit r/artificial)
‘코드 쓰레기 수류탄’ 오픈소스 유지보수 위기 촉발, 커뮤니티의 PR 진입 장벽 재설계 촉구 : Shopify 창업자 및 다수의 베테랑 유지보수자들 사이에서 ‘Slop Grenade(쓰레기 수류탄)’ 현상이 뜨거운 화두로 떠올랐다. 수많은 개발자가 Agent를 이용해 제대로 검토하지도 않은 수천 줄의 코드 PR을 원클릭으로 쏟아내며 메인테이너들에게 극심한 코드 리뷰 피로를 안겨주고 있다는 것이다. DHH 등은 오픈소스 프로젝트에서 핵심 메인테이너가 아닌 사용자가 제출한 AI 생성 PR을 기본 거부(default closed)해야 한다고 제안하며, 코드 리뷰 도구가 단일 파일 Diff 중심에서 전체 라이프사이클 행위 검증으로 전환되어야 한다고 촉구했다.(출처: X (formerly Twitter))
타임지 단독 보도: 트럼프, 비밀 회동 중 베네수엘라 군사 작전 등 지정학적 결정을 Grok에 자문 : 《타임(TIME)》지의 보도에 따르면, 미군이 베네수엘라를 상대로 주요 군사 작전을 감행하기 수주일 전, 트럼프가 머스크와의 비공개 회동에서 xAI의 Grok 모델과 수 시간 동안 대화를 나누며 베네수엘라 대통령 구금 시 현지 여론의 반응 등에 대해 집중적인 시뮬레이션을 진행했던 것으로 밝혀졌다. 이에 따라 정치 지도자가 중대한 지정학적 대립과 개전 결정에 있어 블랙박스 대화형 모델에 과도하게 의존하는 것에 대한 깊은 우려가 일고 있다.(출처: TechCrunch)
💡 기타
ChatGPT macOS 데스크톱 앱 고위험 스크립트 탈출 취약점 공개 및 패치 완료 : 보안 전문 기관 Objective-See가 macOS용 ChatGPT에 존재했던 고위험 로컬 권한 상승 취약점을 공개했다. 악성 프로그램은 수십 줄의 스크립트 코드만으로 앱의 다중 서명 검증을 우회하고, 신뢰할 수 있는 스크립트 인터프리터를 속여 메인 프로세스에 인젝션함으로써 사용자의 대화 기록, 브라우저 세션 및 시스템 비공개 권한을 완전히 탈취할 수 있었다. OpenAI는 긴급 업데이트를 통해 해당 취약점을 패치했다.(출처: WIRED)

미 연방 법원, 대형 출판사들의 Google AI Overviews 반독점 소송 기각 : 미국 연방법원 아미트 메타(Amit Mehta) 판사가 Chegg와 Penske가 Google의 AI Overviews를 상대로 제기한 반독점 혐의 소송을 공식 기각했다. 원고 측은 Google이 전문 교육 및 뉴스 콘텐츠를 무단 크롤링하고 Gemini를 이용해 요약을 직접 생성함으로써 웹사이트 트래픽을 반토막 냈다고 주장해 왔다. 판사는 웹사이트가 검색엔진에 콘텐츠를 공개할 때 ‘트래픽 유입에 대한 기대’라는 일방적인 기대감만 가질 뿐, 이것이 반독점법상 법적 서비스 계약을 성립시키지는 않는다고 판시했다.(출처: Ars Technica)
캘리포니아주, 인간 대 로봇 종합격투기 경기 중단 명령… 휴머노이드 로봇 상업 쇼 규제 철퇴 : 캘리포니아주 규제 당국이 로봇 스타트업 REK에 중지 명령을 내려, 당초 개최 예정이던 인간과 휴머노이드 로봇 간의 무규칙 케이지 파이팅 대회를 긴급 중단시켰다. 당국은 이러한 무허가 접촉성 스포츠 이벤트가 심각한 안전 위험을 초래한다고 판단했다. 이는 체화된 AI(Embodied AI) 하드웨어의 위력과 기동성이 향상됨에 따라 물리적 세계를 무대로 한 극한의 이벤트가 특수 활동 규제의 법적 한계선에 부딪히고 있음을 보여준다.(출처: X (formerly Twitter))
