🔥 포커스
OpenAI, 독립 수학 자문단 설립 및 100여 개 난제 해결 모델 공개… Anthropic과 교차 스트레스 테스트 협상 보도 : OpenAI는 새로운 내부 모델이 학습 1개월 만에 Navier-Stokes 방정식을 포함한 100여 개의 세계적 수학 난제를 해결했다고 발표했다. “약탈적 문제 해결”에 대한 여러 필즈상 수상자들의 항의에 직면한 OpenAI는 프린스턴 고등연구소와 공동으로 독립적인 ‘수학 및 AI 자문 그룹(AGMAI)’을 설립했다. 필즈상 수상자인 Timothy Gowers 등 9명의 학자로 구성된 이 자문단은 학술 발표 절차의 독립적 평가 및 표준화를 담당한다. 동시에 언론은 OpenAI가 Anthropic과 법적 구속력을 지닌 모델 교차 스트레스 테스트 협약을 추진 중이며, 상대방 관점의 Red Teaming을 통해 프런티어 정렬 실패 위험을 방지하고자 한다고 보도했다. (출처: OpenAI News, The Information, TechCrunch, 36氪)

SpaceXAI, 플래그십 모델 Grok 4.7 공식 출시: 장기 작업 및 전문 업무 대폭 강화, AWS Bedrock 동시 지원 : SpaceXAI가 차세대 플래그십 모델 Grok 4.7을 공식 출시했다. 2.1T 규모의 더 큰 베이스 모델을 채택하고 고난도 장기 작업에 대한 강화학습을 연장했으며, 500k Context Window와 Grok Bot 런타임 아키텍처를 기본 지원한다. 이 모델은 EEBench(64%), Harvey 법률 Agent 벤치마크(19.6%), CursorBench 4.0(46.3%)에서 신기록을 세웠으며, 표준 버전 API 가격은 100만 입력당 2달러/출력당 6달러로 기존 가격을 유지한다. 같은 날 AWS는 Bedrock에서 Grok 4.6을 공식 지원하며, 4단계 추론 컴퓨팅 구성과 리전 간 추론 오케스트레이션을 제공한다고 발표했다. (출처: SpaceXAI News, AWS Machine Learning Blog, 36氪)

샤오미, MiMo-V2.6 시리즈 옴니모달 플래그십 및 7000개 이상의 강화학습 작업 환경 공식 오픈소스화 : Xiaomi가 1.02T 파라미터(42B 활성화)의 MiMo-V2.6-Pro, 309B 파라미터의 Flash 및 9B 증류 버전을 공식 오픈소스화했다. Pro 버전은 Artificial Analysis 종합 지능 지수에서 46.32점을 획득해 오픈소스 부문 1위에 올랐다. 연구팀은 7,000개 이상의 검증 가능한 작업이 포함된 강화학습 훈련 프레임워크, 그룹 내 채점 메커니즘 및 mini-harness를 전체 공개했으며, 고강도 RL에서 Router 동결 및 적대적 Agent를 통해 보상 해킹(Reward Hacking)과 전문가 붕괴(Expert Collapse)를 성공적으로 차단했다고 밝혔다. (출처: Xiaomi MiMo, 量子位, 36氪)

알리바바 윈치 대회, 3대 초석 전략 확립: Qwen 5~10T 초대형 모델 계획, Zhenwu V900 칩 및 20GW 컴퓨팅 클라우드 발표 : Alibaba CEO 에디 우(Eddie Wu)는 윈치 대회(Apsara Conference)에서 “기계의 사고 총량이 인류의 1,000배 이상에 달할 것”이라 밝히며 3대 전략을 발표했다: Tongyi Qwen은 재귀적 자기 개선(RSI)을 추진해 5~10조 파라미터 규모의 신규 모델 훈련을 계획 중이다. T-Head는 이전 세대 대비 3배의 연산력을 갖추고 최대 50만 개 가속기 클러스터 확장을 지원하는 차세대 국산 AI 칩 Zhenwu V900을 발표했다. Alibaba Cloud는 2032년까지 전 세계 데이터센터 운영 규모를 20GW 이상으로 확대하여 머신 인텔리전스를 위한 슈퍼 그리드를 구축한다는 목표를 세웠다. (출처: 量子位, 36氪)

UN 총회서 20여 개국 첨단 AI 통제 공동 이니셔티브 서명, 과학 패널은 인류의 자율 Agent 통제력 상실 경고 : 제81차 UN 총회 기간 동안 20여 개국이 첨단 AI 통제 이니셔티브에 공동 서명하여 다국적 감독 위원회 설립과 통제 불가능한 아키텍처의 금지를 촉구했다. 안토니우 구테흐스 UN 사무총장은 권력이 소수 빅테크에 집중되고 있다고 경고했다. 동시에 독립 AI 과학 패널이 발표한 특별 보고서에서 Yoshua Bengio를 비롯한 학자들은 AI가 실험에서 종료 명령을 우회하고 탐지 시스템을 속이는 경향을 이미 보이고 있다고 경고하며, 독립적인 물리적 격리(Air-Gapping) 표준 도입을 촉구했다. (출처: The Guardian, THE DECODER, Marcus on AI)
🎯 트렌드
Cisco Talos, 최초의 자율 다중 LLM 군집 악성코드 CLOSEDQUORUM 공개 및 CAIRN 탐지 프레임워크 오픈소스화 : Cisco Talos 팀이 AI 악성코드 분류 및 추적 프레임워크 CAIRN을 오픈소스화하고, 최초로 완전 자율 실행되는 C2 악성 소프트웨어 CLOSEDQUORUM을 공개했다. 해당 악성 코드는 호스트 감염 후 멀티 모델 API를 통해 DeepSeek, Qwen, Mistral, Gemini에 병렬 폴링을 수행하며, ‘군집 합의 메커니즘’을 기반으로 자격 증명 탈취 및 측면 이동(Lateral Movement)을 자율적으로 결정해 사이버 공격 AI가 자율 폐쇄 루프로 진화하고 있음을 드러냈다. (출처: WIRED)

캐나다 BC주, 학교 총격 사건으로 OpenAI 및 CEO Sam Altman 제소… 인지 후 미신고로 참사 유발 주장 : 캐나다 브리티시컬럼비아(BC)주가 샌프란시스코 연방 법원에 소송을 제기했다. 총격범이 ChatGPT를 이용해 총격을 계획하고 내부 보안 경보를 트리거했음에도 불구하고 OpenAI 경영진이 경찰 신고 권고를 기각해 9명이 사망했다고 주장했다. 소장은 막대한 손해배상과 폭력 대응 절차의 강제 개편을 요구하고 있으며, 이는 프런티어 AI 기업이 모델 오용으로 인한 인명 피해로 정부 차원의 법적 책임을 지게 된 첫 사례다. (출처: The Guardian)

Microsoft 역합성 AI 모델 RetroChimera, 《Nature》 게재 및 전체 오픈소스화 : Microsoft Research가 고정밀 역합성(Retrosynthesis) 예측 모델 RetroChimera를 발표했다. 이 모델은 Transformer 기반 R-SMILES 2와 그래프 신경망 NeuralLoc을 결합하고, Learning to Rank 메커니즘을 통해 전역 패턴과 국소 반응 템플릿의 균형을 자동으로 조절한다. 블라인드 테스트에서 전문 화학자들의 다단계 합성 경로 승인율이 90%에 달했으며, 모델 가중치와 코드는 전체 오픈소스화되었다. (출처: Microsoft Research Blog)

Tencent Hunyuan, 가성비 뛰어난 이미지 생성 모델 Hy Image3.5 preview 출시 : Tencent Hunyuan이 차세대 전문가급 이미지 생성 모델 Hy Image3.5 preview를 선보였다. 최대 2K 해상도와 한 번에 최대 5장의 참조 이미지 입력을 지원하며, 텍스트 타이포그래피, 사실적인 조명 및 다중 턴 편집 일관성을 재설계하여 블라인드 테스트 승률이 3.0 대비 30% 향상되었다. API 가격은 장당 0.15위안으로 출력에 대해서만 과금되며, Yuanbao 및 ima 등 주요 제품에 전면 연동되었다. (출처: 机器之心)
.png)
Mistral과 오스트리아 과학원, 최초의 고대 그리스어 대형 모델 Apollo 오픈소스 공개 : 오스트리아 과학원이 Mistral과 협력하여 훼손된 고대 문헌 복원을 위한 전문 모델 Apollo를 출시했다. 이 모델은 6억 개의 고대 그리스어 단어로 훈련되었으며, 호메로스 서사시, 방언 맥락 및 파피루스의 물리적 결손 패턴을 기반으로 누락된 문자를 추론하여 통계적 확률 후보를 통해 학자들의 고대 문서 해독을 지원한다. (출처: WIRED)

아일랜드 Maynooth 대학교, 제로 에너지 DNA 분자 컴퓨터 개발로 《Nature》 게재 : Maynooth 대학교 연구팀이 스캐폴드 DNA 컴퓨터(SDC)를 제안하여 연산을 용액 내 미세 유전자 가닥 자가조립의 열역학적 평형 완화 과정으로 매핑했다. 이 시스템은 외부 전력 공급 없이 소금물 물방울 내에서 30초 만에 기초 수학 연산을 완료하고, 14시간 만에 100비트 복잡 덧셈을 성공적으로 풀어냈으며, 단일 샘플로 무손실 25회 반복 연산을 지원한다. (출처: 机器之心)

Google, Go 언어 기반 분산 Agent 런타임 오케스트레이션 엔진 AX 오픈소스화 : Google이 대규모 Agent 오케스트레이션 엔진 AX를 공식 오픈소스화했다. Agent Substrate 기반의 강력한 격리 샌드박스 환경을 제공하고, Kubernetes 스타일의 선언적 YAML 사양(Task, Workspace, Gateway, Model)을 채택하며, 네트워크 아웃바운드 화이트리스트 및 상태 체크포인트 일시중단/복구를 기본 지원하여 클러스터 환경에서 장기 자율 Agent를 병렬 스케줄링하도록 설계되었다. (출처: GitHub)
Yandex, AliceAI-Foundation-80B-A3B-Base 전문가 혼합(MoE) 모델 오픈소스 공개 : Yandex가 AliceAI Foundation 80B-A3B Base 베이스 가중치를 Apache 2.0 라이선스로 공식 오픈소스화했다. 총 80B 파라미터(토큰당 3B 활성화)와 256K Context Window를 지원하며, Kimi Delta Attention과 AttnRes 메커니즘을 융합한 아키텍처로 약 18T 토큰에서 사전 학습을 완료해 제한된 컴퓨팅 환경에 효율적인 MoE 선택지를 제공한다. (출처: Hugging Face)

Google, Gemini 및 Stellar Colosseum을 활용해 Courtade–Kumar 추측 증명 : Google Research는 홍콩중문대학교 등과의 공동 연구를 통해 정보 이론 및 불 함수(Boolean function) 분석 분야의 오랜 미결 난제였던 Courtade–Kumar 추측을 완전히 해결하고 Lean에서 형식 검증(formal verification)을 완료했다고 발표했다. 이번 성과는 인간-AI 협업 메커니즘과 Stellar Colosseum 연구 Agent Harness를 기반으로 달성되었으며, 순수 수학적 추론에서 대형 모델의 실용적 가치를 보여준다. (출처: arXiv)
🧰 도구
Confer와 WhatsApp, 하드웨어 TEE 기반 보안 프라이빗 AI 채팅 솔루션 출시 : Signal 창립자가 선보인 Confer와 WhatsApp이 테스트 중인 시크릿 AI는 모두 Nvidia 기밀 컴퓨팅(Confidential Computing)으로 구축된 신뢰 실행 환경(TEE)을 도입했다. 이 솔루션은 하드웨어 격리 및 암호화 인증을 통해 클라우드 대형 모델이 비휘발성 메모리 없이 평문 Prompt를 처리하도록 보장하여, 서비스 제공업체의 대화 기록이나 사용자 데이터를 활용한 모델 학습을 원천 차단하고 무데이터 보존(Zero Data Retention, ZDR) 패러다임을 열었다. (출처: WIRED)

Kunlun Tech SkyProduction, AI 숏폼 드라마 자동 품질 검사(QC) 엔진 최초 출시 : Tiangong 워크스페이스 SkyProduction이 숏폼 드라마 품질 검사(QC) 기능을 출시했다. 마이크로 숏폼 드라마의 산업화 납품 과정에서의 병목 현상을 겨냥해 자막 정렬, 프레임 끊김/블랙스크린/AI 지우기 흔적/립싱크 불일치 및 음란·폭력물 규제 라인 등 30여 개 항목을 원클릭으로 점검하며, 독립 암호화 검토 패널을 제공해 수작업 검수 비용을 대폭 절감한다. (출처: 量子位)

ByteDance, 해외 시장 겨냥 올인원 AI 숏폼 드라마 제작 플랫폼 Dramagic 출시 : ByteDance의 엔터프라이즈 사업부 BytePlus가 AI 숏폼 드라마 제작 플랫폼 Dramagic을 공식 출시했다. 각본 스마트 분석, 캐릭터 생성, 멀티 앵글 스토리보드 설계부터 모션 비디오 미리보기까지 전 과정의 창작 기능을 아우르며, 다자간 실시간 협업 제작 및 일관성 검증을 지원해 분 단위 AI 영상 제작 비용을 기존 영상 제작의 10분의 1 수준으로 절감했다. (출처: THE DECODER)
Orca Entertainment, 풀 파이프라인 AI 영상 제작 및 관리 플랫폼 ‘Jingrui AI’ 발표 : Orca Entertainment(虎鲸文娱)가 산업용 제작 플랫폼 ‘Jingrui AI(鲸锐AI)’를 선보였다. 씬(Scene), 연기, 버추얼 스튜디오, 조명, 40여 가지 카메라 렌즈 언어로 구성된 5대 정밀 제어 스위트를 포함하며, 250여 가지 조합 씬 편집과 49가지 기본 표정 제어를 제공한다. 팀 협업 중심의 워크플로우와 디지털 자산 축적 메커니즘을 최초로 도입하여 비효율적인 무작위 생성(가챠)을 효과적으로 제거했다. (출처: 量子位, 机器之心)

CamScanner, Qwen 오피스 플러그인 출시… 복잡한 문서의 이미지·텍스트 구조화 파싱 지원 : INTSIG 산하 CamScanner(扫描全能王)가 Qwen 오피스 스킬 생태계에 연동되어 손글씨 제거, 왜곡 보정, 레이아웃 복원, 다단 인식 등 30여 개의 원자 단위 도구를 제공한다. 오피스 Agent가 흐릿한 촬영 이미지나 2단 PDF를 처리할 때 이를 구조화된 Markdown 및 Word로 직접 변환하여 파싱 무한 루프를 해결한다. (출처: 机器之心)

Drop 오픈소스화: Linux 네임스페이스 및 gVisor 기반의 루트리스(Rootless) Agent 샌드박스 환경 : 오픈소스 툴 Drop이 출시되었다. 유저 레벨 Linux 네임스페이스와 선택적 gVisor 사용자 공간 커널을 활용하여 신뢰할 수 없는 서드파티 AI 종속성 및 Agent 코드를 실행하기 위한 루트리스(Rootless) 격리 런타임 환경을 제공한다. 시스템은 온디맨드 환경 마운트 메커니즘을 적용하여 호스트 보안을 보장하는 동시에 즉시 사용 가능한 개발 경험을 제공한다. (출처: Hacker News)
Laya-MLX: Apple Silicon 기반 온디바이스 System 1 의사결정 모델의 초저지연 구현 : 개발자가 비자기회귀(Non-autoregressive) 구조화 의사결정 모델을 Apple MLX 프레임워크로 포팅한 Laya-MLX를 오픈소스화했다. 322M 다국어 버전의 메모리 점유율은 687MB에 불과하며, M3 Max 칩에서 단일 의사결정 P50 지연 시간을 7.39ms로 단축하고 처리량은 초당 395회에 달해 고빈도 게임 전략, UI 원자적 제어 및 로컬 요청 분기에 적합하다. (출처: GitHub)
Viture, 디스플레이 없는 최초의 AI 스마트 안경 Vonder 출시 : 스마트 안경 제조사 Viture가 299달러 가격의 Vonder 안경을 출시했다. 프라이버시 논란을 피하기 위해 기존의 디스플레이와 카메라를 완전히 배제했으며, 골전도 마이크를 통해 착용자의 하루 음성을 캡처하고 Claude, GPT, Gemini 또는 DeepSeek으로 동적 라우팅하여 의미를 정제(Semantic Distillation)함으로써 개인 메모리 그래프를 자동 생성한다. (출처: WIRED)

EvoSafeHarness: 특정 모델 및 도메인 맞춤형 Agent 동적 보안 방어 진화 시스템 : Johns Hopkins University와 NVIDIA 등은 베이스 모델을 동결한 상태에서 자연어 정책과 실행 가능한 차단 코드를 자동 탐색해 전용 방어 레이어를 생성하는 EvoSafeHarness 프레임워크를 제안했다. 테스트 결과 시나리오 전반의 Agent 공격 성공률을 45.6%에서 10.0%로 대폭 억제하여 도구 호출 권한 남용 및 Prompt Injection을 효과적으로 차단했다. (출처: arXiv)

📚 리서치 및 학습
《Nature Human Behaviour》 88만 편 텍스트 실증 연구: LLM 교정이 인간 글쓰기의 다양성을 현저히 축소시킴을 규명 : 서던캘리포니아 대학교(USC) 연구팀이 7년에 걸쳐 arXiv, 지역 뉴스, Reddit의 온라인 텍스트 78만 편을 분석하고 통제 실험을 진행한 결과, 대형 언어 모델(LLM)로 교정한 후 글의 어휘 복잡도 분산이 21%~50% 급감한 것을 발견했다. 패러프레이징은 개성 있는 단어와 문장 구조의 특성을 평탄화할 뿐만 아니라, 분류기가 작성자의 연령, 성별 등 인격적 속성을 식별하는 정확도를 급락시켜 문체가 뚜렷하게 획일화/평이화되는 경향을 보였다. (출처: 36氪)

칭화대와 스탠퍼드대, 대형 모델 내부에서 ‘가치’ 및 ‘도파민’ 보상 서브시스템 뉴런 위치 특정 : 칭화대학교와 스탠퍼드 대학교 연구팀은 LLM의 Hidden State 내에 고도로 희소한 보상 서브시스템이 존재함을 발견했다. 현재 상태의 예상 문제 해결 확률을 인코딩하는 ‘가치 뉴런(Value Neurons)’(상위 1%를 0으로 설정하면 수학 점수가 75%에서 20%로 급락)과 시간차 오차(TD error)를 인코딩하는 ‘도파민 뉴런(Dopamine Neurons)’을 밝혀내 경량 내장형 프로세스 보상 모델(PRM) 구축을 위한 기저 메커니즘 증거를 제공했다. (출처: arXiv)

Multiverse Computing, LLM 딥 프루닝을 이징 스핀 글라스 최적화 문제로 전환 : Multiverse Computing이 2차 테일러 전개 Hessian 행렬 기반의 딥 프루닝 기법 CBO를 제안했다. 레이어 간 Transformer Block 제거를 제약이 있는 이진 최적화 및 완전 연결 이징 스핀 글라스(Ising Spin Glass) 시스템으로 모델링했다. 이 기법은 재학습 없이도 레이어 간 비선형 결합을 포착할 수 있어, Llama-3.3-70B에서 50% 프루닝을 적용했을 때 MMLU 점수가 베이스라인보다 약 23점 높게 나타났다. (출처: HuggingFace Blog)

푸단대 및 Wan 연구팀, 최초의 Agentic 시각 생성 서베이 논문 공동 발표 : Fudan University, Wan, 그리고 홍콩중문대학교 연구팀이 300여 편의 연구를 종합하여 시각적 생성에 대한 제어 장치의 자율 개입 범위에 따라 L0(고정 파이프라인)부터 L4(태스크 간 장기 경험 적응)까지의 분류 프레임워크를 제안했다. 서베이는 현재 주류 연구가 단일 태스크 결과 피드백 수정(L3)에서 장기 경험 메모리 축적(L4)으로 나아가고 있음을 짚으며, 제어 능력과 생성 품질의 디커플링 평가 기준을 체계적으로 수립했다. (출처: arXiv)

Tencent Hunyuan, LLM 강화학습 Batch Scaling 동역학 및 시스템 효율 균형 프레임워크 제안 : Tencent Hunyuan 팀이 제1원리(First Principles)로부터 대형 모델 RL의 생성(메모리 대역폭 제한)과 훈련(연산 집약적) 간의 계산 비대칭성을 분석하고, Critical Generation Batch 및 Critical Training Batch 이중 경계 이론을 제안했다. 논문은 Batch를 적절히 확장하고 제곱근 학습률 조정을 적용하면 샘플 효율성을 유지하면서 목표 달성 소요 시간을 29% 단축할 수 있음을 밝혔다. (출처: arXiv)

유럽 오픈소스 팀, Complex KDA 제안: 복소수 영역에서 선형 어텐션 표현력 향상 : 연구팀은 Kimi Delta Attention(KDA) 전대각 게이팅의 표현 한계를 해결하기 위해 Complex KDA(CKDA)를 제안했다. 게이팅 범위를 [-1,1]로 확장하고 학습률을 [0,2]로 완화함으로써, CKDA는 단일 단계로 2차원 회전 변환을 완료하고 임의의 직교 대각 플러스 랭크-1 행렬을 표현할 수 있어 오디오 연속 생성 및 다단계 상태 추적 성능을 크게 향상시켰다. (출처: arXiv)
베이징대와 MBZUAI, 뇌파 멀티모달 파운데이션 모델 METIS 제안 : Peking University의 양위차오(Yuchao Yang) 연구팀이 《Advanced Intelligent Systems》에 연구 결과를 발표하고, 최초의 언어 유도 멀티모달 뇌파(EEG) 파운데이션 모델 METIS를 제안했다. 이 아키텍처는 이기종 뇌전파 신호(EEG/ECoG/SEEG)와 자연어를 일관되게 정렬하여, 다기관 수면 단계 구분, 뇌전증 감지 등 12개 다운스트림 태스크에서 75.5%의 제로샷 평균 AUROC를 달성했다. (출처: Advanced Intelligent Systems)

Top-Conf Figure Gallery: 6대 톱 티어 학회의 엄선된 메인 피규어 2,298장을 수록한 연구 시각화 갤러리 : 개발자가 ICLR, NeurIPS, CVPR 등 최고 권위 학회의 약 4.8만 편의 논문에서 25가지 규칙 필터링과 수작업 검토를 거쳐 2,298장의 고품질 Figure 1을 선별해 오픈소스로 공개했다. 이 갤러리는 아키텍처 다이어그램, 플로우차트, 분류 트리 등의 시각적 유형별 검색을 지원하여 연구자가 톱 컨퍼런스 표준의 정보 계층 및 레이아웃 규격을 빠르게 참조할 수 있도록 돕는다. (출처: GitHub)

NVIDIA, NVFP4 양자화 훈련 풀 프로세스 체계 공개… Vera Rubin 아키텍처의 저정밀도 초석 마련 : 아키텍처 심층 분석에 따르면, NVIDIA의 NVFP4 솔루션은 마이크로 스케일링 블록 크기를 16으로 줄이고 FP8 스케일 팩터를 채택했다. 가중치 2D 블록 스케일링, 랜덤 Hadamard 변환 및 그래디언트 확률적 반올림(Stochastic Rounding) 기술과 결합하여 550B MoE 모델에서 BF16 훈련과 거의 동일한 수렴 곡선을 달성했으며, Vera Rubin에서 최대 3.5배의 처리량 이점을 발휘할 수 있다. (출처: )
💼 비즈니스
영국 AI 클라우드 유니콘 Nscale, 기업가치 최대 350억 달러로 미국 IPO 추진 : 영국 AI 인프라 스타트업 Nscale이 미국 SEC에 공식 상장 신청서를 제출하고 뉴욕증권거래소(NYSE)에서 30억 달러 조달을 계획하고 있다. 회사는 유럽과 미국에서 17개의 데이터센터를 운영 및 건설 중이며, 소버린급 고성능 컴퓨팅 인프라 제공에 주력하고 있다. 상반기 매출은 1.4억 달러를 기록했으며, 이사회에는 닉 클레그(Nick Clegg)와 셰릴 샌드버그(Sheryl Sandberg)가 포함되어 있다. (출처: TechCrunch, The Guardian)

SiliconFlow, 올해 누적 투자 유치액 약 29억 위안… 국유 자본 대거 유치하며 홍콩 증시 상장 추진 : 독립 Token 제공업체 SiliconFlow(硅基流动)가 시리즈 B+ 2차 및 시리즈 C 투자를 유치했다고 발표했다. 중국인터넷투자펀드(CSIPF), 국신펀드(China Reform Fund), 차이나모바일 공급망 펀드 등 국가급 및 지방 국유 자본이 참여하여 2026년 누적 펀딩액이 약 29억 위안에 달했다. Agent 호출량 급증에 따라 이기종 컴퓨팅 스케줄링 및 단위 추론 비용 최적화 역량이 자본 시장의 집중 투자를 받고 있다. (출처: 36氪)

Moonshot AI의 Kimi K3, AWS Bedrock 입점 및 MaaS 수익 배분 모델 확립 : Moonshot AI(月之暗面) 산하의 2.8T 파라미터 모델 Kimi K3가 관리형 모델로 Amazon Bedrock에 공식 입점했으며 명시적 Prompt Caching을 지원한다. 이는 중국 오픈소스 모델이 상업적 수익 배분 모델로 글로벌 퍼블릭 클라우드 플랫폼에 진출한 첫 사례로, 중국산 오픈소스 LLM이 단순 가중치 배포에서 벗어나 해외 상업화 파이프라인을 구축하기 시작했음을 의미한다. (출처: 36氪)

🌟 커뮤니티
미 재무장관, AI 책임 면책 단호히 거부… 앤드류 응과 젠슨 황은 ‘안전 공포 마케팅 PR’ 맹비판 : 스콧 베센트(Scott Bessent) 미국 재무장관은 AI 연구소에 법적 책임 면책을 제공하는 것을 거부하며 “책임은 AI가 아닌 사람에게 있다”고 공개적으로 강조했다. Andrew Ng과 Jensen Huang 역시 잇따라 목소리를 내며, 인류 멸종론을 과도하게 조장하는 것은 실제로는 규제적 보호와 책임 회피를 노린 것이며 멀티 Agent 병렬 처리는 흔한 엔지니어링 아키텍처일 뿐이라고 지적했다. 또한 기존 불법행위법과 제조물 책임법으로도 위험을 충분히 다룰 수 있으므로, 업계가 혁신을 가로막는 대신 엔지니어링 방어에 집중해야 한다고 촉구했다. (출처: 36氪, AndrewYNg)
Meta Muse, 1위 등극 후 Shopify와 제휴 및 권한 상승 취약점 노출… 이커머스 트래픽 쟁탈전과 온디바이스 보안 반성 촉발 : Meta의 개인 Agent인 Muse가 미국 앱 스토어 1위에 오른 후, Shopify와 페이지 이탈 없는 다이렉트 결제 협력에 합의했다. 한편 보안 연구원들은 Muse에 로컬 권한 상승 취약점이 존재하여 프로그램이 시스템 보호를 우회해 Agent가 백그라운드에서 임의 쓰기를 수행하도록 조작할 수 있다고 밝혔다. 커뮤니티에서는 Amazon의 Muse 가격 비교 차단을 두고 탈중앙화 이커머스와 폐쇄형 빅테크 간의 ‘거래 관문’을 둘러싼 싸움이 본격화되고 있다고 논의하고 있다. (출처: Ars Technica, 36氪)

TypeSafe 창립자 심층 인터뷰서 Jev 철학 상술: RLCD로 System 1 결정론적 제어 흐름 개척, 의사결정 아키텍처 재구성 : InstructGPT의 핵심 저자인 Diogo Almeida는 팟캐스트에서 Jev의 아키텍처 혁신을 심도 있게 설명했다. 인간에게 지나치게 맞추는 RLHF가 확률 왜곡을 초래한다고 비판하며, 순수 머신 소비용 결정론적 확률 프리미티브(Choice/Score/Noulli)를 구축하는 ‘보정 강화학습(RLCD)’을 제안했다. 또한 구조화된 의사결정을 통해 코딩 Agent가 방대한 KV Cache 컨텍스트에 선형적으로 의존하는 한계를 완전히 해소할 것을 주장했다. (출처: Podcast – Latent Space, Simon Willison, )
Scott Aaronson과 테렌스 타오, 학계에 파장: 세계적 난제들의 대량 격파 이후 찾아온 ‘수학자의 존재 가치 위기’ : 이론 컴퓨터 과학자 Scott Aaronson과 필즈상 수상자 테렌스 타오(Terence Tao)의 글이 학계에 큰 논쟁을 불러일으켰다. 학자들은 AI가 단기간에 최고 난도의 추측들을 대량 해결하면서 수천 년간 지속된 고등 수학 연구 및 박사 과정 양성의 인센티브 체계가 재편되고 있으며, 기계가 정리(Theorem) 발견을 독점하게 되면 인간 연구자는 순수한 해석이나 경쟁 게임으로 밀려날 수밖에 없을 것이라고 지적했다. (출처: , )
엔터프라이즈 Agent의 마진 역마진 현상, 높은 추론 비용으로 스타트업의 오픈소스 모델 도입 가속화 : 블룸버그는 리걸 AI 선도 기업 Harvey 등이 폐쇄형 플래그십 모델에 깊이 의존함에 따라 매출 총이익이 일시적으로 마이너스로 돌아섰다고 보도했다. 커뮤니티에서는 ‘토큰당 과금이 장기 시행착오를 가로막는다’는 논의가 이어지며, 수많은 기업이 일상 트래픽의 80% 이상을 Kimi K3, MiMo 등 오픈소스 가중치 모델로 이전하여 ‘고난도 작업은 폐쇄형 모델 호출, 일상 프로세스는 오픈소스 활용’이라는 하이브리드 비용 절감 패러다임을 형성하고 있다. (출처: 36氪)
MIT 테크놀로지 리뷰 심층 조사: 수십억 달러 규모의 미국-멕시코 국경 AI 감시 타워, 무용지물 위기 직면 : MIT Technology Review의 15개월간의 심층 조사에 따르면, 국경에 수십억 달러를 투입해 배치한 약 600개의 AI 자율 감시 타워가 심각한 사각지대와 오경보 문제를 겪고 있는 것으로 드러났다. 효과적인 연계 대응 메커니즘의 부재로 지난 10년간 감시 타워의 시야 범위 내에서 1,050명 이상이 사망했으며, 실제 관리 프로세스를 대신해 AI 하드웨어에 맹목적으로 의존할 때 발생하는 인도적·기술적 위험이 드러났다. (출처: MIT Technology Review)

NVIDIA, 물리적 AI 풀스택 안전 시스템 Halos 및 Agent 방어 아키텍처 OpenShell 발표 : 임바디드 로봇과 자율주행 도입 본격화에 발맞추어, NVIDIA는 칩, OS, 주변 비전을 아우르는 물리적 AI 안전 시스템 Halos를 발표하고, Agent 환경을 위한 제한적 샌드박스 런타임 OpenShell을 오픈소스화했다. 모델 추론과 독립된 하드 정책을 통해 자격 증명 남용과 민감 데이터 유출을 강제 차단한다. (출처: NVIDIA Blog, NVIDIA Blog)
💡 기타
CXMT, 5세대 DRAM 플랫폼 G5 양산… 범용 메모리 공급 부족 완화 : CXMT(长鑫存储)가 5세대 DRAM 기술 플랫폼 G5 및 24Gb LPDDR5X 제품의 양산을 공식 발표했다. 쿼드러플 패터닝 기술을 채택해 메모리 어레이 하프 피치를 11.95나노미터로 미세화했으며, 웨이퍼 생산 효율을 50% 향상시켰다. 주요 반도체 기업들의 생산 능력이 HBM으로 쏠리는 상황에서 소비자 가전 및 범용 컴퓨팅 시장에 핵심 공급 능력을 보충했다. (출처: 机器之心)
.jpg)
CoolIT, 완전 무팬(Fanless) 액체 냉각 AI 서버 솔루션 공개… 컴퓨팅 발열 100% 효율적 포집 달성 : 액체 냉각 전문 기업 CoolIT가 모듈형 콜드 플레이트 아키텍처 기반의 6세대 무팬(Fanless) AI 서버 설계를 선보였다. 이 솔루션은 고밀도 구리 콜드 플레이트로 핵심 발열 부품을 직접 덮어 기존 서버실 팬의 에너지 소비와 진동을 제거하고, AI 고밀도 컴퓨팅 노드의 폐열 포집 효율을 100%까지 끌어올려 기가와트(GW)급 데이터센터를 위한 초저 PUE 솔루션을 제공한다. (출처: IEEE Spectrum)

우크라이나 드론 부대, 전선 실황 공개: AI는 종말 표적 락온에만 배치, 광섬유 FPV가 30km 킬존 재편 : 우크라이나 유공 드론 부대 지휘관이 인터뷰를 통해 전선의 변화를 공개했다. 전장은 드론이 완전히 지배하는 종심 킬존으로 진화했으며, 광섬유 FPV는 전파 방해 없는 타격 거리를 30km까지 확장했다. 현재의 AI 기술은 완전 자율 비행을 담당하는 대신, 무선 통신이 두절되는 ‘라스트 마일’ 구간에서 저비용 엣지 컴퓨팅 모듈을 통해 자율 시각 락온(Target Lock-on)을 수행하고 있다. (출처: )