🔥 포커스
Lilian Weng, 신체적 과로로 Thinking Machines 사임 발표 : Thinking Machines의 공동 창업자인 Lilian Weng이 신체적 과로로 인해 사임을 발표했다. 그녀는 작별 편지에서 회사에서 보낸 20개월 동안의 고압박 업무가 건강에 심각한 영향을 미쳤으며, 향후에는 경계가 더 명확하고 예측 가능한 업무를 찾을 것이며 더 이상 공동 창업자 역할을 맡지 않겠다고 밝혔다. 이번 행보는 실리콘밸리에서 AI 스타트업의 고강도 경쟁과 인재 유출에 대한 광범위한 논의를 불러일으켰다 (출처: Qbitai)

Huawei 등, 멀티모달 모델 제품군 Boogu-Image-0.1 공동 발표 : Huawei 홍콩 라이프니츠 연구소의 Xiaoyi 팀이 홍콩대, 홍콩과기대 등과 공동으로 Boogu-Image-0.1을 발표했다. 이 모델은 Qwen3-VL-8B를 지시어 인코더로 채택하고 네이티브 2K 생성을 지원한다. 단 2억 800만 장의 독립된 이미지로 사전 학습을 진행했으며, 이론적 학습 비용은 약 40만 달러다. 여러 벤치마크 테스트에서 폐쇄형 모델 수준에 근접한 성능을 보였으며, Apache 2.0 라이선스로 오픈소스화되었다 (출처: JiQizhixin)
.jpg)
BeingBeyond, 최초의 암묵적 촉각 세계 행동 모델 Being-H0.8 발표 : BeingBeyond가 Being-H0.8 모델을 발표했다. 이 모델은 최초로 촉각 모달리티를 잠재 공간(latent space) 표현에 포함시켰으며, 50만 시간 이상의 UniHand-3.0 비디오 데이터셋을 구축하고 TactoHand를 통해 접촉 주석을 생성했다. 이를 통해 로봇은 동작 수행 중 촉각 피드백에 따라 실시간으로 동작을 조정하여 가방에서 물건을 꺼내는 등의 정밀한 작업을 수행할 수 있게 되었다 (출처: Qbitai)

🎯 동향
Microsoft, 보안 모델 MAI-Cyber-1-Flash 및 Perception 플랫폼 발표 : 오픈소스 보안 동맹 설립에 이어 Microsoft가 MAI-Cyber-1-Flash 모델(파라미터 137B, 활성 파라미터 5B)을 정식 출시하고, 이를 자사의 MDASH 에이전트 보안 시스템에 내장했다. CyberGym 테스트에서 이 조합은 95.95%의 점수를 기록하며 Anthropic의 Mythos 5 등의 모델을 제치고 비용을 절반으로 줄였다. 이와 함께 다중 에이전트 레드/블루/그린팀 메커니즘을 활용해 취약점 탐지 및 복구를 자동화하는 Perception 플랫폼도 출시했다 (출처: THE DECODER)

Volcengine, Doubao 검색 기능을 기업 및 개발자에게 개방 : Volcengine이 Doubao 앱의 기반이 되는 검색 기능을 API, MCP, Skill 등의 형태로 기업과 개발자에게 정식 개방했다. 이 서비스는 권장 등급, 게시 시간, 본문 요약, 원문 Markdown 발췌 등 풍부한 필드를 제공하여 AI Agent가 외부 실시간 정보를 더 효율적으로 획득하고 필터링할 수 있도록 돕고, 불필요한 Token 소모를 줄여준다 (출처: Qbitai)

🧰 도구
Perplexity, 공식 단일 파일 CLI 도구 pplx 출시 : Perplexity가 공식 명령줄 도구인 pplx를 출시했다. 이 도구는 터미널에서 웹 검색 및 콘텐츠 스크래핑을 실행하고 표준 JSON 형식으로 결과를 반환하는 기능을 지원한다. 인간 및 AI 코딩 Agent를 위해 설계된 이 도구는 PPLX_OUTPUT_DIR 환경 변수와 --stdout-preview 매개변수를 통해 Token 예산 제어 및 로컬 파일 저장을 지원한다 (출처: MarkTechPost)
Kando AI, 의사결정 자가 진화 시스템 출시 : 칭화대 및 베이징대 팀이 설립한 Kando AI가 고부가가치 의사결정 시나리오(예: 금융 투자 연구, 과학 연구)를 겨냥한 자가 진화 의사결정 시스템을 출시했다. 이 시스템은 사용자의 의사결정 궤적과 피드백을 기록하고 분석하여 인지적 디지털화 및 자가 진화를 구현하며, “의사결정 분야의 Cursor”를 지향한다. 현재 수천만 위안 규모의 시드 라운드 투자를 유치했다 (출처: 36kr)

📚 학습
CausalGame 논문: 30개 최첨단 모델 중 인과적 사고 테스트를 통과한 모델 전무 : MBZUAI, CMU, 칭화대 등이 공동 발표한 ICML 2026 Oral 논문인 《CausalGame》은 새로운 대화형 게임 벤치마크를 제안하여 30개의 최첨단 LLM Agent의 인과적 사고를 테스트했다. 결과에 따르면, 모든 모델이 선택 편향(selection bias)과 숨겨진 교란 요인(confounder)에 직면했을 때 실제 물리적 인과 메커니즘을 발견하는 데 어려움을 겪었으며, 평균 생존율은 모두 우승 기준선인 75%에 미치지 못했다 (출처: causalgame.github.io)
VISReg 논문: JEPA 세계 모델의 ‘표현 붕괴’ 난제 해결 : 자기지도학습(self-supervised learning)의 새로운 연구인 VISReg는 붕괴를 방지하는 정규화 항을 ‘척도(scale)’와 ‘모양(shape)’이라는 두 개의 독립적인 구성 요소로 분리함으로써, 기존 방법들이 붕괴 시 겪던 경사하강 소실(vanishing gradient) 문제를 해결했다. 이 방법은 15개 데이터셋에서 우수한 성능을 보였으며, 단 1/10의 데이터만으로 분포 외(OOD) 벤치마크에서 DINOv2와 대등한 성능을 기록하여 Yann LeCun의 연속 리트윗 추천을 받았다 (출처: 36kr)

RepLLM 논문: 네트워크 논문을 실행 가능한 코드로 자동 변환 : 샤먼대학의 Xiang Qiao 교수 연구팀은 상하이교통대, 칭화대 등과 공동으로 SIGCOMM 2026에 논문을 발표하고, 다중 에이전트 네트워크 연구 재현 프레임워크인 RepLLM을 제안했다. 이 프레임워크는 콘텐츠 분석, 아키텍처 설계, 코드 생성, 감사 및 수정의 네 가지 에이전트 협업을 통해 네트워크 논문을 실행 가능한 시스템 코드로 자동 변환하며, 이르면 2시간 이내에 재현을 완료할 수 있다 (출처: JiQizhixin)

ABBEL 논문: 장기 상호작용에서의 자기 요약 학습 효율성 향상 : 버클리 AI 연구소(BAIR)가 논문 《ABBEL: Learning Natural-Language Belief States for Memory-Efficient Interaction》을 발표하고, 자연어 ‘신념 상태(belief states)’를 정보 제한 요소로 활용하는 ABBEL 프레임워크를 제안했다. 오토인코더 방식의 신념 점수(belief scoring)를 도입함으로써, 이 프레임워크는 장기 상호작용에서 에이전트의 메모리 및 학습 효율성을 크게 향상시켰다 (출처: BAIR Blog)

💼 비즈니스
Delta Intelligence, 약 5억 위안 규모의 엔젤++ 라운드 투자 유치 : 네이티브 범용 휴머노이드 로봇 기초 모델 개발에 주력하는 Delta Intelligence가 여러 상장 기업과 주요 금융 기관이 참여한 약 5억 위안 규모의 엔젤++ 라운드 투자를 유치했다고 발표했다. 투자금은 모델 고도화, 자체 개발 데이터 수집 장비의 양산 및 데이터 루프 구축에 사용되어 산업 현장에서의 휴머노이드 로봇 도입을 가속화할 예정이다 (출처: 36kr)

Fish Audio, 5,000만 달러 규모의 시드 라운드 투자 유치 : AI 음성 모델 스타트업 Fish Audio가 Coreline Ventures와 Capital Today의 주도로 5,000만 달러 규모의 시드 라운드 투자를 유치했다고 발표했다. 이 회사는 이미 오픈소스 음성 생성 모델인 Fish Speech를 출시했으며, 1만 5,000개 이상의 자연어 제어 명령을 보유하고 있다. 창작자와 기업을 위해 지연 시간이 짧고 표현력이 뛰어난 음성 복제 서비스를 제공하는 데 주력하고 있다 (출처: TechCrunch)

Recursive Superintelligence, 아마존 AWS와 4억 달러 규모의 컴퓨팅 파워 계약 체결 : 자가 개선 AI 시스템 개발에 주력하는 Recursive Superintelligence가 아마존 AWS와 4억 달러 규모의 다년 계약을 체결했다고 발표했다. 이번 계약은 Recursive가 대규모 자가 개선 AI 시스템을 훈련할 수 있도록 컴퓨팅 파워를 지원하며, 올해 내로 첫 실용 에이전트 제품군을 출시하는 데 기여할 예정이다 (출처: TechCrunch)
🌟 커뮤니티
기업급 ‘소비 하향’과 Token 경제학의 부상 : 소셜 미디어에서는 미국 기업들이 대형 모델 호출에 돈을 쏟아붓는 것을 집단적으로 중단하고, 비용을 정밀하게 제어하는 ‘Token 경제학(Tokenomics)’으로 전환하고 있다는 논의가 뜨겁다. 기업들은 간단한 작업은 소형 모델이나 오픈소스 모델로 라우팅하고, 핵심 계획 수립만 비싼 폐쇄형 플래그십 모델에 맡기는 하이브리드 배포를 주류로 삼고 있다. 이로 인해 대형 모델 개발사들은 가격을 인하하고 작업 효율성을 최적화해야 하는 압박을 받고 있다 (출처: 36kr)
AI 코딩 어시스턴트, 소프트웨어 개발 프로세스 및 인재 구조 재편 : 커뮤니티 토론에 따르면, AI 코딩 및 Agent 어시스턴트의 보급으로 제품, 디자인, 엔지니어링 간의 경계가 모호해지고 있으며, ‘풀스택’ 및 ‘제너럴리스트’ 기술 인재가 생겨나고 있다. 전통적인 소프트웨어 개발 프로세스에서 AI의 도입은 코드 작성의 진입 장벽을 낮춘 반면, 제품 정의, 미적 감각, 그리고 ‘취향(taste)’과 같은 인간 고유의 판단력이 새로운 핵심 병목 구간이 되고 있다 (출처: 36kr)
의인화 상호작용 규제 신설로 인한 AI 에이전트 서비스 종료 및 감정적 의존성 논란 : 중국 내 의인화 상호작용에 대한 새로운 규제가 본격 시행됨에 따라, 일부 주요 플랫폼이 사용자 정의 AI 에이전트 기능을 종료하면서 ‘사이버 연인 다운로드’ 및 가상 감정 의존성에 대한 사용자의 광범위한 논의가 촉발되었다. 사용자와 플랫폼은 가상 자산의 정의, 감정적 기탁, 규제 준수 경계를 두고 깊은 이견을 보이고 있으며, 이는 AI 시대 인간과 기계 간 감정적 유대의 복잡성을 부각시킨다 (출처: 36kr)
💡 기타
BYD 최초의 휴머노이드 로봇, 8월 정식 공개 예정 : BYD 공식 발표에 따르면, 자사 최초의 휴머노이드 로봇 제품이 8월 초 ‘디 스페이스(Di Space)’ 정저우관에서 정식 공개된다. 이 로봇은 대리점 네트워크에 배치되어 고객 응대 및 차량 설명에 활용될 예정이며, 향후 1~2년 내에 상용화될 것으로 기대된다 (출처: 36kr)
Sigmastar, 온디바이스 고성능 AI 칩 전환 가속화 : 글로벌 비전 AI SoC 선도 기업인 Sigmastar가 온디바이스 고성능 컴퓨팅 전환을 가속화하고 있으며, 로봇 비전 칩 출하량이 이미 1,000만 개를 넘어섰다. 이 회사는 로컬에서 대형 모델을 실행할 수 있는 8 TOPS 칩과 차량용 32 TOPS 칩을 출시했으며, 올해 내로 2세대 AI 글래스 칩을 테이프아웃(tape-out)할 계획이다 (출처: 36kr)

NVIDIA, OpenAI와 2,500억 달러 규모의 슈퍼컴퓨터 금융 보증 논의 : 외신에 따르면 NVIDIA가 OpenAI와 협상을 진행 중이며, 오하이오주에 건설 예정인 10GW 규모, 총 공사비 5,000억 달러 이상의 슈퍼 컴퓨팅 센터에 대해 최대 2,500억 달러의 금융 보증을 제공할 계획인 것으로 알려졌다. 이 프로젝트는 소프트뱅크의 에너지 자회사가 개발할 예정이며, NVIDIA의 신용 보증을 통해 세계 최대의 컴퓨팅 파워 수요 고객을 확보하는 것을 목표로 한다 (출처: 36kr)
