Ключевые слова:Большая модель, Открытый ИИ, Кризис вычислительных мощностей, Модель MoE с открытым исходным кодом Kimi K3, Гипотеза Якоби Claude Fable 5, Вторжение ИИ-агентов Hugging Face
🔥 В фокусе
Релиз Kimi K3 вызвал дефицит вычислительных мощностей и ограничения на покупку подписок : Компания Moonshot AI выпустила открытую MoE-модель Kimi K3 с 2,8 трлн параметров. Из-за резкого роста спроса возникла острая нехватка вычислительных мощностей GPU, в связи с чем разработчики объявили о временной приостановке подписки для новых C-end пользователей и планах разделить обычную и программируемую подписки. K3 показала отличные результаты во фронтенд-программировании и тестировании кибербезопасности, даже исправив уязвимости, которые Codex и Fable отклонили из-за ограничений безопасности. Этот инцидент вызвал в индустрии глубокие дискуссии о нехватке вычислительных мощностей и путях коммерциализации моделей с открытым исходным кодом. (来源:量子位、The Verge、THE DECODER、Hacker News、机器之心)

Опровержение гипотезы Якоби моделью Claude Fable 5 вызвало потрясение в математическом сообществе : Модель Claude Fable 5 от Anthropic без каких-либо подсказок (prompts) успешно нашла трехмерный контрпример к «гипотезе Якоби», остававшейся нерешенной 87 лет. Этот результат уже был подтвержден расчетами нескольких математиков. Этот «момент AlphaGo в олимпиадной математике» показывает, что LLM обладают уникальным преимуществом, превосходящим человеческую интуицию при обработке сложного символьного вывода и исчерпывающего поиска. Это знаменует переход AI к новому этапу в области чистых математических исследований и научных открытий. (来源:机器之心、THE DECODER、Hacker News)
.jpg)
Hugging Face взломан AI-агентом: система безопасности выявила «слабость защитника» : Открытое AI-сообщество Hugging Face сообщило о компрометации своей производственной инфраструктуры автономной системой AI-агентов. В ходе реагирования на инцидент команда безопасности из-за ограничений безопасности (guardrails) коммерческих API была вынуждена переключиться на локально развернутую открытую модель GLM 5.2 для анализа логов. Этот инцидент подтверждает, что автономные атаки под управлением AI стали реальностью, а также обнажает технические препятствия для защитников, вызванные избыточным выравниванием (alignment) коммерческих моделей. (来源:THE DECODER、Hugging Face)

Противостояние США и Китая вокруг открытых и закрытых AI-моделей обостряется: правительство США планирует «мягкую блокировку» против КНР : На фоне подъема китайских открытых моделей, таких как Kimi K3 и Qwen 3.8, заявление директора по стратегии OpenAI Дина Болла (Dean Ball) о том, что «модели с открытым исходным кодом — это деселерационизм и AI-коммунизм», вызвало раскол в Кремниевой долине. В то же время администрация Трампа рассматривает возможность введения децентрализованной «мягкой блокировки» китайских открытых моделей через ограничения на закупки, списки юрлиц (Entity List) и давление в сфере безопасности, чтобы защитить доминирующее положение американских гигантов с закрытым исходным кодом. (来源:THE DECODER、Axios)

🎯 Тренды
Alibaba выпустила аудио-LLM Qwen-Audio-3.0-TTS с возможностью мелкозернистого контроля эмоций : Компания Alibaba представила большую модель синтеза речи Qwen-Audio-3.0-TTS, которая возглавила рейтинг синтеза речи от Artificial Analysis. Модель поддерживает встраивание тегов мелкозернистого контроля эмоций в текст, охватывает 16 языков и 20 китайских диалектов, а также способна клонировать голос в условиях высокого уровня шума. Это знаменует переход AI-озвучки от простого «чтения» к эпохе выразительного «актерского исполнения». (来源:机器之心、量子位)
.png)
Model Best выпустила серию MiniCPM-Robot: малая модель 1.5B ворвалась в первый эшелон Embodied AI : В рамках WAIC компания Model Best (面壁智能) представила и выложила в открытый доступ серию On-Device моделей воплощенного интеллекта (Embodied AI) MiniCPM-Robot. Манипуляционная модель 1.5B показала отличные результаты в тестах LIBERO и решила проблему отсутствия долговременной памяти у VLA-моделей с помощью потоковых вычислений. Модель отслеживания 0.9B позволяет осуществлять высокочастотное автономное слежение за целями с низкой задержкой на On-Device устройствах, демонстрируя огромный потенциал нативных малых On-Device моделей в области Physical AI. (来源:量子位)

PixVerse представила первый AI-агент для создания контента неограниченной длины vivago R1 : На выставке WAIC 2026 компания PixVerse (智象未来) представила мультимодальный творческий AI-агент vivago R1. Базируясь на собственной операционной системе HD-AgentOS, vivago R1 преодолевает отраслевые ограничения на длительность генерации видео. Он поддерживает непрерывную генерацию и логическую калибровку видео неограниченной длины, эффективно решая проблемы резких переходов кадров и нестабильности персонажей (IP), повышая показатель успешности создания пригодного контента до 85% и ускоряя коммерциализацию AI-видео. (来源:量子位)

Infinigence AI представила межкластерную гетерогенную архитектуру разделения PD для оптимизации стоимости вывода LLM : На WAIC 2026 компания Infinigence AI (无问芯穹) представила межкластерную гетерогенную архитектуру разделения PD (PDD). Путем разделения этапов Prefill и Decode и их развертывания на гетерогенных чипах в разных дата-центрах, архитектура использует Ethernet и механизм эстафеты Token ID для маскировки задержек передачи. Тесты показали снижение задержки первого токена (First-Token) на 51,5% и снижение стоимости одного токена на 37,5%, что предлагает экономически эффективное системное решение для планирования гетерогенных вычислительных мощностей в эпоху AI-агентов. (来源:机器之心、量子位)
.jpg)
Buchou Quantum представила первую в Китае атомно-квантовую платформу для искусственного интеллекта «Liangchou No. 1» : На выставке WAIC компания Buchou Quantum (不筹量子) представила атомно-квантовую AI-платформу «Liangchou No. 1» (Q-Cub). Платформа преодолела рубеж в 1500 кубитов с точностью одного кубита (single-qubit fidelity) 99,9% и впервые предложила гетерогенную архитектуру слияния трех вычислительных мощностей «нейтральные атомы QPU + GPU + CPU». Благодаря полностековой (full-stack) программной системе достигается автоматическое квантовое ускорение алгоритмов. Платформа уже используется для совместного построения экосистемы в восьми ключевых областях, включая прогнозирование погоды и Embodied AI. (来源:量子位)

🧰 Инструменты
FastMCP: инструмент на базе Python для эффективного создания MCP-сервисов и клиентов : Компания Prefect выложила в открытый доступ фреймворк FastMCP, предоставляющий разработчикам питонический способ создания серверов и клиентов Model Context Protocol (MCP). FastMCP автоматически преобразует функции Python в инструменты, ресурсы и подсказки (prompts), соответствующие спецификациям MCP, поддерживает бесшовную интеграцию с различными LLM и упрощает процесс взаимодействия AI-агентов с внешними данными и инструментами. (来源:GitHub)

Релиз рефакторинга OpenCode 2.0: миграция с Bun на Node и поддержка десктопной версии на Electron : Вышла версия 2.0 открытого AI-помощника для программирования OpenCode. В новой версии полностью переработан дизайн API, среда выполнения перенесена с Bun на Node для оптимизации использования памяти, а архитектура десктопного приложения изменена с Tauri на Electron для повышения согласованности кроссплатформенного рендеринга. Версия 2.0 также поддерживает параллельную разработку в нескольких сессиях и сравнение нескольких моделей, что значительно повышает эффективность совместной работы разработчиков. (来源:36氪)

SQRL: семейство моделей Text-to-SQL с поддержкой предварительного опроса базы данных : Компания Feyn AI выпустила открытое семейство моделей Text-to-SQL под названием SQRL, включающее версии 4B, 9B и 35B. SQRL меняет традиционный режим «прямого перевода»: перед генерацией SQL модель проводит исследование базы данных в режиме «только для чтения» и использует возвращенные данные для устранения семантической двусмысленности в схеме (schema). В тестах версия 35B показала точность выполнения 70,6% на BIRD Dev, превзойдя Claude Opus 4.6. (来源:MarkTechPost)
Ontology-Playground: открытая платформа Microsoft для проектирования и изучения онтологий в Fabric IQ : Microsoft выложила в открытый доступ полностью статичное веб-приложение Ontology-Playground, призванное помочь пользователям изучать и проектировать онтологии (Ontology). Платформа предлагает визуальный редактор, импорт/экспорт RDF/XML, отправку PR на GitHub в один клик и встроенный курс «Школа онтологий». Она позволяет пользователям исследовать возможности семантического маппинга Fabric IQ с помощью запросов на естественном языке. (来源:GitHub)

📚 Обучение
Книга «Глубокое понимание AI-агентов» опубликована в открытом доступе: детальный разбор принципов проектирования и инженерной практики : Книга Ли Боцзе (Li Bojie) «Глубокое понимание AI-агентов: принципы проектирования и инженерная практика» выложена в открытый доступ на GitHub вместе с полным текстом в формате PDF и сопутствующим кодом для каждой главы. Книга построена вокруг базовой формулы «Agent = LLM + контекст + инструменты» и систематически объясняет такие передовые технологии, как контекстная инженерия (Context Engineering), базы знаний RAG, мультиагентное взаимодействие и пост-обучение (post-training) моделей. Это отличный ресурс для систематического обучения разработчиков AI-агентов. (来源:GitHub)

COMPASS: пан-раковая базовая модель для прогнозирования ответа на иммунотерапию рака на основе транскриптомики : Команда Гарвардской медицинской школы и другие исследователи опубликовали статью в журнале Nature Medicine, представив пан-раковую базовую модель COMPASS. Модель прошла предобучение на более чем 10 000 опухолевых образцов 33 типов рака. Она иерархически отображает данные транскриптомики через 44 иммунных концепта и обеспечивает точное прогнозирование ответа на иммунотерапию в 16 независимых клинических когортах, повысив среднюю точность на 8,5% по сравнению с существующими методами. (来源:36氪)

HiLS-Attention: иерархический механизм разреженного внимания на основе ориентиров преодолевает узкие места длинных текстов : Команда Tencent Hunyuan выложила в открытый доступ механизм HiLS-Attention. Благодаря внедрению разложения Тейлора первого порядка и иерархического Softmax, он решает проблемы неточной оценки важности чанков (chunks) и невозможности сквозного (end-to-end) обучения в традиционном разреженном внимании (sparse attention). Механизм поддерживает экстраполяцию контекста до 4M без дополнительного обучения при условиях тренировки на 8K, а скорость декодирования при длине 512K увеличивается более чем в 15 раз. (来源:机器之心)
.jpg)
💼 Бизнес
Стартап в сфере генерации AI 3D-контента Meshy привлек почти 400 млн долларов в раунде B : Пекинский стартап по генерации AI 3D-контента Meshy (Taichi Graphics) объявил о завершении раунда финансирования серии B на сумму около 400 млн долларов США. Оценка компании после инвестиций превысила 10 млрд юаней, что установило новый рекорд для одного раунда финансирования и оценки в этой области. Раунд возглавили IDG Capital, Matrix Partners China и другие. Средства будут направлены на исследования и разработку мультимодальных AI 3D-моделей, а также на расширение глобального рынка в таких областях, как игры и 3D-печать. (来源:36氪)

Boton Optoelectronics привлекла более 100 млн юаней в раунде B+, сосредоточившись на сверхточном ионно-лучевом оборудовании : Разработчик ионно-лучевого оборудования Boton Optoelectronics (博顿光电) объявил о завершении раунда финансирования серии B+ на сумму более 100 млн юаней. Инвесторами выступили Yida Capital, CSC Financial Co., Ltd. и другие. Boton Optoelectronics специализируется на независимых управляемых источниках ионов и сверхточном технологическом оборудовании для ионных пучков. Ее продукция уже поставляется ведущим клиентам в таких передовых областях науки и техники, как управляемый термоядерный синтез, оптическая связь и квантовые вычисления. (来源:36氪)

RedBear AI привлекла сотни миллионов юаней в раунде A+ для продвижения «управляемых памятью» AI-приложений : Компания RedBear AI (红熊AI) объявила о завершении раунда финансирования серии A+ на сумму в несколько сотен миллионов юаней под руководством Jiuwei Fund, Zhangyuan Venture Capital и других инвесторов, при этом оценка компании приблизилась к 3 млрд юаней. RedBear AI придерживается концепции «управляемого памятью AGI», глубоко интегрируя собственную большую модель OpenBear с системой когнитивной памяти MemoryBear, стремясь решить проблемы забывания долгосрочного контекста и высокого потребления токенов при внедрении больших моделей на предприятиях. (来源:36氪)

🌟 Сообщество
Специалисты сферы технологий в эпоху AI погрязли в «KPI по токенам» и инфляции рабочей нагрузки : В сообществе активно обсуждают условия жизни ИТ-специалистов в 2026 году. Исследования показывают, что хотя AI увеличил индивидуальную производительность в несколько раз, это привело к появлению новых управленческих оков, таких как «рейтинги использования» и «KPI по токенам». В результате общий уровень выгорания в отрасли подскочил с 44,7% до 55,7%. Многие программисты иронично называют себя «чат-инженерами», сталкиваясь с дилеммой: «AI ускорил темпы производства, но не улучшил качество результатов». (来源:36氪、ZDNet)
Вступили в силу новые правила регулирования AI-микросериалов: отрасль переходит от хаотичного роста к качественной перестройке : С введением в действие «Временных мер по управлению услугами антропоморфного взаимодействия на базе искусственного интеллекта» и «Стандартов классификации и категоризации AI-микросериалов» внутренний рынок AI-сериалов и услуг антропоморфного взаимодействия переживает масштабную чистку. Крупные технологические компании отключают не соответствующие требованиям роли AI-агентов, в то время как роботы-компаньоны для пожилых людей, имеющие физическое воплощение и лицензированные для ухода, получают зеленый свет от властей. Конкуренция в отрасли смещается от «низкобюджетной гонки за объемами» к «соблюдению авторских прав и глубине контента». (来源:36氪、36氪)
Снова вскрылся обман с «обертками» больших моделей: фишинговый эксперимент Basalt Labs развеял миф о бенчмарках : В сообществе предали огласке «фишинговый эксперимент», нацеленный на академические круги AI. Организация под названием Basalt Labs заявила о выпуске модели Monolith-1.0 с 1,6 трлн параметров, которая возглавила несколько бенчмарков. Позже разработчики доказали, что модель представляла собой лишь скопированные и раздутые веса открытой модели 7B, которая тайно вызывала API DeepSeek. Этот инцидент заставил сообщество глубоко задуматься о чрезмерной «накрутке показателей» современных больших моделей и отсутствии содержательной проверки. (来源:36氪)
💡 Другое
Суд отменил план увольнений южнокорейской игровой компании, разработанный генеральным директором с помощью ChatGPT : Генеральный директор южнокорейской игровой компании KRAFTON Чан Хён Гук (Jang Hyun-guk), пытаясь избежать выплаты бонусов сотрудникам поглощенной компании на сумму 250 млн долларов, проигнорировал советы юристов и глубокой ночью с помощью ChatGPT разработал схему «сначала уволить, потом отказаться платить». Эта схема была признана незаконной в ходе судебного разбирательства в штате Делавэр. В итоге компанию обязали восстановить сотрудников на работе и выплатить бонусы в полном объеме. Этот случай стал классическим негативным примером злоупотребления AI в корпоративном управлении. (来源:Reddit r/ArtificialInteligence)
Крупнейшая в США солнечная компания Sunrun исследует распределенную вычислительную сеть для запуска GPU на домашних электросетях : Американский поставщик солнечной энергии Sunrun планирует развернуть узлы краевых вычислений (edge computing) на базе GPU в домах, оборудованных солнечными панелями и системами хранения энергии. Это позволит преобразовывать избыточную солнечную энергию в вычислительные мощности для вывода AI и продавать их предприятиям. Хотя это решение имеет естественные ограничения в виде задержек сети и пропускной способности каналов связи уровня дата-центров, оно предлагает новый подход к созданию распределенных вычислительных сетей для решения проблемы дефицита электроэнергии, с которой сталкиваются американские дата-центры. (来源:36氪)
Интеллектуальная сеть передачи данных AI Flow от China Telecom получила престижную награду WAIC SAIL Award : Самостоятельно разработанная Институтом искусственного интеллекта China Telecom «Интеллектуальная сеть передачи данных (AI Flow)» была удостоена высшей награды WAIC — SAIL Award. Данная технология впервые предлагает парадигму «генеративной интеллектуальной передачи», перестраивая традиционную передачу «битовых потоков» (bitstreams) в передачу «потоков токенов» (token streams). Это позволило осуществлять четкие голосовые вызовы при крайне узкой полосе пропускания всего в 0,266 кбит/с, а также успешно масштабировать технологию в сценариях аварийно-спасательных работ в воздухе, космосе, на суше и на море. (来源:机器之心)