🔥 В фокусе
OpenAI, Anthropic и Google планируют создать орган безопасности передового ИИ SAFA : Согласно информации The Information, OpenAI, Anthropic и Google готовятся к созданию организации по безопасности передового ИИ — «Стандартного агентства передового ИИ» (SAFA), официальный запуск которого намечен на начало 2027 года. Организация призвана координировать независимое стороннее тестирование моделей перед развертыванием, разрабатывать отраслевые механизмы оповещения об инцидентах и бенчмарки, что рассматривается как линия отраслевой саморегуляции и стандартизации технологических гигантов на фоне растущих рисков потери контроля над frontier-моделями и ужесточения регулирования во многих странах (Источник: The Verge)
Белый дом потребовал от OpenAI и Anthropic предоставить передовые модели на проверку властям США в приоритетном порядке : Офис национального кибердиректора Белого дома потребовал от OpenAI и Anthropic передавать свои новейшие передовые модели официальным органам США на проверку до того, как они будут предоставлены Британскому институту безопасности ИИ (AISI). Anthropic уже скорректировала свои процессы, ограничив доступ к ряду frontier-версий исключительно для американских ведомств. Этот шаг подчеркивает прямое соперничество мировых держав за лидерство в оценке ключевых технологий frontier-ИИ и национальную безопасность, а также создает институциональные трения в совместном транснациональном тестировании безопасности между США и Великобританией (Источник: THE DECODER)
Anthropic планирует структуру с суперголосующими акциями: 7 сооснователей с долей всего 2% получат 50,1% голосов : В преддверии многомиллиардного IPO компания Anthropic запрашивает одобрение акционеров на новую структуру корпоративного управления. СЕО Dario Amodei и еще 6 сооснователей, владея примерно по 2% акций каждый, смогут коллективно контролировать 50,1% голосов через траст голосования основателей (аналогично Palantir), если хотя бы трое из них сохранят свои квалифицирующие доли. Данная структура призвана разделить экономическую выгоду и право принятия решений, оградив долгосрочные исследования в области AI alignment и безопасности от давления Уолл-стрит, ориентированного на краткосрочную прибыль (Источник: 机器之心, 36氪, kimmonismus)

Google запускает пилотный проект космического ИИ-дата-центра на солнечной энергии Suncatcher : Google объявила, что запуск первого экспериментального спутника MVP в рамках орбитального проекта ИИ-дата-центра «Project Suncatcher» запланирован на 1 октября на борту ракеты SpaceX Falcon 9 (миссия Transporter-18). Спутник оснащен 4 кастомными TPU-ускорителями Trillium и питается от солнечной энергии; его цель — проверить возможность выполнения ИИ-инференса в экстремальных условиях космоса с использованием солнечной энергии, интенсивность которой в 8 раз выше, чем на Земле. Основной фокус испытаний — вакуумный отвод тепла и энергоэффективные орбитальные вычисления, а на 2027 год запланировано тестирование высокоскоростной межспутниковой лазерной связи (Источник: Ars Technica, Google, dotey)
Стало известно о подготовке OpenAI тарифа ChatGPT Pro Max за $500 в месяц : Разработчики обнаружили во фронтенд-коде ChatGPT новый уровень подписки «Pro Max» со стоимостью $500 в месяц, ориентированный на «максимальную скорость выполнения задач в Work и Codex» и, возможно, доступ к выделенным вычислительным мощностям с низкой задержкой. После того как GPT-6 Astra вызвала огромный расход вычислительных ресурсов на инференс, что привело к ограничениям подписок при пиковых нагрузках, OpenAI вводит ценовую сегрегацию вычислительных мощностей для ресурсоемких сценариев, сигнализируя о том, что передовые мощности все больше концентрируются вокруг корпораций и состоятельных организаций (Источник: 36氪, nicdunz)

🎯 События и тренды
Google представила Gemini 3.8 Live и модель аватаров реального времени : Google официально выпустила Gemini 3.8 Live и функцию Live Avatar, глубоко интегрировав потоковый диалог реального времени с динамической генерацией виртуальных видеоаватаров с низкой задержкой. Модель поддерживает нативную синхронизацию движения губ со звуком и видео на 97 языках, асинхронный фоновый вызов инструментов, генерацию кастомизируемых аватаров для корпоративных сценариев и полностью внедренные водяные знаки SynthID (Источник: Google DeepMind Blog)
Meta представила модель воплощенного аватара Muse Realtime Avatar : Meta выпустила потоковую архитектуру Muse Realtime Avatar, которая использует общий поток аудиотокенов с Realtime Voice, сокращая сквозную задержку видеодиалога примерно до 870 мс. Система сохраняет ограниченные вычислительные затраты за счет фиксированной длины контекста истории и обеспечивает синхронизацию губ и микромимики в диалогах любой продолжительности (Источник: alex_conneau, jack_w_rae)

Meta Muse оказалась в центре скандала из-за привлечения людей-операторов для звонков : Агентство Reuters сообщило, что при тестировании функции автономных телефонных звонков для нового персонального агента Muse Meta фактически перенаправляла задачи на сторонние команды живых операторов ради поддержания высокого процента успеха, что вызвало серьезные опасения пользователей по поводу конфиденциальности и вопросы регуляторов. Руководство Meta экстренно принесло извинения и закрыло тестирование, пообещав не возобновлять его до доработки механизмов раскрытия информации и защиты конфиденциальности (Источник: 量子位)
Отец современного ИИ Jürgen Schmidhuber стал главным научным советником Sakana AI : Пионер рекурсивного самосовершенствования (RSI) и мета-обучения Jürgen Schmidhuber официально занял пост главного научного советника японского ИИ-стартапа Sakana AI. Он возглавит новую лабораторию RSI Lab в Токио, объединяющую эволюционные алгоритмы, модели мира и самоорганизующиеся архитектуры для исследования адаптивного интеллекта в условиях ограниченных вычислений и создания замкнутого цикла RSI в физическом мире (Источник: SakanaAILabs, hardmaru)

LangChain представила LangSmith Engine v2 и Managed Deep Agents 0.8 : LangSmith Engine v2 получил поддержку проактивного Red Teaming и механизмы автоматической валидации и исправления, позволяя выявлять и устранять аномалии в логике до деплоя агента; в Managed Deep Agents 0.8 добавлены политики разрешений для долговременной памяти пользователей корпоративного уровня, Sandbox File API и нативный веб-поиск (Источник: LangChain, hwchase17)

Perplexity выпустила поисковый движок Photon на Rust и Fast Search API : Perplexity представила собственный сервис поиска и реранкинга Photon, написанный на Rust. Он обеспечивает сверхбыстрый поиск с задержкой p95 менее 230 мс и p50 всего 160 мс, снижая стоимость вызова API до $1 за 1000 запросов, и уже бесшовно интегрирован в Hermes Agent и локальную экосистему ИИ (Источник: AravSrinivas, MParakhin)

Выпущен открытый объединенный AI-SQL движок Quail: обработка более 1 млрд токенов в минуту на одном GPU : Команды из Стэнфорда, Modal и других проектов совместно выпустили открытый SQL-движок Quail для операций с ИИ-данными. За счет рефакторинга планировщика vLLM, слияния плана запроса с фазой Prefill LLM, кастомного KV-кэша и ядер внимания движок достиг пропускной способности свыше 1 млрд входных токенов в минуту на одном запросе на одной карте H100 (Источник: charles_irl, HamelHusain)
Google тестирует функцию звонков от имени пользователя Call for Me в Gemini для Pixel : Google тестирует функцию «Call for Me» на Pixel 11 в США: она позволяет Gemini автономно звонить компаниям с реального номера владельца для проверки наличия товаров, бронирования столов и переноса записей, автоматически проходя голосовые меню и ожидание на линии с предоставлением транскрипции в реальном времени и возможности мгновенного перехвата звонка человеком (Источник: TechCrunch)
Alibaba T-Head полностью открыла стек программного обеспечения T-Head SAIL для ИИ-чипов Zhenwu : T-Head (Alibaba) на конференции Apsara Conference объявила о переводе в открытый доступ своего CUDA-подобного программного стека T-Head SAIL, предоставив слой адаптации PyTorch, инструмент миграции sailify и библиотеки ускорения, такие как DeepGEMM и FlashAttention, что позволяет разработчикам проводить оптимизацию на уровне операторов и бесшовную миграцию под архитектуру Zhenwu (Источник: 量子位)
Команда Шаоцина Жэня из NIO представила модель мира и действий MM-Future для автономного вождения : Команда NIO предложила архитектуру MM-Future, реализующую совместную эволюцию нескольких гипотез пар «сценарий-действие» для планирования беспилотного вождения. Благодаря компактному пространственно-временному представлению MM-Tokens и совместному скореру прошлого и будущего модель набрала 94,0 PDMS на бенчмарке NAVSIM-v1, продвигая модели мира от пассивного однонаправленного прогнозирования к замкнутому активному планированию (Источник: 量子位)
Kuaishou представила базовую модель редактирования изображений для e-commerce KwaiMind : Kuaishou выпустила базовую модель редактирования изображений KwaiMind, предназначенную для генерации реальных e-commerce материалов. Объединяя детали одежды, согласованность товаров и рендеринг текста с помощью мультиагентного движка данных и онлайн-дистилляции, модель заняла первое место среди открытых моделей в 11 тестах e-commerce, обеспечив относительный прирост CTR в онлайн A/B тестах примерно на 2,44% (Источник: 机器之心)
Liquid AI открыла модель спекулятивного декодирования LFM2.5-VL-DSpark : Liquid AI выпустила решение для спекулятивного декодирования DSpark для 3B vision-language моделей. Добавление всего 280M параметров позволяет добиться ускорения декодирования до 3,13 раз на чипе M5 Max без потери точности и эквивалентности вывода, с поддержкой llama.cpp и SGLang (Источник: HuggingFace Blog)
Выпущен Qwengram-0.8B: перенос 51B явной N-Gram памяти на компактную локальную модель без потерь : Разработчики опубликовали архитектуру Qwengram: сохранив замороженную основу Qwen3.5-0.8B, модель с помощью легковесного модуля Reader и динамического гейтинга подключила внешнюю память на 51B PLE N-gram, добившись снижения перплексии (PPL) на валидационной выборке на 5,05% (Источник: Reddit r/LocalLLaMA)
PrismML перенесла 1-битную сверхлегкую LLM на умные очки с чипом Qualcomm Snapdragon : Стартап PrismML продемонстрировал работу 1-битной 2B модели Bonsai на чипе Snapdragon AR1 Gen 1, реализовав локальные визуальные ответы на вопросы и естественное взаимодействие в реальном времени, что доказывает инженерную возможность работы мультимодальных моделей на устройствах с ультранизким энергопотреблением (Источник: TechCrunch)
🧰 Инструменты
Запущено браузерное расширение Kimi с сохранением действий на веб-страницах в виде Skill : Kimi обновила WebBridge до нативного расширения для браузера с добавлением диалогового сайдбара и поддержкой записи последовательных действий пользователя (клики, скролл, парсинг данных) в многократно используемые инструкции-навыки (Skill), формируя автоматизированный рабочий процесс в связке с Kimi Code Desktop (Источник: 量子位)
Открыт GLiNER2.5-Decide: сверхбыстрая модель принятия решений с поддержкой связей сущностей и логических ограничений : Fastino выпустила легковесную структурированную модель принятия решений GLiNER2.5-Decide (340M). Она поддерживает не только быструю маршрутизацию и классификацию, но и извлечение спанов на уровне символов и связей сущностей, а также валидацию ограничений исключительности, кардинальности и порядковых условий в реальном времени. Задержка на CPU составляет всего 167 мс, на GPU — 38-47 мс, полностью заменяя затратный длинный вывод традиционных LLM (Источник: MarkTechPost, ClementDelangue)

LangSmith представила открытый инструмент для тюнинга smithtune и платформу Custom Apps : LangChain совместно с Baseten и Fireworks выпустила CLI-утилиту smithtune, позволяющую в один клик преобразовывать трейсы сессий LangSmith из продакшена в датасеты для SFT-дообучения с последующим автодеплоем моделей; функция Custom Apps дает разработчикам возможность с помощью промптов генерировать очереди разметки или дашборды сравнения метрик прямо из логов агентов (Источник: LangChain, baseten)

CoreWeave представила MCP-сервер Mission Control для интеграции с ИИ-средами разработки : Облачный провайдер CoreWeave выпустил сервис Mission Control на базе протокола MCP, позволяющий инструментам кодинга, таким как Cursor и Claude Code, напрямую считывать состояние GPU-кластеров, сети и узлов, давая возможность агентам устранять неполадки и оптимизировать ресурсы прямо внутри редактора кода (Источник: AI Business)
Открыт Pruna-Qwen-Image-2.1: LoRA на 5–8 шагов обеспечивает 6,3-кратное ускорение генерации изображений : Pruna AI выложила быстрый LoRA-адаптер для Qwen-Image-2.1, который за счет оптимизированного sigma-планировщика и работы без CFG сокращает шаги генерации и редактирования с 40 до 5–8 шагов, ускоряя процесс до 6,3 раз с сохранением качества 1K и консистентности по референсам (Источник: _akhaliq, huggingface)
Релиз flow-transform 1.0: высокоточная модель маскирования PII для сохранения бизнес-процессов : micro1 представила модель анонимизации flow-transform 1.0, разработанную специально для обучения передовых LLM и показавшую результат F1 96,0% на PrivacyBench. Ее суть заключается в замене данных синтетическими сущностями вместо простого скрытия, что сохраняет многошаговую логику решений и цепочки вызовов инструментов в бизнес-процессах компании (Источник: omarsar0)

Whiteboard: открытая IDE для совместного проектирования архитектуры ПО человеком и ИИ : На базе CodeOSS выпущена открытая десктопная IDE Whiteboard, предлагающая SDK для диаграмм и семантический Diff Viewer для ИИ-агентов кодинга (таких как Claude Code), снижая «когнитивный долг» от полной автоматизации разработки через визуальные диаграммы последовательностей, ER-диаграммы и журналы решений (Источник: Hacker News)
StarNet: десктопная пиксельная среда для локального выполнения мультиагентных систем : Открытый проект StarNet визуализирует среду выполнения ИИ-агентов в виде пиксельной космической станции, где каждая комната представляет область прав, а шлюзы — потоки данных. Поддерживается подключение популярных LLM по схеме BYOK и локальное сохранение процессов мультиагентного взаимодействия и задач (Источник: GitHub Trending)
Google Gemini официально интегрировала плагины Adobe Photoshop и Lightroom : Вслед за ChatGPT и Claude плагины Adobe Creative Suite появились и в Google Gemini. Пользователи могут вызывать инструменты профессиональной ретуши и дизайна с помощью команды «@Adobe», расширяя графические возможности чат-ассистента (Источник: The Verge)
📚 Исследования и обучение
Стэнфордский университет открыл материалы нового осеннего курса CS329Z «Инженерия ИИ-агентов» : NLP-команда Стэнфорда совместно с авторами DSPy и SWE-bench запустила курс CS329Z, охватывающий полный цикл разработки — от простых LLM-пайплайнов и составных ИИ-систем до автономных агентов. Особое внимание уделено промпт-инжинирингу, оценке состояний, безопасности песочниц и оркестрации инструментов; материалы и код первой лекции уже опубликованы (Источник: stanfordnlp)

Google представила мультиагентную архитектуру генерации длинных видео AI Video Co-Director : Исследователи Google опубликовали инструмент для генерации нарративных видео, объединяющий глобальную оптимизацию стратегии MAB, явную визуальную память CANVAS и замкнутую обратную связь промптов VQQA, эффективно решая проблемы дрейфа объектов и каскадных ошибок при генерации многокадровых длинных видео продолжительностью в несколько минут (Источник: Google Research Blog)
Perplexity раскрыла метод самодистилляции на основе подсказок по реальным ошибкам : Perplexity раскрыла механизм пост-тренинга для агентов управления компьютером, преобразующий ошибки неудачных траекторий в структурированные подсказки. Использование on-policy самодистилляции (OPSD) позволяет модели-учителю направлять студента, сокращая сбои при вызове онлайн-инструментов на 21,2% (Источник: MarkTechPost)
BJTU, Tsinghua и партнеры представили ARGUS: мультиагентный фреймворк детекции дипфейков на основе цепочки доказательств : Для решения проблемы слабой генерализации «черных ящиков» при детекции дипфейков представлена система ARGUS, разделяющая агентов-наблюдателей (текстура, освещение, временная динамика, законы физики) и агента-судью. Опубликован датасет FaceVid-Forensics-100K из 33 источников генерации; показатель F1 вне домена вырос до 53,28% (Источник: 36氪)

Zhejiang University и партнеры представили MemGUI-Bench: первый бенчмарк долговременной памяти и межсессионного обучения для GUI-агентов : Чжэцзянский университет совместно с Нанькайским университетом и CUHK представил бенчмарк MemGUI-Bench со 128 реальными долговременными задачами и трехэтапный инструмент аудита MemGUI-Eval. Эксперименты показали до 58,9% галлюцинаций памяти у ведущих моделей в кросс-приложенческих и кросс-сессионных задачах, обнажив слепые зоны памяти, недоступные обычным бенчмаркам (Источник: 36氪)

Hugging Face открыла SmolDataEnvs: более 5000 верифицируемых сред для обучения с подкреплением : Для решения проблемы нехватки сред обучения малых моделей (до 10B) в области Data Science и программирования сообщество выпустило SmolDataEnvs — свыше 5000 верифицируемых RL-сред на базе реальных задач Data Science с поддержкой асинхронного RL на одном GPU (Источник: _lewtun, huggingface)
Microsoft и партнеры представили CASD: оптимизация промптов на основе полного анализа логов кодовых агентов : Исследователи Microsoft представили метод CASD, доказав, что расчет статистики полных траекторий кодовым агентом и написание правил оптимизации превосходит поисковые циклы на малых батчах на 16,6 балла, снижая стоимость разовой оптимизации промпта до $1,60 (Источник: dair_ai)

Номинант IROS 2026 статья ULTRA: скоординированное управление всем телом для гуманоидных роботов : Исследовательская группа UIUC предложила унифицированный фреймворк ULTRA, который благодаря нейро-ретаргетингу на основе физики и RL-файнтюнингу позволяет роботу Unitree G1 автономно выполнять непрерывный захват и перемещение всего тела лишь по разреженным целевым точкам или облаку точек от первого лица (Источник: 机器之心)
AdaRoboVLG: фреймворк зрительно-языкового захвата с разделением задач для различных робоманипуляторов : Команды HUST, PKU и партнеров представили AdaRoboVLG, разделяющий высокоуровневые семантико-временные априорные данные и низкоуровневую генерацию захвата. Единый интерфейс подходит как для многопалых рук, так и для параллельных захватов, сохраняя высокую надежность на динамических конвейерах и в загроможденных сценах (Источник: 机器之心)
Agent или Workflow? Практическое руководство по выбору архитектуры бизнес-систем : В подробной отраслевой статье анализируются границы между детерминированными рабочими процессами (workflow) и автономными агентами. Сформулирован ключевой критерий: «Можно ли до запуска построить полный конечный автомат?», а также дана рекомендация отдавать приоритет рабочим процессам с LLM-валидацией в высоконагруженных и регуляторно-чувствительных сценариях (Источник: Machine Learning Mastery)
💼 Бизнес
Anthropic подписала долгосрочный контракт на облачные вычисления с Akamai на $11,6 млрд : Anthropic заключила 7-летнее соглашение на сумму $11,6 млрд на облачную инфраструктуру с Akamai с предоставлением последней варрантов на покупку акций до 5%, в результате чего объем ее обязательств по закупке вычислительных мощностей за последние 11 месяцев превысил $500 млрд (Источник: THE DECODER)
Сообщается, что TypeSafe привлекает $1 млрд при оценке более $10 млрд : Как сообщает The Information, после взрывного интереса сообщества разработчиков к модели принятия решений Jev и преодоления планки в триллион токенов вызовов в день, TypeSafe AI ведет переговоры с ведущими фондами о новом раунде финансирования свыше $1 млрд при post-money оценке более $10 млрд, что означает стремительный скачок стоимости стартапа (Источник: steph_palazzolo)
Databricks объявила о приобретении платформы облачных таблиц реального времени Row Zero : Databricks объявила о соглашении по покупке Row Zero — платформы высокопроизводительных облачных электронных таблиц, способной обрабатывать сотни миллионов строк данных. Цель сделки — глубокая интеграция сервиса с ИИ-аналитическим движком Genie от Databricks для предоставления финансистам и аналитикам интерактивного рабочего пространства на базе ИИ и систем управления данными (Источник: jefrankle, matei_zaharia)
🌟 Сообщество
Удаление Claude Code 48 тыс. ключевых файлов вызвало дискуссии о безопасности ИИ в разработке : В сообществе обсуждается случай, когда разработчик при пересборке образа с помощью Claude Code из-за ошибок изоляции прав скрипта непреднамеренно удалил 48 000 файлов проекта и Git-индексы за 103 секунды. Это вновь подняло тревогу относительно выполнения скриптов без песочницы и предоставления агентам прямых прав в рабочих средах (Источник: TechRadar)
Jev вызвал волну научных исследований и дискуссий об архитектуре System 1 : За неделю после релиза Jev на платформе arXiv появилось множество статей, посвященных граничной маршрутизации и каскадной оценке модели. Сообщество отмечает, что при сверхвысокой скорости и снижении затрат в сотни раз в бинарных/множественных решениях модель чувствительна к названиям вариантов в длинных цепочках, что ускоряет переход разработчиков к гибридной парадигме «быстрый отбор через System 1 + подстраховка frontier-моделью System 2» (Источник: 36氪, Latent Space, dair_ai)

Технологические гиганты собрались на ужине в Белом доме: ожесточенные споры о регулировании безопасности и ускорении ИИ : Руководители США и Китая встретились на государственном приеме с Jensen Huang, Elon Musk, Tim Cook и другими лидерами бигтеха, где развитие и безопасность ИИ стали ключевой темой. В индустрии разгорелись споры о том, не используют ли передовые лаборатории страх перед безопасностью для создания «регуляторного захвата рынка»; Zuckerberg и Huang открыто выступили против скоординированного замедления индустрии, настаивая на ответственности в конкретных прикладных сценариях (Источник: Transformer, teortaxesTex, Reddit r/ArtificialInteligence)

Claude Opus 5.5 хвалят за превосходную эстетику, но режим «Max» уличили в зацикливании логики : Сообщество высоко оценило генерацию кода и эстетическое чутье Claude Opus 5.5, однако опытные разработчики отметили, что при максимальном уровне рассуждений (Max) модель склонна впадать в бесконечные циклы самоанализа, расходуя квоты, и рекомендуют использовать режимы Medium или High для обычных и несложных задач (Источник: Reddit r/ClaudeAI, theo, arena)
Медицинское сообщество призывает остерегаться снижения когнитивных функций из-за чрезмерной зависимости от ИИ : В колонке The Guardian отмечается, что по мере проникновения генеративного ИИ в университеты и рабочую среду делегирование аналитических и письменных задач искусственному интеллекту ослабляет нейронные связи мозга и навыки критического мышления, призывая рассмотреть влияние использования ИИ на долгосрочное когнитивное здоровье в контексте общественного здравоохранения и образования (Источник: The Guardian)
💡 Другое
GPT-6 Astra успешно прошла сложнейшую хардкорную Roguelike-игру NetHack : Эксперименты показали, что GPT-6 Astra с третьей попытки достигла финала («Вознесения» / Ascension) в культовой и экстремально сложной Roguelike-игре NetHack, ознаменовав важный прорыв LLM в работе с огромным пространством состояний, неполной информацией и длинными последовательными стратегиями (Источник: Plinz, _rockt)

Консолидация ИИ-продуктов бигтехов: Tencent официально объявила о закрытии сервиса QClaw : Tencent опубликовала уведомление о том, что QClaw прекратит работу 24 декабря 2026 года с переводом пользователей на платформу WorkBuddy. Под давлением затрат на вычисления и требований к ROI китайские бигтехи завершают эпоху параллельных внутренних гонок, консолидируя разрозненные агентные эксперименты в единые платформы продуктивности (Источник: 36氪)

Крупнейший ИИ-суперкомпьютерный центр Великобритании может быть отложен до 2030-х годов из-за задержек с подключением к электросети : Национальный суверенный ИИ-дата-центр мощностью 90 МВт в графстве Эссекс, запуск которого планировался на 2027 год, столкнулся с ограничениями пропускной способности электросетей: местная энергокомпания ожидает, что сможет обеспечить необходимые мощности только к середине 2030-х годов, что подчеркивает структурный дисбаланс между ростом вычислительной инфраструктуры и возможностями энергосетей (Источник: The Guardian)