🔥 Главное
Трамп назначил директора Национальной разведки Jay Clayton «царем ИИ» Белого дома : Дональд Трамп официально объявил о назначении директора Национальной разведки США Jay Clayton на должность «царя ИИ» (AI Czar) Белого дома, возложив на него руководство новым формированием «Super Intelligence Force» (SIF). Ранее Clayton возглавлял SEC и курировал 18 разведывательных ведомств США; он публично заявлял, что AI представляет собой как исторический шанс, так и угрозу национальной безопасности. SIF займется координацией взаимодействия федерального правительства с рядовыми потребителями, общественными и религиозными группами, критической инфраструктурой, а также передовыми центрами разработки суперинтеллекта. Это назначение знаменует переход США к межведомственной координации уровня боевой готовности в сфере регулирования и безопасности передового AI. (Источник: The Guardian)

Европейский стартап Aleph Alpha выпустил в открытый доступ двуязычную MoE-модель Kolibri на 78B параметров : Немецкий AI-стартап Aleph Alpha представил суверенную большую языковую модель Kolibri-1. Модель с общим числом параметров 78.1B построена на гибридной архитектуре скользящего окна и глобального внимания, активируя всего 3.46B параметров на токен (4.4%), и поддерживает контекст до 1 млн токенов. Kolibri полностью обучена на европейской инфраструктуре и соответствует требованиям EU AI Act и стандартам GDPR. Она набрала 96.9% в математическом тесте AIME 2025 и 84.3% в GPQA Diamond. Веса FP8 опубликованы под лицензией Apache 2.0 и оптимизированы для развертывания на одной карте B200 или двух картах H100. (Источник: MarkTechPost)
Команда Kaiming He с архитектурой визуального усиления VISTA установила рекорд на бенчмарке ARC-AGI-3 : Исследовательская группа Kaiming He опубликовала работу VISTA, опровергающую традиционный подход перевода интерактивных игр в абстрактные числовые символы в пользу нативного ввода изображений в сочетании с механизмом внешней «визуальной галереи без потерь» (явное внимание). В процессе исследования модель может параллельно просматривать и сопоставлять кадры истории по мере необходимости. Это позволило модели Claude Opus 5 без дополнительного дообучения набрать максимальные 100 баллов во всех 25 играх, затратив всего 0.43 от количества шагов человека при первом прохождении; результат GPT-5.6 Sol составил 99 баллов. Результат разрушает стереотип о том, что абстрактные рассуждения требуют длинных цепочек рассуждений (Chain-of-Thought) или симуляторов кода, подтверждая, что визуальное восприятие и рабочая память — ключевые факторы преодоления абстрактной генерализации в AGI. (Источник: 36氪)

NASA и IBM совместно представили открытую базовую модель для лунной науки : NASA и IBM Research совместно выпустили базовую модель Луны на мультимодальной архитектуре TerraMind, объединив данные дистанционного зондирования почти из 2 млн тайлов высокого и низкого разрешения, собранные аппаратом Lunar Reconnaissance Orbiter (LRO) за 17 лет. Модель использует угол освещения и пространственную геометрию Солнца в качестве явных априорных данных, снижая погрешность прогнозирования вероятности залежей водяного льда в постоянно затененных кратерах полярных регионов на 22% и демонстрируя высокую точность в распознавании кратеров. Веса модели, код и бенчмарки полностью открыты на Hugging Face и GitHub. (Источник: The Decoder)

🎯 Тенденции
Google изменила тарифную сетку Gemini для частных пользователей: бесплатный уровень ограничен Flash-Lite, введены платные пороги : Google объявила об ограничении доступа к Gemini для персональных аккаунтов. Пользователи бесплатной версии смогут использовать только минимальную модель Flash-Lite, потеряв доступ к Flash и Pro; подписчики тарифа AI Plus за $5/месяц также лишены доступа к Pro и сохранили только Flash-Lite и Flash. Для доступа ко всей линейке моделей теперь требуется подписка на планы Pro или Ultra стоимостью от $20 до $100 в месяц. Аналитики полагают, что этот шаг направлен как на сокращение дефицита вычислительных ресурсов при высокочастотном инференсе, так и на подготовку коммерческого запуска более дорогого флагмана Gemini 4 Argon. (Источник: The Decoder)
Релиз DeepSeek Harness v0.2.1: добавлен экспериментальный уровень совместимости с Claude Code Mods : DeepSeek выпустила обновление v0.2.1-alpha.1 для своего открытого скаффолда агентов. Помимо официального десктопного приложения, ключевым нововведением стал экспериментальный уровень совместимости с Claude Code Mods API, позволяющий через мост запускать такие модули, как Token Weather и Blast Radius, внутри системы плагинов DSH. Руководитель команды Цуй Тяньи отметил, что DSH следует философии «все есть плагин», а этот шаг призван подтвердить, что архитектура модов конкурентов может выступать подмножеством экосистемы DSH. (Источник: 机器之心)

OpenAI анонсировала усиление возможностей сокращения и рефакторинга кода в Astra 6.1 : Руководитель по продукту OpenAI Tibo Sottiaux и исследователь пост-тренировки Rajan Agarwal сообщили, что в модели следующего поколения фокус сделан на «сокращении и упрощении кода», чтобы устранить проблему технического долга и генерации агентами избыточного кода. Команда оптимизирует стратегию пост-тренировки для качественного рефакторинга и самооптимизации кода, а также намекнула на скорый запуск модели Astra 6.1, отложенной ранее из-за вопросов безопасности. (Источник: 机器之心)

Google разработала федеративное обучение с верифицируемой дифференциальной приватностью на базе TEE : Google Research представила архитектуру федеративного обучения (FL) следующего поколения на основе доверенных сред исполнения (TEE), уже внедренную в англо-японскую предиктивную модель клавиатуры Gboard. Градиентные вычисления перенесены с устройств в облачные аппаратные TEE с удаленной аттестацией; через публичный неизменяемый журнал политик доступа Sigstore внешние аудиторы могут проверять процесс добавления шума центральной дифференциальной приватности без необходимости доверять Google, что решает проблему доверия при масштабном совместном обучении. (Источник: MarkTechPost)
Bilibili открыла семейство мультиязычных моделей перевода Index-Translate : Компания Bilibili выложила в открытый доступ серию моделей Index-Translate, дообученных на базе Qwen3.5, поддерживающих высокоточный перевод между 150 языками с упором на терминологические ограничения и сохранение форматирования. В линейку также вошли Index-Echo (синхронный голосовой перевод с клонированием голоса), Index-Homura (перевод с выравниванием количества слогов) и Index-NativeLong (перевод длинных документов с сохранением межпараграфического контекста). В тестах сообщества качество перевода между японским, китайским и английским языками превзошло ряд коммерческих решений. (Источник: Reddit r/LocalLLaMA)
🧰 Инструменты
pstack-claude: библиотека строгих инженерных навыков для агентов, портированная на несколько Harness : Независимые разработчики на базе практик команды Cursor создали мультиплатформенный порт pstack для Claude Code, Codex и Pi. Плагин включает автоматизированный пайплайн poteto-mode, строго соблюдающий цикл «воспроизведение — двустороннее уточнение — точечное исправление — повторное тестирование» при устранении багов, а также принудительно запускает архитектурный аудит при пересечении границ функций, помогая выстраивать качественный процесс автоматических коммитов. (Источник: GitHub Trending)

e2e: управляемый естественным языком AI-фреймворк для сквозного тестирования приложений : Открытый фреймворк тестирования e2e поддерживает управление тестами Web и мобильных платформ с помощью описаний на естественном языке. Его ключевой механизм заключается в том, что после первого прохождения сценария агентом по промпту последовательность действий в UI автоматически фиксируется в исполняемый скрипт без вызова модели. Последующие регрессионные тесты воспроизводятся точно и без расхода токенов, устраняя лишние затраты при сохранении гибких проверок. (Источник: GitHub Trending)

local-codex-proxy: открытый прокси для подключения локальных моделей к интерфейсам Codex и ChatGPT : Разработчик представил легковесный прокси-сервер Codex, позволяющий напрямую подключать открытые модели (такие как Gemma и Qwen), развернутые локально через vLLM или Ollama, к десктопному клиенту ChatGPT и среде исполнения Codex. Локальная эмуляция эндпоинтов OpenAI и синхронизация состояния избавляют от необходимости открывать код во внешней сети, сохраняя при этом удобство десктопного GUI. (Источник: TheZachMueller)

Texting Bubbles: плагин антропоморфных сообщений-пузырей для Open WebUI : Сообщество выпустило набор расширений Texting Bubbles для Open WebUI, преобразующий традиционный монолитный поток ответов в Markdown в цепочку диалоговых пузырей сообщений, имитирующих общение человека. Входящий в комплект фильтр направляет модель на генерацию лаконичных фраз, что вместе с динамическими паузами набора текста создает эффект естественного погружения при ролевой игре и диалогах. (Источник: Reddit r/OpenWebUI)
NInfer-4080: специализированный инференс-движок с экстремальной пропускной способностью для видеокарт на 16GB : Представлен движок NInfer-4080, оптимизированный под видеокарты уровня RTX 4080 (16GB VRAM). Благодаря комбинации квантования GSQ от ISTA-DASLab и спекулятивного декодирования DFlash2 система достигает скорости префилла до 2720 tok/s и генерации до 262 tok/s на контексте 100K, наглядно демонстрируя преимущество узкоспециализированной аппаратной оптимизации перед универсальными фреймворками. (Источник: Reddit r/LocalLLaMA)
📚 Обучение и исследования
Команда Бо Аня из Наньянского технологического университета раскрыла механизмы взаимодействия моделей и Harness : Группа из NTU опубликовала отчет об исследовании экосистемы агентов, сопоставив 66 комбинаций OpenHands, DSH, PI, openJiuwen и нативных окружений Harness. Эксперименты доказали несостоятельность тезиса «нативная связка всегда оптимальна»: например, GPT-6 Astra на платформе PI показала результаты заметно выше, чем на Codex. Кроме того, детали реализации Harness (сигналы обратной связи по тайм-ауту, разделение операций записи и редактирования файлов, частота попадания контекста в KV-кэш) оказывают решающее влияние на самовосстановление моделей и итоговую стоимость выполнения задач. (Источник: 机器之心)

Ключевой автор AlphaGo разобрал причины отсутствия у LLM подлинных рассуждений уровня System 2 : Бывший ведущий исследователь DeepMind Thore Graepel в статье для MIT Technology Review указал, что текущие цепочки рассуждений LLM представляют собой лишь расширенную ассоциативную генерацию System 1, лишенную аудируемого дерева поиска уровня AlphaGo и явного изменяемого состояния познания. Настоящее машинное мышление требует полного разделения «представления знаний» и «дедуктивного вывода», опираясь на независимую арбитражную архитектуру с оценкой доказательств и проверкой гипотез, а не на простое масштабирование параметров. (Источник: 机器之心)

Лаборатория суперинтеллекта Meta выявила феномен «налога на резкость» в пост-тренировке с RL : Исследователи Meta при анализе 42 пар базовых моделей и моделей с пост-тренировкой RL обнаружили, что обучение с подкреплением заметно повышает показатель pass@1, но ценой снижения разнообразия пространства ответов, приводя к крайней категоричности (строго верно или строго неверно). При достаточном бюджете выборки (Large K) базовая модель без избыточного RL в связке с легким Harness справляется со сложными редкими задачами лучше, чем модели после RL. (Источник: dair_ai)

Стэнфорд запустил открытый курс системного уровня по обучению больших моделей CS336 : Лаборатория NLP Стэнфордского университета опубликовала материалы практического курса системной инженерии языковых моделей CS336. Курс посвящен созданию больших моделей с нуля и включает реализацию токенизаторов, оптимизацию распределенного обучения трансформеров, преодоление ограничений памяти GPU, валидацию законов масштабирования (Scaling Laws), пайплайны очистки данных и обучение с подкреплением для рассуждений. (Источник: stanfordnlp)
Meta предложила мультиагентный пайплайн исправления научных ошибок RankEvolve : Команда Meta представила исследовательский скаффолд RankEvolve для устранения скрытых дефектов вроде утечки данных и незаметного обрыва градиентов при проведении ML-экспериментов агентами. Система конфигурирует Claude Code и Codex как взаимодополняющие узлы проверки, проводящие взаимный аудит и исправление изменений кода через протокол компиляции, что повысило точность полностью автоматических научных экспериментов с 45.8% до 62.5%. (Источник: dair_ai)
💼 Бизнес
ARR единорога 3D-генерации Meshy превысил $100 млн, подтвердив барьеры специализированных модальностей : Согласно бизнес-аналитике, годовая регулярная выручка (ARR) стартапа генеративного 3D Meshy взлетела с $1 млн до $100 млн менее чем за два года. Несмотря на появление базовых возможностей написания геометрических скриптов в универсальных LLM, вертикальная генерация 3D сформировала устойчивый коммерческий контур благодаря вызовам API ведущими игровыми студиями и интеграции с экосистемой 3D-печати в части детализированной топологии и текстурных разверток. (Источник: 量子位)

Маск подтвердил переговоры с TSMC о контрактном производстве чипов на Terafab : Илон Маск открыто подтвердил ведение углубленных переговоров с TSMC по проекту масштабного вертикально интегрированного производства чипов Terafab. Мощности Terafab запланированы на уровне 1 ТВт вычислительной мощности в год для обеспечения потребностей Tesla, SpaceX и xAI. На фоне задержек массового производства по техпроцессу Intel 14A привлечение производственного опыта и отработанного выхода годных кристаллов TSMC призвано снизить риски цепочек поставок и обеспечить полный контроль над кастомными чипами. (Источник: 量子位)

Дата-центр для Anthropic стоимостью 31 млрд австралийских долларов вызвал сопротивление в Квинсленде : Проект дата-центра Western Downs в Австралии стоимостью 31 млрд австралийских долларов, предназначенный для вычислений Anthropic, столкнулся с резким протестом местных жителей. Пиковое энергопотребление объекта оценивается в 2.16 ГВт (около четверти энергопотребления всего штата Квинсленд), а петицию против строительства подписали уже более 20 тысяч человек. В целях балансировки энергоперехода и экономической выгоды правительство штата Квинсленд передало согласование проекта на централизованный уровень, подчеркнув конфликт между масштабированием инфраструктуры вычислений и общественными интересами. (Источник: The Guardian))

🌟 Сообщество
Альтман жестко выступил против обожествления ИИ на фоне углубления идеологического раскола в Кремниевой долине : В ответ на публикации о контактах руководства Anthropic с религиозными лидерами для обсуждения сознания и морального статуса машин CEO OpenAI Сэм Альтман заявил, что наделение AI-моделей религиозным авторитетом или побуждение людей к отказу от собственных суждений несет серьезные риски для безопасности. Лауреат премии Тьюринга Yann LeCun и другие ученые поддержали эту позицию, подчеркнув, что наделение LLM признаками чувствующего сознания не только антинаучно, но и может использоваться корпорациями как юридический щит для ухода от ответственности за нарушения авторских прав и законодательства. (Источник: sama)
Трансформация индустрии на фоне взрывной популярности инженеров передового развертывания (FDE) : На фоне роста популярности позиций инженеров передового развертывания (Forward Deployed Engineer, FDE) специалисты отмечают, что фокус работы сместился с классической сдачи кода «под ключ» на перестройку онтологии бизнеса и организационных связей. Когда AI радикально снижает предельную стоимость написания программ, главными препятствиями для внедрения технологий становятся изолированность данных внутри подразделений, барьеры прав доступа и сопротивление сотрудников; тем самым роль FDE переходит в формат глубокого технического бизнес-консалтинга. (Источник: 量子位)
Передача лидерства в AI-направлении Alibaba поколению 90-х и реальные внедрения стали темами конференции Apsara : Конференция Apsara 2026 обозначила смену поколений и стратегическую переориентацию: руководство направлением больших моделей Tongyi Qianwen перешло к представителям поколения 90-х — Лю Даихэну (претренировка) и Чэнь Юйсэню (коммерциализация Tongyi Office), замкнув цикл разработки и внедрения продуктов. На выставке наблюдался приток руководителей производственных предприятий, искавших решения для автоматизации, где главными метриками стали конкретные финансовые показатели: «за сколько часов внедряется процесс и как быстро окупятся затраты». (Источник: 36氪))
Противостояние терминального CLI и десктопного GUI: обсуждение новых интерфейсов взаимодействия с агентами : В сообществе развернулась дискуссия о форме инструментов для написания кода с использованием AI. Разработчики отмечают, что многовкладочные CLI-терминалы уступают место специализированным агентным интерфейсам, подобным десктопному клиенту Codex или независимым канвасам, снижающим когнитивную нагрузку контекста. Пользователи переходят от прямого манипулирования файлами к высокоуровневому управлению несколькими агентами и асинхронному ревью в постоянных рабочих пространствах. (Источник: Yuchenj_UW)
Разработчики призывают облачных провайдеров и шлюзы моделей внедрить жесткие лимиты бюджета по умолчанию : На фоне инцидентов с внезапными огромными счетами из-за зацикливания автономных мультиагентных систем Simon Willison и инженеры сообщества настоятельно призвали API-шлюзы и облачные платформы сделать жесткую аварийную блокировку при превышении лимита опцией по умолчанию. Мягкие предупреждения по электронной почте оказываются бесполезными при ночных сбоях автономных агентов, в связи с чем детальный контроль затрат и жесткие прерыватели становятся обязательными требованиями промышленной эксплуатации. (Источник: Simon Willison)
💡 Разное
NVIDIA Shield TV подорожала на $100 из-за роста стоимости памяти, спровоцированного ИИ : ТВ-приставка NVIDIA Shield TV Pro, находящаяся на рынке уже 7 лет, неожиданно выросла в цене на $100 — до $299.99. NVIDIA официально подтвердила, что масштабное расширение глобальной инфраструктуры AI привело к резкому удорожанию модулей памяти и электронных компонентов, из-за чего даже зрелые потребительские устройства требуют повышения цен для поддержания линий производства. (Источник: WIRED)

Исследование показало снижение доли женщин среди специалистов и лидеров в условиях бума ИИ : Свежие данные исследовательских агентств показывают, что несмотря на рекордное число вакансий и рост компенсаций в сфере AI, доля женщин среди вновь нанятых сотрудников составляет лишь четверть, а на руководящих должностях — 13%, при этом большинство занято на низкооплачиваемых задачах разметки данных. Культура переработок и найм через устоявшиеся связи вытесняют женщин в категорию позиций с повышенным риском замещения искусственным интеллектом. (Источник: The Guardian)

Налоговые льготы для сельских дата-центров в США вызвали дистанцирование техногигантов и сомнения общественности : Федеральные налоговые льготы на миллиарды долларов для дата-центров в сельских «зонах возможностей» вступают в силу в следующем году. Однако Microsoft, Meta и Amazon поспешили дистанцироваться от этой политики. Критики указывают, что льготы, привязанные исключительно к объему капиталовложений, не создают долгосрочной устойчивой занятости в сельских регионах и усиливают конкуренцию за водные и энергетические ресурсы. (Источник: WIRED)
