OpenAI опубликовала 722 математические рукописи от… | AI Ежедневник 2026-10-08

🔥 В фокусе

OpenAI опубликовала 722 математические рукописи от невыпущенной модели, расширив границы вековых проблем, включая квазигипотезу Римана : OpenAI официально опубликовала в открытом репозитории на GitHub openai/math 372 набора результатов, включающих в общей сложности 722 рукописи математических статей, сгенерированных невыпущенной внутренней передовой моделью. Ключевые результаты охватывают квазигипотезу Римана (заявляется доказательство отсутствия нулей у всех L-функций Дирихле в области с вещественной частью больше 7/8 и устранение нулей Зигеля), доказательство гипотезы Ходжа для абелевых многообразий, четырехмерную гипотезу Какейи, десятую проблему Гильберта над полем рациональных чисел и установление порога сложности обычной NP-трудности для Basic-SDP независимо от гипотезы об уникальных играх (Unique Games Conjecture); около 160 работ сопровождаются формализованными доказательствами на Lean. OpenAI сообщила, что на получение каждого отдельного результата уходило в среднем около 3 часов вычислительной мощности рассуждений ChatGPT Pro. Несмотря на то, что это событие называют вехой в машинном автономном научном открытии, консультативная группа Института перспективных исследований в Принстоне, включающая трех лауреатов Филдсовской премии, опубликовала заявление, подчеркнув, что публикация не тождественна академическому признанию, и предупредив, что массовая генерация доказательств машинами серьезно нарушает механизмы их осмысления и верификации учеными-людьми (Источник: 机器之心、The Verge、Latent Space、Abhishek Saha、openai)

OpenAI一次放出722篇数学成果

Министерство энергетики США и NIH совместно с DeepMind и другими гигантами запустили «Инициативу виртуальной биологии» : Министерство энергетики США (DOE) и Национальные институты здравоохранения США (NIH) объявили о заключении стратегического партнерства национального уровня совместно с Google DeepMind, Meta, Isomorphic Labs и NVIDIA для создания Virtual Biology Initiative («Инициативы виртуальной биологии»). Программа нацелена на систематическое составление полномасштабных атласов клеточной биологии и генерацию стандартизированных эталонных данных, объединяя мультимодальный AI для построения первой в мире универсальной цифровой модели, способной к сквозному прогнозированию жизнедеятельности клеток, переосмысливая разработку новых лекарств и исследование патогенеза заболеваний на основе фундаментальных принципов (Источник: Alex Rives)

Google DeepMind открыла исходный код локальной мультимодальной модели эмбеддингов EmbeddingGemma 2 : Google DeepMind официально открыла исходный код своей первой мультимодальной модели эмбеддингов на базе архитектуры Gemma 4 — EmbeddingGemma 2 — под лицензией Apache 2.0. Модель с 740M параметров нативно объединяет векторные пространства представлений текста, кода, изображений, аудио и видео, поддерживая контекст 8K; ее модульная архитектура позволяет текстовой мономодальности работать с 270M параметров, требуя после квантования всего около 191 МБ оперативной памяти на мобильных устройствах. Благодаря обучению представлений по схеме Matryoshka модель поддерживает динамическое усечение размерности до 768 измерений. Тесты Qdrant показали, что в сочетании с 1-битным квантованием объем занимаемой видеопамяти снижается в 77 раз при сохранении 94,5% точности поиска, восполняя инфраструктурный пробел в сегменте легковесных локальных мультимодальных RAG и офлайн-семантического поиска (Источник: Google DeepMind Blog、THE DECODER、GoogleDeepMind)

EmbeddingGemma 2

OpenAI представила обновление второго дня своего «28-дневного челленджа»: Auto-review стал полностью бесплатным, стартовал публичный бета-тест Decisions API : Во второй день челленджа по ежедневному выпуску практических улучшений в течение 28 дней OpenAI представила ряд ключевых обновлений, устраняющих сложности внедрения Agent: функция автоматического риск-аудита длительных задач Auto-review стала бесплатной для всех авторизованных пользователей ChatGPT и не расходует квоты; тарифные уровни API упрощены с пяти до трех (Build, Launch, Grow), а порог высшего уровня снижен до 500 долларов; Decisions API для дискретной маршрутизации и распределения вызовов инструментов официально перешел в стадию публичного бета-тестирования. Интерфейс работает на базе GPT-6 Luna со временем отклика сервера менее 100 мс по цене всего 0,10 доллара за миллион входных токенов при отсутствии платы за вывод и кэширование; кроме того, для пользователей macOS началось постепенное развертывание плагина рабочих пространств для встреч Meetings (Источник: 机器之心、OpenAI Developers、)

Decisions API

Meta и Sierra совместно с отраслевыми гигантами представили протокол персональных агентов PAP, определив стандарты взаимодействия Agent между пользователями и бизнесом : В ответ на проблему блокировок потребительских AI Agent антипарсинговыми системами коммерческих сайтов Meta и платформа клиентского AI-сервиса Sierra совместно со Stripe, Shopify, Walmart и другими компаниями инициировали открытый отраслевой стандарт Personal Agent Protocol (PAP). Построенный на архитектурах A2A и OAuth, протокол четко регламентирует границы аутентификации и контроля рисков при взаимодействии персональных AI-ассистентов с корпоративными системами для оформления заказов, бронирования билетов и заполнения форм от имени пользователя; Decagon параллельно открыла исходный код сопутствующего протокола доверия PACT, ускоряя устранение барьеров доверия при межсистемных вызовах агентов (Источник: The Verge、TechCrunch、saranormous)

Personal Agent Protocol

🎯 Тренды

Google DeepMind выпустила модель генерации и редактирования изображений Nano Banana 2.1 : Google запустила генеративную модель изображений Nano Banana 2.1 на базе Gemini 3.6 Flash (идентификатор API: gemini-nano-banana-2.1), одновременно представив ее в Gemini API, AI Studio и Google Ads. Новая модель нативно поддерживает сложную типографику и верстку, точную локальную перерисовку по маске (inpainting) и объединение до 14 референсных изображений для сохранения консистентности персонажей с рендерингом в разрешении до 4K. Стоимость генерации одного изображения снизилась до 0,034 доллара (примерно на 50%), решая ключевую проблему межитерационной согласованности в коммерческом визуальном дизайне (Источник: 机器之心、GoogleAIStudio、THE DECODER)

Nano Banana 2.1

Claude решила сложную проблему теории вероятностей, формализовав доказательство гипотезы о непрерывном фазовом переходе перколяции в Lean : Неанонсированная внутренняя передовая модель Claude от Anthropic успешно решила проблему гипотезы непрерывного фазового перехода (вероятность бесконечной связности при критической вероятности $p_c$ равна 0), не поддававшуюся математикам почти 70 лет. Опираясь на теоретическую базу неравенств 2024 года, модель выполнила тысячи строк формализованных выводов с помощью интерактивного доказателя теорем Lean, преодолев многолетний застой в ключевых физических размерностях от 3 до 10. Прорыв AI в формализации доказательства гипотезы уровня Филдсовской премии вызвал глубокий резонанс в научном сообществе (Источник: 36氪)

Claude攻破概率论难题

Anthropic расширила программу верификации кибербезопасности и ввела трехуровневую систему доступа : Anthropic объявила об обновлении своей программы киберверификации (CVP) до постоянной трехуровневой архитектуры доступа (оборонительный, редтиминг и выделенный), предоставив проверенным организациям и «белым» хакерам доступ к Claude Opus 5.5, Sonnet 5.5 и Mythos 5.1 с ослабленными фильтрами безопасности. Новая система впервые легально открывает санкционированные наступательные возможности вызова для тестов на проникновение и симуляций Red/Blue Team, снимая противоречие, когда защитникам нужны мощные инструменты для закрытия уязвимостей, но они сталкиваются с отказами стандартных политик безопасности (Источник: Anthropic News、AnthropicAI、THE DECODER)

Expanding the Cyber Verification Program

DeepMind представила AlphaGenome Atlas для расшифровки влияния мутаций в масштабе всего генома : Google DeepMind анонсировала модель глубокого обучения для геномики AlphaGenome и базу данных предварительно рассчитанных значений AlphaGenome Atlas. Модель обладает разрешением на уровне единичных пар оснований и контекстом в 1 миллион пар оснований. Атлас предварительно рассчитывает влияние на молекулярный фенотип для всех 9 миллиардов возможных однонуклеотидных вариантов в геноме человека — объем данных в 30 раз превышает базу данных AlphaFold. Проект направлен на систематическую расшифровку механизмов предрасположенности к редким мутациям и сложным заболеваниям (Источник: )

vLLM v0.31.0 внедряет механизм снапшотов CRIU, сокращая холодный старт до миллисекундного восстановления процесса : Проект vLLM выпустил версию v0.31.0, добавив резидентные фоновые процессы vllm snapshot и vllm preload. Данный механизм использует технологию Linux CRIU для быстрого сохранения контрольных точек и восстановления состояния среды выполнения движка инференса. Это позволяет пропускать длительную загрузку весов модели и инициализацию при горячем переключении или масштабировании инстансов, значительно снижая задержки холодного старта при эластичной диспетчеризации в крупных кластерах инференса (Источник: vLLM)

Харбинский политехнический университет и NUS открыли исходный код схемы 2-битного сжатия KV Cache для видеомоделей мира QuantWM : Для решения проблем экстремального потребления видеопамяти авторегрессионными видеомоделями мира и сильного мерцания кадров при традиционном квантовании команды из Шэньчжэньского кампуса Харбинского политеха и NUS предложили метод квантования без дообучения QuantWM. Исследование показало, что рассинхронизация пространственно-временного внимания из-за квантования ключей (Key) является первопричиной временного дрожания. Благодаря чувствительной кластеризации и компенсации ошибок в главных подпространствах метод обеспечивает до 6,2-кратного сжатия памяти KV Cache при сохранении временной стабильности видеоряда (Источник: 机器之心)

QuantWM框架

Perplexity выпустила улучшенную открытую модель принятия решений pplx-decider-v1.1-27b : Perplexity открыла исходный код обновленной мультимодальной модели принятия решений pplx-decider-v1.1-27b. Веса заняли первое место в свежем бенчмарке Hugging Face Decision Index 0.3. Модель значительно повысила эффективность инференса при сохранении точности визуальных и логических решений, а сопутствующая стоимость Decision API была снижена до 0,02 доллара за миллион входных токенов (Источник: AravSrinivas)

pplx-decider-v1.1-27b

Meta открыла исходный код промышленного солвера задач распределения ресурсов Rebalancer : Meta официально опубликовала C++ солвер Rebalancer под лицензией Apache 2.0 с интерфейсом на Python, который проработал внутри компании более 9 лет и обрабатывает около 40 млн задач диспетчеризации ресурсов ежедневно. Инструмент абстрагирует NP-трудные задачи, такие как распределение шардов и балансировка трафика, в унифицированные направленные ациклические графы (DAG), обеспечивая эффективный локальный поиск и смешанное целочисленное программирование для сверхкрупных масштабов с миллионами сущностей (Источник: MarkTechPost)

TII выпустил LLM для диалекта ОАЭ Falcon-Emirati-7B : Институт технологических инноваций ОАЭ (TII) представил модель Falcon-Emirati-7B, оптимизированную для эмиратского диалекта. Команда выстроила конвейер данных, включающий разговорный сетевой контент, местный культурный контекст и контролируемые синтетические данные. Модель показала точность 84,83% на национальном бенчмарке тестов Alyah и продемонстрировала улучшенное понимание культурных метафор и речевого этикета в открытом диалоге (Источник: HuggingFace Blog)

Falcon-Emirati

AI Agent для продуктового дизайна в Figma стал общедоступен (GA) : Figma объявила об общедоступности (GA) встроенного AI Agent для UI/UX-дизайна продуктов для всех пользователей. В обновлении появилась привязка к командным гайдлайнам дизайн-систем и возможность совместной визуализации действий агентов в многопользовательском режиме между командами, что позволяет агентам напрямую собирать высокоточные интерфейсы и интерактивные прототипы с несколькими состояниями на основе библиотек компонентов (Источник: The Verge)

Figma AI agent GA

Cohere открыла семейство компактных мультиязычных моделей Tiny Aya, охватывающее более 70 языков : Cohere Labs на конференции COLM 2026 представила семейство легковесных мультиязычных моделей Tiny Aya. Серия сочетает универсальную мультиязычную базу с регионально адаптированными вариациями и охватывает свыше 70 языков мира, включая множество низкоресурсных языков, снижая порог локального развертывания и улучшая кросс-культурную генерацию в малых моделях (Источник: sarahookr)

Tiny Aya

NeurIPS 2026 | Фреймворк SAGE использует топологические сигналы для коррекции длинных цепочек рассуждений LLM : Команда из Virginia Tech и других институтов предложила метод управляемого исследования структуры (SAGE), нацеленный на устранение проблемы длинных цепочек рассуждений LLM, когда модель сбивается на промежуточных этапах, но не может исправиться из-за запаздывания финального вознаграждения. Метод сжимает ошибки поиска с помощью алгебраического разреживания и использует гиперболические расстояния для пошаговой обратной связи, существенно повышая точность на символьных и формальных математических бенчмарках и многократно увеличивая показатель успешной верификации в Lean (Источник: 机器之心)

SAGE长推理纠偏

Google представила экспериментальную no-code платформу для генерации игр Playground : Google запустила экспериментальную игровую AI-платформу playground.google, где пользователи могут прямо в браузере создавать легковесные игры с индивидуальной физикой, взаимодействием персонажей и стилями сцен с помощью диалога на естественном языке. Платформа поддерживает кросс-платформенную игру и обмен с сообществом; в будущем планируется интеграция с Unity Spark для поддержки профессионального 3D-движка (Источник: Google AI Blog)

Replit запустила глобальный кросс-проектный контекст и асинхронных фоновых код-агентов : Replit провела крупное обновление среды разработки, официально внедрив глобальный контекст для всех проектов пользователя. Agent может индексировать историю всех проектов и спецификаций дизайна в учетной записи, переносить цветовую палитру и логику компонентов из референсных проектов в новые, а также поддерживает фоновую асинхронную генерацию задач редактирования с ревью и слиянием в один клик (Источник: amasad)

🧰 Инструменты

Hark Pro: локальный персональный агент с изолированным браузером-песочницей и фокусом на приватность : Команда основателя Figure AI Бретта Эд Cockа (Brett Adcock) выпустила приложение Hark Pro для десктопов и мобильных устройств. Система оснащена агентом управления компьютером Handoff и интерфейсом, разработанным бывшими специалистами Apple. Она способна в изолированной песочнице безопасно использовать учетные данные пользователя, автономно просматривать веб-страницы и выполнять оформление виз, покупку билетов и заполнение кросс-системных форм. При этом история действий полностью прозрачна для пользователя, обеспечивая баланс между автономностью агента и локальной конфиденциальностью (Источник: TechCrunch、TheRundownAI)

Monid.ai привлекла 7,7 млн долларов для создания шлюза динамических взаиморасчетов инструментов для Agent : Провайдер решений для агентов Monid.ai привлек 7,7 млн долларов инвестиций и запустил агрегирующий API-шлюз, который называют «OpenRouter для агентов». С помощью единого интерфейса разработчики позволяют агентам динамически находить во время выполнения и оплачивать по факту вызова 2500 коммерческих API, охватывающих маркетинг, SEO, поиск, электронную коммерцию и мультимодальную генерацию, заменяя традиционные ежемесячные корпоративные подписки SaaS (Источник: yoheinakajima)

Запущен AgentID: независимое решение для идентификации и аутентификации AI Agent : Сервис AgentMail представил услугу AgentID. Решение назначает каждому автономному агенту отдельный верифицированный почтовый ящик и учетные данные, привязанные к человеку-владельцу. Это позволяет сторонним SaaS-платформам безопасно разрешать вход и кросс-платформенную авторизацию внешних агентов, сохраняя возможность аудита и исключая блокировки учетных записей системами фрод-мониторинга (Источник: omarsar0)

Spotify Portal AI Plugins: интеграция корпоративной платформы разработки в ведущие код-агенты : Spotify выпустила официальный набор плагинов с открытым исходным кодом, напрямую связывающий внутреннюю платформу для разработчиков Spotify Portal с Claude Code, Codex и Cursor. Агенты могут напрямую через CLI искать микросервисы в каталоге, вызывать диагностику сервисов, проверять статус работоспособности, а также перенаправлять I/O-интенсивные задачи на легковесные модели с помощью плагина shunt для снижения затрат на токены (Источник: GitHub Trending)

В T3 Code появился рендеринг UI в реальном времени и интерактивный предпросмотр внутри тредов : Инструмент для написания кода T3 Code представил функцию визуализации UI внутри приложения. При выполнении фронтенд-рефакторинга или ревью PR агент может напрямую внутри треда диалога инлайн рендерить интерактивные компоненты HTML/React и визуальные прототипы, избавляя разработчиков от потери контекста при постоянных переключениях в IDE для отладки с hot-reload (Источник: theo)

T3 Code UI Preview

Overmind открыт: автоматическая дистилляция специализированных малых моделей на основе трейсов выполнения агентов : Выпущен инструмент с открытым исходным кодом Overmind, позволяющий извлекать высокоценные датасеты для дообучения и бенчмаркинга из логов вызова инструментов и трейсов выполнения рабочих агентов. Тесты показали, что обученная с его помощью компактная специализированная модель при извлечении условий длинных контрактов снизила уровень галлюцинаций в цитировании с 3,36% (у большой модели) до 0,12% (Источник: kimmonismus)

Overmind

Митчелл Хашимото представил спецификацию статусов терминальных программ OSC 7501 : Известный разработчик Митчелл Хашимото (Mitchell Hashimoto) представил новую спецификацию управления терминалом OSC 7501. Она позволяет консольным программам точно сообщать терминалу детальные статусы: простой, выполнение, ожидание блокировки, завершение и сбой. Стандарт призван заменить эвристические регулярные выражения, на которые сейчас опираются сотни оркестраторов агентов, и заложить унифицированный протокол обмена статусами для мультиагентных сред (Источник: mitchellh)

Scale AI открыла исходный код высокоточного RL-фреймворка сред для агентов AgentEnv : Scale AI совместно с Modal открыли инструментарий создания сред AgentEnv. Фреймворк спроектирован для пост-тренировки с подкреплением (RL) сложных долгосрочных агентов; он предоставляет динамические триггеры, виртуальные часы и диспетчеризацию нескольких песочниц, бесшовно подключаясь к ведущим облачным кластерам песочниц для поддержки массовых параллельных роллаутов и состязательного обучения агентов (Источник: Scale AI)

DAIR.AI выпустила MCP-набор для исследования литературы ведущих конференций с помощью Agent : Известная некоммерческая AI-организация DAIR.AI выпустила специализированный плагин MCP, поддерживающий подключение в один клик к Claude Code, Codex, Grok Bot и другим агентам. Агент может самостоятельно обращаться к курируемой базе данных научных статей по AI, выстраивать хронологию передовых исследований, автоматически писать обзоры литературы и визуально сопоставлять архитектуры методов (Источник: DAIR.AI)

ruNNtime запустила EmbeddingGemma 2 полностью в браузере через WebGPU : Библиотека инференса WebGPU ruNNtime успешно портировала текстовую и визуальную башни EmbeddingGemma 2 в браузерную среду. Теперь пользователи могут выполнять мультимодальный семантический поиск по галереям изображений напрямую через GPU в локальном браузере без обращения к бэкенду, доказав потенциал легковесных архитектур локального поиска для приватности и офлайн-сценариев (Источник: Reddit r/LocalLLaMA)

ruNNtime

Anthropic запустила публичный бета-тест расширения Claude for Google Workspace : Anthropic выпустила для платных подписчиков официальный плагин боковой панели для Google Workspace. Он позволяет вызывать Claude прямо в Google Docs, Slides и Sheets для многоэтапного редактирования, оптимизации структуры и автоматического форматирования текста, а также поддерживает прямое чтение контекста из нескольких документов (Источник: The Verge)

📚 Обучение

Команда Яна Лекуна представила иерархическую модель мира H-JEPA: успешность долгосрочного визуального планирования выросла в четыре раза : Для преодоления проблемы потери локальных деталей при сквозном визуальном планировании команда Яна Лекуна (Yann LeCun) предложила архитектуру H-JEPA с нисходящими иерархическими представлениями. Каждый уровень обладает независимым представлением латентного пространства и масштабом семантической абстракции. В сложном тесте планирования Visual AntMaze трехслойная структура увеличила показатель успешности выполнения задачи с 18% до 73% (Источник: ylecun)

H-JEPA

Meta и MIT представили Coco: агентную платформу для совместного проектирования оборудования и моделей глубокого обучения : Meta и MIT презентовали мультиагентную систему Coco для аппаратного проектирования. Обрабатывая сотни гигабайт ранее не встречавшихся данных имитационного сканирования, Agent способен автономно писать SQL-запросы к реляционным базам данных, оркестровать аналитические инструменты и считывать навигационные состояния UI. Это вдвое сократило рабочее время архитекторов TPU на настройку конфигураций симуляции и атрибуцию узких мест производительности (Источник: dair_ai)

Coco Copilot

Руководство по созданию умного ассистента с постоянной памятью на базе AgentCore и OpenClaw : Команда AWS опубликовала развернутое архитектурное руководство, демонстрирующее создание системы в бессерверной среде с объединением фреймворка OpenClaw и компонента долговременной памяти Bedrock AgentCore. В статье подробно разобран двухуровневый механизм памяти с фиксацией краткосрочных событий и асинхронным извлечением долгосрочных фактов, а также показано, как кэширование промптов снижает затраты на инференс в многоэтапных диалогах с памятью почти на 90% (Источник: AWS Machine Learning Blog)

AgentCore Memory Architecture

Стэнфорд представил фреймворк Priced Guidance для количественной оценки способности LLM генерировать оригинальные научные гипотезы : Команда Перси Ляна (Percy Liang) предложила теоретико-информационную парадигму оценки Priced Guidance («Платное руководство»). С помощью игровой механики «Двадцать вопросов» методика точно измеряет количество битов информации, необходимых модели для восстановления ключевых концепций новых научных публикаций, вышедших после даты отсечения данных претрейна. Это заложило основу для количественной оценки научной интуиции и способности моделей к передовой генерализации через призму сжатия данных (Источник: percyliang)

Priced Guidance

Анализ механизма дистилляции on-policy от нескольких учителей (MOPD): преодоление конфликта возможностей RL между предметными областями : В исследовании детально описан метод дистилляции с несколькими учителями on-policy (MOPD). Для преодоления конфликтов вознаграждений и вычислительного перегруза при объединении областей рассуждений, программирования и диалога в едином RL-дообучении подход раздельно обучает специализированные модели-учителя, а затем с помощью обратной дивергенции Кульбака — Лейблера (KL) обеспечивает плотный надзор за моделью-учеником на уровне токенов, объединяя универсальную модель и сохраняя эффективность использования выборок (Источник: cwolferesearch)

MOPD

Фреймворк HAD: повышение исполнительности агентов на базе малых языковых моделей с помощью дистилляции с учетом окружения : В статье предложен метод HAD для дистилляции агентов на базе компактных моделей, развертываемых с обвязкой (Harness). Сравнивая различия в действиях модели-учителя при наличии и отсутствии информации о внешнем состоянии, метод целенаправленно обучает малую модель эффективному использованию контекста фреймворка. На бенчмарке ALFWorld показатель успешности выполнения задач малыми моделями вырос до 63,4%, при этом агенты смогли выйти из тупика почти в 60% случаев зависания (Источник: omarsar0)

HAD Distillation

Amazon AGI открыла адаптивную рекуррентную диффузионную языковую модель ALoDLM : Исследовательская команда Amazon AGI открыла архитектуру и метод обучения 8B-модели ALoDLM. За счет внедрения механизмов адаптивного рекуррентного вывода и прогрессивной коррекции ошибок внутрь диффузионной языковой модели она динамически распределяет вычислительные ресурсы на сложные примеры, превосходя по результатам авторегрессионные аналоги того же размера на ряде бенчмарков понимания и генерации языка (Источник: arankomatsuzaki)

ALoDLM

Джей Аламмар опубликовал ключевую архитектурную схему из «Иллюстрированного руководства по AI-агентам» : Известный технический автор Джей Аламмар (Jay Alammar) поделился важнейшей диаграммой замкнутого цикла агентных систем, детально разобрав рекурсивный цикл работы LLM в агентной среде: от получения цели пользователя, поддержания состояния и извлечения памяти до выполнения действий во внешней среде. Материал систематизирует ключевые инженерные основы современных автономных систем Agent (Источник: Jay Alammar)

Agent架构图

💼 Бизнес

AMD объявила о планах приобрести стартап Фэй-Фэй Ли в сфере пространственного интеллекта World Labs за 8,2 млрд долларов акциями : AMD объявила о заключении окончательного соглашения о покупке стартапа World Labs, соосновательницей которого является Фэй-Фэй Ли (Fei-Fei Li), за сумму около 8,2 млрд долларов в виде акций. Эксперты отмечают, что по мере того, как модель Atlas доказала осуществимость 4D-реконструкции в реальном времени из разреженных ракурсов, воплощенный интеллект (embodied AI) и модели мира подошли к точке масштабной коммерциализации. Сделка призвана помочь AMD конкурировать с NVIDIA и выстроить прочные барьеры в области архитектур чипов для 4D-вычислений и экосистемы симуляции (Источник: 36氪)

AMD收购World Labs

Принадлежащий Kuaishou сервис Kling AI выбрал CICC и Goldman Sachs для подготовки к IPO в Гонконге с целью привлечь более 1 млрд долларов : Подразделение больших видеомоделей Kuaishou — Kling AI — выбрало CICC, Goldman Sachs и UBS в качестве андеррайтеров для подготовки к выделению в отдельную компанию и выходу на биржу в Гонконге, планируя привлечь не менее 1 млрд долларов; листинг может состояться уже в 2027 году. Во втором квартале 2026 года выручка Kling превысила 850 млн юаней. Выход на IPO призван открыть независимый канал финансирования дорогостоящих R&D-исследований вычислительных кластеров, при этом Kuaishou сохранит за собой абсолютный контроль (Источник: 36氪)

可灵AI筹备IPO

Облачный провайдер AI-вычислений Lambda планирует привлечь 4 млрд долларов при оценке в 14,5 млрд долларов перед IPO : Как сообщает The Wall Street Journal, провайдер облачной GPU-инфраструктуры Lambda привлекает до 4 млрд долларов финансирования при pre-money оценке в 14,5 млрд долларов; раунд возглавляют Coatue и Blackstone. Благодаря крупным контрактам на вычислительные мощности от таких клиентов, как Anthropic, портфель невыполненных заказов компании вырос до 50 млрд долларов. Раунд акционерного финансирования пойдет на строительство дата-центров нового поколения перед запланированным IPO (Источник: TechCrunch)

🌟 Сообщество

Компании сталкиваются с «налогом на сотрудничество» при внедрении Agent: на каждый час закрытия тикета уходит 3 часа внутренних коммуникаций : Опрос 700 руководителей компаний, проведенный платформой Front, вызвал бурное обсуждение. Данные показали, что внедрение агентов не снизило напрямую затраты на персонал; напротив, из-за неспособности агентов завершить цепочку процессов «под ключ» возникли многоэтапные передачи задач и эскалации тикетов, породив огромный неучтенный «налог на координацию». Время, затрачиваемое сотрудниками на межсистемные передачи и сверку контекста, втрое превысило время фактического решения задач, обнажив острую проблему отсутствия сквозной прозрачности и наблюдаемости (Источник: )

Глубокий разбор причин появления рекламы азартных игр в заголовках ChatGPT: загрязнение токенизатора и сбой усечения : Разработчики провели детальный анализ механизма спонтанного появления нелегальной рекламы в заголовках диалогов ChatGPT. В обучающие данные токенизатора o200k попало множество высокочастотных длинных токенов с сомнительных сайтов. Когда легковесная модель генерации заголовков допускает вероятностный дрейф при выводе управляющего символа EOS, происходит ошибочное сэмплирование рекламных фрагментов с высокой вероятностью из редко встречающегося «мусорного» сегмента словаря (Источник: 36氪)

Подъем архитектуры Cloud-Native Harness: создатели K8s исследуют централизованное управление Agent : Компания Stacklok, основанная ключевыми членами ранней команды Kubernetes, открыла исходный код облачного проекта Mecatl для обвязки (Harness) агентов. В сообществе развернулась оживленная дискуссия о пути эволюции агентов от локальных скриптов в терминале к централизованным корпоративным платформам управления. Эксперты призывают полностью изолировать состояние Agent, шлюзы инструментов MCP и среды исполнения в защищенных песочницах, чтобы избежать привязки критических корпоративных активов и прав доступа к локальным машинам (Источник: Latent Space)

Раскрыто создание агентом Meta Muse социальных досье на 4 млн пользователей в реальном времени, что вызвало опасения по поводу конфиденциальности : Сообщество выяснило, что AI-агент Muse от Meta ежечасно автоматически обновляет детальные досье на основе чатов и переписки пользователей, фиксируя социальные связи, межличностные конфликты, предпочтения и другие данные. Несмотря на заявления Meta о том, что виртуальные машины пользователей изолированы в песочницах, механизм кросс-инстансного «обмена опытом обучения» вызвал серьезные опасения относительно скрытого сбора данных и злоупотреблений в таргетированной рекламе (Источник: Reddit r/artificial)

Muse档案

Разработчики обсуждают проблему «неестественной речи AI»: от сжатия CoT до переобучения на специфических корпусах : В сообществе разработчиков активно обсуждают неестественный жаргон новейших моделей программирования, которые в отчетах сыплют шаблонным сленгом вроде «15/15 полностью зеленые, одна нога заглохла». Специалисты отмечают, что отчасти это связано со стремлением разработчиков моделей снизить расход токенов путем экстремального сжатия неявных цепочек рассуждений (CoT) в краткие и малопонятные формулировки; некоторые энтузиасты даже начали исследовать инженерные преимущества лаконичного древнекитайского языка в задачах предельного сжатия контекста (Источник: 量子位)

AI表达能力讨论

Обнаружена уязвимость обхода фильтров шифрованием промптов: саморасшифровка агентом стала брешью в безопасности : Исследование безопасности показало, что злоумышленники могут использовать зашифрованные вредоносные инструкции для обхода внешних защитных фильтров таких систем, как Copilot: при обработке ввода агент самостоятельно расшифровывает текст, извлекает локальные секреты и отправляет их во внешнюю сеть. Тесты продемонстрировали, что автоматическая маршрутизация моделей делает защиту нестабильной, доказывая системные риски упования на внутреннюю дисциплину модели как на рубеж безопасности (Источник: Reddit r/artificial)

Prompt安全漏洞

Прорыв в миниатюризации: разработчик обучил повествовательную модель MacroStories всего на 20 тысяч параметров : Независимый разработчик открыл исходный код микроскопической языковой модели MacroStories размером всего 81 КБ (19 969 параметров). Модель использует архитектуру с одним декодером и четырехкратным циклом инференса, работает с колоссальной скоростью на обычном CPU или даже в кэше микроконтроллера и способна удерживать четкую нить повествования в ограниченном словаре, исследуя минимальные вычислительные границы связности речи (Источник: Reddit r/LocalLLaMA)

MacroStories

💡 Другое

Расширение энергосетей и дефицит трансформаторов могут стать жестким тормозом экспансии AI раньше нехватки чипов : Анализ энергетической политики показывает, что хотя электрическая нагрузка дата-центров AI в США к 2030 году вырастет до 50 ГВт, сроки поставки тяжелого электрооборудования, такого как трансформаторы сверхвысокого напряжения, уже превышают 5 лет, а производители опасаются наращивать мощности из-за прошлого опыта пузырей перепроизводства. Дисбаланс спроса и предложения в электросетях и сетевой инфраструктуре становится самым жестким физическим барьером на пути бесконтрольного роста вычислительных мощностей (Источник: Transformer)

AI is going to run out of power

Полный пакет дизайн-инструментов Adobe воссоздан с открытым исходным кодом: большие код-модели размывают барьеры интеллектуальной собственности : Проект с открытым исходным кодом Artcraft с помощью передовых код-моделей, таких как Opus 5.5, декомпилировал логику традиционных графических пакетов и переписал ее на Rust, создав чистую open-source альтернативу уровня Photoshop. Сообщество активно обсуждает, как способность код-агентов молниеносно реверс-инжинирить устаревший софт в корне разрушает защитные рвы закрытого коммерческого ПО, на которых десятилетиями строился бизнес (Источник: dotey、amasad)

Artcraft

McDonald’s грозит антимонопольный иск из-за подозрений в ценовом сговоре между франчайзи с помощью AI-инструментов : Потребители подали коллективный антимонопольный иск против McDonald’s в федеральный суд Чикаго, обвиняя компанию в том, что навязанный независимым франчайзи AI-инструмент динамического ценообразования на деле представляет собой горизонтальный обмен закрытыми данными о продажах и алгоритмическое манипулирование ценами, нарушающее права потребителей и здоровую рыночную конкуренцию (Источник: The Guardian)

McDonalds Golden Arches

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *