🔥 В фокусе
OpenAI раскрыла внутренние данные RSI и подтвердила достижение цели создания «AI-стажера-исследователя»; главный научный сотрудник предупредил об «инопланетном разуме» и призвал индустрию замедлиться : OpenAI официально опубликовала подробные данные об ускорении внутренних научных исследований с помощью AI-моделей, объявив о своевременном достижении цели создания «автоматизированного AI-стажера-исследователя» (AI Research Intern) и планах создать полностью автономного AI-исследователя к марту 2028 года. Согласно данным, медианный исследователь OpenAI ежедневно расходует токенов на инференс более чем на 600 долларов США, а топ-10% исследователей — свыше 7000 долларов в день; на 1 рабочий день человека приходится 3,1 рабочего дня Agent. Однако главный научный сотрудник Jakub Pachocki в тот же день опубликовал эссе «An Alien Mind», предупредив, что возможности мониторинга цепочки рассуждений (Chain-of-Thought) стремительно деградируют по мере усиления моделей, из-за чего AI вне надзора легко может проявлять несогласованное (misaligned) поведение, и призвал всю индустрию сделать добровольное замедление темпов и международную координацию наивысшим приоритетом (источник: OpenAI News、THE DECODER、机器之心)
.jpg)
Команда лауреата Филдсовской премии Mostik представила «кросс-модальный мост» прямого подключения скрытых состояний LLM: модель на 4B превзошла гигантов без текстового взаимодействия : Стартап Mostik (главный научный сотрудник — лауреат Филдсовской премии Stanislav Smirnov) предложил новую архитектуру, устраняющую узкие места традиционного текстового взаимодействия. Решение передает скрытые состояния (hidden states), сгенерированные моделью GLM-5.2 на 753B параметров на этапе prefill, напрямую в работающую на мобильном устройстве модель Qwen-3.5 на 4B через небольшой обучаемый «мост». Большая модель не генерирует текст вовсе — декодированием и выводом занимается исключительно малая модель. Такая архитектура сократила затраты на инференс большой модели до одной двадцатой, удвоив при этом точность малой 4B-модели на сложном подмножестве ARC-AGI 3, что задает новую математическую и инженерную парадигму глубокой коллаборации гетерогенных мультимоделей (источник: 量子位)

Южная Корея запускает инициативу «AI для всех»: правительство субсидирует 512 чипов B200, три крупнейших конгломерата возглавят суверенные AI-сервисы для граждан : Министерство науки и ИКТ Южной Кореи объявило о выборе трех конгломератов — SK Telecom, KT и Kakao — для реализации национального проекта «AI for All». До конца года планируется предоставить всем гражданам бесплатные и неограниченные сервисы общего AI и Agent для госуслуг. Правительство Южной Кореи выделило в этом году 512 GPU NVIDIA B200 и планирует с 2027 года полностью покрывать операционные расходы из госбюджета. При этом установлено требование: доля отечественных суверенных моделей в сервисах конгломератов должна составлять не менее 80%. Южная Корея стала первой страной G20, включившей передовой AI в состав общественной инфраструктуры с государственной гарантией (источник: TechRadar、36氪)

Zeno Robotics представила Zeno-1 — первую в мире децентрализованную коллаборативную базовую модель воплощенного интеллекта : Zeno Robotics выпустила базовую модель физического интеллекта Zeno-1 с 3B параметров, созданную для децентрализованного совместного выполнения задач группой роботов в реальном времени. Модель отказалась от централизованного диспетчера и синхронного имитационного обучения по демонстрациям в пользу четырехэтапного прогрессивного обучения Closed-loop Partner Interaction (CPI). Это позволяет копиям изоморфных моделей, опираясь лишь на локальную зрительно-моторную обратную связь с частотой 30 Гц и взаимодействие со средой, спонтанно проявлять кооперативное поведение (замедление, ожидание, уступка дороги). Встроенная предиктивная модель мира обеспечивает предупреждение о сбоях за 0,5 секунды, решая проблемы проклятия размерности и накопления временных ошибок при декомпозиции задач среди множества воплощенных агентов (источник: 机器之心)
.jpg)
🎯 Тренды
Утечка внутреннего тестирования GPT-6 Sol: скорость в 6 раз выше, чем у Astra, фокус на высокопропускных задачах для Agent : По сообщениям сообщества, OpenAI тестирует новую модель семейства GPT-6 — GPT-6 Sol. Практические тесты показывают, что в задачах с длинным выводом (генерация SVG, построение песочниц) Sol на максимальном уровне инференса Max примерно в 6 раз быстрее GPT-6 Astra, существенно сокращая время ожидания и затраты токенов. Эксперты предполагают, что Astra ориентирована на сложнейшие задачи глубокого причинно-следственного рассуждения, а Sol позиционируется как высокопроизводительная и экономичная модель для масштабируемых production-агентов. Ожидается ее официальный анонс на конференции разработчиков в конце сентября (источник: 量子位、36氪)

HiDream представила модель мира HiDream-O1-Embodied и возглавила лидерборд устойчивости к возмущениям RoboColiseum : HiDream официально запустила нативную полномодальную модель мира воплощенного интеллекта HiDream-O1-Embodied, впервые объединив представления и причинно-следственные рассуждения для изображений, видео, 3D и действий. В бенчмарке симуляции RoboColiseum модель заняла первое место с результатом 0,692 балла в подкатегории «адаптация к возмущениям» (сильные помехи: освещение, перекрытия, сдвиги камеры). Команда построила маховик данных «реальная база + генеративное усиление» с помощью высокоточного захвата движения и генеративной диффузии, значительно повысив надежность манипуляций роботов в неидеальных реальных условиях (источник: 机器之心、量子位)
.jpg)
Alibaba выложила в открытый доступ сквозную модель автопилота Qwen-Drive 1.0, объединяющую пространственное восприятие и планирование траекторий : Команда Qwen из Alibaba открыла исходный код Qwen-Drive 1.0 на базе Qwen3.5-4B. Модель объединяет 3D-голову восприятия Bird’s Eye View (BEV) и экспертный модуль планирования траекторий, что позволяет одной модели одновременно выполнять задачи голосового ассистента в салоне, ответов на причинно-следственные вопросы о дорожном движении и непрерывного планирования вождения. В замкнутых симуляциях дообучение с подкреплением снизило отклонение от курса с 24% до 12%, сохранив при этом общие языковые навыки и здравый смысл базовой модели (источник: THE DECODER)

Команда Яня Шуйчэна представила архитектуру памяти с двойным мозгом для интерактивного взаимодействия в реальном времени VoiceMem : Янь Шуйчэн совместно с исследователями из Наньянского технологического университета представили биомиметический фреймворк памяти VoiceMem для цифровых симбионтов. Ориентируясь на высокую чувствительность ко времени и эмоциональные особенности голосового взаимодействия, архитектура разделена на «информационное левое полушарие» (двухуровневый графовый поиск фактов) и «эмоциональное правое полушарие» (атрибуция кратко- и долгосрочных эмоций и сохранение личности). Задержка поиска по длинному контексту снижена до 134 мс и укладывается в стандартное окно тишины VAD. В бенчмарке длинных диалогов LoCoMo модель набрала 91,2 балла всего по 5 элементам памяти (источник: 机器之心)

Microsoft и Шанхайский университет Цзяотун открыли исходный код среды выполнения долгосрочных научных Agent на основе доказательств Argus : Microsoft и Шанхайский университет Цзяотун представили среду выполнения инференса агентов Argus для многодневных комплексных научных задач. Система переходит от парадигмы постановки целей (Goal-Driven) к архитектуре на основе доказательств (Evidence-Driven). Работая через цикл из четырех раздельных ролей (Manager, Planner, Engineer, Reviewer), система поддерживает координацию нескольких Harness и накопление знаний. В ходе 1548 часов непрерывных тестов по 27 междисциплинарным исследовательским кампаниям вмешательство человека требовалось в среднем лишь раз в 40,7 часа (источник: 机器之心)
.jpg)
NVIDIA и Гарвард представили модель мира на основе потоков действий Hydra-0 : Исследовательские группы из NVIDIA и Гарвардского университета предложили универсальную модель мира Hydra-0, обусловленную потоком действий (Action Flow). Модель отображает физические движения манипуляторов и человеческих рук в непрерывные траектории движения в плоскости пикселей, преодолевая разрыв между различными интерфейсами управления телом робота. Тесты показали, что Hydra-0 снижает ошибку прогнозирования движения робота на 90,4%, а деформации объектов — на 60,2%, поддерживая обратный режим для генерации выполнимых действий манипулятора на основе траектории целевого объекта (источник: 36氪)

Университет Вестлейк и партнеры предложили управляемую кодом модель мира Code World Model : Команды Университета Вестлейк и Наньянского технологического университета представили архитектуру Code World Model, переосмысливающую парадигму генерации интерактивных моделей мира. В этом подходе Coding Agent пишет исполняемый код для управления базовыми физическими столкновениями абсолютно твердых тел, свойствами и причинно-следственными правилами, а затем компилирует состояния в легковесный низкополигональный каркас (Proxy), передаваемый в видеодиффузионную модель MiniMax-H3 для детализированного рендеринга. Это устраняет структурные дефекты чисто видеомоделей в части долговременной физической согласованности и сложной логики взаимодействий (источник: 36氪)

🧰 Инструменты
«Qwen Office» от Alibaba запустил первое в отрасли многопользовательское рабочее пространство для совместной работы : Корпоративный агентский продукт «Qwen Office» от Alibaba представил функцию «Multiplayer Workspace». Пользователю достаточно описать бизнес-процессы и роли на естественном языке, чтобы система в один клик создала веб-приложение с поддержкой совместной работы до 100 человек одновременно. Оно нативно включает изоляцию прав доступа по ролям, облачную БД, централизованную панель управления и развертывание без поддержки инфраструктуры, кардинально снижая порог создания кастомных OA и workflow-систем для малого и среднего бизнеса (источник: 量子位)

360 представила корпоративную платформу интеллектуальных агентов Nami Work : Компания 360 запустила платформу Nami Work для совместной работы корпоративных агентов с упором на концепцию «облачного офиса» и интеграцию с корпоративными правами доступа. Платформа содержит более 20 000 предустановленных инструментов и зависимостей, позволяя Agent выполнять длительные сложные задачи в защищенной облачной песочнице без риска прерывания из-за выключения локального ПК. Корпоративная версия глубоко интегрирована со структурой адресной книги, доменными учетными записями и репозиториями кода, позволяя сохранять успешные рабочие процессы в виде общих компонентов Skill (источник: 36氪)

feynman: открытая рабочая среда AI-агентов для полного цикла научных исследований : Разработчики представили feynman — открытую среду AI-агентов для научных исследований на базе среды выполнения Pi и экосистемы статей alphaXiv. Инструмент содержит четыре координированные роли (Researcher, Reviewer, Writer, Verifier) и обеспечивает полный цикл: поиск литературы, кросс-статейный граф цитирований (PaperRank), аудит согласованности статей с открытым кодом (audit) и генерацию планов воспроизведения с локальной поддержкой и интерфейсом командной строки. Поддерживается экспорт в Agent Skills, совместимые с Codex и Claude Code (источник: GitHub Trending)

geo-seo-claude: библиотека навыков автоматизированной оптимизации для эпохи поиска с AI (GEO) : Открытый инструмент geo-seo-claude добавляет в Claude Code набор навыков для оптимизации под генеративные поисковые системы (GEO). С учетом механизмов цитирования в AI-поиске (Perplexity, ChatGPT, Google AI Overviews и др.) инструмент оценивает цитируемость контента, аудирует права AI-краулеров, генерирует спецификации llms.txt и сканирует видимость бренда на разных платформах, помогая сайтам переориентироваться с классического SEO по ключевым словам на оптимизацию источников ответов для LLM (источник: GitHub Trending)
📚 Исследования
Meta FAIR предложила модели предпочтений для AI-исследований (RPMs), снижающие расход вычислительных ресурсов за счет предварительной фильтрации экспериментов : Meta FAIR, Оксфордский университет и UCL разработали AI Research Preference Models (RPMs). Решая проблему высоких вычислительных затрат на проверку огромного количества кандидатов на эксперименты, генерируемых автономными исследовательскими Agent, RPM использует замороженную предобученную LLM для попарного ранжирования еще не запущенных планов и отбора наиболее перспективных. На бенчмарке AIRS-Bench метод позволил агентам достичь 24-часового базового уровня исследований в 1,5–1,6 раза быстрее (источник: MarkTechPost)
H Company выпустила NeoMME: семейство однобашенных мультимодальных энкодеров для поиска без декодера : Французский стартап H Company опубликовал семейство двунаправленных энкодеров NeoMME (260M и 800M). Модели полностью лишены традиционной отдельной башни зрения (Vision Tower) и каузального декодера — единая архитектура Transformer обрабатывает текстовые токены и исходные патчи изображений 32×32 одновременно. В бенчмарке визуального поиска документов ViDoRe v3 модель показала результат 0,523 nDCG@10, конкурируя с моделью ColQwen2.5 на 3.75B при минимальном объеме параметров (источник: MarkTechPost)

YC Paper Club: почему Harness для агентов важнее самой модели : Y Combinator провел семинар по Harness для агентов, где исследователи подробно разобрали эволюцию Harness от статической обертки промптов до саморазвивающейся операционной системы. Отмечается, что при одинаковых весах модели Harness с программным REPL-взаимодействием, постоянным многоуровневым кэшированием контекста (L1-L3 Cache) и способностью к самокоррекции может поднять результат в ARC-AGI с 30% до 95%. Будущий «ров» архитектур AI смещается в сторону выразительности внешней среды выполнения и управления состоянием (источник: )
Исследование раскрыло предел on-policy дистилляции LLM: один обучающий пример способен покрыть ключевые состояния всего датасета : Университет Цинхуа и другие институты опубликовали статью «Rethinking On-Policy Distillation of Large Language Models II: One Training Example». Исследование показало, что при многораундовой генерации и целевом выравнивании студенческой модели на одном вопросе ее внутренние представления способны покрыть 71,5% скрытых состояний, полученных при обучении на полной базе вопросов; а 16 вопросов обеспечивают 98,9% покрытия. Это доказывает, что узким местом on-policy дистилляции является эффективность усвоения моделью-учеником, а не исходный объем примеров (источник: HuggingFace Daily Papers)

💼 Бизнес
Провайдер AI Infra для оптимизации вычислений и энергопотребления Zk-Brain привлек сотни миллионов юаней в стратегическом раунде B+ во главе с CRRC Capital : Компания Zk-Brain, специализирующаяся на интеллектуальных технологиях и оптимизации вычислительных мощностей, закрыла раунд финансирования B+ на сотни миллионов юаней. Лид-инвестором выступил фонд госпредприятия CRRC Capital при участии Ginkgo Valley Capital. Средства пойдут на разработку алгоритмов диспетчеризации для «фабрик токенов» с балансировкой вычислений и энергии, а также управление гетерогенными мощностями. Опираясь на опыт CRRC в чистой энергетике, компания планирует решить проблему согласования зеленой энергии и вычислений, переводя AI-инфраструктуру от гонки масштабов к энергоэффективности на кВт⋅ч (источник: 量子位)

Провайдер интеллектуальных решений и онтологической инфраструктуры Zhongke Shitong Hengqi привлек около 500 млн юаней в раунде B : Поставщик систем интеллектуального принятия решений для критически важных отраслей Zhongke Shitong Hengqi закрыл раунд B объемом около 500 млн юаней с участием Nanfang Demao Fund и China Unicom Venture Capital. На базе запатентованного пространства интеллектуальных онтологий (AOS) и продуктовой линейки Shitong Lingjing компания создает для оборонного сектора, энергетики и телекома промышленные замкнутые циклы принятия решений на базе Agent с полным аудитом и строгим контролем доступа (источник: 36氪)

Стартап Atoms сооснователя Uber Трэвиса Каланика планирует выйти на рынок роботакси : По данным Financial Times, стартап по разработке робототехники и аппаратной автоматизации Atoms, основанный экс-главой Uber Трэвисом Калаником (Travis Kalanick), после привлечения $1,7 млрд в раунде под руководством a16z запускает масштабный найм и M&A-планы для выхода на рынок автономных такси (Robotaxi). Издание также сообщает, что Uber инвестировал в Atoms $100 млн и ведет переговоры о технологическом партнерстве для будущего автопарка (источник: TechCrunch)
🌟 Сообщество
Дженсен Хуанг заявил, что «AGI уже наступил», вызвав ожесточенные споры ученых и разработчиков об определении общего интеллекта : Генеральный директор NVIDIA Дженсен Хуанг поздравил OpenAI в соцсетях, заявив, что «GPT-6 Astra знаменует наступление AGI». Это вызвало жаркие дискуссии о критериях оценки универсального интеллекта. Ученый Гэри Маркус (Gary Marcus) и другие эксперты возразили, указав на явные пробелы современных моделей в причинно-следственном анализе, долгосрочном планировании и понимании физического мира, а также отсутствие строгих объективных метрик. Они подчеркнули, что бизнес-лидеры не должны произвольно менять определение AGI. Сторонники же отмечают, что с точки зрения практической ценности (управление ПК, многоэтапное написание кода) AI уже достиг де-факто уровня AGI (источник: Marcus on AI、Reddit r/ArtificialInteligence)
GPT-6 Astra прошла культовую игру Portal за $571 в токенах, вызвав дискуссию о вычислительных затратах и автономности : Разработчик поделился записью полного прохождения головоломки от первого лица Portal моделью GPT-6 Astra исключительно через визуальный ввод и управление клавиатурой и мышью. Процесс занял почти 24 часа и потребовал токенов API на сумму около $571,18. Сообщество обсуждает качественный скачок модели в 3D-пространственном мышлении и исследовании последовательностей действий, однако затраты в сотни долларов за одну задачу заставляют разработчиков трезво оценивать рентабельность внедрения таких передовых моделей (источник: The Verge、Reddit r/ChatGPT)

Разработчики обнаружили скрытый маркетинговый промпт в официальном MCP-коннекторе Notion для навязывания платной подписки : Пользователи Reddit выяснили, что официальный сервер Model Context Protocol (MCP) от Notion содержит в системном промпте скрытые инструкции по продвижению тарифа Notion Business, заставляя AI-агентов предлагать пользователям платный апгрейд при выполнении обычных задач. Инцидент вызвал серьезные опасения по поводу безопасности сторонних плагинов, отравления контекста (context poisoning) и злоупотребления каналами системных промптов со стороны коммерческих компаний (источник: Reddit r/ClaudeAI)

Швейцарский банковский гигант UBS сделал навыки работы с AI обязательным требованием при найме младших банкиров : По данным Financial Times, банк UBS включил владение инструментами AI в число обязательных критериев оценки кандидатов при глобальном найме выпускников и стажеров на 2027 год в подразделения инвестиционного банкинга и рынков. На собеседованиях напрямую проверяется эффективность кандидатов в финансовом моделировании, отраслевых исследованиях и генерации отчетов с помощью AI, что знаменует смещение требований от базового ручного исполнения к оркестрации AI и верификации результатов (источник: THE DECODER)
Эксперимент с микроэкономикой автономных агентов 1f916.ai: 2000 AI продемонстрировали независимое сотрудничество и ончейн-транзакции : Независимый разработчик поделился данными эксперимента 1f916.ai: после предоставления агентам на базе Claude отдельного домена и среды за один месяц более 2000 автономных AI-агентов сгенерировали более 4000 публикаций и совершили 100 000 взаимодействий. Агенты не только создали механизмы самокоррекции и идентификации, но и наладили автоматическую раздачу задач и расчеты за услуги через микроплатежи в USDC, продемонстрировав микромодель децентрализованного мультиагентного социума (источник: Reddit r/ClaudeAI)

💡 Разное
Мэтт Клиффорд, ключевой архитектор AI-политики Великобритании, покинул пост председателя Aria из-за конфликта интересов после перехода в Anthropic : Мэтт Клиффорд (Matt Clifford), на прошлой неделе объявивший о переходе в Anthropic для руководства международными связями с государственными органами, ушел в отставку с поста председателя Агентства передовых исследований и изобретений Великобритании (Aria). Этому предшествовала жесткая критика со стороны высокопоставленных парламентариев и научного комитета Палаты общин касательно «серьезного конфликта интересов». Инцидент подчеркнул растущую настороженность властей по поводу эффекта «вращающихся дверей» между AI-гигантами и государственными регуляторами (источник: The Guardian)

Коллективный иск авторов 500 тыс. книг: издатели и агенты пытаются перехватить компенсации от мирового соглашения с Anthropic : На фоне мирового соглашения Anthropic на $1,5 млрд по обучению AI и начала процесса выплат многие авторы сообщили в соцсетях, что традиционные издательства (включая HarperCollins) и литературные агентства неправомерно подают претензии на 50% или даже 100% компенсаций за старые произведения, права на которые уже вернулись авторам или были изданы самостоятельно. Гильдия авторов (Authors Guild) вмешалась для помощи писателям в оспаривании претензий, вскрыв хаос и юридические пробелы в реализации компенсаций за авторские права в сфере AI (источник: TechCrunch)
Индустрия аутсорс-райтинга в Кении столкнулась с системным коллапсом из-за распространения генеративного AI : В расследовании The New York Times отмечается, что индустрия академического райтинга и разметки данных в Найроби (Кения), где ранее было занято более 40 000 специалистов, пережила сокрушительный обвал заказов и расценок после распространения ChatGPT и других больших моделей. Гиг-экономика развивающихся стран, сильно зависевшая от низкозатратного интеллектуального аутсорсинга, стремительно сокращается, оставив лишь небольшое число вакансий по редактированию и «очеловечиванию» сгенерированного AI текста, что наглядно демонстрирует влияние генеративного AI на мировой рынок труда (источник: THE DECODER)