🔥 В центре внимания
GPT-5.6 запускает режим самооптимизации, снижая стоимость инференса на 20%: GPT-5.6 Sol успешно внедрена в продакшн-среду OpenAI, самостоятельно переписав и оптимизировав ядра GPU, что снизило стоимость сквозного обслуживания на 20% и повысило эффективность генерации token более чем на 15% за счет оптимизации моделей спекулятивного декодирования. Этот прогресс демонстрирует практическое воплощение рекурсивного самосовершенствования (RSI) на уровне системной инфраструктуры: AI начинает активно участвовать в преобразовании собственной среды выполнения. (Источник: OpenAI News)
Meta опубликовала финансовый отчет за Q2: капитальные затраты растут, Цукерберг предсказывает эру персональных агентов: Meta опубликовала финансовый отчет за Q2 2026 года с выручкой в 60,8 млрд долларов. Однако из-за инвестиций в инфраструктуру AI и роста судебных издержек свободный денежный поток упал на 91% до 784 млн долларов, что привело к резкому падению акций на постмаркете. CEO Марк Цукерберг прогнозирует, что в ближайшие пять лет миллиарды людей получат персональных AI-агентов, работающих круглосуточно, и заявил о намерении продолжать увеличивать капитальные затраты на AI для интеграции агентов с аппаратной экосистемой. (Источник: TechCrunch)
В Кремниевой долине разгорелись бурные дебаты о путях развития: «открытый или закрытый исходный код»: С подписанием открытого письма «Открытые веса и лидерство США в области AI» более чем 70 гигантами, включая NVIDIA, Microsoft и OpenAI, лагерь сторонников открытого исходного кода в Кремниевой долине значительно укрепил свои позиции. В то же время Anthropic, как единственный неподписавший гигант закрытого кода, опубликовал открытое письмо своего CEO, в котором утверждается, что компания не выступает за запрет открытых весов, но подчеркивается ее обеспокоенность вопросами национальной безопасности и вредоносной дистилляции. Этот шаг вызвал обратную реакцию в Кремниевой долине: некоторые стартапы начали переходить на модели с открытым исходным кодом, опасаясь быть «поглощенными» закрытой экосистемой. (Источник: ZDNet)
OpenAI запускает «Программу для академических исследователей», открывая бесплатный доступ к флагманским моделям для 100 000 ученых: OpenAI объявила о бесплатном предоставлении доступа к своим флагманским моделям (включая серию GPT-5.6) для 100 000 исследователей из университетов по всему миру. Программа предлагает защиту конфиденциальности корпоративного уровня, расширенную версию Deep Research и 75 специализированных навыков в области наук о жизни. Этот шаг направлен на глубокую интеграцию научных исследований в экосистему ChatGPT, закрепляя долгосрочные привычки использования AI в академической среде за счет бесплатного доступа. (Источник: OpenAI News)
🎯 Тренды
Лиллиан Венг (Lilian Weng) молниеносно возвращается в OpenAI, чтобы возглавить исследования в области самоэволюции: Соосновательница Лиллиан Венг, которая недавно объявила о своем уходе из Thinking Machines Lab по состоянию здоровья, подтвердила свое возвращение в OpenAI. Она возглавит высокоуровневую исследовательскую группу по «самоэволюции» (RSI), сфокусированную на использовании AI-моделей для разработки и улучшения моделей следующего поколения. Это указывает на то, что OpenAI ускоряет переход самосовершенствования AI из экспериментальной стадии в системную инженерию. (Источник: Qbitai)
Google выпустила модель генерации музыки Lyria 3.5, добавив функцию локальной перерисовки: Подразделение Google DeepMind запустило Lyria 3.5 в Flow Music, повысив естественность и выразительность мелодий, текстов и вокала. Новая версия представляет функцию «локальной перерисовки областей» (Selective Section Painting), позволяющую пользователям настраивать определенные части аудиотрека или расширять короткую мелодию до полноценной песни без необходимости переделывать всю композицию. (Источник: Google DeepMind Blog)
Мировая модель LJM от Moke Robot заняла второе место в глобальном рейтинге WorldArena: Китайский стартап Moke Robot представил мировую модель LJM (Latent Joint-conditional Model), которая заняла второе место в мире в оценке воплощенных мировых моделей WorldArena. Модель использует архитектуру «совместной работы двух мозгов», разделяя физическое интерактивное рассуждение и рендеринг видео, что позволяет роботу сначала понимать физическую семантику взаимодействия в латентном пространстве, а затем генерировать прогнозируемые кадры. (Источник: Synced)
Google DeepMind выпустила Gemini Robotics 2, открыв возможности управления всем телом и координации: Google представила новое поколение мозга для воплощенного интеллекта Gemini Robotics 2, замкнув цикл от симуляционного обучения до реальной работы. Модель открывает интеллектуальное управление всем телом, продвинутые манипуляции с высокой точностью и возможности координации нескольких роботов, позволяя роботам различных форм-факторов работать автономно в течение длительного времени, обучаясь в симуляционной среде без зависимости от реальных данных. (Источник: )
Tencent WorkBuddy обновил функцию совместного редактирования «человек-машина»: Инструмент повышения эффективности на базе AI-агентов WorkBuddy от Tencent выпустил версию V5.3.5, представив совместно с Tencent Docs функцию совместного редактирования «человек-машина». Пользователи могут напрямую редактировать и изменять документы Word, Excel, PPT в режиме реального времени вместе с AI. Это впервые реализует многостороннюю синхронизацию «человек-человек, человек-машина, машина-машина», продвигая офисное ПО в эру нативной AI-коллаборации. (Источник: Qbitai)
Tencent Video проводит закрытое тестирование облегченной платформы для AI-творчества WorkSolo: Департамент интеллектуальных платформ для творчества Tencent Video тестирует платформу WorkSolo, объединяющую функции «коротких AI-сериалов, интерактивных видеоигр и свободного холста». В отличие от WorkRally, ориентированной на промышленное производство высококачественных анимационных сериалов, WorkSolo фокусируется на быстром создании облегченных коротких сериалов и интерактивного контента, используя модель бесплатных пробных версий и подписок с начислением баллов за вычислительные мощности. (Источник: 36Kr)
Google Earth внедряет Nano Banana для географической реконструкции на базе AI: Google интегрировала модель генерации изображений Nano Banana 2 в Google Earth, позволяя пользователям создавать AI-изображения на основе спутниковых и 3D-снимков. Пользователи могут изменять реальные здания или генерировать географические информационные диаграммы с помощью текстовых подсказок, однако практические тесты показывают, что модель все еще имеет ограничения при обработке точной географической логики и генерации текста. (Источник: The Verge)
Раскрыта дорожная карта аппаратного обеспечения OpenAI: сначала умная колонка, затем смартфон: Сообщается, что спустя год после приобретения компании Джони Айва (Jony Ive) OpenAI разработала четкую дорожную карту аппаратного обеспечения. Первым продуктом станет умная колонка без экрана, оснащенная камерой и механическими элементами, выпуск которой ожидается в начале 2027 года. Кроме того, OpenAI разрабатывает «смартфон с AI-агентом» на базе кастомного чипа MediaTek, массовое производство которого запланировано на первую половину 2027 года. (Источник: 36Kr)
Илон Маск представил Grok Voice Think Fast 2.0, возглавившую рейтинг тестов голосовых агентов: SpaceXAI представила голосовую модель нового поколения Grok Voice Think Fast 2.0, которая заняла первое место в тесте голосовых агентов Tau Voice. Среднее время отклика на первый аудиосигнал составляет всего 0,70 секунды. Модель поддерживает потоковые вычисления по принципу «рассуждение во время речи», снижает потребление Token на 60% по сравнению с предыдущим поколением и стоит 0,08 доллара за минуту. (Источник: 36Kr)
🧰 Инструменты
Replit представила AI-инструмент для дизайна Replit Design с упором на пост-промпт взаимодействие: Replit выпустила AI-инструмент для дизайна Replit Design, ориентированный на взаимодействие по принципу «пост-промптинга» (post-prompting). Инструмент не требует от пользователей ввода сложных промптов или языков дизайна. Вместо этого с помощью пространственного интеллекта (Ambient Intelligence) он на каждом шаге предлагает варианты дальнейшего дизайна, которые можно применить в один клик, что значительно снижает порог входа в дизайн приложений для людей без навыков разработки. (Источник: amasad)
Cisco выпустила бесплатный инструмент для отслеживания цепочки поставок AI для предотвращения проблем с комплаенсом в моделях с открытым исходным кодом: Cisco выпустила бесплатный инструмент «AI Model Provenance Kit», содержащий цифровые отпечатки почти 900 моделей с открытым исходным кодом. Сравнивая метаданные архитектуры и сигналы на уровне весов, этот инструмент может обходить заполненные пользователями теги и точно определять истинное происхождение и производные связи моделей с открытым исходным кодом, помогая предприятиям предотвращать нарушения комплаенса и уязвимости безопасности. (Источник: VentureBeat)
Token Saver: плагин MCP с открытым исходным кодом, значительно снижающий затраты Token при анализе PDF: Разработчики выложили в открытый доступ расширение MCP под названием Token Saver для Claude Desktop. Этот инструмент запускает локальную легковесную гибридную систему RAG (сочетающую BM25 и семантический поиск). Вместо загрузки всего PDF-файла в облако он отправляет модели только наиболее релевантные абзацы, что позволяет снизить затраты Token на анализ длинных документов на 90–99%. (Источник: MarkTechPost)
Hint: запущено приложение AI-помощника по дому, соучредителем которого стала Марта Стюарт: Запущено приложение для управления домом на базе AI Hint, созданное бывшим руководителем инженерного отдела Casper Кайлом Рашем (Kyle Rush) и экспертом по стилю жизни Мартой Стюарт (Martha Stewart). После ввода адреса и загрузки договоров на жилье или счетов приложение объединяет открытые географические, почвенные и погодные данные для автоматического составления плана обслуживания дома, а также отвечает на вопросы по страховым выплатам, оптимизации энергопотребления и другим аспектам управления домом через AI-чат. (Источник: TechCrunch)
📚 Обучение
DeepLearning.AI совместно с Qodo запустили бесплатный курс «Анализ кода с помощью AI»: Платформа DeepLearning.AI Эндрю Ына (Andrew Ng) представила новый короткий курс, обучающий созданию и оптимизации агентов для код-ревью на базе AI. Курс охватывает проведение код-ревью перед PR, предоставление полного контекста репозитория, создание контекстного движка с использованием векторного поиска, а также совместную оценку с помощью экспертных агентов по безопасности и стандартам для снижения ложноположительных результатов. (Источник: )
Научная статья CtrlBench-Rec: фреймворк для оценки внешней управляемости рекомендательных систем типа «черный ящик»: Команда Института информационной инженерии Китайской академии наук и другие исследователи опубликовали статью, в которой предложили фреймворк оценки CtrlBench-Rec. Без доступа к внутренним параметрам модели этот фреймворк использует совместную работу мультиагентных систем в качестве зондов. Симулируя внешние взаимодействия, такие как поиск и клики, он измеряет способность рекомендательных систем типа «черный ящик» реагировать в таких аспектах, как обнаружение контента, формирование профиля интересов и смягчение смещения длинного хвоста. (Источник: HuggingFace Daily Papers)
Tencent выложила в открытый доступ фреймворк для обучения спекулятивному декодированию AngelSpec, ускорив декодирование в 2 раза: Tencent открыла исходный код фреймворка AngelSpec для обучения спекулятивному декодированию, поддерживающего прогнозирование нескольких Token (MTP) и блочно-параллельную архитектуру DFlash. Фреймворк использует общие параметры и многоглубинную конструкцию. За счет механизма Rollout целевой модели и адаптивного к префиксам внимания он обеспечивает почти двукратное ускорение сквозного декодирования на моделях Qwen3 и Hy3. (Источник: MarkTechPost)
YC Paper Club обсудил ядра для мульти-GPU и игровые движки с ускорением на GPU: Клуб YC Paper Club поделился несколькими передовыми системными статьями, включая фреймворк Parallel Kittens для упрощения ядер AI на нескольких GPU, метрику «интеллект на ватт» для измерения энергоэффективности локального и облачного AI, а также высокопроизводительный игровой движок Madrona, полностью работающий на GPU для ускорения обучения с подкреплением. (Источник: )
💼 Бизнес
Tokens Infinity AI завершила новый раунд финансирования на сумму в несколько сотен миллионов юаней: Компания Tokens Infinity AI, разрабатывающая инфраструктуру AI-агентов для корпоративной программной инженерии, объявила о завершении нового раунда финансирования под руководством Linxin Investment при участии прежнего акционера Huakong Fund. За год компания привлекла в общей сложности несколько сотен миллионов юаней. Стартап основан Ян Пином (Yang Ping), бывшим руководителем MarsCode в ByteDance, и специализируется на создании полностью автономных, высокобезопасных и самоэволюционирующих платформ для корпоративных агентов. (Источник: Qbitai)
Dili привлекла 21,7 млн долларов для решения проблем комплаенса в инфраструктуре с помощью AI: Стартап в сфере AI-комплаенса Dili объявил о завершении раунда финансирования серии A на сумму 15 млн долларов, в результате чего общий объем привлеченных средств достиг 21,7 млн долларов. Раунд возглавил фонд Khosla Ventures при участии Y Combinator и других инвесторов. Dili использует AI для анализа контрактов, платежных ведомостей и данных ERP крупных инфраструктурных проектов (таких как здания и дата-центры), автоматически проверяя соответствие федеральным законам, включая Закон Дэвиса-Бэкона (Davis-Bacon Act), с помощью детерминированных правил. (Источник: TechCrunch)
Atlassian вводит механизм «AI-кошельков» для ограничения расходов сотрудников на AI: Софтверный гигант Atlassian внедрил механизм «AI-кошельков» для своих R&D-команд, установив для каждого сотрудника лимит на использование AI в размере от 500 до 2000 долларов в месяц, чтобы справиться с ростом IT-расходов из-за «взрывного потребления Token». Этот шаг контрастирует с предыдущим трендом в Кремниевой долине под названием «tokenmaxxing», когда сотрудников поощряли использовать AI без ограничений. (Источник: The Guardian)
🌟 Сообщество
GCC объявил о запрете на внесение кода, созданного AI, имеющего юридическое значение: Руководящий комитет GNU Compiler Collection (GCC) объявил о новой политике: из соображений авторского права, соответствия лицензиям и юридической ответственности с этого года комитет будет отклонять любые вклады в код, имеющие «юридическое значение», если они были сгенерированы агентами на базе больших моделей. Это вызвало широкую дискуссию в сообществе разработчиков открытого ПО о распределении ответственности за код, созданный AI. (Источник: Hacker News)
Умные очки Meta прозвали «очками для подглядывания», что вызвало опасения по поводу конфиденциальности: На фоне распространения в соцсетях видеороликов с розыгрышами и скрытой съемкой в общественных местах с использованием умных очков Meta Ray-Ban, это устройство в сообществе в шутку прозвали «очками для подглядывания». Руководитель Instagram заявил, что аккаунты и видео, нарушающие конфиденциальность пользователей или подозреваемые в домогательствах, будут блокироваться и удаляться. (Источник: Reddit r/ArtificialInteligence)
💡 Другое
36Kr совместно с PureblueAI опубликовали второй выпуск «Рейтинга рекомендательной силы AI для потребительских брендов 2026»: Издание 36Kr совместно с PureblueAI выпустило новый отчет, оценивающий показатели рекомендаций брендов в пяти основных категориях (включая смартфоны, автомобили и бытовую технику) на ведущих AI-платформах. Данные показывают, что Xiaomi сохранила первое место в рекомендациях электромобилей, а iQOO лидирует среди высокопроизводительных смартфонов. Рекомендательные механизмы AI постепенно становятся новым полем битвы для брендов в конкретных сценариях потребления. (Источник: 36Kr)