OpenAI официально опубликовала 249-страничную научную работу… | AI Ежедневник 2026-08-03

🔥 В центре внимания

OpenAI официально опубликовала 249-страничную научную работу и код верификации модели Astra, решившей 10 сложных математических задач : OpenAI официально выпустила 249-страничную техническую статью о том, как модель рассуждений следующего поколения Astra справилась с 10 математическими задачами уровня Филдсовской премии, и выложила код формальной верификации Lean 4 в открытый доступ на GitHub. Astra впервые построила контрпример для не-sofic групп и преодолела предел скорости затухания для задачи плотной упаковки многомерных сфер, существовавший с 1978 года. Этот прорыв доказывает глубокие конструктивные способности AI в области чистой математики, при этом средняя стоимость Token на одно доказательство составила всего 200 долларов, что предвещает наступление эпохи «покупки математических теорем за счет вычислительных мощностей» (Источник: OpenAI News)

OpenAI официально опубликовала 249-страничную научную работу и код верификации модели Astra, решившей 10 сложных математических задач

Andrej Karpathy активно обсуждает Claude Opus 5, создающую полноценный 3D-игровой мир с физикой по одному промпту : Бывший глава отдела AI в Tesla Andrej Karpathy после перехода в Anthropic опубликовал свой первый пост, продемонстрировав, как Claude Opus 5 в рамках лимита в 1 миллион Token сгенерировала по одному промпту 3D-игровой мир по мотивам «Властелина колец» со сложной физикой, текстурами и музыкой. Этот прогресс знаменует собой сдвиг парадигмы AI от простого рисования 2D SVG к процедурной генерации 3D-прототипов. Однако Karpathy также отметил, что из-за отсутствия у модели восприятия видео в реальном времени и возможностей аудита игры все еще существуют ограничения, такие как прохождение объектов сквозь текстуры («клиппинг») на сгенерированных кадрах (Источник: THE DECODER)

Andrej Karpathy активно обсуждает Claude Opus 5, создающую полноценный 3D-игровой мир с физикой по одному промпту

Система кибербезопасности Microsoft MDASH показала прорывной результат 95,95% на бенчмарке CyberGym : Microsoft опубликовала последние результаты своей мультиагентной системы кибербезопасности MDASH на бенчмарке CyberGym, показав колоссальный отрыв от отрасли с результатом 95,95% воспроизведения уязвимостей. Система использует экономичную гибридную архитектуру маршрутизации: легкая модель MAI-Cyber-1-Flash с 5B активных параметров обрабатывает 90% рутинных запросов безопасности, и лишь 10% самых сложных задач перенаправляются на GPT-5.4. Это позволяет вдвое снизить затраты на инференс при сохранении высочайшего уровня защиты, демонстрируя эволюцию AI в кибербезопасности от «нагромождения больших моделей» к «систематическому снижению затрат» (Источник: 36氪)

Система кибербезопасности Microsoft MDASH показала прорывной результат 95,95% на бенчмарке CyberGym

Посредников данных для AI уличили в массовой скупке и разрушительном сканировании редких книг, изданных до 2022 года : Расследование австралийских книготорговцев и представителей индустрии выявило новые подробности об источниках данных для обучения AI: такие посредники данных, как ISBNdb, анонимно скупают на вторичных платформах редкие и вышедшие из тиража книги, опубликованные до 2022 года, поскольку они не «загрязнены» контентом, сгенерированным AI. Для повышения эффективности оцифровки сканирующие организации срезают корешки книг и уничтожают физические копии, что вызвало этические споры в культурной среде об утрате человеческого культурного наследия из-за обучения AI (Источник: The Guardian)

Посредников данных для AI уличили в массовой скупке и разрушительном сканировании редких книг, изданных до 2022 года

🎯 Тренды

Google Gemini Robotics 2 делает упор на управление с «полной сквозной координацией всего тела» : Google DeepMind представила универсальную модель робототехники Gemini Robotics 2. Ее суть заключается в отказе от традиционного поэтапного контроля («сначала встань устойчиво, затем протяни руку») в пользу полной координации ног, туловища и ловких многопалых рук. Тесты показали, что модель успешно адаптируется к различным физическим воплощениям на Franka Duo и Apollo 2, однако показатель успешности тонких операций на «последних нескольких сантиметрах», таких как вкручивание лампочки или закрытие зип-пакета, все еще требует улучшения (Источник: 36氪)

NVIDIA открыла исходный код Molt — минималистичного фреймворка обучения с подкреплением для агентов : Команда NVIDIA NeMo открыла исходный код Molt — нативного для PyTorch фреймворка обучения с подкреплением для агентов. Фреймворк отличается минималистичным дизайном (всего около 8,6 тыс. строк кода), благодаря чему его легко понимать и модифицировать с помощью AI-ассистентов разработчика. Molt обеспечивает эффективную асинхронную координацию между обучением и Rollout с помощью Ray и vLLM, а также внедряет технологию «маршрутизации и повторного воспроизведения Rollout», решая проблему несоответствия выбора экспертов в моделях MoE на этапах обучения и инференса (Источник: MarkTechPost)

AMD выпустила полностью открытую модель смеси экспертов Instella-MoE-16B-A3B : AMD выпустила открытую модель смеси экспертов Instella-MoE-16B-A3B (с 2,8B активных параметров), обученную на GPU Instinct MI300X/MI325X. Модель использует технологии Gated MLA (Gated Multi-head Latent Attention) и асинхронной связи FarSkip-Collective, что позволило увеличить скорость предобучения на 12,7% и снизить задержку вывода первого токена на 39,2%, лидируя среди открытых моделей аналогичного размера во многих бенчмарках (Источник: MarkTechPost)

AMD выпустила полностью открытую модель смеси экспертов Instella-MoE-16B-A3B

Meta AI предложила архитектуру агента с активной памятью для решения проблемы «деградации поведенческого состояния» : Исследователи из Meta AI предложили архитектуру «агента с активной памятью», внедрив независимого агента-«тренера памяти» для поддержки структурированной базы памяти, содержащей состояния, знания и процессы. Этот тренер может проактивно определять, когда отправлять подсказки исполняющему агенту. В тестах вроде Terminal-Bench это значительно повысило процент успешного выполнения длительных задач, эффективно предотвращая забывание ограничений агентом в длинном контексте и повторение неудачных попыток (Источник: THE DECODER)

Meta AI предложила архитектуру агента с активной памятью для решения проблемы «деградации поведенческого состояния»

OpenAI представила Presence — платформу корпоративного развертывания и интеграции агентов : OpenAI запустила сервис Presence для корпоративных клиентов, призванный превратить агентов ChatGPT Workspace в готовые к промышленной эксплуатации приложения для обслуживания клиентов и внутренних рабочих процессов. OpenAI направит инженеров по передовому развертыванию для помощи корпоративным клиентам в системной интеграции, установлении границ безопасности и управлении тестированием. Это знаменует собой ускорение вывода AI-агентов разработчиками больших моделей в ключевые бизнес-сценарии предприятий (Источник: THE DECODER)

Официальное вступление в силу Закона ЕС об искусственном интеллекте вызвало опасения по поводу «усталости от раскрытия информации» : Закон ЕС об искусственном интеллекте (EU AI Act) официально вступил в силу 2 августа. Новые правила обязывают маркировать любое взаимодействие с системами AI или медиаконтент, созданный/отредактированный с помощью AI. Нарушителям грозят штрафы до 15 миллионов евро или 3% от глобального оборота. Отраслевые аналитики опасаются, что повсеместная маркировка AI, подобно всплывающим окнам Cookie в рамках GDPR, может вызвать у общественности «усталость от раскрытия информации» и привести к игнорированию этих предупреждений (Источник: WIRED)

Официальное вступление в силу Закона ЕС об искусственном интеллекте вызвало опасения по поводу «усталости от раскрытия информации»

🧰 Инструменты

DwarfStar: локальный движок инференса на C, оптимизированный для DeepSeek V4 : Разработчик antirez открыл исходный код DwarfStar — локального движка инференса на языке C, глубоко оптимизированного под DeepSeek V4 Flash. Движок полностью автономен, поддерживает бэкенды Metal, CUDA и ROCm, а также имеет специально разработанный режим потоковой передачи экспертов с SSD, что позволяет запускать модели MoE с большим количеством параметров на потребительских устройствах с ограниченным объемом памяти (например, Mac с 96 ГБ) на приемлемой скорости (Источник: GitHub)

DwarfStar: локальный движок инференса на C, оптимизированный для DeepSeek V4

Xberg v1: фреймворк интеллектуального извлечения контента на Rust с учетом верстки : Разработчики открыли исходный код Xberg v1 (ранее известного как Kreuzberg) — эффективного фреймворка для интеллектуального извлечения контента. Написанный полностью на Rust, он поддерживает глубокий парсинг 101 формата документов и 367 форматов кода. В нем реализовано обнаружение макета на базе ONNX и реконструкция порядка чтения в стиле Docling, что позволяет значительно превосходить аналогичные инструменты вроде docling и mineru по качеству извлечения из нативных PDF и точности восстановления таблиц (Источник: Reddit)

Xberg v1: фреймворк интеллектуального извлечения контента на Rust с учетом верстки

mem-port: локальный сервер памяти для устранения дрейфа контекста при совместной работе с AI : Разработчик открыл исходный код локального MCP-сервера памяти mem-port. Инструмент использует встроенную SurrealDB для хранения графов и векторов, избавляя от необходимости настраивать сложные внешние базы данных. mem-port предоставляет единую общую долговременную память для различных инструментов программирования на базе AI, таких как ChatGPT, Claude Code и Cursor, фиксируя архитектурные решения и историю попыток, что эффективно решает проблему потери контекста при переключении между инструментами (Источник: Reddit)

📚 Обучение

Руководство по обучению с автоматической смешанной точностью FP8 в NVIDIA Transformer Engine : В этом руководстве подробно рассказывается, как использовать NVIDIA Transformer Engine для ускорения процесса обучения моделей Transformer. Материал охватывает использование объединенных операторов, таких как te.Linear, настройку Autocast на основе автоматической смешанной точности FP8, а также способы стабилизации вычислений тензоров низкой точности с помощью отложенного масштабирования (Delayed Scaling) и истории amax. Также приводится сравнение с нативной реализацией на PyTorch (Источник: MarkTechPost)

Практическое руководство по сквозному прогнозированию временных рядов и бэктестингу на базе TimesFM 2.5 : В этом руководстве показан сквозной рабочий процесс прогнозирования временных рядов на основе открытой модели Google google/timesfm-2.5-200m-pytorch. Урок охватывает вероятностное прогнозирование с нулевым выстрелом (zero-shot), бэктестинг со скользящим началом (rolling origin), обнаружение аномалий на основе интервалов прогнозирования, а также интеграцию числовых и категориальных ковариат (таких как цены и промоакции) в модель TimesFM через модуль XReg для обеспечения высокой точности прогнозов в таких сценариях, как розничная торговля (Источник: MarkTechPost)

💼 Бизнес

CuspAI привлекла 450 млн долларов в раунде B, оценка компании достигла 2,6 млрд долларов : Британская компания по дизайну материалов с помощью AI CuspAI объявила о завершении раунда финансирования серии B на сумму 450 млн долларов, в результате чего ее оценка взлетела до 2,6 млрд долларов. Раунд возглавили Kleiner Perkins и NEA, также в нем принял участие фонд Джеффа Безоса. CuspAI делает ставку на концепцию «обратного проектирования», генерируя структуру материалов на основе целевых характеристик. Компания уже создала совместные AI-лаборатории материалов с NVIDIA, Hyundai Motor и другими партнерами для ускорения разработки полупроводников, аккумуляторов и материалов для улавливания углерода (Источник: 36氪)

CuspAI привлекла 450 млн долларов в раунде B, оценка компании достигла 2,6 млрд долларов

Команда RadixArk (создатели SGLang) привлекла более 100 млн долларов и выпустила фреймворк Miles : Стартап RadixArk, созданный основной командой разработчиков открытого движка инференса SGLang, привлек более 100 млн долларов в посевном раунде финансирования с участием NVIDIA, AMD и создателя PyTorch. RadixArk стремится выжать максимум из возможностей GPU и выпустил открытый фреймворк постобучения Miles. Этот фреймворк обеспечивает глубокую системную координацию процессов инференса, оценки и обновления параметров при обучении с подкреплением, значительно сокращая нерациональный расход вычислительных мощностей в процессе постобучения (Источник: 36氪)

Команда RadixArk (создатели SGLang) привлекла более 100 млн долларов и выпустила фреймворк Miles

🌟 Сообщество

Решение сложных математических задач с помощью AI вызвало экзистенциальный кризис в математическом сообществе из-за угрозы «замены человека машиной» : После того как OpenAI Astra всего за 2000 долларов решила 10 сложнейших математических задач, включая проблему не-sofic групп, математическое сообщество охватили смешанные чувства. Часть математиков активно использует AI для повышения эффективности исследований, однако другие ученые, такие как Kirwin Hampshire, отмечают, что массовая генерация искусственным интеллектом доказательств, которые могут быть проверены машиной, но сложны для интуитивного понимания человеком, лишает людей духовной радости от исследования неизведанного. Это провоцирует глубокий «экзистенциальный кризис» в математической среде (Источник: THE DECODER)

Идея Sam Altman о «воспитании детей с помощью ChatGPT» подверглась насмешкам в соцсетях : CEO OpenAI Sam Altman опубликовал пост, в котором предложил родителям использовать ChatGPT Work для автоматического создания «подкастов для поездок» на основе семейного календаря и интересов ребенка, чтобы слушать их по дороге в школу. Это предложение встретило жесткий ответ от создателя мультсериала «Гравити Фолз» Alex Hirsch: «Почему бы тебе просто не поговорить со своим ребенком?». Ответ набрал более 120 тысяч лайков, вызвав в сообществе широкое осуждение чрезмерного вмешательства технологий в детско-родительские отношения и ослабления реальных эмоциональных связей между людьми (Источник: TechCrunch)

Популяризатор науки Hank Green публично извинился за чрезмерную зависимость от AI при подготовке материалов и временно приостановил публикации : Известный научпоп-блогер Hank Green столкнулся с сомнениями зрителей по поводу использования AI для написания сценариев после того, как в его video прозвучали речевые обороты с явными признаками генерации. Вслед за этим Green опубликовал на Reddit длинный пост с извинениями, признав, что в погоне за высокой продуктивностью у него развилась «нездоровая» зависимость от AI, что размыло чистоту его личного творчества. Он приостановит или сократит обновления канала, чтобы перестроить процесс исследований и написания текстов без участия AI (Источник: TechCrunch)

Платформы начинают борьбу с «AI-мусором (Slop)» и сталкиваются с обратным эффектом : С ростом популярности генеративного AI интернет наводнил низкокачественный контент. LinkedIn представила кнопку жалобы в один клик на «AI Slop», отдельную от традиционной системы жалоб, а Snapchat объявила, что алгоритм рекомендаций коротких видео Spotlight больше не будет продвигать ролики, полностью созданные AI. В то же время из-за того, что автоматически сгенерированные AI низкокачественные отчеты об уязвимостях переполнили почтовый ящик безопасности Apple, реальный баг в macOS стоимостью 200 000 долларов не удалось отправить вовремя, что подчеркивает разрушительное воздействие AI-спама на экосистему защиты (Источник: THE DECODER)

💡 Другое

Autonomous Key представила физический NFC-замок для приложений за 9 долларов для борьбы с экранной зависимостью : Чтобы решить проблему, когда пользователи легко обходят программные ограничения экранного времени, компания Autonomous Key выпустила физический NFC-ключ стоимостью всего 9 долларов. Пользователям необходимо физически отсканировать ключ, чтобы разблокировать ограниченные приложения, причем каждая разблокировка длится не более 60 минут. Размещение ключа в другой комнате создает дополнительное физическое препятствие, что в сочетании с «саркастичным» анализом привычек от AI помогает пользователям бороться с зависимостью от социальных сетей (Источник: TechCrunch)

Autonomous Key представила физический NFC-замок для приложений за 9 долларов для борьбы с экранной зависимостью

Судья отклонил ходатайство xAI о приостановке действия запрета на приложения для «раздевания» в Миннесоте : В штате Миннесота официально вступил в силу запрет на приложения для создания дипфейк-обнажения (nudify) без согласия. Компания xAI подала иск, утверждая, что запрет является «чрезмерно ограничивающим», и потребовала приостановить его действие. Однако федеральный судья Don Donovan отклонил это ходатайство, указав на то, что xAI подала экстренный иск спустя почти три месяца после подписания законопроекта и всего за три дня до его вступления в силу, что логически опровергает утверждения компании о «неминуемом ущербе» (Источник: TechCrunch)

Разработчик выложил в открытый доступ пустую модель Vacuum 16T на 16,5 трлн параметров, высмеивая гонку вооружений LLM : В ответ на слепое соперничество закрытых лабораторий по количеству параметров разработчик выложил на Hugging Face пустую модель Vacuum 16T с 16,5 триллионами параметров. Объявив огромное количество нулевых тензоров в заголовке safetensors, модель успешно заняла первое место по числу параметров на Hugging Face, но при фактической передаче благодаря дедупликации потребляет менее 1 МБ трафика. Это иронизирует над слепым поклонением индустрии «большим параметрам» (Источник: Reddit)

Разработчик выложил в открытый доступ пустую модель Vacuum 16T на 16,5 трлн параметров, высмеивая гонку вооружений LLM

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *