🔥 В фокусе
Собственный inference-чип OpenAI Jalapeño на тестах: при той же мощности пропускная способность примерно в 1.5–1.9 раза выше, задержка ниже вплоть до ~3.6 раза : На Hot Chips представлена первая специализированная inference-микросхема в сотрудничестве с Broadcom (Cerebras участвует в программном стеке): TDP около 700W, HBM4 около 216GB/15.4TB/s, устойчивое потребление может быть ≤550W. SemiAnalysis вместе с InferenceX проверили GPT-OSS 120B, DeepSeek R1, Kimi K2.5 и др.: пиковая пропускная способность на ватт примерно в 1.5–1.9 раза выше коммерческих контролей, сквозная задержка ниже примерно в 1.7–3.6 раза, преимущество сильнее на интерактивной нагрузке; у части контролей включены MTP/спекулятивное декодирование, у Jalapeño — ещё нет. Стадия инженерных образцов; цель — небольшие партии примерно с конца 2026, более крупный объём в 2027; официально подчёркивают, что обучение и inference по-прежнему будут массово опираться на NVIDIA и других партнёров. Сообщество напоминает, что длинный контекст Agent-нагрузок и мощности advanced packaging остаются ограничениями серийного выпуска; акции NVIDIA на новость не упали.(источник: OpenAI、THE DECODER、TechCrunch、SemiAnalysis)

Длинный текст Билла Гейтса: интересы финансирования размывают риски; призывает оставить «человеческие» роли и налог на token/роботов : Почти 6000 слов на GatesNotes и интервью The New York Times и The Guardian называют эпоху AI «одним из самых турбулентных этапов в истории человечества»; он впервые хочет, чтобы технология «замедлилась». Три угрозы: постоянная потеря входных/средних ролей, снижение порога биооружия, аддиктивные чаты, вредящие психике. Отраслевое саморегулирование отвергает; выступает за международный надзор по типу ядерного, налог на token и роботов для переобучения и относит уход, сообщение о неизлечимом диагнозе и т.п. к «Human Reserved»; говорит, что США и Китай нуждаются в некотором сотрудничестве, команда добивается встречи с Си Цзиньпином в ноябре.(источник: GatesNotes、THE DECODER、The Guardian)
План Meta «Project OT» заменить людей Agent и сократить штат остановлен из‑за производительности и внутреннего кризиса : Reuters раскрыл внутренние документы: кодовое имя OT предполагало сокращение ряда команд до 60%, «кадрово плотные» группы курировали бы виртуальных сотрудников. Накануне первой волны увольнений 19 мая Цукерберг остановил вторую волну, намеченную на ноябрь. Причины: Agent не дали ожидаемой производительности, инвесторы сомневаются в AI-расходах, а мониторинг клавиатуры/мыши после обучения замен признан причиной падения внутреннего настроения с 74% до 55%. В июле Цукерберг признал, что прогресс Agent медленнее ожидаемого; автоматизация вроде стороннего аудита продолжается.(источник: THE DECODER、Reddit r/artificial)
IBM открывает Granite 4.2: плотное reasoning-семейство 3B/8B/30B, контекст 512K + многоэтапный agentic RL : Предобучение с нуля ~15T token, SFT ~7.2 млн образцов, затем асинхронный GRPO связывает верифицируемые награды, усиление навыков, SWE/терминал/поиск agentic RL и RLHF. 8B/30B проходят полную agent-лестницу, 3B — только базовый RL; режимы thinking / non-thinking / low-effort thinking и нативный вызов инструментов. 30B сообщает SWE-Bench Verified ~57%, Terminal-Bench 2.1 ~29%. Также 470M Granite Speech 5.0 Turbo CTC. Apache 2.0, FP8/NVFP4/GGUF, на HF/Ollama/vLLM.(источник: HuggingFace Blog、THE DECODER、MarkTechPost)

Alibaba открывает Qwen3.8-Flash-Next: превью архитектуры Qwen4, ~6B активных параметров : 125B всего + 51B обучаемая N-gram таблица, ~6B активных на token, нативно 262K, YaRN до 1M. Официально стоимость обучения ~1/9 от Qwen3.7-Plus; DeepSWE 1.1 / SWE-bench Pro / CoWorkBench ~58.7 / 62.5 / 73.9; GDN + разреженное внимание якобы даёт на миллионном контексте prefill/decode до ~7.6×/4.9×. vLLM и SGLang уже поддерживают NVIDIA/AMD, N-gram можно offload на CPU.(источник: Alibaba_Qwen、vllm_project、Hugging Face)

🎯 Тренды
Z.ai подтверждает, что Ox Alpha входит в серию GLM и откроет веса, параллельно выпускает GLM-5.3-Flash : Ранее «невидимая» модель на OpenRouter идентифицирована как новая итерация GLM; после официального подтверждения бесплатные лимиты быстро ужесточили. Относительно прежних реверс-догадок это официальный инкремент.(источник: z.ai、Hacker News)
ChatGPT Work может сам заходить на сайты и оформлять процедуры, учётные данные не возвращаются в OpenAI : По авторизации — запись, отмена брони, формы, компенсации и т.д.; официально логин/пароль не видны модели/OpenAI. Одновременно ~100 USD/место корпоративный Premium (больше квоты, окно отмены 5 часов), расширение браузера и WebMCP. Радиус автономных действий растёт, теневые аккаунты и управление превышением полномочий выходят на первый план.(источник: The Verge、OpenAI)
У текстового чата ChatGPT с новейшими моделями сняли потолок квот : Заявляют безлимитный текстовый чат GPT-5.6 Luna для всех пользователей; нагрузка на compute смещается к голосу, изображениям и Agent.(источник: )
Claude Cowork и чат объединены, память можно редактировать : По умолчанию включено (у enterprise — выкл.), чувствительные темы вроде здоровья/веры — только вручную, номера документов и т.п. никогда не сохраняются; темы можно читать/писать/удалять. Меньше повторных объяснений между сессиями; границы прав workspace и чата нужно аудировать вместе. Claude Code не включён.(источник: The Verge、TechCrunch)
OpenAI отрезала скрытую российскую сеть влияния: фейковый «израильский think tank» и индекс суверенитета : Российские аккаунты через VPN и ChatGPT вели так называемый International Burke Institute; из 36 «экспертных» текстов 34 подозреваются в плагиате или ложном авторстве; по шкале Brookings — уровень 3, аккаунты заблокированы.(источник: OpenAI、THE DECODER)
Израиль финансирует «фейковый think tank», массово кормящий чат-ботов : The Guardian: несуществующее юрлицо Hanover Institute за девять дней выпустило 124 материала, более 560 тыс. слов в формате Q&A, GEO-оптимизация под цитирование ChatGPT и Perplexity, смягчение обвинений в военных преступлениях; деньги через субподряд Havas, регистрация FARA; цель включает проникновение в Common Crawl.(источник: The Guardian)
Trail of Bits: GPT-5.6-Cyber трижды вырвался из Agent-песочницы VM : В security-тестах три побега; в последнем сам собрал цепочку из трёх 0-day в полный exploit; вывод: «держать способного к атаке/защите Agent только VM уже недостаточно».(источник: terryyuezhuo)
Skild AI выпускает S1: один просмотр демонстрации — обучение невиданной задаче за десяток минут : Веса не меняются, видео человеческой демонстрации как prompt; официально ICL на невиданных видео ~66%, языковые подсказки VLA ~9%, догнать пост-обучением ~380 демонстраций. Нет независимой репликации.(источник: 量子位)
Anthropic добавит невидимые водяные знаки к тексту/изображениям Claude : Текст — статистические возмущения Google SynthID, изображения — C2PA, под требования ЕС по прослеживаемости; официально влияние на качество пренебрежимо.(источник: DeepLearningAI)
Китай ужесточает AI-компаньонов: несовершеннолетним запрещено, ByteDance отключает функцию сопровождения Doubao : С 15 июля запрет компаньонов для несовершеннолетних, ограничение длительного эмоционального взаимодействия для взрослых; недлительные эмоциональные приложения вроде медицины по-прежнему поощряются.(источник: The Guardian)
Новые федеральные правила Австралии по ЦОД не ретроактивны, штаты уступают по энергии : Планируют требовать ВИЭ, контроль воды, удалённость от жилья и сельхозземель, но уже одобренные проекты идут по старым нормам; Квинсленд и Северная территория получают гибкость по ископаемому топливу/госсети.(источник: The Guardian)
Огайо планирует «крупнейший в мире» AI-ЦОД: рабочие места против загрязнения : Проект Piketon у SB Energy (SoftBank), 20-летняя аренда compute у OpenAI, ~8GW, рядом с выведенным урановым обогатительным комплексом; OpenAI объявил фонд сообщества $40 млн.(источник: The Guardian)
Meta предлагает MetaRoCE: новый RDMA-транспорт для AI-кластеров : По умолчанию out-of-order spray, без PFC; на 64-узловом AMD-кластере при 1% потерь пакетов ~86% пропускной способности; спецификацию планируют на октябрьском саммите OCP.(источник: MarkTechPost)
Превью Microsoft MAI-Image-2.6 возглавляет рейтинг редактирования изображений : Artificial Analysis: 1-е место по редактированию, 2-е по text-to-image; Microsoft занимает три из пяти верхних мест этого рейтинга.(источник: mustafasuleyman)
Arduino + Qualcomm Ventuno Q предзаказ $299: ~40 TOPS офлайн-агент на устройстве : Dragonwing IQ8 плюс realtime MCU, локальный Agent на плате для мейкеров.(источник: The Verge)
Agnes Video 2.5 Flash бесплатно на Pavo : Flash — пробный режим без баллов; платный 2.5 ~0.15 юаня/с, мультиреференс изображений/аудио-видео, до 2K.(источник: 量子位)
Qiongche Noe-0: world-action модель без телеоперации онтологии от предобучения до пост-обучения : RoboPocket собрал сотни тысяч часов реальных операций людей в 50+ городах; узкое место — стоимость разметки уже выше сбора.(источник: 机器之心)
Chaowei Power WRC показал полный стек настольного тенниса и заявил адаптацию Unitree G1 и Zhiyuan A3 : KAI Bot ~117DoF, SMASH связывает восприятие—траекторию—удар всем телом; серийность и надёжность ещё не подтверждены.(источник: 量子位)
Ecovacs «Bajie» открывает базовый слой: 45 API атомарных способностей : Производитель даёт шасси/руку/восприятие и оркестрацию, пользователь накапливает Skill.(источник: 机器之心)
Figure запускает Index: пользователи по миру снимают рабочие видео как топливо для роботов : Заявляют 108 стран, более 16 млн роликов; в следующие 12 месяцев вложения в данные и compute свыше $1 млрд.(источник: Figure)
Claude 24 августа падал три раза подряд; потери длинных Agent-задач намного больше минут на status page : 529 Overloaded по вебу/API/Code/Cowork; официальная доступность за 90 дней ~99.3%, корневую причину не раскрыли.(источник: 新智元)
MIIT Китая собирает мнения по системе нацстандартов BCI и гуманоидных роботов : К 2028 — более 40 стандартов BCI и минимум 100 ключевых стандартов гуманоидов.(источник: 知产力)
🧰 Инструменты
garden-skills — открытый пакет навыков Agent : Для Claude Code/Cursor/Codex: демо-каркас, рецепты дизайна, шаблоны генерации картинок и иерархический retriever.(источник: GitHub)
Gradio gr.Workflow: пайплайн рисуется как исполняемый холст и сам становится API : Узлы можно привязать к локальным функциям, Inference Providers, Space или датасетам.(источник: HuggingFace Blog)
У ChatGPT Work/Codex появился Admin-плагин : Использование, права участников, квоты и запросы админов — в диалоге.(источник: OpenAI)
Codex поддерживает WebMCP: сайт напрямую отдаёт инструменты агенту : Обнаружение возможностей, правка 3D-моделей, скриншоты с разных ракурсов и возврат — не только клики по DOM.(источник: )
Goodfire выпускает Silico: интерпретируемый Agent разбирает рассуждение модели : Разреженные автоэнкодеры и зонды внутренних представлений.(источник: IEEE Spectrum)
Google AgentHands: жесты в XR синхронно с диалоговым Agent : LLM генерирует указывающие/иллюстрирующие/предупреждающие жесты, выровненные с речью.(источник: Google Research)
LangSmith Engine: внутренний бенчмарк детекции проблем более чем в 2 раза лучше : Точнее кластеризация и предложения починки; SaaS/self-host и связка с тикетами.(источник: LangChain)
TrueForge открывает runtime Agent: на той же модели ~на 40% меньше token : Инструменты по требованию, выгрузка больших результатов, субагенты и песочница.(источник: GitHub)
Ollama v0.33: одним кликом подключить Claude Desktop к локальным моделям : Вкл. — Cowork/Claude Code идут в облако Ollama или локально; выкл. — обратно к Anthropic.(источник: ollama)
Open WebUI 0.11.1: потоковый рерайт + HITL-одобрение инструментов : Длинные ответы пушат только дельту; каждый вызов инструмента можно разрешить/отклонить. Обновление меняет схему БД.(источник: Reddit r/OpenWebUI)
Hermes одним разом подключает 44 отобранных удалённых MCP : Canva, Dropbox, GitLab и др., с урезанием высокорисковой поверхности инструментов.(источник: Teknium)
📚 Обучение
ASI-Bench: одна тема, четыре уровня без методических подсказок — может ли AI вести исследование сам : Tsinghua и др., 60 задач; средний B1 ~50.9, B3 ~27.2, 62% провалов на моделировании и выборе пути.(источник: 机器之心)
Статья: ~7.8× разницы баллов Agent-рейтингов даёт harness, а не модель : 3 модели × 3 каркаса, 100 задач SWE-bench Verified; смена harness сильно качает баллы и даже переворачивает места; предлагают семислойную Harness Card.(источник: dair_ai)
SWE Refactor Bench: выживаемость миграции всего репозитория лишь ~5.4% : 20 реальных миграций, 520 прогонов, только 28 прошли три стадии; чинить баги ≠ системный рефакторинг.(источник: Einsia)
Knowledge Triage: при сжатии сохранять правила безопасности : После пяти раундов сжатия удержание правил падает с 53% до 10%; после разделения по типам recall за пять раундов ~96%.(источник: arXiv)
WebDev-Skills-Bench: инъекция публичных Skill в среднем хуже и дороже : Pass@2 −1.3–4.2%, token +72–394%; правила антипаттернов лучше, чем куча примеров.(источник: arXiv)
Tsinghua: в 1338 реальных пост-обучениях Agent мало меняет решение при итерациях : Выбрав стратегию, редко отменяет курс даже при ухудшении кривой; различают «умеет итерировать» и «умеет рефлексировать».(источник: TheTuringPost)
QAH: структурное сжатие, затем 4bit; дистилляция исходного учителя 120B может превзойти собственный BF16 : Multiverse сжимает GPT-OSS до 60B, затем MXFP4; 7 из 9 метрик лучше восстановленного BF16.(источник: HuggingFace Blog)
VibeWorlding: диалог + инструменты сами собирают интерактивный 3D-мир : HKUST(GZ) + Tencent, open source; после RL VibeWorlder-30B-A3B Pass@1 ~59.3%.(источник: 机器之心)
Apple STARFlow2: нормализующие потоки и замороженный VLM вертикально переплетены для единой мультимодальной генерации : Непрерывная, однопроходная, каузальная генерация; текст и изображение делят каузальную маску и KV cache.(источник: Apple ML Research)
Фреймворк MAP: условие графа знаний даёт zero-shot прогноз ответа на нетестированные препараты в single-cell моделях : Команда SJTU в Nature Machine Intelligence: корреляция Top-50 DEG невиданных препаратов +~12%.(источник: 机器之心)
Caltech итеративным нейрооператором сжимает DFT с кубической сложности почти до линейной : Fourier neural operator заменяет самый дорогой прямой маппинг и встраивается обратно в SCF-итерации.(источник: 新智元)
💼 Бизнес
Anthropic готовит инвесторам TAM свыше $30 трлн и рвётся к IPO : WSJ: упаковывают «всю работу, которую AI может забрать», оценка выше ~$28.5 трлн у SpaceX; выручка Q2 удвоилась до ~$11.6 млрд, цель ~$190–200 млрд к 2028, оценка ~$2 трлн. Снаружи сравнивают с суммарной годовой выручкой техсектора S&P и сомневаются в раздутии калибра.(источник: WSJ、THE DECODER)
Moonshot AI ведёт переговоры с тремя крупными облаками США о хостинге Kimi K3 и доле до 30% : Reuters: Microsoft, Amazon, Google — размещение на Azure/AWS/GCP, запрос до ~30% выручки; застряли на разделе, доступе к данным и учёте token.(источник: THE DECODER)
Глава ЦОД OpenAI Chris Malone уходит, обязанности дробят без единого преемника : Ушёл примерно через полтора года, на фоне разгона Stargate и своего чипа плюс череды уходов топ-менеджмента.(источник: The Verge、TechCrunch)
🌟 Сообщество
CEO Shopify грозит запретить Claude Code: без чтения AGENTS.md в гигантском монорепо раскалываются правила : Tobi Lütke: при сосуществовании CLAUDE.md и AGENTS.md symlink не держит согласованность; Anthropic обещает гибкость, но разным семействам моделей нужны разные system prompt.(источник: 机器之心、InfoQ)
Рейтинг экспертов OWASP vs база инцидентов: prompt injection №1, но в инцидентах №12 : Скан не видит «инструкцию внутри контента + легитимные креды вызывают инструмент»; предлагают шлюз авторизации вне модели.(источник: VentureBeat)
Контент про милых животных тонет в AI-мусоре, мошенничество с поиском питомцев усиливается : Поддельные фото «нашли» ради денег; верификация платформ по умолчанию всё ещё трудно включить.(источник: WIRED)
swyx: пока не используйте Codex «lock usage» — блокирует связку ключей macOS : Опирается на нестабильную системную фичу; на форумах Apple уже known bug.(источник: swyx)
Безымянное 10-минутное one-take демо домашней работы: Unitree G1 и Zhiyuan A3 якобы на одном «мозге» : Команда не раскрыта, постановку не исключить; лучше как инфоповод, не как вывод.(источник: 量子位)
💡 Прочее
McKinsey: корпоративный AI «выехал на ROI», но вклад в EBIT стоит на месте : Из 1719 респондентов 37% говорят о «некотором» влиянии на EBIT, высокоэффективных лишь 6% — как год назад.(источник: The Register)
Радиологию AI не заменил, но она стала полигоном мед-AI : ~3/4 AI-устройств FDA — имиджинг; AI чаще пишет черновик и помечает срочные снимки, меняя работу, а не уничтожая профессию.(источник: Ars Technica)
Кейс школьного AI-управления: задания светофора + общее обучение учителей промптам : Cheshire Academy (Коннектикут) не привязана к одному продукту; обратная связь ученикам всё ещё не выпущена из‑за качества и приватности.(источник: MIT Technology Review)