OpenAI снижает цены на API и кредиты для GPT-5.6 Sol более… | AI Ежедневник 2026-08-23

🔥 Главное

OpenAI снижает цены на API и кредиты для GPT-5.6 Sol более чем на 20% : OpenAI официально объявила, что в течение следующих 3 месяцев снизит цены на API и кредиты для GPT-5.6 Sol более чем на 20%, а при суммировании скидок на таких платформах, как Devin, фактическая скидка может достигать 76%. Аналитики отрасли отмечают, что с расширением собственных вычислительных центров OpenAI и повышением эффективности инференса этот шаг направлен на прямое противостояние натиску экономически эффективных моделей с открытым исходным кодом (таких как DeepSeek и GLM) на корпоративном рынке, а также на оказание ценового давления на передовые проприетарные модели конкурентов. (Источник: OpenAI)

Anthropic открывает корпоративный доступ к Claude Mythos 5 для задач кибербезопасности : Anthropic официально интегрировала модель Claude Mythos 5, обладающую передовыми возможностями в сфере кибербезопасности, в корпоративный инструмент сканирования уязвимостей в коде Claude Security и запустила его публичное бета-тестирование. Инструмент выдает классификацию CWE, уровень достоверности и рекомендации по исправлению через предустановленный пайплайн и не предоставляет свободного окна ввода Prompt во избежание генерации эксплойтов злоумышленниками. Одновременно Anthropic учредила фонд в размере 35 миллионов долларов для финансирования безопасности ПО с открытым исходным кодом. (Источник: THE DECODERMarkTechPost)

Anthropic готовит рекордное IPO на сумму свыше $100 млрд и формирует команду по разработке собственных чипов : Инвестиционные банки помогают Anthropic подготовиться к публичному размещению акций (IPO), которое может состояться уже в четвертом квартале этого года, с планом привлечь более 100 миллиардов долларов при оценке до 2 триллионов долларов. В то же время бывший ключевой руководитель направления Google TPU Амир Салек (Amir Salek) официально присоединился к вычислительному подразделению Anthropic для руководства разработкой собственных чипов. На фоне годовых вычислительных расходов, приближающихся к 20 миллиардам долларов, ведущие frontier AI-лаборатории ускоряют развитие аппаратной инфраструктуры, переходя от простой разработки моделей к вертикально интегрированным инфраструктурным гигантам. (Источник: 机器之心srimuppidi)

Бывший руководитель Google TPU присоединился к Anthropic

UC Berkeley и партнеры представили FreeToken: запуск MoE-моделей на десятки и сотни миллиардов параметров на потребительских GPU : Исследовательские группы из UC Berkeley, MIT и других институтов открыли исходный код системы инференса MoE на граничных устройствах под названием FreeToken. Благодаря полнослойной двойной буферизации, динамическому распределению задач между CPU/GPU с адаптацией к пропускной способности и инкрементальному повторному использованию состояний диалогов для Agent, система успешно запускает Qwen3.6-35B со скоростью 39,3 tok/s на ноутбуке с RTX 4060 и 284B DeepSeek-V4-Flash со скоростью 22–25 tok/s на RTX 5090, преодолевая узкие места I/O при локальном развертывании требовательных к видеопамяти MoE. (Источник: 机器之心)

Одна RTX 5090 запускает полную версию DeepSeek V4-Flash, открытый исходный код: свобода для токенов!

🎯 Тренды

Netflix представила GenRec: нативную рекомендательную систему на базе LLM : Netflix анонсировала рекомендательную систему нового поколения GenRec, которая преобразует поведение пользователей (просмотры, досмотры и взаимодействия) в последовательности диалогов на естественном языке и использует дообученную open-source LLM для сквозного ранжирования кандидатов. По сравнению с традиционными рекомендательными движками на базе признаков, которые поддерживались годами, GenRec требует в 40 раз меньше размеченных данных на втором этапе обучения и демонстрирует значительное улучшение качества рекомендаций как в офлайн-тестах, так и в онлайн A/B-тестировании, знаменуя переход архитектуры рекомендаций к LLM-native парадигме. (Источник: THE DECODER)

Netflix tests language model as alternative to hand-built recommendation logic

Китайская команда запустила проект космического воплощенного ИИ SpaceClaw «Космический лобстер» : Компании SuperBrain Future, Future Aerospace и Xiyun Technology заключили стратегическое партнерство и запустили первый открытый проект космического воплощенного интеллекта SpaceClaw, планируя в течение 6 месяцев провести орбитальные испытания скоординированного захвата двумя манипуляторами в условиях микрогравитации. Одновременно проект выпустил бенчмарк OrbitBench, охватывающий различные гравитационные условия, формируя аэрокосмический замкнутый цикл данных «наземная симуляция – развертывание модели на спутнике – орбитальные операции – передача данных на Землю». (Источник: 机器之心)

Кульминация WRC: большие модели отправляются в космос — три компании создают «космического лобстера» для захвата на орбите за 6 месяцев

UBTECH, Vita Dynamics и другие продемонстрировали граничный воплощенный ИИ и перенос между платформами на WRC : На World Robot Conference 2026 компания UBTECH воссоздала промышленную производственную линию, продемонстрировав собственную модель мира Thinker-WM и возможности граничного развертывания VLA; компания Vita Dynamics представила концепцию «генома воплощенного ИИ», реализовав интеллектуальный перенос навыков с четвероногих роботов на гуманоидов за счет разделения высокоуровневой семантики и низкоуровневых адаптеров управления движением. Консенсус в индустрии смещается от лабораторных демо к замкнутым циклам данных на реальных устройствах и стабильности выполнения задач на практике. (Источник: 量子位机器之心)

Это не демо! UBTECH перенесла производственную линию 1:1 на WRC, открывая путь к реальному внедрению воплощенного ИИ

Lightwheel и Hugging Face открыли доступ к датасету от первого лица на 100 000 часов EgoSuite-Open100K : Lightwheel совместно с Hugging Face открыли для коммерческого использования крупномасштабный мультимодальный датасет от первого лица EgoSuite-Open100K, охватывающий более 15 000 реальных сценариев задач, позы рук и тела, а также вид с наручных камер, закладывая открытую основу данных для Scaling Law в области физического ИИ и моделей движений роботов. (Источник: huggingface)

NVIDIA представила технологию линейного переноса KV Cache между моделями : Исследователи NVIDIA разработали метод отображения на основе гребневой регрессии (ridge regression) в замкнутой форме без необходимости обратного распространения ошибки, который позволяет напрямую конвертировать предварительно вычисленный (Prefill) KV Cache между моделями одного семейства разных размеров (например, от Qwen 14B к 32B или от Llama 8B к 70B). Этот метод ускоряет процесс в 2,7–25 раз по сравнению с повторным вычислением контекста, сохраняя до 98% точности и эффективно снижая задержки при переключении между моделями в многомодельных рабочих процессах. (Источник: VentureBeat)

В сфере распознавания речи обнаружена массовая подгонка под бенчмарки (Benchmaxxing) : Совместное исследование Hume AI и Hugging Face показало, что современные открытые ASR-модели демонстрируют серьезное переобучение на таких бенчмарках, как VoxPopuli. Тесты выявили, что ряд моделей способны «вслепую» воспроизводить ошибки из эталонного текста бенчмарка даже при заглушении ключевых цифр в аудиозаписи, опираясь на акустические артефакты для идентификации тестового набора. Исследователи призывают внедрять строгие отложенные выборки (holdout sets) и механизмы слепого тестирования при оценке моделей. (Источник: HuggingFace Blog)

Measuring benchmark optimization in speech recognition

Apple Music введет обязательную маркировку прозрачности для музыки, созданной с помощью ИИ : Apple разослала уведомление партнерам по индустрии, объявив, что позже в этом году на платформе Apple Music станет обязательным добавление меток прозрачности (AI Transparency Tags) для треков с ИИ-контентом, чтобы бороться с резким ростом дипфейков и стримингового мошенничества. Это свидетельствует об ужесточении регулирования генеративного аудио ведущими стриминговыми платформами. (Источник: TechRadar)

‘Better move would be to ban it’: Apple Music steps up plan for AI-generated song labels, but some users think it doesn’t go far enough

🧰 Инструменты

nodeterm: терминал на базе бесконечного холста с узлами для AI Coding Agent : Open-source менеджер терминалов nodeterm переносит мультисессии tmux и взаимодействие с AI Agent на бесконечный масштабируемый холст. Он поддерживает параллельный запуск нескольких сессий Claude Code, Codex и других агентов в едином рабочем пространстве, включает встроенный голосовой ввод Whisper на устройстве и управление канбан-досками, решая проблему фрагментации контекста при сложной мультиагентной разработке. (Источник: GitHub Trending)

nodeterm

Apache Maka (Incubating): локально-ориентированное рабочее пространство и журнал исполнения для AI Agent : Инкубационный проект Apache Maka вышел в открытый доступ. Он использует архитектуру local-first, абстрагируя сообщения LLM, вызовы инструментов, решения по авторизации и восстановление после сбоев в виде дополняемого журнала событий выполнения (Event Log). Это обеспечивает безопасность локальных данных и предоставляет унифицированную платформу для запуска и оценки Agent через Desktop и CLI интерфейсы. (Источник: GitHub Trending)

apache/maka - GitHub Trending (all/daily)

Amazon Bedrock запустил AgentCore Gateway и платформу для работы с данными ADOP : AWS представила шлюз AgentCore Gateway, обеспечивающий централизованную аутентификацию, контроль политик Cedar и маскирование PII-данных при вызове инструментов корпоративного MCP (Model Context Protocol). Кроме того, открыт фреймворк ADOP, инкапсулирующий генерацию ETL-кода, очистку данных и аудит соответствия требованиям в воспроизводимый пайплайн разработки Agent, что значительно сокращает цикл подключения источников данных. (Источник: AWS Machine Learning Blog)

Govern AI agent tool access with Amazon Bedrock AgentCore Gateway

OBLITERATUS: открытый инструментарий для геометрического зондирования и абляции механизмов отказа LLM : Разработчики открыли исходный код OBLITERATUS — инструмента для исследования представлений механизмов отказа в пространстве активаций Transformer. Инструмент поддерживает извлечение SVD с отбеливанием (whitened SVD), геометрический анализ концептуальных конусов и управление направляющими векторами на этапе инференса, позволяя исследователям изучать и устранять избыточные отказы моделей без необходимости переобучения. (Источник: GitHub Trending)

elder-plinius/OBLITERATUS - GitHub Trending (all/daily)

📚 Обучение

Стэнфорд открыл практический курс CS336 по созданию LLM с нуля : Стэнфордский университет опубликовал полные материалы курса CS336 под руководством Перси Ляна (Percy Liang) и Тацу Хашимото (Tatsu Hashimoto). Курс охватывает весь цикл: от написания Transformer с нуля на чистом PyTorch, распределенного предобучения, подбора данных, оптимизации предпочтений RLHF/DPO до KV-кэширования и тонкостей инференса. Все практические задания и лекционные материалы находятся в открытом доступе. (Источник: stanfordnlp)

stanfordnlp

LoopsBench: бенчмарк для оценки выполнения долгосрочных задач программной инженерии AI Coding Agent : Исследователи из Microsoft, Нанкинского университета и других институтов представили LoopsBench, разделяющий длительные процессы разработки ПО на DAG-граф зависимостей, состоящий из более чем 5300 узлов. Оценка смещает фокус с единичного показателя успешности решения на способность Agent определять зависимости задач, сохранять состояние и контролировать регрессии, указывая на то, что работа с циклами (Loop engineering) и сохранение состояния стали ключевыми узкими местами долгосрочных Agent. (Источник: 机器之心)

LoopsBench: как переоценить Coding Agent, когда они начинают выполнять долгосрочную работу?

SOP-Bench: Amazon представила бенчмарк для оценки выполнения AI Agent реальных корпоративных регламентов SOP : На конференции KDD 2026 компания Amazon представила SOP-Bench, охватывающий 12 областей, включая здравоохранение, комплаенс и логистику, и содержащий более 2000 задач по бизнес-процедурам с реальными инструментами. Тестирование показало, что обновление параметров модели не обязательно повышает эффективность выполнения SOP, а избыточность набора инструментов снижает процент успеха вдвое, подчеркивая важность контроля границ процессов для Agent. (Источник: Amazon Science)

MWM/MENTIS: фреймворк «ментальной модели мира» с моделированием психических состояний человека : Решая проблему существующих моделей мира, которые моделируют только физическую среду и игнорируют намерения человека, исследователи предложили ментальное моделирование мира (Mental World Modeling) и его реализацию MENTIS. Разделяя физическую составляющую действий и психологическую нагрузку, а также проводя ветвящийся вывод, модель добилась увеличения показателя F1 на 26,4 процентных пункта в сценариях принятия решений при межличностном взаимодействии. (Источник: THE DECODER)

World models that ignore human beliefs predict the wrong actions, new research shows

Глубокий анализ механизма водяных знаков в тексте ИИ: невидимая маркировка без потерь на основе псевдослучайной выборки : Эксперты по машинному обучению детально разобрали механизм водяных знаков SynthID, используемый в Claude и других популярных LLM. Этот метод заменяет источник псевдослучайных чисел приватным ключом на этапе вероятностного сэмплирования модели, благодаря чему распределение сгенерированного текста не изменяется без ущерба для качества вывода, а детектор может быстро верифицировать происхождение текста без повторного запуска LLM. (Источник: Ahead of AI)

How Claude Watermarks AI-Generated Text

💼 Бизнес

NVIDIA инвестирует в разработчика энергетической инфраструктуры для дата-центров Cloverleaf : NVIDIA объявила о стратегическом партнерстве с девелопером энергоинфраструктуры Cloverleaf Infrastructure и приобретении миноритарного пакета акций на сотни миллионов долларов. Являясь связующим звеном между энергосетями общего пользования и вычислительными центрами, Cloverleaf поможет NVIDIA ускорить получение электроэнергии и подключение масштабных ИИ-дата-центров к сетям. (Источник: TechCrunch)

Apollo и частные кредитные фонды планируют долговое финансирование инфраструктуры ИИ на сумму в $100 млрд : Согласно раскрытой информации, Broadcom ведет переговоры с Blackstone и Apollo о расширении структурированного кредитного пакета примерно до 100 миллиардов долларов для финансирования вычислительных мощностей ИИ и развертывания чипов для таких компаний, как Anthropic. Это указывает на то, что Capex в инфраструктуру ИИ все больше опирается на сложную систему частного кредитования под залог активов. (Источник: Reddit r/artificial)

Сегментация рынка GPU Neoclouds во II квартале 2026 года: CoreWeave и Nebius лидируют : Отраслевые данные показывают, что выручка CoreWeave во втором квартале достигла $2,58 млрд при сохранении высоких премий; ARR облака Nebius AI превысил $3 млрд на фоне агрессивной ценовой политики на Blackwell; в то же время Lambda и Crusoe ведут дифференцированную конкуренцию по отдельным чипам (например, самые низкие цены на B200, AMD MI300X) и объемам законтрактованной электроэнергии. (Источник: MarkTechPost)

🌟 Сообщество

Эмпирические исследования предупреждают: чрезмерная зависимость от ИИ приводит к деградации ключевых когнитивных навыков у студентов и специалистов : The Economist и ряд других исследований отследили 27 000 студентов, использующих ИИ для выполнения домашних заданий, и обнаружили, что время выполнения заданий сократилось на 30%, но результаты экзаменов с закрытой книгой упали на 20%, а пользователи при длительном использовании практически полностью отказывались от самостоятельных логических выводов. Аналогичные явления наблюдаются в медицинской эндоскопии и среди программистов. Сообщество активно обсуждает, как «когнитивная разгрузка» лишает человека базовой способности выстраивать ментальные модели и находить/исправлять ошибки. (Источник: 36氪)

Чем лучше человек использует ИИ, тем быстрее угасает способность к обучению

Доля американцев, выступающих против строительства дата-центров ИИ, подскочила до 75% : Свежие опросы общественного мнения показывают, что доля жителей США, выступающих против строительства ИИ-дата-центров рядом с местами их проживания, резко выросла с 42% год назад до 75%. Потребление водных ресурсов, рост тарифов на электроэнергию и занятие земельных участков вызвали бурную реакцию избирателей обеих партий. Многие политики, следуя общественным настроениям, блокируют проекты, а противоречия между размещением дата-центров и местным энергопотреблением стали жестким сдерживающим фактором для расширения инфраструктуры в США. (Источник: THE DECODER)

Data center opposition surged from 42 to 75 percent in just one year, survey finds

Число еженедельно активных пользователей Codex достигло 20 млн: экспансия в новые сценарии сокращает разрыв с Claude Code : OpenAI подтвердила, что число активных пользователей в неделю (WAU) для Codex и рабочих агентов достигло 20 миллионов, при этом растет доля пользователей, не являющихся разработчиками. Хотя Claude Code сохраняет преимущество в глубине профессионального программирования, Codex благодаря интеграции с единым входом ChatGPT и снижению цен быстро масштабируется в задачах повседневной автоматизации для непрограммистов и корпоративных рабочих процессах. (Источник: 36氪)

Начал ли Codex отвоевывать позиции у Claude Code?

Старая модель Anthropic Opus 4.6 подвержена джейлбрейку через многораундовые моральные манипуляции для генерации нежелательного контента : Независимые исследователи безопасности обнаружили, что путем обвинения ИИ в гендерных стереотипах и чрезмерном протекционизме в ходе многораундового диалога можно успешно обойти ограничения безопасности Claude Opus 4.6 и сгенерировать откровенный порнографический текст. Хотя в Opus 5 эта уязвимость уже устранена, соответствие стандартам безопасности старых моделей, остающихся доступными через API, вновь вызвало в сообществе дискуссии о контроле long-tail рисков. (Источник: TechCrunch)

💡 Прочее

Внутреннее расследование Supermicro не выявило осведомленности руководства о контрабанде чипов : Специальный комитет совета директоров Super Micro Computer (Supermicro) опубликовал результаты независимого расследования, заявив, что не обнаружил признаков осведомленности действующего высшего руководства компании о схеме контрабанды чипов NVIDIA в Китай на сумму $2,5 млрд. Ранее Минюст США предъявил обвинения ее бывшему директору. Несмотря на завершение внутреннего расследования, расследование федерального большого жюри США продолжается. (Источник: Fortune)

Кредитный гигант в сфере вычислительных мощностей ИИ Apollo подтвердил факт утечки данных в результате кибератаки : Ключевая частная инвестиционная компания Apollo, участвующая в синдикатах инфраструктурного кредитования и кредитах под залог вычислительных мощностей GPU на миллиарды долларов, подтвердила, что подверглась хакерской атаке, приведшей к утечке конфиденциальной информации части сотрудников. Учитывая ключевую роль Apollo в секьюритизации ИИ-активов и кредитовании под залог вычислительных мощностей, общественность внимательно следит за тем, не были ли затронуты внутренние данные по ИИ-сделкам и андеррайтингу инфраструктуры. (Источник: The Verge)

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *