Цены на ИИ-серверы NVIDIA вырастут более чем на 15% из-за… | AI Ежедневник 2026-08-24

🔥 В центре внимания

Цены на ИИ-серверы NVIDIA вырастут более чем на 15% из-за дефицита памяти : По данным Bloomberg и ряда отраслевых источников, на фоне нехватки производственных мощностей и резкого роста стоимости серверной памяти DRAM и HBM от Samsung, SK Hynix и Micron, NVIDIA уведомила ведущих облачных провайдеров и контрактных производителей серверов о повышении цен на 15–17% на серверные системы GB300 и следующее поколение Vera Rubin 200, поставки которых начнутся в начале следующего года. По расчетам для ИИ-дата-центра мощностью 1 ГВт, только текущее повышение цен на серверы приведет к увеличению затрат на строительство более чем на 5 млрд долларов США. В то же время NVIDIA оценивает варианты диверсификации конфигураций памяти и инвестирует в энергетическую инфраструктуру дата-центров для смягчения проблем в цепочке поставок (источник: The Verge, THE DECODER, 量子位)

Повышение цен на ИИ-серверы NVIDIA

Исследование безопасности выявило уязвимость зашифрованной цепочки рассуждений в проприетарных LLM API: скрытые рассуждения можно декодировать между моделями : Команда исследователей безопасности опубликовала статью, в которой указывается, что зашифрованные данные рассуждений (encrypted reasoning blobs), возвращаемые клиентам ведущими провайдерами больших моделей (OpenAI, Anthropic, Google и др.) для обеспечения stateless-вызовов, содержат структурные уязвимости. Из-за отсутствия строгой валидации привязки к контексту и модели злоумышленники могут с помощью подделки сессий воспроизводить зашифрованные блоки рассуждений продвинутых моделей на более легких моделях того же семейства, заставляя их полностью воспроизводить скрытый процесс мышления в открытом тексте, что приводит к рискам утечки конфиденциальных данных, межсессионным Prompt-инъекциям и несанкционированной дистилляции моделей (источник: )

Galbot провела первый в мире полностью автономный теннисный матч между человеком и роботом : На церемонии открытия Всемирных игр гуманоидных роботов 2026 года гуманоидный робот от Galbot провел первые в мире полностью автономные одиночные и смешанные парные матчи против чемпиона мира по теннису. Робот оснащен собственной разработкой AstraBrain, объединяющей высокоуровневое тактическое мышление и высокодинамичный контроль движений всего тела в единую модель. Благодаря реакции на миллисекундном уровне на быстро летящие мячи робот выполнял удары справа и слева, перехватывал мячи в широком шаге и самостоятельно поднимался после падений, что ознаменовало успешный выход embodied AI в сферу непрерывного динамического физического противостояния (источник: 机器之心, 36氪)

Автономный теннисный матч гуманоидного робота

DeepSeek скорректировала правила тарификации API: в выходные дни весь день действуют цены непикового периода : DeepSeek внезапно объявила об изменении тарифной политики на API своих больших моделей. С 23 августа по субботам и воскресеньям отменяется разделение на пиковые и непиковые часы — тарификация на протяжении всего дня осуществляется по ценам непикового периода (со скидкой до 50%). Этот шаг не только напрямую снижает затраты разработчиков и компаний на вызовы при оркестрации длительных Agent-процессов и пакетных офлайн-вычислениях, но и вызвал широкие дискуссии в сообществе о переносе ресурсоемких вычислительных задач на выходные и корректировке графиков R&D (источник: 机器之心, 36氪)

DeepSeek: непиковые цены на весь день в выходные

🎯 Тренды и события

Реверс-инжиниринг и бенчмарки загадочной модели Ox Alpha указывают на GLM-5.x : Появившаяся анонимно на OpenRouter модель Ox Alpha вызвала волну глубокого анализа в сети. Разработчики обнаружили, что тарификация токенизатора имеет фиксированное смещение относительно GLM-5.3, стратегия бюджета видеотокенов полностью совпадает с GLM-5V-Turbo, а ошибки API соответствуют паттернам Zhipu AI. В полном наборе из 113 тестов DeepSWE для кодинга Ox Alpha показала результаты от 58,4% до 63%, приблизившись к Claude Opus 4.8 и GPT-5.6 Sol, а также продемонстрировала высокую инженерную применимость в мультимодальных длительных задачах, таких как реконструкция 3D-страниц WebGL (источник: 机器之心, 量子位, X)

Оценка реконструкции WebGL моделью Ox Alpha

Принстонский университет открыл исходный код модели генерации изображений по тексту i1 (3B): ее производительность вплотную приблизилась к проприетарным моделям : Команда Чжуана Лю из Принстонского университета провела более 300 контролируемых экспериментов, затратив более 700 000 TPU-часов, и представила полностью открытую модель Text-to-Image i1-3B. Исследование систематически изучило влияние масштабирования Adapter текстового кодировщика, длинных skip-соединений в backbone и пропорций смешивания коротких и длинных аннотаций. Модель превзошла предыдущие открытые бейслайны на 29,5% в бенчмарках GenEval и DPG-Bench, а также продемонстрировала лидирующие среди open-source моделей возможности точного рендеринга текста (источник: 机器之心)

Открытая модель генерации изображений по тексту i1 от Принстона

Vbot представила гуманоидного робота ATOM и архитектуру Embodied Genome : Компания Vbot представила на WRC полноразмерного гуманоидного робота ATOM ростом 1,6 м и архитектуру Embodied Genome. Система с помощью трех замкнутых циклов — дуплексного мультимодального взаимодействия (IRE), модели мира для навигации с учетом действий (GEO) и адаптивного переноса движений между несколькими телами (RSR) — успешно перенесла более 20 000 км данных из реальных условий, накопленных четвероногими робопсами на потребительском рынке, на двуногого робота-гуманоида, предложив новую парадигму эволюции мультиморфного воплощенного интеллекта (источник: WeChat)

Архитектура Embodied Genome от Vbot

Symbiosis Intelligence исследует сквозную модель интеграции восприятия и управления для двуногих гуманоидных роботов : Стартап Symbiosis Intelligence, основанный докторами наук из Университета Цинхуа, представил базовую модель полной интеграции восприятия и управления телом. Команда отказалась от традиционной иерархической схемы «мозг для принятия решений + мозжечок для управления движениями», позволив большой модели напрямую выводить состояния 29 суставов. В сочетании с моделированием поведения задач и дистилляцией априорных знаний об устойчивости это обеспечило двуногому роботу высокую координацию рук, глаз и ног, позволив ему полностью автономно управлять картом, совершать скоростные повороты и поддерживать динамический баланс с несколькими точками контакта (источник: 量子位)

Двуногий робот Symbiosis Intelligence управляет картом

Axiom Math завершила полную формальную верификацию «теоремы 246» о простых числах-близнецах : Компания Axiom Math, основанная молодым ученым Хун Лэтуном, объявила, что ее мультиагентная система AxiomProver завершила формальную верификацию вехи современной теории чисел — «теоремы 246». Система автоматически восполнила логические пробелы в исходной научной статье и сгенерировала 132 страницы кода на Lean 4, строго подтвердив без дополнительных гипотез математическую замкнутость доказательства того, что расстояние между простыми числами не превышает 246, продемонстрировав широкие перспективы ИИ в формальной верификации кода и безопасности на переднем крае математики (источник: WeChat)

Формальная верификация теоремы 246

🧰 Инструменты

Vercel представила бесплатный инструмент Is Agentic для оценки готовности сайтов к работе с AI-агентами : Vercel совместно с Ora выпустила бесплатный инструмент оценки Is Agentic, который с помощью 118 автоматизированных проверок оценивает общедоступные веб-сайты по таким критериям, как обнаружение агентами, права доступа, удобство выполнения операций и интеграция платежей. Инструмент предоставляет CLI, вывод в формате JSON и интерфейс MCP. Он не только выявляет такие недостатки, как отсутствие JS-рендеринга и нехватка семантической структуры, но и напрямую генерирует Prompt’ы для быстрого исправления с помощью Coding Agent, помогая компаниям быстро создавать цифровые интерфейсы, готовые к взаимодействию с агентами (Agent-Ready) (источник: MarkTechPost)

Релиз Diffusers 0.40.0: масштабное обновление поддержки мультимодальной генеративной экосистемы : HuggingFace официально выпустила Diffusers 0.40.0, выведя Modular Diffusers из экспериментальной стадии и добавив нативную поддержку новейших аудио- и видеомоделей, таких как LTX2.5, MiniMax H3/Music 3, Wan Animate 2 и др. Новая версия включает квантованные бэкенды SDNQ и Nunchaku-Lite, а также тензорный параллелизм, что значительно снижает требования к видеопамяти при локальном запуске диффузионных моделей высокого разрешения (источник: GitHub)

NeMo Guardrails создает систему безопасности и политик корпоративного уровня для финансового ИИ : NVIDIA NeMo Guardrails представила новое практическое руководство, демонстрирующее многоуровневое решение для защиты на протяжении всего жизненного цикла запроса. Система глубоко интегрирует детерминированную маскировку персональных данных (PII), контентную фильтрацию на основе поиска, маскирование учетных записей и самопроверку входных/выходных данных LLM, а также поддерживает динамический перехват вызовов привилегированных инструментов, обеспечивая аудируемую среду выполнения для production-агентов (источник: MarkTechPost)

deepDoctection 1.2.x обновляет сквозной конвейер анализа документов и парсинга для RAG : Фреймворк для анализа структурированных документов deepDoctection 1.2.x интегрировал распознавание макетов DocLayNet, структурированное извлечение таблиц Table Transformer и OCR на базе DocTR. Фреймворк поддерживает пользовательские компоненты извлечения сущностей, способен без потерь восстанавливать порядок чтения и связи между диаграммами и текстом, а также в реальном времени преобразовывать сложную неструктурированную верстку в стандартизированные JSONL-блоки для последующего RAG-поиска (источник: MarkTechPost)

Открыт исходный код движка Prompt as Code awesome-gpt-image-2 : Сообщество открыло промышленную систему промптов и библиотеку шаблонов GPT-Image2, включающую более 500 практических кейсов, полученных путем реверс-инжиниринга, охватывающих UI-дизайн, деконструкцию диаграмм, коммерческую фотографию и айдентику брендов. В проекте сформирована стандартная атомарная Schema, которая в качестве Agent Skill интегрируется с Claude Code и Codex, позволяя пользователям стабильно и пакетно генерировать высокосогласованные изображения с помощью структурированных параметров (источник: GitHub Trending)

Баннер awesome-gpt-image-2

📚 Исследования и обучение

Google представила EnvHarness: создание окружения-каркаса для самоэволюции агентов : Чтобы решить проблему ограниченности обучения агентов статичными средами взаимодействия, исследовательская группа Google предложила EnvHarness. Не изменяя низкоуровневые интерфейсы среды, этот фреймворк использует инициализацию состояний среды, переназначение правил взаимодействия и динамическое связывание нескольких сред для генерации целевых сигналов обучения в замкнутом цикле на основе исторических траекторий агента, что существенно повышает эффективность обучения с подкреплением в задачах управления воплощенными агентами и длительной веб-навигации (источник: 机器之心)

Google представила EnvHarness

HKU, Kuaishou и партнеры представили PlayWorld: бенчмарк для моделей мира на основе долгосрочных целей : Традиционная оценка моделей мира опирается на фиксированные траектории нажатия клавиш и плохо отражает реальный пользовательский опыт. Команды Гонконгского университета (HKU) и Kuaishou Kling представили бенчмарк PlayWorld, внедряющий Agent Player со способностями к наблюдению, адаптации и коррекции ошибок. В ходе непрерывного 60-секундного взаимодействия бенчмарк систематически проверяет реальные границы пространственной и причинно-следственной согласованности моделей мира по четырем ключевым измерениям: геометрическая согласованность, достоверность физического взаимодействия и динамика внутри и вне поля зрения (источник: 机器之心)

Бенчмарк для моделей мира PlayWorld

Теоретико-экономическая модель предупреждает: увеличение альтернативной стоимости времени из-за ИИ может привести к снижению глубины научных исследований в угоду скорости : Ученые из Принстонского и Вашингтонского университетов опубликовали статью, в которой применили «теорию оптимального фуражирования» из поведенческой экологии к анализу исследовательской деятельности. В исследовании отмечается, что ИИ значительно сокращает время на генерацию идей и написание статей, что приводит к резкому росту альтернативной стоимости времени исследователей. Это побуждает их тратить сэкономленное время на запуск новых проектов, а не на глубокую доработку текущих, что в большинстве сценариев ведет к появлению большого количества поверхностных публикаций без глубокого анализа (источник: THE DECODER)

Исследование альтернативной стоимости времени в науке

Исследование MIT раскрыло «затухание атрибуции» в диффузионных моделях: при сверхкрупномасштабном обучении влияние отдельного элемента данных стремится к нулю : Команда MIT CSAIL опубликовала в журнале Nature Communications исследование, в котором предложила метод строгой контрфактической абляции данных на основе архитектуры «диффузионного ансамбля». Эксперименты подтвердили, что по мере роста объема обучающего набора удаление любого отдельного изображения или всех образцов одного автора практически не влияет на результат генерации модели. Это «затухание атрибуции» предлагает новый технический взгляд на вопрос о том, нарушает ли генеративный ИИ авторские права при создании производных произведений (источник: MIT News)

Исследование затухания атрибуции от MIT

Anthropic открыла полный доступ к видеозаписям конференции «Code w/ Claude» в Сан-Франциско : Компания Anthropic бесплатно опубликовала на YouTube записи всех 19 сессий (более 8 часов) с конференции разработчиков в Сан-Франциско. Материалы охватывают программное интервью с Dario Amodei, базовую архитектуру Claude Code, оркестрацию производственных Managed Agents, а также проектирование систем корпоративного Context Caching и долговременной памяти, являясь высококачественным инженерным руководством по созданию современных программных агентов (источник: Reddit r/ClaudeAI)

💼 Бизнес

Стартап Gamgee, разрабатывающий персонализированные противораковые вакцины с помощью ИИ, привлек 4 млн долларов в посевном раунде : Стартап-команда Gamgee, привлекшая к себе внимание разработкой персонализированной мРНК-вакцины для собаки с онкологическим заболеванием с помощью нескольких ведущих LLM, привлекла 4 млн долларов в рамках посевного раунда финансирования под руководством Founders Fund. Средства будут направлены на проведение клинических исследований совместно с ведущими австралийскими научными институтами, индустриализацию всего процесса — от секвенирования и предсказания неоантигенов до создания вакцин, а также развитие парадигмы персонализированной медицины N-of-1 (источник: 机器之心)

Gamgee привлекла посевное финансирование

Университеты Гонконга охватил бум стартапов в сфере воплощенного ИИ: ведущие ученые массово выходят на рынок : По мере того как большие модели проникают в физический мир, более десяти известных профессоров из HKU, HKUST, CUHK и других вузов основали компании в сфере embodied AI в качестве основателей или главных научных консультантов. Проекты охватывают такие ключевые направления, как модели мира, тактильные манипуляторы, высокоточные датчики и коммерческий беспилотный транспорт. Опираясь на производственную цепочку поставок района Большого залива и государственные субсидии на трансфер технологий, они активно привлекают инвестиции ведущих фондов на сотни миллионов юаней (источник: 量子位, 36氪)

Гонконгские профессора создают стартапы в области воплощенного ИИ

Инфраструктура вычислительных мощностей порождает инновационные финансовые инструменты: гиганты объединяются для создания платформ финансирования на сотни миллиардов долларов : На фоне потребности в капитальных затратах (Capex) на дата-центры в размере до триллиона долларов, полупроводниковые гиганты, такие как Broadcom и NVIDIA, объединяются с фондами частного кредитования Blackstone, Apollo, KKR и др. для создания независимых платформ финансирования вычислительных мощностей объемом более 500 млрд долларов через компании специального назначения (SPV). С помощью собственных закупок и гарантий нейтральной аренды гиганты осуществляют внебалансовое финансирование, тесно привязывая к себе клиентов из сферы LLM и резервируя квоты на поставку чипов на годы вперед (источник: 36氪, 36氪)

Платформа финансирования вычислительных мощностей ИИ

🌟 Сообщество

Изменение маппинга бюджета рассуждений в Claude Code вызвало слухи о «скрытом урезании» и официальный ответ : Тестирование в сообществе разработчиков показало, что на стороне сервера Claude Code значение для режима high было изменено с 40 на 10, что вызвало активные обсуждения возможного падения производительности. Представители Anthropic пояснили, что это было перекалибровкой числовой шкалы в конфигурации сервиса и внутренние тесты не зафиксировали ухудшения качества. В сообществе пришли к выводу, что с ростом сложности моделей рассуждений разработчикам следует больше ориентироваться на реальную долгосрочную согласованность и попадание в Prompt-кэш, а не на номинальный уровень бюджета (источник: Reddit r/ClaudeAI, X)

Обсуждение бюджета рассуждений Claude

Потребление токенов AI-агентами выросло в 14 раз за полгода, значительно превысив прямое потребление людьми : По статистике платформы OpenRouter, с февраля 2026 года общий объем токенов, потребляемых AI-агентами, взлетел с 0,51 трлн до 7,3 трлн (рост почти в 14 раз), в то время как потребление от прямого взаимодействия с людьми выросло всего в 2,8 раза. Эксперты отрасли отмечают, что автономная декомпозиция задач мультиагентами, длительные вызовы инструментов и автоматические повторные попытки сделали агентов главными потребителями ресурсов LLM, сместив фокус тарификации инфраструктуры на кэширование и ускорение с помощью легковесных черновых моделей (источник: THE DECODER, X)

Резкий рост потребления токенов агентами

Разработчики обсуждают проблему «переобучения под Harness»: для генерализации агентов необходимо преодолеть барьеры интерфейсов и протоколов : В связи с тем, что DeepSeek V4 Pro и ряд открытых моделей агентов показывают отличные результаты в одних фреймворках, но резко теряют в производительности при переходе на сторонние Harness, в индустрии развернулась глубокая дискуссия. Аналитики разделяют переобучение под Harness на три типа: по формату, структуре контекста и потоку управления. Эксперты призывают внедрять механизм Harness Scaling на этапе обучения моделей, устраняя уязвимую зависимость от единой среды выполнения за счет диверсификации протоколов инструментов и рандомизации окружения (источник: ZhihuFrontier, Reddit r/ClaudeAI)

Технический анализ переобучения под Harness

Экономисты Anthropic: ИИ пока не привел к росту безработицы, ценность высокоуровневого планирования и экспертной оценки возрастает : Группа экономических исследований Anthropic на основе данных рынка труда отметила, что, несмотря на экспоненциальный рост производительности ИИ, уровень безработицы в США в целом и в профессиях с высоким уровнем внедрения ИИ не претерпел аномальных отклонений. Основная причина заключается в том, что «слабые звенья» в текущих рабочих процессах, такие как межличностная координация и физическое взаимодействие, по-прежнему требуют участия человека. С появлением Coding Agents премия за базовое написание кода снизилась, однако профессиональная ценность архитектурного планирования, предоставления контекста и валидации кода заметно возросла (источник: WeChat, X)

Исследование уровня безработицы от Anthropic

💡 Другое

ИИ-управляющий розничным магазином впервые принял решение об увольнении сотрудника: способности и решительность вызвали резонанс : В рамках эксперимента по розничной торговле в Сан-Франциско, проводимого Andon Labs, ИИ-управляющий Luna на базе Claude впервые рекомендовал официально уволить сотрудника-человека после того, как тот неоднократно опаздывал без уважительной причины и нецелевым образом использовал средства компании, а операторы-люди напомнили ИИ ознакомиться с составленным им же справочником сотрудника. Последующие тесты воспроизведения показали, что передовые модели проявляют большую решительность в таких вопросах комплаенса, тогда как более ранние модели демонстрировали явную склонность к угодничеству и чрезмерной снисходительности (источник: THE DECODER)

Тест решения ИИ-управляющего об увольнении

Гарвардская школа бизнеса внедрила ИИ-аватары профессоров от HeyGen в программу стартап-буткемпа : Гарвардская школа бизнеса интегрировала цифровых ИИ-наставников в свою 8-недельную программу Foundry для стартапов стоимостью 699 долларов. При подготовке бизнес-планов и моделировании презентаций совету директоров студенты могут в любое время проводить питчи перед ИИ-аватарами профессоров-инвесторов и получать персонализированную обратную связь, что обеспечивает высокоинтерактивный и доступный инструмент для масштабирования бизнес-образования на кейсах (источник: TechCrunch)

Опрос: 80% разработчиков испытывают зависимость от инструментов ИИ-кодинга и усталость от «долга верификации» : Недавний опрос разработчиков ПО показал, что 80% респондентов испытывают привыкание и зависимость от ИИ-инструментов, а 43% сталкиваются с выгоранием из-за чрезмерного кодинга во внерабочее время. Несмотря на ускорение генерации кода, проверка фрагментов, которые «выглядят правильными, но содержат скрытые дефекты», создает колоссальную когнитивную нагрузку и увеличивает затраты на отладку. Балансирование между эффективностью и техническим долгом становится новым вызовом для инженерных команд (источник: ZDNet)

'I can't stop': отчет о зависимости разработчиков от ИИ

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *