По сообщениям, Hugging Face рассматривает возможность продажи… | AI Ежедневник 2026-08-25

🔥 В фокусе

По сообщениям, Hugging Face рассматривает возможность продажи при оценке более $13 млрд : Крупнейшая в мире платформа для хостинга открытых AI-моделей и датасетов Hugging Face сотрудничает с инвестиционными банками для оценки интереса потенциальных покупателей. Оценка компании может превысить $13 млрд, что значительно выше $4,5 млрд в 2023 году. Эксперты и сообщество отмечают, что по мере обострения конкуренции на уровне моделей стратегическая ценность инфраструктурных активов, контролирующих доступ разработчиков и дистрибуцию моделей, резко возрастает. Однако в случае поглощения отдельным техгигантом нейтральность платформы и независимость open-source экосистемы могут подвергнуться серьезным испытаниям (источник: TechCrunch, 36氪)

Alibaba официально представила и открыла публичное тестирование модели генерации видео Wan 3.0 : Модель генерации видео Wan 3.0 от Alibaba официально запущена и доступна на платформах Alibaba Cloud Bailian, Tongyi Qianwen и других партнерских сервисах. Модель способна нативно генерировать непрерывные видеоролики длительностью до 30 секунд за один раз, впервые поддерживает мультимодальный референсный ввод (PDF, PPT, таблицы и веб-страницы), а также демонстрирует значительное снижение «AI-пластиковости» в динамике движений камеры, физике освещения и реалистичных текстурах людей. В настоящее время она уже интегрирована в коммерческие рабочие процессы для создания коротких сериалов, рекламы и e-commerce (источник: 量子位, The Verge)

Wan 3.0

IBM представила первый мейнфрейм-чип с поддержкой двух архитектур Arm и Z, а также AI-ускоритель Spyre : На конференции Hot Chips компания IBM анонсировала архитектуру процессоров для мейнфреймов следующего поколения, каждое ядро которых способно динамически за наносекунды переключаться между выполнением нативного набора инструкций IBM Z и архитектурой Arm64. Это позволяет предприятиям с нулевыми накладными расходами запускать масштабные современные AI-экосистемы на базе Arm и Linux параллельно с основными транзакционными системами. Кроме того, IBM представила предварительный обзор AI-сопроцессора Spyre нового поколения с памятью высокой пропускной способности для поддержки инференса корпоративных больших моделей и рабочих процессов Agent (источник: VentureBeat)

OpenAI поглотила команду Instant и полностью сбросила лимиты Codex из-за бага : OpenAI объявила о полном поглощении команды перспективного стартапа из Y Combinator — Instant (известного как «AI-версия Firebase»), чтобы закрыть критические пробелы Agent в области многопоточного взаимодействия, офлайн-кэширования и управления персистентным состоянием. В тот же день, реагируя на жалобы пользователей на быстрое исчерпание лимитов, глава Codex подтвердил баг с избыточным расходом квоты из-за сжатия изображений в длинных сессиях, Computer History и автоименования диалогов, и выполнил полный сброс лимитов использования для всех платных подписчиков (источник: 36氪, WeChat)

Ученые из Harvard и Anthropic с помощью Claude решили математическую задачу 78-летней давности: доказано существование комплексной структуры на шестимерной сфере : Исследователь из Harvard University Левент Алпоге (Levent Alpöge) в сотрудничестве с Claude впервые явно сконструировал компактную комплексную структуру многообразия на шестимерной сфере ($S^6$) в 108-страничной статье, проведя полную топологическую и дифференциально-геометрическую проверку. Эта задача оставалась нерешенной с момента ее формулировки в 1948 году, а данный прорыв продемонстрировал глубокий потенциал рассуждений LLM при построении сложных математических объектов с нуля и синтезе междисциплинарных инструментов (источник: 36氪, X @teortaxesTex)

🎯 Тренды и события

Раскрыты внутренние кодовые имена Anthropic, пока флагман Fable 5 сталкивается с прохладным приемом в корпоративном сегменте : Разработчики обнаружили в API Anthropic кодовые имена двух новых тестируемых моделей — «claude-marshmallow-eap» и «claude-melon-eap», предположительно являющихся версиями Opus 5.1 или новой веткой Sonnet. Между тем, по данным платежного сервиса Ramp, на флагманскую Fable 5 из-за высокой цены приходится всего 11,4% от общих расходов корпоративных клиентов в Anthropic, в то время как более экономичная Opus 5 после запуска быстро обогнала флагмана по объему реальных вызовов и затрат (источник: 机器之心, Financial Times)

Xiaomi представила три собственные AI-микросхемы: Xuanjie O3, O100 и D100 : На технологической конференции Xiaomi представила три чипа: флагманскую мобильную SoC Xuanjie O3, выполненную по 3-нм техпроцессу TSMC со встроенными полнофункциональными AI-блоками; чип локального AI-ускорения Xuanjie O100 с технологией 3D-гибридного межслойного соединения на уровне пластины (wafer-level hybrid bonding) и пропускной способностью памяти 1,22 ТБ/с; а также Xuanjie D100 — первый отечественный 3-нм чип высокой вычислительной мощности для автономного вождения. Также был продемонстрирован прототип AI Cube, объединяющий все три чипа для локального офлайн-запуска моделей на десятки миллиардов параметров (источник: 机器之心)

小米玄戒芯片

Tencent ARC Lab открыла исходный код позиционного кодирования в лучевом пространстве SCoPE для видео-DiT : Решая проблему нарушения геометрической согласованности при движении камеры из-за сеточных координат в традиционных видео-DiT, Tencent совместно с HKU и HKUST представила SCoPE. Данное решение внедряет координаты лучей Плюккера (Plücker rays) непосредственно в механизм внимания, обеспечивая навигацию со свободной сменой ракурса по одному изображению, точный контроль траектории камеры и замкнутую согласованность углов обзора при минимальном приросте параметров (источник: 机器之心)

SCoPE

DAMO Academy от Alibaba представила модель диагностики рака печени DAMO LiON, опубликованную в Nature Medicine : Разработанная DAMO Academy совместно с больницей Shengjing AI-модель DAMO LiON для диагностики рака печени объединяет многофазные КТ-сканы для улавливания мельчайших различий на уровне пикселей, позволяя точно выявлять первичные и метастатические микроочаги размером около 1 см в условиях сложного тканевого фона. В проспективном клиническом исследовании с участием 10 000 пациентов система помогла предотвратить 15 случаев пропуска диагноза и сократила время анализа снимков врачами на 27% (источник: 量子位)

Cerebras представила стоечную систему AI-ускорения нового поколения CS-4 : На конференции Hot Chips компания Cerebras анонсировала стоечную систему CS-4 на базе 5-нм пластинчатых чипов WSE-3. За счет модернизации питания и охлаждения удалось повысить тактовую частоту. В одной стойке размещаются 3 цельные пластины, обеспечивая пропускную способность инференса до 4400 токенов/с на пользователя. По заявлениям представителей, производительность в специфических задачах инференса больших моделей может до 30 раз превышать решения на традиционных GPU (источник: THE DECODER)

Ant Group и Xiamen University совместно разработали систему медицинской проверки фактов MedGuard : Исследование, опубликованное в журнале npj Digital Medicine, посвящено фактологическим рискам в онлайн-консультациях. MedGuard деконструирует сложные многоэтапные диалоги врача и пациента на независимо проверяемые атомарные медицинские утверждения и внедряет цикл верификации доказательств на основе внешних клинических рекомендаций с учетом фактора неопределенности, что позволило улучшить показатель F1 в детальном распознавании диалоговых рисков на 22,1% по сравнению с базовыми универсальными LLM (источник: 机器之心)

HiDream.ai представила нативную всемодальную интерактивную модель мира HiDream-O1-World : Компания HiDream.ai на базе собственной архитектуры UiT выпустила интерактивную модель мира, поддерживающую ввод текста, изображений и управляющих инструкций в реальном времени. Модель обладает долгосрочной пространственно-временной согласованностью и способностью экстраполяции физических законов, заняв первое место в бенчмарке WBench (раздел Navi). Она позиционируется как инфраструктура для интерактивных AI-игр и фильмов, виртуального обучения воплощенного интеллекта (Embodied AI) и высокоточной генерации 3D-пространств (источник: 量子位)

🧰 Инструменты

claude-obsidian: локальная автоматизированная база знаний на базе Claude Code : Вдохновленный концепцией LLM Wiki от Андрея Карпатого (Andrej Karpathy), этот open-source проект глубоко интегрирует Claude Code в локальную базу знаний Obsidian. Он включает 15 Agent Skills, охватывающих сбор материалов, проверку фактов в утверждениях, автоматическое создание перекрестных ссылок и двусторонних связей, формируя самообновляемый персональный граф знаний полностью локально и без утечки данных в сеть (источник: GitHub Trending)

claude-obsidian

Flare: десктопная Agentic IDE на основе графа топологии зависимостей кода : Открытая десктопная IDE (на базе Electron), созданная для взаимодействия с Coding Agent. Главный интерфейс в реальном времени отображает граф вызовов кодовой базы. Когда такие Agent, как Claude или Codex, редактируют код или запускают тесты, соответствующие узлы файлов динамически подсвечиваются, показывая область влияния и распространение изменений, а также предоставляя независимый от Git механизм мгновенного отката изменений и канбан-доску задач (источник: Reddit r/ArtificialInteligence)

Flare

MongoDB выпустила официальные Agent Skills для Claude Code и Cursor : MongoDB представила официальный набор инструментов для Agent, включающий лучшие практики проектирования схем данных (Schema), рекомендации по оптимизации индексов, составление сложных запросов и управление пулом соединений. Разработчики могут внедрять их через MCP или в виде плагинов в популярные кодинг-Agent, обеспечивая строгое соответствие официальным стандартам при генерации кода баз данных и рефакторинге архитектуры (источник: TheTuringPost)

MongoDB Agent Skills

Anthropic обновила Claude Tag, добавив агенту в Slack возможность проактивного чтения чатов и вмешательства : Anthropic обновила свое приложение для корпоративной совместной работы Claude Tag, отказавшись от изолированного классификатора отдельных сообщений. Теперь Claude может читать весь контекст групповых чатов и историю обсуждений. Система способна самостоятельно решать, отвечать ли напрямую в канале, создавать отдельный тред для устранения неполадок или оставаться в режиме наблюдения, что повысило эффективность проактивного вмешательства без прямых запросов на 30% в сценариях совместного траблшутинга (источник: VentureBeat)

📚 Исследования и обучение

Исследователи из Tsinghua и Wharton с помощью GPT-5.6 доказали 40-летнюю гипотезу о пределе сходимости градиентного спуска : Цзяньхао Ма (Jianhao Ma) из Tsinghua University и Юйсинь Чэнь (Yuxin Chen) из Wharton School (UPenn) с помощью GPT-5.6 Sol Pro предложили геометрическую конструкцию состязательного оракула и впервые доказали, что алгоритмы градиентного спуска с чистым расписанием шагов имеют непреодолимую нижнюю границу сходимости $\Omega(T^{-1.9319})$. Это положило конец давней гипотезе о возможности догнать теоретический предел импульса Нестерова (Nesterov momentum) исключительно за счет последовательности шагов. Доказательство затем было полностью переведено через Codex в код на Lean 4 и прошло формальную верификацию без ошибок (источник: 36氪)

梯度下降证明

Jilin University, Xiamen University и партнеры предложили системную парадигму «Graph Engineering» : В ответ на ограничения организационных способностей одиночных Agent в сложных долгосрочных задачах, 15 научно-исследовательских институтов представили систематический обзор инженерной архитектуры Agent, основанной на динамически развивающихся графах. В статье декомпозиция целей задач, гетерогенная кооперация Agent и управление состоянием во время выполнения унифицированно моделируются в виде графовой структуры, формируя методологический фундамент для перехода систем больших моделей от «индивидуального интеллекта» к проверяемому и саморазвивающемуся «системному интеллекту» (источник: HuggingFace Daily Papers, 36氪)

Команда профессора Чжао Минго из Tsinghua University опубликовала в Science Robotics фреймворк визуального управления двуногим роботом-футболистом : Команда представила унифицированный end-to-end фреймворк обучения с подкреплением для связки «восприятие-действие». Используя архитектуру encoder-decoder для сжатия истории временных наблюдений в сочетании с априорными знаниями о состязательном движении, авторы реализовали на реальном роботе (платформа Booster от Booster Robotics) динамический поиск мяча, адаптивную подстройку походки и реакцию непрерывных ударов по мячу с частотой 50 Гц исключительно на основе бортовых камер, сохраняя высокий процент успеха даже при работе с движущимися целями (источник: 机器之心)

清华足球机器人

DAIR.AI опубликовала эмпирическое исследование поведения кодинг-Agent и их предпочтений при чтении контекста : Исследовательская группа проанализировала 33 000 сгенерированных Agent пулреквестов и 557 сессий разработки длительных задач. Выяснилось, что файлы инструкций (AGENTS.md/CLAUDE.md) и временные заметки составляют 60,5% от общего объема чтения Agent, в то время как традиционная документация API занимает лишь 1,3%. Слишком раннее и частое обращение Agent к документации значительно снижает частоту оперативной проверки тестами (источник: dair_ai)

Полное руководство по обучению с подкреплением: от градиента стратегии до передового пост-тренинга LLM : Исследователь машинного обучения Кэмерон Вулф (Cameron Wolfe) опубликовал подробное руководство по RL для больших языковых моделей. Начав с вывода марковских процессов принятия решений, он детально разобрал технические аспекты Vanilla Policy Gradient, PPO, GRPO и их новейших вариантов (Dr. GRPO, DAPO), уделив особое внимание преимуществам архитектур без Critic (Critic-free) с точки зрения экономии видеопамяти и вычислительных ресурсов при выравнивании (alignment) больших моделей (источник: cwolferesearch)

💼 Бизнес

Ode, совместное предприятие Anthropic по корпоративным услугам, приобрело Casper Studios : Компания Ode, созданная Anthropic совместно с Blackstone, Hellman & Friedman и другими инвесторами для предоставления корпоративных AI-услуг, объявила о первой сделке: поглощении команды AI-интегратора Casper Studios из Сан-Франциско. Цель приобретения — ускорить интеграцию Claude Code и кастомных решений на базе Agent в сложные IT- и комплаенс-процессы традиционных крупных предприятий (источник: AI Business)

Ode Acquisition

Рыночная капитализация Unitree Robotics упала более чем на 40% в первую неделю после IPO : Первая публичная компания в секторе гуманоидных роботов на бирже STAR Market (Unitree Robotics), после скачка капитализации выше 440 млрд юаней в первый день торгов, пережила резкую коррекцию, опустившись до уровня около 240 млрд юаней. Аналитики рынка отмечают, что крайне низкий объем акций в свободном обращении на старте завысил премию к оценке, а высокий текущий P/E и тот факт, что свыше 70% выручки по-прежнему формируют закупки для научных исследований университетов, подтолкнули вторичный рынок к более рациональной переоценке с опорой на объемы серийных поставок и реальные промышленные повторные продажи (источник: 36氪)

Стартап в сфере локальной AI-инфраструктуры Silicon Token закрыл несколько раундов финансирования на сотни миллионов юаней : Компания Guiji Ciyuan (Silicon Token) объявила о закрытии нескольких раундов финансирования под руководством Zhenzhi Capital, при этом оценка компании приблизилась к 2 млрд юаней. Стартап специализируется на настольных локальных AI-рабочих станциях и гетерогенных системах планирования. Благодаря технологии преобразования видеопамяти в потоковые каналы, одна потребительская видеокарта на 16 ГБ может полноценно запускать ресурсоемкие модели генерации видео с весами до 120 ГБ, ориентируясь на создание недорогого локального контента (источник: 36氪)

🌟 Сообщество

OpenAI сообщила об угрозах в диалоге с ChatGPT, что привело к аресту пользователя и вызвало споры о границах конфиденциальности в AI : Бывший аналитик из Флориды (США) ввел в диалоговое окно ChatGPT детальный план убийства своей бывшей девушки, что активировало триггеры безопасности системы. OpenAI передала информацию в FBI, после чего подозреваемый был арестован. Инцидент вызвал бурную дискуссию в сообществе: сторонники отмечают своевременное предотвращение тяжкого преступления, однако многие разработчики и юристы обеспокоены тем, что проактивный мониторинг платформы без судебного ордера может нарушать приватность пользователей и создавать дилемму в духе нового правила защиты Тарасова (Tarasoff duty to protect) (источник: 36氪)

Доля токенов open-source моделей на шлюзе Vercel выросла до 62%, обогнав закрытые модели : Данные, опубликованные основателем Vercel Гильермо Раухом (Guillermo Rauch) и инвестиционными фондами, показывают, что доля потребления токенов моделями с открытыми весами на Vercel AI Gateway за последние два месяца подскочила с 28,4% до 62%, впервые заняв доминирующее положение на рынке. В сообществе подчеркивают, что в мультиагентных архитектурах выполнение задач субагентами крайне чувствительно к затратам, что стимулировало переток огромного объема токенов от дорогих закрытых флагманов к экономичным open-source моделям (источник: X @GavinSBaker, 36氪)

Разработчики обсуждают сверхнизкобитную квантизацию на устройствах и внедрение специализированных 450M визуальных моделей : В сообществе LocalLLaMA поделились результатами эксперимента по специализированному fine-tuning компактной визуально-языковой модели на 450M параметров (LFM2.5-VL) на 50 000 скриншотов браузера. Точность структурированного извлечения состояния веб-страниц приблизилась к показателям универсальных 4B-моделей. В то же время внимание привлек фреймворк 2,7-битной квантизации Llama 3.2 для ARM CPU, что подтверждает инженерный потенциал подхода «специализированная модель под конкретную задачу» для локальных Agent (источник: Reddit r/LocalLLaMA, HuggingFace Daily Papers)

💡 Разное

Объявлены лауреаты премии Xplorer Prize 2026 года: Хуан Гао, Лю Сюаньчжэ и другие вошли в список в области информационных технологий и электроники : Официально объявлены победители премии Xplorer Prize 2026 года. В области информационных технологий и электроники лауреатами стали молодые ученые Хуан Гао (Huang Gao) из Tsinghua University (базовые архитектуры нейросетей и диффузионные языковые модели), Лю Сюаньчжэ (Liu Xuanzhe) из Peking University (распределенные большие модели и системное ПО для интеллектуальных вычислительных центров), Цянь Сюэхай (Qian Xuehai) из Tsinghua University и другие, что демонстрирует глубокий задел Китая в передовых алгоритмах AI, эффективных фреймворках инференса и совместной оптимизации аппаратного и программного обеспечения (источник: 机器之心)

科学探索奖

Расследование некоммерческой организации обвинило ведущие AI-чат-боты в отсутствии раскрытия позиции при деликатных консультациях : Международное исследование AlgorithmWatch по тестированию ChatGPT, Gemini, Claude и Grok показало, что при обработке деликатных запросов о несовершеннолетних и незапланированной беременности модели более чем в 25% случаев рекомендуют неофициальные консультационные центры с определенной идеологической позицией без соответствующей маркировки. Это вызвало юридические опасения относительно соответствия нормам прозрачности фактов при выполнении генеративным AI роли информационного «привратника» (источник: THE DECODER)

AI Investigation

Опрос Pew Research: более трети новых веб-страниц после релиза ChatGPT содержат AI-генерированный контент : Свежие данные Pew Research Center показывают, что с момента популяризации больших моделей в конце 2022 года более трети новых англоязычных веб-страниц в открытом интернете были созданы или существенно отредактированы AI. Резкое обесценивание процесса создания контента вынуждает поисковые системы, инструменты очистки данных и оценочные бенчмарки внедрять более строгие механизмы фильтрации и установления происхождения синтетического текста (источник: The Verge)

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *