AI Ежедневник — 2025-07-19(Утренний выпуск)

🔥 В центре внимания

Индия планирует создать собственные крупные консалтинговые компании: Индия планирует создать свои собственные «большую семерку» консалтинговых компаний, чтобы конкурировать с мировыми гигантами. Этот шаг направлен на снижение самоограничений в регулировании профессиональных учреждений и государственных тендерах, а также на повышение статуса Индии на внутреннем и международном консалтинговых рынках. Этот шаг отражает стремление Индии играть более важную роль в мировой экономике и может повлиять на ландшафт мировой консалтинговой индустрии. (Источник: bookwormengr)

OpenAI представила ChatGPT Agent: OpenAI представила ChatGPT Agent, наделяя ChatGPT способностью самостоятельно мыслить, планировать и выполнять сложные задачи на виртуальном компьютере. Пользователю достаточно дать инструкцию, и Agent автоматически выполнит многоэтапные операции, такие как составление пенсионного плана, бронирование поездки и т. д., что значительно повышает практичность и эффективность AI-помощника. Это знаменует собой развитие AI-помощников в сторону большей интеллектуальности и автономности, а также вызывает дискуссии о замене людей искусственным интеллектом. (Источник: _akhaliq, xikun_zhang_, gdb, gdb, AravSrinivas, BlancheMinerva)

🎯 Тенденции

MagicLab выпустила новое поколение человекоподобных роботов MagicBot Z1: Китайская компания MagicLab выпустила новое поколение человекоподобных роботов MagicBot Z1, что привлекло внимание. Этот выпуск означает постоянные инвестиции и технологический прогресс Китая в области человекоподобных роботов. (Источник: Ronald_vanLoon)

ByteDance выпустила модель Seed: ByteDance выпустила модель Seed, привлекая внимание количеством и скоростью выпускаемого контента. (Источник: teortaxesTex)

Figure AI выпустила новое поколение аккумуляторов для человекоподобных роботов: Figure AI представила новое поколение аккумуляторов для человекоподобных роботов и подчеркнула, что вертикально интегрированная аккумуляторная система имеет решающее значение для ее успеха. Это говорит о том, что аппаратные технологии человекоподобных роботов быстро развиваются, а аккумуляторные технологии становятся ключевой областью конкуренции. (Источник: adcock_brett)

Робот Unitree G1 представлен на новом заводе: Робот Unitree G1 был представлен на церемонии открытия нового завода Unitree в Ханчжоу, приветствуя гостей. Это демонстрирует прогресс Unitree в коммерциализации человекоподобных роботов. (Источник: Ronald_vanLoon)

Google Gemini API представил модель генерации видео и аудио Veo 3: Google Gemini API представил модель генерации видео и аудио Veo 3, которая поддерживает нативную генерацию аудио и предлагает масштабируемые ограничения скорости использования для производства по цене 0,75 доллара США в секунду (с аудио) и 0,50 доллара США (без аудио). Это знаменует собой дальнейшее повышение способности ИИ генерировать мультимедийный контент. (Источник: JeffDean)

NVIDIA выпустила модель распознавания речи Canary Qwen 2.5: NVIDIA выпустила Canary Qwen 2.5, модель распознавания речи, достигшую SOTA в Open ASR Leaderboard, с коммерчески дружественной лицензией CC-BY. Модель работает как в режиме ASR, так и в режиме LLM, достигая минимального WER 5,62 и RTFx 418 (впечатляет для модели 2.5B). (Источник: reach_vb, clefourrier)

Kimi K2 стала моделью с открытым исходным кодом номер один в рейтинге Arena: Kimi K2 стала моделью с открытым исходным кодом номер один в рейтинге Arena, заняв пятое место в общем рейтинге, обогнав DeepSeek. Это говорит о конкурентоспособности китайских моделей с открытым исходным кодом в использовании инструментов, математике, кодировании и многоэтапных задачах. (Источник: JonathanRoss321, TheTuringPost, bookwormengr)

🧰 Инструменты

Kimi K2 обновила шаблон чата: Kimi K2 обновила шаблон чата для улучшения вызова инструментов, включая обновление системного приглашения по умолчанию, использование tool_id, возвращаемого моделью, и предотвращение применения tojson к строковым параметрам. Это улучшает возможности использования инструментов Kimi K2 и пользовательский интерфейс. (Источник: Kimi_Moonshot, danielhanchen)

Pydantic AI теперь поддерживает Hugging Face в качестве провайдера: Pydantic AI теперь поддерживает Hugging Face в качестве провайдера, позволяя пользователям запускать модели с открытым исходным кодом, такие как DeepSeek R1, на масштабируемой бессерверной инфраструктуре, с бесплатным планом для тестирования. (Источник: reach_vb, huggingface)

Hugging Face Inference Endpoints теперь поддерживает SGL и vLLM: Hugging Face Inference Endpoints теперь изначально поддерживает SGL и vLLM, предоставляя пользователям централизованную платформу и управляемую инфраструктуру для развертывания высокопроизводительных механизмов вывода. (Источник: huggingface)

Выпущен Jina Embeddings v4 GGUF: Выпущен jina-embeddings-v4-GGUF, предлагающий различные варианты квантования, динамическое квантование, подобное Unsloth, скоро появится. (Источник: JinaAI_)

Le Chat от Mistral AI получил новые функции: Le Chat от Mistral AI получил новые функции, включая глубокое исследование, голосовой режим, нативный многоязычный вывод, папки проектов и расширенное редактирование изображений. Эти функции улучшают исследовательские возможности Le Chat, взаимодействие с пользователем и функции организации. (Источник: algo_diver)

📚 Обучение

6 концепций об ИИ: 6 концепций ИИ, которые необходимо знать: вычисления во время тестирования и их масштабирование, вывод ИИ, варианты RLHF (DPO, RRHF, RLAIF), метаобучение, причинный ИИ и защитный ИИ. (Источник: TheTuringPost, TheTuringPost)

Статья о графовых базах данных и AI Agent: Статья о том, как графовые базы данных и AI Agent решают ограничения статических графов путем постоянного расширения и обогащения базы знаний. (Источник: dl_weekly)

Несколько фактов об Алане Тьюринге: Несколько удивительных фактов об Алане Тьюринге, включая то, что он изобрел идею современного компьютера, взломал природный код, сократил Вторую мировую войну, был пионером искусственного интеллекта и многое другое. (Источник: TheTuringPost)

Статьи о пост-обучении и выводе на основе RL: Kaiwen Wang представит две статьи о пост-обучении и выводе на основе RL на ai4mathworkshop ICML2025: Q# (закладывает теоретическую основу для RL на основе ценностей для пост-обучения LLM) и VGS (практический поиск с учетом ценностей, масштабируемый для длительного вывода CoT). (Источник: jefrankle, jefrankle)

💼 Бизнес

Modular и TensorWaveCloud объявили о сотрудничестве: Modular и TensorWaveCloud объявили о сотрудничестве, которое может снизить стоимость вывода до 70% за счет запуска MAX на графических процессорах AMD MI325X, обеспечивая при этом более высокую пропускную способность, чем H200 + vLLM. (Источник: clattner_llvm, clattner_llvm)

🌟 Сообщество

Обсуждение замены рабочих мест ИИ: В социальных сетях разгорелись дискуссии о замене рабочих мест ИИ, одни считают, что ИИ уже способен выполнять множество человеческих работ, другие же подчеркивают преимущества людей в ответственности, обработке неизвестных ситуаций и взаимодействии с клиентами. (Источник: tokenbender, dotey, random_walker)

Обсуждение возможностей AI Agent: Обсуждаются возможности AI Agent, некоторые считают, что ChatGPT Agent переоценен, а продукты китайских команд, таких как Genspark и Manus AI, работают лучше в некоторых задачах. (Источник: OpenAI新Agent遭中国24人初创团队碾压,实测成本、质量全输惨,海外用户:中国Agent代差领先)

Предположения о данных обучения Kimi K2: Выдвигаются предположения, что данные обучения Kimi K2 могут содержать код, сгенерированный Claude, и приводятся доказательства путем сравнения результатов генерации кода. (Источник: Reddit r/LocalLLaMA)

Обсуждение производительности моделей с длинным текстом: Исследование команды Chroma показывает, что производительность LLM в задачах с длинным текстом снижается с увеличением длины ввода, и это снижение не является равномерным. (Источник: 1万tokens是检验长文本的新基准,超过后18款大模型集体失智)

Обсуждение этики ИИ: Использование Netflix ИИ для создания спецэффектов вызвало дискуссию об этике ИИ, некоторые опасаются, что ИИ заменит людей, занимающихся творческой работой. (Источник: Reddit r/ArtificialInteligence)

💡 Другое

Внебрачная связь генерального директора Astronomer: Женатый генеральный директор Astronomer Энди Байрон был замечен на концерте Coldplay с руководителем отдела кадров компании, что вызвало споры. Бывшие сотрудники сообщают, что у Байрона плохая репутация внутри компании. (Источник: dotey)

Возвращение менеджера по продукту Claude Code: Два менеджера по продукту Claude Code, Борис Черный и Кэт Ву, вернулись после непродолжительной работы в Cursor, что вызвало предположения. (Источник: dotey)

Meta переманила исследователей OpenAI: Два ведущих исследователя OpenAI, Джейсон Вэй (автор Scaling Laws) и Хён Вон Чун (архитектор GPT-4), были переманены в Meta. (Источник: dotey)