AI Ежедневник — 2025-06-01(Утренний выпуск)
Стэнфордский университет случайно обнаружил, что ИИ может генерировать ядра CUDA, превосходящие по производительности те, что созданы экспертами-людьми: Исследовательская группа Стэнфордского универси
AI Ежедневник — 2025-05-31(Вечерний выпуск)
Дилемма и стратегия Nvidia: балансирование между рынками США и Китая: Глубокий анализ The Information раскрывает сложное положение Nvidia между двумя основными рынками — США и Китаем. Дженсен Хуанг ли
AI Ежедневник — 2025-05-31(Утренний выпуск)
DeepSeek выпустила новую модель R1-0528 со значительно улучшенной производительностью, что привлекло внимание: DeepSeek представила новую версию своей большой языковой модели R1-0528, которая показала
AI Ежедневник — 2025-05-30(Вечерний выпуск)
DeepSeek выпустила модель R1-0528, производительность которой приближается к GPT-4o и Gemini 2.5 Pro, и возглавила рейтинг моделей с открытым исходным кодом: DeepSeek-R1-0528 отлично показала себя в н
AI Ежедневник — 2025-05-29(Вечерний выпуск)
DeepSeek R1 получил «небольшое обновление», которое на самом деле стало большим скачком вперед, значительно улучшив возможности программирования и логического вывода: DeepSeek выпустил новую версию (0
AI Ежедневник — 2025-05-29(Утренний выпуск)
Сомнения в эффективности обучения LLM+RL: даже ложные вознаграждения могут улучшить способности модели к логическому выводу: Недавнее исследование ученых из Вашингтонского университета, Allen Institut
AI Ежедневник — 2025-05-28(Вечерний выпуск)
Будущее RLHF/RLAIF: могут ли случайные/ошибочные вознаграждения улучшить производительность модели? : Эксперимент Stella Li показывает, что обучение модели Qwen2.5-Math-7B с использованием случайных и
AI Ежедневник — 2025-05-28(Утренний выпуск)
Omni-R1: Инновационная двухсистемная архитектура обучения с подкреплением улучшает всемодальные логические способности : Omni-R1 предлагает инновационную двухсистемную архитектуру (система глобального
AI Ежедневник — 2025-05-27(Вечерний выпуск)
Споры о производительности AMD и NVIDIA в области ИИ-инференса вызвали бурные обсуждения: SemiAnalysis указал на проблемы с тестированием SGLang на платформе AMD ROCm, такие как удаление неудачных тес