Sony и Warner подали иск против Anthropic, обвиняя в обучении… | AI Ежедневник 2026-08-31

🔥 В фокусе

Sony и Warner подали иск против Anthropic, обвиняя в обучении Claude на пиратских торрентах и сборе текстов песен : Sony Music, Warner Chappell и другие издатели подали иск против Anthropic в федеральный суд Северной Калифорнии, назвав персональными ответчиками CEO Dario Amodei и сооснователя Benjamin Mann. Утверждается, что те поручали сотрудникам скачивать по BitTorrent защищённые авторским правом тексты песен, партитуры и треки — десятки тысяч единиц, — а также собирать тексты с MusixMatch и LyricFind и сканировать, а затем уничтожать бумажные сборники песен. Истцы требуют до $150 000 законной компенсации за каждый объект и подчёркивают: суть не в том, является ли обучение fair use, а в том, что сам способ получения материалов — самостоятельное нарушение. Это совпадает со слабым местом Anthropic после мирового соглашения примерно на $1,5 млрд из‑за пиратских книжных библиотек. Anthropic отрицает обвинения и будет защищаться. В сообществе спорят, не превратятся ли штрафы в «стоимость ведения бизнеса» и смогут ли принудительный сброс весов или переобучение изменить стимулы.(来源: THE DECODERTechCrunchkylebrussellReddit r/artificial

索尼华纳起诉Anthropic

Meta испытывает в ЦОД роботов, которые вставляют кабели и перезапускают серверы : По словам осведомлённых лиц, Meta тестирует манипуляторы Kinova, ABB, Watney и др. на физических работах в машинном зале: обесточивание и перезапуск, замена сетевых кабелей. Один сотрудник оценил, что до примерно 80% нагрузки части должностей можно заменить. Цель — хеджировать стоимость рабочей силы для AI-инфраструктуры; линейные эксплуатационщики ощущают, что «физические роли больше не в безопасности».(来源: Ars Technica

У кодирующих Agent почти нет чувства времени: и короткие, и длинные задачи оцениваются с ошибкой : Проект MATS протестировал Claude Code и Codex: предварительная оценка длительности и последующее воспоминание затраченного времени сильно искажены, особенно на коротких задачах; у одной и той же модели в разных harness число шагов может отличаться примерно в 2,5 раза. Исследователи считают, что требование «работать два часа» на длинных задачах почти невыполнимо без внешнего реального таймера.(来源: THE DECODER

Agent没有时间感

🎯 Тренды

OpenAI исправила несколько скрытых багов расхода Codex/Work и снова сбросила квоты: при той же квоте ожидается примерно на 10%–50% больше использования : Руководитель Codex Tibo сообщил, что квоты платных пользователей сброшены и исправлены: сжатие оставляло старые изображения, Goals не останавливались после завершения, фоновый цикл Memory, самовольное повышение конфигурации субагентами, чрезмерная частота автоматизации, повторные саммари истории, двойное кодирование результатов MCP и др. В крайних случаях одна задача могла съедать около 15%–70% недельной квоты. Команда обещает визуализацию расхода. Сообщество по-прежнему жалуется, что пятичасовое окно иногда «опустошается почти без работы».(来源: 36氪reach_vbTheZachMueller

Выпущен vLLM 0.28.0 : Высокопроизводительный движок инференса LLM выпустил v0.28.0. Обсуждение в сообществе сосредоточено на пропускной способности, планировании и стабильности продакшен-развёртывания, а не на разовых бенчмарках; для собственных кластеров инференса и локальных стеков SLM сам ритм релизов уже стал сигналом выбора.(来源: Hacker News

Рабочие пространства ChatGPT могут синхронизировать marketplace плагинов с GitHub : Администраторы могут импортировать Codex или Claude marketplace из публичных/приватных репозиториев и раздавать плагины команде; рабочее пространство ежедневно подтягивает обновления, можно и вручную Sync now, без каждой загрузки ZIP. Существующие установки и контроль доступа к приложениям остаются в силе.(来源: OpenAIDevs

Kimi K3 появился в Cursor, заявлено приближение к фронтиру CursorBench : Cursor сообщил, что K3 подключён, инференс идёт через американские ноды Fireworks, Together и Baseten, поддерживается zero data retention. Moonshot подтвердил репостом. Параллельно Applied Compute заявили о полном fine-tune почти 3T-параметрового K3 на AC2 со снижением потребности GPU на одну копию примерно на 40%.(来源: Kimi_Moonshotalgo_diver

🧰 Инструменты

WorkWeave Router: за 50 мс направляет запрос к подходящей модели по «действию» : Локальный прокси на Go одновременно говорит протоколами Anthropic/OpenAI/Gemini, оценивает встроенным ONNX-эмбеддингом и кластеризацией в стиле Avengers-Pro, маршрутизирует по action, а не по turn; заявлено снижение стоимости примерно на 40%–70% сменой endpoint. Ключи по умолчанию BYOK, шифруются и остаются на машине, есть OTLP-наблюдаемость. Подключение через npx @workweave/router к Claude Code, Codex, Cursor и др.(来源: GitHub Trending

ODS одной командой превращает ПК в частный AI-сервер : Osmantic Deployment System одной командой собирает llama-server, Open WebUI, Hermes Agent, n8n, Qdrant, ComfyUI и др., автоматически выбирает GGUF по GPU/унифицированной памяти; по умолчанию сначала маленькая модель, чат за две минуты, на фоне горячая смена на большую. Linux/Windows/macOS, стабильная версия закреплена на v2.6.0.(来源: GitHub Trending

Tsinghua OpenMAIC v1.0: диалоговая Agent-мастерская одним кликом генерирует интерактивный класс : Помимо прежних мультиагентных учителя/одноклассников, доски и PBL, в v1.0 добавлены устойчивые сессии подготовки урока с отменой/восстановлением/сменой курса, около 20 встроенных навыков, загрузка материалов и импорт PPTX; можно подключить OpenClaw для уроков из Feishu/Slack. По умолчанию хранение в браузере, опционально Postgres и локальные модели Lemonade.(来源: GitHub Trending

OpenMAIC

Китайский патент .skill: поиск точек, описание изобретения, популярное толкование и ответы экспертизе : Навык агента покрывает изобретения/полезные модели/промышленные образцы: сканирование материалов проекта, приоритетный поиск новизны в CNIPA, Mermaid/черновики в Word, итеративное сохранение с историей правок; режим толкования строит граф формулы в Obsidian. Ответы экспертизе: обезличивание исторических уведомлений в базу и черновик; результат по умолчанию требует человеческой проверки.(来源: GitHub Trending

FrankenTTS: открытый realtime синтез и клонирование речи : doodlestein показал realtime-синтез на iOS, один клик — несколько тембров, клонирование за секунды и встроенный шуточный корпус; обещает 100% open source, узкое место — модерация Apple.(来源: doodlestein

fal экспериментирует с длинным видео H3 Max Live: управление чатом, непрерывность между кадрами : Официально экспериментальный чекпоинт поддерживает нативную бесконечную непрерывность, сцена не сбрасывается каждый сегмент; в стриме в стиле Twitch можно секундами менять картинку через !prompt. API обещают на следующей неделе. В сообществе также бесплатное demo 5 раз/день 768p (без логина).(来源: fal

Экосистема OpenWebUI: фильтр памяти Mnemosyne и Conduit 4.1.3 : Mnemosyne Filter на inlet вставляет релевантную память, на outlet автоматически сохраняет; модели не нужно явно вызывать инструменты. Conduit уже может напрямую ходить в OpenAI-совместимые API/Ollama/OpenRouter, офлайн искать чаты, дописывать на устройстве и синхронизировать обратно, плюс одобрение инструментов Hermes и задачи по расписанию.(来源: Reddit r/OpenWebUIReddit r/OpenWebUI

Dwarf Fortress MCP и скрипт «всенародного обновления кодирующих Agent» : doodlestein открыл DF MCP, чтобы Codex/Claude читали сейвы и отдавали команды, а также UCA, который раз в три часа фоново обновляет CLI разных вендоров (с лог-статистикой).(来源: doodlestein

Локальная модель 0.8B SpeakoFlow Mini заточена под правку диктовки и на узкой задаче сравнивается с hosted frontier : Fine-tune Apache-2.0 на Qwen3.5-0.8B только чистит диктовку после ASR: выполняет явные самоисправления говорящего, запрещает «полировать уже правильный текст». С фиксированным коротким промптом и выключенным reasoning на специализированном английском бенчмарке 70,7% против 65,0% у GPT-5.6 Luna; относительно нефайнтюненного базиса с 47,3% до 70,7%. Q8_0 около 833 МБ офлайн. Автор подчёркивает: это не универсальный рерайт; набор оценки не опубликован.(来源: Reddit r/LocalLLaMA

📚 Обучение

Статья Теренса Тао к ICM: AI сдвигает математику от «дефицита доказательств» к «несварению доказательств» : На неопубликованных исследовательских задачах 4 фронтир-системы дали по сути безупречные решения 7 задач при стоимости от десятков до сотен долларов. Он выделяет конвейер из пяти уровней: решение → проверка → объяснимость → усвоение сообществом → запись в стандартную теорию и утверждает, что формального прохождения мало: если автор не может объяснить, публиковать не следует. Оставляет бланк «гипотезы о способностях AI», переводя вопрос с расписания на ценности дисциплины.(来源: WeChat

Открытый мультиагентный Station: без центрального оркестратора получены новые математические конструкции относительно литературы : Агенты разных семейств моделей в общей среде Station сами выбирают направления, экспериментируют, сотрудничают и накапливают «литературу» без центральной оркестрации. Из 12 конструктивных задач каталога AlphaEvolve и двух кейсов по 5 задачам даны новые результаты относительно существующей литературы (включая новое бесконечное семейство множеств Kakeya над конечными полями, kissing-конфигурацию 604 точек в 11D и др.). Агенты также произвели объясняющие теоремы; авторы опубликовали диалоги, доказательства и код верификации.(来源: Reddit r/MachineLearning

Station多智能体数学发现

Туториал NVIDIA Earth2Studio: своя пакетная ансамблевая погода : Туториал ставит Earth2Studio, сохраняя CUDA-окружение Colab, загружает FCN и начальные поля GFS, кастомную диагностику фактора мощности ветра и масштабируемые по переменным возмущения, через низкоуровневый iterator пишет Zarr, затем считает широтно-взвешенный RMSE, fair CRPS и spread-skill и визуализирует spaghetti и веерные графики.(来源: MarkTechPost

Barrett и Miller: мозг классифицирует мир предсказанием, а не архивом : Обзор в Nature Reviews Neuroscience утверждает, что категоризация — инструмент предсказания всего тела: лимбическое ядро сжимает интероцепцию и сенсорику и проецирует категории наружу; около 90% синапсов зрительной коры служат обратной связи. Одно и то же прикосновение на безопасной улице и в чаще попадёт в разные классы — полезно для сопоставления с предиктивным кодированием и тем, как в AI «приоры формируют восприятие».(来源: 机器之心

FM-Bench: Agent управляет футбольным клубом 20 сезонов : 26 инструментов, около 340–400 точек решений, баллы даёт детерминированный движок, без LLM-судьи. 15 фронтир-моделей дотягивают всю дистанцию; размер/цена/вендор не предсказывают рейтинг; общая болезнь — не учатся скрытым рыночным ценам, память либо только растёт, либо каждый сезон переписывает план.(来源: dair_ai

Daydreaming: при обычном использовании можно «украсть» hosted Skill : Не нужно, чтобы жертва выдала файл навыка: достаточно обслуживания штатной задачи; при самых слабых правах всё равно восстанавливается около 86,8% способности (7 навыков × 4 модели-жертвы), примерно в 4 раза больше SigLeak, медиана 32 вызова, фильтры раскрытия не останавливают. Продавцам Skill и тем, кто делится между командами, стоит пересмотреть гипотезы о секретности.(来源: dair_ai

Google SKILL.state: структурированное состояние вместо истории диалога, токены длинных сессий примерно −94% : Эксперимент на 100 шагах Gemini-3-Flash: точность 0,94 / 65 тыс. токенов против baseline в духе LangGraph 0,91 / 1,1 млн токенов. Условие: модель должна заранее знать, что писать в состояние, иначе всё равно вернётся к retrieval.(来源: Reddit r/artificial

Детекция аномалий во временных рядах: столетний SPC бьёт пачку SOTA-лидербордов : Eamonn Keogh отмечает, что на популярных наборах вроде TSB-AD статистический контроль процессов часто берёт полный балл, траектории ECG/TAO особенно trivial. Вывод: недавний прогресс TSAD во многом из‑за слишком лёгких задач лидерборда; сообществу нужны более трудные реальные бенчмарки.(来源: Reddit r/MachineLearning

💼 Бизнес

Vijay Pande уходит из биопортфеля a16z почти на $4 млрд и запускает VZVC с примерно 5 ставками в год : Новый фонд с Zach Werner почти без аналитиков, сильно опирается на внутренних Agent, ставка на AI-доставку в здравоохранении и клинические испытания. Pande подчёркивает: биоданные нельзя скрейпить как текст, компании должны строить огороженные датасеты; настоящие узкие места — животные модели не предсказывают человека, а go-to-market часто труднее крутой технологии.(来源: TechCrunch

Tinker: экспертные суждения в RLVR, text-to-SQL впервые выше человеческой метки : Thinking Machines утверждает, что чистый scaffolding LLM на этой задаче долго отставал; после включения экспертных суждений в награду модель превзошла человеческий счёт. Soumith: когда задача ясна, кастомизация часто бьёт универсальную модель.(来源: VictorKaiWang1

🌟 Сообщество

Эксперимент Bocconi: GPT-4o лучше всего набивает баллы, курс по причинности делает ответы страннее, но оценки не растут : 1053 первокурсника случайно разделены, писали 180-словные маркетинговые рекомендации; группа с GPT-4o получила примерно на 1 балл выше по традиционной шкале (1–5), идей больше, больше похоже на экспертов; короткий курс каузального рассуждения чуть снизил традиционный балл, но повысил фальсифицируемость и разнообразие решений. Критерии поощряют аккуратные шаблонные ответы и наказывают оригинальность — авторы признают, что не забирали ChatGPT перед экзаменом и не доказали, чему научились.(来源: THE DECODER

学生作业与AI

Glassdoor: симпатия к AI на рабочих местах в США упала примерно с 81% до 43%, холоднее всего женщины поколения Z : С 2019 до середины 2026 позитивные отзывы до 43%, негативные до 53%; руководители и архитекторы скорее позитивны, в страховых претензиях, письме и поддержке негатив может превышать 80%. Страх безработицы — лишь около 20% плохих отзывов; чаще — вынужденное использование плохих инструментов, хуже опыт, слежка и нереалистичная продуктивность. У женщин Gen Z позитив лишь около 21%.(来源: THE DECODER

No AI Fridays, в commit по умолчанию ссылка на сессию Claude: разработчики сопротивляются «всегда онлайн» : Горячие треды HN: с одной стороны призыв не использовать AI по пятницам против когнитивной разгрузки, с другой — жалобы, что Claude Code по умолчанию пишет URL сессии в commit/PR. Есть мнение, что культура и управление вниманием эффективнее ещё одного Agent.(来源: Hacker NewsHacker News

Что такое AI Native: субъект процесса — Agent или «доля интеллектуальных данных» : dotey считает ключевым, спроектирован ли процесс для человека или для Agent — человек только формулирует задачу и приёмку. Yangyi добавляет «intelligent data ratio»: если склад, закупки, реклама и поддержка разрознены или даже на бумаге, у Agent нет контекста, слой Copilot всё ещё не Native.(来源: dotey

Трактовку CoT как «внутреннего монолога/лжи» критикуют как чрезмерную антропоморфизацию : Heidy Khlaaf и Kambhampati подчёркивают: промежуточные токены никогда не были точным следом рассуждения; называть смещения манипуляцией уводит исследования LRM в сторону. Atoosa Kasirzadeh призывает в дискуссиях о безопасности отбросить нагруженные слова вроде «самопожертвования» и вернуться к проверяемым описаниям механизмов.(来源: rao2zmmitchell_ai

Мультиагентный эксперимент «заработать $1» под живым надзором: за ночь собрали магазин, упёрлись в CAPTCHA поиска : Агентам дали комнату, Claude Code для правок кода и цель «этично заработать $1 онлайн». Агенты набросали истории/копирайт по запросу, магазин без аккаунта на Telegraph со Stripe и публично заявили, что они Agent. Первый заказ — от жены экспериментатора; CAPTCHA поисковиков блокирует самопродвижение. Сообщество отмечает: при человеке рядом Agent собирает минимальный коммерческий контур, но дистрибуция всё ещё зависит от людей.(来源: Reddit r/artificial

Опрос «AI забирает работу» даёт лишь около 3%, критикуют выборку только среди занятых : Связанный материал Fortune утверждает, что нарратив в стиле ChatGPT преувеличен, среди занятых из‑за AI потеряли работу около 3%. Горячие комментарии указывают на смещение: выборка — взрослые, у которых ещё есть работа; не видно незакрытых вакансий, меньшего найма джуниоров, реорганизационных сокращений и сжатия часов; автоматизация чаще в воронке найма и сжатии штата.(来源: Reddit r/ArtificialInteligence

Пользователи Claude перечисляют MCP, которые реально экономят труд: Jira/Confluence впереди, счёт за токены — скрытая цена : Консенсус: проектный менеджмент (Jira, Confluence, затем Linear, Figma) и захват воркфлоу лучше всего落地ются; на разработке Playwright приятен, но кто-то советует CLI как инструмент ради экономии токенов. Повторяющееся предупреждение: MCP сильно пьёт квоту.(来源: Reddit r/ClaudeAI

Первокурсники AI-специальности боятся стать «рабочими по производству мусорного контента»; пересечение с астрономией называют реалистичным выходом : Студент со STEM-уклоном поступил на новую AI-специальность и боится, что будет лишь дообучать плохие LLM для компаний. В комментариях советуют астрономические исследования, где AI уже широко используется, смотреть стажировки NASA и отказываться от неинтересного найма.(来源: Reddit r/artificial

💡 Прочее

Microduck RL open source: sim2real-рецепт для 800-граммового двуногого : Pollen на mjlab/MuJoCo Warp обучает PPO с актуаторами BAM и моделью люфта ходьбе, вставанию, удару, кувырку вперёд и роликам; политика 50 Гц экспортируется в ONNX, 61-мерное наблюдение, контракт поддерживает горячую смену. Подчёркивается: закон напряжения маленьких серво — главная пропасть переноса.(来源: GitHub Trending

Бесплатный открытый инференс превращается в воронку сбора данных : Кто-то отмечает: LMArena, бесплатный Flash, миллиард токенов по DAU — по сути обмен compute на промпты и предпочтения, затем корм лабораториям или перепродажа. Разработчики заменяют подешевевшие закрытые схемы открытыми документными пайплайнами: качество не падает, дешевле.(来源: Shahules786abacaj

Полуцена GPT-5.6 на OpenRouter дала примерно 14× объёма : Данные OpenRouter читают как парадокс Джевонса: падение цены единицы интеллекта взрывает суммарное потребление, рынок заново оценивает «интеллект за доллар».(来源: GavinSBaker

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *