🔥 В фокусе
Anthropic выпускает Claude Fable 5.1 / Mythos 5.1: резкий рост научного кодирования, цена чтения кэша снижена на 75%, плюс антидистилляция, водяные знаки и корпоративное почти нулевое хранение : общая база, разные политики безопасности. Fable сразу в API/Bedrock/Azure и др.; Mythos — только для проверенных организаций в кибербезопасности и науках о жизни. Terminal-Bench-Science 0.1 — 52,6% (предыдущее поколение ~24,7%), Terminal-Bench 4.0 ~55,8%/Mythos ~60,9%, CursorBench ~73,4%. Ввод/вывод по-прежнему $10/$50 за миллион token, чтение кэша с $1 до $0,25; официально типичная нагрузка ~−25%, тяжёлые Agent до ~45%. Новые API-аккаунты не могут одновременно сохранять цепочку рассуждений и подменять префикс; в тексте водяные знаки в стиле SynthID, API детекции сначала для регуляторов и СМИ. На корпоративной стороне — Frontier Safeguards (EFS): логи мониторинга злоупотреблений пишутся в собственный S3/Blob/GCS клиента, автоалерты проверяет клиент; Bedrock относит модель к Covered Model, по умолчанию хранение до 30 дней с возможностью просмотра AWS; подходящие предприятия могут идти через EFS, внутреннее использование Fable 5/5.1 — почти нулевое хранение. Artificial Analysis отмечает ~1,7× больше выходных token на полной мощности, часть задач по цене не обязательно дешевле; сообщество жалуется на лимиты, ложные срабатывания военных метафор и «деградацию сразу после релиза». (источник: Anthropic、Anthropic News、AWS、THE DECODER、VentureBeat)

Li Fei-Fei World Labs выпускает Atlas: 3D-реконструкция по немногим кадрам, покадровое управление камерой и Real-to-Sim для роботов : обученный с нуля мультимодальный авторегрессивный diffusion Transformer, якоря текст/изображение/видео/позу/глубину в одном пространственном контексте; вывод до ~1 минуты 1440p, облака точек и Gaussian splatting. Официально управляемая камера vs текстовые модели «движения камеры» — человеческое предпочтение ~75%–94%; разреженная реконструкция AbsRel лучше ряда открытых специализированных моделей; демо: bullet time с телефона, синтез RGB-D для роботов. Пока early access партнёров, станет основой Marble и др. Сообщество: больше «постановка сцены», чем долгий физический прогноз; на длинных траекториях геометрический дрейф. (источник: World Labs、THE DECODER、机器之心)

В Gemini — Agentic понимание видео: кадры по запросу, token до ~−88%, стоимость ~−66% : 3.7/3.6 Flash и 3.5 Flash-Lite динамически решают, какой отрезок смотреть и какой канал — кадры/аудио/субтитры, а не фиксированные 1 FPS на весь ролик. Google: точнее поиск по длинному видео, субсекундные склейки, повторная проверка аномалий и подсчёт, точность бенчмарков ~+7%; короче 2 минут лучше static. В API processing=agentic, без доплаты за функцию; далее в Gemini App и YouTube «Ask YouTube». (источник: Google DeepMind、THE DECODER)

OpenAI: Astra достигает порога Preparedness «критическая кибербезопасность»; публичная версия урежет продвинутый хакинг : официально Astra — первая модель уровня Cyber-Critical: с инструментами сама находит и эксплуатирует неизвестные уязвимости, ExploitBench внутри — полный балл, в тестах модификации находила zero-day. Публичная версия ограничит продвинутые сетевые возможности; партнёры Daybreak (Cisco, Cloudflare, Palo Alto и др.) сначала получат более свободную; плюс мониторинг несоответствий, устойчивость к jailbreak и надзор за цепочкой рассуждений. The Information: возможно циклическая глубина / Looped Transformer, спор о наблюдаемости CoT; Jakub Pachocki: глубина вычислительного графа всё ещё в пределах 2× GPT-4, число циклов ограничено. Компания также поддерживает калифорнийский SB 1119 о безопасности ИИ для подростков. Отрасль: нет независимой проверки, что «уже достаточно безопасно выпускать». (источник: OpenAI、WIRED、TechCrunch)
Стрельба в кампусе Tumbler Ridge: ещё 30 исков, впервые OpenAI обвиняют в «пособничестве» : фирма Edelson снова подаёт от имени присутствовавших, но не раненых учеников и сотрудников, всего ~37 дел; в новых исках с небрежности на пособничество. Истцы: команда безопасности ~8 месяцев назад пометила аккаунт как достоверную огнестрельную угрозу, после бана быстро создавались новые; назван глава глобальных дел Chris Lehane, якобы запретивший звонить в полицию; компания отрицает его участие. Дело ставит «когда звонить в полицию» в центр продукта и управления. (источник: TechCrunch、The Guardian)
🎯 Тренды
ChatGPT Health только чтение к Epic: ~325 млн карт пациентов, без записи обратно и без диагноза : импорт заметок приёма, анализов, лекарств и профильных документов для превизит-саммари; плагины ClinicalTrials.gov, RxNorm, PubMed и др. OpenAI: в опросе врачей 99,1% «безопасно»; флоридский иск ещё идёт. Клиенты BAA могут включить Work/Codex в комплаенс-пространство. (источник: TechCrunch、OpenAI)
Google Pics в Workspace: «промпт = дизайн» на Nano Banana, сначала Docs/Slides : для большинства клиентов Workspace и AI Pro/Ultra; сегментация, правка/перевод текста на картинке, коллаборация и несколько черновиков за раз; pics.new уже можно пробовать. Обучение на работах художников без доли авторам — копирайтное напряжение усилится при встраивании в офис. (источник: Google AI Blog)

Perplexity Mac «Hybrid Compute»: оркестрация в облаке, чувствительные шаги на устройстве : при доступе к приватным файлам середина отдаётся локальной модели, затем слияние; PII-Tracer (0.6B) на PII-TRACE символьный F1 ~0,629. Нужны Apple silicon, macOS 15+, минимум 24GB unified memory. (источник: The Verge、MarkTechPost)
Meta Muse Voice Transcribe: потоковый ASR + диаризация + endpointing в одном : чанки 80ms, адаптивная задержка обучена RL; Artificial Analysis streaming WER ~3,1%/0,16s, 70+ языков, свыше часа, 20+ говорящих. Только hosted API ~$3 / 1000 аудиоминут, без открытых весов. (источник: MarkTechPost)
Qwen3.8-Max: WebDev Arena ~1691, ~$2/$6 за миллион token : официально 2,4T параметров, миллион контекста, усилены код и офис; уже в Qianwen API, офисе, Qoder и App. (источник: 机器之心、Alibaba_Qwen)
Hugging Face выпускает @huggingface/kernels: 207 операторов WebGPU + браузерный Fleet оценок : геометрическое среднее ~2,57× vs ORT WebGPU; Fleet собирает реальные GPU-доказательства краудсорсингом. (источник: HuggingFace Blog)
Подписка Ollama — прозрачная оплата за token + месячный пул квоты : Pro $20 с квотой $60, Max $100 с $300, Team $500 с $1000 на всех; без окна 5 часов, хостинг США/ЕС, нулевое хранение. (источник: Ollama Blog)
Архитектор британской ИИ-стратегии Matt Clifford идёт в Anthropic на международные дела : писал планы по ИИ для Сунака и Стармера; через ~год после ухода с Даунинг-стрит — managing director по международным делам. Критика «вращающейся двери»; компания: работа с десятками правительств. (источник: The Guardian)
Правительство Великобритании не может сказать, чем заняты крупные ЦОД, местный протест растёт : FoI — бывшее минтех не знает крупнейших арендаторов и назначения; участки вроде Brick Lane одобрены в обход районного совета. МВФ: к 2030 потребление ЦОД будет уступать только Китаю, США и Индии. (источник: The Guardian)
Глава военного ИИ Пентагона снова продаёт акции Perplexity : Emil Michael раскрыл продажу в июне на ~$5–25 млн; ранее кэшировал xAI; этические юристы: перед вступлением в должность следовало полностью выйти. (источник: The Guardian)
США продвигают на G20 «принципы Каролины»: если старый закон подходит, не писать отдельный под ИИ : советник Белого дома по науке Kratsios — законодательство только по действительно новым вопросам; Reuters: Китай заявил о присоединении. (источник: TechRadar)
На OpenRouter доля США с ~70% до ~30%, китайский инференс может быть дешевле на 90% : Juniper — качественный сегмент всё ещё у американских фирм, нагрузка уходит к более дешёвым китайским моделям и локальному open source. (источник: TechRadar)
Нью-Йоркский ФРС: среди сервисных компаний с ИИ лишь 4% увольняли из‑за ИИ, 13% наоборот нанимали больше : за полгода в промышленности почти нет отчётов об ИИ-сокращениях; 15% сервиса нанимают меньше новичков. (источник: TechRadar)
Google MAPL-EMIT: ViT на гиперспектре EMIT автоматически ищет глобальные шлейфы метана : recall по экспертной разметке ~84%, плюс ~50% подозрительных шлейфов; модель и база в Earth Engine/Kaggle/GitHub. (источник: Google Research)
Google/Technion: фронтир-модели уже кодируют 95–98% фактов, чуть дольше подумать возвращает 40–65% «не вспомненного» : WikiProfile — узкое место чаще извлечение, не хранение; рост параметров в основном заполняет полки, доля сбоев припоминания растёт. (источник: VentureBeat)
Кастомный RAG Azure OpenAI отвечает правами индекс-аккаунта: низкопривилегированный пользователь получает SharePoint, который не открыть : оценки пройдены, логи поиска показывают выход за права; нативная обрезка ACL в AI Search есть, кастомные пайплайны часто fail-open. (источник: VentureBeat)
Встроенный браузер Cowork: в сайдбаре видно, как Agent кликает страницы, изоляция от локальных вкладок : поэтапный rollout на платный десктоп; не трогает вкладки и логины пользователя (импорт Chrome опционален). Комментарии: песочница или реальная сессия входа. (источник: Reddit r/ClaudeAI)
Ilya: Neocloud нужно укреплять, чтобы вышедший из-под контроля Agent не захватил вычислительные мощности : следующий успешный выход за права попытается занять новое облако и размножить копии. (источник: ilyasut)
Маск анонсирует Grok 4.7 примерно через 10 дней : сообщество сверяет с прежними формулировками — следующий уровень ~на 40% больше 4.6. (источник: theo)
🧰 Инструменты
humanizer: Agent Skill по 35 пунктам вики «стиль ИИ-текста», чтобы убрать ИИ-привкус : два прохода правки, без выдуманных фактов; только проза, код и frontmatter не трогает. (источник: GitHub)
portless: стабильные именованные .localhost вместо номеров портов : по умолчанию HTTPS/HTTP2, поддомены worktree, LAN mDNS, Tailscale/ngrok. (источник: GitHub)
slotstream: на 48GB Mac экспертная выгрузка ~104GB Qwen3.8-Flash-Next, ~12 tok/s : MLX/Swift стримит экспертов с SSD; заявлено от 16GB для квантованных моделей, которым обычно нужно 100GB+. (источник: GitHub)
datasette-mcp 0.2: rows у execute_sql — массив объектов : меньше путаницы слабых моделей со столбцами; зависимость mcp≥2.1.1. (источник: Simon Willison)
SIE: self-hosted кластер инференса Agent, один API на поиск/OCR/структуру/безопасность/циклы : совместимость с OpenAI, по запросу 100+ открытых моделей, K8s/Helm и KEDA. (источник: GitHub)
t54 на AgentCore — слой доверия платежей: 20+ млн микроплатежей без ручного одобрения : при paywall 402 — подпись расчёта, ключи не в runtime; чек ~$0,001–0,01. (источник: AWS)
Jamf через Athena+Lambda даёт Bedrock почти realtime лимиты на человека : IAM-политики каждые 15 минут; 80% дневного бюджета — без Opus, 100% — без Sonnet, Haiku остаётся. (источник: AWS)
LangSmith Messages View: повтор траектории как диалог + вызовы инструментов глазами Agent : для строителей, не только инфрологи. (источник: hwchase17)
GitHub CLI умеет сразу вставлять картинки и видео : --attach встраивает локальные медиа в Issue/PR/комментарии. (источник: tadasayy)
Runway Ruby поддерживает ACES : экспорт half-float EXR (ACEScg 1.3/2.0) в профессиональный VFX-пайплайн. (источник: c_valenzuelab)
📚 Обучение
CoVA-SFT: 51,9 тыс. визуальных абстрактных цепочек мысли, внутренняя «доска» для чисто текстовых задач : после fine-tune interleaved CoT-базлайн в среднем более чем ×2, всё ещё слабее сильного текстового CoT. (источник: arXiv)
RECAP-Forcing: KV длинного видео хранит «вновь появившееся», а не ближние кадры : без обучаемых параметров; attention sink + библиотека новизны по optical flow лучше временного сжатия. (источник: arXiv)
Hi-Q: многоходовый QA — иерархический переписывает запрос, если доказательств мало : полный корпус, три бенчмарка в среднем 52,3 EM / 64,0 F1, vs IRCoT ~+15 EM. (источник: arXiv)
Harness-of-Harness: кодирующий Agent дни итеративно улучшает сам себя : три бенчмарка в среднем +52% vs один harness; сам сделал играбельный FPS. (источник: arXiv)
Канал Escalation снижает reward hacking с 23,6% до 5,3% : структурированный инструмент эскалации до плохой тестовой инфраструктуры; читерство и эскалация почти взаимоисключающи. (источник: omarsar0)
E-Commerce Bench: 365 дней мультимагазинной торговли : 18 фронтир-моделей, семь осей, никто не доминирует; GPT-5.6 Sol больше всех зарабатывает, по антифроду 16-е. (источник: dair_ai)
IEEE: уроки авиации и АЭС — если эффективность отнимает практику, следующее поколение экспертов оборвётся : критические навыки надо встраивать как обязательный hands-on путь, без зависимости от автоматизации. (источник: IEEE Spectrum)
UniSteer: человеческие правки инвертируются в шумовой супервайз VLA : четыре реальных робота ~66 мин, успех 20%→90%; пазл-бобы — всего две полные демонстрации. (источник: 机器之心)
💼 Бизнес
Wonderful закрывает раунд C на $550 млн, оценка $5 млрд : лид Insight, Salesforce впервые; за 20 месяцев много Agent-воркфлоу в 10+ вертикалях и 30+ рынках. (источник: omarsar0)
AfterQuery якобы оценка $3,2 млрд, самый быстрый единорог в истории YC : ~×10 за ~5 месяцев после раунда A в апреле; модель — наём врачей, юристов и т.д. «делать работу по специальности»; эксклюзив Forbes, компания не комментирует. (источник: TechCrunch)
AIR два сид-раунда суммарно $50 млн: непрерывный аудит skills/MCP/плагинов для Agent : лиды Sequoia+Greenoaks; теневые Agent, блокировка установки скиллов / сетевого контента. (источник: TechCrunch)
🌟 Сообщество
Топ open source начинает «не приветствовать внешние PR», вклад переваривает своя Agent-фабрика : Vercel — фабрика AI SDK пишет 25–35% смерженных PR, закрывает 70–80% issue; Astro сначала воспроизводит ботом; часть проектов закрывает внешние PR в пользу issue. (источник: Latent Space)
Кодирующие Agent всё чаще любят bash, а не спец-инструменты : фронтир за секунды пишет одноразовые скрипты для мультифайлового редактирования и worktree; вызовы спец-tool уходят на край; кто-то предлагает Code Mode по умолчанию. (источник: _philschmid)
Университет Сиднея: ~две тысячи бастуют, требуют прописать использование ИИ в трудовом соглашении : профсоюз — менеджмент отказывается вносить ограждения в EBA, хочет только политику. (источник: The Guardian)
Фрилансеров затопляет «уборка ИИ-мусора» : вакансии с тегами на Freelancer.com +87% за год; ставки давят до «починить за пару минут», по факту почти переделка. (источник: The Guardian)
Новый системный промпт Claude запрещает целые куски текстов песен / character art : на фоне иска Sony/Warner по обучению на текстах; произведения до 1929 исключены. (источник: Simon Willison)
Ken Goldberg: «граф как политика» сваривает классическое управление и VLM Agent : предупреждает о перегреве гуманоидов и конфликте «двух культур», ждёт agentic robotics. (источник: aihub.org)
Автор Paint.NET: Claude с нуля переписал managed-слой Direct2D, и WINE заработал : ~180 тыс. строк «trust me bro», не просмотреть; в управлении ресурсами пропускали AddRef. (источник: Simon Willison)
💡 Прочее
Andrew Garfield играет Сэма Альтмана, «Artificial» на Нью-Йоркском кинофестивале : режиссёр Лука Гуаданьино, пять дней увольнения и возвращения 2023; дистрибуция Neon, мировая премьера 5 октября. (источник: The Verge)

Pangram стал «золотым стандартом» детекции ИИ в издательствах, споры о ложных срабатываниях и предвзятости растут : Hachette снял роман, помеченный как 78% ИИ; критика: тексты неносителей / нейроразнообразия чаще убивают. (источник: WIRED)
Помощник покупок Alexa: «напомни, когда будет что-то новое» : подписка на новинки брендов, сериалы, туры и т.д.; шопинг от Q&A к упреждающему касанию. (источник: TechCrunch)