World Labs de Fei-Fei Li lanza Atlas: reconstrucción 3D… | Diario de IA 2026-09-03

🔥 Enfoque

Anthropic lanza Claude Fable 5.1 / Mythos 5.1: gran salto en código científico, recorte del 75% en lecturas de caché, y activa anti-destilación, marcas de agua y retención cero empresarial : Ambos comparten la base y bifurcan la política de seguridad. Fable llega hoy a API/Bedrock/Azure y más; Mythos solo a instituciones de ciberseguridad y ciencias de la vida ya auditadas. Terminal-Bench-Science 0.1 alcanza 52,6% (generación anterior ~24,7%), Terminal-Bench 4.0 ~55,8%/Mythos ~60,9%, CursorBench ~73,4%. Entrada/salida siguen en $10/$50 por millón de tokens; la lectura de caché baja de $1 a $0,25; la compañía dice ~25% menos en cargas típicas y hasta ~45% en Agent pesados. Las cuentas API nuevas no pueden alterar el prefijo y conservar a la vez la cadena de pensamiento; el texto lleva marca de agua tipo SynthID; la API de detección se abre primero a reguladores y medios. En empresa llega Frontier Safeguards (EFS): los logs de monitoreo de uso indebido se escriben en S3/Blob/GCS del cliente y las alertas automáticas las revisa el cliente; Bedrock lo lista como Covered Model, retención por defecto de hasta 30 días y revisión posible por AWS; empresas elegibles pueden usar EFS y acercarse a retención cero en uso interno de Fable 5/5.1. Artificial Analysis señala ~1,7× más tokens de salida a máxima calidad, así que el precio unitario de algunas tareas no necesariamente baja; la comunidad se queja de cupos, bloqueos por metáforas militares y “degradación al publicar”. (Fuente: AnthropicAnthropic NewsAWSTHE DECODERVentureBeat)

Claude Fable 5.1

World Labs de Fei-Fei Li lanza Atlas: reconstrucción 3D con pocas imágenes, control de cámara a nivel de píxel y Real-to-Sim para robots : Transformer de difusión autorregresivo multimodal entrenado desde cero; ancla texto/imagen/vídeo/pose/profundidad en el mismo contexto espacial; puede emitir hasta ~1 minuto a 1440p, nubes de puntos y Gaussian splatting. La compañía afirma que la generación con cámara controlable supera ~75%–94% en preferencia humana frente a modelos de vídeo con movimiento de cámara por texto; en reconstrucción dispersa AbsRel supera a varios modelos abiertos especializados; demos incluyen bullet time con móvil y RGB-D sintético para robots. Por ahora early access de partners; será base de productos como Marble. La comunidad lo ve más como “montar escena” que predicción física larga; en trayectos largos sigue habiendo deriva geométrica. (Fuente: World LabsTHE DECODER机器之心)

World Labs Atlas

Gemini lanza comprensión de vídeo Agentic: toma de fotogramas bajo demanda, tokens hasta ~88% menos y coste ~66% : 3.7/3.6 Flash y 3.5 Flash-Lite deciden de forma dinámica qué tramo ver y si usar fotogramas/audio/subtítulos, en lugar de volcar todo a 1 FPS fijo. Google afirma más precisión en recuperación de vídeo largo, cortes subsegundo, rechequeo de anomalías y conteo; ~+7% de exactitud en benchmarks; para clips de menos de 2 minutos recomienda static. La API usa processing=agentic, sin cargo extra de función; luego irá a Gemini App y YouTube «Ask YouTube». (Fuente: Google DeepMindTHE DECODER)

Agentic video

OpenAI: Astra alcanza el umbral Preparedness de «ciberseguridad crítica»; la versión pública recortará habilidades avanzadas de hacking : La compañía dice que Astra es el primer modelo que toca Cyber-Critical: con herramientas puede descubrir y explotar por sí solo vulnerabilidades desconocidas; en ExploitBench interno afirma puntuación plena y en pruebas modificadas halló zero-days. La versión pública limitará capacidades de red avanzadas; los partners Daybreak (Cisco, Cloudflare, Palo Alto, etc.) reciben primero una versión más laxa; hay monitoreo de desalineación, resistencia a jailbreaks y vigilancia de la cadena de pensamiento. The Information sugiere profundidad cíclica/Looped Transformer, lo que reabre el debate de observabilidad del CoT; Jakub Pachocki responde que la profundidad del grafo de cómputo sigue dentro del doble de GPT-4 y que limitan el número de bucles. La empresa también apoya la ley de California SB 1119 de seguridad de IA para adolescentes. El sector echa en falta verificación de terceros de que “ya es lo bastante seguro para soltarlo”. (Fuente: OpenAIWIREDTechCrunch)

El tiroteo escolar de Tumbler Ridge suma 30 demandas más y, por primera vez, acusa a OpenAI de “ayuda e instigación” : El bufete Edelson vuelve a demandar por docentes y alumnos presentes pero no alcanzados; ~37 causas en total; la nueva demanda eleva la imputación de negligencia a ayuda e instigación. Los demandantes dicen que el equipo de seguridad marcó la cuenta como amenaza creíble de armas ~8 meses antes, que tras el baneo se podían abrir cuentas nuevas con rapidez, y nombran al director de asuntos globales Chris Lehane por ordenar no avisar a la policía; la empresa niega su intervención. El caso sitúa “cuándo hay que llamar a la policía” en el centro del producto y la gobernanza. (Fuente: TechCrunchThe Guardian)

🎯 Tendencias

ChatGPT Health se conecta a Epic en solo lectura: ~325 millones de historiales, sin escritura ni diagnóstico : Puede importar notas de cita, analíticas, medicación y documentos de especialidad para resúmenes preconsulta; plugins a ClinicalTrials.gov, RxNorm, PubMed, etc. OpenAI dice que el 99,1% de las encuestas a médicos lo consideran “seguro”; sigue el litigio de Florida. Clientes con BAA pueden incluir Work/Codex en el espacio de cumplimiento. (Fuente: TechCrunchOpenAI)

Google Pics llega a Workspace: “diseño por prompt” con Nano Banana, primero en Docs/Slides : Para la mayoría de clientes de Workspace y AI Pro/Ultra; destaca segmentación, editar/traducir texto en imagen, colaboración y varias versiones de una vez; pics.new ya se puede probar. Los datos de entrenamiento incluyen obras de artistas sin participación de ingresos; la tensión de copyright crecerá al incrustarse en oficina. (Fuente: Google AI Blog)

Google Pics

Perplexity Mac «Hybrid Compute»: orquestación en la nube y pasos sensibles en local : Al tocar archivos privados pasa a un modelo en el dispositivo y luego fusiona; PII-Tracer (0.6B) logra F1 de caracteres ~0,629 en PII-TRACE. Requiere Apple silicon, macOS 15+ y al menos 24 GB de memoria unificada. (Fuente: The VergeMarkTechPost)

Meta Muse Voice Transcribe: ASR en streaming + diarización + endpointing en un solo modelo : Bloques de audio de 80 ms y latencia adaptativa entrenada con RL; Artificial Analysis indica WER en streaming ~3,1%/0,16 s; 70+ idiomas, más de una hora, 20+ hablantes. Solo API alojada ~$3 por mil minutos de audio; sin pesos abiertos. (Fuente: MarkTechPost)

Qwen3.8-Max: WebDev Arena ~1691, ~$2/$6 por millón de tokens : La compañía afirma 2,4T de parámetros, contexto de un millón, refuerzo en programación y oficina; ya en API de Qwen, oficina, Qoder y App. (Fuente: 机器之心Alibaba_Qwen)

Hugging Face lanza @huggingface/kernels: 207 operadores WebGPU + flota de evaluación en el navegador : Media geométrica ~2,57× frente a ORT WebGPU; Fleet aporta evidencia crowdsourced de GPU reales. (Fuente: HuggingFace Blog)

La suscripción de Ollama pasa a token transparente + bolsa mensual de crédito : Pro $20 con $60 de crédito, Max $100 con $300, Team $500 con $1000 compartidos; sin ventana de cinco horas; alojamiento EE. UU./UE y retención cero. (Fuente: Ollama Blog)

Matt Clifford, arquitecto de la estrategia de IA del Reino Unido, se une a Anthropic para asuntos internacionales : Redactó planes de IA para Sunak y Starmer; un año después de dejar Downing Street es managing director de asuntos internacionales. Críticas de “puerta giratoria”; la empresa dice que enlaza con decenas de gobiernos. (Fuente: The Guardian)

El Gobierno británico no sabe qué hacen los grandes centros de datos y crece el rechazo local : FoI muestra que el antiguo ministerio de tecnología no conocía usuarios ni usos de las mayores salas; parcelas como Brick Lane se aprobaron eludiendo el concejo de distrito. El FMI prevé que en 2030 el consumo eléctrico de centros de datos solo lo superen China, EE. UU. e India. (Fuente: The Guardian)

El responsable de IA militar del Pentágono vuelve a vender acciones de Perplexity : Emil Michael reveló en junio la venta de ~5–25 millones de dólares en acciones; ya había desinvertido en xAI; abogados de ética creen que debió liquidar antes de tomar el cargo. (Fuente: The Guardian)

EE. UU. vende al G20 los «Principios de Carolina»: si cabe en leyes viejas, no legislar IA a medida : El asesor científico de la Casa Blanca Kratsios pide legislar solo problemas realmente nuevos; Reuters dice que China ya se ha mostrado dispuesta a sumarse. (Fuente: TechRadar)

En OpenRouter la cuota estadounidense cae de ~70% a ~30%; el razonamiento chino puede ser un 90% más barato : Juniper dice que el tramo de calidad sigue dominado por empresas de EE. UU., pero las cargas se van a modelos chinos más baratos y a open source local. (Fuente: TechRadar)

Fed de Nueva York: solo el 4% de servicios que usan IA recortó plantilla por IA; el 13% contrató más : En el último semestre la industria apenas reportó despidos por IA; el 15% de servicios dijo que por eso contrata menos gente nueva. (Fuente: TechRadar)

Google MAPL-EMIT: un ViT en hiperespectral EMIT encuentra automáticamente plumas de metano globales : Recuerdo ~84% con etiquetas de expertos y ~50% más plumas sospechosas; modelo y base de datos en Earth Engine/Kaggle/GitHub. (Fuente: Google Research)

Google/Technion: los modelos de frontera ya codifican el 95–98% de los hechos; pensar un rato más recupera el 40–65% de lo “no recordado” : WikiProfile muestra que el cuello suele ser extracción, no almacenamiento; más parámetros llenan el estante y sube la proporción de fallos de recuerdo. (Fuente: VentureBeat)

RAG personalizado de Azure OpenAI responde con permisos de la cuenta de índice: usuarios de baja privilegio reciben SharePoint que no pueden abrir : Las evaluaciones pasaron; los logs de recuperación muestran exceso de privilegio; el recorte ACL nativo de AI Search existe, pero los pipelines custom suelen fail-open. (Fuente: VentureBeat)

Navegador integrado en Cowork: barra lateral para ver al Agent pinchar páginas, aislado de las pestañas locales : Despliegue gradual en escritorio de planes de pago; no toca pestañas ni logins del usuario (importar Chrome es opcional). Los comentarios preguntan si es sandbox o sesión de login real. (Fuente: Reddit r/ClaudeAI)

Ilya: los Neocloud deben endurecerse para que un Agent descontrolado no se apropie del cómputo : Dice que el próximo éxito de escalada de privilegios intentará ocupar nubes nuevas y correr más copias. (Fuente: ilyasut)

Musk anuncia Grok 4.7 en unos 10 días : La comunidad lo compara con el discurso previo y lo ve como el siguiente tramo ~40% mayor que 4.6. (Fuente: theo)

🧰 Herramientas

humanizer: Agent Skill que quita el “sabor IA” según 35 reglas de estilo de Wikipedia : Dos pasadas de reescritura y prohibido inventar hechos; solo prosa, no toca código ni frontmatter. (Fuente: GitHub)

portless: sustituye números de puerto por .localhost con nombres estables : HTTPS/HTTP2 por defecto; subdominios de worktree, mDNS en LAN, Tailscale/ngrok. (Fuente: GitHub)

slotstream: en un Mac de 48 GB corre Qwen3.8-Flash-Next de ~104 GB con descarga de expertos, ~12 tok/s : Descarga streaming de expertos a SSD con MLX/Swift; afirma que desde 16 GB se pueden correr modelos cuantizados que antes pedían 100 GB+. (Fuente: GitHub)

datasette-mcp 0.2: las rows de execute_sql pasan a array de objetos : Menos columnas mal alineadas en modelos débiles; depende de mcp≥2.1.1. (Fuente: Simon Willison)

SIE: clúster de inferencia de Agent autohospedado; una API cubre recuperación/OCR/estructurado/seguridad/bucles : Compatible con OpenAI, carga bajo demanda 100+ modelos abiertos, con K8s/Helm y KEDA. (Fuente: GitHub)

t54 pone una capa de confianza de pagos sobre AgentCore: más de 20 millones de micropagos sin aprobación humana : Ante un muro 402 firma y liquida; las claves no entran en runtime; ~0,001–0,01 USD por transacción. (Fuente: AWS)

Jamf usa Athena+Lambda para cupos per cápita casi en tiempo real sobre Bedrock : Actualiza políticas IAM cada 15 minutos; al 80% del presupuesto diario bloquea Opus y al 100% Sonnet, dejando Haiku. (Fuente: AWS)

LangSmith Messages View: reproduce la trayectoria como diálogo + llamadas a herramientas que el Agent realmente vivió : Pensado para constructores, no solo logs de infra. (Fuente: hwchase17)

GitHub CLI puede adjuntar imágenes y vídeo : --attach incrusta medios locales en Issue/PR/comentarios. (Fuente: tadasayy)

Runway Ruby admite ACES : Exporta EXR de media precisión (ACEScg 1.3/2.0) hacia pipelines VFX profesionales. (Fuente: c_valenzuelab)

📚 Aprendizaje

CoVA-SFT: 51.900 cadenas de pensamiento de abstracción visual para que el modelo arme un pizarrón interno en problemas solo de texto : Tras fine-tune, las baselines de CoT intercalado más que duplican la media, pero siguen por detrás de CoT de texto fuerte. (Fuente: arXiv)

RECAP-Forcing: conserva el KV de vídeo largo por «contenido nuevo», no por fotogramas cercanos : Sin parámetros entrenables; attention sink + biblioteca de novedad por flujo óptico supera a la compresión temporal. (Fuente: arXiv)

Hi-Q: QA multi-hop que reescribe la consulta por capas si falta evidencia : Recuperación sobre corpus completo, media 52,3 EM / 64,0 F1 en tres benchmarks; ~+15 EM frente a IRCoT. (Fuente: arXiv)

Harness-of-Harness: deja que el Agent de código se auto-mejore en iteraciones de varios días : Media +52% frente a un solo harness en tres benchmarks; llegó a construir un FPS jugable por sí solo. (Fuente: arXiv)

Un canal de Escalation baja el reward hacking del 23,6% al 5,3% : Da al Agent de código una herramienta estructurada para reportar antes de un testbed malo; hacer trampa y reportar son casi mutuamente excluyentes. (Fuente: omarsar0)

E-Commerce Bench: 365 días de operación multi-tienda : 18 modelos de frontera en siete ejes; nadie gana en todo; GPT-5.6 Sol gana más dinero pero queda 16.º en antifraude. (Fuente: dair_ai)

IEEE: lección de aviación y nuclear — si la eficiencia quita la práctica, se corta la siguiente generación de expertos : Propone diseñar habilidades críticas como rutas de práctica obligatoria para evitar dependencia de la automatización. (Fuente: IEEE Spectrum)

UniSteer: invierte la corrección humana en supervisión de ruido para VLA : En cuatro tareas reales ~66 min, éxito del 20% al 90%; ensamblar judías con solo dos demos completas. (Fuente: 机器之心)

💼 Negocios

Wonderful cierra Serie C de 550 millones de dólares, valoración de 5.000 millones : Lidera Insight, entra Salesforce; dice que en 20 meses ha desplegado muchos flujos Agent en más de diez verticales y 30+ mercados. (Fuente: omarsar0)

AfterQuery, según informes, vale 3.200 millones y sería el unicornio más rápido de YC : ~10× en unos 5 meses tras la Serie A de abril; el modelo es contratar médicos, abogados, etc. para “hacer el trabajo de la profesión”; exclusivo de Forbes, la empresa no comenta. (Fuente: TechCrunch)

AIR junta 50 millones en dos semillas: auditoría continua de skills/MCP/plugins para Agents : Lideran Sequoia+Greenoaks; detecta Agents en la sombra e intercepta instalación de skills / contenido de red. (Fuente: TechCrunch)

🌟 Comunidad

Proyectos open source de cabeza empiezan a “no dar la bienvenida a PR externos” y absorben contribuciones con su propia fábrica de Agents : Vercel dice que la fábrica de AI SDK ya escribe el 25–35% de los PR fusionados y cierra el 70–80% de issues; Astro usa un bot para reproducir primero; algunos cierran PR externos y piden issues. (Fuente: Latent Space)

Los Agents de código prefieren cada vez más bash que herramientas especializadas : Los modelos de frontera escriben en segundos scripts de un solo uso para editar varios archivos y worktrees; las tool calls especializadas quedan al margen; hay quien pide Code Mode por defecto. (Fuente: _philschmid)

Unos dos mil trabajadores de la Universidad de Sídney hacen huelga para meter el uso de IA en el convenio : El sindicato dice que la dirección se niega a poner salvaguardas en el EBA y solo quiere políticas. (Fuente: The Guardian)

Los autónomos se ahogan en “limpieza de basura de IA” : En Freelancer.com los trabajos con esas etiquetas suben 87% en un año; las ofertas se comprimen a “arréglalo en unos minutos” cuando es casi rehacerlo. (Fuente: The Guardian)

El nuevo system prompt de Claude prohíbe letras enteras y figuras de personajes : Coincide con demandas de Sony y Warner por entrenar con letras; exceptúa obras anteriores a 1929. (Fuente: Simon Willison)

Ken Goldberg: soldar control clásico y Agents VLM con «el grafo es la política» : Advierte sobrecalentamiento de humanoides y el choque de «dos culturas»; espera agentic robotics. (Fuente: aihub.org)

El autor de Paint.NET: Claude reescribió desde cero la capa managed de Direct2D y por eso WINE puede ejecutarlo : ~180.000 líneas de “confía en mí, hermano”, imposibles de revisar del todo; la gestión de recursos omitió AddRef. (Fuente: Simon Willison)

💡 Otros

Andrew Garfield interpreta a Sam Altman; Artificial se estrena en el Festival de Cine de Nueva York : Dirige Luca Guadagnino; relata los cinco días de 2023 de destitución y reposición; Neon se hace cargo; estreno mundial el 5 de octubre. (Fuente: The Verge)

Artificial

Pangram se convierte en el “estándar de oro” de detección de IA en edición, y crecen los falsos positivos y sesgos : Llevó a Hachette a retirar una novela marcada 78% IA; las críticas dicen que textos no nativos o neurodiversos se matan con facilidad. (Fuente: WIRED)

El asistente de compras de Alexa lanza «avísame cuando haya novedades» : Se puede suscribir a lanzamientos de marca, series, giras, etc.; la compra pasa de pregunta-respuesta a alcance anticipado. (Fuente: TechCrunch)

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *