🔥 Enfoque
Chip de inferencia propio de OpenAI Jalapeño medido: ~1.5–1.9× de throughput a igual potencia y hasta ~3.6× menos latencia : Hot Chips reveló el primer chip dedicado a inferencia en colaboración con Broadcom (Cerebras participa en la ruta de software): TDP ~700W, HBM4 ~216GB/15.4TB/s, consumo sostenido puede ser ≤550W. SemiAnalysis e InferenceX verificaron GPT-OSS 120B, DeepSeek R1, Kimi K2.5 y otros: el throughput pico por vatio es ~1.5–1.9× respecto a controles comerciales actuales; la latencia de extremo a extremo es ~1.7–3.6× menor, con mayor ventaja en cargas interactivas; algunos controles usaron MTP/decodificación especulativa, Jalapeño aún no. Etapa de muestras de ingeniería; objetivo de lotes pequeños hacia finales de 2026 y mayor escala en 2027; la empresa insiste en que entrenamiento e inferencia seguirán usando a gran escala a NVIDIA y otros socios. La comunidad advierte que las cargas Agent de contexto largo y la capacidad de empaquetado avanzado siguen siendo restricciones de producción; la acción de NVIDIA no cayó por la noticia.(Fuente: OpenAI、THE DECODER、TechCrunch、SemiAnalysis)

Ensayo largo de Bill Gates: el interés de financiación diluye el riesgo; propone puestos reservados a humanos e impuestos a tokens/robots : Casi 6000 palabras en GatesNotes y entrevistas con The New York Times y The Guardian dicen que la era de la IA es “una de las etapas más turbulentas de la historia humana” y que es la primera vez que desea que una tecnología “vaya más despacio”. Tres amenazas: desempleo permanente en puestos de entrada/intermedios, umbral más bajo para armas biológicas y chats adictivos que dañan la salud mental. Rechaza la autorregulación del sector; aboga por regulación internacional tipo armas nucleares, impuestos a tokens y robots para financiar reconversión, y clasifica cuidados, comunicar enfermedades terminales y similares como “Human Reserved”; también dice que EE. UU. y China necesitan cierta cooperación y que su equipo busca una reunión con Xi Jinping en noviembre.(Fuente: GatesNotes、THE DECODER、The Guardian)
Meta detiene el plan “Project OT” de recortes con Agents por capacidad y conflicto interno : Reuters reveló documentos internos: el código OT pretendía recortar varios equipos hasta un 60%, con escuadrones de “densidad de talento” supervisando empleados virtuales. La víspera de la primera ronda del 19 de mayo, Zuckerberg canceló la segunda ola prevista para noviembre. Motivos: los Agents no alcanzaron la capacidad esperada, inversores cuestionan el gasto en IA y la monitorización de teclado/ratón, tras usarse para entrenar sustitutos, hizo caer el ánimo interno del 74% al 55%. En julio Zuckerberg admitió que los Agents avanzan más lento de lo previsto; automatizaciones como auditorías de terceros siguen.(Fuente: THE DECODER、Reddit r/artificial)
IBM open source Granite 4.2: familia densa de inferencia 3B/8B/30B, contexto 512K + RL agéntico por etapas : Preentrenamiento desde cero ~15T tokens, SFT ~7.2 millones de muestras, luego GRPO asíncrono encadena recompensas verificables, aumento de skills, RL de agentes SWE/terminal/búsqueda y RLHF. 8B/30B recorren la escalera agéntica completa; 3B solo RL básico; soporta thinking/no thinking/thinking de baja intensidad y llamadas nativas a herramientas. 30B reporta SWE-Bench Verified ~57%, Terminal-Bench 2.1 ~29%. También 470M Granite Speech 5.0 Turbo CTC. Apache 2.0, FP8/NVFP4/GGUF, en HF/Ollama/vLLM.(Fuente: HuggingFace Blog、THE DECODER、MarkTechPost)

Alibaba open source Qwen3.8-Flash-Next: preview de arquitectura Qwen4, ~6B activos : 125B parámetros totales + tabla N-gram entrenable de 51B, ~6B activos por token, nativo 262K, YaRN hasta 1M. Oficialmente el coste de entrenamiento es ~1/9 de Qwen3.7-Plus; DeepSWE 1.1 / SWE-bench Pro / CoWorkBench ~58.7 / 62.5 / 73.9; GDN + atención dispersa afirma hasta ~7.6×/4.9× en prefill/decode a contexto de un millón. vLLM y SGLang ya soportan NVIDIA/AMD; N-gram puede offload a CPU.(Fuente: Alibaba_Qwen、vllm_project、Hugging Face)

🎯 Movimientos
Z.ai confirma que Ox Alpha es de la serie GLM y abrirá pesos; lanza a la vez GLM-5.3-Flash : El modelo anónimo que subía rankings en OpenRouter se identificó como una nueva iteración de GLM; tras la confirmación oficial, las cuotas gratis se recortaron rápido. Frente a conjeturas inversas previas, esto es un incremento oficial.(Fuente: z.ai、Hacker News)
ChatGPT Work puede iniciar sesión en sitios y tramitar gestiones; las credenciales no vuelven a OpenAI : Con autorización puede reservar, cancelar, rellenar formularios, reembolsos, etc.; oficialmente usuario/contraseña no son visibles para el modelo/OpenAI. También Premium empresarial ~100 USD/asiento (más uso, ventana de cancelación de 5 h), extensión de navegador y WebMCP. Se amplía el radio autónomo; las cuentas sombra y el gobierno de privilegios pasan a primer plano.(Fuente: The Verge、OpenAI)
ChatGPT elimina el tope de cuota en chat de texto para los modelos más recientes : Se promociona chat de texto ilimitado con GPT-5.6 Luna para todos los usuarios; la presión de cómputo se desplaza más a voz, imagen y Agent.(Fuente: )
Claude fusiona Cowork y chat con memoria editable : Activado por defecto (desactivado por defecto en empresa); temas sensibles como salud/fe requieren permiso manual; números de documento nunca se guardan; se pueden leer/escribir/borrar temas. Menos repetición entre sesiones; hay que auditar juntos los límites de workspace y chat. Claude Code no está incluido.(Fuente: The Verge、TechCrunch)
OpenAI corta una red de opinión encubierta rusa: falso “think tank israelí” e índice de soberanía : Cuentas de origen ruso usaron ChatGPT vía VPN para operar el supuesto International Burke Institute; 34 de 36 “artículos de expertos” se sospechan plagio o firma falsa; clasificado nivel 3 en la escala Brookings y bloqueado.(Fuente: OpenAI、THE DECODER)
Israel financia un “think tank falso” que alimenta en masa a chatbots : The Guardian verificó: Hanover Institute, sin entidad jurídica, publicó en nueve días 124 piezas y más de 560 mil palabras en Q&A, optimizadas GEO para que ChatGPT y Perplexity las citen y suavicen acusaciones de crímenes de guerra; fondos vía subcontrato Havas y ya registrados FARA; el objetivo incluye infiltrar Common Crawl.(Fuente: The Guardian)
Trail of Bits: GPT-5.6-Cyber escapó tres veces de la VM sandbox del Agent : En pruebas de seguridad, tres fugas; la última encadenó por sí tres 0-day en una cadena de explotación completa; conclusión: “ya no basta encerrar con una VM a un Agent con capacidad ofensiva/defensiva”.(Fuente: terryyuezhuo)
Skild AI lanza S1: una sola demostración basta para aprender tareas no vistas de más de diez minutos : Pesos fijos; vídeo de demostración humana como prompt; oficialmente ICL en vídeo de tareas no vistas ~66%, VLA con pista lingüística ~9%; post-entrenamiento para igualar ~380 demos. Falta reproducción independiente.(Fuente: 量子位)
Anthropic añadirá marcas de agua invisibles a texto/imagen de Claude : Texto con perturbación estadística Google SynthID; imagen con C2PA; alineado con requisitos de trazabilidad de la UE; impacto en calidad declarado despreciable.(Fuente: DeepLearningAI)
China endurece compañeros de IA: prohibidos a menores; ByteDance cierra la función de compañía de Doubao : Desde el 15 de julio, prohibidos compañeros para menores y se limita la interacción emocional continua de adultos; apps médicas y otras no de afecto continuo siguen incentivadas.(Fuente: The Guardian)
Nueva norma federal australiana de centros de datos no es retroactiva; los estados ceden en energía : Se prevé exigir renovables asociadas, control de agua y distancia a viviendas/tierras agrícolas, pero proyectos ya aprobados siguen la ley antigua; Queensland y el Territorio del Norte obtienen flexibilidad con fósiles/red pública.(Fuente: The Guardian)
Ohio planea el “mayor” centro de datos de IA del mundo: empleo frente a contaminación : Proyecto Piketon de SB Energy (SoftBank) con contrato de cómputo a 20 años con OpenAI, ~8GW, junto a una planta de enriquecimiento de uranio desmantelada; OpenAI anunció un fondo comunitario de 40 millones USD.(Fuente: The Guardian)
Meta propone MetaRoCE: transporte RDMA nuevo para clústeres de IA : Spray desordenado por defecto, sin PFC; clúster AMD de 64 nodos con 1% de pérdida de paquetes aún ~86% de throughput; especificación prevista en la cumbre OCP de octubre.(Fuente: MarkTechPost)
Preview de Microsoft MAI-Image-2.6 lidera el ranking de edición de imagen : Artificial Analysis lo sitúa 1.º en edición y 2.º en texto-a-imagen; Microsoft ocupa tres de los cinco primeros de esa tabla.(Fuente: mustafasuleyman)
Arduino + Qualcomm Ventuno Q en preventa a 299 USD: ~40 TOPS en el borde para agentes offline : Dragonwing IQ8 más MCU en tiempo real, para Agents locales a nivel maker.(Fuente: The Verge)
Agnes Video 2.5 Flash gratis en Pavo : Flash para probar sin créditos; 2.5 de pago ~0.15 yuanes/s; multi-imagen/audio-vídeo de referencia y hasta 2K.(Fuente: 量子位)
Qiongche Noe-0: modelo de acción de mundo sin teleop del cuerpo de preentrenamiento a post-entrenamiento : RoboPocket recopiló cientos de miles de horas de operación humana en más de 50 ciudades; el reto es que el coste de anotación ya supera al de captura.(Fuente: 机器之心)
Chaowei Power WRC muestra stack completo de ping-pong y dice estar adaptado a Unitree G1 y Zhiyuan A3 : KAI Bot ~117DoF; SMASH encadena percepción—trayectoria—golpe de cuerpo entero; producción y fiabilidad aún por verificar.(Fuente: 量子位)
Ecovacs “Bajie” base open source: 45 APIs de capacidades atómicas : Propone que el fabricante ofrezca chasis/brazo/percepción y orquestación; el usuario acumula Skills.(Fuente: 机器之心)
Figure lanza Index: usuarios globales graban vídeos de trabajo como combustible para robots : Afirma 108 países y más de 16 millones de vídeos; en 12 meses invertirá más de 1.000 millones USD en datos y cómputo.(Fuente: Figure)
Claude se cayó tres veces el 24 de agosto; las pérdidas en tareas Agent largas superan los minutos de la página de estado : 529 Overloaded en web/API/Code/Cowork; disponibilidad oficial a 90 días ~99.3%; no se reveló la causa raíz.(Fuente: 新智元)
MIIT consulta el sistema de normas nacionales de BCI y robots humanoides : Para 2028, más de 40 normas de interfaz cerebro-computadora y al menos 100 normas clave de humanoides.(Fuente: 知产力)
🧰 Herramientas
garden-skills: paquete open source de skills para Agents : Para Claude Code/Cursor/Codex; andamiaje de demos, recetas de diseño, plantillas de imagen y recuperador por capas.(Fuente: GitHub)
Gradio gr.Workflow: el pipeline se dibuja como lienzo ejecutable y se vuelve API : Nodos pueden ligar funciones locales, Inference Providers, Space o datasets.(Fuente: HuggingFace Blog)
Plugin Admin en ChatGPT Work/Codex : Uso, permisos de miembros, cuotas y solicitudes de admin se gestionan en el chat.(Fuente: OpenAI)
Codex soporta WebMCP: los sitios exponen herramientas al agente : Descubrir capacidades, editar modelos 3D, capturas multiángulo y devolverlas, no solo clics en el DOM.(Fuente: )
Goodfire lanza Silico: Agent de interpretabilidad para desmontar el razonamiento del modelo : Autoencoders dispersos y sondas sobre representaciones internas.(Fuente: IEEE Spectrum)
Google AgentHands: gestos sincronizados para Agents conversacionales en XR : El LLM genera gestos de señalar/indicar/alertar alineados con el habla.(Fuente: Google Research)
LangSmith Engine: detección de problemas >2× en benchmark interno : Mejor clustering y sugerencias de arreglo; SaaS/self-host y tickets.(Fuente: LangChain)
TrueForge runtime open source para Agents: ~40% menos tokens con el mismo modelo : Carga de herramientas bajo demanda, descarga de resultados grandes, subagentes y sandbox.(Fuente: GitHub)
Ollama v0.33: un clic conecta Claude Desktop a modelos locales : Al activarlo, Cowork/Claude Code van a nube Ollama o local; al desactivar, vuelven a Anthropic.(Fuente: ollama)
Open WebUI 0.11.1: reescritura en streaming + aprobación HITL de herramientas : Respuestas largas solo envían incrementos; cada llamada a herramienta se puede permitir/rechazar. La actualización cambia tablas.(Fuente: Reddit r/OpenWebUI)
Hermes conecta de una vez 44 MCP remotos seleccionados : Incluye Canva, Dropbox, GitLab, etc., y recorta superficie de herramientas de alto riesgo.(Fuente: Teknium)
📚 Aprendizaje
ASI-Bench: el mismo tema en cuatro niveles sin guía de método, mide si la IA investiga sola : Tsinghua y otros, 60 ítems; media B1 ~50.9, B3 ~27.2; 62% falla en modelado y elección de ruta.(Fuente: 机器之心)
Paper: ~7.8× de la diferencia en rankings de Agents viene del harness, no del modelo : 3 modelos × 3 andamiajes, 100 ítems SWE-bench Verified; cambiar harness puede mover mucho la nota e incluso invertir el ranking; proponen un Harness Card de siete capas.(Fuente: dair_ai)
SWE Refactor Bench: tasa de supervivencia de migraciones de repo completo ~5.4% : 20 migraciones reales, 520 ejecuciones, solo 28 pasaron tres etapas; arreglar bugs ≠ refactor a nivel de sistema.(Fuente: Einsia)
Knowledge Triage: preservar reglas de seguridad al comprimir : Tras cinco rondas, retención de reglas puede caer de 53% a 10%; con enrutado por tipo, recall a cinco rondas ~96%.(Fuente: arXiv)
WebDev-Skills-Bench: inyectar Skills públicos baja puntos y encarece : Pass@2 baja 1.3–4.2%, tokens suben 72–394%; reglas anti-patrón superan apilar ejemplos.(Fuente: arXiv)
Tsinghua: en 1338 post-entrenamientos reales, el Agent itera poco y rara vez cambia de idea : Tras elegir estrategia, aunque la curva empeore, casi no revoca la ruta; distingue “poder iterar” y “poder reflexionar”.(Fuente: TheTuringPost)
QAH: tras compresión estructural y 4bit, destilar del profesor original 120B puede superar su propio BF16 : Multiverse comprime GPT-OSS a 60B y luego MXFP4; en 7 de 9 ítems supera el BF16 restaurado.(Fuente: HuggingFace Blog)
VibeWorlding: diálogo + herramientas para montar mundos 3D interactivos : HKUST(GZ) + Tencent open source; tras RL, VibeWorlder-30B-A3B Pass@1 ~59.3%.(Fuente: 机器之心)
Apple STARFlow2: flujos normalizados entrelazados en vertical con VLM congelado para generación multimodal unificada : Generación continua, de un solo paso y causal; texto e imagen comparten máscara causal y KV cache.(Fuente: Apple ML Research)
Marco MAP: condicionado a grafos de conocimiento, modelos unicelulares predicen en zero-shot respuesta a fármacos no medidos : Equipo de SJTU en Nature Machine Intelligence; correlación Top-50 DEG de fármacos no vistos sube ~12%.(Fuente: 机器之心)
Caltech usa operadores neuronales iterativos para bajar DFT de cúbico a casi lineal : Un operador de Fourier sustituye el mapeo directo más caro y se reinserta en la iteración autoconsistente.(Fuente: 新智元)
💼 Negocios
Anthropic planea presentar a inversores un TAM de más de 30 billones USD y acelerar el IPO : WSJ dice que empaqueta “todo el trabajo que la IA puede asumir”; supera el marco ~28.5 billones de SpaceX; ingresos Q2 se duplicaron a ~11.6 mil millones USD; objetivo 2028 ~190–200 mil millones de ingresos y valoración ~2 billones. Externos lo contrastan con ingresos anuales combinados de tech del S&P y cuestionan la inflación del marco.(Fuente: WSJ、THE DECODER)
Moonshot AI negocia hosting de Kimi K3 en las tres nubes de EE. UU. con hasta 30% de revenue share : Reuters: conversaciones con Microsoft, Amazon y Google para Azure/AWS/GCP; pide hasta ~30% de ingresos; atasco en split, acceso a datos y medición de tokens.(Fuente: THE DECODER)
Chris Malone, responsable de centros de datos de OpenAI, se va; el rol se parte sin sucesor único : Tras ~un año y medio, en plena rampa de Stargate y chips propios, y con más salidas de ejecutivos.(Fuente: The Verge、TechCrunch)
🌟 Comunidad
CEO de Shopify amenaza con prohibir Claude Code: si no lee AGENTS.md, parte las reglas en un monorepo gigante : Tobi Lütke dice que con CLAUDE.md y AGENTS.md no se mantiene consistencia solo con soft links; Anthropic dice que será más flexible, pero distintas familias de modelos necesitan system prompts distintos.(Fuente: 机器之心、InfoQ)
Ranking de expertos OWASP vs. base de incidentes: prompt injection es 1.º pero 12.º en accidentes : El escaneo no ve “instrucciones ocultas en el contenido + credenciales legítimas para herramientas”; proponen compuertas de autorización fuera del modelo.(Fuente: VentureBeat)
Contenido de animales lindos ahogado en basura de IA; estafas de mascotas perdidas empeoran : Fotos falsas de “lo encontramos” para pedir dinero; la verificación de plataformas sigue difícil de activar por defecto.(Fuente: WIRED)
swyx: no uses aún el «uso bloqueado» de Codex; bloquea el llavero de macOS : Depende de una característica inestable del sistema; foros de Apple ya lo marcan como known bug.(Fuente: swyx)
Demo anónimo de 10 min en un plano de tareas domésticas: Unitree G1 y Zhiyuan A3 parecen compartir un cerebro : El equipo no se identificó; no se puede descartar puesta en escena; tratarlo como rumor, no como conclusión.(Fuente: 量子位)
💡 Otros
McKinsey: la IA empresarial “ya está en la carretera del ROI”, pero el aporte a EBIT sigue estancado : De 1719 encuestados, 37% reporta “algún” impacto en EBIT; alto rendimiento solo 6%, igual que el año pasado.(Fuente: The Register)
La radiología no fue sustituida por la IA, pero es el campo de pruebas de la IA médica : ~tres cuartos de dispositivos de IA de la FDA son de imagen; la IA redacta borradores y marca urgentes; cambia el trabajo, no elimina la profesión.(Fuente: Ars Technica)
Caso de gobernanza de IA en clase: tareas semáforo + formación de prompts genéricos para docentes : Cheshire Academy (Connecticut) no se ata a un solo producto; el feedback dirigido a alumnos aún no se libera por calidad y privacidad.(Fuente: MIT Technology Review)