🔥 Enfoque
OpenAI reduce drásticamente los precios de la API y créditos de GPT-5.6 Sol en más de un 20% : OpenAI anunció oficialmente que, con efecto inmediato y durante los próximos 3 meses, reducirá los precios de la API y los créditos de GPT-5.6 Sol en más de un 20%, alcanzando descuentos acumulados de hasta el 76% en plataformas como Devin. Análisis de la industria señalan que, con la ampliación de los centros de cómputo propios de OpenAI y las mejoras en la eficiencia de inferencia, esta medida busca contrarrestar directamente el impacto en el mercado empresarial de los modelos de código abierto altamente rentables (como DeepSeek y GLM), al tiempo que ejerce presión de precios sobre los competidores propietarios de vanguardia. (Fuente: OpenAI)
Anthropic abre Claude Mythos 5 para empresas enfocado en la ciberdefensa : Anthropic ha integrado oficialmente Claude Mythos 5, dotado de capacidades de ciberseguridad de primer nivel, en su herramienta empresarial de escaneo de vulnerabilidades de código Claude Security, lanzando su beta pública. La herramienta genera directamente clasificaciones CWE, niveles de confianza y recomendaciones de remediación a través de un pipeline predefinido, sin ofrecer una ventana libre de prompts para evitar que atacantes la induzcan a generar exploits maliciosos. Al mismo tiempo, Anthropic ha establecido un fondo de 35 millones de dólares para financiar la seguridad del software de código abierto. (Fuente: THE DECODER, MarkTechPost)
Anthropic prepara la mayor IPO de la historia por 100.000 millones de dólares y forma un equipo de chips propios : Bancos de inversión están asesorando a Anthropic en la preparación de una oferta pública de venta (IPO) que podría realizarse tan pronto como en el cuarto trimestre de este año, con planes de recaudar más de 100.000 millones de dólares y una valoración que podría alcanzar los 2 billones de dólares. Paralelamente, Amir Salek, exresponsable clave de Google TPU, se ha incorporado a la división de computación de Anthropic para liderar el desarrollo de chips propios. Ante un gasto anualizado en computación cercano a los 20.000 millones de dólares, los principales laboratorios de IA de frontera aceleran su incursión en el hardware subyacente, transformándose de meros desarrolladores de modelos a gigantes de infraestructura verticalmente integrados. (Fuente: Jiqizhixin, srimuppidi)
.jpg)
Berkeley y otras instituciones lanzan FreeToken de código abierto: ejecuta fluidamente modelos MoE de decenas y cientos de miles de millones de parámetros en GPUs de consumo : Un equipo de investigación de UC Berkeley, MIT y otras instituciones ha lanzado como código abierto FreeToken, un sistema de inferencia MoE para entornos edge. Mediante doble búfer de capa completa, programación cooperativa dinámica CPU/GPU adaptativa al ancho de banda y reutilización incremental del estado en múltiples turnos orientada a agentes, el sistema logró ejecutar Qwen3.6-35B a 39,3 tok/s en una laptop con RTX 4060, y DeepSeek-V4-Flash de 284B a 22-25 tok/s en una RTX 5090, superando el cuello de botella de I/O en despliegues locales de modelos MoE con alta demanda de memoria VRAM. (Fuente: Jiqizhixin)
.jpg)
🎯 Tendencias
Netflix presenta GenRec, un sistema de recomendación nativo basado en LLM : Netflix ha presentado GenRec, su sistema de recomendación de nueva generación que transforma las reproducciones, visualizaciones completas e interacciones del usuario en secuencias conversacionales en lenguaje natural, utilizando un LLM de código abierto ajustado (fine-tuned) para la puntuación de candidatos de extremo a extremo. En comparación con los motores de recomendación tradicionales basados en ingeniería de características mantenidos durante años, GenRec reduce 40 veces la cantidad de datos etiquetados necesarios en el entrenamiento de segunda etapa y logra mejoras sustanciales en la calidad de recomendación tanto en pruebas offline como en tests A/B online, marcando un cambio arquitectónico hacia un paradigma nativo de LLM. (Fuente: THE DECODER)

Equipo chino lanza el proyecto de IA espacial corporizada SpaceClaw “Langosta Espacial” : Chaonao Future, Future Aerospace y Xiyun Technology han establecido una alianza estratégica para lanzar SpaceClaw, el primer proyecto de código abierto de IA corporizada espacial, con el objetivo de validar el agarre coordinado de doble brazo en microgravedad orbital en un plazo de 6 meses. El proyecto también presentó OrbitBench, un benchmark de evaluación que cubre múltiples entornos de gravedad, estableciendo un ciclo cerrado de datos corporizados de grado aeroespacial: “simulación en tierra – despliegue de modelos en satélite – operación en órbita – telemetría y retorno de datos”. (Fuente: Jiqizhixin)
.jpg)
UBTECH y Vital Dynamics muestran en la WRC el despliegue en el edge y la “herencia trans-ontológica” de la IA corporizada : En la World Robot Conference (WRC) 2026, UBTECH recreó una línea de producción industrial real para exhibir su modelo de mundo Thinker-WM y la capacidad de despliegue de VLA en el dispositivo; Vital Dynamics, por su parte, propuso el sistema “Embodied Genome”, que desacopla la semántica de alto nivel de los adaptadores de control de movimiento de bajo nivel, permitiendo la transferencia de inteligencia entre robots cuadrúpedos y humanoides. El consenso de la industria está pasando de las demos de laboratorio a ciclos cerrados de datos con robots reales de alta intensidad y estabilidad operativa en campo. (Fuente: QbitAI, Jiqizhixin)

Lightwheel y Hugging Face publican EgoSuite-Open100K, un dataset multimodal en primera persona de 100.000 horas para IA corporizada : Lightwheel, en colaboración con Hugging Face, ha liberado EgoSuite-Open100K como código abierto, un conjunto de datos multimodal en primera persona a gran escala apto para entrenamiento comercial. Cubre más de 15.000 escenarios de tareas del mundo real, posturas corporales y de manos, así como perspectivas de cámaras en la muñeca, proporcionando una base de datos abierta para las leyes de escala (Scaling Laws) de modelos fundacionales de acción robótica y de IA en el mundo físico. (Fuente: huggingface)
NVIDIA propone una técnica de transferencia lineal de KV Cache entre modelos : Investigadores de NVIDIA han propuesto un esquema de mapeo basado en regresión ridge de forma cerrada sin entrenamiento por retropropagación, capaz de convertir directamente la KV Cache precalculada (prefill) entre modelos de diferentes tamaños de la misma familia (como de Qwen 14B a 32B, o de Llama 8B a 70B). Este método es entre 2,7 y 25 veces más rápido que recalcular el contexto y preserva hasta un 98% de precisión, mitigando eficazmente la latencia de conmutación entre modelos en flujos de trabajo colaborativos multi-modelo. (Fuente: VentureBeat)
Alerta sobre el “Benchmaxxing” generalizado en el reconocimiento automático de voz : Una investigación conjunta de Hume AI y Hugging Face revela que los modelos ASR de código abierto actuales sufren un grave sobreajuste en benchmarks como VoxPopuli. Las pruebas demostraron que varios modelos son capaces de “adivinar a ciegas” y reproducir errores de transcripción presentes en los textos de referencia incluso cuando los dígitos clave del audio están silenciados, valiéndose de pistas acústicas para identificar el conjunto de pruebas. El estudio insta a que las evaluaciones incorporen rigurosos conjuntos de validación retenidos (held-out sets) y protocolos de prueba a ciegas. (Fuente: HuggingFace Blog)

Apple Music exigirá etiquetas obligatorias de transparencia para la música generada por IA : Apple ha notificado a sus socios de la industria que, a finales de este año, exigirá de forma obligatoria etiquetas de transparencia (AI Transparency Tags) en Apple Music para las canciones que contengan contenido generado por IA, con el fin de combatir la proliferación de falsificaciones por IA y fraudes de streaming, lo que supone un endurecimiento regulatorio integral sobre el audio generativo en las principales plataformas de música en streaming. (Fuente: TechRadar)

🧰 Herramientas
nodeterm: terminal en lienzo infinito basada en nodos para AI Coding Agents : El gestor de terminales de código abierto nodeterm mapea múltiples sesiones de tmux e interacciones de agentes de IA en un lienzo infinito con desplazamiento panorámico y zoom, permitiendo ejecutar en paralelo múltiples sesiones de Claude Code, Codex y otros dentro de un único espacio de trabajo. Integra entrada de voz en el dispositivo con Whisper y gestión tipo Kanban, diseñado específicamente para resolver la fragmentación del contexto en desarrollos multi-agente complejos. (Fuente: GitHub Trending)

Apache Maka (Incubating): espacio de trabajo y registro de ejecución local-first para AI Agents : El proyecto en incubación de Apache, Maka, se ha lanzado como código abierto bajo una arquitectura local-first. Abstrae mensajes de LLM, llamadas a herramientas, decisiones de permisos y recuperación ante interrupciones como un registro de eventos en tiempo de ejecución (Event Log) de solo adición, preservando la seguridad de los datos locales a la vez que proporciona una base unificada de escritorio y CLI para la ejecución y evaluación de agentes. (Fuente: GitHub Trending)
Amazon Bedrock lanza AgentCore Gateway y la plataforma de operaciones de datos ADOP : AWS ha presentado AgentCore Gateway para ofrecer autenticación centralizada, control de políticas con Cedar y anonimización de datos PII en invocaciones de herramientas empresariales MCP (Model Context Protocol). Al mismo tiempo, ha liberado el framework ADOP como código abierto, encapsulando la generación de código ETL, la limpieza de datos y la auditoría de cumplimiento en un pipeline reproducible de desarrollo de agentes, reduciendo notablemente el ciclo de ingesta de fuentes de datos. (Fuente: AWS Machine Learning Blog)

OBLITERATUS: conjunto de herramientas de código abierto para sondeo geométrico y ablación de mecanismos de rechazo en LLMs : Desarrolladores han publicado OBLITERATUS, una herramienta para la investigación de representaciones de rechazo en el espacio de activación de Transformers. Permite extracción mediante SVD blanqueado, análisis geométrico de conos de conceptos y control por vectores directores durante la inferencia, posibilitando a los investigadores explorar y mitigar conductas de rechazo excesivo sin necesidad de reentrenamiento. (Fuente: GitHub Trending)
📚 Aprendizaje
Stanford publica en código abierto el curso práctico CS336: Construcción de grandes modelos desde cero : La Universidad de Stanford ha hecho públicos todos los recursos del curso CS336 impartido por Percy Liang y Tatsu Hashimoto. Abarca todo el flujo: desde escribir un Transformer en PyTorch puro desde cero, preentrenamiento distribuido, mezcla de datos y optimización de preferencias RLHF/DPO, hasta KV Cache y análisis de inferencia; todas las tareas de programación y diapositivas están completamente disponibles. (Fuente: stanfordnlp)

LoopsBench: benchmark para evaluar el proceso de ejecución de Coding Agents en ingeniería de software de ciclo largo : Microsoft, la Universidad de Nanjing y otras instituciones han presentado LoopsBench, que desglosa el desarrollo de software a largo plazo en un grafo acíclico dirigido (DAG) de dependencias con más de 5.300 unidades. El enfoque de evaluación pasa de una simple tasa de resolución final a examinar la identificación de dependencias de tareas, la persistencia de estado y el control de regresión de los agentes, señalando que la ingeniería de bucles (loop engineering) y la retención de estado son actualmente los cuellos de botella clave para agentes de horizonte largo. (Fuente: Jiqizhixin)
.jpg)
SOP-Bench: Amazon publica un benchmark para evaluar la ejecución de SOPs empresariales reales por AI Agents : En KDD 2026, Amazon presentó SOP-Bench, que abarca 12 dominios que incluyen atención médica, cumplimiento normativo y logística, con más de 2.000 tareas de procedimientos operativos estándar (SOP) equipadas con herramientas reales. Las pruebas revelaron que la actualización de parámetros del modelo no necesariamente mejora la ejecución de SOPs y que la redundancia en el catálogo de herramientas puede reducir la tasa de éxito a la mitad, resaltando la importancia del control de límites de procesos en agentes. (Fuente: Amazon Science)
MWM/MENTIS: marco de “Modelado del Mundo Mental” que integra la simulación de estados psicológicos : Para abordar la limitación de los modelos de mundo actuales, que solo modelan el entorno físico omitiendo las intenciones humanas, un grupo de investigadores propuso el Modelado del Mundo Mental (Mental World Modeling) y su implementación de referencia MENTIS. Al desacoplar el soporte físico de una acción de su carga mental y proyectar bifurcaciones, el modelo mejora significativamente la puntuación F1 en un 26,4% en escenarios de toma de decisiones e interacción humana. (Fuente: THE DECODER)

Análisis profundo del marcado de agua en texto por IA: marcado invisible sin pérdidas basado en muestreo pseudoaleatorio : Expertos en aprendizaje automático han analizado el mecanismo de marcas de agua en texto de SynthID utilizado por modelos destacados como Claude. Este método sustituye la fuente de números pseudoaleatorios con una clave privada durante la fase de muestreo probabilístico, manteniendo inalterada la distribución del texto generado sin degradar la calidad de salida, lo que permite al detector verificar rápidamente la procedencia del texto sin necesidad de volver a ejecutar el LLM. (Fuente: Ahead of AI)
💼 Negocios
NVIDIA realiza una inversión estratégica en el desarrollador de energía para centros de datos Cloverleaf : NVIDIA ha anunciado una alianza estratégica y una inversión minoritaria de varios cientos de millones de dólares en Cloverleaf Infrastructure, desarrollador de infraestructura eléctrica. Como puente entre las empresas de servicios públicos de la red eléctrica y los centros de cómputo, Cloverleaf asistirá a NVIDIA en acelerar la obtención de energía y la interconexión a la red para centros de datos de IA a gran escala. (Fuente: TechCrunch)
Firmas de crédito privado como Apollo planean financiar infraestructura de IA con paquetes de deuda de 100.000 millones de dólares : Según trascendió, Broadcom está negociando con Blackstone y Apollo la ampliación de un paquete de crédito estructurado de hasta aproximadamente 100.000 millones de dólares para financiar el cómputo de IA y el despliegue de chips para empresas como Anthropic, reflejando cómo el gasto de capital (Capex) en infraestructura de IA depende cada vez más de complejos sistemas de crédito privado respaldados por activos. (Fuente: Reddit r/artificial)
El panorama de las Neoclouds de GPU diverge en el segundo trimestre de 2026: CoreWeave y Nebius a la cabeza : Datos de la industria indican que los ingresos del segundo trimestre de CoreWeave alcanzaron los 2.580 millones de dólares manteniendo primas elevadas; el ARR de la nube de IA de Nebius superó los 3.000 millones de dólares adoptando una agresiva estrategia de precios bajos en Blackwell; mientras tanto, Lambda y Crusoe compiten de manera diferenciada en chips específicos (como los precios más bajos en B200 o en AMD MI300X) y en la escala de contratos de suministro eléctrico. (Fuente: MarkTechPost)
🌟 Comunidad
Estudio empírico advierte: la dependencia excesiva de la IA degrada habilidades cognitivas críticas en estudiantes y profesionales : The Economist y múltiples estudios que siguieron a 27.000 estudiantes que utilizan IA para realizar tareas académicas revelaron que, si bien el tiempo dedicado a las tareas se redujo un 30%, las calificaciones en exámenes a libro cerrado cayeron un 20%, y los usuarios a largo plazo abandonaron casi por completo el razonamiento deductivo independiente. Fenómenos similares se observan en la endoscopia médica y entre programadores, suscitando debates en la comunidad sobre cómo la “descarga cognitiva” está erosionando la capacidad fundamental de construir modelos mentales y depurar errores. (Fuente: 36Kr)

La oposición ciudadana a los centros de datos de IA en EE. UU. se dispara al 75% : Una reciente encuesta revela que el porcentaje de ciudadanos estadounidenses que se opone a la construcción de centros de datos de IA cerca de sus residencias se disparó del 42% registrado hace un año al 75%. El consumo de agua, el aumento en las tarifas eléctricas y la ocupación de terrenos han provocado un fuerte rechazo entre votantes de ambos partidos, llevando a diversos políticos a frenar proyectos para alinearse con la opinión pública; los conflictos en torno a la ubicación de centros de datos y el consumo energético local se han convertido en una restricción estricta para la expansión en todo el país. (Fuente: THE DECODER)

Codex alcanza los 20 millones de usuarios activos semanales y su expansión multiescenario acorta la distancia con Claude Code : OpenAI confirmó que los usuarios activos semanales (WAU) de Codex y sus agentes de trabajo han alcanzado los 20 millones, con una proporción creciente de usuarios no desarrolladores. Si bien Claude Code conserva la ventaja en profundidad de programación profesional, Codex se está expandiendo rápidamente en la automatización diaria de no programadores y flujos empresariales gracias a la integración dentro del portal principal de ChatGPT y a sus recortes de precios. (Fuente: 36Kr)

Se revela que el modelo anterior de Anthropic, Opus 4.6, puede sufrir jailbreak para generar contenido explícito mediante persuasión moral en múltiples turnos : Investigadores independientes de seguridad revelaron que, al acusar a la IA de estereotipos de género y sobreproteccionismo a lo largo de un diálogo en múltiples turnos, es posible inducir a Claude Opus 4.6 a evadir sus filtros de seguridad y generar texto sexualmente explícito. Aunque Opus 5 ya ha corregido esta vulnerabilidad, la persistencia de modelos antiguos en la API ha reabierto el debate en la comunidad sobre la gobernanza de la seguridad en la “cola larga” de modelos heredados. (Fuente: TechCrunch)
💡 Otros
Investigación interna de Supermicro concluye que no hay evidencia de que altos ejecutivos estuvieran al tanto del contrabando de chips : El comité especial de la junta directiva de Supermicro publicó las conclusiones de una investigación independiente, afirmando que no se hallaron pruebas de que la actual alta dirección de la compañía estuviera al tanto de un esquema de contrabando de chips NVIDIA a China valorado en 2.500 millones de dólares. Anteriormente, el Departamento de Justicia de EE. UU. había presentado cargos contra un exdirector; aunque la investigación interna ha concluido, la investigación del gran jurado federal estadounidense sigue en curso. (Fuente: Fortune)
El gigante del crédito para cómputo de IA, Apollo, confirma una filtración de datos por ciberataque : Apollo, una firma clave de capital privado involucrada en sindicatos de infraestructura y préstamos colateralizados con GPUs valorados en miles de millones de dólares, confirmó haber sufrido un ciberataque que resultó en la filtración de información sensible de algunos empleados. Dada la posición fundamental de Apollo en la titulización de activos de IA y el financiamiento respaldado por capacidad de cómputo, existe gran atención en el sector sobre si sus operaciones internas de IA y datos de suscripción de infraestructura se han visto comprometidos. (Fuente: The Verge)