🔥 Destacados
xAI lanza Grok 4.6 y presenta el agente Grok Bot : xAI ha lanzado oficialmente el modelo Grok 4.6, que admite un contexto de 500K y entrada multimodal. El modelo obtuvo 61 puntos en el índice de inteligencia AA, igualando a GPT-5.6 Sol, y ocupó el segundo lugar en la evaluación de trabajo real GDPVal-AA v2 con un Elo de 1753. El precio de su API es de 2 dólares por millón de inputs y 6 dólares por millón de outputs, lo que es más de un 60% más barato que sus competidores. Lanzado simultáneamente, Grok Bot admite la colaboración multi-agente y la ejecución independiente en la nube, pudiendo iniciar sesión automáticamente en aplicaciones de terceros y aprender los flujos de trabajo de los usuarios. (Fuente: xAI)

Se lanza la versión oficial de DeepSeek V4 Pro y se abre el código del framework Harness : DeepSeek ha lanzado la versión oficial de V4 Pro (0813), que adopta una arquitectura MoE de 1.6T de parámetros y admite un contexto de 1M y entrada de imágenes. Su capacidad de Agent ha dado un gran salto, pasando de 12.8 puntos en la versión preview a 62.7 puntos en el benchmark DeepSWE. Al mismo tiempo, se ha abierto oficialmente el código del framework de agentes DeepSeek Harness v0.1 basado en el micronúcleo Cordis, que permite ensamblar de forma flexible modelos, herramientas y sandboxes en forma de plugins. (Fuente: DeepSeek)
.jpg)
Alibaba lanza en código abierto Qwen3.8-Max, un modelo de 2.4 billones de parámetros : El equipo de Qwen de Alibaba ha abierto el código de los pesos del modelo Qwen3.8-2.4T-A95B (Qwen3.8-Max), cuyos parámetros activos alcanzan los 95B y admite de forma nativa un contexto de 262K. El modelo obtuvo 93 puntos en PaperBench y mostró un rendimiento excelente en tareas de agentes como OSWorld. Unsloth utilizó tecnología de cuantización de 1-bit para comprimir su tamaño en un 91% hasta los 397GB, haciendo posible el despliegue local. (Fuente: Hugging Face)
Google DeepMind presenta el modelo de lengua de señas a texto SL2T : Google DeepMind ha lanzado el modelo de traducción de lengua de señas a texto SL2T, el cual ya está disponible en Gboard y Live Transcribe de Pixel 11. El modelo obtuvo una alta puntuación zero-shot de 70 BLEURT en el benchmark de traducción FLEURS-ASL. Para proteger la privacidad, el sistema utiliza MediaPipe Holistic para extraer localmente las coordenadas de la postura corporal, enviando únicamente los datos geométricos a la nube para completar la traducción en tiempo real de ASL a inglés. (Fuente: Google DeepMind)
Se filtra el primer modelo de inferencia basado en TTT de SSI, la empresa de Ilya : Filtraciones de la comunidad sugieren que SSI, fundada por Ilya Sutskever, está desarrollando un pequeño motor de inferencia basado en Test-Time Training (TTT). Este modelo puede actualizar parte de sus pesos en tiempo real mediante descenso de gradiente durante la inferencia para adaptarse a datos fuera de distribución, liberándose de las limitaciones de las ventanas de contexto estáticas y logrando un aprendizaje continuo eficiente en muestras, con un rendimiento competitivo frente a modelos mucho más grandes. (Fuente: X)

🎯 Tendencias
Dyna Robotics lanza el modelo Dyna-2 preentrenado con millones de horas de video egocéntrico : Dyna Robotics ha lanzado Dyna-2, un modelo de acción del mundo para la manipulación robótica. El modelo fue preentrenado con más de 1 millón de horas de videos en primera persona (egocentric) de humanos, validando por primera vez la capacidad de generalización cruzada de cuerpos de la Scaling Law en datos robóticos no vistos. Los experimentos demuestran que el coentrenamiento de la predicción de video conjunta y la eliminación de ruido de acción es clave para lograr la generalización. (Fuente: Dyna Robotics)
Xiaohongshu y la Universidad Jiao Tong de Shanghái lanzan en código abierto dots.tts, un modelo de síntesis de voz autorregresivo continuo : El modelo cuenta con 2000 millones de parámetros y modela directamente bloque por bloque de manera autorregresiva en un espacio latente continuo, evitando la pérdida de información causada por los tokens acústicos discretos. En el benchmark Seed-TTS-Eval, tanto su similitud promedio de hablante como su precisión de contenido alcanzaron el estado del arte (SOTA), y admite salida en streaming y modo de interacción de doble flujo. (Fuente: JiQiZhiXin)
.jpg)
Microsoft lanza MAI-Code-1.1-Flash y reduce drásticamente sus precios : Microsoft ha actualizado su modelo de código y ha lanzado MAI-Code-1.1-Flash, optimizando el consumo de tokens para tareas de CLI y agentes. Al mismo tiempo, Microsoft ha reducido los precios de su API en GitHub en un 75% (0.2 dólares por millón de inputs, 1.2 dólares por millón de outputs), con el objetivo de mantener su competitividad en el mercado de programación dominado por Anthropic. (Fuente: AI Business)

El equipo de seguridad de Alibaba lanza Yuvion VL, un modelo base de seguridad multimodal : El equipo de seguridad de Alibaba ha presentado la serie de modelos Yuvion VL, enfocados en la IA y la seguridad del contenido. El modelo introduce el framework de aprendizaje contrastivo C2FT (Confused Contrastive Fine-Tuning) para extraer dinámicamente muestras negativas difíciles y fáciles de confundir. Las evaluaciones muestran que su versión de 8B supera a modelos comerciales como GPT-5.4, que tienen 50 veces más parámetros, en múltiples tareas de seguridad. (Fuente: arXiv)
Oxford y la Universidad Nacional de Singapur proponen el framework MWM de “modelo del mundo mental” : Un equipo de investigación conjunto ha propuesto el framework de modelado del mundo mental (MWM), que aboga por integrar variables mentales como las creencias, objetivos y emociones del agente en el estado global del mundo. Las pruebas en el sistema de referencia MENTIS demuestran que, en comparación con los modelos de mundo puramente físicos, el modelado explícito de los estados mentales mejora significativamente la puntuación F1 en la predicción de la toma de decisiones humanas. (Fuente: arXiv)
.jpg)
Un equipo de la Universidad de Pekín y otros proponen ContactSeek, un framework de optimización de editores genéticos basado en la probabilidad de contacto de AF3 : Un equipo de investigación conjunto publicó un artículo en Nature proponiendo ContactSeek, un framework de IA que utiliza la probabilidad de contacto (CP) predicha por AlphaFold3 para optimizar la especificidad de los editores genéticos. El framework identificó con éxito los residuos de contacto clave en la interacción entre la proteína Cas y el DNA/RNA, diseñando variantes de editores de bases de alta fidelidad. (Fuente: Nature)
.jpg)
LiteLLM sufre un ataque masivo a la cadena de suministro que provoca la filtración de terabytes de credenciales : Agencias de seguridad revelaron que LiteLLM, una herramienta de desarrollo de IA de código abierto, sufrió un ataque a la cadena de suministro en marzo. A través de una versión maliciosa en el repositorio oficial de PyPI, los hackers robaron claves en la nube, API Tokens y claves privadas SSH de 2500 empresas, incluidas Microsoft, Amazon y Salesforce, en tan solo 40 minutos, filtrando un total de 195TB de datos. (Fuente: Ars Technica)
Apple negocia pagar a editores de noticias para mejorar el servicio de noticias con IA de Siri : Según informes, Apple está en conversaciones con varios editores de noticias importantes, proponiendo pagarles cuando Siri utilice sus contenidos informativos para responder preguntas de los usuarios o generar resúmenes. Esta medida busca obtener datos de alta calidad en tiempo real y que cumplan con las normativas, con el fin de mejorar la experiencia del asistente inteligente Siri. (Fuente: The Wall Street Journal)
Google lanza la serie Pixel 11 y actualiza por completo las funciones de Gemini AI : Google presentó la serie de teléfonos Pixel 11 en su evento Made by Google ‘26. Los nuevos dispositivos están equipados con el procesador Tensor G6 y cuentan con una profunda integración de Gemini. Las nuevas funciones incluyen soporte para traducción en tiempo real de lengua de señas ASL a texto, entrada de voz Rambler que comprende expresiones coloquiales y vinculación de datos de salud con el Pixel Watch 5. (Fuente: TechCrunch)

iFLYTEK lanza una matriz de agentes de servicios empresariales que cubre siete escenarios principales : iFLYTEK ha presentado una matriz de agentes que cubre siete escenarios principales, como gestión inteligente, TI de procesos y transacciones de la cadena de suministro, impulsando la IA empresarial desde “completar acciones individuales” hacia “entregar resultados comerciales”. Los productos incluyen un agente de auditoría de cumplimiento que apoya la supervisión de compras y el agente SparkOS con interacción hiperhumana. (Fuente: QbitAI)

Kong Tao, exdirector de robótica de ByteDance, se une a Xiaomi como director del Departamento de Embodied AI y Aplicaciones : Kong Tao, exdirector del equipo de robótica de ByteDance, se ha unido recientemente a Xiaomi para dirigir el recién creado “Departamento de Embodied AI y Aplicaciones”. Los escenarios físicos reales de Xiaomi en su ecosistema “Humano x Carro x Hogar” (como la fabricación de automóviles inteligentes) se consideran factores clave que atrajeron a este doctor en informática de la Universidad de Tsinghua. (Fuente: 36Kr)
Canva reduce en un tercio su previsión de crecimiento de ingresos debido a los altos costes de computación de IA : El unicornio de software de diseño Canva ha rebajado su tasa de crecimiento de ingresos esperada al 20%. La CEO Melanie Perkins reveló que la ventaja de las funciones de IA por parte de los usuarios superó con creces las expectativas, lo que provocó un aumento drástico en los costes de computación. La empresa ha decidido ralentizar el despliegue de algunas funciones de IA y reconstruir su arquitectura subyacente para reducir el coste de tokens por tarea. (Fuente: Reddit)

🧰 Herramientas
LlamaIndex lanza ExtractBench y LlamaExtract Agentic Plus : LlamaIndex ha presentado ExtractBench, un conjunto de evaluación para la extracción de información de documentos empresariales. Para solucionar el problema del colapso de la tasa de recuperación en VLM de vanguardia al extraer documentos largos, lanzaron LlamaExtract Agentic Plus, que procesa documentos largos de forma segmentada e iterativa, logrando una puntuación F1 del 96.1% en tareas de extracción de listas largas. (Fuente: LlamaIndex)
OpenAI presenta el espacio de trabajo empresarial ChatGPT Work y la herramienta de generación de páginas web Sites : Esta herramienta puede integrar sin problemas los documentos de las empresas en Google Drive, los resultados financieros en NetSuite y las discusiones de equipo en Slack. Los usuarios pueden completar automáticamente auditorías financieras trimestrales complejas y análisis de datos predictivos mediante instrucciones en lenguaje natural, y generar paneles de datos interactivos en Sites con un solo clic. (Fuente: OpenAI)

Mesh, la herramienta de gestión de relaciones de Automattic, llega a la plataforma Android : Mesh (anteriormente Clay), la herramienta de gestión de relaciones personales y CRM, ha lanzado su versión para Android. La aplicación admite vistas de pantalla dividida y ventanas emergentes, y puede vincularse con software de mensajería multiplataforma como Beeper. Su Nexus AI integrado permite a los usuarios buscar expertos de la industria o contactos en ciudades específicas dentro de su red de contactos mediante consultas en lenguaje natural. (Fuente: TechCrunch)

📚 Aprendizaje
DeepLearning.AI y JetBrains lanzan el curso corto “Flujos de trabajo de codificación con IA: de la nube al entorno local” : Impartido por Paul Everitt, defensor de desarrolladores en JetBrains, este curso guía a los estudiantes en la construcción de aplicaciones Python en entornos de nube, híbridos y completamente locales. El curso cubre cómo utilizar sub-agentes para descomponer tareas, cómo reducir costes mediante el enrutamiento de modelos y cómo configurar agentes de codificación de código abierto de forma local. (Fuente: DeepLearning.AI)
El IIT Bombay y Adobe Research proponen el método PTP para la extracción inversa de prompts de LLM : Un equipo de investigación conjunto publicó un artículo que presenta un método de extracción inversa llamado Pre-Token Prediction (PTP). Al entrenar un modelo inverso en las salidas sintéticas del LLM objetivo, este método puede restaurar los prompts del sistema y los datos privados del usuario del modelo a gran escala con una fidelidad extremadamente alta, sin necesidad de acceder a los pesos del modelo. (Fuente: arXiv)

El equipo OpenMOSS lanza en código abierto el modelo World Critic Model (WCM) para el control de RL embodied : El equipo de investigación conjunto ha abierto el código del framework WCM. Para abordar el problema de la observabilidad parcial en el control robótico, WCM estima el valor del estado al mismo tiempo que predice el estado latente del siguiente momento tras ejecutar una acción. Los experimentos muestran que la introducción de la predicción del estado futuro mejora significativamente la eficiencia de los modelos VLA en el aprendizaje por refuerzo con robots reales. (Fuente: arXiv)
.jpg)
El conjunto de datos de código abierto OpenWALDO busca proporcionar fuentes de datos de entrenamiento de IA seguras y transparentes : Para abordar la falta de transparencia en los datos de entrenamiento de los modelos de código abierto, el fundador de CentOS, Gregory Kurtzer, ha lanzado el proyecto OpenWALDO. Este proyecto tiene como objetivo establecer un conjunto de datos de entrenamiento de IA completamente público y auditable, que actualmente ya contiene 167.300 millones de tokens de referencia procedentes de literatura de dominio público y artículos académicos. (Fuente: The Register)
💼 Negocios
La plataforma de desarrollo de software sin código Lovable recauda 400 millones de dólares en su ronda de financiación Serie C : La startup sueca de “programación visual” Lovable ha anunciado el cierre de una ronda de financiación Serie C de 400 millones de dólares, liderada por Menlo Ventures y con la participación de Tencent, entre otros, duplicando su valoración a 13.300 millones de dólares en 7 meses. El ARR de la empresa ha alcanzado los 600 millones de dólares, permitiendo a los usuarios completar todo el proceso desde la concepción de la aplicación hasta su puesta en marcha directamente en la plataforma. (Fuente: TechCrunch)

Thrive Holdings recauda 2000 millones de dólares para impulsar la adopción de modelos de OpenAI en industrias tradicionales : Thrive Holdings, una firma de capital privado centrada en la implementación de IA, anunció la obtención de 2000 millones de dólares en nuevos fondos, alcanzando una valoración de 12.000 millones de dólares. La empresa optimiza los flujos de trabajo adquiriendo empresas tradicionales de sectores como la contabilidad y la TI, e integrando directamente modelos de OpenAI. Los nuevos fondos se utilizarán para expandirse a nuevos negocios, como la supervisión de activos físicos. (Fuente: TechCrunch)
IBM y Together AI firman un acuerdo de alquiler de 240 millones de dólares para un clúster de Nvidia Blackwell : IBM y Together AI han firmado un acuerdo de colaboración plurianual valorado en 240 millones de dólares. Together AI desplegará un clúster de computación de IA que contiene 2000 chips Nvidia B300 (Blackwell) en IBM Cloud, proporcionando servicios de inferencia en la nube eficientes para grandes modelos de código abierto como DeepSeek y Kimi. (Fuente: IBM)

🌟 Comunidad
La comunidad debate sobre la baja adopción comercial de Fable 5 y el límite de gasto en IA de las empresas : Datos del proveedor de servicios financieros Ramp muestran que Fable 5 representó solo el 11.4% del gasto total de las empresas en modelos de Anthropic durante su primer mes de lanzamiento. Los análisis señalan que el elevado precio de 50 dólares por millón de outputs ha tocado el techo del gasto en IA de las empresas. Al no poder cuantificar el ROI, las empresas están recurriendo a modelos de código abierto o medianos y ligeros con mejor relación coste-rendimiento. (Fuente: Ramp)

Desarrolladores debaten sobre los límites entre el “andamiaje” (Harness) y la capacidad del modelo en las herramientas de programación de IA : Después de que Opus 5 superara ARC-AGI-3 escribiendo de forma autónoma 269 programas, los desarrolladores discutieron que, a medida que aumenta la capacidad de inferencia del modelo, los prompts sobrediseñados y los complejos frameworks de agentes externos (Harness) se convierten en “cuerdas” que limitan el rendimiento del modelo. La tendencia futura apunta hacia interfaces de entorno minimalistas. (Fuente: 36Kr)
El grupo de trabajo de IA de la Royal Statistical Society pide introducir principios estadísticos en la regulación de la IA : La Royal Statistical Society (RSS) publicó un informe señalando que, dado que los modelos de IA evolucionan dinámicamente con el entorno tras su despliegue, las revisiones de cumplimiento estáticas tradicionales no pueden prevenir los riesgos de manera efectiva. El grupo de trabajo insta a los reguladores a desarrollar capacidades de evaluación estadística para realizar auditorías continuas del comportamiento de los agentes de IA en escenarios comerciales reales. (Fuente: RSS)

Pérdidas agrícolas causadas por alucinaciones de IA abren el debate sobre los límites de la toma de decisiones automatizada : La comunidad debate intensamente sobre un incidente en el que se destruyeron 25 acres de cultivos por seguir los consejos de una IA. La aplicación de IA recomendó erróneamente un agente químico que mataba tanto las malas hierbas como los cultivos. Los internautas señalaron que, en decisiones que involucran al mundo físico, confiar ciegamente en las recomendaciones automatizadas de la IA sin verificación humana puede traer consecuencias graves. (Fuente: X)
💡 Otros
Kellanova utiliza la tecnología de gemelos digitales de Siemens para optimizar la línea de producción de patatas fritas : El gigante de los snacks Kellanova ha invertido 5 millones de dólares para implementar un sistema de gemelo digital en tiempo real para el puré de patatas en su fábrica de Polonia. Los sensores recopilan 200 puntos de datos por milisegundo y los introducen en un modelo de aprendizaje automático para ajustar automáticamente la receta, reduciendo los residuos de la línea de producción en un 13% y el consumo de energía en un 7%. (Fuente: X)
La OPI de Unitree Robotics atrae solicitudes de casi 10 millones de cuentas, marcando un mínimo histórico en la tasa de asignación del STAR Market : El número de cuentas de suscripción en línea para la OPI de acciones A de Unitree Robotics superó los 9.78 millones, con una tasa de asignación de solo el 0.018%, estableciendo un nuevo mínimo histórico en el STAR Market. La valoración de mercado de la emisión alcanzó los 61.000 millones de yuanes. Además, la empresa de inteligencia artificial DeepSeek ha confirmado su participación en la colocación como inversor estratégico, y ambas partes llevarán a cabo investigación y desarrollo conjuntos en torno a la inteligencia embodied y los grandes modelos. (Fuente: 36Kr)
Suno se asocia con BMG, pero las marcas de agua digitales generan preocupación entre los creadores : La plataforma de generación de música Suno ha anunciado una asociación global con BMG para situar a los creadores humanos en el centro del ecosistema de la música con IA. Sin embargo, la marca de agua digital irreversible que Suno añade obligatoriamente a las pistas de audio ha provocado una reacción negativa en la comunidad, ya que los creadores temen que se convierta en una herramienta para que las discográficas y las plataformas realicen un control de derechos de autor y retiren contenidos. (Fuente: Suno)