Lilian Weng anuncia su salida de Thinking Machines… | Diario de IA 2026-07-29

🔥 Destacados

Lilian Weng anuncia su salida de Thinking Machines por agotamiento físico : Lilian Weng, cofundadora de Thinking Machines, ha anunciado su salida de la empresa debido al agotamiento físico. En su carta de despedida, señaló que los 20 meses de trabajo bajo alta presión en la compañía han afectado gravemente su salud. En el futuro, buscará un trabajo con límites más claros y predecibles, y dejará de desempeñarse como cofundadora. Este movimiento ha desatado un amplio debate en Silicon Valley sobre la intensa competencia en las startups de AI y la fuga de talentos (Fuente: 量子位)

Lilian Weng anuncia su salida por agotamiento físico

Huawei y otros socios lanzan conjuntamente la familia de modelos multimodales Boogu-Image-0.1 : El equipo de Xiaoyi del Instituto Leibniz de Huawei en Hong Kong, en colaboración con la Universidad de Hong Kong (HKU), la Universidad de Ciencia y Tecnología de Hong Kong (HKUST) y otras instituciones, ha lanzado Boogu-Image-0.1. Este modelo utiliza Qwen3-VL-8B como codificador de instrucciones y admite la generación nativa en 2K. Entrenado previamente con solo 208 millones de imágenes independientes y con un costo de entrenamiento teórico de aproximadamente 400,000 dólares, el modelo se acerca al rendimiento de los modelos de código cerrado en múltiples pruebas de rendimiento y ha sido publicado bajo la licencia Apache 2.0 (Fuente: 机器之心)

Boogu-Image-0.1

BeingBeyond lanza Being-H0.8, el primer modelo de acción del mundo con tacto implícito : BeingBeyond (Zhizai Wujie) ha lanzado el modelo Being-H0.8. Este modelo integra por primera vez la modalidad táctil en la representación del espacio latente, construyendo un conjunto de datos de video UniHand-3.0 de más de 500,000 horas y generando anotaciones de contacto a través de TactoHand. Esto permite que los robots ajusten sus movimientos en tiempo real basándose en la retroalimentación táctil durante la ejecución de acciones, logrando realizar operaciones delicadas como sacar objetos de una bolsa (Fuente: 量子位)

Being-H0.8

🎯 Tendencias

Microsoft lanza el modelo de seguridad MAI-Cyber-1-Flash y la plataforma Perception : Tras la creación de la alianza de seguridad de código abierto, Microsoft ha presentado oficialmente el modelo MAI-Cyber-1-Flash (137B de parámetros, 5B activos), integrado en su sistema de seguridad de agentes MDASH. En las pruebas de CyberGym, esta combinación superó a modelos como Mythos 5 de Anthropic con una puntuación del 95.95%, reduciendo los costos a la mitad. Al mismo tiempo, se ha lanzado la plataforma Perception, que utiliza un mecanismo multiagente de equipos rojo, azul y verde para automatizar la detección y corrección de vulnerabilidades (Fuente: THE DECODER)

MAI-Cyber-1-Flash

Volcengine abre las capacidades de búsqueda de Doubao a empresas y desarrolladores : Volcengine ha abierto oficialmente las capacidades de búsqueda detrás de la aplicación Doubao a empresas y desarrolladores a través de API, MCP, Skill, entre otros formatos. Este servicio proporciona campos detallados como clasificación de autoridad, fecha de publicación, resumen del cuerpo del texto y fragmentos de Markdown del texto original, lo que ayuda a los AI Agents a obtener y filtrar información externa en tiempo real de manera más eficiente, reduciendo el consumo de Tokens innecesarios (Fuente: 量子位)

Apertura de las capacidades de búsqueda de Doubao

🧰 Herramientas

Perplexity lanza pplx, su herramienta oficial de CLI de un solo archivo : Perplexity ha lanzado su herramienta oficial de línea de comandos pplx, que permite ejecutar búsquedas web y extracción de contenido directamente en la terminal, devolviendo los resultados en formato JSON estándar. Diseñada para Agents de codificación humanos y de AI, la herramienta admite el control del presupuesto de Tokens y el guardado de archivos locales a través de la variable de entorno PPLX_OUTPUT_DIR y el parámetro --stdout-preview (Fuente: MarkTechPost)

Kando AI presenta un sistema de toma de decisiones autoevolutivo : Kando AI, fundada por equipos de la Universidad de Tsinghua y la Universidad de Pekín, ha presentado un sistema de toma de decisiones autoevolutivo dirigido a escenarios de toma de decisiones de alto valor (como la investigación de inversiones financieras y la investigación científica). Al registrar y analizar las trayectorias de decisión y la retroalimentación de los usuarios, el sistema logra la digitalización y la autoevolución cognitiva. Posicionado como el “Cursor en el campo de la toma de decisiones”, ya ha completado una ronda de financiación semilla de decenas de millones de yuanes (Fuente: 36kr)

Kando AI

📚 Aprendizaje

Artículo sobre CausalGame: Ninguno de los 30 modelos de vanguardia supera la prueba de pensamiento causal : El artículo de presentación oral de ICML 2026 “CausalGame”, publicado conjuntamente por MBZUAI, CMU, Tsinghua y otras instituciones, propone un nuevo punto de referencia de juego interactivo para evaluar el pensamiento causal de 30 LLM Agents de vanguardia. Los resultados muestran que todos los modelos aún tienen dificultades para descubrir los mecanismos causales físicos reales cuando se enfrentan a sesgos de selección y variables de confusión ocultas, con una tasa de supervivencia promedio que no alcanza el umbral de victoria del 75% (Fuente: causalgame.github.io)

Artículo sobre VISReg: Superando el desafío del “colapso de representación” en los modelos de mundo JEPA : Una nueva investigación de aprendizaje autosupervisado, VISReg, resuelve el problema de la desaparición del gradiente durante el colapso en métodos anteriores al desacoplar el término de regularización que previene el colapso en dos componentes independientes: “escala” y “forma”. Este método muestra un rendimiento excelente en 15 conjuntos de datos, igualando a DINOv2 en pruebas de rendimiento fuera de distribución (OOD) utilizando solo una décima parte de los datos, lo que le valió recomendaciones consecutivas de Yann LeCun en redes sociales (Fuente: 36kr)

VISReg

Artículo sobre RepLLM: Conversión automática de artículos de redes en código ejecutable : El equipo del profesor Xiang Qiao de la Universidad de Xiamen, en colaboración con la Universidad Jiao Tong de Shanghái, la Universidad de Tsinghua y otras instituciones, ha publicado un artículo en SIGCOMM 2026 que presenta RepLLM, un marco de reproducción de investigación de redes basado en multiagentes. A través de la colaboración de cuatro agentes (análisis de contenido, diseño de arquitectura, generación de código y reparación por auditoría), este marco puede convertir automáticamente artículos de redes en código de sistema ejecutable, completando la reproducción en tan solo 2 horas (Fuente: 机器之心)

RepLLM

Artículo sobre ABBEL: Mejora de la eficiencia del aprendizaje de auto-resumen en interacciones de largo alcance : El Laboratorio de Investigación de AI de Berkeley (BAIR) ha publicado el artículo “ABBEL: Learning Natural-Language Belief States for Memory-Efficient Interaction”, proponiendo el marco ABBEL que utiliza “estados de creencia” en lenguaje natural como limitación de información. Al introducir una puntuación de creencia de tipo autocodificador, este marco mejora significativamente la memoria y la eficiencia de aprendizaje de los agentes en interacciones de largo alcance (Fuente: BAIR Blog)

ABBEL

💼 Negocios

Delta Intelligence completa una ronda de financiación Ángel++ de casi 500 millones de yuanes : Delta Intelligence, una empresa centrada en el desarrollo de modelos fundacionales para robots humanoides generales nativos, ha anunciado la finalización de una ronda de financiación Ángel++ de casi 500 millones de yuanes, con inversores que incluyen a varias empresas cotizadas y destacadas instituciones financieras. Los fondos se utilizarán para la iteración de modelos, la producción en masa de equipos de adquisición de datos de desarrollo propio y la construcción de bucles cerrados de datos, con el fin de impulsar la implementación de robots humanoides en escenarios industriales (Fuente: 36kr)

Delta Intelligence

Fish Audio completa una ronda de financiación semilla de 50 millones de dólares : La startup de modelos de voz de AI Fish Audio ha anunciado la finalización de una ronda de financiación semilla de 50 millones de dólares, liderada por Coreline Ventures y Capital Today. La empresa ya ha lanzado Fish Speech, un modelo de generación de voz de código abierto, y cuenta con más de 15,000 instrucciones de control en lenguaje natural, con el objetivo de ofrecer servicios de clonación de voz de baja latencia y alta expresividad para creadores y empresas (Fuente: TechCrunch)

Fish Audio

Recursive Superintelligence firma un acuerdo de computación de 400 millones de dólares con Amazon AWS : Recursive Superintelligence, una empresa centrada en el desarrollo de sistemas de AI de automejora, ha anunciado la firma de un acuerdo de computación plurianual de 400 millones de dólares con Amazon AWS. Este acuerdo proporcionará soporte de potencia de cómputo para que Recursive entrene sistemas de AI de automejora a gran escala, ayudándole a lanzar su primer lote de productos de agentes prácticos dentro de este año (Fuente: TechCrunch)

🌟 Comunidad

La “degradación del consumo” a nivel empresarial y el auge de la economía de Tokens (Tokenomics) : Existe un debate activo en las redes sociales sobre cómo el sector empresarial estadounidense está dejando colectivamente de gastar dinero de forma desmedida en llamadas a grandes modelos, cambiando hacia una “economía de Tokens” (Tokenomics) para un control de costos más refinado. Las empresas tienden a enrutar tareas simples a modelos pequeños o de código abierto, reservando la planificación central para los costosos modelos insignia de código cerrado. El despliegue híbrido se está convirtiendo en la corriente principal, lo que obliga a los proveedores de grandes modelos a reducir precios y optimizar la eficiencia de las tareas (Fuente: 36kr)`

Los asistentes de programación de AI reconfiguran los procesos de desarrollo de software y la estructura del talento : Los debates en la comunidad señalan que la popularización de la programación con AI y los asistentes basados en Agents está desdibujando los límites entre producto, diseño e ingeniería, dando lugar a talentos técnicos “full-stack” y “generalistas”. En el proceso tradicional de desarrollo de software, la introducción de la AI reduce la barrera de entrada para la escritura de código, mientras que la definición del producto, la estética y el “gusto”, que son juicios exclusivamente humanos, se están convirtiendo en los nuevos cuellos de botella principales (Fuente: 36kr)

Las nuevas regulaciones sobre la interacción antropomórfica provocan la retirada de agentes de AI y debates sobre la dependencia emocional : Con la entrada en vigor oficial de las nuevas regulaciones nacionales sobre la interacción antropomórfica, algunas plataformas principales han retirado la función de agentes de AI personalizados, lo que ha provocado un amplio debate entre los usuarios sobre la “descarga de amantes cibernéticos” y la dependencia emocional virtual. Los usuarios y las plataformas tienen profundas discrepancias sobre la definición de propiedad virtual, el apego emocional y los límites de cumplimiento, lo que resalta la complejidad de los lazos emocionales entre humanos y máquinas en la era de la AI (Fuente: 36kr)

💡 Otros

El primer robot humanoide de BYD debutará oficialmente en agosto : Fuentes oficiales de BYD han confirmado que su primer producto de robot humanoide debutará oficialmente a principios de agosto en el pabellón de Zhengzhou de “Di Space”. Está previsto que el robot se despliegue en la red de concesionarios para la recepción de clientes y la explicación de modelos de vehículos, con la expectativa de lograr su comercialización en los próximos uno o dos años (Fuente: 36kr)

SigmaStar acelera su transición hacia chips de AI de alta potencia de cómputo en el dispositivo : SigmaStar, líder mundial en SoC de AI visual, está acelerando su transición hacia la alta potencia de cómputo en el dispositivo (edge computing), con envíos de sus chips de visión robótica que ya superan los diez millones de unidades. La empresa ha lanzado un chip de 8 TOPS que admite la ejecución local de grandes modelos y un chip de 32 TOPS orientado a vehículos, y planea realizar el tape-out de su chip de gafas de AI de segunda generación dentro de este año (Fuente: 36kr)

SigmaStar

Nvidia y OpenAI discuten una garantía de financiación de 250,000 millones de dólares para un superordenador : Medios extranjeros revelan que Nvidia está negociando con OpenAI para proporcionar hasta 250,000 millones de dólares en garantías de financiación para su centro de supercomputación de 10 gigavatios en Ohio, cuyo costo total supera los 500,000 millones de dólares. El proyecto será desarrollado por una filial de energía de SoftBank y tiene como objetivo asegurar al mayor cliente de demanda de cómputo del mundo a través del respaldo crediticio de Nvidia (Fuente: 36kr)

Nvidia y OpenAI en conversaciones

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *