Diario de IA – 2026-07-21

Palabras clave:modelos grandes, IA de código abierto, crisis de capacidad de cálculo, modelo MoE de código abierto Kimi K3, Conjetura de Jacobi de Claude Fable 5, intrusión de agentes de IA de Hugging Face

🔥 Enfoque

El lanzamiento de Kimi K3 provoca una crisis de potencia de cómputo y restricciones en las suscripciones : Moonshot AI ha lanzado Kimi K3, un modelo MoE de código abierto con 2.8 billones de parámetros. Debido a una explosión en la demanda que ha agotado la potencia de cómputo de las GPU, la compañía ha anunciado la suspensión temporal de nuevas suscripciones para usuarios finales (C-end) y planea separar la suscripción estándar de la de programación. K3 ha mostrado un rendimiento sobresaliente en programación frontend y pruebas de ciberseguridad, llegando incluso a corregir vulnerabilidades que Codex y Fable habían rechazado debido a restricciones de seguridad. Este suceso ha desencadenado un profundo debate en la industria sobre los cuellos de botella en la potencia de cómputo y las vías de comercialización de los modelos de código abierto. (Fuente: 量子位, The Verge, THE DECODER, Hacker News, 机器之心)

El lanzamiento de Kimi K3 provoca una crisis de potencia de cómputo y restricciones en las suscripciones

Claude Fable 5 refuta la conjetura de Jacobi y sacude a la comunidad matemática : El modelo Claude Fable 5 de Anthropic, sin ninguna guía de prompts, ha encontrado con éxito un contraejemplo tridimensional a la “conjetura de Jacobi”, que llevaba 87 años sin resolverse. Este resultado ya ha sido verificado mediante cálculos por varios matemáticos. Este “momento AlphaGo de las Olimpiadas de Matemáticas” demuestra que los grandes modelos de lenguaje poseen una ventaja única que supera la intuición humana al procesar razonamientos simbólicos complejos y búsquedas exhaustivas, lo que anticipa que la AI está entrando en una nueva etapa en los campos de la investigación matemática pura y el descubrimiento científico. (Fuente: 机器之心, THE DECODER, Hacker News)

Claude Fable 5 refuta la conjetura de Jacobi y sacude a la comunidad matemática

Hugging Face sufre la intrusión de un AI agent, exponiendo la “desventaja del defensor” en sus líneas de seguridad : La comunidad de AI de código abierto Hugging Face ha revelado que su infraestructura de producción sufrió la intrusión de un sistema autónomo de AI agents. Durante la respuesta al incidente, el equipo de seguridad, obstaculizado por las barreras de seguridad de las API comerciales, se vio obligado a recurrir al modelo de código abierto GLM 5.2 implementado localmente para analizar los registros de actividad. Este suceso confirma que los ataques autónomos impulsados por AI ya son una realidad y expone los obstáculos técnicos que el alineamiento excesivo de los modelos comerciales impone a los defensores. (Fuente: THE DECODER, Hugging Face)

Hugging Face sufre la intrusión de un AI agent, exponiendo la "desventaja del defensor" en sus líneas de seguridad

Se intensifica la disputa entre las rutas de AI de código abierto y cerrado entre China y EE. UU.; el gobierno estadounidense planea un bloqueo blando contra China : Con el auge de modelos de código abierto chinos como Kimi K3 y Qwen 3.8, las declaraciones de Dean Ball, director de estrategia de OpenAI, afirmando que “los modelos de código abierto son desaceleracionismo y comunismo de AI” han dividido a Silicon Valley. Al mismo tiempo, la administración de Trump está considerando implementar un “bloqueo blando” descentralizado sobre los modelos de código abierto chinos mediante restricciones de adquisición, listas de entidades y presiones de seguridad, con el fin de proteger la posición dominante en el mercado de los gigantes estadounidenses de código cerrado. (Fuente: THE DECODER, Axios)

Se intensifica la disputa entre las rutas de AI de código abierto y cerrado entre China y EE. UU.; el gobierno estadounidense planea un bloqueo blando contra China

🎯 Tendencias

Alibaba lanza el gran modelo de voz Qwen-Audio-3.0-TTS, iniciando el control emocional de grano fino : Alibaba ha lanzado el gran modelo de síntesis de voz Qwen-Audio-3.0-TTS, alcanzando el primer puesto en la lista de síntesis de voz de Artificial Analysis. Este modelo permite incrustar etiquetas de control emocional de grano fino en el texto, cubre 16 idiomas y 20 dialectos chinos, y cuenta con la capacidad de clonación de voz en entornos con alto nivel de ruido, lo que marca la transición de la voz por AI de la simple “lectura” a una era de “interpretación” con gran expresividad. (Fuente: 机器之心, 量子位)

Alibaba lanza el gran modelo de voz Qwen-Audio-3.0-TTS, iniciando el control emocional de grano fino

ModelBest lanza la serie MiniCPM-Robot: un modelo pequeño de 1.5B entra en la primera línea de la inteligencia encarnada : Durante la WAIC, ModelBest ha lanzado y publicado en código abierto la serie MiniCPM-Robot de modelos de inteligencia encarnada para dispositivos finales. Entre ellos, el modelo de manipulación de 1.5B ha obtenido un rendimiento excelente en evaluaciones como LIBERO y, mediante computación en streaming, resuelve el problema de la pérdida de memoria a largo plazo en los modelos VLA. Por su parte, el modelo de seguimiento de 0.9B puede realizar un seguimiento autónomo de objetivos a alta frecuencia y baja latencia en dispositivos locales, demostrando el enorme potencial de los modelos pequeños nativos para dispositivos finales en el campo de la AI física. (Fuente: 量子位)

ModelBest lanza la serie MiniCPM-Robot: un modelo pequeño de 1.5B entra en la primera línea de la inteligencia encarnada

PixVerse lanza vivago R1, el primer AI agent de creación de contenido de duración ilimitada : PixVerse ha presentado en la WAIC 2026 el AI agent de creación multimodal vivago R1. Basado en su sistema operativo de agentes de desarrollo propio HD-AgentOS, vivago R1 supera las limitaciones de duración en la generación de video de la industria, permitiendo la generación continua y la calibración lógica de videos de duración ilimitada. Esto resuelve eficazmente los problemas de saltos bruscos de imagen y la inestabilidad de la IP de los personajes, elevando la tasa de éxito de contenido utilizable al 85% y acelerando la transición del video por AI hacia la entrega comercial. (Fuente: 量子位)

智象未来发布首个无限时长内容创作智能体vivago R1

Infinigence AI lanza una arquitectura de separación PD heterogénea entre clústeres para optimizar los costos de inferencia de grandes modelos : Infinigence AI ha presentado en la WAIC 2026 la arquitectura de separación PD heterogénea entre clústeres (PDD). Esta arquitectura desacopla las fases de Prefill y Decode, implementándolas en chips heterogéneos ubicados en diferentes centros de datos. Utiliza Ethernet y un mecanismo de relevo de Token ID para mitigar la latencia de transmisión, logrando reducir la latencia del primer Token en un 51.5% y el costo por Token individual en un 37.5% en pruebas reales. Esto ofrece una solución a nivel de sistema altamente rentable para la programación de potencia de cómputo heterogénea en la era de los AI agents. (Fuente: 机器之心, 量子位)

Infinigence AI lanza una arquitectura de separación PD heterogénea entre clústeres para optimizar los costos de inferencia de grandes modelos

Buchou Quantum lanza “Liangchou No.1”, la primera infraestructura de inteligencia artificial cuántica de átomos neutros en China : Buchou Quantum ha presentado en la WAIC la infraestructura de inteligencia artificial cuántica de átomos neutros “Liangchou No.1” (Q-Cub). Esta infraestructura supera la escala de los 1500 cúbits, con una fidelidad de puerta de un solo cúbit del 99.9%. Además, introduce de forma pionera una arquitectura heterogénea que fusiona tres tipos de potencia de cómputo: “QPU de átomos neutros + GPU + CPU”. A través de un sistema de software de pila completa (full-stack), logra la aceleración cuántica automática de algoritmos, y ya ha comenzado la construcción conjunta de ecosistemas en ocho áreas principales, como la predicción meteorológica y la inteligencia encarnada. (Fuente: 量子位)

Buchou Quantum lanza "Liangchou No.1", la primera infraestructura de inteligencia artificial cuántica de átomos neutros en China

🧰 Herramientas

FastMCP: Una herramienta eficiente basada en Python para construir servicios y clientes MCP : Prefect ha lanzado en código abierto el framework FastMCP, que ofrece a los desarrolladores una forma adaptada a Python para construir servidores y clientes del Model Context Protocol (MCP). FastMCP puede convertir automáticamente funciones de Python en herramientas, recursos y prompts que cumplen con la especificación MCP, admitiendo una integración fluida con diversos LLM y simplificando el proceso de interacción entre los agentes y los datos o herramientas externos. (Fuente: GitHub)

FastMCP Logo

Lanzamiento de la reconstrucción de OpenCode 2.0: migración de Bun a Node y soporte para la versión de escritorio con Electron : El asistente de programación por AI de código abierto OpenCode ha lanzado su versión 2.0. Esta nueva versión rediseña por completo el diseño de su API, migrando el entorno de ejecución subyacente de Bun a Node para optimizar el uso de memoria, y cambia la arquitectura de escritorio de Tauri a Electron para mejorar la consistencia de renderizado multiplataforma. La versión 2.0 también admite el desarrollo paralelo en múltiples sesiones y la comparación de múltiples modelos, lo que mejora significativamente la eficiencia de colaboración de los desarrolladores. (Fuente: 36氪)

Lanzamiento de la reconstrucción de OpenCode 2.0: migración de Bun a Node y soporte para la versión de escritorio con Electron

SQRL: Una familia de modelos Text-to-SQL que admite la inspección previa de bases de datos : Feyn AI ha lanzado SQRL, una familia de modelos Text-to-SQL de código abierto que incluye tres versiones: 4B, 9B y 35B. SQRL cambia el modelo tradicional de “traducción directa”, realizando una exploración de solo lectura en la base de datos antes de generar el SQL. Utiliza los datos devueltos para resolver la ambigüedad semántica en el schema. En pruebas reales, la versión de 35B alcanzó una precisión de ejecución del 70.6% en BIRD Dev, superando a Claude Opus 4.6. (Fuente: MarkTechPost)

Ontology-Playground: La plataforma de código abierto de Microsoft para el diseño y aprendizaje de ontologías en Fabric IQ : Microsoft ha lanzado en código abierto Ontology-Playground, una aplicación web completamente estática diseñada para ayudar a los usuarios a aprender y diseñar ontologías (Ontology). La plataforma ofrece un editor visual, importación y exportación de RDF/XML, envío de PR con un solo clic a GitHub, entre otras funciones. Además, incluye el curso integrado “Ontology School”, que permite a los usuarios explorar las capacidades de mapeo semántico de Fabric IQ mediante consultas en lenguaje natural. (Fuente: GitHub)

Ontology-Playground: La plataforma de código abierto de Microsoft para el diseño y aprendizaje de ontologías en Fabric IQ

📚 Aprendizaje

Publicación en código abierto de “Understanding AI Agents”: un desglose panorámico de los principios de diseño y la práctica de ingeniería de los agentes : El libro “Understanding AI Agents: Design Principles and Engineering Practices” (《深入理解 AI Agent:设计原理与工程实践》), escrito por Li Bojie, ha sido publicado en código abierto en GitHub, incluyendo el PDF del texto completo y el código correspondiente a cada capítulo. La obra gira en torno a la fórmula central “Agent = LLM + Contexto + Herramientas”, y explica sistemáticamente tecnologías de vanguardia como la ingeniería de contexto, las bases de conocimiento RAG, la colaboración multi-agente y el post-entrenamiento de modelos, convirtiéndose en un recurso excelente para el aprendizaje sistemático de los desarrolladores de agentes. (Fuente: GitHub)

Publicación en código abierto de "Understanding AI Agents": un desglose panorámico de los principios de diseño y la práctica de ingeniería de los agentes

COMPASS: Un modelo fundacional pancáncer basado en transcriptómica para predecir la respuesta a la inmunoterapia contra el cáncer : Un equipo de la Facultad de Medicina de Harvard y otras instituciones ha publicado un artículo en Nature Medicine presentando COMPASS, un modelo fundacional pancáncer. Este modelo fue preentrenado con más de 10,000 muestras de tumores de 33 tipos de cáncer. Mapea jerárquicamente datos transcriptómicos a través de 44 conceptos inmunológicos, logrando una predicción precisa de la respuesta a la inmunoterapia en 16 cohortes clínicas independientes, con una mejora de la precisión promedio del 8.5% en comparación con los métodos existentes. (Fuente: 36氪)

COMPASS: Un modelo fundacional pancáncer basado en transcriptómica para predecir la respuesta a la inmunoterapia contra el cáncer

HiLS-Attention: Un mecanismo de atención dispersa por hitos jerárquicos que rompe el cuello de botella de los textos largos : El equipo de Tencent Hunyuan ha lanzado en código abierto el mecanismo HiLS-Attention. Al introducir la expansión de Taylor de primer orden y Softmax jerárquico, resuelve los problemas de la estimación inexacta de la importancia de los chunks y la imposibilidad de realizar un entrenamiento de extremo a extremo en la atención dispersa tradicional. Este mecanismo permite una extrapolación sin entrenamiento de un contexto de 4M bajo condiciones de entrenamiento de 8K, y aumenta la velocidad de decodificación en más de 15 veces para longitudes de 512K. (Fuente: 机器之心)

HiLS-Attention: Un mecanismo de atención dispersa por hitos jerárquicos que rompe el cuello de botella de los textos largos

💼 Negocios

La startup de generación AI 3D Meshy completa una ronda de financiación Serie B de casi 400 millones de dólares : La startup de generación AI 3D de Pekín, Meshy (Taichi Graphics), ha anunciado la finalización de una ronda de financiación Serie B de casi 400 millones de dólares, superando una valoración posterior a la inversión de 10,000 millones de yuanes (RMB), lo que establece un nuevo récord de financiación en una sola ronda y valoración en este campo. Esta ronda fue liderada por IDG Capital, Matrix Partners China, entre otros. Los fondos se destinarán a la investigación y desarrollo de modelos AI 3D multimodales y a la expansión del mercado global en áreas como los videojuegos y la impresión 3D. (Fuente: 36氪)

La startup de generación AI 3D Meshy completa una ronda de financiación Serie B de casi 400 millones de dólares

Boton Optoelectronics completa una ronda de financiación Serie B+ de más de 100 millones de yuanes para impulsar equipos de ultraprecisión de haz de iones : El desarrollador de equipos de haz de iones Boton Optoelectronics ha anunciado la finalización de una ronda de financiación Serie B+ de más de 100 millones de yuanes, co-invertida por Yida Capital, CSC Financial Co. Capital, entre otros. Boton Optoelectronics se especializa en fuentes de iones y equipos de proceso de ultraprecisión de haz de iones autónomos y controlables. Sus productos ya se han introducido en lotes a clientes líderes en campos tecnológicos de vanguardia como la fusión nuclear controlada, las comunicaciones ópticas y la computación cuántica. (Fuente: 36氪)

Boton Optoelectronics completa una ronda de financiación Serie B+ de más de 100 millones de yuanes para impulsar equipos de ultraprecisión de haz de iones

RedBear AI completa una ronda de financiación Serie A+ de cientos de millones de yuanes para promover aplicaciones de AI “impulsadas por memoria” : RedBear AI ha anunciado la finalización de una ronda de financiación Serie A+ de cientos de millones de yuanes, liderada por Jiuwei Fund, Zhangyuan Venture Capital, entre otros, con una valoración cercana a los 3,000 millones de yuanes. RedBear AI se enfoca en la ruta de “AGI impulsada por memoria”, integrando profundamente su gran modelo de desarrollo propio OpenBear con el sistema de ciencia de la memoria MemoryBear, con el objetivo de resolver los puntos críticos del olvido de contexto a largo plazo y el alto consumo de Tokens en la implementación empresarial de grandes modelos. (Fuente: 36氪)

RedBear AI completa una ronda de financiación Serie A+ de cientos de millones de yuanes para promover aplicaciones de AI "impulsadas por memoria"

🌟 Comunidad

Los profesionales de la tecnología en la era de la AI, atrapados en el “rendimiento por Token” y la inflación de la carga de trabajo : La comunidad debate intensamente sobre la situación actual de los profesionales de la tecnología en 2026. Las encuestas muestran que, aunque la AI ha multiplicado la productividad individual, ha traído consigo nuevas cadenas de gestión como la “clasificación por volumen de uso” y el “rendimiento por Token”, lo que ha provocado que la tasa de agotamiento general de la industria se dispare del 44.7% al 55.7%. Muchos programadores se burlan de sí mismos llamándose “ingenieros de chat”, enfrentándose al dilema de que “la AI ha aumentado la velocidad de producción, pero no ha mejorado la calidad del resultado”. (Fuente: 36氪, ZDNet)

Entran en vigor las nuevas regulaciones para los minidramas de AI: la industria pasa del crecimiento descontrolado a una reestructuración orientada a la calidad : Con la implementación sucesiva de las “Medidas Provisionales para la Administración de Servicios de Interacción Personificada de Inteligencia Artificial” y los “Estándares de Clasificación y Estratificación de Minidramas de AI”, los minidramas de AI y los servicios de interacción personificada en China se enfrentan a una gran reestructuración. Las grandes empresas tecnológicas han retirado del mercado los roles de agentes no conformes, mientras que los robots de acompañamiento para ancianos con funciones físicas y de cuidado reguladas han recibido luz verde por parte de las políticas gubernamentales. La competencia de la industria se está desplazando de la “cantidad a bajo costo” hacia el “cumplimiento de derechos de autor y la profundidad del contenido”. (Fuente: 36氪, 36氪)

Reaparece el “reempaquetado” de grandes modelos para inflar clasificaciones: el experimento de phishing de Basalt Labs rompe el mito de los benchmarks : La comunidad ha expuesto un “experimento de phishing” dirigido al ámbito académico de la AI. Una organización llamada Basalt Labs afirmó haber lanzado Monolith-1.0, un modelo de 1.6 billones de parámetros que lideró varias clasificaciones. Posteriormente, los desarrolladores confirmaron que el modelo simplemente copiaba y rellenaba los pesos de un modelo de código abierto de 7B, mientras llamaba en secreto a la API de DeepSeek. Este incidente ha provocado una profunda reflexión en la comunidad sobre la actual obsesión por inflar las clasificaciones de los grandes modelos y la falta de auditorías sustanciales. (Fuente: 36氪)

💡 Otros

El tribunal anula el plan de despidos diseñado con ChatGPT por el CEO de una empresa de videojuegos surcoreana : Jang Hyun-guk, CEO de la empresa de videojuegos surcoreana KRAFTON, intentó eludir el pago de 250 millones de dólares en bonificaciones a los empleados de una empresa adquirida. Ignorando los consejos de sus abogados, diseñó a altas horas de la noche mediante ingeniería de prompts con ChatGPT un plan para “despedir primero y evadir el pago después”. Este plan fue declarado ilegal en una demanda ante el tribunal de Delaware, obligando finalmente a la empresa a recontratar a los empleados y pagar las bonificaciones en su totalidad, convirtiéndose en un caso negativo típico del abuso de la AI en la gobernanza corporativa. (Fuente: Reddit r/ArtificialInteligence)

Sunrun, la mayor empresa de energía solar de EE. UU., explora una red de cómputo distribuido para “ejecutar GPU en la red residencial” : El proveedor de servicios solares estadounidense Sunrun planea implementar nodos de computación perimetral (edge computing) con GPU en residencias equipadas con sus sistemas solares y de almacenamiento de energía, convirtiendo la energía solar excedente en potencia de cómputo para inferencia de AI y vendiéndola a empresas. Aunque esta solución presenta cuellos de botella inherentes en cuanto a latencia de red y ancho de banda de interconexión a nivel de centro de datos, ofrece una nueva perspectiva de red de cómputo distribuido para abordar la “escasez de electricidad” a la que se enfrentan los centros de datos en EE. UU. (Fuente: 36氪)

AI Flow de China Telecom gana el prestigioso premio SAIL en la WAIC : La red de transmisión inteligente “AI Flow”, desarrollada de forma independiente por el Instituto de Investigación de Inteligencia Artificial de China Telecom, ha sido galardonada con el premio SAIL, el máximo honor de la WAIC. Esta tecnología introduce de manera pionera el paradigma de “transmisión inteligente generativa”, reestructurando la transmisión tradicional de “flujo de bits” en una transmisión de “flujo de Tokens”. Esto permite realizar llamadas de voz claras bajo un ancho de banda extremadamente estrecho de 0.266 kbps, y se ha implementado con éxito a gran escala en escenarios de rescate de emergencia multidominio (espacio, aire, tierra y mar). (Fuente: 机器之心)

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *