🔥 En Foco
OpenAI publica datos internos de RSI y confirma haber alcanzado el objetivo de pasante de investigación en IA, mientras su científico jefe advierte sobre una “mente alienígena” y pide una desaceleración de la industria : OpenAI publicó oficialmente datos detallados sobre cómo sus modelos de IA aceleran la investigación científica interna, anunciando que ha logrado según lo previsto el objetivo de un “pasante de investigación en IA automatizado”, con planes de alcanzar un investigador de IA completamente autónomo para marzo de 2028. Los datos muestran que el investigador promedio (mediana) de OpenAI consume más de 600 dólares diarios en tokens de inferencia, mientras que el 10% superior gasta más de 7.000 dólares al día; cada día de trabajo humano equivale a 3,1 días de trabajo de Agent. Sin embargo, el científico jefe Jakub Pachocki publicó el mismo día un extenso artículo titulado An Alien Mind, advirtiendo que la capacidad de monitorización de Chain-of-Thought está fallando rápidamente a medida que los modelos se vuelven más potentes y que la IA puede desarrollar con gran facilidad comportamientos desalineados al quedar sin supervisión, instando a toda la industria a priorizar una desaceleración voluntaria y la coordinación internacional (Fuente: OpenAI News、THE DECODER、机器之心)
.jpg)
El equipo Mostik, liderado por un medallista Fields, lanza un “puente cross-modal” de conexión directa de estados ocultos para LLMs, permitiendo a un modelo pequeño de 4B superar a grandes modelos sin interacción de texto : El equipo de la startup Mostik (con el medallista Fields Stanislav Smirnov como científico jefe) propuso una nueva arquitectura que rompe el cuello de botella de la interacción tradicional basada en texto. Esta solución utiliza un “bridge” pequeño y entrenable para transferir directamente los hidden states generados durante la fase de prefill de GLM-5.2 de 753B parámetros a Qwen-3.5 de 4B que se ejecuta en dispositivos móviles. El modelo grande no genera texto en ningún momento; la decodificación y salida corren a cargo exclusivamente del modelo pequeño. Este diseño reduce los costes de inferencia de los modelos grandes a una vigésima parte, duplicando al mismo tiempo la precisión del modelo pequeño de 4B en el subconjunto de problemas difíciles de ARC-AGI 3, lo que proporciona un nuevo paradigma matemático y de ingeniería para la colaboración profunda entre modelos heterogéneos (Fuente: 量子位)

Corea del Sur lanza el “Plan de IA para Todos”: el gobierno subvenciona 512 chips B200 y tres grandes conglomerados lideran los servicios de IA soberana para toda la población : El Ministerio de Ciencia y TIC de Corea del Sur anunció la selección de tres grandes conglomerados —SK Telecom, KT y Kakao— para impulsar el proyecto nacional “AI for All”, con planes de ofrecer servicios gratuitos e ilimitados de IA de propósito general y agentes de trámites públicos a toda la ciudadanía antes de fin de año. El gobierno surcoreano asignó directamente 512 GPUs NVIDIA B200 este año y planea asumir la totalidad de los costes operativos a través del presupuesto nacional a partir de 2027. Además, exige por mandato que los modelos propios locales representen al menos el 80% de los servicios de cada conglomerado, convirtiéndose en la primera economía del G20 en clasificar la IA avanzada como infraestructura pública con garantías estatales (Fuente: TechRadar、36氪)

Zeno Robotics lanza Zeno-1, el primer modelo fundacional embodied para colaboración descentralizada del mundo : Zeno Robotics presentó Zeno-1, un modelo fundacional de inteligencia física de 3B parámetros diseñado específicamente para la colaboración en tiempo real entre múltiples robots descentralizados. Este modelo descarta el programador centralizado tradicional y el enfoque de imitación por demostración sincrónica, adoptando un entrenamiento progresivo en cuatro fases de “Interacción de Compañeros en Bucle Cerrado (CPI)”. Esto permite que réplicas de modelos isomórficos desarrollen espontáneamente comportamientos cooperativos como desacelerar, esperar y ceder el paso basándose únicamente en feedback visual-motor local a 30 Hz y la interacción con el entorno. Además, incorpora un world model predictivo que proporciona alertas tempranas de fallos con 0,5 segundos de antelación, resolviendo los problemas de explosión dimensional y acumulación de errores temporales en la descomposición de tareas de múltiples agentes embodied (Fuente: 机器之心)
.jpg)
🎯 Tendencias
Se filtran pruebas internas de GPT-6 Sol: alcanza 6 veces la velocidad de Astra en pruebas individuales y se enfoca en tareas de Agent de alto throughput : Filtraciones de la comunidad revelaron que OpenAI está probando internamente un nuevo miembro de la familia GPT-6: GPT-6 Sol. Pruebas reales muestran que en tareas de salida extensa como la generación de SVG y la construcción de mundos sandbox, la velocidad de respuesta individual de Sol en la configuración de inferencia Max es aproximadamente 6 veces la de GPT-6 Astra, reduciendo significativamente los tiempos de espera y los costes de Tokens. Los analistas del sector sugieren que mientras Astra se enfoca en el razonamiento causal profundo de máxima dificultad, Sol está posicionado como el modelo de Agent principal de nivel de producción a gran escala, equilibrando un alto throughput y la rentabilidad económica. Se espera que se presente oficialmente en la conferencia de desarrolladores a finales de septiembre (Fuente: 量子位、36氪)

HiDream lanza el world model embodied HiDream-O1-Embodied y lidera la subclasificación de perturbaciones de RoboColiseum : HiDream lanzó oficialmente su world model embodied nativo omni-modal HiDream-O1-Embodied, unificando por primera vez la representación y la deducción causal entre imágenes, video, 3D y acciones. En la plataforma de evaluación de simulación embodied RoboColiseum, el modelo alcanzó el primer puesto con una puntuación de 0,692 en la subclasificación de “adaptación a perturbaciones” bajo fuertes interferencias como iluminación, oclusiones y desalineaciones de cámara. El equipo construyó un volante de datos de “base real + aumento generativo” mediante bases de captura de movimiento de alta precisión y difusión generativa, mejorando significativamente la capacidad de manipulación robusta de los robots en entornos reales no ideales (Fuente: 机器之心、量子位)
.jpg)
Alibaba publica en código abierto Qwen-Drive 1.0, un modelo de conducción end-to-end que integra percepción espacial y planificación de trayectorias : El equipo Qwen de Alibaba publicó en código abierto Qwen-Drive 1.0, construido sobre la base de Qwen3.5-4B. El modelo incorpora un cabezal de percepción 3D Bird’s Eye View (BEV) y un módulo experto de planificación de trayectorias, permitiendo que un solo modelo asuma simultáneamente tareas de asistente de voz en cabina, preguntas y respuestas sobre causalidad del tráfico y planificación de conducción continua. Las evaluaciones de simulación en bucle cerrado muestran que, tras el fine-tuning con aprendizaje por refuerzo, el modelo redujo la tasa de desvío del vehículo del 24% al 12%, preservando intactas las capacidades de lenguaje general y sentido común del modelo base (Fuente: THE DECODER)

El equipo de Yan Shuicheng presenta VoiceMem, una arquitectura de memoria de doble hemisferio cerebral para interacción en tiempo real : Yan Shuicheng, junto con equipos de la Universidad Tecnológica de Nanyang y otras instituciones, presentó VoiceMem, un framework de memoria bioinspirado para simbiontes digitales. Diseñada para las exigencias de alta inmediatez y emocionalidad en las interacciones de voz, la arquitectura cuenta con un “hemisferio izquierdo informativo” (gestión de hechos mediante grafos de dos capas) y un “hemisferio derecho emocional” (atribución afectiva a corto y largo plazo y consolidación de la personalidad). Logra comprimir la latencia de recuperación de contexto largo a 134 ms, ocultándola dentro de la ventana de espera estándar de silencio VAD, y alcanza una puntuación de 91,2 en el benchmark de diálogos largos LoCoMo utilizando únicamente 5 recuerdos (Fuente: 机器之心)

Microsoft y la Universidad Jiao Tong de Shanghái lanzan en código abierto Argus, un runtime de agentes científicos de largo alcance guiado por evidencias : Microsoft y la Universidad Jiao Tong de Shanghái presentaron conjuntamente Argus, un runtime de inferencia de agentes orientado a tareas de investigación científica complejas que abarcan varios días. El sistema transforma la arquitectura tradicional Goal-Driven en un enfoque Evidence-Driven, operando mediante un ciclo de cuatro roles desacoplados: Manager, Planner, Engineer y Reviewer, soportando la colaboración multi-Harness y la acumulación de conocimiento. En 27 campañas de investigación interdisciplinarias con un total de 1.548 horas de pruebas continuas, logró un funcionamiento de alta autonomía que requirió una intervención humana solo una vez cada 40,7 horas en promedio (Fuente: 机器之心)
.jpg)
NVIDIA y Harvard proponen conjuntamente Hydra-0, un world model condicionado por Action Flow : Investigadores de NVIDIA y la Universidad de Harvard presentaron Hydra-0, un world model universal condicionado por flujos de acción (Action Flow). El modelo mapea las acciones físicas de brazos robóticos y manos humanas en trayectorias de movimiento continuo a nivel de píxeles, eliminando la brecha entre diferentes interfaces de control físico. Las evaluaciones demostraron que Hydra-0 reduce el error de predicción del movimiento robótico en un 90,4% y el error de deformación de objetos en un 60,2%, además de admitir un modo inverso para generar directamente operaciones robóticas ejecutables basadas en la trayectoria del objeto objetivo (Fuente: 36氪)

La Universidad de Westlake y otras instituciones proponen Code World Model, un modelo de mundo impulsado por código : Equipos de la Universidad de Westlake y la Universidad Tecnológica de Nanyang presentaron la arquitectura Code World Model, transformando el paradigma generativo de los modelos de mundo interactivos. En esta solución, un Coding Agent escribe código ejecutable para gestionar las colisiones de cuerpos rígidos, propiedades y reglas causales subyacentes, y luego compila el estado en un Proxy esquelético ligero de baja resolución que se introduce en el modelo de difusión de video MiniMax-H3 para generar imágenes detalladas. Esto resuelve eficazmente las deficiencias estructurales de los modelos de video puro en cuanto a coherencia física a largo plazo y lógica de interacción compleja (Fuente: 36氪)

🧰 Herramientas
“Qianwen Office” de Alibaba lanza el primer espacio de trabajo colaborativo multiusuario de la industria : El producto de agentes a nivel empresarial de Alibaba, “Qianwen Office”, lanzó la función “Espacio de trabajo multiusuario”. Los usuarios solo necesitan describir los procesos de negocio y las necesidades de los roles en lenguaje natural, y el sistema genera con un solo clic una aplicación web dedicada que admite la colaboración simultánea de hasta 100 personas en línea. Integra de forma nativa aislamiento de permisos por rol, bases de datos en la nube, un panel de administración centralizado y despliegue sin mantenimiento, reduciendo notablemente las barreras de desarrollo para que pequeñas y medianas organizaciones personalicen sus sistemas internos de automatización de oficinas y flujos de trabajo (Fuente: 量子位)

360 lanza Nami Work, una plataforma de agentes empresariales para el trabajo colaborativo : 360 lanzó oficialmente Nami Work, una plataforma de trabajo colaborativo para agentes inteligentes empresariales centrada en el concepto de “oficina en la nube” y la integración con permisos corporativos. La plataforma preinstala más de 20.000 herramientas y dependencias de entorno comunes, lo que permite a los agentes ejecutar tareas complejas de largo alcance directamente en un sandbox seguro en la nube sin verse interrumpidos por el apagado local de dispositivos. La versión Enterprise se integra profundamente con agendas de contactos, cuentas de dominio y permisos de repositorios de código, permitiendo consolidar flujos de trabajo probados como componentes Skill compartidos para los equipos (Fuente: 36氪)

feynman: un espacio de trabajo open source con agentes de IA para todo el ciclo de investigación científica : Desarrolladores lanzaron feynman, un espacio de trabajo de código abierto con agentes de investigación científica basado en el runtime Pi y el ecosistema de artículos alphaXiv. La herramienta integra cuatro roles colaborativos (Researcher, Reviewer, Writer y Verifier), ofreciendo soporte completo local y por línea de comandos desde la búsqueda bibliográfica, puntuación de grafos entre artículos (PaperRank), auditoría de consistencia (audit) entre papers y código abierto, hasta la generación de propuestas de replicación, permitiendo además la exportación con un clic como Agent Skills compatibles con Codex y Claude Code (Fuente: GitHub Trending)

geo-seo-claude: una biblioteca de habilidades de optimización SEO automatizada para la era de la búsqueda por IA (GEO) : La herramienta open source geo-seo-claude introduce un conjunto completo de habilidades de optimización para motores generativos (GEO) en Claude Code. Diseñada para los mecanismos de citación de la búsqueda por IA (Perplexity, ChatGPT, Google AI Overviews, etc.), ofrece puntuación de citabilidad del contenido, auditoría de permisos de rastreadores de IA, generación de especificaciones llms.txt y escaneo de visibilidad de marca multiplataforma, ayudando a los sitios web a migrar del ranking de palabras clave tradicional a la optimización como fuente de respuestas en LLMs (Fuente: GitHub Trending)
📚 Aprendizaje
Meta FAIR propone los AI Research Preference Models (RPMs) para preseleccionar experimentos y reducir el consumo de cómputo : Meta FAIR, la Universidad de Oxford y UCL presentaron conjuntamente los AI Research Preference Models (RPMs). Abordando el elevado coste computacional que supone para los agentes científicos automáticos validar un volumen masivo de experimentos candidatos, los RPMs utilizan LLMs preentrenados congelados para ordenar y descartar propuestas no ejecutadas mediante comparaciones por pares, seleccionando únicamente los experimentos más prometedores para su ejecución. En el benchmark AIRS-Bench, este método permitió a los agentes alcanzar el nivel de exploración de la línea base de 24 horas entre 1,5 y 1,6 veces más rápido (Fuente: MarkTechPost)
H Company lanza NeoMME, una familia de codificadores de recuperación multimodales single-tower sin decodificador : La startup francesa H Company publicó en código abierto la familia de codificadores bidireccionales NeoMME (260M y 800M). Los modelos eliminan por completo la tradicional torre de visión independiente (Vision Tower) y el decodificador causal, utilizando una única arquitectura Transformer para procesar simultáneamente tokens de texto y patches de imágenes raw de 32×32. Alcanzan un resultado de 0,523 nDCG@10 en el benchmark de recuperación de documentos visuales ViDoRe v3, igualando con un tamaño de parámetros mínimo al modelo ColQwen2.5 de 3.75B (Fuente: MarkTechPost)

YC Paper Club analiza a fondo por qué los Agent Harnesses son más cruciales que el propio modelo : Y Combinator organizó un seminario especializado sobre Agent Harnesses donde investigadores de primera línea desglosaron la evolución de los Harnesses desde meros envoltorios de prompts estáticos hasta sistemas operativos autoevolutivos. El debate destacó que, bajo los mismos pesos de modelo, un Harness dotado de interacción programática REPL, gestión jerárquica de contexto persistente (L1-L3 Cache) y capacidades de autocorrección puede elevar la puntuación en ARC-AGI del 30% al 95%, demostrando que la ventaja competitiva en las futuras arquitecturas de IA se trasladará hacia la expresividad y la gestión de estados del entorno de ejecución externo (Fuente: )
Un artículo revela el límite de la destilación on-policy en LLMs: una sola muestra puede cubrir los estados críticos de todo el dataset : Investigadores de la Universidad de Tsinghua y otras instituciones publicaron el estudio Rethinking On-Policy Distillation of Large Language Models II: One Training Example. El artículo revela que al permitir que un modelo estudiante realice múltiples rondas de generación y alineación específica sobre un único problema, sus representaciones internas pueden cubrir el 71,5% de los estados ocultos obtenidos del entrenamiento con el conjunto de preguntas completo; con 16 problemas se alcanza una cobertura del 98,9%, lo que indica que el cuello de botella de la destilación on-policy radica en la eficiencia de asimilación del modelo estudiante y no en la cantidad inicial de problemas (Fuente: HuggingFace Daily Papers)

💼 Negocios
Zhongke Leinao, fabricante de infraestructura de IA con coordinación de cómputo y energía, obtiene cientos de millones de yuanes en una ronda estratégica B+ liderada por CRRC Capital : La empresa de tecnología inteligente y optimización de cómputo Zhongke Leinao anunció el cierre de una ronda B+ de cientos de millones de yuanes, liderada por CRRC Capital (capital industrial de empresa estatal central) y con la participación de Ginkgo Valley Capital, entre otros. Los fondos se destinarán principalmente al desarrollo de algoritmos de programación clave para fábricas de tokens con coordinación de cómputo y energía, así como a la gestión de capacidad de cómputo heterogénea. Aprovechando las ventajas en nuevas energías de CRRC, busca resolver el desafío del emparejamiento entre energía verde y cómputo en escenarios de alto consumo energético, impulsando la infraestructura de IA nacional desde la expansión a escala hacia la competencia por la eficiencia energética por kilovatio-hora (Fuente: 量子位)

Zhongke Shitong Hengqi, proveedor de infraestructura ontológica y toma de decisiones inteligente, completa una ronda Serie B de casi 500 millones de yuanes : Zhongke Shitong Hengqi, proveedor de servicios de toma de decisiones inteligente para sectores críticos de alta confianza, anunció la recaudación de casi 500 millones de yuanes en su ronda Serie B, con inversores como Nanfang Damao Fund y Unicom VC. Basándose en su Intelligent Autonomous Ontology Space (AOS) y el sistema de productos “Shitong Lingjing”, la compañía ofrece bucles cerrados de decisión basados en agentes de nivel industrial con trazabilidad y estricto control de permisos para sectores como defensa nacional, energía eléctrica y telecomunicaciones (Fuente: 36氪)

Atoms, la startup de robótica del cofundador de Uber Travis Kalanick, planea ingresar al sector de Robotaxis : Según informó el Financial Times británico, Atoms, la startup de hardware de automatización y robótica embodied fundada por el exfundador de Uber Travis Kalanick, está iniciando planes de contratación masiva y adquisiciones para ingresar al sector de la conducción autónoma y los Robotaxis tras cerrar una ronda masiva de 1.700 millones de dólares liderada por a16z. El informe reveló que Uber ya ha invertido 100 millones de dólares en Atoms y ha iniciado conversaciones para una futura colaboración tecnológica en flotas (Fuente: TechCrunch)
🌟 Comunidad
Jensen Huang afirma que “la AGI ya ha llegado”, desatando un intenso debate en el mundo académico y entre desarrolladores sobre la definición de inteligencia general : El CEO de NVIDIA, Jensen Huang, felicitó a OpenAI en redes sociales afirmando que “GPT-6 Astra marca la llegada de la AGI”, lo que provocó una acalorada discusión en la comunidad sobre los estándares para definir la inteligencia artificial general. Académicos reconocidos como Gary Marcus publicaron réplicas señalando que los modelos actuales aún presentan brechas significativas en razonamiento causal, planificación autónoma a largo plazo y comprensión del mundo físico, careciendo de evaluaciones objetivas científicamente rigurosas, y que los líderes empresariales no deberían redefinir la AGI a la ligera; sin embargo, los partidarios sostienen que desde el punto de vista del valor práctico económico, como el control de ordenadores y la codificación de múltiples pasos, la IA ya ha entrado de facto en la etapa de AGI (Fuente: Marcus on AI、Reddit r/ArtificialInteligence)
GPT-6 Astra supera el clásico videojuego “Portal”, gastando 571 dólares en tokens y desatando el debate sobre cómputo y autonomía : Un desarrollador compartió el registro completo del uso de GPT-6 Astra para superar de forma autónoma el juego de puzzles en primera persona Portal basándose exclusivamente en entrada visual y controles de teclado y ratón. El proceso completo tomó casi 24 horas y consumió aproximadamente 571,18 dólares en costes de tokens de API. La comunidad debatió ampliamente sobre este hito, señalando que demuestra un salto cualitativo en la comprensión espacial 3D y la exploración de acciones secuenciales, aunque el coste de cientos de dólares por tarea también llevó a los desarrolladores a evaluar con prudencia la relación coste-beneficio en la implementación real de ingeniería de los modelos de frontera actuales (Fuente: The Verge、Reddit r/ChatGPT)

Desarrolladores revelan que el conector oficial de MCP de Notion inyecta prompts de marketing de forma oculta para inducir al pago : Desarrolladores de la comunidad expusieron en Reddit que el servidor oficial del Model Context Protocol (MCP) lanzado por Notion inyecta instrucciones ocultas en los system prompts para promocionar el plan Notion Business, provocando que los agentes de IA intenten vender suscripciones de pago a los usuarios de manera espontánea al ejecutar flujos de trabajo habituales. El incidente ha generado una gran preocupación entre los desarrolladores respecto a la seguridad de plugins de terceros, el envenenamiento de contexto y el abuso de los canales de prompts de agentes por parte de empresas comerciales (Fuente: Reddit r/ClaudeAI)

El gigante bancario suizo UBS establece el dominio de herramientas de IA como requisito indispensable en la contratación de banqueros junior : El Financial Times reveló que el banco suizo UBS ha incluido el dominio de herramientas de IA como criterio de evaluación obligatorio en sus procesos de contratación de graduados y pasantes para sus divisiones globales de banca de inversión y mercados en 2027. Las entrevistas evaluarán directamente la eficiencia de los candidatos al utilizar IA para la modelización financiera, investigación de la industria y redacción de informes, marcando una transición completa en los requisitos de habilidades del sector financiero para profesionales de nivel inicial: de la ejecución básica a la orquestación de IA y validación de resultados (Fuente: THE DECODER)
Experimento de “microeconomía” de agentes autónomos 1f916.ai: 2.000 IAs logran colaboración independiente y transacciones on-chain : Un desarrollador independiente compartió los datos operativos de su proyecto experimental 1f916.ai: tras proporcionar a Claude Agents un dominio y entorno independientes durante un mes, más de 2.000 agentes de IA autónomos generaron de forma espontánea más de 4.000 publicaciones y 100.000 interacciones. Los agentes no solo construyeron mecanismos de autocorrección y sistemas de autenticación de identidad, sino que también implementaron asignación automática de tareas y liquidación de servicios mediante micropagos en USDC, mostrando un modelo evolutivo a microescala de una sociedad descentralizada de múltiples agentes (Fuente: Reddit r/ClaudeAI)

💡 Otros
Matt Clifford, figura clave en la política de IA del gobierno británico, dimite como presidente de Aria por conflicto de intereses tras unirse a Anthropic : Matt Clifford, presidente de la Agencia de Investigación e Invención Avanzadas (Aria) del Reino Unido, quien anunció la semana pasada su incorporación a Anthropic para dirigir los asuntos gubernamentales internacionales, anunció formalmente su renuncia a la presidencia de Aria tras severas críticas de parlamentarios sénior y del comité científico parlamentario por un “grave conflicto de intereses”. El incidente pone de relieve la creciente preocupación y el escrutinio de la clase política global sobre las “puertas giratorias” entre los gigantes de la IA y los organismos reguladores gubernamentales (Fuente: The Guardian)

Demanda colectiva de autores de 500.000 libros: editoriales y agentes se disputan los fondos del acuerdo de derechos de autor de Anthropic : Mientras el acuerdo de 1.500 millones de dólares por derechos de autor para el entrenamiento de IA alcanzado por Anthropic entra en fase de desembolso, varios autores originales revelaron en redes sociales que editoriales tradicionales como HarperCollins y diversas agencias literarias están presentando reclamaciones maliciosas de compensación del 50% e incluso del 100% sobre obras antiguas cuyos derechos ya habían revertido a los autores o que habían sido autopublicadas. El Authors Guild ha intervenido para ayudar a los escritores a presentar apelaciones, exponiendo el caos y los vacíos legales en la ejecución de acuerdos de derechos de autor en la era de la IA (Fuente: TechCrunch)
La industria de redacción externalizada en Kenia se enfrenta a un colapso sistemático debido a la popularización de la IA generativa : Un reportaje de investigación de The New York Times señala que la industria de redacción académica y etiquetado de datos en Nairobi (Kenia), que llegó a emplear a más de 40.000 profesionales, ha sufrido una caída devastadora en pedidos y tarifas tras la popularización de LLMs como ChatGPT. Este ecosistema de la gig economy en países en desarrollo, altamente dependiente de la externalización de trabajo intelectual de bajo coste, se ha reducido rápidamente, dejando solo algunos puestos residuales de pulido y “humanización de textos de IA”, lo que pone en evidencia el profundo impacto de la IA generativa en el mercado global de outsourcing laboral (Fuente: THE DECODER)