Trump nombra al director de Inteligencia Nacional Jay Clayton… | Diario de IA 2026-10-05

🔥 En foco

Trump nombra al director de Inteligencia Nacional Jay Clayton como zar de la IA de la Casa Blanca : Trump ha anunciado oficialmente el nombramiento del director de Inteligencia Nacional de EE. UU., Jay Clayton, como zar de la IA de la Casa Blanca, asumiendo el liderazgo de la recién creada Super Intelligence Force (SIF). Clayton, quien anteriormente presidió la SEC y lideró las 18 agencias de inteligencia del país, ha declarado públicamente que la IA representa tanto una oportunidad histórica como una amenaza para la seguridad nacional. La SIF coordinará la interacción del gobierno federal con los consumidores comunes, grupos de interés público, comunidades religiosas, infraestructuras críticas e instituciones de investigación y desarrollo de vanguardia en superinteligencia. Este nombramiento marca la entrada de la supervisión y gobernanza de la seguridad de la IA de vanguardia en EE. UU. en una fase de coordinación interinstitucional con nivel de preparación para el combate. (Fuente: The Guardian)

Trump nombra al director de Inteligencia Nacional Jay Clayton como zar de la IA de la Casa Blanca

La europea Aleph Alpha lanza como código abierto Kolibri, un modelo MoE bilingüe de 78B : La startup alemana de IA Aleph Alpha ha lanzado oficialmente como código abierto su modelo soberano Kolibri-1. Con un total de 78.1B parámetros, el modelo adopta una arquitectura híbrida de ventana deslizante y atención global, activando solo 3.46B parámetros por token (un 4,4%), y soporta una ventana de contexto de 1 millón de tokens. Kolibri fue entrenado íntegramente en infraestructura local europea y cumple con la EU AI Act y los estándares del GDPR. Obtuvo puntuaciones sobresalientes de 96,9% en la prueba matemática AIME 2025 y 84,3% en GPQA Diamond. Sus pesos FP8 han sido publicados bajo licencia Apache 2.0 y están adaptados para despliegues en una sola GPU B200 o dos GPU H100. (Fuente: MarkTechPost)

La arquitectura de mejora visual VISTA del equipo de Kaiming He supera el benchmark ARC-AGI-3 : El equipo de Kaiming He ha publicado una nueva investigación, VISTA, que rompe con el enfoque tradicional de transformar juegos interactivos en símbolos numéricos abstractos, apostando en su lugar por entradas de imagen nativas puras combinadas con un mecanismo externo de “álbum visual sin pérdidas” (atención explícita). Durante la exploración, el modelo puede revisar y comparar capturas históricas en paralelo bajo demanda, lo que permitió que Claude Opus 5 sin entrenamiento adicional alcanzara una puntuación perfecta de 100 en los 25 juegos, requiriendo solo 0,43 veces los pasos que toma a un humano superarlos por primera vez, mientras que GPT-5.6 Sol también alcanzó 99 puntos. Este logro derriba el dogma de que el razonamiento abstracto debe depender de largas cadenas de pensamiento o simuladores de código, demostrando que la percepción visual y la memoria de trabajo son claves para resolver la generalización abstracta hacia la AGI. (Fuente: 36氪)

La arquitectura de mejora visual VISTA del equipo de Kaiming He supera el benchmark ARC-AGI-3

La NASA e IBM lanzan conjuntamente un modelo fundacional de código abierto para la ciencia lunar : La NASA e IBM Research han lanzado de forma conjunta un modelo fundacional lunar basado en la arquitectura multimodal TerraMind, integrando cerca de 2 millones de teselas de teledetección de alta y baja resolución acumuladas durante 17 años por misiones como la Lunar Reconnaissance Orbiter (LRO). El modelo incorpora los ángulos de iluminación y la geometría espacial solar como priors explícitos, reduciendo el error hasta en un 22% al predecir la probabilidad de depósitos de hielo de agua en cráteres de sombra permanente en las regiones polares, además de mostrar un rendimiento sobresaliente en la detección de cráteres. Las ponderaciones del modelo, el código y los conjuntos de datos de referencia se han liberado por completo en Hugging Face y GitHub. (Fuente: The Decoder)

La NASA e IBM lanzan conjuntamente un modelo fundacional de código abierto para la ciencia lunar

🎯 Tendencias

Google ajusta la matriz de suscripción personal de Gemini: la versión gratuita baja a Flash-Lite y establece barreras de pago : Google ha anunciado una restricción en el acceso a Gemini para cuentas individuales. Los usuarios gratuitos solo podrán utilizar el modelo de menor escala, Flash-Lite, perdiendo el acceso a Flash y Pro; los suscriptores del plan AI Plus de 5 $/mes también han perdido el acceso a Pro, conservando únicamente Flash-Lite y Flash. Para acceder a la gama completa de modelos, se requiere adquirir los planes Pro o Ultra, que oscilan entre 20 $ y 100 $ mensuales. La industria considera que esta medida busca reducir el déficit derivado de la inferencia de alta frecuencia de modelos de gran tamaño, además de preparar el terreno para el lanzamiento comercial de su nuevo buque insignia más costoso, Gemini 4 Argon. (Fuente: The Decoder)

DeepSeek Harness lanza la v0.2.1 e introduce una capa de compatibilidad experimental para Claude Code Mods : DeepSeek ha actualizado su scaffolding de agentes de código abierto a la versión v0.2.1-alpha.1. Además de empaquetar una aplicación de escritorio oficial, la novedad más destacada es la incorporación de una capa de compatibilidad experimental para la API de Claude Code Mods. Mediante este puente, módulos como Token Weather y Blast Radius pueden ejecutarse dentro del sistema de plugins de DSH. Tianyi Cui, responsable del equipo, afirmó que DSH mantiene la filosofía de “todo es un plugin”, y que esta medida busca validar que los mecanismos de mods de la competencia pueden reutilizarse entre ecosistemas como un subconjunto de la arquitectura de plugins de DSH. (Fuente: 机器之心)

DeepSeek Harness lanza la v0.2.1 e introduce una capa de compatibilidad experimental para Claude Code Mods

OpenAI anticipa que Astra 6.1 reforzará las capacidades de reducción y refactorización de código : Tibo Sottiaux, líder de producto de OpenAI, y el investigador de post-entrenamiento Rajan Agarwal han revelado que su modelo de próxima generación se centra en optimizar las capacidades de “poda y simplificación de código” para erradicar la deuda técnica causada por agentes que generan código farragoso e ineficiente. El equipo de I+D está optimizando las estrategias de post-entrenamiento en función de las dificultades de los desarrolladores, dotando al modelo de un estándar refinado de refactorización y autodepuración, al tiempo que insinúan el inminente lanzamiento a los usuarios de Astra 6.1, cuyo despliegue se había pospuesto temporalmente por motivos de seguridad. (Fuente: 机器之心)

OpenAI anticipa que Astra 6.1 reforzará las capacidades de reducción y refactorización de código

Google desarrolla aprendizaje federado con privacidad diferencial verificable basado en TEE : Google Research ha presentado una arquitectura de aprendizaje federado (FL) de última generación basada en Entornos de Ejecución Confiables (TEE), ya implementada en el modelo de predicción bilingüe inglés-japonés de Gboard. Esta arquitectura traslada el cálculo de gradientes del dispositivo a un TEE de hardware atestiguado remotamente en la nube. A través de registros de políticas de acceso al código inmutables y públicos en Sigstore, los auditores externos pueden verificar el proceso de inyección de ruido de privacidad diferencial central sin necesidad de confiar en Google, resolviendo la brecha de confianza en la privacidad durante el entrenamiento colaborativo a gran escala. (Fuente: MarkTechPost)

Bilibili lanza como código abierto la familia de modelos de traducción multilingüe Index-Translate : Bilibili ha publicado en código abierto la serie de modelos Index-Translate, basados en un fine-tuning de Qwen3.5, que admiten traducción mutua de alta precisión entre 150 idiomas, con un énfasis particular en la observancia de terminología y la preservación del formato y maquetación. La familia se extiende además con Index-Echo (interpretación simultánea de voz con clonación de timbre), Index-Homura (traducción alineada al número de sílabas objetivo) e Index-NativeLong (traducción de documentos extensos con coherencia contextual interparágrafo), superando en pruebas de la comunidad a varios modelos de referencia comerciales en traducción entre chino, inglés y japonés. (Fuente: Reddit r/LocalLLaMA)

🧰 Herramientas

pstack-claude: Biblioteca de habilidades de ingeniería estricta para agentes portada a múltiples Harness : Desarrolladores de la comunidad, basándose en las prácticas del equipo de Cursor, han creado una versión portada multientorno de pstack para plataformas como Claude Code, Codex y Pi. Este plugin integra el flujo de ejecución automatizado poteto-mode, aplicando estrictamente el ciclo de verificación de “reproducción – interrogación bidireccional – corrección localizada – reprueba” al abordar bugs de código, forzando una revisión arquitectónica al cruzar los límites de funciones para ayudar a los desarrolladores a construir pipelines de commit automatizados de alta calidad. (Fuente: GitHub Trending)

pstack-claude: Biblioteca de habilidades de ingeniería estricta para agentes portada a múltiples Harness

e2e: Framework de pruebas AI end-to-end para aplicaciones impulsado por lenguaje natural : El framework de pruebas de código abierto e2e permite realizar pruebas web y móviles guiadas directamente mediante descripciones en lenguaje natural. Su mecanismo fundamental radica en que, tras la exploración inicial y la consecución del objetivo de prueba guiada por el prompt a través de un agente, la secuencia de interacción con la UI se consolida automáticamente en un script ejecutable sin modelo. Las ejecuciones de pruebas de regresión posteriores se reproducen con precisión directa sin incurrir en costes de tokens, garantizando aserciones ágiles y eliminando por completo el desperdicio de tokens en pruebas de larga duración. (Fuente: GitHub Trending)

e2e: Framework de pruebas AI end-to-end para aplicaciones impulsado por lenguaje natural

local-codex-proxy: Acceso local y sin credenciales de LLMs a las interfaces de Codex y ChatGPT : Un desarrollador ha publicado un middleware proxy ligero para Codex que permite conectar modelos de código abierto desplegados localmente mediante vLLM u Ollama (como Gemma o Qwen) directamente a la aplicación de escritorio de ChatGPT y a los entornos de ejecución de Codex. Al simular localmente endpoints de OpenAI y la sincronización de estado, los desarrolladores pueden disfrutar de una experiencia de usuario GUI de escritorio madura sin exponer el código de su red interna a la nube. (Fuente: TheZachMueller)

local-codex-proxy: Acceso local y sin credenciales de LLMs a las interfaces de Codex y ChatGPT

Texting Bubbles: Plugin de burbujas segmentadas y humanizadas para Open WebUI : La comunidad ha presentado la suite de funciones Texting Bubbles para Open WebUI, que transforma las tradicionales respuestas extensas en streaming de Markdown en burbujas de mensajes continuas similares a una conversación humana. Un filtro complementario guía al modelo mediante prompts para generar oraciones concisas que, combinadas con una programación de retardos con efectos dinámicos de pausa al escribir, brindan una experiencia interactiva y de roleplay mucho más natural e inmersiva. (Fuente: Reddit r/OpenWebUI)

NInfer-4080: Motor de inferencia de rendimiento extremo diseñado para GPUs de 16 GB : Un desarrollador ha lanzado NInfer-4080, un motor de inferencia profundamente optimizado para la tarjeta RTX 4080 (16 GB de VRAM). Al combinar la cuantización de alta compresión GSQ de ISTA-DASLab con la decodificación especulativa DFlash2, logra una velocidad de prefill de hasta 2720 tok/s y una generación de 262 tok/s bajo un contexto largo de 100K, demostrando la abrumadora ventaja que ofrecen los motores de inferencia verticales hiperoptimizados para arquitecturas de hardware específicas frente a los frameworks de propósito general. (Fuente: Reddit r/LocalLLaMA)

📚 Aprendizaje

El equipo de Bo An de la Universidad Tecnológica de Nanyang revela los mecanismos de interacción entre modelos y Harness : El equipo de la NTU ha publicado un informe de evaluación sobre el ecosistema de agentes, comparando el rendimiento de OpenHands, DSH, PI, openJiuwen y los Harness nativos oficiales en 66 combinaciones. El estudio demostró que la premisa de que “la combinación nativa es la óptima” no se cumple: por ejemplo, el desempeño de GPT-6 Astra en PI superó ampliamente al de Codex; asimismo, mecanismos específicos del Harness (como la retroalimentación de señales de timeout, la separación entre escritura y edición de archivos, y la tasa de aciertos de KV cache de contexto) jugaron un papel determinante en la capacidad de autorreparación del modelo y en el coste final de las tareas. (Fuente: 机器之心)

El equipo de Bo An de la Universidad Tecnológica de Nanyang revela los mecanismos de interacción entre modelos y Harness

El autor clave de AlphaGo analiza el origen de la falta de razonamiento real del Sistema 2 en los LLM : Thore Graepel, exinvestigador senior de DeepMind, publicó un artículo en MIT Technology Review señalando que la cadena de pensamiento actual de los LLM no es más que una generación asociativa prolongada del Sistema 1, carente del mecanismo de búsqueda auditable y del árbol de estados cognitivos explícito y mutable de AlphaGo. El verdadero razonamiento de las máquinas debe desacoplar por completo la “expresión del conocimiento” de la “deducción y aplicación”, apoyándose en arquitecturas de arbitraje independientes capaces de evaluar evidencias y contrastar hipótesis, en lugar de limitarse a aumentar la escala de parámetros. (Fuente: 机器之心)

El autor clave de AlphaGo analiza el origen de la falta de razonamiento real del Sistema 2 en los LLM

El Laboratorio de Superinteligencia de Meta revela el fenómeno del “impuesto de afilado” en el post-entrenamiento por RL : Tras analizar 42 grupos de modelos base y post-entrenados mediante aprendizaje por refuerzo (RL), el equipo de investigación de Meta descubrió que, si bien el RL incrementa drásticamente la tasa de éxito pass@1, lo hace a expensas de sacrificar la diversidad del espacio de salida, conduciendo las tareas hacia una consistencia extrema (acierto rotundo o fallo total). Al contar con un presupuesto amplio de muestreo (Large K), los modelos base sin un post-entrenamiento excesivo combinados con Harness ligeros son capaces de resolver problemas complejos de cola larga que los modelos ajustados por RL son completamente incapaces de superar. (Fuente: dair_ai)

El Laboratorio de Superinteligencia de Meta revela el fenómeno del "impuesto de afilado" en el post-entrenamiento por RL

Stanford publica el curso abierto a nivel de sistemas sobre entrenamiento de grandes modelos CS336 : El laboratorio de NLP de la Universidad de Stanford ha publicado los materiales del curso práctico de ingeniería de sistemas de modelos de lenguaje CS336. El curso se centra en la ingeniería aplicada para construir grandes modelos desde cero, cubriendo desde la implementación de tokenizadores, optimización de entrenamiento distribuido de Transformers, superación de la barrera de memoria de la GPU, validación de Scaling Laws, pipelines de limpieza de datos hasta RL para razonamiento. El diseño de las tareas equilibra el rigor teórico con las exigencias de la ingeniería a nivel de producción. (Fuente: stanfordnlp)

Meta propone RankEvolve, un pipeline multiagente de corrección de errores para la investigación científica : Ante el problema de que la IA incurre con facilidad en fallos encubiertos como fuga de datos y desconexión silenciosa de gradientes al llevar a cabo experimentos de Machine Learning de forma autónoma, el equipo de Meta ha propuesto RankEvolve, un Harness de investigación científica multiagente. El sistema configura Claude Code y Codex como nodos de revisión redundantes entre sí, auditando y corrigiendo mutuamente los cambios de código mediante protocolos de compilación, lo que incrementó significativamente la precisión de los experimentos científicos totalmente automatizados del 45,8% al 62,5%. (Fuente: dair_ai)

💼 Negocios

El unicornio de generación 3D Meshy supera los 100 millones de dólares en ARR, demostrando la barrera de las modalidades especializadas : Un análisis de mercado reveló que la startup de generación 3D Meshy disparó sus ingresos recurrentes anuales (ARR) de 1 millón a 100 millones de dólares en menos de dos años. A pesar de que los modelos de propósito general han adquirido capacidades elementales para programar scripts geométricos, en aspectos como topología de alto detalle, alineación de texturas y adaptación a pipelines industriales, la generación 3D vertical ha consolidado un sólido ciclo comercial cerrado a través de llamadas a APIs para grandes estudios de videojuegos y el ecosistema de hardware de impresión 3D. (Fuente: 量子位)

El unicornio de generación 3D Meshy supera los 100 millones de dólares en ARR, demostrando la barrera de las modalidades especializadas

Elon Musk confirma conversaciones con TSMC para la fabricación de chips en Terafab : Elon Musk ha confirmado públicamente que mantiene conversaciones avanzadas con TSMC para el proyecto de fabricación de chips verticalmente integrado a ultraescala Terafab. Terafab proyecta una capacidad anual de 1 TW de cómputo para cubrir las demandas de Tesla, SpaceX y xAI. Ante la presión en los plazos de producción en masa del nodo 14A de Intel, Musk busca mitigar los riesgos de la cadena de suministro apoyándose en la experiencia operativa y los rendimientos probados de las fábricas de TSMC, con el fin de asegurar el control absoluto sobre la cadena de suministro de sus chips personalizados. (Fuente: 量子位)

Elon Musk confirma conversaciones con TSMC para la fabricación de chips en Terafab

Queensland, Australia, afronta el rechazo local al centro de cómputo de 31.000 millones de dólares australianos para Anthropic : El proyecto del centro de datos Western Downs, con una inversión prevista de 31.000 millones de dólares australianos para suministrar cómputo a los modelos de Anthropic, ha provocado una fuerte oposición entre los residentes locales. Se prevé que el consumo energético máximo de las instalaciones alcance los 2,16 GW (equivalente a una cuarta parte del consumo eléctrico de todo Queensland), y más de 20.000 personas han firmado ya peticiones de rechazo. Para garantizar la transición energética y los beneficios económicos, el gobierno de Queensland anunció que retirará la potestad de aprobación a los ayuntamientos locales para centralizar la gestión, evidenciando el marcado conflicto entre la expansión del cómputo y la opinión pública local. (Fuente: The Guardian)

Queensland, Australia, afronta el rechazo local al centro de cómputo de 31.000 millones de dólares australianos para Anthropic

🌟 Comunidad

Sam Altman adopta una postura firme contra la divinización de la IA mientras se intensifica la división ideológica en Silicon Valley : Tras las revelaciones en medios sobre los intensos contactos de la directiva de Anthropic con líderes religiosos para discutir sobre la consciencia y el estatus moral de las máquinas, el CEO de OpenAI, Sam Altman, publicó un mensaje enfatizando que otorgar autoridad religiosa a los modelos de IA o incitar a los humanos a renunciar a su propio juicio constituye un grave riesgo para la seguridad. El ganador del premio Turing Yann LeCun y diversos académicos respaldaron esta postura, señalando que presentar a los grandes modelos como entidades conscientes dotadas de sensibilidad no solo es pseudociencia a nivel filosófico, sino que podría ser empleado por las grandes tecnológicas como defensa jurídica para eludir la estricta responsabilidad por daños o infracciones cometidas por los modelos. (Fuente: sama)

Reflexiones sobre la transformación de la industria tras el auge del Forward Deployed Engineer (FDE) : Con la creciente popularidad del puesto de Forward Deployed Engineer (FDE), profesionales del sector señalan que el núcleo de este rol ha pasado de la tradicional entrega de código “llave en mano” a la “estructuración de ontologías de negocio y la reconfiguración de relaciones organizacionales”. Ahora que la IA reduce drásticamente el coste marginal del desarrollo de software, los silos de datos interdepartamentales, las barreras de permisos y la resistencia del personal se han convertido en el principal obstáculo para la implementación de la IA; la esencia del FDE está evolucionando hacia una consultoría de negocio profunda respaldada por conocimientos técnicos. (Fuente: 量子位)

El relevo generacional de la IA en Alibaba hacia los nacidos en los 90 y el despliegue práctico centran la Apsara Conference : La Apsara Conference 2026 (Yunqi Conference) transmitió señales generacionales y estratégicas determinantes: los modelos Qwen pasan a estar dirigidos plenamente por dos miembros de la generación de los 90: Dayiheng Liu, quien lideró el preentrenamiento, y Yusen Chen, responsable de la comercialización de Qwen Workplace, cerrando el ciclo entre el desarrollo del modelo y la comercialización del producto. El evento reunió a una gran cantidad de sucesores de empresas de manufactura en busca de soluciones para la transformación con IA de sus fábricas, con el foco completamente puesto en retornos financieros tangibles: “¿en cuántas horas se completa el proceso y en cuánto tiempo se recupera la inversión?”. (Fuente: 36氪)

El debate entre CLI de terminal y GUI de escritorio: la comunidad discute las nuevas interfaces para agentes : El debate en torno al formato de las herramientas de codificación con IA sigue cobrando fuerza en la comunidad. Múltiples desarrolladores señalan que las interfaces de línea de comandos (CLI) con múltiples pestañas están quedando obsoletas, ya que la elevada carga cognitiva de contexto está impulsando a las herramientas hacia interfaces de usuario dedicadas para agentes, representadas por la aplicación de escritorio de Codex o lienzos independientes. Los usuarios ya no manipulan archivos a nivel microscópico, sino que dirigen y supervisan de forma asíncrona a múltiples agentes a nivel macro a través de espacios de trabajo persistentes. (Fuente: Yuchenj_UW)

Desarrolladores instan a los proveedores de nube y pasarelas de modelos a imponer límites estrictos de presupuesto por defecto : Ante los incidentes de facturas desorbitadas provocadas por bucles autónomos descontrolados de sistemas multiagente, Simon Willison e ingenieros de la comunidad han pedido enérgicamente a las pasarelas de API y plataformas de nube que configuren por defecto un corte estricto que devuelva un error una vez superado el presupuesto fijado. Las alertas blandas por correo electrónico son completamente ineficaces cuando un agente autónomo entra en bucle en mitad de la noche; el control granular de costes y los límites estrictos automáticos se están convirtiendo en un requisito indispensable para poner agentes en producción. (Fuente: Simon Willison)

💡 Otros

NVIDIA Shield TV sube 100 dólares a contracorriente debido al encarecimiento de la memoria impulsado por la IA : Tras siete años en el mercado, el reproductor multimedia NVIDIA Shield TV Pro ha incrementado repentinamente su precio en 100 dólares, alcanzando los 299,99 dólares. NVIDIA confirmó oficialmente que la expansión de la infraestructura de cómputo para IA en toda la industria ha provocado un drástico aumento en los costes de adquisición de memoria y componentes, obligando a elevar el precio incluso de hardware de consumo de generaciones anteriores con arquitecturas maduras para mantener operativas las líneas de producción. (Fuente: WIRED)

NVIDIA Shield TV sube 100 dólares a contracorriente debido al encarecimiento de la memoria impulsado por la IA

Una investigación revela un retroceso en la proporción de mujeres y su participación en el liderazgo en pleno auge de la IA : Datos recientes de firmas de investigación señalan que, a pesar de que el volumen de contratación y las primas salariales en puestos de IA han alcanzado máximos históricos a escala global, las mujeres representan apenas una cuarta parte de las nuevas contrataciones en IA y solo un 13% en puestos ejecutivos, viéndose en su mayoría relegadas a puestos de etiquetado de datos de baja remuneración. La cultura agresiva de horas extras y las dinámicas de contratación sesgadas hacia redes de contactos preexistentes están empujando a las mujeres hacia la periferia con alto riesgo de ser reemplazadas por la IA. (Fuente: The Guardian)

Una investigación revela un retroceso en la proporción de mujeres y su participación en el liderazgo en pleno auge de la IA

Las exenciones fiscales para centros de datos rurales en EE. UU. provocan el distanciamiento de las grandes tecnológicas y dudas públicas : Las exenciones fiscales multimillonarias de la legislación federal dirigidas a centros de datos en “Zonas de Oportunidad” rurales entrarán en vigor el próximo año. Sin embargo, gigantes tecnológicos como Microsoft, Meta y Amazon se han desmarcado públicamente de esta política. Los críticos señalan que tales incentivos, que establecen como único criterio la magnitud del capital, no solo no consiguen generar empleo sustancial y duradero en las zonas rurales, sino que además agravan la disputa por los recursos hídricos y energéticos y la confrontación con la opinión pública. (Fuente: WIRED)

Las exenciones fiscales para centros de datos rurales en EE. UU. provocan el distanciamiento de las grandes tecnológicas y dudas públicas

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *