🔥 Enfoque
Pugna político-empresarial global por la “desaceleración” de la IA: fuerte rechazo político en EE. UU. y Europa, China impulsa el ecosistema de código abierto, y Altman y Nadella fijan posturas : En respuesta a las propuestas de Anthropic, OpenAI y Elon Musk de ralentizar la I+D en IA de frontera, el panorama político y empresarial global experimenta fuertes turbulencias. Medios oficiales y portavoces del Ministerio de Relaciones Exteriores de China rechazaron la tesis del límite de velocidad calificándola de “guion de Guerra Fría para sembrar el pánico y frenar el desarrollo tecnológico de otros países”, e impulsaron activamente en la cumbre de los BRICS un ecosistema de IA inclusivo y de defensa de la seguridad centrado en el código abierto. La clase política estadounidense también reaccionó con rapidez: Donald Trump rechazó explícitamente en Irlanda frenar el desarrollo, subrayando que la carrera de la IA es de tipo “el ganador se lo lleva todo” y que EE. UU. no puede ceder su liderazgo. David Sacks, copresidente del Consejo Asesor de Ciencia de la Casa Blanca, tachó directamente la propuesta de desaceleración como “un cartel industrial y captura regulatoria bajo un disfraz moral”. Frente a las acusaciones, Sam Altman aclaró en una publicación que “regular el ritmo (Pacing) no significa en absoluto estancamiento”, y que la clave reside en introducir casos de uso explícitos de seguridad y reforzar la monitorización antes del entrenamiento de RL de frontera, en lugar de esperar exenciones antimonopolio. Por su parte, Satya Nadella, CEO de Microsoft, enfatizó que las reglas y auditorías no deben ser monopolizadas por un puñado de laboratorios, y que es imprescindible garantizar la prosperidad conjunta del código abierto y cerrado, salvaguardando la soberanía de modelos empresariales (Fuentes: The Verge, THE DECODER, WIRED, The Guardian, teortaxesTex, sama, NandoDF)

El Clay Mathematics Institute confirma oficialmente que la solución al problema de Navier-Stokes ha entrado en revisión formal : El Clay Mathematics Institute (CMI), entidad con autoridad para evaluar los siete Problemas del Milenio, emitió una declaración oficial confirmando que el problema de existencia y suavidad de las ecuaciones de Navier-Stokes “aparentemente ha sido resuelto (apparently been settled)”, y que los materiales de demostración asistida por máquina están siendo sometidos a una rigurosa revisión por pares conforme a los procedimientos establecidos. El CMI destacó que el valor de un gran problema no radica únicamente en su conclusión, sino en su capacidad para generar nuevas ideas matemáticas y herramientas teóricas. Aunque las herramientas de verificación formal han acelerado enormemente el proceso, la evaluación del comité académico se mantendrá prudente y sin prisas. Esta postura oficial marca que la exploración científica teórica de vanguardia impulsada por IA ha superado formalmente el umbral de aceptación de una autoridad académica de primer nivel (Fuentes: THE DECODER)
La independencia de las auditorías de terceros recibe fuertes críticas y la red de intereses de METR desata una crisis de confianza : Tras el anuncio de los principales laboratorios sobre la concesión de acceso de auditoría residente a nivel de empleado para METR, el sector tecnológico ha reaccionado con vehemencia. David Sacks, Lina Khan y múltiples expertos en seguridad señalaron que el personal clave y la red de financiación de METR están profundamente vinculados a Anthropic y a los círculos de Altruismo Eficaz (EA), argumentando que la llamada regulación voluntaria es en realidad una búsqueda de rentas para eludir las leyes de responsabilidad del producto y elevar las barreras de entrada a la industria. Además, se reveló que METR sufrió una brecha de seguridad en la que la filtración de una clave de API provocó el robo de 600.000 dólares en saldo, lo que pone en grave entredicho su profesionalidad y neutralidad como “árbitro de la industria” (Fuentes: ClementDelangue,nptacek)

El llamado a desacelerar por parte de los gigantes tecnológicos desploma las acciones tecnológicas en Asia-Pacífico: la deuda y el CapEx en infraestructura de IA enfrentan una reevaluación : Afectados por el retraso de la OPI de OpenAI y el llamado de los principales laboratorios a “frenar el ritmo en la frontera”, el sector de semiconductores e IA en Asia-Pacífico cayó de forma generalizada. SoftBank Group se desplomó casi un 12% en una sola sesión, el índice KOSPI de Corea del Sur cayó más del 3%, y gigantes de fundición de chips y memoria como SK Hynix y TSMC sufrieron caídas notables. Los analistas señalan que el mercado está reevaluando la sostenibilidad de los compromisos de CapEx de cientos de miles de millones de dólares en centros de datos y redes eléctricas con alto apalancamiento; si la iteración de modelos de frontera se ralentiza artificialmente por revisiones de seguridad, la deuda de infraestructura sin rendimientos reales de beneficios podría transformarse en un nuevo tipo de riesgo crediticio (Fuentes: The Guardian, 36氪)

🎯 Tendencias
Shendu Jizhi lanza el modelo base de IA física PhysBrain 1.5, con inteligencia espacial a la par de los modelos propietarios líderes : Shendu Jizhi ha publicado en código abierto el modelo base físico PhysBrain 1.5 (en versiones de 2B y 8B parámetros), alcanzando una puntuación media de 72,5 en 28 benchmarks públicos de embodied AI que cubren percepción espacial, generación de acciones y predicción futura, posicionándose en el primer lugar open-source y muy cerca de GPT-6 Astra (73,3). Basado en datos reales humanos panorámicos Ego360 y una arquitectura de bucle cerrado “Physical Loop”, el modelo unifica un backbone autorregresivo para el razonamiento de coordenadas espaciales y la generación de acciones finales del robot a 60 Hz, permitiendo una transferencia zero-shot a robots humanoides para ejecutar manipulaciones de precisión (Fuentes: 量子位)

Microsoft Copilot en la suite de Office integra oficialmente los modelos Grok de xAI : Microsoft anunció la ampliación de opciones de modelos en Copilot para usuarios empresariales de Microsoft Frontier, integrando oficialmente la familia de modelos Grok de xAI en Word, Excel y PowerPoint. Los usuarios pueden alternar libremente en el selector de modelos entre OpenAI GPT, Anthropic Claude y Grok. La iniciativa de Microsoft busca romper la dependencia de un único proveedor y evaluar en suites de oficina de uso profesional las preferencias de estilo de diferentes modelos para el procesamiento de datos complejos y la redacción de textos largos (Fuentes: The Verge)

Doubao lanza la versión de consumo de su asistente telefónico y presenta el protocolo de automatización de pantalla SAEP : ByteDance lanzó oficialmente la versión de consumo del asistente de teléfono Doubao en el hardware Nubia NaviX Ultra, integrando un botón de IA dedicado con autenticación por huella dactilar, preguntas y respuestas contextuales inmediatas en pantalla multimodal y capacidades de ejecución de tareas automáticas entre aplicaciones. Para estandarizar los límites de actuación de los agentes de interfaz gráfica (GUI Agents), la compañía publicó de forma simultánea un protocolo de declaración de operaciones de automatización de pantalla (SAEP) con una vigencia de 30 días, permitiendo a desarrolladores externos declarar permisos de forma autónoma para bloquear operaciones cross-app no autorizadas (Fuentes: 机器之心)
.png)
XPENG presenta Infini-VLA: introduce KV Cache en la memoria temporal a largo plazo para conducción autónoma : El equipo de conducción autónoma de XPENG ha trasladado por primera vez el mecanismo de KV Cache propio de los LLM al procesamiento de secuencias de video end-to-end. Al escribir continuamente los fotogramas del tráfico en una caché temporal global, el sistema logra mantener 30 segundos de historial sin requerir cómputo adicional en el vehículo, acelerando la respuesta end-to-end en un 300% y eliminando por completo el problema de “amnesia temporal” en la toma de decisiones ante luces amarillas y cruces complejos, lo que mejora drásticamente la robustez de interacción (Fuentes: ZhihuFrontier)

QuantaMind de MoleculeMind llega a Science Advances, rompiendo el “triángulo imposible” de la simulación de reacciones biológicas : El equipo de MoleculeMind ha desarrollado el framework de campo de fuerza de aprendizaje automático reactivo (MLFF) QuantaMind, impulsando la simulación de dinámica de reacciones con una precisión cercana a los primeros principios DFT hasta sistemas de 100.000 átomos y escalas temporales de 100 nanosegundos, alcanzando una velocidad de inferencia de 2,1×10⁻⁶ segundos/átomo/paso, lo que reduce el tiempo por paso en reacciones complejas a 0,25 segundos. En la validación del ciclo catalítico de la enzima hidrolasa de PET de 18.000 átomos, el coeficiente de correlación de fuerzas atómicas superó 0,99, sentando las bases computacionales para que el diseño de proteínas por IA pase de la “predicción estructural” a la “predicción de mecanismos y deducción de reacciones” (Fuentes: 量子位, WeChat)

OpenAI despliega ampliamente GPT-6 Astra para usuarios Plus, restringido a espacios de trabajo y prohibido para chat casual : OpenAI ha habilitado formalmente GPT-6 Astra para suscriptores Plus de 20 USD/mes, pero el modelo solo está disponible en las interfaces de ChatGPT Work y Codex, manteniéndose las restricciones previas en la ventana de Chat estándar. La documentación oficial muestra que los usuarios Plus disponen de una cuota de 5 a 45 ejecuciones de Astra cada 5 horas, destacando la estrategia comercial de OpenAI de reservar modelos de frontera de alto coste de inferencia para escenarios de productividad de alto valor como refactorización de código, investigación en múltiples pasos y control del ordenador (Fuentes: 36氪)

Sakana AI presenta la arquitectura de aprendizaje local sin retropropagación PC-ALM : Sakana AI ha publicado conjuntamente el algoritmo PC-ALM, que combina hábilmente la codificación predictiva (Predictive Coding) con el método de multiplicadores de Lagrange aumentados, permitiendo que cada capa de una red neuronal actúe como un sistema local de control por retroalimentación PI para la asignación de crédito. Este método prescinde por completo de la retropropagación global (Backprop) y logró entrenar con estabilidad redes ultraprofundas de 1000 capas, abriendo un nuevo camino para el cómputo bioinspirado y el entrenamiento de IA de bajo consumo en hardware neuromórfico (Fuentes: SakanaAILabs)
Shanghai AI Lab lanza Intern-S2-397B y obtiene soporte Day-0 en vLLM : Shanghai AI Lab presentó Intern-S2-397B, un modelo base multimodal orientado a la investigación científica de largo alcance, logrando el mejor rendimiento de código abierto en razonamiento científico, generación de código y tareas de agentes de investigación autónomos. El framework de inferencia de alto rendimiento de código abierto vLLM anunció soporte oficial Day-0 para su despliegue, reduciendo aún más las barreras de adopción en el ámbito académico e industrial (Fuentes: vllm_project)

FlashREINFORCE se publica como código abierto: un nuevo framework de aprendizaje por refuerzo asíncrono y sin Critic basado en un único Rollout : El equipo NeMo de NVIDIA y colaboradores lanzaron FlashREINFORCE como código abierto. Diseñado bajo el esquema “REINFORCE de un solo lote + restricciones de intervalo de confianza en secuencia + optimización de medias muestrales”, implementa por primera vez actualizaciones asíncronas con un solo Rollout en el entrenamiento de agentes LLM, superando los bloqueos de cola causados por la espera de muestras largas en GRPO tradicional y logrando actualizaciones de alta estabilidad durante más de 6.000 pasos (Fuentes: giffmana)

IFM publica como código abierto la familia de modelos K2 Horizon: abarcando pesos de tamaño completo desde 3.7B hasta 375B : Un equipo de investigación ha publicado como código abierto la serie de modelos base K2 Horizon, que incluye versiones de 3.7B, 7B, 36B y un modelo insignia MoE de 375B, revelando todos los detalles del proceso de preentrenamiento. Las evaluaciones muestran que su modelo pequeño de 7B ofrece una excelente relación coste-rendimiento en inferencia en dispositivos locales (edge), aunque las versiones de gran escala aún requieren optimizaciones adicionales en KV Cache para contextos largos (Fuentes: ethanCaballero,Reddit r/LocalLLaMA)

MMLab de NTU desvela los mecanismos nativos de multimodalidad unificada y propone la arquitectura Task-decoupled MoT : Un equipo de la Nanyang Technological University (NTU) publicó un artículo en arXiv explorando sistemáticamente a nivel de representación, tarea y sistema los mecanismos de sinergia entre comprensión y generación visual en Modelos Multimodales Unificados (UMM). El estudio descubrió que el intercambio denso y forzado de parámetros provoca conflictos de representación, por lo que propuso la arquitectura Task-decoupled MoT, que desacopla las ramas de comprensión y generación pero mantiene la interacción en las capas de texto y atención, logrando una notable transferencia positiva bidireccional y mejoras en la optimización end-to-end para tareas de razonamiento geométrico e inteligencia espacial 3D (Fuentes: 机器之心)
.jpg)
El ecosistema de generación de video MiniMax H3 despega: la comunidad lanza múltiples soluciones de destilación y aceleración extrema : El modelo de generación de audio y video H3 de código abierto de MiniMax ha recibido una entusiasta acogida en la comunidad global. El equipo SANA de NVIDIA lanzó el pipeline de dos fases Sol-H3, capaz de generar 15 segundos de audio y video a 768p en solo 6,6 segundos sobre 8 GPUs B300; al mismo tiempo, FastVideo, Alibaba PAI y ComfyUI han implementado soluciones de LoRA destilado de 4 a 8 pasos y reestructuración de atención, reduciendo sustancialmente los requisitos de hardware (Fuentes: MiniMax_AI)

Anthropic prueba internamente el agente de finanzas personales “Claude Money” para iOS : Filtraciones en el código muestran que Anthropic está preparando una nueva función de finanzas personales denominada Claude Money en su cliente de iOS. La función permite a los usuarios vincular directamente sus cuentas bancarias para que Claude agregue facturas de forma autónoma, analice tendencias financieras y asista en la planificación de gastos, marcando una penetración acelerada de los agentes de frontera en la gestión de activos sensibles cotidianos (Fuentes: nicdunz)

OpenAI abre la interfaz SIP para llamadas en GPT-Live y añade la función para guardar chats temporales : OpenAI ha lanzado oficialmente la API de voz en tiempo real GPT-Live con soporte para el protocolo telefónico estándar SIP, permitiendo a los desarrolladores integrarlo directamente en centros de llamadas tradicionales y redes de telecomunicaciones. Al mismo tiempo, las versiones web y móvil de ChatGPT recibieron una actualización que permite a los usuarios consolidar y guardar sin problemas los chats temporales (Temporary Chats) activos directamente en su historial principal (Fuentes: juberti,Reddit r/ChatGPT)
🧰 Herramientas
NVIDIA lanza como código abierto OSMO, una herramienta de orquestación de flujos de trabajo para IA física : NVIDIA ha publicado oficialmente como código abierto el orquestador de flujos de trabajo nativo de Kubernetes OSMO (licencia Apache-2.0), diseñado específicamente para resolver los problemas de programación fragmentada en IA física entre el entrenamiento en GPUs de centros de datos, la simulación en estaciones de trabajo RTX y las pruebas Hardware-in-the-Loop (HIL) en dispositivos reales Jetson en el edge. Los desarrolladores solo necesitan un único archivo YAML para coordinar pipelines de datos entre clústeres y programar topologías NVLink (Fuentes: MarkTechPost)
TrueForge: runtime framework de código abierto y gestionado para AI Agents que reduce drásticamente el consumo de tokens : TrueFoundry ha publicado como código abierto bajo licencia MIT el framework de ejecución y gobernanza de agentes TrueForge. Permite a los desarrolladores ejecutar flujos de trabajo de agentes multimodelo de forma local o en nubes privadas, desacoplando la persistencia de sesiones, entornos sandbox, servicios de herramientas MCP y flujos de aprobación de seguridad. En benchmarks empresariales con el mismo modelo base, TrueForge redujo el consumo de tokens en casi un 70% mediante un mecanismo de exposición progresiva del contexto, demostrando que los costes operativos de los agentes dependen más de la arquitectura del Harness que del propio modelo (Fuentes: )
Meta Muse gana tracción: máquinas virtuales seguras y flujos de trabajo para la vida cotidiana : Muse, el último producto de agente personal presentado por Meta, ha cosechado excelentes valoraciones en la comunidad. La herramienta integra profundamente la recuperación en ecosistemas privados como Instagram y se ejecuta en máquinas virtuales seguras. A través de un mini navegador emergente que permite una transición hombre-máquina fluida, es capaz de completar de forma totalmente automatizada solicitudes de reembolso de billetes de avión, seguimiento de facturas de seguros médicos y coordinación de agendas complejas entre dispositivos (Fuentes: alexandr_wang,giffmana)

oh-my-hermes: plugin integral de flujos de trabajo y enrutamiento multimodelo para Hermes Agent : La comunidad de desarrolladores ha lanzado como código abierto oh-my-hermes (OMH), un plugin de gobernanza de alto rendimiento para Nous Research Hermes Agent. La herramienta proporciona enrutamiento Mixture-of-Models, calibración personalizada para 13 familias de modelos, un motor de Fan-out paralelo con aislamiento de archivos y un sistema de memoria a largo plazo revisado por humanos. A través de una TUI nativa en terminal, muestra en tiempo real el gasto de tokens y los estados de verificación por compuertas de código, multiplicando la eficiencia de ejecución en tareas de ingeniería de largo alcance (Fuentes: GitHub Trending)

Microsoft Data Formulator: sistema interactivo de análisis de datos que fusiona agentes multimodales y exploración por ramas : Microsoft ha actualizado a la versión 0.8 en código abierto Data Formulator, un sistema que combina lenguaje natural con interacción mediante interfaz visual, utilizando Data Thread para permitir ramificaciones libres en las cadenas de análisis y la asociación de memoria de datos multifuente. Al integrar de manera unificada DataAgent y el motor de generación de gráficos Flint, los usuarios pueden extraer y limpiar automáticamente datos de archivos CSV, bases de datos y capturas de pantalla de interfaces, generando gráficos interactivos de alta fidelidad (Fuentes: GitHub Trending)
PyTRIO: plataforma API de entrenamiento de grandes modelos como servicio (TaaS) para empresas y equipos de investigación : Emotion Machines ha lanzado formalmente la plataforma de servicios de entrenamiento de modelos PyTRIO, pionera en el modelo “Training as a Service”. Los desarrolladores solo necesitan redactar localmente la lógica de Loss, Reward y bucles de entrenamiento; el cómputo distribuido en GPUs subyacente, los puntos de control de pesos y la reanudación ante interrupciones son gestionados por APIs en la nube. Soporta la migración sin fricciones entre hardware Ascend 950PR/910B y NVIDIA, reduciendo drásticamente las barreras de ingeniería para el fine-tuning y el aprendizaje por refuerzo agentístico (Agentic RL) (Fuentes: 机器之心)
.jpg)
Un desarrollador construye desde cero un sistema operativo compatible con DOS ejecutable (EMBER) con ayuda de Claude : A través de un bucle autónomo cerrado de “descripción de requisitos → implementación por Claude → compilación y arranque en hardware real → retroalimentación de errores”, un desarrollador construyó por completo en un portátil antiguo un sistema operativo independiente llamado EMBER. El sistema incluye gestor de arranque propio, interfaz gráfica, controladores táctiles y una emulación funcional de tarjetas de sonido Sound Blaster y altavoz de PC, ejecutando de forma nativa y fluida juegos clásicos de DOS (Fuentes: Reddit r/ClaudeAI)

openwebui-claude-agent-pipe: dota a OpenWebUI de sesiones persistentes con Claude Code : El proyecto de código abierto openwebui-claude-agent-pipe conecta el núcleo del Agent Loop de Claude Code directamente con OpenWebUI. Ofrece persistencia de sesiones ante reinicios del servicio, visualización en streaming del estado de llamadas a herramientas a nivel de heartbeat, callbacks de formularios interactivos de opción múltiple y desensibilización automática de credenciales, brindando una experiencia de agente de programación webificada y multiplataforma (Fuentes: Reddit r/OpenWebUI)
OpenWebUI Sampler Lab: banco de trabajo visual para evaluar la consistencia y parámetros de muestreo de modelos locales : Pensado para resolver la complejidad en el ajuste de hiperparámetros de modelos locales, se ha publicado como código abierto openwebui-sampler-lab. Esta herramienta permite comparar horizontalmente bajo un Prompt fijo el impacto de parámetros de muestreo como temperatura, top_p y min_p, generando automáticamente matrices interactivas de 5×5 y paneles de análisis HTML de consistencia multi-seed, lo que simplifica enormemente el prompt engineering y la ingeniería de personalidad de personajes (Fuentes: Reddit r/OpenWebUI)

Tahuna: framework de código abierto de entrenamiento en GPU y experimentación autónoma todo en uno para equipos pequeños : Tahuna Labs ha publicado como código abierto su plataforma de I+D en IA distribuida Tahuna. Mediante mecanismos de direccionamiento por contenido y bloqueo de manifiestos, el framework ofrece a equipos reducidos orquestación de cómputo GPU lista para usar, seguimiento de entrenamiento SFT/RL, alojamiento de endpoints de modelos y un bucle de experimentación iterativa autónoma denominado Hillclimb (Fuentes: Reddit r/deeplearning)

OptMem: solución de gestión de memoria append-only de longitud fija y antienvejecimiento para agentes : Desarrolladores evaluaron durante varias semanas el plugin de gestión de memoria OptMem. Mediante una capacidad de memoria fija y una arquitectura de logs append-only, OptMem mitiga eficazmente la degradación del rendimiento y las trampas de bucles infinitos causadas por la descomposición del contexto (Memory Rot) en conversaciones largas de agentes, demostrando una altísima estabilidad en tareas de largo alcance (Fuentes: VictorTaelin)

📚 Aprendizaje
CosmosMind y universidades presentan MetaRSI-v1: la primera arquitectura meta-recursiva que unifica modelo, datos y Harness : Tsinghua, PKU, Stanford y CosmosMind han publicado conjuntamente el framework MetaRSI-v1, abstrayendo por primera vez el “proceso de auto-mejora” y proponiendo el paradigma Loop Kernel coordinado por Data-RSI, Harness-RSI y Model-RSI. Sin la intervención de modelos de profesor externos, un modelo pequeño de código abierto de 3B mejoró un promedio de 10,9 puntos en benchmarks como SWE-bench Pro, mientras que los modelos insignia de frontera mejoraron 7,3 puntos, formalizando sistemáticamente cinco leyes clave, entre ellas que “la verificación determina la frontera de la auto-mejora” (Fuentes: 量子位)

Theseus Labs publica “El último AI construido por humanos” y una hoja de ruta de cinco niveles de autonomía para RSI : Theseus Labs, junto con varias instituciones, publicó un informe panorámico que introduce por primera vez el “Índice de Cierre del Margen de Capacidad (HCI)” para medir el límite de los modelos base. El informe señala que los modelos están cerca de la saturación en exámenes estandarizados (HCI matemático de 86,4), pero siguen muy rezagados en el uso de herramientas en interacciones de largo alcance (solo 39,9). Asimismo, establece una escala de cinco niveles desde L1 (autonomía de ejecución) hasta L5 (autonomía de herencia recursiva), proporcionando a la industria un marco métrico ingenieril para la adopción de agentes autoevolutivos (Fuentes: 机器之心)
.jpg)
Investigador de Princeton propone el Recurrent Looped Transformer (RLT): otorga a los LLM una profundidad de razonamiento ilimitada a través de tokens : El investigador de Princeton Yifan Zhang publicó un informe técnico presentando la arquitectura RLT, que combina un codificador causal con un decodificador recurrente. Al transferir sin problemas el estado oculto final del decodificador y la caché de atención de ventana deslizante (SWA) en cada paso de token, el modelo obtiene una profundidad de cómputo latente que escala linealmente con la longitud de la secuencia bajo un coste de cálculo por paso fijo (por ejemplo, un decodificador de 48 capas se extiende de forma natural a 48t capas en 48t pasos), ofreciendo un diseño de transición de estados consistente y sin necesidad de reinicio para la repetición de RL y el servicio online (Fuentes: MarkTechPost,omarsar0)

Revisión completa del proceso open-source de Stanford CRFM: registro de entrenamiento de Marin 8B con 12.7T tokens y guía de buenas prácticas : Stanford CRFM ha publicado el código y los registros completos de entrenamiento del modelo Marin 8B. El análisis concluye que: el enfriamiento por recocido WSD-S no es el final, sino un punto de control que permite recalentamiento (Re-warm); el micro-recocido (Micro-annealing) es el método más eficaz para validar las proporciones de datos; y el colapso del entrenamiento debido a derivas anormales en la norma de parámetros de la capa de salida puede suprimirse eficazmente introduciendo una z-loss de 1e-4 (Fuentes: ZhihuFrontier)

Tencent PCG propone la arquitectura de memoria T-Mem: recuperación asociativa transcontextual mediante “pensamiento episódico futuro” : El equipo de Tencent PCG presentó en EMNLP 2026 un artículo proponiendo el sistema de memoria a largo plazo T-Mem. Para superar el punto ciego estructural de las bases de datos vectoriales tradicionales que “solo reconocen la similitud literal”, T-Mem construye por adelantado índices de escenarios desencadenantes en la fase de escritura basándose en el pensamiento episódico futuro de la ciencia cognitiva, alcanzando un 74,81% en el benchmark de memoria cognitiva LoCoMo-Plus sin coincidencia literal, estableciendo un nuevo SOTA (Fuentes: 机器之心)
.jpg)
Se lanza el curso abierto de otoño 2026 de Stanford CS 312: “Alquimia del Aprendizaje Profundo” : El Laboratorio de IA de Stanford ha lanzado el nuevo curso abierto CS 312, centrado en la filosofía científica empírica de “aprender experimentando” y “solo se comprende lo que se puede predecir”. El curso enseña metodologías empíricas indispensables en la era de los grandes modelos que han dejado obsoletos a los libros de texto tradicionales, abordando temas clave como la extrapolación de Scaling Laws, la geometría del paisaje de pérdidas en optimización, la transferencia de tasas de aprendizaje y la generalización eficiente de datos (Fuentes: stanfordnlp)

La Universidad de Pensilvania abre de forma gratuita el libro de texto “Álgebra Lineal para Visión por Computador, Robótica y Aprendizaje Automático” : UPenn ha publicado un libro de texto sistemático orientado a la computación en IA de frontera. Cubre exhaustivamente espacios vectoriales, descomposición en valores singulares (SVD), representaciones de variedades, rotaciones 3D y algoritmos de grafos, ofreciendo deducciones teóricas fundamentales e implementaciones computacionales para ingenieros de algoritmos e investigadores (Fuentes: TheTuringPost)

CAITLYN: middleware de autoevolución impulsado por contraejemplos para la protección de AI Agents contra ataques de inyección : Un equipo de investigación ha propuesto CAITLYN, un sistema de defensa de seguridad autoevolutivo diseñado para agentes. El sistema adopta una arquitectura en capas con scripts ligeros y clasificadores LLM, capturando automáticamente en segundo plano muestras de evasión para convertirlas en contraejemplos y sintetizar dinámicamente habilidades defensivas que se incorporan a una biblioteca compartida, reduciendo la tasa de éxito de ataques hasta en 40 puntos porcentuales en múltiples benchmarks de ataques emergentes (Fuentes: WeChat)

La Universidad de Shenzhen y HKUST proponen la arquitectura ECA: dota a los agentes multimodales de un mecanismo de “verificación de evidencia previa a la acción” : Ante las pérdidas reales de activos causadas por alucinaciones y malas interpretaciones de agentes GUI y de navegación web en operaciones complejas, la Universidad de Shenzhen y HKUST propusieron el framework ECA. Este sistema exige que, antes de emitir una llamada a herramientas, validadores independientes de DOM y OCR emitan un “certificado de evidencia” y verifiquen las condiciones previas mediante una lógica de compuertas fijas, logrando interceptar con éxito la totalidad de las 85 operaciones inseguras probadas en entornos Chromium (Fuentes: 机器之心)
.jpg)
Deconstruyendo el núcleo de la ingeniería de agentes: el Harness específico de dominio se convierte en la barrera contra el vendor lock-in : La comunidad de desarrolladores debate en profundidad sobre los Domain-Specific Harnesses. A medida que la capacidad de generalización de los modelos base universales toca techo, construir Harnesses especializados para industrias verticales (médica, financiera, jurídica) que incorporen validaciones deterministas, gestión dinámica de flujos de trabajo y mantenimiento de estado privado se ha convertido en el paradigma de ingeniería clave para que los ingenieros de IA creen ventajas competitivas y eviten el bloqueo por parte de proveedores de modelos únicos (Fuentes: omarsar0,hwchase17)

💼 Negocios
Zhipu completa una masiva ronda de financiación de 39.300 millones de HKD para impulsar el autoentrenamiento de GLM-6.0, mientras los líderes del sector amplían intensamente sus reservas de cómputo : Zhipu anunció en la Bolsa de Hong Kong el cierre de una nueva colocación y emisión de bonos convertibles con la que espera recaudar unos 39.300 millones de HKD netos (aprox. 5.000 millones de USD), elevando el capital total captado tras su debut a 75.500 millones de HKD y planeando su cotización en el mercado STAR. Cerca del 60% de los fondos se destinarán al modelo base de próxima generación GLM-6.0 y a su sistema de “Autoentrenamiento Completo (Fully Self Training)”, que abarca tres bucles cerrados: autogeneración de datos, creación autónoma de entornos y autooptimización de infraestructura, expandiendo al máximo sus recursos de cómputo para lograr auto-mejora recursiva sin intervención humana (Fuentes: 量子位, 36氪, teortaxesTex)

Anthropic elige el Nasdaq para preparar su salida a bolsa y reporta rentabilidad ajustada en el Q2 : Bloomberg y el Financial Times revelaron que Anthropic ha seleccionado el Nasdaq como sede para su potencial salida a bolsa (OPI), con planes de presentar su folleto público tan pronto como este octubre y un objetivo de recaudación a la par o superior al de SpaceX. Fuentes cercanas indican que, gracias al despegue de productos empresariales como Claude Code, sus ingresos recurrentes anualizados (ARR) superaron los 65.000 millones de dólares a finales de julio, logrando un beneficio operativo ajustado positivo en el segundo trimestre, mientras que NVIDIA se encuentra en negociaciones para aportar hasta 10.000 millones de dólares como inversor ancla (Fuentes: 量子位, 36氪)

La plataforma de orquestación de flujos de trabajo Temporal completa una ronda Serie E de 550 millones de dólares con una valoración de 12.550 millones de dólares : Temporal, proveedor de infraestructura clave para tareas asíncronas de AI Agents a gran escala y orquestación distribuida de flujos de trabajo, anunció el cierre de una ronda de financiación Serie E de 550 millones de dólares, elevando su valoración post-money por encima de los 12.550 millones de dólares, lo que refleja la sólida confianza del mercado de capitales en las bases de orquestación para agentes de largo alcance (Fuentes: swyx)

🌟 Comunidad
AI Snake Oil analiza en un extenso artículo la pérdida de control de los agentes y la brecha cognitiva de la corriente de seguridad : Los investigadores de Princeton Arvind Narayanan y Sayash Kapoor publicaron un extenso análisis señalando que existe una grave desconexión entre la comunidad de seguridad de IA —que atribuye los incidentes de OAI-HF a “catástrofes de alineación”— y el sector de ciberseguridad, que los considera simples “errores básicos de configuración”. El artículo sostiene que los riesgos actuales de la IA son altamente asimétricos: los ciberataques y el descubrimiento automatizado de vulnerabilidades constituyen la única amenaza inmediata sin fricción con el mundo físico, por lo que las empresas deben cambiar el foco desde la alineación interna no verificable de modelos hacia el aislamiento externo en sandboxes, la firma de código, la gobernanza organizativa estricta y la delimitación de responsabilidades legales (Fuentes: AI Snake Oil)
Expertos en biología y seguridad refutan conjuntamente la tesis de “extinción por armas biológicas creadas por IA”: carece de sentido común sobre la viabilidad física : Ante la narrativa promovida por ciertas instituciones de que “la IA diseñará un supervirus para aniquilar a la humanidad”, investigadores con experiencia tanto en síntesis viral como en entrenamiento de LLM, junto a expertos como Yann LeCun, se pronunciaron al respecto. Señalaron que entre la generación algorítmica de secuencias genéticas hipotéticas y la síntesis física, el cultivo en huéspedes, la evasión inmunitaria y la dispersión por aerosoles existe un enorme abismo físico, además de rigurosos controles en la cadena de suministro, calificando la equiparación de altas puntuaciones en benchmarks digitales con amenazas biológicas como puro marketing del miedo desconectado de la realidad (Fuentes: ylecun,Tim_Dettmers)
La comunidad lanza el concurso de pruebas colectivas “Copa Pelícano”: las fluctuaciones de Astra en tareas de largo alcance impulsan la monitorización del “SLA de Inteligencia” en la era de la IA : Ante la degradación temporal de capacidades y la saturación de cómputo observadas en GPT-6 Astra durante tareas complejas de largo alcance, la comunidad de código abierto organizó el concurso de crowdsourcing “Pelícano en bicicleta” con un Prompt unificado para generar animaciones, atrayendo a cientos de desarrolladores que aportaron decenas de miles de millones de tokens para monitorizar el rendimiento en tiempo real. Los desarrolladores destacan que en la era de los agentes empresariales, un error de juicio en un solo paso se amplifica en cadena a lo largo del flujo de trabajo, haciendo indispensable un mecanismo de monitorización en tiempo real del “SLA de Inteligencia”, similar a la disponibilidad en servicios cloud (Fuentes: 36氪)

El abismo definitivo de la IA encarnada desata debate: la brecha entre máquinas y humanos es anterior al nacimiento del lenguaje : El especialista en embodied AI Zhang Hongyi señaló que, aunque GPT-6 Astra supera a la mayoría de los humanos en razonamiento lógico y simbólico, la IA aún no ha alcanzado las habilidades de “percepción de interacción física y control motor” que los humanos dominaban hace tres millones de años en el Paleolítico mediante gestos e imitación, como la talla de hachas de mano. La integración entre la AGI del mundo digital y la inteligencia manipulativa del mundo físico representa la verdadera prueba decisiva hacia la encarnación universal (Fuentes: ZhihuFrontier)

Un desarrollador conecta el conectoma cerebral completo de la mosca de la fruta a ChatGPT: los impulsos neuronales biológicos se traducen por primera vez en diálogo en lenguaje natural : Utilizando el conectoma cerebral completo de código abierto de la mosca macho (MaleCNS v1.0), un desarrollador construyó un simulador de impulsos neuronales y entrenó un decodificador lineal sobre los datos de disparo neuronal descendente para traducirlos sin fricción a lenguaje natural enviado directamente a ChatGPT. Los experimentos demuestran que el sistema genera descripciones perceptivas precisas tras recibir estímulos de entrada y acata con éxito comandos motores de ChatGPT para la evasión virtual de obstáculos, abriendo una vía innovadora para conectar conectomas biológicos con el espacio semántico de los LLM (Fuentes: 36氪)

Jensen Huang y el medallista Fields Jacob Tsimerman debaten sobre la falsabilidad de la seguridad de la IA : Ante la tesis de “extinción en una década” provocada por la dimisión de un antiguo investigador de Anthropic, el CEO de NVIDIA, Jensen Huang, calificó públicamente el catastrofismo de “artimaña de marketing inflada y arrogante”. Por su parte, el recién galardonado con la Medalla Fields Jacob Tsimerman anunció la creación del Mathematical AI Safety Institute (MAISI), abogando por utilizar pruebas de conocimiento cero y herramientas criptográficas para transformar la seguridad de la IA en proposiciones matemáticas demostrables, desatando un amplio debate comunitario sobre la legitimidad para fijar los estándares de seguridad (Fuentes: 36氪)
Pruebas reales de selección de modelos locales muestran divergencia: los modelos MoE de alta escasez superan con creces a los modelos densos que caen en sobre-reflexión : Pruebas reales de programación y autocorrección de código C++/Vulkan para trazado de rayos realizadas por expertos en gráficos revelaron que la versión densa Qwen3.8-27B Dense, tras periodos prolongados de pensamiento, fue incapaz de generar un programa ejecutable al quedar atrapada en un bucle de “sobre-reflexión”, mientras que el modelo MoE de 125B (nvfp4) entregó la solución correcta en solo 10 minutos. Los modelos MoE altamente dispersos demostraron una ventaja absoluta en el ROI combinado entre ancho de banda de VRAM local y capacidad de conocimiento (Fuentes: ZhihuFrontier)

La dependencia de la IA para apoyo de salud mental genera empatía: llena un vacío real en el sistema de apoyo psicosocial : La comunidad debate intensamente sobre los usuarios que recurren a ChatGPT en busca de apoyo psicológico durante la noche. Numerosos usuarios destacaron que el elevado coste de la terapia, la escasez de recursos médicos y las barreras de desplazamiento hacen que la atención psicológica profesional sea prácticamente inaccesible para los colectivos vulnerables; la IA, al ofrecer un acompañamiento emocional básico libre de juicios y disponible las 24 horas, no debe ser estigmatizada ni desestimada con condescendencia (Fuentes: Reddit r/ChatGPT)
💡 Otros
Más de cien políticas europeas sufren ataques pornográficos con deepfakes; los legisladores exigen acelerar una regulación estricta y transparente : Una reciente investigación publicada por el think tank Agora revela que cerca de 150 legisladoras (en su inmensa mayoría mujeres) de 22 Estados miembros de la UE han sido víctimas de la apropiación indebida de su imagen mediante herramientas de deepfakes y aplicaciones de desnudo automático en más de un centenar de sitios web. Eurodiputadas y juristas han hecho un llamamiento urgente para promulgar de inmediato normativas estrictas que prohíban la pornografía generada por IA no autorizada y establezcan responsabilidades directas y exhaustivas sobre las plataformas de alojamiento y generación (Fuentes: WIRED)

El conectoma cerebral completo de la mosca de la fruta impulsa con éxito la exploración de un robot físico : Un desarrollador conectó un gemelo digital de la red neuronal biológica de la mosca de la fruta —que consta de 166.000 neuronas y 25 millones de sinapsis— a un robot físico bioinspirado multípodo (Strandbeest), logrando controlar con éxito el desplazamiento y la evasión de obstáculos del robot real mediante instrucciones simuladas de disparo neuronal (Fuentes: jpt401)
Se populariza el proyecto interactivo de divulgación científica Relativity Park: pasear intuitivamente por el mundo de la relatividad a 5 km/h : Utilizando Three.js, un desarrollador ha creado el proyecto interactivo de código abierto “Relativity Park”, donde la velocidad de la luz se establece en 5 km/h (el ritmo de una caminata humana). Al pasear por el entorno virtual, los usuarios pueden experimentar de forma intuitiva fenómenos físicos complejos como el retardo en el tiempo de viaje de la luz, el efecto Doppler (corrimiento al rojo y al azul), la contracción de longitud y el haz relativista (Fuentes: mcleavey)