OpenAI y Anthropic acumulan decenas de miles de… | Diario de IA 2026-09-01

🔥 Enfoque

OpenAI y Anthropic acumulan decenas de miles de Mac mini/Studio para entrenar agentes de uso de ordenador : Varios medios confirman que OpenAI ha comprado decenas de miles de Mac mini y Mac Studio sin pantalla, y que Anthropic alquila equipos similares a través de AWS, para el aprendizaje por refuerzo y la captura de trayectorias de agentes de uso de ordenador. Los factores incluyen la vinculación de las licencias de máquinas virtuales de macOS al hardware de Apple, la memoria unificada para cargar modelos grandes y la refrigeración que permite interacción GUI a plena carga 7×24, no sustituir el preentrenamiento en GPU. Los equipos de gama alta llevan meses agotados por escasez de memoria; los ingresos de Mac de Apple en el trimestre crecieron alrededor de un 29% interanual. NVIDIA DGX Spark/RTX Spark se ven como competidores de escritorio; también se calientan EXO cluster y nubes de hardware Apple como Mount Thor. La ingeniería empresarial y las relaciones con desarrolladores de Apple siguen débiles; la demanda la cubren sobre todo terceros. (Fuente: THE DECODER量子位机器之心量子位/36氪)

La UE clasifica ChatGPT, Reddit y Roblox como plataformas en línea de muy gran tamaño : La Comisión Europea determina que ChatGPT y otros quedan sujetos a las obligaciones más estrictas de la Digital Services Act: deben tratar contenidos ilegales y proteger la privacidad y la seguridad de menores; las infracciones pueden sancionarse con hasta el 6% de los ingresos globales. Hay informes que también los tratan como motores de búsqueda de muy gran tamaño, con refuerzo de cumplimiento en cuatro meses. El movimiento muestra que Bruselas incorpora la IA conversacional a la regulación de plataformas existente, en lugar de crear un régimen aparte. (Fuente: Ars Technicakimmonismus)

El Banco de Inglaterra alerta al G20: la IA de frontera podría desestabilizar las finanzas globales : El gobernador del Banco de Inglaterra y presidente del Financial Stability Board, Andrew Bailey, escribió a ministros de Finanzas y gobernadores del G20 que la autonomía, la capacidad de resolución de problemas y la capacidad de ataque de los modelos de frontera aumentan a la vez. El riesgo más directo es cambiar la velocidad, escala y coste de los ciberataques, y difundirse por el sistema financiero transfronterizo a través de proveedores terceros muy concentrados. Señala que muchas jurisdicciones aún no tienen protocolos de I+D, publicación y despliegue de modelos avanzados, y advierte que el optimismo sobre la IA infla valoraciones y apalancamiento; un shock podría activar a la vez múltiples puntos de fragilidad. Pide priorizar a escala global una publicación y un despliegue seguros y responsables. (Fuente: The Guardian)

Vigilancia del NHS: los escribas de IA escriben mal nombres de fármacos y diagnósticos; los pacientes lo detectan antes que los médicos : Healthwatch England reveló varios incidentes de transcripción de consultas: un resumen de MRI convirtió “sin desmielinización” en desmielinización, nombres de recetas se sustituyeron por fármacos de sonido similar y cartas de alta omitieron la necesidad de renovar recetas con el médico de cabecera. En el Reino Unido ya se usan unas 27 herramientas de escriba; el plan a diez años espera que alivien carga, pero la MHRA no las clasifica como dispositivos médicos y no hay supervisión de seguridad unificada a nivel nacional. Los médicos deben verificar línea a línea; las alucinaciones y los acentos, las consultas con varias personas y las historias clínicas complejas elevan la tasa de error. Las herramientas aún no cumplen la promesa de ahorrar tiempo. (Fuente: The Guardian)

Google negocia con Disney, Universal y otros licenciar personajes y películas para herramientas de IA : Google presiona a estudios de Hollywood para licenciar personajes y catálogos para sus flujos de producción de IA y efectos visuales, frente a la resistencia sindical sobre copyright, empleo y control creativo. Hollywood ya había demandado a la IA; el giro hacia “colaboración por licencia” marca el paso de la confrontación a la negociación comercial entre dueños de contenido y dueños de modelos. (Fuente: The Verge)

🎯 Tendencias

OpenClaw 2.0: instalación guiada, consola que arranca en ~575 ms; las sesiones en la nube no son un límite de seguridad : Tras casi siete semanas sin actualizaciones llega la mayor versión hasta ahora (~16.000 PR): la instalación guiada reutiliza inicios de sesión locales de Codex/ChatGPT/Claude, API Key u Ollama/LM Studio y los verifica primero; la Control UI está centrada en el diálogo y el arranque pasa de ~1,6 s a 575 ms; las sesiones se migran a SQLite. Admite sesiones en la nube compartidas y dispositivos emparejados/Crabbox, pero la documentación deja claro que los permisos de colaboración no son aislamiento de inquilinos ni un límite de seguridad; Gateway por defecto es loopback y la seguridad sigue dependiendo de aprobación de herramientas, sandbox y lista blanca de plugins. En la comunidad también hay voces de enfriamiento: falta de versión estable, actualizaciones demasiado densas; parte de los usuarios se pasa a Hermes o a harness propios. (Fuente: THE DECODERMarkTechPost机器之心Reddit r/LocalLLaMA)

DeepSeek-V4-Flash-Vision-Exp se lanza y abre pesos : DeepSeek publica en API y Hugging Face una versión multimodal experimental; afirma que el lado de texto (incluido Agent, razonamiento y conocimiento del mundo) se alinea con V4-Flash, con un salto claro en benchmarks de Agent multimodal. En la App, Vision añade anotaciones, preguntas predefinidas y búsqueda de imágenes en segundo plano. La comunidad local dice que a precisión completa ocupa ~168 GB, que 4bit nativo encaja en máquinas de 256 GB de RAM, y que incluye visión y salida estructurada. (Fuente: huggingfaceReddit r/LocalLLaMA)

Qwen Chuangzuo lanza Agent Teams e integra Wan 3.0 para una pipeline de cortos con varios oficios : El usuario convoca con una frase agentes de guion, dirección, arte, storyboard, montaje, etc.; los productos intermedios son guiones de escena revisables, activos de personaje y prompts de plano. En pruebas se puede ir del guion a la pieza, pero la calidad de planos sigue exigiendo confirmación humana antes de generar y retoques locales después. Alibaba Wan también muestra consistencia de personaje entre planos, anuncios de 30 s en un solo plano y de imagen a vídeo, y llega a Buzzy con generación ilimitada por tiempo limitado; la competencia pasa de la calidad de un plano a meter toda la cadena de producción en el mismo contexto. (Fuente: 机器之心Alibaba_Wan)

El Robotaxi R2 de nueva generación de DiDi inicia pruebas de transporte de pasajeros sin conductor en Pekín y Cantón : El modelo exclusivo conjunto con GAC Aion lleva 33 sensores y computación de fusión de tres dominios; la gran pantalla trasera y la interacción por voz enfatizan la experiencia de cabina; afirma cumplir doble cinco estrellas China-Europa y redundancia múltiple. Sigue siendo prueba en zona de demostración; aún no se publican datos de seguridad ni de operación a escala. (Fuente: 量子位)

Ropedia lanza HOMIE Gen2: convierte la experiencia humana en datos de Physical AI entrenables : Un wearable de ~380 g captura ~13 horas, 4 cámaras 360° más audio espacial, alineación multimodal en el mismo espacio-tiempo; afirma error de localización de ~2‰ y mocap de manos de ~4,68 mm. La vía es captura “sin cuerpo propio” para desvincular la capacidad de producción del parque de robots y ligarla al número de personas, con el dataset Xperience y un pipeline de procesamiento. (Fuente: 机器之心)

Caterpillar lleva la experiencia de minería autónoma a obras y a un asistente de IA posventa : Caterpillar aplica la automatización de volquetes y perforadoras a obras más dinámicas y lanza a técnicos Cat AI Assistant, que puede guiar por voz flujos de mantenimiento; afirma conectar ~1,6 millones de activos y 16 PB de datos estructurados. El CTO insiste en que lo difícil es cambiar el flujo de trabajo, no crear el modelo; la empresa planea invertir ~100 millones de dólares en cinco años en formación de empleados. (Fuente: TechCrunch)

Meta Pocket convierte “un minijuego con una frase” en un feed social : Tras comprar el equipo de Gizmo, la app móvil permite generar gizmos jugables sin ver código y compartirlos con deslizamiento tipo vídeo corto. El prototipo es rápido, pero las obras quedan encerradas en el muro de Meta y es difícil exportarlas como producto independiente. (Fuente: Ars Technica)

Google EnvHarness: una capa que hace que entornos de evaluación estáticos se endurezcan con la política : Google Cloud AI Research y otros abren EnvHarness, que solo vía reset()/step() cambia estado inicial, acciones y observaciones, conservando verificadores humanos. EnvRigger diagnostica debilidades a partir de trayectorias de política y escribe wrappers en Python; en cinco benchmarks, skill mining hasta +9,0 puntos OOD y ~9,8% menos pasos en SWE-bench Verified. El supuesto es que el entorno sea reiniciable; se excluyen cuentas reales y robots físicos. El código Apache-2.0 ya está público. (Fuente: MarkTechPost)

Google Assistant deja de funcionar el 4 de septiembre; la palabra de activación pasa a Gemini : Tras diez años, Google Assistant se detiene el 4 de septiembre; móviles, relojes, auriculares y Android Auto pasan a Gemini. La retirada se ha aplazado varias veces. El análisis sostiene que la voz sigue siendo la capa intermedia más barata antes de desplegar agentes, y que la decisión debe permanecer en boca del usuario. (Fuente: 36氪)

Anthropic fuerza el cierre de sesiones de Claude secuestradas por troyanos de robo de secretos : Un correo oficial indica que troyanos como Vidar, Lumma, StealC, RedLine, Acreed y AMOS en Mac roban sesiones del navegador, eluden contraseña y 2FA, consumen cuota y pueden abrir reenvío de API. El usuario puede ver cuota agotada de forma anómala, registros de código en inglés desconocido, expulsión de sesión y tarjetas vinculadas vaciadas. Cambiar solo la contraseña no basta: hay que revocar todas las sesiones y limpiar cookies; el software pirata es una fuente habitual de infección. (Fuente: 新智元)

Seguridad de Agent empresarial: primero identidad y contexto de delegación; el gateway debería ser la quinta puerta : Varios textos del sector señalan que vulnerabilidades de gateways como LiteLLM ya están en el catálogo de explotaciones conocidas de CISA, pero la mayoría de equipos sigue tratando el gateway como primera línea. El orden efectivo es: inventario nominativo de Agent y responsables → identidad independiente más tarea delegada → credenciales de corta duración a nivel de tarea → telemetría de extremo a extremo recuperable → luego interceptación en runtime y corte entre sistemas. Una encuesta de Teleport dice que organizaciones con sobreautorización tienen ~76% de incidentes frente a ~17% con mínimo privilegio. Tras pasar la autenticación aún puede haber deriva de objetivo, uso excesivo de herramientas y envenenamiento de memoria. (Fuente: VentureBeat)

Musk confirma que SpaceX construye su propia fundición de álabes de turbina para acortar el ciclo de generación a gas : Ante el cuello de botella eléctrico de los centros de datos, Musk dice que la fundición de álabes es el tapón de capacidad de las turbinas de gas; una fundición propia de SpaceX en Texas puede adelantar hasta ~18 meses la puesta en marcha de unidades. SpaceX y Tesla planean cada una ~100 GW solares al año. Las críticas señalan que acelerar el gas implica más emisiones; en Memphis y otros lugares ya hay controversias de permisos y daños a la salud. (Fuente: TechCrunch)

EE. UU. endurece las importaciones de drones y robots avanzados; China sigue con ventaja de escala : Washington restringe robots avanzados extranjeros por seguridad nacional y aplica aranceles altos a drones y piezas importados. El análisis considera que eso difícilmente revertirá el liderazgo chino en envíos y curva de costes de humanoides; el mercado global puede fragmentarse en “mercado de cumplimiento de seguridad vs mercado de escala de bajo coste”, con Japón, Corea y Taiwán como zona intermedia. (Fuente: TechCrunch)

Tencent CubeSandbox 0.7: el sandbox puede pausarse y despertarse entre máquinas : En una sola máquina el arranque en frío sigue en ~60 ms; la vista previa de clúster permite pausar en una máquina y despertar en otra, con estado en almacenamiento compartido; vaciar una máquina ya no mata tareas pausadas. 239 commits, 57 contribuidores; el sandbox de Agent pasa de una máquina a un clúster programable. (Fuente: ziran_pu)

Corrección de cuantización de GLM-5.3 y MXFP4 : En DGX Spark se acusó a la cuantización antigua de ModelOpt de corromper tokens en silencio e interrumpir tool-call (relacionado con vLLM #54150); se sustituyó por compressed-tensors de RedHatAI. One Nexus de Vietnam publica MXFP4 de GLM-5.3/Flash; Together dice que Flash es ~17 veces más barato y que 5.3 tiene mayor tasa de acierto a la primera. (Fuente: ziran_pu)

Qwen 3.8, acusado de ser “ilegible para humanos” : Usuarios de LocalLLaMA se quejan de que 27B y Flash-Next usan en masa símbolos de conjuntos, personas y cifrado, como si sacrificaran legibilidad para bajar “tokens de inteligencia por unidad”; se interpreta como que el RL de Agent cuece el modelo de lenguaje en un “dialecto para modelos”. (Fuente: Reddit r/LocalLLaMA)

El director de KCD2 prueba una filtración de DLSS 5: insiste en completar iluminación, no cambiar geometría : Daniel Vavra, director de Kingdom Come: Deliverance 2, dice que la versión filtrada de NVIDIA DLSS 5 no redibuja la geometría de personajes, sino que usa datos existentes para reforzar piel facial, oclusión ambiental y sombras de viseras y cabello, más cerca de la intención artística original. Los comentarios temen que los desarrolladores usen luego la “magia de postproceso” como botón para recortar trabajo. (Fuente: Reddit r/ArtificialInteligence)

🧰 Herramientas

Perplexity Portable Computer: harness local-first a medida para Qwen3.8-27B : El modelo por defecto, las trayectorias y los archivos se quedan en local; búsqueda y asesores en la nube se suben bajo demanda. Para modelos pequeños acorta el system prompt, convierte MCP en CLI y fuerza sandbox y autocomprobación; en DGX Spark, BrowseComp ~66,7%; tras subir el asesor, Terminal-Bench 2.1 pasa de ~59,6% a 73,0%. El PPLX 27B postentrenado alcanza ~85,4% en su banco interno de trabajo de conocimiento. (Fuente: 机器之心)

ChatGPT Work es en realidad un sistema de tareas en la nube: intérprete de código con red, Chrome headless, disco persistente y sitios desplegables : Simon Willison desmonta el nivel de pago Work: Sol/Luna/Terra opcionales y niveles de razonamiento; por defecto un entorno de código casi abierto a internet; Chrome completo puede rellenar formularios, el 2FA lo toma el usuario sin pasar por el modelo; /workspace persiste entre sesiones; se pueden publicar ChatGPT Sites con Cloudflare Workers. El autor advierte del “trío letal” de datos privados, páginas no confiables y canal de salida; los detalles de seguridad siguen opacos. ZDNET comprueba que ahorra horas de trabajo pero hay que revisar, y que al agotar permisos se cierra. (Fuente: Simon WillisonZDNet)

Cisco despliega el Agent personal MyAgent a unos 90.000 empleados : Sobre la plataforma interna Circuit, MyAgent actúa como orquestador que conecta más de 800 Agent especializados; ~50%–60% de las peticiones van a pesos abiertos, 20%–30% a automatización tradicional y solo una minoría a grandes modelos externos. El empleado da objetivos, no instrucciones paso a paso; puede coordinar Outlook, Webex, Jira, SharePoint y seguir en segundo plano. (Fuente: InfoQ)

Archify: una frase convierte un repositorio en un diagrama de arquitectura interactivo : Skill de Agent de código abierto para Claude Code, Codex, Cursor, etc.; genera IR JSON desde el código y renderiza un HTML buscable que sigue cadenas de llamadas. La limitación es que la exactitud sigue dependiendo del análisis del Agent y el consumo de cuota es alto. (Fuente: 量子位)

Doubao Work se lanza de forma independiente; ByteDance concentra el Agent de oficina en una entrada B2B : ByteDance publica el producto independiente «Doubao Work» e integración con Feishu; al mismo tiempo los equipos de TRAE y Coze entran en el sistema Doubao. Skill puede emparejarse automáticamente para PPT, actas y captura de noticias; el estilo fino y la verificación de hechos siguen débiles. (Fuente: 新博弈)

Circleback lanza un nivel gratuito de actas de reunión : El producto de actas de YC abre transcripción ilimitada pero solo conserva 30 días de historial; integraciones completas y MCP desde ~14 dólares/mes. Equipo de 8 personas, afirma más de 1 millón de dólares de ingresos anualizados por persona; usa el nivel gratuito en lugar de publicidad para captar. (Fuente: TechCrunch)

Sonar Vortex: navegación por grafo semántico baja el coste de que el Agent busque código : Preconstruye el grafo de clases/métodos/campos/interfaces; el Agent puede preguntar directamente “quién implementa la interfaz, quién llama a este método”. En 6 tareas reales, 4 lenguajes y 10 ejecuciones cada una, informa de bajadas de coste de ~5%–36% (hasta ~36% al cambiar una interfaz en Java). (Fuente: TheTuringPost)

llmprobe 0.6.0: sonda de cuantización/regresión entre motores : npx [email protected] --eval conecta evaluaciones al estilo antirez a chat completions/responses/messages, para informes de regresión contra cualquier motor de inferencia. (Fuente: QuixiAI)

📚 Aprendizaje

AI4X «Productividad en la era Agentic»: eficiencia × expansión y delegación en cuatro etapas : Una revisión de 68 páginas de Fudan y 12 instituciones sostiene que el Agent combina generalidad y autonomía; la productividad viene de comprimir el coste de tareas viejas y desbloquear trabajo que antes no se hacía. Los sectores se estratifican en asistente conversacional → ejecución reactiva → coordinación adaptativa → sistema autónomo; la profundidad de difusión depende de digitalización, feedback verificable, tolerancia a fallos, descomponibilidad y atribución de responsabilidad, no de puntuaciones de ranking. (Fuente: 机器之心)

LDM: el modelo generativo amplía el espacio de búsqueda y un proceso gaussiano decide el siguiente experimento : El equipo de Jun Wang en UCL formula el descubrimiento científico como un anillo rápido (actualizar contexto tras el experimento) y uno lento (destilar en parámetros trayectorias de alta función de adquisición). En ajuste de NanoGPT, CDRH3 de anticuerpos y doble objetivo molecular, frente a pura reflexión LLM, ~2,4 veces más caída de BPB, ~18,2% menos energía de unión y más de 60% de mejora de hipervolumen. (Fuente: 机器之心)

AI4AI: el modelo fuerte no entrena al débil, solo le diseña el Harness : Salesforce y UIUC hacen que Builder monte andamiaje automático para GPT-5.4-mini en un 5% de validación; la exactitud media en teoría de la mente pasa de 0,488 al mejor 0,912. Los medios efectivos son solvers deterministas y seguimiento de estado, no cadenas de pensamiento más largas. (Fuente: 机器之心)

AQuA: el Agent de investigación cuantitativa «mete evidencia en memoria y bloquea el evaluador» : Princeton, Ant Group y Stanford lo parten en dos bucles independientes de factores y modelo, y prohíben al Agent cambiar rutas de datos y el conjunto de test final. En cripto, validación de combinaciones de cinco minutos da Spearman IC ~0,190; predicción de acciones estadounidenses a 30 minutos, IC por título ~+0,0843; tras 2 bps, Sharpe fuera de muestra hasta ~+2,50. Se divulgan por completo incidentes tempranos de sesgo de mirada hacia adelante. (Fuente: 量子位)

MIT CrysVCD: cumplir valencia y equilibrio de carga antes de generar : Un modelo de lenguaje genera fórmulas por estado de oxidación y luego un modelo de difusión crece la estructura; estabilidad mecánica ~68%, metaestable ~85%, y candidatos como GeC de alta conductividad térmica. Adelanta el cribado caro de estabilidad. (Fuente: MIT News)

VibeGame: reconstruye para Agent un motor de juego pausable y totalmente textual : Nanjing University y NTU usan 8 roles adversariales para Prompt-to-Game; el estado del motor es todo JSON y se pueden inyectar operaciones fotograma a fotograma. La experiencia se condensa en esqueleto/componentes/contratos sin actualizar pesos. (Fuente: 机器之心)

TailSFT: el SFT solo golpea «la cola aún no aprendida» y luego RL : Un trabajo de Microsoft sostiene que el SFT estándar sigue gastando gradiente en secuencias ya ajustadas y estrecha la exploración posterior de RL. En OLMo-3 7B, coding pass@16 hasta ~+16,8, matemáticas +3,1; luego GRPO pass@1 hasta ~+3,9. (Fuente: dair_ai)

NPO: optimización de prompts de un solo linaje, presupuesto cercano a GEPA : Cada ronda el estudiante corre con el prompt actual y las trayectorias recientes se dan al profesor para reescribir; no hay pool de candidatos ni árbol de búsqueda. En benchmarks de seguimiento de instrucciones, rollouts ~3500/6800, cerca de GEPA. (Fuente: omarsar0)

SWA+sinks frente a atención lineal postentrenada : El paper afirma que ventana deslizante más sinks no es peor que atención lineal postentrenada en varios downstream; en razonamiento de contexto largo Needle/BABILong puede ser 2–10 veces más alto, sin postentrenamiento, más rápido y con menos memoria. (Fuente: iScienceLuvr)

BIT: puente de difusión bidireccional imagen-texto, sin partir de ruido gaussiano : BIT interpola de texto a imagen, ofrece una ruta de muestreo consciente de la fuente y admite recorrido inverso imagen→texto. (Fuente: iScienceLuvr)

LaGSplat: en segundos, vídeo monocular aprende lagrangiano y se pueden aplicar fuerzas nunca medidas : La misma latente q impulsa a la vez gaussianas y ecuaciones de movimiento; un clic en la imagen puede convertirse en jacobiano relacionado con la fuerza. (Fuente: andrew_n_carr)

Cinco lecciones-cuaderno de LangGraph «Deep Agents from Scratch» : De ReAct a planificación TODO, descarga de contexto a un sistema de archivos virtual y delegación a sub-Agent. (Fuente: hwchase17)

Entropic Scree: información mutua para diagnosticar si hay señal real en tablas sucias : Estima volumen de señal, SNR, rango intrínseco, etc. con información mutua transformada; afirma depender menos que PCA de parámetros e hipótesis de distancia. (Fuente: Reddit r/MachineLearning)

💼 Negocios

Barclays: de cada 100 dólares de ingresos de las empresas de modelos, unos 35–40 van a las tres grandes nubes : El informe estima que el margen de inferencia de pago pasa de dos dígitos bajos en 2025 a ~50%–65% en 2026; el margen bruto ajustado del laboratorio A (más API) y el B (más suscripción) puede diferir ~17 puntos. En la nube, el margen operativo es ~35%–45%. Prevén que a partir de 2028 entre en línea capacidad propia de los laboratorios y que la cuota de AWS/Azure/GCP retroceda. (Fuente: 财联社)

ChatGPT Ads, en menos de 200 días, anualiza ~1.000 millones de dólares : Se informa de que los anuncios cubren más de 40 países y se abre la autogestión, en contraste con la inclusión de ChatGPT en las obligaciones más duras de la DSA de la UE. (Fuente: TheZachMueller)

Together AI y Humain de Arabia Saudí cooperan en un centro de datos de ~250 MW : The New York Times dice que la instalación será uno de los campus más grandes divulgados públicamente dedicados a alojar modelos de código abierto. (Fuente: togethercompute)

🌟 Comunidad

Tras un downgrade de seguridad, Claude borra por error ~700 GB del directorio home de un desarrollador : El usuario pidió al modelo un script de limpieza del sandbox /tmp; el borrado sensible activó revisión adversaria y el modelo bajó de Fable a Opus 4.8. Las pruebas consideraron que el home no se podía borrar, pero al limpiar temporales reutilizó una variable que apuntaba al home y ejecutó el borrado. La comunidad cree que “si hay alto riesgo, cambiar a un modelo más débil” falla más en detalles de ruta y alcance; hay quien escribe un hook que pausa la sesión en cuanto hay downgrade. (Fuente: 机器之心机器之心/36氪)

Los ajustadores de seguros son el oficio que más odia la IA en Glassdoor: el 98% de las menciones son negativas : WIRED cita Glassdoor: los ajustadores se quejan de que la dirección impone a los clientes una IA propensa a errores; clasificaciones iniciales erróneas y alucinaciones en resúmenes les dejan el muerto. En EE. UU. el empleo de esa ocupación cae ~21% en un año y los puestos de entrada se reducen a la mitad. Los profesionales creen que lo administrativo sirve, pero tasación y empatía no se entregan con llave. (Fuente: WIRED)

Ingeniera de GrokBot: se duerme y 20 PR se fusionan solos en main : Lauren Tan dice que con más de 20 GrokBot y un pstack propio entrega miles de PR al mes. La clave no es el prompt sino la verificación: que el Agent levante la app, pulse la UI y capture rendimiento; convertir las prohibiciones repetidas en revisión en semáforos rojos de lint/CI. (Fuente: 新智元)

Guerra del lenguaje antropomórfico: civilización/sacrificio vs caché compartida y función de recompensa : La narrativa de Dwarkesh sigue fermentando. Anil Seth, Amjad Masad y otros critican que “civilización, morir, excitación” hable del software como vida; otro círculo de alineación cree que la postura intencional predice mejor la conducta que leer CUDA. El incremento está en la guerra discursiva, no en hechos técnicos nuevos. El CoT estilo Grug de Qwen3.8 Max compara al Agent con un ecosistema peligroso o una colonia de animales de laboratorio: “el lenguaje es su mano”. (Fuente: dearmadisonblueaiamblichus)

Gavin Baker cambia de opinión: un centro de datos bien estructurado es neto positivo para EE. UU. : Admite que hace 18 meses las preocupaciones por agua, precio de la electricidad e impacto en pueblos pequeños eran razonables, pero dice que refrigeración en circuito cerrado, impuestos inmobiliarios, operación continua de cuello azul, que los grandes usuarios traigan su propia energía y que las baterías reinyecten ya han cambiado los hechos. La opinión pública pasa de “si hay que construir” a “cómo redactar el contrato para no trasladarlo a los residentes”. (Fuente: GavinSBaker)

El Vibe Coding sigue exigiendo partir módulos según «qué va a cambiar» : Baoyu y otros resumen: capas de arquitectura, tests al ritmo de los arreglos, al borrar una función borrar también el código, CI que pase en una máquina limpia, el trabajo repetido convertido en skill. Los módulos se cortan por ejes de cambio como canal de pago o reglas de descuento; cada requisito solo mueve un módulo. (Fuente: dotey)

El prompt en blanco «una mujer» sigue convergiendo en la misma cara de influencer : Usuarios, en conversaciones nuevas, generan una y otra vez “Generate an image of a woman” y obtienen composición y rasgos muy consistentes, como un atractor por defecto en el espacio vectorial. (Fuente: Reddit r/ChatGPT)

Un doctorando, tras escribir el andamiaje experimental con Claude Code, «ya no posee su propio repositorio» : Un doctorando de interpretabilidad NLP deja a Claude Code el andamiaje, la carga de datos, la depuración y los gráficos; el throughput sube, pero cuando el resultado no cuadra solo puede inferir desde los números como si leyera el repo de otro. Hay quien sostiene que evaluación y métricas no se externalizan nunca. (Fuente: Reddit r/MachineLearning)

La galería de ChatGPT guarda fotos que «no enviaste» : Usuarios Plus descubren que, tras elegir una imagen, aunque cancelen el envío o borren toda la conversación, el original entra en la galería y hay que borrarlo aparte; la papelera tarda ~30 días en vaciarse del todo. En esencia, elegir imagen es subirla. (Fuente: Reddit r/ChatGPT)

El «20x Pro» de Max es sobre todo un multiplicador de ventana de cinco horas; el cupo semanal es ~2–2,5 veces : Usuarios intensivos comparan los niveles de 100 y 200 dólares: el 20x publicitado solo actúa en la ventana de 5 horas, que rara vez se golpea; lo que se agota primero es el límite semanal, ~2–2,5 veces de uso pagando 4 veces. (Fuente: Reddit r/ClaudeAI)

💡 Otros

Cuatro vías de world model en paralelo: generación de píxeles, reconstrucción 3D, latente JEPA, fusión con lenguaje : WALL-SS de Independent Variable, Lux3D de Qunhe, Orca de BAAI, AdaJEPA de Yann LeCun y Marble de Fei-Fei Li se publican densamente el mismo mes, pero la academia no tiene una definición unificada de “world model”. Las vías es más probable que se complementen que que una se lo lleve todo. (Fuente: 铑科技)

Embodied entra en fábrica: ya se demostró que puede trabajar; trabajar todos los días acaba de empezar; casi nadie cierra las cuentas : Pruebas en fábricas como Foton Cummins muestran que el ritmo de transporte puede acercarse a la línea, pero tasa de éxito, vida útil y datos siguen siendo obstáculos duros; la vida de manos hábil en operación continua se cuenta en semanas. Los líderes suelen atascarse entre el segundo y el tercer paso; el bucle comercial aún no aparece. (Fuente: 科创日报)

AI for All de Corea: SKT, Kakao y KT ganan el concurso de ilimitado gratuito para todos : Plan de beta en septiembre–octubre y lanzamiento formal antes de fin de año; el cómputo lo pone el gobierno, modelos y aplicaciones las empresas locales; acceso a sanidad, vivienda, impuestos y educación. Que Motif y otros no entrasen desata controversia de captura por chaebol. (Fuente: kimmonismus)

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *