Diario de IA – 2025-06-01(Edición matutina)
Universidad de Stanford descubre accidentalmente que la IA puede generar kernels CUDA que superan a los expertos humanos: Un equipo de investigación de la Universidad de Stanford, mientras intentaba c
Diario de IA – 2025-05-31(Edición vespertina)
El dilema y la estrategia de NVIDIA al “caminar sobre la cuerda floja” entre los mercados de China y EE. UU.: Un informe en profundidad de The Information revela la difícil situación de NVIDIA entre l
Diario de IA – 2025-05-31(Edición matutina)
DeepSeek lanza el nuevo modelo R1-0528: una mejora significativa de rendimiento atrae la atención: DeepSeek ha lanzado una nueva versión de su gran modelo de lenguaje, R1-0528, que ha mostrado un rend
Diario de IA – 2025-05-30(Edición vespertina)
DeepSeek lanza el modelo R1-0528, con un rendimiento cercano a GPT-4o y Gemini 2.5 Pro, y se sitúa a la cabeza de las clasificaciones de código abierto: DeepSeek-R1-0528 destaca en múltiples benchmark
Diario de IA – 2025-05-29(Edición vespertina)
DeepSeek R1 recibe una “pequeña actualización” que en realidad es un gran salto, con una mejora significativa en la capacidad de programación y razonamiento: DeepSeek lanzó una nueva versión (0528) de
Diario de IA – 2025-05-29(Edición matutina)
Cuestionan la efectividad del entrenamiento LLM+RL: Recompensas falsas también podrían mejorar la capacidad de razonamiento del modelo: Recientemente, investigadores de la Universidad de Washington, e
Diario de IA – 2025-05-28(Edición vespertina)
El futuro de RLHF/RLAIF: ¿Pueden las recompensas aleatorias/incorrectas también mejorar el rendimiento del modelo? : Experimentos de Stella Li demuestran que entrenar el modelo Qwen2.5-Math-7B usando
Diario de IA – 2025-05-28(Edición matutina)
Omni-R1: Novedoso marco de aprendizaje por refuerzo de sistema dual mejora la capacidad de razonamiento omnimodal : Omni-R1 propone una innovadora arquitectura de sistema dual (sistema de razonamiento
Diario de IA – 2025-05-27(Edición vespertina)
La disputa de rendimiento entre AMD y NVIDIA en el campo de la inferencia de IA genera un acalorado debate: SemiAnalysis señala que SGLang presenta problemas en las pruebas en la plataforma ROCm de AM