Diario de IA – 2025-05-30(Edición vespertina)
DeepSeek lanza el modelo R1-0528, con un rendimiento cercano a GPT-4o y Gemini 2.5 Pro, y se sitúa a la cabeza de las clasificaciones de código abierto: DeepSeek-R1-0528 destaca en múltiples benchmark
Diario de IA – 2025-05-29(Edición vespertina)
DeepSeek R1 recibe una “pequeña actualización” que en realidad es un gran salto, con una mejora significativa en la capacidad de programación y razonamiento: DeepSeek lanzó una nueva versión (0528) de
Diario de IA – 2025-05-29(Edición matutina)
Cuestionan la efectividad del entrenamiento LLM+RL: Recompensas falsas también podrían mejorar la capacidad de razonamiento del modelo: Recientemente, investigadores de la Universidad de Washington, e
Diario de IA – 2025-05-28(Edición vespertina)
El futuro de RLHF/RLAIF: ¿Pueden las recompensas aleatorias/incorrectas también mejorar el rendimiento del modelo? : Experimentos de Stella Li demuestran que entrenar el modelo Qwen2.5-Math-7B usando
Diario de IA – 2025-05-28(Edición matutina)
Omni-R1: Novedoso marco de aprendizaje por refuerzo de sistema dual mejora la capacidad de razonamiento omnimodal : Omni-R1 propone una innovadora arquitectura de sistema dual (sistema de razonamiento
Diario de IA – 2025-05-27(Edición vespertina)
La disputa de rendimiento entre AMD y NVIDIA en el campo de la inferencia de IA genera un acalorado debate: SemiAnalysis señala que SGLang presenta problemas en las pruebas en la plataforma ROCm de AM
Diario de IA – 2025-05-27(Edición matutina)
El modelo DeepSeek-V3-0526 podría ser lanzado, comparable a GPT-4.5 y Claude 4 Opus: Informes de la comunidad indican que DeepSeek podría estar a punto de lanzar la última versión actualizada de su mo
Diario de IA – 2025-05-26(Edición vespertina)
Sergey Brin, fundador de Google, descifra el enigma de la potencia de Gemini y el futuro de la IA: Sergey Brin, fundador de Google, profundizó en una entrevista sobre el rápido ascenso del modelo Gemi
Diario de IA – 2025-05-26(Edición matutina)
ByteDance lanza BAGEL, modelo de generación de imágenes de nivel GPT-4o, de código abierto: ByteDance ha lanzado el modelo de IA multimodal de código abierto BAGEL-7B-MoT, que demuestra capacidades co