PAPER · IA · DeepMind
Entrenamiento de modelos de lenguaje grandes optimizados para cómputo — Hoffmann et al. (2022)
Traducción al español del paper Chinchilla (Hoffmann et al., 2022). Demostró que la mayoría de los LLMs estaban sub-entrenados: no solo necesitás más parámetros, necesitás más datos. El paper que cambió cómo se entrenan los modelos de lenguaje.