Latest in AI

Aprender

Modelo de lenguaje grande

Explicación en lenguaje claro de Modelo de lenguaje grande, con páginas relacionadas del catálogo.

Definición

Un modelo de lenguaje grande (LLM) es una red neuronal entrenada para predecir el siguiente token en un texto a gran escala. La misma idea central impulsa ahora el chat, la programación, el resumen y muchos agentes.

Cómo funciona

El texto se divide en tokens. El modelo puntúa los posibles tokens siguientes y muestrea de esa distribución. Las capacidades proceden de los datos de preentrenamiento, del postentrenamiento (incluidos los métodos de preferencia) y de la interfaz que envuelve al modelo.