Explicador en lenguaje claro
El aprendizaje en contexto, explicado
¿Cómo puede un modelo aprender de ejemplos en el prompt sin reentrenarse?
Pon tres ejemplos de una tarea en tu prompt y el modelo hace la cuarta con el mismo patrón, sin cambiar un solo peso. Eso es el aprendizaje en contexto. Funciona porque el preentrenamiento premió sin descanso continuar patrones, así que seguir patrones se volvió uno de los reflejos más fuertes del modelo. El aprendizaje es real pero alquilado: existe solo dentro de la ventana de contexto actual, y desaparece en cuanto la conversación termina.
Revisado por última vez el
Leer es el camino lento. Empieza con una lección gratis que puedes operar ahora mismo.
Empieza gratis: Predice la siguiente palabra →Gratis, sin código, sin registro.
Y después ve más a fondo: Aprendizaje en contexto: enseñar sin entrenar Bloqueada
Lo que la gente entiende mal
- El modelo aprendió de mis ejemplos para siempre. En la próxima conversación ya no están. Solo el context los llevaba.
- El few-shot es una forma de entrenamiento. Sin gradiente, sin cambio de pesos. Es completar patrones en el momento de la inferencia.
- Más ejemplos siempre ayudan. Gastan tokens de context, y los ejemplos inconsistentes enseñan el patrón equivocado.
Dónde lo ves en productos reales
- Los prompts de sistema tipo 'aquí van tres ejemplos de nuestro tono' corren sobre esto.
- Las funciones de fórmula-por-ejemplo de las hojas de cálculo son el mismo reflejo.
- Pega una muestra de escritura y el modelo la imita: aprendizaje en contexto, en vivo.
Preguntas frecuentes
- ¿El modelo aprende de mis ejemplos de forma permanente?
- No. No se escribe nada de vuelta en los pesos. Los ejemplos moldean la respuesta solo mientras están en la ventana de contexto. Abres una conversación nueva y el modelo está exactamente como antes.
- ¿Cuántos ejemplos conviene dar?
- Normalmente unos pocos. El primero o los dos primeros hacen casi todo el trabajo al fijar el formato, y a partir de ahí el beneficio cae rápido mientras el costo sigue subiendo. Que tus ejemplos sean consistentes entre sí importa más que cuántos sean.
- ¿Por qué funcionan los ejemplos?
- El preentrenamiento está lleno de texto donde se establece un patrón y luego se continúa: listas, traducciones, páginas de preguntas y respuestas. Continuar un patrón ya establecido es justo lo que el modelo hace bien, así que unos pocos ejemplos son una manera de escribirle el comienzo de un patrón para que lo termine.
Explicadores relacionados
Más en Cómo se entrenan los modelos
Una idea a la vez, en tu correo
Lecciones y explicadores nuevos, escritos como están escritas estas páginas. De vez en cuando, no a diario, y nunca una secuencia de venta.
Primero te enviamos un enlace de confirmación. Puedes darte de baja con un clic, cuando quieras. Privacidad.
Parte de See How AI Works, un curso interactivo gratuito, donde aprendes cómo funciona la IA moderna operándola, no viendo videos.