Saltar al contenido principal
Zubnet AIAprenderWiki › Zero-shot / Few-shot
Usar AI

Zero-shot / Few-shot

También conocido como: Aprendizaje en contexto
Zero-shot significa pedirle a un modelo que realice una tarea sin ningún ejemplo — solo la instrucción. Few-shot significa proporcionar un puñado de ejemplos de entrada-salida en el prompt antes de la solicitud real. "Aquí hay 3 ejemplos de cómo formatear estos datos... ahora haz este." El modelo aprende el patrón solo del contexto, sin entrenamiento requerido.

Por qué importa

El few-shot prompting es la forma más rápida de enseñarle a un modelo un nuevo formato o comportamiento. Necesitas salida JSON consistente? Muéstrale tres ejemplos. Necesitas un estilo de escritura específico? Dale muestras. Es gratis, instantáneo y sorprendentemente poderoso.

En profundidad

Los términos "zero-shot" y "few-shot" provienen de la tradición de investigación en machine learning, donde "shot" se refiere a un ejemplo de entrenamiento. En ML clásico, necesitabas miles o millones de ejemplos etiquetados para enseñarle una nueva tarea a un modelo. La revelación con los modelos de lenguaje grandes fue que podían realizar tareas con cero ejemplos de entrenamiento (zero-shot) o solo un puñado de demostraciones en el prompt (few-shot). Esto se llama "aprendizaje en contexto" (in-context learning), y sigue siendo una de las capacidades más notables de los LLMs modernos — el modelo no está siendo re-entrenado ni afinado cuando le das ejemplos en el prompt. Está reconociendo patrones en su contexto y aplicandolos sobre la marcha.

Cuando funciona zero-shot

Zero-shot funciona mejor cuando la tarea se mapea limpiamente a algo que el modelo ha visto extensivamente en el entrenamiento. Análisis de sentimiento, traducción, resumen, clasificación simple — estas son tareas que el modelo ha encontrado en millones de variaciones durante el pre-entrenamiento, así que una instrucción clara es frecuentemente suficiente. "Clasifica esta reseña de cliente como positiva, negativa o neutral" funcionará zero-shot en cualquier modelo de frontera moderno porque el modelo entiende profundamente qué significan clasificación, sentimiento y esas etiquetas. Donde zero-shot falla es en tareas con formatos inusuales, convenciones específicas de dominio o requisitos ambiguos. Si necesitas que el modelo produzca datos en el esquema XML propietario de tu empresa, una instrucción sola no va a funcionar.

El few-shot prompting llena esa brecha. Al proporcionar 2–5 ejemplos de entrada-salida antes de la solicitud real, le muestras al modelo exactamente lo que esperas. El modelo capta el patrón — el formato, el nivel de detalle, el estilo, el manejo de casos extremos — y lo aplica a la nueva entrada. Esto es notablemente poderoso para tareas estructuradas. Necesitas extraer entidades de texto desordenado en un formato JSON específico? Muestra tres ejemplos de texto desordenado mapeado a JSON limpio, luego dale el texto nuevo. Necesitas convertir fechas en lenguaje natural ("el próximo martes", "la segunda semana de marzo") a ISO 8601? Tres ejemplos te llevan al 95% del camino. El modelo esencialmente está aprendiendo una función de tus ejemplos, y lo hace en tiempo de inferencia sin actualizaciones de gradiente.

Calidad sobre cantidad

La calidad de tus ejemplos de few-shot importa más que la cantidad. Tres ejemplos cuidadosamente elegidos que cubran diferentes casos extremos superarán a diez repetitivos. Si tu tarea involucra categorías, incluye al menos un ejemplo por categoría. Si hay casos límite complicados, incluye uno. Y el orden de los ejemplos puede importar — la investigación ha demostrado que los modelos pueden sesgarse hacia la etiqueta del último ejemplo que ven, así que mezclar o balancear tus ejemplos vale la pena. Un consejo práctico: incluye un ejemplo de lo que el modelo debería hacer cuando la entrada es ambigua o no encaja en ninguna categoría, porque ese caso extremo aparece constantemente en producción y un modelo sin guia simplemente adivinará.

La compensación de costo

Hay una compensación costo-calidad a considerar. Cada ejemplo de few-shot consume tokens de tu ventana de contexto y se suma a tus costos de API. Cinco ejemplos de 200 tokens cada uno son 1,000 tokens por solicitud, lo cual se acumula a escala. Algunos equipos comienzan con few-shot prompting durante el desarrollo, miden cuáles ejemplos realmente mejoran los resultados, y luego intentan destilar el patrón en una instrucción zero-shot más clara. Otros usan selección dinámica de few-shot — almacenando una biblioteca de ejemplos en una base de datos y recuperando los más relevantes para cada entrada específica, lo cual es esencialmente una forma ligera de RAG aplicada a la ingenieria de prompts. El punto óptimo depende de la complejidad de tu tarea, tu volumen, y si la consistencia o el costo importa más para tu caso de uso.

Conceptos relacionados

← Todos los términos
ESC