¿Qué es un token de parada (stop token)?
Cuando un modelo grande escribe, suelta un token tras otro. Necesita saber cuándo parar; si no, seguiría como un grifo abierto. El token de parada es el marcador especial que le dice al modelo «hasta aquí». En cuanto el modelo genera uno, se detiene.¿Qué aspecto tiene?
Es una señal, no una palabraSuelen ser cadenas de símbolos especiales como <|endoftext|> o <eos>. Los usuarios nunca las ven, pero para el modelo significan mucho.
Puede haber varios
Algunos modelos definen varias condiciones de parada —fin de frase, salto de línea, un formato concreto— para controlar la forma de la salida.
¿Por qué importa?
Nada de enrollarse ni desperdiciarSin token de parada, el modelo podría escribir sin fin, quemando tokens y tiempo.
Fija el límite de la salida
Muchas tareas necesitan controlar con precisión dónde acaba la respuesta —completado de código, generación de JSON, chat de varios turnos—. El token de parada es la línea de meta invisible.
Afecta a tu factura de la API
Parar pronto y con precisión ahorra un buen pellizco de coste de inferencia y hace las respuestas más ágiles.
¿Cómo se usa?
Al llamar a una API puedes fijar un parámetro stop con las cadenas que deben acabar la generación. También puedes definir secuencias de parada propias para que el modelo cierre justo cuando «termina». Ajustar los tokens de parada es una palanca básica pero real sobre calidad y coste.En resumen: el token de parada es el freno del modelo — le dice exactamente dónde dejar de hablar.
Comentarios