Generar código con modelos de lenguaje puede ser costoso si no optimizas los prompts.

El truco

Prompt malo:

{
  "prompt": "Escribe un código para una función que calcule el factorial de un número en Python."
}

Prompt bueno:

{
  "prompt": "Python. Calcula factorial. Usa recursión."
}

Al simplificar tu prompt, reduces el número de tokens y ayudas al modelo a centrarse en lo esencial. El uso de palabras clave específicas como “Python”, “factorial” y “recursión” es más eficiente que frases completas. Esto no solo ahorra tokens, sino que también mejora la precisión de las respuestas generadas.

El ahorro de tokens es clave para mantener los costes bajos y la eficiencia alta: menos palabras, más resultados.