Razonamiento
aguila y apu razonan antes de responder: piensan el problema y después escriben la respuesta. Eso mejora las tareas difíciles, pero tiene dos efectos que conviene conocer.
El razonamiento se cobra como salida
Sección titulada «El razonamiento se cobra como salida»Los tokens que el modelo usa para pensar se cobran como tokens de salida, aunque no los veas en la respuesta. Por eso completion_tokens en usage puede ser mayor que el texto que recibiste.
No pongas un max_tokens muy bajo
Sección titulada «No pongas un max_tokens muy bajo»El razonamiento sale del mismo presupuesto que max_tokens. Con un tope muy bajo, el modelo puede gastarlo entero pensando y devolverte una respuesta vacía con finish_reason: "length".
Controlar cuánto piensa
Sección titulada «Controlar cuánto piensa»Con reasoning.effort eliges cuánto razona: "low", "medium" o "high".
{ "model": "aguila", "messages": [{"role": "user", "content": "Planifica la migración de mi base de datos"}], "reasoning": {"effort": "low"}}low: más rápido y más barato. Suficiente para preguntas directas.high: para problemas de varios pasos, código difícil o análisis largos.
Si no lo mandas, el modelo decide.
