Gestión de tokens y costos en OpenClaw
¿Alguna vez has recibido una factura de API más alta de lo esperado sin entender exactamente qué consumió tantos tokens? Gestionar el context window puede ser frustrante cuando no tienes visibilidad sobre lo que se envía al modelo en cada interacción. OpenClaw te da el control total para que dejes de adivinar y empieces a optimizar.
Requisitos previos
Sección titulada «Requisitos previos»- Una instancia de OpenClaw activa.
- API key configurada (necesaria para ver estimaciones de costo en USD).
- Acceso al archivo de configuración del Gateway.
- Conocimiento de tus límites de quota del provider.
Inicio rápido
Sección titulada «Inicio rápido»Controla tu consumo en menos de 5 minutos con estos comandos directos en el chat:
- Revisa el estado actual: Escribe
/statuspara ver una tarjeta con el modelo de la sesión, el uso del context window y el costo estimado del último mensaje. - Activa el contador persistente: Ejecuta
/usage tokenso/usage fullpara que cada respuesta del asistente incluya un pie de página con el desglose de consumo. - Analiza el context window: Usa
/context listo/context detailpara ver exactamente cuántos tokens ocupan tus herramientas, archivos inyectados y el system prompt. - Consulta el histórico: Escribe
/usage costpara ver un resumen del gasto acumulado en los logs de tu sesión local.
Cómo optimizar el gasto con Caching
Sección titulada «Cómo optimizar el gasto con Caching»OpenClaw permite usar el prompt caching de los providers para reducir costos drásticamente. Si usas Anthropic, leer del cache es mucho más barato que enviar tokens de entrada nuevos.
Para evitar que el cache expire cuando la sesión está inactiva, te recomiendo configurar un heartbeat. Esto mantiene el contexto “caliente” enviando una señal pequeña justo antes de que expire el TTL (Time To Live).
Aquí tienes un ejemplo de configuración en tu archivo de proveedores para mantener un cache de 1 hora usando un intervalo de 55 minutos:
agents: defaults: model: primary: "anthropic/claude-opus-4-6" models: "anthropic/claude-opus-4-6": params: cacheRetention: "long" heartbeat: every: "55m"También puedes activar el cache-ttl pruning en la configuración del Gateway. Esto limpia la sesión cuando el cache expira y reinicia la ventana, evitando pagar de más por re-escribir todo el historial si la sesión se quedó inactiva demasiado tiempo.
Solución de problemas
Sección titulada «Solución de problemas»- No veo el costo en dólares, solo tokens: Esto sucede si estás usando autenticación OAuth. OpenClaw solo muestra estimaciones monetarias cuando usas una API key directa.
- El costo aparece como cero: Verifica que el campo
costesté definido correctamente en tu configuración demodels.providers.<provider>.models[]. Si falta el dato de precio por millón de tokens, el sistema no puede calcular el total. - El system prompt es demasiado grande: OpenClaw trunca archivos grandes por defecto a 20,000 caracteres. Puedes ajustar este límite con el parámetro
agents.defaults.bootstrapMaxChars. - El consumo sube muy rápido: Revisa tus Skills. Como la lista de Skills se inyecta en cada mensaje, las descripciones muy largas aumentan el overhead. Mantén las descripciones de tus herramientas breves y directas.
¿Necesitas ayuda para configurar tus límites de tokens? Prueba nuestro AI Setup Assistant.
Próximos pasos
Sección titulada «Próximos pasos»OpenClaw Expert
Sigues atascado?
Si esta pagina no resolvio tu caso, pregunta a OpenClaw Expert para pasos concretos.