- Entender LiteLLM como proxy entre tu app y varios modelos.
- Diseñar claves por usuario, equipo o entorno.
- Controlar coste, fallbacks y caché antes de que haya sustos.
Configuración conceptual
model_list:
- model_name: local-qwen
litellm_params:
model: openai/Qwen/Qwen3-8B
api_base: http://127.0.0.1:8000/v1
api_key: local
- model_name: backup-cloud
litellm_params:
model: openai/gpt-4.1-mini
api_key: os.environ/OPENAI_API_KEYQué medir por clave
- Tokens de entrada y salida.
- Coste estimado o coste real.
- Modelo usado y fallback aplicado.
- Latencia y errores.
- Usuario, equipo o tenant.
Si has guardado la evidencia de esta lección, continúa con «Observabilidad». Si no, repite la comprobación antes de avanzar.