- Entender cuándo usar adaptador separado y cuándo mergear.
- Preparar GGUF para llama.cpp/Ollama.
- Crear un Modelfile con prompt de sistema y parámetros.
Flujo de salida
adapter LoRA -> evaluar -> merge con modelo base si procede -> export safetensors -> convertir a GGUF -> cuantizar Q4/Q5/Q8 -> crear Modelfile Ollama -> probar en la app real
Modelfile de Ollama
FROM ./soporte-qwen-lora-q5_k_m.gguf PARAMETER temperature 0.2 PARAMETER num_ctx 4096 SYSTEM """ Eres un asistente interno de soporte. Responde en español claro. Si faltan datos, pide aclaración. No inventes políticas, precios ni datos personales. """
ollama create soporte-pyme -f Modelfile ollama run soporte-pyme "Clasifica este email de ejemplo"
Si has guardado la evidencia de esta lección, continúa con «Proyecto pyme». Si no, repite la comprobación antes de avanzar.