- Elegir arquitectura según Mac, PC con GPU, mini PC o VPS.
- Separar bandeja de entrada, worker y modelo.
- Crear watchdog, logs y límites de recursos.
Arquitecturas honestas
- Mac M-series: cómodo, silencioso y buen entorno dev; vigila prefill y memoria unificada.
- RTX 3090/4090: más VRAM y CUDA; vigila calor, consumo y drivers.
- Mini PC: útil para orquestación, no para modelos grandes.
- VPS barato: bien para n8n/colas; mal para inferencia pesada sin GPU.
agent-runtime:
inbox: sqlite_or_postgres
worker_concurrency: 1
max_runtime_minutes: 20
max_steps: 12
idle_sleep_seconds: 10
healthcheck:
- ollama_api_alive
- disk_free_gt_10gb
- memory_free_gt_2gb
- no_repeated_error_3x
on_failure:
- pause_task
- save_trace
- notify_humanChecklist de operación local
- Un solo worker al principio.
- Cola persistente para no perder tareas al reiniciar.
- Logs por tarea, no solo logs globales.
- Resumen final con comandos, archivos y errores.
- Límite de GPU/CPU/tiempo antes de repetir.
Fuentes oficiales
Si has guardado la evidencia de esta lección, continúa con «OOM y memoria». Si no, repite la comprobación antes de avanzar.