MÉTODO TECHYS
Primero demostramos que funciona.
Después lo convertimos en sistema.
Separar discovery, benchmark, arquitectura e implementación evita comprar infraestructura antes de saber qué necesita realmente el caso.
01 · ENTENDER
Definimos el trabajo y las restricciones.
Usuarios, tareas, datos, sensibilidad, fuentes, acciones, latencia, volumen y expectativas de calidad. La primera decisión puede ser que el caso todavía no necesita un LLM local.
02 · MEDIR
Creamos un baseline y benchmark.
Evals
Conjunto de ejemplos representativos con criterios de éxito explícitos.
Modelos
Probamos distintas familias, tamaños y configuraciones que tengan sentido.
Sistema
Medimos contexto, RAG, tools, latencia, memoria y concurrencia, no sólo el modelo aislado.
03 · DECIDIR
Diseñamos la arquitectura.
04 · IMPLEMENTAR
Integración progresiva, no big bang.
Pasamos de un entorno controlado a usuarios reales con límites claros. Los errores de producción vuelven al set de evaluación para que cada mejora sea medible.
05 · OPERAR
Un LLM local no queda terminado el día del deploy.
Evals recurrentes para detectar regresiones y comparar cambios.
Nuevas versiones se prueban antes de reemplazar el baseline.
Observamos latencia, concurrencia, memoria y saturación.
Revisamos accesos, tools, logs y cambios en fuentes de datos.
PRIMER PASO
Contanos el trabajo que querés resolver.
La primera llamada sirve para decidir si vale la pena avanzar a benchmark.