Ir al contenido

Modelos y proveedores

crearModelo(process.env, fila.modelo) devuelve un modelo del AI SDK. Todo es API OpenAI-compatible.

AGENTE_PROVEEDOR Requiere Modelo por defecto
(sin definir) con NAN_API_KEY NAN_API_KEY deepseek-v4-flash
(sin definir) sin NAN_API_KEY LOVABLE_API_KEY el de ia_agentes.modelo
nan NAN_API_KEY deepseek-v4-flash (o AGENTE_MODELO)
lovable LOVABLE_API_KEY ia_agentes.modelo
compatible AGENTE_BASE_URL, AGENTE_API_KEY AGENTE_MODELO (xAI, OpenAI, OpenRouter…)

Con NaN el motor apaga el razonamiento (enable_thinking: false); si no, los modelos gastan el presupuesto pensando y devuelven vacío.

18 conversaciones × 3, juez deepseek-v4-flash, distribuidor de materiales:

Modelo Aprobados p50 p95 Veredicto
deepseek-v4-flash 54/54 1,7 s 6,0 s Recomendado
qwen3.8-flash 50/54 2,5 s 9,0 s Aceptable; timeouts ocasionales
qwen3.6 48/54 0,9 s 3,8 s Rápido pero no llama herramientas (no traspasa cotizaciones)
glm5.3-flash 14/36 >9 s — Demasiado lento para WhatsApp en Workers

Antes de cambiar el modelo de un cliente, corre sus evals con el modelo nuevo.

7 peticiones en paralelo y 60 por minuto por key. Para muchos clientes con volumen, usa keys distintas por cliente o un proveedor con más capacidad. Un 429 hace que el motor responda con mensaje_error y pase a humano.