Modelos y proveedores
crearModelo(process.env, fila.modelo) devuelve un modelo del AI SDK. Todo es API OpenAI-compatible.
AGENTE_PROVEEDOR |
Requiere | Modelo por defecto |
|---|---|---|
(sin definir) con NAN_API_KEY |
NAN_API_KEY |
deepseek-v4-flash |
(sin definir) sin NAN_API_KEY |
LOVABLE_API_KEY |
el de ia_agentes.modelo |
nan |
NAN_API_KEY |
deepseek-v4-flash (o AGENTE_MODELO) |
lovable |
LOVABLE_API_KEY |
ia_agentes.modelo |
compatible |
AGENTE_BASE_URL, AGENTE_API_KEY |
AGENTE_MODELO (xAI, OpenAI, OpenRouter…) |
Con NaN el motor apaga el razonamiento (enable_thinking: false); si no, los modelos gastan el presupuesto pensando y
devuelven vacío.
Resultados (2026-10-01, NaN)
Sección titulada «Resultados (2026-10-01, NaN)»18 conversaciones × 3, juez deepseek-v4-flash, distribuidor de materiales:
| Modelo | Aprobados | p50 | p95 | Veredicto |
|---|---|---|---|---|
| deepseek-v4-flash | 54/54 | 1,7 s | 6,0 s | Recomendado |
| qwen3.8-flash | 50/54 | 2,5 s | 9,0 s | Aceptable; timeouts ocasionales |
| qwen3.6 | 48/54 | 0,9 s | 3,8 s | Rápido pero no llama herramientas (no traspasa cotizaciones) |
| glm5.3-flash | 14/36 | >9 s | — | Demasiado lento para WhatsApp en Workers |
Antes de cambiar el modelo de un cliente, corre sus evals con el modelo nuevo.
Límites de NaN
Sección titulada «Límites de NaN»7 peticiones en paralelo y 60 por minuto por key. Para muchos clientes con volumen, usa keys distintas por cliente
o un proveedor con más capacidad. Un 429 hace que el motor responda con mensaje_error y pase a humano.