El campo model
El campo model de tu petición le dice a Semantara cómo resolverla. Tienes dos modos.
Enrutamiento automático
{ "model": "proxy/auto" }Con proxy/auto (o su alias auto), Semantara elige el modelo por ti. Cómo lo elige
depende de cómo tengas configurada tu API key:
- Una key con un solo proveedor conectado (OpenAI o Anthropic) usa un modelo base fijo y aprobado para ese proveedor. Es una decisión estable y predecible: la misma key recibe siempre el mismo modelo, sin un paso de análisis previo que añada latencia ni costo.
- Una key con proveedor principal y de respaldo usa el enrutamiento clásico, que clasifica cada petición y elige dentro del catálogo de tu proveedor.
En ambos casos no tienes que elegir a mano. Si necesitas un modelo concreto, fíjalo por nombre (abajo) y se respeta exactamente.
Un modelo específico
Si prefieres control total, pasa el nombre del modelo tal como lo nombra tu proveedor:
{ "model": "gpt-4o" }{ "model": "claude-sonnet-4-6" }Semantara lo respeta y omite el enrutamiento: la petición va al modelo que pediste, sin
sustituirlo. El modelo debe pertenecer a un proveedor que hayas conectado en la
Consola (BYOK). Si el modelo o el proveedor no están soportados,
recibes LLM_004.
¿Hay un límite o “modelo tope”?
No existe un parámetro de “modelo tope” por key, y no hace falta: el enrutamiento automático no escala de un modelo a otro dentro de una misma petición. O bien sirve el modelo base fijo de tu proveedor, o bien —en el enrutamiento clásico— elige uno del catálogo de tu proveedor al resolver la petición. Un modelo fijado por nombre se respeta tal cual, siempre.
Cuál usar
- Quieres ahorrar sin pensarlo →
proxy/auto. - Necesitas un modelo exacto (reproducibilidad estricta, una capacidad puntual) → fíjalo por nombre.
Puedes mezclar: usa proxy/auto en la mayoría de tus llamadas y fija un modelo solo donde
lo necesites.