Proveedores y modelos
En Administración → Modelos se conectan los proveedores de modelos y se decide cuáles pueden usar los agentes de todos los workspaces de la instancia. Es exclusivo de los administradores (también se llega desde el menú de tu nombre → «Modelos y credenciales»).
Cambiar de proveedor no obliga a tocar los agentes: cada agente apunta a un modelo de esta lista o al predeterminado. Ver Modelo del agente.
Agregar un proveedor
Sección titulada «Agregar un proveedor»Hacé clic en «Agregar proveedor» y elegí uno:
| Grupo | Proveedores |
|---|---|
| Costo casi cero: planes gratuitos generosos, ideales para pilotos y demos | Google Gemini, Groq, OpenRouter |
| Autoalojados: modelos locales que corren en tu infraestructura, sin costo por token y sin enviar datos a terceros | Ollama (local) y cualquier servidor compatible con OpenAI |
| Proveedores comerciales: pago por uso | OpenAI, Anthropic, Mistral, DeepSeek, Azure OpenAI |
| Otros | Demo extractivo (sin costo, sin LLM) |
En «Conectar …» completá:
| Campo | Notas |
|---|---|
| Nombre | Cómo lo vas a ver en la consola: «OpenRouter producción». |
| API key | Con el enlace «Obtener una API key». Se guarda cifrada y no se vuelve a mostrar. |
| URL base | Solo para los modelos locales (la dirección de tu servidor de modelos, accesible desde la instancia), los compatibles con OpenAI (termina en /v1) y Azure (el endpoint del recurso). |
| Versión de la API | Solo Azure (por defecto 2024-10-21). En Azure, el nombre del modelo es el nombre del deployment. |
| Modelos de chat | Los sugeridos del proveedor, o «Otro modelo» con el nombre exacto. |
| Modelos de búsqueda | Para las bases de conocimiento. Opcional: Sherlock ya trae los suyos, sin costo. |
| Precios | Opcional, en USD por millón de tokens. Si los dejás vacíos, Sherlock usa un precio de referencia del modelo. Para modelos autoalojados podés cargar 0. |
Hacé clic en «Agregar proveedor» y luego en «Probar conexión».
OpenRouter
Sección titulada «OpenRouter»OpenRouter da acceso a cientos de modelos con una sola API key. Al conectarlo, en lugar de una lista fija ves el catálogo en vivo:
- Buscá por nombre: «gpt, claude, gemini, llama, qwen…».
- «Con herramientas» (activado por defecto): muestra solo modelos que admiten herramientas, necesarios para usar APIs, MCP, agentes colaboradores y derivación por el modelo.
- «Solo gratis»: modelos terminados en
:freeo con precio 0. Tienen límites de uso y algunos registran los prompts: no los uses con datos de clientes. - Ordená por «Más nuevos», «Más económicos» o «Por nombre». Cada modelo muestra su precio de entrada y salida por millón de tokens y su ventana de contexto.
Los precios se completan desde OpenRouter, y cada llamada se identifica ante OpenRouter como «Sherlock».
La lista de modelos
Sección titulada «La lista de modelos»La sección Modelos lista todos los modelos de todos los proveedores, con su tipo (de chat o de búsqueda), sus precios y un interruptor Habilitado. Solo los modelos habilitados aparecen para elegir en los agentes.
Acciones de cada modelo:
- «Probar»: le pide que responda una palabra y muestra el tiempo («… responde»). Si falla, muestra el motivo: credencial inválida, sin créditos, límite de solicitudes, modelo inexistente o demora.
- «Usar como predeterminado»: lo usan los agentes que no eligieron un modelo de chat.
- «Editar nombre y precios»: los precios nuevos aplican a las llamadas nuevas; el costo de las anteriores no se recalcula.
- «Eliminar modelo»: si algún agente lo usa, no se puede eliminar.
En Proveedores, el menú de cada proveedor permite «Editar o rotar API key» (los cambios aplican de inmediato a todos los agentes), «Agregar modelo» y «Eliminar proveedor».
Modelo juez para evaluaciones
Sección titulada «Modelo juez para evaluaciones»Las evaluaciones con criterio («Cumple el criterio», «Equivale a la respuesta esperada») las califica un modelo juez con un puntaje de 0 a 1 y una justificación. Las verificaciones exactas (contiene un texto, cita una fuente) no usan modelo.
En la tarjeta «Modelo juez para evaluaciones», elegí «Usar el modelo de chat predeterminado» u otro modelo y hacé clic en «Guardar». Conviene un modelo distinto y, si es posible, más capaz que el de los agentes evaluados. El modelo demo no puede ser juez.
Cada llamada registra tokens de entrada y salida y su costo en USD, con este orden de prioridad: el precio que cargaste en el modelo, el que informa OpenRouter y, si no hay ninguno, un precio de referencia. El modelo demo cuesta cero. El gasto se controla por workspace con el presupuesto.
Modelos de búsqueda
Sección titulada «Modelos de búsqueda»Cada base de conocimiento usa un modelo de búsqueda para encontrar los fragmentos que responden a cada pregunta. Sherlock trae los suyos, sin costo, y con ellos los documentos no salen de la instancia. Si habilitás modelos de búsqueda de un proveedor, aparecen además al crear una base, marcados como de pago por uso. El modelo de cada base se elige al crearla y no se cambia después. Ver Bases de conocimiento.
El modelo demo
Sección titulada «El modelo demo»Cada instancia trae el proveedor «Demo (sin costo)» con el modelo «Demo extractivo (sin LLM)»: responde extrayendo fragmentos del conocimiento, sin llamar a ningún modelo. Sirve para recorrer la consola sin API keys, pero no genera agentes ni casos de prueba y no puede ser juez.