Ir al contenido

Modelo del agente

Cada agente razona con un modelo de lenguaje. Se elige en el Estudio, vista Diseño, pieza Agente, sección «Modelo». Se puede cambiar de proveedor sin tocar el resto del agente, y el costo de cada llamada queda registrado.

Los modelos disponibles los conecta un administrador en Administración → Modelos. El agente solo puede elegir modelos de chat habilitados.

Campo Valores Predeterminado Para qué sirve
Modelo de lenguaje «Predeterminado de la instancia (…)» o un modelo de la lista («Nombre — Proveedor») Predeterminado de la instancia Con el predeterminado, el agente sigue al modelo que marque el administrador. Elegir uno fijo evita cambios de comportamiento cuando cambia el predeterminado.
Temperatura 0 a 1 0,20 Más baja = más preciso y consistente. Para atención al cliente conviene dejarla entre 0 y 0,3.
Máx. tokens de respuesta 64 a 8192 1024 Corta respuestas demasiado largas y acota el costo.
Memoria (turnos de historial) 0 a 50 10 Cuántos intercambios previos de la conversación recuerda. Más memoria da más contexto y más costo por mensaje.

Para usar herramientas, agentes colaboradores, la derivación decidida por el modelo o la búsqueda «Cuando lo necesite», el modelo tiene que admitir herramientas (llamadas a funciones). En el catálogo de OpenRouter, el filtro «Con herramientas» viene activado por eso.

Si el modelo elegido no admite herramientas:

  • Las herramientas no se le ofrecen.
  • La búsqueda en el conocimiento en modo «Cuando lo necesite» pasa a hacerse en cada mensaje.
  • La derivación cuando la persona la pide explícitamente sigue funcionando, porque la detecta Sherlock sin depender del modelo.

Cada instancia trae el modelo «Demo extractivo (sin LLM)»: responde extrayendo fragmentos del conocimiento («Según la documentación: …»), sin llamar a ningún modelo y sin costo. Sirve para recorrer la consola, pero:

  • No cuenta como «Modelo de lenguaje» en la lista para producción.
  • No puede generar agentes ni casos de prueba, ni actuar como juez de la evaluación.

Cada llamada registra los tokens de entrada y de salida y el costo en USD, con el precio que cargó el administrador o el del catálogo del proveedor. Lo ves en cada respuesta de prueba, en la traza, en la vista Versiones («Costo/msj») y en Gobierno. El gasto de todos los agentes del workspace se controla con el presupuesto mensual.