Saltar al contenido
pando/ docs

Configuración del modo automático y del modelo de decisión

Claves del modo automático de modelos y del modelo de decisión compartido. Para la idea, lee Modo automático de modelos; para configurarlo en la Web UI, la guía Deja que Pando elija el modelo adecuado.

Modelo de decisión

Un modelo pequeño responde preguntas rápidas de reparto y de relevancia para el modo automático, la selección automática de persona y el filtro de relevancia del contexto. Web UI: Configuración > Modelo de decisión.

Ajustes del modelo de decisión
[DecisionModel]
TimeoutMs = 0            # 0 = 1500 ms for Ollama, 3000 ms for remote providers

[DecisionModel.Router]
Provider  = 'ollama'     # 'ollama' (default), 'typesafe' or 'custom'
BaseURL   = ''           # empty = provider default
APIKey    = ''           # stored encrypted; '$ENV_VAR' references are allowed
Model     = 'tev1:0.8b'
KeepAlive = '30m'        # how long Ollama keeps the model loaded
# Headers = { 'X-Team' = 'docs' }   # extra headers for gateways
ClavePor defectoDescripción
Router.Providerollamaollama (local), typesafe (TypeSafe Jev) o custom (una pasarela compatible con Jev)
Router.BaseURLla del proveedorRaíz de la API. Para TypeSafe, por defecto https://api.typesafe.ai
Router.APIKeyvacíaCon TypeSafe, si está vacía se usa la variable de entorno TYPESAFE_API_KEY
Router.ModelningunoPor ejemplo tev1:0.8b
Router.KeepAlive30mSolo Ollama
Router.HeadersningunaCabeceras HTTP adicionales
TimeoutMs0Tope de una llamada de decisión

Ollama debe ser 0.35 o posterior; Pando no lo instala. Instala el modelo con ollama pull tev1:0.8b, o con el botón Descargar que la página de ajustes muestra junto a los modelos sugeridos (tev1:0.8b, tev1, nimble) que aún no están instalados.

Probar conexión informa de: Accesible, Autorizado, Versión ≥ 0.35, Modelo presente, Modelo apto para decisiones, Latencia.

Quién usa el modelo de decisión:

FunciónDónde se activa
Enrutado del modo automáticoConfiguración > Auto mode (abajo)
Selección automática de personaConfiguración > Agentes > Persona Selector > Use decision model (useDecisionModel en el agente persona-selector). El modelo propio del agente pasa a ser el de reserva
Filtro de relevancia del contextoConfiguración > Remembrances > Filtro de relevancia con el modelo de decisión; mira la referencia de Remembrances

La idea se explica en Modelo de decisión; la puesta en marcha, en la guía Dale reflejos rápidos a Pando.

Modo automático

Web UI: Configuración > Auto mode.

Ajuste fino del reparto: umbral, confianza mínima y mensajes de historial
[ModelAutoMode]
Enabled        = true
DefaultAuto    = true    # new sessions start with Auto selected
Threshold      = 0.60    # minimum probability of the chosen route (0.05–1)
MinConfidence  = 0       # extra confidence check; 0 disables it
HistoryPrompts = 0       # previous user prompts added as context for the decision

[[ModelAutoMode.Routes]]
ID          = 'quick'
Description = 'Short question or explanation about code, a concept, an error message or a command; no code changes needed.'
Model       = 'ollama.qwen2.5-coder:7b'

[[ModelAutoMode.Routes]]
ID          = 'implementation'
Description = 'Write, modify, refactor or fix code across one or more files, including adding tests.'
Model       = 'anthropic.claude-sonnet-4'
Fallbacks   = ['copilot.gpt-5.4']

[[ModelAutoMode.Routes]]
ID          = 'planning'
Description = 'Design, architecture, trade-off analysis or planning a feature before implementing it.'
Model       = 'anthropic.claude-opus-4'
ClavePor defectoEtiqueta en la Web UIDescripción
EnabledfalseEnable Auto modeAñade «Auto» como primera entrada de todos los selectores de modelo
DefaultAutotrueUse Auto by defaultLas sesiones nuevas empiezan con Auto seleccionado
Threshold0.60ThresholdPor debajo, el turno va al modelo de programación
MinConfidence0Minimum confidence0 desactiva la comprobación extra
HistoryPrompts0History promptsHasta 20

Rutas

ClaveDescripción
IDNombre corto estable. none está reservado para «ninguna ruta encaja»
DescriptionEl tipo de mensaje, en lenguaje natural. Hasta 500 caracteres
ModelModelo principal
FallbacksHasta 2 modelos que se prueban en orden cuando el principal falla por un límite de uso, un error del servidor o un problema de red
Disabledtrue saca la ruta de la decisión sin borrarla

Hasta 25 rutas. El orden solo importa en los empates.

Comportamiento

  • La elección se hace una vez por mensaje; el modelo no cambia mientras el agente encadena llamadas a herramientas.
  • Si ninguna ruta llega al umbral, o el modelo de decisión no responde, el turno va al modelo de programación. El modo automático nunca bloquea un mensaje.
  • Al elegir un modelo concreto, Auto se desactiva en esa sesión hasta que se vuelva a seleccionar.
  • Los subagentes delegados conservan su propio modelo configurado.
  • Cambiar de modelo entre mensajes reduce el aprovechamiento de la caché de prompts del proveedor en esa conversación.
  • El chat informa de cada elección:
Auto: implementation → anthropic.claude-sonnet-4 (p=0.93, 38 ms via ollama/tev1:0.8b)
  • pando doctor comprueba que el modelo de decisión responde y que cada ruta apunta a un modelo que existe.

Dónde aparece Auto

InterfazDónde
Web UI y escritorioPrimera entrada del selector de modelos; muestra Auto · <modelo elegido> durante un turno
TUIPrimera entrada del diálogo de modelos
Editores por ACP (Zed, Xcode y otros)Primer modelo de la lista