Proveedor de IA
Todo lo relacionado con la conexión a la IA que impulsa el asistente.

Proveedor de IA
Un selector en la parte superior te permite elegir qué proveedor de IA impulsa el asistente: Anthropic (Claude), OpenAI (GPT) o DeepSeek. Anthropic viene seleccionado por defecto en una instalación nueva.
Cambiar de proveedor solo cambia cuál está activo — la clave API y el modelo de cada proveedor quedan guardados por separado, así que cambiar de uno a otro y volver nunca borra lo que ya configuraste en ninguno de ellos.
Clave API
- Se guarda cifrada en reposo y nunca se envía al navegador del visitante — todas las llamadas a tu proveedor de IA pasan por el propio servidor de WordPress.
- Mientras hay una clave guardada, el campo la muestra enmascarada
(
********) — para reemplazarla, simplemente pega una nueva y guarda; para confirmarla sin cambiarla, usa Probar conexión (no hace falta volver a pegarla).
Probar conexión
Botón junto al campo de la clave. Hace una llamada real mínima (max_tokens 16) contra el proveedor seleccionado, con el modelo seleccionado, y
distingue tres resultados:
- Clave inválida — el proveedor la rechazó (typo, o clave revocada).
- Sin créditos — la clave es válida pero la cuenta no tiene saldo.
- No se pudo conectar — problema de red/servidor (el servidor no permite peticiones HTTPS salientes, por ejemplo).
Funciona tanto con una clave recién pegada en el campo (antes de guardar) como con la clave ya guardada (dejando el campo con la máscara tal cual).
Eliminar clave
Botón para eliminar la clave guardada de ese proveedor (pide confirmación, ya que el asistente queda desconectado hasta guardar una nueva, si ese es el proveedor actualmente activo). Solo aparece si hay una clave guardada para ese proveedor.
Modelo
Cada proveedor tiene su propio selector:
Anthropic (Claude):
| Modelo | Cuándo usarlo |
|---|---|
| Claude Haiku 4.5 | Más rápido y barato — ideal para volumen alto de chats |
| Claude Sonnet 5 | Equilibrio entre capacidad y coste |
| Claude Opus 4.8 | Más capaz, coste más alto |
OpenAI (GPT):
| Modelo | Cuándo usarlo |
|---|---|
| GPT-5.6 Luna | Más rápido y barato — ideal para volumen alto de chats |
| GPT-5.6 Terra | Equilibrio entre capacidad y coste |
| GPT-5.6 Sol | Más capaz, coste más alto |
DeepSeek:
| Modelo | Cuándo usarlo |
|---|---|
| DeepSeek V4 Flash | Más rápido y barato — ideal para volumen alto de chats |
| DeepSeek V4 Pro | Más capaz, coste más alto |
El modelo más rápido/barato del proveedor activo (Claude Haiku 4.5, GPT-5.6 Luna o DeepSeek V4 Flash) viene preseleccionado por defecto.
Máximo de tokens por respuesta
Techo de tokens por cada respuesta del asistente (rango 256–8000), compartido entre todos los proveedores. Valores más altos permiten respuestas más largas, pero cuestan más por mensaje.
Estimador de coste en vivo
Debajo del selector de modelo y del límite de tokens: "$10 de crédito de API ≈ X–Y mensajes con este modelo y límite." Se recalcula al instante al cambiar de proveedor, cambiar de modelo o ajustar el límite de tokens — antes de guardar — para decidir con el coste delante, no después de que ya esté configurado.
El rango (X–Y) va de un peor caso a un caso típico, y por eso es un rango y no un número único:
- El extremo bajo asume que cada respuesta agota tu límite de tokens, en un sitio con poco tráfico donde los mensajes llegan demasiado espaciados para que la caché del proveedor ayude. Es el suelo pesimista.
- El extremo alto asume respuestas cortas dentro de una conversación en curso, donde el proveedor reutiliza su copia cacheada de la información de tu negocio en vez de cobrártela entera otra vez.
Depende de cuánto completes
La estimación se calcula a partir de la información de negocio que realmente hayas introducido en Empresa y contenido: perfil, servicios, precios, FAQ, contactos y el contenido de las páginas escaneadas. Todo eso se envía a la IA en cada mensaje, así que suele ser la mayor parte de lo que pagas, muy por encima de lo que escribe el visitante.
Esto significa que la cifra baja a medida que añades más contenido, y es lo esperado, no un fallo. Si un número te parece más bajo de lo que querrías, la palanca es recortar lo que hay en Empresa y contenido hasta lo que el asistente necesita de verdad para responder bien.
Solo el primer mensaje de cada conversación paga esa información a precio completo; los proveedores la cachean, así que el resto de la conversación sale bastante más barato. Eso ya está contemplado arriba.
Tómalo como una ayuda para planificar, no como una factura. Tu gasto real siempre se mide con lo que reporta el propio proveedor, que es además lo que aplica el límite de gasto diario.