Saltar al contenido principal

Proveedor de IA

Todo lo relacionado con la conexión a la IA que impulsa el asistente.

Pestaña Proveedor de IA

Proveedor de IA

Un selector en la parte superior te permite elegir qué proveedor de IA impulsa el asistente: Anthropic (Claude), OpenAI (GPT) o DeepSeek. Anthropic viene seleccionado por defecto en una instalación nueva.

Cambiar de proveedor solo cambia cuál está activo — la clave API y el modelo de cada proveedor quedan guardados por separado, así que cambiar de uno a otro y volver nunca borra lo que ya configuraste en ninguno de ellos.

Clave API

  • Se guarda cifrada en reposo y nunca se envía al navegador del visitante — todas las llamadas a tu proveedor de IA pasan por el propio servidor de WordPress.
  • Mientras hay una clave guardada, el campo la muestra enmascarada (********) — para reemplazarla, simplemente pega una nueva y guarda; para confirmarla sin cambiarla, usa Probar conexión (no hace falta volver a pegarla).

Probar conexión

Botón junto al campo de la clave. Hace una llamada real mínima (max_tokens 16) contra el proveedor seleccionado, con el modelo seleccionado, y distingue tres resultados:

  • Clave inválida — el proveedor la rechazó (typo, o clave revocada).
  • Sin créditos — la clave es válida pero la cuenta no tiene saldo.
  • No se pudo conectar — problema de red/servidor (el servidor no permite peticiones HTTPS salientes, por ejemplo).

Funciona tanto con una clave recién pegada en el campo (antes de guardar) como con la clave ya guardada (dejando el campo con la máscara tal cual).

Eliminar clave

Botón para eliminar la clave guardada de ese proveedor (pide confirmación, ya que el asistente queda desconectado hasta guardar una nueva, si ese es el proveedor actualmente activo). Solo aparece si hay una clave guardada para ese proveedor.

Modelo

Cada proveedor tiene su propio selector:

Anthropic (Claude):

ModeloCuándo usarlo
Claude Haiku 4.5Más rápido y barato — ideal para volumen alto de chats
Claude Sonnet 5Equilibrio entre capacidad y coste
Claude Opus 4.8Más capaz, coste más alto

OpenAI (GPT):

ModeloCuándo usarlo
GPT-5.6 LunaMás rápido y barato — ideal para volumen alto de chats
GPT-5.6 TerraEquilibrio entre capacidad y coste
GPT-5.6 SolMás capaz, coste más alto

DeepSeek:

ModeloCuándo usarlo
DeepSeek V4 FlashMás rápido y barato — ideal para volumen alto de chats
DeepSeek V4 ProMás capaz, coste más alto

El modelo más rápido/barato del proveedor activo (Claude Haiku 4.5, GPT-5.6 Luna o DeepSeek V4 Flash) viene preseleccionado por defecto.

Máximo de tokens por respuesta

Techo de tokens por cada respuesta del asistente (rango 256–8000), compartido entre todos los proveedores. Valores más altos permiten respuestas más largas, pero cuestan más por mensaje.

Estimador de coste en vivo

Debajo del selector de modelo y del límite de tokens: "$10 de crédito de API ≈ X–Y mensajes con este modelo y límite." Se recalcula al instante al cambiar de proveedor, cambiar de modelo o ajustar el límite de tokens — antes de guardar — para decidir con el coste delante, no después de que ya esté configurado.

El rango (X–Y) va de un peor caso a un caso típico, y por eso es un rango y no un número único:

  • El extremo bajo asume que cada respuesta agota tu límite de tokens, en un sitio con poco tráfico donde los mensajes llegan demasiado espaciados para que la caché del proveedor ayude. Es el suelo pesimista.
  • El extremo alto asume respuestas cortas dentro de una conversación en curso, donde el proveedor reutiliza su copia cacheada de la información de tu negocio en vez de cobrártela entera otra vez.

Depende de cuánto completes

La estimación se calcula a partir de la información de negocio que realmente hayas introducido en Empresa y contenido: perfil, servicios, precios, FAQ, contactos y el contenido de las páginas escaneadas. Todo eso se envía a la IA en cada mensaje, así que suele ser la mayor parte de lo que pagas, muy por encima de lo que escribe el visitante.

Esto significa que la cifra baja a medida que añades más contenido, y es lo esperado, no un fallo. Si un número te parece más bajo de lo que querrías, la palanca es recortar lo que hay en Empresa y contenido hasta lo que el asistente necesita de verdad para responder bien.

Solo el primer mensaje de cada conversación paga esa información a precio completo; los proveedores la cachean, así que el resto de la conversación sale bastante más barato. Eso ya está contemplado arriba.

Tómalo como una ayuda para planificar, no como una factura. Tu gasto real siempre se mide con lo que reporta el propio proveedor, que es además lo que aplica el límite de gasto diario.