Your AI Connector Docs

Modèle d’IA et BYOK

Cette page explique quel modèle d’IA alimente votre bot, pourquoi un seul fournisseur est pris en charge pour le BYOK (Bring Your Own Key), et comment configurer votre propre clé si votre forfait l’inclut.


Quel modèle d’IA alimente le bot

La plateforme utilise Anthropic Claude comme modèle principal pour votre bot. Claude a été choisi car, après des tests approfondis sur tous les principaux modèles de pointe (terme industriel désignant les modèles d’IA les plus avancés disponibles) sur le marché, c’est le seul qui gère de manière fiable le volume de messages en production.

Vous n’avez pas besoin de choisir un modèle. La plateforme sélectionne automatiquement le modèle approprié pour chaque tâche et optimise son utilisation en arrière-plan (y compris grâce à une mise en cache avancée des prompts, ce qui réduit considérablement le coût par conversation).


Pourquoi uniquement Anthropic pour le BYOK

Les clients nous demandent souvent si nous ajouterons la prise en charge d’OpenAI, de Google Gemini, d’OpenRouter ou de modèles open source pour le BYOK. La réponse honnête est la suivante : aucun d’entre eux, utilisé tel quel et sans optimisation, ne tient la route à un volume de production.

Pour un petit projet, un taux de réussite de 9 sur 10 de la part d’une IA est acceptable. Une fois que vous gérez de vraies conversations clients à grande échelle, un taux d’échec de 10 % signifie des réservations interrompues, des réponses erronées, des suivis manqués et des ventes perdues. C’est l’ordre de grandeur de ce que nous observons même avec les modèles de pointe de premier plan d’autres fournisseurs (environ 6 à 10 % sur des cas limites contradictoires, c’est-à-dire des questions de test délicates et délibérément difficiles) — et cela avant même de prendre en compte les modèles moins coûteux.

Les problèmes se répartissent en trois catégories :

  • Les cas limites échouent de manière imprévisible. Un modèle peut fonctionner parfaitement pendant des centaines de discussions, puis soudainement halluciner un appel d’outil, prétendre avoir fait quelque chose qu’il n’a pas fait, ou abandonner des instructions au milieu d’une conversation.
  • Le contexte long est mal géré. Une seule réponse de bot utilise l’historique de discussion, la FAQ, la logique de suivi, les appels d’outils et le raisonnement. La plupart des modèles s’étouffent avec ce volume et produisent des résultats de moindre qualité.
  • Le “moins cher” l’est rarement. Le prix affiché plus bas par jeton est compensé par davantage de tentatives, plus de jetons de sortie et une moins bonne conversion. Le coût réel par conversation réussie finit par être plus élevé.

Prendre en charge 100 modèles différents est davantage un argument marketing qu’une réelle capacité. Nous préférons vous offrir un fournisseur qui fonctionne de manière fiable plutôt que cinq qui échouent chacun de manières différentes.


Notre propre modèle : Max

Nous avons développé notre propre modèle interne, Max — un modèle maison associé à une pile d’optimisation multi-passes, affiné sur des données de conversation réelles provenant de la plateforme. L’objectif était de créer un modèle nettement plus rentable que Claude tout en restant fiable sur les modèles de conversation réellement utilisés par la plateforme, et c’est ce que Max propose : une fraction du prix Pro (0,25 crédit par action), ajusté pour rester précis là où un modèle économique brut pourrait faillir.

Max ne nécessite aucune configuration — pas de choix de modèle, pas de compte fournisseur, pas de clé. Il fonctionne entièrement sur notre infrastructure et c’est le modèle le plus précis que nous proposons : selon nos propres tests, c’est celui qui respecte le mieux ce que votre entreprise déclare réellement. Pour une analyse détaillée de la comparaison entre Max, Claude et les modèles tiers économiques sur lesquels les clients nous interrogent souvent — y compris ce que ces modèles ont réellement mal interprété lors de nos tests — consultez Pourquoi Max est le meilleur rapport qualité-prix.

Qui peut voir le niveau Max

Si le sélecteur Qualité de l’IA sous l’onglet Instructions IA de votre Agent n’affiche que Pro et Économie, c’est simplement que Max n’est pas activé pour le compte auquel vous êtes connecté. Deux éléments permettent de l’activer :

  • Les comptes bénéficiant d’un plan à vie éligible obtiennent Max automatiquement.
  • Tout autre compte doit avoir Max activé explicitement.
  1. Dans la barre latérale gauche principale, cliquez sur Paramètres (l’icône en forme d’engrenage près du bas).
  2. Sur la page Paramètres, dans le menu de gauche, faites défiler jusqu’au groupe Avancé.
  3. Cliquez sur Clés API BYOK.
  1. Cliquez sur Add key sur la carte Anthropic. Un champ Secret key apparaît (espace réservé sk-ant-…).
  1. Collez votre clé API Anthropic dans le champ, puis cliquez sur Save key.

Une fois activé, votre bot utilisera votre propre clé pour les appels IA, et vous paierez Anthropic directement pour cette utilisation au lieu de dépenser des crédits de la plateforme pour les réponses de l’IA. L’infrastructure des canaux (serveurs WhatsApp Web, numéros de téléphone, etc.) continue d’utiliser des crédits comme d’habitude.

Une exception — le niveau Max. Si la Qualité de l’IA d’un Agent est réglée sur le niveau Max, cet Agent fonctionne entièrement sur notre infrastructure interne et est facturé 0,25 crédit par action, même lorsque vous avez BYOK connecté — Max n’utilise jamais votre clé Anthropic. (Il en va de même pour Mini, lorsqu’il est disponible : 0,15 crédit par action, jamais votre clé.) Pour facturer les réponses sur votre propre compte Anthropic, maintenez l’Agent sur le niveau Pro (standard). Le sélecteur Qualité de l’IA se trouve sous l’onglet Instructions IA de chaque Agent. La page des paramètres Clés API BYOK affiche un avis chaque fois que votre clé est enregistrée mais qu’un ou plusieurs de vos Agents fonctionnent toujours sur le niveau Max, en les listant — afin que vous puissiez voir en un coup d’œil pourquoi des crédits sont toujours utilisés.

Remarque sur le coût : Utiliser votre propre clé n’est plus l’option la plus économique. Avec une clé connectée, votre Agent fonctionne sur Claude et vous payez directement les tarifs à l’usage d’Anthropic (Anthropic vous facture en fonction de votre consommation réelle, comme une facture de services publics). Pour les comptes utilisant leur propre clé, une réponse IA coûte environ 3 fois plus cher que la même réponse sur Max et plus de 5 fois plus cher que sur Mini, si l’on prend en compte le travail en arrière-plan déclenché par une réponse (recherche dans la base de connaissances, vérification anti-spam, extraction de noms et d’e-mails, évaluations de chat, étiquetage), tout cela étant inclus dans le tarif forfaitaire Max et Mini mais facturé au jeton avec votre propre clé. Nos optimisations de mise en cache des prompts s’appliquent également à votre clé, il ne s’agit donc pas d’un problème de cache ; Max et Mini sont tout simplement des modèles beaucoup moins chers qui obtiennent également de meilleurs scores sur notre benchmark de conversation commerciale. Utilisez le BYOK lorsque vous souhaitez spécifiquement que l’utilisation de l’IA soit facturée sur votre propre compte Anthropic, et non pour économiser de l’argent.

Pourquoi la première réponse dans une conversation coûte beaucoup plus cher que les suivantes. La mise en cache fonctionne en stockant le contexte de la conversation auprès d’Anthropic la première fois qu’il est envoyé, puis en le réutilisant. L’écriture coûte plus cher qu’une requête normale ; chaque réponse qui le réutilise coûte environ un vingtième du prix. Ainsi, la première réponse semble alarmante en termes de coût, tandis que les suivantes sont très bon marché. Tout élément volumineux dans la conversation augmente le coût de cette première réponse — un document téléchargé par un visiteur en est la cause principale. Un PDF de 24 pages représente environ 70 000 jetons, car chaque page est envoyée à la fois sous forme de texte et d’image, et elle reste dans la conversation, donc elle est renvoyée (et remise en cache) à chaque réponse. Si une conversation reste inactive pendant plus d’une heure, la copie stockée expire et la réponse suivante paie à nouveau les frais d’écriture.

Si vous développez une solution intensive en documents — explications de contrats, consultation de manuels, ou tout autre cas où les utilisateurs téléchargent des fichiers — le niveau Max est généralement plus adapté : il s’agit d’un tarif fixe de 0,25 crédit par réponse, quelle que soit la taille du document. Il n’y a donc pas de pic de coût sur le premier message ni d’exposition aux frais par jeton. Consultez Pourquoi Max est le meilleur rapport qualité-prix pour comparer Max en termes de qualité et de coût.

Si votre clé BYOK échoue (invalide, hors quota ou limitée en débit — ce qui signifie qu’Anthropic a temporairement plafonné le nombre de requêtes que votre clé peut effectuer), le fait que votre bot continue de fonctionner dépend du commutateur « Repli sur les crédits » sur la même page des clés API BYOK :

  • Activé : la plateforme utilise temporairement les crédits de la plateforme afin que votre bot continue de répondre, et continue de réessayer votre clé en arrière-plan — dès qu’un appel réussit à nouveau, elle repasse automatiquement à votre propre clé.
  • Désactivé (par défaut) : les réponses de l’IA sont bloquées jusqu’à ce que vous corrigiez la clé. Rien ne consomme vos crédits silencieusement, mais votre bot cesse également de répondre. Si vous préférez qu’il continue à fonctionner sur vos crédits pendant que vous réglez le problème de clé, activez ce commutateur à l’avance.

Dans les deux cas, vous recevrez un e-mail la première fois que votre clé échouera (pas un par message).


Foire aux questions

Puis-je utiliser OpenAI, Gemini ou un autre fournisseur pour le BYOK ? Pas pour le moment, en ce qui concerne les autres fournisseurs. Pour la plupart des utilisateurs, la réponse est déjà là : Max et Mini sont nos propres niveaux internes, à 0,25 et 0,15 crédit par action.

Ma clé BYOK sera-t-elle utilisée pour tout ? La plupart des opérations d’IA sont exemptes de frais de crédit lorsque votre propre clé Anthropic (BYOK) est connectée : les réponses de l’IA, l’utilisation des outils, l’optimisation des campagnes, la génération de bases de connaissances et la recherche sur le Web utilisent toutes votre clé. Quatre éléments continuent de coûter des crédits même avec une clé connectée : le niveau Max à 0,25 crédit par action et le niveau Mini à 0,15, car ils utilisent tous deux nos propres modèles ; Lead Finder à 0,25 par adresse e-mail trouvée ; et les automatisations à 0,25 par exécution plus 0,25 par étape d’IA. Pour garder un agent entièrement sur votre propre clé à 0 crédit, laissez-le sur le niveau Pro. Les frais de canal (frais mensuels de WhatsApp Web, frais de livraison et de modèle WhatsApp par message) sont facturés séparément de l’utilisation de l’IA dans tous les cas. Si la clé échoue lors d’un appel qui aurait dû s’exécuter avec celle-ci, le fait que la plateforme bascule sur les crédits dépend de votre option Basculer sur les crédits — voir l’option “Basculer sur les crédits” décrite plus haut sur cette page.

Quand les réponses de l’IA coûtent-elles exactement 0 crédit ? BYOK est défini par compte. Les réponses de l’IA ne coûtent 0 crédit que lorsque ce compte a connecté sa propre clé Anthropic. Sans sa propre clé, les réponses consomment des crédits au tarif normal.

Le BYOK affecte-t-il la livraison des messages ou la fiabilité du canal ? Non. Le BYOK modifie uniquement la façon dont les appels IA de votre bot sont facturés. Tout le reste — routage des messages, infrastructure de canal, suivis, campagnes et diffusions — fonctionne exactement de la même manière.


Voir aussi : Pourquoi le niveau Max est le meilleur rapport qualité-prix · Configuration de votre bot IA · Agents IA