Modelo de IA e BYOK
Esta página explica que modelo de IA alimenta o seu bot, por que razão apenas um fornecedor é suportado para BYOK (Bring Your Own Key) e como configurar a sua própria chave, caso o seu plano o inclua.
Que Modelo de IA Alimenta o Bot
A plataforma utiliza o Anthropic Claude como o modelo principal para o seu bot. O Claude foi escolhido porque, após testes exaustivos em todos os principais modelos de fronteira (termo da indústria para os modelos de IA mais avançados disponíveis) no mercado, é o único que lida com o volume de mensagens de produção de forma fiável.
Não precisa de escolher um modelo. A plataforma seleciona automaticamente o modelo certo para cada tarefa e otimiza a forma como este é utilizado nos bastidores (incluindo o armazenamento em cache de prompts avançado, que reduz drasticamente o custo por conversação).
Por que Apenas Anthropic para BYOK
Os clientes perguntam frequentemente se iremos adicionar suporte para OpenAI, Google Gemini, OpenRouter ou modelos de código aberto para BYOK. A resposta honesta é: nenhum deles, quando utilizados de forma bruta e não otimizada, aguenta o volume de produção.
Para um pequeno projeto, uma taxa de sucesso de 9 em 10 por parte de uma IA é aceitável. Assim que estiver a realizar conversas reais com clientes em escala, uma taxa de falha de 10% significa reservas interrompidas, respostas erradas, seguimentos perdidos e vendas perdidas. Isso está na ordem de grandeza do que vemos mesmo nos modelos de fronteira de topo de outros fornecedores (aproximadamente 6–10% em casos limite adversários, ou seja, perguntas de teste complicadas e deliberadamente difíceis) — e isto antes de considerar os modelos mais baratos.
Os problemas dividem-se em três categorias:
- Casos limite falham de forma imprevisível. Um modelo pode funcionar perfeitamente durante centenas de chats e, de repente, alucinar uma chamada de ferramenta, afirmar que fez algo que não fez ou ignorar instruções a meio da conversação.
- O contexto longo é mal gerido. Uma única resposta do bot utiliza o histórico de chat, FAQs, lógica de seguimento, chamadas de ferramentas e raciocínio. A maioria dos modelos bloqueia com este volume e produz resultados de pior qualidade.
- “Mais barato” raramente o é. O preço de tabela mais baixo por token é compensado por mais tentativas, mais tokens de saída e pior conversão. O custo real por conversação bem-sucedida acaba por ser mais elevado.
Suportar 100 modelos diferentes é mais uma estratégia de marketing do que uma capacidade real. Preferimos oferecer-lhe um fornecedor que funcione de forma fiável do que cinco que falham, cada um à sua maneira.
O Nosso Próprio Modelo: Max
Criámos o nosso próprio modelo interno, Max — um modelo interno aliado a uma pilha de otimização de várias passagens, aperfeiçoado com dados de conversação reais da plataforma. O objetivo era um modelo significativamente mais económico do que o Claude, mantendo a fiabilidade nos padrões de conversação que a plataforma realmente executa, e é isso que o Max oferece: uma fração do preço do Pro (0,25 créditos por ação), ajustado para se manter preciso onde um modelo de orçamento básico falha.
O Max não necessita de configuração — sem escolha de modelos, sem conta de fornecedor, sem chave. É executado inteiramente na nossa infraestrutura e é o modelo mais preciso que disponibilizamos: nos nossos próprios testes de referência, é o mais robusto a manter-se fiel ao que a sua empresa realmente diz. Para uma análise detalhada de como o Max se compara ao Claude e aos modelos de terceiros mais económicos sobre os quais os clientes perguntam frequentemente — incluindo o que esses modelos realmente falharam nos nossos testes — consulte Por que o Max é a melhor opção.
Quem vê o nível Max
Se o seletor de Qualidade de IA no separador Instruções de IA do seu Agente apenas mostra Pro e Economy, o Max simplesmente não está ativado na conta em que tem sessão iniciada. Duas coisas ativam-no:
- As contas num plano vitalício elegível obtêm o Max automaticamente.
- Qualquer outra conta precisa que o Max seja ativado explicitamente.
Numa conta fornecida por uma agência, o seu fornecedor pode ter escolhido o modelo por si. Se o seletor de Qualidade de IA mostrar apenas um cartão e não houver nada para onde mudar, isso é uma definição deliberada na sua conta, não uma falha — peça a quem fornece a sua conta para a alterar. Se um cartão continuar a ser apresentado com uma nota de que já não está disponível, o seu Agente está num modelo que o seu fornecedor removeu entretanto: ele continua a responder, mas num dos modelos que eles permitem, por isso escolha um desses para que o seletor corresponda ao que está realmente em execução.
Ligar a sua própria chave Anthropic (BYOK) não tem nada a ver com a visibilidade do Max. Ambos funcionam lado a lado — consulte a nota de exceção em Configurar BYOK para saber como um Agente Max é faturado quando tem uma chave ligada. Remover a sua chave API não fará com que o Max apareça.
O escalão Mini
Se consegue ver o Max, também consegue ver o Mini, a 0,15 créditos por ação. O Mini é a mesma IA que o Max a um preço mais baixo, com dois compromissos:
- Uma maior probabilidade de erros. O Mini é o modelo mais leve dos dois. O Max é o modelo mais preciso que disponibilizamos — otimizado ao máximo para se manter fiel ao que a sua empresa realmente diz —, enquanto com o Mini existe uma maior probabilidade de um pequeno erro ou alucinação surgir numa resposta.
- Memória mais leve. Em conversas longas, o Mini recorda menos mensagens antigas e utiliza menos fragmentos da base de conhecimento por resposta.
O Max continua a ser a escolha recomendada para tudo onde um detalhe incorreto possa custar uma venda — reservas, questões de preços, apoio com riscos reais. O Mini adequa-se a conversas de alto volume e sensíveis ao preço, onde a velocidade e o custo importam mais do que a última percentagem de precisão.
O Mini encontra-se no mesmo seletor de Qualidade de IA que o Max, em todas as contas que possuem o Max. Tal como o Max, o Mini é executado inteiramente na nossa infraestrutura e nunca utiliza uma chave BYOK, pelo que uma chave Anthropic ligada não é utilizada (nem faturada) enquanto um Agente estiver no Mini.
O que a tarifa Mini de 0,15 cobre. O preço Mini aplica-se a tudo o que acontece dentro de uma conversa em direto: respostas de IA, chamadas de ferramentas de IA (como marcar uma consulta ou alertar um humano), avaliações de chat (decidir se uma conversa deve ser ignorada ou fechada), gestão de interrupções (quando um contacto envia uma nova mensagem enquanto o bot ainda está a compor a sua resposta), resumos de chat e etiquetagem automática por IA. Funcionalidades de IA pontuais fora da conversa — otimização de campanhas, geração de bases de conhecimento e etiquetagem feita através da API — têm uma tarifa fixa única de 0,25 créditos tanto no Max como no Mini, pelo que poderá ver entradas ocasionais de 0,25 no seu histórico de créditos, mesmo quando todos os Agentes estão definidos para Mini. Trata-se dessas funcionalidades, e não do modelo Max a responder aos seus chats.
Configurar BYOK
O BYOK está incluído nos planos Agency e Agency Unlimited, e nos níveis vitalícios do AppSumo a partir do Plan 2. Não faz parte do plano Business. Se o seu plano o incluir, pode ligar a sua própria chave de API da Anthropic (um código privado da sua conta Anthropic que permite à plataforma cobrar a utilização de IA diretamente a si, em vez de utilizar créditos da plataforma).
Apenas as chaves oficiais da Anthropic funcionam. Uma chave válida provém da sua própria conta em console.anthropic.com e começa sempre por
sk-ant-. Chaves de revendedores, proxies ou sites de “API Claude com desconto” (que começam frequentemente com um prefixo diferente) não são suportadas e não serão guardadas. Tenha cuidado com ofertas de tokens Claude baratos muito abaixo dos preços da própria Anthropic — ninguém pode revender legitimamente o acesso ao Claude abaixo do que a Anthropic cobra, e essas ofertas são quase sempre burlas baseadas em chaves roubadas ou criadas para obter os seus dados de pagamento através de phishing.
Está num telemóvel? A barra lateral esquerda pode estar oculta. Toque primeiro no ícone de menu (☰) e, em seguida, toque em Definições.
Não vê as Chaves API BYOK no grupo Avançadas? A secção apenas aparece em planos que incluem BYOK. Se a sua conta for gerida por um fornecedor, esta só aparece quando este tiver ativado a opção Trazer a Sua Própria Chave API para a sua conta.
- Na barra lateral esquerda principal, clique em Definições (o ícone de engrenagem perto da parte inferior).
- Na página de Definições, no menu esquerdo, desloque-se até ao grupo Avançadas.
- Clique em Chaves API BYOK.
- Clique em Add key no cartão da Anthropic. Irá aparecer um campo Secret key (espaço reservado
sk-ant-…).
- Cole a sua chave API da Anthropic no campo e, em seguida, clique em Save key.
Uma vez ativado, o seu bot utilizará a sua própria chave para chamadas de IA e pagará diretamente à Anthropic por essa utilização, em vez de gastar créditos da plataforma em respostas de IA. A infraestrutura do canal (servidores do WhatsApp Web, números de telefone, etc.) continua a utilizar créditos como habitualmente.
Uma exceção — o escalão Max. Se a Qualidade de IA de um Agente estiver definida para o escalão Max, esse Agente funciona inteiramente na nossa infraestrutura interna e é faturado a 0,25 créditos por ação, mesmo quando tem BYOK ligado — o Max nunca utiliza a sua chave Anthropic. (O mesmo se aplica ao Mini, quando disponível: 0,15 créditos por ação, nunca a sua chave.) Para faturar as respostas na sua própria conta Anthropic, mantenha o Agente no escalão Pro (padrão). O seletor de Qualidade de IA encontra-se no separador Instruções de IA de cada Agente. A página de definições de Chaves API BYOK mostra um aviso sempre que a sua chave está registada, mas um ou mais dos seus Agentes ainda estão a funcionar no escalão Max, listando quais — para que possa identificar rapidamente o motivo pelo qual os créditos continuam a ser utilizados.
Uma nota sobre custos: Trazer a sua própria chave já não é a opção mais barata. Com uma chave ligada, o seu Agente funciona com o Claude e paga diretamente as tarifas medidas da Anthropic (a Anthropic cobra-lhe com base naquilo que realmente utiliza, semelhante a uma fatura de serviços públicos). Medido através das contas que utilizam a sua própria chave, uma resposta de IA custa aproximadamente 3 vezes mais do que a mesma resposta custa no Max e mais de 5 vezes mais do que custa no Mini, assim que contabiliza o trabalho de fundo que uma resposta desencadeia (pesquisa na base de conhecimentos, verificação de spam, extração de nomes e e-mails, avaliações de chat, etiquetagem), tudo isto incluído na tarifa fixa do Max e do Mini, mas cobrado por token na sua chave. As nossas otimizações de cache de prompts também se aplicam à sua própria chave, pelo que não se trata de uma lacuna de cache; o Max e o Mini são simplesmente modelos muito mais baratos que também obtêm uma pontuação mais elevada no nosso benchmark de conversação de vendas. Utilize BYOK quando pretender especificamente que a utilização da IA seja cobrada na sua própria conta Anthropic, e não para poupar dinheiro.
Por que a primeira resposta numa conversa custa muito mais do que as restantes. O armazenamento em cache funciona ao guardar o contexto da conversa com a Anthropic na primeira vez que é enviado, reutilizando-o depois. Escrevê-lo custa mais do que um pedido normal; cada resposta que o reutiliza custa cerca de um vigésimo. Por isso, a primeira resposta parece alarmantemente cara e as que se seguem são muito baratas. Qualquer elemento grande na conversa torna essa primeira resposta maior — um documento que um visitante carrega é o principal exemplo. Um PDF de 24 páginas perfaz cerca de 70 000 tokens, porque cada página é enviada tanto como texto como sob a forma de imagem, e permanece na conversa, pelo que é reenviado (e re-armazenado em cache) a cada resposta. Se uma conversa ficar inativa durante mais de uma hora, a cópia armazenada expira e a resposta seguinte volta a pagar o custo de escrita.
Se está a criar algo que envolve muitos documentos — explicadores de contratos, consultas de manuais, qualquer situação em que as pessoas carreguem ficheiros — o nível Max é geralmente a melhor opção: tem um custo fixo de 0,25 créditos por resposta, independentemente do tamanho do documento, pelo que não existe um pico na primeira mensagem nem qualquer exposição por token. Consulte Por que o Max é a melhor relação qualidade-preço para saber como o Max se compara em termos de qualidade e custo.
Se a sua chave BYOK falhar (inválida, sem quota ou com limite de taxa — o que significa que a Anthropic limitou temporariamente o número de pedidos que a sua chave pode fazer), o facto de o seu bot continuar a funcionar depende do interruptor “Recurso a créditos” na mesma página de Chaves API BYOK:
- Ligado: a plataforma recorre temporariamente aos créditos da plataforma para que o seu bot continue a responder, e continua a tentar utilizar a sua chave em segundo plano — no momento em que uma chamada é bem-sucedida novamente, o sistema muda automaticamente de volta para a sua própria chave.
- Desligado (a predefinição): as respostas da IA são bloqueadas até que corrija a chave. Nada consome os seus créditos silenciosamente, mas o seu bot também deixa de responder, por isso, se preferir que continue a funcionar com créditos enquanto resolve o problema da chave, ative este interruptor com antecedência.
De qualquer forma, receberá um e-mail na primeira vez que a sua chave falhar (não um por mensagem).
Perguntas Frequentes
Posso utilizar a OpenAI, o Gemini ou outro fornecedor para BYOK? Atualmente, não para outros fornecedores. Para a maioria das pessoas, a resposta já se encontra aqui: Max e Mini são os nossos próprios escalões internos, a 0,25 e 0,15 créditos por ação, respetivamente.
A minha chave BYOK será utilizada para tudo? A maioria das operações de IA está isenta de custos de créditos quando a sua própria chave Anthropic (BYOK) está ligada: as respostas da IA, a utilização de ferramentas, a otimização de campanhas, a geração de bases de conhecimento e a pesquisa na Web funcionam todas com a sua chave. Quatro elementos continuam a custar créditos mesmo com uma chave ligada: o escalão Max a 0,25 créditos por ação e o escalão Mini a 0,15, uma vez que ambos funcionam com os nossos próprios modelos; o Lead Finder a 0,25 por endereço de e-mail encontrado; e as Automações a 0,25 por execução mais 0,25 por passo de IA. Para manter um Agente totalmente na sua própria chave a 0 créditos, deixe-o no escalão Pro. As taxas de canal (taxa mensal do WhatsApp Web, taxas de entrega de mensagens WhatsApp e taxas de modelos) são faturadas separadamente da utilização de IA em qualquer dos casos. Se a chave falhar numa chamada que teria sido executada com a mesma, a possibilidade de a plataforma recorrer a créditos depende do seu botão Fallback to credits (Recorrer a créditos) — consulte o botão “Fallback to credits” descrito acima nesta página.
Quando é que as respostas de IA custam exatamente 0 créditos? O BYOK é por conta. As respostas de IA custam 0 créditos apenas quando esta conta ligou a sua própria chave Anthropic. Sem a sua própria chave, as respostas consomem créditos à taxa normal.
O BYOK afeta a entrega de mensagens ou a fiabilidade do canal? Não. O BYOK apenas altera a forma como as chamadas de IA do seu bot são faturadas. Tudo o resto — encaminhamento de mensagens, infraestrutura de canal, seguimentos, campanhas e Transmissões — funciona exatamente da mesma forma.
Veja também: Porque é que o Max é a melhor relação qualidade-preço · Configurar o seu Bot de IA · Agentes de IA