Your AI Connector Docs

AI 模型与 BYOK

本页面介绍了驱动您机器人的 AI 模型、为什么 **BYOK(自带密钥,Bring Your Own Key)**仅支持一个提供商,以及如果您的套餐包含该功能,如何设置您自己的密钥。


驱动机器人的 AI 模型

本平台使用 Anthropic Claude 作为您机器人的主要模型。之所以选择 Claude,是因为在对市场上所有主流前沿模型(指目前最先进的 AI 模型)进行广泛测试后,它是唯一能够可靠处理生产环境消息量的模型。

您无需选择模型。平台会自动为每项任务选择合适的模型,并在后台优化其使用方式(包括先进的提示词缓存技术,这能显著降低单次对话的成本)。


为什么 BYOK 仅支持 Anthropic

客户经常询问我们是否会为 BYOK 增加对 OpenAI、Google Gemini、OpenRouter 或开源模型的支持。诚实的回答是:它们中的任何一个,如果未经优化直接使用,都无法支撑生产环境的业务量。

对于小型项目,AI 达到 10 分之 9 的成功率是可以接受的。 一旦您开始大规模处理真实的客户对话,10% 的失败率就意味着预约中断、回答错误、错过跟进以及销售流失。即使是其他提供商的顶级前沿模型,我们观察到的情况也大致如此(在对抗性边缘案例,即棘手且刻意设计的难题上,失败率约为 6-10%)——这还没算上那些更廉价的模型。

问题主要分为三类:

  • 边缘案例不可预测地崩溃。 模型可能在数百次聊天中表现完美,然后突然在工具调用中产生幻觉、声称执行了未完成的操作,或在对话中途丢失指令。
  • 长上下文处理能力较差。 单次机器人回复需要使用聊天记录、常见问题解答、跟进逻辑、工具调用和推理。大多数模型在处理这种数据量时会“窒息”,导致输出质量下降。
  • “更便宜”往往并不便宜。 更低的每 Token 标价会被更多的重试次数、更多的输出 Token 和更差的转化率所抵消。最终,成功完成单次对话的实际成本反而更高。

支持 100 种不同的模型更多是一种营销口号,而非真正的能力。我们宁愿为您提供一个可靠的提供商,也不愿提供五个各具缺陷的模型。


我们自己的模型:Max

我们构建了自己的内部模型 Max——这是一个内部模型加上多轮优化堆栈,并根据平台上的真实对话数据进行了调优。其目标是打造一个比 Claude 成本效益显著更高,同时在平台实际运行的对话模式中保持可靠的模型。这正是 Max 所提供的:仅需 Pro 价格的一小部分(每次操作 0.25 个积分),并经过调优,在普通预算模型容易出错的地方保持准确。

Max 无需任何设置——无需选择模型,无需提供商账户,也无需密钥。它完全在我们的基础设施上运行,是我们发布的最准确的模型:在我们自己的基准测试中,它在忠实于贵公司实际表述方面表现最强。有关 Max 与 Claude 以及客户经常询问的预算型第三方模型之间的详细对比(包括这些模型在我们的测试中实际出错的地方),请参阅 为什么 Max 是最佳选择

谁能看到 Max 层级

如果您的智能体 AI 指令选项卡中的 AI 质量选择器仅显示 ProEconomy,则说明您当前登录的账户未开启 Max。以下两种情况会开启该功能:

  • 拥有符合条件的终身计划的账户会自动获得 Max。
  • 任何其他账户都需要显式启用 Max。

对于由代理机构提供的账户,您的服务提供商可能已经为您选定了模型。 如果 AI 质量选择器仅显示一张卡片且没有其他选项可供切换,这是您账户的特定设置,而非故障——请联系您的账户提供商进行更改。如果某张卡片显示“不可用”的提示,说明您的 Agent 所使用的模型已被提供商移除:它仍会继续回复,但使用的是他们允许的其他模型,因此请选择其中一个,以使选择器与实际运行的模型保持一致。

连接您自己的 Anthropic 密钥 (BYOK) 与 Max 是否可见毫无关系。两者可以并行使用 — 请参阅 设置 BYOK 下的例外说明,了解在连接密钥时 Max 智能体的计费方式。移除 API 密钥不会使 Max 出现。

Mini 层级

如果您可以使用 Max,那么您也可以使用 Mini,价格为 每操作 0.15 积分。Mini 与 Max 使用相同的 AI 模型,但价格更低,不过有两个权衡之处:

  • 出错几率更高。 Mini 是两者中较轻量的模型。Max 是我们提供的最准确的模型——经过严格调优,以确保紧贴您的业务实际内容——而使用 Mini 时,回复中出现小错误或幻觉的几率更高。
  • 内存更轻量。 在长对话中,Mini 记住的旧消息较少,且每次回复调用的知识库片段也较少。

对于任何错误细节可能导致销售损失的场景(如预订、价格咨询、具有实际影响的客服),Max 仍然是推荐选择。Mini 则适用于高频、对价格敏感且速度和成本比最后 1% 的准确性更重要的对话。

Mini 与 Max 位于同一个 AI 质量选择器中,适用于所有拥有 Max 的账户。与 Max 一样,Mini 完全在我们的基础设施上运行,从不使用 BYOK 密钥,因此当 Agent 使用 Mini 时,不会使用(也不会计费)已连接的 Anthropic 密钥。

0.15 Mini 费率涵盖的内容。 Mini 价格适用于实时对话中发生的一切:AI 回复、AI 工具调用(例如预约或提醒人工)、对话评估(决定是否忽略或关闭对话)、中断处理(当联系人在机器人仍在撰写回复时发送新消息)、对话摘要和 AI 自动标记。对话之外的一次性 AI 功能(如营销活动优化、知识库生成以及通过 API 完成的标记)在 Max 和 Mini 上均采用 0.25 积分的统一费率,因此即使所有智能体都设置为 Mini,您的信用记录中偶尔也可能会出现 0.25 的条目。这些是上述功能产生的费用,并非 Max 模型回复您的聊天所致。


设置 BYOK

BYOK 包含在 AgencyAgency Unlimited 计划中,以及 AppSumo Plan 2 及以上的终身层级中。它不属于 Business 计划。如果您的计划包含此功能,您可以连接您自己的 Anthropic API 密钥(这是来自您 Anthropic 账户的私有代码,允许平台直接向您收取 AI 使用费用,而不是使用平台积分)。

仅限使用 Anthropic 官方密钥。 有效的密钥来自您在 console.anthropic.com 的个人账户,且始终以 sk-ant- 开头。来自经销商、代理服务器或“折扣 Claude API”网站(通常以不同前缀开头)的密钥不受支持,且无法保存。请警惕那些远低于 Anthropic 官方价格的廉价 Claude Token 优惠——没有人能够以低于 Anthropic 收费的价格合法转售 Claude 访问权限,这些优惠几乎总是基于被盗密钥的诈骗,或是为了窃取您的支付信息而设置的钓鱼网站。

使用手机? 左侧边栏可能处于隐藏状态。请先点击菜单图标 (),然后点击 Settings(设置)。

在“高级”组中没看到 BYOK API 密钥? 该部分仅在包含 BYOK 的套餐中显示。如果您的账户由服务提供商管理,则仅当他们为您开启了 自带 API 密钥 (Bring Your Own API Key) 功能时,该部分才会显示。

  1. 在主左侧边栏中,点击 Settings(设置,底部附近的齿轮图标)。
  2. 在“设置”页面的左侧菜单中,向下滚动至 Advanced(高级)组。
  3. 点击 BYOK API Keys(BYOK API 密钥)。
  1. 点击 Anthropic 卡片上的 Add key(添加密钥)。此时会出现一个 Secret key(密钥)字段(占位符 sk-ant-…)。
  1. 将您的 Anthropic API 密钥粘贴到该字段中,然后点击 Save key(保存密钥)。

启用后,您的机器人将使用您自己的密钥进行 AI 调用,您将直接向 Anthropic 支付该使用费用,而不是消耗平台积分来支付 AI 回复。渠道基础设施(WhatsApp Web 服务器、电话号码等)仍将照常使用积分。

一个例外 — Max 层级。 如果智能体的 AI 质量设置为 Max 层级,该智能体将完全在我们的内部基础设施上运行,即使您连接了 BYOK,也会按每个操作 0.25 积分计费 — Max 绝不会使用您的 Anthropic 密钥。(Mini 层级也适用此规则,如果可用:每个操作 0.15 积分,绝不使用您的密钥。)若要将回复计费到您自己的 Anthropic 账户,请将智能体保持在 Pro(标准)层级。AI 质量选择器位于每个智能体的 AI 指令选项卡中。当您的密钥已存档但仍有一个或多个智能体在 Max 层级运行时,BYOK API 密钥设置页面会显示通知并列出这些智能体 — 因此您可以一眼看出为什么仍在消耗积分。

关于费用的说明: 使用您自己的密钥不再是更便宜的选择。连接密钥后,您的 Agent 将在 Claude 上运行,您需要直接向 Anthropic 支付按量计费的费用(Anthropic 会根据您的实际使用量向您收费,类似于水电费账单)。对于使用自有密钥的账户,在计入回复所触发的后台工作(知识库查找、垃圾邮件检查、姓名和电子邮件提取、聊天评估、标记)后,单次 AI 回复的成本大约是 Max 费率的 3 倍,是 Mini 费率的 5 倍以上。这些后台工作在 Max 和 Mini 的固定费率中已包含,但在您的密钥下则按 Token 收费。我们的提示词缓存优化也适用于您的自有密钥,因此这并非缓存方面的差距;Max 和 Mini 本身就是成本更低且在我们销售对话基准测试中得分更高的模型。仅在您明确希望 AI 使用费用计入您自己的 Anthropic 账户时才使用 BYOK,而不是为了省钱。

为什么对话中的第一次回复比后续回复成本高得多。 缓存的工作原理是首次发送对话上下文时将其存储在 Anthropic 中,然后进行重用。写入缓存的成本高于普通请求;而重用缓存的每次回复成本大约仅为前者的二十分之一。因此,第一次回复看起来非常昂贵,而之后的回复则非常便宜。对话中任何较大的内容都会增加第一次回复的成本——访客上传的文档是主要原因。一份 24 页的 PDF 大约相当于 70,000 个 token,因为每一页都以文本和图片两种形式发送,并且它会保留在对话中,因此每次回复时都会被重新发送(并重新缓存)。如果对话静默超过一小时,存储的副本就会过期,下一次回复需要再次支付写入费用。

如果您正在构建文档密集型应用(例如合同解释器、手册查询,或任何用户上传文件的场景),Max 层级通常是更好的选择:无论文档有多大,它都按每次回复 0.25 个积分的固定价格收费,因此不会出现首条消息费用激增的情况,也不会有按 token 计费的风险。请参阅 为什么 Max 是最具性价比的选择 以了解 Max 在质量和成本方面的对比。

如果您的 BYOK 密钥失效(无效、超出配额或受到速率限制——意味着 Anthropic 已暂时限制了您的密钥可以发出的请求数量),您的机器人是否继续运行取决于同一 BYOK API 密钥页面上的 “Fallback to credits”(回退至积分)开关:

  • 开启: 平台会暂时回退到使用平台积分,以便您的机器人继续回复,并在后台持续重试您的密钥——一旦调用再次成功,它会自动切换回使用您自己的密钥。
  • 关闭 (默认):AI 回复将被阻止,直到您修复密钥。系统不会静默消耗您的积分,但您的机器人也会停止回复。因此,如果您希望在处理密钥问题时机器人能继续通过积分运行,请提前开启此开关。

无论哪种方式,在您的密钥首次失效时,您都会收到一封电子邮件(而不是每条消息都发)。


常见问题

我可以使用 OpenAI、Gemini 或其他提供商来实现 BYOK 吗? 目前还不支持其他提供商。对于大多数人来说,答案已经在这里了:MaxMini 是我们自己的内部层级,每个操作分别消耗 0.25 和 0.15 个积分。

我的 BYOK 密钥会被用于所有操作吗? 当连接了您自己的 Anthropic 密钥 (BYOK) 时,大多数 AI 操作都是免费的,不收取积分:AI 响应、工具使用、营销活动优化、知识库生成和网络搜索都使用您的密钥运行。即使连接了密钥,仍有四项内容需要消耗积分:Max 层级(每个操作 0.25 积分)和 Mini 层级(每个操作 0.15 积分),因为这两者都是在我们自己的模型上运行的;潜在客户查找(Lead Finder,每个找到的电子邮件地址 0.25 积分);以及自动化(Automations,每次运行 0.25 积分,外加每个 AI 步骤 0.25 积分)。要让代理完全使用您自己的密钥且不消耗积分,请将其保留在 Pro 层级。无论哪种情况,渠道费用(WhatsApp Web 的月费、每条 WhatsApp 消息的发送费和模板费)都与 AI 使用费分开结算。如果密钥在原本应由其运行的调用中失败,平台是否会回退到积分取决于您的“回退到积分”(Fallback to credits)开关——请参阅本页面上方描述的“回退到积分”开关。

AI 回复究竟在什么时候消耗 0 积分? BYOK 是按账户计算的。只有当此账户连接了其自有的 Anthropic 密钥时,AI 回复才会消耗 0 积分。如果没有连接自有密钥,回复将按正常费率消耗积分。

BYOK 会影响消息发送或渠道可靠性吗? 不会。BYOK 仅改变您机器人 AI 调用的计费方式。其他所有功能——消息路由、渠道基础设施、跟进、营销活动和广播——的工作方式完全相同。


另请参阅:为什么 Max 是最具价值的选择 · 设置您的 AI 机器人 · AI 智能体