AI 模型与 BYOK
本页面介绍了驱动您机器人的 AI 模型、为什么 **BYOK(自带密钥,Bring Your Own Key)**仅支持一个提供商,以及如果您的套餐包含该功能,如何设置您自己的密钥。
驱动机器人的 AI 模型
本平台使用 Anthropic Claude 作为您机器人的主要模型。之所以选择 Claude,是因为在对市场上所有主流前沿模型(指目前最先进的 AI 模型)进行广泛测试后,它是唯一能够可靠处理生产环境消息量的模型。
您无需选择模型。平台会自动为每项任务选择合适的模型,并在后台优化其使用方式(包括先进的提示词缓存技术,这能显著降低单次对话的成本)。
为什么 BYOK 仅支持 Anthropic
客户经常询问我们是否会为 BYOK 增加对 OpenAI、Google Gemini、OpenRouter 或开源模型的支持。诚实的回答是:它们中的任何一个,如果未经优化直接使用,都无法支撑生产环境的业务量。
对于小型项目,AI 达到 10 分之 9 的成功率是可以接受的。 一旦您开始大规模处理真实的客户对话,10% 的失败率就意味着预约中断、回答错误、错过跟进以及销售流失。即使是其他提供商的顶级前沿模型,我们观察到的情况也大致如此(在对抗性边缘案例,即棘手且刻意设计的难题上,失败率约为 6-10%)——这还没算上那些更廉价的模型。
问题主要分为三类:
- 边缘案例不可预测地崩溃。 模型可能在数百次聊天中表现完美,然后突然在工具调用中产生幻觉、声称执行了未完成的操作,或在对话中途丢失指令。
- 长上下文处理能力较差。 单次机器人回复需要使用聊天记录、常见问题解答、跟进逻辑、工具调用和推理。大多数模型在处理这种数据量时会“窒息”,导致输出质量下降。
- “更便宜”往往并不便宜。 更低的每 Token 标价会被更多的重试次数、更多的输出 Token 和更差的转化率所抵消。最终,成功完成单次对话的实际成本反而更高。
支持 100 种不同的模型更多是一种营销口号,而非真正的能力。我们宁愿为您提供一个可靠的提供商,也不愿提供五个各具缺陷的模型。
我们自己的模型:Max
我们构建了自己的内部模型 Max——这是一个内部模型加上多轮优化堆栈,并根据平台上的真实对话数据进行了调优。其目标是打造一个比 Claude 成本效益显著更高,同时在平台实际运行的对话模式中保持可靠的模型。这正是 Max 所提供的:仅需 Pro 价格的一小部分(每次操作 0.25 个积分),并经过调优,在普通预算模型容易出错的地方保持准确。
Max 无需任何设置——无需选择模型,无需提供商账户,也无需密钥。它完全在我们的基础设施上运行,是我们发布的最准确的模型:在我们自己的基准测试中,它在忠实于贵公司实际表述方面表现最强。有关 Max 与 Claude 以及客户经常询问的预算型第三方模型之间的详细对比(包括这些模型在我们的测试中实际出错的地方),请参阅 为什么 Max 是最佳选择。
谁能看到 Max 层级
如果您的智能体 AI 指令选项卡中的 AI 质量选择器仅显示 Pro 和 Economy,则说明您当前登录的账户未开启 Max。以下两种情况会开启该功能:
- 拥有符合条件的终身计划的账户会自动获得 Max。
- 任何其他账户都需要显式启用 Max。
对于由代理机构提供的账户,您的服务提供商可能已经为您选定了模型。 如果 AI 质量选择器仅显示一张卡片且没有其他选项可供切换,这是您账户的特定设置,而非故障——请联系您的账户提供商进行更改。如果某张卡片显示“不可用”的提示,说明您的 Agent 所使用的模型已被提供商移除:它仍会继续回复,但使用的是他们允许的其他模型,因此请选择其中一个,以使选择器与实际运行的模型保持一致。
连接您自己的 Anthropic 密钥 (BYOK) 与 Max 是否可见毫无关系。两者可以并行使用 — 请参阅 设置 BYOK 下的例外说明,了解在连接密钥时 Max 智能体的计费方式。移除 API 密钥不会使 Max 出现。
Mini 层级
如果您可以使用 Max,那么您也可以使用 Mini,价格为 每操作 0.15 积分。Mini 与 Max 使用相同的 AI 模型,但价格更低,不过有两个权衡之处:
- 出错几率更高。 Mini 是两者中较轻量的模型。Max 是我们提供的最准确的模型——经过严格调优,以确保紧贴您的业务实际内容——而使用 Mini 时,回复中出现小错误或幻觉的几率更高。
- 内存更轻量。 在长对话中,Mini 记住的旧消息较少,且每次回复调用的知识库片段也较少。
对于任何错误细节可能导致销售损失的场景(如预订、价格咨询、具有实际影响的客服),Max 仍然是推荐选择。Mini 则适用于高频、对价格敏感且速度和成本比最后 1% 的准确性更重要的对话。
Mini 与 Max 位于同一个 AI 质量选择器中,适用于所有拥有 Max 的账户。与 Max 一样,Mini 完全在我们的基础设施上运行,从不使用 BYOK 密钥,因此当 Agent 使用 Mini 时,不会使用(也不会计费)已连接的 Anthropic 密钥。
0.15 Mini 费率涵盖的内容。 Mini 价格适用于实时对话中发生的一切:AI 回复、AI 工具调用(例如预约或提醒人工)、对话评估(决定是否忽略或关闭对话)、中断处理(当联系人在机器人仍在撰写回复时发送新消息)、对话摘要和 AI 自动标记。对话之外的一次性 AI 功能(如营销活动优化、知识库生成以及通过 API 完成的标记)在 Max 和 Mini 上均采用 0.25 积分的统一费率,因此即使所有智能体都设置为 Mini,您的信用记录中偶尔也可能会出现 0.25 的条目。这些是上述功能产生的费用,并非 Max 模型回复您的聊天所致。
设置 BYOK
BYOK 包含在 Agency 和 Agency Unlimited 计划中,以及 AppSumo Plan 2 及以上的终身层级中。它不属于 Business 计划。如果您的计划包含此功能,您可以连接您自己的 Anthropic API 密钥(这是来自您 Anthropic 账户的私有代码,允许平台直接向您收取 AI 使用费用,而不是使用平台积分)。
仅限使用 Anthropic 官方密钥。 有效的密钥来自您在 console.anthropic.com 的个人账户,且始终以
sk-ant-开头。来自经销商、代理服务器或“折扣 Claude API”网站(通常以不同前缀开头)的密钥不受支持,且无法保存。请警惕那些远低于 Anthropic 官方价格的廉价 Claude Token 优惠——没有人能够以低于 Anthropic 收费的价格合法转售 Claude 访问权限,这些优惠几乎总是基于被盗密钥的诈骗,或是为了窃取您的支付信息而设置的钓鱼网站。
使用手机? 左侧边栏可能处于隐藏状态。请先点击菜单图标 (☰),然后点击 Settings(设置)。
在“高级”组中没看到 BYOK API 密钥? 该部分仅在包含 BYOK 的套餐中显示。如果您的账户由服务提供商管理,则仅当他们为您开启了 自带 API 密钥 (Bring Your Own API Key) 功能时,该部分才会显示。
- 在主左侧边栏中,点击 Settings(设置,底部附近的齿轮图标)。
- 在“设置”页面的左侧菜单中,向下滚动至 Advanced(高级)组。
- 点击 BYOK API Keys(BYOK API 密钥)。
- 点击 Anthropic 卡片上的 Add key(添加密钥)。此时会出现一个 Secret key(密钥)字段(占位符
sk-ant-…)。
- 将您的 Anthropic API 密钥粘贴到该字段中,然后点击 Save key(保存密钥)。
启用后,您的机器人将使用您自己的密钥进行 AI 调用,您将直接向 Anthropic 支付该使用费用,而不是消耗平台积分来支付 AI 回复。渠道基础设施(WhatsApp Web 服务器、电话号码等)仍将照常使用积分。
一个例外 — Max 层级。 如果智能体的 AI 质量设置为 Max 层级,该智能体将完全在我们的内部基础设施上运行,即使您连接了 BYOK,也会按每个操作 0.25 积分计费 — Max 绝不会使用您的 Anthropic 密钥。(Mini 层级也适用此规则,如果可用:每个操作 0.15 积分,绝不使用您的密钥。)若要将回复计费到您自己的 Anthropic 账户,请将智能体保持在 Pro(标准)层级。AI 质量选择器位于每个智能体的 AI 指令选项卡中。当您的密钥已存档但仍有一个或多个智能体在 Max 层级运行时,BYOK API 密钥设置页面会显示通知并列出这些智能体 — 因此您可以一眼看出为什么仍在消耗积分。
关于费用的说明: 使用您自己的密钥不再是更便宜的选择。连接密钥后,您的 Agent 将在 Claude 上运行,您需要直接向 Anthropic 支付按量计费的费用(Anthropic 会根据您的实际使用量向您收费,类似于水电费账单)。对于使用自有密钥的账户,在计入回复所触发的后台工作(知识库查找、垃圾邮件检查、姓名和电子邮件提取、聊天评估、标记)后,单次 AI 回复的成本大约是 Max 费率的 3 倍,是 Mini 费率的 5 倍以上。这些后台工作在 Max 和 Mini 的固定费率中已包含,但在您的密钥下则按 Token 收费。我们的提示词缓存优化也适用于您的自有密钥,因此这并非缓存方面的差距;Max 和 Mini 本身就是成本更低且在我们销售对话基准测试中得分更高的模型。仅在您明确希望 AI 使用费用计入您自己的 Anthropic 账户时才使用 BYOK,而不是为了省钱。
为什么对话中的第一次回复比后续回复成本高得多。 缓存的工作原理是首次发送对话上下文时将其存储在 Anthropic 中,然后进行重用。写入缓存的成本高于普通请求;而重用缓存的每次回复成本大约仅为前者的二十分之一。因此,第一次回复看起来非常昂贵,而之后的回复则非常便宜。对话中任何较大的内容都会增加第一次回复的成本——访客上传的文档是主要原因。一份 24 页的 PDF 大约相当于 70,000 个 token,因为每一页都以文本和图片两种形式发送,并且它会保留在对话中,因此每次回复时都会被重新发送(并重新缓存)。如果对话静默超过一小时,存储的副本就会过期,下一次回复需要再次支付写入费用。
如果您正在构建文档密集型应用(例如合同解释器、手册查询,或任何用户上传文件的场景),Max 层级通常是更好的选择:无论文档有多大,它都按每次回复 0.25 个积分的固定价格收费,因此不会出现首条消息费用激增的情况,也不会有按 token 计费的风险。请参阅 为什么 Max 是最具性价比的选择 以了解 Max 在质量和成本方面的对比。
如果您的 BYOK 密钥失效(无效、超出配额或受到速率限制——意味着 Anthropic 已暂时限制了您的密钥可以发出的请求数量),您的机器人是否继续运行取决于同一 BYOK API 密钥页面上的 “Fallback to credits”(回退至积分)开关:
- 开启: 平台会暂时回退到使用平台积分,以便您的机器人继续回复,并在后台持续重试您的密钥——一旦调用再次成功,它会自动切换回使用您自己的密钥。
- 关闭 (默认):AI 回复将被阻止,直到您修复密钥。系统不会静默消耗您的积分,但您的机器人也会停止回复。因此,如果您希望在处理密钥问题时机器人能继续通过积分运行,请提前开启此开关。
无论哪种方式,在您的密钥首次失效时,您都会收到一封电子邮件(而不是每条消息都发)。
常见问题
我可以使用 OpenAI、Gemini 或其他提供商来实现 BYOK 吗? 目前还不支持其他提供商。对于大多数人来说,答案已经在这里了:Max 和 Mini 是我们自己的内部层级,每个操作分别消耗 0.25 和 0.15 个积分。
我的 BYOK 密钥会被用于所有操作吗? 当连接了您自己的 Anthropic 密钥 (BYOK) 时,大多数 AI 操作都是免费的,不收取积分:AI 响应、工具使用、营销活动优化、知识库生成和网络搜索都使用您的密钥运行。即使连接了密钥,仍有四项内容需要消耗积分:Max 层级(每个操作 0.25 积分)和 Mini 层级(每个操作 0.15 积分),因为这两者都是在我们自己的模型上运行的;潜在客户查找(Lead Finder,每个找到的电子邮件地址 0.25 积分);以及自动化(Automations,每次运行 0.25 积分,外加每个 AI 步骤 0.25 积分)。要让代理完全使用您自己的密钥且不消耗积分,请将其保留在 Pro 层级。无论哪种情况,渠道费用(WhatsApp Web 的月费、每条 WhatsApp 消息的发送费和模板费)都与 AI 使用费分开结算。如果密钥在原本应由其运行的调用中失败,平台是否会回退到积分取决于您的“回退到积分”(Fallback to credits)开关——请参阅本页面上方描述的“回退到积分”开关。
AI 回复究竟在什么时候消耗 0 积分? BYOK 是按账户计算的。只有当此账户连接了其自有的 Anthropic 密钥时,AI 回复才会消耗 0 积分。如果没有连接自有密钥,回复将按正常费率消耗积分。
BYOK 会影响消息发送或渠道可靠性吗? 不会。BYOK 仅改变您机器人 AI 调用的计费方式。其他所有功能——消息路由、渠道基础设施、跟进、营销活动和广播——的工作方式完全相同。
另请参阅:为什么 Max 是最具价值的选择 · 设置您的 AI 机器人 · AI 智能体