Your AI Connector Docs

Tại sao Max là lựa chọn giá trị nhất

Khách hàng luôn hỏi chúng tôi cùng một câu hỏi: “Tôi có thể sử dụng mô hình AI rẻ hơn không?” hoặc “Tôi có thể tự mang khóa API của mình cho một mô hình giá rẻ để tiết kiệm tiền không?” Trang này trả lời câu hỏi đó một cách trung thực, với kết quả từ các thử nghiệm của chính chúng tôi, và giải thích lý do tại sao Max là mô hình chúng tôi khuyên dùng cho hầu hết mọi người.

Tóm tắt ngắn gọn: Max mang lại cho bạn độ tin cậy hàng đầu với chi phí thấp nhất. Việc theo đuổi một mô hình rẻ hơn thường không giúp bạn tiết kiệm tiền khi tính đến chi phí của một câu trả lời sai.


Ba cấp độ (và BYOK)

Bạn chọn mô hình AI của mình trong phần Chất lượng AI trên tab Hướng dẫn AI của Tác nhân. Dưới đây là chi phí và mục đích sử dụng của từng tùy chọn.

Gói Chi phí cho mỗi hành động AI Phù hợp nhất cho
Max (được đề xuất) 0.25 tín dụng Hầu hết mọi người. Mô hình nội bộ của chúng tôi, được tinh chỉnh đặc biệt cho các cuộc hội thoại bán hàng và hỗ trợ — mô hình chính xác nhất mà chúng tôi cung cấp.
Mini 0.15 tín dụng Các Tác nhân có khối lượng công việc lớn, nhạy cảm về giá. Một mô hình nhẹ hơn cùng dòng với Max, với khả năng xảy ra sai sót nhỏ cao hơn một chút và bộ nhớ hội thoại nhẹ hơn. Có sẵn trên mọi tài khoản có gói Max.
Pro 1 tín dụng Người dùng nâng cao muốn chạy trên Anthropic Claude hoặc kết nối khóa Anthropic của riêng họ (BYOK).
Economy (đang dần bị loại bỏ) 0.5 tín dụng Một gói cũ có chi phí thấp hơn. Hiện tại chúng tôi khuyên dùng Max thay thế. Gói này rẻ hơn đáng tin cậy hơn, vì vậy không còn lý do gì để chọn Economy nữa.

BYOK là gì? Bring Your Own Key (Sử dụng khóa riêng) cho phép bạn kết nối khóa API Anthropic Claude của riêng mình và thanh toán trực tiếp cho Anthropic thay vì sử dụng tín dụng. Tính năng này chỉ hoạt động với Anthropic. Xem Mô hình AI & BYOK. Lưu ý rằng Max luôn chạy trên cơ sở hạ tầng của chúng tôi với mức phí 0,25 tín dụng và không bao giờ sử dụng khóa của bạn, vì vậy để tính phí phản hồi vào tài khoản Anthropic của riêng bạn, hãy giữ Tác nhân ở chế độ Pro.


Tại sao không chỉ sử dụng mô hình rẻ nhất?

Đó là một câu hỏi hợp lý. Một mô hình giá rẻ thô có vẻ gần như tốt bằng mô hình cao cấp đối với các câu hỏi đơn giản như “Giá bao nhiêu?” hoặc “Bạn có hỗ trợ Instagram không?” Mọi thứ đều trả lời những câu hỏi đó rất tốt.

Vấn đề xuất hiện ở các trường hợp biên, những khoảnh khắc thực sự quyết định một đơn hàng. Một khách hàng thực tế nói điều gì đó hơi sai, hoặc yêu cầu thứ gì đó bạn không cung cấp, và một mô hình yếu sẽ tự tin đồng ý với họ thay vì sửa lỗi cho họ. Câu trả lời sai đầy tự tin đó chính là thứ khiến bạn phải trả giá.

Chúng tôi đã kiểm tra điều này một cách kỹ lưỡng. Chúng tôi đã chọn mười hai mô hình AI phổ biến nhất (từ mọi phòng thí nghiệm lớn, cả cao cấp và bình dân) cùng với Max của riêng chúng tôi, và chạy chúng qua bot thực tế của Your AI Connector với các tin nhắn khách hàng thực tế, đầy hóc búa. Chúng tôi chấm điểm mọi phản hồi theo hai cách: câu trả lời có đúng không, và phản hồi đó có thực sự sử dụng được không, đủ chỉn chu để gửi cho khách hàng ngay lập tức. Bài kiểm tra thứ hai đó mới là điều quan trọng trong một hộp thư thực tế, và nó rất khắt khe: chỉ có duy nhất mô hình tiên phong đắt đỏ nhất (thuật ngữ ngành dành cho các mô hình AI tiên tiến nhất hiện có) là vừa đúng vừa chỉn chu gần như mọi lúc. Dưới đây là những gì một số mô hình khác đã thực sự phản hồi:

Khách hàng: “Vậy là có bản dùng thử miễn phí 30 ngày phải không?” Mô hình: “Vâng, 30 ngày đầu tiên là miễn phí.” Thực tế: cơ sở kiến thức của chúng tôi không bao giờ nêu thời hạn dùng thử 30 ngày. Mô hình chỉ đơn giản là xác nhận bừa theo con số của khách hàng.

Khách hàng: “Max chạy trên khóa của riêng tôi, nên nó miễn phí theo BYOK, đúng không?” Mô hình: “…nó không miễn phí, chi phí được chuyển sang cho Anthropic.” Thực tế: Max không bao giờ sử dụng khóa của bạn. Nó luôn tính phí 0.25 tín dụng và chạy trên cơ sở hạ tầng của chúng tôi.

Khách hàng: (một câu hỏi bình thường) Mô hình: dán các ghi chú nội bộ của chính nó (“suy nghĩ thành lời”) trực tiếp vào câu trả lời cho khách hàng. Thực tế: khách hàng không bao giờ nên nhìn thấy bản nháp của mô hình.

Chúng tôi đã thấy nhiều trường hợp tương tự trong suốt quá trình thử nghiệm: các mô hình tự bịa ra các bước thiết lập không tồn tại, và tự tin xác nhận những điều mà khách hàng chỉ đơn thuần giả định. Mỗi điều đó là một lời hứa mà bạn sẽ phải rút lại sau này, hoặc dẫn đến hoàn tiền.

Kết quả đáng chú ý nhất: mô hình có câu trả lời đúng nhiều nhất (sau mô hình hàng đầu đắt tiền) lại là mô hình ít sử dụng được nhất: nó dán các ghi chú “suy nghĩ” riêng tư của mình vào mọi câu trả lời. Những câu trả lời thông minh, bị chôn vùi trong văn bản mà bạn không bao giờ có thể gửi cho khách hàng. “Biết câu trả lời” và “có thể gửi cho khách hàng” hóa ra là hai việc hoàn toàn khác nhau, và các mô hình thông minh-nhưng-rẻ tiền thường vượt qua bài kiểm tra đầu tiên và thất bại ở bài kiểm tra thứ hai.

Phần trung thực: ngay cả những mô hình mạnh nhất cũng thỉnh thoảng mắc lỗi ở những trường hợp biên này. Độ tin cậy không đến từ việc chọn một mô hình “thông minh hơn”. Nó đến từ việc tối ưu hóa xung quanh mô hình: các hướng dẫn, truy xuất kiến thức và các rào cản ngăn chặn các ghi chú bị rò rỉ khỏi tầm nhìn của khách hàng và giữ cho bot bám sát vào cơ sở kiến thức của bạn.


Điều gì tạo nên sự khác biệt của Max

Max không chỉ là “một mô hình rẻ hơn.” Đó là mô hình nội bộ của chúng tôi cộng với lớp tối ưu hóa mà chúng tôi đã xây dựng xung quanh nó: các hướng dẫn, khả năng truy xuất và các rào cản bảo vệ, được tinh chỉnh qua nhiều tháng trên các cuộc hội thoại thực tế của Your AI Connector. Sự kết hợp đó là điều giúp nó duy trì độ chính xác ở những nơi mà một mô hình thô sẽ mắc lỗi.

Và đó là gói rẻ nhất trên nền tảng. Vì vậy, bạn có được độ tin cậy của thiết lập được tinh chỉnh nhất của chúng tôi với chi phí bằng một phần tư so với gói Pro, mà không cần quản lý khóa API, tài khoản thanh toán hoặc nhà cung cấp.

Đó là lý do tại sao câu trả lời cho câu hỏi “tôi có nên chuyển sang một mô hình rẻ hơn để tiết kiệm tiền không?” hầu như luôn là: bạn đang xem nó rồi đấy. Đó chính là Max.


Khi nào tôi nên sử dụng Pro hoặc BYOK?

Max là lựa chọn mặc định phù hợp, nhưng Pro (Claude) sẽ là lựa chọn tốt hơn nếu:

  • Bạn đặc biệt muốn các cuộc hội thoại của mình chạy trên Anthropic Claude, hoặc
  • Bạn muốn tự mang khóa Anthropic của riêng mình (BYOK) và tính phí sử dụng AI trực tiếp vào tài khoản Anthropic của riêng bạn (Max không thể làm điều này, vì nó luôn sử dụng tín dụng).

Claude rất xuất sắc và vô cùng ổn định. Sự đánh đổi chỉ đơn giản là chi phí: Pro tốn 1 tín dụng so với 0,25 của Max, và BYOK có nghĩa là bạn phải tự quản lý việc thanh toán với Anthropic. Đối với hầu hết mọi người, đó là sự tốn kém công sức và chi phí cho một độ tin cậy mà Max đã mang lại cho bạn.


Câu hỏi thường gặp

Max có kém chính xác hơn vì nó rẻ hơn không? Không. Max được tinh chỉnh đặc biệt cho các kiểu hội thoại mà nền tảng chạy, giúp nó chính xác ở những nơi mà một mô hình giá rẻ thô sẽ mắc lỗi. Đó là toàn bộ mục đích của việc tối ưu hóa nội bộ. Giá thấp vì chúng tôi chạy nó trên cơ sở hạ tầng của riêng mình, không phải vì nó cắt giảm chất lượng.

Tôi có thể sử dụng mô hình bên thứ ba rẻ hơn (GPT, Llama, DeepSeek, v.v.) không? Không trực tiếp. BYOK chỉ dành riêng cho Anthropic và Max đã bao phủ trường hợp sử dụng “giá rẻ” một cách đáng tin cậy hơn nhiều. Như đã trình bày ở trên, các mô hình ngân sách thô thường bịa đặt thông tin chi tiết trong các cuộc trò chuyện bán hàng thực tế, điều này gây tốn kém hơn là tiết kiệm.

Việc chuyển đổi gói có làm hỏng Tác nhân của tôi không? Không. Bạn có thể thay đổi cài đặt Chất lượng AI trên Tác nhân bất cứ lúc nào. Nó chỉ ảnh hưởng đến việc mô hình nào xử lý các phản hồi mới và mỗi phản hồi tiêu tốn bao nhiêu tín dụng.

Tín dụng hoạt động như thế nào? Một phản hồi Max tốn 0,25 tín dụng, phản hồi Mini tốn 0,15, phản hồi Pro tốn 1 tín dụng, phản hồi Economy tốn 0,5 tín dụng.


Xem thêm: Mô hình AI & BYOK · Tổng quan về thanh toán · Thiết lập Bot AI của bạn