Your AI Connector Docs

מודל AI ו-BYOK

דף זה מסביר איזה מודל AI מפעיל את הבוט שלך, מדוע נתמך רק ספק אחד עבור BYOK (הבא מפתח משלך), וכיצד להגדיר מפתח משלך אם התוכנית שלך כוללת זאת.


איזה מודל AI מפעיל את הבוט

הפלטפורמה משתמשת ב-Anthropic Claude כמודל העיקרי עבור הבוט שלך. Claude נבחר מכיוון שאחרי בדיקות מקיפות של כל מודל חזיתי מרכזי (מונח בתעשייה למודלי ה-AI המתקדמים ביותר הקיימים) בשוק, הוא היחיד שמטפל בנפח הודעות בייצור בצורה אמינה.

אינך צריך לבחור מודל. הפלטפורמה בוחרת אוטומטית את המודל הנכון לכל משימה ומבצעת אופטימיזציה לאופן השימוש בו מאחורי הקלעים (כולל מטמון הנחיות מתקדם, שמפחית משמעותית את העלות לשיחה).


מדוע רק Anthropic עבור BYOK

לקוחות שואלים לעיתים קרובות האם נוסיף תמיכה ב-OpenAI, Google Gemini, OpenRouter או במודלים של קוד פתוח עבור BYOK. התשובה הכנה היא: אף אחד מהם, בשימוש גולמי ולא מותאם, לא עומד בעומסי עבודה של סביבת ייצור.

עבור פרויקט קטן, שיעור הצלחה של 9 מתוך 10 מצד AI הוא בסדר גמור. ברגע שאתה מנהל שיחות אמיתיות עם לקוחות בהיקף נרחב, שיעור כשל של 10% משמעותו הזמנות שבורות, תשובות שגויות, מעקבים שהוחמצו ומכירות שאבדו. זהו בערך הטווח שאנו רואים אפילו ממודלים חזיתיים מהשורה הראשונה של ספקים אחרים (בערך 6–10% במקרי קצה עוינים, כלומר שאלות מבחן טריקיות וקשות בכוונה) — וזה עוד לפני שלוקחים בחשבון את המודלים הזולים יותר.

הבעיות מתחלקות לשלוש קטגוריות:

  • מקרים חריגים גורמים לתקלות בלתי צפויות. מודל יכול לעבוד בצורה מושלמת במשך מאות צ’אטים, ואז פתאום להזות קריאת כלי, לטעון שעשה משהו שלא עשה, או לזנוח הוראות באמצע שיחה.
  • טיפול לקוי בהקשר ארוך. תגובת בוט בודדת משתמשת בהיסטוריית צ’אט, שאלות נפוצות, לוגיקת מעקב, קריאות כלי והסקה. רוב המודלים נחנקים מהנפח הזה ומפיקים פלט גרוע יותר.
  • “זול יותר” הוא לעיתים נדירות באמת זול. המחיר הנמוך לטוקן מתקזז על ידי יותר ניסיונות חוזרים, יותר טוקני פלט והמרה גרועה יותר. העלות האמיתית לשיחה מוצלחת מסתיימת להיות גבוהה יותר.

תמיכה ב-100 מודלים שונים היא יותר סיסמה שיווקית מאשר יכולת אמיתית. אנו מעדיפים לתת לך ספק אחד שעובד בצורה אמינה מאשר חמישה שכל אחד מהם נכשל בדרכים שונות.


המודל שלנו: Max

בנינו מודל פנימי משלנו, Max — מודל פנימי בתוספת מחסנית אופטימיזציה רב-שלבית, שעבר שכלול על בסיס נתוני שיחה אמיתיים מהפלטפורמה. המטרה הייתה ליצור מודל חסכוני משמעותית בעלויות בהשוואה ל-Claude, תוך שמירה על אמינות בדפוסי השיחה שמתקיימים בפועל בפלטפורמה, וזה בדיוק מה ש-Max מספק: שבריר מהמחיר של Pro (0.25 קרדיטים לפעולה), מכויל כדי להישאר מדויק במקומות שבהם מודל תקציבי גולמי עלול לטעות.

Max אינו דורש הגדרה כלל — ללא בחירת מודל, ללא חשבון ספק וללא מפתח. הוא פועל במלואו על התשתית שלנו, והוא המודל המדויק ביותר שאנו מציעים: במבחני הביצועים שלנו הוא החזק ביותר בהיצמדות למה שהעסק שלך באמת אומר. לפירוט מלא של האופן שבו Max משתווה ל-Claude ולמודלים הזולים של צד שלישי שלקוחות שואלים עליהם לעיתים קרובות — כולל מה אותם מודלים עשו לא נכון בבדיקות שלנו — עיינו ב-מדוע Max הוא הערך הטוב ביותר.

מי רואה את שכבת Max

אם בבורר איכות ה-AI בכרטיסיית הוראות ה-AI של הסוכן שלך מופיעות רק האפשרויות Pro ו-Economy, סימן ש-Max פשוט לא מופעל בחשבון שאליו נכנסת. שני דברים מפעילים אותו:

  • חשבונות במסלול Lifetime זכאי מקבלים את Max באופן אוטומטי.
  • כל חשבון אחר דורש הפעלה מפורשת של Max עבורו.

בחשבון שסופק על ידי סוכנות, ייתכן שהספק שלך בחר את המודל עבורך. אם בורר איכות ה-AI מציג כרטיס אחד בלבד ואין אפשרות לעבור לאחר, מדובר בהגדרה מכוונת בחשבונך, לא בתקלה — פנה למי שמספק לך את החשבון כדי לשנות זאת. אם עדיין מוצג כרטיס עם הערה שהוא אינו זמין יותר, הסוכן שלך פועל על מודל שהספק שלך הסיר מאז: הוא ימשיך להשיב, אך באחד המודלים שהם כן מאפשרים, לכן בחר באחד מאלה כדי שהבורר יתאים למה שרץ בפועל.

לחיבור מפתח Anthropic משלך (BYOK) אין שום קשר לשאלה אם Max גלוי. השניים עובדים זה לצד זה — עיין בהערת החריגה תחת הגדרת BYOK כדי לדעת כיצד סוכן Max מחויב כאשר יש לך מפתח מחובר. הסרת מפתח ה-API שלך לא תגרום ל-Max להופיע.

שכבת ה-Mini

אם אתם יכולים לראות את Max, אתם יכולים לראות גם את Mini, בעלות של 0.15 קרדיטים לפעולה. Mini הוא אותו מודל בינה מלאכותית כמו Max במחיר נמוך יותר, עם שתי פשרות:

  • סיכוי גבוה יותר לטעויות. Mini הוא הדגם הקל מבין השניים. Max הוא הדגם המדויק ביותר שאנו מספקים — הוא מכוונן בצורה המקסימלית כדי להיצמד למה שהעסק שלך באמת אומר — בעוד שעם Mini קיים סיכוי גבוה יותר לטעות קטנה או להזיה (hallucination) שתשתרבב לתשובה.
  • זיכרון קל יותר. בשיחות ארוכות, Mini זוכר פחות מהודעות קודמות ושולף פחות קטעי מידע ממאגר הידע עבור כל תשובה.

Max נשאר הבחירה המומלצת לכל דבר שבו פרט שגוי עלול לעלות במכירה — הזמנות, שאלות על תמחור, ותמיכה עם סיכונים אמיתיים. Mini מתאים לשיחות בנפח גבוה ורגישות למחיר, שבהן מהירות ועלות חשובות יותר מאחוז הדיוק האחרון.

Mini נמצא באותו בורר איכות בינה מלאכותית כמו Max, בכל חשבון שיש בו Max. בדומה ל-Max,‏ Mini פועל במלואו על התשתית שלנו ולעולם אינו משתמש במפתח BYOK, לכן מפתח Anthropic מחובר אינו בשימוש (ואינו מחויב) בזמן שסוכן מוגדר על Mini.

מה מכסה התעריף של 0.15 עבור Mini. המחיר של Mini חל על כל מה שקורה בתוך שיחה חיה: תשובות של בינה מלאכותית, קריאות לכלי בינה מלאכותית (כמו קביעת פגישה או התרעה לנציג אנושי), הערכות צ’אט (החלטה אם יש להתעלם משיחה או לסגור אותה), טיפול בהפרעות (כאשר איש קשר שולח הודעה חדשה בזמן שהבוט עדיין מנסח את תשובתו), סיכומי צ’אט ותיוג אוטומטי על ידי בינה מלאכותית. תכונות בינה מלאכותית חד-פעמיות מחוץ לשיחה — אופטימיזציה של קמפיינים, יצירת מאגר ידע ותיוג המתבצע דרך ה-API — כוללות תעריף אחיד של 0.25 קרדיטים גם ב-Max וגם ב-Mini, לכן ייתכן שתראה רישומים מזדמנים של 0.25 בהיסטוריית הקרדיטים שלך גם כאשר כל סוכן מוגדר ל-Mini. אלו הן התכונות הללו, ולא מודל ה-Max שעונה על הצ’אטים שלך.


הגדרת BYOK

BYOK כלול בתוכניות Agency ו-Agency Unlimited, ובשכבות ה-lifetime של AppSumo מ-Plan 2 ומעלה. הוא אינו חלק מתוכנית ה-Business. אם התוכנית שלך כוללת אותו, באפשרותך לחבר מפתח API משלך של Anthropic (קוד פרטי מחשבון ה-Anthropic שלך המאפשר לפלטפורמה לחייב אותך ישירות על השימוש ב-AI במקום להשתמש בקרדיטים של הפלטפורמה).

רק מפתחות רשמיים של Anthropic עובדים. מפתח תקין מגיע מהחשבון האישי שלך ב-console.anthropic.com ותמיד מתחיל ב-sk-ant-. מפתחות ממשווקים, שרתים מתווכים (proxies) או אתרים של “Claude API בהנחה” (שלעיתים קרובות מתחילים בקידומת שונה) אינם נתמכים ולא יישמרו. היזהרו מהצעות לטוקנים זולים של Claude במחירים נמוכים משמעותית מהמחירים של Anthropic עצמה — איש אינו יכול למכור גישה ל-Claude באופן לגיטימי מתחת למחיר ש-Anthropic גובה, והצעות אלו הן כמעט תמיד הונאות המבוססות על מפתחות גנובים או שנועדו לדוג (phishing) את פרטי התשלום שלכם.

נמצא בטלפון? סרגל הצד השמאלי עשוי להיות מוסתר. הקש תחילה על סמל התפריט (), ולאחר מכן הקש על Settings.

לא רואה את מפתחות ה-API של BYOK בקבוצת ‘מתקדם’? המקטע מופיע רק בתוכניות הכוללות BYOK. אם החשבון שלך מנוהל על ידי ספק, הוא יופיע רק כאשר הספק הפעיל את הבא מפתח API משלך (Bring Your Own API Key) עבור החשבון שלך.

  1. בסרגל הצד השמאלי הראשי, לחץ על Settings (סמל גלגל השיניים ליד החלק התחתון).
  2. בדף ההגדרות, בתפריט השמאלי, גלול לקבוצת Advanced.
  3. לחץ על BYOK API Keys.
  1. לחץ על Add key בכרטיס Anthropic. יופיע שדה Secret key (מציין מיקום sk-ant-…).
  1. הדבק את מפתח ה-API של Anthropic שלך בשדה, ולאחר מכן לחץ על Save key.

לאחר ההפעלה, הבוט שלך ישתמש במפתח האישי שלך עבור קריאות AI, ואתה תשלם ל-Anthropic ישירות עבור שימוש זה במקום להשתמש בקרדיטים של הפלטפורמה עבור תגובות ה-AI. תשתית הערוצים (שרתי WhatsApp Web, מספרי טלפון וכו’) תמשיך להשתמש בקרדיטים כרגיל.

חריגה אחת — שכבת ה-Max. אם איכות ה-AI של סוכן מוגדרת לשכבת Max, הסוכן פועל במלואו על התשתית הפנימית שלנו ומחויב ב-0.25 קרדיטים לכל פעולה גם כאשר יש לך BYOK מחובר — Max לעולם לא משתמש במפתח ה-Anthropic שלך. (אותו דבר חל על Mini, היכן שזמין: 0.15 קרדיטים לכל פעולה, לעולם לא מהמפתח שלך.) כדי לחייב תשובות בחשבון ה-Anthropic שלך, השאר את הסוכן בשכבת Pro (סטנדרט). בורר איכות ה-AI נמצא בכרטיסיית הוראות ה-AI של כל סוכן. דף הגדרות מפתחות ה-API של BYOK מציג הודעה בכל פעם שהמפתח שלך נמצא במערכת אך אחד או יותר מהסוכנים שלך עדיין פועלים בשכבת Max, ומפרט אילו מהם — כך שתוכל לזהות במבט חטוף מדוע עדיין נעשה שימוש בקרדיטים.

הערה לגבי עלות: הבאת מפתח משלך אינה עוד האופציה הזולה. כאשר מפתח מחובר, הסוכן שלך פועל על Claude ואתה משלם את התעריפים המדודים של Anthropic ישירות (Anthropic מחייבת אותך על סמך השימוש בפועל, בדומה לחשבון שירות). בחישוב המבוסס על חשבונות המשתמשים במפתח משלהם, תשובת AI אחת עולה בערך פי 3 מעלות אותה תשובה ב-Max ופי 5 מעלותה ב-Mini, ברגע שלוקחים בחשבון את עבודת הרקע שתשובה מפעילה (חיפוש בבסיס ידע, בדיקת דואר זבל, חילוץ שם ואימייל, הערכות צ’אט, תיוג), שכולם כלולים בתעריף הקבוע של Max ו-Mini אך מחויבים לפי אסימון (token) במפתח שלך. אופטימיזציות שמירת ה-prompt במטמון שלנו חלות גם על המפתח שלך, כך שזה לא פער של מטמון; Max ו-Mini הם פשוט מודלים זולים הרבה יותר שגם מקבלים ציון גבוה יותר במדד שיחות המכירה שלנו. השתמש ב-BYOK כאשר אתה רוצה במיוחד ששימוש ה-AI יחויב בחשבון ה-Anthropic שלך, ולא כדי לחסוך כסף.

מדוע התגובה הראשונה בשיחה עולה הרבה יותר מהשאר. מנגנון המטמון (Caching) פועל על ידי שמירת ההקשר של השיחה אצל Anthropic בפעם הראשונה שהיא נשלחת, ולאחר מכן שימוש חוזר בו. הכתיבה שלו עולה יותר מבקשה רגילה; כל תגובה שעושה בו שימוש חוזר עולה בערך עשרים אחוז מהעלות. לכן התגובה הראשונה נראית יקרה באופן מדאיג, בעוד שאלו שאחריה זולות מאוד. כל דבר גדול בשיחה הופך את התגובה הראשונה לגדולה יותר — מסמך שמבקר מעלה הוא הגורם העיקרי לכך. קובץ PDF בן 24 עמודים מסתכם בכ-70,000 אסימונים (tokens), מכיוון שכל עמוד נשלח גם כטקסט וגם כתמונה של העמוד, והוא נשאר בשיחה, כך שהוא נשלח מחדש (ונשמר במטמון מחדש) עם כל תגובה. אם שיחה נשארת שקטה במשך יותר משעה, העותק השמור פג תוקפו והתגובה הבאה משלמת שוב את עלות הכתיבה.

אם אתם בונים משהו עתיר מסמכים — מסבירי חוזים, חיפוש במדריכים, או כל דבר שבו אנשים מעלים קבצים — שכבת ה-Max היא בדרך כלל ההתאמה הטובה יותר: היא עולה 0.25 קרדיטים קבועים לכל תגובה ללא קשר לגודל המסמך, כך שאין זינוק בעלות ההודעה הראשונה ואין חשיפה לעלויות לפי אסימון כלל. ראו מדוע Max הוא הערך הטוב ביותר כדי לראות כיצד Max משתווה מבחינת איכות ועלות.

אם מפתח ה-BYOK שלך נכשל (לא תקין, חריגה ממכסה, או הגבלת קצב — כלומר Anthropic הגבילה זמנית את מספר הבקשות שהמפתח שלך יכול לבצע), השאלה האם הבוט שלך ימשיך לפעול תלויה במתג “Fallback to credits” באותו דף של מפתחות BYOK API:

  • מופעל (On): הפלטפורמה עוברת זמנית לשימוש בקרדיטים של הפלטפורמה כך שהבוט שלך ימשיך להשיב, והיא תמשיך לנסות להשתמש במפתח שלך ברקע — ברגע שקריאה תצליח שוב, היא תחזיר אותך אוטומטית לשימוש במפתח שלך.
  • כבוי (Off) (ברירת המחדל): תשובות ה-AI נחסמות עד שתתקן את המפתח. שום דבר לא ינצל את הקרדיטים שלך בשקט, אך הבוט יפסיק להשיב. לכן, אם אתה מעדיף שהוא ימשיך לפעול על קרדיטים בזמן שאתה מסדר את המפתח, הפעל את המתג הזה מראש.

כך או כך, תקבל אימייל בפעם הראשונה שהמפתח שלך ייכשל (לא אימייל אחד לכל הודעה).


שאלות נפוצות

האם אוכל להשתמש ב-OpenAI, Gemini או ספק אחר עבור BYOK? נכון לעכשיו, לא עבור ספקים אחרים. עבור רוב האנשים התשובה כבר כאן: Max ו-Mini הם השכבות הפנימיות שלנו, בעלות של 0.25 ו-0.15 קרדיטים לפעולה בהתאמה.

האם מפתח ה-BYOK שלי ישמש לכל דבר? רוב פעולות ה-AI פטורות מחיוב בקרדיטים כאשר מפתח Anthropic משלך (BYOK) מחובר: תגובות AI, שימוש בכלים, אופטימיזציה של קמפיינים, יצירת בסיס ידע וחיפוש באינטרנט - כולם פועלים על המפתח שלך. ארבעה דברים עדיין עולים קרדיטים גם כשמפתח מחובר: שכבת Max בעלות של 0.25 קרדיטים לפעולה ושכבת Mini בעלות של 0.15, מכיוון ששתיהן פועלות על המודלים שלנו; Lead Finder בעלות של 0.25 לכל כתובת אימייל שנמצאה; ואוטומציות בעלות של 0.25 להרצה פלוס 0.25 לכל שלב AI. כדי להשאיר סוכן (Agent) במלואו על המפתח שלך בעלות של 0 קרדיטים, השאר אותו בשכבת Pro. דמי ערוץ (התשלום החודשי של WhatsApp Web, דמי משלוח הודעות ותבניות ב-WhatsApp) מחויבים בנפרד משימוש ב-AI בכל מקרה. אם המפתח נכשל בקריאה שהייתה אמורה לפעול עליו, השאלה האם הפלטפורמה תעבור לשימוש בקרדיטים תלויה במתג Fallback to credits (נסיגה לקרדיטים) שלך — ראה את המתג “Fallback to credits” המתואר לעיל בדף זה.

מתי בדיוק תשובות AI עולות 0 קרדיטים? BYOK הוא ברמת החשבון. תשובות AI עולות 0 קרדיטים רק כאשר לחשבון זה חובר מפתח Anthropic משלו. ללא מפתח משלו, התשובות צורכות קרדיטים בתעריף הרגיל.

האם BYOK משפיע על משלוח הודעות או על אמינות הערוץ? לא. BYOK משנה רק את אופן החיוב של קריאות ה-AI של הבוט שלך. כל השאר — ניתוב הודעות, תשתית ערוצים, מעקבים, קמפיינים ושידורים — עובדים בדיוק אותו דבר.


ראה גם: מדוע Max הוא הערך הטוב ביותר · הגדרת בוט ה-AI שלך · סוכני AI