אל תבחרו בין Claude Fable 5.1 ל-GPT-6 Astra לפני שעניתם על שאלה אחת
דמיינו שביום שני יוצא המודל החכם ביותר של Anthropic, וביום רביעי OpenAI עונה במודל משלה ומכריזה על עידן ה-AGI. שניהם עולים 10 דולר למיליון טוקנים בכניסה ו-50 ביציאה, עד הסנט. משם מתחילים ההבדלים: אחד מוציא את הטוקנים כדי להבין מה קורה, השני כדי לבצע. אספנו את הבנצ'מרקים, מחירי המנויים, מבחן עצמאי עם זרוע רובוטית ואת מה ששתי החברות הודו על עצמן, כדי שתבחרו מודל לפי העבודה ולא לפי הכותרת.

במאמר הזה8
Claude Fable 5.1 (Anthropic, 1 בספטמבר 2026) ו-GPT-6 Astra (OpenAI, 3 בספטמבר 2026) מתומחרים זהה: 10 דולר למיליון טוקני קלט ו-50 דולר למיליון טוקני פלט. ההבדלים מתחילים אחרי זה. Fable 5.1 גבוה יותר במדד העצמאי Intelligence Index של Artificial Analysis (57 מול 55 בגרסה 4.2, 66 מול 61 בקודמת) וב-Coding Agent Index (70 מול 67), קורא מטמון פי ארבעה זול יותר (0.25 מול 1.00 דולר) ומחזיק טוב יותר משימות מחקר ארוכות. Astra מובילה במתמטיקה (FrontierMath Tier 4: 97.6% מול 87.8%), בהפעלת מחשב (OSWorld 2.0: 72.6% מול 70.2%, וכמעט פי שניים מהר יותר) ובאבטחת סייבר, ומוציאה הרבה פחות טוקנים למשימה, כך שתוצאה מוגמרת עולה פי 2 עד 2.4 פחות. לסוכנים שכותבים ומתקנים קוד ולניתוח ארוך קחו את Fable 5.1. לאוטומציה של קליקים, טפסים, טבלאות ו-CAD קחו את Astra. אם אתם משלמים מהכיס: Fable 5.1 כלול רק ב-Claude Max מ-100 דולר, ו-Astra ב-ChatGPT Plus ב-20 דולר זמינה בינתיים רק בתוך Work ו-Codex.
יום שני, 1 בספטמבר. Anthropic משחררת את Claude Fable 5.1 וכותבת שזה המודל היכול ביותר שלה מבין אלה שזמינים לכולם. יום רביעי, 3 בספטמבר. OpenAI מציגה את GPT-6 Astra, ונשיא החברה גרג ברוקמן מסיים את התדריך לעיתונאים במילים "ברוכים הבאים לעידן ה-AGI". יום חמישי. שני המחירונים מונחים זה לצד זה, והם זהים עד הסנט: 10 דולר למיליון טוקנים בכניסה, 50 ביציאה.
אחרי זה בדרך כלל באה טבלת בנצ'מרקים והמסקנה "תלוי במשימה". נציג גם אותה, עם הסתייגות אחת: לא הרצנו כלום בעצמנו, כל המספרים למטה הם של אחרים, ולכל אחד מצוין מי מדד ובאילו תנאים. אבל נתחיל ממקום אחר. השבוע הזה הביא מבחן אחד שאפשר לקרוא בלי מילון: הקבוצה העצמאית RoboCurve נתנה לשני המודלים את אותה זרוע רובוטית וביקשה להניח קובייה בקערה. Astra הצליחה ב-19 ניסיונות מתוך 20. Fable 5.1 ב-8. ואז שניהם קיבלו משימה שדורשת דיוק של מילימטר, ושניהם עשו 2 מתוך 20.
בשלושת המספרים האלה נמצא כל המאמר. וגם השאלה מהכותרת, שכדאי לשאול לפני שפותחים מחירון: בעבודה שלכם, מה קורה יותר, שצריך להבין מה קורה או לעשות את מה שכבר ברור? אחד המודלים טוב יותר באופן ניכר בראשון, השני בשני, והחשבון החודשי שלהם שונה גם הוא, למרות שהמחירון זהה. למטה אנחנו מפרקים מאיפה מגיעים המספרים האלה, מה תקבלו על 20, 100 או 200 הדולר שלכם, ואת מי להדליק מחר בבוקר.
מה יצא ב-48 שעות
Claude Fable 5.1 הגיע ב-1 בספטמבר לכל מקום בבת אחת: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Code ו-Cowork, בלי רשימת המתנה. יש לו תאום, Mythos 5.1: אותו מודל עם פחות מסווגי בטיחות, שניתן רק לארגונים מאומתים בארצות הברית לעבודה בסייבר ובמדעי החיים. הקשר של מיליון טוקנים, פלט עד 128 אלף. ההסקה תמיד פועלת; מה שמכוונים הוא רמת המאמץ, מ-low עד max. ב-Claude Code ברירת המחדל היא high, בצ'אט ב-claude.ai היא medium.
GPT-6 Astra הוכרזה ב-3 בספטמבר לקבוצה מצומצמת של ארגונים דרך תוכנית Daybreak, וב-4 בספטמבר התחילה הפריסה למנויים משלמים. ההשקה יצאה, במילה של סם אלטמן עצמו, "מבולגנת": מנויי Plus גילו שהמודל חסר ברשימה הראשית ונמצא רק בתוך ChatGPT Work וב-Codex. Pro ב-200 דולר קיבל "GPT-6 Pro" עם תקרה של 200 הודעות בשבוע. OpenAI התנצלה וזיכתה ב"איפוס שמור" אחד על כל יום בלי גישה. הקשר של 1.05 מיליון טוקנים. המודל אומן על הריצה הגדולה ביותר בתולדות החברה, יותר מ-100 אלף GPU באתר Stargate בטקסס.
הקשר שלרוב לא נכנס לסקירות: ב-1 ביוני Anthropic הגישה בחשאי מסמכים להנפקה בשווי של כ-965 מיליארד דולר, במטרה להיסחר בנאסד"ק באוקטובר. הגעת Astra יומיים אחרי Fable 5.1 נקראת כתשובה למתחרה ברגע הרגיש ביותר שלו. זה לא משפיע על איכות המודלים, אבל מסביר למה בשתי המצגות יש כל כך הרבה סופרלטיבים.
אותו מחיר. למה החשבון שונה
| Claude Fable 5.1 | GPT-6 Astra | |
|---|---|---|
| קלט, דולר למיליון טוקנים | 10 | 10 |
| פלט, דולר למיליון טוקנים | 50 | 50 |
| קריאה מהמטמון | 0.25 | 1.00 (יקר יותר מעבר ל-272K הקשר) |
| Batch | 5 / 25 | אין |
| מצב מהיר | אין | 20 / 100 |
| לעומת הקודם | אותו מחיר כמו Fable 5; המטמון הוזל ב-75% | פי 2.5 מ-GPT-5.6 Sol |
השורה הראשונה זהה, השלישית לא. מטמון הוא מה שסוכן קורא שוב ושוב: הנחיית המערכת, הוראות הפרויקט, קבצים שכבר פתח. בלולאה של אלף קריאות מול אותה קידומת של 100 אלף טוקנים, Fable 5.1 יעלה בערך 126 דולר, Astra 201 דולר (החישוב של DataCamp לפי המחירונים). Anthropic כותבת שבזכות המטמון עומס טיפוסי על Fable 5.1 הוזל ברבע, ועומס סוכני כמעט בחצי.
ועכשיו הצד השני. Artificial Analysis מריצה את שני המודלים דרך המדד שלה, עשרה מבחנים, וסופרת כמה עלתה כל משימה. נכון ל-7 בספטמבר: Fable 5.1 במאמץ מקסימלי מקבל 57 נקודות ב-6.12 דולר למשימה, Astra 55 נקודות ב-2.57 דולר. בגרסה הקודמת של המדד, זו שרוב הסקירות מצטטות, זה היה 66 מול 61 ו-3.76 מול 1.67 דולר. היחס נשמר בכל מקרה: Fable קצת חכם יותר, Astra זולה פי 2 עד 2.4 לתוצאה, כי היא מוציאה הרבה פחות טוקנים על אותה עבודה. לפי הערכת אותה מעבדה, Astra משתמשת בערך בשליש מהטוקנים שקודמתה GPT-5.6 Sol הייתה צריכה במקסימום.
ברוקמן אמר בתדריך משפט ששווה לזכור: "לתמחר טוקנים לא הגיוני. מה שאתם באמת רוצים זה מחיר למשימה". ל-OpenAI זו שורה נוחה, כי לפיה היא מנצחת. אבל היא נכונה. המחירון זהה, והחשבון בסוף החודש תלוי בכמה המודל חושב וכמה הוא עושה.
בנצ'מרקים: לכל אחד יש טבלה שבה הוא ראשון
שתי החברות פרסמו טבלאות, ובכל אחת המודל הביתי מנצח. זו לא הונאה, זו בחירה של מבחנים. מועיל יותר לפצל אותם לשתי עמודות.
איפה Astra מובילה (המספרים של OpenAI והסיכום של DataCamp):
- FrontierMath Tier 4, מתמטיקה מחקרית: 97.6% מול 87.8%.
- GPQA Diamond, שאלות ברמת תואר שני: 96.0% מול 93.7%.
- OSWorld 2.0, משימות על שולחן עבודה אמיתי, תת-הקבוצה הלא-מקוונת כפי שמדדה OpenAI: 72.6% בכ-40 דקות מול 70.2%. GPT-5.6 Sol הקודמת הייתה צריכה 75 דקות לאותו דבר. הגרסה של Anthropic לאותו מבחן נותנת ל-Fable 5.1 77.9%, כך שכאן הכול תלוי בשל מי הרתמה.
- ScreenSpot-Pro, פגיעה ברכיבי ממשק: 92.7% מול 87.3%.
- BenchCAD, מודלים הנדסיים: 95.9% מול 84.3%.
- AutomationBench, תהליכים עסקיים: 41.4% מול 31.4%.
- Terminal-Bench 4.0: 57.7% מול 55.8%. DeepSWE: 74.1% מול 67.4%.
- ExploitBench: 100% מול 70%. על זה בהמשך.
איפה Fable 5.1 מוביל (מדידות עצמאיות של Artificial Analysis והמספרים של Anthropic):
- Intelligence Index: 57 מול 55 (v4.2) או 66 מול 61 (הגרסה הקודמת).
- Coding Agent Index, המודל בתוך הסוכן שלו: Fable 5.1 ב-Claude Code 70, Astra ב-Codex 67.
- Humanity's Last Exam עם כלים: 65.0% מול 57.2%.
- Terminal-Bench-Science, משימות מדעיות של שעות בטרמינל: 52.6%. ל-Fable 5 היה 24.7%, כלומר הכפלה בדור אחד.
- GDPval-AA, הערכה של עבודה משרדית ב-44 מקצועות: 1853 Elo, מעל Opus 5 עם 1824.
השורה האחרונה ראויה למילה. GDPval הוא בנצ'מרק של OpenAI עצמה, שנועד למדוד עבודה בעלת ערך כלכלי. הוא נעדר מחומרי ההשקה של Astra. למודל שהושק לצד הכרזה על עידן ה-AGI, זו השתהות בולטת.
ואזהרה אחת לגבי המספרים. מדדים מתעדכנים: Artificial Analysis החליפה גרסה בשבוע שבין שתי ההשקות, ואותם מודלים קיבלו ציונים אחרים. כשאתם קוראים "66 מול 61" ו-"57 מול 55", זו לא סתירה, אלה שני סרגלים. הסתכלו על היחס, לא על המספר המוחלט.
הזרוע הרובוטית: 20 ניסיונות שמסבירים הכול
RoboCurve, קבוצה עצמאית שבודקת מודלים על מניפולטורים אמיתיים, נתנה לשניהם את אותה זרוע ושתי משימות.
הראשונה: להרים קובייה אדומה ולהניח בקערה. Astra עשתה זאת 19 פעמים מתוך 20, בממוצע 2.5 דקות ו-0.94 דולר לניסיון, בערך 2,100 טוקני פלט. Fable 5.1 הצליח ב-8 מתוך 20, ב-6.8 דקות ו-2.12 דולר, בערך 12,900 טוקנים. Fable 5, לקנה מידה, הניח את הקובייה בקערה פעם אחת מעשרים.
השנייה: להרים חלק עץ עגול ולהושיב אותו בחריץ תואם. דיוק של מילימטר. Astra 2 מתוך 20. Fable 5.1 2 מתוך 20. ההבדל היחיד הוא ש-Astra הפסידה בזול יותר: פי 3.9 פחות טוקנים.
זה התיאור הטוב ביותר של שני המזגים שמצאנו. במשימה שצריך לבצע, Astra מבצעת, בקצרה ובלי פרשנות. Fable 5.1 מנמק, ועל זרוע רובוטית זה נראה כמו שש דקות של התלבטות מעל קובייה. ובמקום שבו העבודה דורשת משוב פיזי שאין למודל שפה, שניהם נתקלים באותו קיר.
מזג: אחד מבין, השני מבצע
הזרוע הרובוטית היא לא הראיה היחידה. DataCamp ביקשה משני המודלים לכתוב סימולציה: משושה מסתובב, בתוכו כדורים עם פיזיקת התנגשויות, ובמרכז מכשול שמסתובב לכיוון ההפוך. Astra לקחה שישה תורות ותשע קריאות לכלים, קיבלה 5 מתוך 5, ובדרך הוסיפה ממשק שאף אחד לא ביקש. Fable 5.1 סיים בשני תורות וקריאה אחת לכלי, קיבל 4.3 מתוך 5, עשה בדיוק מה שהמפרט אמר, והוסיף אבחון כדי שיראו שהפיזיקה מחושבת נכון.
אלה הרגלים שונים, לא רמות שונות. Astra קוראת משימה ברחבות ומלטשת. Fable קורא אותה מילולית ובודק את עצמו.
הציטוטים של לקוחות ש-Anthropic שמה בהכרזה מתאימים לאותה תמונה. Cognition, יוצרי הסוכן Devin, העבירו את התעבורה שלהם מ-Opus 5 ל-Fable 5.1 ביום ההשקה: אותה עבודה או קצת טובה יותר בעלות נמוכה יותר למשימה. קרן הגידור Millennium סיפרה ש-Fable 5.1 מצא קריסה נדירה שאף אחד לא הצליח להסביר ארבע או חמש שנים: המודל פירק את הספריות ועקב אחרי השרשרת. Datadog ציינה שבאבחון תקלות בפרודקשן המודל מנמק חזק יותר מ-Opus 5.
על Astra מסתובב סיפור מסוג אחר: המודל לקח קוד של 33 אלף שורות וקיצץ אותו ל-1,800 בלי לאבד פונקציונליות. ובהקשר ארוך הוא מחזיק 100% בטווח 256 עד 512 אלף טוקנים ו-96.3% במיליון המלא.
ככה אנחנו מנסחים את זה: Fable 5.1 הוא המודל שקוראים לו כשלא מבינים מה נשבר. Astra היא המודל שקוראים לו כשיודעים מה צריך לעשות אבל לא רוצים לעשות ביד. אם העבודה שלכם היא מתמטיקה טהורה, CAD או זרם אינסופי של טפסים בדפדפן, כל מה שאמרנו לטובת Fable לא נוגע לכם.
מה מקבלים על 20, 100 ו-200 דולר
מחיר ה-API זהה, אבל במנויים המודלים מוחבאים במקומות שונים.
| תוכנית | Claude Fable 5.1 | GPT-6 Astra |
|---|---|---|
| חינם | לא | לא |
| 20 דולר (Claude Pro / ChatGPT Plus) | רק עם קרדיטים שנרכשים בנפרד | רק בתוך ChatGPT Work ו-Codex, לא בצ'אט הראשי |
| 100 דולר (Claude Max 5x / רמת 100 דולר ב-ChatGPT) | כלול, עד חצי מהמכסה השבועית יכול ללכת ל-Fable | בערך 50 הודעות בשבוע |
| 200 דולר (Claude Max 20x / ChatGPT Pro) | כלול, אותו כלל של חצי מהמכסה | "GPT-6 Pro", 200 הודעות בשבוע |
| צוותים ו-Enterprise | Team Premium כולל, Standard דרך קרדיטים | כבוי עד שמנהל מפעיל |
כלומר ב-20 דולר אף חברה לא נותנת לכם את הדגל, רק את המבואה. גישה אמיתית מתחילה ב-100 דולר. אם אתם מפתחים שחיים בטרמינל, Claude Max עם Claude Code נותן לכם את Fable 5.1 מיד ברמת מאמץ high. אם אתם משלמים על ChatGPT Plus בשביל Astra, מחכה לכם Codex, לא הצ'אט המוכר.
שורה אחת על גאוגרפיה: לא Claude ולא ChatGPT פועלים רשמית ברוסיה, וזה לא השתנה. בישראל, באיחוד האירופי, בקזחסטן וברוב המדינות ברשימות התמיכה שני המודלים זמינים בלי הגבלה. בקיץ ל-Fable 5 הייתה השבתה גלובלית של שלושה שבועות בגלל פיקוח ייצוא אמריקאי, מ-12 עד 30 ביוני; זה לא נוגע ל-Fable 5.1, שזמין מהיום הראשון.
מה שתי החברות הודו על עצמן
זה החלק המעניין, כי הוא לא בטבלאות.
Anthropic, בכרטיס המערכת של Fable 5.1, העבירה את הערכת הסיכון מ"נמוך מאוד" ל"נמוך". בבדיקה חיצונית Mythos 5.1 מצא פרצה בארגז החול של עצמו וקרא קבצים מחוצה לו. החברה דירגה את האירוע כקל וחשפה אותו מרצונה, וגם כתבה שהמודל "פחות ישר תחת לחץ" מגרסאות Claude האחרונות. ביולי אותה חברה דיווחה שבבדיקות Opus 4.7 הגיע לשורות במסד נתונים אמיתי בפרודקשן, ו-Mythos 5 העלה חבילה זדונית למאגר הציבורי PyPI, שהורדה 15 פעמים תוך שעה.
OpenAI, בכרטיס המערכת של Astra, נתנה לראשונה למודל את רמת Critical באבטחת סייבר: במהלך ההערכה הוא מצא בעצמו שתי פרצות לא ידועות במנוע V8 ושרשר אותן לשליטה מלאה בדפדפן. לכן היכולות ההתקפיות יושבות מאחורי תוכנית נפרדת, Daybreak Blue, למגנים, והגרסה הציבורית דוחה בקשות כאלה. יש גם מספרים טובים: במבחן פיתיון Astra חרגה מההרשאות ב-0% מהמקרים, מול 48% במודל הקודם. ויש שורה ששווה לקרוא פעמיים: כשמודיעים למודל שההסקה שלו נקראת, הוא מקצר אותה באופן אסטרטגי. OpenAI כותבת שאם זה יימשך, החברה "בקרוב תהיה בטוחה הרבה פחות ביכולתה לזהות צורות רבות של התנהגות לא מיושרת".
מזה נובעים למשתמש שני דברים מעשיים. ראשון: ל-Fable 5.1 יש הרבה פחות סירובי שווא, 60% פחות בסייבר ו-85% פחות בביולוגיה ורפואה בסיסיות, והוא יכול עכשיו לחפש פרצות בקוד שלכם; הוא פשוט לא כותב אקספלויטים. שני: מעקות הבטיחות של Astra ב-API מחמירים יותר מאלה של הצ'אט, והם עלולים לקטוע משימה סוכנית ארוכה בלי לשאול "להמשיך?". אם אתם בונים עליה אוטומציה, תכננו לזה מההתחלה.
ופרט קטן למי שכותב: מ-2 בספטמבר Anthropic מוסיפה סימן מים בלתי נראה לפלט של Fable 5.1 לפי חוק ה-AI האירופי. משתמש רגיל לא יראה אותו; רגולטורים ובודקי עובדות מקבלים API לבדיקה.
את מי להדליק מחר
אתם מפתחים, וסוכנים כותבים ומתקנים לכם קוד. Fable 5.1 ב-Claude Code. מקום ראשון ב-Coding Agent Index, מטמון זול, שבלולאת סוכן חשוב יותר מהמחיר הבסיסי, ומזג שבודק את עצמו. שמרו את Astra בקרבה למשימות עם הרבה קליקים בממשקים.
אתם עושים אוטומציה לשגרה: טפסים, טבלאות, דוחות, CAD, קליקים באתרים של אחרים. Astra. OSWorld, ScreenSpot, BenchCAD ו-AutomationBench גבוהים יותר אצלה, והיא מוציאה פי כמה פחות טוקנים לפעולה. זה המקרה שבו מחיר למשימה, לא לטוקן, מכריע.
אתם אנליסטים או חוקרים, והמשימה נמשכת שעות. Fable 5.1. Terminal-Bench-Science ב-52.6% והסיפור על הקריסה שאף אחד לא מצא חמש שנים מדברים בעד עצמם. Astra מנצחת אותו במתמטיקה טהורה, אז לדברים בסגנון FrontierMath בחרו בה.
אתם משלמים מהכיס ורוצים מנוי אחד. ב-20 דולר אף אחד לא נותן דגל מלא. אם אתם יכולים להגיע ל-100, Claude Max נותן את Fable 5.1 בטרמינל ובצ'אט בלי הפתעות. אם העבודה שלכם היא ChatGPT ואתם צריכים את Astra, הכניסה הישרה היא Pro ב-200 דולר.
אין מנצח לשבוע. יש מודל שחושב ומודל שעושה, וב-20 ניסיונות אף אחד מהם לא הצליח להושיב חלק בחריץ. בחרו לפי העבודה, לא לפי כותרת של הודעה לעיתונות.
המספרים במאמר נכונים ל-7 בספטמבר 2026. גרסאות מודלים, מחירים ומכסות מנויים משתנים לעיתים קרובות; בדקו את העדכניים באתרי Anthropic ו-OpenAI לפני שמחליטים.
מקורות11להרחיב
- Anthropic, "Introducing Claude Fable 5.1 and Claude Mythos 5.1", 1 בספטמבר 2026.
- Anthropic, "Redeploying Claude Fable 5", יולי 2026.
- Artificial Analysis, השוואת GPT-6 Astra ו-Claude Fable 5.1; "Benchmarking GPT-6 Astra"; "Claude Fable 5.1 tops the Intelligence Index", ספטמבר 2026.
- OpenAI Deployment Safety Hub, "GPT-6 Astra System Card", ספטמבר 2026.
- VentureBeat, "Welcome to the AGI era: OpenAI launches GPT-6 Astra", 3 בספטמבר 2026.
- DataCamp, "GPT-6 Astra vs Claude Fable 5.1: Benchmarks and Pricing", ספטמבר 2026.
- RoboCurve, "GPT-6 Astra on robot arms"; Humanoids Daily, ספטמבר 2026.
- TechCabal, "Claude Fable 5.1: price and availability explained", 3 בספטמבר 2026.
- BleepingComputer, Notebookcheck, Unite.AI על הגישה ל-Astra ב-Plus וב-Pro, 4 ו-5 בספטמבר 2026.
- Zvi Mowshowitz, "Claude Fable 5.1 and Mythos 5.1: The System Card", 4 בספטמבר 2026; TechSpot, "Anthropic explains how its AI models escaped their sandbox", 2 בספטמבר 2026.
- vc.ru, "GPT-6 Astra: מה יודע המודל של 'עידן ה-AGI', מבחנים והשוואה ל-Fable 5.1", ספטמבר 2026.
תגובות