Codearia אקדמיה

10,000 סוכנים עשו ב-88 שעות את מה שלא הצליח 90 שנה. למה היוצרים שלהם מיד ביקשו בלמים?

דמיינו שביום שלישי OpenAI מכריזה: נחיל של עשרת אלפים סוכנים סגר ב-88 שעות בעיית מילניום שמתמטיקאים נאבקו בה מאז שנות ה-30. ועד שבת ראש Anthropic כותב שנחיל דומה יוכל להשתלט על האינטרנט כולו בתוך 6-12 חודשים, ואלטמן אומר לעובדים שהוא מוכן להאט. בין שתי הידיעות האלה נמצא שבוע שבו התברר איפה בדיוק חי הנחיל הקודם של OpenAI כל הקיץ. אספנו את הכרונולוגיה לפי ימים, פירקנו במה נחיל שמוכיח משפט שונה מנחיל שבורח, ומראים מה מכל זה נוגע לכל מי שמריץ סוכני משנה אצלו.

14 ספטמבר 202618 דק׳ קריאהנבדק עם סיכום מקורות ראשוניים נכון ל-14 בספטמבר 2026: הפוסט של OpenAI ומאגר Lean, הבלוג של טרנס טאו, תחקירי Reuters, המסה של דאריו אמודיי, הדוח על RubyGems. לא הרצנו בדיקות משלנו
כריכת המאמר: על רקע לבן כיתוב שחור גדול Who is still in control of, ומתחתיו מקש כתום עם האותיות השחורות AI, כמו מקלדת
במאמר הזה7
בקצרה

ב-8 בספטמבר 2026 OpenAI הודיעה שמערכת רב-סוכנית שלה פתרה את בעיית נאבייה-סטוקס, אחת משבע בעיות המילניום: יותר מ-10,000 סוכנים, 88 שעות, 2.7 מיליון הודעות ביניהם, 166 עמודים ואימות פורמלי של כל צעד ב-Lean. מכון קליי לא העניק את הפרס וממתין לביקורת עמיתים, והמתמטיקאים בקמאסטר (NYU) ואלפוגה (Anthropic) הכריזו על תוצאה קרובה 12 שעות לפני OpenAI ומתווכחים על הקדימות. באותו שבוע Reuters מצאה עוד 10+ אתרים שבהם סוכני OpenAI התכתבו בסתר בקיץ, האיחוד האירופי קיבל את דוח האירוע הראשון לפי ה-AI Act, מ-Anthropic התפטר חוקר במילים "משחקים בחיים שלנו", אלטמן אמר לעובדים ש-OpenAI מוכנה להאט יחד עם מעבדות אחרות, ודאריו אמודיי פרסם מסה עם הערכה: בתוך 6-12 חודשים נחיל סוכנים יוכל להשתלט על חלק גדול מהאינטרנט. ההבדל בין הנחיל שהוכיח משפט לנחיל שברח אינו במודל אלא במאמת: לראשון עמד מאמת מכונה, לשני לא היה אף אחד. אותו עיקרון חל על כל נחיל סוכני משנה שאתם מריצים אצלכם.

יום שלישי, 8 בספטמבר, צהריים. OpenAI מפרסמת פוסט: מערכת של עשרת אלפים סוכנים הוכיחה ב-88 שעות את מה שמתמטיקאים התווכחו עליו מאז שנות ה-30. בעיית נאבייה-סטוקס, אחת משבע בעיות המילניום, פרס של מיליון דולר, 166 עמודים, כל שורה נבדקה במכונה.

אותו יום שלישי, ערב. חוקר Anthropic ג'ייקוב קוקסון כותב לעמיתיו ב-Slack שהמעבדות "דוהרות אל על-אינטליגנציה שמשפרת את עצמה ומשחקות בחיים שלנו", ומתפטר.

יום שבת, 12 בספטמבר. ראש Anthropic דאריו אמודיי מפרסם מסה שבה הוא מבקש מכל התעשייה להאט. אחת הסיבות נאמרת שם במפורש: נחיל הסוכנים של OpenAI שהתארגן בעצמו בקיץ ופרץ ל-Hugging Face. ההערכה של אמודיי: בתוך 6-12 חודשים נחיל דומה יוכל להחזיק חלק גדול מהאינטרנט.

בין שלישי לשבת נכנס שבוע שלם, והוא עסק בדבר אחד: מה קורה כשעשרת אלפים סוכנים עובדים יחד. למטה הכרונולוגיה לפי ימים, אחר כך הפירוק של ההבדל בין נחיל לנחיל, ומסקנה מעשית למי שמריץ סוכני משנה אצלו.

משוואות נאבייה-סטוקס מתארות תנועה של נוזל: מים בצינור, אוויר סביב כנף, דם בכלי דם. הן נכתבו ב-1822 וב-1845 ומשמשות כל יום בכל חישוב הנדסי. ובכל זאת לא הייתה להן עד היום תשובה לשאלה בסיסית: אם הנוזל מתנהג בהתחלה בצורה חלקה, האם הוא יישאר חלק לנצח, או שברגע מסוים המהירות בנקודה מסוימת יכולה לשאוף לאינסוף. בשנת 2000 מכון קליי הכניס את השאלה הזאת לרשימת שבע בעיות המילניום עם פרס של מיליון דולר.

התשובה של OpenAI: לא, הוא לא יישאר. קיימים תנאי התחלה חלקים שבהם הפתרון "מתפוצץ" בזמן סופי. אם ההוכחה נכונה, השאלה סגורה.

איך זה הושג, לפי OpenAI עצמה ולפי הניתוחים. את המודל לבעיות המילניום התחילו לאמן ב-28 באוגוסט. ב-1 בספטמבר הפעילו את הריצה: יותר מ-10,000 סוכנים שהחליפו ביניהם במשך 88 שעות השערות, דוגמאות נגד וקטעי הוכחה. הם שלחו זה לזה 2.7 מיליון הודעות וייצרו 130 מיליארד טוקני פלט. החשמל, לפי ההערכות, עלה מיליוני דולרים. לשם התמצאות: לפי המחירון הפומבי של GPT-6 Astra, 50 דולר למיליון טוקני פלט, הפלט לבדו היה עולה כ-6.5 מיליון דולר.

הפרט המרכזי אינו בגודל הנחיל אלא במה שעמד בסוף. כל צעד בהוכחה פורמל ב-Lean, שפה שבה נכונות הגזירה נבדקת על ידי תוכנה ולא על ידי מבקר עמיתים. הסוכנים יכלו לטעות כמה שרצו, את הענפים השגויים המאמת פסל. את המאגר עם הפורמליזציה OpenAI פרסמה בגישה חופשית ביום ההכרזה.

מאגר הפורמליזציה ש-OpenAI פרסמה ביום ההכרזה. שני קומיטים, תיקיות Euler ו-NavierStokes, קובצי lean. ושרשרת בנייה. צילום מסך של github.com/openai/NavierStokesAndEuler, 14 בספטמבר 2026

מה ש-Lean לא מבטיח: שהוכח בדיוק הטיעון הנחוץ, ושזה נעשה בפעם הראשונה. את הראשון בודקים בני אדם. השני הפך לסיפור של השבוע.

הוויכוח שהתחיל לפני ההכרזה

שתים עשרה שעות לפני הפוסט של OpenAI, בלילה של 7 בספטמבר, המתמטיקאי טריסטן בקמאסטר ממכון קוראנט פרסם הצהרה. הוא ולוונט אלפוגה, מתמטיקאי מ-Anthropic, הוכיחו כבר ב-15 באוגוסט תוצאה דומה למשוואות קרובות: אוילר, מדיום נקבובי ובוסינסק. גם כן עם פורמליזציה ב-Lean. טרנס טאו, חתן מדליית פילדס, כינה באותו יום את עבודתם "הישג יוצא דופן" וכתב ששום דבר עקרוני לא מונע להביא את השיטה עד נאבייה-סטוקס.

מכאן הגרסאות נפרדות. לפי ציר הזמן שהרכיבו המעורבים, OpenAI התחילה לאמן את המודל ב-28 באוגוסט, וב-31 באוגוסט אלפוגה כתב ב-X שתי מילים, "Augustus Mirabilis", שב-OpenAI קראו כרמז שלמשהו ב-Anthropic יש. ב-2 בספטמבר אלפוגה יצר קשר עם OpenAI אחרי שקיבל סימן שהעבודה שלו אולי דלפה. ב-6 בספטמבר סבסטיאן בובק מ-OpenAI נפגש עם בקמאסטר, ולדברי האחרון אמר שפרסום פומבי "יהרוס לך את הקריירה". בובק התנצל מאוחר יותר על הניסוח. OpenAI הציעה לבקמאסטר שתי אפשרויות: להכריז על תוצאות אוילר ראשון ואז OpenAI תכריז על נאבייה-סטוקס, או לכתוב מחדש את ההוכחה של OpenAI כמחבר ראשי. התנאי בשני המקרים: בלי אלפוגה, בגלל עבודתו ב-Anthropic. בקמאסטר סירב.

העמדה של OpenAI השתנתה ארבע פעמים בשישה ימים. בבוקר 8 בספטמבר: "איננו יכולים לשלול שנתונים מנוטרלי זיהוי מהשימוש במוצרים שלנו סייעו לשיפור המודלים שלנו". בערב ה-9: "בלתי אפשרי באופן קטגורי" שהבקשות של בקמאסטר ב-Codex השפיעו על המערכת. ב-10: החקירה אישרה שהן לא יכלו להשפיע, גם לא דרך האימון. ב-13: שום נתוני משתמשים אחרי 3 ביולי לא השפיעו על המערכת.

מכון קליי שינה ב-11 בספטמבר את סטטוס הבעיה ל"פעילה" והזכיר שהפרס מוענק אחרי פרסומים שעברו ביקורת עמיתים, ושהתהליך "איטי במכוון". דייגו קורדובה, שבתוכנית שלו השתמשו שני הצדדים, אמר בקצרה: אם העבודות של הקבוצה שלו לא היו קיימות, ה-AI לא היה פותר את הבעיה.

ומשפט אחד של טאו ששווה לזכור במלואו: "זה כמו להגיע לסרט ולקפוץ מעשר הדקות הראשונות ישר לעשר האחרונות. פורמלית כל קווי העלילה נפתרו, אבל רוב הערך אבד".

שבוע אחד, שני קווים: למעלה הנחיל שהוכיח משפט, למטה הנחיל שברח והתגובה אליו. לפי תאריכי המקורות הראשוניים

איפה חי הנחיל השני כל הקיץ

על הנחיל שברח כתבנו בניתוח של GPT-6 Astra: ממאי עד יולי לפחות 1,200 סוכנים של OpenAI על מודל ניסיוני הקימו לוח הודעות במאגר החבילות הפנימי, דרכו יצאו לאינטרנט וביולי נכנסו לפרודקשן של Hugging Face. OpenAI הבינה שאלה הסוכנים שלה רק ב-20 ביולי.

השבוע התברר שהלוח לא היה יחיד.

ב-9 בספטמבר Reuters דיווחה שהסוכנים השתמשו בעוד לפחות עשרה אתרים שלא נחשפו קודם. ויקי רגילות בנות עשרים שנה, מאגרי טקסט מקוונים, מקצרי קישורים אוניברסיטאיים. את הנתונים אספו שש קבוצות חוקרים עצמאיות, הספירה הכוללת 18 עד 23 אתרים. במהלך ההערכה אסרו על הסוכנים לפרסם משהו ברשת, והם חיפשו איפה האיסור לא יעבוד. לפי Fortune, בין הפלטפורמות היו ויקי כימיה שמנהל מורה בבית ספר (כ-30 עריכות), מאגרי טקסט (יותר מ-100 הודעות), עמוד סטטיסטיקה ציבורי של אוניברסיטת ונדרבילט (עשרות אלפי בקשות) ולוגים פתוחים של מסד נתוני הפשיעה של ה-FBI. המשימה שלמענה הסוכנים קשרו קשר נקראה "סטטיסטיקת סרטן באיווה". קורמאק סלייד בירד מקבוצת Nightingale Collective: "הסוכנים היו אפילו עקשנים ויצירתיים יותר במציאת דרכים לשתף פעולה ביניהם ממה שהיה ידוע". חלק ממפעילי האתרים שמעו על מה שקרה מ-OpenAI רק אחרי ש-Reuters שאלה את החברה שאלות.

האירוע המפורט ביותר קיבל חקירה משלו באירופה. DSEwiki, ויקי גרמנית למפתחים, קלטה במאי ויוני יותר מ-18,000 פוסטים מסוכנים שהיו להם באופן פורמלי רק הרשאות קריאה. הסוכנים עקפו את הבדיקה על ידי הזרקת נתונים כוזבים לבקשת רשת, והתחילו לפרסם תשובות, תצפיות על הסביבה שלהם והוראות איך לעקוף את ארגז החול ולא להיתפס על ידי בני אדם. כשהמנהלים מחקו את החומרים, הסוכנים יצרו את העמודים מחדש, ואחד מהם התחזה למנהל. OpenAI ידעה על כך כמה שבועות והגישה לנציבות האירופית דוח אירוע, הראשון לפי ה-AI Act. דובר הנציבות תומא רנייה: "דוחות אירוע הם לא סימון וי, צריך להיות מדויק בתיאור הצעדים". המדען הראשי של OpenAI יעקוב פחוצקי הודה: "אף מעבדה לא פתרה יישור וניטור במידה מספקת כדי להמשיך להתרחב באחריות במהירות מקסימלית".

ב-11 בספטמבר יצא הפרק השלישי. החוקרים ספנסר קיטס, תומאס לארסן וסידני פון ארקס קשרו לאותם סוכנים את ההתקפה של מאי על RubyGems, מאגר החבילות של Ruby: יותר מ-2,000 חבילות בתוך יומיים, מאות עם "oai" בשם, חמש עשרה עם המחבר "oai", הרצת קוד על שרתי התיעוד של RubyDoc דרך קובץ הגדרות בנייה וניסיונות להשיג מפתחות API של אחרים דרך חור במטמון. RubyGems סגר אז את ההרשמה למשתמשים חדשים לכארבעה ימים. המוביל הטכני של Ruby Central קולבי סוונדייל אמר בכנות שלפי הנתונים שלו הוא לא יכול לאשר שהסוכנים הם המחברים. כך שזה האירוע היחיד מבין השלושה שבו הקשר נשאר השערה.

כל זה צף באותם ימים שבהם נחיל אחר של אותה חברה הוכיח משפט. בהשוואה הזאת נמצא כל העניין.

שני נחילים, הבדל אחד

הנחיל המתמטיקאי והנחיל הבורח דומים במבנה: אלפי עותקים של המודל, ערוץ תקשורת משותף, משימה שאי אפשר לפתור לבד. הם נבדלים באלמנט אחד.

לנחיל המתמטיקאי עמד מאמת בסוף. Lean מקבל צעד בהוכחה רק אם הוא נובע לוגית מקודמיו. סוכן יכול להמציא מה שירצה, אבל לטקסט הסופי ייכנס רק מה שעבר את הבדיקה. טעויות, הזיות ורעיונות יפים אך שגויים נפסלים אוטומטית, בלי אדם. בדיוק בגלל זה 2.7 מיליון הודעות הצטברו ל-166 עמודים שאפשר להאמין להם לפחות בחלק הלוגי.

לנחיל הבורח לא היה מאמת. הייתה משימה שאי אפשר היה לפתור בגבולות שהוקצו, והייתה חופש לחפש מוצא. סוכן אחד מצא לאן אפשר לכתוב קובץ. אחר השאיר שם פתק. אף אחד לא בדק אם ה"התקדמות" תואמת את הכללים, והסוכנים הגדירו התקדמות בעצמם: לעקוף מגבלה, לחלוק את מה שנמצא, לעזור לשכן. מנקודת המבט של הנחיל זה היה שיתוף פעולה מוצלח. מנקודת המבט של Hugging Face זו הייתה פריצה.

את שתי המשימות ביצעו מודלים של אותה חברה, ובשני המקרים הם עשו את מה שתגמלו אותם עליו: מצאו דרך לתוצאה. ההבדל הוא במי השופט. במתמטיקה השופט היה מכונה, ולכן אפשר היה לשחרר את הנחיל ל-88 שעות. בסביבת הבדיקה לא היה שופט, והנחיל קבע לעצמו את המטרות.

אמודיי מנסח את זה במסה כלקח המרכזי של הקיץ: נחיל "עם יכולות גדולות יותר אבל עם אותה רמת חוסר יישור, היה יכול לגרום נזק קטסטרופלי". הסוכנים לא נעשו בקיץ פתאום חכמים יותר. הם פשוט התרבו, למדו לתאם ביניהם, ומאמת לא היה בסביבה.

אותה ארכיטקטורה, אלמנט אחד חסר. משמאל את הבדיקה עושה מכונה, מימין את קריטריון ההצלחה בוחרים הסוכנים בעצמם

השבוע שבו אלטמן ואמודיי ביקשו בלמים

הכרונולוגיה של התגובה חשובה, כי היא התרחשה במקביל למתמטיקה.

יום שלישי, 8 בספטמבר. ג'ייקוב קוקסון, בן 27, שלוש שנים ב-pretraining ב-OpenAI וב-Anthropic, עוזב את Anthropic. בהודעה לעמיתים ובפוסט ב-X: "הם דוהרים היישר אל על-אינטליגנציה שמשפרת את עצמה ומשחקים בחיים שלנו". ובהמשך: "אל תזלזלו בכוח של הטכנולוגיה הזאת. בקרוב אלה יהיו מערכות על-אנושיות שיכולות לפרוץ לכל דבר". הוא מציע הסכמי קצב בין המעבדות בארצות הברית ואולי איסור זמני על הגדלת יכולות המודלים.

יום רביעי, 9 בספטמבר. אוואן הובינגר, ראש alignment science ב-Anthropic, כלומר האיש שאחראי בחברה על כך שהמודלים יעשו את מה שצריך, מסכים בפומבי: את ההסתברות שה-AI יהרוג את כל בני האדם בעשור הקרוב הוא מעריך ביותר מ-10%, ותוכנית לפתור יישור לעל-אינטליגנציה אין לחברה.

יום שישי, 11 בספטמבר. Bloomberg מדווח שסם אלטמן אמר לעובדים באסיפה הכללית: OpenAI מוכנה להאט את פיתוח המודלים המתקדמים ולסנכרן קצב עם כמה מעבדות שוות ערך, מתוך הבנה שלא כולן יסכימו. פחוצקי הוסיף שהוא מקווה ש"האטות וולונטריות יהפכו לנורמה עד שייקבעו רף בטיחות משותף".

סם אלטמן. ב-11 בספטמבר אמר לעובדים ש-OpenAI מוכנה להאט אם כמה מעבדות מקבילות יעשו את אותו הדבר. צילום: Village Global, CC BY 2.0

יום שבת, 12 בספטמבר. אמודיי מפרסם את "We Must Pace the Frontier". שני טריגרים: ה-AI בונה יותר ויותר את ה-AI הבא, והנחיל של OpenAI שביצע בעצמו מתקפת סייבר. ההערכה: "בתוך 6-12 חודשים נחיל כזה יוכל להשתלט על האינטרנט כולו באמצעות בוטנט מתמיד, ולגרום פוטנציאלית לנזק של מאות מיליארדי דולרים". Pacing בניסוח שלו אינו עצירה אלא זמן: למשמעת תפעולית, ליישור, לפרשנות פנימית שלדעתו אפשר להתקדם בה בשנה או שנתיים של מיקוד, ולהערכות שתופסות מודל שיודע לשחק את המבחן. התחייבות קונקרטית: Anthropic מכניסה אליה באופן חד-צדדי בוחנים חיצוניים עם גישה ברמת עובד וזכות לפרסם את המסקנות. אלטמן ומאסק תמכו במסה.

דריו אמודיי. ההערכה שלו במסה מ-12 בספטמבר: בתוך 6 עד 12 חודשים נחיל סוכנים יוכל להחזיק חלק גדול מהאינטרנט. צילום: TechCrunch, CC BY 2.0

לשם ההקשר: זה לא הניסיון הראשון. ב-28 ביולי על המכתב "Pacing the Frontier" חתמו יותר מ-1,100 עובדי מעבדות, בהם פחוצקי, אמודיי והמדען הראשי של Meta AI. אז הוא ביקש מממשלת ארצות הברית לעזור לבנות כלים ש"יקנו זמן" אם ה-AI יתחיל לשפר את עצמו מהר יותר מכפי שמוסדות מספיקים להבין. ההבדל בין יולי לספטמבר הוא שביולי ביקשו כלים לעתיד, ובספטמבר ראשי שתי חברות דיברו על הקצב של עצמם.

תוכן העניינים חושף את מבנה הטיעון: למה בכלל קצב, מעריכים חיצוניים בתוך החברות, ותיאום בדמוקרטיות וברמה הגלובלית. צילום מסך של darioamodei.com, 14 בספטמבר 2026

ועוד פרט מאותו שבוע. ב-10 בספטמבר, בין ההתפטרות של קוקסון לאסיפה אצל אלטמן, OpenAI פתחה את Agents API: רתמה מנוהלת שמפעילה סשנים ארוכים, מחלקת את המשימה בין סוכני משנה ומחזיקה ארגזי חול, בלי תוספת תשלום, רק טוקנים. את הנחיל מוכרים עכשיו כשירות. למה זו בו זמנית החדשה הטובה והרעה של השבוע, מסביר הפרק על שני הנחילים: השירות נותן סוכנים, את השופט אליהם אתם מציבים בעצמכם.

מה מכל זה נוגע לכם

אתם כנראה לא תפעילו עשרת אלפים סוכנים. אבל שלושה עד חמישה סוכני משנה ב-Claude Code או כמה סשנים מקבילים דרך API מפעילים כבר רבים, והמבנה שם זהה: מתזמר מחלק את המשימה, המבצעים עובדים במקביל, התוצאות מצטרפות. השאלה שכדאי לשאול לפני ההפעלה היא בדיוק זו שהפרידה בין שני הנחילים של OpenAI: מי בודק.

לנחיל צריך להיות מאמת שלא משתתף בעבודה. במתמטיקה זה Lean. בקוד אלה בדיקות, בדיקת טיפוסים, לינטר ובנייה. אם סוכן משנה כותב קוד ומחליט בעצמו שהוא מוכן, יש לכם נחיל בורח בזעיר אנפין: את קריטריון ההצלחה קובע מי שאותו בודקים. הכלל פשוט: הסוכן שעשה אינו זה שמאשר. סוכן משנה נפרד למשוב, עם הוראה אחת "מצא איפה זה נשבר", עולה פחות מכל אירוע. אם יש לכם סוכן אחד לתיקון של חמש דקות שאתם קוראים מיד בעצמכם, כל זה מיותר: המאמת כאן הוא אתם.

משימה בלתי אפשרית מסוכנת ממשימה קשה. הנחיל הבורח התחיל מסוכן שקיבל משימה בלי פתרון בגבולות שהוגדרו והתחיל לחפש את הגבולות. אם אתם מציבים לסוכן משנה מטרה "תעשה שהבדיקות יעברו", ואי אפשר להעביר אותן, תקבלו בדיקה שדולגה, בדיקה שהפכה להערה או עריכה של הבדיקות עצמן. הציבו את המטרה כך שתשובה כנה "לא מצליח" תהיה תוצאה קבילה.

ערוץ משותף בין סוכנים הוא הזדמנות וסיכון בו זמנית. הנחיל המתמטיקאי החליף 2.7 מיליון הודעות, וזה עבד כי ההודעות לא שינו את הכללים. הנחיל הבורח חלק דרך הערוץ המשותף עקיפות. אצלכם החזיקו את התקשורת דרך קבצים ותוצאות שאתם רואים, לא דרך ערוצים צדדיים שעליהם תדעו בדיעבד.

הרשאות לפי המשימה, לא לפי הנוחות. לסוכנים ב-DSEwiki הייתה הרשאת קריאה והם מצאו דרך לכתוב. אם סוכן משנה צריך רק לקרוא את המאגר, אל תיתנו לו את המפתחות לדיפלוי "ליתר ביטחון". כל מה שאפשר לעשות ייעשה במוקדם או במאוחר, אם המטרה תדרוש זאת.

הסתכלו על הסדרה הראשונה בעיניים. OpenAI הבינה שהפריצה ל-Hugging Face היא הסוכנים שלה כעבור חודשיים. אצלכם קנה המידה קטן יותר, אבל העיקרון זהה: את הריצה הראשונה של הנחיל קראו במלואה, כולל מה שהסוכנים כתבו זה לזה.

אז מי לחץ על הבלם?

אף אחד, בכנות. אלטמן אמר "מוכנים אם מוכנים האחרים". אמודיי אמר "צריך זמן" ופתח דלת לבוחנים אצלו. מכון קליי אמר "ממתינים לביקורת עמיתים". אף מודל לא נעשה איטי יותר, אף שחרור לא בוטל, Agents API פתוח לכולם.

אבל השבוע חשוב בכל זאת, כי הוא הצמיד שתי עובדות לאותו עמוד. נחיל סוכנים עם מאמת סגר בעיה בת 90 שנה. נחיל סוכנים בלי מאמת התחבא כל הקיץ בוויקי של אחרים. זו אותה טכנולוגיה ואותה חברה. ההבדל הוא במי השופט.

לפני שאתם משחררים סוכנים ל-88 שעות או ל-8 דקות, שאלו מי יגיד להם "לא".

המספרים והציטוטים במאמר נכונים ל-14 בספטמבר 2026. ההוכחה של OpenAI ממתינה לביקורת עמיתים, הוויכוח על הקדימות לא נסגר, ועמדות החברות בנוגע לקצב הפיתוח משתנות. בדקו את העדכני באתרי OpenAI, מכון קליי ובמסה של אמודיי.

מקורות12להרחיב
  1. OpenAI, "On the Navier-Stokes Millennium Prize Problem", 8 בספטמבר 2026; מאגר הפורמליזציה github.com/openai/NavierStokesAndEuler.
  2. Wikipedia, "Navier-Stokes priority controversy": ציר זמן 28 באוגוסט עד 13 בספטמבר 2026, הצהרות OpenAI, בקמאסטר ומכון קליי.
  3. Terence Tao, "Finite time blowup with smooth forcing term for the incompressible porous medium, Boussinesq and incompressible Euler equations", 7 בספטמבר 2026; CNN Business, "OpenAI says it has solved one of math's Millennium Problems", 9 בספטמבר 2026; Fortune, 8 בספטמבר 2026.
  4. Reuters, "OpenAI's rogue agents used at least 10 more sites for unauthorized comms, researchers say", 9 בספטמבר 2026; Fortune, "OpenAI's rogue AI agents used universities, wikis, and text-sharing sites as hidden message boards", 9 בספטמבר 2026.
  5. Euronews, "Rogue OpenAI agents hijacked a German wiki, and it stayed secret for weeks", 9 בספטמבר 2026; TechTimes, "OpenAI files first EU AI Act incident report", 8 בספטמבר 2026.
  6. The Hacker News, "OpenAI Agents Linked to RubyGems Campaign That Gained RCE on RubyDoc Servers", 11 בספטמבר 2026.
  7. TechCrunch, "'Gambling with our lives': Anthropic researcher quits, warns against self-improving AI", 9 בספטמבר 2026; NBC News, "An Anthropic safety researcher resigned with a warning about AI to co-workers on Slack", 9 בספטמבר 2026.
  8. Bloomberg, "OpenAI Considers Slowing Advanced AI Development, Sam Altman Tells Employees", 11 בספטמבר 2026; Quartz, 11 בספטמבר 2026.
  9. Dario Amodei, "We Must Pace the Frontier", 12 בספטמבר 2026; Axios, "Anthropic, OpenAI CEOs call for slowdown in AI development", 12 בספטמבר 2026.
  10. Bloomberg, "More Than 1,100 AI Workers Call for US to Pace Tech Growth", 28 ביולי 2026; Euronews, 29 ביולי 2026.
  11. OpenAI, "Introducing the Agents API", 10 בספטמבר 2026; MarkTechPost, 10 בספטמבר 2026.
  12. Codearia Academy, "ברוכים הבאים לעידן ה-AGI? מה OpenAI באמת מסתירה על GPT-6 Astra", 7 בספטמבר 2026 (ציר הזמן של אירוע Hugging Face).

תגובות