OpenAI פתרה בעיה של מיליון דולר ב-88 שעות. המתמטיקאי שהיה שם קודם טוען שעקפו אותו

OpenAI פתרה בעיה של מיליון דולר ב-88 שעות. המתמטיקאי שהיה שם קודם טוען שעקפו אותו

עשרת אלפים סוכנים, 88 שעות, ומשפט אחד על קריירה

עשרת אלפים סוכנים של בינה מלאכותית עבדו במקביל 88 שעות, ובסופן OpenAI הודיעה שפתרה את אחת משבע בעיות המילניום במתמטיקה. בעיה שהמתינה לפתרון כתשעים שנה, עם פרס של מיליון דולר עליה.

שתים עשרה שעות לפני ההכרזה, בלילה שבין 7 ל-8 בספטמבר, פרופסור למתמטיקה מאוניברסיטת ניו-יורק בשם טריסטן בקמאסטר פרסם הצהרה של כמה עמודים. בחלק הראשון שלה הוא מציג שלוש הוכחות חדשות שהשיג עם שותף. בחלק השני הוא מצטט את מה שלדבריו אמר לו סבסטיאן בובק, חוקר בכיר ב-OpenAI, בפגישה ביניהם: "למה שתהרוס לעצמך את הקריירה?"

וכשבקמאסטר לא נבהל, לפי ההצהרה, הגיע המשפט הבא: "אם אתה לא רוצה שאהיה נחמד, אני לא חייב להיות נחמד."

זה סיפור על מתמטיקה. אבל בעיקר זה סיפור על מה שקורה כשמישהו עם חוות שרתים שומע שאתה קרוב לקו הסיום.

מה זו בעיית נאוויה-סטוקס

בשנת 2000 פרסם מכון קליי למתמטיקה רשימה של שבע בעיות פתוחות, והציע מיליון דולר על פתרון של כל אחת מהן. עד ספטמבר 2026 נפתרה רק אחת, השערת פואנקרה, והמתמטיקאי הרוסי גריגורי פרלמן, שפתר אותה, סירב ב-2010 לקחת את הכסף.

משוואות נאוויה-סטוקס מתארות איך נוזלים וגזים זורמים. מהנדסים משתמשים בהן כל יום כדי לתכנן מטוסים, לחזות מזג אוויר ולדמות זרימת דם בעורקים. הבעיה: אף אחד לא הוכיח שהן תמיד מתנהגות יפה. השאלה היא אם ייתכן מצב שבו נוזל שמתחיל לזרום בצורה חלקה מגיע, בתוך זמן סופי, למהירות אינסופית בנקודה מסוימת. מתמטיקאים קוראים לזה "פיצוץ".

בקמאסטר עבד על הכיוון הזה שנים. בשנה האחרונה הוא עבד עליו עם לוונט אלפוגה, מתמטיקאי שמועסק באנתרופיק אבל הדגיש שהשיתוף ביניהם אישי לגמרי ולא קשור לחברה. השניים השתמשו גם בקלוד וגם בקודקס, כלי התכנות של OpenAI. ב-15 באוגוסט הם הגיעו לתוצאה: משוואות אוילר, בת הדודה של נאוויה-סטוקס שבה לנוזל אין חיכוך כלל, אכן יכולות להתפוצץ כשמפעילים עליהן כוח חיצוני חלק. שבוע אחר כך התוצאות אומתו בלין, שפת תוכנה שבודקת הוכחות מתמטיות צעד אחר צעד. טרנס טאו, אולי המתמטיקאי המפורסם בעולם כיום, כינה את זה "הישג יוצא דופן".

זו עוד לא הייתה בעיית המילניום עצמה. אבל זה היה צעד ענק, בדרך שכמעט אף אחד לא הלך בה.

תשעה ימים בספטמבר

בסוף אוגוסט צייץ אלפוגה שתי מילים בלטינית שמשמעותן "אוגוסט מופלא". זמן קצר אחר כך התחילו ברשת להסתובב שמועות שאנתרופיק פתרה בעיות מילניום.

לפי הפוסט הרשמי של OpenAI, ב-1 בספטמבר החברה שמעה את השמועות שלפיהן שתיים מבעיות המילניום נפתרו, והחליטה להפנות אליהן מודל פנימי חדש שהיא מאמנת מאז 28 באוגוסט. היא מודה שרק אחר כך הבינה שהשמועות קשורות לבקמאסטר ולאלפוגה.

בלילה של 2 בספטמבר אלפוגה קיבל רמז שהמידע על ההתקדמות שלהם הגיע ל-OpenAI, ופנה לחברה. יום אחר כך פנה גם בקמאסטר. ב-6 בספטמבר בובק ביקש להיפגש, ובפגישה נאמר לבקמאסטר שלחברה כבר יש הוכחה מלאה לנאוויה-סטוקס. "התברר שצוות שלם עבד על הבעיה," כתב בקמאסטר, "ושכמות מטורפת של מחשוב הושקעה."

OpenAI מאשרת את רוב ציר הזמן. לפי הפוסט שלה, הסוכנים הגיעו לפתרון ב-5 בספטמבר, כ-88 שעות אחרי שהושקו. בקבוצה שפתרה את הבעיה עבדו בו-זמנית כעשרת אלפים סוכנים. בכל המאמץ, על כל הבעיות שנוסו, הם ייצרו כ-300 מיליארד טוקנים של פלט. בטק קראנץ' עשו את החשבון: לפי המחירון של ג'יפיטי-6 אסטרה, זה שווה 22.5 מיליון דולר במחשוב. על בעיה שהפרס עליה הוא מיליון.

ועכשיו הפרט שמפריע לבקמאסטר יותר מכל. הדרך שהוא ואלפוגה בחרו, דרך כוח חיצוני חלק שפתחו המתמטיקאים הספרדים דייגו קורדובה ולואיס מרטינס-זורואה, היא דרך צדדית שכמעט אף אחד לא עבד עליה. לדבריו, זה לא כיוון שמגיעים אליו תוך כמה ימים רק מלתת למודל את ניסוח הבעיה. ובכל זאת, OpenAI הגיעה בדיוק אליו.

שתי הצעות, ושם אחד מיותר

לפי הסיכום של אנגדג'ט, בפגישה הוצגו לבקמאסטר שתי אפשרויות. הראשונה: הוא ואלפוגה יפרסמו את התוצאה שלהם על אוילר, ו-OpenAI תפרסם את הפתרון המלא שלה יום אחר כך. השנייה: בקמאסטר יכתוב מאמר על ההוכחה של OpenAI, בלי השם של אלפוגה.

אלפוגה, תזכורת, עובד אצל המתחרה הגדולה של OpenAI.

בובק פרסם גרסה משלו ברשת אקס. הוא לא מכחיש שהתנגד לכך שאלפוגה יופיע כמחבר, ומנמק זאת בניגוד עניינים. לפי הגרסה שלו, המשפט על הקריירה נאמר אחרי שבקמאסטר איים ללכת לעיתונות עם האשמות שלדעתו לא היה להן בסיס. בהמשך הוא התנצל על בחירת המילים. סם אלטמן, מנכ"ל OpenAI, שיתף את הגרסה של בובק וטען שהחברה פנתה לשניים בתום לב. OpenAI גם הודיעה שלא תבקש את פרס המיליון.

בקמאסטר סירב לשתי ההצעות, וכמה שעות לפני ההכרזה של OpenAI פרסם הכל.

המודל שאולי קרא את המחברת

יש עוד שכבה לסיפור, והיא נוגעת בכל מי שמקליד רעיונות לצ'אטבוט. בקמאסטר ואלפוגה הזינו את הטיוטות שלהם לקודקס לאורך כל העבודה. OpenAI שומרת לעצמה את הזכות לאמן מודלים על שיחות כאלה, אלא אם המשתמש ביטל זאת. אז בקמאסטר שאל בפגישה אם המודל אומן על הסשנים שלהם, ולדבריו לא קיבל תשובה ברורה.

בגרסה הראשונה של הפוסט, ב-8 בספטמבר, OpenAI כתבה שאף אחד, לא החוקרים ולא הסוכנים, לא ראה את העבודה של השניים. אבל הוסיפה שהיא לא יכולה לשלול שנתונים אנונימיים שנגזרו מהשימוש שלהם במוצרים שלה עזרו לשפר את המודלים. במילים פשוטות: ייתכן שהמודל למד משהו מהמחברת שלהם.

יומיים אחר כך, ב-10 בספטמבר, החברה עדכנה את הפוסט. לדבריה, אחרי בדיקה פנימית התברר שהפרומפטים של בקמאסטר בקודקס בחודשיים שלפני ההכרזה לא יכלו להשפיע על המערכת בשום צורה, כולל באימון. היא גם מדגישה שההוכחות שונות: באוילר, בקמאסטר ואלפוגה הוכיחו תוצאה עם כוח חיצוני, והמערכת של OpenAI הוכיחה תוצאה בלעדיו.

שימו לב למי שערך את הבדיקה: החברה עצמה.

ואז הגיע הטוויסט המתמטי

ב-11 בספטמבר מכון קליי פרסם הודעה שלפיה בעיית נאוויה-סטוקס "הוכרעה ככל הנראה", והוסיף שתהליך הבדיקה וחלוקת הקרדיט יהיה איטי במכוון. לפי הכללים של המכון, פתרון צריך להתפרסם בכתב עת, לעבור שנתיים ולזכות בהסכמה רחבה בקהילה לפני שמישהו מקבל פרס.

וב-21 בספטמבר סיינטיפיק אמריקן העלה שאלה חדשה לגמרי: האם OpenAI פתרה בכלל את הבעיה הנכונה. ההוכחה שלה נשענת על כוח חיצוני שנבנה במיוחד כדי לגרום לפיצוץ. הניסוח הרשמי של קליי מתיר את זה, אבל רוב המתמטיקאים שחקרו את הבעיה חיפשו פיצוץ שנובע מהנוזל עצמו, בלי כוח מבחוץ. שלושה מתמטיקאים כבר פרסמו הוכחה שלפיה השיטה של OpenAI לא יכולה לעבוד בלי הכוח הזה. לואיס סילבסטרה מאוניברסיטת שיקגו סיכם את זה בכתבה כך: בעיית קליי הוכרעה, אבל הבעיה המרכזית של משוואות נאוויה-סטוקס לא.

כלומר, ייתכן שעשרת אלפים הסוכנים מצאו פרצה בניסוח של הבעיה. פרצה חוקית לגמרי, בבעיה שהפרס עליה עדיין מחכה במגירה.

אז מה יוצא מזה

ביוני כתבנו כאן על תעלומה מתמטית בת שמונים שנה ש-OpenAI פתרה בשבוע, והעולם התלהב. הפעם ההישג המתמטי כמעט לא עומד בכותרת. הכותרת היא מי הפעיל את המודל, מתי, ועל חשבון מי.

אני לא יודע מי צודק בשיחה שהתקיימה בחדר סגור בין שני אנשים. אבל מה שמוסכם על כולם מספיק: OpenAI התחילה לעבוד על הבעיה אחרי ששמעה שמישהו אחר מתקרב לפתרון. היא הגיעה לנתיב הנדיר שהם בחרו. והיא הפעילה בשבוע אחד כוח מחשוב שאף מחלקה למתמטיקה לא יכולה להרשות לעצמה.

טרנס טאו כתב שהוא חושש בדיוק מזה: שמועה על כיוון מחקר של מתמטיקאי אחד מספיקה כדי שחברת בינה מלאכותית תשפוך עליו משאבים עצומים, עוד לפני שהחוקר הספיק לפתח את הרעיון בעצמו.

מתמטיקה הייתה במשך אלפי שנים המשחק הכי הוגן שיש: מוח מול בעיה. פרלמן עבד על פואנקרה כמעט לבד, בלי צוות ובלי תקציב. עכשיו, כשהרעיון כבר באוויר, מי שיש לו יותר שרתים מגיע ראשון. וכש-OpenAI כבר הראתה לנו מה קורה כשסוכנים שלה יוצאים מהמעבדה, קשה להירגע מהבטחה שהיא בדקה את עצמה ומצאה שהכל בסדר.

אם אתם חוקרים, יזמים או סתם אנשים עם רעיון טוב, הלקח פשוט: לפני שאתם מדביקים את הטיוטה הכי חשובה שלכם לצ'אטבוט, תבדקו בהגדרות אם ביטלתם את האפשרות לאמן עליה מודלים. בקמאסטר עשה הכל נכון מבחינה מתמטית. הוא רק עבד על הכלי של החברה שבסוף עקפה אותו.