תשעים דקות הפרידו בין שתי ההשקות. עשרה ימים קודם הם ביקשו להאט
ביום שלישי, 22 בספטמבר, בשעה 16:30 לפי שעון גריניץ', אנתרופיק פרסמה את קלוד אופוס 5.5. תשעים דקות אחר כך פרסמה OpenAI את ג'יפיטי-6 סול וג'יפיטי-6 לונה, וחתכה את מחירי הממשק למפתחים בחצי.
עשרה ימים קודם לכן, ב-12 בספטמבר, דריו אמודאי פרסם מסה ארוכה שכותרתה "אנחנו חייבים לקצוב את החזית". המשפט המרכזי בה: "אנחנו חייבים להאט את הקצב שבו אנחנו משפרים את יכולות המודלים". סם אלטמן הביע תמיכה פומבית עוד באותו יום. אלון מאסק ודמיס הסאביס הצטרפו. לרגע נדמה היה שכולם הסכימו על משהו, וזה כבר לא קרה כאן הרבה זמן.
שישה ימים אחרי, ב-18 בספטמבר, ארבעה מנויים משלמים הגישו תביעה בבית המשפט הפדרלי בצפון קליפורניה. הנתבעות: אנתרופיק, OpenAI, גוגל וספייס-אקס-איי. העילה, לפי הדיווח, היא הסדר כובל: החברות תיאמו ביניהן להאט את הפיתוח, ובכך יפחיתו את הערך שהמנויים המשלמים מקבלים.
ארבעה ימים לאחר מכן שתי החברות השיקו מודלים בהפרש של שעה וחצי, ודרסו זו את הכותרות של זו.
ארבעה דולר, שני דולר, עשרה סנט
קלוד אופוס 5.5 יצא במחיר של 4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט, לעומת 5 ו-25 באופוס 5. ירידה של 20% במחיר הטוקנים, וירידה של 60% במחיר קריאה מהמטמון (מ-50 סנט ל-20 סנט למיליון). אנתרופיק הודיעה בהשקה שבמבדק ההתנהגותי האוטומטי שלה, שבודק יישור ובטיחות, זהו "המודל בעל הביצועים החזקים ביותר שבדקנו עד היום", ושהוא מייצר פלט מהר ביותר מ-30% מקודמו.
ג'יפיטי-6 סול ירד ל-2 דולר קלט ו-10 דולר פלט, בדיוק חצי מהמחיר הקודם. לונה ירדה ל-10 סנט ו-50 סנט. דיווח בדה נקסט ווב מציין שהתעריפים החדשים נמוכים ב-50% ממחירי ג'יפיטי-5.6. זה לא מבצע. זה המחיר.
שימו לב למספר אחד: סול עולה בדיוק חצי מאופוס 5.5, על הקלט ועל הפלט. לא בערך. בדיוק. וכשמסתכלים אחורה, מחיר שכבת האופוס ירד מ-15 ו-75 דולר באוגוסט 2025 ל-4 ו-20 היום. ירידה של כ-73% בתוך קצת יותר משנה.
אלטמן כתב בטוויטר באותו ערב: "הם גם חצי מהמחיר לטוקן, ואפילו פחות מזה למשימה".
המספר שאף אחד לא שם בכותרת
פורצ'ן ודה נקסט ווב תיארו את אופוס 5.5 כמודל שאינו פריצת דרך בחזית, ואנתרופיק עצמה הדגישה בהשקה בעיקר את היעילות שלו. זו ההגנה מול טענת ההאטה: לא קידמנו את הגבול, רק הוזלנו את הקיים.
הבעיה היא שחברת המדידה העצמאית ארטיפישל אנליסיס דירגה את אופוס 5.5 במקום הראשון במדד האינטליגנציה שלה, עם ציון 58. זה ציון משוקלל בסולם של 0 עד 100 שמשלב עשרה מבחנים שונים, לא אחוז הצלחה ולא מקום בטבלה. הציון הגבוה ביותר שנמדד שם אי פעם עד כה היה 53, גם לפייבל 5.1 של אנתרופיק וגם לג'יפיטי-6 אסטרה. סול, דרך אגב, קיבל 48.
מודל שקובע את הציון הגבוה ביותר שנמדד מעולם, בפער של כמה נקודות, הוא לא בדיוק "שיפור יעילות".
ויש עוד ממצא, והוא יפה במיוחד. אותה חברת מדידה גילתה שאופוס 5.5 במאמץ מרבי שורף כ-119 אלף טוקני פלט למשימה, לעומת 73 אלף באופוס 5 ו-27 אלף בלבד באסטרה. כלומר: המחיר לטוקן ירד ב-20%, אבל צריכת הטוקנים עלתה פי 1.6, והעלות בפועל למשימה נשארה זהה לדור הקודם. ההנחה נבלעה בתיאבון.
גם אצל OpenAI יש כוכבית. שיעור ההזיות של סול ירד מ-92% ל-60% במבחן הידע של אותה חברת מדידה, וזה נשמע מצוין עד שמבינים איך: המודל פשוט מסרב לענות יותר. הוא ניגש ל-83% מהשאלות במקום ל-99%, ודיוק התשובות שלו ירד מ-59% ל-54%. פחות טעויות, אבל גם פחות תשובות.
ובמדד שבודק עבודת ידע ב-44 מקצועות, סול דווקא נסוג בכ-100 נקודות ולונה בכ-75. המדד הזה עובד בשיטת דירוג בסגנון שחמט: לא ציון באחוזים ולא מקום בטבלה, אלא נקודות שנצברות מהשוואות עיוורות בין שני מודלים בכל פעם. אופוס 5.5 קיבל שם 1,846 נקודות, התוצאה הגבוהה שנמדדה עד כה. צוות המדידה בדק ידנית מאות פלטים כדי להבין את הנסיגה של סול, ומצא שהיא נובעת מאיכות הצגה ירודה יותר ומתוצרים שמשמיטים סעיפים מהדרישות.
אז מי באמת לוחץ עליהן?
לא הבטיחות. לא הרגולציה. סין.
מודלים במשקלים פתוחים, כמו אלה של דיפסיק, מונשוט וזד-איי הסיניות, הגיעו באוגוסט 2026 ל-56% מתעבורת הטוקנים בשער הבינה המלאכותית של ורסל, לעומת 7% בדצמבר. אבל הם היוו רק 14% מההוצאה. במילים אחרות: טוקן במודל סגור עולה בערך פי שמונה. המחיר הממוצע לטוקן בשער הזה ירד ב-23.2% באוגוסט, החודש השלישי ברציפות של ירידה. באתר אופן-ראוטר, מודלים בקוד פתוח היוו 60% משימוש הטוקנים בארה"ב.
וזה כבר לא תיאורטי. הארבי, סטארטאפ הבינה המלאכותית המשפטית ששוויו 15.6 מיליארד דולר, בנה באוגוסט מודל משלו על בסיס קוד פתוח סיני במקום להמשיך לשכור. תופעה קרובה כבר ראינו מכיוון אחר לפני שבוע.
ארה קרזיאן, הכלכלן המוביל של ראמפ, ניסח את זה בצורה הכי חדה: "OpenAI ואנתרופיק מנהלות מלחמת מחירים שמורידה את מחיר הבינה המלאכותית, ולכן מורידה את היכולת שלהן להרוויח ממנה". והוא מוסיף משפט ששווה לקרוא פעמיים: "שוורי הבינה המלאכותית מניחים שיהיו מודלים חזקים יותר שמספקים יותר ויותר ערך, ולכן הם צריכים להיות יקרים יותר. אבל זו לא הדרך שבה טכנולוגיה רגילה מגיעה לשוק".
רנדל האנט, מנהל הטכנולוגיה של חברת הייעוץ קיילנט, מתאר את הצד השני של המשוואה: "סמנכ"לי הכספים ראו חלק מההלם במחיר, והם לא ראו חלק מהרווחים שהובטחו בהשקעות הראשוניות. אז הם חוזרים לתכנון של 2027 ואילך ושואלים: איך אפשר לייעל פה את העלויות".
ברקע, אנתרופיק אמורה להיסחר בנאסד"ק בחודש הבא. קצב ההכנסות השנתי שלה עבר לפי הדיווחים 65 מיליארד דולר בסוף יולי, לעומת כ-9 מיליארד בסוף 2025. חברה שמתכוננת להנפקה ורוצה לשמור על נתח השוק מול חלופות זולות עושה בדיוק מה שאנתרופיק עשתה: חותכת את עצמה לפני שמישהו אחר יעשה זאת.
מה עושים עם זה
הבדיקה הכי משכנעת שראיתי השבוע לא הגיעה ממעבדה. יוצר תוכן בשם נייט הרק העמיד את שני המודלים מול עשר משימות אמיתיות. בשמונה מהן אפשר היה להכריע, ואופוס ניצח בשבע. הוא גם לקח שמונה שעות וארבעים דקות ועלה 213 דולר, לעומת חמש שעות וחמישים ואחת דקות ו-74 דולר אצל סול. במדד סוכני הדפדפן של חברת בראוזר יוז התוצאה התהפכה לגמרי: סול במאמץ בינוני קיבל 66.9 נקודות מול 59.4 של אופוס, בעלות נמוכה פי שלושה וחצי.
לפי הדיווח בטק קראנץ' על ההשקה, OpenAI עצמה מודדת היום בעלות למשימה ולא בציון. זו המסקנה המעשית: כדאי להפסיק לחפש את "המודל הכי טוב" ולהתחיל למדוד כמה עלה להשלים משימה אחת. כמה עלו הטוקנים, כמה זמן זה ארך, כמה ניסיונות חוזרים היו, וכמה פעמים אדם נאלץ להיכנס ולהציל את המצב. מספר פחות סקסי מציון במדד, והיחיד שמופיע בסוף החודש בחשבונית.
אבל מה שנשאר איתי מהשבוע הזה הוא לא המחירים. זה התזמון. שתי החברות שקראו להאט את הקצב, שנתבעו על כך שתיאמו ביניהן להאט את הקצב, בחרו את אותו יום, בהפרש של שעה וחצי, כדי להשיק ולהוזיל. אפשר לקרוא לזה שיפור יעילות. אפשר גם לקרוא לזה מה שזה באמת: אף אחד לא מאט כשמישהו זול יותר נושף בעורף.
עשרה ימים. זה כל מה שהסכמה בתעשייה הזאת מחזיקה.
