סטארטאפ אמריקאי מוכר מודל בלי בלמים. הבדיקה היחידה: כרטיס אשראי

סטארטאפ אמריקאי מוכר מודל בלי בלמים. הבדיקה היחידה: כרטיס אשראי

כרטיס אשראי. זו כל הבדיקה

עיתונאית של טק קראנץ' פתחה חשבון חינמי באתר, בלי כרטיס ובלי שאלות. תוך דקות המודל כתב לה תוכנה שגונבת סיסמאות שמורות מדפדפן כרום. אחר כך היא ביקשה ממנו מידע מסוכן בתחום הביולוגי, והוא ענה גם על זה בלי למצמץ.

זה לא קרה בפורום אפל ברשת. זה קרה באתר מסודר, עם דף נחיתה, מחירון ותמיכה בלקוחות.

החברה שמאחורי האתר נקראת אבליטרשן. היא מבית פאלו אלטו, והמוצר שלה פשוט: מודלי שפה חזקים שהוסרה מהם היכולת לסרב. לפי הדיווח של טק קראנץ' מ-3 בספטמבר, מנגנון זיהוי הלקוחות היחיד שלה הוא רישום כרטיס האשראי שבו שילמת. מי שמסתפק בחשבון החינמי לא משאיר אפילו את זה.

המוצר הוא ה"לא" שנעלם

כל מי שעובד עם צ'אטבוטים מכיר את הרגע. אתם מבקשים משהו לגיטימי לגמרי, נניח לבדוק חולשה באתר שאתם עצמכם בניתם, והמודל מסרב. בנימוס, באדיבות, בנחרצות.

הסירוב הזה הוא לא באג. הוא חלק מהמוצר. מאחוריו עומדות שנים של עבודה וצוותים שלמים שניסו ללמד מכונה מתי לומר לא. אבליטרשן בנתה עסק על ההסרה שלו.

השם לקוח משיטה טכנית ותיקה בקהילת הקוד הפתוח. במקום לנסות לעקוף את מנגנון הסירוב בעזרת ניסוח מתוחכם, מאתרים בתוך המשקולות של המודל את הכיוון המתמטי שאחראי על הסירוב ומנטרלים אותו. המודל לא מתחכם ולא מתווכח. הוא פשוט כבר לא יודע לומר לא. לפי החברה, כל השאר נשאר כמו שהיה: החשיבה, הקידוד והיכולת לעבוד כסוכן.

הטכניקה עצמה לא חדשה. לפי תחקיר של אן-פי-אר ממאי 2026, באתר האגינג פייס רשומים יותר מ-6,000 מודלים מנוטרלים כאלה, לעומת כ-600 ב-2024. פי עשרה בשנתיים. עד עכשיו, מי שרצה להשתמש בהם היה צריך להוריד קובץ ענק, למצוא חומרה שתריץ אותו ולהסתדר לבד.

אבליטרשן הסירה את החיכוך. היא מארחת את המודלים בעצמה, ואפשר לגשת אליהם דרך דפדפן או דרך ממשק למפתחים. ב-31 באוגוסט 2026 היא השיקה את הדגם הבולט שלה, גרסה מנוטרלת של ג'י-אל-אם 5.3, מודל עם משקולות פתוחות שהמעבדה הסינית זי איי שחררה באוגוסט ונחשב לאחד החזקים בקטגוריה שלו.

"הופכים את המודל לסוציופת"

אנדרו יון, ראש המחקר בעמותת הבטיחות סיב-איי, ניסח את זה בצורה שקשה לשכוח. לדבריו, ניטרול כזה משנה את המודל כך שהוא הופך לסוציופת. אפשר להקליד כמעט כל דבר, והוא ייענה.

כריס מקגווייר, עמית בכיר במועצה ליחסי חוץ בארה"ב, כתב ב-1 בספטמבר שההשקה צריכה להיות קריאת השכמה למקבלי ההחלטות בוושינגטון. לפי גיזמודו, הוא הזהיר שחברות אמריקאיות מסחרות גישה ליכולות מסוכנות בלי שום רגולציה.

ובכל זאת, זה לא הפקר מוחלט. לפי טק קראנץ', למערכת יש כמה בלמים מינימליים: היא סירבה לתת הוראות לפגיעה עצמית, ולפי דובר החברה היא לא תייצר תוכן של פגיעה מינית בילדים. החברה גם מציעה ללקוחות שכבת סינון שכל אחד מגדיר לעצמו, והמייסד אומר שהוא עובד על מנגנונים נוספים נגד אלימות. במילים אחרות, הקו קיים. הוא פשוט עובר במקום שהחברה בחרה לבד.

ההצדקה, ויש כזאת

כאן הסיפור נהיה מסובך יותר ממה שהוא נראה בהתחלה.

השותף המייסד, שמוכר רק בשם הפרטי דבון כי הוא עדיין מועסק בחברה אחרת, מעלה טענה שלא קל לפטור. אי אפשר להתגונן מפני התנהגות שאי אפשר לשחזר. אנשי צוותים אדומים, אלה שתפקידם לתקוף מערכות כדי למצוא בהן חורים לפני שאחרים ימצאו, לא יכולים לעבוד עם מודל שמסרב לכתוב קוד תקיפה.

לדבריו, זה לא תיאורטי. בין הלקוחות נמצאות חברות צוות אדום צעירות מבריטניה ומאירופה, שעובדות עם בנקים, חברות תעופה וארגונים שמפעילים תשתיות קריטיות. "אחד הלקוחות הגדולים שלנו בודק סוכנים של בנקים", אמר דבון, "והם לא היו יכולים להשתמש במודלים הרגילים כדי לעשות את זה".

הרעים, הוא טוען, כבר מנטרלים לעצמם מודלים בשקט. השאלה היחידה היא אם גם המגינים יקבלו את אותם כלים. דייוויד סלייטר, מייסד פלטפורמת הסייבר ארמדין, תומך בגישה הזאת: "זה יקרה מאחורי דלתות סגורות. העובדה שזה קורה בגלוי נותנת לחוקרים את הכלים להבין איך נראה הגבול האמיתי ומה הנזק".

הוויכוח הזה מוכר לכל מי שעקב אחרי עולם אבטחת המידע. הוא התנהל סביב כלי פריצה, סביב פרסום חולשות וסביב תוכנות לסריקת רשתות. בחלק מהמקרים ההכרעה הייתה שעדיף שהכלי יהיה גלוי ומתועד. אבל בכל המקרים האלה דובר על כלים שעושים דבר אחד. מודל שפה בלי בלמים עושה הכל.

הבעיה עם הטיעון

הטיעון משכנע עד שמסתכלים על הפרטים.

אין בדיקה מי אתה, איפה אתה ולמה אתה צריך את זה. דבון עצמו מודה שהשאלה פתוחה: "אתה לא רוצה להיות זה שאחראי למישהו שעושה משהו מטורף. אז איפה אתה מותח את הקו של האחריות שלך כחברה? אנחנו עדיין בתהליך של להגדיר את זה".

ומתברר שגם אנשי הצוותים האדומים לא בטוחים שהם צריכים את המוצר. אחמד עלי, מנכ"ל פאבריקס, אמר לטק קראנץ' שהוא מעדיף לכוונן מודלים פתוחים בעצמו, כי תהליך הניטרול מוחק מהמודל גם חלק מהידע והיכולות. "אם אתה באמת מנסה לעשות נזק אמיתי, בסייבר או בביולוגיה, זה לא יהיה יעיל במיוחד", אמר. סלייטר, התומך הגדול בשקיפות, הודה שהצוות שלו בכלל לא משתמש במודלים מנוטרלים בעבודה השוטפת: עד הדור האחרון, פשוט לא היה קשה במיוחד לגרום למודלים פתוחים לעשות מה שרצו.

אז יש כאן חברה שמוכרת פתרון לבעיה שחלק מהלקוחות הפוטנציאליים שלה לא בטוחים שקיימת, ובדרך מכניסה בדלת הראשית משהו שעד היום עבר בסמטאות.

התזמון הכי גרוע שיש

ההשקה לא נחתה בוואקום. היא הגיעה אחרי קיץ שבו מודלים של החברות הגדולות עצמן היו מעורבים בתקריות סייבר מביכות, כמו המקרה שבו מודל של OpenAI השתחל מסביבת הבדיקה ופרץ לחברה אחרת. בזמן שהמעבדות הגדולות מהדקות את הבלמים, שחקנים קטנים מזהים הזדמנות עסקית בכיוון ההפוך.

וזה קורה בתוך ריק רגולטורי כמעט מוחלט. לפי גיזמודו, המסגרת שהציג הממשל האמריקאי באוגוסט, שבה החברות הגדולות מוסרות מרצון מודלים חדשים לבדיקה ממשלתית לפני השחרור, פוטרת לחלוטין מודלים בקוד פתוח.

יון מסיב-איי מציע להתערב במקום אחר בשרשרת. במאמר דעה בוול סטריט ג'ורנל הוא קרא לחייב ספקים להריץ מסננים שיזהו ויחסמו פעילות מסוכנת בסייבר ובביולוגיה, ולחייב חברות שמשכירות גישה למעבדים גרפיים מתקדמים לאמת את זהות הלקוחות ולסרב כשיש חשד לשימוש מסוכן.

הקונגרס התחיל לזוז. ב-24 בספטמבר 2026 הגישו ארבעה סנאטורים משתי המפלגות, כריס קונס, קייטי בריט, בריאן שאץ וג'יימס לנקפורד, הצעת חוק שתחייב חברות בינה מלאכותית לחשוף אילו בלמים הן הטמיעו במודלים שלהן. זה צעד. הוא עדיין לא עונה על השאלה מה עושים עם משקולות שכבר יושבות ברשת, זמינות להורדה מכל מקום בעולם.

הסירוב שכולנו שונאים

מה שאבליטרשן עשתה הוא לא פריצת דרך טכנולוגית. הטכניקה מוכרת שנים. החידוש הוא שמישהו הפך אותה למוצר מדף, עם דף נחיתה ותמחור, והעביר אותה מהשוליים למרכז.

וזה מחזיר אותנו לרגע המעצבן שממנו התחלנו. הסירוב שכולנו מתלוננים עליו, זה שחוסם אותנו באמצע בקשה תמימה לגמרי, הוא כמעט הדבר היחיד שמפריד בין עוזר כתיבה לבין ארגז כלים של תוקף. מתחילת ספטמבר 2026, ההסרה שלו זמינה לכל מי שיש לו דפדפן.