כשהייתי ילד, היינו שבע נפשות בדירה עם שלושה חדרי שינה. חלקתי חדר אחד עם אחיי. אחרי שהיינו אמורים להיות ישנים, אבא שלי היה נכנס, מתיישב ליד המחשב, ומתחיל לשחק Red Alert 2.
להישאר ער עד שתיים בלילה היה קשה, אבל בדרך כלל עשיתי את זה בכל זאת. לאף אחד מהחברים שלי לא היה אבא שעשה משהו כזה. בשבילי, זה היה הדבר הכי מגניב בעולם.
אבא שלי ניהל חיילים, טנקים, רחפנים, ומכונות מוזרות מול כוח אויב גדול בהרבה משלו. אדם אחד מפקד על מלחמה שלמה. הוא לחץ על העכבר במהירות, ושלח יחידות על פני המפה. המכונות זזו ונלחמו בעצמן עד שהיו צריכות פקודה נוספת. הוא צפה בכל השדה והחליט איפה להתערב.
במבט לאחור, אני מבין למה זה נשאר איתי: אדם אחד צופה במשחק כולו ומחליט איפה להתערב.
שנים אחר כך, בניתי את אותו סוג של חדר לרכבים ורובוטים אמיתיים. היום אני בונה אותו לסוכני AI שעושים עבודה משפטית ופיננסית.
מרכז הפעילות של Phantom Auto, אטלנטה. נבנה כדי לאפשר למפעילים מרחוק לקחת שליטה ברכב או ברובוט ברגע שהמכונה לא יכלה להחליט בעצמה.
ב-Phantom
ב-Phantom הושבנו מפעילים בחדר שממנו יכלו לראות את הרכבים ולקחת שליטה כשצריך.
ב-2017 הקמתי חברה סביב הרעיון הזה. ל-Phantom Auto היו שש עמדות מפעיל ב-Mountain View, כל אחת עם הגה, דוושת בלם ודוושת האצה. חיבור שאיחד את רשתות הסלולר של AT&T, Verizon ו-T-Mobile קישר אותן, עם מצלמות שכיסו כל זווית סביב הרכב, כך שמפעיל מרחוק בקליפורניה יכול היה לנהוג ב-Lincoln MKZ בתנועה בלאס וגאס, 870 קילומטר משם, בזמן אמת. הניו יורק טיימס וWired סיקרו את זה; ה-WSJ צילם.
ב-2019 עברנו מרכבים אוטונומיים בכבישים ראשיים ללוגיסטיקה: מלגזות, משאיות חצר לוגיסטיות ורובוטים למשלוחים על מדרכות, ללקוחות כמו Maersk, CJ Logistics, ArcBest ו-Serve Robotics. המפעילים כבר לא נהגו בכבישים ציבוריים; הם נהגו בציוד מחסן בכמה אתרים מחדר אחד במרחק אלפי קילומטרים. אדם אחד יכול לנהוג במלגזה אחת, ואדם אחד יכול לצפות בכמה.
מפעילי Phantom Auto, 2024. כל מפעיל ניהל מספר רכבים במקביל באתרי לקוחות שונים. Wired סיקרה את המעבר לעבודה פיזית מרחוק כתופעה רחבה יותר.
סגרנו את Phantom במרץ 2024, אחרי שבע שנות פעילות וגיוס של 95 מיליון דולר.
ובכל זאת, הצורך באנשים שיעזרו למכונות במצבים קשים נשאר. Serve Robotics רכשה את הקניין הרוחני והנכסים באפריל 2025 לתמיכה בצי רובוטי המשלוחים שלה. Waymo קוראת לסיוע מרחוק שלה Fleet Response ומפעילה אותו מחדר מאויש. לטסלה יש מפעילים מרחוק עבור ה-Cybercab.
התערבות יכולה גם להפוך לדוגמת אימון. מפעיל שעוקף אתר בנייה או מתקן מסלול של רובוט במחסן משאיר החלטה שאפשר לבחון אחר כך. כך גם עורך דין שמתקן סעיף מוצע בחוזה. עדיין צריך להחליט אילו תיקונים כדאי להכניס לנתוני האימון של המודל.
כשטעות עוצרת את העבודה
ב-Red Alert טעות עלתה לך את המשחק; במערכות אמיתיות היא יכולה לעצור את כל הפריסה.
ב-12 ביוני, שלושה ימים לאחר השקת Fable 5, אנתרופיק נדרשה לחסום בפני אזרחים זרים את הגישה ל-Fable 5 ול-Mythos 5, ומכיוון שהחברה לא יכלה להבטיח הבחנה בזמן אמת בין אזרחים אמריקאים לאזרחים זרים, היא השביתה את שני המודלים לכל הלקוחות. שבועיים לאחר מכן הגישה ל-Mythos 5 נפתחה מחדש לקבוצה קטנה של ארגונים מאושרים. Fable 5 נשאר חסום.
אנתרופיק דחתה את הממצאים והזהירה שאם אותו סטנדרט יוחל על כל התעשייה, זה "יעצור בעצם את כל פריסות המודלים החדשות לכל החברות שמפתחות מודלי חזית." סיכון אחד, שתואר ברמה גבוהה בלבד, היה מספיק כדי להשבית מודל חזית עבור מאות מיליוני אנשים בתוך אחר צהריים אחד.
שיפוט אנושי בנה את המודלים האלה. למידת חיזוק ממשוב אנושי, RLHF, היא אנשים שיושבים בלולאה במהלך אימון ההמשך, מדרגים תוצאות ומלמדים את המודל מהי תשובה טובה. הצורך הזה לא נגמר עם האימון. הוא עובר לכל מקום שבו ההשלכות הופכות אמיתיות: מודל שכותב טיוטה ראשונה יכול לפעול כמעט בלי בקרה, ומודל ששולח את האימייל, מעביר את הכסף, חותם על החוזה או מנווט את המכונית עובד במקום שבו טעות עולה ביוקר וקשה לתקן אותה. רמת הבקרה שמערכת צריכה נקבעת על ידי העלות של טעות.
במרץ 2018 רכב אוטונומי של Uber הרג הולכת רגל בטמפה, אריזונה. Uber השעתה את כל תוכנית הבדיקות האוטונומיות שלה תוך ימים. מוות אחד, וצי שלם עצר. לאחר מכן, תעשיית הרכב האוטונומי הפכה הרבה יותר זהירה לגבי העברת השליטה בין המכונה לאדם.
סוכני תוכנה כבר משלמים חשבוניות, מגישים מסמכים ומשנים פרטי לקוחות. אחרי כשל חמור, לקוחות ירצו לדעת מי יכול היה לעצור אותו, ולמה לא עצר.
למי פונים
לפני שסוכן מתחיל לעבוד, אני רוצה לדעת למי הוא פונה כשהוא לא יכול להמשיך בבטחה. לאדם הזה צריכה להיות סמכות לעצור את המשימה ודרך לראות מה הסוכן כבר עשה.
מודל יכול להיות מסוגל להכין חוזה או פעולה כספית בלי שנרצה לתת לו סמכות להתחייב בשמנו, ואלה הרשאות נפרדות בתהליך העבודה.
ב-mixus, שלב יכול לדרוש אישור אנושי לפני שהוא מתקדם, והמערכת מחכה עד שמישהו מאשר; הבדיקה מנותבת לאדם עם המומחיות הנכונה, ואם היא מתעכבת, היא מועברת לגורם בכיר יותר. אפשר לתת לסוכן להכין את העבודה, ולפני שהטיוטה מחייבת מישהו בחוזה או הופכת לפעולה כספית, צריך לעצור לאישור. כל החלטה מתועדת.
התור לבדיקה
בדיקה שלוקחת שעה הופכת לתור, ואנשים עוקפים תורים. הבקשה צריכה להגיע לאדם הנכון עם מספיק הקשר כדי להחליט, וכל אישור צריך לשאת שם. אם החלטות שגרתיות ממשיכות להפריע למומחה, גם ההחלטות הקשות נאלצות לחכות.
איך נותנים לבודק מספיק הקשר כדי לקבל החלטה טובה, בלי לגרום לו לעשות את העבודה מחדש?
קשור: תנו לחול לחשוב, אנחנו מתמזגים
מקורות
- Command & Conquer: Red Alert 2, ויקיפדיה.
- הצהרת אנתרופיק על ההנחיה להשעות את Fable 5 ו-Mythos 5, כולל האזהרה לכל התעשייה (ארכיון מ-13 ביוני 2026).
- דיווח על ההשבתה: SiliconANGLE.
- תאונת הרכב האוטונומי של Uber בטמפה 2018 והשעיית התוכנית שבאה בעקבותיה (רקע).
- פעולות הסיוע מרחוק של Waymo ו-Tesla: Waymo fleet response, Wired על סיוע מרחוק של טסלה.
- סיקור Phantom Auto: ניו יורק טיימס, Wired: שליטה מרחוק ברכבים אוטונומיים, Wired: עבודה פיזית מרחוק, WSJ וידאו.
- סגירת Phantom Auto ורכישת Serve Robotics: TechCrunch, הודעת Serve Robotics.