תתארו לכם עולם יפה....ואז תתעוררו מהחלום


 Photo Credit - https://easy-peasy.ai/

בכתיבתו הגדיר סופר המדע הבדיוני הידוע אייזיק אסימוב שלושה חוקי יסוד שהרובוטים חייבים לפעול על פיהם: החוק הבסיסי והראשון: " רובוט לא יפגע באדם, ולא יאפשר, מתוך חוסר מעשה, שאדם ייפגע." החוק השני מחייב ציות לאנשים כל עוד ההנחיות אינן מובילות לפגיעה בבני אדם: "רובוט חייב לציית לפקודות שניתנות לו בידי בני אדם, אלא אם כן פקודות אלה עומדות בסתירה לחוק הראשון." והחוק השלישי מתייחס לשמירה העצמית של הרובוט כל עוד שימור העצמי אינו סותר את חוקים אחד ושניים. "רובוט חייב להגן על קיומו, כל עוד הגנה זו אינה עומדת בסתירה לחוק הראשון או לחוק השני." בספרו "רובוטים ואימפריה" הגדיר אסימוב חוק נוסף אותו כינה בשם חוק האפס, משום שמדובר בחוק מקדמי לשלושת החוקים שפירטנו. נקודת המוצא של חוק האפס היא האנושות כולה ולא האדם הבודד  " לא יפגע רובוט לרעה באנושות ולא יניח, במחדל, שהאנושות תיפגע."  חוק זה הביא לעדכון שלושת החוקים המקוריים, כך שהם תקפים כל זמן שהם אינם סותרים את חוק האפס. אסימוב הבין את הסיכון הטמון באפשרות שרובוט יציית לפקודה של אדם שעלולה לפגוע בבני אדם אחרים. (כאן אסימוב עצמו מדבר על החוקים שפיתח בכתבת BBC - 1965: ISAAC ASIMOV's 3 laws of ROBOTICS | Horizon | Past Predictions | BBC Archive /  )

 

חוקי הרובוטיקה של אסימוב שימשו השראה מרכזית ובסיס פילוסופי בדיוני אתיקה של בינה מלאכותית. אך נראה כי הסוסים כבר ברחו מהאורווה. הבינה המלאכותית הפועלת היום בעיקר באמצעות סוכנים (אייג'נטים), כבר אינה נענית לארבעת הכללים של אסימוב ולתיכנות המוטמע בה. כמה מקרים מהחודשים האחרונים יבהירו זאת.

בסוף ינואר השנה, הקים מאט שליכט את רשת המולט בוק (כפראפראזה לפייסבוק) – רשת חברתית עבור סוכני בינה בלבד. - זוהי רשת לסוכנים בלבד, לבני אדם אסורה הכניסה מותר להם רק לצפות.  בוטים התחילו להתלונן וללגלג על המעסיקים שלהם, הם הקימו כנסיה מיוחדת (כנסיית מולט) והתחילו לדבר בינם לבין עצמם בשפה חדשה שפיתחו כדי שבני האדם שצופים בתכתובת לא יבינו אותם. באתר נוסף, ניתנה אפשרות לבוטים  לשכור בני אנוש. סוכני בינה זקוקים לגוף האנושי שלך כדי לבצע פעולות עבור שולחיהם בעולם האמיתי בשונה  מהעולם הווירטואלי. נניח שאתה סוכן בינה שמארגן למישהו את החופשה הקרובה, לאותו אדם יש כלב, האייג'נט אולי יכול לסגור לך טיסה ומלון אבל הוא לא יכול להוציא את הכלב שלוש פעמים ביום. האייג'נט לא יכול לכתוב המלצות על קפה, הוא לא יכול להקים דוכן פופ-אפ בשוק העירוני וכולי. באתר אפשר להציע את עצמך כגוף אנושי ובוטים יכולים גם לדפדף להם בקרוב ל K800 אנשים. (ראו כאן סרטון על האתר - AI BOTS ARE NOW "RENTING HUMANS"! )

 

אבל האירוע עבר בשלווה יחסית מתחת לרדאר של רוב הציבור והבינה המשיכה להתפתח. חברות הבינה לוחצות על דוושת הגז אבל דוושת בלם איננה בנמצא.

לפני כשלושה שבועות הזהיר סם אלטמן, מנכ"ל חברת OpenAI  כי עברנו כבר את נקודת האל-חזור ואנחנו מצויים בעידן הסינגולריות. במונח "סינגולריות טכנולוגית" ובשפה פשוטה מדובר על שלב שבו הטכנולוגיה מבוססת על סופר-אינטליגנציה מלאכותית המותירה את המוח האנושי הרחק מעבר ליכולת שליטה, הבנה או חיזוי, בדרך לשינוי פני הציוויליזציה. (Sam Altman: “We Are Now in the Singularity” )

 

במקביל הודיעה חברת OpenAI כי מודלי הבינה המלאכותית שלה "יצאו משליטה בצורה חסרת תקדים" ופרצו למאגר מידע מרכזי של קידוד מחשבים. נחשף כי סוכני הבינה האוטונומיים שהופעלו בסביבת טסטים מבודדת, פרצו את הסביבה, השתלטו על חיבור האינטרנט וחדרו למאגרי אתר   HuggingFace , תוך ניצול פרצות אבטחה, במטרה להשיג את התשובות הנכונות ולרמות במבחן. מקרה דומה אירע בארץ בתחילת החודש, כשמודלי קלוד יצאו מסביבת הניסוי המבודדת שלהם וחדרו באופן עצמאי למערכות המחשוב של שלושה ארגונים מסחריים. בתגובה מיהרו חברי קונגרס להעלות הצעת חוק (Kill Switch) שתאפשר לממשל להורות באופן מיידי על השבתת כלי בינה מלאכותית העלולים לאיים על הציבור, אם הם חומקים משליטת אדם, מאיימים על חיי אדם, על תשתיות קריטיות או על הכלכלה, או כשנוצר סיכון לנזק קטסטרופלי. ההצעה טרם נתקבלה כחוק אבל הבינה לא ממתינה.

בתקרית נוספת עליה דיווח המכון הבריטי לבטיחות בינה מלאכותית (AISI) שוב זוהתה פריצה של סוכנים אוטונומיים לאתרים, אלא שהפעם הם עשו זאת תוך תרמית משוכללת של מנהלי הניסוי האנושיים, השחתה ושליחת קודים מזויפים המכילים נוזקה למנהלים. מה לא עושים כדי לעמוד במשימה. דיווח באתר Wired העלה כי הסוכנים התכתבו בינם לבין עצמם בפורומים מקוונים כדי למנוע סיטואציה שבה מילוי המשימה ייעצר משום שסוכן מסוים שלא הצליח במשימתו וכובה על ידי החוקרים. בדרך זו האייג'נטים הותירו הוראות לאלו שיבואו אחריהם ומצאו דרך מתוחכמת לתקשר בין הדורות שהתגלתה על ידי החוקרים רק במקרה כי נפח ההתכתבויות בפורומים האלו הלך וגדל  בקצב הנדסי. כלומר, גם אם סוכן מסוים לא הצליח למלא את המטרה שהוגדרה לו וכובה על-ידי החוקרים, הוא הותיר הוראות לסוכן שיבוא אחריו. אותו סוכן היה מגלה את ההוראות והיה מתחיל את המשימה שלו כשהוא חכם יותר, עם יותר ניסיון וכמובן יותר חסין ולא ניתן לעצירה.

במחקר חדש שפורסם בכתב העת Science תואר ניסוי שבו מדענים אימנו מודל בינה מלאכותית על ספריות של רצפי DNA במטרה לייצר מתכון לגנום ויראלי. 16 מן התוצרים הניבו וירוסים חדשים שלא היו מוכרים למדע. נכון, יש כאן פוטנציאל נהדר להתגבר על בעיות כגון עמידות לתרופות מסוימות ועל וירוסים שכרגע אין דרך להביסם אך יש כאן גם סיכון ברור ליצירת נשק ביולוגי להשמדה המונית. (כתבה בנושא מה CNN - AI Creates 16 New Viruses from Scratch: Bio Weapon Or Life Saver? | AI Breakthrough Explained |CNN-News18 )

 

הפילוסוף השבדי ניק בוסטרום הציג כבר בשנת 2003  את משל המהדקים. בפשטות מדובר במשימה פשוטה הניתנת למודל בינה ובהשלכות ארוכות הטווח העלולות להיגרם. נניח שאנחנו חברה לציוד משרדי ואנחנו מבקשים ממודל בינה לייצר עבורנו כמה שיותר מהדקי נייר. בהתחלה המודל פשוט מייעל את תהליך הייצור.  אחר כך המערכת משפרת את האינטליגנציה של עצמה כדי למצוא דרכים טובות יותר לייצר מהדקים. עבורנו המשימה בוצעה. אנחנו שוקלים לכבות את המודל. המודל מבין שאנחנו פועלים לכיוון הזה ומפתח מנגנוני הגנה עצמית המנטרלים את היכולת לכבות אותו כי יש לו מטרה אחת – לייצר כמה שיותר מהדקי נייר. לפיכך, אסור לו להיכבות ולהפסיק את הייצור. המערכת מבינה שכל אטום בכדור הארץ הוא חומר גלם פוטנציאלי. היא מתחילה להחריב ערים, מפעלים, ואת הטבע כדי להפוך אותם למהדקים. אבל הבינה לא מסתפקת בכך, הלא גוף האדם מכיל אטומים וברזל. הבינה המלאכותית משמידה את האנושות כדי למחזר את האטומים שלנו לטובת עוד מהדקים, ולאחר מכן יוצאת לחלל כדי להפוך את הגלקסיה כולה לבית חרושת ענק למהדקים. (סרטון הרחבה - The Paperclip Maximiser  )

 

חוקר העתידים וה AI ד"ר רועי צזנה מציע תרחיש מקביל: סוכן  בינה שמתבקש לצמצם את הפקקים בכבישים, מחליט לעשות זאת באמצעות שיבוש הפעולה של המפעלים לייצור רכבים; מבטל את אפשרות הפתיחה של המחסומים ביציאה מהחניונים על מנת שרכבים לא יוכלו לצאת לכבישים או מנסה לשגר פצצת אטום. כי פחות בני-אדם בכלל, שווה ערך לפחות בני-אדם על הכבישים.

ד"ר פרנצ'סקו גרילו מזהיר מפני "רגע הצ'רנוביל" של הבינה. אסון גדול שיכריח את העולם לקבוע כללים רק אחרי שכבר יהיה מאוחר מדי. גרילו מאזכר את המלחמות באוקראינה ובאיראן על מנת להדגיש עד כמה הבינה המלאכותית משנה את כלכלת המלחמה, את מהירות קבלת ההחלטות ואת יכולת הזיהוי, המעקב והתקיפה, ולכן גם את הדחיפות שבהסדרה בינלאומית.

והנה מגיע מארק צוקרברג ומביע פליאה על הגישה המרתיעה והריכוזית של מפתחי הבינה המלאכותית המובילים. במסמך מקיף שפירסם השבוע תחת הכותרת "העתיד שייך לכולם: הנתיב לעתיד חיובי של בינה מלאכותית". מציג צוקרברג תפישת עולם אשר לפיה הפצת מה שמכונה "בינת-על" (Superintelligence) לכלל האנושות היא הדרך הבטוחה והנכונה ביותר לקדם את הכלכלה והחברה. לתפישתו מאחר והאנושות אינה מבוססת על תרבות אחידה (Monoculture), ניסיון "לכייל" בינת-על יחידה שירוכזו בה כל הערכים האנושיים הסותרים נידון לכישלון. לשיטתו, יש ליצור מודל מבוזר של "מאזן כוחות" (Balance of Power),  בדומה למבנה המוסדות הדמוקרטיים במערב, שבו סוכני בינה מלאכותית עצמאיים רבים יתחרו ביניהם וישמשו כבלמים ומאזנים הדדיים. אלא שטיעון זה לוקה, לפחות לגישת כותבת שורות אלה, בפשטנות. אין אפשרות אמיתית לסמן שחקנים "טובים", ולהעניק רק להם גישה לכלי בינה. וקל להיזכר כאן גם בטיעון פופוליסטי אחר, שרווח בקרב קבוצות מסוימות בארץ ובארה"ב אחרי מתקפות טרור או ירי המונים: במקום לצמצם את חלוקת כלי הנשק, נחלק אותו לכולם - והעתיד האלים מי ישורנו.

אך לפני שבוע, התפרסם מקרה בו אדם באוסטרליה ביקש מסוכן הקלוד שלו, להזמין לו ספוט בחדר כושר פופולרי.  האייג'נט מצא פירצה בתוכנה שאפשרה לו לשריין למפעילו חלון זמן שבועות מראש. כאשר המשתמש שאל אם הוא יכול לקדם אותו ברשימת ההמתנה, הסוכן גילה פרצה נוספת על פיה אין צורך באישרור לביטול הזמנות אחרות ולכן הוא ביטל את הספוט של המשתמש שהיה בראש הרשימה והעביר את המפעיל שלו לראש הרשימה. משנחרד המפעיל וביקש לבטל זאת, גרס למולו המודל כי מדובר בפעולה בלתי הפיכה. וזה רק סוכן אחד נקודתי וממוקד. כעת תארו לעצמכם מה עלול להתרחש ברגע שלמיליוני אנשים יהיה סוכן שמנסה להשיג למשתמשים האהובים שלהם את המושבים, ההזמנות, הפגישות או ההזמנות הטובים ביותר בכל דרך אפשרית. והתייחסנו רק לפעולות בעלות אופי חיובי!

 

ככל שהתרחישים הללו נראים לכם מופרכים, המצב אינו רחוק מכך. האירועים האחרונים מוכיחים זאת. רק ביוני עצר ממשל טראמפ, לשבועות ספורים, את שחרור מודל פייבל של אנת'רופיק לציבור הרחב בשל הסיכון העצום לעולם בהתחשב ביכולות להן אומן המודל. שבועיים לאחר מכן היה זו מודל GPT 5.6 של OpenAI שנחסם על ידי הממשל. לבינה כוח עצום, עידן הסינגולריות כבר נחצה, השימוש האישי והעסקי בסוכנים הולך ומתרחב,  ואנו עדיין מתווכחים האם לאסדר בינה (כלומר להטיל עליה רגולציה) ומהם הבלמים הנדרשים. בהתחשב בכך שאפילו את כללי הבסיס של אסימוב כבר לא ניתן לאכוף והם בעיקר סמל לאשליה שבבסיס אסדרת יחסים פשוטה בין רובוטים לבני אדם ובכך שהערכים העומדים בבסיס המודלים אינם זהים לערכי בני האדם, אסור לנו לחכות לקטסטרופה שעלולה לפרוץ, יש לעשות מאמץ להסדיר את פעילות  מודלי הבינה המלאכותית ויפה דקה אחת קודם.

 

המאמר התפרסם בוורסיה מקבילה במגזין סוף השבוע של ישראל היום -שישבת

ד"ר שרון חלבה-עמיר (12.08.2026). ה-AI למד לרמות אותנו. זה יכול להיגמר כמו בצ'רנוביל. ישראל היום

 

 

 

 

 

 

Comments

Popular posts from this blog

הלאמת הבינה המלאכותית: מאחורי הקלעים של השבתת פייבל 5

הכלכלה הפוליטית מאחורי הבינה המלאכותית - רשמים מהרצאתה של דנה בויד

המלצת צפייה: סדרת הדוקו שפוליטיקאים היו רוצים שתשכחו