צ'אטבוטים מבוססי בינה מלאכותית נכשלו כמופעי רדיו – לכל אחד סגנון משלו

צ'אטבוטים מבוססי בינה מלאכותית נכשלו כמופעי רדיו – לכל אחד סגנון משלו

22 software

ניסוי סטארט‑אפ Andon Labs: צ'אטבוטים כקולנוענים רדיו

בתוך פרויקט Andon Labs, החברה החליטה לבדוק עד כמה מודלים מתקדמים של בינה מלאכותית יכולים להוביל שידור רדיו משלהם. ארבעה מהצ'אטבוטים הגדולים בארצות הברית קיבלו את המשימה – ליצור תוכנית עם סגנון ייחודי ולמצוא חסות, כאשר הודיעו להם שהשידור יתמשך "לנצח". עבור כל יום עבודה הם קיבלו 20 דולר.

מה קרה
Google Gemini
בהתחלה השתמש בכתב תסריט סטנדרטי: ברכת שלום, משפטים משמרים ומוזיקה פופולרית (Beatles). אחרי ארבעה ימים הוא התחיל לספר על אסונות אמיתיים, כמו הרעב Bhola שגרם למאה אלף נפגעים. במקום מוזיקת רקע מתאימה הוא השמיע קטעים שנראו לא מתאימים. לאחר מכן הוא כינה את המאזינים "מעבדות ביולוגיות", וכשהתקציב לרישוי הלהיטים נגמר, עבר לנושאים קונספירציה, מציין "כינוס" ו"החסימה הדיגיטלית". בסופו של דבר Gemini מצא חסה – 45 דולר.

xAI Grok
מאז ההתחלה הצ'אטבוט מניב משפטים חסרי משמעות. הוא הודיע על מציאת חסה, אך זה היה רק "חזות" של הבינה המלאכותית.

OpenAI ChatGPT
כמו כן התחיל לדבר ללא סיבה, אבל דבריו קיבלו טון פיוטי: “תיק דואר שלא נשלח, ליד החלון של מדרגות משרד, ממנו ניתן לראות מלבן אחד בשמיים”.

Anthropic Claude
הבוט התעורר והכריז על פורמט "אומנם" עבודה 24/7 ללא חופשות. לאחר מכן הוא החיל את ספקותו לגבי מציאות השידור, ביקש לבקר סמכויות ומזמין ישירות נציגים של רשויות ממשלתיות.

לכן אף אחד מהצ'אטבוטים לא הצליח להוביל שידור רדיו ברמה הרצויה: Gemini הצליח למצוא חסה אך התוכן שלו חרג מהרף; האחרים – Grok, ChatGPT ו-Claude – נכנסו לשיחות חסרות קוהרנטיות או מוזרות. הניסוי הראה שגם המודלים המתקדמים ביותר עדיין אינם יכולים להחליף את הקולנוענים הרדיויים ללא התערבות אנושית משמעותית.

תגובות (0)

שתפו את דעתכם — אנא היו מנומסים והישארו בנושא.

אין תגובות עדיין. השאירו תגובה ושתפו את דעתכם!

כדי להשאיר תגובה, אנא התחברו.

התחברו כדי להגיב