הבנת OpenAI כיצד היא מתמודדת עם "גרמילים" בתשובות של הבינה המלאכותית והסירה מגבלות.

הבנת OpenAI כיצד היא מתמודדת עם "גרמילים" בתשובות של הבינה המלאכותית והסירה מגבלות.

23 software

אופנאי חשפה את ה«בעיה» עם הגובלינים

ב־Wired נודע כי חברת OpenAI נתקלת בתכונה בלתי צפויה במודלי הבינה המלאכותית שלה: הם החלו לעיתים קרובות להזכיר גובלינים, גרמילונים וחיות בדויות אחרות. כדי לתקן זאת, מפתחים נאלצו לתת למודל הוראות מיוחדות: «אל תגיד אף פעם על גובלינים, גרמילונים, סנאים, טרולס, אוגרים, ציפורים או כל חיה ויצור אחר».

למה התפתח הרגל?

הבעיה הופיעה לאחר שחרור GPT‑5.1, במיוחד כאשר בדיאלוג נכנס הדמות «בוטאניק» (Nerdy). עם כל עדכון של המודל, תדירות ההזכרות רק עלתה. נחשף כי במהלך אימון חיזוק המטאפורות הללו קיבלו תגמול – אך רק בעת הפעלת אישיות בוטאניק. מכיוון שאימון חיזוק אינו מבטיח שמירה על ההתנהגות באותו הסביבה, הרגל כזה יכול היה להתפשט גם לחלקים אחרים של המודל, במיוחד אם התוצאות הוחזרו לשימוש חוזר בהגדרות או במידע העדפות.

איך החברה הגיבה?

במרץ OpenAI הפסיקה להשתמש בבוטאניק, ולאחר מכן ההזכרות של גובלינים כמעט נעלמו. עם זאת, הם החלו להופיע שוב בשירות Codex עם GPT‑5.5, מכיוון שהאימון התחל לפני שהתגלתה הבעיה. לכן המפתחים נאלצו להוסיף הוראות נוספות ל־Codex: «אל תזכיר יצורים מיתולוגיים». למרות זאת, משתמשים שמעדיפים סגנון תקשורת כזה קיבלו אפשרות לבטל את הגבלות אלו באמצעות קוד מיוחד.

כך OpenAI התמודדה עם הרגל בלתי צפוי של מודלי הבינה המלאכותית שלה והטיבה צעדים לתיקוןו, תוך הצעת תצורות גמישות לקהלים שונים.

תגובות (0)

שתפו את דעתכם — אנא היו מנומסים והישארו בנושא.

אין תגובות עדיין. השאירו תגובה ושתפו את דעתכם!

כדי להשאיר תגובה, אנא התחברו.

התחברו כדי להגיב