שיאומי השיקה גרסה חדשה של מודלי AI MiMo V2.5, המאפשרים להמיר טקסט לדיבור ולהפך

שיאומי השיקה גרסה חדשה של מודלי AI MiMo V2.5, המאפשרים להמיר טקסט לדיבור ולהפך

22 software

שיאומי משיקה דגמים קוליים חדשים של בינה מלאכותית

החברה שיאומי הציגה שתי גרסאות של הדגמים הקוליים שלה, המופעלים בטקסט ואודיו:

דגםתכונהמאפיינים עיקריים
MiMo‑V2.5‑TTSטקסט → דיבור3 וריאנטים, חינמיות לתקופה מוגבלת ב-MiMo Studio; התאמת מהירות, גוון ורגשות; אפשרות ליצור קולות חדשים לפי משפט קצר (VoiceDesign) והעתקת קול ממספר דוגמאות קטנות (VoiceClone).
MiMo‑V2.5‑ASRדיבור → טקסטזיהוי דיבור במצבים מורכבים, תמיכה בדיאלקטים סיניים + אנגלית; דו-שיחים דו-לשוניים וטקסטי שירים (ווקאל ברקע מוסיקה); עבודה בתנאי רעש גבוה; סימון פיסוק אוטומטי לפי אינטונציה.

איך להשתמש ב‑MiMo‑V2.5‑TTS
1. גרסה בסיסית – בוחרת אחד מהקולות המוגדרים מראש ומאפשרת שינוי מהירות, גוון וצליל רגשתי.
2. VoiceDesign – מכניס משפט קצר, ואז המערכת מייצרת טון קול חדש.
3. VoiceClone – מוריד כמה דוגמאות של הקול הנבחר; הדגם מחזיר אותו תוך שמירה על סגנון והוראות.

כדי להשיג את הצליל הרצוי המשתמש יכול:

- להוסיף תגיות מיוחדות לטקסט;
- לתאר את הקול בשפה טבעית פשוטה (בסינית או באנגלית);
- ליצור תרחישים להצגות וירטואליות שבהן כמה קולות מתקשרים בו‑זמנית.

מאפייני MiMo‑V2.5‑ASR
- רב‑לשוניות – תמיכה בדיאלקטים רבים של סינית ובאנגלית.
- פענוח שירים – הדגם מזהה ווקאל גם ברקע מוסיקלי.
- עמידות לרעש – זיהוי מדויק בתנאי רעש חזק.
- סימון פיסוק לפי אינטונציה – מוסיף אוטומטית סימני פיסוק, מה שמפחית צורך בעריכה ידנית.

כך שיאומי מרחיבה את יכולותיה בתחום הטכנולוגיות הקוליות, מציעה כלים גמישים ליצירת דיבור סינתטי ולזיהוי מדויק של מידע בעל פה.

תגובות (0)

שתפו את דעתכם — אנא היו מנומסים והישארו בנושא.

אין תגובות עדיין. השאירו תגובה ושתפו את דעתכם!

כדי להשאיר תגובה, אנא התחברו.

התחברו כדי להגיב