גוגל השיקה שדרוג קולי למודל שלה – והצליחה לעורר זעם ברשת
גוגל השיקה את מודלי יצירת הדיבור Gemini 3.8 Flash TTS ו-Gemini 3.8 Flash-Lite TTS, המאפשרים עיצוב קולות מותאמים אישית ובימוי דיאלוגים מורכבים. המודלים זוכים לציוני שיא במבחני איכות עולמיים, אך ההשקה עוררה זעם ברשת בשל דחיית מודל העל Gemini 4 Pro, לו ממתינים מפתחים חודשים ארוכים.
גוגל הכריזה בסוף השבוע על השקת צמד מודלי המרת טקסט לדיבור: Gemini 3.8 Flash TTS ו-Gemini 3.8 Flash-Lite TTS. המודלים החדשים מאפשרים למפתחים ליצור זהויות קוליות מותאמות אישית בלמעלה מ-100 שפות וניבים, מתוך תיאור מילולי בלבד, ומציעים מנגנון בימוי תסריט שורה-אחר-שורה הכולל לחישות, שינויי קצב, מבטאים ושיחות מרובות-דוברים. במבחני האיכות העולמיים, המודל כבש את המקום הראשון במדד Hume AI לעיצוב קולות ואיכות שמע, והוביל בהערכות עיוורות ב-Voice Arena. עם זאת, ההשקה נתקלה בגל ביקורת עוקצני מצד קהילת ה-AI, שאיבדה את הסבלנות לעוד גרסת "פלאש" וממתינה חודשים ארוכים למודל העל Gemini 4 Pro. הרשתות החברתיות X ו-Reddit הוצפו בממים ולעג על קצב השחרור של גוגל, בעוד מתחרותיה (OpenAI, אנתרופיק, אילון מאסק) השיקו מודלי חזית ענקיים. מפתחים הביעו תסכול מכך שגוגל ממשיכה לפצל את המותג לגרסאות משניות במקום לשחרר את מודל הדגל. המודלים שולבו החל מהיום ב-Google AI Studio, Google Vids, Gemini Notebook ובשותפויות עם Figma ו-HeyGen.