Google השיקה מודל תמלול חכם חדש
Google הציגה את Gemini 3.5 Transcribe — מודל ייעודי להמרת דיבור לטקסט בקבצי אודיו ובזמן אמת.
המודל תומך ביותר מ-85 שפות, זיהוי דוברים, חותמות זמן ברמת המילה, מעבר בין שפות ואוצר מילים מותאם אישית.
יותר מתמלול
מצב Smart transcription יכול להסיר מילות מילוי, להבין תיקונים עצמיים ולארגן את הטקסט. כך תמלול הופך לשלב ראשון בסיכום שיחות, עדכון CRM, יצירת משימות וניתוח שירות.
מגבלות ומסקנה
עיבוד קובץ נתמך עד שעה, ועד 30 דקות כאשר מופעלים זיהוי דוברים או חותמות זמן. Google מדווחת על שיפור של כ-70 percent בזמן עד לתמלול הסופי בהשוואה ל-Chirp 3, אך יש לבדוק את התוצאות על הקלטות אמיתיות.
במקרים רגישים מומלץ לשמור גם את הגרסה המילולית. תמלול חכם נוח יותר, אך כולל מידה מסוימת של פרשנות.

