יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה

בנושא

בינה מלאכותית קולית

עליבאבא משיקה מודל קול דו-כיווני שמחליט בעצמו מתי לדבר

צוות Qwen של עליבאבא השיק את Qwen-Audio-3.1-Realtime, מודל קול בזמן אמת שיכול להקשיב ולדבר בו-זמנית, להפעיל כלים ולהחליט מתי נכון לענות. בבדיקה שפרסמה החברה שיעור התגובות השגויות לדיבור ברקע ירד מ-73% ל-13%. המודל זמין כבר עכשיו כ-API בפלטפורמת QwenCloud.

עליבאבא משיקה את Qwen Audio 3.1: חמישה מודלים קוליים, כולל זיהוי דוברים ורגשות, והוזלות של עד 95%

צוות Qwen של עליבאבא השיק את Qwen-Audio-3.1, סדרה של חמישה מודלים לזיהוי דיבור, להקראת טקסט ולשיחה בזמן אמת. גרסת ASR-Next מזהה כמה דוברים, רגשות וצלילי רקע. במקביל החברה מורידה את המחירים: עד 95% פחות על זיהוי דיבור, כ-85% פחות על המודל בזמן אמת וכ-70% פחות על הקראת טקסט.

אנבידיה משחררת את Nemotron 3 Diarization: מודל פתוח שמזהה עד 8 דוברים, גם בזמן אמת

אנבידיה פרסמה ב-Hugging Face את Nemotron 3 Diarization, מודל open-weight קטן יחסית, בגודל 100 מיליון פרמטרים, שקובע מי דיבר מתי בשיחה. המודל עוקב אחרי עד שמונה דוברים, גם כשהם מדברים בו-זמנית. אותו checkpoint עובד גם על הקלטות וגם על שידור חי.