קרב קודם · 2024-09-16 UTC
Speech Recognition התמודדות — 16 בספטמבר 2024
מקטגוריית Speech Recognition. 9 סימונים הוצבו על פני 5 לוחמים. MeetingNotes זכה בכתר.
הדירוג הסופי
ההרכב
הלוחמים
פרופילים של כל כלי שהשתתף בקרב הזה, ממוין לפי הציון הסופי.

MeetingNotes
עזרה לאירועי פגישה בעלת מומחיות ב-AI שתפסה, תרגמה וקצרה את אומרות החזית באופן אוטומטי.

MeetingNotes היא עזר לאירועי פגישה בעלת מומחיות ב-AI שמאפשרת דוקומנטציה אוטומטית. הנותן תומך ב-25+ שפות ומציע תרגום שפה ומינית. הוא מספק סיכומים עם-A I כאלה לפירוטיים, ומשמיט תפקידים אקציהם לעניין, ותומך בבוגר- GDPR מומחיות. ה- tool תוכנן תוך מטרה לחברפ- האפקטיבי, להצילזמאת ולאפשר לצוותל- העסוק, עלה קבי חייצ- אלהן. נותן- MeetingNotes כי משמיץ- Google Meet, Outlook ו-Zoom, ותומך בהגדלא ו- shareable עימ- teams. MeetingNotes יש שבע- 5,000+ teams, ו- 3,200,000+ שעת- audio יג'ם, ו- 95% לנ- Users חד- Manual- notes אל- preference
חלוקת קריטריונים
- תרגום-אוריינט בזמן- real
- סכומים- generated- AI ]
- הסרא- decision- item ו- action
- ציור- notes- shareable- export-
- הדמיד- meeting- searcha- history-
- Integrates with- calendar- video- tools

IBM Watson Speech to Text
זיהוי דיבור ברמת תאגיד מ-IBM Watson להמרת אודיו לטקסט מדויק

IBM Watson Speech to Text הוא שירות מבוסס ענן שממיר דיבור לטקסט כתוב במספר שפות וניבים. הוא מיועד לעסקים הזקוקים לתמלול אמין וניתן להרחבה לשימושים כגון ניתוח מרכזיות שירות, עוזרי קול, רישום פגישות, וכלי נגישות. השירות תומך בשידור בזמן אמת וגם בעיבוד אצווה של קבצי שמע, ומציע אפשרויות התאמה אישית לשיפור הדיוק עבור אוצר מילים ספציפי לתעשייה, ראשי תיבות והגיות. ניתן לפרוס את השירות דרך IBM Cloud או במקומות פנימיים באמצעות IBM Cloud Pak for Data, מה שמעניק לארגונים גמישות לגבי מיקום הנתונים והעמידה בתקנות.
חלוקת קריטריונים
- תעתיק זרם בזמן אמת
- עיבוד קובץ אודיו באטום
- אימון מילון מותאם ודגמים
- זיהוי דוברים וזמן מילים
- תמיכה במספר שפות וניבים
- פריסה בענן או במקום


OpenAI Advanced Voice היא מצב אינטראקציה קולית מובנה ב-ChatGPT המאפשר למשתמשים לדבר עם ה-AI באופן טבעי וזורם. הוא תומך בחילופים עם השהיה נמוכה, הפרעות ותגובות אקספרסיביות, מה שהופך את השיחות להרגיש קרובות יותר לשיחה עם אדם מאשר להנפקת פקודות לעוזר. התכונה תוכננה לשימוש ללא ידיים במכשירים ניידים ושולחניים כאחד, ותומכת במשימות כמו שיפור רעיונות, תרגול שפה, הדרכה ואפילו שיחה מזדמנת. היא יכולה להתאים את הטון שלה, לזהות רמזים רגשיים בדיבור, ולהגיב בקולות ובשפות רבות, הכל מופעל על ידי המודלים המולטי-מודאליים של OpenAI.
חלוקת קריטריונים
- שיחות קוליות in real-time
- Multiple selectable AI voices
- Interruption and turn-taking handling
- Emotional and tonal awareness
- Multilingual conversation support
- Integrated within the ChatGPT app

Amazon Transcribe
שירות זיהוי דיבור אוטומטי של AWS שממיר אודיו ווידאו לטקסט מדויק וממוסגר בזמן

Amazon Transcribe היא שירות זיהוי דיבור אוטומטי (ASR) מנוהל מלא מבית AWS שממיר קולות מדוברים לטקסט כתוב. השירות תומך בתמלול קבוצתי של קבצי מדיה מאוחסנים וכן בתמלול שידור בזמן אמת, והפלט כולל תזמון (timestamps), תוויות דוברים ו־confidence scores. השירות מיועד למקרי שימוש כגון ניתוח מרכזי שיחות, כתוביות לפגישות ולמדיה, יישומים המופעלים בקול ורישום לציוני התאמה. וריאנטים מתמחים כגון Transcribe Medical ו-Transcribe Call Analytics מוסיפים אוצר מילים מותאם לתחום ותובנות מובנות כמו זיהוי סנטימנט וגילוי תקלות. מפתחים יכולים לשלב את זה דרך AWS SDKs, ה-CLI, או הקונסול, ולשלב אותו עם שירותים אחרים של AWS כגון S3, Lambda, Comprehend ו-Translate לבניית מעגלי עיבוד קולי מקצה לקצה.
חלוקת קריטריונים
- טרנסקריפציה של אצווה ושידור בזמן אמת
- זיהוי רמקול והפרדת ערוצים
- מילון מותאם אישית ודגמי שפה מותאמים אישית
- פיסוק אוטומטי וחותמות זמן ברמת המילה
- תמיכה במספר שפות עם זיהוי שפה אוטומטי
- שילוב עם S3, Lambda ושירותים אחרים של AWS

Scriptivox הוא כלי שמשתמש ב- AI להפיכת מידע מודע לטקסט, עם עריכה שהיא מופצה מ- AI. נמצא כ- Scriptivox הוא AI ה- engine שמאפשר processing הנר
חלוקת קריטריונים
- מנוע עריכה ל- speech-to-text
- תומך formats שונים של אודיו
- processing מהיר של recordings
- יציאה של text ניתן לעריכה
- ראוי ל- long-form ו- short-form audio




