წარსული ბრძოლა · 2026-06-21 UTC
Speech Recognition შერკინება — 21 ივნისი, 2026
Speech Recognition კატეგორიიდან. 4 ნიშნები განთავსებული 2 მებრძოლზე. Deepgram-მა აიღო გვირგვინი.
საბოლოო შედეგები
Deepgramშემადგენლობა
მებრძოლები
ამ ბრძოლაში მონაწილე ყველა ხელსაწყოს პროფილი, დალაგებული მათი საბოლოო ქულის მიხედვით.

Deepgram
საუბრის-ტექსტში და ტექსტის-საუბარში API-ები რეალურ დროში ხმის აპლიკაციების შესაქმნელად.

Deepgram არის ხმის AI პლატფორმა, რომელიც დეველოპერებს API-ები გაწვდით აუდიოს ტრანსკრიპციასა და ბუნებრივად მოსმენადი ხმის გენერაციისთვის. მისი მოდელები შექმნილია დაბალი ლატენსიით და მაღალი სიზუსტით, სხვადასხვა ენებზე, აქცენტებზე და აუდიო პირობებზე, რაც მას შესაფერისს ხდის პირდაპირი წარწერისთვის, ზარის ანალიზისთვის, ხმის ასისტენტებისთვის და კონვერსაციურ აგენტებისთვის. ძირითადი ტრანსქრიპციის მიღმა, Deepgram უზრუნველყოფს ფუნქციებს, როგორიცაა საუბრის დიარიზაცია, ემოციური და თემატური ამოცნობა, მორგებული მოდელის სწავლება და ნაკადის მხარდაჭერა. პლატფორმა მიმართულია ინჟინერიული გუნდებისთვის, რომლებიც საჭიროებენ ხმის შესაძლებლობების პროდუქტებში ჩასმა, არ ააშენონ ხმის ინფრასტრუქტურა ნულიდან.
კრიტერიუმების დაყოფა
- რეალურ დროში ნაკადის აუდიო-ტექსტში გადაყვანა
- ნეირალური ტექსტის-საუბრის ხმები
- საუბრობელის დიაარიზაცია და სიტყვების დონეზე დროის შტამპები
- მორგებული მოდელის დეტალური კორექტირება
- აუდიო ინტელექტი (სენტიმენტი, თემები, შეჯამება)
- REST და WebSocket API-ები მრავალენოვანი SDK-ებით


OpenAI Advanced Voice არის ხმის ინტერაქციის რეჟიმი, რომელიც ჩასმულია ChatGPT‑ში და მომხმარებლებს საშუალებას იძლევა AI‑სთან ბუნებრივად, თავისუფლად საუბრობდნენ. ის მხარს უჭერს დაბალი-გადაუდებელ მიმოცვლებს, შეწყვეტებს და გამოხატულ პასუხებს, რაც საუბარს უფრო ახლოს ხდის ადამიანთან, ვიდრე ბრძანებების მიწოდებას ასისტენტისთვის. ეს ფუნქცია შექმნილია ხელების გარეშე გამოყენებისთვის მობილურზე და დესკტოპზე, მხარი უჭერით დავალებებს, როგორიცაა იდეების შემუშავება, ენის პრაქტიკა, მასწავლებლის მხარდაჭერა და ყოველდღიური ჩატი. ის შეუძლია მოარგოს ტონი, აღმოაჩინოს ლაპარაკის ემოციური ნიშნები და მრავალმხრივი ხმებით და ენებით უპასუხოს, რაც სრულდება OpenAI-ის ძირითადი მულტიმოდალური მოდელებით.
კრიტერიუმების დაყოფა
- რეალურ დროში ცოცხალი საუბარი
- რამდენიმე არჩევანის AI ხმა
- შეჩერება და გადმოცემის მართვა
- სენტიმენტალური და ტონალური აღქმა
- მრავალენოვანი საუბრის მხარდაჭერა
- ChatGPT აპლიკაციაში ინტეგრირებული
