Iepriekšējā cīņa · 2024-11-03 UTC
Speech Recognition Sadursme — 2024. gada 3. novembris
No Speech Recognition kategorijas. 27 atzīmes izvietotas starp 6 cīnītājiem. WithAudio izcīnīja kroni.
Gala rezultāti
Sastāvs
Cīnītāji
Katra rīka profili, kas piedalījās šajā cīņā, sarindoti pēc to gala rezultāta.

WithAudio
Vienkārša iegādājuma tekstā-skaņās lasītāja lietotne ar dabisko AI skanējumu Mac un Windows iekārtām.

WithAudio ir mākoņa tērpī text-to-speech rīks, kas Mac un Windows datoros konvertē rakstīto saturu runāmo audio. Lietotāji var ielādēt tekstu, tiešsaistē ielādēt dokumentus vai importēt rakstus un tos izrunāt tikai izvēloties no vairākiem AI-ienerētu vokāliem, kā rezultāt tas ir izdevīgs raksturīšanas, pieejamības un bezrīkuma lasošanas nolūkiem. Salīdzinot ar daudziem TTS rīkiem, kas pamatā tiek lietoti mēnešu abonēšanas modeli, WithAudio tiek piedāvāts kā vienasreizējais iegādes piedāvājums, kas iebrūk skaistu cenu noteikumu meitām un cilvēkiem, kas raksta. Apļa galvenais fokus ir uz simplisku dzirdēšanas pieredzi par vien, nevis kompleksu audio iekārtu, un spēle iekļauj dziesmotājas kontroli un iespēju izveidotem audiogrāfiem vārda ierakstiti par nākamām lietošanas iespējām.
Kritēriju sadalījums
- Teksts-skaņas pārvietošana ar AI skanējumiem
- Aizmugurējas platformas atbalsts macOS un Windows
- Skaņas izvade par bezvadu slēdzēju klausēšanos
- Dokuments un teksta ievades iespējas
- Atdalāmu skānišanas atstāvību kontroli
- Vienkārša licencēšanas aktivācija

CallFluent
AI vārdu izvēršanas platforma, kas transkribē, analizē un automatizē uzņēmumu telefonu sarunām

CallFluent ir AI vadīts saziņas analizēšanas platforma, kas palīdz uzņēmējdarbībām iegūt vērtību no savām telefona sarunu. Tā kombinē runu-teksta transkribēšanu, saziņas intelektu un darbību automātizēšanu, lai no sales kalām, atbalsta tiketes un klientu jautājumiem izvietotu domāšanas rezultātus. Platfoms analyse tonu, vēlamību un svarīgākās tēmas tiešraidē, dāvdot komandām redzamību par uzņēmēja viedokli, darbinieku izpildīšanu un bieži izskatītajām protesta pamatos. Vadītāji var pārbaudīt raksturlielumus tiešraidē norisinājušos daudzās konversācijas bez automātiskā skaņas datu kārtošanas. Ar automācijas funkcijām, ieskaitot saņemto sauciņu apskatus, CRM ierakstus un pievadu sekmekāru tiešinājumus, mēģinot sākties ar automatizētu darbu pēc sauciena, CallFluent vēlas samazināt vienreizējo pētīšanu pēc sauciena un palīdzību komandu darbam veikt ātrāk tādēļ, lai varētu tiešām reaģēt uz tas, ko īstenošie klienti patikties.
Kritēriju sadalījums
- AI dziesmu-ietaisīšana
- Saistību un vērtību pētījums
- Automatizētās ierakstu krāsas
- Konversācijas atskats
- CRM un strādnieka saskarne integrācijas
- Konversācijas automātizācijas aktivatori

Inworld AI
Izveidojiet interaktīvas, mākslīgā intelekta vadītas rakstures spēlēm un iedarbīgām virtuālajām pieredzēm.

Inworld AI ir personāžu injektoru, kas ir paredzēts vadītājiem, kuri attīsta spēles, virtuālās pasaulas un interaktīvu mediju. Tas ļauj radītājiem veikt NPC un digitālas personaļi ar atšķirīgiem personībām, atmiņām, balsīm un motivācijām, tad to palīdz dzīvot ar real-time konversāciju un kontekstualo elpu. Platforma tiek veidota, lai kombinētu valodas modeļus ar mērķiem, zināšanu bāzēm un emocione stāvokliem, kas garantētu, ka rakstvari var reaģēt dinamiski uz spēles spēlētājiem, neatkarīgi no skriptu liniņu norādījumiem. Integrācijas ar vardeviņām, kā Unrealis un Unitys, plus SDKs un APIs, padara iespējams izvietot rakstvarus dažādos spēļu projekti, sazināšanās pieredzes, iemaņošanas simulācijas, un iesaiņošanas aplikācijās.
Kritēriju sadalījums
- Pielāgojamas AI rakstures personības
- Ilgtermiņa atmiņa un zināšanu bāzes
- Balsu sintēze un emocionālā izteiksme
- Unity un Unreal Engine SDK
- Mērķi, trigeri un uzvedības kontrole
- Daudzludviela un vairāku rakstures mijiedarbība

Molly Personal Assistant
AI asistents, kas automatizē darba plūsmas un vienkāršo komandas sadarbību.

Molly ir AI personīgais asistents, kas paredzēts darba plūsmu automatizēšanai un komandas sadarbības vienkāršošanai. Tas cenšas nodrošināt dziļi personalizētu pieredzi ar "bezgalīgo atmiņu" funkciju, kas ļauj atcerēties lietotāju preferenču un pielāgot mijiedarbību atbilstoši. Lietotāji var delegēt uzdevumus Molijai, kas tos izpilda, atbilstot lietotāja stilam. Asistentam ir arī proaktīvi ieteikumi, lai lietotāji paliktu priekšroku, paredzot to nākotnes vajadzības. Molly pašlaik ir ierobežotā privātā beta versijā, un interesenti var pievienoties gaidīšanas sarakstam, lai izbaudītu tā iespējas.
Kritēriju sadalījums
- Darba plūsmas automatizēšana
- Uzdevumu un projektu izsekšana
- Komandas sadarbības rīki
- Produktivitāti fokusēts AI asistents
- Gudrs grafika plānošana un atgādinājumi
- Krustrīku integrācijas

Deepgram
Runas uz rakstisku un rakstiskā runas API platforma reāla laika balss lietojumprogrammu izveidei.

Deepgram ir atsauksmes AI platforma, kas sniedz programmatorejiem API, kas transkribē audio un generē dabiski izskatāmu runi. Modeli tā ir izstrādājuši, lai tie bija paredzēti ar augstu ātrgaitu un precīzi, un strādājuši ar tiešām daudzos valodu, aksentu un audio iestādēm, kur tai ir liela lietošanas vērtība konversāciju kapiona, saules kapioni un runas palīgu attīstībā arī. Pilna transkripcijas pamatiešu virzienā Deepgram piedāvā iespējas, kā speakeru diarizācija, sūtīšanas un tēmu izvēle, kā arī personīgā modela trešdaļas mācība un strēmo atbalsts. Platforma tiek veltīta inženieru komandām, kuru nepiecieš prasība iebūvēt balsu iespējas produktos bez balsai piemītošu infrastruktūras būvniecības.
Kritēriju sadalījums
- Reāla laika strīma runas uz rakstisku
- Neurālas rakstiskā runas balss
- Runātāja diarizācija un vārda līmeņa laika zīmes
- Pielāgotas modeļa precizēšana
- Audio inteliģence (sajūta, tēmas, kopsavilkums)
- REST un WebSocket API ar daudzvalodu SDK
Kokoro TTS
Atvērtā pirmkoda daudzvaloda teksta uz runu (TTS), kas pārvērš rakstīto tekstu par dabīgu balss izklausīšanos.

Kokoro TTS ir tekstā izslūdnošanas sistēma, kas pārveido rakstu ievadi par ļoti izskatāmu un dabīgu kārtējo runu daudzās valodās un runas stilās. Tas cenšas nodrošināt kvalitātas runu sintezēšanu, kas ir pieejas zinātniekiem, saturu izveidotājiem un hobiţistiem, kuriem nepiecieš realitātes audio izvadi, lai izveidotu projektu, taika videos, audiobuku, piekļuves līdzekļus un runas asistentus. Rīkotājs modelis koncentrējas uz produkciju fluētentu prosodiju un atpazīstamus valodnieku raksturojumu, paliekot izturīgs, lai var būt dzinīts dažādos vidēs. Izmantojošie var sagatavot izskatāmu audio dati no teksta daļām, izvēloties starp dažādām balsīm, un iekļaut izvades rezultātu savās struktūrās lietojuma programmu vai programmu izvēlē.
Kritēriju sadalījums
- Daudzvaloda teksta uz runu ģenerēšana
- Daudzus izvēles balss profilu
- Dabīga intonācija un ritms
- Eksportējams audio izvadītais
- Piemērots lietotnēm, video un narēšanai
- Izklausa izstrādātājiem integrācija




