Praeita kova · 2026-04-23 UTC
Multimodal AI Susirėmimas — 2026 m. balandžio 23 d.
Iš Multimodal AI kategorijos. 44 įvertinimai pateikti tarp 9 kovotojų. AssiPilot laimėjo vainiką.
Galutiniai rezultatai
Dalyviai
Kovotojai
Kiekvieno šioje kovoje dalyvavusio įrankio profiliai, surikiuoti pagal galutinį rezultatą.

AssiPilot
Viso į vieną AI asistentas kuriant vaizdinius, vaizdo įrašus, kalbos nuosakančius ir muziką

AssiPilot yra visų darbų robotinio intelekto asistentas, kuris pagalba sukuria vaizdus, vaizdo įrašus, kalbą ir garsus. Jis siekia pavergti kūrybinio proceso užduotis naudojantis pranešimo bažnyčia, kuri leidžia vartotojams sakyti savo idėjas ir gaunoti poreikiamą išvestį. Ši platforma yra skirta kūrėjams, įskaitant profesionalų ir asmenis, kurie reikia sutaupyti laiko ir efektyviai sukurti aukštos kokybės turinį. AssiPilot susijungia skirtingus AI modelius, įskaitant Flux vaizdams, Kling vaizdo medžiaga ir ElevenLabs garsą, siūlydami naudotojams skirtingas galimybes. Šios funkcionalumo sąsają suteikia tris pagrindinius žingsnius: pasikalbėti su AssiPilot, kad apibūtinti norimo turinio savybes, pakeisti tinkamą įrankį ir sukurti ir perperperkti išėjimo rezultatą. Naudotojai galės eksportuoti savo kūrinius aukšto rezoliucijos. Naudotojai savinasi komercinę savimą iki kuriantį turinį. AssiPilot priklausomis turėtai įvairius generatyvius funkcijas, pvz., įvaizdo, vaizdo, garso ir muzikos generators. Platforma palaiko daugiafunkcionalumo galimybes, leidžiančias naudotojams prieiti prie savo laikmečio šiaurėje esančios technologijos. Taip pat ji siūlo integruotas darbo sąrankos programas, žvelgiamąjį siuntos ir cloudy saugyklos. Tikrai, kad platforma, tūkstančiai kūrėjų naudojo AssiPilot, kad susikurtų virš milijono atsisiuntimų. Naudojotojai teigia, kad jaukia platformos galimybes, kad pagerintų jų proceso srautą bei greitai gautų auktos kalbos turinį.
Kriterijų išskirstymas
- AI vaizdinių generavimas
- AI vaizdo kūrimas
- Teksto kalbos nuosakančioji gamyba
- Muzikos kūrimas su AI
- Vienkartinė kūrėjo sąrašo valdėjas
- Prompto pagrįsta turinio siuntimo darbuotojas

EmbedAI
Sukurkite personalizuotus ChatGPT-pavarinčius čatbotus, treniruotus jūsų savo duomenimis ir įkeltinus juos kur nors.

EmbedAI yra nuožodžių platforma, skirta sukurti AI čatlentoju, kurie atsakomi naudojant savo turinį. Vartotojai gali įkelti dokumentus, priešingti svetaines ar prisijungti prie kitų duomenų šaltinių, ir platforma apdoroja šį informaciją į konversacijų pagalbininką, kuris bazavosišas didelių kalbų modelių, panašių į ChatGPT. Jei pradinami, šis čatbotas gali būti įtrauktas į interneto svetainę naudojant kodinį fragmentą arba perdarytas kaip vientisas nuoroda. Jis dažniausiai naudojamas klientų aptarnavimo, vidinės žinų bazės, leadų išgavimo, bei interaktyviojo produktų dokumentavimo tikslais; pagalbos komandoms sumažinant kartokusus klausimus ir padidinant duomenų pristatymą.
Kriterijų išskirstymas
- Sukurtais čatbotais treniruoti jūsų įkeltiems duomenims
- Sukelti tinklapis ir dokumentai
- Įkeltinis čat vėrinys bet kurį tinklapį
- Dalikamas čatbotas nuorodų formuotės
- Pavarėjanti konversaciniai atsakymai naudojantis ChatGPT
- Palaikoma daugybės šaltinių žinyno

Magentic One
Atvira šaltinio generalistinė vienalyčių sistema, skirta išvysti kompliacines, kelialapį užduotis

Magentic One yra moksliniu tyrimų orientuotas, daugialypis agentų rėžinis nuo Microsoft kuriamas ir naudojamas atlikti neapsakomų, kompliksuų uždarbų, kurie apima internetą, failus ir kodą. Įvairių užduočių koordinatorius veda planavimą, deleguoja užduotis ir rūpinasi jų eigos ženklu, o specializuoti agentai atlieka interneto paiešką, failų navigaciją, programavimą ir terminalo vykdymą. Baudžiantis AutoGen įrangos, ji siūlo modulinią struktūrą, kuri tyrinėtojai ir programuotojai gali pratęsti ar prisitaikyti prie savo sričių. Ši technika skirta kaip bazinė dalis tyrimams apie agentingoji AI sistemos, nebėra užbaigtas priedainis konsumatorių produktams. Magentic One atsišvels su įvertinimo įrangą (AutoGenBench), kad komandos gali palyginti agento performancę standartizuotose užduoties ir palyginti skirtingų modelių šešėlių arba agentų konfigūracijas.
Kriterijų išskirstymas
- Orchestrator agentas užtikrina užduočių planavimą bei vykdymo koordinavimą
- WebSurfer agentas atlieka internete vykdomus veiksmus
- FileSurfer agentas atlieka lokalūs failų navigavimo veiksmus
- Coder ir ComputerTerminal agentai atlieka kodų užduotis
- Sukurta ant AutoGen daugielyčių kūrybos bazės
- AutoGenBench integravimas užtikrina vykdymo vertinimą

Together AI
Aštuonių platforma, siūlantį parengtis būti, fine-tinti ir deployment generatyvųjų modelių su pakeitimu atliekamos ir našumo kaina efektyvumo.

Together AI siūlo nuolatinį platformą, skirtą generatyvinio AI modelio kūrimui, paaiškinimui ir skverbimuisi. Šioje platformoje, kurioje naudojami naujausios tyrinėjimų rezultatai, vartotojai gali greitinti atvaizdavimo proceso rezultatus, modelio formavimą ir prieštraukimosi rezultatus, naudojant poreikių priklausanti optimizaciją. Pagrindiniai platformos savybės yra be serverių išvados, grupinių išvados, skirtos modelių išvados, greitintos kompiuterinės operacijos, sandbox, ir valdomos siuntimas. Kai kurių šioje svetainėje yra tiesioginių priemonių skirtų atnaujinant atvirųjų šaltinių modelius gaminių produktų darbuose, naudojant naujausius tyrimų metodikas. Plokštė konceptas sukurtas pagal AI-native cloud, kuris leidžia naudotojams gali dalyvauti kiekvienoje AI raidos etapų nuo tyrimų iki milžiniškų mastų. Together AI galimybės apima pagerintą įstatyminį atlikimą, smarkiai sumažinimus išlaidų bei greitesnia pre-trainingą. Platformoje taip pat yra naujauso mokslinįs tyrimų gėliuoti šaltiniai bei priemonės agentų vystymui, architektūrai bei fine-tuningui.
Kriterijų išskirstymas
- Serverless Inference
- Batch Inference
- Dedicated Model Inference
- Dedicated Container Inference
- Accelerated Compute
- Sandbox

Omniverse Audio2Face
NVIDIA taikomosios rengties priemonė 3D veido animacijos generavimui tiksliai sunkiuosegarsuojant

Omniverse Audio2Face yra NVIDIA programa, kuria pagal garso šaltini pagalinaus generate automatiškai 3D ansų kūno animaciją. Naudojant pristatytą derinę neuroninę tinklą, jis analizuoja balsinis įvestį ir valdo 3D personausios žios, sąmonės bei emocijos judėjimus realiu laiku, pagerinę šimtį daugėl manualų klaida, kurios būdavo reikalingos animacijų patekose. Priemonė veikia už priemonių NVIDIA Omniverse ir skuba eksportuoti į standartinius DCC platformų kūrinius tokiais kaip Maya, Unreal Engine ir Blender per USD ir blendshapes formatus. Ji veikia su personalizavusiais žmogaus kūną tinklanų pagalba retargeting, padedant ją naudinga žaidimų kūrėjams, animatoriams, virtualesiems produkcijos komandų ir kūrėjams sukūrusiais digitalius žmones ar interaktyvius avatarus. Audio2Face sukaupąs kineamatų filmų darbų tikrinimą bei interaktyvių aplikacijų realiu laiku transliavimą, su valdomais emocijų elementais bei kelialapiais audiografiniais prireikiniais.
Kriterijų išskirstymas
- Balsu valda veido animacija per giliuosius mokslus
- Realiu laiku labų synchronizacija ir emocijų valdymas
- Veido permainų permaina į nuosavybines formų kelius
- Blenden ir USD exportavimo tinklai
- Realiu laiku streaminimo režimas užklausoms avatarais
- Mokyklų balsu gautos priemonės

AGiXT
Atvirojo kodų AI agentų rėmuo su pritaikoma atmintimi ir išplėstinais priedais priklauso automatizuojant sudėtingus užduotis.

AGiXT yra atviros kodų AI agentų rėmuo, kuris leidžia automatizuoti sudėtingus užduotis pritaikoma atmintimi ir išplėstinais priedais. Naudojantis įstaigos galima nustatyti AI agentą su konfigūruojama asmenybe, žinyno paviršiau ir atmintimi. Rėmuo pritaikytas įvairių dokumentų tipų treniravimui, tarp jų PDF, Word, teksto, Markdown, CSV, JSON ir Excel. Naudojantis agentui galima ryšiuotis per bendradarbiavimo sąsaja, o agentas gali mokytis iš pateiktų dokumentų ir URL.
Kriterijų išskirstymas
- Pritakoma ilgalaikė atmintis
- Priedų ir išplėstų funkcijų ekosistemos
- Mokyklų su LLM paramos
- Kustomizuojamas užklaus ir ryšys
- Vebinis sąsaja ir REST API
- Užduočių automatizavimas su neprižiurktais agentais

Blink AI: Your Instant Shopping Guide
Tvirtas prekiniameis pagalbais - instantines produktų pasirinkimo ir kainų palyginimo priemonė.
Blink AI yra intelektualiosios žmogaus valios pagamintas pirkimo pagalbininkas, kurio užduotis – teikti naudotojams išteklių produktų rekomendacijas ir kainų palyginimus per kelerias sekundes. Jis siekia paprastindinti internetines pirkimo patyrimą greitai siūlydami atitinkamų prekių pagal vartotojo įvestis ar preferencijas. Šis tinklas užsakymams skirtas vartotojams, siekiančiam efektyvios ir individualioivos pirkimo pagalbos. Blink AI greičiai veikia tiksliai apdorojant naudotojo užklauskus, naudodamiesi produktų duomenų bazėje ir siūliant matchus įvardijus pateikius informaciją. Savo pagrindine savybę taip pat išskiria greičio ir tikslumo produktų priūrių ir kainų palyginimų sėkmė, nors konkrečios informacijos apie jo darbų srautą ir integracijas nėra prieinamos. Šiuolaikinių pirkinimų metodų bei kitų AI pirkinimo įrankių atveju, Blink AI rūpinasi tiesioginei aktyvumui bei vartotojo specifikais rekomendacijomis.
Kriterijų išskirstymas
- Pagamintos produktų rekomendacijos naudojant artifiliškos intelektualinės tyrimo technologiją
- Instantus daugiau prekybininkų kainų palyginimas
- Asmeninė prekių pagalbos gairė
- Greitas paieškas už produktų kategorijas
- Prekninio akmeninio sąskaitos surišimas
- Suvirtinta pirkinimo sprendimų protokolis

Project Astra
Kokia Google DeepMind universalio AI agentas, matydamas, girdėdamas į šį pasaulį tiesiogiai.

Projectas Astra yra eksperimentinis universalus AI asistentas iš Google DeepMind, kuris galei helpint kasdieniems užduočiui pamatyti pasaulį taip pat kaip žmonės. Jis apdoroti vaizdo, garso, vaizdų ir tekstų du kartus taip, kad vartotojas gali nurodyti kamerą ar kalbėti lengvai ir gauti kontekstinio sąmoningumo atsakymus. Projektas Astra, įrengtas ant Google Gemini modelių, yra paruoštas geresnei, pokyčiui tarpusavyje užtikrinančiae konversacijai, kadangi jis turi prisiminimų recentiame kontekste. Projektas Astra yra pristatytas kaip tyrimų prototipas, kuris tiria, kaip visas tikslas prietaisas gali būti įdiegęs telefonuose, akinių drabužiuose bei kitose aplinkybėse. Jeigu nors dar nėra viešai prieinamas produktas, Astra rodo Google taiklę agentyms dirbantiems IA sistemoms, kurios gali matyti aplinką, atsiminti, ką matė, ir atlikti naudingus veiksmus naudotojo iniciatyvoje.
Kriterijų išskirstymas
- Vienbajoriai vaizdo ir paveikslėlio apskaičiavimai
- Sakytojo interfeisas
- Saugoma kontekstitinė atsiminimu
- Multimodalų priežasčių apskaičiavimas per tekstą, garsus ir vaizdo
- Integracija su Gemini modelių šeima
- , Prototipo paramėga smartfonai ir smartgurkliai

Wan 2.7
AI sistemų naudojama platforma sukurianti komerciškai paruoštą vaizdinį turinį tekstiniu arvaizuojamais įvaizdžiais.

Wan 2.7 yra AI sistemų video ir nuotraukų generavimo platforma, perųžinantė šalutesnis matmenų kokybę, garsą, judesius, stilistinę detalę ir konsistencijos atveju palyginus su pirmtaku Wan 2.6. Ji naudota tvirti arvuojamas įvaizdžiai ar į juos perėjusios nuotraukas. Platforma pagerina video generacija penkiuose pagrindiniuose sričių: vaizdų kokybė, garsas, judesio dinamika, stilistinė dažnumas, konsistencija. Wan 2.7 pasiekia papildomas savybes kaip pirmųjų ir paskutinių maršo generavimas, 9-grid nuotraukų-vaizdų, objektas kartu balsas, nuorodų-įrašo redakcija pagal nuorodas, taip pat įtraukų sąrašų generavimas. Ji atitinka realaus žmogaus įvaizdžių įvestį, iki 5 vaizdų sąrašų, antraškių trukmę nuo 2 iki 15 sekundžių, taip pat 1080P vaizdų generavimą, kuriuos sudaruoja profesionalaus naudojimo aplinkų sąlygas. Platforma krypti visų pusių video kūrimas ir redagavimas, pasiūlius bet kuriam kėsimo prieš jų naudojimą.
Kriterijų išskirstymas
- Pirmųjų ir paskutinių maršo generavimas
- 9-grid nuotraukų-vaizdų
- Objektas kartu balsas
- Nuorodų-įrašo redakcija pagal nuorodas
- Įtraukų sąrašų generavimas
- Iki 5 vaizdų sąrašų








