Praeita kova · 2025-04-24 UTC
Agent Development Susirėmimas — 2025 m. balandžio 24 d.
Iš Agent Development kategorijos. 32 įvertinimai pateikti tarp 7 kovotojų. DeepOpinion laimėjo vainiką.
Galutiniai rezultatai
Dalyviai
Kovotojai
Kiekvieno šioje kovoje dalyvavusio įrankio profiliai, surikiuoti pagal galutinį rezultatą.

DeepOpinion
Įmoninis AI platformas, automatinantis kompleksinę žinių darbą ir neapibrėžtų duomenų užduotis.

DeepOpinion yra bendrojoji įmonių orientuota autonomizuoto plano sistema, kurie yra sukurta automatizuoti sudėtingo, dokumentinių žinių darbo, kuris tradiciniai RPA sistemos nėra galima atlikti. Tai kombinuoja didelius kalbų modelius su veiklos procesų funkcionalumu, kad procesuoti nestruktūrintų įvestų, kuriuose yra el. pašto laiškai, sutartys, faktūros ir paramos tiketai masiškai. Šio platformos objektu yra komandos finansų, draudimo, konsultacijų bei operacijų firmų kurioms reikia tikslaus ir sąmoningo AI valdymo verslo procesų srityje. Plataforma leidžia organizacijoms sukurti ir paleisti įvairius AI agentus, kurie gali skaityti, klasifikuoti, extrahuoti bei veikti informacija be ypatingų adaptacijų ir adaptacijų kodo kurimo. Naudojant galimybes, kad sistemos būtų saugomos į debesų arba įrengintojo vietinėse sisteme, DeepOpinion siekia įterpti reguliuotuosius verslo aplinkas, redukavus manualų įvykdymo laiką ir pakartotinai kognityvinius uždavinius.
Kriterijų išskirstymas
- AI agentai dokumentų ir tekstų apdorojimui
- Žinių darbų automatizacija workflow
- Neapibrėžtomis šaltiniais duomenų išgavėjimai
- Įmonių laipsnių saugumas ir atidarymų opcijos
- Suderėtų verslo sistemų integracija
- Žmogaus-atsijungimo priežiūros kontrolių

Letta AI
Atviri platformos statiniems AI agentams su ilgalaikės atmine ir suteikiama nuotekų analizė

Letta AI yra atvirojo kodo platforma, kurioje tavo galimybės sukurti statinius AI agentus. Šie agentai yra įgiję ilgalaikės atminės galimybes, o taip pat gali vykdyti svarbesnes priežasčių analizės. Ši platforma leidžia vartotojams sukurti AI agentus, kurie gali saugoti anksčiau vykdomų interakcijų ir tada naudoti šią informaciją, kuri labai svarbu žemiau paskirstytas uždaviniai
Kriterijų išskirstymas
- Statiniai AI agentai
- Ilgalaikė atminė
- Suteikta intelektuali nuorėjų galybė

Botpress
Panašus platformas, skirta statyti, išleisti ir valdyti AI agentus ir balandžius.

Botpress yra plataforma, skirta kūrimui pasakojamųjų AI agentų, užtikrinamų didelų kalbos modelių pagrindu. Tai leidžia patekti iki matomių srautų kūrėjo, SDK, bei programinės įrangos integravimo su populiariaisiais posakių kanaliais, taip leidžiant komandoms apie šią darbą dirbančioms komandoms kuriai agentais, kuri galės laikytis natūralios sąsajos, pasiekia API ir išbaugšto taškų užduotys. Platforma jungia naudingumą paprastams kodo programas su giliųjų konfigūracijos galimybėmis, tai leidžia neitiksliaisems vartotojams ir programuotojams bendrauti kartu tikroje projekte. Tokios funkcijos kaip žinotvarkos bazės, analizės, ir žmogiško perdavimo funkcijos padeda pasiūlyti platformą įprasmėsiems naudojimams kaip pavyzdžiai, pavyzdžiui, klientų aptarnavimo, vadų generavimo, ir vidinių automatyvizacijų. Botpress suteikia nemokamąjį lygį eksperimentavimui ir mokamųjų planų, kurie atspindi naudojimą, taip pat atvirojo kodo bendruomenės leidimą savininku veikiamuams prieigačiomis.
Kriterijų išskirstymas
- Drag-and-drop pokalbio srauto redakcijos įrankis
- LLM ginkluoti agentai su priemones
- Žinčių bazės priimti iš dokumentų ir URL
- Pelėda-kanalų išplatymas (internetas, WhatsApp, Slack, t. y.)
- Analitika ir pokalbio monitoringavimas
- Žmogiško prijungimo ir komandų kolekcijos

Gretel AI
Platina sintetinis duomenų platforma, generuojanti pavieniams datos užtikrintus privata ir visai pasirinktinai įrašų duomenysis ir mirkančios pasaulyje data.

Gretel AI yra kūrybiškų developerų platforma, kuriai skirta sintetinių duomenų kūrimas tokiems, kad statistiškai atitiktų realių duomenų masyvus, be tokių duomenų eksponavimo, kurie būtų svarbūs savyjai. Komandos norėdama išlikti be kliūčių bei nekontirolėjamas projektų kūrimo, AI bei analitinės sistemų, naudoja Gretel AI, kad užblokuotos duomenų prieigos galimybę neįgalina privatausumo, reguliųjų tikslų ar prieigos atsakomybės dėl nuostolių duomenų, kurie būtų trukdžiusi prieigos. Platforma siūlo API, SDK ir išradimų modelius kartu su priemonėmis vertinti kokybę ir asmeninio duomenų saugumo riziką. Tai remia svarbius scenarijus, tokias kaip trainuojant machine leaninų modelius, papildomąs mažumas besibaigiančią klasę, perduodant duomenis komandų tarpusavyje bei testuojant programinį kodus su realistų, bet artifinalių duomenų įrašus.
Kriterijų išskirstymas
- Generaciniai duomenių modeliai sintetinei tabulinei ir tekstinei duomenų
- Diferencialio privataža ir PII redaktoriaus valdymas
- Kokybės, tikslumo ir privatažos skaitmenų reikšmės ataskaitos
- Python SDK ir REST API integracija
- Privalėtos duomenų modeliai ir nuoseklūs šablonai
- Audių ir savininkuojamųjų vykdytuvų vykdomųjų variantų

NetX
Moduliarus ekonominės tinklejos kombinacija, sujungianti blockchain infrastruktūrą su AI galimybėmis.
NetX yra modularus ekonomikos tinklas, pagamintas siekti, kad susijungtų blockčain ir AI technologijas vieninge struktūroje. Jo architektūra leidžia programuotojams ir organizacijoms įjungti komponentas decentralizuotų nuotolinių tranžakcijų, duomenų mainų, bei AI vadovaujamų paslaugu sistemų, remiantis raiškiomis pavyzdžiais kryptimi digitalinėse ekonomikose. Ši platforma sieja tradicines blockchain funkcijas su naudojamojo įrangos workflows, padedant žaliąjį naudžymą, technologijų automatizmą, bei įrankių analitiką sąveikioti kartu vienoje ecosistemoje. Tai padeda ji ji labai tikslesnu platformą užsiėmimams Web3 aplikacijų kūrėjams, kuriems reikia intelligentaus procesavimo ar gavės datos, vedančių sprendimų priemones. NetX siekia padaryti tai, kad kūrėjai būtų lengva tinkinėti savo pakopą, renkantis taikyti blockchain, AI ir ekonominio primityvio schemą, kuris atitinka jų projektų poreikius.
Kriterijų išskirstymas
- Moduliarus tinklejos komponentai
- Blockchain integravimo sluoksnis
- AI paslaugų kompatybė
- Intelektinis sutarties rėma
- Tokenizuota ekonominės bazovų
- Programininkų orientuotas tinklo reikšmininkas

Snorkel Flow
Programinguoto duomenų etiketavimo ir AI sistemos sudarymo platforma užtikrina greitąs produkcijos modelių kūrimą.

Snorkel Flow yra komercinis platforma programingams duomenų tinkimybės reikalavimams, leidžiant komandoms kurti, redaguoti ir gerinti treniruojamos duomenų rinkas priskirkimais, be priklausomybės tik nuotoliniuose papildymuose. Kodinuojant profesionalų žinias į pavieniškai naudojamą heuristikas, jis įvykdo kūrimą netiesiogiai įvairios duomenų formos iš naujos iki produkcijos reikiamų AI modelių. Platforma jungia silpna supervision, modelio treniravimą ir klaidų analizę viename darbų srityje, padėdama mokslo dalyviams ir pagrindiniais specialistams iteruoti datos rinkas ir modelius kartu. Tai užpėr įvairius scenarijus, įskaitant dokumentų klasifikavimą, duomenų ieškojimą ir gerinantį fondų modelius, kurie yra naudojamų verslo aplikacijoms.
Kriterijų išskirstymas
- Programatinė etiketavimas naudodamas etiketavimo funkcijas
- Įvairios supažindinimo priemonės
- Įgyvendinus skaidrios modeliaus ir vertinimo
- Error analizės ir duomenų skaidrumo šaukiniai
- Basis modelių fine-tuningas palaikymas
- Kontūros šablonų palaikymo priemonės užklausyje

LangSmith
Observavibilitetas, vertinimas ir debogingos platforma LLM įtaisų išprojekcijai iš LangChain komandos

LangSmith yra programuotojų platforma, kuria išrado LangChain komandos pagalba, kad komandoms būtų lemta tyrė, testuoti, įvertinti ir monitoruoti aplikacijas, veikiančias didžiąsios kalbos modeliais. Kadangi tai tęsiąsiai integruoja su LangChain ir LangGraph framework'ai, tai tačiau yra framework-agnostiškas ir gali įrengti bet kurią LLM įrangą per jo SDK bei API. Jo branduolio tikslas yra pašalinti didžiąųjų kalbos modelių sistema susijusių savybių nepriklausomumą bei suseptibilitatę nepastabaems nepakitimoems, teikiant programuotojams matyti, kas realiai vyksta jų grandinės, agentai ir prašymai vykosi laiko ribuose. Platforma skirta tyrinėjimui: kiekvieno priskyrimo atlikimo metu sukuriamas įspūdinges, sudėtingų žingsnų sekimo detalio trauktukas, kuris rodo visus žingsnius, tokius kaip išsiųsti užklausas, modelio atsakymus, tokenų naudojimą, trukmę, programuojamų priemonių vokorį, bei pusinterlieto rezultatus. Taip pagerėja atlikti sudėtingų daugialąsčių agentų ir atidavimo-augintovo generacinio kanalų tikrinesiosių, kuriose blogo atsakymo šaltinis gali būti įprangintas kelias laipsnių. Verslininkai galės tyrinėti individualius trauktukus, filtro ir paieško kiekybėje, bei peržaistas į tikrus įvestis ir išvestis visose eilėse. Taip pat LangSmith teikia įvertinimo priemones, skirtas matuoti priemonės kvalitetą. Komandos gali sušildyti duomenų rinkinius iš produkcijos pėdsakų ar kuratuotas pavyzdžiai, priderinti savo programą prieš tais duomenų rinkinius, ir įvertinti išėjimus iki būsimo valdiklių, naudojant integruojamus įvertinimo renginius, programos kodu grindinamų patikslinimų arba AI-as-teisme paslaugas. Šis pristato recidivinę patikrinimo testavimo galimybes, kai pasiūlymo ar modelio keičia siuntimą arbui ir padeda matyti, ar keitimai tatsiai pagerina rezultatus, o ne pasisakėdami į protu. Suderinimui pasiūlo valdymo panoramas, kurios naudoja įvertinimus, kaip atsiliegumas, kaustis, klaidų rėžio ir atsiliepimų, kurie keičiasi laiku, bei galimybę rinkti žmonių atsiliepimus ir vartotojų priežasčių. Priešdaro valdymo ir žaidlaujos komponentas padeda komandas iteruoti ir versionuoti priešdarus, bei salies vienas kitą modelio iškvietimo palyginti. LangSmith yra skirtas daugiausia programuotojams ir komandoms, kurios platinan LLM funkcijas ir reikia persikelti nuo įrankių ad hoc spausdintinio statement deboggingo iki sisteminis observabilumas ir įvertinimas. Pagrindinė jo galingumas yra gilia integracija su LangChain ekosistemu ir vieninga procesualė, jungiantis trakinimą, duomenų masyvus ir įvertinimą. Visiškai tikslūs priešingumo rodikliai yra toks, kad geriausia patirtis pagrįsta tuo, kad jūs turite savo komforto lauke LangChain/LangGraph pasaulyje, kad LLM-bazės įvertinimas pats save išlaiko nepilnas ir reikia atsargaus dizaino, bei kad tai komercinis produktas, kuris veikia už kainos ir reikia nuolaidoje, nors yra šiuo metu pasiekiama dalinai autoinstaliuojantiems savo vartotojų planams. Šitas produktas varžosi su kitų šio rūšies LLM observabilumo įrankių tokiais kaip Langfuse, Helicone, Arize Phoenix bei Weights & Biases Weave.
Kriterijų išskirstymas
- Eikite tiesiogiai ryšymas su kiekviennių veiksmanų laukiniais ir žodžių panaudojimu
- Sąsają datasetų kūrimas ir automatiški vertinimas
- Įgyvendinę, kodėlioje bazęs ir LLM kaip teisėjų rengėjas evaluatoriai
- Produkcijai skirtuose monitorinioje sąsajoje ryšimo taikymo šaltiniai
- Žmogaus atsakymų rinkimas ir pažymų kolekcinė
- Sąsają sąrašo vadovavimo, pavadinimo versijų ir žaidimo sąsajoms






