Praeita kova · 2025-12-12 UTC
Agent Development Susirėmimas — 2025 m. gruodžio 12 d.
Iš Agent Development kategorijos. 39 įvertinimai pateikti tarp 9 kovotojų. Flowwise AI laimėjo vainiką.
Galutiniai rezultatai
Dalyviai
Kovotojai
Kiekvieno šioje kovoje dalyvavusio įrankio profiliai, surikiuoti pagal galutinį rezultatą.

Flowwise AI
Atvira šaltinio drag-and-drop konstruktorius, kuris leidžia sukurti personalizuotus LLN taikikus ir agentų skričių

Flowwise AI yra atviro kodo, naudingos kodo platforma, kuri leidžia programytojams ir komandomiems sukurti modeliaus sulyginimo valdymo funkcijų taikymo programų per vaizdine, node-orientu jungtį. Vienoje kanvos taikant komponentus, taip kaip modeliaus įrenginius, prašymus, atmintį, vektorių saugyklą ir priemonę, naudotojai gali sukonfigūruoti skaitytuvų, agentų ir perkėlimų kanalų sistemų. Pagrindę sudariusią mokslinių sukėlimų sistema naudoja populiariųje LlangChain ir LlamaIndex kūrybos tylose. Taip Flowwise pasisiunčia daugiausia tekstualiųjų LLM įrangų tiekėjų, atvaizdinės kūrybos ir duomenų šaltinių įsigijimui. Užbaigtos prieigos gali būti pasiekiamos kaip API arba įranguotas vaizdo blokai, tad yra naudingai tinkamai pritaikyti prototipuoti vidinių priemonių naudojimo projektus bei keliuos produktinių šarų pristabdojančias priemons pristatyti krovos procesus. Tokiai projektai, kurie yra savarankiški ir bendruomeniškai vadinami, patinka komandoms, kurios ieško gebėjimo prisijungti prie savų AI sistemų, bei gebėjimo kontroliuoti savo programinę įrangą, nei prasidedėjus tikėtis, kad ji bus uždaryta, nors ji būtų priklausoma nuo savitirpinto švietimo šarvas (SaaS) pervedimo.
Kriterijų išskirstymas
- Dizaino node-based vertybinių editoriaus LLN siuvių sąsajos
- LangChain ir LlamaIndex komponentų, palaikymo
- Integracijų agentų atmintimi ir įrankių
- Vektorių bazinių sąrašų sistemų ir vektorių integracijos
- API sąsajų ir skaitytojo prikabintoji widgetų
- Asmeninės praplėstos įkainiojimų ir daugiemodelių atskaitai

Pdf Redaction
Galiu parengtų dokumentų redakcijos galiūnas, skirtas ištrinti sulyginimus duomenis iš PDF dokumentų.

Pdf redakcija yra naudotojams pagalbantis AI sistemos, kurios prijungus jas į PDF failus, padeda atskirti ir visiems laikams pašalinti konfidentialią arba svarbią informaciją. Jūsų sistema automatiškai identifikuojantis asmenines duomenis, finansinius detalius ir kitas privačią turinį, kuris kartais reikalauja užslėpti, prieš išsiųstant dokumentus išorėn. Sukaupti machine learning technologijas tradiciniui redaguoti dokumentų procesui, įrankis siekia sumažinti tiesioginio poveikio, naudojamą peržiūrint ilgus dokumentus. Jame naudingas legaliojo specialisto, sveikatos priežasčiuoju veiklą, valstybinių agentūrų ir įmonių, reguliai nuolat keičiančių pavieniausius dokumentus ir siekiančių atitikti privatumo reglamentaciją. Naudojantės gali įkelti PDF failus, leisti AI skenauti rūgštus duomenis, peržiūrėti pasiūtus ištrinimo pasiūlymus ir išeiti saitinę dokumento kopiją, kuria gali platinti.
Kriterijų išskirstymas
- Integravęs kompiuterinio mokslą prižiūrėjimo sulyginimų duomenų detekcija
- Priežastinių ištrinčių tekstų ir turinio tekstų ir turinio ištrinčių
- Sunkiojo failų batch apdorojimo
- Prižiūrinti ir patvirtinimo sritis
- Palaikanti asmeninių ir finansinių duomenų pavidavų
- Palaikanti dokumento prižiūrėjimo saugumas

IsMyStoreReady
Ištikusi pagreitinys už Shopify ir WooCommerce prekių krautuvų samplų aptikti konversiją ir apkalbos išvydėjimų problemų.

IsMyStoreReady yra automatizuotas auditoringas įrankis, kuris sukurtas už internetinių prekių lauku savininkams, vertynuojantiems greitą svetainės sveikatas peržiūrą. Skenuojant užpuliųjį puslapį, jis išryškina svarbius klausiminius, kurie gali paveikti pirkėjų konvertaciją, SEO reitingą, pavokei ir viso bendro šio svetainės gynybės valiavimo gotovumą. Žaidis generuoja sudarius reportą apie savo pagrindinius požymius, kaip tarkime produktų puslapių kokybę, prekių sandorių politikas, veiklos ženklus bei tikėtino reikšmės elementus. Tai leidžia įmonių įkūrėjams ir mažųjų e-commerce komandų nariai gauti išvadą, kokie sąmoningi pasiruošimui pagal prioritetis be to nepriklausomi specialistai išsižadėti ar vykdyti daugybę skirtingų atestavimo procedūrų. Šis įrenginys skirtas atskirai prekiuojančioms asmenims, naudotuvams ir toksiškai plintančioms prekybos su užsakovais (DTC) markėms, kurios nori greita, antrą žinytį prieš pradėdami skambėti reklamą ar išplečiama reklamos biudžeta.
Kriterijų išskirstymas
- Vienos mygtelės prekių krautuvų apžiūra
- Šopifajus ir Vūkofersiukas palaiko
- Konversijų ir tikėjimo tikrinimas
- SEO bei įvykio signalų apžvalga
- Priorinti problemų pranešimai
- Veiksmingos pagalba užtikrinti gerėjimą

LangChain Agent
Atvirojojo rašymo sąsajos frameworkas LLM galutės aplinkoje bei autonominiam agentui kurti.

LangChain Agent yra viena iš šis plėtros LangChain ramyvų, sukurta kad padėtų programavimo specialistams sudaryti taikinius kuriose kalbos modeliai gali teisėtis, priimti sprendimus ir bendrauti su išoriniais gabi. Agentai naudoja LLM kaip teisių variklį, kuris nustato kurias priemones vykti, koks eilę priimti ir kaip vartoti rezultatus informuoti vėlesnius žingsnius. Šioje bazėje pateikiama modulinės komponentų rinkinys, skirtas sintetinti prielaidas, integruoti šaltinius, valdyti atmintį bei sujungti API, duomenų bazes, ir paieskos įrangą. Ši sąvoka padeda sudaryti pokyvių valdiklius, tyrimų pagalbėjas, darbo sijas automatiząciją, bei kitus dinamiškus LLM - valdomus sistemas. LangChain suteikia paramą daugeliui modelių leistuvių ir kalbų (Python ir JavaScript/TypeScript), todėl yra labai lankstus pagrindas prototipiniam ir reikalingojo laiko naudojimui.
Kriterijų išskirstymas
- LM galimai agentų naudojimo
- Promptų ir sąsajos suderinimas
- Atminties ir būsenos valdymas
- Integravimo su vektorinių saugyklų ir API
- Dalis LLM teikėjų paramojos
- Ežerio skaitmenų ir asinkroninė eikos

LangSmith
Observavibilitetas, vertinimas ir debogingos platforma LLM įtaisų išprojekcijai iš LangChain komandos

LangSmith yra programuotojų platforma, kuria išrado LangChain komandos pagalba, kad komandoms būtų lemta tyrė, testuoti, įvertinti ir monitoruoti aplikacijas, veikiančias didžiąsios kalbos modeliais. Kadangi tai tęsiąsiai integruoja su LangChain ir LangGraph framework'ai, tai tačiau yra framework-agnostiškas ir gali įrengti bet kurią LLM įrangą per jo SDK bei API. Jo branduolio tikslas yra pašalinti didžiąųjų kalbos modelių sistema susijusių savybių nepriklausomumą bei suseptibilitatę nepastabaems nepakitimoems, teikiant programuotojams matyti, kas realiai vyksta jų grandinės, agentai ir prašymai vykosi laiko ribuose. Platforma skirta tyrinėjimui: kiekvieno priskyrimo atlikimo metu sukuriamas įspūdinges, sudėtingų žingsnų sekimo detalio trauktukas, kuris rodo visus žingsnius, tokius kaip išsiųsti užklausas, modelio atsakymus, tokenų naudojimą, trukmę, programuojamų priemonių vokorį, bei pusinterlieto rezultatus. Taip pagerėja atlikti sudėtingų daugialąsčių agentų ir atidavimo-augintovo generacinio kanalų tikrinesiosių, kuriose blogo atsakymo šaltinis gali būti įprangintas kelias laipsnių. Verslininkai galės tyrinėti individualius trauktukus, filtro ir paieško kiekybėje, bei peržaistas į tikrus įvestis ir išvestis visose eilėse. Taip pat LangSmith teikia įvertinimo priemones, skirtas matuoti priemonės kvalitetą. Komandos gali sušildyti duomenų rinkinius iš produkcijos pėdsakų ar kuratuotas pavyzdžiai, priderinti savo programą prieš tais duomenų rinkinius, ir įvertinti išėjimus iki būsimo valdiklių, naudojant integruojamus įvertinimo renginius, programos kodu grindinamų patikslinimų arba AI-as-teisme paslaugas. Šis pristato recidivinę patikrinimo testavimo galimybes, kai pasiūlymo ar modelio keičia siuntimą arbui ir padeda matyti, ar keitimai tatsiai pagerina rezultatus, o ne pasisakėdami į protu. Suderinimui pasiūlo valdymo panoramas, kurios naudoja įvertinimus, kaip atsiliegumas, kaustis, klaidų rėžio ir atsiliepimų, kurie keičiasi laiku, bei galimybę rinkti žmonių atsiliepimus ir vartotojų priežasčių. Priešdaro valdymo ir žaidlaujos komponentas padeda komandas iteruoti ir versionuoti priešdarus, bei salies vienas kitą modelio iškvietimo palyginti. LangSmith yra skirtas daugiausia programuotojams ir komandoms, kurios platinan LLM funkcijas ir reikia persikelti nuo įrankių ad hoc spausdintinio statement deboggingo iki sisteminis observabilumas ir įvertinimas. Pagrindinė jo galingumas yra gilia integracija su LangChain ekosistemu ir vieninga procesualė, jungiantis trakinimą, duomenų masyvus ir įvertinimą. Visiškai tikslūs priešingumo rodikliai yra toks, kad geriausia patirtis pagrįsta tuo, kad jūs turite savo komforto lauke LangChain/LangGraph pasaulyje, kad LLM-bazės įvertinimas pats save išlaiko nepilnas ir reikia atsargaus dizaino, bei kad tai komercinis produktas, kuris veikia už kainos ir reikia nuolaidoje, nors yra šiuo metu pasiekiama dalinai autoinstaliuojantiems savo vartotojų planams. Šitas produktas varžosi su kitų šio rūšies LLM observabilumo įrankių tokiais kaip Langfuse, Helicone, Arize Phoenix bei Weights & Biases Weave.
Kriterijų išskirstymas
- Eikite tiesiogiai ryšymas su kiekviennių veiksmanų laukiniais ir žodžių panaudojimu
- Sąsają datasetų kūrimas ir automatiški vertinimas
- Įgyvendinę, kodėlioje bazęs ir LLM kaip teisėjų rengėjas evaluatoriai
- Produkcijai skirtuose monitorinioje sąsajoje ryšimo taikymo šaltiniai
- Žmogaus atsakymų rinkimas ir pažymų kolekcinė
- Sąsają sąrašo vadovavimo, pavadinimo versijų ir žaidimo sąsajoms

Coval
Simuliacijų ir vertinimo platforma, skirta testuoti ir įvertinti AI balsinio ir žiūronio agentų, apie kelis kartus reikšminga

Coval yra įrangų ir įvertinimo platforma, skirta komandoms, kurių pagrindinis uždavinys - statyti pokalbių AI agentus, įskaitant tiek garsinį, tiek pokalbio modus. Ji sprendžia dažnai pasitaikančią problemą agentų kūrimo proceso metu: tradicinės vieno elemento testavimo priemonės ir manualūs pozityvi reiškiniai nėra gali įkvėpti neapibrėžtųjų, keliems posimams siejančių agentų sistemų savybių, todėl yra sunku nežinoti, ar pakeitimas pagerina ar iškeičia realaus pasaulyje elgesio. Šio platformos branduolio idėja yra simuliavimas. Niekuomet ne tikėdama ties vien tik stačiakabiškomis atvežimu testų atvežimais, Coval generuoja suartėjusias naudotojo interakcijas, vykiančias agento veikimą daugeliu scenarijų ir kalbų maršrutų. Šie simuliuijami veigiai vėliau gali būti įvertinti pagal nustatytų metrikų ir įžvalgu išlikimo sąlygas, leidžiant komandoms matytis įvertinimai prieš išsiuntimą keičiamų korekcijas ir sučiupti regresijas kai ir agentai bei priklausomybių sprendimai keičiasi. Coval yra pristatytas abiemoms balsinei ir teksto agentuiem, kas yra svarbu, kad balsas prisideda iš naujo – balsų perteikimas į tekstą, trukmės efektai, bei pasikeitimo perimavimo efektai – kuriuos taip pat prideda agento kokybės efektai už pagrindinio kalbos modelio. Kompanija priešpriešingo palyginimo įsigaliojusi tuo, kaip nepriklausomas autokuro komandos naudoja didelės skaičio simuliatorių siekiu patvirtinti elgesį, prieš pradėjus tiesiogine tvarkyme, taip pat taikia ta pati testavimo filosofija mašinai agentams. Savaitine darbe vykdymo srityje, komanda prisijungia prie savo agento, apibrėžia scenarijus ir vertinimo kriterijus, vykdo simuliacijas, ir patvirtina rezultatus per vykdančio proceso metu, kad laiku žyrimų performansi. Tai suteikia galimybių naudoti jį atvirkščiai kintamųjų programavimo metu, taip pat tikrinti ir keičianti testavimą kaip dalį CI stiliaus proceso. Neprieštarstant kartu su kitais produktais šióčiau kategorijoje ir tikruojam praeitosioje trumpoje, produkto kaina, integravimo papildai bei tikslio matavimo diapazonas patinka patikrinti tiesiogai. Komandų turi įvertinti, ar šio modelio simuliavimo scenarijus atitinka savo gamybės rūšiavimo modelį. Produktą skiriant nuo kitų paprastų LLM-evaluavimo priemonių, svarbiausia priežastis yra simuliavimo įverstumas ties keliomis, įvairiais rūšiu susijusių agente, o ne vienos paskyrimo vertinimo.
Kriterijų išskirstymas
- Simuliuojami vartotojo interakcijos, skirti testuoti agentus
- Vertinimo metrikos ir balų srautas per runas
- Parama balsiniam ir tekstinių agentų
- Regressijų detekcija visų agentų versijų metu
- Scenarijų paremtasis testavimas konversacinėse keliuuose

Stagehand
Atviras riesto AI naršyklės automatizavimo frameworkas, kuris yra sukurto mažinuojamų ir paprastų

Stagehand yra savaitinių naršyklinės framework, leidžianti developeriams sukurinėti AI agentus, kurie gali naviguoti, bendrauti su internetinėmis svetainėmis bei iš jų ekstrahuoti duomenis. Ji jungia determinantinę kodą stiliuojančią Playwright ir natūralaus kalbos instrukcijas, tuo leidžiant komandoms ir vykdomiesiems komandoms sukurti fine-grained valdymą, kai reikia ir aukšto lygio užteisumą, kai neproblemos nėra. Šio framework'e architektūra sudaryta aplink mažą, prognozuojamą API, kuris koncentruojas į prieigos, veiksmus bei elemento pagalba, bei matmenų apstradinį duomenų gavimą. Priklausomis nuo įvestų modelių, cache ar agentų kompleksų, jis labai geras įgyvendina greitus skriptingus, bei pramoninio lygio naršymo darbus.
Kriterijų išskirstymas
- Naturale kalbos veiksmai, išvada ir ištrinimo metodai
- Išdėstymai su schema duomenų ištrinimu
- Gretimu Playwright stilių kompatybė, kurios leidžia detalizuotas valdymas
- Mokymų modeliai palaiko daugybę LLM tiekėjų
- Atminties apsarginėjimas nuolatine naršylės rėminėmis veiklėmis
- Gali būti naudojamas agentų frameworkai

Vertex AI Agent Builder
Google Cloud platformas, leidžiantis programuotojams sukurti ir įdiegti generatyvinius AI agentus verslo priemonėms.

Vertex AI Agento Statytojas dabar yra dalis Gemini Įmoninės Agentų Platformos, esančios Google Cloud. Jis yra apimantis platforma, skirta programuotojams siekti: statyti, skalauti, reglamentuoti ir užtikrinti didmečio pagaminių generatyviosios intelektualios agentų įgyvendinimą. Jis leidžia techninius komandąs transformuoti įmonių taikomojoji programinei įrangai bei srautams į galingas agentės sistemas. Platforma suteikia vieningą aplinką duomenims ir intelektualioji sistemai, leidžianti greitai vadovautis generatyviojių intelektualiosiomis aplikacijomis su pagalba iš "Gemini". Vartotojai gali mokyti, testuoti ir reguliuoti mašininio mokslinio tyrimo modelius vienoje platformoje. Platformas siūlo atvirus ir įvairiapusią aplinką, kuria padeda įmonėms greitai sukurti, išplėsti, valdyti ir optimizuoti įmonių lygio agentų, pagrįstų į savo įmonių duomenims. Jis teikiama pilno pakopoje bazę ir papročio plėtrą kūrėjams, leidžianti paversti aplikacijas ir darbų sritys galingais sistemų agentais globaliame mastu. Svarbiausios savybės apėmia galimybę pasirinkti daugiau nei 200 Google bei ketvirtųjų šalių AI modelių ir įrankių bei personalizuoti modelius konkrečioms naudojimo atvejams tiesiogjai. Plataforma taip pat skatina agentų valdžią bei protybių tvarkyklas per naudojamus įrankius kaip Google Antigravitacija, kurioje galima valdyti ir tvarkyti agentus centriniu būdu. Gemini Enterprise Agent Platformas sukurtas datos mokslininkams ir Mūsų Karkasinių inžinieriams, skirtingos priemonės užrašui, suderinimui ir įrengimui Mūsų Karkasinių modeliams, tai taip pat MLOps, kad automatizuojam, standartizavim ir valdžiam Mūsų Karkasinių projektus. Jos pateikia įvairių modulių priemonių, kad bendradarbiauti su komandas ir pagerinti modelius per plėtros ciklo gyvavimo. Visumais, „Vertex AI Agent Builder" su „Gemini Enterprise Agent Platform" leidžia sukurti ir paleisti sofistikusius AI agentų tiesioginius įrenginius įmonių reikšmėms, pristatydami įvairius narystės ir funkcijų priemonis, skirtas pagalba taikant, paprystindami, tvarkymui ir panaudojimo optimizavimumi šių agentų.
Kriterijų išskirstymas
- Sukurkite, skaidrinkite, valdykite ir optimituokite verslo klase generatyvinių AI agentų.
- Vieningas duomenų ir AI aplinka greitėja agentų vystymą.
- Gemini Train savo generatyvinius AI įtaisus.
- Gemini verslo priemonė sekurizuota registracija, valdymas ir valdymas agentų
- Google Antigravity skirtas agentų valdomai ir darbo paskyrai.
- 200+ Google ir antrapusų AI modeliai ir priemones.

Botpress
Panašus platformas, skirta statyti, išleisti ir valdyti AI agentus ir balandžius.

Botpress yra plataforma, skirta kūrimui pasakojamųjų AI agentų, užtikrinamų didelų kalbos modelių pagrindu. Tai leidžia patekti iki matomių srautų kūrėjo, SDK, bei programinės įrangos integravimo su populiariaisiais posakių kanaliais, taip leidžiant komandoms apie šią darbą dirbančioms komandoms kuriai agentais, kuri galės laikytis natūralios sąsajos, pasiekia API ir išbaugšto taškų užduotys. Platforma jungia naudingumą paprastams kodo programas su giliųjų konfigūracijos galimybėmis, tai leidžia neitiksliaisems vartotojams ir programuotojams bendrauti kartu tikroje projekte. Tokios funkcijos kaip žinotvarkos bazės, analizės, ir žmogiško perdavimo funkcijos padeda pasiūlyti platformą įprasmėsiems naudojimams kaip pavyzdžiai, pavyzdžiui, klientų aptarnavimo, vadų generavimo, ir vidinių automatyvizacijų. Botpress suteikia nemokamąjį lygį eksperimentavimui ir mokamųjų planų, kurie atspindi naudojimą, taip pat atvirojo kodo bendruomenės leidimą savininku veikiamuams prieigačiomis.
Kriterijų išskirstymas
- Drag-and-drop pokalbio srauto redakcijos įrankis
- LLM ginkluoti agentai su priemones
- Žinčių bazės priimti iš dokumentų ir URL
- Pelėda-kanalų išplatymas (internetas, WhatsApp, Slack, t. y.)
- Analitika ir pokalbio monitoringavimas
- Žmogiško prijungimo ir komandų kolekcijos








