Iepriekšējā cīņa · 2026-05-10 UTC
Research AI Agents Sadursme — 2026. gada 10. maijs
No Research AI Agents kategorijas. 35 atzīmes izvietotas starp 10 cīnītājiem. Google AI Co-Scientist izcīnīja kroni.
Gala rezultāti
Sastāvs
Cīnītāji
Katra rīka profili, kas piedalījās šajā cīņā, sarindoti pēc to gala rezultāta.

Google AI Co-Scientist
Daudzagentu AI sistēma, kas sadarbojas ar zinātniekiem, lai ģenerētu hipotezes un paātrinātu biomedicīnisko pētījumu.

Google AI Co-Scientist ir daudzagentu AI sistēma, ko izveidoja, lai sadarboties ar zinātniekiem un paātrinātu biomedicīnas pētījumus. Tā ir izstrādāta uz Gemini 2.0 un darbojas kā virtuāls zinātnisks sadarbītājs, kas palīdz izveidot jaunus hipotezes un pētījumu priekšstatus. Sistēma paredzēta, lai atspoguļotu zinātniskās metodes domāšanas procesu un atklātu jaunu, originālu zināšanu. Ievadot zinātnieka pētījuma mērķi, kas ir norādīts dabiskajā valodā, AI Co-Scientist ģenerē jaunas pētījuma hipotezes, detalizētu pētījuma pārskatu un eksperimenta protokolus. Tā izmanto specializētu agentu koalīciju, tostarp Generation, Reflection, Ranking, Evolution, Proximity un Meta-review, kas izmanto automatizētas atsauksmes, lai iteratīvi ģenerētu, novērtētu un uzlabotu hipotezes. Sistēma ļauj zinātniekiem mijiedarboties dažādos veidos, iesaistot sākotnējos priekšstatus vai sniedzot atsauksmes par ģenerētajiem rezultātiem dabiskajā valodā. AI Co-Scientist izmanto arī rīkus, piemēram, tīmekļa meklēšanu un specializētus AI modeļus, lai uzlabotu hipotežu pamatojumu un kvalitāti. Sistēma ir izstrādāta ar elastīgu skalu, lai pārkāptu skaitļošanas jaudu un iteratīvi uzlabotu zinātnisko izpēti, kas vērsta uz konkrēto pētījuma mērķi. AI Co-Scientist ir īpaši noderīgs zinātniekiem, kuri saskaras ar grūtībām, navigējot pa ātrāko zinātnisko publikāciju pieaugumu un integrējot ieskatus no nezināmiem jomām. Izmantojot jaunākos AI uzlabojumus, tostarp spēju sintētiski apvienot sarežģītas tēmas un veikt ilgtermiņa plānošanu un domāšanu, AI Co-Scientist cenšas paātrināt zinātnisko un biomedicīnas atklāšanu. Sistēma ir pārbaudīta dažādos lietojumos, ieskaitot gēnu pārnesšanas atklāšanu un pārnesšanas atklāšanas pārskatīšanu. Kamēr AI Co-Scientist piedāvā vairākus ieguvumus, tā efektivitāte atkarīga no ievades pētījuma mērķa kvalitātes un zinātnieka spējai sniegt nozīmīgas atsauksmes. AI Co-Scientist ir jauns rīks, kas var būtiski ietekmēt zinātniskā kopienas darbību, taču tā ierobežojumus un potenciālos aizspriedumus jānovērtē rūpīgi. AI Co-Scientist izstrāde ir pastāvīgs projekts, un tā nākotnes lietojumus un uzlabojumus atkarīgi no turpmākas pētījuma un testēšanas rezultātiem.
Kritēriju sadalījums
- Hipotežu ģenerēšana
- Pētījuma pārskata izveide
- Eksperimenta protokolu izstrāde
- Specializēti agenti zinātniskajai izpratnei
- Automatizēts atsauksmju cikls
- Tīmekļa meklēšanas integrācija

GLM-4.6V
Atvērtā koda multimodālais GLM no Z.ai, apvienojot redzi, tekstu un rīku izsaukšanu ilgas konteksta izpētei, meklēšanai, kodēšanai un UI uz kodu.

GLM-4.6V ir multimodalā liela izglītības modelis, kas apstrādā 128 tūkstošu zīmju konteksta lodzi. Tā sasniedz lielāko dažādu lietotāju izglītības sasniegumus visu pārbaudes laukumu. GLM-4.6V iekļaujas tiešā apakšprogrammātūru (API) iespēju funkciju sazināšanais, nodrošinot vienotu tehniku pamatu multimodāliem darbotājiem reālu biznesa scenāriju gaitā. GLM-4.6V var pieņemt multimodālos ievadiem un automātiski izveidot augstīgu kvalitātes, strukturētu attēlu-teksta interpolēto saturu, veikt kompleksu dokumentu noteikšanu, un veikt attēlu meklēšanu un atļaušanu. Šis models a sniedz sevī dažādas iespējas un scenārijus, to skaitā inteliģentu bildes-teksa satursu un izvietošanas radīšanu, slikto tīkla meklējumus un bagātīgas multimēdiju pārrunu pamatnīšu veidošanu, kā arī ilgās kontekstā izpratīšanu. Tas var pieņemt sajauktas bildes-teksa ievades, ģenerēt augstas kvalitātes saturu un veikt kandidāt-bildēm vīzualitātes auditu. GLM-4.6V sadaļu multimodālā meklēšanas un analīzes processi sniedz slikeru kustību no zināšanu pārvades online izvades un strukturēto ziņojuma izveidi. Tā iepazīstina multimodālo kontekstu un pierāda, pamatojoties uz abām tekstālām un attēla informācijām. Šis models piedāvā vairākas spējas un situācijas, ieskaitot nolūka atpazīšanu un meklēšanas plānošanu, multimodālu rezultātu sakritību, kļūšanu ar bagāto media ziņojumu veidošanu.
Kritēriju sadalījums
- Multimodālie ievades atbalsts (attēli, teksts, faili)
- Natīva multimodālais rīku izsaukšana
- 128k konteksta garums
- Function Calling iespējas
- Ilgas konteksta izpratne
- Vizuālā izpratne un rīku atlase

AlphaSense
AI-dzināta tirgus izlūkošanas platforma, kas autonomi apkopo ekspertu ieskatus un nodrošina analītiķu līmeņa pētījumus lielā apjomā.

AlphaSense ir AI-dzināta tirgus izlūkošanas platforma, kas sniedz uzticamus ieskatus, lai vadītu biznesa lēmumus. Tā piedāvā plašu rūpīgi atlasītu avotu kolekciju, tostarp Tegus ekspertu transkriptus, brokeru pētījumus un uzņēmumu iesniegumus. Platforma izmanto uzlabotus AI modeļus, lai ģenerētu augstas kvalitātes ieskatus ar teikumu līmeņa citātiem. AlphaSense integrē darba plūsmas, likvidējot fragmentētus avotus un nodrošinot racionalizētus, savienotus ieskatus. Tās GenAI iespējas nodrošina reāllaika ieskatus, kas pamato lēmumus uz uzticamu ekspertīzi. Platforma ir paredzēta investīciju banku, hedz fondiem, privāto kapitālu, aktīvu pārvaldības, konsultāciju, dzīvības zinātņu un citām nozarēm. AlphaSense izceļas ar ārkārtīgi sintezētiem ieskatiem, kas iegūti no nepārspējamas satura kopas. Platforma piedāvā arī pielāgojamus aģentus, lai automatizētu atkārtotus pētījumu uzdevumus, pārvēršot atrastos materiālus izpildītājiem gatavos pārskatos un slaidos. Tās ģeneratīvais meklējums sniedz 360 grādu skatu uz tirgiem un uzņēmumiem, saistot kvalitatīvos ieskatus ar strukturētiem finanšu datiem. Viena no AlphaSense galvenajām stiprajām pusēm ir spēja dot lietotājiem iespēju pārliecināti un ātri veikt drosmīgus soļus. Platforma nodrošina komandām precīzas atbildes, unikālus skatījumus un svarīgus atjauninājumus, kas nepieciešami, lai pārspētu konkurenci.
Kritēriju sadalījums
- Atlasīti avoti
- Tegus ekspertu transkripti
- Brokeru pētījumi
- Uzņēmumu iesniegumi
- Privātie un publiskie finanšu dati
- GenAI reāllaika ieskatiem

Autoresearch
Atvērtprojekts, kāds ļauj autonomos AI ģēnius autonomi nodarboties ar LLM treniņu eksperymentiem un saglabāt labākās modelējuma mainījumu izmaiņas.

Autoresearch ir atvērtprojekts, kas ļauj AI ģēniem autonomi nodarboties ar LLM treniņu eksperyientiem un saglabāt labāko modelījumu izmaiņas. Projekts ļauj lietotājiem iestatīt mazu tikai atbilstoši LLM treniņa vidi un ļāvēt autonomajam AI ģēniem ar tās palīdzību eksperimentēt ar to naktī, mainot kodu, trenējot uz īsu laiku un kontrolejot, vai rezultāti irlabāki. Mērķis ir automatizēt pētniecības procesu, ļaujot autonomam AI ģēniem izpētīt dažādas modeļa izkārtojumu konfigurācijas, hiperparametrus un optimizācijas strategijas bez cilvēka intervensijas. Projekts ir izveidots, lai bija izprotams, izmantojot Markdown failus, kas ļauj lietotājiem lietotājiem pievienot vairākus AI ģēnius un uzlabot pētniecības procesu tieši tieši laiku gaitā.
Kritēriju sadalījums
- Autonomā LLM treniņa eksperyiente,
- AI ģēniem izmantojamā pētniecības procesa,
- Jedvaŗa reizējautonomā nanochat implementācija,
- Lietotāja programma programmēšana ar Markdown failiem,
- 5 minūšu treniņa laika budžets atkārtojumam metrāciju (val_bpb)

Cell2Sentence
Atvērtu satura framework, kas pavērī citsaitīgi ģenisko izteiksmes saturs par 'citsaitu sarakstiem' tādai veidā, lai liela valodas modeļa (LLM) varētu analizēt un sasnīt bioloģiskas zinības.

Cell2Sentence ir atvērtās kodiņu iekārtas, kura pārveido vienašu ģenētiskās izražības dati pa 'vārdus par celīm' analīzei un aizsākumprojektējumam lielām valodu modelēm (LLMs). Tā izvirzīta ranga sarakstām izteiksmju vektoru pēc kritērija — tām ir izcelta šūnām piemērotā ieraksts, kurā ir izskatītās ģenas nosaukumu virzienā nozīmētāji, kuru apmērs ir nokritēts. Šis ļauj LLMs modelēt vienašu RNK sekvenciju (scRNA-seq) izmantojot dabisku valodu. Iekārtas daļa ir C2S-Skēsts modeli, kas apvieno transkriptiķa un teksta datus un ļauj sākotnējos vienašu uzdevumus kā pārliecību norādījumu, datu apskati, grādu nosaukumu izvietošanu, un bioloģisko pārskatu pieejumu. Šie C2S-Skēsts modeļi ir pieejami Hugging Face un viņi ir bāzēti uz arhitektūru kādām Pišija un Gemma-2. Cell2Sentence ir paredzēts zinātniekiem un zinātniskiem, kuri strādā ar datiem vienašu ģenētiskajai izražībai. Režīms ir apstiprināts ar jaunām modelēm un funkcijām, ieskaitot atbalstu fine-tuningam uz personīgi izstrādātajām ieteikumu šablonu un daudzcelu ieteikumu formātēšanu. Tajā arī ir ietvertas Pythija modeļu sadaļa, lai aprakstītu šūnu tipu, šūnu tipa apstiprinātu izveidi un vispusīgu daudzcelu multi-taistošo modeļu, kas ir iestrādāts virs 57 miljonus cilvēkiem un pelēkās vēveru šūnu tīkla. Cell2Sentence ierīce ir dokumentēta un tā ir paredzēta mācīšanai, tostarp ar piemēriem, kā precizēt un formatēt dažu elementu pierādījumu. Cell2Sentence attīstība ietver van Dijk Labs un ir publicēta preprintā bioRxiv. Cell2Sentence nodrošina nākotnes paaudzes vienu celiņu atklājumus ar LLM.
Kritēriju sadalījums
- Izteiksmes vektora pārveidošana par citsaitu sarakstiem
- C2S-Scale modeli citsaitas uzdevumiem
- Atbalsts fine-tuningu uz personalizētām prompēm
- Dažādu citsaitu prompēm kārtošana
- Uzzīmēti modeli kā Pythia un Gemma-2 arkitektūru

THEUS (Aigora)
Uzņēmuma AI pētniecības sistēma, kas privātās pētījumu rezultātus pārveido izseklojamiem iespaidiem ar faktu ID, citātiem un eksperta avataru sintēzei.

THEUS ir uzņēmējdarības AI pētniecības sistēma, kas pārveide par privātīgām izpētēm sakotās atspoguļojas pieņēmumus ar faktu ID, citātu un ekspertu avatārēm. Tā būvēta pēc Google Agentu attīstības sastāvdaļu (ADK) un izmanto divvirziena modelēšanu, lai izveidotu dati, kas ir sakrstīti ar zināšanu agentiem. Lietotāji var izgūt, apvienot un izpētīt savu izpētes datus, un katrs pieņēmums tiek atbalstīts ar speciālu faktu ID uz pārlūka daudzumu citātu. THEUS piedāvā divus izmeklēšanas veidus: drīzuot jaunas pieņēmumus ar Dr. Reidu vai analīzējot eksistīgo zināšanas ar Dr. Sinclairu. Šis platforma ir izstrādāts viņiem, kas ir VPs tiesību izstrādes analītikas, globālo sensoru līderiem un inovāciju vadītājiem, kuri pārbauda stratēģisku spēju paplašinājumu. Tā izmanto specifisku pētniecības metodi, nevis ģenerisku uzņēmumu AI, un veido datu pamnatādas zināšanu agēntus, kas ir apmācīti tikai ar patiesajiem organizāciju datiem. Ar 85% jaunu produktu noliedzēšanas, kādas gada došanās pārsteidzošas statistikas (Nielsen), pētnieciski pamatinotas izpētes dramatiiski uzlabo sadarbību kvalitāti. Aigora piedāvā solo vietu, kas ietver funkcijas, tādas kā līdz 30 dokumenti, kas tiek iedarbināti mēnešā, līdz 1 500 lappusēm, kas tiek analīzētas mēnešā, un līdz 500 jautājumiem Dr. Sinkleram mēnešā. Viena no pamatprasību par THEUS ir to nosūtīt desmitu gadu ilgu privatīzu dati iekš zītāmu, pieņemamo lēmumu ziņu, ar Inteligentu Agentūžu palīdzību, kas pamatā ir apgrīstoti kā LLM (Language Model) un izmantoti kā API, kas tiek integrēts ar mūsu SaaS platformu.
Kritēriju sadalījums
- Izvilkt, sintētizēt un izpētīt pētniecības datus
- Izveidojiet jaunas iespaidus ar Dr. Reed vai analizējiet esošās zināšanas ar Dr. Sinclair
- Bidirekcijas modelēšana datu pamatojtiem zināšanu agentiem
- Savienojiet produkta un patērētāju zināšanas, lai iegūtu bidirekciju iespaidu
- Atbalsta starppētījumu sintēzi un pētījuma trūkumu analīzi

StartupValidator
AI startupa ideju validētors, kas izmanto reāla laika Twitter signālus un tīmekļa izpēti, lai ģenerētu vērtējumus ar risku, stiprumu un ieteikto pivotus.

StartupValidator ir AI rīks, kas paredzēts startupa ideju validēšanai, izmantojot reāla laika Twitter signālus un tīmekļa izpēti. Tas cenšas sniegt vērtējumus par startupa idejas īstenojamību, izceļot riskus, stiprumus un ieteicot potenciālos pivotus. Šis rīks ir vērsts uz uzņēmējiem un startupa dibinātājiem, kas vēlas novērtēt savas idejas īstenojamību pirms būtiskas resursu ieguldījuma. Izmantojot reāla laika datus no Twitter un tīmekļa, StartupValidator piedāvā datu balstītu pieeju startupa validēšanai. Tomēr, bez precīzākas informācijas par tā metodoloģiju un datu avotiem, rīka uzticamība un precizitāte ir neprecīza. Rīks, visticamāk, integrējas ar Twitter API un, iespējams, citiem tīmekļa datu avotiem, lai savāktu atbilstošu informāciju.
Kritēriju sadalījums
- Reāla laika Twitter signālu analīze
- Tīmekļa izpētes integrācija
- Vērtēts spriedums par startupa īstenojamību
- Riska un stiprumu identifikācija
- Ieteiktie pivotus uzlabojumu

Kosmos
Autonoms AI zinātnieks garo izpētes kampaņu vajadzībām, kas analizē datus un literatūru, lai izveidotu pilnībā citētus zinātniskos pārskatus.

Kosmos ir autonoms AI zinātnieks, kas paredzēts biopharma R&D komandām un pētniekiem. Tas analizē datus un literatūru, lai izveidotu pilnībā citētus zinātniskos pārskatus, paātrinot zāles izstrādes procesu no hipotezes līdz reģistrācijai dienās, nevis mēnešos. Kosmos darbojas autonomi, lasot literatūru, ģenerējot hipotezes, vēršot izmeklēšanas virzienus un izpildot zinātniskos darba plūsmu. Tas atbalsta pilnu zāles izstrādes dzīves ciklu, sākot no mērķa identificēšanas līdz klīniskajai izstrādei un pieteikuma iesniegšanai. AI rīks sadarbojas ar cilvēku zinātniekiem caur Slack, Teams un e-pastu, un mācās no organizācijas zināšanu bāzes, papildinot eksperimentālās vēstures un īpašīgās zinātniskās datus.
Kritēriju sadalījums
- Autonoms hipotežu ģenerēšana
- Literatūras analīze
- Datu analīze
- Zinātniskās darba plūsmas izpilde
- Sadarbība caur Slack, Teams un e-pastu
- Modeļa agnostisks, lai atbalstītu nākotnes vadošos modeļus

Table Agent ir programma ar integrētām intelektuālās funkcijām, kas palīdzēs tabulārajā pētījumā. Tas ir paredzēts automatizēt procesu, kurā tiek apkopots dati pēc kāda kārtas, kas padarītu pētījumu dzīsolīgākim. Instrumenta atļauj pieņemamīgu datienu skemisu definēšanu, kas ļauj lietotājiem papildināt savu datienu vākšanu, lai tā atbilstu specifiskiem vajadzībām. Šī atvērtība ir labs prece daudzām lielumos un nozīmēm, kur datienu struktūra var atšķirties stipri. Table Agent pamatā ir to darbību pamatā arodīšanās ar AI agentu atbalstu, kas tiešo kārtēju atrod un apvieno svarīgāko datubāzi, tādējādi samazinot laiku un iesmu, kas vajadzīgs manuālajām meklēšanām. Lai arī tās strādniecības un integrāciju satura ir nepiemācīti, ideja par datubāzē izvēloties asistentu, kas darbojas pēc AI algoritmu principiem, var būt, ka tas var savākties labi ar dažādām datu analizēšanas instrumentiem, padarot pavisam izteiktāku pētniecības procesu. Varētu būt, ka galvenie Table Agent vārda spēji ietver iespēju automatizētu datu apkopošanas uzdevumu automātizāciju un pieejamību dažādām datu struktūrām. Tomēr bez vairāk specifiskas informācijas, tiešām nevar noteikt to ierobežojumus vai to salīdzinājumu ar citām datu asistanu rīkiem.
Kritēriju sadalījums
- Automatizēta datu vākšana
- Pielāgotas datu shēmas
- AI agenta vadīta datu meklēšana
- Ātra un precīza datu izgūšana

AMIE
Ar multimodalu AI diagnostisko agentu, kura kondukt ārsta runas un tulko ķirurgiskas attēlas un noteikt precīzos diagnožu.

AMIE (Articulate Medical Intelligence Explorer) ir pētnieku AI diagnostiskais agents, kas tiek attīstīts ar Google DeepMind un Google Research. Tā ir projekta tēma konduktēt ārstu runas un tulkt ķirurgiskās attēlas noteikt precīzās diagnožu. Sākotnēji, AMIE bija tekst-bāzeta ārstu runai pielāgota medicīnas konversācijas AI ģentls, kas tika publicēts Nature žurnālā. Svarīgākie progresi, multimodālais AMIE, integrē spēju inteliģenti pieprasīt, tulkt un runāt par vizuāļa medicīnas informāciju laika gaitā, konduktējot ārstu runas. Šāda attīstība mērķis ir izlabot diagnostisko precizitāti, iekļaujot multimodālo datu kādai diagnoziei, piemēram, attēlos un dokumentos. AMIE izmanto statusu, kas piemīt pavisam saprastajam izpratniem, un tiek būvēta uz multimodālu Gemini modeļu. Tā ir tika vērtēta, izmantojot ekspertu pieteikumus, tostarp Objektīvus strukturētu klinikisko testu (OST) , salīdzinot tās izpildes līdzekli ar pamatāro ārstu darbību (PAĀD).
Kritēriju sadalījums
- Multimodālo diagnostisko runas
- Vizuālās medicīnas informācijas interpretācija
- Status, kas piemīt pavisam saprastajam izpratniem
- Uz Gemini modeļu apvienošana
- Simulācijas vidi runas izpētei









