Minulý súboj · 2024-05-31 UTC
Research AI Agents Súboj — 31. mája 2024
Z kategórie Research AI Agents. 34 body udelených medzi 8 bojovníkov. Google AI Co-Scientist získal korunu.
Konečné poradie
Zostava
Bojovníci
Profily každého nástroja, ktorý súťažil v tomto súboji, zoradené podľa ich konečného skóre.

Google AI Co-Scientist
Viacagentný AI systém, ktorý spolupracuje so vedcami na tvorbe hypotéz a urýchľovaní biomedicínskeho výskumu.

Google AI Co-Scientist je viacagentný AI systém navrhnutý na spoluprácu s vedcami a urýchľovanie biomedicínskeho výskumu. Vytvorený na báze Gemini 2.0 funguje ako virtuálny vedecký spolupracovník a pomáha generovať nové hypotézy a výskumné návrhy. Systém je navrhnutý tak, aby odrážal proces rozumného uvažovania podkladajúceho vedeckú metódu a objavoval nové, originálne poznatky. Keď vedec zadá cieľ výskumu v prirodzenom jazyku, AI Co-Scientist vytvorí nové výskumné hypotézy, podrobný prehľad výskumu a experimentálne protokoly. Používa koalíciu špecializovaných agentov – Generation, Reflection, Ranking, Evolution, Proximity a Meta-review – ktorí pomocou automatizovaného spätnoväzového cyklu iteratívne generujú, hodnotia a zdokonaľujú hypotézy. Systém umožňuje vedcom interagovať rôznymi spôsobmi, napríklad poskytnutím počiatočných nápadov na preskúmanie alebo spätnou väzbu k vygenerovanému výstupu v prirodzenom jazyku. AI Co-Scientist využíva nástroje ako webové vyhľadávanie a špecializované AI modely na zlepšenie základného a kvalitatívneho základu hypotéz. Systém je navrhnutý tak, aby flexibilne škáloval výpočtový výkon a postupne zlepšoval svoje vedecké uvažovanie smerom k stanovenému výskumnému cieľu. AI Co-Scientist je zvlášť užitočný pre vedcov, ktorí čelia výzvam pri navigácii rýchleho rastu vedeckých publikácií a integrácii poznatkov z neznámych oblastí. Využitím nedávnych pokrokov v AI, vrátane schopnosti syntetizovať komplexné témy a vykonávať dlhodobé plánovanie a uvažovanie, sa AI Co-Scientist snaží urýchliť rýchlosť objavov v oblasti vedy a biomedicíny. Systém bol testovaný v rôznych aplikáciách, vrátane objavovania a opätovného objavovania prepravy génov. Aj keď AI Co-Scientist prináša niekoľko výhod, jeho účinnosť závisí od kvality vstupného výskumného cieľa a schopnosti vedca poskytnúť zmysluplnú spätnú väzbu. AI Co-Scientist je nový nástroj s potenciálom významne ovplyvniť vedeckú komunitu, avšak jeho obmedzenia a možné zaujatosti je potrebné starostlivo hodnotiť. Vývoj AI Co-Scientist je pokračujúcim úsilia a jeho budúce aplikácie a vylepšenia budú závisieť od pokračujúceho výskumu a testovania.
Rozdelenie kritérií
- Generovanie hypotéz
- Vytváranie prehľadu výskumu
- Vývoj experimentálnych protokolov
- Špecializovaní agenti pre vedecké dôvodovanie
- Automatizovaný spätnoväzový cyklus
- Integrácia webového vyhľadávania

Bright Data Web MCP
Server MCP, ktorý poskytuje AI agentom spoľahlivé vyhľadávanie, scrapovanie a automatizáciu prehliadača s 5 000 mesačnými bezplatnými požiadavkami.

Web MCP od Bright Data je server, ktorý umožňuje AI agentom spoľahlivo vyhľadávať, scrapovať a automatizovať webové prehliadače. Poskytuje 5 000 mesačných bezplatných požiadaviek. Nástroj umožňuje AI agentom efektívne prehľadávať web, extrahovať údaje a navigovať webové stránky bez blokovania. Ponúka funkcie ako výsledky vyhľadávania v reálnom čase, extrakcia dát, prechádzanie webových stránok a automatizácia prehliadača. Web MCP je navrhnutý na obchádzanie blokov a obmedzení a je dôveryhodný pre viac ako 20 000 zákazníkov po celom svete.
Rozdelenie kritérií
- Vyhľadávanie na webu v reálnom čase
- Prechádzanie webových stránok a extrakcia dát
- Automatizácia prehliadača
- Obchádzanie geografických obmedzení a CAPTCHA
- Renderovanie JavaScriptu pre dynamický obsah
- Imitovanie reálneho používateľského správania

Kosmos
Autonomný AI vedec pre dlhodobé výskumné kampane, ktorý analyzuje údaje a literatúru a vytvára úplne citované vedecké správy.

Kosmos je autonómny AI vedec určený pre biopharma výskumné a vývojové tímy a výskumníkov. Analyzuje údaje a literatúru a vytvára úplne citované vedecké správy, čím urýchľuje proces vývoja liekov od hypotézy až po registráciu v dňoch, nie mesiacoch. Kosmos pracuje autonómne, číta literatúru, generuje hypotézy, riadi výskumy a vykonáva vedecké pracovné postupy. Podporuje celý životný cyklus vývoja liekov, od identifikácie cieľa až po klinický vývoj a podávanie žiadostí. Nástroj AI spolupracuje s ľudskými vedcami cez Slack, Teams a e‑mail a učí sa zo znalostí organizácie, vybuduje na experimentálnej histórii a proprietárnych vedeckých údajoch.
Rozdelenie kritérií
- Autonomné generovanie hypotéz
- Analýza literatúry
- Analýza údajov
- Vykonávanie vedeckých pracovných tokov
- Spolupráca prostredníctvom Slack, Teams a e‑mailu
- Model-agnostický pre budúce najmodernejšie modely

THEUS (Aigora)
Podnikový systém výskumu AI, ktorý premieňa vlastné štúdie na sledovateľné poznatky s faktovými ID, citáciami a expertovými avatarmi pre syntézu.

THEUS je podnikový systém výskumu AI, ktorý transformuje vlastné štúdie na sledovateľné poznatky s faktovými ID, citáciami a expertovými avatarmi. Je postavený na Google's Agent Development Kit (ADK) a využíva obojsmerné modelovanie pre dátovo založené znalostné agenti. Používatelia môžu extrahovať, syntetizovať a skúmať svoje výskumné dáta a každý nárok je podĺpený konkrétnym faktovým ID s citáciami na úrovni stránky. THEUS ponúka dva spôsoby skúmania: generovanie nových poznatkov s Dr. Reed alebo analýzu existujúcich znalostí s Dr. Sinclair. Táto platforma je navrhnutá pre VPs Insights, Global Sensory Leads a Innovation leaderov hodnotiacich strategickú schopnosť budovania. Používa účelovo vytvorenú výskumnú metodológiu, nie generický podnikový AI, a vytvára dátovo založené znalostné agenti vycvičené na skutočných inštitucionálnych dátach. S 85% nových produktov zlyhávajúcich do dvoch rokov (Nielsen), evidencia založená skúmanie dramaticky zlepšuje kvalitu rozhodovania. THEUS ponúka sólo sedadlo, ktoré obsahuje funkcie ako až 30 dokumentov importovaných za mesiac, až 1 500 strán analyzovaných za mesiac a až 500 otázok pre Dr. Sinclair za mesiac. Jednou z kľúčových výhod THEUS je jeho schopnosť premieňať desaťročia vlastných dát na sledovateľné, rozhodovacie inteligencia s AI-powered znalostnými agentmi.
Rozdelenie kritérií
- Extrahovať, syntetizovať a skúmať výskumné dáta
- Generovať nové poznatky s Dr. Reed alebo analyzovať existujúce znalosti s Dr. Sinclair
- Obojsmerné modelovanie pre dátovo založené znalostné agenti
- Spojiť produktové a spotrebiteľské znalosti pre obojsmerné poznatky
- Podporuje syntézu štúdií a analýzu výskumných medzier

AMIE
Multimodálny AI diagnostický agent, ktorý vedie klinické rozhovory a interpretuje lekárske obrazy pre presné diagnózy.

AMIE (Articulate Medical Intelligence Explorer) je výskumný AI diagnostický agent vyvinutý spoločnosťami Google DeepMind a Google Research. Je navrhnutý tak, aby viedol klinické rozhovory a interpretoval lekárske obrazy pre presné diagnózy. Spočiatku bol AMIE textovým medicínskym diagnostickým konverzačným AI agentom publikovaným v Nature. Najnovší vývoj, multimodálny AMIE, integruje schopnosť inteligentne žiadať, interpretovať a uvažovať o vizuálnych lekárskych informáciách počas klinických rozhovorov. Tento vývoj má za cieľ zlepšiť presnosť diagnostiky začlenením multimodálnych údajov, ako sú obrazy a dokumenty, do diagnostického procesu. AMIE používa stavovo uvedomujúci rámec uvažovania a je postavený na multimodálnych modeloch Gemini. Bol hodnotený prostredníctvom odborných hodnotení, vrátane objektívnych štruktúrovaných klinických skúšok (OSCE), porovnávajúcich jeho výkonnosť s praktickými lekármi (PCP) v rôznych scenároch pacientov.
Rozdelenie kritérií
- Multimodálny diagnostický dialóg
- Interpretácia vizuálnych lekárskych informácií
- Stavovo uvedomujúci rámec uvažovania
- Integracia s modelmi Gemini
- Simulačné prostredie pre hodnotenie dialógov

QualiaInterviews
Platforma riadená AI pre viacjazyčný, konverzačný výskum a hodnotiace rozhovory vo veľkom rozsahu.

QualiaInterviews je výskumná platforma, ktorá využíva umelú inteligenciu na vedenie rozhovorov s účastníkmi prostredníctvom prirodzenej, konverzačnej dialógovej formy. Umožňuje tímom zhromažďovať kvalitatívne poznatky z väčších vzoriek, ako umožňujú tradičné individuálne rozhovory, pričom zachováva hĺbku a nuansy otvoreného rozhovoru. Tento nástroj podporuje rozhovory v mnohých jazykoch, čo ho robí vhodným pre cezhraničné štúdie, globálny prieskum trhu a hodnotenie programov. Výskumníci môžu navrhnúť rozhovory, nasadiť ich účastníkom a prezerať automaticky štrukturované zistenia bez manuálnej moderácie každej relácie. QualiaInterviews zvyčajne využívajú sociálni výskumníci, hodnotitelia, tímy UX a organizácie vykonávajúce hodnotenia vplyvu, ktorí potrebujú škálovateľné kvalitatívne údaje bez obety hĺbky konverzácie.
Rozdelenie kritérií
- AI-moderované konverzačné rozhovory
- Podpora viacjazyčných rozhovorov
- Automatické následné a doplňujúce otázky
- Štruktúrovaná analýza kvalitativných odpovedí
- Škálovateľné nasadzovanie účastníkov
- Nástroje pre výskumný a hodnotiaci pracovný tok

Table Agent je inteligentne zdatelnej technológiou pripojený asistent na údaje, ktorý slúži na pomoc pri tabuľkových výskumoch. Je určený na automatisáciu procesu skúmania údajov v akomkoľvek zadanom témavom, čo zvyšuje účinnosť výskumu. Ukážka umožňuje priradenie špecifikovaných šablon dát pre užívateľov, ktoré im umožňuje prispôsobiť svojím zoskupeniu dát podľa konkrétnych potrieb. Táto flexibilita sa prekáža širokému spektru aplikácií a odvetví, kde struktúra dát môže variovať veľmi výrazne. Na centre funkčnosti Table Agenta je jeho agent-drvená vyhledávací schopnosť dát, čo znamená, že nástroj využíva umelú inteligenciu na aktivné vyhľadávanie a skompilovanie relevantných dát, čo môže výrazne pomôcť zmenšiť čas a úsilia vyžadované pre manuálne vyhľadávanie. Ak by údaje o priebehu jeho práce a integráciach neboli podrobné uvádzané, pojem o AI-zariadenom asistentiú dát sa dačí, že by sa ľahko integrovala s rôznymi nástrojmi pre analýzu dát, čím by sa uľahčil celkový proces výskumu. Prednosti Table Agentu by mali pravdepodobne zahrňovať jeho schopnosť automatizovať tediútne úlohy zbieraní údajov a jeho prilákanie k rôznym údajovým štruktúram. Napriek tomu, že nie sme majú konkrétne informácie, je náročné odhadnúť jeho obmedzenia alebo ako sa porovná so súkromnými službami pomocou údaje.
Rozdelenie kritérií
- Automatizované zbieranie údajov
- Šablóny pre data, ktoré môžu používateľmi nastaviť
- Vyhľadávanie údajov pomocou agenta
- Rýchle a presné získanie údajov


Project Autoresearch je otvorený zdrojový projekt pre ľudí, aby zostali zdieľaní AI agentov pre autonómne úklady LLM تدريب experimenty, úprav pretože ich vybíra aj zostáva automatizovaná prenos premlouvajúcich experimentov, aby sa obzvládila zdieľaná občas obchodná zábava najlepšia vysvetlenia zvládania mechanizmus,
Rozdelenie kritérií
- Autonómne experimenty s tréningom LLM
- Výskumný proces riadený AI agentmi
- Implementácia nanochat na jednej GPU
- Programovanie výskumného procesu založené na Markdown
- 5-minútový rozpočet tréningového času s hodnotiacou metrikou (val_bpb)







