Eerdere strijd · 2024-11-29 UTC
Research AI Agents Duel — 29 november 2024
Uit de categorie Research AI Agents. 2 markeringen geplaatst over 2 strijders. Autoresearch pakte de kroon.
Eindstand
THEUS (Aigora)
AutoresearchDe line-up
De strijders
Profielen van elke tool die in deze strijd meedeed, gerangschikt op eindscore.

Autoresearch
Een open-source project waarmee AI‑agents autonoom LLM‑trainingsexperimenten kunnen uitvoeren en de beste modelwijzigingen behouden.

Autoresearch is een open-source project dat AI‑agents in staat stelt autonoom LLM‑trainingsexperimenten uit te voeren en de beste modelwijzigingen te bewaren. Het project laat gebruikers een kleine maar werkelijke LLM‑trainingsomgeving opzetten en een AI‑agent laten experimenteren over nacht, de code aanpassen, kort trainen en controleren of de resultaten verbeteren. Het doel is om het onderzoeksproces te automatiseren, waardoor de AI‑agent verschillende modelarchitecturen, hyperparameters en optimalisatiestrategieën kan verkennen zonder menselijke tussenkomst. Het project bevat een vereenvoudigde single‑GPU implementatie van nanochat en biedt een basisstructuur voor het programmeren van het onderzoeksproces van de AI‑agent met behulp van Markdown‑bestanden. Het project is ontworpen om uitbreidbaar te zijn, zodat gebruikers meer agents kunnen toevoegen en het onderzoeksproces in de loop van de tijd kunnen verbeteren.
Kritériumverdeling
- Autonome LLM‑trainingsexperimenten
- Onderzoekproces geleid door AI‑agents
- Single‑GPU implementatie van nanochat
- Markdown‑gebaseerd programmeren voor het onderzoeksproces
- 5‑minutige trainingsbudget met evaluatiemetriek (val_bpb)

THEUS (Aigora)
Bedrijfs-AI-onthangsysteem dat eigendomsstudies omzet in waarneembare inzichten met Fact IDs, aanbevelingen en expert-avatarren voor synthese.

THEUS is een zakelijk AI-onderzoekssysteem dat propriëtaire studies omvormt tot traceerbare inzichten met feit-ID's, verwijzingen en expert-avatar's. Het is gebouwd op Google's Agent Development Kit (ADK) en gebruikt bidirectionele modellering voor data-gebaseerde kennisagenten. Gebruikers kunnen hun onderzoeksgegevens extracten, synthetiseren en verkennen, en elke bewering wordt ondersteund door een specifieke Feit-ID met paginaniveau-verwijzingen. THEUS biedt twee manieren om te verkennen: het genereren van nieuwe inzichten met Dr. Reed of het analyseren van bestaande kennis met Dr. Sinclair. Het platform is ontwikkeld voor VPs Insights, Global Sensory Leads en innovatieleiders die de strategische opbouw van capaciteiten evalueren. Het maakt gebruik van een doelgerichte onderzoeksmethodologie, geen generieke enterprise AI, en creëert datagedreven kennisagenten die zijn getraind op daadwerkelijke institutionele gegevens. Met 85% van nieuwe producten die binnen twee jaar falen (Nielsen), verbetert evidence-based verkenning de besluitkwaliteit aanzienlijk. THEUS biedt een solo seat aan, met functies zoals het verwerken van maximaal 30 documenten per maand, het parseren van maximaal 1.500 pagina's per maand en het stellen van maximaal 500 vragen aan Dr. Sinclair per maand. Een van de belangrijkste voordelen van THEUS is het vermogen om decennia aan propriëtaire gegevens om te zetten in traceerbare, beslissingsklare inzichten met behulp van AI-gebaseerde kennisagenten.
Kritériumverdeling
- Uit het onderzoek halen, synthetiseren en verkennen
- Genereer nieuwe inzichten met Dr. Reed of bestaande kennis analyseren met Dr. Sinclair
- Bidirectionele modellering voor data-aangedreven kennisagenten
- Verbind product- en consumentenkennis voor bidirectionele inzichten
- Ondersteunt cross-studie synthese en onderzoeksbreukanalyses
- Supports