Προηγούμενη μάχη · 2024-07-19 UTC
AI Agent Development Frameworks Αναμέτρηση — 19 Ιουλίου 2024
Από την κατηγορία AI Agent Development Frameworks. 22 βαθμοί τοποθετήθηκαν σε 7 μαχητές. Το kagent πήρε το στέμμα.
Τελική κατάταξη
Η σύνθεση
Οι μαχητές
Προφίλ κάθε εργαλείου που διαγωνίστηκε σε αυτή τη μάχη, καταταγμένα με βάση την τελική τους βαθμολογία.

kagent
Πλαίσιο ανοιχτού κώδικα που επιτρέπει σε AI agents να αυτοματοποιούν λειτουργίες Kubernetes.

Το kagent επιτρέπει σε AI agents να αυτοματοποιούν τις λειτουργίες Kubernetes. Επιτρέπει στους agents να αναπτυχθούν, να παρακολουθούνται και να ελεγχθούν με τη χρήση γνωστών εργαλείων Kubernetes. kagent κάνει τους agents first-class workload στο Kubernetes, επιτρέποντας την έκδοση τους ως Custom Resource Definitions (CRDs) του Kubernetes και την αναθεώρηση σε pull requests. Αυτή η προσέγγιση επιτρέπει τη χρήση των υφιστάμενων εργαλείων Kubernetes για τη διαχείριση των agents. Το πλαίσιο είναι ανοιχτού κώδικα και έχει αναπτυχθεί από τους ιδρυτές του Istio. Υποστηρίζει διάφορους συνδυασμούς γλώσσας και πλαισίου, όπως Go και Python, και επιτρέπει τη χρήση οποιουδήποτε παρόχου μεγάλου γλωσσικού μοντέλου (LLM). Το kagent παρέχει ισχυρές δυνατότητες ασφαλείας και παρατηρησιμότητας, συμπεριλαμβανομένης της εντοπισμού OpenTelemetry, των μετρικών Prometheus και των structured logs. Υποστηρίζει επίσης την υποστήριξη multi-runtime, την επικοινωνία agent-to-agent, και τη δυνατότητα φόρτωσης γνώσης από Git repositories. Συνολικά, το kagent παρέχει ένα ισχυρό και ευέλικτο πλαίσιο για την αυτοματοποίηση λειτουργιών Kubernetes με AI agents.
Κατανομή κριτηρίων
- Agent Substrate για γρήγορη εκκίνηση και αποδοτική χρήση πόρων
- Zero-trust ready with mTLS and fine-grained RBAC
- Persistent vector-backed memory for long-term memory
- Human-in-the-loop tool approval gates and agent-initiated questions
- Agent-to-agent (A2A) delegation for composing multi-agent workflows

BabyCatAGI
Μοντέρνο framework για αυτόνομα AI ατζέντα για τη μείωση της εργασίας για την αυτόματη εκτέλεση ζητημάτων

Η BabyCatAGI είναι μια απλοποιημένη, τροποποιημένη έκδοση του BabyAGI, σχεδιασμένη να αντιμετωπίζει сложικές εργασίες μέσω αυτονομούμενων μηχανισμών AI. Βγαίνει τα υψηλά επίπεδα στόχων σε κατα鼁ιμένες υποτρόφοος, εκτελεί ταυτοχρόνως και προσαρμόζει το σχέδιο της με βάση τα μεταϋποκείμενα αποτελέσματα, κλπ, το καθιστά κατάλληλο για έρευνα, γέννηση περιεχομένου και εξάγωνο πρόβλημα λύσεων. Το πλαίσιο εδρεύει στις ελάχιστες γραμμές κώδικα και την ευκολία στην ανάγνωση, κάνωντας έτσι εφικτή η πρόσβαση για τους προγραμματιστές που θέλουν να δοκιμάσουν τις μηχανικές IA χωρίς το βάρος μεγαλύτερων βιβλιοθηκών διαχείρισης. Ερχεται σε επαφή με γλώσσα μοντέλα και εργαλεία web αναζήτησης για την συλλογή περιεχομένου, την διαμόρφωση αποφάσεων και την παραγωγή δομημένων εξόδων. Ως ένα ανοικτό πειραματικό πρόγραμμα, το BabyCatAGI είναι πιο ανταπτούμενο για την κίνηση πειραμάτων σε διαδικασίες αντιστοίχησης, την διεξαγωγή γνώσεων πώς λειτουργούν συστήματα αυτόνομης λειτουργίας-με σκοπό-και την προσαρμογή PipeLine για ειδικές αναγκάζοντας αυτοματισμού.
Κατανομή κριτηρίων
- Δημιουργία και κατατάξεις λίστας εργασιών
- Αυτόνομη εκτέλεση υποεργασιών
- Επεκτατική περιήγηση στον διαδίκτυο για κατάσταση
- Αναλυτική αύξησηWorkflow
- Ελαφρύ υλοποίηση Python
- Προσαρμογέας στόχοι και προτάσεις

MCP‑Use
Πλατφόρμα ανοιχτού κώδικα για τη σύνδεση LLM με διακομιστές MCP και τη δημιουργία προσαρμοσμένων AI πράκτορων με πρόσβαση σε εργαλεία.

Το mcp-use είναι μια ανοιχτού κώδικα πλατφόρμα που διευκολύνει τη σύνδεση Μεγάλων Γλωσσικών Μοντέλων (LLMs) με διακομιστές MCP και επιτρέπει την ανάπτυξη προσαρμοσμένων AI agents που μπορούν να αλληλεπιδρούν με αυτά τα LLMs. Η πλατφόρμα παρέχει ένα full-stack MCP framework (mcp-use SDK) για την ανάπτυξη εφαρμογών ChatGPT, Claude Connectors και MCP Servers. Με το mcp-use, οι προγραμματιστές μπορούν να αξιοποιήσουν ένα ενιαίο σύνολο κώδικα για να αναπτύξουν τις εφαρμογές τους σε διάφορες πλατφόρμες όπου οι χρήστες και οι πράκτορες ήδη εργάζονται, όπως ChatGPT, Claude και Gemini. Η πλατφόρμα προσφέρει ένα εύρος εργαλείων και λειτουργιών, όπως η δυνατότητα scaffold εφαρμογών MCP με μία εντολή, η αυτόματη ανάπτυξη στο Manufact Cloud, και ενσωματωμένη analytics και observability. Οι προγραμματιστές μπορούν να χρησιμοποιήσουν το mcp-use SDK για να δημιουργήσουν και να αναπτύξουν διακομιστές MCP και εφαρμογές χωρίς την ανάγκη επιπλέον εργαλείων. Η πλατφόρμα προσφέρει επίσης Visual Inspector και δυνατότητες δοκιμής Sandbox, επιτρέποντας στους προγραμματιστές να δοκιμάσουν τις εφαρμογές τους χωρίς την ανάγκη μίας ζωντανής LLM. Το mcp-use στοχεύει στη διευκόλυνση της ανάπτυξης και διάθεσης εφαρμογών βασισμένων στο MCP, καθιστώντας το μια ελκυστική επιλογή για προγραμματιστές που επιθυμούν να κατασκευάσουν και να αναπτύξουν προσαρμοσμένα AI agents και εφαρμογές.
Κατανομή κριτηρίων
- Διαχείριση διακομιστών MCP
- Σύνδεση και ενσωμάτωση LLM
- Ανάπτυξη προσαρμοσμένων AI πράκτορων
- Αυτόματη ανάπτυξη και κλίμακωση
- Οπτικός Επισκόπτης και δοκιμή Sandbox
- Ενσωματωμένα αναλυτικά στοιχεία και παρατηρήσιμότητα

Claude MCP Agents
Κτηρίσματα AI με την MCP του Anthropic για ομαλή σύνδεση σε εργαλεία και δεδομένα.

Οι αιτήματα Claude MCP Ασκούμενοι είναι ψηφιακοί αξιωματούχοι που εκμεταλλεύονται τον Προτокол Κοντέξτου του Μοντέλου Ανθρωπότητας (MCP) για σύνδεση με ένα ευρύ φάσμα εξωτερικών πηγών δεδομένων, API και εργαλείων διαπραγματεύσεων προγραμματιστών. Μέσω της εξαγωγή της πορείας του συνόλου δεδομένων μεταξύ του Claude και εξωτερικών συσκευών, οιเหลτοι αξιωματούχοι μπορούν να διαβάζουν αρχεία, να ερευνάνε βάσεις δεδομένων, να εκκαλείται υπηρεσίες να ενεργούν επαναλαλούντας πραγματικές καταστάσεις χωρίς ειδικούς ενσωματώστες για κάθε πηγή. Η στρατηγική αυτή επικεντρώνεται στους προγραμματιστές και τις ομάδες που κατασκευάζουν αυτοματισμούς, βοηθούς έρευνας και αλληλεπιδραστικούς αργυρέες ολόκληροι που αναζητούν αξιόπιστες πρόσβασεις σε εταιρικά ή προσωπικά δεδομένα. Η ανοιχτή ορισμούς MCP σημαίνει ότι ο ίδιος ο αλληλεπιδραστικός όμιλος μπορεί να ενσωματωθεί σε νέες εργαλεία σαν συνδετές εκκολάπτουν, μειώνοντας την δέσμευση και το κόστος ένταξης.
Κατανομή κριτηρίων
- Ενσωμάτωση Model Context Protocol
- Σύνδεση με αρχεία, API και δέσμευση
- Διαχειρίσιμο μέσωcustom MCP servers
- Υποστηρίζει διαδικασίες multi-step
- compatibile με την οικογένεια μοντέλων Claude
- Ανοιχτή πρότυπο για την διαλειτουργικότητα

Gemma 3
Ένα ανοιχτού κώδικα μοντέλο AI βελτιστοποιημένο για απόδοση σε single-GPU, υποστηρίζει πολυμορφικές εισόδους και πάνω από 140 γλώσσες.

Το Gemma 3 είναι μια συλλογή ελαφριών, κορυφαίων ανοιχτών μοντέλων σχεδιασμένων για εκτέλεση σε συσκευές, ιδιαίτερα βελτιστοποιημένων για απόδοση με μία μόνο GPU. Υποστηρίζει πολυμορφικές εισόδους και πάνω από 140 γλώσσες. Το μοντέλο διατίθεται σε διάφορα μεγέθη (1B, 4B, 12B και 27B), επιτρέποντας στους προγραμματιστές να επιλέξουν το πιο κατάλληλο για το υλικό και τις ανάγκες απόδοσής τους. Το Gemma 3 προσφέρει προηγμένες δυνατότητες κειμενικής και οπτικής λογικής, παράθυρο συμφραζομένων 128k‑token και κλήση λειτουργιών για σύνθετες εργασίες. Περιλαμβάνει επίσης εκδόσεις κβαντισμένες για ταχύτερη απόδοση και μειωμένες απαιτήσεις υπολογιστικής ισχύος. Το μοντέλο αποτελεί μέρος της δέσμευσης της Google να κάνει την χρήσιμη τεχνητή νοημοσύνη προσβάσιμη και βασίζεται στην ίδια έρευνα και τεχνολογία που τροφοδοτεί τα μοντέλα Gemini 2.0. Το Gemma 3 έχει σχεδιαστεί ώστε να επιτρέπει στους προγραμματιστές να δημιουργούν εφαρμογές AI που μπορούν να τρέχουν απευθείας σε συσκευές όπως κινητά, φορητοί υπολογιστές και σταθμούς εργασίας. Η Gemma 3 προσφέρει απόδοση κορυφαίου επιπέδου για το μέγεθός της, ξεπερνώντας άλλα μοντέλα όπως το Llama3-405B, το DeepSeek-V3 και το o3-mini σε προκαταρκτικές αξιολογήσεις ανθρώπινων προτιμήσεων. Επιτρέπει παγκόσμιες εφαρμογές με ενσωματωμένη υποστήριξη για πάνω από 35 γλώσσες και προεκπαιδευμένη υποστήριξη για περισσότερες από 140 γλώσσες. Το μοντέλο επιτρέπει τη δημιουργία ροών εργασίας που καθοδηγούνται από AI χρησιμοποιώντας κλήση λειτουργιών και δομημένη έξοδο. Η ανάπτυξη του Gemma 3 περιελάμβανε αυστηρά πρωτόκολλα ασφαλείας, όπως εκτενής διακυβέρνηση δεδομένων, ευθυγράμμιση με τις πολιτικές ασφαλείας μέσω fine‑tuning, και ισχυρές αξιολογήσεις benchmark. Η οικογένεια ανοιχτών μοντέλων Gemma έχει δει σημαντική υιοθέτηση, με πάνω από 100 εκατομμύρια λήψεις και μια ζωντανή κοινότητα που έχει δημιουργήσει πάνω από 60 000 παραλλαγές Gemma. Οι δυνατότητες του Gemma 3 το καθιστούν κατάλληλο για προγραμματιστές που θέλουν να δημιουργήσουν ελκυστικές εμπειρίες χρήστη που μπορούν να χωρέσουν σε ένα μόνο GPU ή TPU host.
Κατανομή κριτηρίων
- υποστήριξη πολυμορφικής AI
- ανάπτυξη με έμφαση στην ευθύνη
- εκτεταμένη λεπτής ρύθμισης
- υποστήριξη 140 γλωσσών
- βελτιωμένη απόδοση

Agency Swarm
Ένα ανοικτό framework παραγγελίας.agent που σχεδιάστηκε για να αυτοματοποιήσει και να ροηmatόποιήσει τις διαδικασίες ανάπτυξης AI μέσω συνεργατικών swarm.agent

Το Agency Swarm είναι ένα ανοιχτό framework που κατασκευάζεται πάνω στο SDK και την API Απαντήσεων της OpenAI. Προσφέρει ένα δομημένο και έτοιμο για παραγωγή περιβάλλον για την δημιουργία εφαρμογών πολλαπλών πρακτόρων. Οι βασικές функциές του περιλαμβάνουν προσωποποιήσιμους ρόλους πρακτόρων, την ικανότητα να χειρίζεται διαφορετικά backends μοντέλων (π.χ., τα μοντέλα της οικογένειας GPT της OpenAI, Anthropic, το Gemini της Google, το OpenRouter της Azure και自製 εργαλεία LiteLLM, ενεργοποιημένα από τον διακοσμιτή @function_tool (συνιστάται) ή από τη διάταση του αντικειμένου BaseTool. Ένας βασικόςประโยชนός της αρχιτεκτονικής του Agency Swarm είναι η σταθερότητά του και σε περιβάλλοντα Python και Linux. Η εγκατάσταση είναι απλή με την τυπική εντολή pip install agency-swarm. Η περιγραφή πρέπει να εξηγήσει το Agency Swarm ως ένα ανοιχτού κώδικα εργαλείο που χτίζεται πάνω στη βάση του OpenAI Agents SDK και των Responses API. Το Agency Swarm είναι ένα ανοιχτό toolkit AI που βοηθά τους développers να δημιουργούν εφαρμογές multi-agent για την ανάπτυξη πραγματικού AI. Κλειδί Χαρακτηριστικά: - Αυтомατικά δημιουργημένα εργαλεία CLI: Ανακαλύψτε το REST API της εφαρμογής σας για εύκολη πρόσβαση σε βασικές υπηρεσίες και αύξηση της производικότητας. - Προσαρμόσιμες ρόλοι agent: Μπορείτε εύκολα να καθορίσετε συγκεκριμένες λειτουργίες και επίπεδα разрешений για κάθε ρόλο agent, για αυξημένη προσαρμοστικότητα στην εφαρμογή σας. - Πλήρης Υλοποίηση Στρωμάτων: Το Agency Swarm είναι πλήρης στοίβα για Python μόνο. Nếu είστε σε Linux, σκεφτείτε το ως πλήρη υλοποίηση στρώματος χωρίς κανένα περιορισμό λόγω της τυπικής βιβλιοθήκης Python. Πλεονεκτήματα: 1. Σταθερότητα σε περιβάλλοντα Python/Linux 2. Εύκολη ενσωμάτωση με την εφαρμογή σας 3. Συνθέσιμα και εύχρηστα εργαλεία CLI 4. Προσαρμόσιμες Ρόλοι Πράκτορα Μειονεκτήματα: 1. Περιορισμοί Συμβατότητας Μοντέλου Γλώσσας (Προσωπικοί chatbots: GPT-3, κ.λπ.) N/A 2. Απαιτήσεις Περιβάλλοντος Ανάπτυξης N/A 3. Περιορισμένη Υποστήριξη_BACKEND Μοντέλου N/A 4. Βασικό Interface Χρήστη N/A 5. Ικανότητες Μάθησης N/A 6. Ενοποίηση Funktion N/A 7. Διεργασία Τεκμηρίωσης N/A 8. Ικανότητες Μαχανικού Μάθησης AI: N/A 9. Προηγμένη Διαχείριση Ροής Διαλόγου N/A 10. Πολυστρώματα Εφαρμογές N/A 11. Συγχρόνευση Εκτέλεση N/A 12. Πρόσβαση στην Κατάσταση Εφαρμογής N/A 13. Αυτόματη Ανάπτυξη N/A 14. Προηγμένη Εκτέλεση Καθηκόντων N/A 15. Τύποι Προσαρμοσμένων Πρακτόρων N/A 16. Υποστήριξη Μεγάλου Μοντέλου Γλώσσας N/A 17. Λειτουργεί σε Python ↻ N/A 18. Πλήρης Έλεγχος N/A 19. Μέτρηση Απόδοσης N/A 20. Προσφορά Τοπικών Περιβάλλων Εργασίας N/A 21. Ενοποίηση με το OpenALink: Ένα πλαίσιο ανάπτυξης ιστοσελίδων για εφαρμογές Python 22. Συνεργασία με Πρακτόρες AI σε ένα.project 23. Ερμηνεία 24. Giám sát N/A 25. Πλήρης Ένταξη Κώδικα Πηγής N/A 26. Κλιμακωτότητα N/A 27. Χαμηλή Απόδοση N/A Μειονεκτήματα:
Κατανομή κριτηρίων
- Προσαρμόσιμες Ρόλοι Agent
- Πλήρης Έλεγχος sobre τα Prompts / Οδηγίες
- Εργαλεία για ανάπτυξη με τύπο ασφαλείας
- Συντονισμένη Επικοινωνία Agent
- Ελαστική διατήρηση κατάστασης
- Διαχείριση πολλαπλών agent

Mosaic AI Agent Framework
Ένα σύνολο εργαλείων της Databricks για την δημιουργία, ανάπτυξη και αξιολόγηση υψηλής ποιότητας AI agents και εφαρμογών RAG.

Το Databricks Agent Framework (AAF) είναι ένα σύνολο εργαλείων που παρέχει η Databricks για τη δημιουργία, την ανάπτυξη και τη διακυβέρνηση AI agents. Αυτοί οι agents μπορούν να συνδεθούν με οποιοδήποτε εργαλείο, βάση δεδομένων ή εφαρμογή SaaS μέσω ενός ενιαίου, διακυβερνήσιου πρωτοκόλλου (Model Context Protocol, MCP). Το framework περιλαμβάνει ενσωματωμένη ανάπτυξη, πειραματισμό και υλοποίηση AI σε serverless υπολογιστική μέσω των Databricks Apps χωρίς διαχείριση υποδομών. Τα Agent Bricks και το Unity Catalog είναι απαραίτητα για διακυβέρνηση και ασφάλεια· εφαρμόζουν προκαθορισμένες πολιτικές σε μοντέλα, εργαλεία και συνδέσεις, ενώ επιβάλλουν όρια ταχύτητας, fallback και άλλες προστασίες απαραίτητες για την πρόληψη εισαγωγής prompts, την ανίχνευση ευαίσθητων δεδομένων και το φιλτράρισμα περιεχομένου.
Κατανομή κριτηρίων
- Agent Bricks
- Unity Catalog
- Databricks Apps
- Model Context Protocol (MCP)
- Κεντρική διακυβέρνηση
- Έλεγχος ανά χρήστη






