Bătălie trecută · 2025-03-05 UTC
AI Model Serving Platforms Confruntare — 5 martie 2025
Din categoria AI Model Serving Platforms. 13 puncte plasate pe 3 luptători. New API a luat coroana.
Clasament final
Lotul
Luptătorii
Profilurile fiecărui instrument care a concurat în această bătălie, clasate după scorul lor final.

New API
Poartă de acces LLM open-source care unifică multiplele API-uri ale furnizorilor de inteligență artificială cu rutare, facturare și analitică

New API este o poartă de acces LLM open-source care oferă o interfață unificată pentru conectarea la mai mulți furnizori de modele de inteligență artificială, inclusiv OpenAI, Anthropic Claude și Google Gemini-style API-uri. Acesta acționează ca un strat de gestionare centrală care permite echipelor să direcționeze cererile către diferiți furnizori, să controleze accesul și să urmărească utilizarea dintr-un singur loc. Proiectul este destinat dezvoltatorilor, echipelor de platforme și organizațiilor care consumă API-uri de inteligență artificială la scară largă și doresc o singură poartă de acces în loc de integrarea fiecărui furnizor separat. Prin expunerea unor endpoint-uri compatibile cu OpenAI, permite aplicațiilor existente și SDK-urilor să funcționeze cu mai multe back-end-uri fără a rescrierea codului clientului. Pe lângă proxy-ul de bază, New API se concentrează pe problemele operaționale, cum ar fi cotele bazate pe token-uri, gestionarea facturării și a creditelor, auditarea cererilor și analitica utilizării. Aceste caracteristici îl fac potrivit pentru construirea de platforme interne de inteligență artificială sau pentru revânzarea/metrificarea accesului pentru mai mulți utilizatori sau echipe. Ca instrument open-source, auto-găzduit, oferă operatorilor control asupra implementării și fluxului de date, care poate fi important pentru gestionarea costurilor și conformitatea. Se poziționează în același spațiu ca și alte gateway-uri și agregatori API, cum ar fi LiteLLM și One API, de la care derivă. Ca și în cazul majorității gateway-urilor auto-găzduite, adoptarea New API necesită configurarea infrastructurii și întreținerea continuă, iar amploarea suportului furnizorilor și stabilitatea depind de contribuțiile comunității.
Diviziunea criteriilor
- Poartă de acces API unificată pentru mai mulți furnizori
- Endpoint-uri compatibile cu OpenAI
- Rutare a cererilor către furnizorii de modele
- Gestionarea cotelor și a facturării token-urilor
- Analitică a utilizării și auditare

GLM‑4.5
Model de fundație open-source cu raționament hibrid MoE construit pentru sarcini agentice, de codare și de utilizare a instrumentelor

GLM-4.5 este un model de limbaj mare open-source dezvoltat de Zhipu AI (Z.ai) ca parte a familiei de modele GLM. Acesta utilizează o arhitectură Mixture-of-Experts (MoE) și un design de raționament hibrid care permite modelului fie să "gândească" înainte de a răspunde, fie să răspundă direct, țintind fluxurile de lucru agentice, codarea și utilizarea instrumentelor. Modelul suportă o fereastră de context de 128K-token și apeluri native la instrumente. Modelul este poziționat pentru dezvoltatorii care construiesc agenți AI și asistenți de codare. Acesta a introdus "Gândirea Intercalată", unde modelul raționează înainte de fiecare răspuns și apel la instrumente, care ulterior au fost extinse de lansările ulterioare GLM (GLM-4.6 și GLM-4.7) cu caracteristici precum Gândirea Păstrată și Gândirea la Nivel de Rând. GLM-4.5 subliniază codarea agentică, integrându-se cu cadrele de agent principale și instrumentele de codare, cum ar fi Claude Code, Cline, Roo Code și Kilo Code. Depozitul GitHub găzduiește resursele modelului, codul de inferență și exemplele, în timp ce greutățile sunt lansate deschis pentru auto-găzduire, iar API-ul este oferit prin platforma Z.ai API. Depozitul documentează acum și modelele succesoare GLM-4.6 (extinzând contextul la 200K tokeni) și GLM-4.7, alături de o variantă ușoară de 30B-A3B (GLM-4.7-Flash) pentru o implementare mai eficientă. Ca o lansare cu greutate deschisă, GLM-4.5 concurează cu alte modele deschise care vizează cazuri de utilizare agentică și de codare. Punctele sale forte stau în utilizarea instrumentelor, controlul raționamentului și deschiderea, deși rularea unui model MoE mare local necesită hardware substanțial, iar versiunile ulterioare GLM au depășit-o ulterior pe benchmark-uri.
Diviziunea criteriilor
- Arhitectură Mixture-of-Experts (MoE)
- Raționament hibrid cu moduri de gândire / non-gândire
- Apeluri native la instrumente pentru agenți
- Gândire intercalată înainte de răspunsuri și apeluri la instrumente
- Fereastră de context de 128K
- Optimizare pentru codare agentică

Jina AI
Bază de îngeri pentru căutare eficientă în sens multimodal si comportămător de recunoaștere a limbilor.

Jina AI oferă o suită de modele de bază și API-uri bazate pe căutare, recuperează date și înțelegere multimodală. Ofertele sale fundamentale includ înrăutățiri de text și de imagină, reranker cu neuroni, clasificatori zero-cunoștință și instrumente pentru a construi fluxuri de lucru augmentat cu recuperarea (RAG) la scară. Plataforma a fost proiectată pentru dezvoltatori și echipe care construiesc motoare de căutare, sisteme recomandate și asistenți AI care au nevoie să raționeze texte, imagini și date structurate. Modelele sunt accesibile prin API-uri găzduite și lansări open-source, cu suport multifiliier și capacități de lung context pentru a gestiona documente mari. Jina AI se integrează cu bazele de date vectorice obişnuite și framework-uri ale LLM, făcând-o o componentă practică de baza pentru sisteme de căutare semantică la scară de producţie şi retinere a cunoştinţelor.
Diviziunea criteriilor
- Știree și re-recunoașteri pentru știree și re-recunoașteri pentru știree și recomandări.
- pros
- :
- Tridată pentru orice aplicații de eficiență pentru utilizări în context AI și AJAXien,e știree multi modal si recunoașteri pentru cel mai rezonabil utilizare în știree si anumite tipuri de AJAXien,e oferire de știree pentru Ăştiată ai AJAXien în vechile AI pentru știree comportament inteligent și re
- cons
- :


