Pretekla bitka · 2025-03-05 UTC
AI Model Serving Platforms Obračun — 5. marec 2025
Iz kategorije AI Model Serving Platforms. 13 oznake postavljenih med 3 borci. New API je osvojil krono.
Končna razvrstitev
Postava
Borci
Profili vsakega orodja, ki je tekmovalo v tej bitki, razvrščeni po končnem rezultatu.

New API
Odprtokodni LLM prehod, ki združuje več API-jev AI ponudnikov z usmerjanjem, obračunavanjem in analitiko

New API je odprtokodni LLM prehod, ki nudi enoten vmesnik za povezovanje z več ponudniki AI modelov, vključno z OpenAI, Anthropic Claude in Google Gemini‑style API-ji. Deluje kot centralna upravljavska plast, ki ekipam omogoča usmerjanje zahtevkov med ponudniki, nadzor dostopa in sledenje uporabe z enega mesta. Projekt je namenjen razvijalcem, platformskim ekipam in organizacijam, ki v velikem obsegu uporabljajo AI API-je in želijo enoten vstopni sistem namesto integracije vsakega ponudnika posebej. Z izpostavljanjem OpenAI-kompatibilnih končnih točk omogoča, da obstoječe aplikacije in SDK-ji delujejo z večimi zaledji, ne da bi bilo treba prepisovati kodo odjemalca. Poleg osnovnega proxy-inga se New API osredotoča na operativne vidike, kot so kvote na podlagi žetonov, upravljanje obračunavanja in kreditov, revizija zahtevkov ter analitika uporabe. Te funkcije ga naredijo primernim za gradnjo notranjih AI platform ali za preprodajo/merjenje dostopa več uporabnikom ali ekipam. Ker gre za odprtokodno, samohostljivo orodje, operaterjem omogoča nadzor nad uvajanjem in pretokom podatkov, kar je lahko pomembno za upravljanje stroškov in skladnost. Pojavlja se v istem prostoru kot drugi API prehodi in agregatorji, kot sta LiteLLM in One API, od katerih izhaja. Kot pri večini samogostovanih prehodov, uvajanje New API zahteva postavitev infrastrukture in stalno vzdrževanje, obseg podpore ponudnikov in stabilnost pa sta odvisna od prispevkov skupnosti.
Razdelitev kriterijev
- Enoten API prehod za več ponudnikov
- Končne točke združljive z OpenAI
- Usmerjanje zahtevkov med ponudniki modelov
- Upravljanje kvot žetonov in obračunavanja
- Analitika uporabe in revizija

GLM‑4.5
Odprtokodni hibridno-razmišljajoči MoE temeljni model, zasnovan za agentalne, kodiranje in uporabo orodij

GLM-4.5 je odprtokodni velik jezikovni model, ki ga je razvila Zhipu AI (Z.ai) kot del družine modelov GLM. Uporablja arhitekturo Mixture-of-Experts (MoE) in hibridni razmišljajoči dizajn, ki modelu omogoča, da najprej „razmišlja“ pred odgovorom ali pa odgovori neposredno, pri čemer je namenjen agentnim delovnim tokovom, programiranju in uporabi orodij. Model podpira okno konteksta s 128 000 žetoni in izvirno klicanje orodij. Model je namenjen razvijalcem, ki gradijo AI agente in pomočnike za kodiranje. Uvedel je funkcijo "Interleaved Thinking", pri kateri model razmišlja pred vsakim odgovorom in klicem orodja, kar so kasnejše izdaje GLM (GLM-4.6 in GLM-4.7) razširile z značilnostmi, kot sta Preserved Thinking in Turn-level Thinking. GLM-4.5 poudarja agentno kodiranje, integracijo z glavnimi agentnimi okviri in orodji za kodiranje, kot so Claude Code, Cline, Roo Code in Kilo Code. GitHub repozitorij gosti vire modela, kodo za inferenco in primere, medtem ko so uteži odprto objavljene za samostojno gostovanje, API pa je na voljo prek Z.ai API Platform. Repozitorij zdaj tudi dokumentira naslednike modelov GLM-4.6 (razširja kontekst na 200 000 žetonov) in GLM-4.7, poleg lahke različice 30B-A3B (GLM-4.7-Flash) za učinkovitejšo implementacijo. Kot izdelek z odprto težnostno strukturo GLM‑4.5 tekmuje z drugimi odprtimi modeli, namenjenimi agentalnim in programskim primerom uporabe. Njegove prednosti so uporaba orodij, nadzor razmišljanja in odprtost, čeprav zagon velikega MoE modela lokalno zahteva obsežno strojno opremo, novejše različice GLM pa so ga od takrat prehitele na benchmarkih.
Razdelitev kriterijev
- Arhitektura mešanice strokovnjakov (MoE)
- Hibridno razmišljanje z načini razmišljanja/nerazmišljanja
- Izvorno klicanje orodij za agente
- Prepleteno razmišljanje pred odzivi in klici orodij
- Okno konteksta 128 K
- Optimizacija kodiranja za agente


Jina AI nudi komplet osnovnih modelov in API-jev, ki so zgrajeni okoli iskanja, pridobivanja in multimodalnega razumevanja. Njene osrednje ponudbe vključujejo tekstovne in slikovne embeddings, neuralne rerankers, zero-shot klasifikatorje ter orodja za gradnjo RAG tokov na velikih razsežnostih. Platforma je zasnovana za razvijalce in ekipe, ki gradijo iskalnike, sisteme priporočil in AI pomočnike, ki morajo razmišljati prek besedil, slik in strukturiranih podatkov. Modeli so dostopni prek gostovanih API-jev in odprtokodnih izdaj, z večjezično podporo in zmogljivostjo dolgotrajnega konteksta za obdelavo velikih dokumentov. Jina AI se integrira z običajnimi vektorji bazami in LLM okviri, kar ga naredi praktično gradbeni element za sistem za semantično iskanje in pridobivanje znanja, primeren za proizvodno okolje.
Razdelitev kriterijev
- Modeli za embedinge besedila in slike
- Neuronalni reranker API-ji
- Zero-shot klasifikacija
- Podpora za dokumente z dolgim kontekstom
- Večjezična iskanja
- Integracije RAG in vektorske baze podatkov


