Iepriekšējā cīņa · 2025-03-05 UTC
AI Model Serving Platforms Sadursme — 2025. gada 5. marts
No AI Model Serving Platforms kategorijas. 13 atzīmes izvietotas starp 3 cīnītājiem. New API izcīnīja kroni.
Gala rezultāti
Sastāvs
Cīnītāji
Katra rīka profili, kas piedalījās šajā cīņā, sarindoti pēc to gala rezultāta.

New API
Atvērtā pirmkoda LLM vārteja, kas apvieno vairākus AI pakalpojumu sniedzēju API ar maršrutēšanu, rēķināšanu un analīzi

New API ir atvērtā pirmkoda LLM vārteja, kas nodrošina vienotu saskarni savienojumam ar vairākiem AI modeļu pakalpojumu sniedzējiem, ieskaitot OpenAI, Anthropic Claude un Google Gemini stila API. Tā darbojas kā centrālā pārvaldības slānis, kas ļauj komandām maršrutēt pieprasījumus pāri pakalpojumu sniedzējiem, kontrolēt piekļuvi un izsekot lietojumu no vienotas vietas. Šis projekts ir vērsts uz izstrādātājiem, platformu komandām un organizācijām, kas patērē AI API lielā mērogā un vēlas vienotu vārteju, nevis integrēt katru pakalpojumu sniedzēju atsevišķi. Izvietojot OpenAI saderīgas gala punktu adreses, tā ļauj esošajām lietojumprogrammām un SDK strādāt ar daudziem aizmugursistēmām bez klienta koda pārrakstīšanas. Papildus pamat funkcijai kā starpniekam, New API koncentrējas uz operacionālām problēmām, piemēram, uz tokenu balstītām kvotām, rēķināšanu un kredītu pārvaldību, pieprasījumu revīziju un lietojuma analīzi. Šīs funkcijas padara to piemērotu iekšējo AI platformu veidošanai vai piekļuves pārdalei un mērīšanai vairākiem lietotājiem vai komandām. Kā atvērtā pirmkoda, paš-hostējama rīku, tā dod operatoriem kontroli pār izvietošanu un datu plūsmu, kas var būt svarīga izmaksu pārvaldībai un atbilstībai. Tā pozicionē sevi tajā pašā telpā kā citas API vārtejas un agregatori, piemēram, LiteLLM un One API, no kuriem tā iegūst. Tāpat kā lielākā daļa paš-hostēto vārteju, New API pieņemšana prasa infrastruktūras iestatīšanu un pastāvīgu apkopšanu, un pakalpojumu sniedzēju atbalsta plašums un stabilitāte ir atkarīgi no kopienas ieguldījumiem.
Kritēriju sadalījums
- Vienota daudzpakalpojumu API vārteja
- OpenAI saderīgas gala punktu adreses
- Pieprasījumu maršrutēšana pāri modeļu pakalpojumu sniedzējiem
- Tokenu kvotas un rēķināšanas pārvaldība
- Lietojuma analīze un revīzija

GLM‑4.5
Atvērtas koda hibridiskās pārdomas MoE pamatmodelis, izstrādāts agentu, kodēšanas un rīku lietošanas uzdevumiem

GLM-4.5 ir atvērtā koda lielais valodas modelis, ko ir izstrādājusi Zhipu AI (Z.ai) kā daļu no GLM modeļu saimes. Tam ir Mixture-of-Experts (MoE) arhitektūra un hibridiskās domāšanas konstrukcija, kas ļauj modelim domāt, pirms atbildēs, vai atbildēt tieši, paredzēts darbam ar aģentūras darbplūsmām, kodu rakstīšanu un instrumentu izmantošanu. Modelis atbalsta 128K-tokena konteksta logu un natīvo instrumentu izsaukšanu. Modelis ir paredzēts izstrādātājiem, kas veido AI aģentus un kodēšanas asistentus. Tajā ir ieviests „Interleaved Thinking”, kur modelis doma pirms katras atbildes un rīka izsaukuma, kuru vēlāk GLM versijās (GLM-4.6 un GLM-4.7) paplašināja ar funkcijām kā Preserved Thinking un Turn-level Thinking. GLM-4.5 izceļ aģentu kodēšanu, integrējoties ar populistiskiem aģentu frameworkiem un kodēšanas rīkiem, tādiem kā Claude Code, Cline, Roo Code un Kilo Code. GitHub repozitorijā atrodas modeļu resursi, inferencijas kods un piemēri, kamēr svariem ir atvērti, lai pašiem uzstādītu, un API tiek nodrošināts caur Z.ai API Platform. Šobrīd repozitorijā ir dokumentēti arī modeļu pēcteči GLM-4.6 (paplašina kontekstu līdz 200K tokeniem) un GLM-4.7, kā arī vieglā 30B-A3B variānta (GLM-4.7-Flash) efektivākai izvietošanai. Kā atvērtās svaras izlaidums, GLM-4.5 konkurē ar citiem atvērtiem modeļiem, kas domāti agentejošām un kodēšanas gadījumiem. Tā spējas slēpās rīku lietošanā, argumentācijas kontroles un atvērtībā, tomēr lokāli liela MoE modeļa darbināšanai ir vajadzīga ievērojama aparatūra, un jaunākās GLM versijas ir to pārsniegušas testos.
Kritēriju sadalījums
- Mixture-of-Experts (MoE) arhitektūra
- Hibridiskās pārdomas ar domāšanas/nesekas režīmiem
- Vietējā rīku izsaukšana agentiem
- Sapludināta domāšana pirms atbildes un rīku izsaukumiem
- 128K konteksta logs
- Agentu kodēšanas optimizācija


Jina AI sniedz vienu no pamatmodeliem un aplikācijām ar API pieejamam, kas ir koncentrētas uz meklēšanos, atvieglošanu un multifāzīgu saprātu. Tā svarīgie piedāvājumi ietver teksta un attēlu izvēles, neuronu atkārtotus, bezšūdu klasifikatori un instrumentus, lai veiksmīgi būtu izveidotu atjaunotāmņojošā ģenerācijas (RAG) procesu skaala. Platforma ir izveidota programmatūras izstrādātājiem un komandām, kas būvē meklēšanas motorus, ieteicēju iestatījumus un algoritmus palīdzības, kuru ir nepieciešama apstrādāt tekstu, attēlus un struktūrstu datu. Modeli ir pieejami caur piedāvāto API un atvērto koda izlaižamību, ar daudzuvalodu atbalstu un ilgās konteksta iespējamību lielu dokumentu apstrādei. Jina AI integrētiene ir kopumā izmantotajos vektoru bāzēs un LLM iekārtām, kas padara to par daudzpraktisku pamatviestuli, ar kādu izveidot var produktīvus semantiskos meklēšanas un zinību iegūšanas sistēmas.
Kritēriju sadalījums
- Teksta un attēlu iegudrojumu modeļi
- Neirona pārtraukšanas API
- Zero-shot klasifikācija
- Garā kontekstu dokumentu atbalsts
- Vielvalodu meklēšana
- RAG un vektoru datubāzu integrācijas


