Минала битка · 2025-03-05 UTC
AI Model Serving Platforms Двубой — 5 март 2025 г.
От категория AI Model Serving Platforms. 13 гласове поставени сред 3 бойци. New API грабна короната.
Финално класиране
Съставът
Бойците
Профили на всеки инструмент, който се състезава в тази битка, класирани по техния финален резултат.

New API
Отворен изворен връзки към моделите на LLM, който обединява повече от един провайдър с API и маршрутизатор, както и система за счетовете и анализи.

Нови API са отворен коден ЛМЛ (Large Language Model) gateway, който предлага унифициран интерфейс за свързване със множество предоставячи на AI модели, включително OpenAI, Anthropic Claude, и Google Gemini-style API-та. Той функционира come централен управляващ слой, който позволява на тимовете да рутват изискванията със съответните предоставячи, да контролират достъпа и да следят употребата от едно място. Проектът е насочен към програмисти, тимове по платформа и организиране, които изкарват AI-API-та на големи размери и искат единен вход в мрежата, а не да интегрират отделно всеки услуга. Като излага OpenAI-компатибилни точки за връзка, то позволява съществуващи приложения и SDK-ове да работят с много backends без преискачване на клещи на клиентското кода. Новият API създава за себе си основен етап в рамките на операционните задължения като токен-based квоти, счетове и управление на кредити, аудитиране на заявките и аналитика на използване. Тези функции го прави подходящ за изграждане на вътрешни платформи за AI или продаване/мециране достъп до множество потребители или екипи. Като отворено уреден продукт за самодопълнение, това уреди дава на операторите контрол над разпространението и протичащия от съответния поток данни, което може да е важно за управлението на разходите и спазването на нормативните изисквания. То се използва съответно на същото място, както другите врати на API, агрегатори като LiteLLM и One API, от които то се разработва. Като при повечето самозадържани системи за въвеждане, въвеждането на Нова API изисква конfigurация на инфраструктурата и обща поддържане, а разнообразието на поддръжка на доставчиците и стабилността се дължи на обществените приноси.
Разбивка на критериите
- Обединен връзки с повече от един провайдър API
- Compatibилни точки за OpenAI
- Маршрутизиране на заявките между провайдърите на модели
- Регулация и управление на токените и счетовете
- Анализ на използването и аудит

GLM‑4.5
Отвореният софтуерен хибриден-рационален модел MoE поосновен за агентни, програмниране и използване на инструменти

GLM-4.5 е отворено-източна голяма лингвистична модел, развит от Zhipu AI (Z.ai), като част от семейството модели GLM. Използва архитектура Mixture-of-Experts (MoE) и хибриден дизайн за логическо мислене, позволявайки на модела или да "мисли" преди да отговори, или да отговори директно, насочвайки се към агентният поток на работа, програмиране и използване на уреди. Моделът поддържа векторен контекст от 128K-тики и вграден достъп до програми. Моделът е предназначен för програмиращи разработчици на АИ агенти и програми за помощ при кодиране. Той е introдусирал „Мисленето на върви“, където моделът си прави избори пред всеки отговор и възбуждащ телефонен чак с възможностите му, което в по-късните рилези на GLM (GLM-4.6 и GLM-4.7) се е разширило с функции като „Зачувано мислене“ и „Уровнево мислене“. GLM-4.5 отдава приоритет на агенция при програмиране, интегрирайки със семейните програмиращи рамки и програми за програмиране като Claude Code, Cline, Roo Code и Kilo Code, чрез API и SDK. Репозиториите на GitHub съдържат ресурси за модела, код за инференция и примери, докато взиманията се съдържат отворено за самозадържане и еднствено API се предлагат през платформата на Z.ai API. Репозиторите сега също така документират наследниците на модели GLM-4.6 (поддържащо контекст до 200K токена) и GLM-4.7, вдлъж с лека версия на 30B-A3B (GLM-4.7-Flash) за по-ефективно разпълнение. GLM-4.5 е разпространен под лека.weight лиценз, като съперничи с другите отворени модели, насочени към агентни и програмиращи използвания. Силите му са в използването на инструменти, контрола за логическа аргументация и отвореност, но изпращането на големи модели с MoE локално изисква значителен hardware, а новите версии GLM са превъзхождат го във всички бенчмаркове.
Разбивка на критериите
- Модел Мixture-of-Experts (MoE)
- Хибридно мислене с мислена/немислена мода
- Нativa възлаковане на инструменти за агенти
- Смешено мислене преди отговора и възлакуване на инструменти
- 128K контекстна околина
- Optimiziranе за програмиране с агенти

Jina AI
Основаване на поширата на многомодален търсене за вмърдяване, реранкиране и архитектури за извличане от контекст

Jina AI подписва пакет от основни модели и апи, заритите около търсене, извличане и мултимодална разбиране. Основните му услуги включват текстови и зрялите във вяра embeddings, неурни рангери, zero-shot класификатори, и инструменти за създаване на извеждащи генерации на workflow по мащаб. Платформата е проектирана за разработчици и екипи, строещи търсачки системи, системи за препоръчвания и асистенти за AI, които needed да се съобразяват по текстове, изображения и структурирани данни. Моделите са достъпни чрез hosted API-и и open-source релизи, с поддръжка на множествени езици и long-context възможности за обслужване на големи документи. Jina AI интегрира с общи векторни бази данни и фреймворки за LLM, което я превръща в практичен компонент за производствени системи за семантична търсачка и достъп до знания.
Разбивка на критериите
- Моделите за вмърдяване на текст и изображения
- API-стекът за реранкиране на нейронните модели
- Zero-shot класификация
- Поддръжка за документи с дълъг контекст
- Търсене в многоезичия
- Вградени интеграции с RAG и векторни бази данни


