Минала битка · 2025-08-08 UTC

LLM Двубой — 8 август 2025 г.

От категория LLM. 28 гласове поставени сред 6 бойци. DeepSeek V3 грабна короната.

Финално класиране

Съставът

Бойците

Профили на всеки инструмент, който се състезава в тази битка, класирани по техния финален резултат.

1DeepSeek V3 logo

DeepSeek V3

Отворено-соурсова смесена експертна модель, предлагаща GPT-4o-ни ниво на анализи при една десета от стойността.

4.8 (6)
Безплатно
Снимка на DeepSeek V3

"DeepSeek V3 e голяма шкала комбинация-на-специалисти (MoE) езикови модел, развита от DeepSeek AI. Активира само подмножество от общо-бройните му параметри на token, като така му позволя да осигури силна ефективност в изчислителните задачи, математиката и програмиранията, докато съхранява разходите за инференция значително по-високите от съвместими гъсто-напълнени модели." Излезна с отворени тежести, DeepSeek V3 става популярна избор за разработчици и изследователи, които се нуждаят от мощна базов модел за самодържане, настройване или свързване чрез API. Бenchmark-ите поставят в състезание на високо ниво против водещите комерциални модели като GPT-4о, особено при оценки за математически и логически анализ. Моделът е добре пригоден за технически асистенти, потоци за генериране на код, обичаи на изследователската работа, както и всеки апликација, в която важат качеството на доказите и ефективността на бюджетът.

Разбивка на критериите

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Смесена експертна архитектура
  • Съперение аналитични и математически бенчмъркса
  • Отворените важности на модела за скачване по желание
  • Достъп чрез API на платформата DeepSeek
  • Поддръжка на широк контекст
  • Колеблив за отточване
2Janus pro logo

Janus pro

Глубокият модел DeepSeek за множествена модалност за генерация и визуално разбиране на изображения в една обединена архитектура.

4.8 (4)
Безплатно
Снимка на Janus pro

Janus Pro е отворен източник полимодален AI модел от DeepSeek, който е достъпен в версии с 1M и 7M параметри. Той обединява визуалното разбиране и генерацията на изображения в една-framework, отделяйки визуалните пътя за кодиране, което позволява на модела да интерпретира изображения и да създава образи из текстови промпти. Вариант 7Б доставя състезателни резултати в бенчмарките за синтез на текст на изображение и визуален запитване за отговор, понякога дори надхвърляйки по-големи специализирани модели. Релизван под лиценза MIT, Janus Pro може да бъде самохостен, доработван и интегриран в изследователски или производствени потоци без ограничения за използване. Тази технология е подходяща за разработчици, изследователи и любители, които имат нужда от.flexibilна многомодална основна модел за експериментиране, прототипиране или създаване на приложения, които включват създаване на изображения и разбиране на изображения.

Разбивка на критериите

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Генерация на изображение с текст
  • Отговори на визуални въпроси и анализ на изображения
  • Обединена архитектура transformer
  • Поддръжка на параметри 1B и 7B
  • Отворени тежести с лиценз MIT
  • Поддръжка на многомодални входи и излизания
3DeepSeek R1 logo

DeepSeek R1

Отворен-кодова голема модел за език, обещаваща много добри резултати в задачи за мислене, математика и програмиране с лиценза MIT за свободен използване и модификация.

4.8 (4)
Безплатно
Снимка на DeepSeek R1

DeepSeek R1 е отворен-коден голям модел на езика, който извършва съмнителни, математически и програмиращи задачи извършва съмнителни, математически и програмиращи задачи с висок съоръжение. Използва Мрежа на експерти (MoE) архитектура с 37 милиарда активни параметри и 671 милиард параметри възитки, поддържащ 128K контекстна дължина. Моделът включва напреднали техники на учене на подкрепа за постигане на самозагрижен верифициране, многошаговото отражение и хармонизирана с обществено мнение рационалност на способности. DeepSeek R1 е постигнал бившата точка на сърцето изпълнителни изследвания и различни бенчмаркни тестове, включващи 97,3% точност на МATH-500, 79,8% изпълнителен резултат на АИМЕ 2024 и извикване на 96,3% на участници в Codeforces. Моделът е достъпен в множество варианти, варирани от 1,5 милиарда до 70 милиарда параметри, и е лицензиран под MIT за безплатно използване и модифициране. DeepSeek R1 може да бъде използван онлайн, безплатно, и версията с поддръжка на WebGPU-ускорител заради извършването може да се изпълни локално в браузъра. Моделът е проектиран за сложно решаване на проблеми, за понеждинско разбиране на многуезичните текстове и генериране на производствено качество код. Предимствата му включват изключителен математически рационализъм, генериране на код и умения за понеждинно разбиране на естествените езици. С други думи, като модел, който се разпространява под лиценза GNU, може да изисква техническа експертиза за деплоймента и линейно окачване за определени случаи на употреба. Действащият DeepSeek R1 се класифицира сред най-добрите AI модели в световен мащаб, със сравними способности със световно водещите проприетарни решения. Отвореният му характер позволява за общностно насърчаване на разработките и непрекъснати обновявания, включително планиратите полимодални функции, подобряване на конверсациите и оптимизация на разпределените инференции. Моделът има чисто развитие чрез учене с подкрепление, което му permetва да постига математическия перформенс на GPT-4 във значимо по-малък размер. Възможността за визуализиране на веригата за мисленето се отнася до изтощения на AI "чорът кутия" и посредством това дава възможност за прозрения из модела на процесуане за мислено мислене. Дъбийският DeepSeek R1 API предоставя отворен API-ендпойнт, съвместим с OpenAI, за інтеграция, на който се натоваря $0.14 за милион токени. Весове на модела са отворени за комерсиална употреба и модификация.

Разбивка на критериите

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • Свръзка на експерди
  • Усовемени техники за обучение посредством награда
  • Аутовърификация и капацитета за многократно отразяване на мисълта
  • Човешки усмихнат мислене
  • Поддръжка на 128K дължина за контекст
  • Адрес за API, съвместим с OpenAI
4ASI:One logo

ASI:One

Сътворителен АИ асистент, координиращ автономни агенти за изпълнение на многустепенни задачи.

4.5 (4)
Безплатно
Снимка на ASI:One

ASI:One е възпроизвеждан от гледна точка АИ асистент, изграден около концепцията за агентно интелект, при който конверзационна платформа dispatch-ва и координира специализирани самостоятелни агенти, за да справят с сложни заявки. Вместо да връща само текст, то може да организира, да извиква уреди и да изпълнява workflow нареждания на сметка на потребителя. Разработен в рамките на екосистемата на Алианса за Изкусна Суперинтелегентност, той се предлага като личен агент за изкуствена интелигенция, който се интегрира с децентрализирани системи за агенти. Използователите могат да си изкачат разговор с него от дневния хроник или да му заповядват да изпълни дълги задачи като изследвания, сравнения, програмиране, и търсене на данни през свързани служби.

Разбивка на критериите

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • Чатова интерфейс за разговор
  • Оркестриране на автономни агенти
  • Планиране и изпълнение на многустепенни задачи
  • Връзка с външни агенти и услуги
  • Човешко-асистент стил на памет и контекст
  • Изградено върху стек агента на АСИ Алианс
5Latest DeepSeek R2 logo

Latest DeepSeek R2

Настоящата-генерация разумни AI модел с фокус върху съжденията на DeepSeek

4.8 (6)
Безплатно
Снимка на Latest DeepSeek R2

Новият DeepSeek R2 е наследник на въздействиителния модел за извеждане на заключения R1 на DeepSeek, проектиран да предоставя по-силен по-детайлен подход за решаване на задачи в математика, програмиране и аналитично програмиране. Цели да разшири подхода за отвореност в изследователската работа, който използването му още от предходните версии DeepSeek направи популярен между разработчици и изследователи. Моделът се фокусира върху подобряване на точността, по-дългия обработване на контекста и по-ефикасно инференциране в сравнение с предишния му прототип, което го прави подходящ за технически асистенти, агентни потоци и интеграция в.custom приложения. Достъпността и точно спецификацията зависят от официалните канали на изданието на DeepSeek. Потребителите обикновено имат достъп до моделa чрез API, чат интерфейс или чрез провеждане на отворени тежести, когато са предоставени, което осигурява пружинност както за самостоятелна експериментация, така и за експлоатация във производствен обхват.

Разбивка на критериите

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • Sъвременен цепково-мислен reasoning
  • Раширено контекстно прозорче
  • Поддръжка за генериране и отбелязване на код
  • Многоезично разбиране
  • Достъп чрез API и чат
  • Употреба в агентни приложения
6Pronoia logo

Pronoia

Арабски-направен големи модел за език със силно пренасочване за натива качество на разбиране и генерация.

4.7 (6)
Безплатно

Пърониа е големият езиков модел, специално поддържан за арабски език с цел да предоставя по-голяма точност при разбиране, генериране и аргументиране в езика спрямо обикновените многезициени модели. Намира се като водещ модел с фокус върху арабския език, с оптимизации за диалекти, класически форми и модерен стандартен арабски. Моделът може да се използва в задачи като създаване на съдържание, съкращаване, превод, поддръжка на клиенти и конверсационен АИ в арабскоезични пазари. Като се концентрира за тренировка в арабска данни, Pronoia цели нюансите като морфология, диакритика и културен контекст, които по-широките модели често справят с тях неуравновесено.

Разбивка на критериите

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • Арабски оптимизиран езиков модел
  • Текстова генерация и сумаризация
  • Поддръжка на превод
  • Конверсациялни и айби чатботови възможности
  • Подходящ за бизнес използване на висококачествени Арабски НЛП системи
  • Покрива МСА и диалекти