Минала битка · 2025-08-08 UTC
LLM Двубой — 8 август 2025 г.
От категория LLM. 28 гласове поставени сред 6 бойци. DeepSeek V3 грабна короната.
Финално класиране
Съставът
Бойците
Профили на всеки инструмент, който се състезава в тази битка, класирани по техния финален резултат.

DeepSeek V3
Отворено-соурсова смесена експертна модель, предлагаща GPT-4o-ни ниво на анализи при една десета от стойността.

"DeepSeek V3 e голяма шкала комбинация-на-специалисти (MoE) езикови модел, развита от DeepSeek AI. Активира само подмножество от общо-бройните му параметри на token, като така му позволя да осигури силна ефективност в изчислителните задачи, математиката и програмиранията, докато съхранява разходите за инференция значително по-високите от съвместими гъсто-напълнени модели." Излезна с отворени тежести, DeepSeek V3 става популярна избор за разработчици и изследователи, които се нуждаят от мощна базов модел за самодържане, настройване или свързване чрез API. Бenchmark-ите поставят в състезание на високо ниво против водещите комерциални модели като GPT-4о, особено при оценки за математически и логически анализ. Моделът е добре пригоден за технически асистенти, потоци за генериране на код, обичаи на изследователската работа, както и всеки апликација, в която важат качеството на доказите и ефективността на бюджетът.
Разбивка на критериите
- Смесена експертна архитектура
- Съперение аналитични и математически бенчмъркса
- Отворените важности на модела за скачване по желание
- Достъп чрез API на платформата DeepSeek
- Поддръжка на широк контекст
- Колеблив за отточване

Janus pro
Глубокият модел DeepSeek за множествена модалност за генерация и визуално разбиране на изображения в една обединена архитектура.

Janus Pro е отворен източник полимодален AI модел от DeepSeek, който е достъпен в версии с 1M и 7M параметри. Той обединява визуалното разбиране и генерацията на изображения в една-framework, отделяйки визуалните пътя за кодиране, което позволява на модела да интерпретира изображения и да създава образи из текстови промпти. Вариант 7Б доставя състезателни резултати в бенчмарките за синтез на текст на изображение и визуален запитване за отговор, понякога дори надхвърляйки по-големи специализирани модели. Релизван под лиценза MIT, Janus Pro може да бъде самохостен, доработван и интегриран в изследователски или производствени потоци без ограничения за използване. Тази технология е подходяща за разработчици, изследователи и любители, които имат нужда от.flexibilна многомодална основна модел за експериментиране, прототипиране или създаване на приложения, които включват създаване на изображения и разбиране на изображения.
Разбивка на критериите
- Генерация на изображение с текст
- Отговори на визуални въпроси и анализ на изображения
- Обединена архитектура transformer
- Поддръжка на параметри 1B и 7B
- Отворени тежести с лиценз MIT
- Поддръжка на многомодални входи и излизания

DeepSeek R1
Отворен-кодова голема модел за език, обещаваща много добри резултати в задачи за мислене, математика и програмиране с лиценза MIT за свободен използване и модификация.

DeepSeek R1 е отворен-коден голям модел на езика, който извършва съмнителни, математически и програмиращи задачи извършва съмнителни, математически и програмиращи задачи с висок съоръжение. Използва Мрежа на експерти (MoE) архитектура с 37 милиарда активни параметри и 671 милиард параметри възитки, поддържащ 128K контекстна дължина. Моделът включва напреднали техники на учене на подкрепа за постигане на самозагрижен верифициране, многошаговото отражение и хармонизирана с обществено мнение рационалност на способности. DeepSeek R1 е постигнал бившата точка на сърцето изпълнителни изследвания и различни бенчмаркни тестове, включващи 97,3% точност на МATH-500, 79,8% изпълнителен резултат на АИМЕ 2024 и извикване на 96,3% на участници в Codeforces. Моделът е достъпен в множество варианти, варирани от 1,5 милиарда до 70 милиарда параметри, и е лицензиран под MIT за безплатно използване и модифициране. DeepSeek R1 може да бъде използван онлайн, безплатно, и версията с поддръжка на WebGPU-ускорител заради извършването може да се изпълни локално в браузъра. Моделът е проектиран за сложно решаване на проблеми, за понеждинско разбиране на многуезичните текстове и генериране на производствено качество код. Предимствата му включват изключителен математически рационализъм, генериране на код и умения за понеждинно разбиране на естествените езици. С други думи, като модел, който се разпространява под лиценза GNU, може да изисква техническа експертиза за деплоймента и линейно окачване за определени случаи на употреба. Действащият DeepSeek R1 се класифицира сред най-добрите AI модели в световен мащаб, със сравними способности със световно водещите проприетарни решения. Отвореният му характер позволява за общностно насърчаване на разработките и непрекъснати обновявания, включително планиратите полимодални функции, подобряване на конверсациите и оптимизация на разпределените инференции. Моделът има чисто развитие чрез учене с подкрепление, което му permetва да постига математическия перформенс на GPT-4 във значимо по-малък размер. Възможността за визуализиране на веригата за мисленето се отнася до изтощения на AI "чорът кутия" и посредством това дава възможност за прозрения из модела на процесуане за мислено мислене. Дъбийският DeepSeek R1 API предоставя отворен API-ендпойнт, съвместим с OpenAI, за інтеграция, на който се натоваря $0.14 за милион токени. Весове на модела са отворени за комерсиална употреба и модификация.
Разбивка на критериите
- Свръзка на експерди
- Усовемени техники за обучение посредством награда
- Аутовърификация и капацитета за многократно отразяване на мисълта
- Човешки усмихнат мислене
- Поддръжка на 128K дължина за контекст
- Адрес за API, съвместим с OpenAI

ASI:One
Сътворителен АИ асистент, координиращ автономни агенти за изпълнение на многустепенни задачи.

ASI:One е възпроизвеждан от гледна точка АИ асистент, изграден около концепцията за агентно интелект, при който конверзационна платформа dispatch-ва и координира специализирани самостоятелни агенти, за да справят с сложни заявки. Вместо да връща само текст, то може да организира, да извиква уреди и да изпълнява workflow нареждания на сметка на потребителя. Разработен в рамките на екосистемата на Алианса за Изкусна Суперинтелегентност, той се предлага като личен агент за изкуствена интелигенция, който се интегрира с децентрализирани системи за агенти. Използователите могат да си изкачат разговор с него от дневния хроник или да му заповядват да изпълни дълги задачи като изследвания, сравнения, програмиране, и търсене на данни през свързани служби.
Разбивка на критериите
- Чатова интерфейс за разговор
- Оркестриране на автономни агенти
- Планиране и изпълнение на многустепенни задачи
- Връзка с външни агенти и услуги
- Човешко-асистент стил на памет и контекст
- Изградено върху стек агента на АСИ Алианс

Latest DeepSeek R2
Настоящата-генерация разумни AI модел с фокус върху съжденията на DeepSeek

Новият DeepSeek R2 е наследник на въздействиителния модел за извеждане на заключения R1 на DeepSeek, проектиран да предоставя по-силен по-детайлен подход за решаване на задачи в математика, програмиране и аналитично програмиране. Цели да разшири подхода за отвореност в изследователската работа, който използването му още от предходните версии DeepSeek направи популярен между разработчици и изследователи. Моделът се фокусира върху подобряване на точността, по-дългия обработване на контекста и по-ефикасно инференциране в сравнение с предишния му прототип, което го прави подходящ за технически асистенти, агентни потоци и интеграция в.custom приложения. Достъпността и точно спецификацията зависят от официалните канали на изданието на DeepSeek. Потребителите обикновено имат достъп до моделa чрез API, чат интерфейс или чрез провеждане на отворени тежести, когато са предоставени, което осигурява пружинност както за самостоятелна експериментация, така и за експлоатация във производствен обхват.
Разбивка на критериите
- Sъвременен цепково-мислен reasoning
- Раширено контекстно прозорче
- Поддръжка за генериране и отбелязване на код
- Многоезично разбиране
- Достъп чрез API и чат
- Употреба в агентни приложения
Pronoia
Арабски-направен големи модел за език със силно пренасочване за натива качество на разбиране и генерация.
Пърониа е големият езиков модел, специално поддържан за арабски език с цел да предоставя по-голяма точност при разбиране, генериране и аргументиране в езика спрямо обикновените многезициени модели. Намира се като водещ модел с фокус върху арабския език, с оптимизации за диалекти, класически форми и модерен стандартен арабски. Моделът може да се използва в задачи като създаване на съдържание, съкращаване, превод, поддръжка на клиенти и конверсационен АИ в арабскоезични пазари. Като се концентрира за тренировка в арабска данни, Pronoia цели нюансите като морфология, диакритика и културен контекст, които по-широките модели често справят с тях неуравновесено.
Разбивка на критериите
- Арабски оптимизиран езиков модел
- Текстова генерация и сумаризация
- Поддръжка на превод
- Конверсациялни и айби чатботови възможности
- Подходящ за бизнес използване на висококачествени Арабски НЛП системи
- Покрива МСА и диалекти




