Batalha anterior · 2025-08-08 UTC
LLM Duelo — 8 de agosto de 2025
Da categoria LLM. 28 marcas colocadas em 6 combatentes. DeepSeek V3 conquistou a coroa.
Classificação final
A formação
Os combatentes
Perfis de cada ferramenta que competiu nesta batalha, ordenados pela pontuação final.

DeepSeek V3
Modelo de mistura de especialistas de código aberto que oferece raciocínio de nível GPT-4o a uma fração do custo.

DeepSeek V3 é um modelo de linguagem de grande escala do tipo mixture-of-experts (MoE) desenvolvido pela DeepSeek AI. Ele ativa apenas um subconjunto dos seus parâmetros totais por token, permitindo oferecer um desempenho robusto em tarefas de raciocínio, matemática e codificação, ao mesmo tempo em que mantém os custos de inferência significativamente mais baixos que modelos densos comparáveis. Lançado com pesos abertos, o DeepSeek V3 se tornou uma escolha popular entre desenvolvedores e pesquisadores que precisam de um modelo de base capaz que podem auto‑hospedar, ajustar finamente ou integrar via API. Benchmarks o posicionam de forma competitiva em relação aos principais modelos proprietários, como o GPT-4o, especialmente nas avaliações de matemática e raciocínio lógico. O modelo é bem adequado para assistentes técnicos, pipelines de geração de código, fluxos de trabalho de pesquisa e qualquer aplicação onde a qualidade do raciocínio e a eficiência de custos sejam importantes.
Divisão de critérios
- Arquitetura de mistura de especialistas
- Benchmarks de raciocínio e matemática competitivos
- Pesos do modelo de código aberto
- Acesso à API via plataforma DeepSeek
- Suporte a janelas de contexto longas
- Amigável para ajuste fino

Janus pro
Modelo multimodal aberto da DeepSeek para geração de imagens e compreensão visual em uma arquitetura unificada.

Janus Pro é um modelo de IA multimodal de código aberto da DeepSeek, disponível nas versões de 1 B e 7 B parâmetros. Ele unifica a compreensão visual e a geração de imagens em um único framework ao desacoplar as vias de codificação visual, permitindo que o modelo tanto interprete imagens quanto as crie a partir de prompts de texto. A variante de 7B entrega resultados competitivos em benchmarks para text-to-image synthesis e visual question answering, frequentemente igualando ou superando modelos especializados maiores. Lançado sob a licença MIT, Janus Pro pode ser self-hosted, fine-tuned e integrado em pipelines de research ou production sem restrições de usage. Ele atende desenvolvedores, pesquisadores e entusiastas que precisam de um modelo foundation multimodal flexível para experimentação, prototipagem ou desenvolvimento de aplicações que combinam criação de imagens com compreensão de imagens.
Divisão de critérios
- Geração de imagens a partir de texto
- Resposta a perguntas visuais e análise de imagens
- Arquitetura de transformador unificada
- Opções de 1B e 7B parâmetros
- Pesos abertos licenciados pelo MIT
- Suporte a entrada e saída multimodal

DeepSeek R1
Um modelo de linguagem grande de código aberto que se destaca em tarefas de raciocínio, matemática e codificação com licença MIT para uso e modificação gratuitos.

DeepSeek R1 é um modelo de linguagem de grande porte de código aberto que se destaca em tarefas de raciocínio, matemática e programação. Ele utiliza uma arquitetura Mixture of Experts (MoE) com 37 bilhões de parâmetros ativos e 671 bilhões de parâmetros totais, suportando comprimento de contexto de 128 k. O modelo incorpora técnicas avançadas de reinforcement learning para alcançar auto‑verificação, reflexão em múltiplas etapas e capacidades de raciocínio alinhado ao humano. DeepSeek R1 atingiu desempenho de ponta em diversos benchmarks, incluindo 97,3 % de acurácia no MATH‑500, taxa de aprovação de 79,8 % no AIME 2024 e superando 96,3 % dos participantes do Codeforces. O modelo está disponível em várias variantes, que vão de 1,5 B a 70 B de parâmetros, e é licenciado sob MIT para uso e modificação gratuitos. DeepSeek R1 pode ser usado online gratuitamente, e uma versão acelerada por WebGPU pode ser executada localmente em um navegador. O modelo foi projetado para resolução de problemas complexos, compreensão multilíngue e geração de código em nível de produção. Seus pontos fortes incluem raciocínio matemático excepcional, geração de código e capacidades de entendimento de linguagem natural. No entanto, por ser um modelo de código aberto, pode ser necessário conhecimento técnico para implantá‑lo e ajustá‑lo para casos de uso específicos. DeepSeek R1 está posicionada entre os modelos de IA de melhor desempenho globalmente, com capacidades comparáveis às das principais soluções proprietárias. Sua natureza open‑source permite o desenvolvimento impulsionado pela comunidade e atualizações contínuas, incluindo suporte multimodal planejado, aprimoramento conversacional e otimização de inferência distribuída. O modelo tem um desenvolvimento puro de reinforcement learning, o que lhe permite alcançar desempenho matemático ao nível do GPT-4 a um custo significativamente menor. A capacidade de visualização de chain-of-thought aborda os desafios da "black box" da IA, proporcionando insights sobre o processo de raciocínio do modelo. A API do DeepSeek R1 oferece um endpoint compatível com a OpenAI para integração, com preço de $0.14 por milhão de tokens. Os pesos do modelo são de código aberto, permitindo uso comercial e modificação.
Divisão de critérios
- Arquitetura Mixture of Experts (MoE)
- Técnicas avançadas de aprendizado por reforço
- Capacidades de auto-verificação e reflexão multi-etapa
- Raciocínio alinhado com humanos
- Suporte para comprimento de contexto de 128K
- Endpoint de API compatível com OpenAI

ASI:One
Assistente de IA agênica que coordena agentes autônomos para concluir tarefas em múltiplos passos.

ASI:One é um assistente de IA construído em torno da ideia de inteligência agênica, onde uma interface conversacional pode despachar e coordenar agentes autônomos especializados para lidar com solicitações complexas. Em vez de retornar apenas texto, ele pode planejar, chamar ferramentas e executar fluxos de trabalho em nome do usuário. Desenvolvido dentro do ecossistema da Artificial Superintelligence Alliance, ele é posicionado como um agente de IA pessoal que se integra com redes descentralizadas de agentes. Os usuários podem conversar com ele para questões do dia a dia ou delegar tarefas mais longas, como pesquisas, comparações, agendamento e consultas de dados em serviços conectados.
Divisão de critérios
- Interface de chat conversacional
- Orquestração de agentes autônomos
- Planejamento e execução de tarefas em múltiplas etapas
- Conectividade com agentes e serviços externos
- Memória e contexto no estilo assistente pessoal
- Construído sobre a stack de agentes da ASI Alliance


O Latest DeepSeek R2 é o sucessor do modelo de raciocínio R1 da DeepSeek, projetado para oferecer uma resolução de problemas passo a passo mais robusta em matemática, programação e tarefas analíticas. Ele pretende ampliar a abordagem de pesquisa aberta que tornou as versões anteriores da DeepSeek populares entre desenvolvedores e pesquisadores. O modelo busca melhorar a precisão, lidar com contextos mais longos e oferecer inferência mais eficiente em comparação ao seu antecessor, tornando‑se adequado para assistentes técnicos, fluxos de trabalho agentivos e integração em aplicações personalizadas. A disponibilidade e as especificações exatas dependem dos canais oficiais de lançamento da DeepSeek. Os usuários normalmente podem acessar o modelo via API, interface de chat ou executando os pesos abertos quando disponíveis, permitindo flexibilidade tanto para experimentação individual quanto para implantação em produção.
Divisão de critérios
- Raciocínio avançado em cadeia de pensamento
- Janela de contexto estendida
- Suporte à geração e depuração de código
- Compreensão multilíngue
- Acesso baseado em API e chat
- Adequado para aplicações agenciais
Pronoia
Modelo de linguagem grande de primeira linha em árabe, ajustado para compreensão e geração de qualidade nativa.
Pronoia é um grande modelo de linguagem específico treinado para o árabe, com o objetivo de fornecer uma compreensão, geração e razão mais precisas em relação a modelos multilíngues geral. É colocado como um dos principais modelos de linguagem LLM focados no árabe, com otimizações para dialetos, formas clássicas e árabe padrão moderno. O modelo pode ser utilizado em tarefas como criação de conteúdo, resumo, tradução, suporte ao cliente e inteligência artificial conversacional em mercados árabes falantes. Ao se concentrar no treinamento de dados em árabe, a Pronoia visa as nuances como a morfologia, os acentos e o contexto cultural que modelos mais amplos geram com frequência de forma inconsistente.
Divisão de critérios
- Modelo de linguagem otimizado para árabe
- Geração e sumarização de texto
- Suporte a tradução
- Capacidades conversacionais e de chatbot
- Adequado para NLP empresarial em árabe
- Cobertura de MSA e dialetos




