#Multimodal AI
19 tools tagged “Multimodal AI”

Plataforma de IA tudo-em-um com 20+ modelos para criação de vídeo, imagem e voz

Gerador de vídeo multimodal de IA produzindo clipes de 1080p a partir de texto, imagens e entradas de referência.

Modelos de base multimodal que entendem texto, imagens, vídeo e áudio.

Um agente diagnóstico multimodal de IA que conduz conversas clínicas e interpreta imagens médicas para diagnósticos precisos.

Gerador de vídeo multimodal com IA que transforma texto, imagens ou áudio em vídeos curtos.

Assistente de compras de IA multimodal para lojas Shopify usando texto, voz e imagem.

Uma estrutura de código aberto que automatiza fluxos de trabalho de desktop usando grandes modelos multimodais.

IA multimodal para gerar, editar e renderizar vídeo pronto para produção

API unificada para IA multimodal em chat, imagem e vídeo

Plataforma de IA multimodal para texto-para-vídeo, imagem-para-vídeo, texto-para-imagem e criação de dublagem.

Plataforma de IA multimodal para gerar vídeos, imagens e áudio a partir de prompts de texto ou mídia.

Plataforma multimodal de IA para gerar vídeo consistente e controlável a partir de texto, imagens e referências.

Robô humanoide compacto com 26 juntas e IA multimodal para pesquisa e educação

Gerador de vídeo de dança multimodal de IA que transforma texto, imagens, áudio e clipes em vídeos de dança.

Modelo de IA multimodal do Google criado para tarefas agenciais, raciocínio e uso nativo de ferramentas.

Agente de IA de código aberto que opera seu computador por meio de visão de tela e controle de mouse/teclado.

Família de modelos de IA multimodal do Google com compreensão de contexto longo e arquitetura MoE.

Assistente de IA tudo-em-um para criar imagens, vídeos, narrações e músicas

Gerador de vídeo multimodal de IA que transforma texto, imagens e áudio em clipes curtos cinematográficos.