#Multimodal AI

19 tools tagged “Multimodal AI


GenMix interface preview
#1
GenMix

Wszechstronna platforma AI z ponad 20 modelami do tworzenia wideo, obrazów i dźwięku

4.7 (6)
Freemium
wan2-6.org interface preview
#2
wan2-6.org

Multimodalny generator wideo AI tworzący klipy 1080p z tekstu, obrazów i danych referencyjnych.

4.8 (4)
Free
Reka AI interface preview
#3
Reka AI

Wielomodalne modele bazowe, które rozumieją tekst, obrazy, wideo i dźwięk.

5.0 (5)
Freemium
AMIE interface preview
#4
AMIE

Wielomodalny agent AI diagnostyczny, który prowadzi konwersacje kliniczne i interpretuje obrazy medyczne w celu dokładnych diagnoz.

4.7 (6)
Free
chris li interface preview
#5
chris li

Wielomodalny generator wideo AI, który przekształca tekst, obrazy lub dźwięk w krótkie filmy.

4.5 (6)
Free
Zenor AI interface preview
#6
Zenor AI

Multimodalny asystent AI zakupowy dla sklepów Shopify, wykorzystujący tekst, głos i obraz.

4.8 (6)
Free
OpenAdapt interface preview
#7
OpenAdapt

Otwarte źródło frameworka automatyzującego przepływy pracy na pulpicie przy użyciu dużych modeli multimodalnych.

5.0 (5)
Freemium
Gemini Omni interface preview
#8
Gemini Omni

Multimodalna sztuczna inteligencja do generowania, edytowania i renderowania gotowych do produkcji wideo.

4.0 (4)
Free
evolink interface preview
#9
evolink

Jednolity interfejs API dla multimodalnej SI obejmującej modele czatu, obrazu i wideo.

4.8 (5)
Freemium
Seedance interface preview
#10
Seedance

Multimodalna platforma AI do tworzenia wideo z tekstu, obrazów do wideo, obrazów z tekstu i nagrań głosowych.

4.6 (5)
Free
HappyHorse-model interface preview
#11
HappyHorse-model

Platforma AI wielomodalna do generowania wideo, obrazów i dźwięku na podstawie tekstu lub mediów.

4.8 (6)
Free
Wan 2.7 AI Video Generator interface preview
#12
Wan 2.7 AI Video Generator

Multimodalna platforma AI do generowania spójnych, kontrolowalnych wideo z tekstu, obrazów i odniesień.

4.2 (6)
Free
Unitree R1 interface preview
#13
Unitree R1

Kompaktowy humanoidalny robot z 26 przegubami i multimodalną AI dla badań i edukacji

4.5 (4)
Paid
C Dance ai interface preview
#14
C Dance ai

Wielomodalny generator wideo AI, który zamienia tekst, obrazy, dźwięk i klipy w filmy taneczne.

4.5 (4)
Free
Google Gemini 2.0 interface preview
#15
Google Gemini 2.0

Multimodalny model AI Google, zaprojektowany do zadań agentowych, rozumowania i natywnego wykorzystania narzędzi.

4.8 (4)
Freemium
Self-Operating Computer interface preview
#16
Self-Operating Computer

Otwarto‑źródłowy agent AI, który steruje Twoim komputerem za pomocą wizji ekranu oraz kontrolą myszy i klawiatury.

4.7 (6)
Freemium
Gemini interface preview
#17
Gemini

Multimodalna rodzina modeli AI Google z rozumieniem długich kontekstów i architekturą MoE.

4.2 (5)
Freemium
AssiPilot interface preview
#18
AssiPilot

Wszechstronny asystent AI do tworzenia obrazów, wideo, voiceoverów i muzyki

4.6 (5)
Freemium
Seedance 2 AI Video Generator interface preview
#19
Seedance 2 AI Video Generator

Multimodalny generator wideo AI, który przekształca tekst, obrazy i dźwięk w krótkie, kinowe klipy.

4.5 (6)
Free