#Multimodal AI
19 tools tagged “Multimodal AI”

Wszechstronna platforma AI z ponad 20 modelami do tworzenia wideo, obrazów i dźwięku

Multimodalny generator wideo AI tworzący klipy 1080p z tekstu, obrazów i danych referencyjnych.

Wielomodalne modele bazowe, które rozumieją tekst, obrazy, wideo i dźwięk.

Wielomodalny agent AI diagnostyczny, który prowadzi konwersacje kliniczne i interpretuje obrazy medyczne w celu dokładnych diagnoz.

Wielomodalny generator wideo AI, który przekształca tekst, obrazy lub dźwięk w krótkie filmy.

Multimodalny asystent AI zakupowy dla sklepów Shopify, wykorzystujący tekst, głos i obraz.

Otwarte źródło frameworka automatyzującego przepływy pracy na pulpicie przy użyciu dużych modeli multimodalnych.

Multimodalna sztuczna inteligencja do generowania, edytowania i renderowania gotowych do produkcji wideo.

Jednolity interfejs API dla multimodalnej SI obejmującej modele czatu, obrazu i wideo.

Multimodalna platforma AI do tworzenia wideo z tekstu, obrazów do wideo, obrazów z tekstu i nagrań głosowych.

Platforma AI wielomodalna do generowania wideo, obrazów i dźwięku na podstawie tekstu lub mediów.

Multimodalna platforma AI do generowania spójnych, kontrolowalnych wideo z tekstu, obrazów i odniesień.

Kompaktowy humanoidalny robot z 26 przegubami i multimodalną AI dla badań i edukacji

Wielomodalny generator wideo AI, który zamienia tekst, obrazy, dźwięk i klipy w filmy taneczne.

Multimodalny model AI Google, zaprojektowany do zadań agentowych, rozumowania i natywnego wykorzystania narzędzi.

Otwarto‑źródłowy agent AI, który steruje Twoim komputerem za pomocą wizji ekranu oraz kontrolą myszy i klawiatury.

Multimodalna rodzina modeli AI Google z rozumieniem długich kontekstów i architekturą MoE.

Wszechstronny asystent AI do tworzenia obrazów, wideo, voiceoverów i muzyki

Multimodalny generator wideo AI, który przekształca tekst, obrazy i dźwięk w krótkie, kinowe klipy.