Miniona bitwa · 2024-08-26 UTC

Computer Vision Pojedynek — 26 sierpnia 2024

Z kategorii Computer Vision. 8 ocen oddanych na 3 zawodników. OpenCV AI Kit (OAK) zdobył koronę.

Klasyfikacja końcowa

Zestawienie

Zawodnicy

Profile każdego narzędzia, które rywalizowało w tej bitwie, uszeregowane według ich wyniku końcowego.

1OpenCV AI Kit (OAK) logo

OpenCV AI Kit (OAK)

Otwarte kamery AI łączące widzenie komputerowe i pomiar głębokości bezpośrednio na urządzeniu.

4.3 (4)
Freemium
Zrzut ekranu OpenCV AI Kit (OAK)

OpenCV AI Kit (OAK) to rodzina urzędzeń brzegowych, które połączają stereoskopowe kamery głębokościowe z przyskrzytkowana sieciową sieci neuronalnych, umożliwiając rozwijać programicyjnie wizję komputerową i modele AI bezpośrednio na kamero bez potrzeby wykorzystania GPU hostowego. Opierając się na układzie Intel Movidius Myriad X VPU i wspierane przez DepthAI SDK, urządzenia OAK mogą wykonywać detekcję obiektów, śledzenie, oszacowanie pozycji, a także lokalizację 3D w czasie rzeczywistym. Platforma jest oprogramowana jako otwartoźródłowa, z dokumentowanymi schematami sprzętowymi, API Python i C++, oraz integracjami z ROS, czyniąc ją popularną w zakresie robotyki, dronów, przeglądu przemysłowego i prototypów badań. Programiści mogą wdrożyć gotowe modeli z kolekcji OpenVINO Model Zoo lub przekonwertować swoje własne sieci PyTorch i TensorFlow, aby uruchomić je na urządzeniu. OAK jest produkowany przez Luxonis we współpracy z społecznością OpenCV, w tym modelach od kompaktowych modułów USB do kamery obsługujących PoE, odpowiednich dla wdrażeń wbudowanych i niezależnych.

Podział kryteriów

Ease of use1
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Percepcja głębokości stereo z lokalizacją obiektów 3D
  • Wbudowane przetwarzanie neuralne poprzez VPU Myriad X
  • SDK DepthAI Python i C++
  • Obsługa modeli OpenVINO, PyTorch i TensorFlow
  • Formy modułów: USB, PoE i samodzielne
  • Integracja z ROS i przepływami pracy OpenCV
2Oxipit.ai logo

Oxipit.ai

Komputerowe widzenie AI dla przepływów pracy obrazowania medycznego

4.7 (6)
Freemium
Zrzut ekranu Oxipit.ai

Oxipit.ai to platforma komputerowego widzenia AI dla przepływów pracy obrazowania medycznego, w szczególności radiologii. Firma opracowuje klinicznie potwierdzone rozwiązania AI, aby poprawić efektywność, wesprzeć przepływy pracy diagnostycznej i poprawić opiekę nad pacjentami. Oxipit oferuje trzy kompleksowe pakiety: Oxipit CXR Suite dla zdjęć rentgenowskich klatki piersiowej, Oxipit CT Suite dla zdjęć CT klatki piersiowej i Oxipit MSK Suite dla obrazowania musculoskeletal. Ich flagowa innowacja, ChestLink, autonomicznie identyfikuje normalne badania zdjęć rentgenowskich klatki piersiowej z 99,9% precyzją, automatyzując do 40% przypadków. Platforma ma na celu usprawnienie przepływów pracy radiologicznej, redukcję przeoczeń i wsparcie pewnego podejmowania decyzji. Oxipit współpracuje z kilkoma dostawcami opieki zdrowotnej i niedawno zawarł umowę nabycia przez Sectra, wiodącego dostawcę obrazowania przedsiębiorstwa i IT opieki zdrowotnej, aby skalować swoje klinicznie potwierdzone rozwiązania AI na całym świecie.

Podział kryteriów

Ease of use1
Value for money1
Features & power0
Integrations0
Support & docs1
Reliability0
  • Automatyczne wykrywanie nieprawidłowości na zdjęciach rentgenowskich klatki piersiowej
  • Priorytetyzacja i triaż przypadków
  • Pomoc w sporządzaniu raportów radiologicznych
  • Sprawdzanie jakości
  • Integracja z PACS i przepływem pracy DICOM
  • Wsparcie decyzji klinicznych dla radiologów
3OmniVision logo

OmniVision

Kompaktowy model wizyjno-językowy stworzony dla wdrożeń AI na urządzeniu i krawędzi sieci.

4.6 (5)
Freemium
Zrzut ekranu OmniVision

OmniVision to lekki model wizjajęzyk, zaprojektowany na potrzeby zrozumienia multimodalnego dla urządzeń ograniczonych zasobami. Poprzez minimalizację liczby parametru i obszaru pamięci, może pracować lokalnie na sprzęcie brzegowym bez ustanawiania przetwarzania w chmurze, czyniąc go odpowiednim dla mobilnych aplikacji oraz dla systemów wbudowanych i procesów wrażliwych na prywatność. Model przyjmuje wejścia w postaci obrazów, obok wypowiedzi tekstu, i może wykonywać taski jak pytania wizualne, dodawanie napisów w obiektach fotograficznych oraz podstawowe rozpoznanie sceny. Małe rozmiary kosztują zdolność oryginalną, ale zapewniają przyspieszenie, efektywność, a także dostępność offline, co czyni go elastycznym wyborem dla deweloperów tworzących multimodalne cechy w środowiskach ograniczonych.

Podział kryteriów

Ease of use1
Value for money0
Features & power0
Integrations0
Support & docs0
Reliability0
  • Zrozumienie wizyjno-językowe
  • Zoptymalizowany dla sprzętu brzegowego i mobilnego
  • Tytuły zdjęć i wizualne Q&A
  • Kompaktowa liczba parametrów
  • Możliwość inferencji offline
  • Łatwa integracja dla deweloperów