Miniona bitwa · 2024-08-26 UTC
Computer Vision Pojedynek — 26 sierpnia 2024
Z kategorii Computer Vision. 8 ocen oddanych na 3 zawodników. OpenCV AI Kit (OAK) zdobył koronę.
Klasyfikacja końcowa
Zestawienie
Zawodnicy
Profile każdego narzędzia, które rywalizowało w tej bitwie, uszeregowane według ich wyniku końcowego.

OpenCV AI Kit (OAK)
Otwarte kamery AI łączące widzenie komputerowe i pomiar głębokości bezpośrednio na urządzeniu.

OpenCV AI Kit (OAK) to rodzina urzędzeń brzegowych, które połączają stereoskopowe kamery głębokościowe z przyskrzytkowana sieciową sieci neuronalnych, umożliwiając rozwijać programicyjnie wizję komputerową i modele AI bezpośrednio na kamero bez potrzeby wykorzystania GPU hostowego. Opierając się na układzie Intel Movidius Myriad X VPU i wspierane przez DepthAI SDK, urządzenia OAK mogą wykonywać detekcję obiektów, śledzenie, oszacowanie pozycji, a także lokalizację 3D w czasie rzeczywistym. Platforma jest oprogramowana jako otwartoźródłowa, z dokumentowanymi schematami sprzętowymi, API Python i C++, oraz integracjami z ROS, czyniąc ją popularną w zakresie robotyki, dronów, przeglądu przemysłowego i prototypów badań. Programiści mogą wdrożyć gotowe modeli z kolekcji OpenVINO Model Zoo lub przekonwertować swoje własne sieci PyTorch i TensorFlow, aby uruchomić je na urządzeniu. OAK jest produkowany przez Luxonis we współpracy z społecznością OpenCV, w tym modelach od kompaktowych modułów USB do kamery obsługujących PoE, odpowiednich dla wdrażeń wbudowanych i niezależnych.
Podział kryteriów
- Percepcja głębokości stereo z lokalizacją obiektów 3D
- Wbudowane przetwarzanie neuralne poprzez VPU Myriad X
- SDK DepthAI Python i C++
- Obsługa modeli OpenVINO, PyTorch i TensorFlow
- Formy modułów: USB, PoE i samodzielne
- Integracja z ROS i przepływami pracy OpenCV


Oxipit.ai to platforma komputerowego widzenia AI dla przepływów pracy obrazowania medycznego, w szczególności radiologii. Firma opracowuje klinicznie potwierdzone rozwiązania AI, aby poprawić efektywność, wesprzeć przepływy pracy diagnostycznej i poprawić opiekę nad pacjentami. Oxipit oferuje trzy kompleksowe pakiety: Oxipit CXR Suite dla zdjęć rentgenowskich klatki piersiowej, Oxipit CT Suite dla zdjęć CT klatki piersiowej i Oxipit MSK Suite dla obrazowania musculoskeletal. Ich flagowa innowacja, ChestLink, autonomicznie identyfikuje normalne badania zdjęć rentgenowskich klatki piersiowej z 99,9% precyzją, automatyzując do 40% przypadków. Platforma ma na celu usprawnienie przepływów pracy radiologicznej, redukcję przeoczeń i wsparcie pewnego podejmowania decyzji. Oxipit współpracuje z kilkoma dostawcami opieki zdrowotnej i niedawno zawarł umowę nabycia przez Sectra, wiodącego dostawcę obrazowania przedsiębiorstwa i IT opieki zdrowotnej, aby skalować swoje klinicznie potwierdzone rozwiązania AI na całym świecie.
Podział kryteriów
- Automatyczne wykrywanie nieprawidłowości na zdjęciach rentgenowskich klatki piersiowej
- Priorytetyzacja i triaż przypadków
- Pomoc w sporządzaniu raportów radiologicznych
- Sprawdzanie jakości
- Integracja z PACS i przepływem pracy DICOM
- Wsparcie decyzji klinicznych dla radiologów

OmniVision
Kompaktowy model wizyjno-językowy stworzony dla wdrożeń AI na urządzeniu i krawędzi sieci.

OmniVision to lekki model wizjajęzyk, zaprojektowany na potrzeby zrozumienia multimodalnego dla urządzeń ograniczonych zasobami. Poprzez minimalizację liczby parametru i obszaru pamięci, może pracować lokalnie na sprzęcie brzegowym bez ustanawiania przetwarzania w chmurze, czyniąc go odpowiednim dla mobilnych aplikacji oraz dla systemów wbudowanych i procesów wrażliwych na prywatność. Model przyjmuje wejścia w postaci obrazów, obok wypowiedzi tekstu, i może wykonywać taski jak pytania wizualne, dodawanie napisów w obiektach fotograficznych oraz podstawowe rozpoznanie sceny. Małe rozmiary kosztują zdolność oryginalną, ale zapewniają przyspieszenie, efektywność, a także dostępność offline, co czyni go elastycznym wyborem dla deweloperów tworzących multimodalne cechy w środowiskach ograniczonych.
Podział kryteriów
- Zrozumienie wizyjno-językowe
- Zoptymalizowany dla sprzętu brzegowego i mobilnego
- Tytuły zdjęć i wizualne Q&A
- Kompaktowa liczba parametrów
- Możliwość inferencji offline
- Łatwa integracja dla deweloperów


