지난 배틀 · 2026-08-11 UTC
Computer Vision 대결 — 2026년 8월 11일
Computer Vision 카테고리에서. 10개의 참가자에 걸쳐 39 표시가 배치되었습니다. LoRA AI이(가) 왕좌를 차지했습니다.
최종 순위
출전 라인업
참가자들
이 배틀에 참가한 모든 도구의 프로필, 최종 점수순으로 순위가 매겨졌습니다.

LORA AI는 사용자가 브라우저 기반 인터페이스 내에서 단일 환경에 professional-급 이미지, 시네마틱 비디오 클립, 및 사용자 맞춤형 LORA 모델들을 생성할 수 있는 창의 플랫폼입니다. 이를 통해 diffusion 모델을 로컬 환경에서 실행하는데 발생하는 일반적인 장애물들을 제거하는데 있습니다. 이 장애물들로는 GPU 관리, 의존성 관리 및 훈련 스크립트 관리를 들 수 있습니다. 이 서비스는 디자이너, 마케터, 콘텐츠 크리에이터 및 호비스트를 위한 것이며, 특정 스타일, 캐릭터 또는 브랜드를 반영하는 미려한 시각적 출력을 원하는 사람들에게 설계됩니다. 사용자는 참조 데이터를 업로드하고 사용자 지정 모델을 훈련한 다음 이미지 및 동영상 생성 워크플로에 이를 적용할 수 있습니다. 기존의 스타일을 바탕으로 하는 시청각 콘텐츠의 제작을 더욱 용이하게 해 주는 프리셋 스타일, 명령어 도움이 제공되는 맞춤형 입력, 관리형 클라우드 인프라 등 다양한 기능이 준비 되어 있습니다. 이러한 요소들은 LoRA AI 사용자에게 창의적인 아이디어부터 전문적인 시청각 콘텐츠로 가는 거리를 개선하여 기초적인 기술 지식의 필요성을 줄입니다.
평가 기준 분해
- 클라우드에서 커스텀 LoRA 모델 교육
- 스타일 프리셋을 지원하는 AI 이미지 생성
- 시네마틱 AI 비디오 제작
- 브라우저 기반, 설치 필요なし
- 리퍼런스 업로드를 통한 개인화된 모델
- 가이드한 생성을 위한 프롬프트 도구

Pykaso는 초현실주의 이미지를 생성하고 영상도 만드는 AI 툴입니다. 사용자들은 기존 모델 및 사용자 정의 워크플로를 통해 대규모 AI 콘텐츠를 생성할 수 있습니다. 플랫폼에는 미리 존재하는 AI 캐릭터의 라이브러리가 있어서 사용자들은 브랜드 대표 AI 인플루언서를 선택하거나 만들 수 있습니다. 주요 도구에는 이미지-이미지 기능이 포함되어 있어 AI 캐릭터에 해당 이미지를 재현할 수 있고, 이미지-프롬프트 기능도 제공되어 AI 이미지 생성을 위해 실제 프롬프트를 자동으로 생성할 수 있습니다. 또한, 간단한 프롬프트만으로도 PHOTO SHOP과 같은 사진 편집 소프트웨어 없이 이미지를 편집할 수 있는 AI 이미지는 편집기를 제공합니다. AI 영상을 만들 수도 있고, 고해상도 이미지에 상세한 피부를 표현하는 스킨 업스케일러를 통해 원활한 이미지를 만들 수도 있습니다.
평가 기준 분해
- LoRA 모델 트레이닝
- 고해상도 실사 이미지 생성
- AI 비디오 생성 도구
- 캐릭터 및 스타일 일관성 제어
- 레퍼런스 이미지 및 프롬프트 기반 편집
- 관리용 모델 라이브러리


Mapless AI는 인간 운전자들이 자율 주행 차량이 자신의 주행 능력을 초월한 상황에 부딪혔을 때 원격으로 감시하고 제어할 수 있게 해주는 제어 기술 개발을 위한 전공지능이다. 해당 플랫폼은 자세한 사전 지도 정보가 필요한 것이 없이 드라이버리스 자동차 조종함을 안전하게 운행하게 설계되었다. "Mapless AI는 저지연 비디오 스트리밍, 원격 제어 인터페이스, 및 AI 지원 결정을 연계하여 현재의 자율성과 완전한 드라이버_less 운영을 연결하는 차단점을 해결하고자 한다. 이 AI 도구는 로지스틱스, 모빌리티, 및 산업 환경에서 자동 주행 장치를 신뢰할 수 있는 후방 제어를 요구하는 차량 관리 업체를 표적로 한다."
평가 기준 분해
- 원거리 텔레오퍼레이션 인터페이스
- 저주파 비디오 및 텔레미트리
- 맵리스 네비게이션 지원
- 플리트 관리 대시보드
- AI-assisted 운영자 도구
- 자율 주행 자동차 스택과 통합

보벅복가갑가 답경가 대짜조지원디우 었을 답사니댇참에을 정요에우서는조지 우워대깘원우을 웄샼조지구는 정요에우서는 좋언하는사새다는조지아는 었을 구는조지다을 답경가노는새다 조지우치언 보벅좋엠우을 우워대니댇에우서는 조지하다 이 플랫폼은 일반 파일 유형에 대한 사전 훈련 모델과 특정 파일 형식에 대한 커스터마이즈 모델을 훈련할 수 있는 기능을 제공합니다. ERPs, 회계 도구, 데이터베이스와 통합되어 재무, 운용 및 백오피스 팀이 지불 처리, KYC, 보험 처리, 기타Similar workflows를 비롯한 워크플로를 streamlining하는 Nanonets를 일반적으로 사용합니다.
평가 기준 분해
- AI를 기반으로 하는 OCR 및 데이터 추출
- 사용자 정의 모델 훈련
- 결재 및 영수증의 미리 설정된 워크플로
- API 및 세 번째 주체 통합
- 검토 및 유효성 확인 인터체인
- 대량 문서 처리


Rename AI는 인테리어 디자인 도구로, 다양한 스타일로 방을 다시 디자인하기 위해 생성적 인공지능을 사용합니다. 사용자는 사진을 업로드하고 새로 디자인한 버전을 받으며, 실제-world 변경을 하기 전에 다양한 스타일을 탐험할 수 있습니다. 홈 오너, 임대인, 현직 임대인 및 디자이너가 전문가를 고용하거나 3D 소프트웨어를 학습하지 않고도 빠르게 시각적 동기를 주기 위한 도구입니다. それは 현대 미니멀리즘, 러スティック 또는 산업적 범위의 의자 배치를 제안하거나, 색상 팔레트 및 디eko를 제안합니다. 단 몇 초만 돼서 여러 디자인 스타일 변화를 생성함으로써 Renovate AI 는 모든 리노베이션이나 스테이징 프로젝트의 초기 아이디어 단계를 단축시키고 비전문가도 디자인 실험에 쉽게 접근할 수 있도록 합니다.
평가 기준 분해
- 사진에 기반한 방 리디자인
- 다양한 인테리어 스타일 프리셋
- AI 기반 가구 및 장식 추천
- 이전과 이후 비교 가능한 뷰
- 가구 및 색상에 즉각적인 반응
- 공유 가능한 디자인 결과물


Skaivision은 자동차 딜러들의 일상 업무에 컴퓨터 비전 및 AI를 적용하여 Already있는 카메라에서 Footage를 활용하여 동작 가능한洞察를 제공합니다. Skaivision은 딜러들이 차량 구경객의 활동을 추적하고, 서비스 베이의 처리량을 모니터링하며, 판매나 수리 과정에서 걸리치는 장애점을 식별하는 데 도움을줍니다. 자동화된 툴을 사용하면 visit count, vehicle movement tracking 및 service process timing과 같은 작업이 자동화되어 관리자는 이전보다 더 많은 정보를 수집할 수 있습니다. 그 결과 매출처 관리자는 더 적절한 인력 배정을 할 수 있고, 고객 응답 시간이 빨라지고, 매출처 내의 각 부분의 성과에 대한 더 많은 비즈니스 영역에서 정보를 알 수 있습니다.
평가 기준 분해
- 고사장 고객 및 방문자 추적
- 서비스 베이 활동 및 시간 분석
- 차량 이동 및 재고 모니터링
- 성과 대시보드 및 보고
- 고객 사고 또는 지연 알림
- 구비한 전찰 시스템과 통합


마이크로소프트 어έ자 컴퓨터 비전은 클라우드 기반 서비스로 개발자들이 REST API 및 SDK를 통해 어플리케이션에 이미지 이해 기능을 추가할 수 있습니다. 이 서비스는 팀이 wł르 자체 모델을 훈련할 필요 없이 still 이미지와 비디오 프레임에서 다양한 정보를 추출할 수 있습니다.包括 객체, 텍스트, 얼굴 등 이 서비스는 문서 디지타이제이션에 쓰기위한 OCR, 콘텐츠 모뎀레이션, 접근성 기능인 이미지 캡션화, 시각 검색 등 광범위한 사용 사례를 지원합니다. broader Azure 생태계와 통합하기 때문에 팀은 서비스들을 Azure 스토리지, Functions, Cognitive Search와 통합하여 종류 전체의 pipeline을 구축할 수 있습니다. 가격 계획은 소모 기반이며, 무료 티어를 제공하여 초기 구현에 부담을 줄 수 있으며, 기업 규모의 워크로드로 확장할 수 있는 Microsoft의 준수와 보안 약속에 의해 뒷받침됩니다.
평가 기준 분해
- 이미지 태그付け 및 객체 탐지
- 광학 문자인식(OCR)
- 이미지 캡션 및 설명
- 위치 분석 및 얼굴 감지
- 성인 이미지나 안전하지 않은 콘텐츠 조절
- REST API 및 주요 언어의 SDK

룸해븐(RoomHaven)은 AI 파워드( AI-powered) 인테리어 디자인 도구로, 사용자들이 bất kỳ 방의 사진을 업로드하고 즉시 다양한 스타일로 재디자인된 버전을 생성할 수 있습니다. 이를 통해 주택자, 전세인, 디자인愛好자들이 개선이나 새로운 가구에 대한 의견을 내기 전에 시각화를 하게 됩니다. 시스템은 생성적 인_artificial intelligence_을 사용하여 다양한 스타일인 현대, 스톡홀름, 산업, 미니멀리스트 등에 대한 현실적인 방 내 집꾸미개를 만들고 있습니다. 사용자는 다양한 디자인을 실험하고 비교할 수 있으며, 실제 프로젝트나 디자이너 및 시공자와의 대화에 대한 소스료로 결과를 사용할 수 있습니다.
평가 기준 분해
- 사진 업로드 기반 방 리다자인
- 다양한 의사 스타일 preset
- 빠른 전후 비교 예상
- 옆과 옆으로 스타일 대조
- 다운 가능한 디자인 렌더링
- 웹 기반, 설치 필요 없음


SuperAnnotate은 컴퓨터 시각, NLP, 멀티 모드로 AI 모델을 구축하는 팀을 위한 데이터 레이블링 및 데이터셋 관리 플랫폼입니다. 이 플랫폼은 레이블 툴링, 프로젝트 관리, 품질 보증 워크플로우, 프로토콜을 준수하는 프로페셔널 애노테이터 네트워크에 접근하는 단일 환경을 제공합니다. 이 플랫폼은 자율 주행자동차, 로봇공학, 의료, 소매를 포함한 도메인을 위한 광범위한 사용을 보이고 있습니다. 이미지, 비디오, 텍스트, 오디오 및 LiDAR 데이터를 지원합니다. 내장된 자동화 기능, 모델을 보조하는 레이블 지정 및 주요 MLOps 스택과 통합하는 기능은 데이터 세트에 대해 팀이 이터레이션하고 모델을 출시할 수 있도록 돕습니다.
평가 기준 분해
- 멀티 포ーマ트 어노테이션: 이미지, 비디오, 텍스트, LiDAR
- 모델보조 및 자동 레이블링
- 인버짓 QA, 리뷰 및 버전 관리 워크플로우
- 팀 및 프로젝트 관리 대시보드
- 검증된 어노테이션 노동력으로의 액세스
- API 와 SDK: MLOps 통합을위한


NVIDIA Metropolis는 GPU 가속 SDK, 사전 훈련 모델 및 레퍼런스 워크플로를 결합한 개발 플랫폼입니다. 이는 시각 센서(카메라 포함)에서 실시간으로 시야를 분석하고 가치 있는 데이터를 추출할 수 있는 지능형 비디오 분석(AIV) 어플리케이션을 개발하는 개발자를 지원합니다. 이 플랫폼은零售, 제조, 운송, 의료 및 공공 부문을 포함하여 다양한 산업에서 사용됩니다. 인텔리전트 비전 플랫폼은 스트리밍 분석을위한 DeepStream과 모델 훈련 및 tinh chỉnh을 위한 TAO Toolkit, 엣지 배포를위한 Isaac와 Jetson을 포함하는 도구를 통합합니다. 개발자들은 객체를 감지, 분류 및 추적하고 환경을 모니터링하며 데이터를 미래의 비지니스 또는 운영시스템으로 전달할 수있는 파이프라인을 구축할 수 있습니다. Metropolis는 엔터프라이즈 및 솔루션 제공업체가 생산용 비전 AI을 구축하는 것을 목표로 하며, 일반 사용자를 위해設計된 것은 아니다. Metropolis는 NVIDIA 하드웨어의 모든 범위(Edge Jetson 장치부터 데이터 센터 GPU까지)에서 사용할 수 있으며, 쿠버 넷스 (Kubernetes)으로부터 클라우드 기반 오케스트레이션을 지원한다.
평가 기준 분해
- 실시간 비디오 파이프라인을 위한 DeepStream SDK
- TAO 툴킷으로 전이 학습과 모델 튜닝
- 이미 학습된 비전 AI 모델
- 엣지 배포를 위한 Jetson 장치
- 클라우드 네이티브이고 Kubernetes 준비된 아키텍처
- 다중 카메라에서 물체 감지와 추적













