심층 비전 AI · Deep Vision

영상 frame 자연어 심층 분석

단순 객체 검출의 한계를 넘어선 통합 비전-언어 모델. 영상 frame 을 보고 장면 묘사, 객체 검출, 영역별 캡션, region grounding을 자연어로 출력. 오프라인 영상 심층 분석의 새 기준.

기존 객체 검출 모델 대비 30× 풍부한 정보 추출. K League 환경에 맞춰 도메인 fine-tune 진행 중.

매치
분석 task
시점 (초)