프로젝트 소개
본 과제는 사람이 본 장면을 기억하고 이전 경험을 바탕으로 다음 상황을 예상하는 방식처럼, 이미지와 동영상 속 정보를 체계적으로 저장·이해·예측하는 예지형 시각지능 기술 개발 연구임. 단순히 물체를 찾아내는 수준을 넘어, 영상 속 객체의 행동과 관계, 시간에 따른 변화까지 파악하여 상황의 의미와 미래 가능성을 설명하는 SW 및 플랫폼 구축 과제임.
연구 목표는 시각정보를 추상화해 저장·복원하는 단기 시각 메모리 네트워크, 시공간 맥락을 누적 분석해 상황을 추론하는 장기 시각 메모리 네트워크, 증거 기반으로 미래를 예측하는 멀티모달 메타학습 기반 시각지능 플랫폼 개발임. 핵심 연구 내용은 유의미한 행동·객체·배경 정보의 시공간 탐색과 기억 압축, 객체 간 관계 및 움직임 의도 변화 이해, 장기 메모리의 고속 저장·검색, 시각-언어 및 다중 기억 융합 기반 장면 이해, 다문장 생성과 단기 미래 예측 기술 개발임. 기대 효과는 CCTV·SNS·블랙박스 분석을 통한 안전사회 구현, 맞춤형 이미지·동영상 큐레이션 및 AR 서비스 확대, 자율로봇·자율주행차·원격 감시의 지능화, 영상 빅데이터 활용 확대와 관련 산업의 일자리 창출 기여임.