• 제목/요약/키워드: Video Retrieval

검색결과 371건 처리시간 0.028초

스포츠 비디오를 위한 자막 위치검색 시스템 (Korea Information Science Society Caption position retrieval system for sports video)

  • 임정훈;곽순영;국나영;이지현;이양원
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 가을 학술발표논문집 Vol.29 No.2 (2)
    • /
    • pp.628-630
    • /
    • 2002
  • 하이라이트를 구성하는데 종전에는 사람의 수작업에 의해서 이루어졌다. 요즘은 이런점을 연구를 통해 계속 자동화시키고 있는 추세이고 많은 논문들이 나오고 있다. 이 논문은 낮은 해상도의 동영상을 향상시키기 위해 Shannon Upsampling을 수행하고 적당한 임계치를 찾아내 이진영상을 만들어 전처리를 수행하고 수평 수직 히스토그램 기법과 다중프레임조함을 혼합해 자막위치를 찾는 방법을 제안한다. 이는 기존의 에지를 사용하는 방법들에 비해 간단하고 비교적 빠른 성능을 보인다.

  • PDF

키 프레임의 주석과 비교 영역 학습을 이용한 비디오 검색 시스템 (A Video Retrieval System Using Annotation and Comparison Area Learning of Key-frames)

  • 이기성
    • 한국산학기술학회:학술대회논문집
    • /
    • 한국산학기술학회 2006년도 추계학술발표논문집
    • /
    • pp.239-241
    • /
    • 2006
  • 비디오 데이터를 효율적으로 처리하기 위해서는 비디오 데이터가 가지고 있는 내용에 대한 정보를 데이터베이스에 저장하고 사용자들의 다양한 질의를 처리할 수 있는 의미기반 검색 기법이 요구된다. 본 논문에서는 사용자의 키워드 학습과 비교 영역 학습을 이용하여 대용량의 비디오 데이터에 대한 사용자의 다양한 의미검색을 지원하는 에이전트 기반에서의 자동화된 비디오 검색 시스템을 제안한다.

  • PDF

MPEG 비디오 스트림에서의 대표 프레임 추출 및 멀티미디어 검색 기법 (Key Frame Detection and Multimedia Retrieval on MPEG Video)

  • 김영호;강대성
    • 융합신호처리학회 학술대회논문집
    • /
    • 한국신호처리시스템학회 2000년도 하계종합학술대회논문집
    • /
    • pp.297-300
    • /
    • 2000
  • 본 논문에서는 MPEG 비디오 스트림을 분석하여 DCT DC 계수를 추출하고 이들로 구성된 DC 이미지로부터 제안하는 robust feature를 이용하여 shot을 구하고 각 feature들의 통계적 특성을 이용하여 스트림의 특징에 따라 weight를 부가하여 구해진 characterizing value의 시간변화량을 구한다. 구해진 변화량의 local maxima와 local minima는 MPEG 비디오 스트림에서 각각 가장 특징적인 frame과 평균적인 frame을 나타낸다. 이 순간의 frame을 구함으로서 효과적이고 빠른 시간 내에 key frame을 추출한다. 추출되어진 key frame에 대하여 원영상을 복원한 후, 색인을 위하여 다수의 parameter를 구하고 사용자가 질의한 영상에 대해서 이들 파라메터를 구하여 key frame들과 가장 유사한 대표영상들을 검색한다.

  • PDF

Pitch 히스토그램을 이용한 내용기반 음악 정보 검색 (Content-based Music Information Retrieval using Pitch Histogram)

  • 박만수;박철의;김회린;강경옥
    • 방송공학회논문지
    • /
    • 제9권1호
    • /
    • pp.2-7
    • /
    • 2004
  • 본 논문에서는 내용 기반 음악 정보 검색에 MPEG-7에 정의된 오디오 서술자를 적용하는 방법을 제안한다. 특히 Pitch 정보와 timbral 특징들은 음색 구분을 용이하게 할 수 있어 음악 검색뿐만 아니라 음악 장르 분류 또는 QBH(Query By Humming)에 이용 될 수 있다. 이러한 방법을 통하여 오디오 신호의 대표적인 특성을 표현 할 수 있는 특징벡터를 구성 할 수 있다면 추후에 멀티모달 시스템을 이용한 검색 알고리즘에도 오디오 특징으로 이용 될 수 있을 것이다. 본 논문에서는 방송 시스템에 적용하기 위해 영화나 드라마의 배경음악에 해당하는 O.S.T 앨범으로 검색 범위를 제한하였다. 즉, 사용자가 임의로 검색을 요청한 시점에서 비디오 컨텐츠로부터 추출한 임의의 오디오 클립만을 이용하여 그 컨텐츠 전체의 O.S.T 앨범 내에서 음악을 검색할 수 있도록 하였다. 오디오 특징 백터를 구성하기 위해 필요한 MPEG-7 오디오 서술자의 조합 방법을 제안하고 distance 또는 ratio 계산 방식을 통해 성능 향상을 추구하였다. 또한 reference 음악의 템플릿 구성 방식의 변화를 통해 성능 향상을 추구하였다. Classifier로 k-NN 방식을 사용하여 성능평가를 수행한 결과 timbral spectral feature 보다는 pitch 정보를 이용한 특징이 우수한 성능을 보였고 vector distance 방식으로는 특징들의 비율을 이용한 IFCR(Intra-Feature Component Ratio) 방식이 ED(Euclidean Distance) 방식보다 우수한 성능을 보였다.

이동 객체 좌표의 시간적 히스토그램 기반 행동패턴 분석 및 검색 디스크립터 설계 (Behavior Pattern Analysis and Design of Retrieval Descriptor based on Temporal Histogram of Moving Object Coordinates)

  • 이재광;이규원
    • 한국정보통신학회논문지
    • /
    • 제21권4호
    • /
    • pp.811-819
    • /
    • 2017
  • 이동 객체 정보로 이루어진 디스크립터 및 시간적 히스토그램 기반 움직임 패턴 분석 알고리즘을 제안한다. 이동객체의 검출, 추적 및 분석을 위하여 배경으로부터 이동객체를 분리하는 배경학습을 수행한다. 무게중심의 좌표연관성을 이용하여 객체를 식별한 후 객체별로 추적한다. 시간적 히스토그램은 객체의 무게중심의 위치와 시간 정보를 이용해 움직임 특징 패턴을 정의한 것으로서 시간적 히스토그램으로부터 각 객체의 좌표정보와 비교하여 움직임특징 및 행동정보를 파악한다. 검출된 각 객체의 시작프레임, 종료프레임, 위치 등 행동정보를 연결리스트에 저장하여 관리한다. 저장된 정보들을 바탕으로 디스크립터를 작성하고 비디오 검색 알고리즘을 설계한다. 다양한 객체 이동 비디오에 대한 검색 실험을 통해 기존 방법보다 높은 검색 정확도를 보임을 확인하였다.

CBIR을 위한 코너패치 기반 재배열 DCT특징 분석 (Rearranged DCT Feature Analysis Based on Corner Patches for CBIR (contents based image retrieval))

  • 이지민;박종안;안영은;오상언
    • 전기학회논문지
    • /
    • 제65권12호
    • /
    • pp.2270-2277
    • /
    • 2016
  • In modern society, creation and distribution of multimedia contents is being actively conducted. These multimedia information have come out the enormous amount daily, the amount of data is also large enough it can't be compared with past text information. Since it has been increased for a need of the method to efficiently store multimedia information and to easily search the information, various methods associated therewith have been actively studied. In particular, image search methods for finding what you want from the video database or multiple sequential images, have attracted attention as a new field of image processing. Image retrieval method to be implemented in this paper, utilizes the attribute of corner patches based on the corner points of the object, for providing a new method of efficient and robust image search. After detecting the edge of the object within the image, the straight lines using a Hough transformation is extracted. A corner patches is formed by defining the extracted intersection of the straight line as a corner point. After configuring the feature vectors with patches rearranged, the similarity between images in the database is measured. Finally, for an accurate comparison between the proposed algorithm and existing algorithms, the recall precision rate, which has been widely used in content-based image retrieval was used to measure the performance evaluation. For the image used in the experiment, it was confirmed that the image is detected more accurately in the proposed method than the conventional image retrieval methods.

The Kernel Trick for Content-Based Media Retrieval in Online Social Networks

  • Cha, Guang-Ho
    • Journal of Information Processing Systems
    • /
    • 제17권5호
    • /
    • pp.1020-1033
    • /
    • 2021
  • Nowadays, online or mobile social network services (SNS) are very popular and widely spread in our society and daily lives to instantly share, disseminate, and search information. In particular, SNS such as YouTube, Flickr, Facebook, and Amazon allow users to upload billions of images or videos and also provide a number of multimedia information to users. Information retrieval in multimedia-rich SNS is very useful but challenging task. Content-based media retrieval (CBMR) is the process of obtaining the relevant image or video objects for a given query from a collection of information sources. However, CBMR suffers from the dimensionality curse due to inherent high dimensionality features of media data. This paper investigates the effectiveness of the kernel trick in CBMR, specifically, the kernel principal component analysis (KPCA) for dimensionality reduction. KPCA is a nonlinear extension of linear principal component analysis (LPCA) to discovering nonlinear embeddings using the kernel trick. The fundamental idea of KPCA is mapping the input data into a highdimensional feature space through a nonlinear kernel function and then computing the principal components on that mapped space. This paper investigates the potential of KPCA in CBMR for feature extraction or dimensionality reduction. Using the Gaussian kernel in our experiments, we compute the principal components of an image dataset in the transformed space and then we use them as new feature dimensions for the image dataset. Moreover, KPCA can be applied to other many domains including CBMR, where LPCA has been used to extract features and where the nonlinear extension would be effective. Our results from extensive experiments demonstrate that the potential of KPCA is very encouraging compared with LPCA in CBMR.

저작권보호를 위한 내용기반 비디오 복사검출의 비디오 정합 알고리즘 (Video Matching Algorithm of Content-Based Video Copy Detection for Copyright Protection)

  • 현기호
    • 한국멀티미디어학회논문지
    • /
    • 제11권3호
    • /
    • pp.315-322
    • /
    • 2008
  • 비디오 데이터베이스에서 복사본의 위치를 검출하기 위해서는 비디오의 특징(signature)이 비디오의 재편집(reediting), 채널 잡음, 시간적인 프레임 율(frame rate) 변화에 강한 특성을 지녀야 한다. 여러 가지 시그네쳐중 하나인 오디널(ordinal) 시그네쳐는 평균 명암도 값을 구하는 고정 윈도우(fixed window) $N{\times}N$의 크기에 따라 프레임의 공간적인 특징을 나타내기 어렵다. 본 논문은 인터넷상에서 이미 배포된 비디오, 위조된 비디오의 검출을 위해 키 프레임으로 정합하지 않고 연속적인 비디오 프레임에서 공간의 변화특성인 기존의 오디널을 개선한 변형된 robust 오디널 특징을 제안하였다. Robust 오디널은 2차원 벡터 구조를 가지고 있어 비디오의 잡음과 프레임 율의 변화에 강한 특성을 가지고 있으며, 검색공간인 R-트리 공간에서 MBR 형태로 표현될 수 있다. 또한 비디오 복사 검출에 필수적인 대용량 데이터베이스 검색에 적합한 R-트리 구조를 이용하여 정확히 정합되는 프레임의 위치를 찾아내고, n차원 입력의 구조를 가지고 있는 R-트리의 입력으로 robust 오디널 특징이 적합하게 사용되었다. 실험결과 비디오 정합율이 향상되고 대용량 데이터베이스에 알맞은 특징을 가지고 있음을 확인하였다.

  • PDF

광범위한 지역 감시시스템에서의 행동기반 키프레임 검출 및 비디오 요약 (Activity-based key-frame detection and video summarization in a wide-area surveillance system)

  • 권혜영;이경미
    • 인터넷정보학회논문지
    • /
    • 제9권3호
    • /
    • pp.169-178
    • /
    • 2008
  • 본 논문에서는 광범위한 지역을 감시하기 위해 설치된 여러 대의 카메라로부터 획득된 비디오에 대해 행동을 기반으로 한 비디오 요약 시스템을 제안한다. 제안된 시스템은 시야가 겹쳐지지 않은 다수의 CCTV 카메라를 통해서 촬영한 비디오들을 30분 단위로 나누어 비디오 데이터베이스를 구축하여 시간별, 카메라별 비디오 검색이 가능하다. 또한 30분 단위로 나눈 비디오에서 키프레임을 추출하여 카메라별, 행동별로 비디오를 요약할 수 있도록 하였다. 행동 검출과 관련된 11가지(in, out, stay, left, right, forward, backward, left_forward, left_backward, right_forward, right_backward)에 대한 요약된 정보를 가지고 현재 사람의 행동이 어떤 영역에서 어떤 방향으로 움직이고 있는 지에 대한 정보를 행동별 비디오 요약을 통해 보여줌으로써 더 자세히 행동 추적된 결과를 볼 수 있다. 또한 카메라 3대에 대한 전체적인 키프레임에 대한 행동별 통계를 통해서 감시지역의 행동기반 이벤트들을 한 눈에 간단히 확인해 볼 수 있다.

  • PDF

Improvement of Accuracy for Human Action Recognition by Histogram of Changing Points and Average Speed Descriptors

  • Vu, Thi Ly;Do, Trung Dung;Jin, Cheng-Bin;Li, Shengzhe;Nguyen, Van Huan;Kim, Hakil;Lee, Chongho
    • Journal of Computing Science and Engineering
    • /
    • 제9권1호
    • /
    • pp.29-38
    • /
    • 2015
  • Human action recognition has become an important research topic in computer vision area recently due to many applications in the real world, such as video surveillance, video retrieval, video analysis, and human-computer interaction. The goal of this paper is to evaluate descriptors which have recently been used in action recognition, namely Histogram of Oriented Gradient (HOG) and Histogram of Optical Flow (HOF). This paper also proposes new descriptors to represent the change of points within each part of a human body, caused by actions named as Histogram of Changing Points (HCP) and so-called Average Speed (AS) which measures the average speed of actions. The descriptors are combined to build a strong descriptor to represent human actions by modeling the information about appearance, local motion, and changes on each part of the body, as well as motion speed. The effectiveness of these new descriptors is evaluated in the experiments on KTH and Hollywood datasets.