• 제목/요약/키워드: Object detecting system

검색결과 238건 처리시간 0.022초

Structural SVM을 이용한 백과사전 문서 내 생략 문장성분 복원 (Restoring Omitted Sentence Constituents in Encyclopedia Documents Using Structural SVM)

  • 황민국;김영태;나동열;임수종;김현기
    • 지능정보연구
    • /
    • 제21권2호
    • /
    • pp.131-150
    • /
    • 2015
  • 영어와 달리 한국어나 일본어 문장의 경우 용언의 필수격을 채우는 명사구가 생략되는 무형대용어 현상이 빈번하다. 특히 백과사전이나 위키피디아의 문서에서 표제어로 채울 수 있는 격의 경우 그 격이 문장에서 더 쉽게 생략된다. 정보검색, 질의응답 시스템 등 주요 지능형 응용시스템들은 백과사전류의 문서에서 주요한 정보를 추출하여 수집하여야 한다. 그러나 이러한 명사구 생략 현상으로 인해 양질의 정보추출이 어렵다. 본 논문에서는 백과사전 종류 문서에서 생략된 명사구 즉 무형대용어를 복원하는 시스템의 개발을 다루었다. 우리 시스템이 다루는 문제는 자연어처리의 무형대용어 해결 문제와 거의 유사하나, 우리 문제의 경우 문서의 일부가 아닌 표제어도 복원에 이용할 수 있다는 점이 다르다. 무형대용어 복원을 위해서는 먼저 무형대용어의 탐지 즉 문서 내에서 명사구 생략이 일어난 곳을 찾는 작업을 수행한다. 그 다음 무형대용어의 선행어 탐색 즉 무형대용어의 복원에 사용될 명사구를 문서 내에서 찾는 작업을 수행한다. 문서 내에서 선행어를 발견하지 못하면 표제어를 이용한 복원을 시도해 본다. 우리 방법의 특징은 복원에 사용된 문장성분을 찾기 위해 Structural SVM을 사용하는 것이다. 문서 내에서 생략이 일어난 위치보다 앞에 나온 명사구들에 대해 Structural SVM에 의한 시퀀스 레이블링(sequence labeling) 작업을 시행하여 복원에 이용 가능한 명사구인 선행어를 찾아내어 이를 이용하여 복원 작업을 수행한다. 우리 시스템의 성능은 F1 = 68.58로 측정되었으며 이는 의미정보의 이용 없이 달성한 점을 감안하면 높은 수준으로 평가된다.

토픽 모델링을 이용한 트위터 이슈 트래킹 시스템 (Twitter Issue Tracking System by Topic Modeling Techniques)

  • 배정환;한남기;송민
    • 지능정보연구
    • /
    • 제20권2호
    • /
    • pp.109-122
    • /
    • 2014
  • 현재 우리는 소셜 네트워크 서비스(Social Network Service, 이하 SNS) 상에서 수많은 데이터를 만들어 내고 있다. 특히, 모바일 기기와 SNS의 결합은 과거와는 비교할 수 없는 대량의 데이터를 생성하면서 사회적으로도 큰 영향을 미치고 있다. 이렇게 방대한 SNS 데이터 안에서 사람들이 많이 이야기하는 이슈를 찾아낼 수 있다면 이 정보는 사회 전반에 걸쳐 새로운 가치 창출을 위한 중요한 원천으로 활용될 수 있다. 본 연구는 이러한 SNS 빅데이터 분석에 대한 요구에 부응하기 위해, 트위터 데이터를 활용하여 트위터 상에서 어떤 이슈가 있었는지 추출하고 이를 웹 상에서 시각화 하는 트위터이슈 트래킹 시스템 TITS(Twitter Issue Tracking System)를 설계하고 구축 하였다. TITS는 1) 일별 순위에 따른 토픽 키워드 집합 제공 2) 토픽의 한달 간 일별 시계열 그래프 시각화 3) 토픽으로서의 중요도를 점수와 빈도수에 따라 Treemap으로 제공 4) 키워드 검색을 통한 키워드의 한달 간 일별 시계열 그래프 시각화의 기능을 갖는다. 본 연구는 SNS 상에서 실시간으로 발생하는 빅데이터를 Open Source인 Hadoop과 MongoDB를 활용하여 분석하였고, 이는 빅데이터의 실시간 처리가 점점 중요해지고 있는 현재 매우 주요한 방법론을 제시한다. 둘째, 문헌정보학 분야뿐만 아니라 다양한 연구 영역에서 사용하고 있는 토픽 모델링 기법을 실제 트위터 데이터에 적용하여 스토리텔링과 시계열 분석 측면에서 유용성을 확인할 수 있었다. 셋째, 연구 실험을 바탕으로 시각화와 웹 시스템 구축을 통해 실제 사용 가능한 시스템으로 구현하였다. 이를 통해 소셜미디어에서 생성되는 사회적 트렌드를 마이닝하여 데이터 분석을 통한 의미 있는 정보를 제공하는 실제적인 방법을 제시할 수 있었다는 점에서 주요한 의의를 갖는다. 본 연구는 JSON(JavaScript Object Notation) 파일 포맷의 1억 5천만개 가량의 2013년 3월 한국어 트위터 데이터를 실험 대상으로 한다.

평면 데이터 분포에 영향을 끼치는 점 분포의 부분집합 추출 방법 - 소규모 소매점포의 매출자료를 이용한 상권 및 경쟁력 분석기법을 사례로 - (A Method for the Extraction of a Subset of Points from a Large Set of Points Affecting the Distribution of Surface Data - A Case Study of Market Area and Competitive Power Analysis by Sales Data of Micro Scale Retail Stores -)

  • 이정은;사다히로 유키오
    • 한국지리정보학회지
    • /
    • 제9권1호
    • /
    • pp.1-12
    • /
    • 2006
  • 공간분석에서는 사용되는 공간데이터 종류에 따라, 각각의 특징있는 분석법을 요구하므로, 다양한 접근법을 필요로 한다. 특히, 두 종류의 상이한 공간데이터 집합이 공존하는 경우, 어느 한 공간객체의 분포에 영향을 끼치는 다른 공간객체 집합에 대한 부분집합을 추출하여, 공간객체간의 관계성을 규명할 수가 있다. 지리정보시스템 등의 공간객체 분석기술의 발달로, 시각적으로도 간단히 공간객체간의 관계성을 파악할 수 있으나, 데이터의 양이 방대해지는 추세에서는, 지리정보시스템 (geographical information system)상에서 시각화된 공간객체 정보만으로는 서로 다른 공간객체간의 분포에서 상호관계성을 정량적으로 분석하기 어렵다. 따라서, 본 연구에서는 정량적 기준을 통해, 서로 다른 두 공간객체 간의 관계성 분석을 주목적으로 한다. 모델화된 정량적 기준의 평가를 위해 분석에 사용되는 실제 데이터는, 소규모 소매점포의 매출데이터를 사례로 들기로 한다. 데이터 수집에 제한이 있다는 특수환경으로 인해, 본 연구에서 사용되는 모델은 로짓모델을 기반으로 한 미지파라미터 추정이 가능하도록 구성되어있다. 제안된 모델을 사용하여, 대상점포의 매출분포에 큰 영향을 끼치는 것으로 판단되는 경쟁점포를 일련의 경쟁점포 집합에서 추출하며, 그 결과의 타당성을 검증하도록 한다.

  • PDF

TDoA 기반의 위치 추정을 위한 초정밀 시각동기에 관한 연구 (A Study of High-Precision Time-Synchronization for TDoA-Based Location Estimation)

  • 김재완;엄두섭
    • 정보처리학회논문지:컴퓨터 및 통신 시스템
    • /
    • 제2권1호
    • /
    • pp.7-14
    • /
    • 2013
  • 현재 위치인식에 관한 많은 기술들이 존재한다. 하지만 서로 다른 곳에 위치한 신호수신장치들이 먼 곳에 위치한 특정 물체의 위치를 정확하게 알아내기 위해서는 해당 물체 또는 사용자의 단말장치에서 내보내는 신호의 정확한 시간을 알아야 한다. 이러한 목적 때문에 ToA 기술보다는 TDoA 기술이 보다 적합하다. TDoA 기술을 기본으로 하는 전자 감시 시스템 및 다른 위치추적 장치들은 이격 장치들간의 정밀한 시각동기가 되지 않아서 신호수신장치들에 의해 보내지는 신호로부터 정확한 TDoA 값을 획득하는 것이 불가능하다. 이렇게 직접적으로 정확한 값을 받지 못함으로써 위치 추정 에러가 발생된다. 이러한 이유로 이격 장치들간의 정밀한 시각동기 기술은 TDoA를 기반으로 하는 위치인식에 있어서 필수적인 것이다. 본 논문에서는 TDoA를 기반으로 하는 위치인식을 위해, 제안된 정밀한 시각동기 기술의 정확성과 측정오차가 평가된다. TDoA를 기반으로 하는 위치 측정 오차는 제안하는 시각동기 알고리즘을 사용할 때 크게 향상된다.

Automatic Detection of Malfunctioning Photovoltaic Modules Using Unmanned Aerial Vehicle Thermal Infrared Images

  • Kim, Dusik;Youn, Junhee;Kim, Changyoon
    • 한국측량학회지
    • /
    • 제34권6호
    • /
    • pp.619-627
    • /
    • 2016
  • Cells of a PV (photovoltaic) module can suffer defects due to various causes resulting in a loss of power output. As a malfunctioning cell has a higher temperature than adjacent normal cells, it can be easily detected with a thermal infrared sensor. A conventional method of PV cell inspection is to use a hand-held infrared sensor for visual inspection. The main disadvantages of this method, when applied to a large-scale PV power plant, are that it is time-consuming and costly. This paper presents an algorithm for automatically detecting defective PV panels using images captured with a thermal imaging camera from an UAV (unmanned aerial vehicle). The proposed algorithm uses statistical analysis of thermal intensity (surface temperature) characteristics of each PV module to verify the mean intensity and standard deviation of each panel as parameters for fault diagnosis. One of the characteristics of thermal infrared imaging is that the larger the distance between sensor and target, the lower the measured temperature of the object. Consequently, a global detection rule using the mean intensity of all panels in the fault detection algorithm is not applicable. Therefore, a local detection rule was applied to automatically detect defective panels using the mean intensity and standard deviation range of each panel by array. The performance of the proposed algorithm was tested on three sample images; this verified a detection accuracy of defective panels of 97% or higher. In addition, as the proposed algorithm can adjust the range of threshold values for judging malfunction at the array level, the local detection rule is considered better suited for highly sensitive fault detection compared to a global detection rule. In this study, we used a panel area extraction method that we previously developed; fault detection accuracy would be improved if panel area extraction from images was more precise. Furthermore, the proposed algorithm contributes to the development of a maintenance and repair system for large-scale PV power plants, in combination with a geo-referencing algorithm for accurate determination of panel locations using sensor-based orientation parameters and photogrammetry from ground control points.

Ensemble Deep Network for Dense Vehicle Detection in Large Image

  • Yu, Jae-Hyoung;Han, Youngjoon;Kim, JongKuk;Hahn, Hernsoo
    • 한국컴퓨터정보학회논문지
    • /
    • 제26권1호
    • /
    • pp.45-55
    • /
    • 2021
  • 본 논문은 고해상도를 가지는 영상에서 겹쳐져있는 소형 물체를 효과적으로 검출하고 추적하는 알고리즘을 제안한다. Coarse to Fine 방식을 기본으로 하는 두 개의 Deep-Learning Network을 앙상블 형태로 구성하여 차량이 존재할 위치를 미리 판단하고 서브영역으로 선택한 이미지로부터 차량을 정확하게 검출한다. Coarse 단계에서는 서로 다른 다수의 Deep-Learning Network 에 대한 각각의 결과로 Voting Space를 생성한다. 각 Voting Space 의 조합을 통해 Voting Map을 만들고 차량이 존재할 위치를 선택한다. Fine 단계에서는 Coarse 단계에서 선택된 영역을 기준으로 서브영역을 추출하고 해당 영역을 최종 Deep-Learning Network 에 입력한다. 서브 영역은 Voting Map을 이용하여 영상에서의 높이에 적합한 크기의 동적 윈도우를 생성함으로써 정의되며, 본 논문에서는 원거리에서 근거리로 접근하는 도로의 이미지를 대상으로 미리 계산된 매핑테이블을 적용하였다. 각 서브 영역 간 이동하는 차량의 동일성 판단은 검출된 영역의 하단 중심점에 대한 근접성을 기반으로 하였으며, 이를 통해 이동하는 차량의 정보를 트래킹 하였다. 실제 주야간 도로 CCTV를 통해 획득한 실시간 영상에서 처리 속도 및 검출 성능을 비교 실험하여 제안한 알고리즘을 평가하였다.

초목을 포함한 도로 환경에서 주행 가능 영역 검출을 위한 필터링 기반 방법 및 하드웨어 구조 (Filtering-Based Method and Hardware Architecture for Drivable Area Detection in Road Environment Including Vegetation)

  • 김영현;하지석;최철호;문병인
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제11권1호
    • /
    • pp.51-58
    • /
    • 2022
  • 첨단 운전자 보조 시스템(advanced driver assistance system)의 주요 기능 중 하나인 주행 가능 영역 검출은 차량이 안전하게 주행할 수 있는 영역을 검출하는 것을 의미한다. 주행 가능 영역 검출은 운전자의 안전과 밀접한 연관이 있으며 실시간 동작과 높은 정확도 성능을 요구한다. 이러한 조건들을 충족하기 위해, 영상의 각 행에서 도로 시차 값을 계산하여 주행 가능 영역을 검출하는 V-시차 기반 방법이 폭넓게 사용된다. 그러나 V-시차 기반 방법은 시차 값이 정확하지 않거나 객체의 시차 값이 도로의 시차 값과 동일한 경우, 도로가 아닌 영역을 도로로 오검출할 수 있다. 또한, 고속도로 및 시골길과 같이, 초목을 포함한 도로 환경에서 초목의 시차는 도로의 시차 특성과 매우 유사하기 때문에 초목 영역이 주행 가능 영역으로 오검출될 수 있다. 이에 본 논문에서는 V-시차의 특성으로 인한 오검출 횟수를 감소시킴으로써 초목 영역을 포함한 도로 환경에서 높은 정확도를 갖는 주행 가능 영역 검출 방법 및 하드웨어 구조를 제안한다. 제안하는 방법의 성능을 평가하기 위해 KITTI road dataset의 289장 영상을 사용하였을 때, 제안하는 방법은 90.12%의 정확도와 97.96%의 재현율을 보인다. 또한, 제안하는 하드웨어 구조를 FPGA 플랫폼에 구현하였을 때, 제안하는 하드웨어 구조는 8925개의 slice registers와 7066개의 slice LUTs를 사용한다.

전역 토픽의 지역 매핑을 통한 효율적 토픽 모델링 방안 (Efficient Topic Modeling by Mapping Global and Local Topics)

  • 최호창;김남규
    • 지능정보연구
    • /
    • 제23권3호
    • /
    • pp.69-94
    • /
    • 2017
  • 최근 빅데이터 분석 수요의 지속적 증가와 함께 관련 기법 및 도구의 비약적 발전이 이루어지고 있으며, 이에 따라 빅데이터 분석은 소수 전문가에 의한 독점이 아닌 개별 사용자의 자가 수행 형태로 변모하고 있다. 또한 전통적 방법으로는 분석이 어려웠던 비정형 데이터의 활용 방안에 대한 관심이 증가하고 있으며, 대표적으로 방대한 양의 텍스트에서 주제를 도출해내는 토픽 모델링(Topic Modeling)에 대한 연구가 활발히 진행되고 있다. 전통적인 토픽 모델링은 전체 문서에 걸친 주요 용어의 분포에 기반을 두고 수행되기 때문에, 각 문서의 토픽 식별에는 전체 문서에 대한 일괄 분석이 필요하다. 이로 인해 대용량 문서의 토픽 모델링에는 오랜 시간이 소요되며, 이 문제는 특히 분석 대상 문서가 복수의 시스템 또는 지역에 분산 저장되어 있는 경우 더욱 크게 작용한다. 따라서 이를 극복하기 위해 대량의 문서를 하위 군집으로 분할하고, 각 군집별 분석을 통해 토픽을 도출하는 방법을 생각할 수 있다. 하지만 이 경우 각 군집에서 도출한 지역 토픽은 전체 문서로부터 도출한 전역 토픽과 상이하게 나타나므로, 각 문서와 전역 토픽의 대응 관계를 식별할 수 없다. 따라서 본 연구에서는 전체 문서를 하위 군집으로 분할하고, 각 하위 군집에서 대표 문서를 추출하여 축소된 전역 문서 집합을 구성하고, 대표 문서를 매개로 하위 군집에서 도출한 지역 토픽으로부터 전역 토픽의 성분을 도출하는 방안을 제시한다. 또한 뉴스 기사 24,000건에 대한 실험을 통해 제안 방법론의 실무 적용 가능성을 평가하였으며, 이와 함께 제안 방법론에 따른 분할 정복(Divide and Conquer) 방식과 전체 문서에 대한 일괄 수행 방식의 토픽 분석 결과를 비교하였다.