• 제목/요약/키워드: 인식기 융합

검색결과 229건 처리시간 0.022초

한국어 SNS 문서에 적합한 문장 경계 인식 (Robust Sentence Boundary Detection for Korean SNS Documents)

  • 염하람;김재훈
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2021년도 제33회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.532-535
    • /
    • 2021
  • 다양한 SNS 플랫폼이 등장하고, 이용자 수가 급증함에 따라 온라인에서 얻을 수 있는 정보의 활용 가치가 높아지고 있다. 문장은 자연어 처리 시스템의 기본적인 단위이므로 주어진 문서로부터 문장의 경계를 인식하는 작업이 필수적이다. 공개된 문장 경계 인식기는 SNS 문서에서 좋은 성능을 보이지 않는다. 본 논문에서는 문어체로 구성된 일반 문서뿐 아니라 SNS 문서에서 사용할 수 있는 문장 경계 인식기를 제안한다. 본 논문에서는 SNS 문서에 적용하기 위해 다음과 같은 두 가지를 개선한다. 1) 학습 말뭉치를 일반문서와 SNS 문서 두 영역으로 확장하고, 2) 이모티콘을 사용하는 SNS 문서의 특징을 반영하는 어절의 유형을 자질로 추가하여 성능을 개선한다. 실험을 통해서 추가된 자질의 기여도를 분석하고, 또한 기존의 한국어 문장 경계 인식기와 제안한 모델의 성능을 비교·분석하였다. 개선된 모델은 일반 문서에서 99.1%의 재현율을 보이며, SNS 문서에서 88.4%의 재현율을 보였다. 두 영역 모두에서 문장 경계 인식이 잘 이루어지는 것을 확인할 수 있었다.

  • PDF

복잡한 컬러 문서에 대한 문자인식 (A Character Recognition on Complex Color Documents)

  • 양철용;김갑기;김진욱;김항준
    • 융합신호처리학회 학술대회논문집
    • /
    • 한국신호처리시스템학회 2000년도 하계종합학술대회논문집
    • /
    • pp.233-236
    • /
    • 2000
  • 최근 수많은 인쇄된 문서들이 HTML과 같은 디지털 문서로 바뀌고 있으며 이를 자동으로 변환해 주는 문자인식 기술에 대한 관심이 증가하고 있다. 본 논문에서는 그림과 글자가 공존하는 문서에서 자동으로 문자영역을 추출해서 문자를 인식하는 방법을 제안한다. 우선 입력문서는 유사한 칼라로 이루어진 영역들로 나누어진 뒤 휴리스틱 룰에 의해 문자후보 영역과 비 문자 영역으로 나누어진다. 그 다음 이들 문자후보영역들은 문자인식기를 이용하여 문자 혹은 문자의 일부분으로 인식된다. 제안된 방법으로 여러 문서들에 대하여 실험한 결과를 보이며 그 성능을 평가한다.

  • PDF

다중 분류기의 판정단계 융합에 의한 얼굴인식 (Multi-classifier Decision-level Fusion for Face Recognition)

  • 염석원
    • 대한전자공학회논문지SP
    • /
    • 제49권4호
    • /
    • pp.77-84
    • /
    • 2012
  • 얼굴인식 기술은 지능형 보안, 웹에서 콘텐츠 검색, 지능로봇의 시각부분, 머신인터페이스 등, 활용이 광범위 하다. 그러나 일반적으로 대상자의 표정과 포즈 변화, 주변의 조명 환경과 같은 문제가 있으며 이와 더불어 원거리에서 획득한 영상의 경우 저해상도를 비롯하여 블러와 잡음에 의한 영상의 열화 등의 여러 가지 어려움이 발생한다. 본 논문에서는 포톤 카운팅(Photon-counting) 선형판별법(Linear Discriminant Analysis)을 이용한 다중 분류기(Classifier)에 의한 판정을 융합하여 얼굴 영상 인식을 수행한다. Fisher 선형판별법은 집단 간 분산을 최대로 하고 집단 내 분산을 최소로 하는 공간으로 선형 투영하는 방법으로, 학습영상의 수가 적을 경우 특이행렬 문제가 발생하지만 포톤카운팅 선형 판별법은 이러한 문제가 없으므로 차원축소를 위한 전 처리 과정이 필요 없다. 본 논문의 다중 분류기는 포톤 카운팅 선형판별법의 유클리드 거리(Euclidean Distance) 또는 정규화된 상관(Normalized Correlation)을 적용하는 판정규칙에 따라 구성된다. 다중분류기의 판정의 융합은 각 분류기 cost의 정규화(Normalization), 유효화(Validation), 그리고 융합규칙(Fusion Rule)으로 구성된다. 각 분류기에서 도출된 cost는 같은 범위로 정규화된 후 유효화 과정에서 선별되고 Minimum, 또는 Average, 또는 Majority-voting의 융합규칙에 의하여 융합된다. 실험에서는 원거리에서 획득한 효과를 구현하기 위하여 고해상도 데이터베이스 영상을 인위적으로 Unfocusing과 Motion 블러를 이용하여 열화하여 테스트하였다. 실험 결과는 다중분류기 융합결과의 인식률은 단일분류기보다 높다는 것을 보여준다.

고유얼굴에 의한 얼굴인식 (Face Recognition using Eigenface)

  • 박중조;김경민
    • 융합신호처리학회논문지
    • /
    • 제2권2호
    • /
    • pp.1-6
    • /
    • 2001
  • 고유얼굴 방법에 의한 얼굴인식은 얼굴 표정의 변화에 둔감한 유용한 인식기법이나 인식률이 낮아 지속적인 연구가 필요한 실정이다. 본 논문에서는 고유얼굴 특징을 이용한 얼굴인식에 있어서 인식률 개선을 위한 효과적인 방안을 제시한다. 이를 위해 본 연구에서는 고유얼굴 특징에 대해 세 종류의 분류기-단일원형 분류기, 최소거리 분류기, 신경회로망 분류기-를 사용하여 그 성능을 평가하고 분석함으로써 고유얼굴 특징의 분포 특성을 고찰하고, 분류기 및 학습용 샘플 영상의 선정이 인식률 제고에 큰 영향을 미침을 보인다. ORL 얼굴영상 데이터베이스를 사용하여 실험한 결과 최소거리 분류기가 가장 좋은 인식률을 나타내었으며, 학습용 샘플영상의 선정과 최소거리 분류기에 의해 91.0%의 인식률을 달성하였다.

  • PDF

비디오 행동 인식을 위하여 다중 판별 결과 융합을 통한 성능 개선에 관한 연구 (A Study for Improved Human Action Recognition using Multi-classifiers)

  • 김세민;노용만
    • 방송공학회논문지
    • /
    • 제19권2호
    • /
    • pp.166-173
    • /
    • 2014
  • 최근 다양한 방송 및 영상 분야에서 사람의 행동을 인식하여는 연구들이 많이 이루어지고 있다. 영상은 다양한 형태를 가질 수 있기 때문에 제약된 환경에서 유용한 템플릿 방법들보다 특징점에 기반한 연구들이 실제 사용자 환경에서 더욱 관심을 받고 있다. 특징점 기반의 연구들은 영상에서 움직임이 발생하는 지점들을 찾아내어 이를 3차원 패치들로 생성한다. 이를 이용하여 영상의 움직임을 히스토그램에 기반한 descriptor(서술자)로 표현하고 학습기반의 판별기로 최종적으로 영상내에 존재하는 행동들을 인식하였다. 그러나 단일 판별기로는 다양한 행동을 인식하기에 어려움이 있다. 따라서 이러한 문제를 개선하기 위하여 최근에 다중 판별기를 활용한 연구들이 영상 판별 및 물체 검출 영역에서 사용되고 있다. 따라서 본 논문에서는 행동 인식을 위하여 support vector machine과 sparse representation을 이용한 decision-level fusion 방법을 제안하고자 한다. 제안된 논문의 방법은 영상에서 특징점 기반의 descriptor를 추출하고 이를 각각의 판별기를 통하여 판별 결과들을 획득한다. 이 후 학습단계에서 획득된 가중치를 활용하여 각 결과들을 융합하여 최종 결과를 도출하였다. 본 논문에 실험에서 제안된 방법은 기존의 융합 방법보다 높은 행동 인식 성능을 보여 주었다.

일반국도의 지점 및 구간검지기 자료의 융합을 통한 통행시간 추정 알고리즘 개발 (A Link Travel Time Estimation Algorithm Based on Point and Interval Detection Data over the National Highway Section)

  • 김성현;임강원;이영인
    • 대한교통학회지
    • /
    • 제23권5호
    • /
    • pp.135-146
    • /
    • 2005
  • 현재까지 다양한 검지기로부터 추정되는 통행시간의 융합에 관한 연구는 주로 GPS, Probe 자료 등 간헐적인 자료에 기반하여 이루어져 왔다. 이러한 간헐적 자료의 분산비에 기초한 융합모형은 번호판 인식 AVI와 같이 다량의 자료 구득이 용이한 시스템에는 적합하지 않다. 따라서, 본 연구는 지점검지기와 번호판 인식 AVI를 기반으로 각각 산출한 통행시간의 융합모형을 개발하고자 수행되었다. 본 연구에서는 지점검지기와 번호판인식 AVI 통행시간의 융합을 위해 최적화 융합모형과 비례화 융합모형을 각각 개발하였다. 검증 결과, 최적화 융합모형이 가장 우수한 추정력을 보여주었다. 최적화 융합모형은 실시간 이력자료를 기반으로 융합 가중치를 산정하여 현재 시간대에 적용하는 실시간 차원의 동적 융합비 예측 모형이다. 본 연구결과는 향후 국도교통관리 및 정보제공시스템에 유용하게 적용될 것으로 기대된다. 그러나, 향후 AVI의 적정설치간격과 설치차로에 따른 매칭율을 고려한 보다 심도있는 연구를 필요로 한다.

무제한 단어 음성인식을 위한 모음열 사전의 구축 (A construction of vowel string dictionary for unlimited word speech recognition)

  • 김동환;윤재선;홍광석
    • 융합신호처리학회 학술대회논문집
    • /
    • 한국신호처리시스템학회 2000년도 하계종합학술대회논문집
    • /
    • pp.177-180
    • /
    • 2000
  • 기존의 제한적 단어 인식과는 달리 무제한 단어 음성인식에 있어서는 방대한 용량의 단어 모델을 참조로 인식이 이루어지게 되어, 참조모델과 입력패턴과의 비교를 위한 탐색시간이 너무 길어지게 된다. 본 논문에서 제한하는 방법은 무제한 단어 음성인식 시스템을 구축하기 위해 선행되어야 하는 모음열 사전을 구축하는 것이다. 음성인식시 입력패턴과 참조모델에 속한 모든 단어와의 비교를 수행하지 않고, 입력패턴의 모음열을 인식한 후, 인식된 모음열 단어들만을 참조모델에서 인식 후보로 두어 인식을 수행하게 하여 시간적인 측면에서의 효율성을 기하는 것이다. 결과적으로 본 연구 방법은 무제한 단어 음성인식에서의 실시간 처리라는 점에 주 목적을 두었다.

  • PDF

수정된 카오스 신경망을 이용한 무제약 서체 숫자 인식 (Recognition of Unconstrained Handwritten Numerals using Modified Chaotic Neural Networks)

  • 최한고;김상희;이상재
    • 융합신호처리학회논문지
    • /
    • 제2권1호
    • /
    • pp.44-52
    • /
    • 2001
  • 본 논문은 수정된 카오틱 신경망(MCNN)을 이용하여 완전 무제약 서체 숫자 인식을 다루고 있다. 카오틱 신경망(CNN)의 동적 특성과 학습과정을 강화함으로써 복잡한 패턴인식 문제를 해결할 수 있는 유용한 신경망으로 수정하였다. MCNN은 신경망 구조와 뉴런 자체가 높은 차수의 비선형 동적특성을 갖고 있으므로 복잡한 서체 숫자를 분류할 수 있는 적합한 신경망이다. 숫자 확인은 원래의 숫자 이미지로부터 특징을 추출하고 MCNN에 근거한 분류기를 이용하여 숫자를 인식한다. MCNN 분류기의 성능은 Canada, Montreal의 Concordia 대학의 숫자 데이터 베이스로 평가하였다. 인식성능의 상대적인 비교를 위해 MCNN 분류기는 리커런트 신경망(RNN) 분류기와 비교하였다. 실험결과에 의하면 인식율은 98.0%이었으며, 이는 MCNN 분류기가 같은 데이터 베이스에 대해 발표되었던 다른 분류기와 RNN 분류기보다 성능이 우수함을 나타낸다.

  • PDF

SVM 분류기를 이용한 필기체 숫자인식 (Recognition of Handwritten Numerals using SVM Classifiers)

  • 박중조;김경민
    • 융합신호처리학회논문지
    • /
    • 제8권3호
    • /
    • pp.136-142
    • /
    • 2007
  • 최근의 인식 시스템 연구들에 의하면 SVM 분류기가 여러 다른 분류기에 비해 우수한 인식 성능을 나타내고 있다. 이에 본 논문에서는 SVM 분류기를 사용하여 필기체 숫자를 인식하는 알고리즘을 제시한다. 본 기법에서는 필기체 숫자의 특징으로서 망특징과 Kirsch 연산자에 의한 방향 특징 및 오목특징을 사용하는데, 이중에서 처음 두 특징은 숫자를 이루는 선에 대한 전경 정보를 표현하며, 마지막 특징은 숫자의 배경 정보를 표현하여 상호 보완적인 역학을 수행한다. 본질적으로 SVM은 두 클래스 분류기이므로 이를 다중 클래스 분류기로 사용하기 위해서는 여러 개의 SVM들을 결합하여 사용해야 하는데, 본 논문에서는 "일대일" 방법과 "일대다" 방법을 사용하여 주어진 특징에 대한 인식을 수행하였다. 제시된 기법의 성능 평가를 위해 CENPARMI 필기체 숫자 데이터베이스를 사용하여 실험하였으며, 그 결과 98.45%의 인식률을 얻을 수 있었다.

  • PDF

AI면접 대상자에 대한 다면적 평가방법론 -얼굴인식, 음성분석, 자연어처리 영역의 융합 (Multifaceted Evaluation Methodology for AI Interview Candidates - Integration of Facial Recognition, Voice Analysis, and Natural Language Processing)

  • 지현욱;이상진;문성민;이재열;이동은;임규상
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2024년도 제69차 동계학술대회논문집 32권1호
    • /
    • pp.55-58
    • /
    • 2024
  • 최근 각 기업의 AI 면접시스템 도입이 증가하고 있으며, AI 면접에 대한 실효성 논란 또한 많은 상황이다. 본 논문에서는 AI 면접 과정에서 지원자를 평가하는 방식을 시각, 음성, 자연어처리 3영역에서 구현함으로써, 면접 지원자를 다방면으로 분석 방법론의 적절성에 대해 평가하고자 한다. 첫째, 시각적 측면에서, 면접 지원자의 감정을 인식하기 위해, 합성곱 신경망(CNN) 기법을 활용해, 지원자 얼굴에서 6가지 감정을 인식했으며, 지원자가 카메라를 응시하고 있는지를 시계열로 도출하였다. 이를 통해 지원자가 면접에 임하는 태도와 특히 얼굴에서 드러나는 감정을 분석하는 데 주력했다. 둘째, 시각적 효과만으로 면접자의 태도를 파악하는 데 한계가 있기 때문에, 지원자 음성을 주파수로 환산해 특성을 추출하고, Bidirectional LSTM을 활용해 훈련해 지원자 음성에 따른 6가지 감정을 추출했다. 셋째, 지원자의 발언 내용과 관련해 맥락적 의미를 파악해 지원자의 상태를 파악하기 위해, 음성을 STT(Speech-to-Text) 기법을 이용하여 텍스트로 변환하고, 사용 단어의 빈도를 분석하여 지원자의 언어 습관을 파악했다. 이와 함께, 지원자의 발언 내용에 대한 감정 분석을 위해 KoBERT 모델을 적용했으며, 지원자의 성격, 태도, 직무에 대한 이해도를 파악하기 위해 객관적인 평가지표를 제작하여 적용했다. 논문의 분석 결과 AI 면접의 다면적 평가시스템의 적절성과 관련해, 시각화 부분에서는 상당 부분 정확도가 객관적으로 입증되었다고 판단된다. 음성에서 감정분석 분야는 면접자가 제한된 시간에 모든 유형의 감정을 드러내지 않고, 또 유사한 톤의 말이 진행되다 보니 특정 감정을 나타내는 주파수가 다소 집중되는 현상이 나타났다. 마지막으로 자연어처리 영역은 면접자의 발언에서 나오는 말투, 특정 단어의 빈도수를 넘어, 전체적인 맥락과 느낌을 이해할 수 있는 자연어처리 분석모델의 필요성이 더욱 커졌음을 판단했다.

  • PDF