• 제목/요약/키워드: 유사도 측정

검색결과 5,603건 처리시간 0.04초

다양한 언어적 자질을 고려한 발화간 유사도 측정 방법 (A Method for Measuring Inter-Utterance Similarity Considering Various Linguistic Features)

  • 이연수;신중휘;홍금원;송영인;이도길;임해창
    • 한국음향학회지
    • /
    • 제28권1호
    • /
    • pp.61-69
    • /
    • 2009
  • 본 연구는 예제 기반 대화 시스템에서 응답을 결정하기 위한 핵심 요소 기술 중 하나인 발차간 유사도 측정 방법의 개선에 대해 논한다. 일반적인 문장간 유사도 측정과는 달리, 대화에서 발차간 유사도 측정은 단어 분포간 유사도 뿐만 아니라, 문형, 시제, 긍/부정, 양태등 대화 자연스러움을 결정하는 문장의 다양한 언어적 요소 역시 중요하게 고려되어야 한다. 그러나 기존 연구에서는 이에 대한 고려가 부족 했던 것이 사실이며, 따라서 본 연구에서는 개선 방안으로서 발화의 형태적 유사성 뿐 아니라 다양한 언어적 자질들을 분석하고 이를 유사도 측정에 반영하여 정확도를 향상시키는 새로운 유사도 측정 방법을 제안한다. 또한, 발차의 자질별 유사도를 고려함으로써, 한정된 수의 예제들의 활용도를 높일 수 있는 방법을 제안하였다. 실험 결과 제안하는 방법이 기존 방식에 비해 10%p 이상 정확도 성능 향상이 있었다.

문헌 클러스터링을 위한 유사계수간의 연관성 측정 (A Measurement of Relationship among Similarity Coefficients for Document Clustering)

  • 한승희;이재윤
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 1999년도 제6회 학술대회 논문집
    • /
    • pp.25-28
    • /
    • 1999
  • 자동분류나 정보검색에 주로 이용되는 문헌 클러스터링에서는 문헌간의 유사성을 측정하기 위해 다양한 유사계수를 이용하는데, 모든 유사계수가 동일한 클러스터링 결과를 가져오는 것은 아니다. 본고에서는 50건의 신문기사를 대상으로 SPSS 통계 패키지를 이용하여 다양한 유사계수에 각각 달라지는 문헌 클러스터링의 결과를 살펴본 후, 유사계수간의 연관성을 측정하였다.

  • PDF

AST를 이용한 프로그램 유사도 평가 시스템 설계 (A Design of the Similarity Evaluation System using Abstract Syntax Tree)

  • 정재은;김영철;김상헌;유재우
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 1999년도 가을 학술발표논문집 Vol.26 No.2 (1)
    • /
    • pp.430-432
    • /
    • 1999
  • 본 논문에서는 AST(Abstract Syntax Tree)를 이용하여 서로 다른 프로그램의 유사도를 측정하는 방법을 제시한다. 지금까지 유사도 평가 방법은 거의 제시되지 않고 프로그램의 비교평가 연구는 찾아볼 수가 없다. 본 시스템은 서로 다른 여러 프로그램을 입력받아 파싱함으로써 AST를 생성하여 생성된 AST를 유사도 측정에 이용한다. 따라서 다른 비교 측정 시스템보다 비용과 속도 면에서 경제적이고 빠르게 유사도를 검출해 낼 수 있으며, 또한 신속히 평가 결과를 학생들에게 피드백 함으로써 큰 학습성과를 기대할 수 있다.

  • PDF

수리실험을 통한 통제된 유사 조건에서의 횡방향 초음파도플러유속계 초음파산란도 활용 부유사농도 분포 및 평균 입경 분석 (Representation of spatial variation and particle mean size for suspended sediment using acoustic backscatter in controlled channel experiments)

  • 손근수;김종민;강우철
    • 한국수자원학회:학술대회논문집
    • /
    • 한국수자원학회 2022년도 학술발표회
    • /
    • pp.252-252
    • /
    • 2022
  • 최근 기존의 전통적인 부유사채집기를 활용한 유사량 측정방법의 대안으로 지속적인 유량측정을 목적으로 활용되고 있는 횡방향 초음파도플러유속계의 초음파산란도를 활용하여 부유사농도를 측정에 대한 연구가 수행되고 있다. 하지만, 하천에서 횡방향 초음파도플러유속계를 활용한 유사량 측정 연구는 현장에서 측정된 자료를 기반으로 분석이 수행되기 때문에 통제된 유사 조건에서의 유사의 농도 및 입도분포에 대한 사전 정보를 바탕으로 정밀한 분석의 어려움이 있다. 이에 본 연구에서는 안동하천실험센터 순환수로에서 균일한 입도를 가지고 있는 황토를 활용하여 주입량에 따른 초음파산란도의 변화와 동시에 측정된 LISST(laser in-situ scattering and transmissometry)의 부유사 농도와 입도 자료를 활용하여 유사공급에 따른 3Mhz의 단일 주파수를 사용하는 횡방향 초음파도플러유속계의 초음파산란도를 활용한 부유사농도 및 평균입경의 측정에 대한 연구를 수행하였다. 측정결과, 유사공급에 따라서 초음파산란도를 활용하여 부유사농도가 증가하는 경향을 나타내고 있었으며, 횡방향 초음파도플러유속계로부터 측정된 셀별 초음파산란도를 활용하여 부유사농도의 공간적인 분포의 분석이 가능함을 확인할 수 있었다. 그리고 유사감쇄계수를 활용하여 LISST로부터 측정된 평균입경과의 관계식을 개발하여 유사공급에 따른 평균입경의 변화를 측정할 수 있을 것으로 나타났다. 추후, 통제된 조건에서의 다양한 입도분포에 따른 실험을 통해 횡방향 초음파도플러유속계의 초음파산란도를 활용한 부유사농도 측정 정확도를 개선과 유사감쇄계수를 통해 평균입경을 측정하는데 활용이 될 것으로 판단된다.

  • PDF

사용자 기반의 협력필터링 시스템을 위한 유사도 측정의 최적화 (Optimization of the Similarity Measure for User-based Collaborative Filtering Systems)

  • 이수정
    • 컴퓨터교육학회논문지
    • /
    • 제19권1호
    • /
    • pp.111-118
    • /
    • 2016
  • 협력 필터링 기반의 추천시스템에서 유사도 측정은 시스템의 성능에 큰 영향을 미치는데, 이는 유사한 다른 사용자들로부터 항목을 추천받기 때문이다. 본 연구에서는 전통적인 유사도 측정 방법의 가장 큰 문제인 데이터 희소성을 극복하기 위해, 기존의 유사도 측정값과 공통평가항목수의 반영값을 최적으로 결합하는 새로운 유사도 측정방식을 제안한다. 제안 방식의 성능 평가를 위해 다양한 조건으로 실험한 결과 기존 방식들보다 우수한 예측 정확도를 나타냈으며, 구체적으로 전통적인 피어슨 상관보다 최대 약 7%, 코사인 유사도보다는 최대 약 4% 향상된 결과를 보였다.

상품 분류 체계를 고려한 구매이력 유사도 측정 기법 (Purchase Transaction Similarity Measure Considering Product Taxonomy)

  • 양유정;이기용
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제8권9호
    • /
    • pp.363-372
    • /
    • 2019
  • 시퀀스란 두 항목 간의 순서가 존재하는 데이터를 말하며, 고객 한 명이 구매한 상품들이 나열된 구매이력 데이터는 대표적인 시퀀스 데이터 중 하나이다. 일반적으로 모든 상품은 대분류/ 중분류/ 소분류와 같은 상품 분류 체계를 가지며, 서로 다른 상품이더라도 비슷하다면 그 특성에 따라 동일한 범주로 분류된다. 따라서 본 논문에서는 두 구매이력 시퀀스 비교 시 상품의 구매 순서를 고려할 뿐만 아니라, 비교하고자 하는 두 상품이 다르더라도 서로 동일한 상품 군에 속한다면 더 높은 유사도를 부여하여 계산한다. 특히 구매이력 시퀀스 유사도 계산 성능에 직접적인 영향을 미치는 시퀀스 유사도 측정 방법을 선택하기 위해 본 연구에서는 대표적인 시퀀스 간 유사도 측정 방법인 레벤슈타인 거리, 동적 타임 워핑 거리, 니들만-브니쉬 유사도의 성능을 비교하였으며, 항목간의 계층구조도 반영하여 계산하도록 확장하였다. 기존의 유사도 측정 방법의 경우 시퀀스 내 상품 비교 시 상품의 일치 유무에 따라 단순히 0 또는 1의 값을 부여하여 계산한다. 하지만 제안 방법의 경우 서로 다른 상품이더라도 두 상품 간의 연관정도를 다르게 부여하기 위하여 상품 분류 트리를 사용하여 0에서 1 사이의 값을 가지도록 세분화하였다. 실험을 통해 세 알고리즘에 제안 방법을 적용한 경우 기존 방법에 비하여 구매이력 시퀀스 간의 유사도를 더 정확히 측정함을 확인하였다. 또한 정확성 측정 비교 실험을 통해 동적 타임 워핑 유사도가 다른 두 유사도 측정 방법에 비하여 시퀀스 내 상품의 연관 정도를 고려할 뿐만 아니라 두 시퀀스의 길이가 다른 경우에도 좋은 성능을 보였기 때문에 구매이력 데이터에서 시퀀스 간의 유사도 비교 시 가장 적합한 측정 방법임을 확인하였다.

2021년 유사량 조사 및 특성분석 (2021 Sediment discharge survey and analysis of characteristics)

  • 이대웅;이정훈;최홍윤;이충대;이신재
    • 한국수자원학회:학술대회논문집
    • /
    • 한국수자원학회 2022년도 학술발표회
    • /
    • pp.427-427
    • /
    • 2022
  • 하천에서 유사량 자료는 하천의 이·치수 목적으로 활용할 수 있는 기본 자료중 하나로서 하상 변동 예측, 저수지 퇴사량 추정, 하도 계획과 설계, 유사조절 계획 수립 및 기타 구조물 등의 영향 평가 등 다양하게 활용할 수 있다. 본 연구에서는 신뢰성 높은 유사량 자료를 생산하기 위하여 국가유사량관측망 중 27개 지점에 대하여 유사량의 측정 및 특성분석을 수행하였다. 유사량 측정과정은 사전조사, 현장측정, 실험실분석, 모형적용(총유사량 산정) 단계로 구분할 수 있다. 사전조사 단계에서는 현장관련 정보를 수집하여 현장측정 계획 및 현장 안전대책을 수립하고, 현장측정 단계에서는 사전조사 단계에서 수립한 계획을 바탕으로 유사량을 측정하였다. 유사량 측정시 측선은 ISO 기준 이상의 5~7개로 측선을 나누어 측정하였고, 측정장비는 D-74, DH-48 부유사 채취기를 이용하여 왕복수심적분법으로 수행하였다. 실험실분석은 한국수자원조사기술원 유사량 실험실에서 채취시료에 대한 농도, 레이저회절법을 이용한 입도분석, 하상토분석(체분석), 비중실험을 수행하였다. 총유사량 산정을 위한 모형적용 단계에서는 수정-아인슈타인법(Modified Einstein Method)을 적용하였다. 또한, 유량-부유사량 농도 변화양상과 부유사량 특성 분석을 이용한 부유사량 측정결과를 평가하였고 각 지점의 부유사량특성을 잘 나타낼 수 있는 지수식(Qss = aQb)을 이용하여 유량-부유사량관계곡선식을 개발하였다.

  • PDF

위상한정상관을 이용한 화상의 유사도 측정 (Measurement of Similarity between Images Using Phase Only Correlation)

  • 이충호;김응규
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 가을 학술발표논문집 Vol.29 No.2 (2)
    • /
    • pp.580-582
    • /
    • 2002
  • 본 논문은 위상한정상관법을 이용하여 겹쳐진 화상이 둘 중 어떤 화상에 더 유사한 지를 정량적으로 측정하는 알고리듬을 제안한다. 제안된 알고리듬은 화상을 푸리에변환하여 위상만을 가지고 합성화상을 만든 다음 역푸리에변환을 통하여 만들어지는 위상한정상관을 가지고 유사도를 측정한다. 본 알고리듬에서는 유사도를 충분히 구분할 수 있을 정도로 상수로 설정된 진폭을 충분히 크게 하고 중심부분이외에 나타나는 피크치를 무시하고 오직 중심부분 만의 피크치를 원화상의 자기상관과 비교한다. 실험결과는 진폭을 100으로 하였을 경우 위상한정상관의 피크는 그 유사도가 1에서 0까지 변함에 따라서 100에서 40까지변하는 것을 보여 준다. 이것은 제안된 알고리듬이 위상한정상관을 이용하여 화상의 유사도를 정량적으로 효과적으로 측정하는데 사용될 수 있음을 보여준다.

  • PDF

의미 유사도를 활용한 Distant Supervision 기반의 트리플 생성 성능 향상 (Improving The Performance of Triple Generation Based on Distant Supervision By Using Semantic Similarity)

  • 윤희근;최수정;박성배;박세영
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2015년도 제27회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.23-28
    • /
    • 2015
  • 본 논문에서는 한국어 트리플 생성 시스템의 정확도를 향상시키기 위한 distant supervision 기반의 신뢰도 측정 방법을 제안한다. 기존의 많은 패턴 기반의 트리플 생성 시스템에는 distant supervision의 기본 가정으로 인해 다수의 오류 패턴이 발생할 여지가 크다. 기존의 연구에서는 오류 패턴을 제거하기 위하여 발생 빈도, 공기 횟수 등의 통계에 기반하여 간접적으로 신뢰도를 측정하였다. 본 논문에서는 한국어 패턴과 영어 프로퍼티 사이의 의미 유사도를 측정함으로써 통계에 기반한 방법보다 더 정확한 신뢰도 측정 방법을 제안한다. 비지도 학습 방법인 워드임베딩을 활용하여 어휘의 의미를 학습하고, 이들 사이의 유사도를 측정한다. 한국어 패턴과 영어 프로퍼티의 어휘 불일치 문제를 해결하기 위하여 정준상관분석을 활용하였다. 실험 결과에 따르면 본 논문에서 제안한 패턴 신뢰도 측정 방법은 통계 기반의 방법에 비해 정확률이 9%나 더 높은 트리플 집합을 생성함을 보여주어, 의미 유사도를 반영한 신뢰도 측정이 기존의 통계 기반 신뢰도 측정보다 고품질 트리플 생성에 더 적합함을 확인하였다.

  • PDF

다국어 공통 음소 체계를 이용한 금기어 매칭 시스템 (Taboo Word Matching System Using a Common Multilingual Phoneme System)

  • 김다희;신사임;장달원;이종설;장세진
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송공학회 2015년도 하계학술대회
    • /
    • pp.155-158
    • /
    • 2015
  • 단어의 유사도 측정 알고리즘은 DB 인덱싱, 필터링, 소스코드 분석 소프트웨어, 음성 인식 등 다양한 분야에서 활용되고 있다. 하지만 기존의 단어의 유사도만 비교하는 시스템에는 발음이 비슷한 유사단어나 오타가 있는 유사단어들은 측정을 못하는 단점이 있다. 언어의 유사도 측정에서는 알파벳만으로 볼게 아니라 언어 발음의 발화적 특성 또한 고려되어야 한다. 본 논문에서는 글로벌 시장에서의 다국적 기업들의 제품이나 문화 수출 등의 도움이 되는 각 나라의 금기어와의 발화적 특성까지 고려한 단어 유사도를 측정 할 수 있는 시스템을 제안한다. 11개국의 4개 언어 총 21487개의 금기어 단어를 금기어 데이터로 사용하였다. 제안하는 방법의 성능을 평가하기 위하여 타 알고리즘과의 성능비교와 여러 나라의 다양한 언어의 사용자들로부터 사용자 평가를 수행하였고 제안하는 방법이 발음 유사도를 측정하지 않는 알고리즘보다 우수한 성능을 보임을 확인하였다.

  • PDF