• 제목/요약/키워드: 유사성 측정

검색결과 2,973건 처리시간 0.038초

OWL 속성을 이용한 온톨로지 간 의미 유사도 측정 방법 (Similarity Measure between Ontologies using OWL Properties)

  • 안우식;박정은;오경환
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2006년도 한국컴퓨터종합학술대회 논문집 Vol.33 No.1 (B)
    • /
    • pp.169-171
    • /
    • 2006
  • 인터넷이 보다 대중화되고 광범위해지면서 의미적 관계에 따라 정보를 저장하는 온톨로지 시스템이 미래의 지능적인 컴퓨터를 위한 적절한 수단으로 각광받고 있다. 하지만 온톨로지와 같은 메타 데이터를 사용한 방법은 그 사용 목적 또는 작성자의 개인적인 관점에 따라 다양한 이질적인(heterogeneous) 형태를 띠게 된다. 이러한 이질적인 정보들은 데이터가 다른 시스템에서 처리되는 것을 어렵게 한다. 정보의 상호운용성을 보장하기 위해서는 서로 다른 온톨로지 시스템간의 개체에 대한 유사도를 평가할 수 있어야 한다. 따라서 두 개의 다른 OWL 언어로 정의된 온톨로지 사이에서 두 개의 엔티티의 유사도를 측정하기 위한 새로운 유사도 척도(similarity measure)를 제안하였다. 이는 온톨로지 상의 이질적인 정보를 통합하는데 사용되며, 온톨로지 비교(comparison), 정렬(alignment), 매칭(matching) 그리고 병합(merging)의 기반이 되는 중요한 기법이다. 새로운 유사도 척도는 특정한 매핑 정보를 사용하지 않고 온톨로지 언어의 속성을 기반으로 하므로 OWL을 사용한 온톨로지 간의 유사도 검색에 곧바로 적용될 수 있는 장점을 지닌다.

  • PDF

U-WIN을 이용한 의미 유사도 측정과 활용 (A Measure of Semantic Similarity and its Application in User-Word Intelligent Network)

  • 임지희;배영준;최호섭;옥철영
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2007년도 한국컴퓨터종합학술대회논문집 Vol.34 No.1 (C)
    • /
    • pp.189-193
    • /
    • 2007
  • 개념 간의 유사도 측정 방법은 의미망에서의 두 개념의 최단 경로의 수 노드의 깊이 관계의 종류 등의 정보를 이용하는 링크(Link) 기반 방법, 대용량의 말뭉치에서의 개념의 발생빈도를 확률로 계산한 정보량(Information Content) 기반 방법, 관련 단어들의 공기정보를 활용한 의미(Gloss) 기반 방법이 있으며, 이미 국외에서는 WordNet과 같은 의미적 언어자원을 활용하여 많은 연구가 진행되고 있다. 그러나 국내에서는 아직 한국어 의미망을 바탕으로 한 개념간의 유사성 측정 방법이나 이를 활용하는 방법에 대한 연구가 미흡하다. 본 논문에서는 이를 바탕으로 링크 타입 노드의 깊이 최단경로 정보량 등의 요소를 이용한 의미 유사도 측정방법을 제안하고 이를 활용하여 명사-용언간의 연계 정보를 확보함으로써, 효율적으로 명사-용언간의 네트워크를 구축하도록 한다.

  • PDF

딥러닝 기반 이미지 특징 추출 모델을 이용한 유사 디자인 검출에 대한 연구 (Detecting Similar Designs Using Deep Learning-based Image Feature Extracting Model)

  • 이병우;이우창;채승완;김동현;이충권
    • 스마트미디어저널
    • /
    • 제9권4호
    • /
    • pp.162-169
    • /
    • 2020
  • 디자인은 섬유패션 산업에서 제품의 경쟁력을 결정짓는 핵심요인이다. 무단복제를 방지하고 독창성을 확인하기 위하여 제시된 디자인의 유사도를 측정하는 것은 매우 중요하다. 본 연구에서는 딥러닝 기법을 이용하여 섬유 디자인의 이미지로 부터 특징(feature)을 수치화하고, 스피어만 상관계수를 이용하여 유사도를 측정하였다. 유사한 샘플이 실제로 검출되는지 검증하기 위하여 300장의 이미지를 임의로 회전 및 색상을 변경하였다. 유사도 수치가 높은 순으로 Top-3와 Top-5의 결과에 회전을 하거나 색상을 변경한 샘플이 존재하는지 측정하였다. 그 결과, AlexNet 보다 VGG-16 모델이 월등히 높은 성능을 기록하였다. VGG-16 모델의 성능은 회전 이미지의 경우에 유사도 결과값이 높은 Top-3와 Top-5에서 64%, 73.67%로 가장 높게 나타났다. 색상변경의 경우에는 Top-3와 Top-5에서 각각 86.33%, 90%로 가장 높게 나타났다.

정적 주요 경로 API 시퀀스를 이용한 소프트웨어 유사성 검사 (Detecting Software Similarity Using API Sequences on Static Major Paths)

  • 박성수;한환수
    • 정보과학회 논문지
    • /
    • 제41권12호
    • /
    • pp.1007-1012
    • /
    • 2014
  • 소스코드가 없이 실행코드만으로 소프트웨어 간의 유사성을 비교하기위해 소프트웨어 버스마크를 이용한다. 소프트웨어 버스마크란 그 소프트웨어만의 고유한 특징으로 소프트웨어 식별에 사용된다. 본 논문에서는 정적 주요경로 상의 API 함수 시퀀스를 이용하여 소프트웨어 간의 유사성을 산정하는 방법을 제시한다. 바이너리코드에서 소프트웨어의 특성이 뚜렷하게 나타나는 API 함수만을 사용하여 소프트웨어 유사성 검사의 신뢰성을 높이고, 정적 분석 기법에 동적 분석 기법의 특징을 적용하여 강인성을 높이는 방법을 모색하였다. 정적 분석으로 바이너리코드의 주요경로를 추출하고, API 함수 시퀀스 간의 효과적인 유사성 측정을 위해 서열정렬 알고리즘인 Smith-Waterman 알고리즘을 이용한 유사성 척도를 제안한다. 버스마크의 신뢰성을 평가하기 위하여 같은 프로그램의 여러 버전을 대상으로 실험하였고, 강인성을 평가하기 위해 오픈소스 소프트웨어의 소스코드를 다양한 컴파일환경으로 바꾸어 실험하였다.

재귀적 지역정렬을 이용한 프로그램 표절 탐색 (Source code Plagiarism Detection with Recursive Local Alignments)

  • 전명재;이평준;조환규
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2004년도 봄 학술발표논문집 Vol.31 No.1 (A)
    • /
    • pp.946-948
    • /
    • 2004
  • 지역정렬(local alignment)과 전체정렬(global alignment)로 대표되는 정렬 문제는 전산학 분야의 전형적인 문제로, 두 서열의 전체적인 또는 부문적인 유사성(similarity)을 찾아 주기 위한 방법이다. 특히 정렬은 두 문자열에서 유사하게 나타나는 유사 서브스트링을 찾아내는 문제라든가 근래의 생물정보학에서 두 DNA시퀀스간의 유사도를 판별하는 문제 등에서 매우 중요란 기법이다. 본 논문에서는 두 서열들을 유사하게 매칭 시켜 주는 기존의 정렬 방법을 응용, 변형하여 C, C++. JAVA등으로 짜여진 프로그램 소스들의 유사도를 측정하는 방법을 제시하였다. 실제로 이런 프로그램 소스의 표절은 대학교육 수업과정 등에서 빈번하게 발생되는 문제점으로서 본 논문에서는 프로그램 소스표절을 검사, 탐지할 수 있는 방법론 및 구체적인 프로그램과 그 결과를 제시하고 있다. 아울러 두 프로그램간의 유사성을 비교하기 위해 기존의 지역정렬 방법을 보다 효율적으로 적절히 변형시키는 방법을 제시하고 있다.

  • PDF

Cosine Measure를 이용한 음악 동기간 유사도 계산 (Similarity Computation between Music Motifs Using Cosine Measure)

  • 임상혁;구경이;김유성
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2003년도 춘계학술발표논문집 (하)
    • /
    • pp.1603-1606
    • /
    • 2003
  • 음악에서 동기는 독립성을 지니는 최소 단위이며, 저작권 검사의 단위로 이용된다 따라서, 한 음악에서 약간의 변화를 가지고 반복되는 주제선율을 추출하거나, 다른 음악간의 유사도를 측정하는데 유사도 계산은 필요하다. 본 논문에서는 비교되는 동기의 선율정보를 음 길이와 음높이가 함께 고려되는 시계열 데이타로 변환하고, cosine measure를 이용하여 동기간의 유사도를 계산한다. 시계열 데이타에서 유사도 계산으로 사용되는 유클리드 거리함수 대신 cosine measure를 이용한 경우, 공간상의 거리 합대신 변화 방향이 반영됨으로써 비교되는 동기간의 유사도를 정확하게 계산한다. 본 논문에서 제안된 동기간의 유사도 계산은 내용 기반 음악 검색에서 색인으로 사용되는 주제선율을 추출하거나, 다른 음악의 동기간의 유사성을 비교하는데 이용될 수 있다.

  • PDF

S/W 프로젝트 수행 경험과 WBS Activity의 유사도 측청을 통한 인력 할당 기법 (Human Resource Allocation Method using Similarity between Software Project Experience and WBS Activity)

  • 권진용;이의종;백두권
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2015년도 춘계학술발표대회
    • /
    • pp.530-533
    • /
    • 2015
  • 기존의 조사에 따르면 현재 소프트웨어 개발 프로젝트의 실패율은 높은 편이다. 미국의 The Standish Group의 보고서에 따르면 소프트웨어 프로젝트의 성공률은 약 32%로 낮음을 볼 수 있다. 소프트웨어 프로젝트 성공에 영향을 주는 요소 중 하나는 인력배치이다. 이는 소프트웨어 개발 프로젝트의 참여 인력 구성에 따라 생산성, 비용 및 개발기간이 달라지게 되기 때문이다. 즉 인력 구성에 따라 프로젝트 성공률에 많은 영향을 주게 될 수 있다. 프로젝트 인력할당은 WBS(Work Breakdown Structure)에 따라 PM(Project Manager) 또는 부서장이 할당하게 되는데, 이들은 프로젝트 구성원들의 상세한 정보까지 파악이 어렵기 때문에 인력구성의 어려움이 존재한다. 과거에 수행했던 개발 프로젝트에서 유사성이 높은 작업을 했음에도 불구하고 전혀 경험이 없는 작업에 할당되면 상대적으로 업무 지식습득에 어려움을 겪고 시간 지연에 따른 비용이 추가적으로 발생하게 된다. 이러한 문제를 해결하고자 본 연구는 소프트웨어 개발 프로젝트 구성원의 상세한 정보들과 소프트웨어 개발 업무와의 유사도 측정을 통해 인력을 업무에 할당하는 기법을 제안한다. 이를 위하여 제안한 기법을 프로토타입으로 구현한 후 현업에서 실제 개발되는 프로젝트에 적용하여 제안 기법의 우수함을 평가한다.

재난안전 사회관심 분석을 위한 언어모델 활용 정보 네트워크 구축 (A Language Model based Knowledge Network for Analyzing Disaster Safety related Social Interest)

  • 최동진;한소희;김경준;배은솔
    • 한국재난정보학회:학술대회논문집
    • /
    • 한국재난정보학회 2022년 정기학술대회 논문집
    • /
    • pp.145-147
    • /
    • 2022
  • 본 논문은 대규모 텍스트 데이터에서 이슈를 발굴할 때 사용되는 기존의 정보 네트워크 또는 지식 그래프 구축 방법의 한계점을 지적하고, 문장 단위로 정보 네트워크를 구축하는 새로운 방법에 대해서 제안한다. 먼저 문장을 구성하는 단어와 캐릭터수의 분포를 측정하며 의성어와 같은 노이즈를 제거하기 위한 역치값을 설정하였다. 다음으로 BERT 기반 언어모델을 이용하여 모든 문장을 벡터화하고, 코사인 유사도를 이용하여 두 문장벡터에 대한 유사성을 측정하였다. 오분류된 유사도 결과를 최소화하기 위하여 명사형 단어의 의미적 연관성을 비교하는 알고리즘을 개발하였다. 제안된 유사문장 비교 알고리즘의 결과를 검토해 보면, 두 문장은 서술되는 형태가 다르지만 동일한 주제와 내용을 다루고 있는 것을 확인할 수 있었다. 본 논문에서 제안하는 방법은 단어 단위 지식 그래프 해석의 어려움을 극복할 수 있는 새로운 방법이다. 향후 이슈 및 트랜드 분석과 같은 미래연구 분야에 적용하면, 데이터 기반으로 특정 주제에 대한 사회적 관심을 수렴하고, 수요를 반영한 정책적 제언을 도출하는데 기여할 수 있을 것이다

  • PDF

공주지점의 유사량 특성 분석(2007) (An Analysis of Sediment Characteristic in Gongju(2007))

  • 고주연;정성원
    • 한국수자원학회:학술대회논문집
    • /
    • 한국수자원학회 2008년도 학술발표회 논문집
    • /
    • pp.918-922
    • /
    • 2008
  • 본 연구에서의 측정 대상인 공주지점은 금강 본류로 홍수 예 경보 지점이며, 그 하상이 대부분 모래로 구성된 충적하천으로 간주된다. 유사량 측정은 강우가 집중되는 6$\sim$9월의 홍수기(25회)와 이를 기준으로 전 후시기인 저 평수기(2회)로 나누어 총 27회로 측정하였고 부유사량(D-74, P-61A: 수심적분법), 하상토(BM-54, 홍수기전 후 2회 채취), 수리량(수위, 유속, 측정수심, 수면폭, 수면경사, 수온)등의 실측자료를 이용하여 미측정구간의 유사량을 포함한 총유사량을 추정(실측+계산; Modified Einstein, 간접계산; Engelund & Hansen, Yang, Ackers & White)하였다. 이러한 분석결과를 가지고 유량-부유사농도와 부유사량 및 총유사량 관계에 대해 살펴보았다. 전체적으로 유량에 대한 측정성과들의 변위와 저유량시 산포도에 있어 다소 큰 경향을 보였고, 주요 강우사상별로 보았을 때 루프(Loop)현상을 볼 수 있었다. 이러한 분석결과의 상충은 하천의 수리, 유사특성과 추정방법의 적용한계 등의 서로 다른 제한된 범위의 자료들을 이용하여 분석하는 데서 오는 차이, 특히 유량, 수심, 하상토의 입경크기 등 자료의 범위가 추정공식들이 추천하는 범위에서 벗어났기 때문인데, 이는 총유사량 공식에 대한 범용성이 적다는 것을 의미한다.

  • PDF

이미지 데이터베이스 유사도 순위 매김 알고리즘 (A Similarity Ranking Algorithm for Image Databases)

  • 차광호
    • 한국정보과학회논문지:데이타베이스
    • /
    • 제36권5호
    • /
    • pp.366-373
    • /
    • 2009
  • 이 논문은 이미지 데이터베이스를 위한 유사도 순위 매김 알고리즘을 제시한다. 이미지 검색의 문제점 중 하나가 이미지로부터 자동적으로 계산한 하위 레벨 특성과 인간 지각과의 의미 차이이며, 검색시에 이미지 유사도 측정을 위해 많은 알고리즘에서는 민코프스키 측정법($L_p$-norm)을 사용하고 있다. 그러나 민코프스키 측정법은 인간 시각 시스템의 비선형적 특성과 문맥 정보를 반영하지 못한다. 본 알고리즘에서는 인간 지각의 비선형성과 문맥 정보를 반영하는 유사도와 탐색 알고리즘을 통해 이 문제를 해결한다. 본 알고리즘을 필기체 숫자 이미지 데이터베이스에 적용하여 성능의 우수성과 효과를 증명하였다.