• Title/Summary/Keyword: 주제 기반

Search Result 1,747, Processing Time 0.029 seconds

Exploration of Intellectual Structure of Artificial Intelligence Field Using Co-word Analysis (동시출현 단어 분석을 통한 지식 구조의 파악 : 인공지능 분야를 대상으로)

  • 이미경;정영미
    • Proceedings of the Korean Society for Information Management Conference
    • /
    • 2003.08a
    • /
    • pp.245-251
    • /
    • 2003
  • 이 연구에서는 통제된 색인어를 이용하여 파악한 지식 구조와 통제되지 않은 키워드를 이용한 지식 구조를 비교하여 두 구조가 어떤 차이점을 보이는지를 살펴보았다. 또한 색인효과가 어떻게 나타나는지, 비통제어를 사용한 경우가 실제적으로 더 상세한 하위 영역을 표현하는지를 확인하고자 하였다. 실험 결과 통제된 색인어인 주제명표목을 사용한 영역지도와 비통제 색인어인 키워드를 사용한 영역지도 둘 다 인공지능 분야의 주요 분야들을 비슷하게 나타냈지만, 주제명표목을 사용한 경우에 색인효과가 일부 나타났다. 그리고 대체적으로 주제명표목에 기반한 영역지도보다는 키워드에 기반한 영역지도가 더 상세하게 나타났다.

  • PDF

A content-based movie recommendation method for targeted advertising (맞춤형 광고를 위한 내용기반 영화 추천 기법)

  • Bong, Seong-Yong;Suh, In-Sik;Kim, Moon-Sik;Hwang, Kyu-Baek
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2011.06c
    • /
    • pp.269-272
    • /
    • 2011
  • 추천은 다양한 컨텐츠 중에서 사용자가 원하는 것을 선택할 수 있도록 돕는 것이다. 이러한 추천은 광고주가 자신의 광고에 적절한 컨텐츠를 찾을 때에도 활용될 수 있다. 본 논문에서는 광고를 표현하는 태그와 영화를 나타내는 주제어들을 매칭하여 광고에 적합한 영화를 추천하는 문제를 다룬다. 이 문제의 경우, 광고를 표현하는 태그의 개수가 적고, 영화의 주제어와 성격이 다른 경우가 많아 단순 매칭을 활용한 추천 기법으로는 결과를 얻을 수 없는 경우도 존재한다. 우리는 이러한 문제를 완화하기 위해 키워드 확장을 통한 추천 기법을 제안한다. 구체적으로 각 영화 컨텐츠가 가진 주제어를 위키피디아를 통해 검색하고 이를 통해 주제어를 확장한다. 광고의 태그 또한 위키피디아 검색을 통해 확장한다. 이렇게 확장된 영화 주제어와 광고 태그를 연관성 규칙에 기반하여 매칭한다. 실험 결과 단순 매칭보다 제안한 확장을 통한 매칭이 37.5%의 성능 향상을 보였다.

Analysis of Automatic Topic Classification using Youtube Meta Information (유튜브 메타정보를 이용한 자동 주제 분류 고찰)

  • Kim, Yong-Woo;Jeon, Seong-Bae;Jung, Yuchul
    • Proceedings of the Korean Society of Computer Information Conference
    • /
    • 2021.01a
    • /
    • pp.349-351
    • /
    • 2021
  • Youtube 동영상 업로드 시, 사용자가 직접 주제를 설정해야 하는 어려움이 있다. 본 연구에서는 사용자가 입력하는 제목과 설명정보를 이용하여 자동으로 주제를 분류하는 연구를 진행하였다. 이를 위해 한국어기반의 컨텐츠 중 고빈도의 8개 주제 카테고리를 선정하고, 이를 1.3만건의 학습데이터를 크롤링을 통해 구축하였다. 또한, 다양한 알고리즘들에 대한 최대성능을 확인하기 위해 대표적인 텍스트 분류 방법인 SVM과 LSTM기법 및 BERT 모델기반 미세적용(fine-tuning)을 시도하였다. 결과적으로 Bert-multiligual (base)를 fine-tuning한 실험에서 최대 94%의 정확도를 확인하였다. 하지만, Youtube 동영상 특성상 여러 주제를 가진 것들이 상당수 존재하기에, 실제 체감정확도는 더 높을 것으로 기대된다.

  • PDF

A Design and Implementation of Exhibition Recommendation Chatbot Based on Microsoft Luis (Microsoft Luis 기반의 전시장 추천 챗봇 설계 및 구현)

  • Lee, Won Joo;Kim, Seung Gyeom;Lee, Gyo Bum;Han, Jae Geun
    • Proceedings of the Korean Society of Computer Information Conference
    • /
    • 2022.07a
    • /
    • pp.425-426
    • /
    • 2022
  • 본 논문에서는 사용자가 원하는 주제를 통해 전시장을 추천, 등록, 조회하는 Microsoft Bot Framework, Microsoft Azure 기반의 챗봇을 설계하고 구현한다. 이 챗봇은 사용자가 원하는 주제를 입력하면, 해당하는 주제의 전시장을 추천하게 된다. 주제는 알고리즘으로 단어를 지정한 것이 아닌, Azure Luis로 단어를 학습시켜서 비슷한 주제의 단어를 도출하는 알고리즘을 선택한다. 등록 부분은 Form 형식이 아닌 대화형으로 사용자 정보를 수집하게 된다. 사용자 정보는 Microsoft SQL Database 서버에 저장이 되고, 구현한 챗봇은 애뮬레이터 형식이 아닌 Channel 연동으로 Line 서비스로 배포한다.

  • PDF

Topic and Topic Change Detection in Instance Messaging (인스턴트 메시징에서의 대화 주제 및 주제 전환 탐지)

  • Choi, Yoon-Jung;Shin, Wook-Hyun;Jeong, Yoon-Jae;Myaeng, Sung-Hyon;Han, Kyoung-Soo
    • Journal of the Korea Society of Computer and Information
    • /
    • v.13 no.7
    • /
    • pp.59-66
    • /
    • 2008
  • This paper describes a novel method for identifying the main topic and detecting topic changes in a text-based dialogue as in Instant Messaging (IM). Compared to other forms of text, dialogues are uniquely characterized with the short length of text with small number of words, two or more participants, and existence of a history that affects the current utterance. Noting the characteristics, our method detects the main topic of a dialogue by considering the keywords not only the utterances of the user but also the dialogue system's responses. Dialogue histories are also considered in the detection process to increase accuracy. For topic change detection, the similarity between the former utterance's topic and the current utterance's topic is calculated. If the similarity is smaller than a certain threshold, our system judges that the topic has been changed from the current utterance. We obtained 88.2% and 87.4% accuracy in topic detection and topic change detection, respectively.

  • PDF

Construction of Theme Melody Index by Transforming Melody to Time-series Data for Content-based Music Information Retrieval (내용기반 음악정보 검색을 위한 선율의 시계열 데이터 변환을 이용한 주제선율색인 구성)

  • Ha, Jin-Seok;Ku, Kyong-I;Park, Jae-Hyun;Kim, Yoo-Sung
    • The KIPS Transactions:PartD
    • /
    • v.10D no.3
    • /
    • pp.547-558
    • /
    • 2003
  • From the viewpoint of that music melody has the similar features to time-series data, music melody is transformed to a time-series data with normalization and corrections and the similarity between melodies is defined as the Euclidean distance between the transformed time-series data. Then, based the similarity between melodies of a music object, melodies are clustered and the representative of each cluster is extracted as one of theme melodies for the music. To construct the theme melody index, a theme melody is represented as a point of the multidimensional metric space of M-tree. For retrieval of user's query melody, the query melody is also transformed into a time-series data by the same way of indexing phase. To retrieve the similar melodies to the query melody given by user from the theme melody index the range query search algorithm is used. By the implementation of the prototype system using the proposed theme melody index we show the effectiveness of the proposed methods.

Keyword-based Document C lustering Algorithm (주제어 기반 문서 클러스터링 알고리즘)

  • 장성호;강승식
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2002.04b
    • /
    • pp.469-471
    • /
    • 2002
  • 높은 연관성을 갖는 문서들을 서로 집단화시키는 문서 클러스터링은 문서와 문서간의 연관성을 확인할 수 있는 문서의 주제어 추출이 중요한 문제이며 일반적인 정보검색 시스템에서 사용하는 출현빈도에 의한 주제어 추출은 성능 향상에 한계가 있다. 또한, 문서 클러스터링은 문서를 집단화시키기 위해 문서간 연관성을 확인하기 위해 유사도 계산에 따른 시간과 공간을 많이 소비하는 문제를 가지고 있다. 본 논문에서는 주제어 추출 기법을 적용하여 주제어 연관성에 의해 문서들을 집단화시키는 새로운 방법의 문서 클러스터링 알고리즘을 제안한다.

  • PDF

A Study on Developing Facet-based Subject Headings of Oral History Records Use: Using Oral History Records of Knit Business in Haebangchon (구술 기록의 활용을 위한 패싯 기반 주제명표목 개발에 관한 연구: 해방촌 니트 사업 구술 기록을 대상으로)

  • Haein, Kim;Yeon-Kyoung, Chung
    • Journal of Korean Society of Archives and Records Management
    • /
    • v.22 no.4
    • /
    • pp.67-85
    • /
    • 2022
  • This study develops a methodology for facet-based subject headings for the subject access to oral history records collected by such a project of the knit business in Haebangchon. First, the concept and characteristics of oral history records and their contents were investigated, and the meaning of facets and subject headings applied to such content was examined in the literature review. Second, the basic facets of oral history records were created based on 5W1H that reflected the narrative feature of oral history. Third, 540 subject-related terms were selected through an analysis of the transcript written based on oral history interviews with one interviewer and seven interviewees linked to the knit business in Haebangchon. Fourth and last, subject headings were proposed with the selected subject-related terms categorized in facets with various relationships. These facet-based subject headings will improve the subject access and use of oral history records.

An Automated Topic Specific Web Crawler Calculating Degree of Relevance (연관도를 계산하는 자동화된 주제 기반 웹 수집기)

  • Seo Hae-Sung;Choi Young-Soo;Choi Kyung-Hee;Jung Gi-Hyun;Noh Sang-Uk
    • Journal of Internet Computing and Services
    • /
    • v.7 no.3
    • /
    • pp.155-167
    • /
    • 2006
  • It is desirable if users surfing on the Internet could find Web pages related to their interests as closely as possible. Toward this ends, this paper presents a topic specific Web crawler computing the degree of relevance. collecting a cluster of pages given a specific topic, and refining the preliminary set of related web pages using term frequency/document frequency, entropy, and compiled rules. In the experiments, we tested our topic specific crawler in terms of the accuracy of its classification, crawling efficiency, and crawling consistency. First, the classification accuracy using the set of rules compiled by CN2 was the best, among those of C4.5 and back propagation learning algorithms. Second, we measured the classification efficiency to determine the best threshold value affecting the degree of relevance. In the third experiment, the consistency of our topic specific crawler was measured in terms of the number of the resulting URLs overlapped with different starting URLs. The experimental results imply that our topic specific crawler was fairly consistent, regardless of the starting URLs randomly chosen.

  • PDF

A Study on Ontology-based Keywords Structuring for Efficient Information Retrieval (연구.학술정보 효율적 검색을 위한 온톨로지 기반의 주제 색인어 구조화 방안 연구)

  • Song, In-Seok
    • Journal of Information Management
    • /
    • v.39 no.4
    • /
    • pp.121-154
    • /
    • 2008
  • In this paper, a ontology-based keyword structuring method is proposed to represent the knowledge structure of scholarly documents and to make inferences from the semantic relationships holding among them. The characteristics of thesaurus as a knowledge organization system(KOS) for subject heading is critically reviewed from the information retrieval point of view. The domain concepts are identified and classified by analysis of the information activities occurring in a general research process based on scholarly sensemaking model. The ontological structure of keyword set is defined in terms of the semantic relationship of the canonical concepts which constitute scholarly documents such as journal articles. As a result, each ontologically structured keyword set of a document represents the knowledge structure of the corresponding document as semantic index. By means of the axioms and inference rules defined for information needs, users can efficiently explore the scholarly communication network built on the semantic relationship among documents in an analytic way based on the scholarly sensemaking model in oder to efficiently retrieve the relevant information for problem solving.