• Title/Summary/Keyword: 정답 선택

Search Result 88, Processing Time 0.023 seconds

Transfer Learning-based Multi-Modal Fusion Answer Selection Model for Video Question Answering System (비디오 질의 응답 시스템을 위한 전이 학습 기반의 멀티 모달 퓨전 정답 선택 모델)

  • Park, Gyu-Min;Park, Seung-Bae
    • Annual Conference on Human and Language Technology
    • /
    • 2021.10a
    • /
    • pp.548-553
    • /
    • 2021
  • 비디오 질의 응답은 입력으로 주어진 비디오와 질문에 적절할 정답을 제공하기 위해 텍스트, 이미지 등 다양한 정보처리가 요구되는 대표적인 multi-modal 문제이다. 질의 응답 시스템은 질의 응답의 성능을 높이기 위해 다수의 서로 다른 응답 모듈을 사용하기도 하며 생성된 정답 후보군 중 가장 적절할 정답을 선택하는 정답 선택 모듈이 필요하다. 정답 선택 모듈은 응답 모듈의 서로 다른 관점을 고려하여 응답 선택을 선택할 필요성이 있다. 하지만 응답 모듈이 black-box 모델인 경우 정답 선택 모듈은 응답 모듈의 parameter와 예측 분포를 통해 지식을 전달 받기 어렵다. 그리고 학습 데이터셋은 응답 모듈이 학습에 사용했기 때문에 과적합 문제로 각 모듈의 관점을 학습하기엔 어려우며 학습 데이터셋 이외 비교적 적은 데이터셋으로 학습해야 하는 문제점이 있다. 본 논문에서는 정답 선택 성능을 높이기 위해 전이 학습 기반의 멀티모달 퓨전 정답 선택 모델을 제안한다. DramaQA 데이터셋을 통해 성능을 측정하여 제안된 모델의 우수성을 실험적으로 증명하였다.

  • PDF

Paragraph Re-Ranking and Paragraph Selection Method for Multi-Paragraph Machine Reading Comprehension (다중 지문 기계독해를 위한 단락 재순위화 및 세부 단락 선별 기법)

  • Cho, Sanghyun;Kim, Minho;Kwon, Hyuk-Chul
    • Annual Conference on Human and Language Technology
    • /
    • 2020.10a
    • /
    • pp.184-187
    • /
    • 2020
  • 다중 지문 기계독해는 질문과 여러 개의 지문을 입력받고 입력된 지문들에서 추출된 정답 중에 하나의 정답을 출력하는 문제이다. 다중 지문 기계독해에서는 정답이 있을 단락을 선택하는 순위화 방법에 따라서 성능이 크게 달라질 수 있다. 본 논문에서는 단락 안에 정답이 있을 확률을 예측하는 단락 재순위화 모델과 선택된 단락에서 서술형 정답을 위한 세부적인 정답의 경계를 예측하는 세부 단락 선별 기법을 제안한다. 단락 순위화 모델 학습의 경우 모델 학습을 위해 각 단락의 출력에 softmax와 cross-entroy를 이용한 손실 값과 sigmoid와 평균 제곱 오차의 손실 값을 함께 학습하고 키워드 매칭을 함께 적용했을 때 KorQuAD 2.0의 개발셋에서 상위 1개 단락, 3개 단락, 5개 단락에서 각각 82.3%, 94.5%, 97.0%의 재현율을 보였다. 세부 단락 선별 모델의 경우 입력된 두 단락을 비교하는 duoBERT를 이용했을 때 KorQuAD 2.0의 개발셋에서 F1 83.0%의 성능을 보였다.

  • PDF

Answer Extraction of Concept based Question-Answering System (개념 기반 질의-응답 시스템에서의 정답 추출)

  • Ahn Young-Min;Oh Su-Hyun;Kang Yu-Hwan;Seo Young-Hoon
    • Proceedings of the Korea Contents Association Conference
    • /
    • 2005.05a
    • /
    • pp.448-451
    • /
    • 2005
  • In this paper, we describe a method of answer extraction on a concept-based question-answering system. The concept-based question answering system is a system which extract answer using concept information. we have researched the method of answer extraction using concepts which analyzed and extracted through question analysing with answer extracting rules. We analyzed documents including answers and then composed answer extracting rules. Rules consist of concept and syntactic information, we generated candidates of answer through the rules and then chose answer.

  • PDF

Concept and Attribute based Answer Retrieval (개념 속성 기반 정보 검색)

  • Yun Bo-Hyun;Seo Chang-ho
    • Journal of the Korea Society of Computer and Information
    • /
    • v.10 no.3 s.35
    • /
    • pp.1-10
    • /
    • 2005
  • This paper presents the information retrieval system which can retrieve the most appropriate answer sentence for user queries by using the concept and the attribute for the knowledge retrieval. The system analyzes the user query into the Boolean queries with the concept and the attribute and then retrieve the relevant documents in the indexing set of answer documents. Users can retrieve the relevant answer sentences from the relevant documents. For this, the answer documents indexed by the concept and the attribute are segmented by each sentence respectively. Thus, the segmented sentences are analyzed into the concept and the attribute of which the relevance degree with indexing units of documents is evaluated. Then, the system indexes the location of answer sentences. In the experiment, we evaluate the performance of our answer retrieval system against 100 user queries and show the experimental results.

  • PDF

Analysis of Compound Nouns Containing Korean or Foreign Unknown Words (한국어 및 외래어 미등록어를 포함한 복합명사 분석)

  • Kim, Myoung-Sun;Ra, Dong-Yul
    • Proceedings of the Korean Society for Cognitive Science Conference
    • /
    • 2006.06a
    • /
    • pp.73-79
    • /
    • 2006
  • 본 논문에서는 미등록어 처리가 강화된 복합명사 분석 기법을 제시한다. 기본적으로 모든 복합명사 내에 한국어나 외래어의 미등록어가 포함되어 있을 수 있다는 가정하에 분석을 시도한다. 따라서 등록어로 구성된 복합명사에 대해서도 미등록어가 포함된 분해 후보가 생성될 수도 있다. 이는 분해 후보의 수를 크게 증가시키는 문제를 일으킨다. 이 문제에 대처하기 위하여 미등록어의 분류에 따라 미등록어로서의 가능성 여부의 판별 및 제거, 분해 후보 상호간의 견제에 의한 제거 등을 이용하였다. 이러한 과정은 정답 후보 선택시에도 영향을 미쳐 정답이 아닌 분해 후보가 선택되는 것을 방지할 수 있으며, 처리 시간을 줄일 수 있는 이점이 있다. 실험 결과 제시된 기법들이 매우 효과적임을 확인할 수 있었다.

  • PDF

2002년 월드컵 축구 예제를 활용한 수학 I 의 확률학습모형 개발

  • Park, Dong-Jun;Park, Gwang-Won
    • Communications of Mathematical Education
    • /
    • v.12
    • /
    • pp.265-280
    • /
    • 2001
  • 고등학교 수학 I 의 확률 및 통계영역의 교육내용을 정리한 후, 고등학생들에게 확률 및 통계영역에 관한 흥미를 돋구기 위하여 2002년 월드컵을 소재로 한 문제들을 활용하여 비주얼 베이직으로 프로그램한 ‘확률상자’ 라는 확률모형을 개발하였다. 확률상자에는 확률의 역사, 경우의 수, 순열, 같은 것이 있는 순열, 원순열, 조합, 이항계수, 통계적 확률, 조건부 확률, 배반사건 등 모두 10가지 모듈을 포함한다. 확률상자의 초기화면에서 메뉴를 선택하면 선택된 내용에 관한 간단한 정의와 함께 문제가 제시되어 정답을 적도록 하였고, 오답일 때는 힌트를 누르면 정답을 이해할 수 있도록 풀이과정을 제시하였다. 특히, 메뉴가운데서 경우의 수, 순열, 같은 것이 있는 순열, 원순열, 조합, 통계적 확률의 경우에는 풀이과정 중에 애니메이션 또는 시뮬레이션이 실행되도록 하여 이해를 돕도록 하였다.

  • PDF

Korean Open Domain Question Answering System Using KorQuAD (KorQuAD를 활용한 한국어 오픈도메인 질의응답 시스템)

  • Cho, Sanghyun;Kim, Minho;Kwon, Hyuk-Chul
    • Annual Conference on Human and Language Technology
    • /
    • 2019.10a
    • /
    • pp.321-325
    • /
    • 2019
  • 오픈 도메인 질의응답이란, 질문을 줬을 때 그 질문과 연관성이 높은 문서를 검색하고 검색된 문서에서 정답을 추출하는 태스크이다. 본 논문은 기계 독해 데이터인 KorQuAD를 활용한 오픈도메인 질의응답 시스템을 제안한다. 문서 검색기를 이용하여 질문과 관련 있는 위키피디아 문서들을 검색하고 검색된 문서에 단락 선택 모델을 통해서 문서 질문과 연관성이 높은 단락들을 선별하여 기계 독해 모델에서 처리해야 할 입력의 수를 줄였다. 문서 선별모델에서 선별된 여러 단락에서 추출된 정답 후보에서 여러 가지 정답 모형을 적용하여 성능을 비교하는 실험을 하였다. 본 논문에서 제안한 오픈도메인 질의응답 시스템을 KorQuAD에 적용했을 때, 개발 데이터에서 EM 40.42%, F1 55.34%의 성능을 보였다.

  • PDF

Korean Student's Achievement of Earth Science in International Comparative Studies: From the Perspectives of Gender Differences (국제 비교 연구에 나타난 우리 나라 학생들의 지구과학 성취도: 성 차이를 중심으로)

  • Park, Chung;Shin, Dong-Hee
    • Journal of the Korean earth science society
    • /
    • v.23 no.3
    • /
    • pp.207-220
    • /
    • 2002
  • The purpose of this study was to verify the trends of Korean students' achievement of earth science, especially the gender differences, in recent two international comparative studies, TIMSS-R (The Third International Mathematics and Science Study-Repeat) and PISA 2000 (Programme for International Student Assessment). To achieve this purpose, the 33 earth science items in TIMSS-R and 13 earth and environmental science items in PISA 2000 were analyzed. As a result of the comparison between Korean- and international percent correct, Korean students showed especially higher achievement in close-ended items or items required 'understanding of simple information.' Korean students, in particular Korean male students, also showed higher achievement in items of data interpretation. On the other hand, Korean students, in particular Korean female students, showed relatively lower achievement in astronomy items. The serious gender differences occurred in all aspects of items, regardless of item content, item format, and performance expectations.

Factors of Predicting Difficulty of Mathematics Test Items in College Scholastic Ability Test (고등학교 수리영역 시험의 난이도 예측 요인 분석)

  • Ko, Ho-Kyoung;Yi, Hyun-Sook
    • Journal of the Korean School Mathematics Society
    • /
    • v.10 no.1
    • /
    • pp.113-127
    • /
    • 2007
  • This study explored the possibility of building a statistical model predicting difficulty of mathematics test items through the analysis of nation-wide scholastic ability test results for the past 5 years. Multiple linear regression analysis was conducted in predicting difficulty of mathematics test items. We adopted three major areas for independent variables: the content area, the behavior area, and the test item format area, each of which was categorized into more detailed sub-areas. For the dependent variable, the proportion of correct answer was used to represent the item difficulty. Statistically significant independent variables were included in the regression model based on the stepwise selection method. Several important factors affecting difficulty of mathematics test items for each area were identified. R-squares for the final regression model were fairly high, implying that the regression equation can be used to predict difficulty of test items at an acceptable level. Lastly, the regression model was cross-validated using independently collected data. We believe that this study will provide basic but very critical information for predicting the proportion of correct answer by showing the factors that should be considered for developing mathematics test items for the college entrance examination or high school classroom test.

  • PDF

Relationships of Elementary Students념 Conceptions about Basic Circuits and Electric Currents (초등학생의 전기회로 개념과 전류 개념간의 관계)

  • 김진숙;권성기
    • Journal of Korean Elementary Science Education
    • /
    • v.19 no.2
    • /
    • pp.1-13
    • /
    • 2000
  • The purposes of this study were to survey the elementary students' conceptions of electric circuits and of electric currents, and to explore the relationships between them. The questionaire were developed into matched forms which corresponds to each conceptions of electric circuits and electric currents. The elementary students were selected from 4th and 5th grade in a elementary school in a large local city, which of the total numbers of students were 163. The student who have well-developed conception in electric circuits are superior in conceptions of electric currents to other student who have not in each items of questionnaire required to draw a simple basic electric circuits for lightening the bulb, to select the basic elements of circuits, to identify the arrangement of batteries and bulbs. So we concluded that the scientific conceptions of electric circuits could contribute to the scientific conceptions of electric currents, as expected in elementary science textbooks.

  • PDF