• Title/Summary/Keyword: 이중언어

Search Result 248, Processing Time 0.024 seconds

Pivot-based Bilingual Lexicon Extraction Using Word2Vec and CCA (중간언어 기반의 Word2Vec와 CCA를 이용한 이중언어 사전 추출)

  • Kim, Jeong-Tae;Kim, Chang-Hyun;Cheon, Min-Ah;Kim, Jae-Hoon;Kim, Jae-Hwan
    • Annual Conference on Human and Language Technology
    • /
    • 2016.10a
    • /
    • pp.307-309
    • /
    • 2016
  • 이중언어 사전은 자연어처리 분야에서 매우 유용한 자원으로 사용되고 있다. 그러나 초기사전이나 병렬말뭉치 등 자원이 부족한 언어 쌍에 대해서 이중언어 사전을 추출하는 것은 쉽지 않다. 이러한 문제를 해결하기 위해 본 논문에서는 중간 언어 기반으로 Word2Vec와 CCA를 이용하여 이중언어 사전을 추출하는 방법을 제안한다. 본 논문에서 제안하는 방법의 성능을 평가하기 위해서 중간언어로 영어를 사용하여 스페인어-한국어에 대한 이중언어 사전을 추출하는 실험을 하였다. 무작위로 뽑은 200개의 단어에 대한 번역 정확도를 구하였다. 그 결과 최상위에서 37.5%, 상위 10위에서 63%, 그리고 상위 20위에서는 69.5%의 정확도를 얻을 수 있었다.

  • PDF

Pivot-based Bilingual Lexicon Extraction Using Word2Vec and CCA (중간언어 기반의 Word2Vec와 CCA를 이용한 이중언어 사전 추출)

  • Kim, Jeong-Tae;Kim, Chang-Hyun;Cheon, Min-Ah;Kim, Jae-Hoon;Kim, Jae-Hwan
    • 한국어정보학회:학술대회논문집
    • /
    • 2016.10a
    • /
    • pp.307-309
    • /
    • 2016
  • 이중언어 사전은 자연어처리 분야에서 매우 유용한 자원으로 사용되고 있다. 그러나 초기사전이나 병렬말뭉치 등 자원이 부족한 언어 쌍에 대해서 이중언어 사전을 추출하는 것은 쉽지 않다. 이러한 문제를 해결하기 위해 본 논문에서는 중간 언어 기반으로 Word2Vec와 CCA를 이용하여 이중언어 사전을 추출하는 방법을 제안한다. 본 논문에서 제안하는 방법의 성능을 평가하기 위해서 중간언어로 영어를 사용하여 스페인어-한국어에 대한 이중언어 사전을 추출하는 실험을 하였다. 무작위로 뽑은 200개의 단어에 대한 번역 정확도를 구하였다. 그 결과 최상위에서 37.5%, 상위 10위에서 63%, 그리고 상위 20위에서는 69.5%의 정확도를 얻을 수 있었다.

  • PDF

Rated Recall: Evaluation Method for Constructing Bilingual Lexicons (등급 재현율: 이중언어 사전 구축에 대한 평가 방법)

  • Seo, Hyeong-Won;Kwon, Hong-Seok;Kim, Jae-Hoon
    • Annual Conference on Human and Language Technology
    • /
    • 2013.10a
    • /
    • pp.146-151
    • /
    • 2013
  • 이중언어 사전 구축 방법을 평가하는 방법에는 정확률, 재현율, MRR(Mean Reciprocal Rank) 등이 있다. 이들 방법들은 평가 집합에 있는 대역어를 정확하게 찾는 것에 초점을 맞추고 있다. 그러나 어떤 대역어가 얼마나 많이 사용되는지는 전혀 고려하지 않는다. 즉 자주 사용되는 대역어를 빨리 찾을 수 있는 방법이 좋은 방법이라고 말할 수 있다. 이와 같은 문제를 해결하기 위해서 본 논문에서는 이중언어 사전 구축의 새로운 평가 방법인 등급 재현율을 제안한다. 등급 재현율(rated recall)은 대역어가 학습 말뭉치에 나타난 정도를 반영하는 재현율이며, 자주 사용되는 대역어를 얼마나 정확하게 찾는지를 파악할 수 있는 좋은 측도이다. 본 논문에서는 문맥벡터와 중간언어를 이용한 이중언어 사전 구축 시스템의 성능을 평가하고 기존의 방법과 비교 분석하였다.

  • PDF

English-Production Structures of Korean-English Bilinguals (한국어-영어 이중언어자의 영어 산출 구조 분석)

  • Shin, Sung-Shik;Yum, Eun-Young;Chung, Chan-Sup
    • Annual Conference on Human and Language Technology
    • /
    • 1996.10a
    • /
    • pp.128-141
    • /
    • 1996
  • 한국어-영어 이중언어자와 비이중언어자인 한국 대학생들을 대상으로 두 언어 처리의 독립성과 영어 처리의 사고 억제 과정을 알아보기 위해서 두 개의 산출실험을 실시하였다. 실험 1에서는 한국어와 영어로 산출 과제를 준 후에 한국어, 영어 단어에 대한 어휘 판단 과제를 하였다. 이중언어자는 한국어-영어 처리 체계가 분리되어 있어서 산출 언어와 목표 단어의 언어가 바뀐 경우에 단어 판단시간이 더 길 것으로 예상하였으나 유의미한 결과는 나오지 않았다. 비이중언어자는 영어 산출 후에 한국어, 영어 단어에 대한 판단 시간이 모두 느려졌으며 이것은 영어 산출에 많은 심적 자원을 소모하였기 때문이라고 해석하였다. 실험2에서는 영어로만 1분간 산출 과제를 주고 20초씩 나눈 세 구간에서 발화된 단어 수를 측정하였다. 이중언어자는 세 번째 구간에서 유의미하게 발화된 단어수가 감소하였지만 비이중언어자는 세 구간에서 발화된 단어수가 비슷하였다. 이것을 영어 산출시의 처리 부담과 관련하여 논하였다.

  • PDF

Syntax Process in English Sentence Types : Comparison between Korean-English Bilinguals and Korean Non-bilinguals (이중언어자와 한국 대학생의 문장 유형별 영어 통사처리 특성 조사)

  • Park, Jin-Han;Oh, Chang-Young;Yum, Eun-Young;Chung, Chan-Sup
    • Annual Conference on Human and Language Technology
    • /
    • 1996.10a
    • /
    • pp.123-127
    • /
    • 1996
  • 영어와 한국어의 통사구조의 차이로 인하여, 이중언어자와 비이중언어자인 한국 대학생의 영어 문장 유형에 따른 통사 처리에 있어 차이가 있을 것이다. 네가지 영어 문장 유형, 수동태, 관계사절, 물주구문, 가정법 구문 등으로 문장 완성 과제를 실험하여 이중언어자와 비이중언어자의 문장완성 시간과 오류율을 측정하였다. 실험 결과 비이중언어자인 한국 대학생은 다른 문장 유형에 비하여 물주구문에서의 통사처리 수행에 있어 이중언어자와 유의한 차이를 보였다. 이로부터 이중언어자와 한국 대학생의 영어 문장의 통사 정보처리의 자동화 및 어순효과 정보와 생물 주어(word animacy)구문 단서, 즉 대부분의 주어는 살아있는 사물의 명사로 이루어져 있다는 단서(Gass, l987)의 사용에 대하여 논의하였다.

  • PDF

Two Languages in One Brain Shown by fMRI: Orthography Specific Effects in L2 (fMRI에 나타난 모국어와 외국어로서의 한국문자와 중국문자의 차이)

  • 이동훈;이홍재;문찬홍;유재욱;남기춘
    • Proceedings of the Korean Society for Cognitive Science Conference
    • /
    • 2002.05a
    • /
    • pp.216-221
    • /
    • 2002
  • 본 연구는 문자 규칙 심층성이 다른 문자체계인 한국어와 중국어의 차이가 이중언어화자의 모국어 처리와 외국어 처리에서 각각 어떤 대뇌 활성화의 차이를 가져오는지 fMRI (functional Magnetic Resonance Imaging)를 이용하여 살펴보았다. 중국어 (Ll)-한국어(L2) 이중언어화자 및 한국어(Ll)-중국어(L2) 이중언어화자를 제 2언어 습득시기에 따라 초기 및 후기 이중언어화자로 구분하여 모국어 차이와 습득시기에 따른 영향을 알아보았다. 실험 1에서는 어휘 판단 과제(lexical decision task)를 실시하였고, 실험 2에서는 의미 판단 과제(semantic decision task)를 각각 실시하였다. 어휘판단과제를 사용한 실험 1의 결과는 음운처리와 관련된 좌반구 SMG(supramarginal gyrus), 하두정소엽(inferior parietal lobule, BA 39, 40)에서 중국어-한국어 초기 및 후기이중언어화자의 경우, 한국어 조건에서 보다 많은 활성화를 보였으나, 한국어-중국어 화자의 경우 활성화가 나타나지 않았다. 철자처리에 관련된 방추상회(fusiform gyrus, BA 37, 19) 영역에서는 중국어-한국어 화자뿐만 아니라, 한국어-중국어 인중언어화자의 경우도 중국어 조건에서 보다 많은 활성화를 보였다. 실험 2에서 사용한 의미판단과제의 경우, 중국어-한국어 이중언어화자의 경우 어휘판단과제를 사용한 실험 1의 결과에서 보고된 한국어 특정적인 반응, 즉 SMG영역에서의 활성화의 증가가 실험 2에서는 나타나지 않았다. 그러나 한국어-중국어 이중언어화자의 경우, 실험 1에서 나타난 것과 같이 철자처리 혹은 의미처리와도 관련된다고 보고되는 방추상회(fusiform gyrus)등의 영역 유의미한 차이를 나타났다. 이는 어휘 판단과제와 의미판단과제가 유도하는 뇌 활성화 양상이 다름을 시사한다. 종합해 볼 때, 이중언어화자의 뇌 영상 연구에서 어휘수준에서는 거의 공통적인 활성화를 보인다는 개략적 수준의 연구 결과를 넘어, 음운처리 및 철자처리와 같은 어휘접근 수준에서는 이중언어화자들의 뇌 활성화가 다르게 일어남을 보여주고 있다. 따라서 이중언어 화자의 뇌 기전을 밝히기 위해서도 보다 개략적 수준을 넘어 언어처리의 세부적인 수준에 따른 접근이 필요함을 시사한다.

  • PDF

이중언어 통로 형성을 위한 청음특성 보강학습 원리

  • 진용옥
    • Proceedings of the KSLP Conference
    • /
    • 2003.11a
    • /
    • pp.164-166
    • /
    • 2003
  • 모국어와 영어의 2중 언어 통로 모국어 통로, 4-6개월 태아의 내이 형성에서 시작, 탯줄과 수도청음 주파수 8khz로 학습됨, 모국어=어머니 언어특질에 맞춰진 처음 인지구조 이중언어통로와 영어학습 원리, 모국어 기반의 새로운 언어 통로 형성, 모국어와 원 어민 언어 특질의 정합 (중략)

  • PDF

Enhancing Performance of Bilingual Lexicon Extraction through Refinement of Pivot-Context Vectors (중간언어 문맥벡터의 정제를 통한 이중언어 사전 구축의 성능개선)

  • Kwon, Hong-Seok;Seo, Hyung-Won;Kim, Jae-Hoon
    • Journal of KIISE:Software and Applications
    • /
    • v.41 no.7
    • /
    • pp.492-500
    • /
    • 2014
  • This paper presents the performance enhancement of automatic bilingual lexicon extraction by using refinement of pivot-context vectors under the standard pivot-based approach, which is very effective method for less-resource language pairs. In this paper, we gradually improve the performance through two different refinements of pivot-context vectors: One is to filter out unhelpful elements of the pivot-context vectors and to revise the values of the vectors through bidirectional translation probabilities estimated by Anymalign and another one is to remove non-noun elements from the original vectors. In this paper, experiments have been conducted on two different language pairs that are bi-directional Korean-Spanish and Korean-French, respectively. The experimental results have demonstrated that our method for high-frequency words shows at least 48.5% at the top 1 and up to 88.5% at the top 20 and for the low-frequency words at least 43.3% at the top 1 and up to 48.9% at the top 20.

Changes in fundamental frequency depending on language, context, and language proficiency for bilinguals (한국어-영어 이중언어 화자의 사용 언어, 문맥, 언어 능숙도에 따른 기본 주파수 변화)

  • Yoon, Somang;Mok, Sora;Youn, Jungseon;Han, Jiyun;Yim, Dongsun
    • Phonetics and Speech Sciences
    • /
    • v.11 no.1
    • /
    • pp.9-18
    • /
    • 2019
  • The purpose of this study is to determine whether the mean fundamental frequency (F0) changes depending on language, task, or language proficiency for Korean-English bilinguals. A total of forty-eight Korean-English speakers (28 balanced bilinguals and 20 Korean dominant bilinguals) participated in the study. Participants were asked to read aloud two types of tasks in English and Korean. For statistical analyses, the language ${\times}$ task two-way repeated ANOVAs were conducted within the balanced bilingual group first, and then group ${\times}$ language two-way mixed ANOVAs. The results showed that the females in both bilingual groups changed their mean F0 depending on the language they used and the tasks (p<.05), whereas no significant results were found in the males in either group under any conditions. The mean fundamental frequency in the Korean reading task was significantly higher than that in the English reading task for females in both balanced and Korean dominant bilingual groups. Thus, changes in mean F0 depending on language and context may reflect gender-specific characteristics, and females seem to be more sensitive to the socio-cultural standards that are imposed on them.

Bilingualism and Processing Strategies: Backward Transfer in Korean-Chinese Bilinguals (이중언어와 문장 처리 전략: 한국어-중국어 이중언어자의 전략후행전이)

  • Lee, Kwee-Ock;Jun, Jong-Sup;Park, Hye-Won;Ahn, Jung-Ok
    • Korean Journal of Cognitive Science
    • /
    • v.14 no.4
    • /
    • pp.21-31
    • /
    • 2003
  • This paper reports our experimental study with Korean-Chinese (=KC) bilinguals as compared with Korean monolinguals. We aim to find KC bilingual speakers' sentence processing strategies, and the interaction between the Ll and U2 grammars in bilingual development. To this end, we recruited 166 subjects of all age groups from age 3 to adult in the Korean autonomous community in Yanji, China, and did a classical subject/actor identification test, where subjects are supposed to pick out the subjects/actor of both sensical and nonsensical sentences (cf. Liu, Bates & Li, 1992). We compared our results with our previous work on monolingual Koreans, and found out that KC bilinguals rely on word order as well as anumacy; that KC bilinguals make use of morphology at age 10 as compared with age 5 for monolinguals; and that KC bilingual adults rely on animacy and word order as well as morphology, while monolingual Korean adults rely solely on morphology for sentence interpretation. Given that animacy and word order play an important role in the Chinese grammar, our finding lends support to the backward transfer which Liu, Bates & Li (1992) propose for early bilingualism.

  • PDF