This paper proposes a method to improve speech recognition performance by extracting various pronunciations of the pseudo-morpheme unit from an eojeol unit corpus and generating a new recognition unit considering pronunciation variations. In the proposed method, we first align the pronunciation of the eojeol units and the pseudo-morpheme units, and then expand the pronunciation dictionary by extracting the new pronunciations of the pseudo-morpheme units at the pronunciation of the eojeol units. Then, we propose a new recognition unit that relies on pronunciation by tagging the obtained phoneme symbols according to the pseudo-morpheme units. The proposed units and their extended pronunciations are incorporated into the lexicon and language model of the speech recognizer. Experiments for performance evaluation are performed using the Korean speech recognizer with a trigram language model obtained by a 100 million pseudo-morpheme corpus and an acoustic model trained by a multi-genre broadcast speech data of 445 hours. The proposed method is shown to reduce the word error rate relatively by 13.8% in the news-genre evaluation data and by 4.5% in the total evaluation data.
The genes related to specific events or pathways in bacteria are frequently localized proximate to the genome of their neighbors, as with the structures known as operon, but eukaryotic genes seem to be independent of their neighbors, and are dispersed randomly throughout genomes. Although cases are rare, the findings from structures similar to prokaryotic operons in the nematode genome, and the clustering of housekeeping genes on human genome, lead us to assess the genomic association of genes as functional subunits. We evaluated the genomic association of neighboring genes on chromosomes 4 and 5 of Arabidopsis thaliana with and without respectively consideration of the scaffold/matrixattached regions (S/MAR) loci. The observed number of functionally identical bigrams and trig rams were significantly higher than expected, and these results were verified statistically by calculating p-values for weighted random distributions. The observed frequency of functionally identical big rams and trig rams were much higher in chromosome 4 than in chromosome 5, but the frequencies with, and without, consideration of the S/MAR in each chromosome were similar. In this study, a genomic association among functionally related neighboring genes in Arabidopsis thaliana was suggested.
Journal of Advanced Marine Engineering and Technology
/
v.34
no.6
/
pp.871-879
/
2010
In this paper, we present a system that classifies comments on a news article into a user opinion called a polarity (positive or negative). The system is a kind of document classification system for comments and is based on machine learning techniques like support vector machine. Unlike normal documents, comments have their body that can influence classifying their opinions as polarities. In this paper, we propose a feature weighting scheme using such characteristics of comments and several resources for opinion classification. Through our experiments, the weighting scheme have turned out to be useful for opinion classification in comments on Korean news articles. Also Korean character n-grams (bigram or trigram) have been revealed to be helpful for opinion classification in comments including lots of Internet words or typos. In the future, we will apply this scheme to opinion analysis of comments of product reviews as well as news articles.
Journal of the Korean association of regional geographers
/
v.11
no.3
/
pp.367-380
/
2005
This paper aims to investigate the characteristics of house site selection and its expression of building through manuscript of Taegdanggip which was authored by Lee-sik in the middle of Chosun dynasty. Its results are summarized in the following. Firstly, as a Confucianist, Lee-sik selected his ancestor's grave site as well as his house site by means of divination sign. And then he interpreted the characteristics of the location from feng-shui perspective. Secondly, he built Taepoongdang(literally 'pond and wind house') as his house for retirement based on a trigram from the Book of Changes. He reflected the divination sign in consturcting his house Taekpoongdang. Finally, the location of Taekpoongdang and Baekagog village was well suitable to feng-shui theory.
Journal of the Korean Institute of Intelligent Systems
/
v.18
no.4
/
pp.501-506
/
2008
Statistical POS tagging is prone to error, because of the inherent limitations of statistical data, especially single source of data. Therefore it is widely agreed that the possibility of further enhancement lies in exploiting various knowledge sources. However these data sources are bound to be inconsistent to each other. This paper shows the possibility of using maximum entropy model to Korean language POS tagging. We use as the knowledge sources n-gram data and trigger pair data. We show how perplexity measure varies when two knowledge sources are combined using maximum entropy method. The experiment used a trigram model which produced 94.9% accuracy using Hidden Markov Model, and showed increase to 95.6% when combined with trigger pair data using Maximum Entropy method. This clearly shows possibility of further enhancement when various knowledge sources are developed and combined using ME method.
Journal of the Institute of Convergence Signal Processing
/
v.4
no.4
/
pp.30-39
/
2003
In this paper, we carried out the performance evaluation of HM-Net(Hidden Markov Network) speech recognition system for Korean speech databases. We adopted to construct acoustic models using the HM-Nets modified by HMMs(Hidden Markov Models), which are widely used as the statistical modeling methods. HM-Nets are carried out the state splitting for contextual and temporal domain by PDT-SSS(Phonetic Decision Tree-based Successive State Splitting) algorithm, which is modified the original SSS algorithm. Especially it adopted the phonetic decision tree to effectively express the context information not appear in training speech data on contextual domain state splitting. In case of temporal domain state splitting, to effectively represent information of each phoneme maintenance in the state splitting is carried out, and then the optimal model network of triphone types are constructed by in the parameter. Speech recognition was performed using the one-pass Viterbi beam search algorithm with phone-pair/word-pair grammar for phoneme/word recognition, respectively and using the multi-pass search algorithm with n-gram language models for sentence recognition. The tree-structured lexicon was used in order to decrease the number of nodes by sharing the same prefixes among words. In this paper, the performance evaluation of HM-Net speech recognition system is carried out for various recognition conditions. Through the experiments, we verified that it has very superior recognition performance compared with the previous introduced recognition system.
The visual span refers to the number of letters that can be accurately recognized without moving one's eyes. The size of the visual span is affected by sensory factors such as perimetric complexity, crowding, and mislocation of letters. Korean Hangul utilizes rather unique alphabetic-syllabary writing system, quite different from English and Chinese writing systems. Due to this combinatorial nature of the script, the visual span for Hangul characters can also be affected by the letter type (e.g., CV vs CVCC). The present study examined the effect of syllable complexity on the visual span for Hangul by comparing letter recognition accuracy across four letter type conditions (C only, CV, CVC, and CVCC). We also aimed to determine the meaningful letter type(s) that is associated with differences in reading abilities in Korean. Using a trigram presentation method, we found that overall recognition accuracy declined as syllable complexity increased. However, the visual span for CVC type was greater than that for CV type, suggesting that the effect is not necessarily linear, and that there might be other factors affecting the visual span for these types of letters. C and CV type showed fairly strong positive correlations with reading comprehension, suggesting that these might be the meaningful units for measuring visual span in relating to reading abilities.
Noju Oh Hui-sang was a Confucian who was active during the reign of King Sunjo in late Joseon Dynasty and he also was a master of the Sallim faction. Though he is known as an eclectic Neo-Confucian, he had profound knowledge in the study of Confucian classics as well through succeeding the family study handed down by his father Oh Jae-sun and his oldest brother Oh Yun-sang. This thesis hereby examines Noju's Confucianism doctrine and its characteristics. Noju's Confucianism doctrine is characterized significantly with the following aspects. First, its analyses are detailed overall and it annotates chapters and verses mostly related to Neo-Confucian theories on interpretation of the Confucian classics. Second, it conducts in-depth study not only on Chu Hsi's annotation but also on the small commentaries (小注) in Compendium of the Commentaries on Four Chinese Classics (四書集註大全). In terms of Chu Hsi's theory, however, Noju interprets Confucian classics while supplementing shortcomings on Chu Hsi's theory rather than opposing it. For opinions of all philosophers and scholars on small commentaries, it expresses rather critical theories than supporting ones. Third, it quotes many theories not only of Chinese Confucians but also of Korean ones. It mainly introduces theories of Namdang Han Won-jin, including those of Yi Yulgok. Among them, it particularly has frequent quotations from Han Won-jin's Kyoungyigimunrok (經義記聞錄). Fourth, Noju actively acknowledges senior Confucians' theories many times in quoting them but he also daringly points out their errors when a theory is thought not to be appropriate. He indicates errors one by one in theories not only of Uam and Yulgok but even of Mencius. Fifth, it especially discusses Book of Changes (周易) in depth. It tends to criticize Chengzi's I-Chuan (易傳) but accept Chu Hsi's Benyi (本義). It roughly explains Book of Changes in general but seldom directly accounts for trigrams of it other than Qian trigram and it has detailed explanation especially on Xicizhuan (繫辭傳).
In The Canonical Scripture (典經), the core scripture of Daesoon Thought, the Former World and the Later World are divided into the Era of Mutual Contention and the Era of Mutual Beneficence. This concept of the Former World and the Later World appears in diagrams on I-Ching Studies (易學) in the text titled, The Comprehensive Mirror of Taegeukdo (太極道通鑑). In I-Ching Studies, Anterior Heaven (先天) and Posterior Heaven (後天) are the main concepts in Song Dynasty diagram books on I-Ching Studies. Among the diagrams of I-Ching Studies, Fuxi's Diagram of the Sequence of the Eight Trigrams, Fuxi's Diagram of the Positions of the Eight Trigrams, Fuxi's Diagram of the Sequence of the 64 Hexagrams, and Fuxi's Diagram of the Positions of the 64 Hexagrams correspond to the Anterior Heaven, and King Wen's Diagram of the Sequence of the Eight Trigrams and King Wen's Diagram of the Positions of the Eight Trigrams correspond to Posterior Heaven. In The Comprehensive Mirror of Taegeukdo, the diagrams of I-Ching Studies are reinterpreted according to Daesoon Thought. The Diagram of the Eight Trigrams of King Wen's Era corresponds to King Wen's Diagram of the Eight Trigrams in I-Ching Studies. This diagram was drawn according to the text in Chapter Five of the Treatise of Remarks on the Trigrams. This diagram corresponds to "the Era of the Nobility of Earth (地尊時代)" centered on the trigram kun (坤 / ☷ ground). Fuxi's Diagram of the Positions of the Eight Trigrams in I-Ching Studies corresponds to The Diagram of the Positions of the Eight Trigrams of Fuxi's Era in Daesoon Thought. The most significant feature of this diagram is that the trigrams assigned to the directions of north and south match the hexagram indicating the obstruction of Heaven and Earth. This is hexagram 12 (否), meaning "obstruction," and it depicts no exchange or communication between Yin and Yang. Naturally, this symbolizes mutual destruction overtaking Yin and Yang. Daesoon Thought expresses this as "the Era of the Nobility of Heaven (天尊時代)." The most significant feature of The Diagram of the Eight Trigrams of the Corrected Book of Changes in The Comprehensive Mirror of Taegeukdo is that the trigrams assigned to the directions of south and north are indicative of hexagram 11, Peace on Earth and in Heaven (泰). This is a diagram in which mutual destruction is resolved through the Five Phases because the trigrams for water (坎 / ☵) and fire (離 / ☲) are in a corrected orientation. Therefore, this diagram symbolizes a world "free from Mutual Contention" and "the Era of Human Nobility (人尊時代)." According to the contents of The Canonical Scripture, the Supreme God performed the Reordering Works of the Three Realms to correct the Mutual Contention of the Former World, and as a result, the Mutual Contention of the Former World will give way to the implementation of the Dao of Mutual Beneficence. The Supreme God's Reordering Works of the Three Realms have been completed in the realm of divine beings, but in the Later World, they appear as an Earthly Paradise where the Dao of Mutual Beneficence is realized. The diagram depicting the Later World is The Diagram of the Eight Trigrams of the Era of the Corrected Book of Changes in The Comprehensive Mirror of Taegeukdo.
본 웹사이트에 게시된 이메일 주소가 전자우편 수집 프로그램이나
그 밖의 기술적 장치를 이용하여 무단으로 수집되는 것을 거부하며,
이를 위반시 정보통신망법에 의해 형사 처벌됨을 유념하시기 바랍니다.
[게시일 2004년 10월 1일]
이용약관
제 1 장 총칙
제 1 조 (목적)
이 이용약관은 KoreaScience 홈페이지(이하 “당 사이트”)에서 제공하는 인터넷 서비스(이하 '서비스')의 가입조건 및 이용에 관한 제반 사항과 기타 필요한 사항을 구체적으로 규정함을 목적으로 합니다.
제 2 조 (용어의 정의)
① "이용자"라 함은 당 사이트에 접속하여 이 약관에 따라 당 사이트가 제공하는 서비스를 받는 회원 및 비회원을
말합니다.
② "회원"이라 함은 서비스를 이용하기 위하여 당 사이트에 개인정보를 제공하여 아이디(ID)와 비밀번호를 부여
받은 자를 말합니다.
③ "회원 아이디(ID)"라 함은 회원의 식별 및 서비스 이용을 위하여 자신이 선정한 문자 및 숫자의 조합을
말합니다.
④ "비밀번호(패스워드)"라 함은 회원이 자신의 비밀보호를 위하여 선정한 문자 및 숫자의 조합을 말합니다.
제 3 조 (이용약관의 효력 및 변경)
① 이 약관은 당 사이트에 게시하거나 기타의 방법으로 회원에게 공지함으로써 효력이 발생합니다.
② 당 사이트는 이 약관을 개정할 경우에 적용일자 및 개정사유를 명시하여 현행 약관과 함께 당 사이트의
초기화면에 그 적용일자 7일 이전부터 적용일자 전일까지 공지합니다. 다만, 회원에게 불리하게 약관내용을
변경하는 경우에는 최소한 30일 이상의 사전 유예기간을 두고 공지합니다. 이 경우 당 사이트는 개정 전
내용과 개정 후 내용을 명확하게 비교하여 이용자가 알기 쉽도록 표시합니다.
제 4 조(약관 외 준칙)
① 이 약관은 당 사이트가 제공하는 서비스에 관한 이용안내와 함께 적용됩니다.
② 이 약관에 명시되지 아니한 사항은 관계법령의 규정이 적용됩니다.
제 2 장 이용계약의 체결
제 5 조 (이용계약의 성립 등)
① 이용계약은 이용고객이 당 사이트가 정한 약관에 「동의합니다」를 선택하고, 당 사이트가 정한
온라인신청양식을 작성하여 서비스 이용을 신청한 후, 당 사이트가 이를 승낙함으로써 성립합니다.
② 제1항의 승낙은 당 사이트가 제공하는 과학기술정보검색, 맞춤정보, 서지정보 등 다른 서비스의 이용승낙을
포함합니다.
제 6 조 (회원가입)
서비스를 이용하고자 하는 고객은 당 사이트에서 정한 회원가입양식에 개인정보를 기재하여 가입을 하여야 합니다.
제 7 조 (개인정보의 보호 및 사용)
당 사이트는 관계법령이 정하는 바에 따라 회원 등록정보를 포함한 회원의 개인정보를 보호하기 위해 노력합니다. 회원 개인정보의 보호 및 사용에 대해서는 관련법령 및 당 사이트의 개인정보 보호정책이 적용됩니다.
제 8 조 (이용 신청의 승낙과 제한)
① 당 사이트는 제6조의 규정에 의한 이용신청고객에 대하여 서비스 이용을 승낙합니다.
② 당 사이트는 아래사항에 해당하는 경우에 대해서 승낙하지 아니 합니다.
- 이용계약 신청서의 내용을 허위로 기재한 경우
- 기타 규정한 제반사항을 위반하며 신청하는 경우
제 9 조 (회원 ID 부여 및 변경 등)
① 당 사이트는 이용고객에 대하여 약관에 정하는 바에 따라 자신이 선정한 회원 ID를 부여합니다.
② 회원 ID는 원칙적으로 변경이 불가하며 부득이한 사유로 인하여 변경 하고자 하는 경우에는 해당 ID를
해지하고 재가입해야 합니다.
③ 기타 회원 개인정보 관리 및 변경 등에 관한 사항은 서비스별 안내에 정하는 바에 의합니다.
제 3 장 계약 당사자의 의무
제 10 조 (KISTI의 의무)
① 당 사이트는 이용고객이 희망한 서비스 제공 개시일에 특별한 사정이 없는 한 서비스를 이용할 수 있도록
하여야 합니다.
② 당 사이트는 개인정보 보호를 위해 보안시스템을 구축하며 개인정보 보호정책을 공시하고 준수합니다.
③ 당 사이트는 회원으로부터 제기되는 의견이나 불만이 정당하다고 객관적으로 인정될 경우에는 적절한 절차를
거쳐 즉시 처리하여야 합니다. 다만, 즉시 처리가 곤란한 경우는 회원에게 그 사유와 처리일정을 통보하여야
합니다.
제 11 조 (회원의 의무)
① 이용자는 회원가입 신청 또는 회원정보 변경 시 실명으로 모든 사항을 사실에 근거하여 작성하여야 하며,
허위 또는 타인의 정보를 등록할 경우 일체의 권리를 주장할 수 없습니다.
② 당 사이트가 관계법령 및 개인정보 보호정책에 의거하여 그 책임을 지는 경우를 제외하고 회원에게 부여된
ID의 비밀번호 관리소홀, 부정사용에 의하여 발생하는 모든 결과에 대한 책임은 회원에게 있습니다.
③ 회원은 당 사이트 및 제 3자의 지적 재산권을 침해해서는 안 됩니다.
제 4 장 서비스의 이용
제 12 조 (서비스 이용 시간)
① 서비스 이용은 당 사이트의 업무상 또는 기술상 특별한 지장이 없는 한 연중무휴, 1일 24시간 운영을
원칙으로 합니다. 단, 당 사이트는 시스템 정기점검, 증설 및 교체를 위해 당 사이트가 정한 날이나 시간에
서비스를 일시 중단할 수 있으며, 예정되어 있는 작업으로 인한 서비스 일시중단은 당 사이트 홈페이지를
통해 사전에 공지합니다.
② 당 사이트는 서비스를 특정범위로 분할하여 각 범위별로 이용가능시간을 별도로 지정할 수 있습니다. 다만
이 경우 그 내용을 공지합니다.
제 13 조 (홈페이지 저작권)
① NDSL에서 제공하는 모든 저작물의 저작권은 원저작자에게 있으며, KISTI는 복제/배포/전송권을 확보하고
있습니다.
② NDSL에서 제공하는 콘텐츠를 상업적 및 기타 영리목적으로 복제/배포/전송할 경우 사전에 KISTI의 허락을
받아야 합니다.
③ NDSL에서 제공하는 콘텐츠를 보도, 비평, 교육, 연구 등을 위하여 정당한 범위 안에서 공정한 관행에
합치되게 인용할 수 있습니다.
④ NDSL에서 제공하는 콘텐츠를 무단 복제, 전송, 배포 기타 저작권법에 위반되는 방법으로 이용할 경우
저작권법 제136조에 따라 5년 이하의 징역 또는 5천만 원 이하의 벌금에 처해질 수 있습니다.
제 14 조 (유료서비스)
① 당 사이트 및 협력기관이 정한 유료서비스(원문복사 등)는 별도로 정해진 바에 따르며, 변경사항은 시행 전에
당 사이트 홈페이지를 통하여 회원에게 공지합니다.
② 유료서비스를 이용하려는 회원은 정해진 요금체계에 따라 요금을 납부해야 합니다.
제 5 장 계약 해지 및 이용 제한
제 15 조 (계약 해지)
회원이 이용계약을 해지하고자 하는 때에는 [가입해지] 메뉴를 이용해 직접 해지해야 합니다.
제 16 조 (서비스 이용제한)
① 당 사이트는 회원이 서비스 이용내용에 있어서 본 약관 제 11조 내용을 위반하거나, 다음 각 호에 해당하는
경우 서비스 이용을 제한할 수 있습니다.
- 2년 이상 서비스를 이용한 적이 없는 경우
- 기타 정상적인 서비스 운영에 방해가 될 경우
② 상기 이용제한 규정에 따라 서비스를 이용하는 회원에게 서비스 이용에 대하여 별도 공지 없이 서비스 이용의
일시정지, 이용계약 해지 할 수 있습니다.
제 17 조 (전자우편주소 수집 금지)
회원은 전자우편주소 추출기 등을 이용하여 전자우편주소를 수집 또는 제3자에게 제공할 수 없습니다.
제 6 장 손해배상 및 기타사항
제 18 조 (손해배상)
당 사이트는 무료로 제공되는 서비스와 관련하여 회원에게 어떠한 손해가 발생하더라도 당 사이트가 고의 또는 과실로 인한 손해발생을 제외하고는 이에 대하여 책임을 부담하지 아니합니다.
제 19 조 (관할 법원)
서비스 이용으로 발생한 분쟁에 대해 소송이 제기되는 경우 민사 소송법상의 관할 법원에 제기합니다.
[부 칙]
1. (시행일) 이 약관은 2016년 9월 5일부터 적용되며, 종전 약관은 본 약관으로 대체되며, 개정된 약관의 적용일 이전 가입자도 개정된 약관의 적용을 받습니다.