통합 검색 | Korea Science

MVC 프레임 워크를 사용한 VoiceXML 다중 뷰 편집기의 설계 및 구현 (A Design and Implementation of the VoiceXML Multiple-View Editor Using MVC Framework)

유재우;염세훈
- 한국음향학회지
- /
- 제23권5호
- /
- pp.390-399
- /
- 2004
본 논문에서는 음성 웹 언어인 VoiceXML의 작성 효율을 향상하기 위한 다중 뷰 편집기를 설계 및 구현하였다. VoiceXML 다중 뷰 편집기는 다중 뷰를 제공하기 위해 MVC (Model-View-Controller) 프레임워크을 이용하였다. MVC 프레임워크를 이용한 다중 뷰 편집기는 핵심 자료구조인 모델과 인터페이스인 뷰, 모델과 뷰를 제어하기 위한 제어기로 구성된다. MVC 프레임워크에서 모델은 추상 구문 트리와 추상 문법으로 구성되며 뷰는 역파싱 규칙과 역파서로 구성되고 제어기는 명령어 처리기와 트리 조작기로 구성된다. VoiceXML 다중 뷰 편집기는 문서의 구조, 내용, 흐름을 동시에 보여주어 기존 XML 편집기의 단점을 극복할 수 있다. MVC 프레임워크가 적용된 VoiceXML 다중 뷰 편집기는 여러 편집기를 통해 동시에 다양한 편집 뷰 (View)를 제공함으로써 사용자에게 음성 웹 문서 작성의 편의성을 제공하여 효율을 높일 수 있으며 여러 개의 뷰가 하나의 모델을 가짐으로써 편집기들의 무결성을 보장하도록 하였다.
PDF KSCI

DWT 계수의 트리구조를 이용한 네트워크-적응적 JPEG2000 컨텍스트 추출방법 (A Network-adaptive Context Extraction Method for JPEG2000 Using Tree-Structure of Coefficients from DWT)

최현준;서영호;김동욱
- 한국통신학회논문지
- /
- 제30권9C호
- /
- pp.939-948
- /
- 2005
본 논문에서는 JPEG2000의 EBCOT에서 과다한 연산량을 요구하는 컨텍스트 추출과정의 연산량을 감소시키는 방법을 제안하였다. 이 방법은 웨이블릿 변환의 특성인 계수들의 트리구조와 그 계수들의 상관도를 이용하여 특정 임계값을 설정하고 그 임계값보다 작은 계수와 그 자손계수들은 컨텍스트 추출과정을 거치지 않게 하는 것이다. 이 임계값이 증가함에 따라 컨텍스트 추출을 위한 연산량과 출력 데이터양이 줄어드나 화질의 열화가 심해지는 연산량과 화질 또는 데이터량간의 상보적 관계가 성립된다. 따라서 이 임계값을 네트워크의 환경 또는 조건에 따라 설정하면 네트워크에 적응적으로 수행할 수 있는 컨텍스트 추출방법이 가능하다. 이 방법을 실험한 결과 수용할 만한 화질의 범위(30dB 이상)의 임계값은 0에서 4사이이었으며, 이 범위에서 연산량은 평균 $3\%$에서 $64\%$를 감소할 수 있고, 출력데이터는 평균 $32\%$에서 $73\%$의 감소율을 보여 수용할 만한 화질의 열화를 대가로 상당한 연산량 감소와 데이터량 감소를 얻을 수 있을 것으로 판단된다. 따라서 제안한 방법은 무선 환경에서 영상/비디오 데이터의 실시간 통신 등에 매우 유용하게 사용될 것으로 기대된다.
PDF KSCI

무손실 의료 영상 압축을 위한 적응적 심볼 교환에 기반을 둔 이진 적응 산술 부호화 방법 (A binary adaptive arithmetic coding algorithm based on adaptive symbol changes for lossless medical image compression)

지창우;박성한
- 한국통신학회논문지
- /
- 제22권12호
- /
- pp.2714-2726
- /
- 1997
본 논문은 디지탈 의료 영상을 효과적으로 무손실 압축하기 위한 적용적 심볼 교환에 기반을 둔 새로운 부호화 방법을 제안한다. 제안하는 알고리즘은 먼저 원영상에 차분 규칙 또는 적용 예측기를 적용하여 차분 영상값을 구하며, 이러한 차분 영상값에 대한 개별 context를 결정한다. 다음 단계에서 context하에서 현재 부호화될 차분 영상값과 모델 템플리트상의 차분 영상값들 사이의 극성 일치를 갖는 심볼의 추정을 기반으로 한 적응적인 심볼 교환 과정을 적용하여 예측 심볼을 얻는다. 예측 심볼은 부호화 될 차분 영상값에 대해 가장 빈번하게 발생하리라고 예측되는 심볼을 가리키며, 예측 심볼이 차분 영상값과 동일할 때 부호화 효율이 높게 유지된다. 마지막 부호화 단계에서 이진 적응 산술 부호기는 특정 context가 주어진 차분 영상값의 예측 여부를 판단하는 이진 판단 트리를 사용하여 차분 영상값을 부호화 한다. 차분 영상값 예측 적중율 향상을 통하여 제안된 알고리즘의 부호화 효율은 ISO JPEG 무손실 예측기를 산술 부호기에 적용한 경우보다 약 33% 정도 높아지고, 차분 예측기 또는 적용 예측기를 산술 부호기에 적용한 경우에 비해 약 23% 정도 높아짐을 알 수 있다. 제안된 부호화 방법은 단위 구간 부분할시 곱셈 연산이 아닌 덧셈 연산을 사용하기 때문에 부호기의 복잡성이 낮고 다중 비트 공간의 영상을 이진 공간 열로 분할하지 않고 바로 다중 비트 의료 영상을 부호기에 적용 할 수 있기 때문에 의료 PACS의 영상 압축부에서 사용될 수 있다.
PDF

Hidden Markov Network 음성인식 시스템의 성능평가에 관한 연구 (A Study on Performance Evaluation of Hidden Markov Network Speech Recognition System)

오세진;김광동;노덕규;위석오;송민규;정현열
- 융합신호처리학회논문지
- /
- 제4권4호
- /
- pp.30-39
- /
- 2003
본 논문에서는 한국어 음성 데이터를 대상으로 HM-Net(Hidden Markov Network) 음성인식 시스템의 성능평가를 수행하였다. 음향모델 작성은 음성인식에서 널리 사용되고 있는 통계적인 모델링 방법인 HMM(Hidden Markov Model)을 개량한 HM-Net을 도입하였다. HM-Net은 기존의 SSS(Successive State Splitting) 알고리즘을 개량한 PDT(Phonetic Decision Tree)-SSS 알고리즘에 의해 문맥방향과 시간방향의 상태분할을 수행하여 생성되는데, 특히 문맥방향 상태분할의 경우 학습 음성데이터에 출현하지 않는 문맥정보를 효과적으로 표현하기 위해 음소결정트리를 채용하고 있으며, 시간방향 상태분할의 경우 학습 음성데이터에서 각 음소별 지속시간 정보를 효과적으로 표현하기 위한 상태분할을 수행하며, 마지막으로 파라미터의 공유를 통해 triphone 형태의 최적인 모델 네트워크를 작성하게 된다. 인식에 사용된 알고리즘은 음소 및 단어인식의 경우에는 One-Pass Viterbi 빔 탐색을 사용하며 트리 구조 형태의 사전과 phone/word-pair 문법을 채용하고 있다. 연속음성인식의 경우에는 단어 bigram과 단어 trigram 언어모델과 목구조 형태의 사전을 채용한 Multi-Pass 빔 탐색을 사용하고 있다. 전체적으로 본 논문에서는 다양한 조건에서 HM-Net 음성인식 시스템의 성능평가를 수행하였으며, 지금까지 소개된 음성인식 시스템과 비교하여 매우 우수한 인식성능을 보임을 실험을 통해 확인할 수 있었다.
PDF

라이다 자료와 정사영상을 이용한 산림지역의 수목영역추출 (Extraction of the Tree Regions in Forest Areas Using LIDAR Data and Ortho-image)

김의명
- 대한공간정보학회지
- /
- 제21권2호
- /
- pp.27-34
- /
- 2013
지구온난화에 대한 관심이 증가함에 따라 온실가스를 저감할 수 있는 산림자원에 대한 관심도가 증가되고 있다. 이러한 산림자원에 대한 정보는 대부분 항공사진 또는 위성영상을 이용한 도화에 의해 구축되었다. 그러나 영상정보만을 이용한 경우 수목이 울창한 산림지역의 수고정보를 정확하게 구축하지 못하는 단점이 발생하였다. 이에 본 연구에서는 라이다 자료와 정사영상을 이용하여 산림지역에서 개별 수목을 분리하고 수고정보를 효율적으로 획득할 수 있는 자료처리 방법을 제안하였다. 라이다를 이용한 자료처리는 정규화된 수치표면모형을 생성한 후 국지적 최대값 필터링을 통하여 수목점을 추출하였다. 또한 정사영상을 이용한 자료처리는 수목영역을 추출하기 위하여 객체기반 영상분류법을 적용하였다. 그리고 라이다 및 정사영상의 결과를 조합하여 최종 수목점을 추출하였다. 용인지역에 대한 실험을 통하여 라이다 자료와 정사영상을 각각 이용하는 방법에 대한 장단점을 분석하고 두 자료를 융합하여 산림지역에서 개별 수목에 대한 정보를 획득할 수 있었다. 이를 통해 제안한 방법의 효율성을 검증할 수 있었다.
https://doi.org/10.7319/kogsis.2013.21.2.027 인용 PDF KSCI

Modelling Duration In Text-to-Speech Systems

정현성
- 대한음성학회지:말소리
- /
- 제49호
- /
- pp.159-174
- /
- 2004
The development of the durational component of prosody modelling was overviewed and discussed in text-to-speech conversion of spoken English and Korean, showing the strengths and weaknesses of each approach. The possibility of integrating linguistic feature effects into the duration modelling of TTS systems was also investigated. This paper claims that current approaches to language timing synthesis still require an understanding of how segmental duration is affected by context. Three modelling approaches were discussed: sequential rule systems, Classification and Regression Tree (CART) models and Sums-of-Products (SoP) models. The CART and SoP models show good performance results in predicting segment duration in English, while it is not the case in the SoP modelling of spoken Korean.
PDF

어휘독립 환경에서의 가변어휘 음성인식에 관한 연구 (A Study on the Variable Vocabulary Speech Recognition in the Vocabulary-Independent Environments)

황병한
- 한국음향학회:학술대회논문집
- /
- 한국음향학회 1998년도 학술발표대회 논문집 제17권 2호
- /
- pp.369-372
- /
- 1998
본 논문은 어휘독립(Vocabulary-Independent) 환경에서 별도의 훈련과정 없이 인식대상 어휘를 추가 및 변경할 수 있는 가변어휘(Variable Vocabulary) 음성인식에 관한 연구를 다룬다. 가변어휘 인식은 처음에 대용량 음성 데이터베이스(DB)로 음소모델을 훈련하고 인식대상 어휘가 결정되면 발음사전에 의거하여 음소모델을 연결함으로써 별도의 훈련과정 없이 인식대상 어휘를 변경 및 추가할 수 있다. 문맥 종속형(Context-Dependent) 음소 모델인 triphone을 사용하여 인식실험을 하였고, 인식성능의 비교를 위해 어휘종속 모델을 별도로 구성하여 인식실험을 하였다. Unseen triphone 문제와 훈련 DB의 부족으로 인한 모델 파라메터의 신뢰성 저하를 방지하기 위해 state-tying 방법 중 음성학적 지식에 기반을 둔 tree-based clustering(TBC) 기법[1]을 도입하였다. Mel Frequency Cepstrum Coefficient(MFCC)와 대수에너지에 기반을 둔 3 가지 음성특징 벡터를 사용하여 인식 실험을 병행하였고, 연속 확률분포를 가지는 Hidden Markov Model(HMM) 기반의 고립단어 인식시스템을 구현하였다. 인식 실험에는 22 개 부서명 DB[3]를 사용하였다. 실험결과 어휘독립 환경에서 최고 98.4%의 인식률이 얻어졌으며, 어휘종속 환경에서의 인식률 99.7%에 근접한 성능을 보였다.
PDF

트리 접합 문법의 LR파싱 알고리즘 (A LR Parsing Algorithm for Tree Adjoining Grammar)

한성국
- 인지과학
- /
- 제6권3호
- /
- pp.41-63
- /
- 1995
트리접합문법의 LR상향식 파싱 방법을 제시한다.먼저 트리접합문법의 형식특성을 기술하기 위한 접합규칙 시스템을 도입하여 파싱과정을 효율적으로 수행할 수 있게 한다.트리접합문법은 문맥의존성을 갖고 있는데,접합 순간은 문맥자 유문법 체계로 기술할 수 있음을 보이고,이러한 특성을 기반으로 상향식 파싱방법을 유도한다.본 논문에서 제시한 LR상향식 파싱방법은 트리접합문법에 문맥자유문법의 파싱방법을 변형하여 적용할 수 있음을 보인다.
PDF

How has belief modality contributed to formal semantics?

Tojo, Satoshi
- 한국언어정보학회:학술대회논문집
- /
- 한국언어정보학회 2007년도 정기학술대회
- /
- pp.42-53
- /
- 2007
Looking back the history of formal treatment of linguistics, we cannot disregard the contribution of possible world semantics. Intensional logic of Montague semantics, DRT (Discourse Representation Theory), mental space, and situation theory are closely related to or compared with the notion of possible world. All these theories have commonly clarified the structure of belief context or uncertain knowledge, employing hypothesized worlds. In this talk, I firstly brief the pedigree of these theories. Next, I will introduce the recent development of modal logic for the representation of (i) knowledge and belief and (ii) time, in which belief modality is precisely discussed together with the accessibility among possible worlds. I will refer to BDI (belief-desire-intention) logic, CTL (computational tree logic), and sphere-based model in belief revision. Finally, I will discuss how these theories could be applied to the further development of analyses of natural language.
PDF

강건한 음향모델을 위한 모델의 상태와 문맥환경에 관한 연구 (A Study on Context Environment and Model State for Robustness Acoustic Models)

최재영;오세진;황도삼
- 한국멀티미디어학회:학술대회논문집
- /
- 한국멀티미디어학회 2003년도 춘계학술발표대회논문집
- /
- pp.366-369
- /
- 2003
본 연구에서는 강건한 문맥의존 음향모델을 작성하기 위한 기초적인 연구로서 문맥환경과 상태수의 변화에 따른 음향모델의 성능을 고찰하고자 한다. 음성은 시간함수로 표현되며 음절, 단어, 연속음성을 발성할때 자음과 모음에 따라 발성시간에 차이가 있으며 음성인식의 최소 인식단위로 널리 사용되는 음소의 앞과 뒤에 오는 문맥환경에 따라 인식성능에 많은 차이를 보이고 있다. 따라서 본 연구에서는 시간의 변화(상태수의 변화)와 상태분할 과정에서 문맥환경의 변화를 고려하여 다양한 형태의 문맥의존 음향모델을 작성하였다. 모델학습은 음소결정트리 기반 SSS 알고리즘(Phonetic Decision Tree-based Successive State Splitting： PDT-555)을 이용하였다 PDT-SSS 알고리즘은 미지의 문맥정보를 해결하기 위해 문맥방향과 시간방향으로 목표 상태수에 도달할 때까지 상태분할을 수행하여 모델을 작성하는 방법이다. 본 연구에서 강건한 문맥의존 음향모델을 학습하기 위한 방법의 유효성을 확인하기 위해 국어공학센터의 452 단어를 대상으로 음소와 단어인식 실험을 수행하였다. 실험결과, 음성의 시간변이에 따른 모델의 상태수와 각 음소의 문맥환경에 따라 인식성능의 변화를 고찰할 수 있었다. 따라서 본 연구는 향후 음성인식 시스템의 강건한 문맥의존 음향모델을 작성하는데 유효할 것으로 기대된다.
PDF

검색결과 143건 처리시간 0.026초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)