• 제목/요약/키워드: TTS system

검색결과 145건 처리시간 0.032초

일본어 합성기에서 악센트 정보가 결합된 발음기호를 이용한 Break 예측 방법 (Break Predicting Methods Using Phonetic Symbols Combined with Accents Information in a Japanese Speech Synthesizer)

  • 나덕수;이종석;김종국;배명진
    • 대한음성학회지:말소리
    • /
    • 제62호
    • /
    • pp.69-84
    • /
    • 2007
  • Japanese is a language having intonations, which are indicated by the relative differences in pitch heights and the accentual phrases (APs) are placed according to the changes of the accents while a break occurs on a boundary of the APs. Although a break can be predicted by using J-ToBI, which is a rule-based or statistical approach, it is very difficult to predict a break exactly due to the flexibility. Therefore, in this paper, a method which can enhance the quality of synthesized speech by reducing the errors in predicting break indices (BI), are proposed. The method is to use a new definition for the phonetic symbols, which combine the phonetic values of Japanese words with the accents information. Since a stream of defined phonetic symbols includes the information on the changes in intonations, the BI can be easily predicted by dividing the intonation phrase (IP) into several APs. As a result of an experiment, the accuracy of break generations was 98 % and the proposed method contributed itself to enhance the naturalness of synthesized speeches.

  • PDF

TTS를 활용한 영어 교육용 시스템 구현 (Development of English Education System Using TTS)

  • 연용흠;임순용;임성수;민지선;송한솔;김봉현;가민경;조동욱;배영래
    • 한국산학기술학회:학술대회논문집
    • /
    • 한국산학기술학회 2011년도 춘계학술논문집 2부
    • /
    • pp.892-896
    • /
    • 2011
  • 영어 교육용 소프트웨어는 다양한 기법을 적용하여 개발, 활용되고 있으며 영어 능력을 중요시하는 현재의 시대상을 반영하듯 학교, 학원, 직장 외에 개인 PC를 이용해 시간과 장소의 제약 없이 쉽고, 재미있게 영어 공부를 돕는데 목적이 두고 지속적으로 개발되고 있다. 따라서 본 논문에서는 영어 교육의 중요성을 높게 판단하여 영어 단어를 중점적으로 학습하는데 목표를 둔 시스템을 구현하였다. 즉, TTS를 활용하여 음성적 교육 방식을 적용하였으며 영어 단어 학습 과정과 문제 풀이 과정으로 분류하여 영어 공부에 대한 흥미를 유발시키는 시스템을 설계하였으며 개인 계정을 통한 학습 과정 진도를 저장 및 관리하는 시스템 환경을 구현하였다.

  • PDF

A Study on Visual Feedback Control of a Dual Arm Robot with Eight Joints

  • Lee, Woo-Song;Kim, Hong-Rae;Kim, Young-Tae;Jung, Dong-Yean;Han, Sung-Hyun
    • 제어로봇시스템학회:학술대회논문집
    • /
    • 제어로봇시스템학회 2005년도 ICCAS
    • /
    • pp.610-615
    • /
    • 2005
  • Visual servoing is the fusion of results from many elemental areas including high-speed image processing, kinematics, dynamics, control theory, and real-time computing. It has much in common with research into active vision and structure from motion, but is quite different from the often described use of vision in hierarchical task-level robot control systems. We present a new approach to visual feedback control using image-based visual servoing with the stereo vision in this paper. In order to control the position and orientation of a robot with respect to an object, a new technique is proposed using a binocular stereo vision. The stereo vision enables us to calculate an exact image Jacobian not only at around a desired location but also at the other locations. The suggested technique can guide a robot manipulator to the desired location without giving such priori knowledge as the relative distance to the desired location or the model of an object even if the initial positioning error is large. This paper describes a model of stereo vision and how to generate feedback commands. The performance of the proposed visual servoing system is illustrated by the simulation and experimental results and compared with the case of conventional method for dual-arm robot made in Samsung Electronics Co., Ltd.

  • PDF

스마트폰 자이로센서를 이용한 시각장애인용 광학문자인식 방법 (An Optical Character Recognition Method using a Smartphone Gyro Sensor for Visually Impaired Persons)

  • 권순각;김흥준
    • 한국산업정보학회논문지
    • /
    • 제21권4호
    • /
    • pp.13-20
    • /
    • 2016
  • 현대 사회에서 스마트폰은 장착된 고화질의 카메라를 이용하여 광학문자인식시스템을 구현할 수 있다. 광학문자시스템으로부터 인식된 문자들은 또한 TTS를 이용하여 시각장애인들에게 음성 서비스를 제공할 수 있다. 문자 정보가 들어있는 객체에 대하여 스마트 폰 카메라를 사용하여 촬영하는 것도 시각장애인들에게는 다소 어려운 일이다. 왜냐하면 피사체의 촬영 이미지를 볼 수가 없기 때문이다. 이러한 문제점을 해결하기 위하여 본 논문에서는 스마트폰의 자이로 센서를 사용하여 시각장애인들의 올바른 촬영을 유도하는 방법을 제안한다. 구현된 프로그램을 사용하여 모의 실험한 결과, 제안된 방법은 같은 객체로부터 보다 많은 문자를 인식하는 것을 확인할 수 있었다.

능동형 서비스를 제공하는 CAMUS 시스템에 관한 설계 및 구현 (Design and Implementation of the CAMUS system based Proactive Service)

  • 정인철;조준면;이강우;김형선
    • 한국IT서비스학회:학술대회논문집
    • /
    • 한국IT서비스학회 2007년도 추계학술대회
    • /
    • pp.373-377
    • /
    • 2007
  • 유비쿼터스 환경에서 사용자에게 유용한 서비스를 제공하기 위해서는 기능을 명시적으로 제공하기 보다는 사용자의 요구에 따라서 능동형으로 제공하는 기능이 필요하다. 이러한 능동형 서비스는 알아서 서비스를 수행하는 기능으로 CAMUS 시스템에서는 서비스 탐색 부분에서 사용된다. 즉 시스템의 상황에 따라서 메시지 시스템을 구현하는 경우에 자원의 형태에 따라서 영상 메세징, TTS 기능을 이용한 메세징, Text 기반 메세징 시스템으로 자동적으로 처리할 수 있다. 이를 위해 CAMUS 서버에는 SAM(Service Agent Manager) 과의 통신을 통해 환경 내에 존재하는 센서와 장치들 (Service Agent)을 관리 및 제어한다. 이러한 Service Agent Manager 는 여러 다양한 환경에 설치되어 환경 내에 위치한 다양한 센서로부터 정보를 얻고 그 정보를 CAMUS 메인 서버에 전달하는 한편 CAMUS 메인 서버로부터 실행명령을 받아 환경 내 장치를 제어하는 역할을 한다. 이러한 Service Agent Manager는 임의의 공간 내에 설치될 수 있으며 로봇단말이나 개인 휴대단말 등에도 설치될 수 있다 이 논문에서는 SAM(Service Agent Manager) 과 CAMUS 서버에서 원하는 서비스를 탐색하는 방법에 대한 내용을 기술하였다.

  • PDF

시각장애인용 웹사이트 자동생성 툴 개발 (Development of Automatic Creating Web-Site Tool for the Blind)

  • 백현기;하태현
    • 디지털콘텐츠학회 논문지
    • /
    • 제8권4호
    • /
    • pp.467-474
    • /
    • 2007
  • 본 연구는 시각장애인을 위해 음성 인식, 음성 합성 기술을 이용하여 일반인과 마찬가지로 개인의 특성에 맞는 홈페이지를 구축하게 하는 웹 사이트 자동 생성 툴을 개발 하였다. 이 연구에서 개발한 툴을 이용하여 시각 장애인은 개인 맞춤 정보 생성 기능과 관리기능을 통해 일반인과 의사소통을 원활하게 할 수 있다. 또한 이 툴은 기본적인 명령어를 음성인식으로 처리할 수 있게 지원하며, 음성출력이 지원되는 TTS등을 추가적으로 제공한다. 따라서 본 연구개발의 결과물은 시각장애인들이 사회적 소외감을 없애며, 정보화 시대에 동등한 위치에서 생활 할 수 있도록 하는데 중요한 역할을 할 것이다.

  • PDF

한국어 TTS 시스템을 위한 운율구 경계 예측 (Prosodic-Boundary Prediction for Korean Text-to-Speech System)

  • 전진욱;김한우;김동건;이양희
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 2002년도 하계학술발표대회 논문집 제21권 1호
    • /
    • pp.77-82
    • /
    • 2002
  • 운율은 음성의 초분절적인 면에 연관하는 음성의 한 성으로서 통상적으로 화자는 음성을 달하는 과정에서 청자의 이해를 돕기 위해 운율을 사용하게 된다. 본 논문은 이러한 운율을 이루는 성분 중의 하나인 운율구의 위치 예측에 대한 성능을 향상시키는 것에 그 목적을 둔다. 한국어 운율 정보에 대한 표기 방법 중의 하나인 K-ToBI를 기반으로 하여, 운율구의 경계와 그에 대한 레벨을 Break Indices 정보로서 나타내었고, 통계학 분야에서 제안된 Support Vector Machine(SVM)을 이용하여 시스템의 예측률 향상을 꾀하였다. 기존의 방법에서 사용된 트리 기반 모델을 이용하여 한국어 운율에 가장 많은 영향을 끼치는 언어 정보들을 추출하였고 이를 실험에 적용하였다. 기존의 트리 모델과 SVM 모델에 대한 예측률을 비교한 결과, 경계 유무 정보 예측과 4단계의 레벨을 가지는 경계 정보의 예측에서 모두 본 방법이 보다 높은 예측률을 보여 주어 본 연구에서 제시한 접근법이 운율구의 경계 정보를 예측하는 데에 있어 더욱 효과적인 접근법임을 실험적으로 입증하였다.

  • PDF

신호등 인식 성능 향상을 위한 쿠버네티스 기반의 프레임워크: YOLOv5와 Visual Attention을 적용한 C-RNN의 융합 Vision AI 시스템 (Kubernetes-based Framework for Improving Traffic Light Recognition Performance: Convergence Vision AI System based on YOLOv5 and C-RNN with Visual Attention)

  • 조형서;이민정;한연지
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2022년도 추계학술발표대회
    • /
    • pp.851-853
    • /
    • 2022
  • 고령화로 인해 65세 이상 운전자가 급증하며 고령운전자의 교통사고 비율이 증가함에 따라 시급한 사회 문제로 떠오르고 있다. 이에 본 연구에서는 객체 검출, 인식 모델을 결합하고 신호등을 인식하여 Text-To-Speech(TTS)로 알리는 쿠버네티스 기반의 프레임워크를 제안한다. 객체 검출 단계에서는 YOLOv5 모델들의 성능을 비교하여 활용하였으며 객체 인식 단계에서는 C-RNN 기반의 attention-OCR 모델을 활용하였다. 이는 신호등의 내부 LED 영역이 아닌 이미지 전체를 인식하는 방식으로 오탐지 요소를 낮춰 인식률을 높였다. 결과적으로 1,628장의 테스트 데이터에서 accuracy 0.997, F1-score 0.991의 성능 평가를 얻어 제안한 프레임워크의 타당성을 입증하였다. 본 연구는 후속 연구에서 특정 도메인에 딥러닝 모델을 한정하지 않고 다양한 분야의 모델을 접목할 수 있도록 하며 고령 운전자 및 신호 위반으로 인한 교통사고 문제를 예방할 수 있다.

구문 관계와 운율 특성을 이용한 한국어 운율구 경계 예측 (Prediction of Prosodic Break Using Syntactic Relations and Prosodic Features)

  • 정영임;조선호;윤애선;권혁철
    • 인지과학
    • /
    • 제19권1호
    • /
    • pp.89-105
    • /
    • 2008
  • 본 논문에서는 자연스러운 한국어 운율구 경계를 예측하기 위해 (1) 문장 성분을 하위범주화하고, (2) 세분화된 문장 성분 간 의존관계를 이용하여 통사구를 추출하며 (3) 추출한 통사구의 유형에 따른 운율구 경계 예측 규칙을 설정하였다. 또한, (4) 통사적 정보 외에도 통사구와 문장의 길이, 통사구의 문장 내 위치, 문맥의 의미 정보 등에 따라 가변적인 운율구 경계를 판단하여 보다 자연스러운 한국어 운율구 경계 예측 시스템을 개발하였다. 그 결과 통사구 경계와 상관관계가 높은 강한 운율구 경계 예측과 운율구 내부 비경계 예측에 있어 90% 이상의 높은 재현율과 정확도를 보였으며, 전체 운율구 경계 예측에 있어서도 87% 이상의 성능을 보였다.

  • PDF

스마트공장 표준 인증제도 도입에 관한 인식 조사 (The Study on Perception of Adoption of Certification System for Smart Factory)

  • 김경일
    • 융합정보논문지
    • /
    • 제7권3호
    • /
    • pp.153-158
    • /
    • 2017
  • 최근에 제조기업들간에 이슈가 되고 있는 스마트공장의 성공적 확산을 위하여 기업들이 자발적, 경쟁적으로 스마트공장을 도입할 수 있도록 표준 인증제 수립을 위한 기본 모델을 제시하는 민관의 움직임이 활발하게 이루어지고 있다. 그러나 인증제도를 도입하기 위해서는 인증 운영체계의 정비는 물론 스마트공장에 대한 사회 전반의 공감대를 형성해야 하므로 제도 도입에 대한 심도있는 검토가 필요하다. 본 연구는 이러한 연구의 필요성에 따라 아직까지 국내에 스마트공장 인증제도가 도입되지 않은 상황에서 인증제도 도입에 대한 다양한 이해관계자들의 인식을 조사하는데 그 목적이 있다. 조사연구 결과, 과거 공장관리에서 전사적 경영으로 제조프로세스관리의 패러다임이 변화되었고, 조직의 경영성과를 달성하기 위한 새로운 제조프로세스관리체계와 관련 경영활동을 적절하게 평가할 수 있는 도구에 대한 필요성이 도출되었다. 그러나 인증제도는 협의해야 할 과제가 많아 제조기업의 스마트공장 인프라 부실과 인증제도 추진시 인증제도의 부작용 등이 인증제도 도입의 방해요소로 작용하는 것으로 파악되었다. 인증제도의 성공적인 도입을 위하여는 인증 조직체계의 정비, 관련법 제 개정, 중소기업청 주도의 시범사업 운영, 전문인력 양성, 인센티브 정책 마련이 확립되어야 하는 것으로 결과를 도출하였다.