• 제목/요약/키워드: Voice Recognition Technology

검색결과 212건 처리시간 0.029초

잡음 환경에서의 음성 검출 알고리즘 비교 연구 (A Comparative Study of Voice Activity Detection Algorithms in Adverse Environments)

  • 양경철;육동석
    • 대한음성학회:학술대회논문집
    • /
    • 대한음성학회 2006년도 춘계 학술대회 발표논문집
    • /
    • pp.45-48
    • /
    • 2006
  • As the speech recognition systems are used in many emerging applications, robust performance of speech recognition systems under extremely noisy conditions become more important. The voice activity detection (VAD) has been taken into account as one of the important factors for robust speech recognition. In this paper, we investigate conventional VAD algorithms and analyze the weak and the strong points of each algorithm.

  • PDF

An Interactive Voice Web Browser Usable as a Multimodal Interface in Information Devices by Using VoiceXML

  • Jang, Min-Seok
    • 한국지능시스템학회논문지
    • /
    • 제14권6호
    • /
    • pp.771-775
    • /
    • 2004
  • The present Web surroundings is mostly composed of HTML(Hypertext Mark-up Language) and thereby users obtain web informations mainly in GUI(Graphical User Interface) environment by clicking mouse in order to keep up with hyperlinked informations. However it is very inconvenient to work in this environment comparing with easily accessed one in which human`s voice is utilized for obtaining informations. Using VoiceXML, resulted from XML, for supplying the information through telephone on the basis of the contemporary matured technology of voice recognition/synthesis to work out the inconvenience problem, this paper presents the research results about VoiceXML VUI(Voice User Interface) Browser designed and implemented for realizing its technology and also the VoiceXML Dialog designed for the purpose of the browser's efficient use.

Windows95 환경에서의 음성 인터페이스 구현 (Implementation of speech interface for windows 95)

  • 한영원;배건성
    • 전자공학회논문지S
    • /
    • 제34S권5호
    • /
    • pp.86-93
    • /
    • 1997
  • With recent development of speech recognition technology and multimedia computer systems, more potential applications of voice will become a reality. In this paper, we implement speech interface on the windows95 environment for practical use fo multimedia computers with voice. Speech interface is made up of three modules, that is, speech input and detection module, speech recognition module, and application module. The speech input and etection module handles th elow-level audio service of win32 API to input speech data on real time. The recognition module processes the incoming speech data, and then recognizes the spoken command. DTW pattern matching method is used for speech recognition. The application module executes the voice command properly on PC. Each module of the speech interface is designed and examined on windows95 environments. Implemented speech interface and experimental results are explained and discussed.

  • PDF

Alexa를 이용한 대학안내 시스템 (The University Gusdance System using the Alexa)

  • 김태진;김동현
    • 한국정보통신학회논문지
    • /
    • 제21권11호
    • /
    • pp.2061-2066
    • /
    • 2017
  • 음성인식 기술은 사용자의 음성을 인식하여 명령을 실행하는 기술로 현재는 자연어 처리 기법과 접목되어 인공지능 음성인식 서비스로 제공되어 지고 있다. 이러한 인공지능 음성인식 서비스는 IoT기기를 제어하거나 뉴스 또는 날씨와 같은 정보 제공 분야에서 활용되고 있다. 정보 제공 분야의 하나인 대학 정보는 주로 웹을 통하여 제공되나 너무 많은 데이터를 제공하기 때문에 사용자가 신속하게 원하는 정보를 검색할 수 없는 문제가 있다. 이 논문에서는 사용자가 찾고자 하는 정보를 음성으로 인식하고 제공하기 위한 대학 안내 시스템을 설계하고 구현한다. 대학정보를 각 주제별로 분류하고 이를 제공하기 위한 람다 함수를 설계한다. 그리고 알렉사 스킬 키트를 이용하여 노드제이에스로 구현된 모듈을 아마존웹서비스에 업로드하여 음성인식을 이용하여 대학 정보를 제공한다.

VoiceXML을 이용한 VUI 지원 웹브라우저 개발 (Development of a Voice User Interface for Web Browser using VoiceXML)

  • 예상후;장민석
    • 한국정보과학회논문지:컴퓨팅의 실제 및 레터
    • /
    • 제11권2호
    • /
    • pp.101-111
    • /
    • 2005
  • 현재의 웹정보들은 주로 HTML로 기술되어 있으며, 이러한 정보를 얻기 위해 사용자들은 마우스와 키보드와 같은 입력장치를 사용한다. 이와 같이 기존의 GUI 환경은 인간의 가장 자연스러운 정보획득 수단의 하나인 음성을 지원하지 못하고 있다. 이러한 문제를 해결하기 위해 음성 인터페이스를 가진 여러 제품들이 개발되고 있다. 하지만 이들은 상호대화성이나 기존 웹환경을 수용한다는 측면에서 부족한 면을 가지고 있다. 본 논문에서는 현재 무르익어 가는 음성인식 기술과 XML의 파생언어인 VoiceXML을 이용하여, 기존의 인터페이스 환경을 XML 기반의 대화형 음성인터페이스 환경으로 대체하고자 한다. 이를 통해 기존의 인터페이스 환경을 수용한 VUI(Voice User Interface) 환경을 사용자에게 제공할 수 있다. 기존의 환경을 수용하기 위해 "XML Island" 기술을 이용하여 VoiceXML 문서를 HTML 문서에 포함시키며, 대표적인 정보획득화면인 메뉴, 게시판, 검색 엔진에 대한 대화형 음성 시나리오를 제안하고 있다.

AI 기술 기반 지능형 시니어 도우미 음성인식 시스템 (An AI Technology-based Intelligent Senior Assistant Voice Recognition System)

  • 홍필두
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국정보통신학회 2019년도 춘계학술대회
    • /
    • pp.355-357
    • /
    • 2019
  • 고령화 사회로 진입하고 있는 지금, 시니어 세대에게는 새로운 디바이스나 IoT기술에 대한 사용자 접점은 매우 불편하다. 이를 개선하기 위하여 우리는 AI 기술 기반 지능형 시니어 도우미 음성인식 시스템을 제안한다. 제안 시스템은 Cloud platform기반 API를 구현하여 머신러닝 처리 활용을 위한 데이터를 축적하며, 치매진단, 치매예방활동을 위한 콘텐츠를 제공하며,시니어 세대를 위한 챗봇 콘텐츠를 제공한다. 우리가 제안한 개념모델을 이용한 서비스를 API로 제공함으로서 시니어 세대에 대한 IoT기반 등 새로운 디바이스의 접근성 및 편리성을 증대하는 계기가 될 것으로 기대한다.

  • PDF

음성인식기술의 문화변동에 대한 인문학적 대응에 관한 연구 (A study on the humanistic measure about cultural changes of voice recognition technology)

  • 육현승;조병철
    • 디지털융복합연구
    • /
    • 제13권8호
    • /
    • pp.21-31
    • /
    • 2015
  • 최근 음성인식기술의 향상은 세계를 새로운 구비문화의 시대로 이끌 것이다. 그것은 문자를 기반으로 하는 존재하지 않았던 말문화의 시대이며 문화적 혁명이 될 수 있다. 본 연구는 언어와 문자의 기반에 뿌리를 두고 인간을 탐구하는 인문학의 입장에서 이러한 말과 글의 상보적 관계가 야기할 수 있는 미래의 문화적 문제에 대응하는 것을 목표로 한다. 이를 위해 먼저 최근 변화되고 있는 글문화에서 말문화의 양상을 논의하고, 음성인식기술의 변화에 대해 점검한 이후, 그것이 야기할 수 있는 문화적 변동의 가능성과 문제성을 논의하게 될 것이다. 이에 대한 예상 가능성으로는 말하기와 쓰기의 상보성, 사적 문화의 공적문화로의 확대, 동시적 병행성의 가능성 등을 논하고, 문제점으로는 음성의 새로운 기호화 필요성, 생활세계로의 확대에 대한 준비, 그리고 한국문화의 글로벌 기업 종속에 저항해야 할 필요성들을 논의하였다. 본 연구는 새로운 음성인식기술과 문화변동의 가능성에 대한 단초적 연구로서, 이후 구체적이고 세분화된 후속연구들을 여는데 유용하게 활용될 수 있을 것으로 기대한다.

VoiceXML 기반 음성인식시스템을 이용한 서비스 개발 (The Interactive Voice Services based on VoiceXML)

  • 김학균;김은향;김재인;구명완
    • 대한음성학회지:말소리
    • /
    • 제43호
    • /
    • pp.113-125
    • /
    • 2002
  • As there are needs to search the Web information via wire or wireless telephones, VoiceXML forum was established to develop and promote the Voice eXtensible Markup Language (VoiceXML). VoiceXML simplifies the creation of personalized interactive voice response services on the Web, and allows voice and phone access to information on Web sites, call center databases. Also, it can utilize the Web-based technologies, such as CGI(Common Gateway Interface) scripts. In this paper, we have developed the voice portal service platform based on VoiceXML called TeleGateway. It enables integration of voice services with data services using the Automatic Speech Recognition (ASR) and Text-To-Speech (TTS) engines. Also, we have showed the various services on voice portal services.

  • PDF

An Ultrasonic Wave Encoder and Decoder for Indoor Positioning of Mobile Marketing System

  • Kim, Young-Mo;Jang, Se-Young;Park, Byeong-Chan;Bang, Kyung-Sik;Kim, Seok-Yoon
    • 한국컴퓨터정보학회논문지
    • /
    • 제24권7호
    • /
    • pp.93-100
    • /
    • 2019
  • In this paper, we propose an intelligent marketing service system that can provide custom advertisements and events to both businesses and customers by identifying the location and contents using the ultrasonic signals and feature information in voice signals. We also develop the encoding and decoding algorithm of ultrasonic signals for this system and analyze the performance evaluation results. With the development of the hyper-connected society, the on-line marketing has been activated and is growing in size. Existing store marketing applications have disadvantages that customers have to find out events or promotional materials that the headquarters or stores throughusing the corresponding applications whenever they visit them. To solve these problems, there are attempts to create intelligent marketing tools using GPS technology and voice recognition technology. However, this approach has difficulties in technology development due to accuracy of location and speed of comparison and retrieval of voice recognition technology, and marketing services for customer relation are also much simplified.

무선랜 환경에서의 분산 음성 인식을 이용한 음성 다이얼링 시스템 (A Voice-Activated Dialing System with Distributed Speech Recognition in WiFi Environments)

  • 박성준;구명완
    • 대한음성학회지:말소리
    • /
    • 제56호
    • /
    • pp.135-145
    • /
    • 2005
  • In this paper, a WiFi phone system with distributed speech recognition is implemented. The WiFi phone with voice-activated dialing and its functions are explained. Features of the input speech are extracted and are sent to the interactive voice response (IVR) server according to the real-time transport protocol (RTP). Feature extraction is based on the European Telecommunication Standards Institute (ETSI) standard front-end, but is modified to reduce the processing time. The time for front-end processing on a WiFi phone is compared with that in a PC.

  • PDF