• Title/Summary/Keyword: 데이터 평가 모델

Search Result 2,514, Processing Time 0.034 seconds

Performance Evaluation of Acoustic Models According to Differences between Vocabularies in Training and Test Phases of Speech Recognition (음성 인식에서 훈련 및 인식 과정에 사용되는 대상 어휘의 차이에 대한 음향 모델의 성능 평가)

  • 김회린;이항섭;권오욱
    • The Journal of the Acoustical Society of Korea
    • /
    • v.17 no.7
    • /
    • pp.22-27
    • /
    • 1998
  • 본 논문에서는 ETRI에서 개발한 가변 어휘 음성 인식기의 어휘 독립 음향 모델링 방법을 기술하고, 이 모델의 어휘 종속, 어휘 독립 및 어휘적응 성능을 평가하기 위하여 다 양한 고립단어 및 연속음성 DB에 대하여 실험한 결과를 분석하였다. 평가를 위하여 사용한 음성 DB로는 고립단어 음성으로 POW(Phonetically Optimized Words) 3848, PBW(Phonetically Balanced Words) 445, PBW 452, 호텔예약 244 단어, 게임 제어용 단어 등이며, 연속음성으로 일반 문장 음성 및 연속 숫자음을 이용하였다. 성능 분석 결과 40개 음소 모델만으로도 비교적 높은 인식률을 보여 주었지만, 어휘독립의 경우는 어휘종속에 비 하여 성능이 크게 낮았고, 특히 대상 어휘가 숫자음, 알파벳, 연속음 등의 경우에는 POW 데이터나 PBW 데이터만 가지고는 우수한 가변 어휘 음성 인식기를 구현하기에 한계가 있 음을 알 수 있다. 또한, 훈련 데이터의 어휘와 평가데이터의 어휘가 비슷할 경우에는 변이음 모델을 사용하면 음소 모델만을 사용할 경우에 비하여 그 성능이 우수하였지만, 일반적인 어휘독립의 상황에서는 효과가 별로 없음을 알 수 있었다.

  • PDF

A Study of the Data Qualituy Evaluation (데이터 품질 평가에 관한 연구)

  • Jung, Hye-Jung
    • Journal of Internet Computing and Services
    • /
    • v.8 no.4
    • /
    • pp.119-128
    • /
    • 2007
  • In this paper, We study on the Data Quality Model of ISO/IEC 25012 among the Software product Quality Requirements and Evaluation(SQuaRE) in ISO/IEC 25000 Series. Because of the increasing data, user require the accuracy data, recent data, suitable data for used tools, complied security and not open to be public. We research the data quality management in the point of application of be affect influenced low quality in business. We propose the testing items and we propose the method of the evaluation proposed testing items. We study on the basis international Standards ISO/IEC 25012 and ISO/IEC 9126-2 and we proposed the testing method quantitatively on the basis of ISO/IEC 25000.

  • PDF

Optimization of granular-based RBF NN with the aid of reconstructability criterion (Reconstructability criterion을 통한 granular-based RBF NN의 최적화)

  • Park, Ho-Sung;Oh, Sung-Kwun
    • Proceedings of the KIEE Conference
    • /
    • 2009.07a
    • /
    • pp.1899_1900
    • /
    • 2009
  • 본 논문에서는 주어진 데이터의 입자화 특성을 효과적으로 모델 구축에 반영하고자 재구성 평가 기준을 통한 새로운 형태의 입자화 기반 RBF 뉴럴 네트워크를 개발한다. 주어진 데이터들의 입자화 특성을 파악하기 위해서 새로운 형태의 FCM 클러스터링(-Context-based fuzzy clustering)을 이용한다. 즉, 출력 공간의 입자화 특성은 K-means clustering 방법을 사용한 것에 반해, 입력 공간에서의 정보들은 Context-based fuzzy clustering 방법을 이용하여 효율적으로 데이터의 특성을 파악하여 모델의 구축에 반영하였으며, 또한 모델의 최적화를 위하여 RBF 뉴럴 네트워크의 은닉층의 수를 재구성 평가 기준을 통하여 모델의 최적화를 꾀하였다. 제안된 모델의 효율적인 특성을 보여주기 위해 저차원 합성 데이터를 이용하여 모델을 평가한다.

  • PDF

Activity Capability Level-based Maturity Evaluation Model for Public Data Quality Management (활동능력수준 기반의 공공데이터 품질관리 성숙수준 평가 모델)

  • Kim, Sun-Ho;Lee, Jin-Woo;Lee, Chang-Soo
    • Informatization Policy
    • /
    • v.24 no.1
    • /
    • pp.30-47
    • /
    • 2017
  • The Korean government developed an organizational maturity model for public data quality management based on international standards to evaluate the data quality management level of public organizations, However, as the model has too many indicators to apply on the site, a new model with reduced number of indicators is proposed in this paper. First, the number of processes is reduced by integrating and modifying the processes of the previous model. Second, a new maturity evaluation method is proposed based on capability levels focused on the activity, not on the process. Third, the maturity level of public data quality management is represented by five discrete levels or real values of 1 through 5. Finally, characteristics of the proposed model are compared with those of the previous model.

KommonGen: A Dataset for Korean Generative Commonsense Reasoning Evaluation (KommonGen: 한국어 생성 모델의 상식 추론 평가 데이터셋)

  • Seo, Jaehyung;Park, Chanjun;Moon, Hyeonseok;Eo, Sugyeong;Kang, Myunghoon;Lee, Seounghoon;Lim, Heuiseok
    • Annual Conference on Human and Language Technology
    • /
    • 2021.10a
    • /
    • pp.55-60
    • /
    • 2021
  • 최근 한국어에 대한 자연어 처리 연구는 딥러닝 기반의 자연어 이해 모델을 중심으로 각 모델의 성능에 대한 비교 분석과 평가가 활발하게 이루어지고 있다. 그러나 한국어 생성 모델에 대해서도 자연어 이해 영역의 하위 과제(e.g. 감정 분류, 문장 유사도 측정 등)에 대한 수행 능력만을 정량적으로 평가하여, 생성 모델의 한국어 문장 구성 능력이나 상식 추론 과정을 충분히 평가하지 못하고 있다. 또한 대부분의 생성 모델은 여전히 간단하고 일반적인 상식에 부합하는 자연스러운 문장을 생성하는 것에도 큰 어려움을 겪고 있기에 이를 해결하기 위한 개선 연구가 필요한 상황이다. 따라서 본 논문은 이러한 문제를 해결하기 위해 한국어 생성 모델이 일반 상식 추론 능력을 바탕으로 문장을 생성하도록 KommonGen 데이터셋을 제안한다. 그리고 KommonGen을 통해 한국어 생성 모델의 성능을 정량적으로 비교 분석할 수 있도록 평가 기준을 구성하고, 한국어 기반 자연어 생성 모델의 개선 방향을 제시하고자 한다.

  • PDF

Assessment & Justification of Data Warehousing from A Competitive Advantage Perspective (경쟁우위적 관점에서의 데이터 웨어하우징 평가 및 정당화)

  • Park, Yong-Tae
    • The Journal of Information Systems
    • /
    • v.16 no.1
    • /
    • pp.65-90
    • /
    • 2007
  • 전통적인 비용수익 분석법 (CBA approach) 과 활동기준원가계산 방법 (ABC approach)과 같은 지금까지의 방법으로는 전략적 정보시스템이나 정보 하부구조를 효과적으로 평가하고 정당화하는데 한계가 있다고 지적되어왔다. 따라서, 본 논문은 정보시스템의 하부구조를 이루고 있는 데이터 웨어하우징을 스물여섯 개의 데이터 웨어하우징 성공사례 분석을 통해서 데이터 웨어하우징이 가치사슬 모델의 각 활동에 어떻게 활용되고 있는지를 분석하고, 경쟁우위적 관점에서 이들 사례들의 공통점을 찾아내어, 데이터 웨어하우징을 경쟁우위적 관점에서 보다 효과적으로 정당화할 수 있는 모델을 제시하고 있다. 이 모델은 기존의 정보시스템 정당화에 사용되어왔던 방법들의 단점을 보완하여, 기업들이 데이터 웨어하우징이나 경쟁우위를 확보하기 위해서 구축하는 다른 정보시스템들을 경쟁우위적 관점에서 정당화하고자 할 때 유용한 도구로써, 기존의 방법들과 병행해서 사용하면 보다 효과적으로 정보시스템들을 평가하고 정당화할 수 있으리라 생각된다.

  • PDF

A Quality Evaluation Model for Distributed Processing Systems of Big Data (빅데이터 분산처리시스템의 품질평가모델)

  • Choi, Seung-Jun;Park, Jea-Won;Kim, Jong-Bae;Choi, Jae-Hyun
    • Journal of Digital Contents Society
    • /
    • v.15 no.4
    • /
    • pp.533-545
    • /
    • 2014
  • According to the evolving of IT technologies, the amount of data we are facing increasing exponentially. Thus, the technique for managing and analyzing these vast data that has emerged is a distributed processing system of big data. A quality evaluation for the existing distributed processing systems has been proceeded by the structured data environment. Thus, if we apply this to the evaluation of distributed processing systems of big data which has to focus on the analysis of the unstructured data, a precise quality assessment cannot be made. Therefore, a study of the quality evaluation model for the distributed processing systems is needed, which considers the environment of the analysis of big data. In this paper, we propose a new quality evaluation model by deriving the quality evaluation elements based on the ISO/IEC9126 which is the international standard on software quality, and defining metrics for validating the elements.

로지트 모델 시물레이션에 의한 도시교통안전계획에 관한 연구

  • 김용수;이근철
    • Journal of the Korean Society of Safety
    • /
    • v.4 no.1
    • /
    • pp.103-120
    • /
    • 1989
  • 최근 도시교통계획분야에 있어서 교통수요의 예측모델 또는 교통정책의 평가 모델로서 비집계(非集計) 모델에 관한 연구가 진행되고 있다. 이 비집계모델은 개개의 의사결정단위에 있어서 선택행동을 영역마다 집계하는 것이 아니고 의사결정레벨의 데이터률 그대로 모델로 구성할 경우 이 데이터를 이용함으로써 의사결정단위의 선택행동을 모델화 할 수 있다는 특징을 갖고 있다. 한편 비집계모델의 사용목적은 여러가지로 생각되나 이것을 교통수요의 목적이나 교통정잭의 평가를 위한 모델로 이용할 때는 파라미터의 추정값이나 선택비율의 추정값에 대한 안정성이 매우 중요한 문제가 되고 있다.

  • PDF

Performance Improvement of data Mining by Input Data Discrimination (입력자료 판별에 의한 데이터 마이닝의 성능개선)

  • 이재식;이진천
    • Proceedings of the Korea Inteligent Information System Society Conference
    • /
    • 2000.04a
    • /
    • pp.293-303
    • /
    • 2000
  • 데이터 마이닝의 수행 예측 오차를 줄이기 위한 방법으로 하나의 문제를 여러 기법들을 결합하여 해결하고 있다. 본 연구에서는 새로운 결합 모델을 제시하고 이를 통해 예측 오차를 감소시킬 수 있는 가능성을 제시한다. 제시된 결합모델의 성능을 검증하기 위해서 국내 자동차보험 회사의 고객데이터를 바탕으로 고객이탈 예측문제를 다루었다. 결합모델의 예측결과를 의사결정나무, 사례기반추론 그리고 인공신경망 중 하나의 기법만을 사용하여 예측한 결과와 비교 평가하였다. 평가 결과, 결합 모델의 예측 적중률이 개별 기법의 예측 적중률보다 우수했다.

  • PDF

Developing an Assessment Model of Library Open Data Quality (도서관의 오픈 데이터 품질측정모델 개발)

  • Park, Jin Ho
    • Journal of the Korean Society for information Management
    • /
    • v.35 no.1
    • /
    • pp.33-59
    • /
    • 2018
  • This study draws on the current momentum to diversify open government data research through multidimensional scaling and model development. It formulates a quality assessment model applicable to library open data, taking into consideration the paucity of such research in the field. The model was developed using the Delphi method and verified for validity and reliability on the basis of a survey administered to library open data users. The results of the fourth round exhibited an average of 4.00 for all measured elements and a minimum validity of .75, rendering the model appropriate for use in quality assessments of library open data. The convergence and stability results provided by the expert panel fell below .50, confirming that there was no need to conduct further surveys in order to establish the validity of the Delphi method. The model's reliability likewise garnered results of .60 and above in all three dimensions. This Model completed with the input of the Delphi panel was put through a verification process in which library open data users such as domestic and international librarians, developers, and open data activists reviewed the model for validity and reliability. The model scored low on validity on account of its failure to load all measure factors and elements pertaining to the three dimensions. Reliability results, on the other hand, were at 0.6 and above for all dimensions and measured elements.