• 제목/요약/키워드: Chi-square analysis

검색결과 1,971건 처리시간 0.023초

Analysis on the Amino Acid Distributions with Position in Transmembrane Proteins

  • Chi, Sang-Mun
    • Journal of the Korean Data and Information Science Society
    • /
    • 제16권4호
    • /
    • pp.745-758
    • /
    • 2005
  • This paper presents a statistical analysis on the position-specific distributions of amino acid residues in transmembrane proteins. A hidden Markov model segments membrane proteins to produce segmented regions of homogeneous statistical property from variable-length amino acids sequences. These segmented residues are analyzed by using chi-square statistic and relative-entropy in order to find position-specific amino acids. This analysis showed that isoleucine and valine concentrated on the center of membrane-spanning regions, tryptophan, tyrosine and positive residues were found frequently near both ends of membrane.

  • PDF

잠재적 위험요인의 탐색에 관한 단일표본분석과 복합표본분석의 비교 (Comparative Analysis of Unweighted Sample Design and Complex Sample Design Related to the Exploration of Potential Risk Factors of Dysphonia)

  • 변해원
    • 한국산학기술학회논문지
    • /
    • 제13권5호
    • /
    • pp.2251-2258
    • /
    • 2012
  • 본 연구는 잠재적 위험요인을 탐색하는 방법으로 단순임의추출분석(unweighted sample design), 빈도 가중치를 적용한 단일표본분석(frequency weighted sample design), 가중치를 층화하여 적용한 복합표본분석(complex sample design)을 비교하고, 도출된 결과에 통계적인 차이가 있는지를 파악하고자 수행되었다. 자료원은 2009 국민건강영양조사의 이비인후과 검진 자료를 이용하였다. 분석 방법은 피어슨의 교차검정(Pearson chi-square test)과 라오-스콧교차검정(Rao-scott chi-square test)을 이용하였다. 분석 결과, 빈도 가중치만을 적용한 단일표본분석의 경우에는 모든 변수가 유의한 위험요인으로 과대 예측 되었고, 가중치를 적용하지 않은 단순임의추출 분석과 복합표본분석은 유의수준 및 결과에 차이가 있었다. 국가통계자료를 이용할 때, 연구의 결과가 전체 인구집단을 대표할 수 있도록 의미를 부여하기 위해서는 층화변수와 집락변수를 사용하여 가중치를 적용하는 복합표본분석이 필요하다. 나아가, 빈도 가중치만을 적용하는 경우에는 연구 결과에 대한 과잉해석의 가능성이 높기 때문에 각별한 주의가 요구된다.

Clinical Analysis of Symptoms and Oriental Medical Prescriptions According to Elapsed Time of Stroke in Oriental Medical Hospital Inpatients

  • Yun, Hen-Ja;Sung, Kang-Keyng
    • 대한한의학방제학회지
    • /
    • 제20권1호
    • /
    • pp.133-147
    • /
    • 2012
  • Objectives : This study was intended to understand characteristics of symptoms, oriental medicine prescription and laboratory test results according to elapsed time of stroke. Methods : Through the medical records of 205 stroke inpatients in the oriental medical hospital in the year 2010, we investigated manifested symptoms, administered oriental medicine prescription and clinical pathological examination results. Collected items were classified to depend on stroke types, cerebral infarction and hemorrhage. We analyzed association between manifested symptoms, the oriental medicine prescription, and laboratory test results of stroke patients and elapsed time. Chi-square tests were performed to determine the significance level of association. Results : All symptoms, prescriptions and laboratory test results in cerebral infarction patients were associated with elapsed time. Especially, symptoms, prescriptions and pathological examination results showed very high statistical significance with elapsed time (a symptom; chi-square(df)=164.3(22), p<0.001, prescription; chi-square(df)=93.5(22), p<0.001, and pathological examination results; chi-square(df)=164.3(22), p<0.0004). But in the case of cerebral hemorrhage, there was not statistical significance. Conclusions : The elapsed time of stroke may be an essential requisite in catching symptoms and prescribing for stroke patients in oriental medical treatment.

The Role of Negative Binomial Sampling In Determining the Distribution of Minimum Chi-Square

  • Hamdy H.I.;Bentil Daniel E.;Son M.S.
    • International Journal of Contents
    • /
    • 제3권1호
    • /
    • pp.1-8
    • /
    • 2007
  • The distributions of the minimum correlated F-variable arises in many applied statistical problems including simultaneous analysis of variance (SANOVA), equality of variance, selection and ranking populations, and reliability analysis. In this paper, negative binomial sampling technique is employed to derive the distributions of the minimum of chi-square variables and hence the distributions of the minimum correlated F-variables. The work presented in this paper is divided in two parts. The first part is devoted to develop some combinatorial identities arised from the negative binomial sampling. These identities are constructed and justified to serve important purpose, when we deal with these distributions or their characteristics. Other important results including cumulants and moments of these distributions are also given in somewhat simple forms. Second, the distributions of minimum, chisquare variable and hence the distribution of the minimum correlated F-variables are then derived within the negative binomial sampling framework. Although, multinomial theory applied to order statistics and standard transformation techniques can be used to derive these distributions, the negative binomial sampling approach provides more information regarding the nature of the relationship between the sampling vehicle and the probability distributions of these functions of chi-square variables. We also provide an algorithm to compute the percentage points of the distributions. The computation methods we adopted are exact and no interpolations are involved.

A Chi-Square-Based Decision for Real-Time Malware Detection Using PE-File Features

  • Belaoued, Mohamed;Mazouzi, Smaine
    • Journal of Information Processing Systems
    • /
    • 제12권4호
    • /
    • pp.644-660
    • /
    • 2016
  • The real-time detection of malware remains an open issue, since most of the existing approaches for malware categorization focus on improving the accuracy rather than the detection time. Therefore, finding a proper balance between these two characteristics is very important, especially for such sensitive systems. In this paper, we present a fast portable executable (PE) malware detection system, which is based on the analysis of the set of Application Programming Interfaces (APIs) called by a program and some technical PE features (TPFs). We used an efficient feature selection method, which first selects the most relevant APIs and TPFs using the chi-square ($KHI^2$) measure, and then the Phi (${\varphi}$) coefficient was used to classify the features in different subsets, based on their relevance. We evaluated our method using different classifiers trained on different combinations of feature subsets. We obtained very satisfying results with more than 98% accuracy. Our system is adequate for real-time detection since it is able to categorize a file (Malware or Benign) in 0.09 seconds.

암석의 탄성파속도 거동특성과 역학 parameter와의 상관성 해석 (Analysis of Correlation Between Velocity of Elastic Wave and Mechanical Properties of Rocks)

  • 이종석;문종규;최웅의
    • 터널과지하공간
    • /
    • 제21권1호
    • /
    • pp.50-65
    • /
    • 2011
  • 이 연구에서는 퇴적암, 화성암, 변성암군의 10개 암종-1,417개의 시험자료를 이용하여 탄성파속도와 각종 역학적 parameter간의 상관성해석을 시행하였다. 해석 과정에서 나타나는 암종과 역학 parameter간의 거동특성이 상의함을 구명하였으며, 거동이 동일한 암종들을 모집단으로 상관성 해석을 하였다. 각종 시험자료는 표본의 규모 검정과 Chi-Square검정을 거친 후 해석에 임하였다. 도출된 추정식들은 95% 신뢰도가 확보됨을 확인할 수 있었다.

Comparison of Parameter Estimation Methods in the Analysis of Multivariate Categorical Data with Logit Models

  • Song, Hae-Hiang
    • Journal of the Korean Statistical Society
    • /
    • 제12권1호
    • /
    • pp.24-35
    • /
    • 1983
  • In fitting models to data, selection of the most desirable estimation method and determination of the adequacy of fitted model are the central issues. This paper compares the maximum likelihood estimators and the minimum logit chi-square estimators, both being best asymptotically normal, when logit models are fitted to infant mortality data. Chi-square goodness-of-fit test and likelihood ratio one are also compared. The analysis infant mortality data shows that the outlying observations do not necessarily result in the same impact on goodness-of-fit measures.

  • PDF

최근 5년간(2011~2015) 사상체질분야 논문의 통계기법 분석 및 오류에 관한 연구 (Analysis of the Statistical Techniques and Errors in the Field of Sasang Constitution Researches: from 2011 to 2015)

  • 김수정;김상혁;이시우
    • 사상체질의학회지
    • /
    • 제28권1호
    • /
    • pp.51-56
    • /
    • 2016
  • Objectives This study was to identify the types of errors in the statistical analysis and trends of previous reported papers that used various statistical techniques.Methods We have selected 118 original articles for statistical review from the OASIS(http://oasis.kiom.re.kr) and the Pubmed(http://www.pubmed.gov) in the field of Sasang constitutional medicine. Published year was restricted from 2011 to 2015.Results 1. The ANOVA(25.72%) was the statistic of choice overall, followed by the chi-square test(21.74%), regression analysis(14.13%), t-test(11.59%), and etc. 2. By examining the errors of the statistical methods, there were 42(59.2%) thesis with errors among 71 thesis using ANOVA, 19(31.7%) thesis among 60 thesis using chi-square test, and 35(89.7%) over 39 thesis using regression analysis.Conclusions To improve the quality of Sasang Constitution, the participation of statisticians in research design will reduce the significant errors in statistical interpretation of the results.

수명분포가 자유도에 의존한 카이제곱분포를 따르는 무한고장 NHPP 소프트웨어 신뢰성 모형에 관한 비교연구 (A Comparative Study on the Infinite NHPP Software Reliability Model Following Chi-Square Distribution with Lifetime Distribution Dependent on Degrees of Freedom)

  • 김희철;김재욱
    • 한국정보전자통신기술학회논문지
    • /
    • 제10권5호
    • /
    • pp.372-379
    • /
    • 2017
  • 소프트웨어 개발과정동안 소프트웨어 신뢰성 요인은 매우 기본적인 사항이다. 소프트웨어 고장파악을 위한 무한고장 비동질적인 포아송 과정을 이용할 때 고장발생률 혹은 위험함수가 일정하거나 증가 또는 감소하는 속성을 가진다. 본 논문에서는 소프트웨어 신뢰 성능에 관한 효율성을 비교하는 자유도에 의존하는 카이제곱 분포를 적용한 신뢰성 모형을 제안하였다. 효율적인 모형을 평가하기 위하여 평균제곱오차(MSE)와 결정계수($R^2$)를 이용하고 최우추정법과 수치 해석적 방법을 사용하여 모수추정 알고리즘이 수행되었다. 제안하는 카이제곱분포의 자유도를 이용한 신뢰성 모형을 위해 실제 고장 간격 데이터를 사용한 고장 성능 분석이 적용되었다. 고장데이터 분석은 카이제곱분포의 자유도에 근거한 강도함수를 기준으로 비교되었다. 데이터 신뢰성을 확인하기 위하여 라플라스 추세검정이 적용되었다. 본 연구에 제안된 카이제곱분포의 자유도는 다양한 고장현상을 표현 할 수 있기 때문에 (결정계수가 90% 이상), 신뢰성 분야에서 활용 할 수 있는 모형으로 활용 할 수 있다. 이 연구 결과를 적용하면 소프트웨어 개발 설계자에게 다양한 자유도를 적용하여 소프트웨어 고장패턴을 예측함으로서 효율적인 모형을 개발하는데 표준 지침으로 적용 할 수 있다.

보완된 카이-제곱 기법을 이용한 단백질 기능 예측 기법 (Fucntional Prediction Method for Proteins by using Modified Chi-square Measure)

  • 강태호;유재수;김학용
    • 한국콘텐츠학회논문지
    • /
    • 제9권5호
    • /
    • pp.332-336
    • /
    • 2009
  • 유전체 분석에서 중요한 부분 중 하나는 기능이 알려지지 않은 미지 단백질에 대한 기능 예측이다. 단백질-단백질 상호작용 네트워크를 분석하는 것은 미지 단백질에 대한 기능을 보다 쉽게 예측할 수 있게 한다. 단백질-단백질 상호작용 네트워크로부터 미지 단백질의 기능을 예측하기 위한 다양한 연구들이 시도되어 왔다. 카이-제곱(Chi-square) 방식은 단백질-단백질 상호작용 네트워크를 통해 기능을 예측하고자 하는 연구 중 대표적인 방식이다. 하지만 카이-제곱 방식은 네트워크의 토폴로지를 반영하지 않아 네트워크 크기에 따라 예측의 정확성이 떨어지는 문제점이 있다. 따라서 본 논문에서는 카이-제곱 방식을 보완하여 정확성을 높인 새로운 기능 예측 방법을 제안한다 이를 위해 MIPS, DIP 그리고 SGD와 같은 공개된 단백질 상호작용 데이터베이스들로부터 데이터를 수집하여 분석하였다. 그리고 제안된 방식의 우수성을 입증하기 위해 각 데이터베이스들에 대해 카이-제곱방식과 제안하는 보완된 카이-제곱(Modified Chi-square)방식으로 예측해보고 이들의 정확성을 평가하였다.