• 제목/요약/키워드: maximum entropy measure

검색결과 17건 처리시간 0.028초

Minimum Variance Unbiased Estimation for the Maximum Entropy of the Transformed Inverse Gaussian Random Variable by Y=X-1/2

  • Choi, Byung-Jin
    • Communications for Statistical Applications and Methods
    • /
    • 제13권3호
    • /
    • pp.657-667
    • /
    • 2006
  • The concept of entropy, introduced in communication theory by Shannon (1948) as a measure of uncertainty, is of prime interest in information-theoretic statistics. This paper considers the minimum variance unbiased estimation for the maximum entropy of the transformed inverse Gaussian random variable by $Y=X^{-1/2}$. The properties of the derived UMVU estimator is investigated.

Maximum entropy test for infinite order autoregressive models

  • Lee, Sangyeol;Lee, Jiyeon;Noh, Jungsik
    • Journal of the Korean Data and Information Science Society
    • /
    • 제24권3호
    • /
    • pp.637-642
    • /
    • 2013
  • In this paper, we consider the maximum entropy test in in nite order autoregressiv models. Its asymptotic distribution is derived under the null hypothesis. A bootstrap version of the test is discussed and its performance is evaluated through Monte Carlo simulations.

거시적인 관점에서 바라본 취약점 공유 정도를 측정하는 방법에 대한 연구 (Which country's end devices are most sharing vulnerabilities in East Asia?)

  • 김광원;윤지원
    • 정보보호학회논문지
    • /
    • 제25권5호
    • /
    • pp.1281-1291
    • /
    • 2015
  • 과거와 비교하여, 오늘날의 사람들은 오픈 채널을 통해 단말기를 제어할 수 있다. 비록 이러한 오픈 채널이 사용자들에게 편의를 제공하지만, 보안 사고의 빌미를 제공 하기도 한다. 본 논문은 단말기 간의 관계들에 가중치를 주는 인간 중심적인 보안 리스크 분석 방법을 제안한다. 이 방법은 네트워크에 존재하는 한 노드가 가지는 평균적인 불확실성을 표현하는 엔트로피 레이트를 응용하여 만들어졌다. 다른 크기의 네트워크들을 비교하는데 있어서 엔트로피 레이트를 이용하는 것에는 한계가 있기때문에, 주어진 네트워크에 대하여 주어진 네트워크와 동일한 노드수를 가진 컴플릿 네트워크의 엔트로피레이트를 나누어 비교가 가능하도록 만들었다. 또한, 그래프 상에서 랜덤워크에 대한 엔트로피 레이트의 기본 전제인 irreducible의 위배를 피하는 방법 또한 기술하였다.

이종의 통계정보를 이용한 품사 부착 기법 (Part-Of-Speech Tagging using multiple sources of statistical data)

  • 조세형
    • 한국지능시스템학회논문지
    • /
    • 제18권4호
    • /
    • pp.501-506
    • /
    • 2008
  • 통계적 방식의 품사부착 문제는 보통 N-그램과 같을 단일 통계정보를 활용하지만 단순한 통계 정보라는 원천적인 한계가 있어 많은 오류가 발생한다. 따라서 다양한 정보를 활용하는 것이 정확도를 높일 가능성이 있다는 데는 이론의 여지가 없다. 그러나 다른 종류의 통계 자료는 배타적 자료가 아닌 한 상충되는 정보를 가질 수밖에 없으므로 이러한 정보들로부터 어떻게 종합적인 결론을 내는가가 문제이다. 본 논문에서는 이러한 상이한 통계정보를 통합하는 방법으로 언어 모델의 구성에서 활용된 바 있는 최대엔트로피 모델의 한국어 품사 부착에의 사용 가능성을 제시한다. 여기서는 이종의 통계정보로서 N그램과, 트리거 쌍을 사용하게 된다. 이러한 트리거 쌍 통계정보를 N그램과 함께 최대엔트로피 모델링을 했을 경우 퍼플렉시티가 어떻게 변화하는지에 대한 실험결과를 관찰하게 될 것이다. 트리거 쌍은 또한 다양하게 문맥사이즈를 변화할 수 있으며, N그램의 확률 모델도 다양하기 때문에 여러 종류의 실험을 통한 많은 향상을 예상 할 수 있다. 본 실험에서는 단일 모델 사용시 94.9 %의 정확도를 가진 3-그램 모델에 트리거 쌍을 최대 엔트로피 방식으로 추가한 견우 95.6% 의 정확도를 보여 0.7% 포인트의 정확도 향상을 기록하였다. 따라서 향후 다양한 정보원을 개발하여 최대엔트로피 방식으로 통합할 경우 지속적인 정확도 향상을 가져 올 수 있는 가능성을 보여준다고 할 수 있다.

최대유속과 표면유속에 관한 연구 (A Study on the Maximum Velocity and the Surface Velocity)

  • 추태호;제성진
    • 한국콘텐츠학회:학술대회논문집
    • /
    • 한국콘텐츠학회 2006년도 춘계 종합학술대회 논문집
    • /
    • pp.351-355
    • /
    • 2006
  • 본 연구의 목적은 모든 하천에서 표면유속만을 이용하여 유량측정을 용이하게 할 수 있는 효과적이고 유용한 측정방법을 개발하는데 있다. 본 연구로 다음과 같은 중요한 결과를 얻었다. 1) 자연하천은 엔트로피 M값에 대응하여 평형상태를 유지하는 경향이 있으며, 2) 표면유속을 이용하여 산정된 계산치와 실측을 비교한 결과 상당히 좋은 일치를 보여주었으며, 3) 하천단면에서 최대유속이 발생하는 지점에서의 표면유속을 이용하여 유량을 산정하는 공식을 개발하였으며, 실측치와 비교한 결과 그 적용성을 확인하였다.

  • PDF

전산화단층촬영 영상에서 통계적 특징을 이용한 질감특징분석 알고리즘의 적용: 간세포암 중심으로 (Application of Texture Feature Analysis Algorithm used the Statistical Characteristics in the Computed Tomography (CT): A base on the Hepatocellular Carcinoma (HCC))

  • 유주은;전태성;권진아;정주영;임인철;이재승;박형후;곽병준;유윤식
    • 한국방사선학회논문지
    • /
    • 제7권1호
    • /
    • pp.9-15
    • /
    • 2013
  • 본 연구는 전산화단층촬영에서 간 질환의 자동 인식으로 질감특징분석(texture feature analysis. TFA) 알고리즘을 제안하고자 하였으며, 간세포암(Hepatocellular carcinoma. HCC)에 대한 컴퓨터보조진단(computer-aided diagnosis. CAD) 시스템을 설계하고, 제안하는 각 알고리즘의 성능을 평가하고자 하였다. HCC 영상에서 분석영역($40{\times}40$ 픽셀)을 설정하고 각 부분영상에 통계적 특징을 이용한 6가지 TFA 파라메터(평균 밝기, 평균 대조도, 평탄도, 왜곡도, 균일도, 엔트로피)비교하여 간세포암 인식률(recognition rate)을 구하였다. 결과적으로 TFA는 간세포암 인식률을 나타내는 척도로 유의함을 알 수 있었으며 6가지 파라메터에서 균일도가 가장 인식률이 높았으며 평균 대조도, 평탄도, 왜곡도가 비교적 높았고 평균 밝기와 엔트로피는 상대적으로 낮은 인식률을 나타내었다. 이와 관련하여 높은 인식률을 보인 알고리즘(최대 97.14%, 최소 82.86%)을 간세포암 영상의 병변을 판별하여 임상의 조기 진단을 보조하여 치료를 시행한다면 진단의 효율성이 높아 질 것으로 판단되었으며, 향후 효율적이고 정량적인 분석을 추가함으로써 질병인식의 일반화에 대한 기준 연구가 필요 할 것으로 사료되었다.

능동 학습을 이용한 학습 데이터 반자동 구축 (Semi-automatic Construction of Training Data using Active Learning)

  • 이창기;허정;왕지현;이충희;오효정;장명길;이영직
    • 한국HCI학회:학술대회논문집
    • /
    • 한국HCI학회 2006년도 학술대회 1부
    • /
    • pp.1252-1255
    • /
    • 2006
  • 본 논문은 정보검색, 정보추출, 번역, 자연어처리 등의 작업을 위한 통계적 방법론에서 필요한 학습 데이터 구축을 효율적으로 하기 위한 학습 데이터 반자동 구축 장치 및 그 방법에 대하여 기술한다. 본 논문에서는 학습 데이터 구축양을 줄이기 위해서 능동 학습을 이용한다. 또한 최근 각광 받고 있는 Conditional Random Fields(CRF)를 능동학습에 이용하기 위해서 CRF를 이용한 Confidence measure를 정의한다.

  • PDF

A Study on Decision Tree for Multiple Binary Responses

  • Lee, Seong-Keon
    • Communications for Statistical Applications and Methods
    • /
    • 제10권3호
    • /
    • pp.971-980
    • /
    • 2003
  • The tree method can be extended to multivariate responses, such as repeated measure and longitudinal data, by modifying the split function so as to accommodate multiple responses. Recently, some decision trees for multiple responses have been constructed by Segal (1992) and Zhang (1998). Segal suggested a tree can analyze continuous longitudinal response using Mahalanobis distance for within node homogeneity measures and Zhang suggested a tree can analyze multiple binary responses using generalized entropy criterion which is proportional to maximum likelihood of joint distribution of multiple binary responses. In this paper, we will modify CART procedure and suggest a new tree-based method that can analyze multiple binary responses using similarity measures.

잡음과 위치이동에 강인한 새로운 홍채인식 기법 (A Novel Iris recognition method robust to noises and translation)

  • 원정우;김재민;조성원;최경삼;최진수
    • 대한전기학회:학술대회논문집
    • /
    • 대한전기학회 2003년도 학술회의 논문집 정보 및 제어부문 B
    • /
    • pp.392-395
    • /
    • 2003
  • This paper describes a new iris segmentation and recognition method, which is robust to noises. Combining statistical classification and elastic boundary fitting, the iris is first segmented. Then, the localized iris image is smoothed by a convolution with a Gaussian function, down-sampled by a factor of filtered with a Laplacian operator, and quantized using the Lloyd-Max method. Since the quantized output is sensitive to a small shift of the full-resolution iris image, the outputs of the Laplacian operator are computed for all space shifts. The quantized output with maximum entropy is selected as the final feature representation. An appropriate formulation of similarity measure is defined for the classification of the quantized output. Experimentally we showed that the proposed method produces superb performance in iris segmentation and recognition.

  • PDF

TAKES: Two-step Approach for Knowledge Extraction in Biomedical Digital Libraries

  • Song, Min
    • Journal of Information Science Theory and Practice
    • /
    • 제2권1호
    • /
    • pp.6-21
    • /
    • 2014
  • This paper proposes a novel knowledge extraction system, TAKES (Two-step Approach for Knowledge Extraction System), which integrates advanced techniques from Information Retrieval (IR), Information Extraction (IE), and Natural Language Processing (NLP). In particular, TAKES adopts a novel keyphrase extraction-based query expansion technique to collect promising documents. It also uses a Conditional Random Field-based machine learning technique to extract important biological entities and relations. TAKES is applied to biological knowledge extraction, particularly retrieving promising documents that contain Protein-Protein Interaction (PPI) and extracting PPI pairs. TAKES consists of two major components: DocSpotter, which is used to query and retrieve promising documents for extraction, and a Conditional Random Field (CRF)-based entity extraction component known as FCRF. The present paper investigated research problems addressing the issues with a knowledge extraction system and conducted a series of experiments to test our hypotheses. The findings from the experiments are as follows: First, the author verified, using three different test collections to measure the performance of our query expansion technique, that DocSpotter is robust and highly accurate when compared to Okapi BM25 and SLIPPER. Second, the author verified that our relation extraction algorithm, FCRF, is highly accurate in terms of F-Measure compared to four other competitive extraction algorithms: Support Vector Machine, Maximum Entropy, Single POS HMM, and Rapier.