• Title/Summary/Keyword: 표본추출

Search Result 1,291, Processing Time 0.026 seconds

A visual query database system for the Sample Research DB of the National Health Insurance Service (국민건강보험공단의 표본연구DB를 위한 비주얼 쿼리 데이터베이스 시스템 개발 연구)

  • Cho, Sang-Hoon;Kim, HeeChan;Kang, Gunseog
    • The Korean Journal of Applied Statistics
    • /
    • v.30 no.1
    • /
    • pp.13-24
    • /
    • 2017
  • The Sample Cohort DB supplied by the National Health Insurance Service is a valuable resource for statistical studies as well as for health and medical studies. It takes significant time and effort to extract data from this Cohort DB having a large size. As such, we introduce a database system, conveniently called the National Health Insurance Service Cohort DB Extract Tool (NICE Tool), which supports several useful operations for effectively and efficiently managing the Cohort DB. For example, researchers can extract variables and cases related with study by simply clicking a computer mouse without any prior knowledge regarding SAS DATA step or SQL. We expect that NICE Tool will facilitate the faster extraction of data and eventually lead to the active use of the Cohort DB for research purposes.

Two-stage Latin hypercube sampling and its application (이단계 Latin Hypercube 추출법과 그 응용)

  • 임미정;권우주;이주호
    • The Korean Journal of Applied Statistics
    • /
    • v.8 no.2
    • /
    • pp.99-108
    • /
    • 1995
  • When modeling a complicated system with a computer model, it is of vital importance to choos input values efficiently. The Latin Hypercube sampling (LHS) proposed by MaKay et al.(1979) has been most widely used for choosing input values for a computer model. We propose the two-stage Latin Hypercube sampling(TLHS) which is an improved version of the LHS for procucing input values in estimating the excectation of a function of the output variable. The proposed method is applied to simulation study of the performance of a printer actuator and it is shown to outperform the other sampling methods including the LHS in accuracy.

  • PDF

A Study on Sample Allocation for Stratified Sampling (층화표본에서의 표본 배분에 대한 연구)

  • Lee, Ingue;Park, Mingue
    • The Korean Journal of Applied Statistics
    • /
    • v.28 no.6
    • /
    • pp.1047-1061
    • /
    • 2015
  • Stratified random sampling is a powerful sampling strategy to reduce variance of the estimators by incorporating useful auxiliary information to stratify the population. Sample allocation is the one of the important decisions in selecting a stratified random sample. There are two common methods, the proportional allocation and Neyman allocation if we could assume data collection cost for different observation units equal. Theoretically, Neyman allocation considering the size and standard deviation of each stratum, is known to be more effective than proportional allocation which incorporates only stratum size information. However, if the information on the standard deviation is inaccurate, the performance of Neyman allocation is in doubt. It has been pointed out that Neyman allocation is not suitable for multi-purpose sample survey that requires the estimation of several characteristics. In addition to sampling error, non-response error is another factor to evaluate sampling strategy that affects the statistical precision of the estimator. We propose new sample allocation methods using the available information about stratum response rates at the designing stage to improve stratified random sampling. The proposed methods are efficient when response rates differ considerably among strata. In particular, the method using population sizes and response rates improves the Neyman allocation in multi-purpose sample survey.

2단계 집락추출법에 의한 확률화응답모형

  • 이기성;홍기학
    • Communications for Statistical Applications and Methods
    • /
    • v.5 no.1
    • /
    • pp.99-105
    • /
    • 1998
  • 본 논문에서는 매우 민감한 조사에서 모집단이 여러 개의 집락으로 구성되어 있을 때, 모집단으로부터 집락을 단순임의추출한 후 추출된 각 집락에서 다시 조사단위의 표본을 추출하는 2단계 집락추출법에 확률화응답모형을 적용하였다. 그리고, 일정한 비용 하에서 분산을 최소로 하는 1단계 집락의 수와 2단계 집락에서 추출된 조사단위의 수의 최적값을 구하여 최소분산의 형태를 도출하였다.

  • PDF

Bayesian Approaches to Zero Inflated Poisson Model (영 과잉 포아송 모형에 대한 베이지안 방법 연구)

  • Lee, Ji-Ho;Choi, Tae-Ryon;Wo, Yoon-Sung
    • The Korean Journal of Applied Statistics
    • /
    • v.24 no.4
    • /
    • pp.677-693
    • /
    • 2011
  • In this paper, we consider Bayesian approaches to zero inflated Poisson model, one of the popular models to analyze zero inflated count data. To generate posterior samples, we deal with a Markov Chain Monte Carlo method using a Gibbs sampler and an exact sampling method using an Inverse Bayes Formula(IBF). Posterior sampling algorithms using two methods are compared, and a convergence checking for a Gibbs sampler is discussed, in particular using posterior samples from IBF sampling. Based on these sampling methods, a real data analysis is performed for Trajan data (Marin et al., 1993) and our results are compared with existing Trajan data analysis. We also discuss model selection issues for Trajan data between the Poisson model and zero inflated Poisson model using various criteria. In addition, we complement the previous work by Rodrigues (2003) via further data analysis using a hierarchical Bayesian model.

Usefulness of In-store Spotting Survey in Developing a Supermarket Location Analysis Model (내점객 인터뷰에 근거한 슈퍼마켓 입지분석 모델의 실용성 평가)

  • 서성무;고윤배
    • Asia Marketing Journal
    • /
    • v.1 no.1
    • /
    • pp.5.1-5.11
    • /
    • 1998
  • 이 연구는 2차자료가 부족한 우리나라 슈퍼마켓 업체의 여건을 감안하여 간편하게 활용할 수 있는 입지분석 모델의 가능성을 탐구하였다. 연구모델은 두 가지 기준을 근거로 모두 네가지 모델을 설정하고 비교검토했다. 먼저 표본추출방법에 의해 내점객표본과 지역할당표본으로 분류하고, 이것을 다시 포함하는 변수의 범위에 따라 축소모델과 확장모델로 구분하였다. 공간상호작용모델의 추정에는 MNL(Multinomial Logit)방식을 이용했다. 분석결과 내점객표본으로 조사해서 얻은 응답자의 주거지와 주로 찾는 점포, 그리고 사전적으로 입수한 경쟁점포의 매장면적, 인접점포까지의 거리에 대한 자료만을 이용해서 추정한 가장 간단한 모델이 비교적 만족스러운 결과를 나타냈다.

  • PDF

기업연구개발활동통계 개선방안에 관한 연구

  • Jo, Seong-Pyo;Park, Seon-Yeong;Han, Gi-In;No, Min-Seon;Bae, Han-Su;Kim, Hyeon-A
    • Proceedings of the Technology Innovation Conference
    • /
    • 2009.02a
    • /
    • pp.313-332
    • /
    • 2009
  • 본 연구에서는 국가의 연구개발활동조사에서 기업연구개발활동 통계에 대한 효과적인 산출방법을 제시하고자 하였다. 이를 위하여 국내 외 연구개발 통계방법을 조사한 후 이를 토대로 우리나라에서 기업연구개발활동에 대한 자료의 수집 및 분석에 대한 개선방안을 제시하였다. 대부분의 국가에서는 대기업은 전수조사, 소규모 기업은 표본조사를 수행하고 있으나, 우리나라에서는 연구소 등록법인에 대하여 전수조사를 행하고 있다. 전수조사는 비용이 많이 들고 비 표본오차로 인하여 모집단에 대한 체계적인 추정이 불가능하다는 문제점이 있다. 현재 산업기술진흥협회에 등록된 연구기관의 수가 20,000개를 넘어서고 있어 전수조사는 한계에 다다른 것으로 생각되어 표본조사 도입에 대한 타당성과 방법론을 중점적으로 검토하였다. 먼저, 표본조사의 타당성을 평가하기 위하여 현재 전수조사를 통해 수집된 자료를 이용하여 표본조사를 수행한 결과를 비교 분석하였다. 산업별(24개), 그룹별(8개)로 구분하여 216개 셀별로 모집단수/표본수를 곱하여 산정 (셀별추정법)한 결과, 전수 통계치와 거의 동일하게 나타났다. 따라서, 산업별, 그룹별로 세분하여 모집단수/표본수를 곱하여 추정하는 셀별추정법이 타당한 것으로 평가할 수 있다. 이상의 분석결과를 토대로 새로운 조사설계방안을 제시하면 다음과 같다. 직전연도 조사기업은 직전연도 연구개발비 수준과 기업종류(대기업, 벤처기업, 중소기업), 그리고 산업에 따라 셀을 분할한다. 대기업, 연구개발비 수준이 높은 기업 등 주요한 셀에 대하여는 전수조사를 실시한다. 나머지 셀에 대하여는 각 셀별 연구개발지출의 분포가 동질적이기 때문에 표본 추출방법은 단순임의추출법(SRS)을 사용한다. 다만 전년도 미계상된(또는 미포함된) 기업에 대하여는 신규 대형 연구소 진입 등을 고려하여 규모비례확률추출법(PPS)을 고려하는 것이 바람직할 것으로 판단된다. 일부 기업들이 특정 항목에 대한 자료를 제공하지 않는 항목무응답의 경우, 누락된 자료에 대하여는 대체기법(Imputation Algorithm)에 따라 이를 추정한다. 이러한 표본조사방법은 전수조사에서 발생하는 비 표본오차를 해소하고, 자료수집비용 및 소규모기업의 행정적 부담을 경감할 수 있다는 장점이 있다. 향후 연구에서는 좀 더 구체적인 조사방법론을 강구할 필요가 있으며, 이와 함께, 연구개발에 대한 다양한 측면의 정보를 수집하기 위해 새로운 설문지를 개발할 필요성이 있다.

  • PDF

Sampling Methods for the 'dark grey cutworm' (Agrotis tokionis B.) Larval Population and Effect of its Larval Density on Tobacco Yield (숯검은밤나방(Agrotis tokionis B.) 유충개체군의 밀도추정방법 및 유충밀도와 연초감수량의 관계)

  • Kim S.S.;Boo K.S.;Kang Y.K.
    • Korean journal of applied entomology
    • /
    • v.20 no.4 s.49
    • /
    • pp.217-222
    • /
    • 1981
  • As a primary study on the economic injury level of A. tokionis larval populations in tobacco fields, we carried out some experiments for the evaluation of sampling efficiency of 3 sampling methods (pit-fall traps of apple pomace and rice bran, and clover patches) for the larval population and the regressions between loss and infested larval density The $10\times10cm$ clover patch showed a better sampling efficiency $11.8\;to\;18.0\%$ than the others. The sampling efficiency of clover patch becomes higher when the plots did not have any green plants. The linear regression equation (Y=4.2+1.383x) between loss (Y:kg/10a) and infested larval density (X: no. of larvae/plot) which was obtained by substitution of damage ratio and corrected damage ratio fitted the observed data better than the one (Y=2.68X) obtained without substitioning.

  • PDF

Efficiency of Variance Estimators for Two-stage PPS Systematic Sampling (2단 크기비례 계통추출법의 분산추정량 효율성 비교)

  • Kim, Young-Won;Kim, Yeny;Han, Hye-Eun;Kwak, Eun-Sun
    • The Korean Journal of Applied Statistics
    • /
    • v.26 no.6
    • /
    • pp.1033-1041
    • /
    • 2013
  • In this paper, we investigate several variance estimators for pps systematic sampling. Unfortunately, there is no unbiased variance estimators for a systematic sample because systematic sampling can be regarded as a random selection of one cluster. This study provides guidance on which variance estimator may be more appropriate than others in several circumstances. We judge the efficiency of variance estimators for systematic sampling based on of their relative biases and relative mean square error. Also, we investigate variance estimation problems for two-stage systematic sampling applied for the Food Raw Material Consumption Survey and the Establishment Labor Force Survey simulation study, in order to consider the popular two-stage pps systematic sample design for establishment and household survey in Korea.