In this paper we suggest a new alternative estimator for the characteristics that are pooly correlated with the selection probabilities by applying the Amahia et al.(1989)'s estimator to Rao-Hartley-Cochran sampling scheme and compare it with that of Rao(1966)'s under a super-population model.
Research on the application of informative sampling technique has been conducted in order to reduce the influence of non-response. Chung and Shin (Korean Journal of Applied Statistics, 30, 993-1004, 2017) showed that the estimation accuracy improved when using exponential response rate information for the parameter estimation if the distribution of errors included in the super population model follows normal distribution. However this method divides the stratum into equally spaced substrata to obtain the sample weight of the informative sampling technique and shows that the accuracy of the estimation improves as the number of substrata increases. In this study, with the given number of total sample size, the optimal substratum boundary points are calculated using equal space, quantile, and LH algorithm; consequently, the results using those methods are compared through simulation. We also studied the criteria to determine the number of substrata and substratum boundaries that can be used in practice with various types of auxiliary variable distributions.
P-value is the probability of observing a current sample and possibly other samples departing equally or more extremely from the null hypothesis toward postulated alternative hypothesis. When p-value is less than a certain level called ${\alpha}$(= 0:05), researchers claim that the alternative hypothesis is supported empirically. Unfortunately, some findings discovered in that way are not reproducible, partly because the p-value itself is a statistic vulnerable to random variation. Boos and Stefanski (2011) suggests calculating the upper limit of p-value in hypothesis testing, using a bootstrap predictive distribution. To determine the sample size of a replication study, this study proposes thought experiments by simulating boosted bootstrap samples of different sizes from given observations. The method is illustrated for the cases of two-group comparison and multiple linear regression. This study also addresses the reproducibility of the points in the given 95% confidence interval. Numerical examples show that the center point is covered by 95% confidence intervals generated from bootstrap resamples. However, end points are covered with a 50% chance. Hence this study draws the graph of the reproducibility rate for each parameter in the confidence interval.
Large amounts of information on individuals is available to many organizations and data users and government agencies release microdata files from their survey data or administrative records data. However, if a microdata file is released without any limitation, an invasion of privacy is likely to occur. Therefore, in creating a microdata file, agencies attempt to eliminate disclosure risk of the file while maintaining maximum utility of the data. In this paper, we introduce the concept of disclosure risk, identification and uniqueness. Also, we show the method for creating a 2% microdata file using the 2005 Korean census microdata.
Journal of the Korean Society for Marine Environment & Energy
/
v.15
no.2
/
pp.156-162
/
2012
Outlier detection and treatment process is highly required as the first step for the statistical analysis of the monitoring data having many outliers frequently occurred in the coastal environmental monitoring projects. In this study, the outlier detection method using the approximate and detail (or residual) components of the (raw) data is suggested. The approximate and detail components of the data can be separated by the diverse filtering and smoothing methods. The decomposition of the data is carried out by the harmonic analysis and local regression curve, respectively. Then, the Grubbs' test and modified z-score method widely used to detect outliers in the data are applied to the detail components of the water temperature data. The new data set is reconstructed after removed the outliers detected by these methods. It can be shown that the suggested process is successfully applied to the outlier detection of the coastal water temperature monitoring data provided by the Real-time Information System for Aquaculture Environment, National Fisheries Research and Development Institute (NFRDI).
本稿는 統計學의 理論 개척과 발전을 위해서 應用分野의 연구에 주력해야 할 필요성을 밝히려 한다. 우선 기존의 統計理論이 應用分野에서 生成 발전된 점을 밝히는 동시에 應用分野에 대한 연구의 관심을 확대시켜야 할 필요성을 설명하려 한다. 물론 數理統計學이나 確率論과 같은 分野는 論理的 硏究方法으로 數理解析의 발전이나 方法을 개척할 수가 있다. 그러나 그것도 人類의 福祉증진에 기여하게 된다는 최종적인 목적성이 전제된다면 현실의 應用分野와 결코 무관할 수는 없을 것이다. 이상과 같은 목적을 위해서 우선 統計學이 과학으로 성립하기 이전의 生成 배경을 설명하면서 統計學이 人間의 生活과 얼마나 밀접하고 그 대상이 얼마나 광범위한가에 대하여 설명하려 한다. 처음부터 그것은 個人生活보다는 集團生活과 더욱 밀접한 관계가 있었다는 점을 강조하게 된다. 그리고 20世紀初에 론돈大學의 生物測定硏究室, 겔톤優生學硏究室 등을 중심으로 한 웰든, 겔톤, 피어슨 그리고 네이만의 生物測定硏究와 數理統計學연구와 핏샤와 끄ㅅ 등의 연구업적에 의해서 統計學이 科學으로 성립된 歷史的 사실을 반취하면서 統計學의 연구방법과 대상을 간접적으로 인식하게 된다. 또 統計學이 他科學과 비교하여 硏究對象 方法 그리고 實踐的 側面에서의 學問的 特殊性을 설명하면서 統計學연구의 應用側面을 강조하게 된다. 끝으로 선구자들의 統計學연구방법과 태도를 조감하면서 어떻게 하면 새로운 統計的方法을 개척할 수 있고 또 他分理 연구에 기존의 統計的方法이 기여할 수 있는가의 方法을 탐색하게 될 것이다. 즉 專門硏究機關에서, 實務現場에서 새로운 硏究對象을 찾아 새 方法을 개척할 수 있는가 하는 문제를 論議하게 된다. 이러한 탐구는 모두 과거에 統計學발전에 기여한 여러 선구자들의 연구방법과 업적을 되새기면서 유도된다.격)개발에 관심을 가진 사람들이 모이는 일일 것이다. 통계분야에서도 몇가지 표준화 활동이 ISO 를 중심으로 진행되고 있다. 예를 들면 실험과 검증 결과의 표현과 해석, 표본추출 방법 등에 관한 것으로 이들은 통계의 응용분야에서 꼭 필요한 표준이다. 구체적인 예로서 우리나라 국민의 표준체위값을 설정하기 위하여 측정조사할 때 측정방법 뿐 아니라 표본추출 방법과 통계자료 처리과정의 표준화가 이루어 지지 않는다면 각 기관에서 조사 발표하는 체위관계 자료가 상이하여 국가기관의 통계자료에 대한 신뢰성이 저하되고 통계값을 이용하여 의류, 신발 등의 제품을 제조하는 산업계에 혼란을 야기시킬 수 있다. 본 고에서는 ISO의 활동을 정보처리 분야에 초점을 맞춰 간략하게 설명하고 통계분야의 국제 활동을 비전문가인 필자들이 아는대로 소개하는 한편 국내활동의 필요성을 강조하여 관련 기관, 학계 및 산업계 관련전문가들의 ISO 국내활동 참여를 제의하고자 한다.mes$E조합에서는 견층비율의 자잠에서, D$\times$F조합에서는 웅잠의 견층비율에서 비교적 높은 값을 나타내었다.
Journal of The Korean Association of Information Education
/
v.24
no.3
/
pp.225-232
/
2020
This study is to clarify how college students think about quality computer classes. Q methodology is applied to extract the subjective thinking of college students. After extracting the statements through students' interviews and advanced study, the 54 Q samples were selected. The P sample consisted of 50 college students. They performed Q sort against the Q sample questionnaire. The Q sort results were analyzed by performing QUANL program. As a result of the analysis, four types of perceptions of quality computer classes based on college students' ideas were extracted. There were no differences between male and female students, but there was a clear difference between general college and teacher's college students by type. The types were divided into four categories which we named as follows: is 'Value change-oriented class through creative problem-solving', is 'Improving computer application skills through the learner's competition', is 'Improving advanced computer technology with programming skills' and is 'Learner centered pleasant class'.
Spatial variability of infiltration rates of 96 samples from Hwadong SiCL was studied by using geostatistical concepts. The measurement was made at the nodes of the regular grid consisting of 12 rows and 8 columns. Sample spacing within rows and columns was 3 and 2 meters, respectively. This study illustrated the use of variogram as a tool to identify the degree of dependency of the infiltration rate on the distance between pairs of measurements and how to take advantage of this dependency. Fractile diagram showed that the distribution of observation was approximately normal. The range of the variogram was about 7.4 meters. The minimum number of samples necessary to reproduce the results similar to the 96 measured values was 8 to 10. Coefficients of theoretical variogram function for computing kriged values and kriged varionces of nuogget effect, slope, and range were 0.444 cm/day, 0.003 cm/day, and 7.4 m, respectively.
KSCE Journal of Civil and Environmental Engineering Research
/
v.28
no.6A
/
pp.835-842
/
2008
The response surface method (RSM) is widely adopted for the structural reliability analysis because of its numerical efficiency. However, the RSM is still time consuming for large-scale applications and sometimes shows large errors in the calculation of sensitivity of reliability index with respect to random variables. Therefore, this study proposes a new RSM in which moving least squares (MLS) approximation is applied. Least squares approximation generally used in the common RSM gives equal weight to the coefficients of the response surface function (RSF). On the other hand, The MLS approximation gives higher weight to the experimental points closer to the design point, which yields the RSF more similar to the limit state at the design point. In the procedure of the proposed method, a linear RSF is constructed initially and then a quadratic RSF is formed using the axial experimental points selected from the reduced region where the design point is likely to exist. The RSF is updated successively by adding one more experimental point to the previously sampled experimental points. In order to demonstrate the effectiveness of the proposed method, mathematical problems and ten-bar truss are considered as numerical examples. As a result, the proposed method shows better accuracy and computational efficiency than the common RSM.
This study investigated pre-service teachers' understanding of statistical sampling. The researchers categorized major topics related to sampling into representativeness of samples, sampling variability, and sampling distribution, and selected concepts connected to each topic. Findings on this study are as follows: Even though most of the pre-service teachers considered the random sampling bringing unbiased outcomes as a proper sampling method, only 64% of them recognized that sample is a quasi-proportional, small-scale version of population; Few pre-service teachers understood that more important is the size of sample, not the portion of sample to population, and half of them appreciated that the number of sampling has a powerful effect on drawing of reliable results than the size of sample; Few pre-service teachers understood that sampling distribute is irrelevant to the shape of population and has a symmetrical bell-shape.
본 웹사이트에 게시된 이메일 주소가 전자우편 수집 프로그램이나
그 밖의 기술적 장치를 이용하여 무단으로 수집되는 것을 거부하며,
이를 위반시 정보통신망법에 의해 형사 처벌됨을 유념하시기 바랍니다.
[게시일 2004년 10월 1일]
이용약관
제 1 장 총칙
제 1 조 (목적)
이 이용약관은 KoreaScience 홈페이지(이하 “당 사이트”)에서 제공하는 인터넷 서비스(이하 '서비스')의 가입조건 및 이용에 관한 제반 사항과 기타 필요한 사항을 구체적으로 규정함을 목적으로 합니다.
제 2 조 (용어의 정의)
① "이용자"라 함은 당 사이트에 접속하여 이 약관에 따라 당 사이트가 제공하는 서비스를 받는 회원 및 비회원을
말합니다.
② "회원"이라 함은 서비스를 이용하기 위하여 당 사이트에 개인정보를 제공하여 아이디(ID)와 비밀번호를 부여
받은 자를 말합니다.
③ "회원 아이디(ID)"라 함은 회원의 식별 및 서비스 이용을 위하여 자신이 선정한 문자 및 숫자의 조합을
말합니다.
④ "비밀번호(패스워드)"라 함은 회원이 자신의 비밀보호를 위하여 선정한 문자 및 숫자의 조합을 말합니다.
제 3 조 (이용약관의 효력 및 변경)
① 이 약관은 당 사이트에 게시하거나 기타의 방법으로 회원에게 공지함으로써 효력이 발생합니다.
② 당 사이트는 이 약관을 개정할 경우에 적용일자 및 개정사유를 명시하여 현행 약관과 함께 당 사이트의
초기화면에 그 적용일자 7일 이전부터 적용일자 전일까지 공지합니다. 다만, 회원에게 불리하게 약관내용을
변경하는 경우에는 최소한 30일 이상의 사전 유예기간을 두고 공지합니다. 이 경우 당 사이트는 개정 전
내용과 개정 후 내용을 명확하게 비교하여 이용자가 알기 쉽도록 표시합니다.
제 4 조(약관 외 준칙)
① 이 약관은 당 사이트가 제공하는 서비스에 관한 이용안내와 함께 적용됩니다.
② 이 약관에 명시되지 아니한 사항은 관계법령의 규정이 적용됩니다.
제 2 장 이용계약의 체결
제 5 조 (이용계약의 성립 등)
① 이용계약은 이용고객이 당 사이트가 정한 약관에 「동의합니다」를 선택하고, 당 사이트가 정한
온라인신청양식을 작성하여 서비스 이용을 신청한 후, 당 사이트가 이를 승낙함으로써 성립합니다.
② 제1항의 승낙은 당 사이트가 제공하는 과학기술정보검색, 맞춤정보, 서지정보 등 다른 서비스의 이용승낙을
포함합니다.
제 6 조 (회원가입)
서비스를 이용하고자 하는 고객은 당 사이트에서 정한 회원가입양식에 개인정보를 기재하여 가입을 하여야 합니다.
제 7 조 (개인정보의 보호 및 사용)
당 사이트는 관계법령이 정하는 바에 따라 회원 등록정보를 포함한 회원의 개인정보를 보호하기 위해 노력합니다. 회원 개인정보의 보호 및 사용에 대해서는 관련법령 및 당 사이트의 개인정보 보호정책이 적용됩니다.
제 8 조 (이용 신청의 승낙과 제한)
① 당 사이트는 제6조의 규정에 의한 이용신청고객에 대하여 서비스 이용을 승낙합니다.
② 당 사이트는 아래사항에 해당하는 경우에 대해서 승낙하지 아니 합니다.
- 이용계약 신청서의 내용을 허위로 기재한 경우
- 기타 규정한 제반사항을 위반하며 신청하는 경우
제 9 조 (회원 ID 부여 및 변경 등)
① 당 사이트는 이용고객에 대하여 약관에 정하는 바에 따라 자신이 선정한 회원 ID를 부여합니다.
② 회원 ID는 원칙적으로 변경이 불가하며 부득이한 사유로 인하여 변경 하고자 하는 경우에는 해당 ID를
해지하고 재가입해야 합니다.
③ 기타 회원 개인정보 관리 및 변경 등에 관한 사항은 서비스별 안내에 정하는 바에 의합니다.
제 3 장 계약 당사자의 의무
제 10 조 (KISTI의 의무)
① 당 사이트는 이용고객이 희망한 서비스 제공 개시일에 특별한 사정이 없는 한 서비스를 이용할 수 있도록
하여야 합니다.
② 당 사이트는 개인정보 보호를 위해 보안시스템을 구축하며 개인정보 보호정책을 공시하고 준수합니다.
③ 당 사이트는 회원으로부터 제기되는 의견이나 불만이 정당하다고 객관적으로 인정될 경우에는 적절한 절차를
거쳐 즉시 처리하여야 합니다. 다만, 즉시 처리가 곤란한 경우는 회원에게 그 사유와 처리일정을 통보하여야
합니다.
제 11 조 (회원의 의무)
① 이용자는 회원가입 신청 또는 회원정보 변경 시 실명으로 모든 사항을 사실에 근거하여 작성하여야 하며,
허위 또는 타인의 정보를 등록할 경우 일체의 권리를 주장할 수 없습니다.
② 당 사이트가 관계법령 및 개인정보 보호정책에 의거하여 그 책임을 지는 경우를 제외하고 회원에게 부여된
ID의 비밀번호 관리소홀, 부정사용에 의하여 발생하는 모든 결과에 대한 책임은 회원에게 있습니다.
③ 회원은 당 사이트 및 제 3자의 지적 재산권을 침해해서는 안 됩니다.
제 4 장 서비스의 이용
제 12 조 (서비스 이용 시간)
① 서비스 이용은 당 사이트의 업무상 또는 기술상 특별한 지장이 없는 한 연중무휴, 1일 24시간 운영을
원칙으로 합니다. 단, 당 사이트는 시스템 정기점검, 증설 및 교체를 위해 당 사이트가 정한 날이나 시간에
서비스를 일시 중단할 수 있으며, 예정되어 있는 작업으로 인한 서비스 일시중단은 당 사이트 홈페이지를
통해 사전에 공지합니다.
② 당 사이트는 서비스를 특정범위로 분할하여 각 범위별로 이용가능시간을 별도로 지정할 수 있습니다. 다만
이 경우 그 내용을 공지합니다.
제 13 조 (홈페이지 저작권)
① NDSL에서 제공하는 모든 저작물의 저작권은 원저작자에게 있으며, KISTI는 복제/배포/전송권을 확보하고
있습니다.
② NDSL에서 제공하는 콘텐츠를 상업적 및 기타 영리목적으로 복제/배포/전송할 경우 사전에 KISTI의 허락을
받아야 합니다.
③ NDSL에서 제공하는 콘텐츠를 보도, 비평, 교육, 연구 등을 위하여 정당한 범위 안에서 공정한 관행에
합치되게 인용할 수 있습니다.
④ NDSL에서 제공하는 콘텐츠를 무단 복제, 전송, 배포 기타 저작권법에 위반되는 방법으로 이용할 경우
저작권법 제136조에 따라 5년 이하의 징역 또는 5천만 원 이하의 벌금에 처해질 수 있습니다.
제 14 조 (유료서비스)
① 당 사이트 및 협력기관이 정한 유료서비스(원문복사 등)는 별도로 정해진 바에 따르며, 변경사항은 시행 전에
당 사이트 홈페이지를 통하여 회원에게 공지합니다.
② 유료서비스를 이용하려는 회원은 정해진 요금체계에 따라 요금을 납부해야 합니다.
제 5 장 계약 해지 및 이용 제한
제 15 조 (계약 해지)
회원이 이용계약을 해지하고자 하는 때에는 [가입해지] 메뉴를 이용해 직접 해지해야 합니다.
제 16 조 (서비스 이용제한)
① 당 사이트는 회원이 서비스 이용내용에 있어서 본 약관 제 11조 내용을 위반하거나, 다음 각 호에 해당하는
경우 서비스 이용을 제한할 수 있습니다.
- 2년 이상 서비스를 이용한 적이 없는 경우
- 기타 정상적인 서비스 운영에 방해가 될 경우
② 상기 이용제한 규정에 따라 서비스를 이용하는 회원에게 서비스 이용에 대하여 별도 공지 없이 서비스 이용의
일시정지, 이용계약 해지 할 수 있습니다.
제 17 조 (전자우편주소 수집 금지)
회원은 전자우편주소 추출기 등을 이용하여 전자우편주소를 수집 또는 제3자에게 제공할 수 없습니다.
제 6 장 손해배상 및 기타사항
제 18 조 (손해배상)
당 사이트는 무료로 제공되는 서비스와 관련하여 회원에게 어떠한 손해가 발생하더라도 당 사이트가 고의 또는 과실로 인한 손해발생을 제외하고는 이에 대하여 책임을 부담하지 아니합니다.
제 19 조 (관할 법원)
서비스 이용으로 발생한 분쟁에 대해 소송이 제기되는 경우 민사 소송법상의 관할 법원에 제기합니다.
[부 칙]
1. (시행일) 이 약관은 2016년 9월 5일부터 적용되며, 종전 약관은 본 약관으로 대체되며, 개정된 약관의 적용일 이전 가입자도 개정된 약관의 적용을 받습니다.