비정형 텍스트 문서를 다중 범주로 분류하는 문제에 있어서, 계층적 분류 방법이 비계층적 분류 방법에 비하여 분류 성능이 우수한 것으로 알려져 있다. 기존 문헌과 다르게 본 연구에서는 사전에 범주들의 계층 구조가 정의된 상황에서 계층적 분류 방법과 비계층적 분류 방법의 성능을 비교하였다. 수자원 분야 기후변화 적응기술과 관련한 논문 분류 데이터와 20NewsGroup 오픈 데이터를 대상으로 계층적/비계층적 분류 방법의 성능을 비교하였다. 본 연구결과 기존 문헌과 다르게 계층적 분류 방법이 비계층적 분류 방법에 비하여 언제나 성능이 우수한 것은 아님을 확인하였다. 계층 구조의 상위/하위 수준에서의 상대적 유사도에 따라서 계층적/비계층적 분류 방법의 성능에 차이가 있음을 확인하였다. 즉, 상위 수준의 유사도가 하위 수준보다 상대적으로 낮은 경우 상위 수준에서의 오분류 감소로 계층적 분류 방법의 성능이 개선됨을 확인하였다.
본 논문은 K-means과 비음수 행렬 분해(NMF)를 이용하여 주제기반의 다중문서를 요약하는 새로운 방법을 제안하였다. 제안방법은 비음수 행렬 분해를 이용하여 가중치가 부여된 용어-문장 행렬을 희소(Sparse)한 비음수 의미특징 행렬과 비음수 변수 행렬로 분해함으로써 직관적으로 이해할 수 있는 형태의 의미적 특징을 추출할 수 있고, 주제와 의미특징간의 유사도에 가중치를 부여하여 유사도는 높으나 실제 의미 없는 문장이 추출되는 것을 막는다. 또한 K-means 군집을 이용하여 문장에 포함된 노이즈를 제거함으로써 문서의 의미가 요약에 편향되게 반영하는 것을 피할 수 있고, 추출된 문장에 부여된 순위순서대로 정렬하여 보여 줌으로써 응집성을 높인다. 실험 결과 제안방법이 다른 방법에 비하여 좋은 성능을 보인다.
You 와 Rao (2002)는 소지역 추정시 유사 최량선형 비편향 예측에서 설계 가중 값을 사용하는 방법을 발전시켰다. 특히 소지역 평균들을 추정하기 위하여 유사-최량선형 비편향 예측 추정량을 제안하였다. 우리는 소지역 추정에서 실용적으로 이용되는 몇 가지 추가적인 성질을 연구하였다.
흔히 진흙으로 불리는 점착성 유사는 모래 등의 비점착성 유사와는 다른 특성을 보인다. 가장 큰 특징은 점착력에 의해 서로 엉겨 붙어 큰 덩어리(플럭)를 형성하고 다시 큰 플럭이 파괴되는 과정인 응집현상(Flocculation Process)을 보인다는 것이다. 이 응집현상의 과정을 통해 플럭은 크기 및 밀도를 지속적으로 변화시킨다. 크기 및 밀도의 변화는 플럭의 침강속도를 변화시켜 점착성 유사의 부유, 퇴적, 이송, 확산의 과정에 직접적인 영향을 미친다. 응집현상은 플럭의 침강속도 뿐 아니라 부피농도와 질량농도 사이의 비선형적 관계를 야기하여 흐름 운동량 방정식 유도, 난류의 모형화 등에서도 비점착성 유사와 다른 방향으로 진행된다. 점착성 유사가 우세한 지역의 또 다른 특성은 자기하중에 의한 압밀현상에 따라 발생하는 가변적인 한계소류력이다. 따라서 점착성 유사의 이동을 모형화 하는 과정에서는 가변적인 침식율의 가정 등을 통해 이에 대한 고려가 반드시 이루어져야 한다. 흐름의 운동량 방정식 및 난류 모형에서는 플럭의 부피 농도와 질량농도가 각 항의 물리적 의미에 부합하도록 개별적으로 선택 및 적용되어야 질량보존의 문제 등으로 발생할 수 있는 계산상의 오류를 배제할 수 있다. 적용 결과, 점착성 유사가 우세한 지역에서 나타나는 높은 부유 및 흐름정체기에서의 부유사 존재 등의 특성이 점착성 유사 이동을 위한 모형에서 보다 합리적으로 계산된다는 사실이 확인되었다. 그리고 비점착성 유사에 적합한 이동 모형이 점착성이 우세한 지역에 적용될 경우, 상황에 따라 유사량을 과대 및 과소 산정할 수 있다는 결론이 도출되었다. 조류의 영향이 존재하는 하구부의 경우에는 조류의 형태와 비대칭성에 따라 유사량의 차이가 큰 것으로 나타났다. 조류의 형태는 주로 하구부의 지형에 의해 결정되므로 준설, 매립, 확폭 등과 같은 하구부에서의 사업이 진행되는 경우, 유사량 변화에 대한 고려가 반드시 이루어져야 할 것으로 판단된다.
일반적으로 그룹화된 다변량자료는 다변량 분산분석(multivariate analysis of variance; MANOVA)을 사용하여 그룹 간 차이를 검정할 수 있다. 그러나 만약 다변량 분산분석의 기본적인 가정이 위배되면 이 방법은 적절하지 못하다. 이 경우 다양한 거리로부터 그룹화된 비유사성을 계산한 후 다차원척도법(multidimensional scaling; MDS), 거리분석(analysis of distance; AOD) 그리고 비모수적 기법인 순열검정(permutation test)을 적용하여 문제를 해결할 수 있다. 다차원척도법은 비유사성으로부터 개체들의 좌표를 계산해주며 거리분석은 이 좌표를 활용하여 그룹구조를 파악하는데 유용하다. 특히 비유사성의 측도로 유클리드 거리를 사용하면 거리분석은 다변량 분산분석과 수리적으로 매우 밀접한 연관관계를 맺는다. 따라서 본 연구에서는 그룹화된 비유사성에 다차원척도법과 거리분석을 적용하여 그룹 내와 그룹 간의 구조를 파악하고 순열검정을 위한 새로운 검정통계량을 제안하려 한다. 덧붙여 유클리드 거리를 활용한 비유사성을 통해 거리분석과 다변량 분산분석과의 수리적 연관성을 고찰하고자 한다.
본 연구의 주요 목적은 댐 설계를 위한 유역의 비유사량 추정방법을 개발하는 것으로 유역면적 $200km^2{\sim}2,000km^2$의 중규모 유역을 대상으로 한다. 이를 위하여, 먼저 연구(I)에서는 비유사량 추정방법의 개발방향을 결정하고, 기존 저수지 퇴사자료에서 5점과 하천 유사량 실측 자료에서 8 점 등 총 13 점의 비유사량 자료를 도출하였다. 본 연구(II)에서는 이러한 중규모 유역에서 수집된 유역 비유사량 자료와 유역특성 인자들을 이용하여 3 변수 경험공식과 6 변수 도표식 방법을 개발하였다. 제한된 범위와 비교 분석 결과, 본 연구에서 개발된 방법들은 기존의 방법들보다 모형 개발에 이용된 자료의 범위와 신뢰도 면에서 적용성이 높은 것으로 나타났다. 한편, 본 연구에서 수집된 비유사량 자료 및 개발된 모형에 의하면, 우리나라에서 중규모 유역의 경우 비유사량의 하한치는 $100tons/km^2/yr$정도이며 상한치는 $1,000tons/km^2/yr$ 정도로 추정된다.
수문모형들은 유역차원의 저감대책 수립 및 평가에 유용하게 사용될 수 있고 이를 활용한 합리적인 예측이 가능하다. 한국의 미계측 유역에 대한 유사발생량 예측을 모델을 개발하였다. 본 연구에서 개발한 예측모형의 특징은 신뢰할 수 있는 관측 자료를 활용하여 단계별 다중회귀분석을 이용하여 매개변수를 결정하였으며, 최소한의 입력자료를 이용하여 전국 규모의 연평균 유사발생량을 예측할 수 있다는 것이다. 본 연구에서 개발된 모형을 활용하여 4대강 유역의 중권역별 유사량을 추정하였다. 수자원장기 종합에서 사용한 중권역별 강우 자료를 활용하여 모의를 수행하였다. 2001년부터 2015년 까지 15년까지 모의결과 4대강 유역 전체적으로 연 강우량의 변동에 따라 유사발생량도 증감하는 패턴을 나타내고 있으며, 그 주기는 약 8년 정도로 추정되었다. 4대강 주요 중권역을 대상으로 2010년에 추정된 비유사량을 K-DRUM 예측값 및 유량조사사업단 추정값과 비교하여 모델의 활용성을 검토하였다. 유사량 예측의 불확실성을 감안할 때 본 연구에서 개발된 모델을 이용하여 1차 스크리닝 수준에서 미계측 유역에 대한 비유사량 예측이 가능할 것으로 판단되며, 향후 미계측 유역에 대한 유사관리계획 수립에 활용될 수 있을 것으로 판단된다.
본 논문에서는 클러스터 간의 중복을 허용한 계층적 클러스터링(hierarchical clustering) 기법에 적합한 클러스터 간 유사도 평가방법(linkage metric)을 제안하였다. 클러스터 간 유사도 평가방법은 계층적 클러스터링에서 클러스터를 통합하거나 분해하는데 쓰이며 사용된 방법에 따라 클러스터링의 결과가 다르게 형성된다. 기존의 클러스터 간 유사도 평가방법인 single linkage, complete linkage, average linkage 중 single linkage와 complete linkage는 클러스터 간 중복이 허용된 환경에서 정확도가 낮은 문제점이 있고, average linkage는 정확도가 두 방법에 비해 높지만 계산 시간 소요가 크다는 단점이 있다. 따라서 본 논문에서는 기존의 average linkage를 개선하여 중복된 데이터에 의한 필요 계산량을 크게 줄임으로써 시간적 성능이 우수한 클러스터 간 유사도 평가방법을 제안하였다. 또한, 제안된 방법을 기존 방법들과 비교실험하여 중복을 허용하는 계층적 클러스터링 환경에서 정확도는 비슷하거나 더 높고, average linkage에 비해 계산량이 감소됨을 확인하였다.
풍화작용에 의해 생성된 유사는 자연 매체에 의해 이동하고 하천에 도달하기 이전이나 이후 퇴적되며, 해당 과정 중에서 하상변동, 홍수위 상승, 제방 안정성, 두부 침식, 생태환경 변화, 수질문제 등 다양한 침식과 퇴적 관련 문제들이 발생한다. 이러한 유사 문제의 해결과 지속적인 하천관리를 위해서는 유사의 생성, 이송, 그리고 퇴적 과정에 대한 충분한 이해와 정량적인 유사량을 파악하는 것이 필수적이다. 다양한 연구들을 통해서 유사량을 정량적으로 파악하기 위해 여러 종류의 모델과 공식들이 제안 되어져 왔다. 그 중 경험적 모델의 경우 실제로 관측된 값을 기반으로 하며, 복잡한 계산이나 요구하는 자료가 다른 종류의 모델들 보다 적어 쉽게 접근이 가능하다. 이러한 경험적 모델은 유사에 영향을 주는 인자를 규명하거나 특정 유역이나 지역에서 이송 및 퇴적 되는 유사의 출처와 특성을 규명하는 초기 단계에서 유용하게 이용된다. 국내 하천의 경우 여름에 강우가 집중되고 대부분의 국토가 산지로 이루어져있어 상류에서 침식이 주로 발생한다. 또한, 본류 및 하류 지역의 하천은 유사의 퇴적이 주로 일어나서 하천의 형태와 물길이 형성된 충적 하천 형태로 발전 되어있기 때문에 국내 하천에서는 전반적으로 국부적이며 다양한 형태의 유사 관련 문제가 발생한다. 국내 하천에서 발생하는 유사 관련 문제를 해결하기 위해 국내 하천의 유사량을 추정하는 다양한 경험적 모델들이 지속적으로 개발되어왔다. 하지만 과거에 개발된 모델들의 경우 계측 자료가 충분하지 않은 시기에 개발 되었으며, 현재에는 활용하기 불가능하다. 본 연구에서는 국내 하천의 비유사량을 예측하는 동시에 국내 하천의 유사 특성을 이해하기 위해 과거에 국내 하천을 대상으로 비유사량을 추정하기 위해 개발되었던 경험적 모델을 개선하였다. 본 연구를 통해 기존 경험 모델의 경우 주기적인 업데이트가 필요함을 확인하였으며, 개발된 모델의 경우 국내 하천 유사 관리를 위해 미래 유사량 예측하는 등 다양한 방면으로 활용 관리가 가능할 것으로 보인다.
하천에서 발생하는 유사량은 공급능력이 흐름의 이송능력보다 지배적인 경우 같은 유량이 발생하더라도 유사량이 다르게 관측될 수 있다. 특히 국내 하천과 같이 홍수기가 특정기간에 편중되어 연중 유량발생 편차가 매우 크게 나타나는 경우 이와 같은 현상이 더욱 두드러지게 발생한다. 즉, 대부분의 연중발생 유사량이 홍수시에 이동하고 홍수발생 초기와 후기의 유사 공급능력의 차이가 나타나는 국내하천의 경우 이를 기존의 유사이송공식으로 정량적인 유사량 값을 추정하는데는 한계가 있음을 의미한다. 따라서 본 연구에서는 국내 하천에서 실측한 유사량 자료를 종합하고 주요 지점별, 연도별, 계절별, 하천 유역별로 분류한 후 이를 분석하여 국내하천의 유사량 발생 특성을 규명하였다. 실측 유사량 데이터베이스는 국내 하천의 주요지점에서 2007년부터 2012년까지 측정한 자료로 구성되어 있으며 총 26개 지점 1,283개의 자료를 포함하고 있다. 4대강의 본류 대표지점으로 선정된 여주, 왜관, 공주, 나주지점을 대상으로 유량-총유사량 관계를 비교한 결과, 여주지점의 유량 증가에 따른 총유사량 증가 폭이 다른 대표지점들에 비해 가장 크게 나타나는 반면, 나주지점의 경우 제일 작은 값을 보인다. 또한 본류의 유량-유사량 관계식의 지수 값이 본류와 지류를 모두 포함한 관계식에 비해 더 크게 나타나는데 이는 지류에서는 본류보다 적은 유량이 발생하더라도 유사 이송량은 상대적으로 크게 발생한다는 것을 의미하며 그 이유는 본류와 지류에서 유사 이송이 지배적으로 발생하는 유량범위가 상이하기 때문에 나타나는 결과로 추정할 수 있다. 대표지점별 부유사 농도를 분석한 결과, 7월과 8월 부유사 농도에 비해 9월에 발생하는 부유사 농도가 현저히 낮은 값을 보이는데 이는 연중 홍수기 전반기에 유사 공급량이 상대적으로 많아 나타나는 현상으로 판단된다.
본 웹사이트에 게시된 이메일 주소가 전자우편 수집 프로그램이나
그 밖의 기술적 장치를 이용하여 무단으로 수집되는 것을 거부하며,
이를 위반시 정보통신망법에 의해 형사 처벌됨을 유념하시기 바랍니다.
[게시일 2004년 10월 1일]
이용약관
제 1 장 총칙
제 1 조 (목적)
이 이용약관은 KoreaScience 홈페이지(이하 “당 사이트”)에서 제공하는 인터넷 서비스(이하 '서비스')의 가입조건 및 이용에 관한 제반 사항과 기타 필요한 사항을 구체적으로 규정함을 목적으로 합니다.
제 2 조 (용어의 정의)
① "이용자"라 함은 당 사이트에 접속하여 이 약관에 따라 당 사이트가 제공하는 서비스를 받는 회원 및 비회원을
말합니다.
② "회원"이라 함은 서비스를 이용하기 위하여 당 사이트에 개인정보를 제공하여 아이디(ID)와 비밀번호를 부여
받은 자를 말합니다.
③ "회원 아이디(ID)"라 함은 회원의 식별 및 서비스 이용을 위하여 자신이 선정한 문자 및 숫자의 조합을
말합니다.
④ "비밀번호(패스워드)"라 함은 회원이 자신의 비밀보호를 위하여 선정한 문자 및 숫자의 조합을 말합니다.
제 3 조 (이용약관의 효력 및 변경)
① 이 약관은 당 사이트에 게시하거나 기타의 방법으로 회원에게 공지함으로써 효력이 발생합니다.
② 당 사이트는 이 약관을 개정할 경우에 적용일자 및 개정사유를 명시하여 현행 약관과 함께 당 사이트의
초기화면에 그 적용일자 7일 이전부터 적용일자 전일까지 공지합니다. 다만, 회원에게 불리하게 약관내용을
변경하는 경우에는 최소한 30일 이상의 사전 유예기간을 두고 공지합니다. 이 경우 당 사이트는 개정 전
내용과 개정 후 내용을 명확하게 비교하여 이용자가 알기 쉽도록 표시합니다.
제 4 조(약관 외 준칙)
① 이 약관은 당 사이트가 제공하는 서비스에 관한 이용안내와 함께 적용됩니다.
② 이 약관에 명시되지 아니한 사항은 관계법령의 규정이 적용됩니다.
제 2 장 이용계약의 체결
제 5 조 (이용계약의 성립 등)
① 이용계약은 이용고객이 당 사이트가 정한 약관에 「동의합니다」를 선택하고, 당 사이트가 정한
온라인신청양식을 작성하여 서비스 이용을 신청한 후, 당 사이트가 이를 승낙함으로써 성립합니다.
② 제1항의 승낙은 당 사이트가 제공하는 과학기술정보검색, 맞춤정보, 서지정보 등 다른 서비스의 이용승낙을
포함합니다.
제 6 조 (회원가입)
서비스를 이용하고자 하는 고객은 당 사이트에서 정한 회원가입양식에 개인정보를 기재하여 가입을 하여야 합니다.
제 7 조 (개인정보의 보호 및 사용)
당 사이트는 관계법령이 정하는 바에 따라 회원 등록정보를 포함한 회원의 개인정보를 보호하기 위해 노력합니다. 회원 개인정보의 보호 및 사용에 대해서는 관련법령 및 당 사이트의 개인정보 보호정책이 적용됩니다.
제 8 조 (이용 신청의 승낙과 제한)
① 당 사이트는 제6조의 규정에 의한 이용신청고객에 대하여 서비스 이용을 승낙합니다.
② 당 사이트는 아래사항에 해당하는 경우에 대해서 승낙하지 아니 합니다.
- 이용계약 신청서의 내용을 허위로 기재한 경우
- 기타 규정한 제반사항을 위반하며 신청하는 경우
제 9 조 (회원 ID 부여 및 변경 등)
① 당 사이트는 이용고객에 대하여 약관에 정하는 바에 따라 자신이 선정한 회원 ID를 부여합니다.
② 회원 ID는 원칙적으로 변경이 불가하며 부득이한 사유로 인하여 변경 하고자 하는 경우에는 해당 ID를
해지하고 재가입해야 합니다.
③ 기타 회원 개인정보 관리 및 변경 등에 관한 사항은 서비스별 안내에 정하는 바에 의합니다.
제 3 장 계약 당사자의 의무
제 10 조 (KISTI의 의무)
① 당 사이트는 이용고객이 희망한 서비스 제공 개시일에 특별한 사정이 없는 한 서비스를 이용할 수 있도록
하여야 합니다.
② 당 사이트는 개인정보 보호를 위해 보안시스템을 구축하며 개인정보 보호정책을 공시하고 준수합니다.
③ 당 사이트는 회원으로부터 제기되는 의견이나 불만이 정당하다고 객관적으로 인정될 경우에는 적절한 절차를
거쳐 즉시 처리하여야 합니다. 다만, 즉시 처리가 곤란한 경우는 회원에게 그 사유와 처리일정을 통보하여야
합니다.
제 11 조 (회원의 의무)
① 이용자는 회원가입 신청 또는 회원정보 변경 시 실명으로 모든 사항을 사실에 근거하여 작성하여야 하며,
허위 또는 타인의 정보를 등록할 경우 일체의 권리를 주장할 수 없습니다.
② 당 사이트가 관계법령 및 개인정보 보호정책에 의거하여 그 책임을 지는 경우를 제외하고 회원에게 부여된
ID의 비밀번호 관리소홀, 부정사용에 의하여 발생하는 모든 결과에 대한 책임은 회원에게 있습니다.
③ 회원은 당 사이트 및 제 3자의 지적 재산권을 침해해서는 안 됩니다.
제 4 장 서비스의 이용
제 12 조 (서비스 이용 시간)
① 서비스 이용은 당 사이트의 업무상 또는 기술상 특별한 지장이 없는 한 연중무휴, 1일 24시간 운영을
원칙으로 합니다. 단, 당 사이트는 시스템 정기점검, 증설 및 교체를 위해 당 사이트가 정한 날이나 시간에
서비스를 일시 중단할 수 있으며, 예정되어 있는 작업으로 인한 서비스 일시중단은 당 사이트 홈페이지를
통해 사전에 공지합니다.
② 당 사이트는 서비스를 특정범위로 분할하여 각 범위별로 이용가능시간을 별도로 지정할 수 있습니다. 다만
이 경우 그 내용을 공지합니다.
제 13 조 (홈페이지 저작권)
① NDSL에서 제공하는 모든 저작물의 저작권은 원저작자에게 있으며, KISTI는 복제/배포/전송권을 확보하고
있습니다.
② NDSL에서 제공하는 콘텐츠를 상업적 및 기타 영리목적으로 복제/배포/전송할 경우 사전에 KISTI의 허락을
받아야 합니다.
③ NDSL에서 제공하는 콘텐츠를 보도, 비평, 교육, 연구 등을 위하여 정당한 범위 안에서 공정한 관행에
합치되게 인용할 수 있습니다.
④ NDSL에서 제공하는 콘텐츠를 무단 복제, 전송, 배포 기타 저작권법에 위반되는 방법으로 이용할 경우
저작권법 제136조에 따라 5년 이하의 징역 또는 5천만 원 이하의 벌금에 처해질 수 있습니다.
제 14 조 (유료서비스)
① 당 사이트 및 협력기관이 정한 유료서비스(원문복사 등)는 별도로 정해진 바에 따르며, 변경사항은 시행 전에
당 사이트 홈페이지를 통하여 회원에게 공지합니다.
② 유료서비스를 이용하려는 회원은 정해진 요금체계에 따라 요금을 납부해야 합니다.
제 5 장 계약 해지 및 이용 제한
제 15 조 (계약 해지)
회원이 이용계약을 해지하고자 하는 때에는 [가입해지] 메뉴를 이용해 직접 해지해야 합니다.
제 16 조 (서비스 이용제한)
① 당 사이트는 회원이 서비스 이용내용에 있어서 본 약관 제 11조 내용을 위반하거나, 다음 각 호에 해당하는
경우 서비스 이용을 제한할 수 있습니다.
- 2년 이상 서비스를 이용한 적이 없는 경우
- 기타 정상적인 서비스 운영에 방해가 될 경우
② 상기 이용제한 규정에 따라 서비스를 이용하는 회원에게 서비스 이용에 대하여 별도 공지 없이 서비스 이용의
일시정지, 이용계약 해지 할 수 있습니다.
제 17 조 (전자우편주소 수집 금지)
회원은 전자우편주소 추출기 등을 이용하여 전자우편주소를 수집 또는 제3자에게 제공할 수 없습니다.
제 6 장 손해배상 및 기타사항
제 18 조 (손해배상)
당 사이트는 무료로 제공되는 서비스와 관련하여 회원에게 어떠한 손해가 발생하더라도 당 사이트가 고의 또는 과실로 인한 손해발생을 제외하고는 이에 대하여 책임을 부담하지 아니합니다.
제 19 조 (관할 법원)
서비스 이용으로 발생한 분쟁에 대해 소송이 제기되는 경우 민사 소송법상의 관할 법원에 제기합니다.
[부 칙]
1. (시행일) 이 약관은 2016년 9월 5일부터 적용되며, 종전 약관은 본 약관으로 대체되며, 개정된 약관의 적용일 이전 가입자도 개정된 약관의 적용을 받습니다.