본 연구는 웹 크롤링을 이용하여 1990년부터 2022년까지 총 32개년에 해당하는 NBA 통계 정보를 획득하고, 탐색적 데이터 분석을 통해 관심 변수를 관찰하고 관련된 파생변수를 생성한다. 입력 데이터에 대한 정제 과정을 거쳐 무의미한 변수들을 제거하고, 남은 변수에 대한 상관관계 분석, t 검정 및 분산분석을 수행하였다. 관심 변수에 대해 플레이오프 진출/미진출 그룹 간 평균의 차이를 검정하였고, 이를 보완하기 위해 순위를 기준으로 하는 3개 집단(상위/중위/하위) 간 평균 차이를 재확인하였다. 입력 데이터 중 올해 시즌 데이터만을 테스트 세트로 활용하였고, 모델 훈련을 위해서는 훈련 세트와 검증 세트를 분할하여 5-fold 교차검증을 수행하였다. 교차검증 결과와 시험 세트를 이용한 최종 분석 결과를 비교하여 성능 지표에서 차이가 없음을 확인함으로써 과적합 문제를 해결하였다. 원시 데이터의 품질 수준이 높고, 통계적 가정을 만족하기 때문에 적은 수준의 데이터 세트임에도 불구하고 대부분 모델에서 좋은 결과를 나타냈다. 본 연구는 단순히 머신러닝을 이용하여 NBA의 경기 결과를 예측하거나 플레이오프 진출 여부만을 분류하는 것에서 그치지 않고, 입력 특성의 중요도를 파악하여 높은 중요도를 갖는 주요 변수에 본 연구의 관심 대상 변수가 포함되는지를 확인하였다. Shap value의 시각화를 통해 특성 중요도의 결과만으로 해석할 수 없었던 한계를 극복하고, 변수의 진입/제거 과정에서 중요도 산출에 일관성이 부족하다는 점을 보완할 수 있었다. 본 연구에서 관심 대상으로 분류했던 3점 및 실책과 관련된 다수의 변수가 미국 프로농구에서의 플레이오프 진출에 영향을 미치는 주요 변수에 포함되는 것으로 나타났다. 본 연구는 기존의 스포츠 데이터 분석 분야에서 다루었던 경기 결과, 플레이오프 및 우승 예측 등의 주제를 포함하고 분석을 위해 여러 머신러닝 모델을 비교 분석했다는 점에서 유사성이 있지만, 사전에 관심 속성을 설정하고, 이를 통계적으로 검증함으로써 머신러닝 분석 결과와 비교하였다는 측면에서 차이가 있다. 또한 XAI 모델 중 하나인 SHAP를 이용하여 설명 가능한 시각화 결과를 제시함으로써 기존 연구와 차별화하였다.
최근 코로나19 팬데믹으로 인해 전 세계 경제와 외교 상황에 급격한 변화가 일어나고 있으며, 수출 의존도가 높은 한국은 이러한 변화에 큰 영향을 받고 있다. 본 연구에서는 기업의 수출전략 수립 및 의사결정 지원을 위해 차년도 수출액 예측 모델을 구축하고, 모델의 예측 결과를 바탕으로 수출 유망국가 추천 방식을 제안한다. 본 연구에서는 모델이 다양한 정보를 학습할 수 있도록 국가별, 품목별, 거시경제 변수 등 선행 연구에서 중요하게 사용된 변수를 다방면으로 수집하였다. 수집한 데이터를 분석한 결과, 국가와 품목에 따라서 수출액의 분포가 매우 비대칭적인 것을 확인할 수 있었다. 따라서, 모델의 예측 성능을 향상시키고 설명력을 확보하기 위해서 분리학습 방식을 사용하였다. 분리학습은 전체 데이터를 동질적인 하위 그룹으로 분리하고 개별 모델을 구축하는 방식으로, 본 연구에서는 수출액을 기준으로 5개 구간으로 데이터를 분리하였다. 모델 학습 과정에서 구간별 특성을 반영하여 구간1부터 구간4까지는 LightGBM을 사용하고, 구간5는 지수이동평균을 사용하였으며 이를 통해 모델의 예측 성능을 향상시킬 수 있었다. 모델의 설명력 확보를 위해서 추가로 구간별 모델의 SHAP-value를 계산하고 중요도가 높은 변수를 제시했다. 또한, 본 연구에서는 예측 모델을 기반으로 2단계 수출 유망국가 추천 방식을 제안했다. 효율적인 수출 전략 수립을 위해서 BCG 매트릭스와 국가별 점수 산출 방식을 사용하였고, 품목별 유망 국가 순위와 수출 관련 주요 정보들을 제공하였다. 본 연구는 다양한 정보를 학습한 머신러닝 모델로 여러 국가와 품목에 대한 예측을 실시하고, 이 과정에서 분리학습 방식으로 예측 성능을 향상시켰다는 점에서 의의가 있다. 또한, 현재 무역 관련 서비스들이 과거 데이터에 기반한 정보를 제공하고 있음을 고려할 때, 본 연구에서 제안한 예측 모델과 유망국가 추천 방식은 기업들의 미래 수출 전략 수립 및 동향 파악에 유용하게 사용될 수 있을 것으로 기대된다.
본 연구는 다년생 목본작물 바이오매스에 대한 해외 주요국가들의 산정 방법과 연구사례를 분석하였다. 주요국별 다년생 목본작물의 탄소축적 변화량 산정 방법을 살펴본 결과, 호주, 캐나다, 일본, 불가리아 등은 축적차이법을 적용하고 있는 것으로 확인되었으며, 독일, 오스트리아와 덴마크 등은 획득손실법을 기반으로 탄소축적 변화량을 산정하고 있는 것으로 나타났다. 또한, 해외의 경우, 2단계 고도화연구를 통해 계수를 자체 개발하는 단계를 넘어 영상자료를 활용한 탄소축적 변화량 추정 연구를 진행하고 있는 반면, 국내의 경우 2단계 고도화연구를 시작하는 단계인 것으로 나타났다. 이러한 결과를 기반으로, 국내에서 향후 필요한 연구 네 가지를 제안하고자 한다: 1) 배출·흡수량 통계의 완전성 제고를 위한 과수별 바이오매스 상대생장식 및 탄소전환계수와 이를 활용하여 산출된 단위면적(ha)당 탄소축적량 같은 국가고유계수에 대한 자체 개발, 2) 과수별 바이오매스 기준 성목 및 벌채 주기에 대한 정의와 고도화된 연령별 재배면적 산정방법론에 대한 정책연구, 3) 2025년 발사 예정인 농림위성을 기반으로 상대생장식 및 원격탐사기법을 활용하여 농경지 부문 다년생 목본작물의 고도화된 산정기법을 개발하는 연구, 그리고 농경지 부문 다년생 목본작물 재배지 매트릭스 구축 및 모니터링 체계를 확립하는 연구, 마지막으로, 4) 동적탄소순환모형을 구현하기 위해, 현재 전체 농경지들을 하나로 취급하여 산정하고 있는 토양의 탄소축적 변화량을 하위 토지분류별로 구분하여 산정하는 연구들이 반드시 필요할 것이다. 본 연구는 비교대상 국가가 8개국으로 한정되어 전세계 국가의 다년생 목본작물에 대한 정의 및 탄소축적 변화량 연구에 대한 일반화에 한계점이 존재한다. 그러나, 주요국별 다년생 목본작물 탄소축적 변화량 산정방법 비교·분석을 통해, 국내 다년생 목본작물의 관련 연구를 위해 필요한 단계별 접근방식과 탄소축적 변화량 산정방법을 제안하였다. 이는 2050 농식품부 탄소중립 추진전략, 농업분야 탄소중립 실현을 위한 기반 구축 및 관련 연구 활성화에 기여할 것으로 기대된다.
기업의 지식 자원은 조직의 지속 가능한 성장을 촉진하는 역할을 한다. 이에 기업은 조직의 구성원들이 새로운 지식 자원을 원활하게 탐색하고 개발할 수 있도록 지원해 주어야 한다. 기업은 보유하고 있는 지식 자산을 통해 기존의 지식을 개선하거나 새롭게 생성할 수 있어야 하며, 이를 위해 기업은 지속적으로 구성원들에게 정보와 인프라를 제공해야 한다. 이러한 정보와 인프라를 외부로부터 수혜 받는다면 해당 서비스를 지식서비스라 할 수 있다. 기업이 보유하고 있는 지식서비스의 다양성 수준은 매우 높다고 할 수 있다. 이에 본 연구는 지식서비스 유형을 분류할 수 있는 지식서비스 유형 매트릭스를 제시하였으며, 지식서비스 이용자들의 개선된 성과를 역량모델을 기반으로 기초역량(개인역량, 학술역량)과 산업역량(R&D 역량, 기술역량)으로 정의하여 측정지표를 제시하였다. 본 연구는 세 가지 지식서비스 유형(정보제공형, 정보분석형, 인프라형)에 대한 지식서비스 품질(정보품질, 시스템품질)과 산업역량(R&D 역량, 기술역량) 간의 관계에 있어 기초역량(개인역량, 학술역량)의 매개효과를 분석할 수 있는 연구모형을 제시하였으며, 이용자 집단(대학, 민간기업체, 정부기관)에 따른 지식서비스 품질과 지식서비스 역량 차원의 차이를 분석하였다. 분석결과 지식서비스 유형에 따른 기초역량의 매개효과(완전매개, 부분매개)가 명확하게 차이를 보였으며, 소속집단에 따른 지식서비스 품질과 지식서비스 역량의 차이도 제시하였다. 본 연구는 지식서비스의 유형 분류, 지식서비스 유형에 따른 속성 및 지식서비스 역량 지표를 고민하는 연구자들에게 학술적, 실무적 시사점을 제시하는 연구이다.
토양정밀조사결과 우리나라에서 밝혀진 235 개(個)의 토양통에 대하여 분류체계를 확립(確立)코저 미국(美國)의 신토양분류법에 준(準)하였는바 60개(個)의 아군으로 구분할 수 있었다. 그러나 수도재배기간중(水稻栽培期間中) 담수상태(湛水狀態)를 유지(維持)하게되는 답토양들은 신분류법(新分類法)에 분류기준(分類基準)이 확립(確立)되어 있지않아 토양형태적특성에 입각(立脚)하여 분류(分類)코저 할때 무리(無理)가 있음을 알 수 있었다. 답토양의 분류상(分類上) 문제시(問題視)된 것은 토양아군의 수준(水準)에서 18개(個)였으며 이들 새로운 아군에 대하여 분류기준(分類基準)을 설정(設定)(Setup)하였는 바 그 분류시안(分類試案)의 내용(內容)을 요약(要略)하면 다음과 같다. Anthro aquic, Aquic Udipsamments; 관개수(灌漑水)의 영향(影響)을 받아 표토(表土)로 부터 50cm이상(以上) 회색화작용(灰色化作用)을 받은 사질계충적토(砂窒系沖積土)이며 사두(沙頭)및 김천통등(金川統等)이 이에 속(屬)한다. Anthroaquic Udipsamments; 관개수(灌漑水)의 영향(影響)을 받아 표토(表土)로 부터 50cm 이내(以內)에서 회색화작용(灰色化作用)을 받은 사질계충적토(砂窒系沖積土)로 백수통(白岫統)이 이에 속(屬)한다. Halic Psammaquents; 개답년대(開畓年代)가 오래되지 않은 간척지의 염해답으로 낙천통이 이에 속(屬)한다. Anthroaquic, Aquic Udifluvents; 관개수(灌漑水)의 영향(影響)을 받아 표토(表土)에서 50cm이상(以上) 회색화작용(灰色化作用)을 받은 사양질 및 식양질계 충적토로 마영통(馬嶺統)이 이에 속(屬)한다. Anthroaquic Udifluvents: 관개수(灌漑水)의 영향(影響)을 받아 표토(表土)로부터 50cm이내(以內)에서 회색화작용(灰色化作用)을 받은 사양질 및 식양질계 충적토로 행곡통(杏谷統)이 이에 속(屬)한다. Fluventic Haplaquepts: 지하수위(地下水位)가 높아 토양은 전층이 회색화(灰色化)된 습답으로 유기물(有機物)의 함량(含量)은 토심(土深)이 깊어짐에 따라 불규칙적(不規則的)으로 감소(減少)되는 회색토(灰色土)로 백구 및 학성통등(鶴城統等)이 이에 속(屬)한다. Fuventic Thapto-Histic Haplaquepts: Fluventic Haplaquepts와 유사(類似)하나 토양단면내에 유기물층이 개재된 습답으로 공덕(孔德) 및 서탄통(西炭統)이 이에 속(屬)한다. Fluventlc Aeric Haplaquepts: Fluventic Haplaquepts보다 지하수위(地下水位)가 비교적(比較的) 낮으므로 토양배수가 약간 불량(不良)한 회색토(灰色土)로 만경(萬頃) 및 전북통등(全北統等)이 이에 속(屬)한다. Fluventic Thapto-Histic Aeric Hapldquepts: Fluventic Thapto-Histic Haplaquepts보다 지하수위(地下水位)가 비교적(比較的) 낮으므로 토양배수가 약간 불량(不良)한 회색토(灰色土)로 봉남통(鳳南統)이 이에 속(屬)한다. Fluventic Aeric Sulfic Haplaquepts: Fluventic Aeric Haplaquepts에 비(比)하여 토심(土深) 50~150cm 사이에 황색반문(黃色斑紋)(PH<4.0)인 유화물집적층이 있는 회색토(灰色土)로 등구통이 이에 속(屬)한다. Fluventic Sulfaquepts: 이들 토양은 주(主)로 강하류(江下流)에서 바다로 유입(流入)되는 지점(地点) 및 간석 소택지에 분포(分布)되며 표토(表土)에서 50cm이내(以內)에 유화물집적층이 있는 습답으로 봉림(鳳林) 및 해척통(海拓統)이 이에 속(屬)한다. Fluventic Aeric Sulfaquepts: Fluventic Sulfaquepts 보다 지하수위(地下水位)가 비교적(比較的) 깊으므로 토양 배수(排水)가 약간 불량(不良)한 회색토(灰色土)로 김해통(金海統)이 이에 속(屬)한다. Anthro aquic Fluvaquentic Eutrochrepts: 관개수(漑水)의 영향(影響)을 받아 표토(表土)로 부터 50cm이상(以上) 회색화(灰色化)되고 염기포화도가 높은(>60%) 토양이며 장유(長有) 및 칠곡통등(漆谷統等)이 이에 속(屬)한다. Anthro aquic Dystric Fluventic Eutrochrepts: Anthro aquic Fluvaquentic Eutrochrepts와 유사(類似)하나 회색화작용(灰色化作用)은 표토(表土)로부터 50cm이내(以內)에서만 나타나는 토양이며 월곡(月谷) 및 경산통등(慶山統等)이 이에 속(屬)한다. Anthro aquic Fluventic Dystrochrepts; Anthro aquic Dystric Fluventic Eutrochrepts에 비(比)하여 염기포화도가 낮은(<60%) 토양으로 고천(高川) 및 비곡통등(秘谷統等)이 이에 속(屬)한다. Anthre aquic Eutrandepts; 염기포화도가 높은 (>50%) 화산회토(火山灰土)로 대정통(大靜統)이 이에 속(屬)한다. Anthre aquic Hapludalfs; 관개수(灌漑水)의 영향(影響)을 받아 표토(表土)로부터 50cm 이내(以內)에서 회색화작용(灰色化作用)을 받은 적황색토(赤黃色土)로 화동(華東) 및 용수통등이 이에 속(屬)한다. Anthro aquic Aquic Hapludalfs; Anthro aquic Hapludalfs에 비(比)하여 회색화작용(灰色化作用)을 더 받은(표토(表土)에서 50cm이상(以上)) 적황색토(赤黃色土)로 덕평(德坪) 및 극락통등이 이에 속(屬)한다.
Web2.0의 등장과 함께 급속히 발전해온 온라인 포럼, 블로그, 트위터, 페이스북과 같은 소셜 미디어 서비스는 소비자와 소비자간의 의사소통을 넘어 이제 기업과 소비자 사이의 새로운 커뮤니케이션 매체로도 인식되고 있다. 때문에 기업뿐만 아니라 수많은 기관, 조직 등에서도 소셜미디어를 활용하여 소비자와 적극적인 의사소통을 전개하고 있으며, 나아가 소셜 미디어 콘텐츠에 담겨있는 소비자 고객들의 의견, 관심, 불만, 평판 등을 분석하고 이해하며 비즈니스에 적용하기 위해 이를 적극 분석하는 단계로 진화하고 있다. 이러한 연구의 한 분야로서 비정형 텍스트 콘텐츠와 같은 빅 데이터에서 저자의 감성이나 의견 등을 추출하는 오피니언 마이닝과 감성분석 기법이 소셜미디어 콘텐츠 분석에도 활발히 이용되고 있으며, 이미 여러 연구에서 이를 위한 방법론, 테크닉, 툴 등을 제시하고 있다. 그러나 아직 대량의 소셜미디어 데이터를 수집하여 언어처리를 거치고 의미를 해석하여 비즈니스 인사이트를 도출하는 전반의 과정을 제시한 연구가 많지 않으며, 그 결과를 의사결정자들이 쉽게 이해할 수 있는 시각화 기법으로 풀어내는 것 또한 드문 실정이다. 그러므로 본 연구에서는 소셜미디어 콘텐츠의 오피니언 마이닝을 위한 실무적인 분석방법을 제시하고 이를 통해 기업의사결정을 지원할 수 있는 시각화된 결과물을 제시하고자 하였다. 이를 위해 한국 인스턴트 식품 1위 기업의 대표 상품인 N-라면을 사례 연구의 대상으로 실제 블로그 데이터와 뉴스를 수집/분석하고 결과를 도출하였다. 또한 이런 과정에서 프리웨어 오픈 소스 R을 이용함으로써 비용부담 없이 어떤 조직에서도 적용할 수 있는 레퍼런스를 구현하였다. 그러므로 저자들은 본 연구의 분석방법과 결과물들이 식품산업뿐만 아니라 타 산업에서도 바로 적용 가능한 실용적 가이드와 참조자료가 될 것으로 기대한다.
서 론 : 비소세포 폐암은 악성 종양 관련 사망의 중요한 원인 질환으로, 주요 병태생리 기전에 관여하는 EGFR, MMP-9 및 C-erbB-2의 발현 양상을 관찰 하는 것이 환자의 예후와 향후 치료 방향을 결정하는데 도움이 될 수 있다. 방 법 : 1995년 부터 2001년 까지 고려 대학교 의료원에 내원 후 원발성 비소세포 폐암 확진 후 외과절제술을 받은 81명 환자의 조직에 EGFR, MMP-9 및 C-erbB-2 면역 조직 화학 염색 및 정량화 후, 환자들의 특성 및 생존 기간과 함께, 조직 및 수술 병기에 따른 생물학적 표지자의 발현 양상을 후향적 고찰 하였다. 결 과 : 각 종양 조직 부위의 20%이상 염색되는 Grade 2 이상의 염색 양성률은, 편평상피세포암과 선암에서 EGFR은 75.0%와 63.4%, MMP-9은 43.3%와 43.9%, C-erbB-2는 23.3%와 22.0%를 보였다. 수술 병기가 I, II, IIIa 일때 EGFR 염색 양성률은 각각 75.0%, 66.7%, 76.9%, MMP-9은 41.7%, 47.6%, 46.2%, 그리고 C-erbB-2는 19.4%, 40.0%, 30.8%를 보였다. EGFR 양성군은 중앙 생존기간이 33.5개월로 EGFR 음성군의 71.8개월보다 유의한 불량한 예후를 나타냈다.(p<0.05). 그리고 MMP-9 양성군은 중앙 생존기간 35개월로 MMP-9 음성군의 65.3개월보다 불량한 생존 곡선의 양상을 보였으나 통계적 유의성은 없었다. 또한 C-erbB-2 양성군은 중앙 생존기간이 44.2개월, C-erbB-2 음성군은 58.4개월을 나타냈으나 통계적 유의한 차이는 없었다. EGFR과 MMP-9 동시 양성군은 전체 환자의 34.2%로서 중앙 생존기간이 26.9개월로 EGFR과 MMP-9 동시 음성군의 77.0개월보다 유의한 불량한 예후를 나타냈다(p<0.05) 결 론 : 비소세포 폐암 에서 EGFR의 양성군에서 음성군 보다 환자의 생존기간이 불량하였고, EGFR과 MMP-9의 동시 양성군에서 동시 음성군보다 생존기간이 불량하였다. C-erbB-2는 다른 생물학적 표지자에 비해서 낮은 염색 양성률을 나타냈으며 특이한 상관관계는 보이지 않았다.
배경: CD44는 세포상호간 그리고 세포와 기질 사이의 부착을 조절하는 세포표면당단백질로 표준형인 CD44s와 여러 동종변형이 있다. CD44는 림프구와 단핵구를 활성화할 뿐만 아니라, 여러가지 상피성 종양의 진행과정에 참여하여 종양의 침습과 전이를 도와줄 것이라는 연구결과가 나오고 있다. 그러나, 종양의 종류에 따라 CD44의 표준형과 여러 동종변형의 발현양상이 다르고, 종양의 생물학적 특성과의 관련성에 대해서도 아직은 잘 알려져 있지 않다. 폐장에는 많은 종류의 원발성 악성종양과 전이성종양이 발생하기 때문에 폐암조직에서 CD44 당단백의 발현양상에 대해 연구하는 것이 폐암의 생물학적 특성뿐만 아니라 다른 종양의 전이에 관한 이해의 폭을 넓히는데 도움이 될 것으로 생각하여 본 연구를 시행하였다. 대상 및 방법: 1985년부터 1994년까지 비소세포성폐암으로 진단한 후 절제하여 의뢰된 48예의 편평세포암종, 33예의 선암종, 8예의 미분화성대세포암종을 합한 총 89예의 폐암조직을 대상으로 연구하였다. CD44 당단백질은 표준형인 CD44s와 동종변형인 CD44v6에 대해 면역조직화학염색을 시행하여 발현정도를 평가하였다. 종양의 미세혈관분포는 혈관내피세포 표지자인 CD34에 대한 면역조직화학염색을 시행하여 200배 및 400배 현미경 시야에서 혈관의 수를 헤아렸다. CD44s와 CD44v6의 발현정도와 미세혈관의 수 사이에 연관성을 검정하였다. 이 결과를 환자의 나이, 성별, 병기, 종양의 크기, 림프절 전이 여부, 종양의 병리조직학적 유형 및 생존율과 비교하였다. 결과: CD44s와 CD44v6는 89예의 비소세포폐암종 중 각각 71예(79.8$\%$)와 64예(71.9$\%$)에서 발현하였다. 이 두 당단백의 발현은 상호 관련성이 있었다(p < 0.0001). CD44s와 CD44v6모두 편평세포암종에서 각각 95.8$\%$로 가장 높은 발현율을 보였다(p < 0.0001). CD44s의 발현은 편평세포암종의 분화도와 관련이 있었는데 (p=0.008), 불량한 분화를 보이는 암종이 양호한 분화의 암종보다 발현율이 높았으며(p=0.002), 중등도 분화를 보인 암종과는 유의한 차이가 없었다. CD44v6의 발현은 편평세포암종과 선암종의 분화도와 관련이 없었다. CD44s의 발현은 종양의 미세혈관의 수와 상관관계를 보였다(p=0.019 및 p=0.007). 종양의 미세혈관의 수는 종양의 크기와 상관 관계가 있었다 (각각 p=0.043). 그러나, 나이, 성별, 병기, 림프절 전이 및 생존율과는 관련성이 없었다. 결론: 이상의 결과에서, 종양의 미세혈관의 수가 CD44s의 발현과 상관관계가 있고, 종양의 크기와도 상관관계를 보이는 점으로 미루어 CD44s가 종양의 성장과 혈관 형성에 관련되어 있을 가능성을 시사한다. CD44s와 CD44v6의 발현이 편평세포암종에서 가장 높은 발현율을 보이는 것으로 보아 조직형태학적 특성과 관련이 있을 것으로 생각한다.
최근 다양한 매체를 통해 생성되는 방대한 양의 텍스트 데이터를 효율적으로 관리 및 활용하기 위한 방안으로써 문서 요약에 대한 연구가 활발히 진행되고 있다. 특히 최근에는 기계 학습 및 인공 지능을 활용하여 객관적이고 효율적으로 요약문을 도출하기 위한 다양한 자동 요약 기법이(Automatic Summarization) 고안되고 있다. 하지만 현재까지 제안된 대부분의 텍스트 자동 요약 기법들은 원문에서 나타난 내용의 분포에 따라 요약문의 내용이 구성되는 방식을 따르며, 이와 같은 방식은 비중이 낮은 주제(Subject), 즉 원문 내에서 언급 빈도가 낮은 주제에 대한 내용이 요약문에 포함되기 어렵다는 한계를 갖고 있다. 본 논문에서는 이러한 한계를 극복하기 위해 저빈도 주제의 누락을 최소화하는 문서 자동 요약 기법을 제안한다. 구체적으로 본 연구에서는 (i) 원문에 포함된 다양한 주제를 식별하고 주제별 대표 용어를 선정한 뒤 워드 임베딩을 통해 주제별 용어 사전을 생성하고, (ii) 원문의 각 문장이 다양한 주제에 대응되는 정도를 파악하고, (iii) 문장을 주제별로 분할한 후 각 주제에 해당하는 문장들의 유사도를 계산한 뒤, (iv) 요약문 내 내용의 중복을 최소화하면서도 원문의 다양한 내용을 최대한 포함할 수 있는 자동적인 문서 요약 기법을 제시한다. 제안 방법론의 평가를 위해 TripAdvisor의 리뷰 50,000건으로부터 용어 사전을 구축하고, 리뷰 23,087건에 대한 요약 실험을 수행한 뒤 기존의 단순 빈도 기반의 요약문과 주제별 분포의 비교를 진행하였다. 실험 결과 제안 방법론에 따른 문서 자동 요약을 통해 원문 내각 주제의 균형을 유지하는 요약문을 도출할 수 있음을 확인하였다.
본 웹사이트에 게시된 이메일 주소가 전자우편 수집 프로그램이나
그 밖의 기술적 장치를 이용하여 무단으로 수집되는 것을 거부하며,
이를 위반시 정보통신망법에 의해 형사 처벌됨을 유념하시기 바랍니다.
[게시일 2004년 10월 1일]
이용약관
제 1 장 총칙
제 1 조 (목적)
이 이용약관은 KoreaScience 홈페이지(이하 “당 사이트”)에서 제공하는 인터넷 서비스(이하 '서비스')의 가입조건 및 이용에 관한 제반 사항과 기타 필요한 사항을 구체적으로 규정함을 목적으로 합니다.
제 2 조 (용어의 정의)
① "이용자"라 함은 당 사이트에 접속하여 이 약관에 따라 당 사이트가 제공하는 서비스를 받는 회원 및 비회원을
말합니다.
② "회원"이라 함은 서비스를 이용하기 위하여 당 사이트에 개인정보를 제공하여 아이디(ID)와 비밀번호를 부여
받은 자를 말합니다.
③ "회원 아이디(ID)"라 함은 회원의 식별 및 서비스 이용을 위하여 자신이 선정한 문자 및 숫자의 조합을
말합니다.
④ "비밀번호(패스워드)"라 함은 회원이 자신의 비밀보호를 위하여 선정한 문자 및 숫자의 조합을 말합니다.
제 3 조 (이용약관의 효력 및 변경)
① 이 약관은 당 사이트에 게시하거나 기타의 방법으로 회원에게 공지함으로써 효력이 발생합니다.
② 당 사이트는 이 약관을 개정할 경우에 적용일자 및 개정사유를 명시하여 현행 약관과 함께 당 사이트의
초기화면에 그 적용일자 7일 이전부터 적용일자 전일까지 공지합니다. 다만, 회원에게 불리하게 약관내용을
변경하는 경우에는 최소한 30일 이상의 사전 유예기간을 두고 공지합니다. 이 경우 당 사이트는 개정 전
내용과 개정 후 내용을 명확하게 비교하여 이용자가 알기 쉽도록 표시합니다.
제 4 조(약관 외 준칙)
① 이 약관은 당 사이트가 제공하는 서비스에 관한 이용안내와 함께 적용됩니다.
② 이 약관에 명시되지 아니한 사항은 관계법령의 규정이 적용됩니다.
제 2 장 이용계약의 체결
제 5 조 (이용계약의 성립 등)
① 이용계약은 이용고객이 당 사이트가 정한 약관에 「동의합니다」를 선택하고, 당 사이트가 정한
온라인신청양식을 작성하여 서비스 이용을 신청한 후, 당 사이트가 이를 승낙함으로써 성립합니다.
② 제1항의 승낙은 당 사이트가 제공하는 과학기술정보검색, 맞춤정보, 서지정보 등 다른 서비스의 이용승낙을
포함합니다.
제 6 조 (회원가입)
서비스를 이용하고자 하는 고객은 당 사이트에서 정한 회원가입양식에 개인정보를 기재하여 가입을 하여야 합니다.
제 7 조 (개인정보의 보호 및 사용)
당 사이트는 관계법령이 정하는 바에 따라 회원 등록정보를 포함한 회원의 개인정보를 보호하기 위해 노력합니다. 회원 개인정보의 보호 및 사용에 대해서는 관련법령 및 당 사이트의 개인정보 보호정책이 적용됩니다.
제 8 조 (이용 신청의 승낙과 제한)
① 당 사이트는 제6조의 규정에 의한 이용신청고객에 대하여 서비스 이용을 승낙합니다.
② 당 사이트는 아래사항에 해당하는 경우에 대해서 승낙하지 아니 합니다.
- 이용계약 신청서의 내용을 허위로 기재한 경우
- 기타 규정한 제반사항을 위반하며 신청하는 경우
제 9 조 (회원 ID 부여 및 변경 등)
① 당 사이트는 이용고객에 대하여 약관에 정하는 바에 따라 자신이 선정한 회원 ID를 부여합니다.
② 회원 ID는 원칙적으로 변경이 불가하며 부득이한 사유로 인하여 변경 하고자 하는 경우에는 해당 ID를
해지하고 재가입해야 합니다.
③ 기타 회원 개인정보 관리 및 변경 등에 관한 사항은 서비스별 안내에 정하는 바에 의합니다.
제 3 장 계약 당사자의 의무
제 10 조 (KISTI의 의무)
① 당 사이트는 이용고객이 희망한 서비스 제공 개시일에 특별한 사정이 없는 한 서비스를 이용할 수 있도록
하여야 합니다.
② 당 사이트는 개인정보 보호를 위해 보안시스템을 구축하며 개인정보 보호정책을 공시하고 준수합니다.
③ 당 사이트는 회원으로부터 제기되는 의견이나 불만이 정당하다고 객관적으로 인정될 경우에는 적절한 절차를
거쳐 즉시 처리하여야 합니다. 다만, 즉시 처리가 곤란한 경우는 회원에게 그 사유와 처리일정을 통보하여야
합니다.
제 11 조 (회원의 의무)
① 이용자는 회원가입 신청 또는 회원정보 변경 시 실명으로 모든 사항을 사실에 근거하여 작성하여야 하며,
허위 또는 타인의 정보를 등록할 경우 일체의 권리를 주장할 수 없습니다.
② 당 사이트가 관계법령 및 개인정보 보호정책에 의거하여 그 책임을 지는 경우를 제외하고 회원에게 부여된
ID의 비밀번호 관리소홀, 부정사용에 의하여 발생하는 모든 결과에 대한 책임은 회원에게 있습니다.
③ 회원은 당 사이트 및 제 3자의 지적 재산권을 침해해서는 안 됩니다.
제 4 장 서비스의 이용
제 12 조 (서비스 이용 시간)
① 서비스 이용은 당 사이트의 업무상 또는 기술상 특별한 지장이 없는 한 연중무휴, 1일 24시간 운영을
원칙으로 합니다. 단, 당 사이트는 시스템 정기점검, 증설 및 교체를 위해 당 사이트가 정한 날이나 시간에
서비스를 일시 중단할 수 있으며, 예정되어 있는 작업으로 인한 서비스 일시중단은 당 사이트 홈페이지를
통해 사전에 공지합니다.
② 당 사이트는 서비스를 특정범위로 분할하여 각 범위별로 이용가능시간을 별도로 지정할 수 있습니다. 다만
이 경우 그 내용을 공지합니다.
제 13 조 (홈페이지 저작권)
① NDSL에서 제공하는 모든 저작물의 저작권은 원저작자에게 있으며, KISTI는 복제/배포/전송권을 확보하고
있습니다.
② NDSL에서 제공하는 콘텐츠를 상업적 및 기타 영리목적으로 복제/배포/전송할 경우 사전에 KISTI의 허락을
받아야 합니다.
③ NDSL에서 제공하는 콘텐츠를 보도, 비평, 교육, 연구 등을 위하여 정당한 범위 안에서 공정한 관행에
합치되게 인용할 수 있습니다.
④ NDSL에서 제공하는 콘텐츠를 무단 복제, 전송, 배포 기타 저작권법에 위반되는 방법으로 이용할 경우
저작권법 제136조에 따라 5년 이하의 징역 또는 5천만 원 이하의 벌금에 처해질 수 있습니다.
제 14 조 (유료서비스)
① 당 사이트 및 협력기관이 정한 유료서비스(원문복사 등)는 별도로 정해진 바에 따르며, 변경사항은 시행 전에
당 사이트 홈페이지를 통하여 회원에게 공지합니다.
② 유료서비스를 이용하려는 회원은 정해진 요금체계에 따라 요금을 납부해야 합니다.
제 5 장 계약 해지 및 이용 제한
제 15 조 (계약 해지)
회원이 이용계약을 해지하고자 하는 때에는 [가입해지] 메뉴를 이용해 직접 해지해야 합니다.
제 16 조 (서비스 이용제한)
① 당 사이트는 회원이 서비스 이용내용에 있어서 본 약관 제 11조 내용을 위반하거나, 다음 각 호에 해당하는
경우 서비스 이용을 제한할 수 있습니다.
- 2년 이상 서비스를 이용한 적이 없는 경우
- 기타 정상적인 서비스 운영에 방해가 될 경우
② 상기 이용제한 규정에 따라 서비스를 이용하는 회원에게 서비스 이용에 대하여 별도 공지 없이 서비스 이용의
일시정지, 이용계약 해지 할 수 있습니다.
제 17 조 (전자우편주소 수집 금지)
회원은 전자우편주소 추출기 등을 이용하여 전자우편주소를 수집 또는 제3자에게 제공할 수 없습니다.
제 6 장 손해배상 및 기타사항
제 18 조 (손해배상)
당 사이트는 무료로 제공되는 서비스와 관련하여 회원에게 어떠한 손해가 발생하더라도 당 사이트가 고의 또는 과실로 인한 손해발생을 제외하고는 이에 대하여 책임을 부담하지 아니합니다.
제 19 조 (관할 법원)
서비스 이용으로 발생한 분쟁에 대해 소송이 제기되는 경우 민사 소송법상의 관할 법원에 제기합니다.
[부 칙]
1. (시행일) 이 약관은 2016년 9월 5일부터 적용되며, 종전 약관은 본 약관으로 대체되며, 개정된 약관의 적용일 이전 가입자도 개정된 약관의 적용을 받습니다.