본 연구에서는 정보의 주제 접근 도구로서 LCSH의 유용성을 실무 사서들의 관점에서 고찰하고자 하였다. 웹서베이를 통해 University of Washington(UW)의 64명의 도서관 사서들과 Council on East Asian Libraries(CEAL) 회원 도서관 67명 사서들의 LCSH에 대한 의견을 조사하였고 9명의 UW 사서들과 10명의 CEAL 도서관 사서들과는 직접 만나 심층 면담과 전자 우편 교환을 통해 자세한 의견을 받았다. 조사 결과, LCSH는 주제 접근점으로서 여전히 가치가 있었으며 주제에 관한 다른 관련 자료를 찾을 때 매우 유용한 것으로 나타났다. LCSH에서 이루어질 필요가 있는 개선 사항으로는 첫째, 용어와 관련해서 주제명 표목은 좀 더 이용자에게 익숙하고 최신성을 반영해서 주제명 표목간의 명확한 정의와 관계를 보여주어야 하며, 둘째, 구조와 관련해서는 주제명 표목 조합에 있어서 단순성, 용이성, 일관성이 필요하다는 것이었다. 또한 많은 다른 국가에서 LCSH를 실제로 사용하거나 변형하여 활용하고 있어서 그 파급 효과가 상당히 크므로 LCSH에서 주제명 표목으로 사용되고 있는 "Tok Island(Korea)"가 갖는 의미는 매우 중요한 것으로 나타났다. 구글 검색할 때, 결과 레코드의 수나 국제적으로 나오는 관련 문헌의 수, 외교적인 연구 활동 등이 주제명 표목의 변경에 영향을 주는 요인으로 나타나 앞으로 독도 주제명표목과 관련 자료에 관한 학술적인 노력을 배가하고 다른 주요국에서 이루어지고 있는 움직임도 유의 주시해야 할 필요가 있다.
2010년 6월에는 IFLA에서 FRBR 시리즈의 세 번째 보고서인 '주제전거레코드의 기능상의 요건'(FRSAD)이 발표되었다. 이 개념모형은 최근의 주제전거 동향을 나타낼 뿐 아니라, FRBR 체제에 적합한 주제전거레코드를 위한 밑거름이 될 것이다. 이에 본 연구에서는 FRBR 시리즈의 맥락 안에서 FRSAD 모형을 분석하고, 이 모형을 우리나라의 주제명표와 서지레코드에 시범적으로 적용하였다. 이를 위해 개체와 속성, 관계를 중심으로 FRSAD 모형을 분석하였는데, 그 결과 FRSAD는 개체의 범주를 미리 규정하지 않은 개방성을 가지고 있으며, 테마와 노멘을 구분함으로써 주제명의 형식 측면 뿐아니라 개념 측면까지 강조하고 있음을 알 수 있었다. 그리고 이 개념모형을 FAST의 패싯과 연계하여 NLSH에 속한 일부 주제명의 개념구조와 주제전거와 관련된 서지레코드의 필드로 표현한 사례를 함께 제시하였다. 단, 본 연구에서는 인명과 단체명, 표제를 제외한 추가적인 개체로서의 주제전거 데이터만을 분석대상으로 하였다. 그 결과 FRSAD에서 별도로 정의하지 않은 제3집단 개체의 유형을 선정하는 기준과 그 기준을 주제명표에 일관되게 적용하는 방안이 필요함을 알 수 있었다. 앞으로는 보다 더욱 구체적인 적용 사례와 그 결과를 분석한 후속연구가 필요할 것이다.
이 연구는 딥러닝 기법의 전이학습 모형인 BERT를 이용하여 주제명의 자동 분류를 실험하고 그 성능을 평가하였으며, 더 나아가 주제명이 부여된 KDC 분류체계와 주제명의 범주 유형에 따른 성능을 분석하였다. 실험 데이터는 국가서지를 이용하여 주제명의 부여 횟수에 따라 6개의 데이터셋을 구축하고 분류 자질로 서명을 이용하였다. 그 결과, 분류 성능으로 3,506개의 주제명이 포함된 데이터셋(레코드 1,539,076건)에서 마이크로 F1과 매크로 F1 척도가 각각 0.6059와 0.5626 값을 보였다. 또한 KDC 분류체계에 따른 분류 성능은 총류, 자연과학, 기술과학, 그리고 언어 분야에서 좋은 성능을 보이며 종교와 예술 분야는 낮은 성능을 보였다. 주제명의 범주 유형에 따른 성능은 '식물', '법률명', '상품명'이 높은 성능을 보인 반면, '국보/보물' 유형의 주제명에서 낮은 성능을 보였다. 다수의 주제명을 포함하는 데이터셋으로 갈수록 분류기가 주제명을 제대로 부여하지 못하는 비율이 늘어나 최종 성능의 하락을 가져오기 때문에, 저빈도 주제명에 대한 분류 성능을 높이기 위한 개선방안이 필요하다.
딥러닝 기법이 발달함에 따라 텍스트에 내재된 의미 및 구문을 어떠한 벡터 공간 상에 표현하기 위한 언어 모델이 활발히 연구되어 왔다. 이를 통해 자연어 처리를 기반으로 하는 감성 분석 및 문서 분류, 기계 번역 등의 분야가 진보되었다. 그러나 대부분의 언어 모델들은 텍스트에 나타나는 단어들의 일반적인 패턴을 학습하는 것을 기반으로 하기 때문에, 문서 요약이나 스토리텔링, 의역된 문장 판별 등과 같이 보다 고도화된 자연어의 이해를 필요로 하는 연구들의 경우 주어진 텍스트의 주제 및 의미를 고려하기에 한계점이 있다. 이와 같은 한계점을 고려하기 위하여, 본 연구에서는 기존의 LSTM 모델을 변형하여 문서 주제와 해당 주제에서 단어가 가지는 문맥적인 의미를 단어 벡터 표현에 반영할 수 있는 새로운 언어 학습 모델을 제안하고, 본 제안 모델이 문서의 주제를 고려하여 문장을 자동으로 생성할 수 있음을 보이고자 한다.
21세기 건설산업 생존을 위한 대토론회가 지난 3월 28일 서울 르네상스호텔 3층 다이아몬드 볼룸에서 대한건설단체총연합회의 주최와 매일경제신문사의 후원으로 개최되었다. 이번 토론회는 최근 건설산업이 건설업계의 경영혁신 등 적극적인 대처에도 불구하고 경기침체가 장기화되고 경쟁이 심화되는 등 생사의 기로에 서 있다고 판단, 이제는 건설산업계가 스스로 생존을 모색함은 물론 과거의 관행과 사고방식에서 탈피하여 시대의 변화에 걸맞는 새로운 패러다임을 모색하기 위해 개최된 것이다. 이날 토론회는 제1주제 건설산업은 왜 위기에 처해 있는가?(음성직/중앙일보 수석논설위원), 제2주제 건설산업은 제값을 받고 있는가?(김경래/한양대학교 건축공학과 교수), 제3주제 건설기술경쟁정책이 존재하는가?(이규제/대림산업 주식회사 전무이사), 제4주제 건설산업에 대한 정부의 역할은 무엇인가?(동의대학교 경제학과 교수) 등 4개의 주제발표와 언론계, 건설관련정책주관부서 담당자, 업계전문가 등 각계의 인사들이 토론자로 참석하여 현 건설산업의 문제점과 나아갈 방향에 대해 열띤 토론을 벌였다. 다음 내용은 이날 발표된 주제 내용을 간추린 것이다.
본 연구는 디렉토리 검색엔진의 주제구성에 대한 문제점을 분석하고, 효율적인 데렉토리 구성과 운영을 위한 지침을 제시함으로써 인터넷 공간에서의 정보검색에 효과성을 높일 수 있도록 하였다. 연구방법으로는 연구대상인 디렉토리 검색엔진의 최상위 주제와 하위 주제를 조사하여 검색엔진들의 일반적 특성과 주제구성의 계층성, 논리성 등을 분석하였고, 이론적 배경을 위해 문헌적 연구를 병행하였다. 연구 결과로 디렉토리 구성, 주제 선정, 인터페이스, 유지·관리 등을 위한 10가지의 지침을 제시하였다.
인류의 소중한 문화유산인 '직지'가 지난 4월 유네스코로부터 세계기록유산분야 최초의 시상제도인 '직지상'으로 제정된 것을 기념하기 위한 경축 세미나가 지난 6월 4일 오후 청주 고인쇄박물관 세미나실에서 열렸다. 이날 세미나의 제1주제는 허권 유네스코 문화팀장이 '직지상 의미와 전망'을 주제로 발표하고 김승환 충북대 교수의 사회로 황재봉 시의원, 임병무 충북일보 논설위원이 토론을 벌였다. 이어 제2주제로 박조원 한국문화정책연구원의 '직지상 제정과 세계화 추진'이란 주제발표와 전순동 충북대 교수의 사회로 강형기 충북대 교수의 박종관 충북민예총 사무처장이 토론을 벌였다. 제3주제는 노영민 국회의원이 '국가차원의 직지문화정책과 지원방안'이란 주제발표를 한데 이어 이동주 직지세계화추진단장, 남윤성 청주문화방송 특집부장의 토론이 있었다. 다음은 노영민 의원이 발표한 내용을 요약 소개한다.
본 논문은 군집 주제의 유의어와 유사도를 이용하여 문서군집의 성능을 향상시키는 방법을 제안한다. 제안된 방법은 비음수행렬분해의 의미특징을 이용하여 군집 주제(topic)의 용어들을 선택함으로서 문서 군집 집합의 내부구조를 잘 표현할 수 있으며, 군집 주제의 용어들에 워드넷의 유의어를 사용하여서 확장함으로써 문서를 용어집합(bag-of-words)으로 표현하는 문제를 해결할 수 있다. 또한 확장된 군집 주제의 용어와 문서집합에 코사인 유사도를 이용하여서 군집의 주제에 적합한 문서를 잘 군집하여서 성능을 높일 수 있다. 실험결과 제안방법을 적용한 문서군집방법이 다른 문서군집 방법에 비하여 좋은 성능을 보인다.
문서에서 저자의 의도와 주제, 그 안에 포함된 감성을 분석하는 것은 자연어 연구의 핵심적인 주제이다. 이와 유사하게 특정 글에 포함된 정치적 문화적 편향을 분석하는 것 역시 매우 의미 있는 연구주제이다. 우리는 최근 발생한 한 사건에 대하여 여러 신문사와 해당 신문사에서 생산한 기사를 중심으로 해당 글의 정치적 편향을 정량화 하는 방법을 제시한다. 그 방법은 선택된 주제어들의 문장 공간에서의 거리를 중심으로 그래프를 생성하고, 생성된 그래프의 기계학습을 통하여 편향과 특징을 분석하였다. 그리고 그 그래프들의 시간적 변화를 추적하여 특정 신문사에서 특정 사건에 대한 입장이 시간적으로 어떻게 변화하였는지를 동적으로 보여주는 그래프 애니메이션 시스템을 개발하였다. 실험을 위하여 최근 이슈에 대하여 12개의 신문사에서 약 2000여 개의 기사를 수집하였다. 그 결과, 약 82%의 정확도로 일반적으로 알려진 정치적 편향을 예측할 수 있었다. 또한, 학습 데이터에 쓰이지 않은 신문기사를 활용하여도 같은 정도의 정확도를 보임을 알 수 있었다. 우리는 이를 통하여 신문기사에서의 정치적 편향은 작성자나 신문사의 특성이 아니라 주제어들의 문장 공간에서의 거리 관계로 특성화할 수 있음을 보였다. 할 수 있다.
블로그 월드에는 동일한 주제와 관련된 포스트들에 공통적으로 관심을 보이는 블로거들이 존재한다. 본 논문에서는 이러한 블로거들의 집합을 블로그 커뮤니티(blog community)라 정의한다. 블로그 커뮤니티는 타겟 마케팅, 양질의 정보 공유, 블로그 월드의 활성화 등 다양한 블로그 비즈니스 정책을 수립하는데 활용될 수 있다. 그러나 블로그 커뮤니티는 카페 등과 달리 멤버쉽으로 운영되는 집단이 아니기 때문에 커뮤니티에 속하는 멤버를 쉽게 파악할 수 없다. 본 논문에서는 주어진 주제와 관련된 블로그 커뮤니티를 추출하는 효과적인 방법을 제안한다. 먼저, 주어진 주제에 대한 시드 포스트들을 선택하고, 이 시드 포스트들을 통해서 주제와 관련된 블로거들을 선택한다. 다음으로, 선택된 블로거들을 통해서 주제와 관련된 포스트들을 선택한다. 위와 같은 과정을 반복해 나가면서 블로그 월드에 존재하는 주어진 주제와 관련된 모든 블로거들을 선발한다. 실제 블로그 데이터를 이용한 실험을 통하여 제안하는 방법의 우수성을 검증하였다.
본 웹사이트에 게시된 이메일 주소가 전자우편 수집 프로그램이나
그 밖의 기술적 장치를 이용하여 무단으로 수집되는 것을 거부하며,
이를 위반시 정보통신망법에 의해 형사 처벌됨을 유념하시기 바랍니다.
[게시일 2004년 10월 1일]
이용약관
제 1 장 총칙
제 1 조 (목적)
이 이용약관은 KoreaScience 홈페이지(이하 “당 사이트”)에서 제공하는 인터넷 서비스(이하 '서비스')의 가입조건 및 이용에 관한 제반 사항과 기타 필요한 사항을 구체적으로 규정함을 목적으로 합니다.
제 2 조 (용어의 정의)
① "이용자"라 함은 당 사이트에 접속하여 이 약관에 따라 당 사이트가 제공하는 서비스를 받는 회원 및 비회원을
말합니다.
② "회원"이라 함은 서비스를 이용하기 위하여 당 사이트에 개인정보를 제공하여 아이디(ID)와 비밀번호를 부여
받은 자를 말합니다.
③ "회원 아이디(ID)"라 함은 회원의 식별 및 서비스 이용을 위하여 자신이 선정한 문자 및 숫자의 조합을
말합니다.
④ "비밀번호(패스워드)"라 함은 회원이 자신의 비밀보호를 위하여 선정한 문자 및 숫자의 조합을 말합니다.
제 3 조 (이용약관의 효력 및 변경)
① 이 약관은 당 사이트에 게시하거나 기타의 방법으로 회원에게 공지함으로써 효력이 발생합니다.
② 당 사이트는 이 약관을 개정할 경우에 적용일자 및 개정사유를 명시하여 현행 약관과 함께 당 사이트의
초기화면에 그 적용일자 7일 이전부터 적용일자 전일까지 공지합니다. 다만, 회원에게 불리하게 약관내용을
변경하는 경우에는 최소한 30일 이상의 사전 유예기간을 두고 공지합니다. 이 경우 당 사이트는 개정 전
내용과 개정 후 내용을 명확하게 비교하여 이용자가 알기 쉽도록 표시합니다.
제 4 조(약관 외 준칙)
① 이 약관은 당 사이트가 제공하는 서비스에 관한 이용안내와 함께 적용됩니다.
② 이 약관에 명시되지 아니한 사항은 관계법령의 규정이 적용됩니다.
제 2 장 이용계약의 체결
제 5 조 (이용계약의 성립 등)
① 이용계약은 이용고객이 당 사이트가 정한 약관에 「동의합니다」를 선택하고, 당 사이트가 정한
온라인신청양식을 작성하여 서비스 이용을 신청한 후, 당 사이트가 이를 승낙함으로써 성립합니다.
② 제1항의 승낙은 당 사이트가 제공하는 과학기술정보검색, 맞춤정보, 서지정보 등 다른 서비스의 이용승낙을
포함합니다.
제 6 조 (회원가입)
서비스를 이용하고자 하는 고객은 당 사이트에서 정한 회원가입양식에 개인정보를 기재하여 가입을 하여야 합니다.
제 7 조 (개인정보의 보호 및 사용)
당 사이트는 관계법령이 정하는 바에 따라 회원 등록정보를 포함한 회원의 개인정보를 보호하기 위해 노력합니다. 회원 개인정보의 보호 및 사용에 대해서는 관련법령 및 당 사이트의 개인정보 보호정책이 적용됩니다.
제 8 조 (이용 신청의 승낙과 제한)
① 당 사이트는 제6조의 규정에 의한 이용신청고객에 대하여 서비스 이용을 승낙합니다.
② 당 사이트는 아래사항에 해당하는 경우에 대해서 승낙하지 아니 합니다.
- 이용계약 신청서의 내용을 허위로 기재한 경우
- 기타 규정한 제반사항을 위반하며 신청하는 경우
제 9 조 (회원 ID 부여 및 변경 등)
① 당 사이트는 이용고객에 대하여 약관에 정하는 바에 따라 자신이 선정한 회원 ID를 부여합니다.
② 회원 ID는 원칙적으로 변경이 불가하며 부득이한 사유로 인하여 변경 하고자 하는 경우에는 해당 ID를
해지하고 재가입해야 합니다.
③ 기타 회원 개인정보 관리 및 변경 등에 관한 사항은 서비스별 안내에 정하는 바에 의합니다.
제 3 장 계약 당사자의 의무
제 10 조 (KISTI의 의무)
① 당 사이트는 이용고객이 희망한 서비스 제공 개시일에 특별한 사정이 없는 한 서비스를 이용할 수 있도록
하여야 합니다.
② 당 사이트는 개인정보 보호를 위해 보안시스템을 구축하며 개인정보 보호정책을 공시하고 준수합니다.
③ 당 사이트는 회원으로부터 제기되는 의견이나 불만이 정당하다고 객관적으로 인정될 경우에는 적절한 절차를
거쳐 즉시 처리하여야 합니다. 다만, 즉시 처리가 곤란한 경우는 회원에게 그 사유와 처리일정을 통보하여야
합니다.
제 11 조 (회원의 의무)
① 이용자는 회원가입 신청 또는 회원정보 변경 시 실명으로 모든 사항을 사실에 근거하여 작성하여야 하며,
허위 또는 타인의 정보를 등록할 경우 일체의 권리를 주장할 수 없습니다.
② 당 사이트가 관계법령 및 개인정보 보호정책에 의거하여 그 책임을 지는 경우를 제외하고 회원에게 부여된
ID의 비밀번호 관리소홀, 부정사용에 의하여 발생하는 모든 결과에 대한 책임은 회원에게 있습니다.
③ 회원은 당 사이트 및 제 3자의 지적 재산권을 침해해서는 안 됩니다.
제 4 장 서비스의 이용
제 12 조 (서비스 이용 시간)
① 서비스 이용은 당 사이트의 업무상 또는 기술상 특별한 지장이 없는 한 연중무휴, 1일 24시간 운영을
원칙으로 합니다. 단, 당 사이트는 시스템 정기점검, 증설 및 교체를 위해 당 사이트가 정한 날이나 시간에
서비스를 일시 중단할 수 있으며, 예정되어 있는 작업으로 인한 서비스 일시중단은 당 사이트 홈페이지를
통해 사전에 공지합니다.
② 당 사이트는 서비스를 특정범위로 분할하여 각 범위별로 이용가능시간을 별도로 지정할 수 있습니다. 다만
이 경우 그 내용을 공지합니다.
제 13 조 (홈페이지 저작권)
① NDSL에서 제공하는 모든 저작물의 저작권은 원저작자에게 있으며, KISTI는 복제/배포/전송권을 확보하고
있습니다.
② NDSL에서 제공하는 콘텐츠를 상업적 및 기타 영리목적으로 복제/배포/전송할 경우 사전에 KISTI의 허락을
받아야 합니다.
③ NDSL에서 제공하는 콘텐츠를 보도, 비평, 교육, 연구 등을 위하여 정당한 범위 안에서 공정한 관행에
합치되게 인용할 수 있습니다.
④ NDSL에서 제공하는 콘텐츠를 무단 복제, 전송, 배포 기타 저작권법에 위반되는 방법으로 이용할 경우
저작권법 제136조에 따라 5년 이하의 징역 또는 5천만 원 이하의 벌금에 처해질 수 있습니다.
제 14 조 (유료서비스)
① 당 사이트 및 협력기관이 정한 유료서비스(원문복사 등)는 별도로 정해진 바에 따르며, 변경사항은 시행 전에
당 사이트 홈페이지를 통하여 회원에게 공지합니다.
② 유료서비스를 이용하려는 회원은 정해진 요금체계에 따라 요금을 납부해야 합니다.
제 5 장 계약 해지 및 이용 제한
제 15 조 (계약 해지)
회원이 이용계약을 해지하고자 하는 때에는 [가입해지] 메뉴를 이용해 직접 해지해야 합니다.
제 16 조 (서비스 이용제한)
① 당 사이트는 회원이 서비스 이용내용에 있어서 본 약관 제 11조 내용을 위반하거나, 다음 각 호에 해당하는
경우 서비스 이용을 제한할 수 있습니다.
- 2년 이상 서비스를 이용한 적이 없는 경우
- 기타 정상적인 서비스 운영에 방해가 될 경우
② 상기 이용제한 규정에 따라 서비스를 이용하는 회원에게 서비스 이용에 대하여 별도 공지 없이 서비스 이용의
일시정지, 이용계약 해지 할 수 있습니다.
제 17 조 (전자우편주소 수집 금지)
회원은 전자우편주소 추출기 등을 이용하여 전자우편주소를 수집 또는 제3자에게 제공할 수 없습니다.
제 6 장 손해배상 및 기타사항
제 18 조 (손해배상)
당 사이트는 무료로 제공되는 서비스와 관련하여 회원에게 어떠한 손해가 발생하더라도 당 사이트가 고의 또는 과실로 인한 손해발생을 제외하고는 이에 대하여 책임을 부담하지 아니합니다.
제 19 조 (관할 법원)
서비스 이용으로 발생한 분쟁에 대해 소송이 제기되는 경우 민사 소송법상의 관할 법원에 제기합니다.
[부 칙]
1. (시행일) 이 약관은 2016년 9월 5일부터 적용되며, 종전 약관은 본 약관으로 대체되며, 개정된 약관의 적용일 이전 가입자도 개정된 약관의 적용을 받습니다.