• 제목/요약/키워드: 주제

검색결과 8,596건 처리시간 0.037초

정보의 접근점으로서 미국의회도서관 주제명 표목에 관한 연구 (A Study on the Library of Congress's Subject Headings as an Information Access Point)

  • 정연경
    • 한국문헌정보학회지
    • /
    • 제44권2호
    • /
    • pp.51-72
    • /
    • 2010
  • 본 연구에서는 정보의 주제 접근 도구로서 LCSH의 유용성을 실무 사서들의 관점에서 고찰하고자 하였다. 웹서베이를 통해 University of Washington(UW)의 64명의 도서관 사서들과 Council on East Asian Libraries(CEAL) 회원 도서관 67명 사서들의 LCSH에 대한 의견을 조사하였고 9명의 UW 사서들과 10명의 CEAL 도서관 사서들과는 직접 만나 심층 면담과 전자 우편 교환을 통해 자세한 의견을 받았다. 조사 결과, LCSH는 주제 접근점으로서 여전히 가치가 있었으며 주제에 관한 다른 관련 자료를 찾을 때 매우 유용한 것으로 나타났다. LCSH에서 이루어질 필요가 있는 개선 사항으로는 첫째, 용어와 관련해서 주제명 표목은 좀 더 이용자에게 익숙하고 최신성을 반영해서 주제명 표목간의 명확한 정의와 관계를 보여주어야 하며, 둘째, 구조와 관련해서는 주제명 표목 조합에 있어서 단순성, 용이성, 일관성이 필요하다는 것이었다. 또한 많은 다른 국가에서 LCSH를 실제로 사용하거나 변형하여 활용하고 있어서 그 파급 효과가 상당히 크므로 LCSH에서 주제명 표목으로 사용되고 있는 "Tok Island(Korea)"가 갖는 의미는 매우 중요한 것으로 나타났다. 구글 검색할 때, 결과 레코드의 수나 국제적으로 나오는 관련 문헌의 수, 외교적인 연구 활동 등이 주제명 표목의 변경에 영향을 주는 요인으로 나타나 앞으로 독도 주제명표목과 관련 자료에 관한 학술적인 노력을 배가하고 다른 주요국에서 이루어지고 있는 움직임도 유의 주시해야 할 필요가 있다.

서지레코드의 주제전거를 위한 FRSAD 모형 연구 (A Study on the Functional Requirement of Subject Authority Data for Subject Authority Control)

  • 박지영
    • 정보관리연구
    • /
    • 제42권1호
    • /
    • pp.113-135
    • /
    • 2011
  • 2010년 6월에는 IFLA에서 FRBR 시리즈의 세 번째 보고서인 '주제전거레코드의 기능상의 요건'(FRSAD)이 발표되었다. 이 개념모형은 최근의 주제전거 동향을 나타낼 뿐 아니라, FRBR 체제에 적합한 주제전거레코드를 위한 밑거름이 될 것이다. 이에 본 연구에서는 FRBR 시리즈의 맥락 안에서 FRSAD 모형을 분석하고, 이 모형을 우리나라의 주제명표와 서지레코드에 시범적으로 적용하였다. 이를 위해 개체와 속성, 관계를 중심으로 FRSAD 모형을 분석하였는데, 그 결과 FRSAD는 개체의 범주를 미리 규정하지 않은 개방성을 가지고 있으며, 테마와 노멘을 구분함으로써 주제명의 형식 측면 뿐아니라 개념 측면까지 강조하고 있음을 알 수 있었다. 그리고 이 개념모형을 FAST의 패싯과 연계하여 NLSH에 속한 일부 주제명의 개념구조와 주제전거와 관련된 서지레코드의 필드로 표현한 사례를 함께 제시하였다. 단, 본 연구에서는 인명과 단체명, 표제를 제외한 추가적인 개체로서의 주제전거 데이터만을 분석대상으로 하였다. 그 결과 FRSAD에서 별도로 정의하지 않은 제3집단 개체의 유형을 선정하는 기준과 그 기준을 주제명표에 일관되게 적용하는 방안이 필요함을 알 수 있었다. 앞으로는 보다 더욱 구체적인 적용 사례와 그 결과를 분석한 후속연구가 필요할 것이다.

BERT 모형을 이용한 주제명 자동 분류 연구 (A Study on Automatic Classification of Subject Headings Using BERT Model)

  • 이용구
    • 한국문헌정보학회지
    • /
    • 제57권2호
    • /
    • pp.435-452
    • /
    • 2023
  • 이 연구는 딥러닝 기법의 전이학습 모형인 BERT를 이용하여 주제명의 자동 분류를 실험하고 그 성능을 평가하였으며, 더 나아가 주제명이 부여된 KDC 분류체계와 주제명의 범주 유형에 따른 성능을 분석하였다. 실험 데이터는 국가서지를 이용하여 주제명의 부여 횟수에 따라 6개의 데이터셋을 구축하고 분류 자질로 서명을 이용하였다. 그 결과, 분류 성능으로 3,506개의 주제명이 포함된 데이터셋(레코드 1,539,076건)에서 마이크로 F1과 매크로 F1 척도가 각각 0.6059와 0.5626 값을 보였다. 또한 KDC 분류체계에 따른 분류 성능은 총류, 자연과학, 기술과학, 그리고 언어 분야에서 좋은 성능을 보이며 종교와 예술 분야는 낮은 성능을 보였다. 주제명의 범주 유형에 따른 성능은 '식물', '법률명', '상품명'이 높은 성능을 보인 반면, '국보/보물' 유형의 주제명에서 낮은 성능을 보였다. 다수의 주제명을 포함하는 데이터셋으로 갈수록 분류기가 주제명을 제대로 부여하지 못하는 비율이 늘어나 최종 성능의 하락을 가져오기 때문에, 저빈도 주제명에 대한 분류 성능을 높이기 위한 개선방안이 필요하다.

문서 주제에 따른 문장 생성을 위한 LSTM 기반 언어 학습 모델 (LSTM based Language Model for Topic-focused Sentence Generation)

  • 김다해;이지형
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2016년도 제54차 하계학술대회논문집 24권2호
    • /
    • pp.17-20
    • /
    • 2016
  • 딥러닝 기법이 발달함에 따라 텍스트에 내재된 의미 및 구문을 어떠한 벡터 공간 상에 표현하기 위한 언어 모델이 활발히 연구되어 왔다. 이를 통해 자연어 처리를 기반으로 하는 감성 분석 및 문서 분류, 기계 번역 등의 분야가 진보되었다. 그러나 대부분의 언어 모델들은 텍스트에 나타나는 단어들의 일반적인 패턴을 학습하는 것을 기반으로 하기 때문에, 문서 요약이나 스토리텔링, 의역된 문장 판별 등과 같이 보다 고도화된 자연어의 이해를 필요로 하는 연구들의 경우 주어진 텍스트의 주제 및 의미를 고려하기에 한계점이 있다. 이와 같은 한계점을 고려하기 위하여, 본 연구에서는 기존의 LSTM 모델을 변형하여 문서 주제와 해당 주제에서 단어가 가지는 문맥적인 의미를 단어 벡터 표현에 반영할 수 있는 새로운 언어 학습 모델을 제안하고, 본 제안 모델이 문서의 주제를 고려하여 문장을 자동으로 생성할 수 있음을 보이고자 한다.

  • PDF

21세기 건설산업 생존을 위한 대토론회

  • 대한설비건설협회
    • 월간 기계설비
    • /
    • 통권117호
    • /
    • pp.43-69
    • /
    • 2000
  • 21세기 건설산업 생존을 위한 대토론회가 지난 3월 28일 서울 르네상스호텔 3층 다이아몬드 볼룸에서 대한건설단체총연합회의 주최와 매일경제신문사의 후원으로 개최되었다. 이번 토론회는 최근 건설산업이 건설업계의 경영혁신 등 적극적인 대처에도 불구하고 경기침체가 장기화되고 경쟁이 심화되는 등 생사의 기로에 서 있다고 판단, 이제는 건설산업계가 스스로 생존을 모색함은 물론 과거의 관행과 사고방식에서 탈피하여 시대의 변화에 걸맞는 새로운 패러다임을 모색하기 위해 개최된 것이다. 이날 토론회는 제1주제 건설산업은 왜 위기에 처해 있는가?(음성직/중앙일보 수석논설위원), 제2주제 건설산업은 제값을 받고 있는가?(김경래/한양대학교 건축공학과 교수), 제3주제 건설기술경쟁정책이 존재하는가?(이규제/대림산업 주식회사 전무이사), 제4주제 건설산업에 대한 정부의 역할은 무엇인가?(동의대학교 경제학과 교수) 등 4개의 주제발표와 언론계, 건설관련정책주관부서 담당자, 업계전문가 등 각계의 인사들이 토론자로 참석하여 현 건설산업의 문제점과 나아갈 방향에 대해 열띤 토론을 벌였다. 다음 내용은 이날 발표된 주제 내용을 간추린 것이다.

  • PDF

인터넷 검색엔진의 디렉토리 구성에 관한 연구 (A Study on the Organizing Directory for Internet Directory Search Engines)

  • 신동민
    • 정보관리학회지
    • /
    • 제18권2호
    • /
    • pp.143-164
    • /
    • 2001
  • 본 연구는 디렉토리 검색엔진의 주제구성에 대한 문제점을 분석하고, 효율적인 데렉토리 구성과 운영을 위한 지침을 제시함으로써 인터넷 공간에서의 정보검색에 효과성을 높일 수 있도록 하였다. 연구방법으로는 연구대상인 디렉토리 검색엔진의 최상위 주제와 하위 주제를 조사하여 검색엔진들의 일반적 특성과 주제구성의 계층성, 논리성 등을 분석하였고, 이론적 배경을 위해 문헌적 연구를 병행하였다. 연구 결과로 디렉토리 구성, 주제 선정, 인터페이스, 유지·관리 등을 위한 10가지의 지침을 제시하였다.

  • PDF

직지상 제정 경축 세미나

  • 대한인쇄문화협회
    • 프린팅코리아
    • /
    • 통권25호
    • /
    • pp.116-118
    • /
    • 2004
  • 인류의 소중한 문화유산인 '직지'가 지난 4월 유네스코로부터 세계기록유산분야 최초의 시상제도인 '직지상'으로 제정된 것을 기념하기 위한 경축 세미나가 지난 6월 4일 오후 청주 고인쇄박물관 세미나실에서 열렸다. 이날 세미나의 제1주제는 허권 유네스코 문화팀장이 '직지상 의미와 전망'을 주제로 발표하고 김승환 충북대 교수의 사회로 황재봉 시의원, 임병무 충북일보 논설위원이 토론을 벌였다. 이어 제2주제로 박조원 한국문화정책연구원의 '직지상 제정과 세계화 추진'이란 주제발표와 전순동 충북대 교수의 사회로 강형기 충북대 교수의 박종관 충북민예총 사무처장이 토론을 벌였다. 제3주제는 노영민 국회의원이 '국가차원의 직지문화정책과 지원방안'이란 주제발표를 한데 이어 이동주 직지세계화추진단장, 남윤성 청주문화방송 특집부장의 토론이 있었다. 다음은 노영민 의원이 발표한 내용을 요약 소개한다.

  • PDF

군집 주제의 유의어와 유사도를 이용한 문서군집 향상 방법 (Enhancing Document Clustering Method using Synonym of Cluster Topic and Similarity)

  • 박선;김철원
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2011년도 춘계학술발표대회
    • /
    • pp.1538-1541
    • /
    • 2011
  • 본 논문은 군집 주제의 유의어와 유사도를 이용하여 문서군집의 성능을 향상시키는 방법을 제안한다. 제안된 방법은 비음수행렬분해의 의미특징을 이용하여 군집 주제(topic)의 용어들을 선택함으로서 문서 군집 집합의 내부구조를 잘 표현할 수 있으며, 군집 주제의 용어들에 워드넷의 유의어를 사용하여서 확장함으로써 문서를 용어집합(bag-of-words)으로 표현하는 문제를 해결할 수 있다. 또한 확장된 군집 주제의 용어와 문서집합에 코사인 유사도를 이용하여서 군집의 주제에 적합한 문서를 잘 군집하여서 성능을 높일 수 있다. 실험결과 제안방법을 적용한 문서군집방법이 다른 문서군집 방법에 비하여 좋은 성능을 보인다.

주제어 문장거리를 이용한 뉴스 편향성 분석 그래프 학습 (Graph Learning System for Analyzing Bias among News Using Keyword Distance Model)

  • 조찬우;조찬형
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2023년도 제35회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.533-538
    • /
    • 2023
  • 문서에서 저자의 의도와 주제, 그 안에 포함된 감성을 분석하는 것은 자연어 연구의 핵심적인 주제이다. 이와 유사하게 특정 글에 포함된 정치적 문화적 편향을 분석하는 것 역시 매우 의미 있는 연구주제이다. 우리는 최근 발생한 한 사건에 대하여 여러 신문사와 해당 신문사에서 생산한 기사를 중심으로 해당 글의 정치적 편향을 정량화 하는 방법을 제시한다. 그 방법은 선택된 주제어들의 문장 공간에서의 거리를 중심으로 그래프를 생성하고, 생성된 그래프의 기계학습을 통하여 편향과 특징을 분석하였다. 그리고 그 그래프들의 시간적 변화를 추적하여 특정 신문사에서 특정 사건에 대한 입장이 시간적으로 어떻게 변화하였는지를 동적으로 보여주는 그래프 애니메이션 시스템을 개발하였다. 실험을 위하여 최근 이슈에 대하여 12개의 신문사에서 약 2000여 개의 기사를 수집하였다. 그 결과, 약 82%의 정확도로 일반적으로 알려진 정치적 편향을 예측할 수 있었다. 또한, 학습 데이터에 쓰이지 않은 신문기사를 활용하여도 같은 정도의 정확도를 보임을 알 수 있었다. 우리는 이를 통하여 신문기사에서의 정치적 편향은 작성자나 신문사의 특성이 아니라 주제어들의 문장 공간에서의 거리 관계로 특성화할 수 있음을 보였다. 할 수 있다.

  • PDF

블로그 월드를 위한 커뮤니티 추출 방안 (On Extracting a Community in the Blog World)

  • 신정환;김상욱;윤석호
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2008년도 추계학술발표대회
    • /
    • pp.283-285
    • /
    • 2008
  • 블로그 월드에는 동일한 주제와 관련된 포스트들에 공통적으로 관심을 보이는 블로거들이 존재한다. 본 논문에서는 이러한 블로거들의 집합을 블로그 커뮤니티(blog community)라 정의한다. 블로그 커뮤니티는 타겟 마케팅, 양질의 정보 공유, 블로그 월드의 활성화 등 다양한 블로그 비즈니스 정책을 수립하는데 활용될 수 있다. 그러나 블로그 커뮤니티는 카페 등과 달리 멤버쉽으로 운영되는 집단이 아니기 때문에 커뮤니티에 속하는 멤버를 쉽게 파악할 수 없다. 본 논문에서는 주어진 주제와 관련된 블로그 커뮤니티를 추출하는 효과적인 방법을 제안한다. 먼저, 주어진 주제에 대한 시드 포스트들을 선택하고, 이 시드 포스트들을 통해서 주제와 관련된 블로거들을 선택한다. 다음으로, 선택된 블로거들을 통해서 주제와 관련된 포스트들을 선택한다. 위와 같은 과정을 반복해 나가면서 블로그 월드에 존재하는 주어진 주제와 관련된 모든 블로거들을 선발한다. 실제 블로그 데이터를 이용한 실험을 통하여 제안하는 방법의 우수성을 검증하였다.