학문의 발전으로 새로운 개념의 생성과 함께 전문용어가 급증함에 따라 이를 체계적으로 집성하여 관리하고자 하는 필요성이 대두되고 있다. 본 연구는 전문용어사전에서 전문용어의 체계적이고 효율적인 뜻풀이를 위한 미시구조를 제안하고자 한다. 이를 위해 전문용어사전과 밀접한 관계를 맺고 있는 전문용어와 사전편찬학의 이론을 바탕으로 전문용어기술학의 특성 혹은 차이점을 살펴보고, 현행 전문용어사전의 미시구조를 분석하여 문제점을 파악한 후, 형태론적 측면과 방법론적 측면에서 미시구조에 대한 개선방안을 제안하였다.
본 연구는 IEC 60050-801:1994 국제 표준을 기준으로 남한 산업표준과 북한 국가규격의 음향학 전문용어 431개를 비교 분석하고 통합 알고리즘을 사용하여 남북한 음향학 용어 통합안을 제시하였다. 용어가 완전히 같은 형태인 AA형은 139개(32.3 %), 어문규범의 차이로 인해 표기 형태가 다른 Aa형은 35개(8.1 %), 형태가 완전히 다른 AB유형은 257개(59.6 %)로 확인되었다. 형태적으로 같은 유형의 용어보다 다른 유형의 용어가 2배 이상 많았으나 내용 면에서 대부분 용어는 충분히 이해하고 유추할 수 있는 범위 안에 있었다. 형태가 다른 음향학 전문용어 통합에서는 북한 전문용어가 178개(61 %), 남한 전문용어가 76개(26 %)로 채택되었다. 이와 같은 결과는 북한 전문용어가 고유성이 압도적으로 높았고, 남한 전문용어는 경제성이 상대적으로 높았기 때문이다. 용어 순화를 통한 고유성과 최신 기술 용어의 대중 활용을 높일 수 있는 경제성 기준을 충족하는 음향학 전문용어 통합 체계 구축이 필요하다. 본 연구는 남북한 음향학 전문용어를 최초로 비교하고 통합안 제시에 의의가 있으며 다음과 같은 제언으로 연구 한계를 극복하고자 한다. 첫째, 정부는 남북한 학술 교류 및 표준화 공통 안을 마련할 수 있도록 지원 및 법적인 장치를 마련하고 북한 관련 연구 데이터에 쉽게 접근할 수 있는 연구 환경을 조성해야 한다. 둘째, 음향학 용어 데이터를 남북한이 공유하고 통합 음향학 용어사전을 발간하도록 노력해야 한다. 셋째, 추후 남북이 전문용어 위원회를 함께 발족하여 표준 개정이 동시에 이루어지도록 노력해야 한다.
지식의 확산과 대중화로 인하여 동일한 개념에 대한 검증되지 않은 용어들이 난립하고 있다. 종전에는 해당 학 회의용어심의위원회, 혹은 전문가 그룹의 합의를 통해서 출판된 전문용어집이 권위를 가지고 전문용어의 사용을 통제하였었다. 그러나 이제는 기존 전문용어집에 수록되지 않은 새로운 개념을 위한신조어의 생성에 있어서 사용자의 자의적인 해석이 빈번해져서 사회적 합의에 도달하지 못한 새로운 전문용어들이 경쟁적으로 사용되는 추세이다. 이러한 현실에 직면하여 국내외적으로 전문용어의 정비 및 표준화 사업은 언어 및 학문 분야의 경계를 넘어 총체적으로 전략적 접근을 시도하고 있다. 이에 본 연구에서는 7가지의 전문용어 표준화 지침을 수립하고, 그에 따라 ISO 2382의 4030개 정보기술용어를 표준화하고자 한다.
기술문서는 지식정보사회에서 생성되는 중요 연구 성과물로, 이를 제대로 활용하기 위해서는 정보 요약 및 정보추출과 같은 개선된 정보 처리 방법을 토대로 기술문서 활용의 편의성을 높여줄 필요가 있다. 이에 본 연구는 기술문서의 핵심 정보를 추출하기 위한 방안으로, 기술문서의 구조와 정의문 패턴을 기반으로 전문용어 및 정의문을 자동 추출하고, 이를 기반으로 전문용어사전을 구축할 수 있는 시스템을 제안하였다. 나아가 전문용어사전을 지식메모리로서 보다 다양하게 활용할 수 있도록 전문용어사전에 기반한 개인화서비스 제공방안을 제안하였다. 이처럼 전문용어 및 정의문 자동추출을 기반으로 전문용어사전을 구축하게 되면 새롭게 등장하는 전문용어를 빠르게 수용할 수 있어 이용자들이 최신정보를 보다 손쉽게 찾을 수 있다. 더불어 개인화된 전문용어사전을 이용자에게 제공한다면 전문용어사전의 가치와 활용성, 검색의 효율성을 극대화할 수 있다.
대용량 문서에서 정보를 추출하는 작업은 크게 개체명 인식, 전문용어 인식, 관계추출 작업으로 구성된다. 이들 각각의 기술들은 지금까지 독립적으로 연구되어 왔기 때문에, 이와 관련된 기계학습모델을 위한 테스트컬렉션 또한 독립적으로 구축되어 왔다. 과학기술문헌의 경우 개체명과 전문용어가 혼재되어 있는 형태로 구성된 문서가 많아, 기존의 연구결과를 이용하여 접근한다면 결과물 통합과정의 불편함과 처리속도에 많은 제약이 따르므로, 개체명과 전문용어를 동시에 추출 할 수 있는 기계학습 모델을 위한 테스트컬렉션이 필요하다. 본 연구에서는 생의학 분야 과학기술문헌에 대한 개체명, 전문용어를 통합한 PLOT(Person, Location, Organization, Terminology)과, PLOT 간의 관계추출을 위한 테스트컬렉션을 구축한다.
대용량 문서에서 정보를 추출하는 작업은 정보검색 분야뿐 아니라 질의응답과 요약 분야에서 매우 유용하다. 정보추출은 비정형 데이터로부터 정형화된 정보를 자동으로 추출하는 작업으로서 개체명 인식, 전문용어 인식, 대용어 참조해소, 관계 추출 작업 등으로 구성된다. 이들 각각의 기술들은 지금까지 독립적으로 연구되어왔기 때문에, 구조적으로 상이한 입출력 방식을 가지며, 하부모듈인 언어처리 엔진들은 특성에 따라 개발 환경이 매우 다양하여 통합 활용이 어렵다. 과학기술문헌의 경우 개체명과 전문용어가 혼재되어 있는 형태로 구성된 문서가 많으므로, 기존의 연구결과를 이용하여 접근한다면 결과물 통합과정의 불편함과 처리속도에 많은 제약이 따른다. 본 연구에서는 과학기술문헌을 분석하여 개체명과 전문용어를 통합 추출할 수 있는 기반 프레임워크를 개발한다. 이를 위하여, 문장자동분리, 품사태깅, 기저구인식 등과 같은 기반 언어 분석 모듈은 물론 이를 활용한 개체명 인식기, 전문용어 인식기를 개발하고 이들을 하나의 플랫폼으로 통합한 과학기술 핵심개체 인식 체계를 제안한다.
문헌에서의 전문용어 인식 연구는 정보검색, 정보추출, 시맨틱 웹, 질의응답 분야 등의 연구를 위한 선행 연구로서, 지금까지 대부분 특정 분야, 특히 생의학 분야에서 집중되어 연구되어 왔다. 그러나 기존 연구들이 특정 도메인 또는 문헌 내부 통계 정보를 활용함으로써 범용적인 전문용어 인식에 한계점을 보여 왔기 때문에, 본 연구에서는 웹 검색 결과와 사전, 후보용어의 문형 특징 등을 활용하는 기계 학습 기반 범용 전문용어 인식 방법을 제안하였다. 제안한 방법을 문헌의 지역 통계 정보를 사용하는 방법(C-value)과 비교 실험하여 80.8%의 F-값으로 6.5%의 성능향상을 보였다. 다양한 응집도 자질들을 접목한 두 번째 실험에서는 Normalized Google Distance 방법과 접목한 방식이 F-값 81.8%의 성능으로 최고의 성능을 나타냈다. 기계 학습 방법으로는 로지스틱 회귀분석, C4.5, SVMs 등을 적용하였는데, 일반적으로 이진 분류에 좋은 성능을 보이는 SVMs과 로지스틱 회귀분석 방법보다 결정 트리 방식의 C4.5가 전반적으로 좋은 성능을 보였다.
대용량 문서에서 정보를 추출하는 작업은 정보검색 분야 뿐 아니라 질의응답과 요약분야에서 매우 유용하다. 정보추출은 비정형 데이터로부터 정형화된 정보를 자동으로 추출하는 작업으로써, 개체명 인식, 전문용어 인식, 대용어 참조해소, 관계 추출 작업 등으로 구성된다. 이들 각각의 기술들은 지금까지 독립적으로 연구되어왔기 때문에, 구조적으로 상이한 입출력 방식을 가지며, 하부모듈인 언어처리 엔진들은 특성에 따라 개발 환경이 매우 다양하여 통합 활용이 어렵다. 과학기술문헌의 경우 개체명과 전문용어가 혼재되어 있는 형태로 구성된 문서가 많으므로, 기존의 연구결과를 이용하여 접근한다면 결과물 통합과정의 불편함과 처리속도에 많은 제약이 따른다. 본 연구에서는 생의학 분야 과학기술 문헌을 분석하여 전문용어 및 개체명 등을 통합 추출할 수 있는 기반 프레임워크를 개발한다. 이를 위하여, 문장자동분리, 품사태깅, 기저구인식 등과 같은 기반 언어 분석 모듈은 물론 이를 활용한 개체명 인식기, 전문용어 인식기를 개발하고 이들을 하나의 플랫폼으로 통합한 과학기술 핵심개체 인식 체계를 제안한다. 전체 플랫폼의 성능을 체계적으로 평가하기 위해서, KEEC 2009를 비롯한 다양한 말뭉치를 기반으로 세부 요수 모듈에 대한 성능 평가를 수행하였으며, 비교적 높은 수준의 성능을 확보하였다. 본 논문에서 개발된 핵심개체자동인식 플랫폼은 정보검색, 질의응답, 문서색인, 사전구축 등 다양한 정보서비스 분야에 활용될 수 있다.
본 연구의 목적은 임상병리사의 전공과 직업에 정체성을 부여할 수 있는 용어를 찾는 것이다. 임상병리학이라는 용어는 병리학의 모든 분야, 즉 해부병리학, 화학병리학, 혈액학, 미생물학 및 이들의 모든 하위 전문 분야를 포함하도록 의도되었다. 불행히도, 많은 나라에서 임상병리학이라는 용어는 해부병리학을 배제하는 것으로 생각되었는데, 이는 이름이 영어 이외의 언어로 번역되었을 때 문제가 복잡해졌다. 임상병리학(미국, 영국)은 의학의 한 전문 분야이다. 유사한 용어로는 검사의학(독일, 폴란드), 의료/임상생물학(프랑스, 네덜란드) 또는 임상분석학(스페인)이 있다. 의료기술은 개인, 회사 및 기관과 같이 질문하는 사람에 따라 약간 다르게 정의된다. 물론, 질문하는 언어에 따라 다르다. 의료기술은 임상검사기술학, 지원보건과학, 의료기기, 의생명공학, 보건기술로도 번역될 수 있다. 지원보건과학에서는 '임상병리기술학·병리기술학'이라는 용어를 사용하지 않는다. '보건계열 임상병리학 및 임상병리사'의 명칭은 '의생명검험과학·의생명검험사' 또는 '임상검사분석학·임상검사분석사'로 대체할 수 있다. 본 연구에서는 학문과 자격의 명칭을 '의생명'이 결합된 용어로 '의료생물학·의료생물사'로 변경할 것을 제안해 본다.
우리 학회에서는 최근에 폐탄광지 복구에 관한 관심이 고조되고 있으며, 특히 금년내 적당한 시기에, 되도록 빠른 시일 안에 폐탄광지 복구에 관한 국제 심포지엄을 개최할 계획을 가지고 있으나, 아직 학회 설립이후 이 분야에 관한 연구활동이 다소 일천하므로 기초자료준비가 미진한 상태에 있는 현실이다. 이러한 현실적인 상황하에서 필자는 학회의 회장으로서 학회와 회원들의 연구활동지원을 위한 기초적인 자료라도 수집 제공해야 되겠다는 취지를 가지고 이런 저런 일을 진행하고 있다. 이와 같은 학회활동의 하나로 우선 지난 5월 15일부터 20일까지 중국 북경시 신대도(新大都)호텔에서 중국토지학회(中國土地學會) 중국토지부간학회(中國土地復墾學會) 주최로 개최된 "북경 국제토지부간학술연토회(北京 國際土地復墾學術硏討會)" 심포지엄(Beijing International Symposium on Land Reclamation ISLR 2000 - Mine Land Reclamation and Ecological Restoration for 21st Century)에 참석하여 국제적인 상황을 파악할 수 있도록 한 바 있다. 또한 한국의 "폐탄광지역의 산림훼손지 복구 및 폐석유실 방지대책에 관한 고찰" 원고를 우리 학회지에 투고 게재하여 우리 나라의 폐탄광지 복구에 대한 현황을 개략적으로 이해할 수 있도록 하고저 한다. 이와 같은 일을 하다보니, 우리 학회에서도 석탄광산에 관한 전문용어를 파악해야 되겠다는 필요성에 따라서 우선 필자가 가지고 있는 제반 용어자료(참고문헌 제시)를 종합적으로 정리하여 이 용어집을 발표하고자 한다. 이 "소고(小考)" 용어집은 시기적으로 우리 학회 회원들의 필요성에 의해서 편집된 "초고(草稿)" 수준이며, 약 860 용어가 영문 국문(ABC순)/국문 영문(ㄱㄴㄷ순)으로 편집되었다. 이 용어집은 장차 우리 학회에서 용어제정의 기회가 있을 때에는 귀중한 표준 자료로 활용될 수 있을 것이다. 따라서 이 용어집은 우리 학회 제정 표준용어집이 아니라 단순히 필자의 연구자료(안)로 보아야 할 것이다.
본 웹사이트에 게시된 이메일 주소가 전자우편 수집 프로그램이나
그 밖의 기술적 장치를 이용하여 무단으로 수집되는 것을 거부하며,
이를 위반시 정보통신망법에 의해 형사 처벌됨을 유념하시기 바랍니다.
[게시일 2004년 10월 1일]
이용약관
제 1 장 총칙
제 1 조 (목적)
이 이용약관은 KoreaScience 홈페이지(이하 “당 사이트”)에서 제공하는 인터넷 서비스(이하 '서비스')의 가입조건 및 이용에 관한 제반 사항과 기타 필요한 사항을 구체적으로 규정함을 목적으로 합니다.
제 2 조 (용어의 정의)
① "이용자"라 함은 당 사이트에 접속하여 이 약관에 따라 당 사이트가 제공하는 서비스를 받는 회원 및 비회원을
말합니다.
② "회원"이라 함은 서비스를 이용하기 위하여 당 사이트에 개인정보를 제공하여 아이디(ID)와 비밀번호를 부여
받은 자를 말합니다.
③ "회원 아이디(ID)"라 함은 회원의 식별 및 서비스 이용을 위하여 자신이 선정한 문자 및 숫자의 조합을
말합니다.
④ "비밀번호(패스워드)"라 함은 회원이 자신의 비밀보호를 위하여 선정한 문자 및 숫자의 조합을 말합니다.
제 3 조 (이용약관의 효력 및 변경)
① 이 약관은 당 사이트에 게시하거나 기타의 방법으로 회원에게 공지함으로써 효력이 발생합니다.
② 당 사이트는 이 약관을 개정할 경우에 적용일자 및 개정사유를 명시하여 현행 약관과 함께 당 사이트의
초기화면에 그 적용일자 7일 이전부터 적용일자 전일까지 공지합니다. 다만, 회원에게 불리하게 약관내용을
변경하는 경우에는 최소한 30일 이상의 사전 유예기간을 두고 공지합니다. 이 경우 당 사이트는 개정 전
내용과 개정 후 내용을 명확하게 비교하여 이용자가 알기 쉽도록 표시합니다.
제 4 조(약관 외 준칙)
① 이 약관은 당 사이트가 제공하는 서비스에 관한 이용안내와 함께 적용됩니다.
② 이 약관에 명시되지 아니한 사항은 관계법령의 규정이 적용됩니다.
제 2 장 이용계약의 체결
제 5 조 (이용계약의 성립 등)
① 이용계약은 이용고객이 당 사이트가 정한 약관에 「동의합니다」를 선택하고, 당 사이트가 정한
온라인신청양식을 작성하여 서비스 이용을 신청한 후, 당 사이트가 이를 승낙함으로써 성립합니다.
② 제1항의 승낙은 당 사이트가 제공하는 과학기술정보검색, 맞춤정보, 서지정보 등 다른 서비스의 이용승낙을
포함합니다.
제 6 조 (회원가입)
서비스를 이용하고자 하는 고객은 당 사이트에서 정한 회원가입양식에 개인정보를 기재하여 가입을 하여야 합니다.
제 7 조 (개인정보의 보호 및 사용)
당 사이트는 관계법령이 정하는 바에 따라 회원 등록정보를 포함한 회원의 개인정보를 보호하기 위해 노력합니다. 회원 개인정보의 보호 및 사용에 대해서는 관련법령 및 당 사이트의 개인정보 보호정책이 적용됩니다.
제 8 조 (이용 신청의 승낙과 제한)
① 당 사이트는 제6조의 규정에 의한 이용신청고객에 대하여 서비스 이용을 승낙합니다.
② 당 사이트는 아래사항에 해당하는 경우에 대해서 승낙하지 아니 합니다.
- 이용계약 신청서의 내용을 허위로 기재한 경우
- 기타 규정한 제반사항을 위반하며 신청하는 경우
제 9 조 (회원 ID 부여 및 변경 등)
① 당 사이트는 이용고객에 대하여 약관에 정하는 바에 따라 자신이 선정한 회원 ID를 부여합니다.
② 회원 ID는 원칙적으로 변경이 불가하며 부득이한 사유로 인하여 변경 하고자 하는 경우에는 해당 ID를
해지하고 재가입해야 합니다.
③ 기타 회원 개인정보 관리 및 변경 등에 관한 사항은 서비스별 안내에 정하는 바에 의합니다.
제 3 장 계약 당사자의 의무
제 10 조 (KISTI의 의무)
① 당 사이트는 이용고객이 희망한 서비스 제공 개시일에 특별한 사정이 없는 한 서비스를 이용할 수 있도록
하여야 합니다.
② 당 사이트는 개인정보 보호를 위해 보안시스템을 구축하며 개인정보 보호정책을 공시하고 준수합니다.
③ 당 사이트는 회원으로부터 제기되는 의견이나 불만이 정당하다고 객관적으로 인정될 경우에는 적절한 절차를
거쳐 즉시 처리하여야 합니다. 다만, 즉시 처리가 곤란한 경우는 회원에게 그 사유와 처리일정을 통보하여야
합니다.
제 11 조 (회원의 의무)
① 이용자는 회원가입 신청 또는 회원정보 변경 시 실명으로 모든 사항을 사실에 근거하여 작성하여야 하며,
허위 또는 타인의 정보를 등록할 경우 일체의 권리를 주장할 수 없습니다.
② 당 사이트가 관계법령 및 개인정보 보호정책에 의거하여 그 책임을 지는 경우를 제외하고 회원에게 부여된
ID의 비밀번호 관리소홀, 부정사용에 의하여 발생하는 모든 결과에 대한 책임은 회원에게 있습니다.
③ 회원은 당 사이트 및 제 3자의 지적 재산권을 침해해서는 안 됩니다.
제 4 장 서비스의 이용
제 12 조 (서비스 이용 시간)
① 서비스 이용은 당 사이트의 업무상 또는 기술상 특별한 지장이 없는 한 연중무휴, 1일 24시간 운영을
원칙으로 합니다. 단, 당 사이트는 시스템 정기점검, 증설 및 교체를 위해 당 사이트가 정한 날이나 시간에
서비스를 일시 중단할 수 있으며, 예정되어 있는 작업으로 인한 서비스 일시중단은 당 사이트 홈페이지를
통해 사전에 공지합니다.
② 당 사이트는 서비스를 특정범위로 분할하여 각 범위별로 이용가능시간을 별도로 지정할 수 있습니다. 다만
이 경우 그 내용을 공지합니다.
제 13 조 (홈페이지 저작권)
① NDSL에서 제공하는 모든 저작물의 저작권은 원저작자에게 있으며, KISTI는 복제/배포/전송권을 확보하고
있습니다.
② NDSL에서 제공하는 콘텐츠를 상업적 및 기타 영리목적으로 복제/배포/전송할 경우 사전에 KISTI의 허락을
받아야 합니다.
③ NDSL에서 제공하는 콘텐츠를 보도, 비평, 교육, 연구 등을 위하여 정당한 범위 안에서 공정한 관행에
합치되게 인용할 수 있습니다.
④ NDSL에서 제공하는 콘텐츠를 무단 복제, 전송, 배포 기타 저작권법에 위반되는 방법으로 이용할 경우
저작권법 제136조에 따라 5년 이하의 징역 또는 5천만 원 이하의 벌금에 처해질 수 있습니다.
제 14 조 (유료서비스)
① 당 사이트 및 협력기관이 정한 유료서비스(원문복사 등)는 별도로 정해진 바에 따르며, 변경사항은 시행 전에
당 사이트 홈페이지를 통하여 회원에게 공지합니다.
② 유료서비스를 이용하려는 회원은 정해진 요금체계에 따라 요금을 납부해야 합니다.
제 5 장 계약 해지 및 이용 제한
제 15 조 (계약 해지)
회원이 이용계약을 해지하고자 하는 때에는 [가입해지] 메뉴를 이용해 직접 해지해야 합니다.
제 16 조 (서비스 이용제한)
① 당 사이트는 회원이 서비스 이용내용에 있어서 본 약관 제 11조 내용을 위반하거나, 다음 각 호에 해당하는
경우 서비스 이용을 제한할 수 있습니다.
- 2년 이상 서비스를 이용한 적이 없는 경우
- 기타 정상적인 서비스 운영에 방해가 될 경우
② 상기 이용제한 규정에 따라 서비스를 이용하는 회원에게 서비스 이용에 대하여 별도 공지 없이 서비스 이용의
일시정지, 이용계약 해지 할 수 있습니다.
제 17 조 (전자우편주소 수집 금지)
회원은 전자우편주소 추출기 등을 이용하여 전자우편주소를 수집 또는 제3자에게 제공할 수 없습니다.
제 6 장 손해배상 및 기타사항
제 18 조 (손해배상)
당 사이트는 무료로 제공되는 서비스와 관련하여 회원에게 어떠한 손해가 발생하더라도 당 사이트가 고의 또는 과실로 인한 손해발생을 제외하고는 이에 대하여 책임을 부담하지 아니합니다.
제 19 조 (관할 법원)
서비스 이용으로 발생한 분쟁에 대해 소송이 제기되는 경우 민사 소송법상의 관할 법원에 제기합니다.
[부 칙]
1. (시행일) 이 약관은 2016년 9월 5일부터 적용되며, 종전 약관은 본 약관으로 대체되며, 개정된 약관의 적용일 이전 가입자도 개정된 약관의 적용을 받습니다.