• 제목/요약/키워드: Semantic Computing

검색결과 252건 처리시간 0.023초

Grammatical Structure Oriented Automated Approach for Surface Knowledge Extraction from Open Domain Unstructured Text

  • Tissera, Muditha;Weerasinghe, Ruvan
    • Journal of information and communication convergence engineering
    • /
    • 제20권2호
    • /
    • pp.113-124
    • /
    • 2022
  • News in the form of web data generates increasingly large amounts of information as unstructured text. The capability of understanding the meaning of news is limited to humans; thus, it causes information overload. This hinders the effective use of embedded knowledge in such texts. Therefore, Automatic Knowledge Extraction (AKE) has now become an integral part of Semantic web and Natural Language Processing (NLP). Although recent literature shows that AKE has progressed, the results are still behind the expectations. This study proposes a method to auto-extract surface knowledge from English news into a machine-interpretable semantic format (triple). The proposed technique was designed using the grammatical structure of the sentence, and 11 original rules were discovered. The initial experiment extracted triples from the Sri Lankan news corpus, of which 83.5% were meaningful. The experiment was extended to the British Broadcasting Corporation (BBC) news dataset to prove its generic nature. This demonstrated a higher meaningful triple extraction rate of 92.6%. These results were validated using the inter-rater agreement method, which guaranteed the high reliability.

유비쿼터스 환경에서 어플리케이션의 의미 상호운용성을 위한 메타데이터 레지스트리 기반의 프레임워크 구현 (Implementation of the Metadata Registry-based Framework for Semantic Interoperability of Application in Ubiquitous Environment)

  • 김정동;정동원;김진형;백두권
    • 한국시뮬레이션학회논문지
    • /
    • 제16권1호
    • /
    • pp.11-19
    • /
    • 2007
  • 유비쿼터스 환경에서의 어플리케이션은 다양한 센서 정보를 수집하고 센서로부터 받은 정보를 활용한다. 최근 유비쿼터스환경을 위한 에너지 관리, 프로토콜 표준화, 센서필드의 독립성, 그리고 보안과 관련한 많은 연구들이 이슈화 되었다. 특히, 센서필드에 독립적인 정보의 활용은 다양한 센서필드에서 센서의 유용성을 극대화 하는 중요한 문제 중 하나이다. 그러나 기존의 프레임워크에서는 센서필드의 데이터 요소들 간에 이질성이 발생하기 때문에 이상적인 유비쿼터스 환경을 위해서는 적당하지 못하다. 기존의 어플리케이션은 센서필드에 의존적이며, 기존 유비쿼터스 컴퓨팅 환경에서의 센서들은 센서필드 내의 어플리케이션에 의존적이다. 다시 말해, 기존의 어플리케이션은 특정 센서필드의 정보만을 이용한다. 이러한 제약성을 극복하기 위해 하드웨어 또는 소프트웨어적인 많은 문제들은 반드시 해결 되어야 한다. 이 논문에서는 유비쿼터스 환경에서 메타데이터 레지스트리 기반의 프레임워크 (UbiMDR)의 설계와 구현을 제안한다. 이 프레임워크는 유비쿼터스 환경에서 어플리케이션 또는 다양한 센서필드 사이의 데이터 의미상호운용성을 제공한다. 또한 데이터 상호운용성의 정확성을 검증하기 위해 기존의 유비쿼터스 프레임워크와 제안하는 프레임워크인 UbiMDR을 비교평가 한다.

  • PDF

시멘틱 컴퓨팅 기반의 동적 작업 스케줄링 모델 및 시뮬레이션 (Semantic Computing-based Dynamic Job Scheduling Model and Simulation)

  • 노창현;장성호;김태영;이종식
    • 한국시뮬레이션학회논문지
    • /
    • 제18권2호
    • /
    • pp.29-38
    • /
    • 2009
  • 이기종의 자원들로 이루어진 컴퓨팅 환경에서 효율적인 자원 활용과 대용량의 데이터를 고속으로 처리하기 위해서는 실시간으로 변화하는 자원의 상태에 따라 대처 할 수 있는 동적인 작업 스케줄링 모델이 필요하다. 현재 이기종의 자원들에게 작업을 어떻게 분배 및 할당 할 것인지에 대하여 많은 자원 평가 방법 및 휴리스틱 기법들이 연구되었으나 이러한 방법들은 표준언어를 사용하지 않기 때문에 시스템 호환 및 확장에 어려움이 많다. 또한 다양한 자원들의 상태가 실시간으로 동적으로 변화하기 때문에 기존 연구에서 제안한 방법으로는 효율적인 처리가 불가능하거나 자원의 상태 변화에 동적으로 대처할 수 없다. 본 논문은 이러한 기존 연구들의 문제에 대한 해결책으로 W3C에서 제정한 온톨로지 표준 언어인 OWL을 이용하여 자원 온톨로지를 구축함으로써 이기종의 자원 관리를 손쉽게 할 수 있으며, 자원의 동적인 변화에 따라 작업 스케줄링하는 방법을 지식기반의 다양한 규칙들로 정의하여 추론을 통해서 최적의 자원에게 작업을 할당하는 시멘틱 컴퓨팅 기반의 동적 작업 스케줄링 모델을 제안한다. 시뮬레이션 실험 결과는 본 논문에서 제안한 작업 스케줄링 모델이 기존 모델에 비하여 낮은 작업 손실과 높은 작업 처리율 및 짧은 응답시간을 제공함으로써 이기종의 자원들로 구성된 시스템 전반에 걸쳐 안정적이고 고속의 데이터 처리를 제공할 수 있다는 사실을 증명한다.

의미 분석과 부호화된 구조 분석을 이용한 XML 자동 변환 (Automating XML documents Transformations based on Semantic and Encoded Structure Analysis)

  • 양홍준;곽동규;문현주;유재우
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2008년도 한국컴퓨터종합학술대회논문집 Vol.35 No.1 (B)
    • /
    • pp.562-567
    • /
    • 2008
  • XML은 W3C 표준으로 채택된 이후로 많은 어플리케이션에서 데이터를 표현하는 방법으로 사용되고 있다. XML문서는 특정 어플리케이션에 종속적이기 때문에 XSLT를 이용하여 변환한 뒤 사용하게 된다. 그러나 변환에는 많은 노력, 시간과 비용이 소요되기 때문에 이를 자동으로 변환하는 시스템을 구축하는 것이 최선의 방법이다. 이를 위해서 XTGen이나 XSLT 스크립트 시스템이 기존에 제안되었지만 사용자가 엘리먼트간의 관계를 수동으로 처리하는 방식이거나 변환 문서간 단말 노드의 1:1 매칭이라는 제약과 대규모 변환에 어려움이 있다. 본 논문은 JAWS를 이용한 엘리먼트간의 의미 관계 분석과 DTD의 구조를 분석하여 XSLT를 생성함으로써 기존 시스템들의 단점을 보완하고 더 높은 정확성을 보장한다는 장점을 가지고 있다. 본 논문에서 제안하는 시스템은 XML 문서를 변환하기 위한 XSLT를 자동으로 생성하여 XML 문서를 변환하는 모든 과정을 자동화 함으로써 문서 변환에 따르는 비용의 절감할 수 있을 것으로 기대된다.

  • PDF

의미적 연관성을 이용한 멀티미디어 정보 검색 (Multimedia Information Retrieval Using Semantic Relevancy)

  • 박창섭
    • 인터넷정보학회논문지
    • /
    • 제8권5호
    • /
    • pp.67-79
    • /
    • 2007
  • 최근 웹 기술의 발달과 유무선 네트워크 성능의 향상, 그리고 다양한 멀티미디어 서비스가 등장함에 따라 텍스트 문서나 이미지에 대한 검색뿐만 아니라 동영상을 포함한 멀티미디어 검색에 대한 요구가 크게 증가하고 있다. 그러나 기존의 멀티미디어 검색 방법은 멀티미디어 콘텐츠에 포함된 의미 개념들의 연관성을 효과적으로 이용하지 못하고 콘텐츠에 대한 메타데이터의 검색에 의존함에 따라 제한적인 검색 결과만을 제공한다. 본 논문에서는 도메인 온톨로지를 활용하여 멀티미디어 콘텐츠의 의미적 연관성에 기반을 둔 멀티미디어 검색 방법 및 시스템 구조를 제안한다. 사용자 검색어를 직접적으로 포함하지 않지만 의미적으로 연관성이 있는 개념들을 온톨로지에서 검색하고 이들에 대한 랭킹을 결정하기 위한 클래스 연관도 척도를 정의하고, 이를 효율적으로 계산하기 위한 알고리즘을 제시한다. 또 프로토타입 시스템 구현 및 실험을 통해 제안한 검색 방법 및 시스템의 효과를 보인다.

  • PDF

시각화 기반 모바일 라이프 로그 시맨틱 네트워크 연관 검색 시스템 (An Associative Search System for Mobile Life-log Semantic Networks based on Visualization)

  • 오근현;김용준;조성배
    • 한국정보과학회논문지:컴퓨팅의 실제 및 레터
    • /
    • 제16권6호
    • /
    • pp.727-731
    • /
    • 2010
  • 최근 모바일 기기의 다양한 센서들을 통하여 데이타를 수집하여 개인의 삶을 기록하는 연구들이 진행 중이다. 효율적인 모바일 라이프로그의 저장과 탐색을 위해 연관 검색이 가능한 모바일 라이프로그 시맨틱 네트워크가 제안되었다. 기존의 시맨틱 네트워크 상의 검색은 텍스트 기반으로 관계를 바탕으로 하는 사용자의 능동적인 연관 검색에 한계가 있었다. 본 논문에서는 모바일 라이프로그의 연관 검색을 위해 검색 과정과 결과를 시각화된 네트워크로 데이타간의 관계를 보여주는 선택 연관 검색과 키워드 연관 검색을 제안한다. 복잡한 시맨틱 네트워크에 대해서 사용자의 이해도를 높이기 위해 의미 추상화를 적용하였다. 실제 모바일 라이프로그 시맨틱 네트워크 데이타를 바탕으로 질의를 해결하는 과정을 기존 연구에서 보였던 텍스트 기반 연관 검색 방법과 비교하고 사용성 평가를 시행함으로 유용성을 입증하였다.

A Mobile P2P Semantic Information Retrieval System with Effective Updates

  • Liu, Chuan-Ming;Chen, Cheng-Hsien;Chen, Yen-Lin;Wang, Jeng-Haur
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제9권5호
    • /
    • pp.1807-1824
    • /
    • 2015
  • As the technologies advance, mobile peer-to-peer (MP2P) networks or systems become one of the major ways to share resources and information. On such a system, the information retrieval (IR), including the development of scalable infrastructures for indexing, becomes more complicated due to a huge increase on the amount of information and rapid information change. To keep the systems on MP2P networks more reliable and consistent, the index structures need to be updated frequently. For a semantic IR system, the index structure is even more complicated than a classic IR system and generally has higher update cost. The most well-known indexing technique used in semantic IR systems is Latent Semantic Indexing (LSI), of which the index structure is generated by singular value decomposition (SVD). Although LSI performs well, updating the index structure is not easy and time consuming. In an MP2P environment, which is fully distributed and dynamic, the update becomes more challenging. In this work, we consider how to update the sematic index generated by LSI and keep the index consistent in the whole MP2P network. The proposed Concept Space Update (CSU) protocol, based on distributed 2-Phase locking strategy, can effectively achieve the objectives in terms of two measurements: coverage speed and update cost. Using the proposed effective synchronization mechanism with the efficient updates on the SVD, re-computing the whole index on the P2P overlay can be avoided and the consistency can be achieved. Simulated experiments are also performed to validate our analysis on the proposed CSU protocol. The experimental results indicate that CSU is effective on updating the concept space with LSI/SVD index structure in MP2P semantic IR systems.

Arabic Stock News Sentiments Using the Bidirectional Encoder Representations from Transformers Model

  • Eman Alasmari;Mohamed Hamdy;Khaled H. Alyoubi;Fahd Saleh Alotaibi
    • International Journal of Computer Science & Network Security
    • /
    • 제24권2호
    • /
    • pp.113-123
    • /
    • 2024
  • Stock market news sentiment analysis (SA) aims to identify the attitudes of the news of the stock on the official platforms toward companies' stocks. It supports making the right decision in investing or analysts' evaluation. However, the research on Arabic SA is limited compared to that on English SA due to the complexity and limited corpora of the Arabic language. This paper develops a model of sentiment classification to predict the polarity of Arabic stock news in microblogs. Also, it aims to extract the reasons which lead to polarity categorization as the main economic causes or aspects based on semantic unity. Therefore, this paper presents an Arabic SA approach based on the logistic regression model and the Bidirectional Encoder Representations from Transformers (BERT) model. The proposed model is used to classify articles as positive, negative, or neutral. It was trained on the basis of data collected from an official Saudi stock market article platform that was later preprocessed and labeled. Moreover, the economic reasons for the articles based on semantic unit, divided into seven economic aspects to highlight the polarity of the articles, were investigated. The supervised BERT model obtained 88% article classification accuracy based on SA, and the unsupervised mean Word2Vec encoder obtained 80% economic-aspect clustering accuracy. Predicting polarity classification on the Arabic stock market news and their economic reasons would provide valuable benefits to the stock SA field.

Spatio-temporal Semantic Features for Human Action Recognition

  • Liu, Jia;Wang, Xiaonian;Li, Tianyu;Yang, Jie
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제6권10호
    • /
    • pp.2632-2649
    • /
    • 2012
  • Most approaches to human action recognition is limited due to the use of simple action datasets under controlled environments or focus on excessively localized features without sufficiently exploring the spatio-temporal information. This paper proposed a framework for recognizing realistic human actions. Specifically, a new action representation is proposed based on computing a rich set of descriptors from keypoint trajectories. To obtain efficient and compact representations for actions, we develop a feature fusion method to combine spatial-temporal local motion descriptors by the movement of the camera which is detected by the distribution of spatio-temporal interest points in the clips. A new topic model called Markov Semantic Model is proposed for semantic feature selection which relies on the different kinds of dependencies between words produced by "syntactic " and "semantic" constraints. The informative features are selected collaboratively based on the different types of dependencies between words produced by short range and long range constraints. Building on the nonlinear SVMs, we validate this proposed hierarchical framework on several realistic action datasets.

Research on Ontology Constructing by Delphi Technique (with Modeling Micheogul Tourist Resort)

  • Kim, Young-Ick;Kim, Min-Cheol;Kang, Han-Seop
    • 한국전자거래학회:학술대회논문집
    • /
    • 한국전자거래학회 2005년도 e-Biz World Conference 2005
    • /
    • pp.286-292
    • /
    • 2005
  • Continual attempt to accumulate and apply information eventually gives birth to the concept of the 'Semantic Web'. Thus, the 'Semantic Web' can be defined as a product of mankind's desire to standardize information. A term of knowledge is used as information or data in computer science. These are regarded and are divided sometimes each other in terminologies that have similar meaning. If it is divided, knowledge is different from information. However, some kind of information in Knowledge Representation is called knowledge often if it can be expressed in computing system. Therefore, knowledge representation can talk as information representation. The purpose of the study is systematizing knowledge through knowledge representation that uses Delphi technique and ontology is designed by utilizing assistance editor called protege-2000 to construct semantic web environment's ontology. Level of interest regarding the construction and evaluation of search systems based on ontology is set to increase. If defined well, semantic can reflect human's thinking to knowledge information on web. Furthermore systematizes knowledge, search of information and comprehension about Jeju tour using present computer may be done intelligence.

  • PDF