• Title/Summary/Keyword: web pages

검색결과 554건 처리시간 0.045초

Customer Personalized System of eCRM Using Web Log Mining and Rough Set

  • Lee, Jae-Hoon;Chung, Il-Yong;Lee, Sung-Joo
    • 한국지능시스템학회:학술대회논문집
    • /
    • 한국퍼지및지능시스템학회 2006년도 추계학술대회 학술발표 논문집 제16권 제2호
    • /
    • pp.29-32
    • /
    • 2006
  • In this paper, we propose a customer personalized system that presents the web pages to users which are customized to their individuality. It analyzes the action of users who visit the shopping mall, and preferentially supplies the necessary information to them. When they actually buy some items, it forecasts the users' access pattern to web site and their following purchasable items and improves their web pare on the bases of their individuality. It reasons the relation among the web documents and among the items by using the log data of web server and the purchase information of DB. For reasoning it employs Rough Set, which is a method that searches the association rule and offers most suitable cases by reduces cases. It reasons the web pages by considering the users' access pattern and time by using the web log and reasons the users' purchase pattern by using the purchase information of DB. On the basis of the relation among them, it appends the related web pages to link of users' web pages and displays the inferred goods on users' web pages.

  • PDF

SVM을 활용한 악성 웹 페이지 분류 (Classification of Malicious Web Pages by Using SVM)

  • 황영섭;문재찬;조성제
    • 한국컴퓨터정보학회논문지
    • /
    • 제17권3호
    • /
    • pp.77-83
    • /
    • 2012
  • 웹 페이지에서 다양한 서비스를 제공하면서 악성코드가 웹 페이지를 통해 배포되는 것도 늘어났다. 악성코드는 개인정보 유출, 시스템의 성능저하, 시스템의 좀비 피씨화 등의 피해를 입힌다. 이런 피해를 막으려면 악성코드가 있는 웹 페이지의 접근을 막아야 한다. 그런데 웹 페이지에 있는 악성코드는 난독화나 변형기법으로 위장하고 있어 기존 안티바이러스 소프트웨어가 사용하는 시그니처 방식의 접근법으로 찾아내기 어렵다. 이를 해결하기 위하여, 웹 페이지를 분석하여 악성 웹 페이지와 양성 웹 페이지를 구별하기 위한 특징을 추출하고, 기계 학습법으로 널리 사용되는 SVM을 통하여 악성 웹 페이지를 분류하는 방법을 제안한다. 제안하는 방법이 우수함을 실험을 통하여 보인다. 제안한 방법으로 악성 웹 페이지를 정확히 분류하면 웹 페이지를 통한악성코드의 배포를 막는데 이바지할 것이다.

웹삐에로 : 웹 데이터베이스를 포함하는 멀티미디어 홈페이지 저작 시스템 (WebPierrot : Multimedia Homepage Authoring System Including Web Database)

  • 성승규;이명원
    • 인터넷정보학회논문지
    • /
    • 제2권5호
    • /
    • pp.21-29
    • /
    • 2001
  • 본 논문에서는 웹 프로그래밍 기술이 없이도 일반 사용자가 웹 데이터베이스 구축과 함께 멀티미디어 홈페이지를 작성하도록 해주는 시스템(웹삐에로) 개발을 기술한다. 본 시스템은 페이지 에디터, 웹 데이터베이스를 자동 구축해주는 데이터베이스 마법사와, 웹 데이터베이스의 생성 및 수정을 지원하는 데이터베이스 관리자로 구성되어 있다. 데이터베이스 마법사는 홈페이지 템플릿과 연동되는 데이터베이스를 자동으로 생성하고 로컬 사용자 영역에 서버를 자동적으로 구축하는 기능을 갖는다. 페이지 에디터는 DHTML(Dynamic Hypertext Markup Language) 컴포넌트를 기반으로 구현되었으며 멀티미디어 홈페이지를 대화형으로 쉽게 제작할 수 있게 한다. 데이터베이스 관리자는 웹 데이터베이스를 생성, 수정 및 유지 보수하는 기능을 제공한다. 본 시스템은 웹 데이터베이스 프로그래밍 기술이 없이도 웹 데이터베이스와 연동되는 홈페이지 작성을 쉽게 구축하도록 하는 특징을 갖는다.

  • PDF

XML을 이용한 웹 정보 추출 및 다차원 분석 (Web Information Extraction and Multidimensional Analysis Using XML)

  • 박병권
    • 한국멀티미디어학회논문지
    • /
    • 제11권5호
    • /
    • pp.567-578
    • /
    • 2008
  • 인터넷에 있는 방대한 양의 웹 페이지들을 분석하기 위해서는 웹 페이지에 내재된 정보를 추출하는 것이 필요하다. 본 논문에서는 웹 페이지로부터 정보를 추출하고 이를 XML 문서로 변환하여 다차원적으로 분석하는 방법을 제안한다. 웹 페이지로부터 정보를 추출하기 위하여 두 종류의 언어를 제안한다. 하나는 객체지향 모델에 의거하여 웹 정보 추출 규칙을 기술하기 위한 것이고, 다른 하나는 추출하고자 하는 정보를 찾기 위한 HTML 태그 패턴을 정규식으로 기술하기 위한 것이다. XML 문서에 대한 다차원 분석을 위하여 관계형 데이터에 대해 하는 것처럼 웨어하우스를 구축하고 이로부터 다양한 큐브를 생성하는 방법을 제안한다. 마지막으로 본 논문에서 제안한 방법을 미국특허 웹 페이지에 적용한 예를 통해 그 타당성을 보인다.

  • PDF

무선 단말기를 위한 웹 페이지의 자동 재구성 (Automatic Reconstruction of Web Pages for Mobile Devices)

  • 송동리;황인준
    • 정보처리학회논문지B
    • /
    • 제9B권5호
    • /
    • pp.523-532
    • /
    • 2002
  • 최근 들어 인터넷이 광범위하게 보급되고 무선 이동통신 기술이 눈부시게 발전하면서 무선 단말기를 통한 인터넷 상에서의 정보 검색이 시간과 장소에 구애받지 않고 가능하게 되었다. 하지만 무선 단말기를 통한 인터넷의 접근은 단말기 자체의 제한과 무선망의 제한으로 인해 기존 데스크 탑 컴퓨터의 유선 상에서 보다 웹 페이지 탐색에 많은 어려움을 가진다. 본 논문은 이러한 제약을 완화시키기 위해서 웹 페이지로부터 페이지 정보를 축소한 페이지 맵을 생성하여 웹 정보를 쉽게 검색할 수 있게 하는 페이지 재구성 시스템을 제안한다. 그리고 대표적인 웹 사이트에 대한 실험을 통해 제안한 시스템이 무선 단말기 상에서 빠른 웹 페이지 로딩 속도를 보장하며, 작은 스크린을 통해서도 효율적인 웹 탐색이 가능함을 보인다.

Main Content Extraction from Web Pages Based on Node Characteristics

  • Liu, Qingtang;Shao, Mingbo;Wu, Linjing;Zhao, Gang;Fan, Guilin;Li, Jun
    • Journal of Computing Science and Engineering
    • /
    • 제11권2호
    • /
    • pp.39-48
    • /
    • 2017
  • Main content extraction of web pages is widely used in search engines, web content aggregation and mobile Internet browsing. However, a mass of irrelevant information such as advertisement, irrelevant navigation and trash information is included in web pages. Such irrelevant information reduces the efficiency of web content processing in content-based applications. The purpose of this paper is to propose an automatic main content extraction method of web pages. In this method, we use two indicators to describe characteristics of web pages: text density and hyperlink density. According to continuous distribution of similar content on a page, we use an estimation algorithm to judge if a node is a content node or a noisy node based on characteristics of the node and neighboring nodes. This algorithm enables us to filter advertisement nodes and irrelevant navigation. Experimental results on 10 news websites revealed that our algorithm could achieve a 96.34% average acceptable rate.

병원의 인터넷 마케팅을 위한 간호부서의 웹사이트 분석 (An analysis of Web Sites on the Nursing Departments for Hospital Internet Marketing)

  • 정면숙
    • 간호행정학회지
    • /
    • 제7권3호
    • /
    • pp.531-543
    • /
    • 2001
  • Purpose : The purpose of this study was exploring current status of having home page on the hospitals which have more than 500 beds and analyzing web site on the Nursing Department among them. Method : Cases under analyzing were 92 hospitals which have their own home pages. And then, content analysis with 33 cases was used to evaluate web site of Nursing Department. Results : 1. There are 85(92.4%) home pages in the hospitals among 92 hospitals. 2. There are 33(35.9%) web pages on the Nursing Home page in the 85 hospitals which has hospital home pages. 3. The contents of web pages were 'Introduction of Nursing Department' (78.8% of Nursing Department), 'Home health care'(39.4%), 'Areas of Nursing department'(36.4%), 'Educational Opportunities'(36.4%), 'Research activities'(30.3%), 'Interaction'(27.3%), 'E-mail'(18.2%), 'Information providing to consumer'(15.2%), 'Hospice'(15.2%), 'Hot line, consultation'(12.1%) respectively. Conclusion : The results showed that most web sites of Nursing Department were consist of simple contents with simple purpose. Therefore, in this informational world, Nursing Departments have to try using internet marketing with well developed client centered web site.

  • PDF

그래프 탐색 기법을 이용한 효율적인 웹 크롤링 방법들 (Effective Web Crawling Orderings from Graph Search Techniques)

  • 김진일;권유진;김진욱;김성렬;박근수
    • 한국정보과학회논문지:시스템및이론
    • /
    • 제37권1호
    • /
    • pp.27-34
    • /
    • 2010
  • 웹 크롤러는 웹에서 링크를 따라다니며 웹 페이지들을 자동으로 다운로드하는 프로그램으로 주로 웹 환경을 연구하거나 검색 엔진을 만들기 위해 사용된다. 기존의 연구들에서는 웹 크롤러가 인기 있는 웹 페이지들을 먼저 크롤링 할 수 있도록 몇 가지 방법들이 제안되었으나 그래프 이론 분야에서 연구되어 온 몇몇 그래프 탐색 기법들은 아직 웹 크롤링 방법으로 고려되지 않았다. 이 논문에서는 잘 알려진 너비 우선 탐색, 깊이 우선 탐색 뿐 아니라 사전식 너비 우선 탐색, 사전식 깊이 우선 탐색 및 최대 크기 탐색을 웹 크롤링 방법으로 고려하여 이 중에서 선형적인 시간복잡도를 가지면서도 인기 있는 웹 페이지를 효율적으로 수집할 수 있는 웹 크롤링 방법을 찾는다. 특히 선형 구현이 단순하지 않은 최대 크기 탐색과 사전식 너비 우선 탐색에 대해서는 분할 정제 방법을 이용한 선형 시간 웹 크롤링 방법을 제시한다. 실험 결과는 최대 크기 탐색이 다른 그래프 탐색 방법에 비해 시간 복잡도 및 크롤링 된 페이지들의 질에 있어서 바람직한 성질을 가짐을 보여준다.

Online resources for information on shoulder arthroplasty: an assessment of quality and readability

  • Mohamad Y. Fares;Jaspal Singh;Amar S. Vadhera;Jonathan Koa;Peter Boufadel;Joseph A. Abboud
    • Clinics in Shoulder and Elbow
    • /
    • 제26권3호
    • /
    • pp.238-244
    • /
    • 2023
  • Background: Many patients use online resources to educate themselves on surgical procedures and make well-informed healthcare decisions. The aim of our study was to evaluate the quality and readability of online resources exploring shoulder arthroplasty. Methods: An internet search pertaining to shoulder arthroplasty (partial, anatomic, and reverse) was conducted using the three most popular online search engines. The top 25 results generated from each term in each search engine were included. Webpages were excluded if they were duplicates, advertised by search engines, subpages of other pages, required payments or subscription, or were irrelevant to our scope. Webpages were classified into different source categories. Quality of information was assessed by HONcode certification, Journal of the American Medical Association (JAMA) criteria, and DISCERN benchmark criteria. Webpage readability was assessed using the Flesch reading ease score (FRES). Results: Our final dataset included 125 web pages. Academic sources were the most common with 45 web pages (36.0%) followed by physician/private practice with 39 web pages (31.2%). The mean JAMA and DISCERN scores for all web pages were 1.96±1.31 and 51.4±10.7, respectively. The total mean FRES score was 44.0±11.0. Only nine web pages (7.2%) were HONcode certified. Websites specified for healthcare professionals had the highest JAMA and DISCERN scores with means of 2.92±0.90 and 57.96±8.91, respectively (P<0.001). HONcode-certified webpages had higher quality and readability scores than other web pages. Conclusions: Web-based patient resources for shoulder arthroplasty information did not show high-quality scores and easy readability. When presenting medical information, sources should maintain a balance between readability and quality and should seek HONcode certification as it helps establish the reliability and accessibility of the presented information. Level of evidence: IV.

Ajax 를 이용한 사용자의 웹 페이지 이용 행태 분석 (Analysis User Action in Web Pages using Ajax technique)

  • 이동훈;윤태복;김건수;이지형
    • 한국HCI학회:학술대회논문집
    • /
    • 한국HCI학회 2008년도 학술대회 1부
    • /
    • pp.528-533
    • /
    • 2008
  • 웹 페이지의 증가에 따라 문서의 질을 파악하는 것은 매우 중요한 문제가 되었다. 방문횟수와 같은 빈도 측정에 기반한 평가는 문서에 대한 사용자의 반응을 반영하기에 부족하다. 사용자는 문서가 사용자의 의도와 관련이 부족하거나 필요가 없는 경우 이용 시간이 매우 짧아진다는 특성을 보인다. 또한 사용자는 웹 페이지 이용 시 다양한 행위를 통해 페이지를 이용하게 된다. 마우스 포인터의 이동이나 클릭, 페이지 스크롤 등 웹 브라우저에서만 이루어지는 다양한 행위가 존재한다. JavaScript 는 브라우저에서 발생하는 이벤트 정보를 축적할 수 있고, 이렇게 수집된 정보를 사용자가 이용하는 도중에 서버로 전송이 가능하다. 본 논문에서는 사용자의 이용 정보를 수집하여 웹 페이지 이용을 분석하여 페이지 평가에 대한 기준을 제시한다.

  • PDF