• 제목/요약/키워드: effective extraction

검색결과 1,655건 처리시간 0.024초

울산지역 유통 발효주의 잔류농약 및 중금속 실태조사 (Monitoring of Pesticide Residues and Heavy Metals in Fermented Liquor in Ulsan)

  • 김희정;김경진;김민경;김금비;김수희;조영경;박주은;정소연;서원덕;최영선
    • 한국식품위생안전성학회지
    • /
    • 제39권3호
    • /
    • pp.250-259
    • /
    • 2024
  • 발효주의 잔류물질 실태조사를 위해 울산지역에서 유통되는 발효주 150건을 수거하여 잔류농약 400종과 중금속 납, 카드뮴, 수은을 분석하였다. 잔류농약 분석 결과, 102건(68%)의 검출을 나타냈으며 검출된 농약 종류는 35종으로 그 중 원료 농산물의 기준이 없는 농약은 4종이 검출되었다. 발효주 종류별로 비교하면 와인이 60건의 검사 중 54건(90%)으로 가장 많은 잔류농약이 검출되었고 맥주는 60건 중 37건(61.7%), 막걸리는 30건 중 11건(36.7%)이 검출되었다. 발효주에 대한 중금속 분석 결과는 납 73건(48.7%), 카드뮴은 9건(6.0%), 수은은 36건(24.0%)을 나타내었다. 납은 73건의 검출 중 와인이 57건(78.1%)을 차지해 가장 높은 검출을 나타내었고 카드뮴과 수은은 검출된 9건, 36건 중 막걸리가 7건(77.8%), 13건(36.1%)으로 가장 많이 검출되었다. 각 품목에서 검출된 잔류농약 및 중금속 항목에 대해 인체노출량 평가결과는 모두 1% 미만으로 안전한 것으로 나타났다.

시민참여형 무미목 양서류 음성신호 수집 및 품질관리 방안 (Anura Call Monitoring Data Collection and Quality Management through Citizen Participation)

  • 김경태;이현정;송원경
    • 한국환경생태학회지
    • /
    • 제38권3호
    • /
    • pp.230-245
    • /
    • 2024
  • 외부 환경변화에 민감한 양서류는 지역 내 생태환경의 변화나 교란을 평가하는 생물지표종으로 활용되고 있다. 도시화로 인한 서식지 파괴, 단절과 같은 인위적인 위협으로 인해 무미목 양서류 종 3분의 1이 멸종 위험에 처한 것으로 알려져있다. 무미목 양서류의 적절한 보호 및 보전전략 마련을 위해서는 개체군의 특성을 고려한 생물종 조사가 요구된다. 본 연구는 무미목 양서류의 번식기 울음소리를 이용한 생태모니터링에 있어 시민들의 참여 가능성을 모색하고자 하였다. 또한 적절한 품질관리 방안을 제안하여 오류나 편향을 제거하고 신뢰도 높은 생물종 출현 자료를 추출하고자 하였다. 시민과학 프로젝트는 국내에 서식하는 무미목 양서류 12종을 대상으로 2022년 4월 1일부터 8월 31일까지 전국을 대상으로 수행되었다. 시민들의 자발적인 참여를 통해 무미목 양서류의 번식기 울음소리를 직접 청취하고 모바일 애플리케이션을 통해 녹음함으로써 음성신호 모니터링이 진행되었다. 또한 품질관리 프로세스를 구축하여 시민들로부터 수집된 데이터의 오류 및 편향을 누락, 허위, 잘못된 식별과 같이 3단계로 분류하여 신뢰도 높은 생물종 출현 자료를 추출하고자 하였다. 시민참여 무미목 양서류 음성신호 모니터링 결과 총 6,808건의 관찰 기록을 수집할 수 있었다. 품질관리 프로세스를 통해 6,808건의 데이터 중 1,944건(28.55%)에서 오류 및 편향이 발생하였다. 오류 및 편향 유형으로는 누락이 922건 (47.43%)으로 높은 빈도를 보였으며 잘못된 식별 540건(27.78%), 허위 482건(24.79%) 순서로 나타났다. 시민과학프로젝트를 통해 국내에 서식하는 12종의 무미목 양서류 중 두꺼비(Bufo gargarizans Cantor), 한국산개구리(Rana coreana)를 제외한 10종의 무미목 양서류의 번식기 울음소리를 관찰할 수 있었다. 주로 개체수 감소로 인하여 관찰이 어렵거나 비 출현 개체의 번식기와 시민과학 프로젝트 진행 시점과의 차이로 인해 번식기 울음소리를 수집하는데 어려움이 발생한 것으로 나타났다. 본 연구는 시민참여를 토대로 국내에 서식하는 무미목 양서류의 번식기 울음소리를 통해 분포현황과 생물종 출현 자료 수집을 처음으로 검토한 연구이다. 향후 시민과학을 접목한 생물음향 모니터링 설계와 시민과학 데이터 품질관리 방안에 대한 기초자료로 활용될 수 있을 것으로 판단된다.

딥러닝 기반 윤곽정보 추출자를 활용한 RPC 보정 기술 적용성 분석 (Analysis of Applicability of RPC Correction Using Deep Learning-Based Edge Information Algorithm)

  • 허재원;이창희;서두천;오재홍;이창노;한유경
    • 대한원격탐사학회지
    • /
    • 제40권4호
    • /
    • pp.387-396
    • /
    • 2024
  • 대부분의 고해상도 위성영상은 rational polynomial coefficients (RPC) 정보를 제공하여 지상좌표와 영상좌표 간 변환을 수행한다. 그러나 초기 RPC에는 기하학적 오차가 존재하여 ground control points (GCPs)와의 정합을 통해 보정을 수행하여야 한다. GCP chip은 항공정사영상에서 추출한 높이 정보가 포함된 작은 영상 패치(patch)이다. 많은 선행연구에서는 영역 기반 정합 기법을 사용하여 고해상도 위성영상과 GCP chip 간 정합을 수행하였다. 계절적 차이나 변화된 지역이 존재하는 영상에서는 화소값에 의존하는 정합이 어렵기 때문에 윤곽 정보를 추출하여 정합을 수행하기도 한다. 그러나 일반적으로 사용하는 canny 기법으로 정합에 용이한 윤곽을 추출하기 위해서는 위성영상의 분광 특성에 적절한 임계치를 설정해주어야 하는 문제가 존재한다. 따라서 본 연구에서는 위성영상의 지역별 특성에 둔감한 윤곽 정보를 활용하여 RPC 보정을 위한 정합을 수행하고자 한다. 이를 위해 딥러닝 기반 윤곽 정보 추출 네트워크인 pixel difference network (PiDiNet)를 활용하여 위성영상과 GCP chip의 윤곽맵(edge map)을 각각 생성하였다. 그 후 생성된 윤곽맵을 normalized cross-correlation과 relative edge cross-correlation의 입력데이터로 대체하여 영역 기반의 정합을 수행하였다. 마지막으로 RPC 보정에 필요한 변환모델 계수를 도출하기 위하여 data snooping 기법을 반복적으로 적용하여 참정합쌍을 추출하였다. 오정합쌍을 제거한 참정합쌍에 대해 root mean square error (RMSE)를 도출하고 기존에 사용하던 상관관계 기법과 결과를 정성적으로 비교하였다. 실험 결과, PiDiNet은 약 0.3~0.9 화소의 RMSE 값 분포를 보였으나 canny 기법에 비해 두꺼운 윤곽을 나타내어 일부 영상에서 미세하게 정확도가 저하되는 것을 확인하였다. 그러나 위성영상 내 특징적인 윤곽을 일관적으로 나타냄으로써 정합이 어려운 지역에서도 정합이 잘 수행되는 것을 확인하였다. 본 연구를 통해 윤곽 기반 정합 기법의 강인성을 개선하여 다양한 지역에서의 정합을 수행할 수 있을 것으로 예상된다.

비정형 정보와 CNN 기법을 활용한 이진 분류 모델의 고객 행태 예측: 전자상거래 사례를 중심으로 (Customer Behavior Prediction of Binary Classification Model Using Unstructured Information and Convolution Neural Network: The Case of Online Storefront)

  • 김승수;김종우
    • 지능정보연구
    • /
    • 제24권2호
    • /
    • pp.221-241
    • /
    • 2018
  • 최근 딥러닝 기술이 주목을 받고 있다. 대중들의 관심을 받았던 국제 이미지 인식 기술 대회(ILSVR)와 알파고(AlphaGo)에서 사용된 딥러닝 기술이 바로 합성곱 신경망(CNN; Convolution Neural Network)이다. 합성곱 신경망은 입력 이미지를 작은 구역으로 나누어 부분적인 특징을 인식하고 이것을 결합하여 전체를 인식하는 특징을 가진다. 이러한 딥러닝 기술이 우리의 생활에 있어 많은 변화를 야기할 것이라는 기대를 주고 있지만 현재까지는 이미지 인식과 자연어 처리 등에 그 성과가 국한되어 있다. 비즈니스 문제에 대한 딥러닝 활용은 아직까지 초기 연구 단계로 향후 마케팅 응답 예측이나 허위 거래 식별, 부도 예측과 같은 전통적 비즈니스 문제들에 대해 보다 깊게 활용되고 그 성능이 입증된다면 딥러닝 기술의 활용 가치가 보다 더 주목받게 될 것으로 기대된다. 이러한 때 비교적 고객 식별이 용이하고 활용 가치가 높은 빅데이터를 보유하고 있는 전자상거래 기업의 사례를 바탕으로 하여 딥러닝 기술의 비즈니스 문제 해결 가능성을 진단해보는 것은 학술적으로 매우 의미 있는 시도라 할 수 있겠다. 이에 본 연구에서는 전자상거래 기업의 고객 행태 예측력을 높이기 위한 방안으로 합성곱 신경망을 활용한 '이종 정보 결합(Heterogeneous Information Integration)의 CNN 모델'을 제시한다. 이는 정형과 비정형 정보를 결합하여 다층 퍼셉트론 구조의 합성곱 신경망에서 학습시키는 모델로서 최적의 성능을 발휘하도록 '이종 정보 결합'과 '비정형 정보의 벡터 전환', 그리고 '다층 퍼셉트론 설계'로 하는 3개의 내부 아키텍처를 정의하고 각 아키텍처 단위로 구성되는 방식에 따른 성능을 평가하여 그 결과를 바탕으로 제안 모델을 확정하고 그 성능을 평가해보고자 한다. 고객 행태 예측을 위한 목표 변수는 전자상거래 기업에서 중요하게 관리하고 있는 재구매 고객, 이탈 고객, 고빈도 구매 고객, 고빈도 반품 고객, 고단가 구매 고객, 고할인 구매 고객 등 모두 6개의 이진 분류 문제로 정의한다. 제안한 모델의 유용성을 검증하기 위해서 국내 특정 전자상거래 기업의 실제 데이터를 활용하여 실험을 수행하였다. 실험 결과 정형과 비정형 정보를 결합하여 CNN을 활용한 제안 모델이 NBC(Naïve Bayes classification)과 SVM(Support vector machine), 그리고 ANN(Artificial neural network)에 비해서 예측 정확도와 F1 Measure가 높게 평가되었다. 또 NBC, SVM, ANN에서 정형 정보만을 사용할 때 보다 정형과 비정형 정보를 결합하여 입력 변수로 함께 활용한 경우에 예측 정확도가 향상되는 것으로 나타났다. 따라서 실험 결과로부터 비정형 정보의 활용이 고객 행태 예측의 정확도 향상에 기여한다는 점과 CNN 기법의 특징 추출 알고리즘이 VOC에 사용된 단어들의 분포와 위치 정보를 해석하여 문장의 의미를 파악하는데 효과적이라는 점을 실증적으로 확인하였다는데 그 의미가 있다고 할 수 있겠다. 이를 통해서 CNN 기법이 지금까지 소개된 이미지 인식이나 자연어 처리 분야 외에 비즈니스 문제 해결에도 활용 가치가 높다는 점을 확인하였다는데 이 연구의 의의가 있다 하겠다.

사회문제 해결형 기술수요 발굴을 위한 키워드 추출 시스템 제안 (A Proposal of a Keyword Extraction System for Detecting Social Issues)

  • 정다미;김재석;김기남;허종욱;온병원;강미정
    • 지능정보연구
    • /
    • 제19권3호
    • /
    • pp.1-23
    • /
    • 2013
  • 융합 R&D가 추구해야 할 바람직한 방향은 이종 기술 간의 결합에 의한 맹목적인 신기술 창출이 아니라, 당면한 주요 문제를 해결함으로써 사회적 니즈를 충족시킬 수 있는 기술을 개발하는 것이다. 이와 같은 사회문제 해결형 기술 R&D를 촉진하기 위해서는 우선 우리 사회에서 주요 쟁점이 되고 있는 문제들을 선별해야 한다. 그런데 우선적이고 중요한 사회문제를 분별하기 위해 전문가 설문조사나 여론조사 등 기존의 사회과학 방법론을 사용하는 것은 참여자의 선입견이 개입될 수 있고 비용이 많이 소요된다는 한계를 지닌다. 기존의 사회과학 방법론이 지닌 문제점을 보완하기 위하여 본 논문에서는 사회적 이슈를 다루고 있는 대용량의 뉴스기사를 수집하고 통계적인 기법을 통하여 사회문제를 나타내는 키워드를 추출하는 시스템의 개발을 제안한다. 2009년부터 최근까지 3년 동안 10개 주요 언론사에서 생산한 약 백 30만 건의 뉴스기사에서 사회문제를 다루는 기사를 식별하고, 한글 형태소 분석, 확률기반의 토픽 모델링을 통해 사회문제 키워드를 추출한다. 또한 키워드만으로는 정확한 사회문제를 파악하기 쉽지 않기 때문에 사회문제와 연관된 키워드와 문장을 찾아서 연결하는 매칭 알고리즘을 제안하다. 마지막으로 사회문제 키워드 비주얼라이제이션 시스템을 통해 시계열에 따른 사회문제 키워드를 일목요연하게 보여줌으로써 사회문제를 쉽게 파악할 수 있도록 하였다. 특히 본 논문에서는 생성확률모델 기반의 새로운 매칭 알고리즘을 제안한다. 대용량 뉴스기사로부터 Latent Dirichlet Allocation(LDA)와 같은 토픽 모델 방법론을 사용하여 자동으로 토픽 클러스터 세트를 추출할 수 있다. 각 토픽 클러스터는 연관성 있는 단어들과 확률값으로 구성된다. 그리고 도메인 전문가는 토픽 클러스터를 분석하여, 각 토픽 클러스터의 레이블을 결정하게 된다. 이를 테면, 토픽 1 = {(실업, 0.4), (해고, 0.3), (회사, 0.3)}에서 토픽 단어들은 실업문제와 관련있으며, 도메인 전문가는 토픽 1을 실업문제로 레이블링 하게 되고, 이러한 토픽 레이블은 사회문제 키워드로 정의한다. 그러나 이와 같이 자동으로 생성된 사회문제 키워드를 분석하여 현재 우리 사회에서 어떤 문제가 발생하고 있고, 시급히 해결해야 될 문제가 무엇인지를 파악하기란 쉽지 않다. 따라서 제안된 매칭 알고리즘을 사용하여 사회문제 키워드를 요약(summarization)하는 방법론을 제시한다. 우선, 각 뉴스기사를 문단(paragraph) 단위로 세그먼트 하여 뉴스기사 대신에 문단 세트(A set of paragraphs)를 가지게 된다. 매칭 알고리즘은 각 토픽 클러스터에 대한 각 문단의 확률값을 측정하게된다. 이때 토픽 클러스터의 단어들과 확률값을 이용하여 토픽과 문단이 얼마나 연관성이 있는지를 계산하게 된다. 이러한 과정을 통해 각 토픽은 가장 연관성이 있는 문단들을 매칭할 수 있게 된다. 이러한 매칭 프로세스를 통해 사회문제 키워드와 연관된 문단들을 검토함으로써 실제 우리 사회에서 해당 사회문제 키워드와 관련해서 구체적으로 어떤 사건과 이슈가 발생하는 지를 쉽게 파악할 수 있게 된다. 또한 매칭 프로세스와 더불어 사회문제 키워드 가시화를 통해 사회문제 수요를 파악하려는 전문가들은 웹 브라우저를 통해 편리하게 특정 시간에 발생한 사회문제가 무엇이며, 구체적인 내용은 무엇인지를 파악할 수 있으며, 시간 순서에 따른 사회이슈의 변동 추이와 그 원인을 알 수 있게 된다. 개발된 시스템을 통해 최근 3년 동안 국내에서 발생했던 다양한 사회문제들을 파악하였고 개발된 알고리즘에 대한 평가를 수행하였다(본 논문에서 제안한 프로토타입 시스템은 http://dslab.snu.ac.kr/demo.html에서 이용 가능함. 단, 구글크롬, IE8.0 이상 웹 브라우저 사용 권장).