• Title/Summary/Keyword: 데이터 증강

Search Result 485, Processing Time 0.029 seconds

A study on data augmentation methods for sound data classification (소리 데이터 분류에 대한 데이터 증대 방법 연구)

  • Chang, Il-Sik;Park, Goo-man
    • Proceedings of the Korean Society of Broadcast Engineers Conference
    • /
    • 2022.06a
    • /
    • pp.1308-1310
    • /
    • 2022
  • 소리 데이터 분류는 단순 소리를 통한 분류, 감정 인식등 다양한 연구가 진행중이다. 심층 신경망에서 데이터의 부족과 과적합 문제를 개선하는 방법으로 데이터 증강은 중요하다. 본 논문에서는 3가지의 소리데이터(UrbanSound8K, RAVDESS, IRMAS)를 사용하였으며, 소리데이터는 멜 스펙트로그램을 통한 변환과정을 거쳐 네트워크 망에 입력된다. 입력된 신호는 다양한 네크워크 신경망(Bidirection LSTM, Bidirection LSTM Attention, Multi-Head Attention, CNN)을 통해 학습되어지며, 각각의 네트워크 신경망에서 데이터 증강 전후의 분류 정확도를 확인 하였다. 다양한 데이터셋과 다양한 네트워크 망에서의 데이터 증강 방법의 결과 비교를 통한 통찰을 얻을수 있을 것이다.

  • PDF

Prompt-based Data Augmentation for Generating Personalized Conversation Using Past Counseling Dialogues (과거 상담대화를 활용한 개인화 대화생성을 위한 프롬프트 기반 데이터 증강)

  • Chae-Gyun Lim;Hye-Woo Lee;Kyeong-Jin Oh;Joo-Won Sung;Ho-Jin Choi
    • Annual Conference on Human and Language Technology
    • /
    • 2023.10a
    • /
    • pp.209-213
    • /
    • 2023
  • 최근 자연어 이해 분야에서 대규모 언어모델 기반으로 프롬프트를 활용하여 모델과 상호작용하는 방법이 널리 연구되고 있으며, 특히 상담 분야에서 언어모델을 활용한다면 내담자와의 자연스러운 대화를 주도할 수 있는 대화생성 모델로 확장이 가능하다. 내담자의 상황에 따라 개인화된 상담대화를 진행하는 모델을 학습시키려면 동일한 내담자에 대한 과거 및 차기 상담대화가 필요하지만, 기존의 데이터셋은 대체로 단일 대화세션으로 구축되어 있다. 본 논문에서는 언어모델을 활용하여 단일 대화세션으로 구축된 기존 상담대화 데이터셋을 확장하여 연속된 대화세션 구성의 학습데이터를 확보할 수 있는 프롬프트 기반 데이터 증강 기법을 제안한다. 제안 기법은 기존 대화내용을 반영한 요약질문 생성단계와 대화맥락을 유지한 차기 상담대화 생성 단계로 구성되며, 프롬프트 엔지니어링을 통해 상담 분야의 데이터셋을 확장하고 사용자 평가를 통해 제안 기법의 데이터 증강이 품질에 미치는 영향을 확인한다.

  • PDF

Dataset Augmentation Technique for Crack Detection of Wood Building (목조건물 크랙 감지를 위한 데이터셋 증강 기법)

  • Kim, Beom-Jun;Kim, Inki;Lim, Hyunseok;Gwak, Jeonghwan
    • Proceedings of the Korean Society of Computer Information Conference
    • /
    • 2021.07a
    • /
    • pp.645-647
    • /
    • 2021
  • 본 논문에서는 목조건물의 Crack만을 움직여 Data set을 증강하는 기법을 제안한다. 이 기법은 이미지 내 Crack Detection의 학습 데이터를 만들기 위해 이미지의 전체적인 값으로 Flip, Rotation, Shift, Rescale 등의 변환을 통해 Data Augmentation을 진행하는 대신 Crack이라는 하나의 Object만을 가지고 새로운 데이터를 생성한다. 이때 Object는 관심 영역 내에서만 연산되어 기존의 방법보다 더욱 많은 데이터를 얻을 수 있으며, Crack이 관심 영역 밖으로 이동하지 않기 때문에 이상치 혹은 결측치가 존재하지 않는 데이터를 얻을 수 있다. 또한 Crack이 존재하지 않는 이미지에도 임의적으로 Crack을 생성하여 새로운 데이터를 만들 수 있다. 결론적으로 본 논문에서는 Crack Detection의 학습을 위하여 기존 방법보다 우수한 성능의 Data Augmentation을 제안하였다.

  • PDF

Visualization of Local Eating-Out Trend Using AR Graph (증강현실 그래프를 이용한 지역별 외식 성향 시각화)

  • Kim, Sang-Joon;Ko, Yu-Jin;Park, Goo-Man;Choi, Yoo-Joo
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • 2019.05a
    • /
    • pp.700-701
    • /
    • 2019
  • 본 논문에서는 지역 데이터의 시각화에 적합한 증강현실 그래프를 제안하고, 이를 카드 사용 빅데이터에 적용하여 지역별 외식 성향 시각화 도구로 활용한 사례를 제시한다. 증강현실 그래프는 사용자가 위치한 해당 지역의 GPS 정보를 기반으로 빅데이터에서 분석 대상 지역을 선별하고, 지역별 특수 데이터를 찾아내어 해당 지역에 대한 빅데이타 분석 내용을 카메라 영상과 함께 시각화한 그래프이다. 증강현실 그래프를 적용한 외식 성향 시각화 사례에서는 카드 사용 가맹점 소재지 정보, 가맹점 업종, 카드사용시점(월), 카드 사용자 성별구분, 연령대, 월 카드사용금액 및 월 사용 건수 정보등을 수집하였다. 그리고, 분석 대상 지역에 대한 연령대별 외식 선호도 내용을 카드사용건수가 많은 업종별 순위 그래프로 시각화 하여 사용자의 위치에서 확인할 수 있도록 하였다. 제안 증강현실 그래프는 지역별 상권 현황, 아파트 시세 등에 효과적으로 적용될 수 있을 것으로 기대된다.

Data Augmentation Scheme for Semi-Supervised Video Object Segmentation (준지도 비디오 객체 분할 기술을 위한 데이터 증강 기법)

  • Kim, Hojin;Kim, Dongheyon;Kim, Jeonghoon;Im, Sunghoon
    • Journal of Broadcast Engineering
    • /
    • v.27 no.1
    • /
    • pp.13-19
    • /
    • 2022
  • Video Object Segmentation (VOS) task requires an amount of labeled sequence data, which limits the performance of the current VOS methods trained with public datasets. In this paper, we propose two effective data augmentation schemes for VOS. The first augmentation method is to swap the background segment to the background from another image, and the other method is to play the sequence in reverse. The two augmentation schemes for VOS enable the current VOS methods to robustly predict the segmentation labels and improve the performance of VOS.

Optimization of Data Augmentation Techniques in Neural Machine Translation (신경망 기계번역에서 최적화된 데이터 증강기법 고찰)

  • Park, Chanjun;Kim, Kuekyeng;Lim, Heuiseok
    • Annual Conference on Human and Language Technology
    • /
    • 2019.10a
    • /
    • pp.258-261
    • /
    • 2019
  • 딥러닝을 이용한 Sequence to Sequence 모델의 등장과 Multi head Attention을 이용한 Transformer의 등장으로 기계번역에 많은 발전이 있었다. Transformer와 같은 성능이 좋은 모델들은 대량의 병렬 코퍼스를 가지고 학습을 진행하였는데 대량의 병렬 코퍼스를 구축하는 것은 시간과 비용이 많이 드는 작업이다. 이러한 단점을 극복하기 위하여 합성 코퍼스를 만드는 기법들이 연구되고 있으며 대표적으로 Back Translation 기법이 존재한다. Back Translation을 이용할 시 단일 언어 데이터를 가상 병렬 데이터로 변환하여 학습데이터의 양을 증가 시킨다. 즉 말뭉치 확장기법의 일종이다. 본 논문은 Back Translation 뿐만 아니라 Copied Translation 방식을 통한 다양한 실험을 통하여 데이터 증강기법이 기계번역 성능에 미치는 영향에 대해서 살펴본다. 실험결과 Back Translation과 Copied Translation과 같은 데이터 증강기법이 기계번역 성능향상에 도움을 줌을 확인 할 수 있었으며 Batch를 구성할 때 상대적 가중치를 두는 것이 성능향상에 도움이 됨을 알 수 있었다.

  • PDF

Generative Adversarial Networks Based Data Augmentation to Address Medical Data Imbalances (의료 데이터 불균형 문제 해결을 위한 생성적 적대 신경망 기반 데이터 증강)

  • Choe, Jae-Hong;Lee, Seung-Lee;Seo, Young-Jae;Seo, Won-Jin;Hou, Jong-Uk
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • 2022.11a
    • /
    • pp.350-352
    • /
    • 2022
  • 발병률이 낮은 병은 데이터 불균형 문제가 발생하며, 이는 의료계에서 겪는 원초적인 문제이다. 이런 불균형 문제를 해결하고자 Pix2Pix 로 생성적 적대 신경망 기반 의료 이미지 증강 기법을 설계하여 데이터 불균형 문제 해결 및 성능을 향상시켰다. 합성 데이터의 추가 및 기하학적 데이터 증강의 유무에 대한 4 가지 시나리오로 성능을 비교하여 제안된 기법이 가장 효과적임을 보인다.

Abnormal Data Augmentation Method Using Perturbation Based on Hypersphere for Semi-Supervised Anomaly Detection (준 지도 이상 탐지 기법의 성능 향상을 위한 섭동을 활용한 초구 기반 비정상 데이터 증강 기법)

  • Jung, Byeonggil;Kwon, Junhyung;Min, Dongjun;Lee, Sangkyun
    • Journal of the Korea Institute of Information Security & Cryptology
    • /
    • v.32 no.4
    • /
    • pp.647-660
    • /
    • 2022
  • Recent works demonstrate that the semi-supervised anomaly detection method functions quite well in the environment with normal data and some anomalous data. However, abnormal data shortages can occur in an environment where it is difficult to reserve anomalous data, such as an unknown attack in the cyber security fields. In this paper, we propose ADA-PH(Abnormal Data Augmentation Method using Perturbation based on Hypersphere), a novel anomalous data augmentation method that is applicable in an environment where abnormal data is insufficient to secure the performance of the semi-supervised anomaly detection method. ADA-PH generates abnormal data by perturbing samples located relatively far from the center of the hypersphere. With the network intrusion detection datasets where abnormal data is rare, ADA-PH shows 23.63% higher AUC performance than anomaly detection without data augmentation and even performs better than the other augmentation methods. Also, we further conduct quantitative and qualitative analysis on whether generated abnormal data is anomalous.

Trends in Recognition and Modelling Technology of Experience Data for Augmented, Cognition (인지증강을 위한 경험정보 인식 및 모델링 기술 동향)

  • Jeong, H.T.;Kim, G.G.;Noh, K.J.;Lim, J.Y.;Chung, S.E.
    • Electronics and Telecommunications Trends
    • /
    • v.32 no.4
    • /
    • pp.11-20
    • /
    • 2017
  • 본고에서는 인지증강을 위한 서비스, 경험정보 인식 기술과 경험정보 모델링 기술에 관한 동향을 살펴본다. 경험정보 기반 인지증강 서비스를 위해 기존의 센서 데이터 중심의 인식 기술과 더불어 개인 경험상황의 특징을 고려한 인식기술에 관한 연구와 다수의 이질적인 경험 데이터를 기반으로 한 사용자 특정 패턴분석을 위한 경험정보 모델링 및 분석 기법에 관한 지속적이고 폭넓은 연구가 필요하다.

Game System for Agent applied Artificial Intelligence based on Augmented Reality (증강현실 기반의 인공지능이 적용된 에이전트를 위한 게임 시스템)

  • Jang, yu-na;Park, sung-jun
    • Proceedings of the Korea Contents Association Conference
    • /
    • 2010.05a
    • /
    • pp.49-51
    • /
    • 2010
  • 스마트폰의 도입으로 인하여 증강현실이 널리 알려짐에 따라 대중들의 관심은 이에 집중되고 있으며 휴대성으로 인하여 모바일기기에서의 증강현실 연구가 하나의 흐름으로 자리 잡고 있다. 기존의 증강현실과 인공지능이 결합된 연구들은 주로 로봇공학이 많은 비율을 차지하고 있으며 게임에 접목된 연구들은 부족한 실정이다. 또한 인공지능이 적용된 에이전트들의 움직임을 위한 데이터들은 아직까지 사용자가 직접 입력해주거나 이를 인식하는데 마커를 사용하고 있다. 본 논문에서는 마커리스 추적 기술을 사용하여 생성한 데이터를 인공지능부분에서 사용하며 증강현실 기반의 인공지능이 적용된 에이전트를 위한 게임 시스템을 제안한다. 그리고 이를 아이폰 모바일 기기에서 구현하였으며 인식율, 정확도를 측정하여 본 시스템을 검증하였다.

  • PDF