머신 러닝을 통한 단백질의 자유 에너지 예측

  • 이광중 (숙명여자대학교, 나노바이오전산화학연구실, 화학과) ;
  • 함시현 (숙명여자대학교, 나노바이오전산화학연구실, 화학과)
  • Published : 2017.03.24

Abstract

Protein contact map은 단백질 삼차구조에 대한 정보를 이차원의 이미지로 표현하는 방법의 하나로, 비교적 간략하지만 단백질 구조에 대한 핵심적 정보를 함축하고 있다. 이러한 단백질 구조를 바탕으로 단백질의 internal energy, solvation free energy, free energy 와 같은 열역학 함수를 도출할 수 있다. 본 연구에서는 이미지 인식에 대한 머신러닝 기법을 사용하여 단백질 구조를 함축하는 단백질의 contact map으로부터 단백질의 열역학적 함수를 예측하는 연구를 진행하였다. 단백질의 main-chain 간의 contact map, side-chain 간의 contact map, main-chain과 side-chain 간의 contact map 들로부터 단백질의 여러 가지 열역학적 함수를 예측하고자 했으며 최종적으로 Convolution Neural Network (CNN) 기법을 사용하여 단백질의 free energy를 ~18 kcal/mol의 범위에서 예측 가능함을 보였다. 본 연구를 바탕으로 단백질의 contact map과 열역학 함수 사이의 상관관계가 있으며, 머신러닝 기법을 사용하여 단백질 contact map으로부터 열역학적 함수를 예측하는 것이 가능함을 보였다.

Keywords