• 제목/요약/키워드: 상대 정책 모델

검색결과 22건 처리시간 0.021초

효율적인 멀티 에이전트 강화학습을 위한 RBFN 기반 정책 모델 (RBFN-based Policy Model for Efficient Multiagent Reinforcement Learning)

  • 권기덕;김인철
    • 한국지능정보시스템학회:학술대회논문집
    • /
    • 한국지능정보시스템학회 2007년도 추계학술대회
    • /
    • pp.294-302
    • /
    • 2007
  • 멀티 에이전트 강화학습에서 중요한 이슈 중의 하나는 자신의 성능에 영향을 미칠 수 있는 다른 에이전트들이 존재하는 동적 환경에서 어떻게 최적의 행동 정책을 학습하느냐 하는 것이다. 멀티 에이전트 강화 학습을 위한 기존 연구들은 대부분 단일 에이전트 강화 학습기법들을 큰 변화 없이 그대로 적용하거나 비록 다른 에이전트에 관한 별도의 모델을 이용하더라도 현실적이지 못한 가정들을 요구한다. 본 논문에서는 상대 에이전트에 대한RBFN기반의 행동 정책 모델을 소개한 뒤, 이것을 이용한 강화 학습 방법을 설명한다. 본 논문에서는 제안하는 멀티 에이전트 강화학습 방법은 기존의 멀티 에이전트 강화 학습 연구들과는 달리 상대 에이전트의 Q 평가 함수 모델이 아니라 RBFN 기반의 행동 정책 모델을 학습한다. 또한, 표현력은 풍부하나 학습에 시간과 노력이 많이 요구되는 유한 상태 오토마타나 마코프 체인과 같은 행동 정책 모델들에 비해 비교적 간단한 형태의 행동 정책 모델을 이용함으로써 학습의 효율성을 높였다. 본 논문에서는 대표적이 절대적 멀티 에이전트 환경인 고양이와 쥐 게임을 소개한 뒤, 이 게임을 테스트 베드 삼아 실험들을 전개함으로써 제안하는 RBFN 기반의 정책 모델의 효과를 분석해본다.

  • PDF

효율적인 멀티 에이전트 강화 학습을 위한 나이브 베이지만 기반 상대 정책 모델 (A Naive Bayesian-based Model of the Opponent's Policy for Efficient Multiagent Reinforcement Learning)

  • 권기덕
    • 인터넷정보학회논문지
    • /
    • 제9권6호
    • /
    • pp.165-177
    • /
    • 2008
  • 멀티 에이전트 강화학습에서 중요한 이슈 중의 하나는 자신의 성능에 영향을 미칠 수 있는 다른 에이전트들이 존재하는 동적 환경에서 어떻게 최적의 행동 정책을 학습하느냐 하는 것이다. 멀티 에이전트 강화 학습을 위한 기존 연구들은 대부분 단일 에이전트 강화 학습기법들을 큰 변화 없이 그대로 적용하거나 비록 다른 에이전트에 관한 별도의 모델을 이용하더라도 현실적이지 못한 가정들을 요구한다. 본 논문에서는 상대 에이전트에 대한 나이브 베이지안 기반의 행동 정책 모델을 소개한 뒤, 이것을 이용한 강화 학습 방법을 설명한다. 본 논문에서 제안하는 멀티 에이전트 강화학습 방법은 기존의 멀티 에이전트 강화 학습 연구들과는 달리 상대 에이전트의 Q 평가 함수 모델이 아니라 나이브 베이지안 기반의 행동 정책 모델을 학습한다. 또한, 표현력은 풍부하나 학습에 시간과 노력이 많이 요구되는 유한 상태 오토마타나 마코프 체인과 같은 행동 정책 모델들에 비해 비교적 간단한 형태의 행동 정책 모델은 이용함으로써 학습의 효율성을 높였다. 본 논문에서는 대표적인 적대적 멀티 에이전트 환경인 고양이와 쥐게임을 소개한 뒤, 이 게임을 테스트 베드 삼아 실험들을 전개함으로써 제안하는 나이브 베이지안 기반의 정책 모델의 효과를 분석해본다.

  • PDF

적대적 멀티 에이전트 환경에서 효율적인 강화 학습을 위한 정책 모델링 (Policy Modeling for Efficient Reinforcement Learning in Adversarial Multi-Agent Environments)

  • 권기덕;김인철
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제35권3호
    • /
    • pp.179-188
    • /
    • 2008
  • 멀티 에이전트 강화 학습에서 해결해야 할 중요한 문제는 자신의 작업 성능에 영향을 미칠 수 있는 다른 에이전트들이 존재하는 동적 환경에서 한 에이전트가 시행착오적 상호작용을 통해 어떻게 자신의 최적 행동 정책을 학습할 수 있느냐 하는 것이다. 멀티 에이전트 강화 학습을 위한 기존 연구들은 대부분 단일 에이전트 MDP 기반의 강화 학습기법들을 큰 변화 없이 그대로 적용하거나 비록 다른 에이전트에 관한 별도의 모델을 이용하더라도 다른 에이전트에 관해 요구되는 정보나 가정이 현실적이지 못하다는 한계점을 가지고 있다. 본 논문에서는 멀티 에이전트 강화 학습기술에 기초가 되는 기본 개념들을 정형화하고 이들을 기초로 기존 연구들의 특징과 한계점을 비교한다. 그리고 새로운 행동 정책 모델을 소개한 뒤, 이것을 이용한 강화 학습 방법을 설명한다. 본 논문에서 제안하는 멀티 에이전트 강화학습 방법은 상대 모델을 이용하는 기존의 멀티 에이전트 강화 학습 연구들에서 주로 시도되었던 상대 에이전트의 Q 평가 함수 모델 대신 상대 에이전트의 행동 정책 모델을 학습하며, 표현력은 풍부하나 학습에 시간과 노력이 많이 요구되는 유한 상태 오토마타나 마코프 체인과 같은 행동 정책 모델들에 비해 비교적 간단한 형태의 행동 정책 모델을 이용함으로써 학습의 효율성을 높였다. 또한, 본 논문에서는 대표적인 적대적 멀티 에이전트 환경인 고양이와 쥐게임을 소개하고, 이 게임을 테스베드삼아 비교 실험들을 수행하고 그 결과를 설명함으로써 본 논문에서 제안하는 정책 모델 기반의 멀티 에이전트 강화 학습의 효과를 분석해본다.

가상점원 : 고객과의 협상을 위한 에이전트 (Cyber-Salesman : An Agent negotiating with Customers)

  • 조의성;조근식
    • 한국지능정보시스템학회:학술대회논문집
    • /
    • 한국지능정보시스템학회 1999년도 춘계공동학술대회-지식경영과 지식공학
    • /
    • pp.217-225
    • /
    • 1999
  • 협상은 상거래에 있어서 매우 중요한 요소 중 하나이다. 현재의 웹 기반 전자상거래 시스템은 이러한 중요한 협상 구조를 상거래에 잘 반영하지 못하는 문제점을 가지고 있다. 이러한 문제점중 기업과 소비자간의 미비한 협상 구조를 보안하기 위해 실세계 상거래에서 존재하는 점원을 전자상거래상의 가상점원으로 모델링하여 회사의 정책과 구매자의 특성을 반영하여 구매자와 전략적으로 자동 협상을 수행할 수 있는 에이전트의 구조를 설계하고 표현하고, 그 제안에 대한 평가 내용과 결정사항을 전달할 수 있는 언어적인 구조가 필요하며, 협상의 대상이 되는 사안들의 특성을 반영할 수 있는 표현 구조도 요구된다. 또한 이러한 협상에서 전략을 세우고 알맞은 제안을 제시하며 상대의 제안에 대하여 전략적으로 반응할 수 있는 의사결정 모델이 요구된다. 본 논문에서는 회사의 정책 모델과 구매자의 모델을 정의하고 이를 이용한 협상 모델을 설계 구현하였다. 협상 구조의 모델링을 위해 KQML(Knowledge Query Manipulation Language)을 기반으로 전자상거래 프로토콜로 설계하고, 논쟁 기반 협상 모델을 기초로 협상언어를 설계하였다. 또한 협상에서의 전략적인 의사결정을 위해 게임이론을 이용하고, 규칙 기반 시스템으로 이를 보충하였다. 마지막으로 가상점원 모델을 바탕으로 조립 컴퓨터 판매를 위한 가상점원으로 구현하였고, 이에 대한 실험을 통하여 가상점원의 유용성을 보였다.

  • PDF

가상점원 : 고객과의 협상을 위한 에이전트 (Cyber-Salesman : An Agent negotiating with Customers)

  • 조의성;조근식
    • 한국데이타베이스학회:학술대회논문집
    • /
    • 한국데이타베이스학회 1999년도 춘계공동학술대회: 지식경영과 지식공학
    • /
    • pp.217-225
    • /
    • 1999
  • 협상은 상거래에 있어서 매우 중요한 요소 중 하나이다. 현재의 웹 기반 전자상거래 시스템은 이러한 중요한 협상 구조를 상거래에 잘 반영하지 못하는 문제점을 가지고 있다. 이러한 문제점중 기업과 소비자간의 미비한 협상 구조를 보안하기 위해 실세계 상거래에서 존재하는 점원을 전자상거래상의 가상점원으로 모델링하여 회사의 정책과 구매자의 특성을 반영하여 구매자와 전략적으로 자동 협상을 수행할 수 있는 에이전트의 구조를 설계하고 구현하였다. 협상은 매우 복잡한 구조를 가지고 있다. 이러한 협상 구조를 지원하기 위해서는 상호간의 제안을 표현하고, 그 제안에 대한 평가 내용과 결정사항을 전달할 수 있는 언어적인 조가 필요하며, 협상의 대상이 되는 사안들의 특성을 반영할 수 있는 표현 구조도 요구된다. 또한 이러한 협상에서 전략을 세우고 알맞은 제안을 제시하며 상대의 제안에 대하여 전략적으로 반응할 수 있는 의사결정 모델이 요구된다. 본 논문에서는 회사의 정책 모델과 구매자의 모델을 정의하고 이를 이용한 협상 모델을 설계 구현하였다. 협상 구조의 모델링을 위해 KQML(Knowledge Query Manipulation Language)을 기반으로 전자상거래 프로토콜로 설계하고, 논쟁 기반 협상 모델을 기초로 협상언어를 설계하였다. 또한 협상에서의 전략적인 의사결정을 위해 게임이론을 이용하고, 규칙 기반 시스템으로 이를 보충하였다. 마지막으로 가상점원 모델을 바탕으로 조립 컴퓨터 판매를 위한 가상점원을 구현하였고, 이에 대한 실험을 통하여 가상점원의 유용성을 보였다.

  • PDF

전자거래상에서의 구매자와 자동협상 수행을 위한 가상점원 시스템 (Cyber-Salesperson agent for automated negotiation with customers in EC)

  • 조의성;조근식
    • 지능정보연구
    • /
    • 제5권2호
    • /
    • pp.63-78
    • /
    • 1999
  • 협상은 상거래에 있어서 매우 중요한 요소 중 하나이다. 현재의 웹 기반 전자상거래 시스템은 이러한 중요한 협상 구조를 상거래에 잘 반영하지 못하는 문제점을 가지고 있다. 이러한 문제점중 기업과 소비자간의 미비한 협상 구조를 보안하기 위해 실세계 상거래에서 존재하는 점원을 전자상거래상의 가상점원으로 모델링하여 회사의 정책과 구매자의 특성을 반영하여 구매자와 전략적으로 자동 협상을 수행할 수 있는 에이전트의 구조를 설계하고 구현하였다. 협상은 매우 복잡한 구조를 가지고 있다. 이러한 협상 구조를 지원하기 위해서는 상호간의 제안을 표현하고, 그 제안에 대한 평가 내용과 결정사항을 전달할 수 있는 언어적인 구조가 필요하며, 협상의 대상이 되는 사안들의 특성을 반영할 수 있는 표현 구조도 요구된다. 또한 이러한 협상에서 전략을 세우고 알맞은 제안을 제시하며 상대의 제안에 대하여 전략적으로 반응할 수 있는 의사결정 모델이 요구된다. 본 논문에서는 회사의 정책 모델과 구매자의 모델을 정의하고 이를 이용한 협상 모델을 설계 구현하였다. 협상 구조의 모델링을 위해 KQML(Knowledge Query Manipulation Language)을 기반으로 전자상거래 프로토콜로 설계하고, 논쟁 기반 협상 모델을 기초로 협상언로를 설계하였다. 또한 협상에서의 전략적인 의사결정을 위해 게임이론을 이용하고, 규칙 기반 시스템으로 이를 보충하였다. 마지막으로 가상점원 모델을 바탕으로 조립 컴퓨터 판매를 위한 가상점원을 구현하였고, 이에 대한 실험을 통하여 가상점원의 유용성을 보였다.

  • PDF

뇌파기반 정신적 피로 판별을 위한 딥러닝 모델 (Deep Learning Model for Mental Fatigue Discrimination System based on EEG)

  • 서쌍희
    • 디지털융복합연구
    • /
    • 제19권10호
    • /
    • pp.295-301
    • /
    • 2021
  • 개인의 정신적 피로는 인지능력 및 업무 수행능력을 감소시킬 뿐만 아니라 일상에서 발생하는 크고 작은 사고의 주요 요인이 된다. 본 논문에서는 EEG 기반의 정신적 피로 판별을 위한 CNN 모델을 제안하였다. 이를 위해 안정 상태와 작업 상태에서의 뇌파를 수집하여 제안한 CNN 모델에 적용한 후 모델 성능을 분석하였다. 실험에 참여한 피험자들은 모두 대학교에 재학 중인 오른손잡이 남학생들이며 평균 나이는 25.5세이다. 각 상태에서의 측정된 뇌파에 대해 스펙트럼분석을 수행하였으며, CNN 모델의 입력데이터로써 원시 EEG 신호, 절대파워, 상대파워를 사용하여 CNN모델의 성능을 비교 분석하였다. 그 결과, 알파대역 후두엽 위치의 상대파워가 가장 좋은 성능을 나타내었다. 모델정확도는 훈련데이터 85.6%, 검증데이터 78.5%, 시험데이터 95.7%이다. 제안한 모델은 정신적 피로 판별을 위한 자동화시스템 개발에 적용될 수 있다.

업종별 방사선작업종사자 피폭 기록 다각형 모델 분석 연구 (Polygonal Model Analysis on Occupational Exposure Record of Radiation Workers by Work Field)

  • 박제완;한지영;김용민
    • 한국방사선학회논문지
    • /
    • 제17권2호
    • /
    • pp.277-284
    • /
    • 2023
  • 작업환경에 따라 방사선학적 위험성이 상이하므로 해당 업종 환경에 대한 분석을 통해 방호 수단과 정책을 개발해야 한다. 방사선을 이용하는 업종 분야에서의 특성을 평가하는 것은 해당 업종의 수치만을 보는 것이 아니라 다른 업종과의 비교 분석을 통해 수행되어야 한다. 본 연구는 업종별 방사선 피폭 기록 비교를 위해 부처별 종사자 피폭 기록으로부터 평가 인자를 도출하고 이를 상대적으로 평가할 수 있는 다각형 모델을 개발하여 8개 방사선 이용 업종에 대해 적용하였다. 2020년 방사선 피폭 기록을 바탕으로 다각형 모델을 적용하여 방사선 업종의 피폭 기록을 기반으로 특성을 비교 평가하였다. 이를 통해 다각형 모델의 유용성을 확인하였으며 업종에 대한 방호 정책 방안을 제안하였다.

특허의 내적.외적 가치산정요인을 고려한 입체적 특허평가모델: 아레니우스 화학반응속도론 기반의 특허수명예측 (A three-dimensional patent evaluation model that considers the factors for calculating the internal and external value of a patent: Arrhenius chemical reaction kinetics-based patent lifespan prediction)

  • 최용묵;이재원;조대명
    • 디지털융복합연구
    • /
    • 제19권6호
    • /
    • pp.113-132
    • /
    • 2021
  • 특허수명은 특허가치를 평가하는 척도로 사용되어 왔다. 본 연구에서는 특허수명을 예측하여 개별특허의 가치를 평가함에 있어, 특허의 내적가치요소와 외적가치요소를 하나의 모델로 평가하기 위하여 화학반응속도 추정식으로 널리 알려진 아레니우스식을 사용한 새로운 평가모델을 제시하였다. 한국의 소멸된 특허데이터를 활용하여 평가모델의 성능을 검증하였으며, 선행연구에서 특허평가모델로 사용되었던 SVM, Logistic reg., ANN 모델과 성능을 비교하였다. 결과적으로, 제안한 평가모델이 다른 모델 보다 정확도가 높았으며, 특허권자의 특성을 고려한 상대체감비용지수 반영 시 여러 평가모델에서 정확도가 상승하는 경향을 보였다. 또한, 특허의 예측수명등급과 특허의 실제수명과는 강한 상관관계가 있었다. 이러한 평가모델은 대량의 특허를 객관적으로 신속하게 평가할 수 있으며 특허의 유지여부에 대한 의사결정 혹은 기술거래나 평가에 활용할 수 있다. 특히, 평가목적에 따라 특허만을 평가하거나 사업화주체나 기술적 특성을 고려한 평가가 필요한 경우에 각각 사용될 수 있다.

공공부문의 MIS 도입에 관한 연구

  • 서의호;최현아;이영민;서창교
    • 한국경영과학회:학술대회논문집
    • /
    • 한국경영과학회 1993년도 추계학술대회발표논문집; 서강대학교, 서울; 25 Sep. 1993
    • /
    • pp.6-7
    • /
    • 1993
  • MIS는 1970년대부터 국내기업에 도입되어 초기에는 단순한 데이타 처리용(TPS:Transaction Process System)으로 수립, 실행, 평가하는데 없어서는 안 될 요인이 되었다. 그러한 반면에 정부의 정보시스템 (IS:Information System)의 도입은 매우 저조한 수준에 머무르고 있다. 정부는 이익집단이 아니라는 이유 때문에 정부업무의 효율성을 위한 정보시스템 도입 방안-기자재의 도입, 새로운 시스템 구축, 우수한 인력의 도입-이 번번히 좌절되고 있다. 아울러 정부의 최고 의사결정자인 각료층의 잦은 교체도 IS 도입의 걸림돌이 되고 있다. 그러나 정부는 기업전체를 포함하여 국민을 전체 고객으로 상대하는 기관이라는 점에서 비록 이익집단은 아니더라도 전폭적인 투자가 필요하다. 가장 시급한 것은 각 부처의 정보를 종합한 통합된 데이타베이스의 구축이다. 이 중앙 데이타베이스에 의해서 정부는 보다 일관성 있고 신속하며 신뢰성 있는 정책을 결정하고 수행할 수 있을 것이다. 본 논문에서는 정부를 포함한 공공기관에 있어서 정보시스템 도입의 필요성에 대해서 분석해 보았다. 또 이를 토대로 정부 각 부처에 분산되어 있는 정보를 수집하여 통합된 데이타베이스를 구축하는데 필요한 개발모델을 세워보았다. 아울러 이러한 통합시스템의 파급효과 및 운용방법도 예측, 분석해 보았다.

  • PDF