Reinforcement Learning  Paper

 

강화학습 기법을 이용한 TSP 의 해법 (A learning based algorithm for Traveling Salesman Problem) : 임준묵, 강진규, 길본일수, 임재국, 대한산업공학회, 2002

강화학습에 기초한 로봇축구 에이전트의 설계 및 구현 (Design and Implementation of Robot Soccer Agent Based on Reinforcement Learning) : 김인철, 한국정보처리학회, 2002

강화학습을 이용한 다중 에이전트 제어전략 (Multiagent Control Strategy Using Reinforcement Learning) : 김병천, 이형일, 한국정보처리학회, 2003

개미 집단 시스템에서 TD-오류를 이용한 강화학습 기법 (A Reinforcement Learning Method using TD-Error in Ant Colony System) : 정태충, 이승관, 한국정보처리학회, 2004

목표상태 값 전파를 이용한 강화학습 (Reinforcement Learning using Propagation of Goal-State-Value) : 윤병주, 김병천, 한국정보처리학회, 1999

미로환경에서 최단경로 탐색을 위한 실시간 강화학습 (Online Reinforcement Learning to Search the Shortest Path in Maze Environments) : 김병천, 김삼근, 윤병주, 한국정보처리학회, 2002

상태공간 압축을 이용한 강화학습 (Reinforcement Learning Using State Space Compression) : 윤병주, 김병천, 한국정보처리학회, 1999

지능형 에이전트의 환경 적응성 및 확장성 (A study on environmental adaptation and expansion of intelligent agent) : 백혜정, 박영택, 한국정보처리학회, 2003

퍼지 클러스터링을 이용한 강화학습의 함수근사 (Function Approximation for Reinforcement Learning using Fuzzy Clustering) : 이영아, 정태충, 정경숙, 한국정보처리학회, 2003

Ant Colony System에서 효율적 경로 탐색을 위한 지역갱신과 전역갱신에서의 추가 강화에 관한 연구 (A Study about Additional Reinforcement in Local Updating and Global Updating for Efficient Path Search in Ant Colony System) : 이승관, 정태충, 한국정보처리학회, 2003

강화학습을 이용한 웹 정보 검색 : 서울대 컴퓨터공학과 석사논문, 정태진, 2002

The National Science Foundation Workshop on Reinforcement Learning : Sridhar Mahadevan and Leslie Pack Kaelbling 17(4): Winter 1996, 89-93

A Review of Reinforcement Learning : Sebastian Thrun and Michael L. Littman 21(1): Spring 2000, 103-105

Reinforcement Learning : A Survey : Leslie Kaelbling, Michael Littman, Andrew Moore. Journal of Artificial Intelligence Research 4 (1996) pp. 237–285

Reinforcement Learning : Richard Sutton and Andrew Barto, MIT Press, 1998

Enhancing Transfer in Reinforcement Learning by Building Stochastic Models of Robot Actions : Sridhar Mahadevan, in Proceedings of the Ninth International Workshop on Machine Learning (ML92), pp.290-299, San Francisco: Morgan Kaufmann, 1992.

Automatic Programming of Behavior-Based Robots Using Reinforcement Learning : Sridhar Mahadevan, Artificial Intelligence, 55(1-2):311-365, 1992.