Reinforcement Learning Paper
강화학습 기법을 이용한 TSP 의 해법 (A learning based algorithm for Traveling Salesman Problem) : 임준묵, 강진규, 길본일수, 임재국, 대한산업공학회, 2002
강화학습에 기초한 로봇축구 에이전트의 설계 및 구현 (Design and Implementation of Robot Soccer Agent Based on Reinforcement Learning) : 김인철, 한국정보처리학회, 2002
강화학습을 이용한 다중 에이전트 제어전략 (Multiagent Control Strategy Using Reinforcement Learning) : 김병천, 이형일, 한국정보처리학회, 2003
개미 집단 시스템에서 TD-오류를 이용한 강화학습 기법 (A Reinforcement Learning Method using TD-Error in Ant Colony System) : 정태충, 이승관, 한국정보처리학회, 2004
목표상태 값 전파를 이용한 강화학습 (Reinforcement Learning using Propagation of Goal-State-Value) : 윤병주, 김병천, 한국정보처리학회, 1999
미로환경에서 최단경로 탐색을 위한 실시간 강화학습 (Online Reinforcement Learning to Search the Shortest Path in Maze Environments) : 김병천, 김삼근, 윤병주, 한국정보처리학회, 2002
상태공간 압축을 이용한 강화학습 (Reinforcement Learning Using State Space Compression) : 윤병주, 김병천, 한국정보처리학회, 1999
지능형 에이전트의 환경 적응성 및 확장성 (A study on environmental adaptation and expansion of intelligent agent) : 백혜정, 박영택, 한국정보처리학회, 2003
퍼지 클러스터링을 이용한 강화학습의 함수근사 (Function Approximation for Reinforcement Learning using Fuzzy Clustering) : 이영아, 정태충, 정경숙, 한국정보처리학회, 2003
Ant Colony System에서 효율적 경로 탐색을 위한 지역갱신과 전역갱신에서의 추가 강화에 관한 연구 (A Study about Additional Reinforcement in Local Updating and Global Updating for Efficient Path Search in Ant Colony System) : 이승관, 정태충, 한국정보처리학회, 2003
강화학습을 이용한 웹 정보 검색 : 서울대 컴퓨터공학과 석사논문, 정태진, 2002
The National Science Foundation Workshop on Reinforcement Learning : Sridhar Mahadevan and Leslie Pack Kaelbling 17(4): Winter 1996, 89-93
A Review of Reinforcement Learning : Sebastian Thrun and Michael L. Littman 21(1): Spring 2000, 103-105
Reinforcement Learning : A Survey : Leslie Kaelbling, Michael Littman, Andrew Moore. Journal of Artificial Intelligence Research 4 (1996) pp. 237–285
Reinforcement Learning : Richard Sutton and Andrew Barto, MIT Press, 1998
Enhancing Transfer in Reinforcement Learning by Building Stochastic Models of Robot Actions : Sridhar Mahadevan, in Proceedings of the Ninth International Workshop on Machine Learning (ML92), pp.290-299, San Francisco: Morgan Kaufmann, 1992.
Automatic Programming of Behavior-Based Robots Using Reinforcement Learning : Sridhar Mahadevan, Artificial Intelligence, 55(1-2):311-365, 1992.