학 습
인간행동과 심리학 : 오세진.김형일.임영식.현명호.김병선.김정인.김한준.양병화.이재일.양돈규.최창호.이장한 공저, 학지사, 1999, Page 95~126
학습이란 유기체가 경험을 함으로써 나타날 수 있는 비교적 영속적인 행동상의 변화를 말한다. 일반적인 의미에서의 학습의 개념과는 달리 심리학에서의 학습은 교육적인 의미에서의 학습뿐만 아니라 걷기, 뛰기, 언어습득, 악기를 다루는 것 등과 같은 보다 넓은 의미의 행동을 포함한다. 인간이 가지고 있는 다양한 종류의 능력 중에서도 학습은 아마 가장 중요한 능력이라고 할 수 있을 것이다. 인간은 태어나면서부터 죽을 때까지 계속적으로 학습을 하게되고 이러한 계속적인 학습을 통하여 환경에 적응하여 살아갈 수 있게된다.
심리학에서 학습을 중요시해 온 이유는 우선 학습이 행동의 중요한 결정 요인이 된다는 점을 들 수 있다. 즉, 학습에 대한 이해 없이는 행동에 대한 이해를 할 수가 없기 때문에 학습은 심리학에서 매우 중요한 주제일 수밖에 없다. 또 한 가지 이유는 학습에 대한 이해는 인간 행동을 보다 효율적으로 통제할 수 있게 한다는 점이다. 즉, 학습에 대한 이해와 그 응용을 통하여 우리가 보다 나은 삶을 살아갈 수 있게 된다.
이러한 학습과 여기에 관여되는 여러 가지 변인들에 대해 살펴본다. 우선 고전적 조건화, 조작적 조건화의 개념에 대해 살펴본 후, 이어서 인지 학습에 대해 살펴보겠다.
"학습"이라는 단어를 생각할 때 일반적으로 사람들은 학교에서 하는 공부를 생각하기 쉽다. 그러나 심리학에서의 학습은 이보다는 훨씬 넓은 개념이다. 태어나서 학습없이 할 수 있는 행동은 극히 제한되어 있다. 우리는 학습을 통하여 실로 다양한 행동들을 배워가는 것이다. 말하자면 학습이란 비단 학교에서의 공부뿐만 아니라 젓가락질을 배운다든지, 신발끈을 맨다든지, 혹은 자전거 타는 것이나 운전을 배우는 것 등 다양한 것을 포함한다. 이렇게 우리는 지식과 여러 가지 기술들을 습득하고 경험을 통해 유지해 나간다. 학습을 정의하자면 "경험을 통하여 얻어지는 행동과 지식에서의 비교적 영속적인 변화"라고 할 수 있다.
포유류를 포함하여 많은 다른 동물들도 학습할 수 있는 능력을 가지고 있기는 하지만 인간만큼이나 그 능력이 뛰어난 종은 없다. 진화를 통하여 인간이 습득한 여러 가지 능력 중에서 가장 중요한 능력은 아마도 학습하는 능력일 것이다. 심리학자들이 학습에 관해 과학적인 연구를 시작한 것은 19세기 말기 부터였다. Darwin은 동물과 인간을 하나의 연속선상에 있는 것으로 보았으며, 이에 기초하여 심리학자들은 우선 동물들의 학습 현상에 대해 연구를 시작하였고, 동물 연구에서 밝혀진 원리들을 바탕으로 인간에게도 적용될 수 있는 학습 원리들을 찾아내고자 노력해 왔다. 이 장에서 앞으로 볼 수 있겠지만 많은 학습 원리들이 사실상 인간과 동물 모두에게 적용될 수 있는 원리라고 할 수 있다.
학습은 고전적 조건화 (classical conditioning), 조작적 조건화 (operant conditioning), 그리고 인지 학습 (cognitive learning) 의 세 가지로 구분된다. 고전적 조건화는 행동과 그 결과 간의 연합에 의한 학습이라고 할 수 있다. 그리고 인지 학습이란 입수된 정보의 정신적 조작을 통한 학습이라고 할 수 있다.
고전적 조건화(classical conditioning) 는 반응 조건화 (respondent conditioning) 혹은 파블로프 조건화 (povlovian conditioning) 와 동일한 의미를 가지고 있다. 특히 파블로프 조건화라는 말은 고전적 조건화가 Ivan Pavlov 에 의해 최초로 세계적인 연구가 시작되었다는 점에서 나온 명칭이다.
Pavlov는 소화에 관한 연구를 하면서 개에게 고깃가루를 먹이는 것과 타액의 분비현상에 대해 관심을 가졌다. 개의 타액은 타액 분비선에 튜브를 연결시켜 측정하였는데, 고깃가루를 줄 때마다 이 고깃가루와 연합된 자극에 대해서도 개가 타액을 분비한다는 것을 발견 하였다. 다시 말하면 고깃가루를 담았던 그릇, 고깃가루를 주었던 실험 보조원, 심지어는 실험 보조원의 걸음 소리 등에 대해서도 개가 타액을 분비하게 된다는 사실을 발견하였다.
사실 처음에 Pavlov는 이러한 현상 때문에 매우 난처해 했다고 한다. 왜냐하면 이 실험의 실제 목적은 소화에 관한 것이었는데, 이러한 현상 때문에 개의 타액 분비를 제대로 통제할 수 없었기 때문이었다. 그러나 Pavlov는 곧 원래의 목적이었던 소화에 관한 연구보다는 이 현상에 보다 더 많은 관심과 흥미를 가지게 되었고, 그 후 고전적 조건화 연구에 평생을 바쳤다.
앞에서 간략히 언급하였듯이, 고전적 조건화에서는 처음에는 어떠한 기능도 하지 않았던 자극이 특정 반응을 유출시킬 수 있는 능력을 가지게 된다. 어떻게 이러한 현상이 나타나게 되는지 살펴보자.
고전적 조건화를 시도하기 위해서는 먼저 반사 반응(reflexsive response)을 유출시키는 자극을 찾아야 한다. 이 자극을 무조건 자극(unconditioned stimulus:UCS)이라고 하며, 이 자극에 의해 자동적으로 유출되는 반응을 무조건 반응(unconditioned response:UCR) 이라고 한다. 예를 들면, Pavlov의 실험에서 고깃가루는 타액 분비를 일으키는 무조건 자극이며, 이 자극에 의한 타액 분비는 무조건 반응이라고 할 수 있다. 고전적 조건화를 형성시키기 위한 다음 단계는 무조건 자극과 중립 자극 (neutral stimulus:NS,원래는 무조건 반응을 일으키지 않는 자극) 을 서로 연합시키는 과정이다. 이러한 연합과정을 여러차례 반복하게 되면 중립 자극은 결국 무조건 자극이 없이도 반응을 유출시킬 수 있게 된다.
이렇게 중립 자극만으로도 반응을 유출시킬 수 있게 될 때 이 중립 자극을 조건 자극(conditioned stimulus:CS)이라고 부르며, 이 자극에 의해 유출되는 반응은 조건반응(conditioned response:CR)이라고 부른다. Pavlov의 실험에서는 고깃가루가 무조적 자극으로 사용되었으며, 이에 대한 무조건 반응은 타액 분비였다. 그리고 중립 자극으로서는 종소리가 사용되었다. 종소리와 무조건 자극이 여러 차례 짝을 지워 제시된 후, 종소리는 그 자체로서 타액 분비를 일으킬 수 있는 조건자극(CS)이 되었으며, 이때 이 조건 자극에 의해 나오는 타액 분비는 조건 반응(CS)이라고 부른다.
이러한 고전적 조건화를 형성하는 과정에서 무조건 자극과 중립 자극을 짝지우는 방법에는 여러 가지가 있을 수 있으며, 고전적 조건화의 효율성은 이러한 방법에 따라 많은 영향을 받는다.
지연 조건화(delayed conditioning) 과정에는 두 가지 종류가 있다. 하나는 중립 자극이 먼저 제시되고 이 중립 자극이 일정 시간 유지된 후 없어짐과 동시에 무조건 자극이 제시되는 방법이며, 또 한 가지 방법은 중립 자극이 제시되고 있는 중에 무조건 자극이 제시되어 두 자극이 동시에 제시된 상태로 일정 시간이 지난 후 두 자극을 동시에 끝나게 하는 방법이다. 이 두 가지 방법은 조건 반응을 유출하는데 효과적인 것으로 알려져 있다.
흔적 조건화(trace conditioning)에서는 중립 자극의 철회와 무조건 자극의 제시 사이에 어느 정도의 시간 간격이 있는 것을 말한다. 이 방법 또한 효과적인 방법으로 알려져 있으나, 시간 간격이 짧을 경우에만 효과적이라고 할 수 있다.
동시 조건화(simultaneous conditioning)에서는 중립 자극과 무조건 자극이 동시에 제시되었다가 동시에 없어지게 되는데, 이 방법은 일반적으로 효과적이지 못한 것으로 알려져 있다.
마지막으로 역행 조건화(backward conditioning)에서는 무조건 자극이 제시되고 철회된 후 중립 자극이 제시되는 방법인데 이 방법 역시 효과적이지 못한 것으로 알려져 있다.
어떤 중립 자극이 고전적 조건화 과정을 통하여 조건 자극이 되었을 때, 이 조건 자극이 또 다른 중립 자극과 반복적으로 연합되면 이 새로운 중립 자극도 조건 반응을 일으킬 수 있는 또 하나의 조건 자극이 될 수 있다. 이러한 현상을 이차적 조건화(second-order conditioning)라고 하며, 이차적 조건화 이상의 조건화를 총칭하여 고전적 조건화(higher-order conditioning)라고 한다.
예를 들면, Pavlov의 실험에서의 개는 조건 자극인 종소리에 조건 반응을 타액 분비를 일으키도록 조건화 하였다. 여기서 만약 또 다른 중립 자극으로서 빨간 불빛을 종소리와 반복적으로 연합시키면 불빛도 결국에는 타액 분비를 일으킬 수 있게 된다. 이것을 이차적 조건화라고 하며, 이 과정을 반복하여 빨간 불빛을 또 다른 중립 자극과 연합시키면 개념적으로는 삼차적 조건화도 가능하다. 그러나 일반적으로 이차적 조건화 이상은 현실적으로 이루어 내기가 매우 힘들다. 그 이유는 삼차적 조건화부터는 소거의 과정이 포함되기 때문이다. 소거에 대해서는 아래에서 살펴볼 것이다.
고전적 조건화가 일단 형성되었다고 할 때, 조건 자극이 무한정 조건 반응을 유출시킬 수 있는 것은 아니다. 다시 말하면, 조건 자극이 조건 반응을 계속적으로 유출시킬 수 있게 하기 위해서는 적어도 가끔씩은 조건 자극과 무조건 자극을 연합시켜 주어야 한다. 만약 조건화가 형성된 후 무조건 자극이 전혀 나오지 않고 조건 자극만 계속 제시하게 되면 조건 자극의 효과가 점점 떨어지게 되고 결국에는 조건 반응을 유출시키지 못하게 된다. 이와 같이 무조건 자극이 조건 자극과 연합되지 않음으로써 조건 자극이 반응을 일으키지 못하는 현상을 소거(extinction)라고 한다. 예를 들면, Pavlov의 실험에서 종소리를 들려주고 난 후 음식을 전혀 주지 않게 되면 종소리는 결국 타액 분비를 일으키지 못하게 된다. 소거가 된 것이다.
그러나 Bouton과 Swartzenruber(1991)에 의하면, 소거는 조건 반응을 단지 억제시킨 것에 불과하며, 완전히 제거시킨 것은 아니라고 한다. 이것은 소거 과정을 통하여 일단 조건 자극이 능력을 상실한 것으로 보이더라도 어느 정도의 시간이 자난 후 조건 자극을 제시하면 다시 조건 반응을 일으키는 현상에서 알 수 있다. 물론 계속적이면서도 장기간에 걸친 소거는 결국 조건 자극의 능력을 완전히 제거시킬 수 있겠지만, 소거 후에 이전의 조건 자극을 다시 제시하면 이러한 현상이 일반적으로 나타나는데 이것을 자발적 회복(spontaneous recovery)이라고 부른다. 그러나 이러한 자발적 회복에서의 조건 자극의 효과는 소거 이전의 효과보다는 매우 약하며, 다시 소거 과정에 들어가면 이전에 소거될 때보다 훨씬 빨리 소거가 된다.
어떤 자극이 일단 조건 자극으로서 형성되고 나면 이 자극과 유사한 다른 자극들도 무조건 자극과 연합된 적이 없음에도 불구하고 조건 반응을 유출시킬 수 있게 되는데, 이러한 현상을 자극 일반화 (stimulus generalization) 라고 한다.
예를 들어, 어린아이가 벌에게 쏘인 경험이 있다고 하자. 그러면 벌에게 쏘인 것은 무조건 자극이라고 할 수 있다. 즉, 벌에게 쏘이면 그 고통 때문에 어린아이가 울게 되는 반응이나 혹은 이와 관련된 생리적 현상이 생기게 되고 이러한 여러 가지 특징(크기, 모양, 색깔, 움직임, 소리) 들이 무조건 자극과 연합되어 있다고 볼 수 있고, 이러한 특징들이 조건 자극으로서 작용할 수 있다. 그래서 벌을 보게 되면 아이는 벌에 쏘였을 때와 유사한 반응을 하게 된다.
한편 아이는 설사 벌이 아니더라도 벌과 비슷한 특징을 가진 벌레를 보게 되면 벌을 보았을 때와 비슷한 반응을 보이게 되는데, 이 현상이 자극 일반화의 전형적인 예이다. 우리 나라 속담 중에 "자라 보고 놀란 가슴 솥뚜껑 보고 놀란다."는 속담 역시 자극 일반화를 설명하는 현상이라고 볼 수 있다. 이러한 자극 일반화 현상은 자극 일반화를 일으키는 자극과 본래의 조건 자극의 유사성에 따라 그 정도가 달라질 수 있다. 일반적으로 그 자극이 조건 자극과 유사할수록 일반화가 더 쉽게 일어난다.
변별(discrimination) 이란 자극 일반화와 정반대의 현상이다. 바꾸어 말하면, 자극 일반화 현상은 변별 과정을 통하여 없어질 수도 있다. 위의 예에서 어린아이는 성장하면서 벌이 아닌 다른 벌레들에 의해서는 아무런 고통을 받지 않게 되고 동시에 벌에 의해서는 가끔씩은 다시 고통을 받게 되는 경험을 되풀이하게 된다면, 벌과 다른 벌레에 대한 아이의 반응은 서로 차이가 나게 된다. 즉, 벌에 의해서는 고통과 관련된 다양한 생리적 반응을 보이지만 벌이 아닌 다른 벌레들에 의해서는 그러한 반응을 보이지 않게 되는데, 이러한 현상을 변별이라고 한다.
고전적 조건화는 우리에게 어떤 중요성을 지니는가? 만약 고전적 조건화를 단순히 타액 분비나 혹은 몇몇 전문적인 용어로서만 생각한다면 별로 중요한 것이 없어 보이나 실제로 우리가 살아가는 데 매우 중요하다. 이를테면, 고전적 조건화를 통하여 우리는 인간의 정서나 감정뿐만 아니라 공포증의 형성에 대해서도 설명이 가능하며, 약물 의존성, 미각혐오 학습 등 인간에게 있을 수 있는 다양한 현상에 대한 설명도 최소한 부분적으로는 가능하다.
예를 들면, 학교에 가기 싫어하는 아동들의 경우 학교에 대한 부정적 느낌이 고전적 조건화를 통해 형성되었을 가능성이 충분하다. 만약 어떤 아동이 학교에서 선생님에게 반복적으로 야단을 맞았거나, 더 심하게는 매를 맞았다고 가정해 보자. 그렇다면 선생님의 야단이나 매는 불쾌한 정서를 만들어 내는 무조건 자극이라고 할 수 있고, 이 무조건 자극은 학교가 가지고 있는 여러 가지 특징들과 연합하게 된다. 그래서 학교의 분위기, 교실, 선생님의 얼굴, 심지어 친구들의 모습 등이 불쾌한 정서를 만들어 내는 무조건 자극과 연합되어 조건자극으로서의 역할을 하게 된다. 이러한 특징만으로도 아동은 불쾌한 감정을 가지게 될 수 있고, 결과적으로 학교에 가는 것을 싫어하게 될 수 있다.
이러한 현상은 약 300년 전 John Locke에 의해서도 발견된 적이 있다. Locke는 선생님께 벌을 받은 적이 있는 아이들이 책이나 그밖에 학교와 연관이 있는 다른 자극에 대해 공포감을 형성한다는 것을 발견하였다(Locke, 1690, 1956). 오늘날 이러한 현상을 "학교 공포증(school phobia)"이라 부른다.
미각혐오 학습(taste aversion learning)은 단순한 조건 반사 이상의 특이한 성격이 있기는 하지만 재미있는 고전적 조건화의 한 예이다. 미각혐오 학습은 1950년대에 Garcia와 그의 동료(1956)들이 처음 발견하였다. 그들은 쥐에게 사카린 맛이 나는 물을 섭취토록 한 뒤 구토를 일으키게 하는 효과를 가진 감마선에 노출시켰다. 감마선에 노출되기 전에는 쥐들이 순수한 물보다 사카린물을 더 선호하였으나, 사카린 물을 섭취하고 감마선에 노출시킨 이후에는 사카린 물보다 순수한 물을 더 선호하게 된다는 것이 밝혀졌다. 즉, 사카린 물이 구토를 일으키는 감마선과 단 한 번 연합이 됨으로써 쥐들은 사카린 물을 회피하는 현상을 보였다.
그러나 이러한 미각혐오 학습은 세 가지 측면에서 일반적인 고전적 조건화와 차이점이 있다.
첫째, 일반적으로 전형적인 고전적 조건화에서는 조건 자극과 무조건 자극이 적어도 여러 번 연합이 되어야 하지만, 미각혐오 학습에서는 조건 자극과 무조건 자극이 단 한 번의 연합으로도 조건화가 이루어진다. 둘째, 전형적인 고전적 조건화에서는 조건 자극과 무조건 자극의 제시 시간 간격이 매우 짧아야 하지만(대부분 수초 이내), 미각혐오 학습에서는 그 간격이 길더라도(수분 혹은 수시간) 조건화가 가능하다. 셋째, 미각혐오 학습은 반사적 행동뿐만 아니라 조작적 행동(operant behavior)도 포함하고 있다. 즉, 미각혐오 학습이 일어나게 되면 앞에서 보았듯이 구역질과 연합되었던 자극과 접촉하는 것을 회피하게 되는데, 회피 행동은 반사적 행동이 아니라 조작적 행동이다. 조작적 행동에 대해서는 다음 절에서 자세히 언급할 것이다.
이러한 미각혐오 학습은 쥐뿐만 아니라 다른 동물에서도 관찰되고 있으며, 인간에게서도 나타나는 일반적인 현상이다. 아마 많은 사람들이 특정한 음식을 먹고 소화불량이나 혹은 다른 이유로 구토를 한 경험이 있다면, 그 음식을 쳐다보기도 싫거나 심지어는 생각조차 하기 싫은 경험들이 있을 것이다. 또한 미각혐오 학습과 유사한 현상이 방사선 치료나 화학 요법을 사용하는 암환자들에게서도 일어난다. 문제는 환자들이 치료를 받던 병원에 오게 될 때 구토를 느끼게 된다는 것이다.
이러한 현상은 물론 고전적 조건화에 의한 것이다. 즉, 병원이 포함하고 있는 여러 가지 특징들이 일련의 자극들이 되는 것이고, 이러한 자극들이 구토를 유발시키는 치료와 일관성 있게 연합됨으로써 고전적 조건화를 통하여 조건 자극이 되고, 이 조건 자극들이 조건 반응인 구토를 유발하게 되는 것이다.
고전적 조건화는 성적 각성(sexual arousal)을 통제하는 자극에 있어서도 역할을 한다. 어떤 자극들은 성적 각성을 유발시키는 데 무조건 자극으로서 작용하며, 또 어떤 자극들은 처음에는 이러한 역할을 하지 않으마 무조건 자극과 여러 번 연합됨으로써 성적 각성을 유발시키는 기능을 가지기도 한다. Farris(1967)는 이러한 현상을 동물을 대상으로 한 실험에서 증명한 바 있다.
Farris는 숫일본메추라기(Japanese quail)의 성적 각성이 부저 소리에 쉽게 조건화될 수 있다는 사실을 발견하였다. 처음에는 중립 자극(NS)이었던 부저 소리(CS)를 10초 동안 들려주고 그 즉시 암컷을 수컷의 둥지에 넣어 주었다. 그리고 암컷은 교미가 이루어질 때까지 혹은 부저 소리가 울린지 1분이 흐를 때 까지 수컷의 둥지에 놓아 두었다. 이러한 절차를 몇번 반복한 뒤에 수컷은 부저 소리가 울리면 교미 행동을 보이기 시작하였고, 32회의 연합이 이루어진 후에는 실험 대상이 되었던 모든 수컷들이 완전한 교미 행동을 보여주었다.
Rachman과 Hodgson(1968)은 Farris가 사용한 것과 유사한 실험 절차를 사용하여 여성의 부츠에 대해 남성들의 성적 각성을 유발시키는 실험을 실시한 바 있다. 피험자들에게 처음에는 여성의 부츠를 찍은 컬러 슬라이드(CS)를 보여주고, 그 뒤 매력적인 여성의 나체 사진(US)을 보여주었다. 이 실험의 초반에는 무조건 자극(여성의 나체 사진)만이 남성의 발기를 유발시켰고 조건 자극(부츠의 컬러 슬라이드)은 발기를 유발시키지 못하였다. 그러나 몇 번의 연합후에는 조건 자극도 발기를 유발시키기 시작하였다. 그리고 무조건 자극의 제시 없이 조건 자극만이 계속적으로 제시되었을 때에는 소거 현상이 일어나 발기를 유발시키지 못하는 것이 관찰되었다.
이 연구는 비정상적인 성행동의 하나인 비성적 대상물에 대해 성적 흥분을 느끼는 현상(sexual fetishes)의 형성 과정에 고전적 조건화가 어떤 역할을 할 수 있다는 점을 시사하고 있다.
약물 의존성 역시 고전적 조건화를 통하여 일부 설명될 수 있다. 일반적으로 약물은 특정한 생리적 반응을 유출시키는 무조건 자극이라고 할 수 있으며, 약물을 거듭할수록 동일한 효과를 얻기 위해서 더 많은 약물이 필요하게 되는데, 이것은 내성(tolerance)이 증가되기 때문이다. 이러한 내성의 증가 현상을 부분적으로 고전적 조건화의 과정으로 설명할 수 있다. 약물의 투여와 연관되는 자극들은 계속적인 연합을 통하여 조건 자극으로 형성되고, 이 조건 자극은 약물이 만들어 내는 반응과 반대되는 생리적 반응을 유출시키는 것으로 밝혀졌다.
예를 들면, 헤로인은 호흡이 억제되는 효과를 가지고 있는데, 헤로인과 연합된 조건 자극은 반대로 호흡이 빨라지는 효과를 가져오게 한다. 또한 헤로인 투여를 늘릴수록 이와 연합된 조건 자극의 효과는 계속적인 연합을 통하여 점점 커지게 된다. 그리고 조건 자극에 의해 유출된 반응은 헤로인에 의해 유출되는 반응과 상반되므로 헤로인을 투여하지 않으면 약물 중독자는 조건 자극에 의해 나타난 생리적 반응 때문에 금단 증상을 느끼게 된다. 그리고 이전 보다 더 많은 양의 헤로인을 투여하여 조건 자극이 유출시킨 반응을 상쇄시켜야 한다. 이것이 바로 내성이 생기는 원인이라고 할 수 있다.
헤로인 중독자가 보통 헤로인을 투여하는 장소가 아닌 다른 낯선 장소에서 헤로인을 투여한 후 호흡 장애로 사망하는 경우가 자주 발생하는데, 그 이유를 여기서 찾을 수 있다. 말하자면, 낯선 장소에서는 헤로인의 효과를 상쇄시켜 줄 수 있는 조건 자극이 없는 상황이 되며, 이것은 평소에 투여하는 헤로인의 양에 따른 생리적 반응인 호흡 억제현상이 지나치게 높아진다는 것을 의미하게 된다.
조작적 조건화는 B. Skinner 에 의해 가장 체계적으로 연구되었으며, 개념적으로 고전적 조건화와 조작적 조건화를 명백히 구분한 사람도 바로 Skinner 이다. Skinner의 이러한 업적에는 많은 사람의 영향이 있었으며, 그 중 한 사람이 Throndike이다.
미국에서 심리학을 공부했던 E. Thorndike 는 그 당시 자극과 반응과의 관계에 대해 연구했던 러시아 심리학자들과는 달리 행동과 그 결과 간의 관계성에 대해 연구하였다.
문제상자에는 고양이를 넣어 두고 고양이가 나무페달을 밟으면 문이 열리도록 고안되어 있었다. 행동과 결과 간의 관계성을 연구하기 위해 Thorndike 는 문제상자 않에 굶주린 고양이를 넣어 두고 밖에는 생선을 놓아 두었다. 그리고 이 상황에서 고양이가 문제상자를 빠져 나오는 데 걸리는 시간을 측정하였다.
처음에는 고양이가 즉각적으로 페달을 밟아 문을 열고 나오지 못하고 여러 가지 관련 없는 행동들을 하였으나, 결국에는 우연히 페달을 밟아서 문제상자를 빠져나오게 되었다. 그리고 시행을 거듭할수록 고양이가 문제상자를 빠져 나오는 데 걸리는 시간이 점점 단축되었다. 이 현상을 Thorndike 는 효과의 법칙 (law of effect) 이라고 불렀다. 효과의 법칙이란 만족스러운 결과를 가져오게 하는 행동은 강해지고 불만족스러운 결과를 가져오는 행동은 약해지는 현상을 말한다.
Thorndike 의 실험에서 본다면 문제상자의 문을 열리게 하고 결과적으로 바깥에 있는 생선을 먹을 수 있게 했던 페달을 밟는 행동은 강해졌고, 문제상자 안에 그대로 남아 있게 했던 여러 행동들은 약해졌다고 볼 수 있다. Thorndike 는 이러한 전체적인 과정을 도구적 조건화(instrumental conditioning) 라고 불렀다. 이는 행동이 어떤 결과를 초래하는 데 있어서 도구적 역할을 하였기 때문이다.
Thorndike 에게서 영향을 받은 Skinner 는 도구적 조건화 라는 용어 대신 조작적 조건화(operant conditioning) 라는 용어를 사용하였다. 이는 사람들이 바람직한 결과를 이끌어 내기 위해 단지 어떤 자극에 대해 수동적으로 반응하는 것이 아니라 환경상에 어떤 능동적인 "조작"을 가한다는 의미에서 나왔다고 할 수 있다. Skinner 가 연구한 조작적 조건화의 원리로서는 긍정적 강화(positive reinforcement), 부정적 강화(negative reinforcement), 소거(extinction), 처벌(punishment) 등을 들 수 있다.
정적 강화란 어떤 특정한 행동이 나오고 이 행동 뒤에 즉각적으로 주어지는 자극의 제시에 의해 이후의 행동의 빈도가 증가되는 과정을 말한다. 그리고 여기서 행동의 빈도를 증가시키는 역할을 한 자극을 강화인(reinforcer)이라고 한다. 정적 강화의 예는 우리 주위에서 얼마든지 찾아볼 수 있다. 예를 들면, 어떤 어린이가 어머니의 심부름을 하고 나자 어머니가 과자를 주었고, 그로 인해서 다음에도 그 어린이가 어머니의 심부름을 더 자주 하게 되었다면, 이 때 어린이의 심부름 행동이 증가한 것은 정적 강화에 의한 행동의 예라고 할 수 있다.
여기서 주의해야 할 것은 강화인이 어떤 특성을 지니고 있는지와 관계없이 이후의 행동이 증가되어야만 강화라고 할 수 있다. 다시 말하면 위의 예에서 만약 어머니가 과자를 주었음에도 불구하고 다음에 그 어린이가 어머니의 심부름을 자주 해 주지 않는다면 이것은 강화라고 할 수가 없다.
부적 강화는 행동의 빈도를 증가시킨다는 측면에서는 정적 강화와 동일하다. 그러나 과정 면에서는 정적 강화와 약간의 차이가 있다. 정적 강화는 행동의 결과로서 어떤 자극이 주어짐으로써 이후 행동의 빈도가 증가하게 되는 반면에, 부적 강화에서는 행동의 결과로서 어떤 자극이 없어짐으로써 행동의 빈도가 증가하게 되는 과정을 말한다. 예를 들면, 도피 행동(escape behavior)이나 회피 행동(avoidance behavior)이 여기에 속한다.
도피 행동이란 이미 어떤 혐오 자극이 존재하고 있을 때 특정 행동을 함으로써 혐오 자극을 없애는 행동을 말한다. 예를 들어, 방의 공기가 너무 더울 때 방의 창문을 여는 행동은 더운 공기라는 혐오적인 상황이 없어졌다는 의미에서 도피 행동이라고 할 수 있다. 그리고 창문을 여는 이 행동은 이후 다시 방이 더울 때 일어날 가능성이 높다는 측면에서 부적 강화를 받았다고 할 수 있다.
회피 행동이란 도피 행동에서처럼 혐오 자극이 현재 존재하고 있지는 않지만 미리 어떤 행동을 함으로써 혐오적인 상황이 닥치지 않게 하는 행동을 말한다. 예를 들어 어떤 학생이 TV를 보고 있으면 어머니가 항상 잔소리를 한다고 가정해 보자. 이런 경우 만약 그 학생이 TV를 보고 있을 때 어머니가 오시자 어머니가 잔소리를 시작하기 전에 미리 TV를 끄고 공부하러 간다면 이것은 회피 행동이라고 할 수 있다. 이러한 회피 행동 역시 부적 강화의 예가 될 수 있다. 왜냐하면 TV를 보고 있는 상황에서의 어머니는 잔소리와 거의 같은 혐오 자극이라고 할 수 있고, TV를 끄고 공부를 하러 감으로써 혐오 자극인 어머니의 잔소리를 듣지 않아도 되기 때문이다.
강화인의 종류
정적 강화 및 부적 강화에서 행동의 빈도를 증가시켜 주는 역할을 하는 강화인에는 여러 가지가 있다. 무조건 강화인(unconditioned reinforcers)이라고도 불리는 일차적 강화인(primary reinforcement)은 유기체의 어떤 특별한 경험 없이도 행동을 증가시키는 역할을 하는 강화인이다. 예를 들면 음식, 물, 공기 등이 여기에 속한다. 일차적 강화인과는 달리 조건화된 강화인(conditioned reinforcers)이라고도 불리는 이차적 강화인(secondary reinforcers)은 행동의 빈도를 증가시키는 효과가 일차적 강화인과 연합됨으로써 생기게 된다. 예를 들면, 돈이라는 것은 돈을 사용해 본 경험이 없는 어린이들에게는 아무런 소용이 없다. 그러나 좀더 성장한 어린이들에게 돈은 다양한 종류의 일차적 강화인과 관련되어 있기 때문에 강화인으로서의 효과가 있는 것이다. 그리고 돈과 같이 다양한 종류의 일차적 강화인과 관련되어 있는 이차적 강화인을 일반화된 강화인이라 한다.
지금까지 언급한 강화인은 주로 환경상의 자극이나 사건 등의 물질적인 것을 의미하였다. 그러나 물질적인 것이 아니라도 강화인의 역할을 할 수 있다. Premack(1962)은 물질적인 자극이 아닌 어떤 행동이 강화인의 역할을 할 수 있다는 사실을 발견하였다. Premack에 의하면, 발생 확률이 높은 행동은 발생 확률이 낮은 행동을 증가시키기 위한 강화인으로 사용될 수 있다. 에를 들어, 아이들에게 만화를 볼 기회와 공부할 기회를 동시에 준다면 아마도 아이들은 만화 보는 것을 더 좋아할 것이다. 여기서 만화 보는 것은 발생 확률이 높은 행동이고 공부하는 것은 발생 확률이 낮은 행동이다. 이러한 프리맥의 원리에 따라 아이들로 하여금 공부를 더 하게 하기 위해서는 공부(저확률 행동)를 어느 정도 하고 난 후에 만화를 보게 해 주면(고확률 행동) 공부하는 행동이 증가될 수 있다.
강화계획
강화인이 어떤 행동을 형성시키고 유지시키는 데 있어서 중요한 역할을 하는 것은 사실이지만 강화 계획이 어떤가에 따라 행동이 학습되는 속도와 패턴, 그리고 지속성 등이 달라진다. 강화 계획(reinforcement schedule)이란 간단히 말해서 어떤 행동 후에 나오는 강화인이 어떤 방식으로 제공되느냐를 말해 주는 것이다. 예를 들어 특정 행동을 학습시키고자 할 때 그 행동이 나올 때마다 매번 강화인을 제공해 줄 때 이를 계속적 강화(continuous reinforcement:CRF)라고 한다. 심리학자들이 인간이나 동물의 행동을 연구하기 위해 사용하는 강화 계획은 계속적 강화 이외에 수없이 많은 종류가 있다. 그러나 여기에서는 가장 기초적인 강화 계획 몇 가지만 살펴보기로 하자.
행동이 나올 때마다 매번 강화가 주어지는 계속적 강화 이외의 강화는 모두 간헐적 강화(intermittent reinforcement)라고 볼 수 있다. 간헐적 강화란 행동이 일어날 때마다 매번 강화가 주어지지는 않는 경우를 총칭하는 것이다. 간헐적 강화는 다시 비율 스케줄(ratio schedule)과 간격 스케줄(interval schedule)로 나뉘어진다. 비율 스케줄은 강화인이 제공되는 방식이 유기체의 반응에 따라 결정되며, 반면에 간격 스케줄은 강화인이 제공되는 방식이 유기체의 반응뿐만 아니라 시간에도 기초를 두고 있다.
비율 스케줄은 다시 고정 비율(fixed-ratio: FR)과 변동 비율(variable ratio: VR)스케줄로 나누어진다. 고정 비율 스케줄에서는 매 n 번의 반응마다 강화인이 주어지는 스케줄이다. 예를 들면, FR 3이라는 스케줄은 특정 행동을 세 번했을 때마다 강화인이 한 번씩 주어지는 스케줄이다. 앞에서 언급한 계속적 강화(CRF)는 그러므로 FR 1과 동일한 스케줄이다. 반면 변동 비율 스케줄에서는 평균적으로 n 번의 반응마다 강화인이 주어지는 스케줄이며, 정확하게 몇 번째 반응에 강화인이 주어지는지는 알 수가 없다. 다만 정해진 시간 내에 반응 수와 강화인의 수를 계산해 보면 평균적으로 n 번의 반응마다 강화인이 주어진 경우이다. 예를 들어 VR 5의 경우, 어떤 경우에는 세 번째 반응에 강화인이 주어질 수 있고, 또 어떤 경우에는 10번째 반응에 강화인이 주어질 수 있다. 그러나 반응 수를 합하고 이를 강화인의 수로 나누게 되면 다섯 번의 반응에 대해 한 번의 비율로 강화인이 주어진 경우이다.
간격 스케줄도 고정 간격(fixed-interval: FI)과 변동 간격(variable-interval: VR)스케줄로 나누어진다. 고정 간격 스케줄에서는 정해진 시간이 지난 후의 첫 번째 반응에 강화인이 주어지고, 강화인이 주어진 시점에서 다시 정해진 시간이 지난 후의 첫 번째 반응에 강화인이 주어지게 된다. 예를 들어, FI 30초의 스케줄에서는 30초가 경과하기 전에 나온 반응은 아무런 강화를 받지 못하고 30초가 지난 후 첫 번째 반응에 강화가 주어지며, 이 시점에서 다시 30초가 지난 후의 첫 번째 반응에 강화가 주어지는 식으로 진행된다.
변동 간격 스케줄에서는 평균적으로 어떤 정해진 시간이 지나간 다음의 첫 번째 반응에 강화인이 주어지고, 강화인이 주어진 시점에서 다시 평균적으로 정해진 시간이 지난 다음의 첫 번째 반응에 강화인이 주어지는 형식으로 진행된다. 예를 들어, 변동 간격 10초(VI 10초)라는 스케줄이 있다면, 어떤 경우에는 10초가 지난 후 첫 번째 반응에 강화인이 주어질 수 있고, 어떤 경우에는 15초가 지난 후의 첫 번째 반응에 강화인이 주어질 수 있다. 그러나 총 반응 시간을 구하고 이를 주어진 강화인의 수로 나누면 평균적으로 10초가 지난 후 첫 번째 반응에 대해 한 번의 비율로 강화인이 주어진 경우이다.
지금까지 언급한 네 가지 스케줄은 반응 패턴과 반응률에 있어서 차이가 있다. 우선 고정 비율과 고정 간격 스케줄에서는 강화를 받은 후 일시적으로 반응이 중단되는 특성이 있다. 그 이유는 강화인의 제공에 대한 예측이 어느 정도 가능하기 때문이다. 이에 비해 변동 비율과 변동 간격 스케줄에서는 반응이 중단되지 않고 지속적으로 나오는 경향이 있다. 이는 강화인에 대한 예측이 불가능하기 때문이다. 그리고 비율 스케줄과 간격 스케줄을 비교할 때, 일반적으로 비율 스케줄이 간격 스케줄보다 더 높은 반응률을 만들어 낸다. 이는 비율 스케줄에서는 시간이 아니라 반응의 수에 따라 강화인이 주어지도록 되어 있기 때문이다.
고전적 조건화에서의 소거가 무조건 자극과 조건 자극의 연합이 줄어듦에 따라 조건 반응의 소거가 이루어지는 반면, 조작적 조건화에서는 강화에 의해 행동의 빈도가 증가된 경우 강화인의 제공이 감소됨에 따라서 그 행동의 빈도가 감소하게 되고 이때 소거가 이루어졌다고 말한다. 즉, 조작적 조건화에서의 소거란 강화인이 더 이상 나오지 않게 될 때 행동의 빈도가 감소하는 현상을 말한다. Skinner는 이러한 소거 현상을 우연히 발견하였다고 한다. 실험실에서 쥐에서 지렛대를 누르는 행동을 학습시키는 도중 기계의 오작동으로 지렛대를 눌러도 음식이 나오지 않았다. 그래서 쥐의 지렛대를 누르는 행동이 점차 감소하여 결국에는 완전히 나타나지 않는 현상을 발견하였다.
인간의 경우에도 소거 현상을 흔히 발견할 수 있다. 한 학생이 선생님의 질문에 답하기 위해 손을 아무리 들어도 선생님이 답을 말할 기회를 주지 않으면 어느 정도까지는 행동이 유지되나 결국에는 더 이상 손을 들지 않게 된다. 이것 역시 소거의 예라고 할 수 있다.
이러한 소거는 이전에 행동이 어떠한 강화 계획에 의해 강화되었는지에 따라 그 속도가 달라진다. 간헐적 강화는 일반적으로 계속적 강화보다는 소거가 잘 되지 않는다는 특징이 있다. 왜냐하면 계속적 강화에서는 행동이 일어날때마다 강화가 주어졌기 때문에 소거 과정에서 강화를 받지 못하면 상황에 있어서 소거 이전과 매우 큰 차이가 있는 것이고, 반면에 간헐적 강화를 받아 온 경우에는 행동을 하더라도 강화를 받지 않은 경우가 있었기 때문에 소거 과정이 이전과 큰 차이가 없기 때문이다. 이와 관련된 예로 도박을 들 수 있다. 도박에 한 번 빠진 사람이 쉽게 도박에서 헤어나올 수 없게 되는 것을 우리는 흔히 볼 수 있는데, 이것은 도박 행동이 간헐적으로(변동 비율 스케줄에 따라)강화받기 때문이다.
고전적 조건화에서와 마찬가지로 조작적 조건화에서도 자발적 회복 현상을 볼 수 있다. 즉, 어떤 행동이 소거를 통하여 없어졌다가 일정 기간이 지난 후 다시 일어나는 현상을 보이게 된다. 자발적 회복 이외에 어떤 행동을 소거할 때 나타나는 특이한 현상으로 "소거에 의한 행동의 폭발(extinction-induced bursting)"을 들 수 있다. 이것은 어떤 행동을 소거시키기 시작하면 초기 단계에는 오히려 일시적으로 행동이 더 많이 나오는 현상을 말한다. 예를 들면, 자판기에 돈을 넣고도 커피가 나오지 않을 때 사람들은 종종 버튼을 계속해서 눌러대는 행동을 하는 것을 흔히 관찰할 수 있다. 또한 소거는 좋지 못한 정서적 반응이나 심지어는 공격 행동을 야기시킬 수도 있다. 위의 예에서 커피가 나오지 않으면 버튼을 계속해서 누르는 행동뿐만 아니라 자판기를 발로 찬다든가 욕을 하는 등의 행동도 쉽게 관찰할 수 있다.
처벌은 행동의 빈도를 감소시키는 또 하나의 방법이다. 처벌이란 특정 행동에 즉각적으로 뒤따라 나오는 자극의 변화에 의해 이후의 행동의 빈도가 감소하게 되는 과정을 말한다. 그리고 여기서 행동의 빈도를 감소시키는 자극의 변화를 처벌인(punisher)이라고 한다. 강화가 행동을 증가시켜야만 강화라고 말할 수 있듯이, 처벌도 행동의 감소를 가져와야만 처벌이라고 할 수 있다. 이를테면 행동이 일어난 후 어떤 혐오적인 사건이 생기더라도 이 혐오적인 사건이 행동을 감소시키지 못하면 처벌이라고 할 수 없다. 즉, 처벌이란 일반적으로 혐오 자극을 말하는 것이지만 자극이 혐오적이라는 것만을 가지고 그것을 처벌이라고 단정지을 수는 없다. 문제 행동을 보이는 아동들의 경우 부모나 선생님이 처벌 의도를 가지고 야단을 치는 경우 이것이 어떤 아동에게는 처벌로서 작용하여 문제 행동을 더 이상 하지 않게 되는 경우도 있지만, 어떤 경우에는 오히려 이것이 문제 행동을 더 부추기기도 한다. 이런 경우에는 부모나 선생님이 야단치는 것이 오히려 강화로 작용했다고 보아야 한다. 왜냐하면, 부모나 선생님의 야단으로 인해 문제 행동의 빈도가 증가되었기 때문이다.
강화인과 마찬가지로 처벌이 역시 무조건 처벌인(unconditioned punisher)과 조건화된 처벌인(conditioned punisher)으로 나눌수 있다. 무조건 처벌인은 유기체의 어떤 경험 없이도 유기체에게 처벌인으로서 효과를 가지는 것들을 말한다. 예를 들어 고통스러운 자극을 가하는 것 등은 무조건 처벌인이라 할 수 있다. 그리고 원래는 처벌인으로서의 효과가 없는 다른 환경적 자극이 무조건 처벌인과 반복적으로 연합되면, 이 자극도 역시 처벌인으로서의 역할을 하게 되는데, 이것을 조건화된 처벌인이라 한다. 예를 들면, "안돼"라는 말과 여러 가지 혐오적인 자극들(예:체벌)이 연합되었던 경험을 가진 아이들에게는 처벌인으로서의 효과를 가질 수 있다.
강화가 정적 강화와 부적 강화로 나누어질 수 있듯이 처벌 또한 정적 처벌과 부적 처벌로 구별할 수 있다. 정적 처벌이란 어떤 자극이 주어짐으로써 행동이 감소하게 되는 경우이며, 부적 처벌은 어떤 자극이 없어짐으로써 행동이 감소하게 되는 것을 말한다. 아이가 나쁜 짓을 했을 때 부모가 매를 때림으로서 나쁜 짓을 더 이상 하지 않게 된다면 이것은 정적 처벌이라고 할 수 있다. 만약 어떤 사람이 제한 속도를 지키지 않고 과속을 하다가 벌금을 물고난 뒤 다시는 과속을 하지 않게 된다면 이것은 부적 처벌에 해당한다. 특히 후자의 경우를 반응 비용(response cost)이라고 한다.
또 다른 형태의 부적 처벌의 예로 타임 아웃(time out)을 들 수 있다. 타임아웃이란 부적절한 행동을 했을 때 강화인을 받을 수 있는 상황에서 격리시키는 것을 말한다. 예를 들면 어떤 아이가 교실에서 다른 아이들을 괴롭히고 산만한 행동을 할 때, 이 아이를 일시적으로 교실 밖으로 나가 있게 함으로써 교실 내에서의 재미있는 활동에 참여하지 못하게 하는 것이다.
이러한 처벌은 그 효과 면에서 매우 뛰어나기는 하지만 여러 가지 부작용이 있을 수 있다. 가장 대표적인 부작용으로 공격성을 들 수 있다. 인간과 동물 모두 처벌을 받게 되면 공격적 행동을 보이는 경우가 있는데, 이것은 공격적 행동이 처벌을 감소시키는 데 아무런 역할을 하지 못함에도 불구하고 나타난다. 처벌을 적용함으로써 나타나는 또 다른 부작용으로는 부정적인 정서 반응과 회피 반응 등을 들 수 있으며, 처벌 적용에 따른 윤리적인 문제 또한 신중히 고려해야 할 사항이다. 처벌의 또 한 가지 단점은 처벌이 부적절한 행동을 감소시킬 수는 있어도 바람직한 행동을 증가시킬 수는 없다는 것이다. 그러므로 처벌은 가능하면 사용하지 않는 것이 좋으며, 사용할 수밖에 없는 상황이라면 강화와 함께 사용하는 것이 바람직하다.
처벌을 사용해야 한다면 다음과 같은 사항을 고려해 볼 필요가 있다. 첫째, 처벌은 반응이 일어난 후 즉각적으로 주어질 때 가장 효과가 좋다. 둘째, 반응이 나올 때마다 매번 처벌이 주어지지 않는 경우는 오히려 강화를 받게 되므로 처벌은 문제 행동이 나올 때마다 매번 주어져야 한다. 셋째, 처벌의 강도는 처음부터 아주 강한 것이 좋다. 만약 처벌의 강도가 처음에는 약하다가 점점 강해지면 처벌에 적응하게 되는 현상이 생기므로 처음부터 강한 처벌을 줄 필요가 있다. 넷째, 처벌받는 행동에 대해 대안적 행동이 있을 때 처벌의 효과는 커진다. 다시 말하면, 어떤 특정 행동이 처벌을 받을 때 그 행동 이외의 다른 행동을 할 수 있는 기회가 있다면 처벌의 효과는 더 커진다고 할 수 있다. 즉, 문제 행동을 처벌함과 동시에 대안적 행동을 강화해 주면 처벌의 효과는 더 커질 수 있다.
앞에서 살펴본 강화의 원리는 특정 행동의 발생 빈도가 어느 정도 있는 상황에서 그 행동이 발생할 때 적용시킬 수 있다. 그러나 어떤 경우는 행동의 발생 빈도가 적용시킬 수 조차 없을 때도 있다. 말하자면, 유기체로 하여금 전혀 해 보지 않은 새로운 행동을 학습시키려고 할 때에는 행동이 전혀 발생하고 있지 않기 때문에 강화를 적용시킬 기회가 없는 것이다. 이렇게 현재 유기체가 할 수 있는 행동이 아닌 새로운 행동을 형성시키려고 할 때에는 조형(shaping)이라는 방법을 사용한다.
조형에서 최종적으로 학습시키고자 하는 목표 행동은 현재 발생하고 있지 않기 때문에 목표 행동과 다를지라도 이와 유사한 행동이 나올 때 강화를 하기 시작한다. 그리고 유사 행동이 강화되어 그 빈도가 점차 늘어나게 되면 이 행동에 대한 강화를 중단하고(소거를 시작함), 목표 행동과 좀더 유사한 행동이 나올 때만 강화를 해 주기 시작한다.
또한 이 행동의 빈도가 어느 정도 증가하면 강화를 다시 중단하고 이 행동보다 목표 행동에 더 유사한 행동이 나올 때까지 계속하게 되는데, 이러한 절차를 조형이라고 한다.
사람들은 일생을 살아가면서 조형을 통하여 수많은 새로운 행동을 학습한다. 예를 들면, 어린아이들이 말을 배울 때 일종의 조형 절차를 거치게 된다. 어린 아이가 '엄마'라는 단어를 배울 때, 부모들은 처음에는 아이가 정확하게 '엄마'라는 발음을 하지 않고 그와 유사한 "어-", "어-"와 같은 발음을 하더라도 안아준다든지 웃어줌으로써 이에 대해 강화를 해 준다. 그러면 아이가 이와 같은 소리를 내는 빈도가 증가하게 된다.
좀더 시간이 흐른 뒤에는 '엄마'라는 단어와 보다 유사한 발음, 예를 들면 "엄-" 등과 같은 발음을 하게 될 때에만 강화를 해 주고 이전의 보다 서투른 발음에는 강화를 해 주지 않게 된다.
'엄-'과 같은 발음의 빈도가 좀더 많아지면 이보다는 좀더 정확한 발음인 '엄므'등과 같은 발음에 대해서만 강화를 받고 그렇지 못한 발음은 강화를 받지 못하게 된다. 이와 같은 식으로 계속적으로 차별 강화를 받음으로써 결국에는 '엄마'라는 발음을 거의 완벽하게 할 수 있게 되는 것이다.
이 외에도 조형을 통하여 새로운 행동을 학습하는 경우는 수없이 많다. 운전을 배우는 것도 일종의 조형 과정을 통해 학습되는 것이라고 볼 수 있고, 야구, 테니스, 수영 등의 운동을 배우는 것에도 조형 과정이 포함된다고 볼 수 있다.
조작적 조건화에서 행동에 영향을 미치는 것은 주로 강화, 처벌 등과 같은 행동의 결과라고 할 수 있다. 그러나 행동에 영향을 미치는 것이 꼭 결과만이라고는 할 수 없으며, 행동이 발생하기 이전에 존재하고 있는 자극 상황 또한 행동에 영향을 미친다.
예를 들어, 실험용 쥐를 실험상자에 넣어 두고 고정 비율 1(FR1) 스케줄로 지렛대를 누르는 행동을 학습시켜(쥐가 지렛대를 한 번 누를 때마다 한 번씩의 먹이가 나오도록 실험 상황을 조작함) 행동의 빈도가 높아져 있다고 가정해 보자. 이 상황에서 실험상자 위에 빨간 전구와 파란 전구를 하나씩 단 뒤 30초 동안은 빨간 불을 켜 두고 다음 30초 동안은 파란불을 켜 두는 과정을 되풀이 하면서, 빨간불이 켜진 상태에서는 항상 FR 1 스케줄을 적용시키고 파란불이 켜진 상태에서는 지렛대를 누르더라도 음식이 나오지 않도록 한다면 어떤 현상이 발생하겠는가? 아마 빨간불이 켜진 상태에서는 지렛대를 누르게 될 것이며, 파란불이 켜진 상태에서는 지렛대를 누르지 않게 될 것이다. 여기서 빨간불과 파란불의 존재 유무는 행동 이전에 존재하는 사전 자극(antecedent stimulus)으로서 행동에 영향을 미치게 된다. 이와 같은 사전 자극을 보다 전문적인 용어로 표현하면 변별 자극(discriminative stimulus)이라고 한다.
이러한 변별 자극이 어떤 특정한 행동을 유출시킬 수 있는 이유는 과거의 강화 역사에서 찾아볼 수 있다. 위의 예에서 쥐의 지렛대를 누르는 행동이 빨간불이 켜져 있을 때 나타나는 이유는 빨간불이 켜져 있을 때에만 지렛대를 누르는 행동이 강화를 받아 왔기 때문이며, 유사하게 파란불이 켜져 있을 때 지렛대를 누르는 행동이 나타나지 않는 이유는 파란불이 켜져 있을 때에는 그 행동이 강화를 받지 못했기 때문이다. 이와 같이 행동이 나타나기 이전에 존재하는 사전 자극으로서의 변별 자극이 행동을 통제하는 현상을 자극 통제(stimulus control)라고 한다.
이러한 자극 통제 현상은 실무율적인 현상은 아니다. 자극 통제의 정도는 자극 통제 현상이 형성되는 과정에 포함되었던 본래의 변별 자극과 얼마나 유사한 자극이 제시되느냐에 달려 있다. 말하자면, 본래의 변별 자극과 완전히 동일한 자극이 아니더라도 자극 통제 현상은 일어날 수 있으며, 자극이 본래의 변별 자극과의 유사성이 크면 클수록 자극 통제의 정도는 높아진다.
예를 들어 빨간불이 켜질 때마다 쥐의 지렛대 누르는 행동이 FR1 스케줄에 의해 강화를 받는 실험을 했다고 가정해 보자. 아마 이 실험을 반복하게 되면 빨간불은 변별 자극으로서의 효력을 가지게 될 것이다. 이것을 검증하기 위해 빨간불에서 파란불에 이르는 다양한 색깔의 불을 켜 준다면 어떤 현상이 생기겠는가? 즉, 본래의 자극과 유사성이 클수록 자극 통제의 정도는 높아지며, 유사성이 낮을수록 자극 통제의 정도가 낮아짐을 알 수 있다.
이와 같이 본래의 변별 자극과 완전히 동일하지는 않더라도 그와 유사한 자극이 행동을 통제하게 되는 현상을 자극 일반화(stimulus generalization)라고 한다. 이러한 자극 일반화와 반대되는 개념은 변별화(discrimination)라고 하는데, 이것은 차별 강화(differential reinforcement)에 의해 형성될 수 있다. 차별 강화란 어떤 특정한 자극이 존재하는 상태에서는 반응이 강화를 받고, 자극이 존재하지 않거나 혹은 다른 자극이 존재하고 있는 상태에서는 강화를 받지 않는 (즉, 소거) 것을 말한다. 앞에서 언급된 예에서 빨간불이 켜져 있을 때 훈련받은 쥐는 이와 유사한 색깔의 불에도 반응을 나타내게 된다. 자극 일반화 현상이 나타난 것이다.
그러나 훈련을 통하여 오직 빨간불이 켜져 있을 때만 반응이 강화를 받고 이와 유사한 색깔의 불이 켜져 있을 때는 강화를 전혀 받지 않게 된다면, 쥐는 빨간불이 켜져 있을 때에만 반응을 하게 되고 그 이외의 자극에는 반응하지 않게 된다. 이것이 바로 변별화라고 할 수 있다. 자극 일반화의 예로 어린아이가 남자들만 보면 "아빠"라고 부르는 현상을 들 수 있고, 변별화의 예로는 아이들이 좀더 자라게 되면 다른 남자 성인들과 아버지를 구별할 수 있게 되는 현상을 들 수 있다.
지금까지 우리는 조작적 조건화의 원리에 따라 행동이 어떻게 형성, 유지, 혹은 소멸되는지에 대해 살펴보았다. 이와 같이 강화나 처벌과 같은 행동의 결과에 직접적으로 노출됨으로써 통제되는 행동을 유관형성 행동(contingency-shaped behavior)이라 부른다. 그러나 동물들의 행동과는 달리 인간 행동은 유관뿐만 아니라 규칙에 의해서도 형성될 수 있다. 이렇게 규칙에 의해 형성되는 행동을 규칙통제 행동(rule-governed behavior)이라고 한다(Skinner, 1969). 규칙통제 행동이란 유관 관계에 대한 직접적인 노출이라기 보다는 반응과 그에 따른 환경 사건과의 관계성의 규칙에 의해 통제되는 행동이라 할 수 있다.
예를 들어, 어떤 공장에 새로 입사한 근로자가 있다고 가정해 보자. 이 공장의 작업장에는 근로자들이 작업중의 안정을 위해 필히 지켜야 할 여러 가지 사항들이 있다. 물론 오랫동안 근무해 온 사람들은 안전을 위하여 어떤 행동을 하지 말아야 할지 혹은 어떤 행동은 반드시 해야 하는지를 잘 알고 있으나, 새로 입사한 사람들은 그것에 대해 잘 알지 못할 것이다.
이러한 상황에서 만약 새로 입사한 사람들의 행동이 유관적으로 형성되어야 한다면(즉, 어떤 행동을 하고 그 행동에 대해 직접적으로 강화나 처벌을 받아서 형성된다면), 아마 그들은 극히 위험한 상황에 부딪히거나 행동을 학습하기도 전에 사망하게 될지도 모른다. 예를 들어 작업장 내로 연결되어 있는 고압 전선은 손으로 만지지 말아야 하는데, 그것을 처벌을 통하여 배워야만 한다면 근로자들은 살아남을 수가 없을 것이다. 그러므로 보통 이와 유사한 상황에서 근로자들은 어떤 규칙을 전해 받게 되고 이 규칙에 따라서 행동하게 된다. 그래서 만약 근로자들이 "고압 전선에 가까이 가지 마시오."라는 규칙을 듣거나 읽으면 그 규칙에 따라 행동을 하게 된다. 이것이 규칙통제 행동의 예이다.
어떤 특정한 규칙을 따라 하느냐 하지 않느냐 하는 것은 규칙의 정확성이나 규칙을 전해 주는 사람에 대한 과거의 개인적인 경험에 달려 있다고 할 수 있다. 즉, 우리는 어떤 규칙을 따라 하느냐 하지 않으냐를 조작적 조건화를 통하여 학습하게 된다. 어머니가 아이에게 "난로를 만지지 마라. 만지면 손을 데." 라고 말했다고 하자. 만약 아이가 어머니의 말을 듣지 않고 난로를 만져서 손을 데었다면, 난로를 만지면 손을 덴다는 어머니로부터의 규칙과 실제로 만짐으로써 손을 덴 결과와의 일치성을 경험하여 앞으로 어머니의 규칙을 따르게 될 확률이 높아지게 되는 것이다. 그러나 난로를 만졌음에도 불구하고 손을 데지 않았다면 앞으로 어머니의 규칙을 따를 확률은 감소하게 된다.
규칙통제 행동은 직접 경험해 보지 않고도 행동을 학습할 수 있는 기회를 준다. 만약 행동이 모두 유관적으로 형성되어야 한다면 평생을 통해서도 현재 우리가 가지고 있는 행동을 다 배우지 못할 것이다. 다행히 동물들과는 달리 인간은 언어 능력을 바탕으로 직접적으로 경험하지 않고서도 규칙을 통해 많은 행동을 배울 수 있다. 그러나 인간 행동 모두를 규칙통제 행동이라고 할 수는 없다. 거의 모든 인간 행동은 규칙통제 행동과 유관형성 행동의 혼합이라고 보는 것이 옳을 것이다.
규칙통제 행동은 습득이 빠르다는 장점이 있기는 하지만, 그 행동이 완전하지 못하다는 것이 단점이다. 즉, 어떤 규칙을 단지 따라 하는 행동은 유관적으로 형성된 행동에 비해서 효율성이나 속도가 현저히 떨어진다. 예를 들면, 외국어를 배우는 것은 일종의 규칙통제 행동이라고 볼 수 있는데, 영어를 배울 때의 불규칙 동사의 과거와 과거완료형을 배운다고 가정해 보자. 우리 나라 사람이 go의 과거형을 쓰기 위해서는 교과서나 선생님이 가르쳐 주는 것을 그대로 따라 하는 수밖에 없다. 즉, go의 과거형을 써야 할 상황에서 go의 과거형은 goed가 아니라 went라는 선생님이나 교과서로부터 배운 규칙을 그대로 따라 하게 된다. 이것이 바로 규칙통제 행동이라고 할 수 있다.
그러나 여기서의 문제점은 went라는 낱말을 써야 할 상황에서 그 행동이 즉각적으로 혹은 gydbf적으로 나와 주지 않는다는 것이다. 외국인을 직접 만나서 회화를 해야 할 경우 went라는 말이 즉각적으로 어려움 없이 나올 때 효과적으로 대화를 할 수 있음에도 불구하고 우리는 외국인을 만났을 때 아무 말도 하지 못하고 머뭇거렸던 경험을 대부분 가지고 있다. 우리가 배운 영어는 일종의 규칙통제 행동으로서, 일단은 먼저 규칙을 떠올려서 그 규칙을 따라 해야 하기 때문에 시간이 걸리고 비효율적이다.
반면에 영어가 모국어인 나라에서 태어나 자라온 사람들은 이러한 규칙을 배울 필요가 없다. 그들은 영어를 사용하는 사회에서 자라면서 go의 과거는 goed가 아니라 went라는 것을 직접적으로 강화나 처벌을 받으면서 학습해 왔기 때문이다. 그러므로 타인과 대화를 할 때 규칙을 떠올릴 필요 없이 즉각적으로 그 상황에 적합한 말을 할 수 있는 것이다.
요약하면, 인간의 행동은 규칙통제 행동과 유관형성 행동으로 구성되어 있으며, 어떤 특정한 행동이 학습된다는 것은 위의 두 가지 종류의 행동이 상호보완적으로 작용하는 것이라 할 수 있다. 규칙통제 행동은 학습 속도가 빠르며 단시간 내에 다양한 행동이 학습될 수 있는 장점을 가진 반면에, 비효율적이며 완전하지 못한 성격을 가지고 있다. 반면에 유관형성 행동은 일단 형성되고 나면 그 행동이 완전하며 효율적이지만 학습에 많은 시간이 소요된다. 그러므로 인간 행동의 대부분은 위의 두 가지 형태의 행동이 상호 작용하여 형성되어 간다.
지금까지 살펴본 조작적 조건화의 원리는 우리 실생활에서 매우 광범위하게 적용될 수 있다. Skinner는 우리가 직면하고 있는 여러 가지 사회 문제를 조작적 조건화의 원리를 이용하여 상당 부분 해결할 수 있다고 주장한다. 예를 들면, 자동차 사고에 따른 부상이나 사망은 심각한 사회 문제라고 할 수 있고, 이러한 문제는 안전벨트를 매는 행동을 조작적 조건화의 원리를 이용하여 증가시킴으로써 부분적으로 해결할 수 있다. Roberts와 Fanurik(1986)은 승용차를 운전해서 통학하는 학생들을 대상으로 안전벨트를 매는 행동에 대해 피자, 스티커, 그림책 등으로 강화를 한 결과 안전벨트를 착용하는 비율이 평균 일곱 배 이상 증가하는 결과를 가져온다는 것을 발견하였다.
이 외에도 우리가 직면하고 있는 많은 문제가 조작적 조건화의 원리를 이용함으로써 해결될 수 있다. 학교에서는 강화와 소거 등을 이용하여 학생들의 문제 행동을 감소시키고 학업 성취도 또한 향상시킬 수 있다. 산업체에서는 보상을 이용한 결근율 감소, 생산성 향상, 산업 안전사고 감소를 가능케 할 뿐만 아니라 환경 보호를 위한 쓰레기 재활용 증가에도 효과적인 것으로 밝혀졌다.
또한 임상 장면에서도 다양한 이상 행동을 치료하는 데 성공적으로 적용되기도 한다. 특히 정신병원에서 흔히 적용되는 토큰 이코노미(token economy)는 조작적 조건화를 이용한 대표적인 치료법이다. 이것은 환자들이 사회적으로 적절한 행동을 할 때마다 토큰을 주고 이 토큰을 나중에 음식, 담배, 혹은 환자들이 원하는 다른 물건들과 교환할 수 있게 해 주는 치료 방법인데 매우 성공적인 것으로 알려져 있다.
고전적 조건화와 조작적 조건화는 전통적으로 근접성의 원리로 설명되어 왔다. 근접성이란 단순히 시간과 공간상에서의 사건들의 단순한 연합을 의미하는 것이다. 즉, 고전적 조건화는 무조건 자극과 조건 자극 간의 연합에 의해서, 그리고 조작적 조건화는 행동과 그 결과 간의 연합에 의해 설명된다. 그러나 최근 이러한 연합적 설명이 비판을 받기 시작했다. 연합적 설명이 인간을 너무 수동적인 역할을 하는 존재로 보고 있기 때문이다. 학습에 대한 인지적 관점은 이와는 달리 학습에서 인지적 요소의 역할을 강조한다.
학습에 대한 인지적 관점은 학습에 있어서 인지적 요소의 중요성을 강조한다. 뿐만 아니라 학습을 외현적 행동의 변화라는 측면보다는 오히려 지식의 습득이라는 측면으로 보고 있다. 다시 말하면, 외현적 행동으로 나타나지 않더라도 학습은 일어날 수 있다고 보는 것이다. 예를 들어 보자. 시험을 위해 오랫동안 공부한 사람이 만약 시험에서 낙제점수를 받았다고 한다면, 이것은 학습이 일어나지 않았다는 것을 뜻하는가? 아마도 그렇지는 않을 것이다. 학습은 일어났으나 단지 그것이 제대로 표현되지 못했을 수도 있을 것이다. 즉, 학습과 수행은 분리되어 생각될 수 있다.
학습과 수행을 개념적으로 분리시켜 설명한 심리학자는 Tolman(1932)이다. Tolman은 외현적 행동에 대한 강화 없이도 학습이 일어날 수 있다고 주장하였고, 이러한 형태의 학습을 잠재 학습(latent learning)이라고 하였다. 잠재 학습에서는 학습이 수행으로 즉각적으로 나타나지는 않으나 나중에 수행에 대해 강화가 주어지면 학습 현상을 볼 수 있게 된다.
Tolman은 실험에서, 세 집단의 쥐에게 우선 10일간 하루에 한 번씩 미로를 통하여 목표 지점에 도달하게 하였다. 한 집단에게는 목표 지점에 도달하면 강화로 음식을 주었고, 나머지 두 집단에게는 목표 지점에 도달하더라도 음식을 주지 않았다. 그 결과 강화를 받은 집단은 실수도 적었고 빠르게 목표 지점에 도달하였으마, 강화를 받지 않은 두 집단은 그렇지 않았다. 11일째부터는 강화를 받지 못했던 두 집단 중 한 집단에게는 목표 지점에 도달했을 때 음식을 주었고, 나머지 한 집단은 여전히 음식을 주지 않았다. 그러자 강화를 받은 집단은 그 다음날 첫 번째 집단만큼이나 효과적으로 목표 지점에 도달하였으며, 강화를 받지 않은 집단은 여전히 목표 지점에 도달하는 것이 빠르지 못했다.
이 연구에서의 결과가 잠재 학습의 성격을 정확히 말해 주고 있다. 즉, 처음 10일간은 강화를 받지 않았던 두 번째 집단은 강화가 주어지지 않았음에도 불구하고 미로를 학습하였고, 단지 수행에 대해 강화가 주어졌을 때 이미 학습되었던 수행이 나타나게 되었던 것이다.
1960년대에 활발하게 진행되었던 잠재 학습에 대한 연구는 관찰 학습(observational learning)에 대한 관심을 불러일으켰다. 관찰 학습이란 학습자가 직접적으로 행동하지 않고도 타인이 행동하는 것을 관찰함으로써 행동을 학습하는 것을 말하는 것이다. 관찰 학습은 Bandura의 사회학습 이론(social learning theory)의 핵심이다. 사회학습 이론이란 사회적 행동이 주로 관찰과 정보에 대한 정신적 처리 과정을 통하여 학습된다고 가정하는 이론이다.
Bandura는 관찰 학습이 일어나기 위해서는 다음의 네 가지 요소가 필요하다고 하였다. 첫째, 관찰자가 모델의 행동에 주의를 집중해야 한다. 둘째, 모델의 행동을 기억해야 한다. 셋째, 모델의 행동을 재현할 수 있는 능력을 가지고 있어야 한다. 넷째, 행동을 수행하려는 동기가 있어야 한다.
예를 들어, 기계체조 중에서 평행봉을 배우려는 사람이 있다고 가정해 보자. 이 사람에게 필요한 것은 다음과 같다. 첫째, 이미 평행봉을 할 수 있는 사람이 하는 동작에 대해 주의를 집중할 필요가 있다. 둘째, 이 행동을 나중에 해 보기 위해서는 기억을 해야 할 것이다. 셋째, 나중에 이 행동을 직접 할 수 있을 정도의 팔힘이 있어야 할 것이다. 이 세 가지가 모두 충족된다면 마지막으로 이 행동을 수행할 만큼의 동기가 필요할 것이다.
관찰 학습을 통해 형성되는 행동은 바람직한 행동뿐만 아니라 바람직하지 못한 행동도 포함된다. 예를 들면, 사람들은 다른 사람들이 거미에 대해 공포증을 보이는 것을 단지 관찰하는 것만으로도 거미에 대한 공포증을 가질 수 있다. 관찰 학습에 대한 초기의 연구에서 Bandura(1965)는 아동들의 공격성에 미치는 관찰 학습의 영향을 연구한 적이 있다.
세 집단의 아동들에게 영상으로 모델이 보보(Bobo) 인형을 주먹으로 치고 나쁘게 이야기하는 장면을 보여주었다. 이러한 공격적 행동에 대해 주어지는 결과는 세 개의 서로 다른 내용으로 구성되어 있고, 각 집단은 한 가지씩의 영상을 보았다. 한 집단은 모델의 공격적 행동이 과자나 음료수 등으로 강화받는 영상을 보았고, 또 다른 집단은 공격적 행동을 한 모델이 다른 사람에게 야단맞는 내용을 보았다. 나머지 한 집단은 모델이 아무런 결과를 받지 않는 영상을 보았다. 그럼 후에 세 집단의 아동들에게 보보 인형과 다른 장난감들이 있는 방에서 혼자 놀 수 있는 기회를 주었다. 그 결과, 앞에서 모델의 공격적 행동이 강화받는 영상을 보았던 아동들이 다른 두 종류의 영상을 보았던 아동들보다 훨씬 더 많은 공격적 행동을 하는 것으로 나타났다.
이 연구의 결과는 타인이 정적 강화를 받는 것을 단순히 관찰한 것만으로도 조작적 조건화가 대리적으로 일어날 수 있음을 말해 주고 있다. 이러한 연구 결과를 놓고 볼 때 아동들이 흔히 접하게 되는 영화나 TV 프로그램의 내용은 아동들의 행동에 많은 영향력을 미친다고 볼 수 있다. 폭력적인 장면은 아동들의 공격적 성향을 높일 가능성이 있으며, 반대로 남을 도와주는 등의 이타적 행동이 담긴 내용들은 아동들로 하여금 이타적 행동을 하게 해 준다.