🐘 綜合學習筆記:Fagen 等人(大象學習研究)(2014) 🐘

歡迎來到學習取向!

你好!這項核心研究 Fagen 等人的研究,是一個絕佳的例子,展示了心理學理論——特別是學習取向 (Learning Approach)——如何應用於現實生活中,在這種情況下,是用於改善尼泊爾工作大象的福利與管理。你將會看到操作制約的實際運作!

第一部分:正在調查的心理學概念

1.1 學習取向的基本假設

記住,學習取向假設所有行為都是透過與環境的互動與經驗而獲得的。本研究主要集中在操作制約 (Operant Conditioning) 上。

什麼是操作制約?

操作制約是基於自主行為的後果 (consequences) 來進行學習。大象執行一項行為(操作),而該行為的後果決定了這種行為是否會再次發生。

  • 增強 (Reinforcement): 使行為更有可能再次發生的後果。Fagen 等人的研究幾乎完全依賴此方法。
  • 懲罰 (Punishment): 使行為較不可能再次發生的後果(例如傳統嚴厲的訓練方法,而 Fagen 等人旨在取代這些方法)。
1.2 操作制約中的關鍵概念 (Fagen 等人)

本研究特別使用了三個核心概念來達成複雜的訓練目標:

  1. 增強類型:
    • 初級增強物 (Primary Reinforcement): 滿足生物性需求(例如食物、水)。對大象而言,這是食物獎勵,如切塊的新鮮香蕉
    • 次級增強物 (Secondary Reinforcement): 本身沒有生物價值,但透過與初級增強物的聯結而習得(例如讚美或哨子聲)。在本研究中,使用了言語讚美以及短促的哨子聲
  2. 塑造 (Shaping): 這是獎勵期望行為的漸進式接近 (successive approximations) 的過程。你會獎勵那些越來越接近最終複雜行為的小步驟。
    比喻:教導狗翻滾。首先,獎勵趴下。然後,獎勵趴下且稍微轉身。最後,獎勵完整的翻滾。
  3. 行為連鎖 (Behavioural Chaining): 將幾個已經學會的小行為,按特定順序連結起來,形成一個複雜的程序。大象必須學會執行完整洗鼻程序所需的連鎖動作順序。

快速回顧: Fagen 等人利用正向後果(零食/讚美)逐步教導大象一套複雜的多步驟程序,取代了舊有的負面訓練方法。

第二部分:核心研究:Fagen, Acharya & Kaufman (2014)

2.1 研究背景

傳統上,像在尼泊爾這樣的地方,工作大象通常是使用厭惡性方法 (aversive methods)(懲罰或負增強)進行訓練。這些方法可能會導致動物產生壓力和攻擊性。
研究中具體探討的行為——洗鼻 (trunk wash)——是用於檢測結核病 (tuberculosis, TB) 的重要獸醫診斷程序。然而,如果以激進方式訓練或予以約束,大象往往會抗拒。Fagen 等人致力於尋找一種人道且有效的替代方案。

2.2 研究目的

主要目的是研究使用正向增強訓練 (Positive Reinforcement Training, PRT) 來教導圈養工作大象執行一項特定的、複雜的獸醫行為(用於結核病檢測的洗鼻),以改善牠們的管理與福利。

2.3 程序與方法學

研究方法:

本研究主要使用結構化的觀察法 (observation) 來衡量每頭大象在培訓介入計畫期間的進展。

樣本:

五頭母亞洲象 (Elephas maximus),位於尼泊爾,包含 4 頭幼象(年齡 5–7 歲)和 1 頭年長成年象(年齡 50 歲以上)。

程序中的關鍵特徵:

該程序主要依賴於使用初級增強物(香蕉片)和次級增強物(哨子/言語讚美)的塑造 (shaping)行為連鎖 (behavioural chaining)

逐步訓練過程(連鎖序列):

  1. 鼻子在手上 / 標誌: 將鼻子平穩地放在訓練師的手上 / 標誌棒上。
  2. 注入液體: 允許將液體(生理鹽水/水)注入鼻子中。
  3. 舉起鼻子: 向上舉起並保持鼻子朝上以保留液體。
  4. 鼻子放進桶中: 將鼻子放進收集桶中。
  5. 噴氣: 用力將液體噴回收集桶中以進行樣本收集。
數據收集(測量指標):

研究人員使用行為檢核表 (behavioural checklist) 來客觀地衡量在表現測試中的成功情況。

  • 量化數據: 測量指標包括準確度 / 正確任務百分比、所需的提示/主動嘗試次數,以及潛伏期 (latency) / 持續時間。
  • 質性數據(福利): 觀察內容包括關於行為反應以及壓力或合作跡象的記錄。

記憶小幫手: Fagen 使用 PRT(正向增強訓練)來清洗大象鼻子 (Wash the Trunk)。

第三部分:結果、發現與結論

3.1 關鍵結果(量化發現)

  • 5 頭大象中有 4 頭(全部 4 頭幼象)在 35 節課內成功學習了整個洗鼻序列並達到標準(在各項測試中達到 80% 以上的合格標準)。
  • 單獨一頭年長的成年象(5 號大象)在測試期間未能成功掌握完整的連鎖序列。
  • 大象在表現測試中表現出顯著進步,整體任務平均成功率從基準線(約 39.0%)增加到最終評估中的 89.3%。
  • 次級增強物(配合讚美的哨子聲)成功發出了正確行為的信號並維持了合作。

3.2 主要結論

Fagen 等人得出結論,正向增強訓練是一種有效且非厭惡性的方法,可用於教導工作大象執行獸醫程序等複雜行為。此外,這種方法透過以合作、正向的互動取代嚴厲的傳統方法,改善了大象的福利

第四部分:評估與辯論

4.1 優點與缺點

優點:
  • 對日常生活的高度應用: 研究結果對於在全球(保護區、工作象舍、動物園)改善圈養動物的獸醫管理與福利具有即時的實踐價值。
  • 高生態效度: 本研究是在尼泊爾大象自然的工作環境中進行,而非無菌的人工實驗室。
  • 客觀測量: 使用結構化的行為檢核表來記錄準確度、潛伏期和提示次數,提供了客觀的量化數據。
缺點:
  • 低可推論性 (Generalisability): 樣本量非常小(5 頭尼泊爾的母亞洲象)。結果可能無法推論到公象、非洲象,或不同年齡及生活經歷的動物身上。
  • 學習的個別差異: 並非所有動物都以相同的速度學習或取得成功(例如年長成年象未能達到標準),顯示出普遍訓練速度上的局限性。

4.2 議題與辯論

動物在心理學研究中的使用

這項研究在動物研究倫理方面得分很高,因為其主要目的是將傷害減至最低,並將效益達到最大

  • 減輕傷害: 研究積極地用溫和的正向增強法取代了潛在有害的負面訓練技術,改善了大象的生活質素。
  • 程序: 沒有造成任何痛苦或折磨;全程使用食物獎勵(香蕉)。
  • 居住/物種: 研究在該大象固有的工作家園中進行,且方法論是專門針對亞洲工作象的福利需求而量身定制的。
先天與後天 (Nature Versus Nurture)

本研究強烈支持辯論中後天 (Nurture) 的觀點。研究表明,複雜行為(如忍受獸醫洗鼻)是透過環境互動和系統性訓練(操作制約)而習得的,而非純粹天生(先天)的。

個體與情境解釋

本研究強調了情境解釋 (Situational Explanation)。大象的行為(學習洗鼻)是由外部環境解釋的——具體而言,是增強物的系統性應用和細心的訓練結構。然而,觀察到了學習速度上的個別差異,這顯示了來自個體因素(如年齡或先前的制約經歷)的某些影響。

核心總結: Fagen 等人證明了「善良是有用的」!正向增強是動物管理的有力工具,證明了即使在大型圈養動物身上,複雜的學習過程也能可靠地發生。