🐘 综合学习笔记:Fagen 等人(大象学习研究)(2014) 🐘
欢迎来到学习取向!
你好!这项核心研究 Fagen 等人的研究,是一个绝佳的例子,展示了心理学理论——特别是学习取向 (Learning Approach)——如何应用于现实生活中,在这种情况下,是用于改善尼泊尔工作大象的福利与管理。你将会看到操作性条件反射的实际运作!
第一部分:正在调查的心理学概念
1.1 学习取向的基本假设
记住,学习取向假设所有行为都是通过与环境的互动与经验而获得的。本研究主要集中在操作性条件反射 (Operant Conditioning) 上。
什么是操作性条件反射?
操作性条件反射是基于自主行为的后果 (consequences) 来进行学习。大象执行一项行为(操作),而该行为的后果决定了这种行为是否会再次发生。
• 强化 (Reinforcement): 使行为更有可能再次发生的后果。Fagen 等人的研究几乎完全依赖此方法。
• 惩罚 (Punishment): 使行为较不可能再次发生的后果(例如传统严厉的训练方法,而 Fagen 等人旨在取代这些方法)。
1.2 操作性条件反射中的关键概念 (Fagen 等人)
本研究特别使用了三个核心概念来达成复杂的训练目标:
1. 强化类型:
- 初级强化物 (Primary Reinforcement): 满足生物性需求(例如食物、水)。对大象而言,这是食物奖励,如切块的新鲜香蕉。
- 次级强化物 (Secondary Reinforcement): 本身没有生物价值,但通过与初级强化物的联结而习得(例如赞美或哨子声)。在本研究中,使用了言语赞美以及短促的哨子声。
2. 塑造 (Shaping): 这是奖励期望行为的渐进式接近 (successive approximations) 的过程。你会奖励那些越来越接近最终复杂行为的小步骤。
比喻:教导狗翻滚。首先,奖励趴下。然后,奖励趴下且稍微转身。最后,奖励完整的翻滚。
3. 行为链 (Behavioural Chaining): 将几个已经学会的小行为,按特定顺序链接起来,形成一个复杂的程序。大象必须学会执行完整洗鼻程序所需的一系列动作顺序。
第二部分:核心研究:Fagen, Acharya & Kaufman (2014)
2.1 研究背景
传统上,像在尼泊尔这样的地方,工作大象通常是使用厌恶性方法 (aversive methods)(惩罚或负强化)进行训练。这些方法可能会导致动物产生压力和攻击性。
研究中具体探讨的行为——洗鼻 (trunk wash)——是用于检测结核病 (tuberculosis, TB) 的重要兽医诊断程序。然而,如果以激进方式训练或予以约束,大象往往会抗拒。Fagen 等人致力于寻找一种人道且有效的替代方案。
2.2 研究目的
主要目的是研究使用积极强化训练 (Positive Reinforcement Training, PRT) 来教导圈养工作大象执行一项特定的、复杂的兽医行为(用于结核病检测的洗鼻),以改善它们的管理与福利。
2.3 程序与方法学
研究方法:
本研究主要使用结构化的观察法 (observation) 来衡量每头大象在培训干预计划期间的进展。
样本:
五头雌性亚洲象 (Elephas maximus),位于尼泊尔,包含 4 头幼象(年龄 5–7 岁)和 1 头年长成年象(年龄 50 岁以上)。
程序中的关键特征:
该程序主要依赖于使用初级强化物(香蕉片)和次级强化物(哨子/言语赞美)的塑造 (shaping) 和行为链 (behavioural chaining)。
逐步训练过程(行为链序列):
1. 鼻子在手上 / 标志: 将鼻子平稳地放在训练师的手上 / 标志棒上。
2. 注入液体: 允许将液体(生理盐水/水)注入鼻子中。
3. 举起鼻子: 向上举起并保持鼻子朝上以保留液体。
4. 鼻子放进桶中: 将鼻子放进收集桶中。
5. 喷气: 用力将液体喷回收集桶中以进行样本收集。
数据收集(测量指标):
研究人员使用行为核对表 (behavioural checklist) 来客观地衡量在表现测试中的成功情况。
• 定量数据: 测量指标包括准确度 / 正确任务百分比、所需的提示/主动尝试次数,以及潜伏期 (latency) / 持续时间。
• 定性数据(福利): 观察内容包括关于行为反应以及压力或合作迹象的记录。
第三部分:结果、发现与结论
3.1 关键结果(定量发现)
• 5 头大象中有 4 头(全部 4 头幼象)在 35 节课内成功学习了整个洗鼻序列并达到标准(在各项测试中达到 80% 以上的合格标准)。
• 单独一头年长的成年象(5 号大象)在测试期间未能成功掌握完整的行为链序列。
• 大象在表现测试中表现出显著进步,整体任务平均成功率从基线(约 39.0%)增加到最终评估中的 89.3%。
• 次级强化物(配合赞美的哨子声)成功发出了正确行为的信号并维持了合作。
3.2 主要结论
Fagen 等人得出结论,积极强化训练是一种有效且非厌恶性的方法,可用于教导工作大象执行兽医程序等复杂行为。此外,这种方法通过以合作、积极的互动取代严厉的传统方法,改善了大象的福利。
第四部分:评估与争论
4.1 优点与缺点
优点:
• 对日常生活的高度应用价值: 研究结果对于在全球(保护区、工作象舍、动物园)改善圈养动物的兽医管理与福利具有即时的实践价值。
• 高生态效度: 本研究是在尼泊尔大象自然的工作环境中进行,而非枯燥的人工实验室。
• 客观测量: 使用结构化的行为核对表来记录准确度、潜伏期和提示次数,提供了客观的定量数据。
缺点:
• 低概括性 (Generalisability): 样本量非常小(5 头尼泊尔的雌性亚洲象)。结果可能无法推广到雄象、非洲象,或不同年龄及生活经历的动物身上。
• 学习的个体差异: 并非所有动物都以相同的速度学习或取得成功(例如年长成年象未能达到标准),显示出普遍训练速度上的局限性。
4.2 议题与争论
动物在心理学研究中的使用
这项研究在动物研究伦理方面得分很高,因为其主要目的是将伤害降至最低,并将效益达到最大。
• 减轻伤害: 研究积极地用温和的积极强化法取代了潜在有害的消极训练技术,改善了大象的生活质量。
• 程序: 没有造成任何痛苦或折磨;全程使用食物奖励(香蕉)。
• 居住/物种: 研究在该大象固有的工作家园中进行,且方法论是专门针对亚洲工作象的福利需求而量身定制的。
先天与后天 (Nature Versus Nurture)
本研究强烈支持争论中后天 (Nurture) 的观点。研究表明,复杂行为(如忍受兽医洗鼻)是通过环境互动和系统性训练(操作性条件反射)而习得的,而非纯粹天生(先天)的。
个体与情境解释
本研究强调了情境解释 (Situational Explanation)。大象的行为(学习洗鼻)是由外部环境解释的——具体而言,是强化物的系统性应用和细致的训练结构。然而,观察到了学习速度上的个体差异,这显示了来自个体因素(如年龄或先前的条件反射经历)的某些影响。