2026/07/25|不要讓先犯錯成為拿到獎勵的入口
志強開始會站起來勾餐桌、查看桌面。原本想到的做法是:牠一站起來,就帶回墊子坐下,完成後再給食物或稱讚。但我很快擔心,如果流程每次都一樣,牠會不會反而學成「先勾桌,人才會理我;回墊子後還有獎勵」。
同一天也討論到志強平常不常坐,只有在隔離板門口等人時較容易自然坐下。這讓問題從單純的餐桌制止,延伸到兩件事:如何避免建立錯誤行為鏈,以及如何利用自然發生的正確行為開始教口令。
原本的擔心為什麼合理
Section titled “原本的擔心為什麼合理”狗學習的不只是最後一個動作。若整個流程反覆固定,較早的行為也可能變成啟動後續結果的第一步:
勾桌 → 人靠近 → 被帶回墊子 → 坐下 → 得到食物或摸摸
人想獎勵的是「回墊子」,志強卻可能把整串都學起來,尤其勾桌後總能立刻得到人的注意時。
這不代表犯錯後完全不能引導,也不代表只要曾經在回墊子後獎勵一次就一定會學偏。風險來自流程是否高頻、固定,而且大部分獎勵是否都只能在犯錯後取得。
可確認的事實、推論與未知
Section titled “可確認的事實、推論與未知”可確認的事實
Section titled “可確認的事實”- 志強會因桌上食物氣味站起來查看。
- 牠目前還沒有穩定的「墊子」行為。
- 牠在門口等待時會自然坐下。
- 勾桌可能同時受到食物氣味、視野和人接近的強化。
- 若每次勾桌後都進入有獎勵的固定流程,勾桌可能成為行為鏈入口。
目前無法確認
Section titled “目前無法確認”- 志強是否已經形成完整的「先犯錯再拿獎勵」策略。
- 牠站起來主要是想偷食、探索,還是尋求人互動;不同次可能原因不同。
四種處理方式的差異
Section titled “四種處理方式的差異”1. 犯錯後立刻叫回並馬上給獎勵
Section titled “1. 犯錯後立刻叫回並馬上給獎勵”優點是容易讓狗回到正確位置。缺點是若每次都如此,最容易形成「勾桌才能啟動流程」。不適合作為主要訓練方式。
2. 中性重設後,再另外給提示
Section titled “2. 中性重設後,再另外給提示”先平靜讓四腳落地、帶離桌邊,短暫停頓,再下「墊子」提示;成功停留數秒後才標記。這能把犯錯處理和正式練習稍微分開,但若同一餐反覆發生,仍要降低難度。
3. 在犯錯前強化正確位置
Section titled “3. 在犯錯前強化正確位置”食物上桌前就讓牠到墊子,並在原本安靜待著時給結果。這最直接,因為獎勵不需要經過勾桌才能取得。
4. 用環境管理阻止反覆練習
Section titled “4. 用環境管理阻止反覆練習”門欄、距離、安全房或有人監督下的室內短牽繩,能避免牠在正式用餐時一直成功勾桌。管理不是訓練失敗,而是讓難度回到牠目前能成功的程度。
如何利用自然坐下教口令
Section titled “如何利用自然坐下教口令”門口等待時自然坐下,是可以利用的「捕捉」機會:
重心往後、準備坐下時說一次「坐下」 → 屁股著地時說「對」 → 開門、靠近或開始活動
若來不及在動作前說口令,這一次只標記坐下即可,不在牠坐了很久後重複補說。先在門口建立清楚關聯,再慢慢泛化到客廳與安靜戶外。
這和餐桌處理的共同原則是:不要只等錯誤發生才開始互動,要主動找出正確行為自然出現的時刻。
我原本擔心「先犯錯才能拿獎勵」是合理的。較穩定的方向是讓大部分獎勵發生在志強尚未靠桌、原本就在正確位置時;已經勾桌則中性重設,不讓制止本身變成高價值互動。若同一餐兩三次離開墊子,表示難度太高,應改用管理而不是不斷循環叫回與獎勵。
- 記錄牠是否只在有食物時勾桌,或空桌也會做。
- 比較「食物上桌前先到墊子」與「站起來後才叫回」的成功率。
- 觀察門口坐下是否能在不同位置、不同人和不同結果下維持。