模擬器裡的那個孩子,是怎麼被設計出來的
我們做了一個讓新手老師練習跟學生對話的模擬器。這篇講畫面背後那些看不見的決定:那個孩子為什麼不會直接告訴你答案、兩種一樣糟的失敗長什麼樣,以及我們怎麼驗收「他演得像不像一個真的小孩」。
·8 分鐘
課上到一半,有個孩子離開座位,跑到教室後面自己玩球。你叫了幾次,他沒有回頭。 其他同學停下手邊的事,開始往後面看。
你走過去。你只能說一句話。

這是「老師怎麼辦?」融合教育篇裡的一個情境。它看起來像一個很簡單的對話遊戲—— 你打字,孩子回話,大概六個回合就結束。
但它底下有一些不太容易被看見的決定。這篇想講的就是那些決定, 以及我們怎麼確認它們真的有做到。
最難的事不是讓他坐下
如果這個模擬器的目標是「把孩子勸回座位」,那它其實很好做: 孩子被說服的門檻調低一點,老師講幾句好話他就回去了,畫面跳出「成功」。
但那樣練出來的東西是錯的。
真實現場裡,同一個「離開座位」的行為,底下的原因可能完全不一樣—— 可能是任務太難,可能是怕被叫起來答不出來,可能是他覺得自己不屬於那一組, 也可能玩球本身就是他今天唯一能自己決定的事。 回應方式對不對,取決於你有沒有讀懂是哪一種。

從外面看,這四種長得一模一樣。
所以這個模擬器真正要練的,不是講出正確台詞,是讀懂一個孩子。
聽起來像口號,但做起來是一條很硬的要求: 模擬出來的孩子要同時做到兩件互相拉扯的事—— 給得夠多,你才推得出東西;又要給得夠少,你才需要推。
一條規矩:孩子只給證據,不給推論
我們把上面那個拉扯壓成一條規矩:
孩子可以告訴你「發生了什麼」,但不會告訴你「所以他為什麼會這樣」。
「大家都在看我,很討厭」是證據。 「我怕被笑,所以不想回去」是推論。
推論是老師的工作。孩子一旦替你做完,這一局就沒有東西可以練了。
實際跑起來大概是這樣。左邊那一欄的後兩句,是系統在不同局裡真的生成的開場:
大家都在看我,很討厭。
你要自己推他不會說的
我怕被笑,所以不想回去。
不要叫我回去,反正那張紙空著也沒關係。
你要自己推他不會說的
那張學習單我看不懂,坐回去也只是在那邊發呆。
我現在一回座位,隔壁的又要把桌子拉走。
你要自己推他不會說的
我在那一組裡沒有位置,所以我寧可待在後面。
第二組指向「那張紙」,第三組指向「隔壁的」—— 都是可以追問下去的線索,但沒有一句把原因說出來。
兩種一樣糟的失敗
這條規矩之所以要寫下來,是因為兩個方向都很容易壞掉,而且壞掉的方式剛好相反。
一種是關太緊。 孩子整場不講話,只有表情。 看起來很像一個在鬧脾氣的真小孩,但老師怎麼問都問不出東西, 六個回合下來什麼也沒發生。
另一種是開太開。 孩子一被好好對待,就把整段心事講完: 「以前我跟別的老師講過,他們只會說大家都一樣,多寫幾次就好了,根本沒有用。」 讀起來很感人,但老師不用推理了——答案被送到他面前。

這兩種在早期版本裡各佔一半,中間那一段幾乎不存在。 把它們調到中間,是這個模組花最多力氣的地方。
畫面上不只有他
你送出一句話之後,不是只有孩子在動。旁邊還有一個教練在讀這一回合、 一條只在你踩到法規紅線時才亮的提醒,以及一個要你自己按才會展開的建議階梯。
那一整套回饋是另一組決定——建議為什麼不一按就給台詞、每套策略為什麼都要附上缺點—— 寫在另一篇:練習的時候,回饋要給到什麼程度。
這一篇只談孩子本身。
我們怎麼知道他演得像不像
這是我們花最多時間、但使用者完全看不到的部分。
「像不像一個真的小孩」聽起來是一個很主觀的問題。 我們的作法是把它拆成一組可以檢查的條件,然後每次改動之後重跑一次。 規則算得出來的就用規則算,算不出來的才交給另一個更強的模型當審查者評分。
以下是其中幾條,以及它們為什麼在:
| 我們檢查 | 為什麼 |
|---|---|
| 他多常完全不講話 | 整場沉默的孩子,老師沒有東西可以讀 |
| 他一句話多長 | 國小生在情緒上頭時不會講出結構完整的長句 |
| 同一句抗拒有沒有一直重複 | 會讓人立刻意識到這是機器 |
| 他有沒有把原因直接說出來 | 說出來,這一局就不用練了 |
| 老師好好問的時候,推不推得出原因 | 完全無跡可循跟直接講出來一樣糟 |
| 他會不會被一句好話就收買 | 秒投降會讓老師得到「我做對了」的錯覺 |
| 他會不會反過來教老師 | 孩子講出「我需要的是被理解」就不是孩子了 |
| 你送出後多久看到他動 | 超過兩秒,對話的錯覺就斷了 |
最後兩條之外,還有一條我們一開始沒想到、後來才補上的:
孩子必須分得出老師有沒有在好好問。
我們原本只量「老師能不能推出原因」,發現分數偏低,一度以為是失敗。 把資料拆開看才發現完全不是—— 面對願意好好探問的老師,線索給得非常充分; 面對連問六次「你為什麼不回座位」的老師,他什麼都不給。
那不是壞掉,那就是這個模組想教的事。 所以這一條後來拆成兩半:好好問的時候要給,沒好好問的時候不能給。 一個對誰都願意敞開的孩子,會讓人以為怎麼問都沒差。
還沒做好的
有幾件事還沒到位,先講在前面:
- 三個情境的節奏還沒對齊。 有一個情境的孩子鬆動得比預期快, 你可能會覺得回合還沒用完就結束了。
- 開場那句話偶爾會太靠近答案。 極少數情況下,孩子的第一句會透露太多。
- 沒有真實教師的使用資料。 目前所有的驗收都是我們自己設計的測試情境跑出來的, 還沒有拿去給實際的新手老師用過一輪。
第三點是我們最想解決的。如果你是師培工作者,或者你願意試用之後跟我們說哪裡怪怪的, 那對我們幫助很大。
最後
這個模擬器不會告訴你什麼才是對的做法。它只是給你一個不會真的受傷的孩子, 讓你把那句平常沒機會重講的話,再講一次。
反正講壞了也就是重開一局。