我之前给孩子奖励,让孩子刷题,很多人说,那以后不给好处了怎么办?现在孩子上初中了,我啥也不给,孩子就拼命学啊。
我大量的粉丝也是一样的,他们的孩子现在也没有任何奖励,平时就很积极的训练,成绩好的很,而且孩子越学越爱学。
而当初问我这种问题的人,我就想问问,当初你没给孩子好处,现在他更愿意学习了吗?
但凡你有点脑科学常识,就会明白:给孩子糖吃换来做题,不是功利,也不是教坏孩子,而是用对了强化学习的原理!
多年前我女儿刚开始刷题,我给她糖吃,一块糖换几道题。这事被网友骂了好多年,说我把孩子教功利了,说我该让孩子学会延迟满足。
我当时没反驳,因为我心里清楚,这帮人既不懂孩子,也不懂训练。更不懂大脑的工作原理。
强化学习这套东西,训过AI的人都熟。AI做了一个动作,做对了给奖励,做错了给惩罚,通过不断试错学会做对的动作。这里头有两个关键,奖励必须即时,奖励频率要有变化。
是的,就连AI都需要,有血有肉的人不需要?你是怎么想的?
即时奖励这件事,是很多人误解最深的地方。他们以为要培养延迟满足,所以奖励要拖一拖,让孩子学会等待。这等于把两个层面搞混了。延迟满足是结果,不是训练手段。
你在训练阶段延迟奖励,孩子的大脑建立不起努力等于回报的因果链,他学到的反而是努力不一定有回报,于是干脆不努力。
打个比方。训海豚跳圈,海豚跳完圈你立刻给鱼,它学到跳圈等于有鱼。你等它跳完圈再游三圈才给鱼,它学到的是游三圈等于有鱼,跳圈这个动作反而被弱化了。奖励的时机决定孩子学到的是什么,你延迟一秒,他学到的可能就是另一个东西。
奖励频率也有讲究。每次做题都给糖,孩子很快对糖免疫,奖励失效,这叫固定比率强化,效率最低。真正高效的是变比强化,有时给糖,有时给玩具,让孩子不知道哪次会有什么奖励。不确定性最能激活多巴胺。
而且我当年给女儿糖吃,也不是每道题都给,是随机给,有时给有时不给,有时多有时少。她刷题刷得很起劲,因为不知道下一道题会不会有糖,这种不确定性本身就是动力。
这就是为什么我一直讲,奖励要用对时机和方式,不是给不给的问题,而是怎么给,给多少,用什么手段给更高明,效果更好的问题。
可那些育儿专家一上来就讲内驱力,讲延迟满足,讲让孩子自我激励。孩子连最基本的行为习惯都没建立起来,你跟他讲内驱力,他听不懂。这套理论听着高级,落地就是不管用。
那些单纯理解不了的,我也不说什么,毕竟人都认知需要时间。而那些骂我的,冷嘲热讽的,等着看笑话的,现在他们的孩子又怎样了呢?以他们的低端认知,他们的孩子又能怎样?这是毫无悬念的问题。
奖励训练的完整路径,说白了很简单:即时反馈起手,变比强化加速,逐步退出外部奖励,让内驱力接管。我女儿当年糖奖励退出之后,刷题变成了她自己的事,不用我管。
但是这个过程怎么操作?这是个核心问题:退出早了内驱力没接上,孩子反弹;退出晚了孩子依赖外部奖励,不给糖就不动。
这套退出路径,就算告诉你了方法,也不是写下来照做就行的,你作为家长得盯着孩子随时改。每个孩子都训练阶段不同,吸收能力不同,退出时机就完全不同。
这个过程怎么退,想想看,如果你冷嘲热讽过我,骂过我,等着看我的笑话,我能告诉你吗?开什么玩笑!我只会告诉那些花钱参加我训练的人。因为花钱的人,都是认可我的人,肯定不会干那些小人的事。
某些人一边骂完我,一边不付费,天天追着问我怎么操作,你是不是拿我当傻子?白嫖上瘾了?
