《硅谷101》对话斯坦福博士:探究大模型的隐藏推理与可解释性
本期《硅谷101》采访斯坦福博士生Arman,聚焦大模型可解释性研究。人类仍存有诸多疑问:AI为何答对、产生幻觉,模型人格本质是什么。Arman本科主修语言学,投身该领域,希望搞懂大模型内部究竟如何运作,探寻模型能力爆发的背后原因。节目解读Anthropic J‑Space论文,研究证实大模型存在不会输出的内部推理过程。借助雅可比算子,研究者可干预模型潜藏表征,在不改动输出文本的前提下改变模型思考对象。现有技术还难以真正控制模型内部思维,可解释性依旧是充满挑战的前沿方向。#视频播客开麦计划# http://t.cn/AX00Jv2n
发布于 四川
