我一直有一个猜测,既然课堂上的知识总体是一个相对封闭的集合,那么用于教育场景的大模型应该可以比通用大模型更小,这样应用起来更灵活,更低成本。有道今天正式发布的“子曰3数学模型”,一定程度上证实了这个猜测,子曰3数学模型用14B的参数大小,实现了中文数学解题的SOTA性能(英文解题和其他学科也有较强能力)。我们把这个工作开放出来,包括完整的模型,论文和方法创新,希望对教育大模型的发展有所助力!
发布于 北京
我一直有一个猜测,既然课堂上的知识总体是一个相对封闭的集合,那么用于教育场景的大模型应该可以比通用大模型更小,这样应用起来更灵活,更低成本。有道今天正式发布的“子曰3数学模型”,一定程度上证实了这个猜测,子曰3数学模型用14B的参数大小,实现了中文数学解题的SOTA性能(英文解题和其他学科也有较强能力)。我们把这个工作开放出来,包括完整的模型,论文和方法创新,希望对教育大模型的发展有所助力!