去年11月和今年3月,有两个项目需要分别用LLM处理两套非常不同的中文语料数据。处理过程的第一步,是写个大致的prompt,测试不同模型的效果。美国top模型 + 国内top开源模型都测过之后,两个项目当中deepseek R1(是的,就是那个最老的R1)的效果都是和当时的sota差不多,考虑到性价比,那就是妥妥的吊打。真的很难不变成他家脑残粉(。
发布于 北京
去年11月和今年3月,有两个项目需要分别用LLM处理两套非常不同的中文语料数据。处理过程的第一步,是写个大致的prompt,测试不同模型的效果。美国top模型 + 国内top开源模型都测过之后,两个项目当中deepseek R1(是的,就是那个最老的R1)的效果都是和当时的sota差不多,考虑到性价比,那就是妥妥的吊打。真的很难不变成他家脑残粉(。