#Qualcomm知识课堂# 骁龙X2 Elite平台AI实战(一): 搭建本地AI编程助手:Qwen2.5:7B 推理速度可达18-22 tok/s,Qwen2.5-Coder:7B 代码生成17-20 tok/s,Llama 3.2:3B Tab 补全延迟控制在 500ms以内,三模型同驻仅占12GB内存。18核Oryon全核推理半小时68℃,完全离线零网络依赖。 http://t.cn/AXpjHdjQ
发布于 北京
#Qualcomm知识课堂# 骁龙X2 Elite平台AI实战(一): 搭建本地AI编程助手:Qwen2.5:7B 推理速度可达18-22 tok/s,Qwen2.5-Coder:7B 代码生成17-20 tok/s,Llama 3.2:3B Tab 补全延迟控制在 500ms以内,三模型同驻仅占12GB内存。18核Oryon全核推理半小时68℃,完全离线零网络依赖。 http://t.cn/AXpjHdjQ