# 国产模型及套餐的选择参考
一直有朋友问我,想买国产 Token,买哪家的好,哪家的模型更适合之类的问题。我感觉啊,你们不是不看那些测评,而是测评的内容不匹配你们的工作需求。所以我这里开一篇以我个人视角触发的真实感受,以我的实际使用体感给你们一些小建议。
先声明一点,因为我不是程序员,我没办法告诉你们在代码这块,模型的强弱,所以我主要会在文学能力和办公场景下告诉你们我的使用体感,我也没做过什么深入的评测,所以我的建议你只能作为参考,希望各位尽可能先去找一些免费的渠道试用一下再结合这篇文章来选择。以下模型套餐,除了 GLM 我抢不到以外,其他家的我都有,所以你要是说我说的不对,那就是你对。
---
## 1,DeepSeek。
这是我个人的主力模型,无论是 Flash 还是 Pro,使用率都是最高的。无论是制作 Skill,还是日常写故事,或者是办公场景,我几乎没有在 DeepSeek 上面遇到过问题。
日常的办公场景下,轻量化的工作 Flash 已经够用,遇到做深度研究,给甲方做方案,我才会切换到 Pro 模型。
对写作来说 Flash 其实也可以满足常规的需求,只是文笔稍微比 Pro 弱一些,但上下文的一致性并没有太大的问题。如果不是深度创作,只是写一个故事本的话,Flash 完全足够使用。
DeepSeek 目前或许不是最强的那一档,但是在第二梯队里绝对是最水桶的模型,以它的 API 定价来说,如果不是某些特殊领域的需求,无脑买 DeepSeek 就足够了,这也是我对下面同事直接推荐的。
---
## 2,Kimi。
Kimi 很强,K3 更强。能让 A/ 和 OpenAI 都着急的模型厂家,绝对值得考虑。
K2.5 的时候,它的写作能力就已经得到了我的认可,后面的 K2.6 再到 K3,这一块的能力没有被拉下。论文学功底和写作能力,在我的体感下,是略微超过 DeepSeek 的。
在办公领域,Kimi 也一直是国内的头部存在,在 Agent 还没有火起来的时候,网页端的 Kimi 就已经有了很多办公能力,所以如果你用来办公也没有任何问题。
但大家也都知道,Kimi 不便宜,它的不便宜除了定价以外,还有一点,是过度思考。K2.5 的时候还好,但是 K2.6 和 K3,哪怕是一个小问题,也能给你洋洋洒洒思考出好几千字来,这就导致 Token 的消耗量很大。但是如果你觉得值,那么 Kimi 个人依然是非常推荐的选择之一。
---
## 3,Qwen。
阿里的 Qwen,当然不弱,虽然最近的热度没有 Kimi 和 GLM 高,但是 Qwen3.8 Max Preview 实际上还是很强的。
从写作能力上说,属于中规中矩的档次,不弱,但也不强,你用来写工作文档那是没什么问题的。不过用来写故事就弱一点了,和 DeepSeek Flash 差不多我觉得。
之前 Qwen 3.6 那一批模型给我的体感很好,跑办公任务已经完全够用,后来的 3.7 版本也没什么问题。Qwen3.8 Max Preview 也有和 Kimi K3 同样的问题,就是过度思考,但相对稍微好一点。其实模型有两个发展方向,一个是把参数量加大,一个是把思考链路变长,这样就可以提升模型的实际能力。Qwen 现在的参数量肯定是相对小一点的,所以通过增加思维链长度来提升能力不是什么大问题,只不过消耗更高而已。
但是它的坑在于 Plan 上,之前它便宜的时候,Coding Plan 的性价比非常高,而且里面每一个模型都很好用。但是后来只有 Agent Plan 的时候,每个月 200 元就不行了,套餐里虽然有其他的模型但是经常报错,只有它自己的 Qwen 系列是没问题的。而 Qwen3.7 Max,你们应该也看到我吐槽过,消耗太厉害了,我要是给 DeepSeek 花 200,以我这种不写代码的人来说,我根本用不完。之前 Coding Plan 的时期我就没用完,但是每个月 200 的 Agent Plan,Qwen3.7 Max 我一个星期就把月额度用完了,属实恐怖。
不过最近它新上了 Token Plan,价格便宜不少,如果你不用 Qwen3.8 Max Preview 的话,我估计还可以。所以你如果要买阿里的,那么你最好想清楚,有多少场景需要动用 Qwen3.8 Max Preview 来做,如果很多的话,那么消耗量会比较大。不过优势是,Token Plan 里面包含了生图模型,这点还是挺方便的。
---
## 4,GLM。
GLM 5.2 就不用多说了,Kimi K3 出来之前,这是能向 A/ 和 OpenAI 发起冲击的模型,最近 HuggingFace 那件大事,也是让 GLM 5.2 狠狠的长脸了。
从写作能力上,老实说,比较一般,和 Qwen 在一个档次,我一般不会用它来进行文学创作。当然你普通的写写东西还是没问题的,其实目前的大语言模型,写文章都不是很差,对于内部使用来说,并不需要去掉什么 AI 味儿。
办公场景下,GLM 5.2 就比较不错了,思考深度控制的很不错,完全可以一个模型搞定几乎所有的办公任务,哪怕是轻量化的代码任务,你完全不用操心这个模型。包括之前的 5.1 也完全可用。
GLM 5.2 是我做工程化的主力模型,我一般做项目,最后需要结构化或者规范化的话,会用 GLM 5.2 或者 GPT 5.6 Terra。GLM 5.2 做这个非常好,也从侧面说明它的代码能力很强。
那么问题就来了,它家的套餐,你抢得到吗。如果你抢不到国内的,那么我建议你去看看国外,好像是 80 块钱左右一个月,那个应该能买到。此外,其他家的各种 Plan ,往往也会包含 GLM 5.2,实在不行就去别家买,只不过肯定没有官方的用起来顺手。
---
## 5,Doubao Seed
字节跳动的豆包,大家最熟悉了,要是之前,我可能不会把它放在这里,但是 Doubao Seed 2.1 Pro,以及 Turbo 模型,现在可用度已经有了。
我之前做过豆包桌面版的评测,用的就是 Doubao Seed 2.1 Pro 和 Turbo 模型。用来办公完全没有问题,而且很能打。字节家的视频模型,图像模型,音频模型都有,所以生态很全面,用在办公场景以及部分偶尔为之的音视频领域,完全没问题,甚至你直接买豆包就可以了。它的办公任务模式确实很不错,这是我实际跑过验证过的。
不过你要说写作能力,那我有一说一我还没试过,不过刚才我收到短信说 Doubao Seed 2.1 Turbo 已经在 Plan 里了,接下来我会试着跑跑看它的文学造诣怎么样。
对于大部分普通人来说,如果你只是想用字节自己家的模型,那么我不建议去买它的套餐,你直接买豆包就行了。
---
## 6,Xiaomi。
米家的模型我一开始显然是不当回事的,但是那时候我阿里的套餐到期后,买了一个月试试,结果发现,我小看了米家。
Mimo v2.5 Pro 是个很不错的模型,在我做 Skill 也好,日常办公也好,它没有出过幺蛾子,任务完成的很好。在办公能力下,它甚至不输于 DeepSeek Pro 模型。
但是它的写作能力就差强人意了,Mimo v2.5 Pro 是我用下来 AI 味儿最重的模型,所以哪怕是办公文档,我也不建议用 Mimo v2.5 Pro 来写,更别说你用来做公众号发微博写小红书之类的社交文案了。用来写故事,相对会好一些,但是非必要,你但凡有其他选择,我也不推荐。
不过小米向来是性价比的王者,它的定价很合理,和 DeepSeek 差不多,所以如果你不是用来写作的话,那么米家的套餐完全可以买。而且它的套餐里还有音频模型,无论是 ASR 还是 TTS,如果你有需要的话,可以纳入考虑。
---
## 7,MiniMax。
你们见到我吐槽最多的应该就是 MiniMax 了,你们不要以为我尬黑,也别被网上铺天盖地的宣传迷惑。我是它家 Token Plan Plus 极速版年度会员,所以下面的话我完全有资格说。
MiniMax M2.5 的模型,当时给我的印象非常好,任务完成可用度不错,价格也不错,而且速度也快。但是 M2.7,M2.7 Highspeed,说实话,我没有感到有提升。M2.7 Highspeed 的速度很快,但从能力上,以我的体感而言,并不比 M2.5 强多少。而现在最新的 M3,我更是怒其不争,它的任务表现能力甚至还不如 M2.7 和 M2.5。
同一个任务,它频繁的调用工具,却无法完成,我不是第一次遇到,是很多次。而这个任务,我交给 DeepSeek,哪怕只是 Flash 模型,都只需要几步就可以完成了。
甚至于,我在小龙虾上的定时任务,也就是每天早上给我发影视行业和 AI 行业资讯的任务,M3 有好几次都没有完成,后来我不得不直接换成 M2.7 的模型。我在这里说这些,确实会让你疑惑它真的这么拉跨吗?有的,真的,M3 的任务执行稳定性很堪忧,不如 M2.7 和 M2.5。
那么在写作领域呢,对不起,同样不行。MiniMax 的所有模型,在长会话叙事创作里有两个很大的问题,第一是上下文很容易就忘,大部分模型要经过几十轮的对话可能才会犯一些小错误,但是它可能五轮就忘了刚才自己说过的话了。第二是它的会话结构性重复率很高,什么意思。你在同一个场景里推动剧情的时候,它会连续输出文字内容不同,但是结构完全一样的话。简单说就是上一段输出,它只改几个字,就继续变成了下一轮的输出。在长会话里这简直是不可饶恕的问题,它的文学性几乎是拉跨到家了。
它的套餐价格,我也不做过多评价,对我来说是够用的。而且模型比较多,图像,语音,音乐模型都有,比如我要做一段音乐,我会用它的音乐模型。
---
国内常见的几大家模型和套餐的建议基本上就讲完了,你们要是能有办法用 A/ 和 OpenAI,那当然是很好的选择。但是对大部分普通人来说,还是用国内的更省心一些,大部分任务根本没必要折腾国外的顶级模型。
国产模型现在确实是百家争鸣百花齐放的状态,但是各家的算力资源又确实紧张。我不知道所谓的倒下几家,把算力匀过去是不是一种暂时的解法。但我还是希望,给用户的选择更多一点,能力更强一点,价格再便宜一点。才能给国外的那些不友好的厂商更多压力,我希望所有的国产模型,都是能打,能扛,能用的顶级模型。
发布于 上海
