皇家山的维特根斯坦
26-08-31 20:15

简单说说微博智搜的设计问题。

第一个问题是缓存用得太重。为了减少 token 消耗和生成成本,它大量复用已有答案,但上下文追踪和深度检索没有做好。你换个角度追问,它经常还在重复上一轮的内容,根本没有真正沿着问题继续往下挖。

第二个问题是模型能力不稳定。有时用 DeepSeek,有时用千问,千问的表现稍微好一点。快速模式的逻辑能力尤其差,稍微复杂一点的问题就容易丢掉前提,前后结论也经常对不上。

第三最严重的还是信息源。微博本身就缺少高质量、系统性的语料,搜索出来的大量内容都是赢学、粉红和互相复制的二手信息。RAG 再怎么设计,也解决不了 garbage in, garbage out。只要问题稍微深入一点,它给出的答案基本没有多少参考价值。

当然,微博智搜仍然有用。至少它可以帮助普通用户避开很多低级谣言和明显陷阱,大家确实应该多用。但一定要记住,它给出的只是经过搜索和模型整理的结果,远远谈不上可靠结论,更不能把它当成事实本身。

发布于 加拿大