Scalers
26-10-04 12:01 微博认证:作家,著有《刻意学习》

这两天在整理多个硬盘里积攒十几年的S成长会课程和分享录音,发现现在离线语音转文字的效果,已经挺好了。

我的做法是,让 AI 帮忙搭好流程,用OpenAI的 Whisper large-v3 在自己电脑上批量转写,疑难片段再用阿里的 Qwen3-ASR 辅助复核,最后请大模型帮忙校对、分段整理。

前面两个语音模型都能离线运行,靠自己电脑的显卡干活,不产生云端 token 费用,后面的校对整理再使用大模型额度。

我看了一下,准确率非常高,基本上把一些可能存在的偏差都抓准了。

以前很多录音,存下来就很少打开过。现在陆续变成能搜索、能翻阅的文字,后面再整理进入知识库,接入到Scalers AI智能里,里面讲过的故事、想过的问题,又能拿出来用了。

大量记录这个习惯,在 AI 时代又迎来了10倍的效率突破。

我准备把这些一手经验和做法,在明年的S成长会毫无保留地分享给大家,让每一位伙伴自己都能搭一套这样的生产线。

发布于 北京