蚁工厂
26-06-27 08:59 微博认证:科技博主

把小米的 CED 音频标签模型移植到 C++/ggml 生态中的一个项目,可用来快速识别声音。
地址:github.com/localai-org/ced.cpp

作者介绍:“我们做了一个 C++ 引擎(ced.cpp),可以告诉你一段声音是什么:公鸡叫、雷声、吉他声等等。在 CPU 上大约 55 毫秒就能完成识别,而且整个流程不需要 Python。

它是对小米 CED 音频标签模型基于 ggml 的从零移植。它使用和 PyTorch 原版相同的标签,数值结果等价,但速度更快,体积也轻了 2 倍。

现在,你可以让你的 LLM “听见”周围的声音了!”
#How I AI# http://t.cn/AXSTEAzb

发布于 山东