把小米的 CED 音频标签模型移植到 C++/ggml 生态中的一个项目,可用来快速识别声音。
地址:github.com/localai-org/ced.cpp
作者介绍:“我们做了一个 C++ 引擎(ced.cpp),可以告诉你一段声音是什么:公鸡叫、雷声、吉他声等等。在 CPU 上大约 55 毫秒就能完成识别,而且整个流程不需要 Python。
它是对小米 CED 音频标签模型基于 ggml 的从零移植。它使用和 PyTorch 原版相同的标签,数值结果等价,但速度更快,体积也轻了 2 倍。
现在,你可以让你的 LLM “听见”周围的声音了!”
#How I AI# http://t.cn/AXSTEAzb
发布于 山东
