Rapid-MLX 0.13.2 现已上线!🚀 在 Mac 上运行本地 AI 的最快方式刚刚迎来重大升级。
⚡️ Qwen3.8 Flash-Next:解码速度提升高达 42%,前缀缓存近乎瞬时(5k 令牌仅需 0.5 秒!)
🤯 原生 MTP(多令牌预测)功能现已登场:
我们实现了 45/45 的有效功能成果。硬件优化简直不可思议:
• 解码速度:+36.2% 至 +41.8%
• 长上下文 TTFT:-28.9% 至 -32.5%
• 前缀缓存:6.497 秒 ➡️ 0.539 秒(近乎瞬时!)
MTP 专业提示:它能轻松吞噬长输出任务。但它会增加内存开销(推荐 128/192/256GB 统一内存),并可能延长长输入/短输出工作流的 TTFT。(可选功能,实验性,仅限文本)。
🛠️ 除了 MTP,我们还全面提升了核心体验:
👁️ 专业多模态:支持最多 4 张图像,低内存 Mac 自动降采样,并保留 FLUX 维度。
🎙️ 完整音频:100% 离线 Kokoro 语音 + Parakeet v3(25 种语言)。
🛡️ 更精简、更安全:DMG 文件缩小 43%,网络安全更严格,本地聊天标题优化。
验证我们的基准测试,阅读复现文档,并在你的 Mac 上试用:
http://t.cn/AX0LukSg
发布于 北京
