在 Apple Silicon 上本地运行开放权重的结构化决策模型Laya-MLX(类似jev)。占用最高1G内存
地址: github.com/mizorewww/laya-mlx/
单个短问题端到端中位耗时 13.4 ms;multilingual 检查点为 7.4 ms。0 个输出 token,原生 MLX,无 PyTorch / Transformers 推理依赖,无云端 API。
附图为开发者在自己本地M3Max上玩贪吃蛇,这个模型能够以每秒决策60次的速度玩贪吃蛇!
发布于 山东
