Inception 推出 Mercury 2.5——面向生产环境的更强 dLLM(扩散大语言模型)。智能提升约40%,性能可比 GPT‑5.6 Luna(Low)等,单卡速度达1107 tokens/s,支持 260K 上下文;具备可调推理、并行工具调用与 schema 对齐的 JSON 输出。语音版 Mercury Voice TTFT <170ms,Router 可智能路由模型;已在搜索、语音与编码场景大规模部署(显著降延迟与成本)。通过 Inception API、Baseten、OpenRouter 可用,现可试用 1 亿免费 Tokens,发布期优惠 80%。企业用户支持专用容量、弹性伸缩与合规控制。了解详情与上手指南:www.inceptionlabs.ai /blog/introducing-mercury-2-5
发布于 北京
