# tokencn.com # 中国token出海
OpenRouter最新月榜显示,DeepSeek V4上线仅一个月便存在感极强:V4 Flash以9.13T tokens稳居第1,V4 Pro以3.89T排第9,V3.2以4.07T排第8,三模型同时挤进前十,月调用合计超17万亿tokens。与此同时,Token消耗主力已从聊天机器人彻底让位给Agent系统,单次任务动辄触发上百轮LLM调用和数十次工具执行,负载飙升至数百GB甚至TB级,将基础设施短板无限放大。此前传闻V4延迟因与昇腾深度适配,这是对算力底座最大的误解。事实是,智谱、MiniMax、DeepSeek等头部模型在低精度量化、长上下文、万亿MoE方向步调一致,今年4月三家密集开源,昇腾全部做到发布即支持,说明其底层能力高度通用。当前头部模型共同面对三堵墙:MoE的卡间通信、百万token的内存压力、低精度推理的可靠性,能系统解决这三件事的AI软硬件平台将率先抢占下一代基础设施入口。
发布于 上海
