以下为 2026-09-28 当日视角下,AI / 算力显卡 / 开源大模型方向最新且高影响的 10 条(已避开历史里的昇腾960、Qwen3.8、GLM-5.3、GPT-6、混合推理系统、TPU v7 等老素材,改打“软件栈 / 生物计算 / 显卡诊断 / 3D芯片 / 数据中心扩张”等角度):
#ai# 新闻~
1. Open3D-PIMC 开源:清微智能×智源发布面向 3D 算力芯片的编程模型与开源框架,接入 FlagOS,可对接 30+ 国产芯片,补上“先进硬件+低效软件”短板。
2. 摩尔线程 S5000 跑通 Protenix-v2:国产 MUSA 栈完成开源生物分子结构预测模型全链路推理,端到端较国际主流 GPU 快约 26%。
3. 英伟达申请“GPU 诊断 AI 智能体”专利:用通用问题体+报告精读体+路由中枢做显卡/NVLink/数据中心训练瓶颈的对话式排查,显卡运维进入 ChatOps 时代。
4. xAI Colossus 2 冲 66 万 Blackwell GPU:马斯克披露已跑 11 万 GB200 + 44 万 GB300,年底再叠 22 万×3 批,全球最大 AI 数据中心继续拉高算力天花板。
5. PyTorch 原生支持昇腾成定局:昇腾进 PyTorch 官网后端、2000+ 卡接社区 CI、贡献 20 万行核心代码,国产算力从“插件适配”切到“上游共建”。
6. 高通 HBC 把 AI 算力和内存贴脸放:高带宽计算架构把推理/训练访存路径压短,端侧与数据中心 GPU 都在卷“破内存墙”。
7. AMD RDNA5 预热 GDDR7 路径:新驱动加入 GDDR7 显存支持,消费级 AI 显卡从纯光追游戏卡转向“本地大模型推理卡”。
8. DeepSeek DSec 智能体沙盒外溢影响:单集群日产 300 万沙盒环境,Agent 训练从“调提示词”升级到“造环境工厂”,开始影响国产推理集群调度设计。
9. OpenAI GPT-6 提示缓存降本:重复前缀不复算,长上下文 Agent / 代码库问答 / 多轮办公场景推理账单明显下探,模型竞争转“上下文经济”。
10. 国产超节点集体化:壁仞/沐曦/燧原/摩尔线程在 WAIC 后集中推超节点,“单卡跑分”退场,“组网 MFU、跨芯调度、十万卡稳定性”成主战场#罗永浩被举报 理性等待#
发布于 河南
