【GPT周报|智谱发布GLM-5.3模型;DeepSeek发布V4 Pro正式版和Harness工具;Manus恢复独立公司运营;腾讯预告发布更大参数模型Hy4】http://t.cn/AXNTp0Pn 智谱发布GLM-5.3模型 后训练提升性能、网络安全能力对标Mythos 5
8月14日下午,智谱发布GLM-5.3。公司表示,该模型在GLM-5.2相同的基座模型基础上,通过后训练大幅提高了模型的编程能力和网络安全能力。智谱称GLM-5.3为“编程能力最强的开源模型”,在内部评测中较GLM-5.2提升50%,在多项公开基准测试中超越Kimi K3,取得开源模型第一。网络安全方面,智谱称GLM-5.3在该领域的表现“超出预期”,在白盒代码审查与漏洞发现等安全任务中,表现持平Claude Mythos 5和GPT-5.6 Sol,但在考察深度推理和漏洞利用任务完成能力的测试中,GLM-5.3表现逊于北美顶级闭源模型。由于性能提升全部来自后训练,智谱表示,可能“还远未开发出这个基座的智能上界。”完成安全评估和模型加固后,GLM-5.3将在发布两周后开放权重。
谷歌发布Gemini 3.7 Flash 费用减半、开发能力提升
当地时间8月14日,谷歌推出Gemini 3.7 Flash模型,距离该系列上代模型Gemini 3.6 Flash发布间隔不到三周。谷歌表示,Gemini 3.7 Flash模型专为编程和Agents(智能体)场景打造,在软件工程、知识工作和网页开发等工作流上实现了大幅提升,同时每百万tokens费用为Gemini 3.6 Flash的一半。谷歌公布的数据显示,Gemini 3.7 Flash在软件工程、网页编辑、复杂资料处理评测中的表现大幅超越3.6 Flash,多项评测分数接近或超越Claude Sonnet 5及GPT-5.6 Terra。大模型测评网站Artificial Analysis显示,Gemini 3.7 Flash的智能指数略高于Claude Sonnet 5,略低于GPT-5.6 Terra,但在tokens输出速度上排名第一。该模型已上线谷歌订阅制智能体平台Gemini Spark,并对Google AI Pro及Ultra订阅用户开放。
