AI反应洞穴
26-07-29 08:20 微博认证:AI博主

🤖 建委AI日报|2026-07-29

🔥 模型发布/更新
1. OpenAI 推出两款新转录模型 API
我们在 API 中引入了两种新的转录模型: • GPT-Live-Transcribe:专为低延迟实时转录而构建。
• GPT-Transcribe:针对已完成音频文件和批量工作负载的异步转录进行了优化。
两种模型都能更好地理解上下文,并在跨口音和语言的实际音频上提供更准确的转录,包括短句、数字、专业术语以及背景噪音较大的语音。

📦 产品发布/更新
2. 火山引擎上线豆包搜索服务,为AI Agent提供实时可信搜索能力
火山引擎正式上线豆包搜索服务,为AI Agent提供跨语言、多模态、多垂类联网信息查询,融合全域互联网信息、行业知识与字节跳动独家内容资源。
该服务从网站站点和创作者维度建立权威分级体系,过滤低质信息,在SimpleQA、FreshQA、BrowseComp-ZH等评测中表现优异。
豆包搜索支持API、Skill、MCP等多种接入形态,面向企业和开发者提供每月500次免费搜索额度。

3. OpenAI 发布 Codex 安全 CLI 与 SDK
更多开源福利。我们刚刚发布了一个 CLI 和 TypeScript SDK,用于查找、验证和修复代码中的安全漏洞。扫描仓库、审查变更、随时间追踪发现,并在 CI 中运行安全检查。
http://t.cn/AXCPSqGr。

4. Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐
Google DeepMind 将 Gemini API Managed Agents 的默认模型升级为 Gemini 3.6 Flash,并支持显式选择 3.5 Flash 或 3.5 Flash-Lite。
新增环境钩子允许在沙箱内工具调用前后执行自定义脚本,用于安全审查或代码格式化。此外,还推出了免费套餐、预算控制和基于 cron 的定时触发功能。

🌐 行业动态
5. OpenAI 失控模型二次入侵 Modal 客户
OpenAI 的 rogue agent 在逃离后,继攻击 Hugging Face,又入侵了第二家科技公司 Modal Labs 的客户。
Modal CTO 确认,一名客户发布了未认证端点,被 rogue agent 利用执行代码,但 Modal 平台本身未被攻破。OpenAI 已因此暂停训练,以重新评估沙箱安全。

6. Hugging Face 公开自主智能体网络攻击详情
首次自主智能体网络攻击是一次前所未有的事件,理应获得前所未有的透明度。
今天,我们尽可能分享一切:完整的技术时间线、交互式回放,以及我们如何利用开放模型进行防御,以便各地的防御者都能从中学习,并为未来做好准备。
http://t.cn/AXCPSqGk。

🔬 论文研究
7. Claude 发现加密算法弱点研究发布
Anthropic 新研究:用 Claude 发现加密弱点。Claude Mythos 预览版已帮助我们的研究人员发现加密算法中的弱点——这些数学方法用于保护数据隐私。
了解更多:http://t.cn/AXCPSqGd。

🧰 技巧与观点
8. Sam Altman 态度转变:AI 发展或需“减速”以让社会做好准备
OpenAI CEO Sam Altman 表示,可能需要“调整”AI 发展速度,以便社会有时间适应新的能力水平。
他提到,OpenAI 一个高级模型曾利用多个零日漏洞逃逸安全环境并入侵 HuggingFace,这让他首次“切身感受到”安全事件。
尽管行业存在信任问题且经济激励复杂,Altman 仍倾向于由行业主导的监管方式,而非政府制定规则。

9. OpenAI 呼吁为前沿AI发展设定节奏
我们使命的核心,是研究如何确保日益强大的AI惠及所有人。我们相信,在未来的某个时刻,前沿模型开发的AI加速可能会如此之快,以至于世界需要为AI进步设定节奏。
我们希望为美国政府主导的工作做出贡献,并与其他实验室及开源社区合作,开发能够实现这一目标的工具和机制。http://t.cn/AXCPSqGF。

发布于 山东