【AIGC日报】2025.12.19 | 今日要闻速览:
1、火山引擎发布豆包大模型1.8,日均调用量突破50万亿次
2、谷歌发布Gemini 3 Flash反击OpenAI,多模态推理表现抢眼
3、OpenAI发布最强编程模型GPT-5.2-Codex,优化Win11原生环境
4、小米MiMo-V2-Flash开源发布,代码能力比肩顶尖闭源模型
5、阿里千问App接入高德地图,AI助手开始具备物理世界行动力
6、前OpenAI大牛姚顺雨加盟腾讯任首席AI科学家,助力架构调整
7、苹果发布UniGen 1.5多模态模型,实现看图/修图/绘图三合一
以下为具体要闻内容:
1.火山引擎正式发布豆包大模型 1.8,具备更强多模态 Agent 能力
在火山引擎原动力大会上,总裁谭待正式发布豆包大模型 1.8。新版本具备更强的多模态 Agent 能力,支持 256K 超长上下文及原生 API 上下文管理,擅长处理复杂多步任务。数据显示,截至今年 12 月,豆包大模型日均调用量已突破 50 万亿次,较去年同期增长超 10 倍,已有逾百家企业在平台上突破万亿 tokens 使用量。
来源:IT之家
2.谷歌深夜反击 OpenAI:Gemini 3 Flash 模型发布,部分测试优于 GPT-5.2
谷歌发布注重效率的 Gemini 3 Flash 模型,旨在降低成本的同时保留旗舰级推理能力。测试显示,Gemini 3 Flash 在多模态推理测试 MMMU-Pro 中取得 81.2% 的成绩,超过了 OpenAI GPT-5.2 的 79.5%。目前该模型已作为默认模型推送至 Gemini App,并免费开放。同时,谷歌 AI Mode 新增了对 Nano Banana Pro 图像生成能力的直接访问入口。
来源:IT之家
3.OpenAI 最强智能体编程模型 GPT-5.2-Codex 登场:AI 写代码新巅峰
OpenAI 发布 GPT-5.2-Codex,专为解决现实软件工程问题设计。该模型引入“上下文压缩”技术提升长程任务效率,并显著增强了在 Windows 10/11 原生环境下的编码可靠性。新模型能精准解读 UI 截图并将其转化为原型代码。为防范风险,OpenAI 同时启动“可信访问试点计划”,邀请安全专家在受控环境中进行威胁模拟。
来源:IT之家
4.小米发布 MiMo-V2-Flash 开源模型,代码能力比肩标杆闭源模型
小米发布总参数 309B 的开源 MoE 模型 Xiaomi MiMo-V2-Flash。该模型专为智能体设计,代码能力超越所有开源模型,比肩闭源标杆 Claude 4.5 Sonnet,但推理成本仅为其 2.5%。小米同步推出在线聊天服务 MiMO Studio,支持深度搜索。模型权重及代码已按 MIT 协议全面开源。
来源:IT之家
5.阿里千问 App 接入高德地图,开始具备物理世界的理解和行动能力
阿里千问 App 接入首个生态场景——高德地图。接入后,AI 助手能够根据动态现实信息实现从“意图理解”到“服务执行”的跨越。用户不再只是得到文字建议,而是能直接获取包含推荐餐厅、酒店及出行方案的可视化决策卡片。未来阿里旗下的消费、支付等核心业务场景也将陆续接入。
来源:IT之家
6.消息称腾讯大模型团队架构调整:前 OpenAI 研究员姚顺雨任要职
腾讯完成组织架构调整,新设 AI Infra 部、AI Data 部等。前 OpenAI 核心成员姚顺雨(Vinces Yao)加盟并出任首席 AI 科学家,向腾讯总裁刘炽平汇报,同时兼任大语言模型部负责人。姚顺雨曾是 OpenAI 智能体产品的主要贡献者。报道称腾讯正不惜成本挖掘 AI 人才,校招最高可达 2 倍薪资。
来源:IT之家
7.苹果全能视觉 AI 模型 UniGen 1.5 亮相,看图、修图、绘图三合一
苹果研究团队发布 UniGen 1.5 多模态模型,通过统一架构集成图像理解、生成与编辑功能。该模型引入“编辑指令对齐”技术,通过“先想后画”的中间步骤提升修改准确度。在 ImgEdit 测试中,其表现与 GPT-Image-1 等闭源模型持平。虽然在细粒度文字生成上仍有局限,但其统一奖励系统显著增强了跨任务的稳定性。
来源:IT之家
(AI声明:以上所有信息来源于网络权威来源,由AI进行文字整理及配图生成)
#AI创造营##德里克文ai日报##德里克文[超话]#
