IT之家 9 月 16 日消息,火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本,API 全量上线火山方舟。
IT之家从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。
本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。

除豆包外,TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本,企业无需更换 API 接入节点。
Agent 任务交付方面,官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉显著减少,更忠于工具调用事实。在金融投研、办公自动化等长报告任务中,结论有据可查,推进更稳。
以金融投研为例,官方称模型具备分析师级别分析框架,能自主拆解研究需求、查询高质量数据源并建模分析,产出专家级建模底稿。
多模态 Coding 能力强化,模型更懂复杂代码仓库,面对跨文件、长程问题能理清项目结构与模块关系、定位根因并修复,覆盖从理解需求到运行验证的端到端流程。
借助 VLM 能力,模型可直接读懂设计稿、图纸和操作录屏,将视觉信息转为前端代码和游戏逻辑,Web 3D 开发和游戏场景呈现效果提升。
多模态理解方面,视频推理能力增强,可在视频中定位证据、跨帧整合后作答,也能对照 SOP 辨认操作并解释原理。物理教学、工程、实验操作、医疗等专业内容理解提高,视频标注、内容质检、长视频剪辑与定位摘要等场景受益。
图像理解在 3D 物体与密集图文方向增强:可识别 CAD 工件、游戏引擎 3D 元素及 AR 空间;工程图纸尺寸标注与公差符号、PDF 图注脚注与表头层级、财报研报表格提取和跨页脚注引用等处理精度提升。
Token 效率同步优化,推理轮次和工具调用次数降低。图像推理和视频推理的 Token 消耗比上一代减少 30% 以上,看图解题、图像质检、视频审核等高频场景成本更低。
