告别胡言乱语!豆包大模型 2.1 Pro 重磅更新:幻觉大幅降低,Agent 复杂任务交付更稳
9月16日,火山引擎官方宣布豆包大模型2.1 Pro正式更新至0915版本,API已全量上线火山方舟平台。用户下载或升级最新版豆包App后,选择“豆包 2.1 Pro(0915 新版)”模型即可体验相关能力。此外,TRAE已同步接入该版本,今年6月推出的Doubao-Seed-Evolving也完成同版本更新,企业用户无需更换API接入节点即可使用新功能。

豆包2.1 Pro强化Agent能力,幻觉减少任务交付更稳
本次升级针对企业生产级需求,重点优化了Agent任务交付能力:模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉现象显著减少,工具调用结果更贴合事实。在金融投研、办公自动化等需要生成长报告的场景中,输出结论有据可查,任务推进稳定性大幅提升。
官方以金融投研场景为例介绍,模型具备分析师级别的分析框架,能够自主拆解研究需求、查询高质量数据源并完成建模分析,输出专家级的投研底稿。有用户分享制作加拿大办公室选址调研报告的经历,将相关文档输入模型后,不仅拿到了结构清晰的分析结论,还获得了标注了发布机构、报告原名、精确链接和访问日期的31条来源附录,所有数据均可溯源,无需二次核验就能直接用于团队决策。还有电商从业者反馈,以往做洗衣机选品对比需要逐份翻文档、手动整理参数表格,稍有不慎就会填混数据,将5份产品文档输入模型后,不仅自动提取了洗涤容量、能效等级等所有要求的参数填入统一格式的表格,还自动抠出了产品展示图,原本需要数小时的工作几分钟就能完成。
多模态Coding能力升级,复杂代码问题端到端解决
本次更新对多模态Coding能力进行了强化,模型对复杂代码仓库的理解程度大幅提升,面对跨文件、长程代码问题,能够理清项目结构与模块关系、定位问题根因并完成修复,覆盖从需求理解到运行验证的端到端全流程。借助视觉语言模型(VLM)能力,模型还可以直接读懂设计稿、工程图纸和操作录屏,将视觉信息转化为前端代码和游戏逻辑,Web 3D开发和游戏场景的呈现效果明显提升。
有建筑行业用户分享,需要处理60份钢筋工程明细表,提取每张表的钢筋总重量和混凝土体积并汇总到总表时,模型不仅准确完成了所有数据的提取与匹配,还保留了原始表格的全部格式,甚至识别出了原文件中缺失的Sheet11未作补全,最终交付的汇总表经过手工核验完全准确,无需二次调整。
多模态理解精度提升,Token消耗降低超30%
多模态理解能力也在此次升级中得到增强:视频推理能力提升后,模型可在视频中定位关键证据、跨帧整合信息后作答,也能对照标准作业程序(SOP)辨认操作并解释原理,物理教学、工程实验、医疗等专业内容的识别准确率提高,视频标注、内容质检、长视频剪辑与定位摘要等场景的使用体验明显改善。图像理解在3D物体与密集图文方向实现突破:可识别CAD工件、游戏引擎3D元素及AR空间内容;工程图纸的尺寸标注与公差符号、PDF图注脚注与表头层级、财报研报表格提取和跨页脚注引用等处理的精度大幅提升。
此外Token效率同步优化,模型推理轮次和工具调用次数降低,图像推理和视频推理的Token消耗比上一代减少30%以上,看图解题、图像质检、视频