谷歌最强 Gemini 4 Pro 开测 SVG 生图惊艳
谷歌近日正式开放最新AI模型Gemini 3.1 Pro的测试通道,作为Gemini 3系列的结构性强化版本,该模型不仅推理能力显著提升,更首度实现原生SVG可交互图形生成,在多模态生成领域带来代际式升级。本次升级距离谷歌首次推出Gemini原生图像生成功能仅过去一个多月,迭代速度明显加快。

谷歌Gemini 3.1 Pro完成结构性能力强化
不同于常规的小版本参数迭代,Gemini 3.1 Pro在多项高难度基准测试中表现亮眼:在ARC-AGI-2测试中得分达77.1%,面对从未见过的陌生问题结构时,模式抽象与规则推导能力大幅提升;Humanity’s Last Exam、GPQA Diamond等测试的稳定性和推理完整度也均有显著增长,部分指标已进入行业最强梯队。同时该模型在成本控制上表现突出,处于高分+低单次成本的区域,企业级部署性价比更高。谷歌还展示了名为Murmuration的演示项目,模型可模拟成千上万只虚拟飞鸟根据简单规则形成复杂群体行为,展现出强大的复杂系统模拟能力。
原生SVG生图能力惊艳设计前端圈
本次升级最受关注的突破当属原生SVG生成能力:不同于过往多模态模型仅能生成静态图片,Gemini 3.1 Pro可直接输出可编辑、可无限放大、可直接嵌入项目的SVG代码,需要模型同时理解几何逻辑、层级关系、路径构造与动画控制规则。实测中该模型的SVG生成已覆盖多个实用场景:
- 带路径动画的UI交互动效,元素结构清晰、运动曲线自然
- 日夜模式切换的路径形变与颜色渐变叠加,光影逻辑处理准确
- 复杂图标之间的路径插值转换,满足高阶前端动画需求
- 植物生长过程等动态效果的代码化生成
搭配Gemini 2.0 Flash使用时,可支持模型自主构思内容并生成对应图像;搭配Gemini 2.5 Pro使用时,还可实现“图像转代码自然行为表示”的功能,进一步拓展开发场景。
多模态生成实测细节表现稳定
谷歌在官方demo中展示了该模型在常规图像生成领域的升级效果:图像质量、文本渲染准确度、生成速度均较实验版本的Gemini 2.0 Flash有明显提升,能将完全不同属性的元素自然融合,抠图与素材融合处理干净,甚至支持希腊文等小语种文本的准确渲染,不会出现字符错误。在换图、扩图场景的测试中,模型可精准遵循用户指令,仅修改指定元素(如仅更换吊床颜色,其余素材完全一致),指令遵循度表现优秀。不过部分细节仍有优化空间,比如少量logo颜色存在细微偏差等小问题。
开发者免费体验商用路径清晰
目前上述功能已可在Google AI Studio的Starter Apps板块免费试玩,开发者可通过Google AI Studio和Vertex AI的Gemini API集成使用,对应模型为“gemini-2.0-flash-preview-image-generation”,单张图片生成成本约0.039美元(约合人民币0.28元),使用门槛较低。不过对比当前热门的GPT-4o生图能力,Gemini 3.1 Pro的整体表现仍有一定差距,且此前曾因种族和族群相关生成争议关闭过人物图像生成功能,后续仍需持续优化。