
9月22日,腾讯混元正式发布 Hy Image 3.5 Preview,新模型支持文生图、图生图和多轮编辑,并进一步强化文本渲染、画面布局、真实感与编辑一致性。
相比上一代 Hy Image 3.0,这次升级的重点已经不只是“生成一张更漂亮的图片”,而是开始向连续视觉创作延伸:用户可以提供参考图片,在对话中不断提出修改要求,模型结合此前的上下文持续生成和编辑。
腾讯表示,Hy Image 3.5 Preview经过内部数百名专业设计师参与的GSB盲测,相较Hy Image 3.0综合能力提升约30%,测试结果与Seedream 5.0 Pro相当,并略高于Nano Banana Pro和Qwen-Image-3.0 Pro。(搜狐)
需要注意的是,这些横向比较属于腾讯基于内部盲测给出的结果,并非统一第三方基准测试。目前公开的部分第三方图像模型榜单中,不同评测体系的结果也存在明显差异,因此更适合作为能力定位,而非严格的模型排名。(Hugging Face)
从单轮生图转向多轮编辑
Hy Image 3.5 Preview最大的产品变化,是引入了更加完整的多轮创作机制。
腾讯云的技术文档显示,该模型采用类似Chat的Messages协议,可以把文本和参考图片作为多模态输入,并保留历史上下文进行连续编辑。也就是说,用户不需要每次重新描述整张图片,而可以围绕上一轮结果继续提出修改要求。(腾讯云)
例如,先生成一张产品海报,再要求调整人物、替换背景、修改文案或改变画面比例,模型可以基于此前的创作过程继续完成编辑。
在参考图方面,腾讯此次产品资料显示单次最多可上传5张参考图,可以用于人物、商品、风格以及构图等不同维度的参考。
这实际上意味着生图产品的交互方式正在发生变化:Prompt不再只是一次性指令,而逐渐成为视觉创作过程中的持续对话。
面向专业视觉生产,而不只是AI绘图
Hy Image 3.5 Preview继续强化了几个此前图像模型竞争非常激烈的能力,包括文字生成与排版、画面真实感、风格表现以及编辑前后的内容一致性。
这些能力对应的也不再只是个人娱乐型生图,而是商业海报、电商素材、产品视觉、剧集分镜、设计草图等实际生产环节。
腾讯此次还将模型接入元宝、ima、Miora、WorkRally、OnSolo、WorkBuddy等产品。其中,Hy Image 3.5 Preview此前已经在元宝App进行灰度测试。腾讯披露,灰度期间整体生图请求量提升超过50%。(搜狐)
这背后其实是腾讯在做一个很明确的尝试:把图像模型从独立的生成工具,嵌入到办公、内容生产和AI Agent工作流中。
API价格保持低位,4K能力进一步开放
价格方面,腾讯云此前公布的国内API价格为2K图像0.15元/张,国际版为0.024美元/张,并按照输出图片计费。企业和开发者可以通过腾讯云TokenHub调用模型。(搜狐)
不过,从腾讯云最新技术文档来看,Hy Image 3.5 Preview实际支持的最高输出规格已经达到4096×4096,即4K级别,并非仅限于2K。API还支持自定义尺寸,最高面积达到16777216像素。(腾讯云)
这意味着2K更准确地说是当前公开价格所对应的规格,而不是模型的最高输出上限。
从API设计来看,Hy Image 3.5 Preview也比上一代更接近一个可以直接嵌入应用的视觉模型:支持多模态输入、多轮编辑、自定义尺寸、随机种子以及外部搜索增强等能力,并采用同步接口直接返回生成结果。(腾讯云)
国内图像模型竞争进入“工作流”阶段
过去一年,国内AI图像生成市场的竞争重点主要集中在画质、文字生成和审美表现。
而随着Seedream、Qwen-Image、混元等模型不断迭代,竞争开始向另一个方向移动:模型能否稳定参与真实的视觉生产流程。
这也是Hy Image 3.5 Preview值得关注的地方。
从单张图片生成,到参考图控制,再到多轮连续编辑,模型正在逐步承担过去由设计师反复修改完成的部分工作。
与此同时,成本也成为模型进入生产环境的重要变量。腾讯将Hy Image 3.5 Preview以较低的API价格开放给开发者,再通过元宝、办公工具和其他应用扩大实际使用场景,本质上是在同时推进模型能力、调用成本与应用生态三条线。
对于图像生成而言,下一阶段真正需要验证的,或许已经不是“能不能生成一张惊艳的图片”,而是模型能否在几十轮甚至更长的创作流程中,持续保持指令理解、视觉一致性和可控编辑能力。
Hy Image 3.5 Preview,正是在这一方向上的一次进一步尝试。





