腾讯混元发布图像生成模型 Hy Image3.5 预览版,支持多图参考与专业级创作
模型能力全面升级
9月22日,腾讯混元正式发布了 Hy Image3.5 preview(混元图像3.5预览版)。这不是一次小修小补,而是在多个关键维度上的系统性提升。新模型支持文生图和图生图两种模式,单次最多可上传5张参考图,帮助模型更准确地理解用户意图。这种多图参考机制,让生成结果不再只是“看起来像”,而是能真正贴合具体的设计需求或视觉风格。
在文本渲染与布局方面,Hy Image3.5 preview 对复杂提示词的理解更精准,比如能正确处理“左侧放产品图,右侧配三行说明文字,字体用思源黑体”这类指令。真实感和风格表现力也得到加强——无论是写实人像、动漫插画,还是复古海报或科技感UI,模型都能更稳定地输出符合预期的结果。更重要的是,它在编辑一致性上有了进步:当你对一张图进行局部修改(比如换衣服、改背景),其他部分不会出现奇怪的扭曲或风格突变。
支持多轮创作与多种输出尺寸
Hy Image3.5 preview 还引入了多轮对话创作能力。这意味着你可以基于之前的生成结果继续提要求:“把刚才那张海报的主色调改成蓝色”“给人物加一副眼镜”,模型会结合历史上下文进行连续编辑,而不是从头开始。这种交互方式更接近人类设计师的工作流程,减少了重复沟通的成本。
输出方面,模型支持多种宽高比,并能生成最高2K分辨率的图像。这对专业场景尤为重要——商业海报、影视分镜、电商主图等通常需要高清晰度,而过去很多AI模型只能输出低分辨率图片,后期放大容易失真。现在,Hy Image3.5 preview 能直接满足这类需求,省去了额外的超分步骤。
覆盖从日常到专业的全场景
腾讯强调,这款模型既能服务普通用户的日常需求,也能支撑专业创作。在生活娱乐和学习场景中,你可以用它做旅游规划图、知识卡片、人像美化或简单修图;而在专业领域,它已能用于商业海报、剧集分镜、影视宣传物料、UI界面设计、创意插画、品牌视觉系统和电商素材制作。
这种“双轨覆盖”并非空谈。模型在研发阶段就与腾讯内部多个业务线深度协同,包括元宝、WorkRally、OnSolo、Miora、WorkBuddy 和 ima 等原生AI应用。这些产品分别面向办公、影视、游戏、知识管理等不同场景,反馈直接反哺模型优化。例如,影视团队可能更关注镜头构图和光影逻辑,而电商团队则在意商品细节的真实还原——这些真实世界的偏好被融入训练数据,让生成结果更“接地气”。
性价比突出,按输出图片收费
价格是 Hy Image3.5 preview 的一大亮点。腾讯云API对2K图像的定价为0.15元/张(国际版0.024美元/张),且仅对最终输出的图片收费,中间过程不计费。相比市面上动辄几毛甚至几元一张的专业级生图服务,这个定价确实有竞争力。
更关键的是,它在成本更低的同时实现了更好的效果。官方称,语言与视觉理解能力较 Hy Image3.0 进一步提升,但推理成本反而下降。这种“降本增效”的背后,可能是模型架构或训练策略的优化,虽然腾讯未透露技术细节,但对开发者和企业用户来说,这意味着可以用更少的钱获得更高质量的图像生成服务。
内部盲测表现亮眼
腾讯组织了数百名专业设计师进行GSB(Gold Standard Benchmark)盲测。结果显示,Hy Image3.5 preview 的综合胜率比上一代 Hy Image3.0 高出30%。在与竞品的横向对比中,它与 Seedream 5.0 Pro 基本持平,略优于 Nano-Banana Pro 和 Qwen-Image-3.0 Pro。
值得注意的是,这些测试者不是普通用户,而是每天与图像打交道的专业设计师。他们的评判标准更严苛——不仅看“好不好看”,更关注是否符合行业规范、能否直接用于生产流程。能在这样的群体中获得认可,说明模型确实达到了“专业可用”的门槛。
已在多款产品上线,提供免费体验
目前,Hy Image3.5 preview 已集成到腾讯多个AI产品中:
- 元宝APP:用户可免费使用人像编辑、智能P图、旅游规划图、知识信息图等功能。实际上,模型早在两个月前就在元宝中灰度上线,期间生图请求量增长超过50%,说明用户需求被有效激发。
- ima:作为AI知识管家,它能将用户的笔记或专业知识自动转化为可视化网页或PPT,适合学生和知识工作者。
- Miora、WorkRally、OnSolo:这三款面向创作者的工具同步推出为期两周的免费体验,分别聚焦创意插画、影视智能制作和剧集/游戏内容生产。

此外,模型能力也接入了腾讯云的媒体处理(MPS)、云点播(VOD)和TokenHub,企业可通过API直接调用。这种“原生应用+云服务”的双通道策略,既照顾了普通用户,也为B端客户提供了灵活的集成方案。
快速迭代的研发节奏
自今年2月重建基础设施以来,混元大模型保持着平均每两个月一次大版本迭代的速度。Hy Image3.5 preview 的研发延续了“preview先行、正式版跟进”的策略——先在真实业务场景中灰度测试,收集反馈后再打磨正式版。这种方式避免了闭门造车,让模型在解决实际问题中不断进化。
就在8月,腾讯刚发布了开源大语言模型 Hy4 preview,在代码、办公和科学任务上表现突出。如今图像模型的更新,标志着混元在多模态方向的加速。未来,语言与视觉能力的深度融合可能会带来更多跨模态应用场景,比如根据一段剧本自动生成分镜,或把会议纪要直接转成信息图。
总的来说,Hy Image3.5 preview 不只是一次技术升级,更是腾讯将AI能力嵌入具体工作流的一次实践。它没有堆砌华丽辞藻,而是用实实在在的功能、合理的价格和真实的业务反馈,试图回答一个问题:AI生成的图像,到底能不能被专业人士真正用起来?目前来看,答案正变得越来越肯定。