你的位置:安庆异型材设备价格_建仓机械 > 新闻资讯 > 汕尾异型材设备 苹果全能视觉 AI 模型 UniGen 1.5 亮相,看图、修图、绘图三一

汕尾异型材设备 苹果全能视觉 AI 模型 UniGen 1.5 亮相,看图、修图、绘图三一

时间:2025-12-24 04:14:21 点击:61 次
塑料管材设备Q Q:183445502

IT之家 12 月 19 日消息汕尾异型材设备,科技媒体 9to5Mac 昨日(12 月 18 日)发布博文,报道称苹果研究团队近日发布多模态 AI 模型 UniGen 1.5,成功在单一系统中集成了图像理解、生成与编辑三大核心功能。

与主要依赖不同模型分别处理任务的传统方案不同,UniGen 1.5 大的突破在于构建了一个统一的框架,仅凭一个模型即可同时完成图像理解、图像生成以及图像编辑任务。研究人员认为,这种统一架构能让模型利用强大的图像理解能力反哺生成果,从而实现更的视觉输出。

在图像编辑域,模型往往难以捕捉用户微妙或复杂的修改指令。苹果团队为解决这一难题,创引入了名为“编辑指令对齐”的后训练阶段。

该技术并不直接让模型修改图片,而是要求模型先根据原图和指令,预测出目标图像的详细文本描述。这种“先想后画”的中间步骤,迫使模型在生成终图像前,须深度内化用户的编辑意图,从而大幅提升了修改的准确度。

这一中间步骤有助于模型在生成终图像之前更好地理解预期的编辑内容。

除了指令对齐汕尾异型材设备,UniGen 1.5 的另一大贡献在于强化学习层面的创新。研究团队成功设计了一套统一的奖励系统,能够同时应用于图像生成和图像编辑的训练过程。

此前,由于编辑任务涉及从微调到重构的巨大跨度,统一奖励机制难实现,塑料挤出机设备而这一突破让模型在处理不同类型的视觉任务时,能够遵循一致的质量标准,显著增强了系统的“抗干扰”。

UniGen-1.5 的文本转图像生成和图像编辑功能的一些示例

UniGen-1.5 的文本转图像生成和图像编辑功能的一些示例

在多项行业标准基准测试中,UniGen 1.5 展现了强劲的竞争力。数据显示,该模型在 GenEval 和 DPG-Bench 测试中分别获得 0.89 和 86.83 的高分,显著优于 BAGEL 和 BLIP3o 等近期热门方法。

在图像编辑项测试 ImgEdit 中,其 4.31 的综得分不仅越了 OminiGen2 等开源模型,更与 GPT-Image-1 等有闭源模型表现持平。

尽管整体表现优异,UniGen 1.5 目前仍存在一定局限。研究人员在论文中坦承,由于离散去标记器(discrete detokenizer)在控制细粒度结构方面存在不足,模型在生成图片内的文字时容易出错。

“在相高市早苗围绕‘台湾有事’的国会答辩引起日中关系恶化的背景下,为缓和两国紧张关系,议员联盟方面强调了继续开展交流的重要。”共同社写道,“日本经济团体联会会长筒井义信也请求中方接受经济代表团明年1月访问北京的计划。”

图 A 展示了 UniGen-1.5 在文本转图像生成和图像编辑任务中的失败案例。以上图源:苹果论文

此外,在部分编辑场景下,模型偶尔会出现主体特征漂移的问题,例如猫的毛发纹理改变或鸟的羽毛颜偏差,这些问题将是团队未来的优化。

IT之家附上参考地址

UniGen-1.5: Enhancing Image Generation and Editing through Reward Unification in Reinforcement Learning汕尾异型材设备

服务热线
官方网站:aqyxc.gangbianzhishuidai.com
工作时间:周一至周六(09:00-18:00)
联系我们
QQ:2852320325
邮箱:w365jzcom@qq.com
地址:武汉东湖新技术开发区光谷大道国际企业中心
关注公众号

Powered by 安庆异型材设备价格_建仓机械 RSS地图 HTML地图

Copyright Powered by365站群 © 2025-2035