← 回總覽

效果惊艳!又一个信息图开源神器问世!

📅 2026-07-17 17:05 GitHubDaily 人工智能 2 分鐘 1806 字 評分: 82
AI 模型 信息图 图像编辑 开源模型 商汤科技
📌 一句话摘要 商汤发布 SenseNova U1 Infographic-V3 开源模型,新增局部文字与风格编辑能力,显著提升信息图可编辑性。 📝 详细摘要 文章介绍了商汤科技最新开源的信息图生成模型 SenseNova-U1-8B-MoT-Infographic-V3(简称 Infographic-V3)。该模型在继承 V2 强大的图文融合、复杂排版与结构化视觉表达能力的基础上,首次加入信息图编辑功能,支持局部文字修改、整体风格切换以及全局布局调整,使得用户能够在不重新生成的情况下对图像进行精细打磨。文章通过多组前后对比图示展示了文字替换、风格迁移、布局美化等具体编辑案例,并给出了在

📌 一句话摘要

商汤发布 SenseNova U1 Infographic-V3 开源模型,新增局部文字与风格编辑能力,显著提升信息图可编辑性。

📝 详细摘要

文章介绍了商汤科技最新开源的信息图生成模型 SenseNova-U1-8B-MoT-Infographic-V3(简称 Infographic-V3)。该模型在继承 V2 强大的图文融合、复杂排版与结构化视觉表达能力的基础上,首次加入信息图编辑功能,支持局部文字修改、整体风格切换以及全局布局调整,使得用户能够在不重新生成的情况下对图像进行精细打磨。文章通过多组前后对比图示展示了文字替换、风格迁移、布局美化等具体编辑案例,并给出了在 WeEdit 和 Qwen-Image-Bench 两个基准上的评测结果,表明模型在文字编辑和综合图像生成方面表现优秀。最后指出团队正在探索让模型实现自我检查与自我纠错的闭环,以进一步提升一次性交付高质量视觉内容的能力。模型权重及文档已在 Hugging Face、ModelScope 等平台开放下载。

💡 主要观点

- Infographic-V3 首次加入信息图编辑能力,支持局部文字和全局风格修改。 用户无需重新生成整张图,只需标注区域或使用自然语言 Prompt,即可在保持原有版式和视觉结构的前提下完成文字替换、风格迁移等操作。

模型在保持强大生成能力的同时,通过在中期训练阶段引入编辑数据实现生成与编辑的统一训练。 技术团队在 MT 阶段合成了多样化的信息图编辑数据,联合训练 T2I 和图像编辑任务,使模型在保留图文融合优势的同时获得文字编辑和风格编辑能力。
在 WeEdit 和 Qwen-Image-Bench 基准上表现优异,尤其在编辑榜单 WeEdit 上得分最高。 Infographic-V3 在 WeEdit 上均分达到 5.89 分,位列开源模型之首;在 Qwen-Image-Bench 上也呈稳步增长,验证了其文本编辑、局部编辑及综合图像生成的综合实力。
提供多种编辑方式:区域标注定点修改、自然语言 Prompt 指令、全局风格与布局编辑。 用户可以通过框选目标区域进行精确文字替换,也可以直接描述需求让模型理解并执行修改;此外还支持切换中传风格、亮色风格、复古羊皮纸地图风等全局风格,以及重新组织内容层次与版面结构。
模型已在 Hugging Face、ModelScope 等平台全面开源,附带详细文档与社区支持。 开发者可直接下载权重文件,参考官方文档进行二次开发或直接使用,社区也提供了模型卡和使用示例,降低了使用门槛。

💬 文章金句

- 新版本延续了 V2 强大的信息图生成能力,并首次加入信息图编辑能力:当画面整体已经令人满意时,用户无需推倒重来,只需针对局部文字或整体风格进行修改,即可继续完善作品。

  • 让好图不再因小错作废。
  • 在编辑榜单 WeEdit 上,Infographic-V3 均分为 5.89 分,表现为开源模型中的最优。
  • 为了获得稳定的信息图编辑能力,技术团队没有只在后训练上调整,而是回到 MT(中期训练)阶段重新设计训练路径。
  • 目前 SenseNova U1 信息图增强版 V3(SenseNova-U1-8B-MoT-Infographic-V3)已面向全球用户开源。

📊 文章信息

AI 初评:82

来源:GitHubDaily

作者:GitHubDaily

分类:人工智能

语言:中文

阅读时间:10 分钟

字数:2469

标签: AI 模型, 信息图, 图像编辑, 开源模型, 商汤科技

阅读完整文章

查看原文 → 發佈: 2026-07-17 17:05:00 收錄: 2026-07-18 00:00:50

🤖 問 AI

針對這篇文章提問,AI 會根據文章內容回答。按 Ctrl+Enter 送出。