SenseNova U1.5 Lite 预览版发布

Reddit r/LocalLLaMA 模型

摘要

SenseNova 发布了 U1.5 Lite 模型的预览版,基准测试显示其在图像生成和编辑方面有所提升,支持原生 4K 输出,中文和英文文本渲染得到改进,但已知的弱点仍然存在。

SenseNova 发布了 U1.5-Lite-Preview 基准测试:Qwen-Image-Bench 从 47.14 提升到 55.20;ImgEdit-Bench 从 3.90 提升到 4.37;GEdit-Bench-en 从 7.47 提升到 8.17。 主要更新: - 原生 4K 生成,纹理、材质和光照细节更佳 - 改进中英文文本渲染,适用于海报、信息图等密集排版 - 支持带层级约束的长结构化提示词(其文档中一个示例提示词约 3,880 个中文字符,涵盖时间线、配色方案、构图规则和禁用元素) - 图像编辑保持局部性,修改一个区域不会影响图像其他部分 - 新工作流:多参考图合成、风格迁移、无需重新生成的连续迭代编辑 仍是预览版质量。短提示词理解、小字体渲染、面部细节和美学一致性是公认的弱点。复杂场景下的世界知识和编辑稳定性也需要打磨。 GitHub: https://github.com/OpenSenseNova/SenseNova-U1 HF: https://huggingface.co/sensenova/SenseNova-U1.5-8B-MoT-Preview
查看原文

相似文章