@PrajwalTomar_: 目前还没人讨论这个,真让我惊讶。一家实验室刚刚开源了一个8B模型,解决了图像AI中最恼人的问题…
摘要
一家实验室开源了 SenseNova U1.5-Lite,这是一个8B参数的图像AI模型,允许在不破坏其他元素的情况下对图像进行特定更改,如在信息图和海报上的演示。
查看缓存全文
缓存时间: 2026/08/27 15:28
目前还没人讨论这个,这让我觉得不可思议。
一个实验室刚刚开源了一个8B模型,解决了图像AI中最烦人的难题:只做一处修改而不破坏画面其他内容。
我用自定义图形测试了 SenseNova U1.5-Lite。给它一张真实的信息图,要求在保留所有标签的前提下,彻底改变整体风格。
接着生成文字密集的海报,仅修改副标题;再处理4K场景,观察细节是否得以保持。
有趣的并非生成的新图像,而是它最大程度保留了原图内容。
其独特之处在于架构设计——无需独立的视觉编码器或变分自编码器。同一模型能同时理解图像、生成图像并执行编辑,因此精准知道哪些元素需要保留。
下方轮播图展示的是实际输出效果。
相似文章
@heyshrutimishra: 我们衡量图像模型的方式一直是错的。多年来,我们关注的是相似度,然后是照片级真实感,每个基准测试都聚焦于……
该推文认为,图像模型一直以照片级真实感而非生产就绪性来评估,然后介绍了基于 NEO-Unify 架构的 SenseNova U1 Pro,该架构支持原生 8K 分辨率和迭代式设计推理。
@AdinaYakup: SenseNova-Vision 商汤科技的新模型将所有计算机视觉视为生成任务 - 7B - CC BY-NC 4.0 (非商业性…
商汤科技发布了SenseNova-Vision,这是一个7B参数的模型,将所有计算机视觉任务统一为生成任务,并提供了开放权重、指令语料库、基准、论文和演示。
SenseNova U1.5-Lite 全面发布:专家训练、OPD蒸馏、推理统一模型
SenseNova U1.5-Lite 已发布,具备专家训练和OPD蒸馏功能,创建统一模型用于推理,改进了指令跟随和图像生成能力。
@abidlabs:对于一个8B模型来说,非常出色!在这里查看 @Gradio 应用:https://huggingface.co/spaces/LiquidAI/LFM2.5-8B-A1B…
Liquid AI 发布了 LFM2.5-8B-A1B,这是一个8B MoE模型,拥有1.5B活跃参数和128K上下文,为边缘设备优化。
sensenova/SenseNova-U1.5-8B-MoT
SenseNova-U1.5-8B-MoT 是一款用于增强视觉创作的原生统一多模态模型,在图像生成质量、文本渲染和精确控制方面有所改进。