标签
SoL-Refiner 是一个一步视频精炼器,通过单个去噪步骤将低分辨率视频输出转换为4K分辨率,实现了显著的速度提升并在质量指标上超越了现有的精炼器。
埃隆·马斯克预测,月球和火星上的生产将以指数级加速,每年增长超过一倍,直到遇到自然限制,并参考了Kardashev scale的时间线。
Pruna-Qwen-Image-2.1 是一组 LoRA 适配器,可显著加快 Qwen-Image-2.1 中的图像生成和编辑,将步数从 40 步减少到 5 或 8 步,性能提升高达 6.3 倍。
一条推文讨论了当前的AI话语,暗示加速与incel文化相关联,安全与 slut 文化相关联,未提供进一步解释。
本文提出'Early-Bird Decoding',这是一个通过可学习块大小和并行采样来加速扩散大语言模型的框架,在不修改预训练权重的情况下实现了显著的吞吐量提升。
Osprey引入了一种针对推测解码中草稿模型的目标无关预训练方法,通过从现成模型中引导并适应最少的特定目标工作来提高效率,在多个大语言模型上实现了显著的接受率提升。
AI 研究人员 François Fleuret 用一个比喻评论了当前人工智能领域的现状:发展步伐不断加速,而不确定性与炒作也愈演愈烈。
验证感知训练(VAT)通过在训练中模拟顺序验证并自适应损失权重以匹配接受模式,改进投机解码的草稿模型,从而提升接受长度和推理加速。
一条推文讨论了数据中心项目如何因政治担忧而遭到地方市议会的反对,将其与中国能源进展形成对比,并强调加速人工智能发展以争夺主导地位的紧迫性。
本文基准测试了MiniMax-H3视频生成在8×H200 GPU上使用SGLang Diffusion的加速效果,通过SSIM衡量质量,最高实现6.24倍速度提升。
Alibaba PAI 发布了 LoRA 检查点,用于通过并行解码蒸馏加速 MiniMax-H3 视频生成,从而在 8 步内实现高效推理。
TileMix引入了一种以分块为中心的混合精度注意力机制,以加速大型语言模型中的长上下文预填充,通过将分数分块组路由到FP16或INT8路径来平衡准确性和效率。
本文介绍了Consistency Forcing(CForce),一种针对扩散大语言模型的蒸馏技术,通过将早期阶段的预测与后期阶段对齐来提升并行解码,从而改善速度-质量权衡。
这是 MiniMax-H3 的早期预览版 LoRA,支持在 4 步采样(而非约 20 步)内联合生成视频和同步音频,采样速度约提升 5 倍,并附带 ComfyUI 自定义节点和三个 bf16 检查点。