model-conversion

标签

Cards List
#model-conversion

在任意后端运行任何模型(网站)

TLDR AI · 2026-09-10 缓存

ZeroModels是一个工具,能够使用Keras 3在多个后端(JAX、PyTorch、TensorFlow)上运行任何AI模型,权重从原始检查点转换而来,且运行时无需依赖transformers或torch。

0 人收藏 0 人点赞
#model-conversion

Kijai/MiniMax-H3_comfy

Hugging Face Models Trending · 2026-08-07 缓存

一个Hugging Face仓库,托管了为ComfyUI使用而转换的MiniMax-H3模型,以及用于加快推理的Lightx2v蒸馏LoRA。

0 人收藏 0 人点赞
#model-conversion

连接胜过混合:不同Transformer规模之间迁移了什么——以及什么没有迁移

arXiv cs.LG · 2026-08-05 缓存

本文研究了同一系列(Pythia)中不同规模Transformer模型之间迁移的内容,表明表示对齐而权重不对齐,并且通过初始化而非直接权重投影进行转换效果最佳。

0 人收藏 0 人点赞
#model-conversion

超越KV重建:投机解码中MLA草稿模型的功能重构

arXiv cs.LG · 2026-07-31 缓存

本文提出功能重构方法,将MHA/GQA检查点转换为投机解码的MLA草稿模型,直接优化注意力模块以保留令牌接受率。报告在涉及Llama/Qwen模型和多种转换方法的192种配置中持续改进。

0 人收藏 0 人点赞
#model-conversion

@Italianclownz: 已将 Qwen 3.6 35b a3b 转换为 ROCmfp4,运行飞快。使用了 mtp 版本,因为此 ROCmfp4 也可以融合 MTP 的优势…

X AI KOLs Timeline · 2026-05-24 缓存

将 Qwen 3.6 35b a3b 模型转换为 ROCmfp4 格式,利用 MTP 优势提升 AMD 硬件上的性能。

0 人收藏 0 人点赞
#model-conversion

提取的MTP张量GGUF文件——用于嫁接的较小捐赠模型。

Reddit r/LocalLLaMA · 2026-05-07

作者提供了仅包含Qwen3.6模型MTP张量的提取GGUF文件,用户可通过显著小于完整模型文件的下载大小来嫁接张量。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈