AliesTaha/fable-traces
摘要
fable-traces 是一个基于 Qwen3-4B-Instruct-2507 的紧凑型指令微调语言模型,专为简短对话回复而调优,可在单块中端GPU上运行。基于 Apache 2.0 许可发布。
查看缓存全文
缓存时间: 2026/07/04 18:38
AliesTaha/fable-traces · Hugging Face
一个紧凑的指令微调语言模型,基于 Qwen/Qwen3-4B-Instruct-2507。fable-traces 专为简短、对话式的回复而微调,可在单个中端GPU上流畅运行。
使用
from transformers import AutoModelForCausalLM, AutoTokenizer
import torch
repo = "AliesTaha/fable-traces"
tok = AutoTokenizer.from_pretrained(repo)
model = AutoModelForCausalLM.from_pretrained(repo, dtype=torch.bfloat16, device_map="auto")
messages = [{"role": "user", "content": "Tell me something interesting."}]
ids = tok.apply_chat_template(messages, add_generation_prompt=True, return_tensors="pt").to(model.device)
out = model.generate(ids, max_new_tokens=100, do_sample=False)
print(tok.decode(out[0, ids.shape[1]:], skip_special_tokens=True))
使用vLLM部署:
vllm serve AliesTaha/fable-traces
详细信息
| 属性 | 说明 |
|---|---|
| 基础模型 | Qwen3-4B-Instruct-2507 |
| 参数 | ~4B |
| 精度 | bfloat16 (safetensors) |
| 提示格式 | ChatML — 使用分词器的聊天模板 |
| 上下文长度 | 继承自基础模型 |
许可证
Apache 2.0,遵循基础模型。
相似文章
DavidAU/Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-无审查-NEO-CODER-MAX-MTP-GGUF
Qwen3.8-27B 的微调版本,显著减少了思考令牌数量,同时在 ARC-C 和 ARC-E 等关键 AI 基准测试上超越了其他模型,针对消费级硬件进行了优化。
Claude Fable 5 蒸馏版
Qwable-v1 是一个开放权重的代理编码模型(35B MoE,3B 活跃参数),通过串联来自 Claude Opus 4.7 推理和 Claude Fable-5 代理工具使用轨迹的蒸馏构建。它能够显式思考 CoT 链,并在提示时充当类似 Claude-Code 风格的代理。
peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF
Tiel-Coder-35B-A3B-GGUF是一个针对编码任务优化的动态量化AI模型,在诸如SWE-bench-Live和多轮对话等基准测试中取得有竞争力的表现,同时对于本地推理具有高效率。
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking
MiniCPM5-1B-Claude-Opus-Fable5-Thinking 是一个紧凑的 10 亿参数思考型语言模型,基于 openbmb/MiniCPM5-1B 在 Fable 5 数据上微调而成,增强了编码和指令跟随能力,同时保留了原生的思考聊天模板和工具调用格式。它支持高达 128K 的上下文长度,适合本地部署。
Qwen/Qwen3.6-27B-FP8
阿里巴巴发布 Qwen3.6-27B-FP8,一款 27B 参数的 FP8 量化模型,在代理式编码与推理基准上表现强劲,现已上架 Hugging Face。