标签
一个针对双AMD 7900 XTX GPU优化的llama.cpp GitHub分支,显著提升了Qwen 3.8 Q8模型的解码速度至82 tokens/秒。
一场在X上的直播,由Tom Turney和参与者测试Qwen3.8 AI模型,伴有轻松音乐并分享结果。