@no_stp_on_snek: 小步前进。昨晚朋友远程进行的AMD开发:https://github.com/Avarok-Cybersecurity/atlas/pull/1107……

X AI KOLs Timeline 工具

摘要

远程开发已为Atlas LLM推理引擎添加了AMD R9700(RDNA 4)支持,使其能够在硬件上运行像Qwen3.8-27B和Ornith-9B这样的模型。

小步前进。昨晚朋友远程进行的AMD开发:https://github.com/Avarok-Cybersecurity/atlas/pull/1107… 实现了R9700(RDNA 4 / gfx1201)的SCALE目标,从而让Atlas在显卡上运行Qwen3.8-27B和Ornith-9B。仍有工作要做,但几个小时的成果还不错 @AtlasInferenceX
查看原文
查看缓存全文

缓存时间: 2026/09/17 20:27

纯Rust大语言模型推理,从掌上设备到数据中心机架。

网站 · 文档 · 博客 · Discord · 部署指南

atlascybernetics.ai · docs.atlascybernetics.ai · blog.atlascybernetics.ai

相似文章

@no_stp_on_snek: 进行中

X AI KOLs Following

推广 Atlas Inference,这是一个开源推理服务工具,在 Qwen3.6-35B-A3B 基准测试上实现了 200+ tok/s 的性能。

@no_stp_on_snek: https://x.com/no_stp_on_snek/status/2052833502475833384

X AI KOLs Following

使用 Qwen2.5-32B-Instruct 搭配 longctx 和 vllm-turboquant 的单个 AMD MI300X 开源技术栈,在 MRCR v2 百万级上下文基准测试中取得了与 SubQ 闭源模型(0.659)相竞争的结果(0.601-0.688),表明开源权重方法已接近达到同等水平。