我的开源技术栈完成了!!LLM - @deepseek_ai V4 Flash 0731 视觉 - Qwen 3 VL 2B 图像 - @Alibaba_Qwen Image …
摘要
一位用户宣布其全面开源AI技术栈已完成,该技术栈使用了Deepseek、Qwen和MiniMax的模型,运行在NVIDIA DGX Spark系统上。
查看缓存全文
缓存时间: 2026/08/16 16:12
我的开源技术栈已经全部就位!!
语言大模型 - @deepseek_ai V4 Flash 0731 视觉模型 - Qwen 3 VL 2B 图像生成 - @Alibaba_Qwen Image 3 视频生成 - MiniMax H3 与 @ltx_io 2.5 语音转录 - faster whisper base 声音克隆 - Chatterbox Turbo 音乐创作 - @MiniMax_AI Music 3!
……全部运行在一台 @NVIDIAAI DGX Spark 上!
(视频/图像生成时会自动从 dsv4 降级至 Qwen 27b)
已经迫不及待想再搞一台,让它们全天候 24 小时运行!!
MiniMax(官方)(@MiniMax_AI): 🎵MiniMax-Music3 新一代开源权重、生产就绪且功能全面的音乐模型
相似文章
@DeRonin_: 我目前的本机AI配置:- 2x DGX Spark 链接 (256gb) > GLM 5.2 @ 2bit, 推理 + 代理循环 - Mac Studio M3 Ultr…
一位用户描述了他们完全本地的AI堆栈,使用多个硬件设备运行GLM、Qwen和Kimi等中国模型,声称相比GPT-5.5和Opus 4.8等前沿模型节省了87%的成本,同时提到了自托管视频生成的计划。
@dee_hw: Qwen3.8-27B 即将发布。我们开源了我们的 2x RTX 5090 构建,让你可以在本地托管:本地部署、私有、无速率限制…
Autonomous AI 开源了一款由 2x 或 4x NVIDIA RTX 5090 驱动的个人 AI 计算机构建方案,实现完全本地、私有的 AI 托管,无需 API 成本或速率限制。
@SpaceTimeViking: Qwen3.6 27B 在新的 AEON ULTIMATE VLLM 镜像上备受青睐 @NVIDIAAI DGX SPARK OPTIMIZED!https://github.com/AEO…
AEON-7 发布了 Qwen3.6-27B 的完全无审查、能力增强的 ablitation 版本,针对 NVIDIA DGX Spark 进行了优化,采用 NVFP4 量化和 DFlash 推测解码以提升性能。
@Saboo_Shubham_:开源 AI 势头强劲。DeepSeek v4 Flash 是一款准前沿模型,拥有高达 100 万的上下文窗口。它可本地…
文章重点介绍了 DeepSeek v4 Flash,这是一款拥有 100 万上下文窗口的准前沿开源模型,并指出其能够通过 2 比特量化在 128GB 内存的 Mac 上本地运行。
@sgl_project: 小型模型之王回归了!来自@Alibaba_Qwen的Qwen3.8-27B已经开源,SGLang已经实现了首日支持:-…
Qwen3.8-27B,一个来自阿里巴巴的270亿参数多模态AI模型,现在已经开源,并在SGLang中提供了首日支持,提供高推理速度和在编码与办公任务上的卓越性能。