@YRSM_Simon: 7天,5亿token,Local AI GLM 5.2,deepseek v4 flash,Qwen 3.6 35B A3B,三个模型几乎能满足绝大部分业务自动化需求了
摘要
A user reports that using three local AI models (GLM 5.2, DeepSeek v4 Flash, Qwen 3.6 35B A3B) over 7 days with 500 million tokens can cover most business automation needs.
查看缓存全文
缓存时间: 2026/07/21 14:45
7天,5亿token,Local AI
GLM 5.2,deepseek v4 flash,Qwen 3.6 35B A3B,三个模型几乎能满足绝大部分业务自动化需求了 https://t.co/qULfBAOg13
相似文章
@DeRonin_: 我目前的本机AI配置:- 2x DGX Spark 链接 (256gb) > GLM 5.2 @ 2bit, 推理 + 代理循环 - Mac Studio M3 Ultr…
一位用户描述了他们完全本地的AI堆栈,使用多个硬件设备运行GLM、Qwen和Kimi等中国模型,声称相比GPT-5.5和Opus 4.8等前沿模型节省了87%的成本,同时提到了自托管视频生成的计划。
@cjzafir: 我日常使用的模型:> Codex 5.5 high (fast) > Deepseek v4 pro via API > Kimi 2.6 via API 我正在微调的模型...
用户分享了一份日常使用的AI模型列表(Codex 5.5、Deepseek v4 pro、Kimi 2.6)以及用于微调的模型(Qwen 3.5系列、Gemma4 E4B、GPT-oss 20B),目标是微调小型语言模型(SLM)成为专家语言模型(ELM)。
@cryptoresetlife: @support_huihui 在 Mac Studio M3 Ultra (512GB) 上成功部署无审查版 GLM5.2 754B 参数模型 (231GB GGUF),948 tokens / 4分25秒 ≈ 3.6 tokens/s
无审查版 GLM5.2 754B 参数模型(231GB GGUF)已成功部署在配备512GB内存的 Mac Studio M3 Ultra 上,实现了约3.6 tokens/s的速度。
@jakevin7: DeepSeek cache hit 命中率 95%,舒服了。 Maka 在最新一轮的长程任务 Deepseek 模型下的表现太出色了。 全跑完接近 18 小时,接近 4 亿 token,33块消耗。 Make builder 们太给力了…
DeepSeek cache hit 高达95%,Maka 桌面AI工作台在长程任务中表现出色,支持多种模型和工具,开源且本地优先。
@DeRonin_: 我跑了一整天Fable 5,却还没触及我的极限,为什么?因为我在这里停止了为闲聊支付高昂的费用……
一位用户分享了一种高效使用多个AI模型(Fable、Opus、Codex、DeepSeek、GLM、Qwen、Kimi)的详细工作流策略,通过根据成本和能力委派任务、使用单个CLAUDE.md路由表、以及避免闲聊来减少token使用。