Qwen 3.6 其实很适合 vibe-coding,而且比 Claude 便宜多了

Reddit r/LocalLLaMA 模型

摘要

用户展示了在本地使用 llama-server 运行 Qwen 3.6 27B/35B,将 Claude Code 的 API 成本从 142 美元降至 8 小时 vibe-coding 会话不到 4 美元,4500 美元的双 RTX 3090 设备可在 30 天内回本。

启动了 Claude Code,把它指向我本地运行的 Qwen,然后,嗯,它 vibe coding 得相当完美。我昨天用 Qwen3.6-35B-A3B (Q4) 启动了一个项目,今天早上换成了 27B (Q8),两个都运行得很好!跑在一台双 3090 的机器上,200k 上下文。用的是 Unsloth Q_8。没什么花哨的设置,就是跟着 Unsloth 的快速入门指南走,然后把上下文调高了。 ```bash #!/bin/bash llama-server \ -hf unsloth/Qwen3.6-27B-GGUF:Q8_0 \ --alias "unsloth/Qwen3.6-27B" \ --temp 0.6 \ --top-p 0.95 \ --top-k 20 \ --min-p 0.00 \ --ctx-size 200000 \ --port 8001 \ --host 0.0.0.0 ``` ```bash #!/bin/bash export ANTHROPIC_AUTH_TOKEN="ollama" export ANTHROPIC_API_KEY="" export ANTHROPIC_BASE_URL="http://192.168.18.4:8001" claude $@ ``` 最爽的是看到 Claude Code 的费用估算。在那 8 个小时里,我用 API 的话要花掉 142 美元,而实际上电费不到 4 美元(假设我的机器全程跑 1kW,实际上比这低,但我现在没接功率计)。所以对于那些说"本地部署不值得"的人,这台机器我花了大约 4500 新西兰元组装,回本周期大约是 260 小时的本地使用来替代 Anthropic API。如果我全职当日常工作用,大概 30 天回本。如果我 24/7 开足马力搞"暗软件工厂",10 天就回本。偶尔晚上启动项目的话,回本周期大概也就几个月吧? 我 vibe coding 了啥?没什么太花哨的。一个 Rust 写的服务器,监控我的服务器资源,然后通过 SSE 暴露给 Web 仪表盘。全栈开发,端到端,全部用本地模型完成。我跟它交互了大概 5 次。一次是给提示,另外 4 次是 UI/UX 改动和 bug 修复。 我可能还不会马上取消 Codex 订阅(我没能让 Codex 配合 llama-server 工作?),但可能也快了。
查看原文

相似文章

Qwen 3.6 27B:本地开发的理想之选

Hacker News Top

Qwen 3.6 27B 被赞誉为强大的本地 AI 模型,在通用智能方面超越预期,适用于代码生成等实际任务,并能通过 llama.cpp 轻松运行。