TielCoder 的 22GB 4-bit 量化在最新现实编程问题上与 Opus4.6 medium 持平,超越 KAT-Coder 和 Nail,成为最强且最快的混合专家模型选择。
摘要
TielCoder 是一个新的 35B-A3B 混合专家模型,专为编码任务优化,在现实世界问题上提供高速度和高准确性,超越了 Opus4.6 medium 等模型。
Qwen3.8-27B 非常出色,但速度较慢。一个更强大的 35B-A3B 混合专家编码器,能够快速运行和解决真实代码库问题(即使在受限硬件上),是工具箱中宝贵的补充。这是我测试过的最强和最一致的 35B-A3B 模型,在正确性和速度上表现突出,并且在处理真实代码库时,是所有 35B-A3B 模型中修复最快的。除了基于 Ornith-1.5 的微调,TielCoder 使用代码加权 imatrix 进行动态量化,并采用针对令牌高效和正确代理编码优化的聊天模板。GGUFs: https://huggingface.co/peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF MLX: https://huggingface.co/peculiar-ragdoll/Tiel-Coder-35B-A3B-MLX-oQ4e
相似文章
CyberTiel 35B-A3B 的无审查4位量化版本在真实代码库问题上轻松超越 Opus 4.6 medium,耗时仅为 Qwen3.8-27b medium 的27%。
CyberTiel 35B-A3B 是一款无审查的4位量化AI模型,专为编码任务优化,在真实代码库问题上表现优于 Opus 4.6 medium,并且速度远快于 Qwen3.8-27b medium。
35B-A3B工具调用基准测试:原始Qwen对比KAT Coder、Ornith和Tiel-Coder
本文基准测试了经过微调的Qwen3.6-35B-A3B模型的工具调用能力,显示Ornith 1.5和Tiel-Coder表现最佳,接近更大Qwen模型的分数。该研究使用了大量GPU时间和tool-eval-bench工具进行评估。
peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF
Tiel-Coder-35B-A3B-GGUF是一个针对编码任务优化的动态量化AI模型,在诸如SWE-bench-Live和多轮对话等基准测试中取得有竞争力的表现,同时对于本地推理具有高效率。
@scaling01: Opus 4.8 是目前最好的编程模型。Cognition 的 FrontierCode 可能是最高质量的编程基准测试……
Cognition 推出了 FrontierCode,这是一个高质量的编程基准测试,超越了单纯的单元测试,用于衡量代码的可维护性、回归安全性和质量,由 20 多位开源开发者精心设计了 150 个任务。
使用 Codex 而非 Opencode
一位用户对比了 Codex 和 Opencode 这两个 AI 编程工具,并思考在本地使用 Qwen 3.6 27b Q8 的情况下是否应该切换。