@mr_r0b0t:我毫不掩饰地认为,专业的小型模型是高效本地代理团队的一部分。下面这个模型肯定会加入我的团队……
摘要
一款新的小型AI模型——Qwopus 3.5-Coder 4B,被推荐作为本地代理团队中专业角色的候选,并具有微调和数据集生成的潜力。
查看缓存全文
缓存时间: 2026/05/30 22:47
众所周知,我认为专业小模型是运行良好的本地智能体团队的一部分。
下面这个模型肯定会申请加入我的团队 🤩❤️
Kyle Hessling (@KyleHessling1): 大家好,再次见面!欢迎,Qwopus 3.5-Coder 4B!
大量精彩的模型发布接踵而至,我们有了许多出色的新候选模型用于微调和数据集生成。
我们非常兴奋,目前正在运行大量精彩的实验!
我们整理了这份
相似文章
@KyleHessling1: 大家好,再次见面!我们又有一个非常有趣的9b,这个专门为工具调用和智能体编码…
发布了名为Qwopus3.5-9B-Coder的新型9B微调模型,该模型针对工具调用和智能体编码工作流进行了优化,在SWE-bench和HermesAgent-20测试中取得了出色成绩,同时可在经济实惠的硬件上运行。
@TheAhmadOsman: 终于大家都在谈论小型专用模型了,下面的推文是17个月前发的
一条推文强调了Jina AI的ReaderLM-v2,这是一个4GB的小型模型,能从杂乱的DOM元素中高精度提取信息,体现了小型专用语言模型的趋势。
结构化工作流与小规模本地模型的力量
作者详细介绍了使用小型本地模型(Qwen3.5 9B)结合结构化工作流和map-reduce模式来管理上下文限制、构建自定义智能体循环的经验,并已用其取代Claude Code处理大部分任务。
@cjzafir: 我日常使用的模型:> Codex 5.5 high (fast) > Deepseek v4 pro via API > Kimi 2.6 via API 我正在微调的模型...
用户分享了一份日常使用的AI模型列表(Codex 5.5、Deepseek v4 pro、Kimi 2.6)以及用于微调的模型(Qwen 3.5系列、Gemma4 E4B、GPT-oss 20B),目标是微调小型语言模型(SLM)成为专家语言模型(ELM)。
超智能小型模型与超高效率大型模型之争
本文探讨了功能强大的本地化小型大语言模型与为效率优化的大型模型之间的争议,并通过MiniCPM5 2B和MoE Qwen3.6 35B在CPU上的运行表现进行对比分析。