Qwen3.8-27b:我见过本地模型中最高水平的'自主性'
摘要
本文赞扬Qwen3.8-27b在执行复杂多步骤任务时展现出的卓越自主性,它无需人工干预即可进行多次工具调用,并且所有操作都在消费级硬件如RTX 3090上本地运行。
仅凭一个提示,提供我的凭证和大学名称,qwen3.8-27b成功地从那有点糟糕且复杂的大学网站网络中拉取了我的课程表。它无需人工干预,并执行了80次工具调用。另一次,我要求它调查一个社交媒体网络上的用户,它找到了一个公开视频,下载了它,每几秒提取帧以便'观看'视频,并安装了openAI whisper运行转录以理解上下文,然后选择性地放大并提亮一些帧以查看动作。这东西竟然在我自己的硬件(单张RTX 3090)上运行,简直不可思议,普通公众没有意识到我们的现实已经多么赛博朋克。量化:Unsloth's Q4_K_S(kv cache量化为q8)上下文:150k
相似文章
Qwen 3.8 27b 发布:本地AI的重大新闻
Qwen 3.8 27b,一个参数小于300亿的AI模型,已经发布,适合在消费级硬件如RTX 3090或M4 Pro上进行本地推理,有可能取代基于云的AI订阅,并将工作流程转移到本地。
@davis7:@0xSero 帮我把本地模型配置好了,我没想到它们现在竟然这么强大了。这算是前沿(frontier)级别了吗……
作者强调了在 RTX 5090 上本地运行开源 Qwen 3.6-27B 模型的卓越能力,指出其在编程任务上的强劲表现,并与商业模型进行了对比,尽管本地部署过程颇具挑战性。
@sudoingX:更新:Qwen 3.6 27b dense q4 在单张 3090 上一次生成了 Octopus Invaders 游戏。Hermes Agent 驱动了整个事…
用户基准测试表明,Qwen 3.6 27B dense 模型(Q4 量化)能够在单张 RTX 3090 上通过单次提示自主生成一个完全可玩的多文件游戏,性能显著优于其前代版本,且无需任何人工干预。测试结果突显了在消费级硬件上本地代码生成和智能体能力方面的重大改进。
试了 Qwen3.6-27B-UD-Q6_K_XL.gguf 配 CloudeCode,真不敢相信居然能用
用户报告称,在 RTX 5090 本地运行 Qwen3-27B-UD-Q6_K_XL.gguf,200K 上下文速度约 50 tok/s,编码表现出乎意料地可用,标志着本地模型质量大幅跃升。
Qwen3.7:智能代理前沿(15分钟阅读)
阿里巴巴Qwen团队发布了Qwen3.7-Max,这是一款专有智能代理基础模型,在Terminal-Bench 2.0、SWE-Pro、GPQA Diamond等多个基准测试中取得最高分,并在多种代码环境中表现一致。