qwen

标签

Cards List
#qwen

endless-frontier/BigBang-v1 - qwen 3.5 微调

Reddit r/LocalLLaMA · 8小时前

对 Qwen 3.5 的 BigBang-v1 微调版本持怀疑态度,指出尽管有 Bartowski 的 GGUF 转换,其基准测试声明可疑且可能存在测试集污染。

0 人收藏 0 人点赞
#qwen

难怪 Qwen 和 Gemma 差异这么大

Reddit r/LocalLLaMA · 昨天

一位用户分享了一个观察:Qwen 和 Gemma 对代码的分词方式非常不同,对于相同的 HTML/JS 输入,Qwen 使用的 token 数量远少于 Gemma,这可能解释了它们在编程和语言任务上的表现差异。他们还提到了 LiquidAI 的一个可能使用更高效分词器重新训练模型的项目。

0 人收藏 0 人点赞
#qwen

我为 Ollama 构建了一个本地实时语音栈:Parakeet STT → Qwen 2.5 7B → Qwen3-TTS

Reddit r/LocalLLaMA · 昨天

作者使用 Parakeet STT、Qwen 2.5 7B 和 Qwen3-TTS 构建了一个本地实时语音栈,并与 Ollama 集成。

0 人收藏 0 人点赞
#qwen

@berryxia: 卧槽~千呼万唤始出来? 终于定了!国行 Apple AI手册出来了,并且是千问。 Apple 官方文档已上线——《在 Mac 上配合 Apple 智能使用千问》。 将率先在 macOS 26.6 +系统使用,不过我还没有更新不知道是不是已…

X AI KOLs Timeline · 昨天 缓存

苹果官方文档确认国行 Apple 智能将采用千问(Qwen)模型,率先在 macOS 26.6+ 系统上使用,标志着 Apple AI 在中国市场落地的重要进展。

0 人收藏 0 人点赞
#qwen

还有人跟我一样对 Qwen 3.8 感到兴奋吗?

Reddit r/LocalLLaMA · 昨天

作者表达了对即将推出的 Qwen 3.8 模型的期待,分享了他们使用 Qwen 3.6 27B 进行本地 LLM 的体验,并讨论了自托管 AI 取代基于订阅的前沿模型的潜力。

0 人收藏 0 人点赞
#qwen

Qwen 35B-A3B MoE 与 27B dense 本地编码测试对比:速度快约 4 倍,质量差距远小于预期

Reddit r/LocalLLaMA · 昨天

一项本地实验,在代码维护任务上比较 Qwen 35B-A3B MoE 和 Qwen 27B dense,发现 MoE 模型速度快约 3.9 倍,且质量差距比预期更小。

0 人收藏 0 人点赞
#qwen

@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-Max,一个2.4万亿参数模型,每个token仅激活约950亿参数。一个……

X AI KOLs Timeline · 2天前 缓存

阿里巴巴发布了Qwen3.8-Max,这是一个2.4万亿参数的稀疏MoE模型,每个token激活950亿参数,支持100万token的上下文,并具有强大的智能体能力和基准测试结果,包括自主编码数天、电路设计,以及在Terminal Bench和PaperBench上超越竞争对手。

0 人收藏 0 人点赞
#qwen

Qwen 3.6 27B 在 llama.cpp 中的标志/设置

Reddit r/LocalLLaMA · 2天前

一位用户分享了他们在 RTX 5090 上运行 Qwen 3.6 27B 的 llama.cpp 服务器配置,达到了 80-100 t/s 的速度,并向社区询问其他设置和技巧。

0 人收藏 0 人点赞
#qwen

@Saccc_c: 想给deepseek v4 flash增加多模态能力,强烈建议配合qwen3.7-flash使用,目前最高性价比的模型组合 qwen3.7-flash是一个轻量多模态模型,速度快也很适合大部分图片理解任务。关键价格也够低,现在注册有100…

X AI KOLs Timeline · 2天前 缓存

推荐将 DeepSeek v4 flash 与 qwen3.7-flash 组合使用,以低成本为 DeepSeek 增加多模态图片理解能力,并提供了通过阿里云百炼和 Codex 的简单配置步骤。

0 人收藏 0 人点赞
#qwen

GLM 5.2、Kimi 2.7 还值得用吗?

Reddit r/LocalLLaMA · 2天前

这是一场讨论,质疑在 Kimi K3、Qwen 3.8 Max 和 DeepSeek V4 Pro 等新模型陆续推出后,GLM 5.2 和 Kimi 2.7 等旧 AI 模型是否仍对编程具有重要意义。

0 人收藏 0 人点赞
#qwen

我对 Artificial Analysis 的“智能指数”的不满

Reddit r/LocalLLaMA · 3天前

这篇文章批评了 Artificial Analysis 的智能指数,声称突然的 v4.1.1 更新重新调整了指标权重,使开源模型 Qwen 3.8 Max 的排名降至 Anthropic 的 Claude Opus 之下,暗示存在偏见或赞助商影响。

0 人收藏 0 人点赞
#qwen

双3090配置:Qwen 3.6 27B 上从 400 pp tokens/s 提升到 1600 pp tokens/s... 但 tps 略降。

Reddit r/LocalLLaMA · 3天前

使用双 RTX 3090 配置的用户发现,llama.cpp 的 `--split-mode tensor` 会在 CPU 上运行提示处理(约 400 t/s),而切换到 `--split-mode layer` 则可解锁 GPU 提示处理,速度超过 1600 t/s,且 token 生成速度仅略有下降。

0 人收藏 0 人点赞
#qwen

Qwen3.8 Max 在智能体指数中被评为最佳整体模型

Hacker News Top · 3天前 缓存

Qwen3.8 Max 目前在 Artificial Analysis 的智能体指数中排名第一,在独立评估中超越了其他领先的AI模型。

0 人收藏 0 人点赞
#qwen

Auto-fit vs tuned MoE offload: 564 → 1330 pp tok/s, unchanged decode (Qwen3.6-35B-A3B Q6 / RTX 3090)

Reddit r/LocalLLaMA · 3天前

A developer benchmarks Qwen3.6-35B-A3B Q6 on an RTX 3090, showing that offloading eight MoE expert layers to CPU and increasing batch sizes improves prompt processing by 2.36× (564→1330 tok/s) with no decode speed regression, using evolutionary search to find the tuning config.

0 人收藏 0 人点赞
#qwen

Qwen3.8-2.4T-A95B(又名 Qwen3.8-Max)开放发布时间:下周三

Reddit r/LocalLLaMA · 3天前

宣布下周三开放发布 Qwen3.8-2.4T-A95B(又名 Qwen3.8-Max),并提供 ModelScope 链接。

0 人收藏 0 人点赞
#qwen

bootai

Reddit r/LocalLLaMA · 4天前 缓存

bootai 是一个开源 UEFI 应用,可直接启动进入 AI 聊天/代码 REPL,在无操作系统的裸机上运行 Qwen2.5 和 SmolLM 模型推理,并配有手写网络驱动和 TCP/IP 协议栈。

0 人收藏 0 人点赞
#qwen

@HuggingModels:看看 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF。

X AI KOLs Timeline · 4天前 缓存

HuggingModels 宣布发布 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF,这是 Qwen 模型的微调和量化版本。

0 人收藏 0 人点赞
#qwen

Qwen 3.0 Image Pro

Hacker News Top · 4天前 缓存

QwenCloud 发布了 Qwen-Image-3.0-Pro,一款强大的图像生成模型,支持密集布局、微小文字渲染和原生多语言输出,将其定位为可部署的生产力工具。

0 人收藏 0 人点赞
#qwen

Qwen 开发者在近期 Twitter/X AMA 中的回应

Reddit r/LocalLLaMA · 4天前

Qwen 开发者在 Twitter 上举行了一场 AMA,确认了即将推出的 27B 模型,分享了 Qwen 3.8 的 2.4T 参数和 95B 激活参数的细节,并提到社区对发布的影响。

0 人收藏 0 人点赞
#qwen

卡在“A”:0.6B语言模型注意力到KDA线性化中的接口损伤诊断与修复

arXiv cs.CL · 5天前 缓存

本文研究了在单块GPU上将Qwen3-0.6B-Base的注意力层转换为KDA线性注意力的失败模式,识别出一种“接口损伤”——模型预测选项标签而非内容,并提出了一个针对格式的KL阶段来修复该问题。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈