Qwen3.7预览版登陆Arena(1分钟阅读)
摘要
阿里巴巴Qwen宣布两大重要模型发布:Qwen3-Omni,首个原生端到端全模态AI,统一处理文本、图像、音频和视频;以及Qwen3-Next-80B-A3B,一款超高效MoE模型,每个token激活30亿参数,实现了SOTA性能,推理速度比Qwen3-32B快10倍。
Qwen3.7预览版现已登陆Arena,支持文本和视觉。Qwen3.7 Max预览版在Text Arena中排名第13,而Qwen3.7 Plus预览版在Vision Arena中排名第16。
查看缓存全文
缓存时间: 2026/05/20 00:21
# @Alibaba_Qwen 在 Thread Reader App 上的推文
来源:https://threadreaderapp.com/thread/2056403591464984753.html
## 更多来自 @Alibaba\_Qwen
Qwen 头像 (https://threadreaderapp.com/user/Alibaba_Qwen)
2025年9月22日
🚀 重磅推出 Qwen3-Omni —— 首个原生端到端全模态 AI,统一处理文本、图像、音频和视频于一个模型,无需在模态间取舍!
🏆 在 22/36 项音频与音视频基准测试中取得 SOTA 成绩 🌍 支持 119 种文本语言 / 19 种语音输入 / 10 种语音输出 ⚡ 延迟仅 211ms 🎧 可理解 30 分钟音频 🎨 通过系统提示词完全可定制 🔗 内置工具调用 🎤 开源字幕生成模型(低幻觉!)
🌟 开源了什么?我们已开源 Qwen3-Omni-30B-A3B-Instruct、Qwen3-Omni-30B-A3B-Thinking 和 Qwen3-Omni-30B-A3B-Captioner,助力开发者探索从指令跟随到创意任务等多种应用。
立即体验 👇 💬 Qwen Chat:chat.qwen.ai/?models=qwen3-... (https://chat.qwen.ai/?models=qwen3-omni-flash) 💻 GitHub:github.com/QwenLM/Qwen3-O... (https://github.com/QwenLM/Qwen3-Omni) 🤗 Hugging Face 模型:huggingface.co/collections/Qw... (https://huggingface.co/collections/Qwen/qwen3-omni-68d100a86cd0906843ceccbe) 🤖 ModelScope 模型:modelscope.cn/collections/Qw... (https://modelscope.cn/collections/Qwen3-Omni-867aef131e7d4f) 🎬 演示:huggingface.co/spaces/Qwen/Qw... (https://huggingface.co/spaces/Qwen/Qwen3-Omni-Demo)图片 (https://pbs.twimg.com/media/G1d9f1ZawAA0DRH.jpg)
在 Qwen Chat 中使用语音聊天和视频聊天功能,即可体验 Qwen3-Omni 模型。
性能图片 (https://pbs.twimg.com/media/G1eAq2KaoAI2beT.jpg)
阅读 4 条推文
Qwen 头像 (https://threadreaderapp.com/user/Alibaba_Qwen)
2025年9月11日
🚀 重磅推出 Qwen3-Next-80B-A3B —— 高效大语言模型的未来已至!
🔹 800 亿参数,但每个 token 仅激活 30 亿 → 训练成本降低 10 倍,推理速度比 Qwen3-32B 快 10 倍(尤其在 32K+ 上下文时!)
🔹 混合架构:Gated DeltaNet + Gated Attention → 兼顾速度与召回
🔹 超稀疏 MoE:512 个专家,10 个路由 + 1 个共享
🔹 多 token 预测 → 提升推测解码性能
🔹 性能超越 Qwen3-32B,推理与长上下文能力媲美 Qwen3-235B
🧠 Qwen3-Next-80B-A3B-Instruct 接近我们的 235B 旗舰模型。
🧠 Qwen3-Next-80B-A3B-Thinking 性能超越 Gemini-2.5-Flash-Thinking。
立即体验:chat.qwen.ai (https://chat.qwen.ai/)
博客:qwen.ai/blog?id=4074cc... (https://qwen.ai/blog?id=4074cca80393150c248e508aa62983f9cb7d27cd&from=research.latest-advancements-list)
Hugging Face:huggingface.co/collections/Qw... (https://huggingface.co/collections/Qwen/qwen3-next-68c25fd6838e585db8eeea9d)
ModelScope:modelscope.cn/collections/Qw... (https://modelscope.cn/collections/Qwen3-Next-c314f23bd0264a)
Kaggle:kaggle.com/models/qwen-lm... (https://www.kaggle.com/models/qwen-lm/qwen3-next-80b)
阿里云 API:alibabacloud.com/help/en/model-... (https://www.alibabacloud.com/help/en/model-studio/models#c5414da58bjgj)图片 (https://pbs.twimg.com/media/G0lVrz1aMAMqnVP.jpg)
预训练效率与推理速度图片 (https://pbs.twimg.com/media/G0ldAWZakAAGBdx.jpg)
预填充阶段:在 4K 上下文长度下,吞吐量几乎是 Qwen3-32B 的 7 倍。超过 32K 后,速度提升超过 10 倍。图片 (https://pbs.twimg.com/media/G0ldN9sbAAAwSft.jpg)
阅读 9 条推文
相似文章
Qwen 3.7 Preview
阿里巴巴在 Arena 上发布了 Qwen3.7-Max-Preview 和 Qwen3.7-Plus-Preview,在文本和视觉类别中均取得顶级排名。
Qwen 3.8
阿里巴巴发布Qwen3.8,这是一款拥有2.4万亿参数的模型,并计划很快进行开放权重发布。预览版Qwen3.8-Max-Preview现已在阿里巴巴的Token Plan平台、Qoder和QoderWork上可用。
Qwen3.8-Flash-Next
Qwen 发布了 Qwen3.8-Flash-Next,这是一款开放权重的多模态 MoE 模型,拥有 125B tokens,但只有 6B 活跃参数,提供了性能提升,并作为 Qwen4 架构的早期预览。
Qwen 3.8 27b 发布:本地AI的重大新闻
Qwen 3.8 27b,一个参数小于300亿的AI模型,已经发布,适合在消费级硬件如RTX 3090或M4 Pro上进行本地推理,有可能取代基于云的AI订阅,并将工作流程转移到本地。
Qwen/Qwen3.8-Flash-Next
发布 Qwen3.8-Flash-Next,一款开放权重的 AI 模型,引入混合注意力(Hybrid Attention)与 QSA 以及门控残差(Gated Residual)等架构创新,提升效率和可扩展性,预览未来的 Qwen4 架构。