@AdinaYakup: Step-3.7-Flash 来自@StepFun_ai的新VL模型 198B/11B活跃参数 - MoE 256K上下文 3推理等级 高达400 tokens/秒
摘要
StepFun 发布了 Step-3.7-Flash,这是一个新的视觉语言 MoE 大模型,拥有 198B 参数(11B 激活),256K 上下文,推理速度高达 400 tokens/秒。
查看缓存全文
缓存时间: 2026/05/29 14:11
Step-3.7-Flash 🔥 来自 @StepFun_ai 的新VL模型
✨ 198B / 11B 激活 - MoE ✨ 256K 上下文 ✨ 3种推理级别 ✨ 高达400 token/秒 🤯 https://t.co/zNgbnsMEsl
相似文章
stepfun-ai/Step-3.7-Flash
Step 3.7 Flash 是一个198B参数的稀疏MoE视觉语言模型,每个token有11B活跃参数,支持256k上下文和三种推理级别,专为高吞吐量的代理工作流设计。
@nathanhabib1011: 来自 @StepFun_ai 的 Step-3.7-Flash 是一个低调的赢家。效果极为惊艳,是HuggingFace排行榜上参数量低于500B的最佳模型……
Step-3.7-Flash(来自 StepFun_ai)被突出显示为 Hugging Face 排行榜上参数量低于500B的最佳模型,具有强大的多模态性能。
stepfun-ai/Step-3.7-Flash-GGUF
StepFun 发布了其 198B 参数的稀疏 MoE 视觉语言模型 Step-3.7-Flash 的 GGUF 量化版本,支持本地部署,最高 256K 上下文长度和可选择的推理级别。
@modal: Modal上Step 3.7 Flash的Day 0支持 - 198B参数的MoE,11B激活参数 - 256K上下文 - 3个推理层级 - N…
Modal宣布为Step 3.7 Flash AI模型提供Day 0支持,该模型拥有198B参数的MoE(11B激活参数)、256K上下文、三个推理层级,以及原生图像和视频理解能力。
@modal:DeepSeek-V4-Flash 总参数为 284B,每个 token 激活 13B。结合混合压缩注意力机…
DeepSeek-V4-Flash 是一个 284B 参数的 MoE 模型,每 token 激活 13B 参数,采用混合压缩注意力机制,可降低 1M token 上下文的 KV 缓存需求。可使用 Modal 上的 SGLang 提供服务,在单个 B300 上实现快速解码。