@modal: Modal上Step 3.7 Flash的Day 0支持 - 198B参数的MoE,11B激活参数 - 256K上下文 - 3个推理层级 - N…
摘要
Modal宣布为Step 3.7 Flash AI模型提供Day 0支持,该模型拥有198B参数的MoE(11B激活参数)、256K上下文、三个推理层级,以及原生图像和视频理解能力。
查看缓存全文
缓存时间: 2026/05/29 23:58
Day 0 支持 Modal 上的 Step 3.7 Flash。
- 198B 参数的 MoE,11B 活跃参数
- 256K 上下文
- 3 个推理级别
- 原生图像与视频理解
很高兴与 @StepFun_ai 和 @sgl_project 合作完成此事。https://t.co/3tC2Ow9a2t
相似文章
@modal:在 Modal 上对 Inkling-Small 的 Day 0 支持。 - 276B 参数 MoE,12B 激活 - 1M 上下文 - 可变思考强度 …
Thinking Machines 发布了 Inkling-Small,这是一个 276B 参数的混合专家模型,具有 12B 激活参数、1M 上下文以及原生图像/音频理解能力,现已在 Modal 上可用,并支持 NVIDIA B300。
stepfun-ai/Step-3.7-Flash
Step 3.7 Flash 是一个198B参数的稀疏MoE视觉语言模型,每个token有11B活跃参数,支持256k上下文和三种推理级别,专为高吞吐量的代理工作流设计。
@charles_irl: 来自你的友好本地疯子 (r/localllama) 的更多氛围检查 https://reddit.com/r/LocalLLaMA/s/vqBVXvIT…
Modal 宣布对 Step 3.7 Flash 提供 Day 0 支持,该模型是一个 198B 参数的 MoE 模型,拥有 256K 上下文窗口和原生图像/视频理解能力。
@modal:DeepSeek-V4-Flash 总参数为 284B,每个 token 激活 13B。结合混合压缩注意力机…
DeepSeek-V4-Flash 是一个 284B 参数的 MoE 模型,每 token 激活 13B 参数,采用混合压缩注意力机制,可降低 1M token 上下文的 KV 缓存需求。可使用 Modal 上的 SGLang 提供服务,在单个 B300 上实现快速解码。
@AdinaYakup: Step-3.7-Flash 来自@StepFun_ai的新VL模型 198B/11B活跃参数 - MoE 256K上下文 3推理等级 高达400 tokens/秒
StepFun 发布了 Step-3.7-Flash,这是一个新的视觉语言 MoE 大模型,拥有 198B 参数(11B 激活),256K 上下文,推理速度高达 400 tokens/秒。