MiniMax M3 开始在 API 上推出
摘要
MiniMax 正在 API 上推出其 M3 模型,具有 100万 token 的上下文窗口。
100万 token 上下文窗口 https://preview.redd.it/goe30iwkek4h1.png?width=576&format=png&auto=webp&s=d0fbe072777e48a4205b1d1e0492286e7f4ec316 https://preview.redd.it/3b5dnhwkek4h1.png?width=628&format=png&auto=webp&s=2854aa1c72035f32d0595cc702e11d5f5c256273
相似文章
@FinanceYF5: Claude Opus 5已发布3天
Claude Opus 5 已发布,被描述为一款深思熟虑且积极主动的模型,以一半的价格即可接近前沿智能。
我为AI代理构建了一个API,用于编程检查域名并启动注册
作者构建了一个API,使AI代理能够以编程方式检查域名可用性并启动注册。
Neutrino-1 8B
Neutrino-1 8B是一个拥有8.19B参数、采用专有三值权重格式的Transformer模型,使其能够部署在8GB显存的GPU上,并从一个仅3.88GB的模型文件中以高解码速度服务多个平台。
@DanKornas: 您的会议数据在变得有用之前不应离开您的基础设施。Vexa是一个开源、自托...
Vexa是一个开源、自托管的会议机器人及转录API,使开发者能够捕获实时对话并将其转化为自有知识。
ThinkingCap-Qwen3.6-27B 值得一看
用户报告称,与 Qwen3.5-27B 相比,ThinkingCap-Qwen3.6-27B 的每秒 token 数(tps)有所提升,且质量未受影响,建议将其作为日常主力模型使用,直至 Qwen 推出下一个版本。