标签
社区发现DeepSeek上传到Hugging Face的V4-Pro-0813开源模型架构实为V4 Flash,仓库下架后重新上传,且部分safetensors权重文件的哈希和大小也发生变化,疑似发布部署失误。
DeepSeek 推出 V4-Pro 和 V4-Flash,支持灵活的推理强度、原生 OpenAI Responses API,以及针对 Codex 优化的智能体工作流,可通过 API 和应用/网页使用。
DeepSeek 悄然发布了 V4 Pro (0813),其 API 文档显示支持 Responses API 格式并与 Codex 集成,可使用 deepseek-v4-flash/pro 模型。
DeepSeek v4 PRO,一个拥有1.6万亿参数的模型,通过SSD流式传输在128GB MacBook m5 max上运行,展示了本地运行大规模模型的能力。
DeepSeek宣布其V4-Pro API永久降价75%,每百万缓存输入令牌仅0.003625美元,输出0.87美元,比OpenAI的GPT-5.5便宜约34倍。该模型拥有1.6万亿参数但仅需490亿活跃参数,支持100万令牌上下文,在编码和推理基准测试中表现领先。
DeepSeek 将 DeepSeek-V4-Pro 的折扣永久化,有效期延长至 2026 年 5 月 31 日。