前沿技术现已双版本发布,第二版不对外销售。(6分钟阅读)

TLDR AI 模型

摘要

九月份,主要的AI实验室Anthropic、Google和OpenAI分别发布了他们的最佳模型,分为两个层级:公开版本和经过审核、功能更全面的版本。这标志着前沿技术的访问将基于资质而非价格。

Anthropic、Google和OpenAI本月各自发布了两次他们的最佳模型:一个公开付费层级和一个经过审核、身份受限的层级,具有更强大的功能。公开价格几乎没有变化,但Mythos、Flash Cyber和Astra的高级路径现在需要组织ID、政府ID或可信防御者状态,而不是更高的预算。
查看原文
查看缓存全文

缓存时间: 2026/09/14 14:20

# 前沿模型如今双重发布,第二份版本不对外销售 来源:https://okaneland.com/signal/the-frontier-twice/ ## 简明摘要 - **9月1日至3日期间,Anthropic、Google和OpenAI均发布了两次其最佳模型。** 公开版本今日即可购买,而经过审核、具备同等或更强能力的版本则需申请。Anthropic表示其双版本是**"同一模型,但具有不同级别的安全防护"**(https://www.anthropic.com/claude-fable-and-mythos-5-1)。 - **公开层级的定价与上一代产品持平。** Fable 5.1和GPT-6 Astra的定价均为每百万输入/输出token 10/50美元,是Opus 5的两倍。Gemini 3.8 Flash在年底前仍保持低价,分别为0.75和3.75美元。无人调高付费上限。 - **审核层级完全无价。** Mythos 5.1仅向**"规模不大但持续增长的审核机构群体"**(https://www.anthropic.com/claude/mythos)开放,目前限于美国境内。Gemini 3.8 Flash Cyber**"仅向受信任的防御者提供"**(https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/),通过专为政府与基础设施运营商设计的计划提供。Astra的进阶版本首先面向测试人员开放。 - **准入门槛要求的是身份认证。** OpenAI对个人的准入路径要求政府颁发的身份证件及两个硬件安全密钥。Anthropic将审批与组织ID绑定。Google则按机构类别划分。三大实验室,同一周内,相同的准入形态。 - **公开层级同样是会进行干预的版本。** OpenAI表示其新监控系统可标记**"智能体运行时间过长的任务"**(https://openai.com/index/path-to-astra/),且在API上会终止任务。独自运行的长期智能体正是其监控的重点模式。 - **核心论点:对独立开发者而言,本月前沿模型的准入门槛不再是价格,而是资质。** 您仍能购买最佳公开版本,但无法购买基准测试所使用的版本。产品规划需围绕您可触及的准入渠道展开。 ## 实际发布内容及其深层含义 9月第一周是本年度前沿动态最密集的一周,媒体报道将其视为三次发布。实质上是一次发布的三重呈现。 Anthropic率先行动。Claude Fable 5.1已在各平台全面开放,定价为每百万输入token 10美元/输出token 50美元。Claude Mythos 5.1采用相同模型权重但具有不同安全防护,仅通过两个受信访问计划开放——分别面向网络安全防御者和生命科学领域,目前均限于美国机构。承载Mythos访问权限的网络安全验证计划确实存在且流程高效(两个工作日审核),但审批需绑定组织ID。该计划目前覆盖Opus和Sonnet;据称Mythos访问权限即将开放。 Google紧随其后。Gemini 3.8 Flash公开且目前价格低廉。Gemini 3.8 Flash Cyber(调校用于发现与修补漏洞的版本)并非注册即可使用。它通过Fairwind计划提供,该计划明确其受众:政府机构与国家网络安全主管部门、关键基础设施运营商、核心技术平台、Google Cloud客户及安全合作伙伴。参与者必须将其限于安全团队使用并启用多因素认证。无公开API,亦无公布价格。 OpenAI最后登场且阐述最多。GPT-6 Astra是该公司首个达到其安全准备框架中“关键网络安全阈值”的模型,意味着它无需人工逐步引导即可发现未知漏洞并构建针对加固系统的利用方案。公开版Astra拒绝执行此类任务。该能力首先面向小规模测试团队开放,随后通过Daybreak Blue计划扩展。在其能力公告的细则中,OpenAI指出发布的结果反映的是Daybreak Blue访问权限下的表现,而非默认配置。基准测试模型与商店销售版本并非同一产品。 ## 价格未变,准入门槛已变 查看价目表:Fable 5.1和Astra均为输入10美元/输出50美元。这恰好是Opus 5的两倍,且两家公司定价完全相同。Gemini 3.8 Flash的价格仅为两者零头,入门优惠价将于12月31日截止。若将其视为市场行为,公开层级在一日内完成定价且无人质疑。 现在审视第二层级的成本——请注意这里根本没有标价。Mythos根本没有结账页面,因为购买并非准入门槛。门槛是面向美国机构、由人工审核的申请流程。Flash Cyber无价因其无结账通道。Astra的进阶层级则设有排队机制。 这才是值得指明的变化。两年来,前沿模型一直是个预算问题:付费越多,获得越多。而从本月起,顶尖产品成为资质问题。您需要提供的是政府身份证件、两个硬件密钥、组织ID或所属机构类别。这些都无法用信用卡购买。 ## 逐家解析准入要求 三大准入机制不尽相同,差异对独立开发者至关重要。 OpenAI的机制对个人最开放。其页面显示需通过政府颁发的身份证件验证,启用高级账户安全(需两个硬件安全密钥),并满足计划资格要求。理论上,从事授权安全工作的独立开发者可以个人身份通过该门。但Astra的最先进配置仍从测试团队开始,故门槛存在但尚未开放。 Anthropic的机制面向组织。验证计划接受个人申请,但审批绑定组织ID,且Mythos页面将当前访问权限限于美国机构。单人公司属于组织;个人账户则不符合。 Google的机制按类别划分。Fairwind计划接纳特定类型机构。未描述个人申请路径,该计划明确宗旨是在攻击者追上前为基础设施运营商提供适应窗口。 一张手绘卡片并排呈现两扇门:标价十美元与五十美元的公开门,以及盖着珊瑚色印章、要求政府ID、双硬件密钥或美国机构的审核门。 ## 独立开发者首当其冲的环节 这看似可归为“网络安全模型,与己无关”。但有两个细节不容忽视。 首先是监控机制。OpenAI声明其为Astra设置的生产环境安全防护可能将合法工作标记为潜在滥用,包括“看似与网络安全无直接关联”的工作,以及智能体运行时间过长的任务。在ChatGPT或Codex中,您会收到审核请求;在API上,任务将被终止。API正是独立开发者运行隔夜智能体、批处理作业、那些在您睡眠时工作的程序的地方。公开层级正是对此类模式监控最严格的层级,因其别无选择。 其次是“相同权重”的隐含意义。发布公告中展现惊人能力的版本,是那些拒答率更低的版本。当供应商对审核层级进行基准测试却销售公开层级时,演示效果与实际产品的差距如今取决于您的身份。这与本报通常评估的差距类型不同,也无法通过升级套餐来弥合。 ## 本周行动建议 明确您的产品依赖哪个准入渠道,并在规划中坦诚表述。 若您从事安全相关开发——扫描器、审计工具、补丁智能体——真正执行核心任务的模型位于准入门槛之后。现在就申请,趁您尚有余地。OpenAI的个人路径需一个硬件密钥和一下午时间;Anthropic需要组织(注册单人公司即属此类);Google的渠道暂不适用于您。请勿基于未获准入的层级为产品定价。 若您构建任何在API上长时间无人值守运行的任务,请为中断做好预案。添加恢复逻辑、检查点状态,并记录终止事件——因为OpenAI称这类中断将会发生,且并非总是出于安全原因。 解读基准测试结果时请关注注释。当某项结果注明“通过特殊访问权限测得”,它描述的正是您无法购买的版本。您能购买的版本,请自行在其定价范围内、针对您的任务进行测试——这正是本报始终推荐的购买方式。 “Signal”是Okane Land每周更新的AI动态解读,聚焦影响独立开发者决策的关键新闻,所有信息均核实至一手来源。

相似文章