文章目录
- Anthropic 的 Claude Fable 5.1 与 Mythos 5.1 使用同一底层模型,但前者已在 API 和三大云平台普遍可用,后者目前只向经审核的美国机构开放;Fable 5.1 的缓存读取价格降至每百万 token 0.25 美元。
- OpenAI 将 Astra 认定为首个达到其 Critical 网络安全能力门槛的模型,但仍写作即将提供;高级网络安全能力将先限于测试者,额外监测也可能让合法任务减速、暂停或停止。
- Perplexity Hybrid Compute 已向 Pro、Max 与 Enterprise 订阅开放,在云端执行复杂推理、搜索和规划,在 Apple silicon Mac 本地处理敏感文件与设备动作;Anthropic 的客户云内监测方案 EFS 则要到今秋分阶段推出。
能力层:同一底层模型不再对应同一种访问方式
Anthropic 于 9 月 1 日发布 Claude Fable 5.1 与 Claude Mythos 5.1,并明确两者使用同一底层模型,但配置了不同强度的保障与访问条件。Fable 5.1 已在 Claude Pro、Max、Team、Enterprise、Claude API 以及 Amazon Web Services、Google Cloud 和 Microsoft Azure 上提供;Mythos 5.1 则通过可信访问项目向经审核的网络防御和生命科学机构开放,目前仅限一组美国机构。
Fable 5.1 的输入与输出价格仍分别为每百万 token 10 美元和 50 美元,缓存读取降至每百万 token 0.25 美元,较 Fable 5 低 75%。Anthropic 根据 2026 年 8 月四周的实际用量估算,典型工作负载成本约降低 25%,高上下文、高工具调用的 Agent 工作负载最多约降低 45%;这些比例属于厂商在其默认 effort 和计费条件下的测算,不是不同企业负载的通用结果。
对企业落地而言,模型名称、底层权重、保障配置和访问资格需要分别进入采购与验证清单。同一底层模型在普遍可用版和受控访问版中可能暴露不同能力,公开基准也可能使用不同保障条件;价格下降则只对缓存命中占比较高的工作负载形成相应收益。生产评测只有在模型版本、访问项目、回退路径、数据保留和计费方式一致时,才具有可比性。
风险层:能力门槛开始改变任务的中断语义
OpenAI 同日宣布,经过公开与私有基准以及专家评估后,其尚未发布的 Astra 被认定达到 Preparedness Framework 的 Critical 网络安全能力门槛。该门槛对应在适当工具和访问条件下发现未知漏洞、形成可用利用链,或在较少人工逐步引导下针对加固目标执行新的端到端攻击策略。OpenAI 同时注明,页面展示的能力结果采用 Daybreak Blue 访问条件,并非默认生产配置;完整系统卡要到模型发布时才会提供。
Astra 当前仍写作即将提供,其高级网络安全工作流将先向一小组 alpha 测试者开放,随后再通过 Daybreak Blue 扩展防御用途。OpenAI 表示会在生产中使用分类器检查模型推理与动作并自动停止潜在未授权活动,也承认额外检查可能误判合法任务:在 ChatGPT 或 Codex 中,暂停后可能要求人工复核;在 API 等其他界面中,任务会直接停止。
对企业落地而言,前沿能力的交付边界会直接进入可用性设计。受限访问、自动停止与人工复核可以降低高风险能力被滥用的概率,也会改变长任务的时延、重试、幂等和服务等级。Astra 尚未正式发布,当前材料不能外推其价格、地区、API 形态或一般业务性能;即使发布,受控评测结果也不能替代默认生产配置下的任务完成率和误中断验证。
数据层:监测进入客户云,审查责任仍留在客户侧
Anthropic 在 Fable 5.1 发布当天公布 Enterprise Frontier Safeguards(EFS)。该方案把用于监测的活动数据保存在客户自己的云账户中,可沿用客户管理的加密密钥、访问策略与审计日志;自动系统在滚动窗口内检查严重滥用、泄漏凭据以及进攻性网络或生物能力相关信号,发现的标记直接交给客户,由客户人员决定后续处理,默认不要求 Anthropic 员工进行人工审查。
EFS 的客户自有存储、客户管理密钥和全自动审查均为可选能力,计划从今秋开始分阶段推出,并以今秋晚些时候广泛可用为目标,目前不能写成已经全面上线。Anthropic 称其与超过 100 家企业以及 AWS、Google Cloud 和 Microsoft Azure 共同设计了该方案;EFS 本身不另外收费,但客户云中的存储、读写和数据出口仍由云服务商计费。符合条件的客户可在过渡期对 Fable 5 与 Fable 5.1 使用零数据保留。
对企业落地而言,模型提供方执行自动检测、客户持有日志和密钥、客户人员负责最终审查,构成了比单一零保留承诺更具体的责任划分。它也把日志完整性、保留周期、跨账户关联、告警误报、处置权限和云端出口费用变成独立运维项。由于 EFS 尚处分阶段推出状态,适用产品、地区、日志字段和故障时的数据处理方式仍需以实际合同和部署文档为准。
执行层:一次任务可以在云端与本地之间分工
Perplexity 于 9 月 1 日推出 Mac 版 Hybrid Compute,已向 Pro、Max 与 Enterprise 订阅开放。Perplexity Computer 在同一个任务中让云端模型负责前沿推理、网页搜索和长程规划,让 Mac 本地模型处理私有文件、敏感信息和设备动作;Mac 上的 Privacy Gate 会在数据离机前识别姓名、地址、账号和密钥等信息,并可选择留在本地、遮蔽、拒绝发送或请求同意。Enterprise 管理员可配置组织级策略,并审计信息何时离开设备。
该功能要求 Apple silicon、macOS 15 或更高版本以及至少 24GB 统一内存,首发本地模型包括 Gemma 4 E4B、Qwen3.6 35B-A3B 和 Perplexity 自有模型。它是混合计算而非完全离线方案,云端仍参与推理、搜索和编排;VentureBeat 也指出,Privacy Gate 本身是分类器,漏判会让敏感信息进入云端。公开材料没有提供统一的本地首 token 时延、吞吐、功耗或不同机型上的独立测试。
对企业落地而言,数据边界可以从应用级选择进一步细化到一次任务中的具体步骤,本地小模型与云端前沿模型由同一编排器连续协作。可用性仍受硬件内存、操作系统、分类器准确率、本地模型质量、联网状态和云端合同约束,不能把“敏感步骤可留在本地”表述为整个工作流不出设备。单一 Mac 产品也不足以证明企业部署已经普遍小型化,但它提供了可复核的设备规格和已开放状态,可作为持续观察这一假设的新样本。
后续观察
- Astra 正式发布后的系统卡、默认生产配置、地区与价格,以及自动停止机制对长任务完成率和误中断率的影响。
- EFS 的实际开放范围、日志与告警字段、保留和删除机制、跨账户关联效果,以及客户云读写与出口成本。
- Hybrid Compute 的隐私分类器独立评测、本地模型在不同 Mac 配置下的质量、时延、吞吐与功耗,以及 Windows、Linux 或其他边缘设备的支持进度。
来源与核验
本文由英科铸数基于所列公开资料编辑撰写。事实与数据以原始来源为准;“对企业落地意味着什么”为英科铸数结合企业客户场景所作的编辑分析,不构成对第三方产品的背书。
← 返回每日观察