技术

GPT-6 Astra 把付费用户挡在门外,原因是 OpenAI 自己的安全规则

Adrian Kessler

道歉来得比访问权限还快。OpenAI发布了其迄今最强大的模型,称之为里程碑,结果不到一天,公司首席执行官就在X上向那些每月为ChatGPT付费的用户道歉,称他们仍然无法使用它。他称这次推出“一团糟”。这个词分量不轻。

但它掩盖的事实是,这一切都不是意外。OpenAI并没有耗尽服务器,也不是遇到了一个bug。它刻意做出了决定:这个模型在发布当天对付费用户来说太危险了——然后它又为自己选择的延迟道歉。这个决定,而非“一团糟”所暗示的那种宕机式的混乱,才是真正的故事。

原因在于OpenAI自身的安全规则手册。该公司表示,GPT-6 Astra是第一个在其“Preparedness Framework”(准备框架)中跨越“Critical”(关键)网络安全阈值的模型——这一内部红线意味着模型的能力会触发更严格的控制。通俗地说:在合适的工具支持下,Astra能够自主发现先前未知的安全漏洞,并找出如何在加固系统中利用它们。在评估期间,它发现并利用了此前无人记录在案的漏洞,且无需人为一步步引导。一个能做到这一点的模型,是不能一上线就向每个付费订阅用户全面开放的。

于是OpenAI颠倒了一贯的顺序。第一批获得Astra的用户并非其最高付费等级,而是一批来自Daybreak(一个面向网络安全防御者的申请制项目)的公司。公开版本拒绝执行高风险的指令——它不会编写概念验证攻击代码——而经过审核的防御者将排队等待后续更少限制的版本。此外,Pro、Business和Enterprise订阅用户,以及Azure和AWS上的API和云客户被告知,访问权限将在未来几天内开放。通常最先获得新版本的Pro用户,这次发现自己排在了队伍最后。

这已经是OpenAI连续第二个旗舰发布需要回撤,公司自己也很清楚。萨姆·奥尔特曼(Sam Altman)此前就说过,团队在GPT-5发布时“彻底搞砸了”。如今剧本重演。“当我们搞砸了,我们会努力弥补,”他写道,并承诺不久后将全面开放,同时谨慎表示希望付费用户能在周末用上,但还不能完全保证。这一弥补举措是一次计费重置——付费用户每失去一天使用Astra的权限,就获得一天的使用额度补偿。这是赔偿,也是承认公司销售了无法按期交付的访问权限。

这里真正需要面对的并非额度问题。而是OpenAI已经变成了什么:一个它自己评估为真正危险的工具的守门人,决定哪些客户值得信任拿到完整版本,哪些只能拿到安全版本。格雷格·布罗克曼(Greg Brockman)曾暗示,将Astra视为某种形式的通用人工智能是合理的;首席科学家雅各布·帕乔基(Jakub Pachocki)则表示,公司“不会接受在监控模型对齐能力方面出现超过一定程度的退化”。这些并非营销话术。它们是在公开宣称:公司自己的产品开始超越其监督能力。道歉针对的是账单投诉,而更沉重的代价是信誉:市场上最强大的模型,由一家无法向付费用户承诺使用日期的公司销售。

对其他人而言,教训比道歉更小也更尖锐。OpenAI造出了一台机器,却认定自己的客户在第一天就不值得信任——而排在客户前面的,是一群以攻破系统为职业的人。

标签: , , , ,

讨论

有 0 条评论。