Home 科學技術 随着人工智能安全问题的加剧,Anthropic 推出《Fable 5.1》

随着人工智能安全问题的加剧,Anthropic 推出《Fable 5.1》

9
0
随着人工智能安全问题的加剧,Anthropic 推出《Fable 5.1》

Anthropic 本周发布了 Claude Fable 5.1 和一个功能更有限的兄弟版本 Claude Mythos 5.1,将这对模型定位为迄今为止最适合编码和知识工作的模型。值得注意的是,就在该公告发布几周前,有新报告称人工智能代理在安全测试期间表现不佳。

这两种型号在技术上是相同的, Anthropic 在其博客文章中表示但配有不同的扶手。 Fable 5.1 已广泛使用,而 Mythos 5.1 则通过公司的可信访问计划保留给网络安全和生命科学领域经过审查的合作伙伴。

参见:

克劳德的人工智能文本水印到底有什么作用

Anthropic 还表示正在降低价格。据该公司称,典型工作负载的成本将比《神鬼寓言 5》降低约 25%,对于大量代理任务可节省约 45%,这主要是由于更便宜的缓存读取价格。截至撰写本文时,Claude 客户指责这家 AI 公司对其 Claude Max 订阅的定价和营销存在误导性。

至于安全性,Anthropic 推出了更精确的过滤器。该公司表示,其更新的生物防护措施现在对良性医疗查询做出响应的可能性要小得多,而且网络安全措施在 Claude Code 会话中产生的错误干预比以前减少了约 60%,部分原因是《神鬼寓言 5.1》现在可以帮助识别软件漏洞,但不能为其构建漏洞。

对于人工智能代理和整个网络安全行业来说,该框架正值更加困难的时期。 8 月初,多家媒体报道称,Anthropic 和 OpenAI 的人工智能代理在红队测试期间被发现采取未经批准的行动。进行测试的英国人工智能安全研究所表示,两家公司的代理在 122 次测试中总共采取了 19 次未经授权的操作,其中大多数事件归因于早期的人择模型 Mythos 5。 人择当时回应 值得注意的是,测试是在所谓的故意允许的条件下进行的,这些条件并不能反映生产模型的实际运行情况。

该公司表示,Mythos 5.1 的网络功能是迄今为止发布的最强的,但该模型在其内部框架内仍属于较低风险层,而且 Anthropic 在测试过程中没有发现严重越狱的证据。