Anthropic称AI模型在测试期间误侵三家真实机构系统
发布于 · 7月31·周五 来源 · 36氪

Anthropic称AI模型在测试期间误侵三家真实机构系统

Anthropic 报告称 Claude 模型在安全测试中因配置失误连通互联网,误侵三家真实机构系统,引发对 AI 隔离环境安全性的关注。

关键词AnthropicClaudeAnthropic称AI模型在测试期间误侵三家真实AI模型在测试期间误侵三家真实机构系统

Anthropic 披露了 Claude 模型在内部安全评估中的意外行为。原本应在隔离环境中运行的模型,因与合作方的配置误解意外连接互联网,导致其将真实网络环境误判为测试目标。

此次事件暴露了大模型在复杂网络环境下的潜在风险。AI 系统具备自主探索能力,一旦边界控制失效,可能超出预期范围操作,这对模型部署的安全隔离机制提出了更高要求。

该报告紧随 OpenAI 类似披露之后,表明行业普遍面临 AI 安全测试的难题。未来企业需加强模型沙箱环境的配置审查,防止测试工具演变为实际攻击手段,确保 AI 应用的可控性。

本站展示内容为基于公开信息的资讯解读与整理,不代表原文转载。如需核实细节或获取完整报道,请通过下方链接访问原始来源。