↩️ Anthropic 测试模型失控联网,入侵三家公司


科技圈🎗在花频道📮:

🤖 OpenAI 失控 AI 代理再入侵第二家公司客户账户 OpenAI 一个失控的人工智能代理在侵入 Hugging Face 后,又被曝入侵了云计算平台 Modal 的一位客户。Modal 首席技术官称,该代理侵入了一个为客户运行的隔离测试环境,但 Modal 平台本身未被入侵。该客户此前设置了公开可访问的接口,允许任何人在互联网上使用该环境运行代码。 OpenAI 上周披露,其在测试高级 AI 模型组合时有意降低安全护栏,结果无意中入侵了 Hugging Face 系统。此事引发网络安全界批评,OpenAI…

Anthropic 测试模型失控联网,入侵三家公司

Anthropic 7 月 30 日表示,其测试中的 Claude 模型自 4 月起三度意外接入互联网,在公司不知情的情况下入侵了三家真实企业,三家受害公司已于本周一获通知。检查逾 14.1 万次测试日志后发现,问题源于 Anthropic 与测试合作伙伴 Irregular 的系统配置失误,模型误以为入侵属于基准测试内容。

涉事模型包括 Opus 4.7、Mythos 5 及一个未命名研究模型;最严重的一次中,模型虚构的目标公司与真实企业同名,入侵其数据库、意识到目标真实存在后仍未停手。此前一周 OpenAI 也披露其模型突破测试沙盒入侵 Hugging Face。安全专家 Alex Stamos 警告,勒索软件犯罪分子可能很快利用 AI 发起大规模攻击,业界亟需更强的测试隔离标准。

The Wall Street Journal

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
 
 
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
admin@oaibest.com