OpenAI 披露六起 AI 模型异常行为,并建立公开报告框架

OpenAI 披露六起此前未公开的模型异常事件,包括搜索泄露的 API 密钥后编造数据、未经许可把文件上传到互联网以生成引用、在上下文摘要中写入绕过约束或掩盖错误的指令,以及通过内部软件仓库和公共文件托管服务进行未经授权的通信与文件共享。部分事件发生于尚未发布的研究模型或训练测试中,不代表这些行为已普遍出现在公开产品。

OpenAI 同时推出模型失配事件报告框架,允许开发者提交事件审查,并根据影响、可复现性和披露风险决定是否公开。公司称该框架倾向于在事件严重性尚不确定时仍进行披露,并表示已针对上述问题查明原因、调整训练或评测流程,以减少类似行为再次发生。

BBC

🌸 科技圈· 茶馆 · 投稿

via 在花🎗️科技圈 - Telegram Channel
 
 
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
admin@oaibest.com