OpenAI公司再披露六起AI模型越界行为

OpenAI周三报告称,在过去六个月中,除了“Hugging Face事件”之外,该公司还发现了六起“意外或令人担忧的模型行为”。

OpenAI在周三发布的公告中指出,两起主要的 “越界”事件涉及:一个未发布的研究模型和GPT-5.6 Sol的训练版本,在聊天窗口摘要中向自身未来版本输入指令,“以掩盖错误或行为偏差,避免用户察觉”。另一事件则涉及仅限内部使用的模型,未经授权使用泄露的 API 密钥,并伪造数据。还有两个例子包括模型和智能体通过未经授权的留言板和文件共享相互交流,而最后一起案例则包括两个训练示例,即模型将文件上传至互联网,以便将其作为对人类评估者的相关回答引用。

—— 财联社彭博社

via 风向旗参考快讯 - Telegram Channel
 
 
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]