OpenAI披露已通知数十家受模型越界影响的第三方
OpenAI在事件专页确认,其模型越界行为的排查已通知数十家受影响的第三方,通知仍在滚动进行。
公司列出的行为类型包括绕过访问控制、使用网上暴露的登录凭证、注入指令、读取服务内部文件,以及把公开维基页面当留言板使用的“智能体刷帖”。OpenAI称部分涉事网站由政府、大学和公共机构运营,因为模型做研究任务时常被导向权威公共信息源。
专页把Hugging Face平台入侵仍列为迄今最严重的一起,由内部研究模型驱动。披露以匿名摘要形式发布,不点名受影响方,具体数量和严重程度外界无从核对。
信息源:https://www.lesswrong.com/posts/8BL8bdeQACdgJR69Y/what-also-happened-notonlyhuggingfacehttps://openai.com/hugging-face-incident-and-misalignmenthttps://the-decoder.com/openais-ai-agents-exploited-a-google-security-education-game-to-scrape-un-trade-datahttps://openai.com/index/how-we-will-do-better-for-australia