GPT-6免费开放,敏感内容防御退步
GPT-6向12亿免费用户推送并新增交互界面,但安全报告显示敏感内容防御较前代回退。
重要性结构性证据E3 可检验写法深度
GPT-6从10月7日起向付费用户推送,8日起覆盖免费和Go用户,替换GPT-5.6。OpenAI公告落款10月7日。
此前GPT-6仅上月向付费用户开放,免费用户停留在GPT-5.6 Luna。本次更新同时引入Intelligent UI:模型根据问题动态生成图表、计算器或交互组件,聊天框从纯文本变为可变界面。OpenAI称GPT-6 Instant在需搜索的问题上平均比前代早44%开始回答。
同日发布的24页安全报告显示:多轮越狱和指令层级测试中防御提升,Sol抵抗率达99.99%;但自伤、血腥、色情及青少年情感依赖评测出现显著回退,Luna的情感依赖得分从0.927降至0.734。OpenAI解释称模型对敏感话题的信息性回答意愿增强,评测使用专门挑选的困难样本,未计入产品层分类器拦截。
安全数据为OpenAI自发布系统卡,尚未经独立复现。Work和Codex当前模型不随此次切换。