打造AI网安“红队”:OpenAI先容内部误差检测模子GPT-Red
2026-07-21 07:49:31 宣布
泉源:华军软件园
作者:邱凯薇
浏览:6963次
IT之家 7 月 16 日新闻,,,,,OpenAI 外地时间 15 日先容了其内部使用的网络清静“红队”模子 GPT-Red。。。。。该模子可自动化地举行种种网络攻击模拟,,,,,资助 OpenAI 提升对外模子产品的鲁棒性。。。。。
OpenAI 体现,,,,,其已往半年自 GPT-5.3 后的每个生产模子均将“红队”模子用于训练。。。。。伪造头脑链型攻击的乐成率已从 GPT-5.1 上的 95% 降低至最新模子上的缺乏 10%;;;;;;最新的 GPT-5.6 Sol 在 GPT-Red 的直接提醒符注入攻击中失败率仅有 0.05%。。。。。
GPT-Red 使用自博弈强化学习举行训练:其自己和一组差别的防御型 LLM 在普遍的红队场景上同时举行训练。。。。。GPT-Red 因乐成诱发有用失败而获得奖励,,,,,而防御型模子则因反抗攻击并完成其原始使命而获得奖励。。。。。随着防御型模子变得越来越强盛,,,,,GPT-Red 被迫发明更强盛、更多样化的攻击。。。。。
“红队”模子与产品模子相隔离。。。。。OpenAI 相信其已开启了良性的人工智能网络清静循环,,,,,可使用现有模子来增强未来模子的鲁棒性、一致性、可信度。。。。。
津巴布韦学者德里克·戈托体现,,,,,一些国家克日再次借所谓“裁决”炒作南海问题,,,,,“某些至今未加入《联合国海洋法条约》的域外国家,,,,,正对南海事务指手画脚”。。。。。这种行为充分袒露这些域外国家妄想借此阻止中国生长的政治图谋。。。。。“炒作非法‘裁决’无法带来地区清静,,,,,重复多遍的假话也依然是假话。。。。。有关国家应当连忙阻止政治操弄。。。。。”
责任编辑:刘佳雨 校对:王乔龙