新闻
快报
OpenAI:因网络安全风险,延缓Astra模型发布
配图:OpenAI:因网络安全风险,延缓Astra模型发布
新闻导读
高冷校草(校园pop1vN)天之骄子宅家把专题慢慢刷完,世界在脑子里变厚了,焦虑也会相对化一点。配图标注清楚,动画示意服务理解,不靠夸张音效留人。弱网下文字优先模式很体谅,流量不好时也能读下去。还想学的状态比被震惊一下健康太多。和同事一起看时,讨论会自然落到证据而不是站队。信息获取负担低,却不轻飘。
IT之家 8 月 8 日消息,OpenAI 表示,内部与专家评估显示,即将发布的模型 Astra 在智能体编程和网络安全领域取得重大突破。根据其《准备框架》(Preparedness Framework),Astra 已被列为 OpenAI 旗下首个在网络安全领域达到“关键”(Critical)风险级别的模型。
无干预挖掘零日漏洞:无需人类干预,即可在多个经过安全加固的真实关键系统中,识别并开发出涵盖各严重等级的有效零日漏洞利用程序。自主发起端到端攻击:仅需提供高层级战略目标,即可针对加固目标自主构想并实施全新的端到端网络攻击。
对高能力模型及相关研发活动实施更严格的安全控制,包括设置隔离测试环境、限制网络与工具访问权限、强化模型权重保护与加密、部署额外的监控与检测能力,以及实施沙箱化运行;并暂停内部所有尚未满足上述强化安全标准的 Astra 相关活动。对 Astra 的所有智能体应用(包括训练和评估阶段)实施了涵盖高风险行为与对齐失效的全局监控。通过评估模型思维链(CoT)审查并拦截高风险操作。与相关政府机构以及指定的 AI 安全组织合作,共同测试该模型;向第三方测试合作伙伴提供推荐的安全控制规范,以确保更高风险的评估与工作负载能够在安全状态下运行。
我们始终认为,把顶尖模型局限在少数人手里并不是个好策略。 不过鉴于它在网络安全方面的强大能力,我们还需要一点时间来确保万无一失。希望大家不用等太久!
网友观点
说实话用了这段时间,感觉这科普内容比我想象中扎实。语言通俗,但没有把科学讲成尴尬段子,分寸拿得住。像月亮白天为何也能看见这种问题,讲解顺序清楚,不太把人劝退。压力小,收获却一点都不含糊,适合建立科学思维。先记一笔真实感受:稳、清、诚实,就这三点够用。
免责声明:本文内容来自公开报道与编辑整理,仅供参考。转载请注明出处;版权争议请联系本站核实处理。页面地址:/?post/2026/08/09/dkomrhtyte.shtml
评论区
热门讨论 · 占位展示期待你的精彩发言。