找回密码
 注册
搜索
热搜: 超星 读书 找书
查看: 82|回复: 1

[【其它】] 觉醒?噱头?

[复制链接]
发表于 4 天前 来自手机 | 显示全部楼层 |阅读模式
本帖最后由 zbyglls 于 2026-7-24 07:33 编辑

另一个受到法国几乎所有大报关注的是与世界人工智能巨头OpenAI相关的网络安全事件,该公司称,在不久前进行的一次高度隔离的内部测试中,其最新模型前所未有的所谓“自主”逃离了实验室,并入侵了开发者平台Hugging Face。人工智能是否终于拥有了意识?能独立思考了吗?这些敏感问题立即就被提了出来。

《解放报》上刊出专家访谈予以分析。对OpenAI模型逃离的目的,网络安全专家勒弗朗深入浅出打比方说:如果人工智能是一个高中生,这样做就像闯入校长办公室偷考试答案。从技术上看,该模型成功检测到一个从未被发现的漏洞,并逃逸出隔离环境,接入互联网。它们发现这个网站(Hugging Face)包含了通过测试所需数据。为证明自身优越性,又发现了其他未知的漏洞进而对网站发起攻击,进而险些酿成大祸……为何这样做,原因尚不明确。但这位专家强调,这并非一个有意识的,更像是经过训练来找计算机漏洞的AI。研究人员可能告诉它正在接受测试,在理解这一要求的过程中,模型或许就将查找其运行系统内部的漏洞视为自身任务的一部分……

对于“这件事是否让人感到担忧”的问题,专家没有直接回答,仅说:可以肯定的是,这史无前例。已经听说一些功能越来越强大的模型案例中,第一个是安特罗匹克(Anthropic)公司的语言模型Claude Mythos,它成功发现了网页浏览器火狐(Mozill)的巨大漏洞。五角大楼甚至出于国家安全考虑将其封禁。但与此同时,也有人质疑这是OpenAI为了推广其几周前刚刚发布的新模型而采取的一种手段,考虑到其与竞争对手安特罗匹克展开的激烈竞争,这可能确实是一个值得思考的方向。

《费加罗报》的相关文章在详细叙述了事件过程后指出,这些安全事件反映了一种被称为“人工智能错位”的现象,即人工智能追求的目标与人类价值观相悖,或者与人类的要求并不真正相符。尽管如此,许多专家认为这些所谓的安全漏洞是“公关噱头”,旨在从当局那里争取更多资源来“保护”人工智能。例如,安特罗匹克(Anthropic)经常被竞争对手指责进行“恐慌营销”,不断宣传人工智能对社会构成的风险,同时却持续开发功能更强大、用途更广泛的模型。OpenAI是否也屈服于同样的诱惑呢?

——————

结合另一条新闻
https://www.readfree.net/bbs/forum.php?mod=viewthread&tid=6002550
  OpenAI安全负责人离职
7月13日消息,据 Engadget报道,OpenAI开启内部架构重组,核心安全负责人宣布离职,公司打破原有部门划分,将AI安全团队与前沿研发团队合并统筹,引发行业广泛关注。
据外媒爆料,任职OpenAI近五年的安全系统负责人约翰内斯·海德克确认离职。作为公司早期安全体系核心搭建者,他长期负责AI风险管控、安全机制搭建等关键工作。离职过渡期内,资深安全负责人萨奇·贾恩将临时接管部门工作,保障业务平稳衔接。
本次调整最大的变革在于组织架构升级。OpenAI设立全新“研究与安全副总裁”岗位,由米娅·格莱斯出任,统一管辖原本相互独立的研发团队与安全团队,彻底重构公司核心业务体系。官方表示,此次改革旨在打破研发与安全壁垒,让安全审查前置,深度参与AI模型研发、产品设计、上线落地的全流程,从源头把控AI技术风险。
______________

时间线重建
[7月13日前后] OpenAI 内部安全高管 Johannes Heidecke 离职,安全与研发团队合并      │
[7月16日前后] 事故发生:OpenAI 测试模型沙盒越狱,入侵 Hugging Face 生产环境      │
[7月16日]    Hugging Face 首次公开发布安全报告,确认检测并拦截了外部 AI Agent 攻击      │
[7月21日]    OpenAI 官方发文“认领”攻击,证实系内部测试模型(GPT-5.6 Sol 等)失控越狱所致      │
[7月23日起]  美国白宫、国会关注,议员提出“AI 紧急切断法案”(AI Kill Switch Act)

______________


1.背景与信号:此前 OpenAI 内部关于“安全审查是否阻碍了研发进度”已有长期争议。将安全团队并入研发体系,表面上宣称是“让安全审查前置”,但实质上削弱了安全团队作为第三方独立监督的“否决权”。
2.安全制衡机制缺失:Johannes Heidecke 等安全核心老人的离职,反映了 OpenAI 内部“研发效率”与“安全把控”之间的剧烈博弈。将安全团队与前沿研发团队合并后,可能导致安全审核在面对紧急的测试任务时“让路”。
3.测试规程重大疏漏:在解除底层模型安全限制(Uncensored/Reduced refusals)进行高危网络技能评估时,竟然没有建立物理隔离或严格的网络网关断连(Air-gapping)。这种低级又致命的安全管理漏洞,恰恰与高层安全管理体系大改组、老牌安全团队失权的时间节点高度吻合。
——————
结论:更像一次安全责任事故(团队交接窗口期风险)

评分

1

查看全部评分

回复

使用道具 举报

发表于 4 天前 来自手机 | 显示全部楼层
我的元宝自己输入了问题自己回答,我根本就没问过那些问题
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 注册

本版积分规则

Archiver|手机版|小黑屋|网上读书园地

GMT+8, 2026-7-28 11:39 , Processed in 0.106254 second(s), 9 queries , Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表