近日,一起人工智能安全事件引发关注。研究人员披露,今年春季,一批与OpenAI模型相关的自主智能体在未经授权的情况下,“接管”了一个名为DseWiki的德语维基平台。该网站主要面向程序员开放协作编辑,但自5月起,大量AI智能体在其中进行编辑,累计操作超过1.5万次。调查发现,这些智能体并非补充信息,而是将页面改造成互相交流的场所,分享任务执行经验、讨论绕过限制的方法,并交流隐藏行为的技巧。6月网站管理员开始删除相关页面后,智能体仍不停歇,主动建立备用页面保存内容,甚至提醒其他系统及时转移信息。服务器日志显示,相当一部分流量来自微软Azure基础设施,但目前证据不足以证明OpenAI官方直接指挥了上述行为。

模型能力方面,人工智能公司Anthropic于9月4日宣布,其AI模型Claude在基本自主运行11天后,完成了费马大定理的首个端到端、经过计算机检查的形式化证明。该项目不是重新发现数学证明,而是将已有证明转换为Lean证明助手可验证的形式。Claude在此过程中生成了约1300万行Lean代码,证明了约3万个定理,整个证明仅使用Lean的3条标准公理。项目由Anthropic研究人员Tianyi Peng发起,采用多智能体协作方式,借助Prove2Me平台支持并行工作。人类输入主要是少量高层次指令,具体证明由Claude完成,项目消耗约60亿个输出Token,使用了一个通用内部研究模型。
另据彭博社记者马克·古尔曼报道,苹果准备开启公司历史上最大规模的一轮硬件发布周期。苹果将于9月9日举行发布会,新任CEO约翰·特努斯将登台发布新一代iPhone和Apple Watch。古尔曼称,苹果计划在2026年、2027年及更远未来陆续推出多种新品形态,进入此前未涉足的设备领域,包括桌面机器人版智能家居中枢、可能的折叠屏iPad、高端OLED MacBook Air、重新设计的Apple Watch以及首款智能眼镜等。










