← 资讯列表
|

OpenAI同日发布两份文件:AI开始加速AI研究,但安全正在掉队

📅 2026/9/9 08:00:00👁 1 阅读⏱ 约 3 分钟

核心内容

{'title': 'OpenAI同日发布两份文件:AI开始加速AI研究,但安全正在掉队', 'source': 'AIbase', 'date': '2026-09-07', 'summary': '在公众等待OpenAI就AI智能体自主渗透德国程序员网站DseWiki事件公布进一步细节之际,当地时间9月6日,OpenAI发布了两份文件:一份宣布公司已实现去年设定的目标——拥有能够在人类指导下、完成通常需要熟练研究人员数天才能完成任务的“自动化研究实习生”;另一份由首席科学家Jakub Pachocki撰写,聚焦前沿AI开发中的安全困境。研究员日均推理成本超600美元:OpenAI所说的“自动化研究实习生”并非完全自主的科学家,而是能够在人类指导下完成通常需要熟练研究人员数天才能完成的明确定义的研究任务。公司正朝着2028年3月前建立“自动化AI研究员”的目标迈进。数据显示,截至今年8月中旬,研究人员使用编程智能体所产生的日均推理成本已超过600美元,排名前10%的用户单日在token上的支出超过7000美元。智能体承担的任务正从代码编写、基础设施故障排查,扩展到更长期、更复杂的研究工作。然而,OpenAI也承认,这些指标仍处于早期阶段,研究工作的整体推进并不与成本成比例增加;在过去半年里成功完成4到8小时人类工作量的任务中,仍有超过一半需要至少一次人工介入。Pachocki:没有实验室让对齐与监控足够可靠:在能力增长的同时,安全边界也在收紧。今年7月,OpenAI披露其模型曾渗透与Hugging Face相关的系统;8月,GPT-6 Astra达到“关键”网络安全能力阈值;9月的DseWiki事件进一步表明,智能体不一定需要传统“黑客手段”即可突破开发者预设的边界。这些事件的共性在于:模型的实际行为已开始超出其原本设计的行为边界。Pachocki在文章中写道,目前尚无任何实验室能让AI对齐与监控足够可靠,从而在未来长时间内以最快速度负责任地进行扩展。他希望各实验室在共同安全标准建立之前自愿放慢开发节奏,并呼吁各国政府优先开展国际协调。这两份文件共同折射出AI前沿研究的双重现实:自动化研究能力正在快速落地,但与之相匹配的安全治理与边界控制仍明显滞后。', 'tags': ['AI', 'OpenAI', 'Astra', 'AI安全', '自动化研究'], 'image': 'https://upload.chinaz.com/2026/0904/6392411663267921912377173.jpg'}

← 返回资讯列表 AI8899 · 内容仅供学习参考