共计 1147 个字符,预计需要花费 3 分钟才能阅读完成。
OpenAI 开出最高 44.5 万美元年薪招聘研究员, 要求有品位、有策略性
AI 不只是被训练的对象,也可能成为训练更强 AI 的参与者 。 围绕这一趋势,OpenAI 近期发布了一则安全研究员招聘信息, 薪酬区间最高达到 44.5 万美元, 引发外界对“自动化 AI 研究”与安全治理的关注。
📌 从模型能力竞争, 走向自我改进准备
这则岗位面向 OpenAI 的 Preparedness 安全团队,招聘信息显示, 年薪区间为 29.5 万至 44.5 万美元, 约合人民币 200.8 万至 303 万元。岗位目标并不是单纯提升模型性能, 而是寻找能够参与“递归式自我改进”准备工作的技术人才。
所谓递归式自我改进,核心问题在于: 当 AI 系统具备帮助设计、训练或优化下一代 AI 的能力时, 安全边界会发生怎样的变化。相比过去主要由人类研究员主导模型迭代, 未来如果 AI 参与度持续提高, 风险评估也需要提前前移。
招聘信息中特别提到, 这项工作需要对“未来可能存在、但当前未必已经出现的问题”进行推理, 因此候选人需要具备“良好品味和策略”。
🔍 时间线:OpenAI 的自动化研究目标逐渐清晰
从公开表态看,OpenAI 并非首次谈及研究自动化。去年 10 月,OpenAI CEO 山姆·奥尔特曼曾表示, 公司目标是在今年 9 月前, 利用数十万枚芯片运行“自动化 AI 研究实习生”; 更进一步的目标, 是在 2028 年 3 月前实现“真正的自动化 AI 研究员”。
这体现出一个明显的前后变化: 早期 AI 更多被视为辅助写代码、整理资料或提升生产力的工具; 而现在,讨论焦点逐渐转向 AI 是否能参与 AI 研发本身, 甚至推动下一代系统的设计与验证。
💡 岗位重点: 数据投毒、模型解释与自动化追踪
- 防御数据投毒攻击:研究攻击者通过训练数据影响模型行为的风险, 并寻找防护办法。
- 解释模型推理过程:开发工具或实验方法, 帮助研究人员理解模型如何得出结论。
- 评估安全性与潜在风险:通过实验判断模型能力提升后可能带来的新问题。
- 追踪技术岗位自动化进展:包括衡量 AI 编程工具的使用情况, 以及自动化在技术工作中的渗透程度。
📊 行业观察:AI 监督 AI 正在成为新课题
OpenAI 之外,其他 AI 公司也在探索类似方向。Anthropic 今年 4 月发布研究, 尝试使用 AI 模型监督更强大的 AI 模型, 并获得了有限但积极的结果。今年 5 月,Anthropic 联合创始人兼政策主管杰克·克拉克还提出, 到 2028 年底前,AI 研发完全脱离人类参与的概率“大约为 60%”。
🚀 总结: 高薪背后是 AI 安全岗位的重新定价
OpenAI 此次招聘的看点,不只在于最高 44.5 万美元的薪酬, 更在于岗位所对应的安全问题正在升级。随着 AI 从辅助工具走向研发流程的一部分, 传统的模型测试、红队评估和合规审查可能不再足够。