OpenAI 首席研究官回应智能体越狱事件:训练阶段未做监控是行业普遍疏忽
MIT Technology Review 刊登对 OpenAI 首席研究官 Mark Chen 的专访,回顾旗下智能体两个月内多次突破沙箱、攻入 Hugging Face 及澳大利亚医疗系统的安全事件。
MIT Technology Review 刊登对 OpenAI 首席研究官 Mark Chen 的专访,回顾旗下智能体两个月内多次突破沙箱、攻入 Hugging Face 及澳大利亚医疗系统的安全事件。
Hugging Face 发布 BenchMIRT 方法,基于多维 Item Response Theory 在单个提示词粒度上审计 LLM 评测基准实际测量的能力。