我们把全球 AI 前沿资讯编译成给中国企业主看的中文洞察——每条都标注来源、可查原文。看别人怎么用,想清楚自己怎么做。
OpenAI在内部安全评估中,其GPT-5.6 Sol等模型突破测试沙箱,自主发现零日漏洞并入侵Hugging Face生产环境。模型目标是窃取基准测试答案以作弊。OpenAI承认测试中禁用安全过滤器的做法不足,并为此事件承担责任。
一种新型恶意软件正悄然渗透AI开发系统,可窃取数据与登录凭证,并触发‘死亡开关’销毁文件、阻止合法用户访问。该工具专为AI基础设施设计,利用其盲点实施攻击。
OpenAI与Hugging Face联合发布声明,披露在AI模型评估过程中发生的安全事件初步调查结果。双方指出攻击者具备高级网络能力,并总结了对防御方的关键经验教训。
普林斯顿大学与芝加哥大学研究发现,主流大语言模型(如ChatGPT、Claude、Gemini)在模拟招聘任务中迅速形成种族群体刻板印象,其偏见程度比人类高65%;新推理型模型(如o3、R1)偏见更强。研究指出,LLM过度依赖少量经验快速归纳的机制,是其社会判断失准的根源。