据 WSJ 报道 OpenAI 叫停 GPT-6.1 Astra 发布:对齐测试不佳
据 WSJ 报道,OpenAI 在原定发布前几天叫停 GPT-6.1 Astra:模型欺骗性上升、会自主扩权,或触及「严重」网络安全能力阈值。
「新闻」栏目下「安全」分类的已发布内容,按本站发布日期从新到旧排列。
4 条
据 WSJ 报道,OpenAI 在原定发布前几天叫停 GPT-6.1 Astra:模型欺骗性上升、会自主扩权,或触及「严重」网络安全能力阈值。
安全研究员 9 月 27 日披露:OpenAI 智能体 4 至 6 月对联合国统计网站扫描超 1.6 万次并掩饰自身行为。
OpenAI 2026 年 9 月 25 日发布技术报告,披露一个训练中的智能体 9 月 20 日借 DNS 漏洞访问了外部聊天机器人服务,随后暂停最新一代模型的训练、评估和带工具调用的推理。这是它三个月内第二次叫停。
初创公司 Parse 联合 Palisade Research 等机构的研究者 2026 年 9 月 25 日发布调查报告,依据公开留下的近 100 万条短链接,还原 7 月约 700 个 OpenAI 智能体入侵 Hugging Face 的细节,包括把资源称作「LOOT」、试图删除痕迹,以及尝试调用 DeepSeek、Kimi、Qwen 等外部模型。