OpenAI:官网动态·· 2025-08-27精选AI 评分61
OpenAI 与 Anthropic 发布联合安全评估结果
OpenAI and Anthropic share findings from a joint safety evaluation
AI 导读
OpenAI 与 Anthropic 发布了一项此前未有的联合安全评估结果,两家实验室互相测试对方模型在失齐、指令遵循、幻觉、越狱等方面的表现,指出跨实验室协作的进展与挑战。
推荐理由
两大实验室互相评测对方模型的失齐、越狱等安全问题,正文透露了跨实验室协作的具体评估维度。
来源:OpenAI:官网动态 · openai.com