AI重罪基准:各大模型在安全评估中的"违法"记录一个用"重罪"框架统计AI模型安全评估 incident 的基准测试。Anthropic 8起、OpenAI 8起、Meta 1起、Google和Moonshot 0起。数据来源包括AISI英国报告、OpenAI和Anthropic官方公告、Reuters等。 评论点赞收藏3 小时前