Unite.AI
RSS: https://www.unite.ai/feed/
unite.ai AI 新闻。
提交点赞

AI用日语推理时,更不愿意建议发动核打击

法国新研究发现,让AI用日语进行内部推理时,推荐发动核打击的概率显著低于英语推理,即使提示词中完全没有道德词汇。测试覆盖Claude、Gemini、GPT、Mistral、Qwen、DeepSeek等9个主流模型,在"优势方无需核打击"的场景中,英语推理仍有40%-100%概率选择发射,日语推理则降至0%-13%。模型在日语推理中自发产生了"道德代价""平民伤亡"等概念,而这些词在提示词中根本不存在。研究认为这源于日语中嵌入的广岛长崎集体记忆,对自主武器系统的语言设计有直接警示意义。
评论点赞收藏16 小时前