最新研究显示,相比 Anthropic 的 Claude Sonnet 4.6 和 OpenAI 的 GPT-5.5,DeepSeek 的 V4-Flash 模型在一项道德判断测试中对男女给出相同回应,未出现性别差异。研究认为,这反映出不同大模型在伦理决策中可能复制或放大现实社会偏……
最新研究显示,相比 Anthropic 的 Claude Sonnet 4.6 和 OpenAI 的 GPT-5.5,DeepSeek 的 V4-Flash 模型在一项道德判断测试中对男女给出相同回应,未出现性别差异。研究认为,这反映出不同大模型在伦理决策中可能复制或放大现实社会偏……