热点事件持续更新
Aleph Alpha评测中国模型敏感议题回答
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
10月4日,The Decoder报道,Aleph Alpha研究了千问、DeepSeek和Kimi在政治敏感问题上的回答。测试涵盖967个手选敏感议题,研究发现这些模型经常复述中国官方立场、回避问题或拒绝回答。Aleph Alpha使用自建AI评分系统,将中国模型17%至41%的回答评为平衡;作为对照,Claude Sonnet 5和Mistral Small的对应比例分别为70%和92%。上述比例来自该研究的评分系统,反映其在此次测试中的评定结果。
AI 根据报道生成 · 1 小时前更新
最新进展10月4日 16:47
Aleph Alpha公布敏感议题评测,中国模型获评平衡的回答比例为17%至41%。报道时间线
沿着报道,了解事件的不同侧面。
10月4日
- The DecoderAleph Alpha 研究发现中国 AI 模型在敏感议题上复述官方立场或拒答
Aleph Alpha 的研究发现,千问、DeepSeek 和 Kimi 在政治敏感问题上经常复述中国官方立场、回避或拒答。测试涵盖 967 个手选敏感议题,其自建 AI 评分系统将中国模型仅 17%–41% 的回答评为平衡,Claude Sonnet 5 和 Mistral Small 的对应比例为 70% 和 92%。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。