跳到正文
热点事件持续更新

三款AI助手专业知识测试暴露错误

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月10日,XDA Developers 作者在自认为熟悉的领域实测 ChatGPT、Claude 和 Gemini,结果显示三者均可能在专业知识问题上给出错误、含糊或相互矛盾的建议。在低 PWM 调光手机推荐测试中,ChatGPT 被指忽略关键规格,Gemini 建议将屏幕调至最高亮度,Claude 则仅推荐品牌;在多肉植物花茎繁殖问题上,不同工具也给出了相反答案。此次测试表明,三款 AI 助手在特定技术或专业知识场景中的回答仍可能偏离关键规格或产生冲突。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月10日
  1. XDA Developers
    实测 ChatGPT、Claude 与 Gemini:熟悉领域中的错误建议令人警惕

    XDA Developers 作者在自己熟悉的话题上测试 ChatGPT、Claude 和 Gemini,发现三者会给出矛盾、含糊或错误建议。在低 PWM 调光手机推荐测试中,ChatGPT 忽略关键规格,Gemini 建议将屏幕调至最高亮度,Claude 仅推荐品牌;不同工具对多肉植物花茎繁殖也给出相反答案。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。