标签: 推理

AI预测世界杯大横评:豆包靠玄学,千问看数据,deepseek选黑马

AI预测世界杯大横评:豆包靠玄学,千问看数据,deepseek选黑马

多家国产大模型——豆包、千问、DeepSeek、Kimi、联想天禧——被要求就法国vs塞内加尔比赛和最终冠军给出预测,结果呈现出明显的“人格分裂”:有人信玄学,有人信数据,有人专挑黑马。这场测试揭示了当前大模型在开放域推理中的自主风格差异,也暴露了AI幻觉和知识更新不及时等老问题。

“你不直接上传到ChatGPT吗?”

“你不直接上传到ChatGPT吗?”

Hacker News 上的一则高赞讨论揭示了当前 AI 应用的一个核心矛盾——非专家对其输出非常信任,而真正的专家却能轻易看出其严重缺陷。这提醒我们,AI 目前更多地是增强而非替代人类专家,但其“效果”的评判权,正掌握在非专家手中。