我对 GPT-4o、Claude 5 和 Grok 4.6 进行了 10 个提示词的盲测。
我对 GPT-4o、Claude 5 和 Grok 4.6 进行了 10 个提示词的盲测。 同样的任务。没有标签。只看输出。 结果: > 3 项任务:GPT-4o 获胜 > 4 项任务:Claude 5 获胜 > 3 项任务:Grok 4.6 获胜 基准测试上只有 2 分的差距。我的测试证实了这一点。 模型已不再是决定性因素。 你的
所有带有「aiceodev」标签的 AI 情报。
1 条情报我对 GPT-4o、Claude 5 和 Grok 4.6 进行了 10 个提示词的盲测。 同样的任务。没有标签。只看输出。 结果: > 3 项任务:GPT-4o 获胜 > 4 项任务:Claude 5 获胜 > 3 项任务:Grok 4.6 获胜 基准测试上只有 2 分的差距。我的测试证实了这一点。 模型已不再是决定性因素。 你的