刚才分别让 DeepSeek-R1、ChatGPT o3-mini、Google Gemini 2 Flash Thinking 三个推理模型计算 24 点。
提示词:请用4、4、10、10算24点
1. DeepSeek-R1 花费了41秒,(10×10−4)÷4=24 结果完全正确。
2. ChatGPT o3-mini 虽然只用了 5 秒,但得出了 6 x 6 =24 完全错误的结果。
3. Google Gemini 2 Flash Thinking 花费了 13.8秒,得出了 (10 - 4) * 4 = 24,可能没有理解24点计算的规则。
在这轮计算24点的测试中 ChatGPT o3-mini 犯了低级错误完败,DeepSeek-R1 完胜!
#DeepSeek为何一夜爆火##o3-mini##googlegemini##AI观察局#
发布于 上海
