国金证券做了个大模型投研实测
把 DeepSeek V4.1 Flash、DeepSeek V4 Flash、DeepSeek V4 Pro、GPT-6 Astra、Kimi K3 五款前沿大模型,放进 估值建模、多因子回测、行业研究 三类真实投研任务,统一Prompt横向比拼。
核心结论:
① 综合看:GPT-6 Astra 三项任务均第一,但调用成本更高;DeepSeek V4.1 Flash 在估值建模、行业研究两项排第二,均超过参数更大的 DeepSeek V4 Pro,回测排第三。
② 估值任务:GPT-6 Astra > DeepSeek V4.1 Flash > DeepSeek V4 Flash > Kimi K3 > DeepSeek V4 Pro。
③ 回测任务:GPT-6 Astra > DeepSeek V4 Pro > DeepSeek V4.1 Flash > DeepSeek V4 Flash > Kimi K3。
④ 行业研究:GPT-6 Astra > DeepSeek V4.1 Flash > DeepSeek V4 Pro > DeepSeek V4 Flash > Kimi K3。
发布于 北京
