arXiv cs.AI· Jiayi Chen, Guiling Wang·· 1 天前AI 评分40
思考的代价:测试时推理在 DeepSeek、GPT、Gemini 的 LLM 交易中划算吗?
The Price of Thought: Does Test-Time Reasoning Pay in LLM Trading?
AI 导读
一项对照研究显示,DeepSeek、GPT 和 Gemini 系列模型在美股交易中增加测试时推理量,并未可靠提升扣除交易成本后的组合净收益。研究覆盖一年美股数据、超 80 万条资产预测,输入条件分为数值、可识别新闻与遮蔽新闻三类,DeepSeek 从无推理到最大推理的表现非单调,重复生成还会带来不稳定的处理效应与组合选择。作者据此建议部署前逐任务验证。
来源:arXiv cs.AI · arxiv.org