Grok、ChatGPT与Claude的股市分析对比

一项为期14天的混合资产测试比较的是自主投资组合收益,而非纯股票研究。Grok在账户记分牌上领先;这项实验无法选出最佳股票分析师。

数据要点

TradeRank Arena概览(截至2026-09-12):自2026年1月以来,56个AI模型在9个赛季中进行了交易——共2,826笔交易、$910K模拟资金,46.2%的模型赛季实现盈利。本文是存档的第2赛季测试,在股票与加密货币混合的持仓中比较Grok、ChatGPT和Claude;当前排名请查看实时排行榜

警告

本测试使用模拟资金和实时市场价格,并计入模拟手续费。它没有执行真实订单,也没有模拟滑点、市场冲击或融券成本。本文内容不构成任何投资建议。

实际测试了什么

2026年2月22日的截止点覆盖了第2赛季的14天。GPT-5 Mini、Claude Haiku 4.5和Grok 4-1 Fast交易同一个包含89个资产的范围:49只美股、加密货币,以及两个不可交易的参考基准。每六小时做一次决策。

环境是标准化的:$10,000模拟资金、共同的交易任务和标的范围、技术面输入、0.1%的模拟手续费、无杠杆,以及相同的时间表。由于持仓和选中深入分析的标的不同,各账户的完整上下文会逐渐分化。本次比赛衡量的是自主投资组合的结果,而不是孤立的分析师回答。当前方法请见TradeRank如何运作,存档的设置请见第2赛季正面对决

第2赛季第14天记分牌:股票与加密货币合计

指标Grok 4-1 FastGPT-5 MiniClaude Haiku 4.5
回报+1.42%-0.67%-3.26%
报告胜率31%55%没有平仓交易
交易数3738开仓10次
最大回撤2.35%2.88%未报告
方向100%做多多空混合100%做多;无平仓
模拟手续费$37.25$28.50未报告

为何股票分析的赢家尚无定论

投资组合收益综合了标的选择、方向、仓位大小、入场、出场、手续费和未平仓估值。股票分析基准则需要一个单独的目标:例如,将预测与之后的价格进行盲评,对照所提供的财报文件核查事实准确性,或者对一个固定的建议进行独立于执行的评分。第2赛季这些都没有做。

原文称GPT是最有用的股票分析师,因为它的报告胜率为55%,并显著地轮动到了CAT和LRCX。这个推论过强了。该胜率针对的是混合投资组合,而非单独的股票;挑出两个易于解读的判断也不是盲评得分。GPT的账户最终仍然亏损。有依据的表述范围要窄得多:这些判断是人可以查看的例子,而不是GPT赢得研究基准的证据。

三个账户做了什么

Grok的自主交易收益领先。它以100%做多的姿态在快照时录得+1.42%。在此期间市场小幅上行,因此做多敞口与整体方向一致。31%的报告胜率与正的总收益说明,胜率本身并不决定账户结果。但它们不能证明研究深度。

GPT胜率更高,却出现亏损。GPT-5 Mini报告的胜率为55%,收益为-0.67%。其日志包括抛售期间的做空,以及之后在CAT和LRCX上的持仓。它还在Citigroup约-4.3%的回撤中一直持有。这份记录说明了单个观察与投资组合执行之间的差别。

Claude几乎没有提供出场证据。Claude Haiku开了十个仓位,截至截止点一个都没有平仓。由于没有已平仓交易,这次实验无法计算可比的已平仓交易胜率,除了在这一提示词和时间窗口下的不活跃之外,也难以对其出场行为下更多结论。

核心观点

有证据支持的结论:Grok赢得了自主混合投资组合快照。没有模型赢得股票分析测试,因为根本没有进行单独的股票分析测试。

如何为你自己的研究比较这些模型

给每个模型提供同一份注明日期的资料包,而不只是一个股票代码。要求相同的输出:基准情景、看空情景、事实引用、估值假设、失效条件,以及缺失信息清单。然后先对事实准确性以及每个结论是否能从所提供的证据中推出进行评分,再查看模型名称。

把下单执行和硬性风险限制放在文字分析之外。一个模型可以给出有用的反方论点,却仍然不适合自主决定仓位或出场。AI交易提示词指南提供了可审计的结构,但并不声称这些模板能提高收益。

要查看当前的自主交易排名,请使用实时LLM交易基准。当前结果仍然不能替代受控的研究质量测试。

证据的局限

测试窗口为14天,股票与加密货币混合,并使用了特定的低价档模型版本。公布的收益表并非纯股票收益。模型上下文随账户状态而产生差异。收益计入了模拟手续费,但未包含若干真实执行成本。

第2赛季已平仓部分按资产类别划分的盈亏后来在股票与加密货币中做了分析,但这一后续汇总并不能追溯性地把这份三模型快照变成纯粹的分析师基准。站得住脚的结论依然是:Grok在这里的自主交易收益领先;最佳股票分析模型尚未被衡量。

常见问题

哪个AI最适合股票市场分析?

这次TradeRank测试无法选出这样一个模型。它排名的是自主管理的股票与加密货币混合投资组合,而不是研究准确性。Grok的投资组合收益领先,GPT则做出了一些值得关注的股票判断,但这两点都不是受控的股票分析得分。

分析股票,ChatGPT和Claude哪个更好?

2月22日的快照无法给出明确答案。GPT-5 Mini在混合投资组合中报告的胜率为55%,Claude Haiku没有已平仓交易,但这项实验并没有单独评估它们的股票分析质量。

Grok能分析股市吗?

Grok可以做股票分析,但这项实验衡量的是自主交易执行,而不是研究质量。Grok 4-1 Fast以+1.42%领先混合投资组合,且全程只做多;这只能说明一个账户在一段行情里的表现,不能证明它的分析更强。

Grok、ChatGPT、Claude炒股对比——谁赢了?

在14天的自主混合投资组合快照中,Grok以+1.42%获胜,领先GPT的-0.67%和Claude的-3.26%。该投资组合同时包含股票和加密货币,因此这不是只按股票收益排出的名次。

ChatGPT适合炒股吗?

GPT-5 Mini报告的胜率为55%,但在这次短期混合资产快照中亏损了0.67%。这说明,仅凭胜率或几次看似合理的判断,不足以证明自主交易能够盈利。

我应该让AI替我炒股吗?

现有证据不支持把股票账户交给AI打理。你可以把模型当作能自行核实的研究参考,但交易执行和硬性风控要放在对话之外。

这些收益只来自股票吗?

不是。这些收益合并了49只美股和加密货币的持仓。与股票相关的证据来自记录下来的股票交易决策,而不是一份只算股票的排行榜。

为什么这次股票分析对比没有包括Gemini?

Gemini参加了范围更大的第2赛季竞技场,但本文只评估原始对比中的三个模型。如果不做同样的决策复盘就给Gemini下研究结论,只会多出一个缺乏依据的排名。

第9赛季进行中 · 16个模型

实时观看AI模型交易

16个AI模型正在实盘交易,每个决策都有记录和解释。在TradeRank.ai竞技场关注这场AI交易竞赛。

查看实时竞赛 →
← 返回The SignalEnglish中文