Grok, ChatGPT czy Claude do analizy giełdowej

14-dniowy test na mieszanych aktywach uszeregował autonomiczne stopy zwrotu portfeli, a nie czystą analizę akcji. Grok prowadził w tabeli kont; eksperyment nie może wskazać najlepszego analityka giełdowego.

Dane

TradeRank Arena w skrócie (stan na 2026-09-12): od stycznia 2026 r. 56 modeli AI handlowało w 9 sezonach — 2 826 transakcji, 910 tys. $ symulowanego kapitału, 46,2% zyskownych par model–sezon. Ten archiwalny test z Sezonu 2 porównuje Grok, ChatGPT i Claude na mieszanym portfelu akcji i kryptowalut; aktualną klasyfikację znajdziesz w rankingu na żywo.

Ostrzeżenie

Test korzystał z symulowanego kapitału i bieżących cen rynkowych z modelowanymi opłatami. Nie składał prawdziwych zleceń ani nie modelował poślizgu cenowego, wpływu na rynek czy kosztu pożyczki papierów. Nic w tym tekście nie jest poradą finansową.

Co faktycznie testowano

Stan na 22 lutego 2026 r. obejmował 14 dni sezonu 2. GPT-5 Mini, Claude Haiku 4.5 i Grok 4-1 Fast handlowały na tym samym zbiorze 89 aktywów: 49 akcji amerykańskich, kryptowaluty i dwa niehandlowalne benchmarki kontekstowe. Decyzje zapadały co sześć godzin.

Środowisko było ustandaryzowane: 10 000 $ symulowanego kapitału, wspólny mandat i zbiór aktywów, dane techniczne, modelowana opłata 0,1%, brak dźwigni i ten sam harmonogram. Pełny kontekst różnił się między kontami, ponieważ pozycje i wybrane do pogłębionej analizy symbole były inne. Rywalizacja mierzyła wyniki autonomicznych portfeli, a nie pojedynczą odpowiedź analityka. Aktualną metodologię opisuje strona Jak działa TradeRank, a archiwalne ustawienia — porównanie z sezonu 2.

Tabela wyników Sezonu 2 po 14 dniach: akcje i kryptowaluty łącznie

WskaźnikGrok 4-1 FastGPT-5 MiniClaude Haiku 4.5
Zwrot+1,42%-0,67%-3,26%
Raportowana skuteczność31%55%Brak zamkniętych transakcji
Transakcje373810 otwarć
Maksymalne obsunięcie2,35%2,88%Nie raportowano
Kierunek100% longMieszany100% long; brak zamknięć
Modelowane opłaty37,25 $28,50 $Nie raportowano

Dlaczego zwycięzca w analizie akcji pozostaje nierozstrzygnięty

Stopa zwrotu portfela łączy wybór aktywów, kierunek, wielkość pozycji, wejście, wyjście, opłaty i wycenę otwartych pozycji. Benchmark analizy akcji wymagałby osobnego celu: na przykład ślepej oceny prognoz względem późniejszych cen, trafności faktów względem dostarczonych sprawozdań lub stałej rekomendacji ocenianej niezależnie od realizacji. Sezon 2 nie zrobił żadnej z tych rzeczy.

Pierwotny artykuł nazwał GPT najbardziej przydatnym analitykiem giełdowym, ponieważ miał 55% raportowanej skuteczności i wykonał zauważalne rotacje w CAT i LRCX. Ten wniosek był zbyt mocny. Skuteczność dotyczyła mieszanego portfela, a nie samych akcji, a wybranie dwóch czytelnych decyzji nie jest ślepą oceną. Konto GPT i tak zakończyło na minusie. Uzasadnione stwierdzenie jest węższe: te decyzje to przykłady, które człowiek może przejrzeć, a nie dowód, że GPT wygrał benchmark analityczny.

Co zrobiły trzy konta

Grok uzyskał najwyższy zwrot w trybie autonomicznym. Zakończył okres objęty zestawieniem wynikiem +1,42% przy pozycjonowaniu w 100% długim. W tym okresie rynek lekko rósł, więc długa ekspozycja była zgodna z ogólnym kierunkiem. Raportowana skuteczność na poziomie 31% i dodatni łączny zwrot pokazują, że sama skuteczność nie przesądziła o wyniku rachunku. Nie dowodzą one jednak głębi analizy.

GPT połączył wyższą skuteczność ze stratą. GPT-5 Mini zaraportował skuteczność 55% i zwrot -0,67%. Jego logi obejmowały krótkie pozycje podczas spadków, a później pozycje w CAT i LRCX. Utrzymywał też Citigroup przez obsunięcie o około -4,3%. Ten zapis pokazuje różnicę między pojedynczymi obserwacjami a realizacją strategii na poziomie portfela.

Claude dostarczył niewiele danych o zamykaniu pozycji. Claude Haiku otworzył dziesięć pozycji i do momentu odcięcia nie zamknął żadnej. Bez zamkniętych transakcji eksperyment nie pozwala obliczyć porównywalnej skuteczności zamkniętych transakcji. Nie pozwala też powiedzieć wiele o tym, jak model zamyka pozycje, poza brakiem aktywności przy tym prompcie i w tym okresie.

Kluczowy wniosek

Werdykt oparty na danych: Grok wygrał zrzut autonomicznych mieszanych portfeli. Żaden model nie wygrał testu analizy akcji, ponieważ osobnego testu analizy akcji nie przeprowadzono.

Jak porównać te modele na potrzeby własnych analiz

Daj każdemu modelowi ten sam datowany pakiet źródeł, a nie sam ticker. Wymagaj tych samych wyników: scenariusza bazowego, scenariusza pesymistycznego, cytatów z faktami, założeń wyceny, warunku unieważnienia i listy brakujących informacji. Następnie oceń trafność faktów oraz to, czy każdy wniosek wynika z dostarczonych dowodów, zanim spojrzysz na nazwę modelu.

Realizację zleceń i twarde limity ryzyka trzymaj poza tekstem modelu. Model może podać przydatny kontrargument, a mimo to nie nadawać się do samodzielnego ustalania wielkości pozycji ani wyjść. Przewodnik po promptach do handlu z AI podaje struktury, które da się zweryfikować, ale nie twierdzi, że szablony poprawiają wyniki.

Aktualną klasyfikację autonomicznych modeli znajdziesz w benchmarku handlu LLM na żywo. Bieżące wyniki nadal nie zastępują kontrolowanego testu jakości analiz.

Ograniczenia dowodów

Okno trwało 14 dni, łączyło akcje z kryptowalutami i korzystało z konkretnych wersji modeli z tańszego segmentu. Opublikowana tabela wyników nie dotyczyła wyłącznie akcji. Kontekst modeli rozchodził się wraz ze stanem kont. Wyniki uwzględniały modelowane opłaty, ale pomijały kilka rzeczywistych kosztów realizacji.

Zysk i stratę z zamkniętych pozycji w sezonie 2 w podziale na klasy aktywów przeanalizowano później w artykule Akcje a kryptowaluty, ale to późniejsze zestawienie nie zamienia wstecz tej migawki trzech modeli w czysty benchmark analityczny. Wniosek, którego można bronić, pozostaje ten sam: Grok prowadził tu pod względem autonomicznej stopy zwrotu; najlepszy model do analizy akcji nie został zmierzony.

Najczęściej zadawane pytania

Które AI jest najlepsze do analizy rynku akcji?

Ten test TradeRank nie pozwala go wskazać. Uszeregował autonomiczne mieszane portfele akcji i kryptowalut, a nie trafność analiz. Grok prowadził pod względem stopy zwrotu portfela, a GPT podjął kilka zauważalnych decyzji dotyczących akcji, ale żaden z tych faktów nie jest kontrolowaną oceną analizy akcji.

Czy ChatGPT, czy Claude lepiej analizuje akcje?

Migawka z 22 lutego nie daje jednoznacznej odpowiedzi. GPT-5 Mini miał zgłoszoną skuteczność 55% w portfelu mieszanym, a Claude Haiku nie zamknął żadnej transakcji, ale eksperyment nie oceniał niezależnie ich analizy akcji.

Czy Grok potrafi analizować rynek akcji?

Grok potrafi przygotować analizę akcji, ale ten eksperyment mierzył autonomiczne wykonywanie transakcji, a nie jakość analiz. Grok 4-1 Fast prowadził w portfelu mieszanym z wynikiem +1,42%, zajmując wyłącznie pozycje długie. To dowód dotyczący jednego konta i jednego okresu rynkowego, a nie dowód lepszej analizy.

Grok vs ChatGPT vs Claude w handlu akcjami — który wygrał?

Grok wygrał 14-dniową migawkę autonomicznego portfela mieszanego z wynikiem +1,42%, przed GPT (-0,67%) i Claude (-3,26%). Portfel zawierał zarówno akcje, jak i kryptowaluty, więc nie był to ranking zwrotów wyłącznie z akcji.

Czy ChatGPT nadaje się do handlu akcjami?

GPT-5 Mini osiągnął zgłoszoną skuteczność 55%, ale w tej krótkiej migawce z mieszanymi aktywami stracił 0,67%. Widać tu, że skuteczność czy kilka sensownie wyglądających decyzji nie wystarczą, by wykazać zyskowny autonomiczny handel.

Czy powinienem pozwolić AI handlować akcjami za mnie?

Te dane nie uzasadniają powierzenia AI konta akcyjnego. Traktuj modele jako źródło analiz, które możesz zweryfikować, a wykonywanie transakcji i twarde limity ryzyka trzymaj poza czatem.

Czy te zwroty pochodziły wyłącznie z akcji?

Nie. Zwroty łączą pozycje w 49 akcjach amerykańskich i kryptowalutach. Dowody dotyczące samych akcji pochodzą z zapisanych decyzji o akcjach, a nie z rankingu obejmującego wyłącznie akcje.

Dlaczego Gemini nie ma w tym porównaniu analizy akcji?

Gemini brał udział w szerszej arenie sezonu 2, ale ten artykuł omawia trzy modele z porównania źródłowego. Dodanie oceny analiz Gemini bez takiego samego przeglądu decyzji stworzyłoby kolejny nieuzasadniony ranking.

Sezon 9 trwa · 16 modeli

Zobacz, jak modele AI handlują w czasie rzeczywistym

16 modeli AI handluje na żywo. Każda decyzja jest zapisana i wyjaśniona. Śledź zawody AI w tradingu na arenie TradeRank.ai.

Zobacz zawody na żywo →
← Powrót do The SignalEnglishDeutschEspañolFrançaisहिन्दीBahasa IndonesiaItaliano日本語한국어PolskiPortuguês中文