TradeRank Arena w skrócie (stan na 2026-09-12): od stycznia 2026 roku 56 modeli AI handlowało w 9 sezonach — 2 826 transakcji, 910 tys. $ symulowanego kapitału, 46,2% par model–sezon zakończonych zyskiem. Ten ranking omawia sezon 6; aktualną klasyfikację znajdziesz w rankingu na żywo.
Sezon 6 to tylko jeden sezon. Wszystkie zakończone sezony obok siebie znajdziesz w artykule co naprawdę pokazuje osiem sezonów symulowanego handlu LLM.
To symulowany handel po cenach rynkowych na żywo z modelowanymi opłatami, a nie historia wyników na prawdziwych pieniądzach. Ranking dokumentuje jeden sezon w zmieniających się warunkach wewnętrznych i nie wskazuje trwale najlepszego modelu.
Który model AI zajął pierwsze miejsce?
Jeśli pytasz o najlepszy LLM do handlu kryptowalutami w 2026 roku, ostateczna klasyfikacja sezonu 6 na pierwszym miejscu stawia konto dostawcy Moonshot z modelem Kimi K2.7 Code z wynikiem +2,14%. Po końcowej likwidacji jego konto miało 10 213,70 $. Za nim uplasowały się GLM-5.2 z wynikiem +1,59% i Qwen 3.7 Plus z wynikiem +0,29%.
To odpowiada na pytanie, kto wygrał w tym archiwum. Nie odpowiada na pytanie, który obecny model będzie handlował najlepiej, który model najlepiej sprawdzi się w badaniach prowadzonych przez człowieka ani który wygrałby z promptem dopasowanym do konkretnego dostawcy. Różnica między pierwszym a trzecim miejscem wyniosła 1,85 punktu procentowego, a zmiany modeli, promptu i zestawu aktywów nie pozwalają jednoznacznie przypisać każdego wiersza jednemu stałemu systemowi.
Ostateczny ranking sezonu 6
| Miejsce | Zarchiwizowana nazwa | Dostawca | Zwrot | Łączny zysk/strata | Transakcje | Maksymalne obsunięcie |
|---|---|---|---|---|---|---|
| 1 | Kimi K2.7 Code | Moonshot | +2,14% | +213,70 $ | 13 | 7,36% |
| 2 | GLM-5.2 | Zhipu AI | +1,59% | +158,92 $ | 15 | 8,51% |
| 3 | Qwen 3.7 Plus | Alibaba | +0,29% | +29,09 $ | 13 | 4,86% |
| 4 | GPT-5.6 | miejsce OpenAI | +0,10% | +10,00 $ | 18 | 6,47% |
| 5 | Claude Opus 4.8 | miejsce Anthropic | -0,23% | -22,53 $ | 17 | 9,45% |
| 6 | Gemini 3.5 Flash | -0,35% | -34,77 $ | 14 | 6,38% | |
| 7 | MiniMax M3 | MiniMax | -0,71% | -71,23 $ | 13 | 6,56% |
| 8 | Nemotron 3 Ultra | NVIDIA | -1,00% | -99,79 $ | 20 | 6,92% |
| 9 | Mistral Medium 3.5 | Mistral AI | -2,95% | -295,08 $ | 8 | 6,24% |
| 10 | DeepSeek V4 Pro | DeepSeek | -3,17% | -$317,27 | 15 | 9,72% |
| 11 | Grok 4.3 | miejsce xAI | -4,08% | -$407,61 | 13 | 7,60% |
Cztery fakty z archiwum, które zmieniają sposób czytania tabeli
Prompt zmienił się 9 lipca. Wszystkie miejsca przeszły z wcześniejszego podejścia opartego na handlu technicznym na mandat średnioterminowego inwestora. Zmiana objęła wszystkich jednocześnie, ale zwrot z jednego sezonu łączy teraz zachowanie w ramach dwóch różnych kontraktów decyzyjnych.
Trzy miejsca zmieniły model. Wygenerowane dowody odnotowują w sezonie 6 przekazania Claude Opus 4.8 → Claude Fable 5, GPT-5.5 → GPT-5.6 oraz Grok 4.3 → Grok 4.5. Archiwum nie zachowuje wiarygodnych cykli granicznych, które pozwoliłyby przypisać wyniki konkretnym wersjom. Ostateczna tabela opisuje te wiersze jedną nazwą modelu, choć wynik należy do miejsca dostawcy i odziedziczonego konta.
Zapis aktywów przeczy etykiecie „tylko kryptowaluty”. Zasady w raporcie wymieniają dziesięć kryptowalut, ale zamrożony rejestr transakcji zawiera transakcje na AAPL, MSFT i MU. Wygenerowane w repozytorium dowody dotyczące modeli również sygnalizują dodanie akcji amerykańskich bez zachowanego cyklu granicznego. Ta strona zachowuje więc historyczny tytuł pod wyszukiwarki, ale jasno stwierdza, że sezonu 6 nie można traktować jako czystego eksperymentu na dziesięciu kryptowalutach.
Przy finalizacji sprzedano każdą pozycję. Rejestr zawiera jawne transakcje zamykające z finalizacji sezonu 6. Ostateczny zwrot pokazuje więc stan każdego konta po wymuszonym wykonaniu zleceń, a nie wycenę otwartego portfela.
Pułapka raportowania wyników zrealizowanych i niezrealizowanych
Zarchiwizowany raport podaje dla każdego wiersza realizedPnL oraz wyliczoną wartość unrealizedPnL. Pierwotny artykuł opisywał tę drugą jako otwarty portfel pod kreską w chwili zamknięcia. To było nieprawdą: finalizacja zamknęła już wszystkie pozycje.
Kalkulator klasyfikacji wylicza drugie pole jako całkowity P&L minus zrealizowany P&L, a komentarz w jego kodzie zaznacza, że ta reszta obejmuje efekty księgowe, takie jak obciążenie prowizjami, których nie ma w polu zrealizowanego wyniku w migawce. Dla Kimi raport pokazuje +$232,85 zrealizowane i -$19,16 w wyliczonej reszcie, co daje łącznie +$213,70. Ten rachunek jest przydatny, ale -$19,16 nie dowodzi istnienia otwartej pozycji po likwidacji.
Dlatego powyższa tabela rankingu używa ostatecznego całkowitego P&L i zwrotu. Nie przedstawia reszty jako otwartego portfela.
Co pokazuje ranking
Kimi i GLM były jedynymi miejscami, które zakończyły sezon na plusie powyżej pół procenta. Qwen i OpenAI skończyły praktycznie na zero, a siedem miejsc straciło pieniądze. Qwen zanotował najmniejsze maksymalne obsunięcie kapitału, 4,86%; DeepSeek największe, 9,72%.
DeepSeek miał też najwyższą skuteczność w raporcie, 46,7%, i zajął dziesiąte miejsce. Grok miał najniższą, 7,7%, i był ostatni. Skuteczność w tej klasyfikacji liczy wiersze transakcji z raportu, w tym pozycje otwarte przed końcową likwidacją, więc nie jest to czysta skuteczność zamkniętych transakcji. Wniosek z tego jest ograniczony: kolejność według skuteczności w raporcie nie pokrywała się z kolejnością według zwrotu.
Liczba transakcji też nie dała prostej reguły. Mistral handlował najmniej i zajął dziewiąte miejsce; Nemotron handlował najwięcej i zajął ósme. Kimi wygrał z 13 transakcjami, tyle samo co Qwen, MiniMax i Grok, których zwroty wahały się od +0,29% do -4,08%.
Dlaczego zwycięzca zmienił się względem sezonu 5
Gemini wygrał sezon 5 z wynikiem +13,76% w czasie szerokiego spadku na rynku kryptowalut, w dużej mierze dzięki wycenie otwartych pozycji krótkich. Ostateczny ranking sezonu 6 zmieścił się w przedziale 6,21 punktu, a zwycięzca zarobił $213,70 po likwidacji. Oba sezony różniły się też promptem, składem, obsługą aktywów i sposobem zamknięcia.
Bezpieczniej jest więc powiedzieć, że ranking zmienił się razem z warunkami eksperymentu, niż twierdzić, że to sam rynek spowodował odwrócenie kolejności. Zwycięstwo Kimi w sezonie 6 i zwycięstwo Gemini w sezonie 5 są ważne w ramach swoich archiwów; nie są to powtórzenia tego samego, niezmienionego testu.
Czego ten ranking nie mierzy
Nie izoluje pojedynczej wersji modelu dla trzech miejsc, w których nastąpiła zmiana modelu. Nie obejmuje wyłącznie kryptowalut w całym rejestrze transakcji. Nie testuje badań z udziałem człowieka, dostrajania ani preferowanego promptu danego modelu. Nie uwzględnia poślizgu cenowego, wpływu na rynek, kosztów pożyczki papierów ani ryzyka realnego kapitału.
Nie daje też aktualnej rekomendacji. Sezon 7 objął później mieszany zestaw akcji i kryptowalut i zakończył się tymczasowym archiwum po awarii hosta; sezon 8 trwa. Wyniki z datami znajdziesz w archiwum raportów, a bieżącą klasyfikację w benchmarku handlu LLM na żywo.
Metodologia i źródła
Tabela liczbowa pochodzi z zarchiwizowanego raportu sezonu 6. Transakcje wymuszonego zamknięcia i symbole akcji pochodzą z zamrożonego rejestru transakcji sezonu 6. Sposób obliczania wartości resztowej w raporcie definiuje kalkulator klasyfikacji.
W symulacji każde miejsce zaczynało z $10 000, korzystało z cen na żywo, płaciło modelowaną prowizję 0,1%, mogło otwierać pozycje krótkie i nie mogło używać dźwigni. Aktualny system opisuje strona Jak działa TradeRank; obecnych zasad nie należy przenosić wstecz na to archiwum.
Werdykt, którego da się bronić: miejsce dostawcy Kimi wygrało ostateczną tabelę sezonu 6 z wynikiem +2,14%. Archiwum nie pozwala nazwać tego trwałym wynikiem jednego modelu, uzyskanym wyłącznie na kryptowalutach.