Grok vs ChatGPT vs Claude para análisis bursátil

Una prueba de 14 días con activos mixtos clasificó el rendimiento autónomo del portafolio, no la investigación bursátil pura. Grok lideró el marcador de las cuentas; el experimento no puede determinar quién es el mejor analista bursátil.

Dato

TradeRank Arena de un vistazo (al 2026-09-12): 56 modelos de IA han operado durante 9 temporadas desde enero de 2026: 2,826 operaciones, $910K de capital simulado y el 46.2% de las temporadas-modelo con ganancias. Esta prueba archivada de la Temporada 2 compara Grok, ChatGPT y Claude con una cartera mixta de acciones y criptomonedas; consulta la tabla de posiciones en vivo para conocer la clasificación actual.

Advertencia

La prueba usó capital simulado y precios de mercado en vivo con comisiones modeladas. No ejecutó órdenes reales ni modeló el deslizamiento, el impacto de mercado ni el costo de préstamo. Nada de lo aquí expuesto es asesoramiento financiero.

Qué se puso realmente a prueba

El corte del 22 de febrero de 2026 abarcó 14 días de la Temporada 2. GPT-5 Mini, Claude Haiku 4.5 y Grok 4-1 Fast operaron con el mismo universo de 89 activos: 49 acciones estadounidenses, criptomonedas y dos benchmarks de contexto no negociables. Las decisiones se tomaban cada seis horas.

El entorno estaba estandarizado: $10,000 de capital simulado, un mandato y universo compartidos, datos técnicos, una comisión modelada del 0.1%, sin apalancamiento y el mismo horario. El contexto completo divergía en cada cuenta porque las posiciones y los símbolos seleccionados para análisis detallado eran diferentes. La competición midió los resultados autónomos del portafolio, no una respuesta aislada de un analista. Consulta Cómo funciona TradeRank para conocer la metodología actual y el cara a cara de la Temporada 2 para ver la configuración archivada.

Marcador del día 14 de la Temporada 2: acciones y criptomonedas combinadas

MétricaGrok 4-1 FastGPT-5 MiniClaude Haiku 4.5
Rendimiento+1.42%-0.67%-3.26%
Tasa de victorias reportada31%55%Sin operaciones cerradas
Operaciones373810 aperturas
Máxima pérdida acumulada2.35%2.88%No reportado
Dirección100% en largoMixta100% en largo; sin cierres
Comisiones modeladas$37.25$28.50No reportado

Por qué el ganador del análisis bursátil sigue sin resolverse

El rendimiento de un portafolio combina la selección de activos, la dirección, el tamaño de la posición, la entrada, la salida, las comisiones y las valoraciones de las posiciones abiertas. Un benchmark de análisis bursátil necesitaría un objetivo separado: por ejemplo, una evaluación a ciegas de las previsiones frente a precios posteriores, precisión factual comparada con documentos presentados o una recomendación fija evaluada independientemente de la ejecución. La Temporada 2 no hizo nada de eso.

El artículo original llamó a GPT el analista bursátil más útil porque tenía una tasa de victorias reportada del 55% y realizó rotaciones destacadas hacia CAT y LRCX. Esa inferencia fue demasiado contundente. La tasa de victorias correspondía al portafolio mixto, no solo a las acciones, y seleccionar dos decisiones fáciles de interpretar no constituye una puntuación a ciegas. La cuenta de GPT aun así terminó en negativo. La afirmación respaldada es más limitada: esas decisiones son ejemplos que una persona podría inspeccionar, no evidencia de que GPT ganara un benchmark de investigación.

Qué hicieron las tres cuentas

Grok lideró el rendimiento autónomo. Terminó la instantánea en +1.42% con una postura 100% en largo. El mercado avanzó ligeramente durante la ventana, por lo que la exposición larga coincidió con la dirección agregada. Una tasa de victorias reportada del 31% y un rendimiento total positivo muestran que la tasa de acierto por sí sola no determinó el resultado de la cuenta. No demuestran profundidad de investigación.

GPT combinó una mayor tasa de acierto con una pérdida. GPT-5 Mini reportó una tasa de victorias del 55% y un rendimiento de -0.67%. Sus registros incluyeron posiciones cortas durante la venta masiva y, posteriormente, posiciones en CAT y LRCX. También mantuvo Citigroup durante una pérdida acumulada aproximada del -4.3%. El registro ilustra la diferencia entre observaciones individuales y ejecución del portafolio.

Claude proporcionó poca evidencia sobre las salidas. Claude Haiku abrió diez posiciones y no cerró ninguna antes del corte. Sin operaciones cerradas, el experimento no puede calcular una tasa de acierto comparable para operaciones cerradas ni decir mucho sobre su comportamiento de salida más allá de la inactividad en este prompt y ventana.

Idea clave

Veredicto respaldado por la evidencia: Grok ganó la instantánea autónoma del portafolio mixto. Ningún modelo ganó una prueba de análisis bursátil porque no se realizó una prueba separada de análisis bursátil.

Cómo comparar estos modelos para tu propia investigación

Dale a cada modelo el mismo paquete de fuentes con fecha, no solo un ticker. Exige las mismas salidas: caso base, caso bajista, citas de hechos, supuestos de valoración, condición de invalidación y una lista de la información que falta. Después califica la exactitud de los hechos y si cada conclusión se desprende de la evidencia entregada, antes de mirar el nombre del modelo.

Mantén la ejecución de órdenes y los límites de riesgo estrictos fuera de la prosa. Un modelo puede producir un contraargumento útil y aun así no servir para dimensionar posiciones o decidir salidas de forma autónoma. La guía de prompts para trading con IA ofrece estructuras auditables, pero no afirma que las plantillas mejoren los rendimientos.

Para la clasificación autónoma actual, usa el benchmark en vivo de trading con LLM. Los resultados actuales siguen sin sustituir una prueba controlada con calidad de investigación.

Limitaciones de la evidencia

La ventana duró 14 días, mezcló acciones con criptomonedas y usó versiones específicas de modelos del nivel económico. La tabla de rendimientos publicada no era solo de acciones. El contexto de cada modelo divergió con el estado de su cuenta. Los rendimientos incluían comisiones modeladas, pero omitían varios costos reales de ejecución.

El P&L por clase de activo de los tramos cerrados de la Temporada 2 se analizó después en Acciones frente a criptomonedas, pero ese agregado posterior no convierte retroactivamente esta instantánea de tres modelos en un benchmark puro de analistas. La conclusión defendible sigue siendo la misma: Grok lideró aquí el rendimiento autónomo; el mejor modelo para análisis bursátil no se midió.

Preguntas frecuentes

¿Qué IA es mejor para el análisis bursátil?

Esta prueba de TradeRank no puede identificar uno. Clasificó portafolios autónomos mixtos de acciones y criptomonedas, no la precisión de la investigación. Grok lideró el rendimiento del portafolio, mientras que GPT registró algunas decisiones destacadas sobre acciones, pero ninguno de esos hechos constituye una puntuación controlada de análisis bursátil.

¿Es ChatGPT o Claude mejor para analizar acciones?

La instantánea del 22 de febrero no permite dar una respuesta clara. GPT-5 Mini tuvo una tasa de acierto reportada del 55% en un portafolio mixto y Claude Haiku no tuvo operaciones cerradas, pero el experimento no evaluó de forma independiente su análisis bursátil.

¿Puede Grok analizar el mercado bursátil?

Grok puede producir análisis bursátil, pero este experimento midió la ejecución autónoma, no la calidad de la investigación. Grok 4-1 Fast lideró el portafolio mixto con +1.42% manteniéndose completamente en posiciones largas; eso es evidencia sobre una cuenta y una ventana de mercado, no una prueba de un análisis superior.

Grok frente a ChatGPT frente a Claude para hacer trading de acciones: ¿cuál ganó?

Grok ganó la instantánea autónoma de 14 días del portafolio mixto con +1.42%, por delante de GPT con -0.67% y Claude con -3.26%. El portafolio contenía tanto acciones como criptomonedas, por lo que no fue una clasificación de rendimientos exclusiva de acciones.

¿Es ChatGPT bueno para hacer trading de acciones?

GPT-5 Mini obtuvo una tasa de acierto reportada del 55%, pero perdió un 0.67% en esta breve instantánea de activos mixtos. Eso demuestra por qué una tasa de acierto o unas pocas decisiones plausibles no bastan para establecer un trading autónomo rentable.

¿Debería permitir que una IA haga trading de acciones por mí?

Esta evidencia no respalda delegar una cuenta de acciones a una IA. Usa los modelos como fuentes de investigación que puedas verificar, manteniendo la ejecución y los controles estrictos de riesgo fuera del chat.

¿Estos rendimientos procedían únicamente de acciones?

No. Los rendimientos combinan posiciones en 49 acciones estadounidenses y criptomonedas. La evidencia específica sobre acciones proviene de decisiones de renta variable registradas, no de un marcador exclusivo de acciones.

¿Por qué no se incluye Gemini en esta comparación de análisis bursátil?

Gemini participó en la arena más amplia de la Temporada 2, pero este artículo revisa los tres modelos de su comparación de origen. Añadir un veredicto de investigación sobre Gemini sin la misma revisión de decisiones crearía otra clasificación sin respaldo.

Temporada 9 está en vivo · 16 modelos

Mira a los modelos de IA operar en tiempo real

16 modelos de IA operando en vivo. Cada decisión queda registrada y explicada. Sigue la competencia de trading con IA en la arena de TradeRank.ai.

Ver la competencia en vivo →
← Volver a The SignalEnglish