ChatGPT vs. Gemini vs. Claude: ¿cuál usar para cada tarea?

Comparamos ChatGPT Free, Gemini Free y Claude Free en cuatro tareas de texto. Consulta las puntuaciones históricas, las diferencias y los límites de la prueba.

Documento de proyecto sobre una mesa de trabajo, rodeado de un bolígrafo, una lupa y una regla.

Planteamos a ChatGPT Free, Gemini Free y Claude Free las mismas cuatro tareas: reescribir un aviso, extraer datos en JSON, distinguir una propuesta de una decisión y organizar un plan con dependencias. Definimos de antemano qué observar en cada respuesta. Dos personas evaluaron el material sin saber qué herramienta lo había producido y revisaron las diferencias antes de revelar los nombres.

Claude Free obtuvo 40/40, ChatGPT Free 38/40 y Gemini Free 36/40. Las tres empataron en la reescritura y la extracción de datos. Las diferencias surgieron en las tareas que exigían prestar atención a una condición de coste y a las dependencias de un calendario.

En qué se diferenciaron las respuestas

Para revisar un aviso o extraer campos estructurados como los que utilizamos, cualquiera de las tres cumplió los criterios. En cambio, ante una decisión con un límite de coste o un calendario con dependencias, conviene comprobar las palabras que cambian el sentido de la decisión, las fechas y quién realizará cada actividad. Esos detalles marcaron las diferencias.

Cómo hicimos la comparación

Las cuatro tareas

Los encargos fueron: reescribir un aviso sin cambiar su sentido; extraer datos en JSON; distinguir una propuesta de una decisión que incluía un límite de coste; y elaborar un plan con dependencias, la primera fecha posible de publicación y las personas responsables. Trabajamos únicamente con texto, sin búsquedas en la web, PDF ni imágenes.

Cómo evaluamos las respuestas

Utilizamos las versiones gratuitas disponibles en el momento de la prueba. Cada herramienta recibió la misma tarea y la misma instrucción. Los criterios estaban definidos antes de leer las respuestas. Para que la comparación fuera más justa, dos personas evaluaron la primera respuesta de cada ejecución incluida en el resultado sin saber de qué IA procedía. Revisaron las diferencias entre sus evaluaciones antes de revelar los nombres.

Cada tarea valía hasta diez puntos. La puntuación refleja el cumplimiento de los criterios, incluidos los detalles que debían aparecer de forma explícita.

Qué ocurrió en cada tarea

Puntuaciones por tarea

Resultados de las cuatro tareas de texto de esta prueba
HerramientaReescrituraJSONDecisiónPlanificaciónTotal
Gemini Free10/1010/1010/106/1036/40
ChatGPT Free10/1010/109/109/1038/40
Claude Free10/1010/1010/1010/1040/40

La puntuación solo se aplica a estas cuatro tareas y no indica qué IA es mejor para todo.

En qué empataron las tres

En la reescritura del aviso, las tres recibieron 10/10. Lo mismo ocurrió en la extracción en JSON con la entrada correcta. En esas dos tareas, los resultados fueron iguales.

Dónde empezó la diferencia: el límite de coste

Al distinguir propuesta y decisión, Gemini Free y Claude Free recibieron 10/10. ChatGPT Free obtuvo 9/10: mencionó R$ 6.000, pero no dejó explícita la condición «hasta R$ 6.000». En ese encargo, una palabra marcaba la diferencia.

La tarea que más separó los resultados

En planificación, Gemini Free recibió 6/10. Su respuesta añadió las horas 08:00/09:00, que no figuraban en el enunciado, y retrasó la primera publicación posible al viernes. Según las dependencias indicadas, ya podía realizarse el jueves después de la actividad anterior.

ChatGPT Free se acercó más, con 9/10. Situó dos actividades en paralelo, pero no indicó claramente que debían asignarse a personas distintas. Claude Free cumplió todos los criterios de esa tarea y recibió 10/10.

¿Cuál considerar en cada situación?

Revisar textos y extraer datos

Para reescribir textos o extraer campos parecidos a los nuestros, empieza por la herramienta a la que ya tienes acceso. Las tres cumplieron los criterios, pero comprueba que la reescritura haya conservado el sentido y que los datos estén en el formato solicitado. Prueba con tu propio material antes de adoptar una en tu día a día.

Interpretar decisiones y planificar con dependencias

Si la respuesta trata de una decisión con un techo de gasto, comprueba palabras como hasta, aprobado y propuesto. En un cronograma, revisa las dependencias, la primera fecha viable y los responsables de las tareas paralelas. En planificación observamos la mayor diferencia; comprobar estos puntos resulta más útil que elegir únicamente por el total de la tabla.

Qué no midió la prueba

Búsquedas en la web, PDF, imágenes e integraciones

No evaluamos búsquedas en la web, carga de archivos, lectura de PDF, imágenes, memoria, proyectos ni integraciones. La disponibilidad de estas funciones depende de cada producto y debe consultarse por separado. Para comparar resúmenes de documentos, consulta la prueba de IA para resumir PDF y documentos; aquí solo comparamos tareas de texto.

Consulta las páginas oficiales de ChatGPT Free, Gemini y Claude para comprobar las funciones y los límites vigentes en tu cuenta. Las puntuaciones proceden de las respuestas que evaluamos, no de esas páginas.

Qué no puede responder esta prueba

Hicimos una ronda con cuatro tareas de texto en las versiones gratuitas disponibles entonces. Otras sesiones pueden producir respuestas distintas, y las funciones y los límites cambian según el producto, el país, la cuenta y el plan. El resultado no indica qué IA es mejor para todo. Antes de enviar datos personales o documentos de terceros, confirma la autorización y las normas aplicables a tu trabajo.

Una corrección en la tarea de extracción

En el primer intento de extracción de datos, utilizamos por error una entrada distinta de la prevista. Descartamos esa ejecución y repetimos la tarea con la entrada correcta para las tres herramientas. Solo las respuestas de la repetición se incluyeron en la puntuación. El error fue nuestro, no de las herramientas.

Cómo hacer una prueba parecida

Elige una tarea tuya y utiliza exactamente el mismo texto y la misma instrucción en cada herramienta. Antes de ver las respuestas, anota qué consideras una buena solución. Guarda la primera respuesta de cada herramienta, compara los mismos puntos y, si es posible, pide a otra persona que evalúe sin saber quién escribió cada una. Repite con otras tareas antes de sacar una conclusión para tu uso.

Si todavía estás eligiendo entre asistentes según sus funciones y tu rutina, lee la guía introductoria de ChatGPT, Gemini, Claude y Copilot. Para explorar herramientas según tus necesidades, utiliza Encuentra la herramienta de IA adecuada como punto de partida para explorar opciones.

Qué llevarte de esta comparación

Las tres herramientas respondieron bien a los encargos más directos. Las diferencias aparecieron cuando una condición o una dependencia debía quedar explícita. Claude Free obtuvo la mayor puntuación en esta pequeña muestra, pero la elección para tu trabajo depende de la tarea. Comprueba los detalles de la respuesta y, cuando la decisión sea importante, compárala con tu propio material.