Planteamos a ChatGPT Free, Gemini Free y Claude Free las mismas cuatro tareas: reescribir un aviso, extraer datos en JSON, distinguir una propuesta de una decisión y organizar un plan con dependencias. Definimos de antemano qué observar en cada respuesta. Dos personas evaluaron el material sin saber qué herramienta lo había producido y revisaron las diferencias antes de revelar los nombres.
Claude Free obtuvo 40/40, ChatGPT Free 38/40 y Gemini Free 36/40. Las tres empataron en la reescritura y la extracción de datos. Las diferencias surgieron en las tareas que exigían prestar atención a una condición de coste y a las dependencias de un calendario.
En qué se diferenciaron las respuestas
Para revisar un aviso o extraer campos estructurados como los que utilizamos, cualquiera de las tres cumplió los criterios. En cambio, ante una decisión con un límite de coste o un calendario con dependencias, conviene comprobar las palabras que cambian el sentido de la decisión, las fechas y quién realizará cada actividad. Esos detalles marcaron las diferencias.
Cómo hicimos la comparación
Las cuatro tareas
Los encargos fueron: reescribir un aviso sin cambiar su sentido; extraer datos en JSON; distinguir una propuesta de una decisión que incluía un límite de coste; y elaborar un plan con dependencias, la primera fecha posible de publicación y las personas responsables. Trabajamos únicamente con texto, sin búsquedas en la web, PDF ni imágenes.
Cómo evaluamos las respuestas
Utilizamos las versiones gratuitas disponibles en el momento de la prueba. Cada herramienta recibió la misma tarea y la misma instrucción. Los criterios estaban definidos antes de leer las respuestas. Para que la comparación fuera más justa, dos personas evaluaron la primera respuesta de cada ejecución incluida en el resultado sin saber de qué IA procedía. Revisaron las diferencias entre sus evaluaciones antes de revelar los nombres.
Cada tarea valía hasta diez puntos. La puntuación refleja el cumplimiento de los criterios, incluidos los detalles que debían aparecer de forma explícita.
Qué ocurrió en cada tarea
Puntuaciones por tarea
| Herramienta | Reescritura | JSON | Decisión | Planificación | Total |
|---|---|---|---|---|---|
| Gemini Free | 10/10 | 10/10 | 10/10 | 6/10 | 36/40 |
| ChatGPT Free | 10/10 | 10/10 | 9/10 | 9/10 | 38/40 |
| Claude Free | 10/10 | 10/10 | 10/10 | 10/10 | 40/40 |
La puntuación solo se aplica a estas cuatro tareas y no indica qué IA es mejor para todo.
En qué empataron las tres
En la reescritura del aviso, las tres recibieron 10/10. Lo mismo ocurrió en la extracción en JSON con la entrada correcta. En esas dos tareas, los resultados fueron iguales.
Dónde empezó la diferencia: el límite de coste
Al distinguir propuesta y decisión, Gemini Free y Claude Free recibieron 10/10. ChatGPT Free obtuvo 9/10: mencionó R$ 6.000, pero no dejó explícita la condición «hasta R$ 6.000». En ese encargo, una palabra marcaba la diferencia.
La tarea que más separó los resultados
En planificación, Gemini Free recibió 6/10. Su respuesta añadió las horas 08:00/09:00, que no figuraban en el enunciado, y retrasó la primera publicación posible al viernes. Según las dependencias indicadas, ya podía realizarse el jueves después de la actividad anterior.
ChatGPT Free se acercó más, con 9/10. Situó dos actividades en paralelo, pero no indicó claramente que debían asignarse a personas distintas. Claude Free cumplió todos los criterios de esa tarea y recibió 10/10.
¿Cuál considerar en cada situación?
Revisar textos y extraer datos
Para reescribir textos o extraer campos parecidos a los nuestros, empieza por la herramienta a la que ya tienes acceso. Las tres cumplieron los criterios, pero comprueba que la reescritura haya conservado el sentido y que los datos estén en el formato solicitado. Prueba con tu propio material antes de adoptar una en tu día a día.
Interpretar decisiones y planificar con dependencias
Si la respuesta trata de una decisión con un techo de gasto, comprueba palabras como hasta, aprobado y propuesto. En un cronograma, revisa las dependencias, la primera fecha viable y los responsables de las tareas paralelas. En planificación observamos la mayor diferencia; comprobar estos puntos resulta más útil que elegir únicamente por el total de la tabla.
Qué no midió la prueba
Búsquedas en la web, PDF, imágenes e integraciones
No evaluamos búsquedas en la web, carga de archivos, lectura de PDF, imágenes, memoria, proyectos ni integraciones. La disponibilidad de estas funciones depende de cada producto y debe consultarse por separado. Para comparar resúmenes de documentos, consulta la prueba de IA para resumir PDF y documentos; aquí solo comparamos tareas de texto.
Consulta las páginas oficiales de ChatGPT Free, Gemini y Claude para comprobar las funciones y los límites vigentes en tu cuenta. Las puntuaciones proceden de las respuestas que evaluamos, no de esas páginas.
Qué no puede responder esta prueba
Hicimos una ronda con cuatro tareas de texto en las versiones gratuitas disponibles entonces. Otras sesiones pueden producir respuestas distintas, y las funciones y los límites cambian según el producto, el país, la cuenta y el plan. El resultado no indica qué IA es mejor para todo. Antes de enviar datos personales o documentos de terceros, confirma la autorización y las normas aplicables a tu trabajo.
Una corrección en la tarea de extracción
En el primer intento de extracción de datos, utilizamos por error una entrada distinta de la prevista. Descartamos esa ejecución y repetimos la tarea con la entrada correcta para las tres herramientas. Solo las respuestas de la repetición se incluyeron en la puntuación. El error fue nuestro, no de las herramientas.
Cómo hacer una prueba parecida
Elige una tarea tuya y utiliza exactamente el mismo texto y la misma instrucción en cada herramienta. Antes de ver las respuestas, anota qué consideras una buena solución. Guarda la primera respuesta de cada herramienta, compara los mismos puntos y, si es posible, pide a otra persona que evalúe sin saber quién escribió cada una. Repite con otras tareas antes de sacar una conclusión para tu uso.
Si todavía estás eligiendo entre asistentes según sus funciones y tu rutina, lee la guía introductoria de ChatGPT, Gemini, Claude y Copilot. Para explorar herramientas según tus necesidades, utiliza Encuentra la herramienta de IA adecuada como punto de partida para explorar opciones.
Qué llevarte de esta comparación
Las tres herramientas respondieron bien a los encargos más directos. Las diferencias aparecieron cuando una condición o una dependencia debía quedar explícita. Claude Free obtuvo la mayor puntuación en esta pequeña muestra, pero la elección para tu trabajo depende de la tarea. Comprueba los detalles de la respuesta y, cuando la decisión sea importante, compárala con tu propio material.

