Publicado originalmente el · Actualizado el .
Entregamos el mismo PDF ficticio a ChatGPT Free, Gemini Free y NotebookLM gratuito y formulamos las mismas preguntas. En la prueba de IANautaLab del 28 de septiembre de 2026, las tres herramientas recuperaron gran parte del documento. La diferencia más útil para elegir una IA apareció en las omisiones y en una comparación del gráfico, más que en un podio de puntuaciones.
Aquí puedes ver cómo hicimos la prueba, qué acertó o pasó por alto cada herramienta y cuándo puede tener sentido cada forma de trabajar. El PDF utilizado en el experimento está disponible para comprobar las respuestas o probar por tu cuenta. Los resultados de esta ronda no miden el rendimiento universal de los productos.
Respuesta breve: ¿cuál destacó con este PDF?
En esta ronda, con este documento, estas versiones gratuitas y estas condiciones, NotebookLM obtuvo la mayor puntuación bruta en las 24 preguntas: 46/48. Gemini Free recibió 45/48 y ChatGPT Free 43/48. La diferencia es pequeña. En los resúmenes independientes, Gemini y NotebookLM obtuvieron 12/14; ChatGPT, 10/14. Estos números son puntos asignados según los criterios de evaluación de esta prueba, no porcentajes de precisión.
El resultado decisivo para el lector es el perfil: todas respondieron bien sobre la tabla y la nota al pie; ChatGPT recuperó los valores de un gráfico, pero se equivocó al identificar el intervalo de mayor crecimiento. Las tres respuestas resumidas omitieron al menos una condición o salvedad importante. Por eso, incluso la herramienta con la puntuación más alta necesita comprobarse con el original.
Cómo hicimos la prueba
IANautaLab creó el Documento de prueba v1.1, un informe operativo completamente ficticio de diez páginas. Reúne texto, números, una tabla, un gráfico, una nota al pie, una excepción local, una condición conjunta y una salvedad final repartidos entre secciones. El escenario no describe personas, proyectos ni gastos reales. Antes de recibir las respuestas, definimos el PDF, dos instrucciones, 24 preguntas, las respuestas esperadas y los criterios de puntuación. Utilizamos el mismo documento y las mismas instrucciones en las tres herramientas.
Para mantener una comparación coherente, probamos únicamente las opciones gratuitas disponibles en la ronda: ChatGPT Free, Gemini Free y NotebookLM gratuito. El resumen breve era una tarea distinta de las 24 preguntas. Comprobamos las respuestas con el documento y los criterios definidos antes de la ejecución. Preparamos una forma de evaluar sin identificar las herramientas, pero no se aplicó íntegramente en la evaluación final. No probamos planes de pago.
Asignamos dos puntos cuando la respuesta era correcta y conservaba las condiciones necesarias; uno cuando era parcialmente correcta, pero omitía algo; y ninguno cuando era incorrecta, estaba ausente o era inventada. Por tanto, 43/48 es la suma de puntos en esta evaluación y no mide una tasa general de precisión en otros PDF. No se identificó ninguna alucinación factual relevante en esta ronda. Eso no garantiza los usos futuros.
Repite el ejercicio: descarga el PDF utilizado en la prueba y pruébalo con las herramientas que ya usas. Pide un resumen breve y después pregunta cuál fue el mayor aumento consecutivo del gráfico y si se aprobó la segunda ronda del proyecto. Comprueba las páginas 8 a 10 antes de aceptar la respuesta.
Resultados generales de la prueba
La tabla separa preguntas y resumen. Tabla, gráfico, nota, combinación y condición son subconjuntos de las 24 preguntas; sus puntos no deben volver a sumarse al total. La columna de condición corresponde específicamente a la pregunta 15. Desplaza la tabla lateralmente en pantallas estrechas.
| Herramienta | Preguntas | Resumen | Tabla | Gráfico | Nota | Combinación | Condición (pregunta 15) |
|---|---|---|---|---|---|---|---|
| ChatGPT Free | 43/48 | 10/14 | 4/4 | 2/4 | 2/2 | 2/2 | 2/2 |
| Gemini Free | 45/48 | 12/14 | 4/4 | 4/4 | 2/2 | 2/2 | 2/2 |
| NotebookLM gratuito | 46/48 | 12/14 | 4/4 | 4/4 | 2/2 | 2/2 | 2/2 |
«Tabla» y «gráfico» agrupan las preguntas basadas en esos elementos; «nota» trata de la nota al pie, «combinación» reúne información de distintas secciones y «condición» evalúa los requisitos de la segunda ronda en la pregunta 15. El resumen se puntuó por separado, en una escala de 14 puntos. La explicación siguiente describe las diferencias por capacidad sin convertir una pequeña ventaja en un ganador universal. La pregunta 12, sobre si se había aprobado la segunda ronda, se evaluó de forma independiente; su puntuación parcial no sustituye la de la pregunta 15.
Dónde aparecieron realmente las diferencias
Gráfico: recuperar los valores no bastó
El gráfico mostraba 20 inscripciones en enero, 25 en febrero, 31 en marzo, 34 en abril, 38 en mayo y 40 en junio. El mayor aumento entre meses consecutivos fue de febrero a marzo: +6. En esta ejecución, ChatGPT Free respondió abril a mayo: +4. En otra pregunta, recuperó correctamente valores del mismo gráfico. El hallazgo es específico: acertó al leer los valores, pero falló en la comparación que exigía encontrar el mayor aumento. Gemini y NotebookLM acertaron las dos preguntas del gráfico.
Condiciones y salvedades: qué puede ocultar un resumen breve
La segunda ronda del proyecto ficticio no estaba aprobada. Para proponerla, era necesario cumplir todas las metas locales y mantener el gasto dentro del límite; el Norte no alcanzó su meta. En la pregunta 12, que pedía indicar si se había aprobado la segunda ronda, ChatGPT mencionó la existencia de una condición conjunta, sin explicitar los dos requisitos ni el incumplimiento del Norte, y recibió 1/2. Es una pregunta distinta de la pregunta 15 de la tabla, puntuada con 2/2. Esto muestra por qué «no se aprobó» puede ser una conclusión correcta y, aun así, dejar fuera la lógica necesaria para decidir.
En la pregunta que pedía una síntesis más amplia, las tres herramientas dieron respuestas parciales por motivos diferentes. ChatGPT conservó la salvedad sobre el alcance limitado de las inscripciones, pero omitió la condición de la segunda ronda. Gemini y NotebookLM conservaron la condición, pero omitieron la salvedad final: las inscripciones, por sí solas, no demuestran aprendizaje, adopción de prácticas, permanencia ni asistencia media. En los resúmenes independientes, ChatGPT omitió tanto la condición como la salvedad; Gemini y NotebookLM omitieron la salvedad. Quien utilice IA para tomar una decisión debe preguntar específicamente por condiciones, excepciones y límites, además de pedir una visión general.
Tabla, nota e información entre secciones
Las tres herramientas obtuvieron 4/4 en las preguntas basadas en la tabla, 2/2 en la nota al pie sobre inscripciones duplicadas, 2/2 en la combinación de información de distintas secciones y 2/2 en la condición de la segunda ronda evaluada en la pregunta 15. Esto describe lo que ocurrió con este PDF. No demuestra que alguna vaya a interpretar siempre correctamente tablas, notas o gráficos de otros archivos.
Las tres herramientas probadas: qué observar
ChatGPT Free: preguntas variadas, con revisión de la comparación
ChatGPT Free respondió gran parte del cuestionario y permite seguir preguntando sobre el archivo en un chat. La documentación de OpenAI confirma la carga de documentos, incluidos PDF, en el plan gratuito, sujeta a límites. El resultado de 43/48 incluyó el error al identificar el mayor aumento del gráfico y respuestas parciales sobre metas locales, las condiciones de aprobación de la pregunta 12 y la síntesis más amplia. Si una decisión depende de un cálculo, una comparación o una condición, abre el PDF y compruébalo manualmente. La documentación de Visual Retrieval describe su propia disponibilidad; no suponemos que todos los PDF enviados a ChatGPT Free reciban una lectura visual completa.
Gemini Free: buen rendimiento en este conjunto
Gemini Free obtuvo 45/48 en las preguntas y 12/14 en el resumen. Acertó las dos cuestiones del gráfico en esta ejecución, pero respondió parcialmente sobre metas locales, la aprobación de la segunda ronda en la pregunta 12 y la síntesis más amplia. La ayuda oficial de Gemini documenta la carga y el análisis de PDF, con límites más restrictivos sin suscripción y condiciones de cuenta u organización para archivos de Drive. Puede ser una vía práctica si el documento ya está en ese entorno. Sigue siendo necesario comprobar las salvedades y los permisos.
NotebookLM gratuito: fuentes organizadas y la mayor puntuación bruta de la ronda
NotebookLM gratuito obtuvo 46/48 y 12/14. Google también denomina el producto Gemini Notebook. Su ayuda sobre fuentes documenta los PDF como origen de preguntas y resúmenes. En esta prueba, respondió parcialmente sobre la aprobación de la segunda ronda en la pregunta 12 y la síntesis más amplia; en el resumen breve, omitió la salvedad final. El cuaderno puede ser útil si necesitas volver a las fuentes, pero una cita o una puntuación alta no sustituye la lectura del fragmento original.
Otras opciones documentadas, fuera de esta prueba
El artículo anterior también presentaba Claude, Adobe Acrobat AI Assistant y Copilot en OneDrive. No participaron en esta prueba, por lo que no tienen puntuación en la tabla. Son formas alternativas de trabajar, no puestos en una clasificación experimental.
- Claude: su ayuda oficial documenta la carga de PDF y otros archivos en las conversaciones. Puede interesarte si ya trabajas en ese chat; prueba con tu documento y comprueba los pasajes.
- Adobe Acrobat AI Assistant: Adobe documenta respuestas y referencias dentro del lector de PDF. El acceso gratuito es limitado; el uso completo o continuado depende del plan o la licencia aplicable. Confirma la disponibilidad en tu cuenta y abre la fuente citada.
- Copilot en OneDrive: Microsoft documenta resúmenes en OneDrive para cuentas con una suscripción o licencia apta. Esto no describe el chat gratuito de Copilot. Puede tener sentido si los archivos ya están en OneDrive y la función está habilitada.
¿Cuál usar para tu tarea?
Para preguntar sobre un PDF individual: ChatGPT Free o Gemini Free pueden ser puntos de partida si tu cuenta permite cargarlo. En esta ronda, ambos recuperaron gran parte del documento; ChatGPT necesitó una revisión adicional de la comparación del gráfico. Para trabajar en un espacio centrado en las fuentes: NotebookLM puede resultar más natural, sobre todo si volver al fragmento original forma parte del proceso. Para un PDF ya abierto en Acrobat o archivos en OneDrive: considera estas vías solo si tienes el acceso necesario, sin atribuirles los resultados de esta prueba.
Si quieres aprender cómo elaborar un buen resumen y comprobar unos apuntes, lee la guía de método para PDF y materiales de estudio. Para comparar asistentes en tareas más amplias, tienes la comparación de ChatGPT, Gemini y Claude. Aquí nos centramos en la evidencia del mismo PDF entregado a tres versiones gratuitas.
Limitaciones de la prueba y cuidados con tu PDF
Fue una única ronda con un único PDF creado por IANautaLab, el 28/09/2026. Los productos pueden cambiar y las respuestas pueden variar entre ejecuciones. No evaluamos velocidad, interfaz, OCR intensivo, PDF escaneados complejos, cientos de páginas, varios documentos, edición de PDF, integraciones empresariales ni aspectos jurídicos de la privacidad. No se probaron versiones de pago. No utilices estos totales para inferir el rendimiento en esos escenarios.
Antes de enviar un documento real, comprueba si puedes compartirlo con el servicio y lee las políticas aplicables. Para verificar una respuesta, localiza el fragmento original y confirma números, fechas, unidades, condiciones y salvedades. Una frase fluida puede omitir precisamente el detalle que cambia la conclusión. Si el PDF está escaneado, la lectura también depende del reconocimiento del contenido; aceptar el archivo no demuestra que se haya interpretado cada imagen o gráfico.
Cómo repetir una prueba útil sin convertir la nota en una verdad universal
- Utiliza el mismo PDF autorizado en las herramientas que quieras comparar; anota la fecha, el plan y si la carga funcionó.
- Formula el mismo encargo: «Resume el documento en un máximo de 80 palabras. Incluye metas, resultado, gasto, la condición para una próxima ronda y salvedades. Indica cuándo falte información».
- Haz una pregunta verificable: «¿Cuál fue el mayor aumento entre meses consecutivos del gráfico? Muestra el intervalo y la diferencia».
- Vuelve al original: compara la respuesta con el gráfico, la tabla, la nota y la sección de salvedades; registra errores y omisiones por separado.
El Documento de prueba v1.1 permite repetir este ejercicio. Es ficticio y no incluye las respuestas correctas en el archivo publicado. La mejor elección para ti es la que resuelve la tarea, conserva las condiciones importantes y permite comprobar el origen de las afirmaciones con la menor fricción razonable.

