Publicado originalmente em · Atualizado em .
Entregamos o mesmo PDF fictício a ChatGPT Free, Gemini Free e NotebookLM gratuito e fizemos as mesmas perguntas. No teste do IANautaLab de 28 de setembro de 2026, as três ferramentas recuperaram grande parte do documento. A diferença mais útil para escolher uma IA apareceu nas omissões e em uma comparação de gráfico, não em um pódio de pontuação.
Aqui você vê como o teste foi feito, o que cada ferramenta acertou ou deixou escapar e quando cada fluxo pode fazer sentido. O PDF usado no experimento está disponível para você conferir as respostas ou experimentar por conta própria. Resultados desta rodada não medem o desempenho universal dos produtos.
Resposta curta: qual se destacou neste PDF?
Nesta rodada, com este documento, estas versões gratuitas e estas condições, o NotebookLM obteve a maior pontuação bruta nas 24 perguntas: 46/48. Gemini Free ficou com 45/48 e ChatGPT Free com 43/48. A distância é pequena. Nos resumos independentes, Gemini e NotebookLM tiveram 12/14; ChatGPT, 10/14. Esses números são pontos atribuídos pelos critérios de avaliação deste teste, não percentuais de precisão.
O resultado decisivo para o leitor é o perfil: todos foram bem na tabela e na nota de rodapé; o ChatGPT recuperou valores de um gráfico, mas errou qual intervalo tinha o maior crescimento. As três respostas resumidas omitiram ao menos uma condição ou ressalva importante. Por isso, mesmo a ferramenta com maior pontuação precisa de conferência no original.
Como fizemos o teste
O IANautaLab criou o Documento-Teste v1.1, um relatório operacional inteiramente fictício de dez páginas. Ele reúne texto, números, tabela, gráfico, nota de rodapé, exceção local, condição conjunta e ressalva final distribuídos entre seções. O cenário não descreve pessoas, projetos ou gastos reais. Antes de receber as respostas, definimos o PDF, dois pedidos, 24 perguntas, as respostas esperadas e os critérios de pontuação. O mesmo documento e os mesmos pedidos foram usados nas três ferramentas.
Para manter a comparação coerente, testamos apenas opções gratuitas disponíveis na rodada: ChatGPT Free, Gemini Free e NotebookLM gratuito. O resumo curto era uma tarefa separada das 24 perguntas. Conferimos as respostas com o documento e os critérios definidos antes da execução. Preparamos uma forma de avaliar as respostas sem identificar as ferramentas, mas ela não foi aplicada integralmente na avaliação final. Não testamos planos pagos.
Atribuímos dois pontos quando a resposta estava correta e preservava as condições necessárias; um ponto quando era parcialmente correta, mas omitia algo; e nenhum ponto quando estava incorreta, ausente ou inventada. Assim, 43/48 é a soma de pontos neste instrumento e não mede uma taxa geral de precisão em outros PDFs. Nenhuma alucinação factual relevante foi identificada nesta rodada. Isso não é garantia para usos futuros.
Reproduza: baixe o PDF que usamos no teste e experimente nas ferramentas que você já usa. Peça um resumo breve, depois pergunte qual foi o maior aumento consecutivo no gráfico e se a segunda rodada do projeto foi aprovada. Confira as páginas 8 a 10 antes de aceitar a resposta.
Resultados gerais do teste
A tabela separa perguntas e resumo. Tabela, gráfico, nota, combinação e condição são subconjuntos das 24 perguntas; seus pontos não devem ser somados novamente ao total. Deslize a tabela lateralmente em telas estreitas.
| Ferramenta | Perguntas | Resumo | Tabela | Gráfico | Nota | Combinação | Condição |
|---|---|---|---|---|---|---|---|
| ChatGPT Free | 43/48 | 10/14 | 4/4 | 2/4 | 2/2 | 2/2 | 2/2 |
| Gemini Free | 45/48 | 12/14 | 4/4 | 4/4 | 2/2 | 2/2 | 2/2 |
| NotebookLM gratuito | 46/48 | 12/14 | 4/4 | 4/4 | 2/2 | 2/2 | 2/2 |
“Tabela” e “gráfico” agrupam as perguntas baseadas nesses elementos; “nota” trata da nota de rodapé, “combinação” reúne informações de seções diferentes e “condição” avalia os requisitos da segunda rodada. O resumo foi pontuado separadamente, em uma escala de 14 pontos. A leitura abaixo explica as diferenças por capacidade, sem transformar uma diferença pequena em vencedor universal.
Onde as diferenças realmente apareceram
Gráfico: recuperar valores não bastou
O gráfico apresentava janeiro 20, fevereiro 25, março 31, abril 34, maio 38 e junho 40 inscrições. O maior aumento entre meses consecutivos foi de fevereiro para março: +6. Nesta execução, o ChatGPT Free respondeu abril para maio: +4. Em outra pergunta, recuperou corretamente valores do mesmo gráfico. Portanto, o achado é específico: acertou a leitura de valores, mas errou a comparação que exigia encontrar o maior aumento. Gemini e NotebookLM acertaram as duas perguntas do gráfico.
Condições e ressalvas: o que um resumo curto pode esconder
A segunda rodada do projeto fictício não estava aprovada. Para propô-la, era preciso cumprir todas as metas locais e manter o gasto dentro do teto; o Norte não alcançou sua meta. Na pergunta sobre as condições da segunda rodada, o ChatGPT mencionou a existência de uma condição conjunta, sem explicitar os dois requisitos nem a falha do Norte, e recebeu 1/2. Isso ilustra por que “não foi aprovado” pode ser uma conclusão correta e ainda deixar de fora a lógica necessária para decidir.
Na pergunta que pedia uma síntese mais ampla, as três ferramentas ficaram parciais por razões diferentes. O ChatGPT preservou a ressalva sobre o alcance limitado das inscrições, mas omitiu a condição da segunda rodada. Gemini e NotebookLM preservaram a condição, mas omitiram a ressalva final: inscrições não demonstram, por si, aprendizagem, adoção de práticas, permanência ou presença média. Nos resumos independentes, ChatGPT omitiu tanto a condição quanto a ressalva; Gemini e NotebookLM omitiram a ressalva. Quem usa IA para tomar uma decisão deve perguntar especificamente por condições, exceções e limites, além de pedir a visão geral.
Tabela, nota e informações entre seções
As três ferramentas obtiveram 4/4 nas perguntas baseadas na tabela, 2/2 na nota de rodapé sobre inscrições duplicadas, 2/2 na combinação de informações de seções diferentes e 2/2 na condição para a segunda rodada. Isso descreve o que ocorreu com este PDF. Não comprova que qualquer uma sempre lerá tabelas, notas ou gráficos em outros arquivos.
As três ferramentas testadas: o que observar
ChatGPT Free: perguntas variadas, com revisão da comparação
O ChatGPT Free respondeu grande parte do questionário e permite continuar perguntando ao arquivo em um chat. A documentação da OpenAI confirma upload de documentos, inclusive PDF, no plano gratuito, sujeito a limites. O resultado de 43/48 incluiu o erro ao identificar o maior aumento no gráfico e respostas parciais sobre metas locais, condições da segunda rodada e a síntese mais ampla. Se uma decisão depende de um cálculo, comparação ou condição, abra o PDF e faça a checagem manual. A documentação de Visual Retrieval descreve disponibilidade própria; não presumimos que todo PDF enviado ao ChatGPT Free receba leitura visual completa.
Gemini Free: bom desempenho neste conjunto
O Gemini Free alcançou 45/48 nas perguntas e 12/14 no resumo. Acertou as duas questões do gráfico nesta execução, mas foi parcial nas perguntas sobre metas locais, condições da segunda rodada e a síntese mais ampla. A ajuda oficial do Gemini documenta envio e análise de PDF, com limites mais restritos sem assinatura e condições de conta ou organização para arquivos do Drive. É um caminho prático quando o documento já está nesse ambiente. Ainda é necessário conferir ressalvas e permissões.
NotebookLM gratuito: fontes organizadas e maior pontuação bruta da rodada
O NotebookLM gratuito somou 46/48 e 12/14. O produto também é chamado Gemini Notebook pelo Google. Sua ajuda de fontes documenta PDF como origem para perguntas e resumos. Neste teste, foi parcial nas perguntas sobre as condições da segunda rodada e a síntese mais ampla; no resumo curto, deixou de fora a ressalva final. O notebook pode ser útil quando você precisa voltar às fontes, mas uma citação ou pontuação alta não dispensa a leitura do trecho original.
Outras opções documentadas, fora deste teste
O artigo anterior também apresentava Claude, Adobe Acrobat AI Assistant e Copilot no OneDrive. Eles não participaram deste teste, portanto não têm pontuação nesta tabela. São alternativas de fluxo, não colocados em um ranking experimental.
- Claude: a ajuda oficial documenta upload de PDF e outros arquivos em conversas. Vale considerar se você já trabalha nesse chat; teste com o seu documento e confira as passagens.
- Adobe Acrobat AI Assistant: a Adobe documenta respostas e referências no leitor de PDF. O acesso gratuito é limitado; uso completo ou continuado depende do plano ou licença aplicável. Confirme a disponibilidade na sua conta e abra a fonte citada.
- Copilot no OneDrive: a Microsoft documenta resumo no OneDrive para contas com assinatura ou licença elegível. Isso não descreve o chat gratuito do Copilot. Pode fazer sentido quando os arquivos já estão no OneDrive e o recurso está habilitado.
Qual usar para a sua tarefa?
Para perguntar a um PDF avulso: ChatGPT Free ou Gemini Free podem ser pontos de partida se sua conta permite o upload. Nesta rodada ambos recuperaram muito do documento; o ChatGPT exigiu revisão adicional na comparação do gráfico. Para trabalhar em um espaço centrado em fontes: NotebookLM pode ser mais natural, sobretudo quando voltar ao trecho original é parte do processo. Para um PDF já aberto no Acrobat ou arquivos no OneDrive: considere esses fluxos apenas com o acesso necessário, sem atribuir a eles os resultados deste teste.
Se sua intenção é aprender como construir um bom resumo e verificar uma apostila, leia o guia de método para PDFs e apostilas. Para comparar assistentes em tarefas mais amplas, há o comparativo ChatGPT, Gemini e Claude. Aqui o foco é a evidência do mesmo PDF entregue a três versões gratuitas.
Limitações do teste e cuidados com o seu PDF
Foi uma única rodada com um único PDF criado pelo IANautaLab, em 28/09/2026. Os produtos podem mudar, e respostas podem variar entre execuções. Não avaliamos velocidade, interface, OCR pesado, PDFs escaneados complexos, centenas de páginas, múltiplos documentos, edição de PDF, integrações empresariais ou privacidade jurídica. Versões pagas não foram testadas. Não use estes totais para inferir desempenho nesses cenários.
Antes de enviar um documento real, verifique se você pode compartilhá-lo com o serviço e leia as políticas aplicáveis. Para conferir uma resposta, localize o trecho original, confirme números, datas, unidades, condições e ressalvas. Uma frase fluente pode omitir exatamente o detalhe que muda a conclusão. Se o PDF for escaneado, a leitura depende também do reconhecimento do conteúdo; aceitar o arquivo não prova que cada imagem ou gráfico foi interpretado.
Como repetir um teste útil, sem transformar a nota em verdade universal
- Use o mesmo PDF autorizado nas ferramentas que deseja comparar; anote a data, o plano e se o upload funcionou.
- Faça o mesmo pedido: “Resuma o documento em até 80 palavras. Inclua metas, resultado, gasto, condição para uma próxima rodada e ressalvas. Diga quando faltar informação.”
- Faça uma pergunta verificável: “Qual foi o maior aumento entre meses consecutivos no gráfico? Mostre o intervalo e a diferença.”
- Volte ao original: compare a resposta com o gráfico, a tabela, a nota e a seção de ressalvas; registre erros e omissões separadamente.
O Documento-Teste v1.1 permite reproduzir esse exercício. Ele é fictício e não inclui gabarito no arquivo publicado. A melhor escolha para você é a que atende à tarefa, preserva as condições importantes e permite conferir a origem das afirmações, com o menor atrito razoável.

