Análise da Qualidade do Documento
Este guia explica o Relatório em PDF do Verificador Gramatical do DrillBit — o documento em PDF para download que o DrillBit gera após analisar um documento quanto à gramática, qualidade das frases, riqueza de vocabulário e clareza estrutural. É o mais rico em parâmetros dos três relatórios do DrillBit: além dos metadados básicos do envio, apresenta contagens de caracteres e palavras, estimativas de tempo de leitura e de execução, uma pontuação global de Qualidade Gramatical, quatro subpontuações que contribuem para essa pontuação global, uma análise detalhada das frases, um índice de conteúdos e uma lista estruturada de erros gramaticais com explicações por categoria.
O que a «Qualidade Gramatical» mede: A percentagem de Qualidade Gramatical apresentada neste relatório é calculada excluindo semelhanças e correspondências de conteúdo gerado por IA. Por outras palavras, centra-se exclusivamente na qualidade da escrita — se o texto original está gramaticalmente correto, se apresenta um vocabulário variado, se está isento de repetições e se está claramente estruturado — e não no facto de o conteúdo ter sido copiado ou gerado por IA. Utilize-o em conjunto com os relatórios de Detecção de Similaridade e de Conteúdo de IA para obter uma visão completa.
Como ler um relatório de qualidade de um documento
O relatório em PDF do Verificador Gramatical tem quatro páginas lógicas, nesta ordem: um Resumo da Capa com metadados do envio, estatísticas do texto e as quatro pontuações principais; uma página Análise Detalhada que divide Qualidade das Frases em oito métricas individuais e que lista quaisquer frases duplicadas e categorias de conteúdo indexado; uma página Texto Enviado que apresenta o documento linha a linha com os marcadores gramaticais destacados no texto; e uma página Informações Gramaticais que detalha cada frase assinalada com uma descrição da categoria. Antes de aprofundarmos o assunto, eis o aspeto do relatório à medida que o percorre:
Resumo da capa
O bloco de resumo da capa reúne quatro informações numa única página: quem enviou o quê (Informações sobre o envio), qual é o tamanho do documento (Texto enviado), quanto tempo demora a ler ou a ler em voz alta (Tempo de leitura e execução) e as pontuações principais (Informações sobre os resultados).
Informações sobre o envio
Este bloco regista a identidade do documento e da pessoa que o enviou. Todos os campos são preenchidos no momento do upload e não podem ser editados posteriormente. Veja a animação abaixo, onde cada campo é explicado:
- Nome do autor: O nome introduzido para o autor do documento no momento do envio.
- Título: O título do documento tal como fornecido durante o carregamento. Aparece em todas as cópias descarregadas.
- ID do artigo / submissão: Um identificador numérico único que o DrillBit atribui à submissão. Indique-o ao criar um pedido de apoio.
- Enviado por: O endereço de e-mail da conta que carregou o documento.
- Data de envio: O registo temporal da receção do documento, gravado no formato
YYYY-MM-DD HH:MM:SS. - Tipo de documento: O tipo de fonte detetado pelo DrillBit — por exemplo, Trabalho, Artigo, Tese, ou Sinopse.
Texto enviado e tempo de leitura
Dois blocos compactos resumem o tamanho do documento e o tempo que demora a lê-lo:
Texto Enviado apresenta quatro contagens retiradas diretamente do documento analisado:
- Caracteres: Número total de caracteres no documento — incluindo letras, números, sinais de pontuação e espaços.
- Palavras: Contagem total de palavras, calculada após a tokenização do documento.
- Frases: O número de frases identificadas pelo DrillBit. Útil para detetar frases invulgarmente longas ou curtas quando comparadas com a contagem de palavras.
- Linhas: O número de linhas distintas de texto. As linhas não são o mesmo que frases — uma única frase pode ocupar várias linhas e uma única linha pode conter várias frases.
Tempo de leitura e execução apresenta três estimativas de duração. Todas as três estão formatadas como X h, Y min:
- Leitura: Tempo que o documento demora a ser lido em silêncio, calculado a partir da contagem de palavras, utilizando uma estimativa padrão da velocidade de leitura de um adulto.
- Leitura em voz alta: Tempo que o documento demora a ser lido em voz alta. É sempre superior ao tempo de leitura silenciosa, uma vez que a leitura em voz alta é mais lenta.
- Execução: Tempo que o verificador gramatical do DrillBit demorou a analisar o documento. Útil como verificação de integridade; tempos de execução muito longos podem indicar um documento muito extenso ou um problema passageiro.
Informações sobre o resultado — Quatro subpontuações
O bloco «Informações sobre o resultado» é a parte mais importante da página inicial. Apresenta uma percentagem global Qualidade gramatical a vermelho, seguida das quatro pontuações parciais que para ela contribuem. Veja a animação abaixo: a pontuação global aparece primeiro, depois cada pontuação parcial é contada até ao seu valor com uma dica de explicação:
- Qualidade gramatical (global): Uma pontuação combinada que reflete a qualidade da escrita em termos de variedade de vocabulário, ausência de repetições, equilíbrio entre conteúdo indexado e não indexado e ausência de erros gramaticais. O qualificador «Exceto semelhança & Conteúdo de IA» lembra-lhe que esta pontuação é independente dos relatórios de Semelhança e Conteúdo de IA.
- 1. Qualidade das frases: Um valor composto pelas oito métricas de frases apresentadas na página «Análise detalhada» — quanto mais elevada for a pontuação, mais rica e variada será a formulação das frases.
- 2. Conteúdo não duplicado: A percentagem de conteúdo que não se repete no documento. A anotação entre parênteses — por exemplo, (Duplicação 0,0%) — indica o complemento: a percentagem que está duplicada.
- 3. Conteúdo indexado: A percentagem do documento que o DrillBit conseguiu categorizar em tipos de conteúdo conhecidos (por exemplo, referências, legendas, material citado). Uma percentagem mais elevada significa, normalmente, que o documento segue uma estrutura académica reconhecível.
- 4. Informações gramaticais: A percentagem do documento isenta de erros gramaticais. A anotação entre parênteses — por exemplo, (Erros 0, Sugestão 1) — indica as contagens brutas de erros detetados e melhorias sugeridas.
Análise detalhada
A secção seguinte divide as pontuações gerais em métricas individuais. Esta secção é composta por três subblocos: as oito métricas de qualidade das frases, a lista de conteúdo duplicado e a tabela de conteúdo indexado.
Discriminação da qualidade das frases
Oito métricas, em conjunto, descrevem a forma como o documento utiliza palavras e frases. As primeiras quatro classificam a composição de caracteres de cada palavra; as últimas quatro descrevem a riqueza do vocabulário e a estrutura das frases:
- Apenas letras do alfabeto: Percentagem de palavras compostas inteiramente por letras — prosa comum. A maior parte de um documento académico típico enquadra-se nesta categoria.
- Apenas números: Percentagem de palavras compostas inteiramente por algarismos. Útil como verificação rápida para garantir que um documento não contém, de forma inesperada, uma grande quantidade de conteúdo numérico bruto.
- Alfanumérico: Percentagem de palavras que misturam letras e algarismos — por exemplo, códigos de produtos, indicações de versão, referências bibliográficas como secção 4a.
- Palavras com caracteres especiais: Percentagem de palavras que contêm pontuação, hífens ou outros caracteres não alfanuméricos — incluindo termos com hífens, como multifacetado.
- Palavras únicas: Percentagem de termos distintos utilizados exatamente uma vez no documento. Um valor elevado indica um vocabulário variado; um valor baixo indica muitas palavras repetidas.
- Palavras raras: Percentagem de palavras que não constam das 5 000 palavras mais comuns da língua inglesa. Um valor mais elevado sugere um vocabulário avançado; um valor invulgarmente elevado pode indicar uma linguagem artificialmente rebuscada.
- Palavras comuns: Percentagem de palavras que se encontram entre as 1 000 palavras mais comuns em inglês. Esperam-se proporções razoáveis; valores muito elevados sugerem uma formulação simplista.
- Comprimento das palavras: Média de caracteres por palavra. A prosa típica em inglês tem uma média de cerca de 4 a 6 caracteres; números significativamente mais elevados indicam uma escrita densa e técnica.
- Comprimento da frase: Média de palavras por frase. Valores mais baixos indicam frases curtas e diretas; valores mais elevados indicam estruturas complexas com várias orações.
Conteúdo não duplicado
Imediatamente a seguir à análise das frases, o relatório lista qualquer conteúdo duplicado que tenha encontrado. As duplicatas são apresentadas em duas categorias:
- Frases duplicadas: Frases completas que aparecem mais do que uma vez no documento. Se não forem encontradas, a secção indica --NENHUMA--.
- Subcadeias duplicadas: Frases compostas por várias palavras consecutivas que se repetem. Utilizadas para detetar quase-duplicações que não são frases completas, mas que ainda assim reduzem a variedade do vocabulário.
A percentagem apresentada para Conteúdo Não Duplicado na capa é calculada como 100% - (duplicações como percentagem do conteúdo total). Uma pontuação elevada significa que o documento é, em grande parte, original (no sentido interno do documento), e não que seja original em relação a fontes externas — é para isso que serve o relatório de Similaridade.
Conteúdo indexado
A tabela «Conteúdo indexado» mostra como o DrillBit categorizou cada linha do documento. Cada linha corresponde a uma categoria, com contagens de linhas e palavras e uma percentagem:
- N.º de ordem: O número de ordem da linha, útil para se referir a uma categoria específica no feedback.
- Índice: A categoria atribuída pelo DrillBit. Os valores comuns incluem Outros dados (texto principal geral), Referências, Citações e categorias estruturais semelhantes.
- Linhas: Quantas linhas do documento se enquadram nesta categoria.
- Palavras: Quantas palavras se enquadram nesta categoria.
- % no relatório: A percentagem da categoria em relação ao total do documento. A ligação ver no visualizador no ecrã abre apenas essas linhas para inspeção.
Texto enviado
Após a Análise Detalhada, o relatório apresenta o documento na íntegra, linha a linha, com números de linha (Linha 1|, Linha 2|, ...). O texto é exatamente como o DrillBit o analisou — útil tanto como cópia de referência como para que qualquer marcador gramatical mencionado posteriormente (por exemplo, «Linha 12») remeta para a localização correta. Nos casos em que o verificador gramatical assinalou uma frase, as palavras-chave são sublinhadas no próprio texto apresentado.
Informações gramaticais — Lista detalhada de erros
A secção final do relatório lista todos os erros gramaticais ou sugestões detetados pelo DrillBit, com um cartão por resultado. Cada cartão apresenta a frase exata em análise, a categoria gramatical a que pertence, a substituição recomendada e um exemplo prático. Abaixo de cada cartão encontra-se um bloco Descrição da categoria que explica o conceito gramatical em linguagem simples, para que a sugestão seja aplicável mesmo que o leitor não seja um especialista em gramática:
- Frase & linha: O texto exato que o DrillBit assinalou e o número da linha onde aparece na página «Texto Enviado» acima. Utilize o número da linha para encontrar o contexto circundante no documento original.
- Categoria: O conceito gramatical ao qual o problema pertence (preposições, concordância entre sujeito e verbo, uso de artigos, etc.). É idêntico ao título no bloco «Descrição da categoria» abaixo.
- Sugestão: A correção recomendada pelo DrillBit. O texto riscado é o original; o texto destacado é a substituição proposta.
- Exemplo: Uma ligação que, no visualizador no ecrã, abre um exemplo prático da questão. No PDF impresso, isto permanece como um espaço reservado ver.
- Descrição da categoria: Uma definição em linguagem simples da categoria gramatical, juntamente com um par de frases incorreto/correto que ilustra a regra. Fornecida para que a sugestão possa ser aplicada sem consultar uma referência gramatical separada.
Como ler rapidamente um relatório gramatical: Observe rapidamente a percentagem global de Qualidade gramatical na capa. Se for elevada (acima de ~85%), o documento está em bom estado. Se for inferior, as quatro subpontuações indicar-lhe-ão onde reside o problema — vocabulário fraco (Qualidade das Frases), conteúdo repetido (Sem Duplicações), excesso de texto do corpo não categorizado (Conteúdo Indexado) ou erros gramaticais efetivos (Informação Gramatical). Em seguida, passe para a secção relevante nas páginas «Análise Detalhada» ou «Informação Gramatical» para obter os detalhes.