Deskora
Pesquise dentro de ficheiros PDF, Word, Excel, PowerPoint e OpenDocument no Windows. O Deskora encontra o texto que a pesquisa do Windows não alcança. Grátis.

Pesquisa de Texto Integral em Ficheiros PDF e Word no Windows

A pesquisa do Windows encontra nomes de ficheiros. O que está dentro de um PDF de cem páginas quase nunca encontra. O Deskora extrai o texto de PDF, Word, Excel, PowerPoint e OpenDocument e pesquisa-o ali mesmo.

🎁 100% grátis
🔒 Sem registo
Pronto em 30 segundos
🛡️ Sem publicidade
Transferir o Deskora gratuitamente
Busca NTFS instantânea do Deskora encontrando arquivos em todo o disco rígido

Porque os vossos documentos ficam invisíveis

O texto de um PDF não é guardado em claro: está em fluxos de conteúdo comprimidos, codificados tipo de letra a tipo de letra. Desde 2007 os ficheiros do Office são contentores ZIP com XML comprimido lá dentro. Uma pesquisa que lê os bytes em bruto desses ficheiros não encontra nada por princípio — e é por isso que tanta gente está convencida de que um documento «não está neste computador» quando esteve lá o tempo todo.

  • PDF — o texto está em fluxos comprimidos com FlateDecode
  • DOCX, XLSX, PPTX — contentores ZIP com XML comprimido
  • ODT, ODS, ODP — o mesmo princípio, outro XML
  • Pesquisa do Windows — indexa apenas pastas escolhidas e ignora unidades inteiras

📄 Encontrar o documento, não apenas o nome do ficheiro

O Deskora pesquisa dentro de PDF, Word, Excel, PowerPoint e OpenDocument — em todas as unidades.

Transferir o Deskora gratuitamente

Que formatos são pesquisados

O Deskora extrai o texto legível de um documento e pesquisa nele. Isto é o que está coberto — e o que deliberadamente não está.

FormatoO que é pesquisado
PDF (.pdf)Texto completo das páginas, incluindo fluxos comprimidos e tipos de letra CID. É indicado o número da página.
Word (.docx, .docm)Corpo do texto, tabelas, cabeçalhos, rodapés e notas. O texto eliminado do controlo de alterações fica de fora.
Excel (.xlsx, .xlsm)Todas as células de todas as folhas. É indicado o nome da folha.
PowerPoint (.pptx, .ppsx)Todo o texto dos diapositivos, por ordem. É indicado o número do diapositivo.
OpenDocument (.odt)Texto completo, incluindo títulos e tabelas.
OpenDocument (.ods)Todas as células de todas as tabelas. É indicado o nome da tabela.
OpenDocument (.odp)Todo o texto dos diapositivos. É indicado o nome do diapositivo.
RTF (.rtf)Texto completo, com palavras de controlo e códigos de caracteres resolvidos.
TXT, LOG, CSV, XML, JSONPesquisado diretamente, byte a byte — o caminho rápido, inalterado.
.doc, .xls, .msgNão suportados. Os formatos binários antigos e os contentores de correio são um tema à parte e ficam de fora de propósito, em vez de serem feitos pela metade.

Como funciona

A extração é cara, por isso acontece uma única vez. Depois o texto fica comprimido no índice e cada pesquisa seguinte parece uma pesquisa em texto simples.

🔍 Extração de texto

Os fluxos PDF são descomprimidos e descodificados através das tabelas de tipos de letra; os ficheiros do Office são desempacotados e o seu XML corretamente analisado — entidades e separação de parágrafos incluídas.

💾 Índice persistente

O texto extraído é guardado comprimido. Só é extraído de novo se o tamanho ou a data do ficheiro mudarem.

🌙 Construção discreta

Prioridade mínima de thread e de entrada/saída, cancelável a qualquer momento. Não devem dar por isso.

📄 Localizações reais

Um resultado indica a página 7, a folha «Receita» ou o diapositivo 3 — não um número de linha sem significado.

O Deskora em comparação

Comparação honesta. O Deskora é software de secretária gratuito, não uma plataforma jurídica de e-discovery — e não finge sê-lo.

DeskoraPesquisa do WindowsAgent RansackdtSearch
Pesquisa dentro de PDFSimSó pastas indexadasSimSim
Pesquisa dentro de ficheiros do OfficeSimSó pastas indexadasSimSim
Abrange todas as unidadesSimNãoSimSim
Expressões regularesSimNãoSimSim
Indica página / folha / diapositivoSimNãoNãoSim
PreçoGrátisIncluídoGrátis / pagoA partir de várias centenas de euros

Para quem foi feito

⚖️ Escritórios de advogados e contabilistas

Um número de processo aparece no cabeçalho de um PDF, na terceira folha de uma tabela e num contrato digitalizado. Pelo nome do ficheiro não se encontra nenhum. Pelo conteúdo encontram-se os três — com a página que é preciso abrir.

🔬 Investigação e estudo

Centenas de artigos, dezenas de conjuntos de dados, notas em três formatos. «Em que artigo estava aquele método?» é uma pergunta de conteúdo e devia demorar um segundo, não uma tarde.

🔧 Documentação técnica

Os números de peça e os códigos de erro estão dentro dos manuais, não nos seus nomes de ficheiro. Uma pesquisa que lê lá dentro transforma uma pasta de PDF numa base de conhecimento.

Os vossos documentos ficam no vosso computador

A extração corre inteiramente em local. Nada é carregado, nada é enviado para um servidor, não é preciso conta. O índice de documentos pode ser desligado por completo, limitado a pastas escolhidas ou dotado de exclusões — um programa que conhece todas as unidades tem de vos deixar traçar o limite.

Perguntas frequentes

Encontra texto em PDF digitalizados?

Não. Um PDF digitalizado é uma imagem de texto, não texto. Seria preciso reconhecimento ótico, que é outro tipo de programa. O Deskora indicará simplesmente que não há resultados em vez de fingir.

E os ficheiros protegidos por palavra-passe?

São ignorados. O Deskora não tenta quebrar a cifragem, nem sequer no caso comum de palavra-passe de utilizador vazia: esse bloqueio foi posto de propósito.

Isto abranda o computador?

O índice é construído em segundo plano com a prioridade mais baixa e pode ser cancelado a qualquer momento. A pesquisa em texto simples fica inalterada: continua a trabalhar diretamente sobre o ficheiro, sem cópia.

Quanto espaço ocupa o índice?

O texto extraído é guardado comprimido e é uma fração dos documentos. Alguns milhares de documentos custam tipicamente algumas dezenas de megabytes.

Funciona com escritas não latinas?

Sim. Chinês, japonês, cirílico, árabe e devanágari são processados, e a pesquisa sem distinção de maiúsculas funciona para além do ASCII.

Posso usar expressões regulares?

Sim, em sintaxe ECMAScript. Uma expressão inválida mostra um aviso junto ao campo em vez de falhar em silêncio.

📄 Encontrar o documento, não apenas o nome do ficheiro

O Deskora pesquisa dentro de PDF, Word, Excel, PowerPoint e OpenDocument — em todas as unidades.

Transferir o Deskora gratuitamente

🎁 Deskora é 100% Gratuito

Organize sua área de trabalho Windows agora. Sem cadastro, sem assinatura.

Baixar Deskora Gratuitamente