Visão geral de GroupDocs.Parser

Document Parser SDK para executar análise de documentos de alta precisão em aplicativos Node.js

Illustration parser

Extrair dados de documentos

GroupDocs.Parser for Node.js via Java API permite recuperar texto, metadados e imagens de uma ampla variedade de formatos de arquivo, como documentos Office, e‑mails, anexos e arquivos compactados. Esta poderosa ferramenta ajuda a acessar e processar de forma eficiente informações valiosas contidas nesses arquivos para diversas aplicações, como análise de dados, indexação de mecanismos de busca ou sistemas de gerenciamento de conteúdo.

Analisar documentos

Extrair diversos elementos, como hyperlinks, tabelas, códigos QR, códigos de barras e dados de formulários PDF. Também analisar quaisquer informações desejadas dos documentos usando modelos personalizados.

Personalizar resultados

Node.js API permite recuperar dados em vários formatos, como bruto, estruturado, HTML ou Markdown. Além disso, a API oferece funcionalidade de pesquisa para localizar palavras ou frases específicas dentro do texto dos documentos.

Independência de Plataforma

GroupDocs.Parser for Node.js via Java oferece suporte aos seguintes sistemas operacionais, frameworks e gerenciadores de pacotes

Windows
macOS
Linux
NPM
Amazon
Docker
Azure
VS Code
IntelliJ

Formatos de arquivo suportados

GroupDocs.Parser for Node.js via Java oferece suporte a operações com os seguintes formatos de arquivo.

Formatos Microsoft Office

  • Word: DOCX, DOC, DOCM, DOT, DOTX, DOTM, RTF
  • Excel: XLSX, XLS, XLSM, XLSB, XLTM, XLT, XLTM, XLTX, XLAM, SXC, SpreadsheetML
  • PowerPoint: PPT, PPTX, PPS, PPSX, PPSM, POT, POTM, POTX, PPTM

Imagens e Outros Formatos

  • Portátil: PDF
  • Imagens: JPG, BMP, PNG, TIFF, GIF
  • Outros formatos de Office: ODT, OTT, OTS, ODS, ODP, OTP, ODG

Outros formatos

  • Web: HTML, MHTML
  • Arquivos: ZIP, TAR, 7Z
  • e-Books: CHM, EPUB, FB2, MOBI

GroupDocs.Parser for Node.js via Java recursos

Extraia dados de PDFs, documentos Office, imagens e outros formatos de forma rápida e precisa com nosso Node.js Document Parser SDK

Feature icon

Extrair texto

Extrair informações textuais de vários formatos de arquivo, como documentos Office, arquivos PDF e imagens, para fácil leitura e análise.

Feature icon

Extrair imagens

Recuperar conteúdo visual de diversas fontes, como documentos Office e arquivos PDF, para acesso e uso convenientes.

Feature icon

Digitalizar códigos QR

Detectar e decodificar códigos QR presentes em documentos Office, arquivos PDF ou conteúdo visual para recuperação eficiente de informações.

Feature icon

Extrair dados de anexos de e‑mail e arquivos compactados

Coletar informações valiosas de mensagens de e‑mail, anexos de arquivos e fontes de dados compactados para análise e utilização eficazes.

Feature icon

Extrair tabelas

Identificar e extrair dados tabulares de documentos PDF para análise e uso organizados.

Feature icon

Extrair hyperlinks

Localizar e extrair hyperlinks e endereços de e‑mail em documentos Office ou arquivos PDF para acesso eficiente.

Feature icon

Analisar Formulários PDF

Formulários PDF são documentos digitais com campos preenchíveis para interação do usuário, permitindo que eles insiram informações eletronicamente. A API Node.js pode ser utilizada para extrair dados desses formulários para processamento eficiente.

Feature icon

Analisar dados por modelos

Crie modelos personalizados e utilize-os com a API Node.js para analisar informações específicas de arquivos PDF, simplificando os processos de extração de dados.

Feature icon

Pesquisar texto em documentos

Localize rapidamente palavras ou padrões específicos dentro de documentos.

Exemplos de código

Além da extração básica de texto, aqui estão os casos de uso mais comuns para extração rápida de texto, imagens e metadados.

Pesquisar Texto em um Documento

Este exemplo demonstra como pesquisar uma palavra em um documento PDF e imprimir a página e a posição de cada ocorrência.

Pesquisar Texto em um Documento em JavaScript

const groupdocs = require('@groupdocs/groupdocs.parser');

// Carregar o documento
const parser = new groupdocs.Parser("sample.pdf");

// Pesquisar uma palavra página por página
const options = new groupdocs.SearchOptions(false, false, false, true);
const results = parser.search("Lorem", options);

// Imprimir o índice da página, a posição e o texto de cada ocorrência
const it = results.iterator();
while (it.hasNext()) {
    const result = it.next();
    console.log(`Page ${result.getPageIndex()}, position ${result.getPosition()}: ${result.getText()}`);
}

parser.close();

Extrair Imagens de um Documento

Este exemplo demonstra como extrair imagens de um documento PDF e salvá‑las como arquivos PNG.

Extrair Imagens de um Documento em JavaScript

const groupdocs = require('@groupdocs/groupdocs.parser');

// Carregar o documento
const parser = new groupdocs.Parser("images.pdf");

// Extrair imagens do documento
const images = parser.getImages();

// Salvar as imagens como arquivos PNG
const options = new groupdocs.ImageOptions(groupdocs.ImageFormat.Png);
let index = 1;
const it = images.iterator();
while (it.hasNext()) {
    it.next().save(`image_${index++}.png`, options);
}

parser.close();

Extrair Metadados de um Documento

Este exemplo demonstra como extrair metadados de um documento PDF e imprimi‑los.

Extrair Metadados de um Documento em JavaScript

const groupdocs = require('@groupdocs/groupdocs.parser');

// Carregar o documento
const parser = new groupdocs.Parser("sample.pdf");

// Extrair metadados do documento
const metadata = parser.getMetadata();

// Imprimir os metadados
const it = metadata.iterator();
while (it.hasNext()) {
    const item = it.next();
    console.log(`${item.getName()}: ${item.getValue()}`);
}

parser.close();

Pronto para começar?

Baixe GroupDocs.Parser gratuitamente ou obtenha uma licença de teste para acesso total!

Recursos úteis

Explore a documentação, as amostras de código e o apoio da comunidade para aprimorar sua experiência.

Dicas de licença temporária

1
Cadastre-se com seu e-mail comercial. Serviços de e-mail gratuitos não são permitidos.
2
Use o botão Obter uma licença temporária na segunda etapa.
✕
 Português