GroupDocs.Parser en un vistazo

SDK de análisis de documentos para realizar un análisis de alta precisión en aplicaciones Node.js

Illustration parser

Extraer datos de documentos

GroupDocs.Parser for Node.js via Java API le permite recuperar texto, metadatos e imágenes de una amplia variedad de formatos de archivo, como documentos de Office, correos electrónicos, adjuntos y archivos comprimidos. Esta potente herramienta le ayuda a acceder y procesar de manera eficiente la valiosa información contenida en estos archivos para diversas aplicaciones como análisis de datos, indexación de motores de búsqueda o sistemas de gestión de contenido.

Analizar documentos

Extraiga varios elementos como hipervínculos, tablas, códigos QR, códigos de barras y datos de formularios PDF. También analice cualquier información deseada de los documentos utilizando plantillas personalizadas.

Personalizar resultados

Node.js API le permite recuperar datos en varios formatos, como sin procesar, estructurado, HTML o Markdown. Además, la API ofrece una funcionalidad de búsqueda para localizar palabras o frases específicas dentro del texto de los documentos.

Independencia de plataforma

GroupDocs.Parser for Node.js via Java admite los siguientes sistemas operativos, frameworks y gestores de paquetes

Windows
macOS
Linux
NPM
Amazon
Docker
Azure
VS Code
IntelliJ

Formatos de archivo compatibles

GroupDocs.Parser for Node.js via Java admite operaciones con los siguientes formatos de archivo.

Formatos de Microsoft Office

  • Word: DOCX, DOC, DOCM, DOT, DOTX, DOTM, RTF
  • Excel: XLSX, XLS, XLSM, XLSB, XLTM, XLT, XLTM, XLTX, XLAM, SXC, SpreadsheetML
  • PowerPoint: PPT, PPTX, PPS, PPSX, PPSM, POT, POTM, POTX, PPTM

Imágenes y otros formatos

  • Portátil: PDF
  • Imágenes: JPG, BMP, PNG, TIFF, GIF
  • Otros formatos de oficina: ODT, OTT, OTS, ODS, ODP, OTP, ODG

Otros formatos

  • Web: HTML, MHTML
  • Archivos: ZIP, TAR, 7Z
  • eBooks: CHM, EPUB, FB2, MOBI

Características de GroupDocs.Parser for Node.js via Java

Extraiga datos de PDFs, documentos de Office, imágenes y otros formatos de forma rápida y precisa con nuestro Node.js Document Parser SDK

Feature icon

Extraer texto

Extraiga información textual de varios formatos de archivo, como documentos de Office, archivos PDF e imágenes, para una fácil legibilidad y análisis.

Feature icon

Extraer imágenes

Recupere contenido visual de diversas fuentes, como documentos de Office y archivos PDF, para un acceso y uso cómodos.

Feature icon

Escanear códigos QR

Detecte y decodifique códigos QR presentes en documentos de Office, archivos PDF o contenido visual para una recuperación de información eficiente.

Feature icon

Extraer datos de adjuntos de correo electrónico y archivos comprimidos

Obtenga información valiosa de mensajes de correo electrónico, archivos adjuntos y fuentes de datos comprimidos para un análisis y uso eficaces.

Feature icon

Extraer tablas

Identifique y extraiga datos tabulares de documentos PDF para un análisis y uso organizados.

Feature icon

Extraer hipervínculos

Ubique y extraiga hipervínculos y direcciones de correo electrónico dentro de documentos de Office o archivos PDF para un acceso eficiente.

Feature icon

Analizar formularios PDF

Los formularios PDF son documentos digitales que incluyen campos rellenables para la interacción del usuario, lo que permite introducir información electrónicamente. La API Node.js puede utilizarse para extraer datos de estos formularios y facilitar su procesamiento.

Feature icon

Analizar datos mediante plantillas

Cree plantillas personalizadas y utilícelas con la API Node.js para analizar información específica de archivos PDF, simplificando los procesos de extracción de datos.

Feature icon

Buscar texto en documentos

Ubique rápidamente palabras o patrones específicos dentro de los documentos.

Ejemplos de código

Más allá de la extracción básica de texto, aquí están los casos de uso más comunes para una extracción rápida de texto, imágenes y metadatos.

Buscar texto en un documento

Este ejemplo muestra cómo buscar una palabra en un documento PDF y imprimir la página y la posición de cada coincidencia.

Buscar texto en un documento en JavaScript

const groupdocs = require('@groupdocs/groupdocs.parser');

// Cargar el documento
const parser = new groupdocs.Parser("sample.pdf");

// Buscar una palabra página por página
const options = new groupdocs.SearchOptions(false, false, false, true);
const results = parser.search("Lorem", options);

// Imprimir el índice de página, la posición y el texto de cada coincidencia
const it = results.iterator();
while (it.hasNext()) {
    const result = it.next();
    console.log(`Page ${result.getPageIndex()}, position ${result.getPosition()}: ${result.getText()}`);
}

parser.close();

Extraer imágenes de un documento

Este ejemplo muestra cómo extraer imágenes de un documento PDF y guardarlas como archivos PNG.

Extraer imágenes de un documento en JavaScript

const groupdocs = require('@groupdocs/groupdocs.parser');

// Cargar el documento
const parser = new groupdocs.Parser("images.pdf");

// Extraer imágenes del documento
const images = parser.getImages();

// Guardar las imágenes como archivos PNG
const options = new groupdocs.ImageOptions(groupdocs.ImageFormat.Png);
let index = 1;
const it = images.iterator();
while (it.hasNext()) {
    it.next().save(`image_${index++}.png`, options);
}

parser.close();

Extraer metadatos de un documento

Este ejemplo muestra cómo extraer metadatos de un documento PDF y mostrarlos.

Extraer metadatos de un documento en JavaScript

const groupdocs = require('@groupdocs/groupdocs.parser');

// Cargar el documento
const parser = new groupdocs.Parser("sample.pdf");

// Extraer metadatos del documento
const metadata = parser.getMetadata();

// Imprimir los metadatos
const it = metadata.iterator();
while (it.hasNext()) {
    const item = it.next();
    console.log(`${item.getName()}: ${item.getValue()}`);
}

parser.close();

¿Listo para empezar?

Descargue GroupDocs.Parser gratis u obtenga una licencia de prueba para obtener acceso completo.

Recursos útiles

Explore la documentación, las muestras de código y el apoyo de la comunidad para mejorar su experiencia.

Consejos para licencias temporales

1
Regístrate con tu correo electrónico del trabajo. No se permiten servicios de correo gratuitos.
2
Utilice el botón Obtener una licencia temporal en el segundo paso.
✕
 Español