Extraer texto de PDF usando Rust
Contents
[
Hide
]
Extraer texto de documento PDF
Extraer texto del documento PDF es una tarea muy común y útil. Los PDFs a menudo contienen información crítica que necesita ser accedida, analizada o procesada para diversos propósitos.
Extraer texto hace que el contenido del PDF sea buscable, permitiendo a los usuarios localizar información específica rápidamente sin revisar manualmente todo el documento.
En caso de que quieras extraer texto de un documento PDF, puedes usar extract_text función. Por favor, revisa el siguiente fragmento de código para extraer texto de un archivo PDF usando Rust.
- Abrir un documento PDF con el nombre de archivo proporcionado.
- extract_text extrae el contenido de texto del documento PDF.
- Imprime el texto extraído en la consola.
use asposepdf::Document;
fn main() -> Result<(), Box<dyn std::error::Error>> {
// Open a PDF-document with filename
let pdf = Document::open("sample.pdf")?;
// Return the PDF-document contents as plain text
let txt = pdf.extract_text()?;
// Print extracted text
println!("Extracted text:\n{}", txt);
Ok(())
}