¿Cómo usar OCR y editar archivos PDF e imágenes para copiar el texto que contienen?
Google Docs sigue agregando nuevas funciones a su aplicación en línea. Así que junto con la capacidad de transferir archivos de cualquier tipo y tamaño (en Google Drive), añade ahora una novedad muy interesante, Función OCReso permite extraer texto de pdf o imagen.
Por lo tanto, puede ver claramente lo útil que puede ser, tanto en el lugar de trabajo como en la vida cotidiana, poder capturar texto de una imagen escaneada y un documento PDF protegido.
Por ejemplo, en teoría, podría usar un escáner para guardar un libro en su computadora, extraer el texto y modificarlo, o podría tomar la documentación terminada, modificarla y reciclarla (tenga cuidado con copiar y pegar documentos con derechos de autor). , sin emabargo). Autor).
veamos juntos cómo extraer texto de pdf o imagen usando google docs; Para completar la información, también te mostraremos algunas alternativas importantes para que puedas extraer el texto mediante OCR.
Cómo extraer texto usando Google Docs
Para activar la función OCR en Documentos abra la página de Google Drive, toque el ícono de ajustes en la esquina superior derecha, luego hacia arriba Ajustes; en la ventana que se abre, marque el elemento Convierta los archivos cargados al formato del editor de Google Docs.
En este punto, simplemente cargue el PDF o la imagen con texto en Google Drive, luego haga clic derecho en el archivo cargado y use la opción Abrir con – Documentos de Google. El PDF o la imagen no cargará en su formato original, pero lo conseguiremos hoja de texto editable directamente utilizando las herramientas de Google Docs. El archivo de texto se puede volver a guardar en formato PDF en su computadora o en formato compatible con Word, TXT, RTF o Libreoffice (ODT).
Por supuesto, si carga un archivo PDF y extrae el texto, perderá el formato del párrafo aunque la configuración de fuente, cursiva y negrita deben permanecer (mucho depende de la calidad de las imágenes que componen el PDF original). Sin embargo, sigue siendo una forma rápida y fácil de transferir sus libros en papel a su computadora sin tener que volver a escribirlos.
Cómo extraer texto en Windows 10
Si Google Docs OCR no nos ha convencido del todo, podemos utilizar alternativamente la herramienta PDF24, disponible de forma gratuita para cualquier versión de Windows.
Después de instalar la aplicación, iníciela, presione el elemento reconocer el texto y en la siguiente ventana, haga clic en Agregar archivos y luego en Comienzo. El programa comenzará a capturar automáticamente el texto de las imágenes en un archivo PDF; al final del trabajo, seguimos adelante guardar el archivopara que pueda crear un nuevo archivo PDF con texto extraído de imágenes (mucho más legible y preciso).
Alternativamente, en Windows siempre podemos usar FreeOCR, una de las mejores herramientas gratuitas.
Después de que se abra el programa, presione Abrir PDF y seleccione un archivo PDF para cargar para que pueda extraer el texto que contiene, y presione OCR en la parte superior. Al final del proceso, elegimos si guardar el texto recuperado en un nuevo PDF (recomendado) o en cualquier otro formato de texto compatible.
Para ver más de cerca otras alternativas de Windows, te recomendamos que leas nuestra guía Programas OCR para convertir imágenes, faxes y archivos PDF desde el escáner.
¿Cómo extraer texto de PDF en Mac?
Si buscamos algo similar al software Mac visto anteriormente, podemos probar OCRKit, que está disponible como prueba gratuita durante 14 días.
Después de abrir esta pequeña herramienta, solo necesita cargar el archivo PDF con imágenes y comenzar a convertir: en unos minutos habremos leído todas las imágenes y se generará un archivo con todo el texto extraído, listo para ser copiado, modificado o compartido. .
Cómo extraer texto de PDF en línea
Si no podemos instalar ningún programa en la computadora de nuestra empresa o trabajar en una computadora con derechos de usuario limitados, aún podemos extraer texto de un PDF que contenga imágenes o escaneos utilizando el servicio en línea onlineocr.net.
Después de que la página esté abierta, presione el botón escoge un archivocargue el archivo PDF con el texto que se va a extraer, seleccione ITALIANO Esto es Microsoft Word (docx) en el menú desplegable junto a y finalmente presione Convertir.
El archivo PDF se leerá y convertirá en un documento de Word fácilmente editable y se descargará desde su navegador como cualquier archivo, listo para ser editado en Word o LibreOffice Writer (versión gratuita disponible para todos).
Si el sitio anterior no funciona para usted y desea probar uno diferente, puede obtener OCR gratuito para PDF llevándonos al sitio web de Convertio, que tiene una sección dedicada a leer caracteres de escaneos o imágenes.
Para utilizar el servicio, haga clic en el botón Selecciona archivoscargue un archivo PDF para escanear, verifique si todas las opciones satisfacen nuestras necesidades y luego presione Reconocer. El sitio leerá inmediatamente todas las imágenes y generará un archivo de Word editable, listo para usar.
En la versión gratuita, solo podemos convertir 10 páginas; si necesitamos más páginas, tendremos que registrarnos presionando la esquina superior derecha Registrarse Antes de hacer nada.
Conclusiones
Como hemos visto, realmente existen muchos métodos para extraer texto de un PDF o una imagen: empezamos por Google Docs (la herramienta más sencilla y directa) para después mostrarte otras herramientas y programas útiles para este fin.
Aún en el tema de PDF, podemos modificar este tipo de archivo leyendo nuestras guías Cómo editar archivos PDF Esto es Los 10 mejores programas de edición de PDF.
Sin embargo, si estamos buscando una forma de editar y compilar archivos PDF en nuestro teléfono, recomendamos leer nuestro artículo. Cómo editar y rellenar archivos PDF desde Android y iPhone.
¿Eso resolvió tu problema?









