Cómo pasar un PDF a Word editable
En resumen: Para obtener un Word realmente editable, cambia el tipo de resultado de pdf-to-word a fluido: por defecto está el exacto, que mete cada página como imagen con una capa oculta para buscar. El modo fluido reconstruye párrafos, títulos y tablas de Word auténticas.
Cluster
guía paso a paso
Instrucciones paso a paso para llevar una tarea PDF de la entrada a un resultado fiable.
Herramienta principal
PDF a Word en línea
Abre la herramienta de este artículo y completa la operación en la localización actual.
Abrir herramientaTabla de contenidos
- Por defecto sale una imagen, no texto
- Qué hay dentro del archivo exacto
- Cómo obtener un documento que se pueda editar
- Los encabezados repetidos desaparecen a propósito
- Los títulos se deciden por el tamaño de letra
- Las tablas salen como tablas
- El peso del archivo y las vistas previas
- Un escaneo sin capa de texto
Convertir un PDF en un Word editable
La petición es casi siempre la misma: hay que corregir un par de párrafos de un PDF que alguien envió. Y el primer intento casi siempre decepciona. El archivo se abre en Word, se ve perfecto, y el cursor no entra en el texto. No es un fallo de la conversión, sino la consecuencia del ajuste que viene puesto de fábrica.
Por defecto sale una imagen, no texto
La herramienta tiene dos modos, y el selector entre ellos se llama tipo de resultado. Viene marcado el exacto, y hace justo lo que promete: conserva el aspecto de la página letra por letra. El método es brusco: cada página del PDF se dibuja como imagen y se pega entera en el documento de Word.
De ahí la sensación de cambiazo. Es un .docx, se abre en Word, las páginas coinciden con el original en tamaño y orientación, y no hay nada que editar: lo que hay en la página son imágenes.
El segundo modo, el fluido, desarma la página y reconstruye con las piezas un documento de Word de verdad: párrafos, títulos, listas y tablas. A cambio se pierde la colocación exacta de cada elemento.
| Modo | Qué hay dentro | Qué puedes hacer |
|---|---|---|
| Exacto | Una imagen de cada página más una capa de texto oculta | Leer, buscar en el texto, imprimir |
| Fluido | Párrafos, títulos, listas y tablas de Word | Editar el texto, cambiar estilos, trabajar con tablas |
La elección no va de calidad sino de tarea. Un documento que debe seguir su camino en un formato de oficina conocido y quedarse intacto pide el exacto. Un documento que hay que cambiar pide el fluido, y ningún ajuste del modo exacto dará texto editable.
Qué hay dentro del archivo exacto
La imagen de la página no es todo su contenido. Debajo se coloca además el texto extraído del PDF, marcado como oculto: no aparece en pantalla ni al imprimir, pero la búsqueda del documento lo encuentra.
Eso vuelve útil el modo exacto justo donde parece inútil. Un contrato que hay que repartir y en el que luego se buscarán cláusulas funciona bien así: el aspecto se conserva, la búsqueda va y nadie lo edita por accidente. La propia herramienta lo advierte al terminar, avisando de que el documento no es texto editable, y conviene leer ese mensaje en vez de cerrarlo.
El tamaño y la orientación de la página se toman del PDF de origen, página por página. Una hoja apaisada en medio de un documento vertical sigue apaisada.
Cómo obtener un documento que se pueda editar
1. Abre pdf-to-word y sube el archivo. 2. Cambia el tipo de resultado a fluido. Esta es la acción decisiva, y por defecto no está hecha. 3. Decide si quieres las vistas previas de página, algo que se explica más abajo, y apágalas si no. 4. Lanza el procesamiento y descarga el .docx. 5. Abre el documento y recorre el panel de navegación: muestra qué títulos se reconocieron. 6. Revisa las tablas y la primera página, donde suelen verse las pérdidas.
Los encabezados repetidos desaparecen a propósito
El modo fluido hace una pasada aparte por todo el documento buscando líneas repetidas. Se aplican dos condiciones: la línea debe quedar en la décima parte superior o inferior de la página y repetirse en al menos tres páginas y en al menos la mitad del documento. Todo lo que cumpla ambas se elimina del resultado.
La comparación no es ingenua. Las series de dígitos se colapsan, así que «Página 4» y «Página 5» cuentan como la misma línea. Pero el colapso solo entra si quedan letras en la línea: un número suelto al pie se compara de forma exacta, y tres cifras distintas en tres páginas no son iguales entre sí. En la práctica un pie que diga «Confidencial. Página 7» se va, mientras que un pie que sea solo un número se queda como párrafo en cada página.
Probado sobre un informe de cuatro páginas: la línea `Confidential report Page N` no aparece en el resultado fluido y sí en el exacto, donde la página es una imagen y no hay nada que quitarle.
El mecanismo también tiene su reverso. Un título de documento puesto en grande en lo más alto de cada página, idéntico en todas, cae bajo la misma regla y se borra junto con los encabezados. Si esa línea superior importa, volver a escribirla sale más rápido que buscar la causa.
Los títulos se deciden por el tamaño de letra
Los estilos de título del resultado no se inventan. La herramienta calcula primero, para todo el documento, cuál es el tamaño de letra del cuerpo. Cuenta caracteres y no líneas, de modo que un rótulo grande y aislado nunca gana la votación.
Después cada bloque se mide contra ese tamaño. Alrededor de un 15 por ciento mayor que el cuerpo da un título de nivel dos, una vez y media o más da nivel uno. Lo demás sigue siendo párrafo corriente. El texto además tiene que parecer un título: una frase larga terminada en punto no lo será, con la letra que sea.
Eso produce un comportamiento previsible en documentos maquetados sin estilos. Si todo el texto va en un solo cuerpo y las secciones se marcan solo con negrita, el archivo de Word no tendrá ningún título: el tamaño no cambia y no hay de dónde agarrarse. El panel de navegación sale vacío y la estructura hay que ponerla a mano.
Las tablas salen como tablas
Las tablas las localiza un detector aparte, el mismo sobre el que está construido pdf-to-excel. Una tabla detectada llega al documento como tabla de Word auténtica, con su cuadrícula visible, y no como párrafos rellenos de espacios.
Los bloques de texto que caen dentro de los límites de una tabla detectada se retiran del flujo de párrafos; si no, el contenido de las celdas saldría dos veces, una como tabla y otra como prosa. El umbral es un solape de seis décimas del área del bloque.
Dónde aterriza la tabla lo decide su borde superior: se inserta antes del primer párrafo que empiece por debajo de ella. En una página normal a una columna eso da el orden correcto. En una página a dos columnas la tabla puede acabar en otro sitio, porque los párrafos de ambas columnas van seguidos en el archivo mientras que sus alturas se entrelazan.
Si la detección de tablas falla en alguna página, la tarea no se cae: esa página pasa como texto corriente y la respuesta lleva un aviso con los números de página. Una respuesta vacía y sin explicación no es posible aquí.
El peso del archivo y las vistas previas
El modo fluido añade por defecto una imagen de cada página después del texto de esa página, para tener con qué contrastar el resultado. Nada más influye tanto en el peso.
Medido sobre un mismo documento de cuatro páginas:
| Resultado | Tamaño |
|---|---|
| Modo exacto | 671 KB |
| Fluido con vistas previas | 315 KB |
| Fluido sin vistas previas | 37 KB |
El PDF de origen pesaba unos 4 KB. La distancia entre las filas extremas es de dieciocho veces, y toda ella son imágenes. Si el documento va a trabajo real y no a comparación, apaga las vistas previas desde el principio: no se editan, no participan en el texto y estorban al corregir.
El modo exacto ignora por completo ese ajuste, porque su página ya es una imagen.
Un escaneo sin capa de texto
Un documento escaneado es una imagen, y no hay nada dentro que extraer. En modo exacto el resultado es ese mismo escaneo reempaquetado como .docx. En modo fluido las páginas salen vacías, con una nota en lugar de cada una indicando que la página estaba en blanco.
El remedio va antes de la conversión, no después: pasa el archivo por ocr-pdf, consigue un PDF con capa de texto y solo entonces conviértelo a Word. El orden inverso no sirve, porque ya no quedará nada sobre lo que reconocer.
Un documento cerrado con contraseña de apertura tampoco se convierte; la tarea se detiene y pide la contraseña. Quita la protección con unlock-pdf. Una contraseña que solo limita la impresión o la copia no estorba.
Con las correcciones hechas, el documento suele tener que volver a PDF. Para eso está word-to-pdf, que tiene su propio comportamiento de sustitución de fuentes, conviene saberlo de antemano.
FAQ
Más de este cluster
guía paso a paso
Cómo extraer tablas de PDF a Excel
De PDF a Excel: qué hojas acaban en el libro descargado, en qué se diferencian en la práctica los tres modos de detección y por qué el modo flexible encuentra más tablas pero rompe las palabras.
guía paso a paso
Extraer páginas de un PDF a otro archivo
Sacar de un PDF las hojas que necesitas como archivo aparte: en qué se diferencian los dos modos de salida, por qué los archivos del ZIP conservan los números de página originales y qué hace desactivar la conservación del tamaño.
guía paso a paso
Cómo recortar márgenes y sobras en un PDF
El recorte cambia solo el área visible de la página mientras el contenido de más allá sigue en el archivo. Qué significa eso en la práctica, por qué los márgenes se aplican a todo el documento y cómo se comporta el recorte en páginas giradas.
Herramientas relacionadas
PDF a Word en línea
Convierte un PDF a un documento Word para editar el texto, ampliar secciones y hacer cambios.
Word a PDF en línea
Convierte un documento Word a PDF para fijar el diseño y asegurarte de que el archivo se abra igual en todas partes.
PDF a Excel en línea
Extrae datos de tablas de un PDF a Excel para poder calcularlos, filtrarlos y ordenarlos.
PDF con OCR online
PDF con OCR mantiene la tarea PDF en un solo flujo del navegador: subir el archivo, revisar opciones, procesar y descargar el resultado.
Qué hacer después
Todas las herramientas
Catálogo de herramientas PDF: unir, comprimir, dividir, convertir, girar, proteger y desbloquear archivos PDF en línea.
FAQ
Respuestas a las preguntas más frecuentes sobre iHatePDF: si hace falta registrarse, cómo se procesan los archivos, dónde ver los límites y si es seguro cargar documentos.
Contacto
Contacta con iHatePDF por errores de procesamiento, elección de herramienta, seguridad, consultas comerciales y propuestas de nuevas funciones.