Qué sobrevive cuando un PDF se convierte en un archivo de Word
Conviertes un PDF a Word y la tabla sale torcida. Supones que el conversor es malo, pruebas otro y obtienes casi lo mismo. Hay problemas que no se arreglan cambiando de herramienta.
Entender por qué te dice qué herramienta elegir y cuánto puedes esperar de ella.
Un PDF es un impreso, no un documento
Lo que hay dentro de un PDF es una lista larga de instrucciones que dicen imprime este carácter en 72, 680. En ninguna parte del archivo queda registrado dónde terminaba un párrafo ni qué dos líneas pertenecían a la misma fila de una tabla.
Esa información se tira en el momento en que un documento se exporta a PDF, igual que una hoja impresa no la necesita. Así que devolverlo es una reconstrucción y no una conversión: la forma original se deduce de dónde se sitúan los caracteres.
Esa sola frase explica todo lo demás. La tabla sale torcida no porque el conversor la leyera mal, sino porque no había tabla que leer y hubo que deducirla solo de la posición.
Lo que se puede deducir y lo que nunca estuvo
Separar estas dos cosas te dice qué puede mejorar y qué no.
- Deducible. La separación de párrafos, por el interlineado y por dónde se detienen las líneas. Las tablas, por si las celdas quedan alineadas hacia abajo. Los títulos, por una letra mayor que el cuerpo. Mejores algoritmos lo hacen más preciso.
- Extraíble directamente. Los propios caracteres, y cualquier imagen o sello impreso en la página. Son objetos reales del archivo y no hace falta adivinarlos.
- Nunca registrado. Qué estilo de Word usaba el original, dónde tenía la tabla celdas combinadas, cuántos puntos de espacio había entre párrafos. Ninguna herramienta puede producir esto.
Desconfía de los conversores que reproducen la maquetación exacta
Algunas herramientas anuncian un resultado que coincide con el original píxel a píxel. Lo abres y, en efecto, coincide. Luego editas una línea y el documento se desmonta.
Conseguirlo significa meter el texto en cientos de cuadros flotantes clavados en coordenadas fijas en vez de en párrafos. Un documento construido así parece el original pero no se puede trabajar en él. Borra un carácter y solo ese cuadro se reajusta mientras todo lo demás se queda quieto.
| Qué necesitas | Qué elegir |
|---|---|
| Leer y editar el contenido | Un conversor que reconstruya párrafos |
| Solo leerlo | No conviertas; usa un visor de PDF |
| Que coincida con el impreso | No conviertas; quédate con el PDF |
| Calcular con las cifras | Convierte a hoja de cálculo |
La conversión existe para que puedas editar. Un resultado que no puedes editar ha perdido el sentido. Si el objetivo es que se vea idéntico, no había motivo para convertir.
Por qué salen mal las tablas en realidad
Las tablas de los PDF muchísimas veces no llevan ninguna línea. Donde sí las hay, están dibujadas en una capa distinta del texto, invisibles para cualquier cosa que extraiga las palabras. Por eso fallan tan a menudo los planteamientos basados en encontrar las líneas.
Así que lo que se lee es la posición: las celdas cuyo borde izquierdo coincide a lo largo de varias líneas se toman por una tabla. El método flojea con las celdas vacías. Una celda vacía no deja rastro en el archivo, así que esa fila parece tener una celda menos y todo lo que sigue se corre un lugar.
Con las celdas combinadas ocurre lo mismo. Tu ojo ve dos celdas unidas; el archivo contiene un trozo de texto situado un poco más a la izquierda que sus vecinos.
Ninguna herramienta convierte un PDF escaneado
Un PDF producido por un escáner de oficina es una sola fotografía por página. Tus ojos ven letras, el archivo no contiene ninguna. No es una limitación de la herramienta sino una ausencia en el origen.
El reconocimiento óptico puede fabricar texto a partir de la imagen. Pero eso es reconocer y no extraer, y mezcla errores como leer un cero como la letra O. En un contrato o en un formulario que se presenta, ese error sale caro. Pedir el archivo original a quien lo emitió suele ser más rápido.
En resumen
La pregunta que hay que hacerle a un conversor no es cuánto se parece, sino si puedes editar lo que sale. Y cuando el resultado no es perfecto, saber distinguir un límite de la herramienta de un límite del formato te ahorra cambiar de herramienta para nada.
Preguntas frecuentes
- ¿Por qué distintos conversores dan resultados distintos?
- Porque sus reglas de deducción son distintas. Cuánto tiene que abrirse un hueco para contar como fin de párrafo, cuántas filas alineadas cuentan como tabla: cada herramienta traza esas líneas en un sitio algo diferente. Por eso una herramienta va mejor con ciertos documentos que otra.
- Mis tablas salen mal una y otra vez. ¿Se puede hacer algo?
- Cuantas más celdas vacías tenga una tabla, peor sale, porque una celda vacía no deja rastro en el PDF. Si solo necesitas la tabla, convertir a hoja de cálculo va mejor que a Word. Esa vía reparte las celdas por columnas a propósito, y el desajuste es más fácil de arreglar a mano.
- ¿Pasan las imágenes y los sellos?
- Sí. Son objetos reales impresos en la página, así que no hay que adivinarlos y se extraen tal cual. Dónde caen lo decide el orden de lectura y no sus coordenadas originales, porque clavarlos a unas coordenadas daría un documento que no puedes editar.
- Las tipografías han cambiado.
- Un PDF sí incrusta archivos de fuentes, pero nada garantiza que lleven el nombre que especificaba el documento original, y mucho menos que esa misma fuente esté instalada en el equipo que abre el resultado. Así que las tipografías se dejan estar y se usa la predeterminada.
- ¿Existe algún conversor que no suba mi archivo?
- Sí, las herramientas de este sitio funcionan así. Toda la conversión termina dentro del navegador, de modo que no hay paso de subida. Para comprobarlo, abre la pestaña de red en las herramientas de desarrollo y lanza una conversión.
Actualizado 17 de septiembre de 2026