Repáralo ahora
- Suelta el archivo
- La reparación ocurre en local
- Descarga el resultado
Cuando Word muestra "Word found unreadable content in .docx moderno no es un único bloque binario — es un archivo ZIP lleno de archivos XML. Suelta el documento arriba y la herramienta abre ese paquete en tu navegador, repara el contenedor y las partes mal formadas, y reconstruye un archivo que Word abrirá sin problemas — sin que el documento salga nunca de tu equipo.
Un .docx es un ZIP de XML — y por eso se rompe de esta forma
Desde Word 2007, .docx usa el formato Office Open XML (OOXML), empaquetado con las Open Packaging Conventions. Cambia la extensión de uno a .zip y podrás mirar dentro: encontrarás [Content_Types].xml, un mapa _rels/.rels y la carpeta word/ que contiene document.xml (el texto real y la estructura de párrafos), styles.xml, settings.xml, fontTable.xml, una carpeta word/media/ para las imágenes y word/_rels/document.xml.rels que lo enlaza todo.
El corazón del archivo es word/document.xml. Cada párrafo es un <w:p>, cada fragmento de texto un <w:r> que envuelve un <w:t>. El XML es estricto: una sola etiqueta sin cerrar, un byte perdido o un flujo que se detiene a mitad de un elemento vuelve toda la parte imposible de analizar. Word es implacable aquí por diseño — en lugar de mostrar en silencio medio documento, se detiene y ofrece la recuperación. Así que el error tiene dos causas raíz habituales: el propio contenedor ZIP está dañado (una copia defectuosa, una sincronización que estropeó bytes), o una parte XML — normalmente document.xml — está mal formada o truncada.
Qué recupera realmente la reparación
Como el formato está estructurado en capas, la reparación funciona en dos niveles. Primero la herramienta trata el archivo como un ZIP y reconstruye la estructura del paquete — arreglando el directorio, releyendo cada parte almacenada y volviendo a ensamblar un archivo bien formado. Luego repara las partes OOXML del interior: vuelve a validar document.xml y sus semejantes, cierra las estructuras que quedaron abiertas y descarta los fragmentos que no se pueden rescatar para que el texto restante se analice sin problemas.
En la práctica, esto recupera el texto del cuerpo y buena parte del formato — los estilos de párrafo, los títulos, las tablas y las listas que se escribieron por completo sobreviven porque están todos en document.xml y styles.xml. Las imágenes incrustadas suelen recuperarse bien: viven como archivos independientes bajo word/media/ (PNG, JPEG, etc.), así que el daño en el XML del texto no las afecta, y una imagen cuya parte esté intacta simplemente se traslada al paquete reconstruido. Todo esto ocurre en la pestaña de tu navegador — sin instalar Word, sin complementos, sin ida y vuelta a un servidor.
Dónde se detiene de verdad el contenido
La reparación recupera lo que está presente; no puede reconstruir texto que nunca se escribió en el disco. Si document.xml quedó truncado — el guardado o la copia se detuvo a medias — todo lo que hay después del punto de ruptura ha desaparecido, y la herramienta solo puede devolver los párrafos hasta ese corte. Ese es el techo honesto de cualquier recuperación de este archivo, la nuestra o la del propio Word.
Algunas construcciones más ricas son también más frágiles que los párrafos simples. Los campos complejos (referencias cruzadas que se actualizan solas, algunos campos de formulario) y el control de cambios llevan marcado adicional que, si cae en el lado dañado, puede perderse o quedar aplanado aunque el texto que lo rodea sobreviva. Cuando eso ocurre, por lo general conservas el texto legible y pierdes el mecanismo, no todo el documento. Para cualquier cosa confidencial — contratos, notas médicas, trabajo sin publicar — que la reparación se quede en el dispositivo es lo importante: puedes confirmar en la pestaña Red que nunca se envía ni un byte del .docx.
Qué puede y qué no puede reparar
Puede reparar
- Un .docx cuyo contenedor ZIP/OPC quedó dañado en una copia o sincronización defectuosa
- El texto del cuerpo y la estructura de párrafos cuando document.xml se puede reparar
- Estilos, títulos, tablas y listas que se escribieron por completo antes del daño
- Imágenes incrustadas, que viven como partes independientes bajo word/media/ y suelen sobrevivir
- Archivos que Word solo abre a través de su propio aviso de 'recuperar contenido'
No puede reparar
- El texto posterior a la ruptura cuando word/document.xml quedó truncado — esos bytes nunca se guardaron
- El control de cambios y los campos complejos/automáticos cuyo marcado cayó en el lado dañado (el texto puede sobrevivir, el mecanismo puede que no)
- Archivos .docx cifrados con contraseña sin la contraseña
- Un archivo que tiene 0 bytes o no contiene partes OOXML reconocibles
Si una reparación falla, te decimos por qué (datos que faltan frente a estructura dañada), y nunca se te cobra por una reparación fallida.