DOC vs DOCX: ¿cuál es la diferencia?
.DOC es el formato binario propietario de Microsoft Word, usado desde Word 97 hasta Word 2003. Es un formato opaco — su estructura interna es compleja y cerrada.
.DOCX es el formato XML abierto (OOXML) introducido con Word 2007. Está basado en un archivo ZIP con archivos XML en su interior. Es el estándar actual.
| Característica | DOC | DOCX |
|---|---|---|
| Introducido | Word 97 (1997) | Word 2007 (2006) |
| Estructura | Binaria, propietaria | ZIP + XML, abierta |
| Compatibilidad moderna | Buena | Excelente |
| Tamaño de archivo | Mayor | Menor (~30%) |
| Estándar ISO | No | Sí (ISO 29500) |
| Soporte de características nuevas | Limitado | Completo |
Por qué actualizar de DOC a DOCX
- Tamaño menor: DOCX suele ser un 30% más pequeño que el DOC equivalente.
- Mejor compatibilidad: herramientas modernas (Google Docs, LibreOffice) abren DOCX mejor que DOC.
- Más características: las funciones de Word 2010+ solo están disponibles en DOCX.
- Corrupción menos frecuente: el formato XML es más robusto que el binario DOC.
- Interoperabilidad: DOCX es un estándar ISO abierto, DOC no.
Método 1: KaijuConverter (online, gratis)
- Ve a Convertir DOC a DOCX.
- Sube el archivo .doc.
- Descarga el .docx.
Método 2: Microsoft Word
- Abre el archivo .doc en Word.
- Word puede mostrar un banner "[Modo de compatibilidad]" en la barra de título.
- Archivo → Información → Convertir (solo aparece si el documento está en modo de compatibilidad).
- O bien: Archivo → Guardar como → elige Documento de Word (*.docx).
Método 3: LibreOffice Writer
- Abre el DOC en LibreOffice Writer.
- Archivo → Guardar como → cambia el tipo de archivo a Microsoft Word 2007-365 (.docx).
- Guarda.
Para conversión masiva por línea de comandos:
soffice --headless --convert-to docx *.doc
¿Se pierde algo al convertir DOC a DOCX?
Para documentos normales (texto, tablas, imágenes): prácticamente nada. Las posibles diferencias:
- Macros VBA: generalmente se conservan, pero pueden requerir ajuste.
- Objetos OLE incrustados: pueden cambiar ligeramente.
- Fuentes antiguas sin equivalente moderno: pueden sustituirse.
Recomendación: abre y revisa el DOCX tras la conversión, especialmente si el DOC tiene tablas complejas o macros.
Convertir documentos Word muy antiguos (Word 95, Word 6)
Los DOC de Word 95 o Word 6 (extensión .doc también) pueden tener problemas de compatibilidad con versiones modernas. LibreOffice suele abrirlos mejor que Word moderno para estos casos.
# LibreOffice puede manejar formatos muy antiguos
soffice --headless --convert-to docx documento_word95.doc
Conversiones relacionadas
Casos de uso avanzados
Workflow legal y empresarial: contratos firmados se distribuyen en PDF/A (PDF Archival) que garantiza que el documento se renderice idénticamente en 50 años — todas las fonts embedded, no JavaScript, no contenido dinámico. La firma electrónica (PAdES, advanced eSignatures) está integrada en el PDF y se valida criptográficamente. Publicación académica: tesis y papers usan LaTeX → PDF para fórmulas matemáticas precisas; los journals requieren formato específico (Word con styles, LaTeX con clase del journal, o ambos). Convertir entre LaTeX, DOCX y PDF preservando estructura semántica (citations, references, equations) requiere herramientas especializadas como Pandoc. E-books: Amazon KDP requiere formato MOBI (legacy) o KFX (moderno) generado desde EPUB; Apple Books acepta EPUB nativamente; Kobo, PocketBook y Nook prefieren EPUB; Google Play Books acepta PDF y EPUB. Convertir manuscrito DOCX a EPUB requiere atención al markup semántico (headings jerárquicos, listas, blockquotes) para que el reflowable layout funcione bien. Translation workflows: traductores profesionales prefieren XLIFF como intermediate format — mantiene segmentación, translation memory matches, y context info que se pierde en plain text export.
Mejores prácticas y consejos profesionales
Style preservation: al convertir entre formatos editables (DOCX↔ODT↔RTF), usa siempre styles definidos en lugar de formatting directo — Heading 1/2/3 vs "16pt Bold". Esto garantiza que el outline se preserve y la conversión mantenga estructura jerárquica. Font embedding: para distribución cross-platform (PDF), embebe todas las fonts no-estándar — sin embedding, los lectores sustituyen automáticamente con fonts disponibles que pueden romper el layout. PDF/A para archivado: para documentos legales, regulatorios o de archivo permanente, exporta como PDF/A-1b (basic) o PDF/A-2u (Unicode + JPEG2000) — no permite contenido dinámico, garantiza self-contained rendering. Revision history: PDF, DOCX y ODT soportan tracked changes y comments — al convertir, decide si quieres preservarlos (DOCX→DOCX o DOCX→ODT) o aplanarlos (DOCX→PDF típicamente acepta solo el final state). Accesibilidad: documentos PDF para distribución pública deben cumplir PDF/UA — heading structure, alt text en imágenes, reading order definido para screen readers.
Compatibilidad y consideraciones técnicas
KaijuConverter usa LibreOffice 7.6 headless como engine principal con Pandoc 3.x como fallback para markup conversions complejas. Soportamos más de 60 formatos de documento (PDF, DOCX, DOC, ODT, RTF, TXT, HTML, MD, EPUB, MOBI, AZW3, FB2, LaTeX, RST y más). Fidelity de formato: preservamos fonts (con substitution fallback si la fuente original no está en el sistema), tamaños, colores, párrafos completos con indentación y line spacing, listas anidadas, tablas con cell merging y borders complejos, imágenes embedded con anchor positioning, headers/footers con campos dinámicos (page number, date, document title), footnotes y endnotes. Conversión a PDF: garantizamos PDF/A-conforme cuando se requiere, con font embedding correcto y ICC profile embedding para color fidelity absoluta. Limitaciones: documentos con macros (DOCX con VBA) no ejecutan los macros durante conversión — solo se preserva el contenido estático. PDFs escaneados (imagen sin OCR) no son editables — necesitan OCR previo (Tesseract, ABBYY) para extraer texto. Privacidad: TLS 1.3, contenedores Docker aislados, eliminación tras 2 horas. Performance: documento típico de 20 páginas tarda 3-8 segundos; documentos grandes con muchas imágenes pueden requerir 15-30 segundos.