Saltar al contenido principal
Explorar documentación
En esta página
Ver Markdown~904 tokensDescargar Markdown~904 tokens

Extraer de DOCX

Usa este extractor para archivos .docx. Puede extraer imágenes, páginas renderizadas, texto, Markdown, audio, video y archivos incrustados en un resultado ZIP.

Probar Extraer de DOCX en el navegador ->

Extract.FAST usa esta misma API: lo que ves en el navegador es lo que obtienes en el código.

Referencia rápida

CampoValor
Tipo de archivo origen.docx
Grupo origendocumentos
Endpoint de envíoPOST https://api.tools.fast/extract
Endpoint de estimaciónPOST https://api.tools.fast/extract/estimate/docx
ResultadoDescarga ZIP
Capacidades predeterminadasword.images, word.pages, word.text, word.markdown, word.audio, word.video, word.embeddedFiles
Tamaño máximo de archivofree: 50 MB; pro: 2048 MB
Límites de documentofree: 2000 unidades de documento; pro: 2000 unidades de documento
Límites de duraciónNo aplica

Capacidades

CapacidadPredeterminadaOpcionesPrecioDescripción
word.imagesNingunaIncluidoImágenes originales guardadas como archivos separados.
word.pagesNingunaIncluidoPáginas listas para revisar sin abrir el documento.
word.textNingunaIncluidoTexto legible para revisión, migración o búsqueda.
word.markdownNingunaIncluidoMarkdown que conserva texto, encabezados, enlaces y tablas del documento.
word.audioaudioFormatIncluidoArchivos de audio extraídos cuando estén presentes.
word.videoNingunaIncluidoArchivos de video extraídos cuando estén presentes.
word.embeddedFilesNingunaIncluidoArchivos incrustados recuperados como archivos separados.

Opciones de capacidades

Audio

OpciónTipoPredeterminadaValores permitidosLímites
audioFormatenummp3mp3, wav, m4a, original, bestNinguna

JSON de opciones con todas las capacidades

Usa esta estructura cuando quieras configurar explícitamente todas las salidas compatibles con este tipo de archivo.

{
  "extraction": {
    "selectedCapabilities": [
      "word.images",
      "word.pages",
      "word.text",
      "word.markdown",
      "word.audio",
      "word.video",
      "word.embeddedFiles"
    ],
    "includeManifest": true,
    "capabilityOptions": {
      "word.audio": {
        "audioFormat": "mp3"
      }
    }
  }
}

Ejemplo de estimate

curl -sS -X POST "https://api.tools.fast/extract/estimate/docx" \
  -H "X-Fast-Api-Key: $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "fileSizeMb": 10,
  "pageCount": 12,
  "options": {
    "extraction": {
      "selectedCapabilities": [
        "word.images",
        "word.pages",
        "word.text",
        "word.markdown",
        "word.audio",
        "word.video",
        "word.embeddedFiles"
      ],
      "includeManifest": true,
      "capabilityOptions": {
        "word.audio": {
          "audioFormat": "mp3"
        }
      }
    }
  }
}'

Ejemplo de extract con todas las opciones configuradas

curl -sS -X POST "https://api.tools.fast/extract" \
  -H "X-Fast-Api-Key: $API_KEY" \
  -F "[email protected]" \
  -F 'options={
  "extraction": {
    "selectedCapabilities": [
      "word.images",
      "word.pages",
      "word.text",
      "word.markdown",
      "word.audio",
      "word.video",
      "word.embeddedFiles"
    ],
    "includeManifest": true,
    "capabilityOptions": {
      "word.audio": {
        "audioFormat": "mp3"
      }
    }
  }
}'

Descubrimiento legible por máquina

GET /options/docx
GET /extractors/docx
Copiado