Extraer de DOCX
Usa este extractor para archivos .docx. Puede extraer imágenes, páginas renderizadas, texto, Markdown, audio, video y archivos incrustados en un resultado ZIP.
Probar Extraer de DOCX en el navegador ->
Extract.FAST usa esta misma API: lo que ves en el navegador es lo que obtienes en el código.
Referencia rápida
| Campo | Valor |
|---|---|
| Tipo de archivo origen | .docx |
| Grupo origen | documentos |
| Endpoint de envío | POST https://api.tools.fast/extract |
| Endpoint de estimación | POST https://api.tools.fast/extract/estimate/docx |
| Resultado | Descarga ZIP |
| Capacidades predeterminadas | word.images, word.pages, word.text, word.markdown, word.audio, word.video, word.embeddedFiles |
| Tamaño máximo de archivo | free: 50 MB; pro: 2048 MB |
| Límites de documento | free: 2000 unidades de documento; pro: 2000 unidades de documento |
| Límites de duración | No aplica |
Capacidades
| Capacidad | Predeterminada | Opciones | Precio | Descripción |
|---|---|---|---|---|
word.images | Sí | Ninguna | Incluido | Imágenes originales guardadas como archivos separados. |
word.pages | Sí | Ninguna | Incluido | Páginas listas para revisar sin abrir el documento. |
word.text | Sí | Ninguna | Incluido | Texto legible para revisión, migración o búsqueda. |
word.markdown | Sí | Ninguna | Incluido | Markdown que conserva texto, encabezados, enlaces y tablas del documento. |
word.audio | Sí | audioFormat | Incluido | Archivos de audio extraídos cuando estén presentes. |
word.video | Sí | Ninguna | Incluido | Archivos de video extraídos cuando estén presentes. |
word.embeddedFiles | Sí | Ninguna | Incluido | Archivos incrustados recuperados como archivos separados. |
Opciones de capacidades
Audio
| Opción | Tipo | Predeterminada | Valores permitidos | Límites |
|---|---|---|---|---|
audioFormat | enum | mp3 | mp3, wav, m4a, original, best | Ninguna |
JSON de opciones con todas las capacidades
Usa esta estructura cuando quieras configurar explícitamente todas las salidas compatibles con este tipo de archivo.
{
"extraction": {
"selectedCapabilities": [
"word.images",
"word.pages",
"word.text",
"word.markdown",
"word.audio",
"word.video",
"word.embeddedFiles"
],
"includeManifest": true,
"capabilityOptions": {
"word.audio": {
"audioFormat": "mp3"
}
}
}
}Ejemplo de estimate
curl -sS -X POST "https://api.tools.fast/extract/estimate/docx" \
-H "X-Fast-Api-Key: $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"fileSizeMb": 10,
"pageCount": 12,
"options": {
"extraction": {
"selectedCapabilities": [
"word.images",
"word.pages",
"word.text",
"word.markdown",
"word.audio",
"word.video",
"word.embeddedFiles"
],
"includeManifest": true,
"capabilityOptions": {
"word.audio": {
"audioFormat": "mp3"
}
}
}
}
}'Ejemplo de extract con todas las opciones configuradas
curl -sS -X POST "https://api.tools.fast/extract" \
-H "X-Fast-Api-Key: $API_KEY" \
-F "[email protected]" \
-F 'options={
"extraction": {
"selectedCapabilities": [
"word.images",
"word.pages",
"word.text",
"word.markdown",
"word.audio",
"word.video",
"word.embeddedFiles"
],
"includeManifest": true,
"capabilityOptions": {
"word.audio": {
"audioFormat": "mp3"
}
}
}
}'Descubrimiento legible por máquina
GET /options/docx
GET /extractors/docx