# Options reference

Extraction options use one JSON envelope. Use this page for humans and `GET /options/{sourceFileType}` for machine-readable values.

```json
{
  "extraction": {
    "selectedCapabilities": [
      "video.audio",
      "video.metadata",
      "media.transcript"
    ],
    "includeManifest": true,
    "capabilityOptions": {
      "video.audio": {
        "audioFormat": "mp3"
      },
      "media.transcript": {
        "transcription.mode": "quality"
      }
    }
  }
}
```

## Envelope fields

| Field | Type | Default | Notes |
| --- | --- | --- | --- |
| `extraction.selectedCapabilities` | array of strings | Source-specific defaults | Capability IDs to include in the ZIP output. |
| `extraction.includeManifest` | boolean | `true` | Includes a manifest file that lists the produced ZIP entries. |
| `extraction.capabilityOptions` | object | `{}` | Map of capability ID to option fields for that capability. |

## Capability reference

| Capability | Description | Used by | Options |
| --- | --- | --- | --- |
| `archive.images` | Image files found inside the archive. | [ZIP](/api/docs/extractors/archives/zip) | None |
| `archive.metadata` | Archive structure and file metadata. | [ZIP](/api/docs/extractors/archives/zip) | None |
| `audio.artwork` | Cover art and attached pictures. | [AAC](/api/docs/extractors/audio/aac), [AIF](/api/docs/extractors/audio/aif), [AIFF](/api/docs/extractors/audio/aiff), [FLAC](/api/docs/extractors/audio/flac), [M4A](/api/docs/extractors/audio/m4a), [M4B](/api/docs/extractors/audio/m4b), [MKA](/api/docs/extractors/audio/mka), [MP3](/api/docs/extractors/audio/mp3), [OGG](/api/docs/extractors/audio/ogg), [OPUS](/api/docs/extractors/audio/opus), [WAV](/api/docs/extractors/audio/wav), [WMA](/api/docs/extractors/audio/wma) | None |
| `audio.chapterAudio` | Chapter audio files split from markers. | [AAC](/api/docs/extractors/audio/aac), [AIF](/api/docs/extractors/audio/aif), [AIFF](/api/docs/extractors/audio/aiff), [FLAC](/api/docs/extractors/audio/flac), [M4A](/api/docs/extractors/audio/m4a), [M4B](/api/docs/extractors/audio/m4b), [MKA](/api/docs/extractors/audio/mka), [MP3](/api/docs/extractors/audio/mp3), [OGG](/api/docs/extractors/audio/ogg), [OPUS](/api/docs/extractors/audio/opus), [WAV](/api/docs/extractors/audio/wav), [WMA](/api/docs/extractors/audio/wma) | `audioFormat` |
| `audio.chapters` | Chapter markers exported for review. | [AAC](/api/docs/extractors/audio/aac), [AIF](/api/docs/extractors/audio/aif), [AIFF](/api/docs/extractors/audio/aiff), [FLAC](/api/docs/extractors/audio/flac), [M4A](/api/docs/extractors/audio/m4a), [M4B](/api/docs/extractors/audio/m4b), [MKA](/api/docs/extractors/audio/mka), [MP3](/api/docs/extractors/audio/mp3), [OGG](/api/docs/extractors/audio/ogg), [OPUS](/api/docs/extractors/audio/opus), [WAV](/api/docs/extractors/audio/wav), [WMA](/api/docs/extractors/audio/wma) | None |
| `audio.metadata` | File information, duration, dates, and embedded tags. | [AAC](/api/docs/extractors/audio/aac), [AIF](/api/docs/extractors/audio/aif), [AIFF](/api/docs/extractors/audio/aiff), [FLAC](/api/docs/extractors/audio/flac), [M4A](/api/docs/extractors/audio/m4a), [M4B](/api/docs/extractors/audio/m4b), [MKA](/api/docs/extractors/audio/mka), [MP3](/api/docs/extractors/audio/mp3), [OGG](/api/docs/extractors/audio/ogg), [OPUS](/api/docs/extractors/audio/opus), [WAV](/api/docs/extractors/audio/wav), [WMA](/api/docs/extractors/audio/wma) | None |
| `email.embeddedFiles` | Email attachments saved as separate files. | [EML](/api/docs/extractors/email/eml) | None |
| `email.images` | Inline email images saved separately. | [EML](/api/docs/extractors/email/eml) | None |
| `email.metadata` | Message headers and email metadata. | [EML](/api/docs/extractors/email/eml) | None |
| `excel.audio` | Extracted audio files when present. | [XLSM](/api/docs/extractors/documents/xlsm), [XLSX](/api/docs/extractors/documents/xlsx), [XLTM](/api/docs/extractors/documents/xltm), [XLTX](/api/docs/extractors/documents/xltx) | `audioFormat` |
| `excel.embeddedFiles` | Embedded files recovered as separate files. | [XLSM](/api/docs/extractors/documents/xlsm), [XLSX](/api/docs/extractors/documents/xlsx), [XLTM](/api/docs/extractors/documents/xltm), [XLTX](/api/docs/extractors/documents/xltx) | None |
| `excel.images` | Original image assets saved as separate files. | [XLSM](/api/docs/extractors/documents/xlsm), [XLSX](/api/docs/extractors/documents/xlsx), [XLTM](/api/docs/extractors/documents/xltm), [XLTX](/api/docs/extractors/documents/xltx) | None |
| `excel.video` | Extracted video files when present. | [XLSM](/api/docs/extractors/documents/xlsm), [XLSX](/api/docs/extractors/documents/xlsx), [XLTM](/api/docs/extractors/documents/xltm), [XLTX](/api/docs/extractors/documents/xltx) | None |
| `excel.worksheets` | Worksheet CSV files for analysis or migration. | [XLSM](/api/docs/extractors/documents/xlsm), [XLSX](/api/docs/extractors/documents/xlsx), [XLTM](/api/docs/extractors/documents/xltm), [XLTX](/api/docs/extractors/documents/xltx) | None |
| `executable.icons` | Embedded Windows icon resources saved as ICO and PNG files. | [EXE](/api/docs/extractors/executables/exe) | None |
| `image.codes` | QR codes and barcodes found in the file. | [AVIF](/api/docs/extractors/images/avif), [AVIFS](/api/docs/extractors/images/avifs), [BMP](/api/docs/extractors/images/bmp), [GIF](/api/docs/extractors/images/gif), [HEIC](/api/docs/extractors/images/heic), [HEIF](/api/docs/extractors/images/heif), [HIF](/api/docs/extractors/images/hif), [ICO](/api/docs/extractors/images/ico), [JPEG](/api/docs/extractors/images/jpeg), [JPG](/api/docs/extractors/images/jpg), [PNG](/api/docs/extractors/images/png), [TIF](/api/docs/extractors/images/tif), [TIFF](/api/docs/extractors/images/tiff), [WEBP](/api/docs/extractors/images/webp) | None |
| `image.colors` | Dominant colors and palette information. | [AVIF](/api/docs/extractors/images/avif), [AVIFS](/api/docs/extractors/images/avifs), [BMP](/api/docs/extractors/images/bmp), [GIF](/api/docs/extractors/images/gif), [HEIC](/api/docs/extractors/images/heic), [HEIF](/api/docs/extractors/images/heif), [HIF](/api/docs/extractors/images/hif), [ICO](/api/docs/extractors/images/ico), [JPEG](/api/docs/extractors/images/jpeg), [JPG](/api/docs/extractors/images/jpg), [PNG](/api/docs/extractors/images/png), [TIF](/api/docs/extractors/images/tif), [TIFF](/api/docs/extractors/images/tiff), [WEBP](/api/docs/extractors/images/webp) | None |
| `image.exif` | EXIF-style metadata exported as JSON and CSV. | [AVIF](/api/docs/extractors/images/avif), [AVIFS](/api/docs/extractors/images/avifs), [BMP](/api/docs/extractors/images/bmp), [GIF](/api/docs/extractors/images/gif), [HEIC](/api/docs/extractors/images/heic), [HEIF](/api/docs/extractors/images/heif), [HIF](/api/docs/extractors/images/hif), [ICO](/api/docs/extractors/images/ico), [JPEG](/api/docs/extractors/images/jpeg), [JPG](/api/docs/extractors/images/jpg), [PNG](/api/docs/extractors/images/png), [TIF](/api/docs/extractors/images/tif), [TIFF](/api/docs/extractors/images/tiff), [WEBP](/api/docs/extractors/images/webp) | None |
| `image.frames` | Extract frames and timing data when present. | [AVIF](/api/docs/extractors/images/avif), [AVIFS](/api/docs/extractors/images/avifs), [GIF](/api/docs/extractors/images/gif), [WEBP](/api/docs/extractors/images/webp) | `frameIntervalSeconds`, `frameMode`, `maxExtractedFrames` |
| `image.gps` | GPS coordinates plus a downloadable map when stored in the source file. | [AVIF](/api/docs/extractors/images/avif), [AVIFS](/api/docs/extractors/images/avifs), [BMP](/api/docs/extractors/images/bmp), [GIF](/api/docs/extractors/images/gif), [HEIC](/api/docs/extractors/images/heic), [HEIF](/api/docs/extractors/images/heif), [HIF](/api/docs/extractors/images/hif), [ICO](/api/docs/extractors/images/ico), [JPEG](/api/docs/extractors/images/jpeg), [JPG](/api/docs/extractors/images/jpg), [PNG](/api/docs/extractors/images/png), [TIF](/api/docs/extractors/images/tif), [TIFF](/api/docs/extractors/images/tiff), [WEBP](/api/docs/extractors/images/webp) | None |
| `image.icons` | Icon sizes and embedded icon images. | [ICO](/api/docs/extractors/images/ico) | None |
| `image.profiles` | ICC profiles and color management data. | [AVIF](/api/docs/extractors/images/avif), [AVIFS](/api/docs/extractors/images/avifs), [BMP](/api/docs/extractors/images/bmp), [GIF](/api/docs/extractors/images/gif), [HEIC](/api/docs/extractors/images/heic), [HEIF](/api/docs/extractors/images/heif), [HIF](/api/docs/extractors/images/hif), [ICO](/api/docs/extractors/images/ico), [JPEG](/api/docs/extractors/images/jpeg), [JPG](/api/docs/extractors/images/jpg), [PNG](/api/docs/extractors/images/png), [TIF](/api/docs/extractors/images/tif), [TIFF](/api/docs/extractors/images/tiff), [WEBP](/api/docs/extractors/images/webp) | None |
| `image.text` | Text recognized from screenshots, photos, and scanned images with Fast AI OCR. | [AVIF](/api/docs/extractors/images/avif), [AVIFS](/api/docs/extractors/images/avifs), [BMP](/api/docs/extractors/images/bmp), [GIF](/api/docs/extractors/images/gif), [HEIC](/api/docs/extractors/images/heic), [HEIF](/api/docs/extractors/images/heif), [HIF](/api/docs/extractors/images/hif), [ICO](/api/docs/extractors/images/ico), [JPEG](/api/docs/extractors/images/jpeg), [JPG](/api/docs/extractors/images/jpg), [PNG](/api/docs/extractors/images/png), [TIF](/api/docs/extractors/images/tif), [TIFF](/api/docs/extractors/images/tiff), [WEBP](/api/docs/extractors/images/webp) | None |
| `media.transcript` | Create transcripts from speech. | [AVI](/api/docs/extractors/video/avi), [M4V](/api/docs/extractors/video/m4v), [MKV](/api/docs/extractors/video/mkv), [MOV](/api/docs/extractors/video/mov), [MP4](/api/docs/extractors/video/mp4), [WEBM](/api/docs/extractors/video/webm), [AAC](/api/docs/extractors/audio/aac), [AIF](/api/docs/extractors/audio/aif), [AIFF](/api/docs/extractors/audio/aiff), [FLAC](/api/docs/extractors/audio/flac), [M4A](/api/docs/extractors/audio/m4a), [M4B](/api/docs/extractors/audio/m4b), [MKA](/api/docs/extractors/audio/mka), [MP3](/api/docs/extractors/audio/mp3), [OGG](/api/docs/extractors/audio/ogg), [OPUS](/api/docs/extractors/audio/opus), [WAV](/api/docs/extractors/audio/wav), [WMA](/api/docs/extractors/audio/wma) | `transcription.mode` |
| `pdf.annotations` | PDF comments and markup records when present. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.embeddedFiles` | Embedded PDF files saved separately. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.fonts` | Embedded PDF font files when present. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.forms` | PDF form field data when available. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.images` | Images embedded in the PDF saved separately. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.links` | PDF link annotations for review. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.markdown` | Markdown generated from PDF text. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.metadata` | PDF document metadata for audit workflows. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.pages` | Whole PDF pages rendered as image files. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `pdf.text` | Selectable PDF text saved by page. | [PDF](/api/docs/extractors/documents/pdf) | None |
| `powerpoint.audio` | Extracted audio files when present. | [POTM](/api/docs/extractors/documents/potm), [POTX](/api/docs/extractors/documents/potx), [PPSM](/api/docs/extractors/documents/ppsm), [PPSX](/api/docs/extractors/documents/ppsx), [PPTM](/api/docs/extractors/documents/pptm), [PPTX](/api/docs/extractors/documents/pptx) | `audioFormat` |
| `powerpoint.embeddedFiles` | Embedded files recovered as separate files. | [POTM](/api/docs/extractors/documents/potm), [POTX](/api/docs/extractors/documents/potx), [PPSM](/api/docs/extractors/documents/ppsm), [PPSX](/api/docs/extractors/documents/ppsx), [PPTM](/api/docs/extractors/documents/pptm), [PPTX](/api/docs/extractors/documents/pptx) | None |
| `powerpoint.images` | Original image assets saved as separate files. | [POTM](/api/docs/extractors/documents/potm), [POTX](/api/docs/extractors/documents/potx), [PPSM](/api/docs/extractors/documents/ppsm), [PPSX](/api/docs/extractors/documents/ppsx), [PPTM](/api/docs/extractors/documents/pptm), [PPTX](/api/docs/extractors/documents/pptx) | None |
| `powerpoint.markdown` | Markdown generated from slide text and speaker notes. | [POTM](/api/docs/extractors/documents/potm), [POTX](/api/docs/extractors/documents/potx), [PPSM](/api/docs/extractors/documents/ppsm), [PPSX](/api/docs/extractors/documents/ppsx), [PPTM](/api/docs/extractors/documents/pptm), [PPTX](/api/docs/extractors/documents/pptx) | None |
| `powerpoint.notes` | Speaker notes split into readable files. | [POTM](/api/docs/extractors/documents/potm), [POTX](/api/docs/extractors/documents/potx), [PPSM](/api/docs/extractors/documents/ppsm), [PPSX](/api/docs/extractors/documents/ppsx), [PPTM](/api/docs/extractors/documents/pptm), [PPTX](/api/docs/extractors/documents/pptx) | None |
| `powerpoint.slides` | Rendered slide images for preview and review. | [POTM](/api/docs/extractors/documents/potm), [POTX](/api/docs/extractors/documents/potx), [PPSM](/api/docs/extractors/documents/ppsm), [PPSX](/api/docs/extractors/documents/ppsx), [PPTM](/api/docs/extractors/documents/pptm), [PPTX](/api/docs/extractors/documents/pptx) | None |
| `powerpoint.text` | Readable text files for review, migration, or search. | [POTM](/api/docs/extractors/documents/potm), [POTX](/api/docs/extractors/documents/potx), [PPSM](/api/docs/extractors/documents/ppsm), [PPSX](/api/docs/extractors/documents/ppsx), [PPTM](/api/docs/extractors/documents/pptm), [PPTX](/api/docs/extractors/documents/pptx) | None |
| `powerpoint.video` | Extracted video files when present. | [POTM](/api/docs/extractors/documents/potm), [POTX](/api/docs/extractors/documents/potx), [PPSM](/api/docs/extractors/documents/ppsm), [PPSX](/api/docs/extractors/documents/ppsx), [PPTM](/api/docs/extractors/documents/pptm), [PPTX](/api/docs/extractors/documents/pptx) | None |
| `video.artwork` | Cover art and attached pictures when present. | [AVI](/api/docs/extractors/video/avi), [M4V](/api/docs/extractors/video/m4v), [MKV](/api/docs/extractors/video/mkv), [MOV](/api/docs/extractors/video/mov), [MP4](/api/docs/extractors/video/mp4), [WEBM](/api/docs/extractors/video/webm) | None |
| `video.audio` | Extracted audio files when present. | [AVI](/api/docs/extractors/video/avi), [M4V](/api/docs/extractors/video/m4v), [MKV](/api/docs/extractors/video/mkv), [MOV](/api/docs/extractors/video/mov), [MP4](/api/docs/extractors/video/mp4), [WEBM](/api/docs/extractors/video/webm) | `audioFormat` |
| `video.frames` | Extract frames and timing data when present. | [AVI](/api/docs/extractors/video/avi), [M4V](/api/docs/extractors/video/m4v), [MKV](/api/docs/extractors/video/mkv), [MOV](/api/docs/extractors/video/mov), [MP4](/api/docs/extractors/video/mp4), [WEBM](/api/docs/extractors/video/webm) | `frameIntervalSeconds`, `frameMode`, `maxExtractedFrames` |
| `video.metadata` | File information, dimensions, dates, and embedded tags. | [AVI](/api/docs/extractors/video/avi), [M4V](/api/docs/extractors/video/m4v), [MKV](/api/docs/extractors/video/mkv), [MOV](/api/docs/extractors/video/mov), [MP4](/api/docs/extractors/video/mp4), [WEBM](/api/docs/extractors/video/webm) | None |
| `video.subtitles` | Subtitle files extracted from embedded tracks. | [AVI](/api/docs/extractors/video/avi), [M4V](/api/docs/extractors/video/m4v), [MKV](/api/docs/extractors/video/mkv), [MOV](/api/docs/extractors/video/mov), [MP4](/api/docs/extractors/video/mp4), [WEBM](/api/docs/extractors/video/webm) | None |
| `word.audio` | Extracted audio files when present. | [DOCM](/api/docs/extractors/documents/docm), [DOCX](/api/docs/extractors/documents/docx), [DOTM](/api/docs/extractors/documents/dotm), [DOTX](/api/docs/extractors/documents/dotx) | `audioFormat` |
| `word.embeddedFiles` | Embedded files recovered as separate files. | [DOCM](/api/docs/extractors/documents/docm), [DOCX](/api/docs/extractors/documents/docx), [DOTM](/api/docs/extractors/documents/dotm), [DOTX](/api/docs/extractors/documents/dotx) | None |
| `word.images` | Original image assets saved as separate files. | [DOCM](/api/docs/extractors/documents/docm), [DOCX](/api/docs/extractors/documents/docx), [DOTM](/api/docs/extractors/documents/dotm), [DOTX](/api/docs/extractors/documents/dotx) | None |
| `word.markdown` | Markdown preserving document text, headings, links, and tables. | [DOCM](/api/docs/extractors/documents/docm), [DOCX](/api/docs/extractors/documents/docx), [DOTM](/api/docs/extractors/documents/dotm), [DOTX](/api/docs/extractors/documents/dotx) | None |
| `word.pages` | Page snapshots ready to skim without opening the document. | [DOC](/api/docs/extractors/documents/doc), [DOCM](/api/docs/extractors/documents/docm), [DOCX](/api/docs/extractors/documents/docx), [DOT](/api/docs/extractors/documents/dot), [DOTM](/api/docs/extractors/documents/dotm), [DOTX](/api/docs/extractors/documents/dotx) | None |
| `word.text` | Readable text files for review, migration, or search. | [DOCM](/api/docs/extractors/documents/docm), [DOCX](/api/docs/extractors/documents/docx), [DOTM](/api/docs/extractors/documents/dotm), [DOTX](/api/docs/extractors/documents/dotx) | None |
| `word.video` | Extracted video files when present. | [DOCM](/api/docs/extractors/documents/docm), [DOCX](/api/docs/extractors/documents/docx), [DOTM](/api/docs/extractors/documents/dotm), [DOTX](/api/docs/extractors/documents/dotx) | None |

## audioFormat

Chooses the audio file format when extracting an audio track from video or splitting audio from embedded media.

| Property | Value |
| --- | --- |
| Type | `enum` |
| Default | `mp3` |
| Allowed values | `mp3`, `wav`, `m4a`, `original`, `best` |
| Limits | None |
| Used by | `audio.chapterAudio`, `excel.audio`, `powerpoint.audio`, `video.audio`, `word.audio` |

Example:

```json
{
  "extraction": {
    "capabilityOptions": {
      "video.audio": {
        "audioFormat": "mp3"
      }
    }
  }
}
```

## frameIntervalSeconds

Sets the interval when `frameMode` is `every-n-seconds`.

| Property | Value |
| --- | --- |
| Type | `number` |
| Default | `1` |
| Allowed values | Any value within limits |
| Limits | 0.1 to 300 |
| Used by | `image.frames`, `video.frames` |

Example:

```json
{
  "extraction": {
    "selectedCapabilities": [
      "video.frames"
    ],
    "capabilityOptions": {
      "video.frames": {
        "frameMode": "every-n-seconds",
        "frameIntervalSeconds": 5,
        "maxExtractedFrames": 100
      }
    }
  }
}
```

## frameMode

Chooses how frames are selected from video and animated image sources.

| Property | Value |
| --- | --- |
| Type | `enum` |
| Default | `evenly-spaced` |
| Allowed values | `evenly-spaced`, `first`, `every-n-seconds` |
| Limits | None |
| Used by | `image.frames`, `video.frames` |

Example:

```json
{
  "extraction": {
    "selectedCapabilities": [
      "video.frames"
    ],
    "capabilityOptions": {
      "video.frames": {
        "frameMode": "every-n-seconds",
        "frameIntervalSeconds": 5,
        "maxExtractedFrames": 100
      }
    }
  }
}
```

## maxExtractedFrames

Caps the number of frame image files written into the ZIP.

| Property | Value |
| --- | --- |
| Type | `integer` |
| Default | `500` |
| Allowed values | Any value within limits |
| Limits | 1 to 2000 |
| Used by | `image.frames`, `video.frames` |

Example:

```json
{
  "extraction": {
    "selectedCapabilities": [
      "video.frames"
    ],
    "capabilityOptions": {
      "video.frames": {
        "frameMode": "every-n-seconds",
        "frameIntervalSeconds": 5,
        "maxExtractedFrames": 100
      }
    }
  }
}
```

## transcription.mode

Chooses the transcript add-on mode for audio and video speech-to-text output.

| Property | Value |
| --- | --- |
| Type | `enum` |
| Default | `fast` |
| Allowed values | `fast`, `quality`, `meeting-intelligence` |
| Limits | None |
| Used by | `media.transcript` |

Example:

```json
{
  "extraction": {
    "selectedCapabilities": [
      "media.transcript"
    ],
    "capabilityOptions": {
      "media.transcript": {
        "transcription.mode": "quality"
      }
    }
  }
}
```

## Source type matrix

| Source | Format | Capabilities | Capability options |
| --- | --- | --- | --- |
| [DOC](/api/docs/extractors/documents/doc) | `doc` | `word.pages` | None |
| [DOCM](/api/docs/extractors/documents/docm) | `docm` | `word.images`, `word.pages`, `word.text`, `word.markdown`, `word.audio`, `word.video`, `word.embeddedFiles` | `audioFormat` |
| [DOCX](/api/docs/extractors/documents/docx) | `docx` | `word.images`, `word.pages`, `word.text`, `word.markdown`, `word.audio`, `word.video`, `word.embeddedFiles` | `audioFormat` |
| [DOT](/api/docs/extractors/documents/dot) | `dot` | `word.pages` | None |
| [DOTM](/api/docs/extractors/documents/dotm) | `dotm` | `word.images`, `word.pages`, `word.text`, `word.markdown`, `word.audio`, `word.video`, `word.embeddedFiles` | `audioFormat` |
| [DOTX](/api/docs/extractors/documents/dotx) | `dotx` | `word.images`, `word.pages`, `word.text`, `word.markdown`, `word.audio`, `word.video`, `word.embeddedFiles` | `audioFormat` |
| [PDF](/api/docs/extractors/documents/pdf) | `pdf` | `pdf.images`, `pdf.pages`, `pdf.text`, `pdf.markdown`, `pdf.embeddedFiles`, `pdf.metadata`, `pdf.links`, `pdf.annotations`, `pdf.forms`, `pdf.fonts` | None |
| [POTM](/api/docs/extractors/documents/potm) | `potm` | `powerpoint.images`, `powerpoint.slides`, `powerpoint.text`, `powerpoint.markdown`, `powerpoint.notes`, `powerpoint.audio`, `powerpoint.video`, `powerpoint.embeddedFiles` | `audioFormat` |
| [POTX](/api/docs/extractors/documents/potx) | `potx` | `powerpoint.images`, `powerpoint.slides`, `powerpoint.text`, `powerpoint.markdown`, `powerpoint.notes`, `powerpoint.audio`, `powerpoint.video`, `powerpoint.embeddedFiles` | `audioFormat` |
| [PPSM](/api/docs/extractors/documents/ppsm) | `ppsm` | `powerpoint.images`, `powerpoint.slides`, `powerpoint.text`, `powerpoint.markdown`, `powerpoint.notes`, `powerpoint.audio`, `powerpoint.video`, `powerpoint.embeddedFiles` | `audioFormat` |
| [PPSX](/api/docs/extractors/documents/ppsx) | `ppsx` | `powerpoint.images`, `powerpoint.slides`, `powerpoint.text`, `powerpoint.markdown`, `powerpoint.notes`, `powerpoint.audio`, `powerpoint.video`, `powerpoint.embeddedFiles` | `audioFormat` |
| [PPTM](/api/docs/extractors/documents/pptm) | `pptm` | `powerpoint.images`, `powerpoint.slides`, `powerpoint.text`, `powerpoint.markdown`, `powerpoint.notes`, `powerpoint.audio`, `powerpoint.video`, `powerpoint.embeddedFiles` | `audioFormat` |
| [PPTX](/api/docs/extractors/documents/pptx) | `pptx` | `powerpoint.images`, `powerpoint.slides`, `powerpoint.text`, `powerpoint.markdown`, `powerpoint.notes`, `powerpoint.audio`, `powerpoint.video`, `powerpoint.embeddedFiles` | `audioFormat` |
| [XLSM](/api/docs/extractors/documents/xlsm) | `xlsm` | `excel.images`, `excel.worksheets`, `excel.audio`, `excel.video`, `excel.embeddedFiles` | `audioFormat` |
| [XLSX](/api/docs/extractors/documents/xlsx) | `xlsx` | `excel.images`, `excel.worksheets`, `excel.audio`, `excel.video`, `excel.embeddedFiles` | `audioFormat` |
| [XLTM](/api/docs/extractors/documents/xltm) | `xltm` | `excel.images`, `excel.worksheets`, `excel.audio`, `excel.video`, `excel.embeddedFiles` | `audioFormat` |
| [XLTX](/api/docs/extractors/documents/xltx) | `xltx` | `excel.images`, `excel.worksheets`, `excel.audio`, `excel.video`, `excel.embeddedFiles` | `audioFormat` |
| [AVIF](/api/docs/extractors/images/avif) | `avif` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text`, `image.frames` | `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames` |
| [AVIFS](/api/docs/extractors/images/avifs) | `avifs` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text`, `image.frames` | `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames` |
| [BMP](/api/docs/extractors/images/bmp) | `bmp` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [GIF](/api/docs/extractors/images/gif) | `gif` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text`, `image.frames` | `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames` |
| [HEIC](/api/docs/extractors/images/heic) | `heic` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [HEIF](/api/docs/extractors/images/heif) | `heif` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [HIF](/api/docs/extractors/images/hif) | `hif` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [ICO](/api/docs/extractors/images/ico) | `ico` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text`, `image.icons` | None |
| [JPEG](/api/docs/extractors/images/jpeg) | `jpeg` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [JPG](/api/docs/extractors/images/jpg) | `jpg` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [PNG](/api/docs/extractors/images/png) | `png` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [TIF](/api/docs/extractors/images/tif) | `tif` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [TIFF](/api/docs/extractors/images/tiff) | `tiff` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text` | None |
| [WEBP](/api/docs/extractors/images/webp) | `webp` | `image.exif`, `image.gps`, `image.codes`, `image.colors`, `image.profiles`, `image.text`, `image.frames` | `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames` |
| [AVI](/api/docs/extractors/video/avi) | `avi` | `video.audio`, `video.metadata`, `video.artwork`, `video.subtitles`, `video.frames`, `media.transcript` | `audioFormat`, `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames`, `transcription.mode` |
| [M4V](/api/docs/extractors/video/m4v) | `m4v` | `video.audio`, `video.metadata`, `video.artwork`, `video.subtitles`, `video.frames`, `media.transcript` | `audioFormat`, `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames`, `transcription.mode` |
| [MKV](/api/docs/extractors/video/mkv) | `mkv` | `video.audio`, `video.metadata`, `video.artwork`, `video.subtitles`, `video.frames`, `media.transcript` | `audioFormat`, `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames`, `transcription.mode` |
| [MOV](/api/docs/extractors/video/mov) | `mov` | `video.audio`, `video.metadata`, `video.artwork`, `video.subtitles`, `video.frames`, `media.transcript` | `audioFormat`, `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames`, `transcription.mode` |
| [MP4](/api/docs/extractors/video/mp4) | `mp4` | `video.audio`, `video.metadata`, `video.artwork`, `video.subtitles`, `video.frames`, `media.transcript` | `audioFormat`, `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames`, `transcription.mode` |
| [WEBM](/api/docs/extractors/video/webm) | `webm` | `video.audio`, `video.metadata`, `video.artwork`, `video.subtitles`, `video.frames`, `media.transcript` | `audioFormat`, `frameMode`, `frameIntervalSeconds`, `maxExtractedFrames`, `transcription.mode` |
| [AAC](/api/docs/extractors/audio/aac) | `aac` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [AIF](/api/docs/extractors/audio/aif) | `aif` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [AIFF](/api/docs/extractors/audio/aiff) | `aiff` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [FLAC](/api/docs/extractors/audio/flac) | `flac` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [M4A](/api/docs/extractors/audio/m4a) | `m4a` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [M4B](/api/docs/extractors/audio/m4b) | `m4b` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [MKA](/api/docs/extractors/audio/mka) | `mka` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [MP3](/api/docs/extractors/audio/mp3) | `mp3` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [OGG](/api/docs/extractors/audio/ogg) | `ogg` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [OPUS](/api/docs/extractors/audio/opus) | `opus` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [WAV](/api/docs/extractors/audio/wav) | `wav` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [WMA](/api/docs/extractors/audio/wma) | `wma` | `audio.metadata`, `audio.artwork`, `audio.chapters`, `audio.chapterAudio`, `media.transcript` | `audioFormat`, `transcription.mode` |
| [ZIP](/api/docs/extractors/archives/zip) | `zip` | `archive.images`, `archive.metadata` | None |
| [EML](/api/docs/extractors/email/eml) | `eml` | `email.embeddedFiles`, `email.images`, `email.metadata` | None |
| [EXE](/api/docs/extractors/executables/exe) | `exe` | `executable.icons` | None |
