# Trích Xuất Văn Bản Từ PDF Có Text

> Hồ sơ MCP chính thức, sinh từ registry BOP.INK.

| Trường | Giá trị |
| --- | --- |
| Slug | `trich-xuat-van-ban-tu-pdf-co-text` |
| Danh mục V2 | Tài liệu & PDF (`tai-lieu-pdf`) |
| Danh mục con V2 | OCR / Text Extraction (`documents-pdf.ocr-text-extraction`) |
| Route legacy tương thích | `tai-lieu-van-phong` |
| Taxonomy V2 | `documents-pdf` / `documents-pdf.ocr-text-extraction` |
| Phạm vi áp dụng | `global` |
| Trạng thái thực thi MCP | `client_execution_required` |
| Nguồn giao diện/schema | `config/engines-data/media/trich-xuat-van-ban-tu-pdf-co-text.ts` |
| Website | [Mở công cụ](https://bop.ink/tai-lieu-van-phong/trich-xuat-van-ban-tu-pdf-co-text/) |

Đọc text layer có sẵn trong PDF và xuất TXT, không OCR ảnh.

## Cách dùng qua MCP

### Trích Xuất Văn Bản Từ PDF Có Text

- Capability: `media.tai_lieu_van_phong.trich_xuat_van_ban_tu_pdf_co_text`
- MCP availability: `client-execution-required`
- Hành động: capability này chỉ được discovery trên Node MCP; mở website để thực thi trong runtime phù hợp.
- Mô tả: Đọc text layer có sẵn trong PDF và xuất TXT, không OCR ảnh.

Các trường đầu vào:

- `fileUrl`: URL hoặc dữ liệu tệp hình ảnh/media
- `options`: Tham số xử lý

Ví dụ đầu vào:

```json
{}
```
