转变 PDF 到 Word - 可编辑文档 API
PDF4me 转变 PDF 到 Word 是一个功能强大的企业级解决方案,可实现变革 PDF 将文档导入 Microsoft Word 通过高级格式 API 整合。这种全面的 PDF 到 Word 转换服务高效处理 PDF 从文件中提取文本内容、格式和布局元素,同时保留文档结构和样式,以满足专业需求。 Word 创建文档。 PDF4me的 API v2,您可以无缝转换 PDF 提交给微软的文件 Word (DOCX采用这种格式,确保高质量和准确的结果。利用 PDF4me的强健 PDF 到 Word 转换功能可实现应用程序中快速、可靠和自动化的文档处理。
验证您的身份 API 要求
要访问 PDF4me REST API每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份。 REST API。
主要特点
- 高级内容提取从中提取文本内容、格式和布局元素 PDF 文件 Word 转换
- 格式保存:保持文档的原始结构、字体、样式和格式 Word 文件
- 质量优化选择草稿模式或高质量模式以获得最佳处理效果 PDF 类型
- OCR 一体化: 自动的 OCR 扫描文档和图像的处理 PDFs
- 多语言支持: 过程 PDF使用智能文本识别技术,支持多种语言
- 表格管理将所有工作表合并到单个文档中,或根据需要保留单独的页面。
- 无缝的 API 一体化RESTful API 专为自动化文档工作流程和企业系统集成而设计
REST API 端点
这 PDF4me REST API 使用标准 HTTP 与资源交互的方法。全部 PDF 到 Word 转换操作通过单个端点执行:
- 方法: POST
- 终点:
/api/v2/ConvertPdfToWord
支持 PDF 类型
这 API 为各种 PDF 文档类型和 Word 转换场景:
PDF 内容类型
- 基于文本 PDFs包含文本内容、标题和结构化信息的文档
- 图片较多 PDFs包含图表、示意图和视觉元素的文档
- 混合内容包含文本和视觉元素的文档
- 扫描文档:基于图像的 PDFs 与 OCR 文本识别处理
- 格式化文档: PDF具有复杂布局和格式要求的
内容提取能力
- 文本处理提取并格式化文本内容 Word 格式正确的文档
- 布局识别智能检测文档结构和格式元素
- 格式保留保持原有的字体、颜色、样式和文档结构
- 多页面支持: 处理 PDF包含多个页面的 s 作为单独的页面 Word 章节或合并文档
质量选项
- 草稿模式快速处理标准 PDF包含文本内容的 s(1 API 按文件调用)
- 高模式:高级处理 PDF由图像和扫描文档生成的(2) API 每页调用次数)
- OCR 加工:根据需要对扫描内容进行自动文本识别
- 语言检测智能语言识别与处理
REST API 参数
Convert 函数的完整参数列表 PDF 到 Word REST API参数按类别组织,以便更好地理解和实施。
重要的: 标有星号 (*) 的参数为必填项,必须提供。 API 正常运作。
必需参数
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 文件内容* | Base64 | 输入文件的内容。 | JVBERi... |
| 文件名* | String | 源文件名(需包含正确的文件扩展名) | document.pdf |
| 质量类型* | String | 选择质量类型。 草稿 - 适用于正常 PDFs,消耗1 API 每个文件调用一次。 高的 - 适用于 PDF由图像和扫描文档生成。消耗 2 API 每页调用次数 | Draft 或者 High |
| 语言* | String | 指定源文件中的文本语言。仅当输出无法识别时才使用。 | English |
| 合并所有工作表* | Boolean | “合并所有工作表”操作必须采用布尔格式。 真的 错误的 | true 或者 false |
| 输出格式* | String | 输出格式 PDF 文件输出必须为字符串格式。 | xyz |
| 是异步的* | Boolean | isAsync 必须采用布尔值格式。 真的 错误的 | true 或者 false |
输出
这 PDF4me 转变 PDF 到 Word REST API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:
- JSON
- Table
- Schema
- Binary
JSON 回复格式
原始 JSON 来自……的回应 API:
{
"File Content": "Output file content from PDF4me action",
"File Name": "Output file name from PDF4me action"
}
表格视图
以结构化表格格式呈现的响应数据:
| 范围 | 价值 |
|---|---|
| 文件内容 | PDF4me 操作的输出文件内容 |
| 文件名 | PDF4me 操作的输出文件名 |
架构视图
响应的数据结构和类型:
2 items
File Content: Binary Output file content from PDF4me action
File Name: String Output file name from PDF4me action
类型指示器:
Binary二进制数据String= 文本数据
二进制数据视图
实际转换 Word 文件数据和元数据:
data
─────────────────────────────
File Content: Output file content from PDF4me action
File Name: Output file name from PDF4me action
二进制数据访问:
- Word 内容:可供下载或进一步处理
- PDF 转换: 完全的 PDF 到 Word 转型
请求示例
标题
Content-Type: application/json
Authorization: YOUR_API_KEY
笔记: 获得你的 API 钥匙 PDF4me 控制面板
有效载荷
{
"docContent": "Please put PDF base64 content",
"docName": "test.pdf",
"qualityType": "Draft",
"language": "English",
"mergeAllSheets": true,
"outputFormat": "xyz",
"ocrWhenNeeded": "true"
}
代码示例
这 PDF4me 转变 PDF 到 Word REST API 提供多种编程语言的代码示例。请选择最适合您开发环境的语言:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
PDF 到 Word 转换功能
内容提取能力
- 文本处理提取并格式化文本内容 Word 格式和结构正确的文档
- 布局识别智能检测文档结构、标题、段落和格式元素
- 格式保留保持原始字体、颜色、样式和文档格式。 PDF
- 多页面支持: 处理 PDF包含多个页面的 s 作为单独的页面 Word 章节或合并文档
质量和加工选项
- 草稿质量快速处理标准 PDF包含文本内容的 s(1 API 按文件调用)
- 高质量:高级处理 PDF由图像和扫描文档生成的(2) API 每页调用次数)
- OCR 一体化:根据需要对扫描文档和图像进行自动文本识别 PDFs
- 语言支持多语言文本识别和处理能力
Word 输出功能
- 文档结构:保持原始文档层级结构和格式 Word 格式
- 格式保留保留字体、样式、颜色和布局元素 PDF
- 多页面处理将所有工作表合并到单个文档中,或根据需要保留单独的页面。
- 内容完整性确保准确提取文本并正确 Word 格式化
行业应用案例及应用
- Business & Enterprise
- Legal & Professional Services
- Education & Research
- Government & Compliance
商业及企业应用案例
- 文档编辑将 PDF 文档转换为 Word 文档,以便进行编辑和内容修改。
- 内容管理将 PDF 内容转换为可编辑的 Word 格式,以便用于内容管理系统。
- 文档协作将 PDF 文件转换为 Word 文档,以便进行协作编辑和审阅。
- 商业文件将商务 PDF 文件转换为 Word 文档以便编辑
法律及专业服务用例
- 法律文件编辑将法律 PDF 文件转换为 Word 文档以便编辑和修改
- 合同编辑将合同 PDF 文件转换为 Word 文档,以便进行协作编辑
- 法律内容管理将法律 PDF 文件转换为 Word 文档以进行内容管理
- 文件审查将法律PDF文件转换为Word文档以进行审核。
教育与研究应用案例
- 文本处理从PDF文件中提取文本,用于分析、翻译和文本处理工作流程
- 研究文件将研究PDF文件转换为Word格式以便编辑
- 学术论文将学术 PDF 文件转换为 Word 文档,以便进行协作编辑
- 教育材料将教育类 PDF 文件转换为 Word 文档以便修改内容
政府及合规应用案例
- 档案处理将已存档的 PDF 文档转换为可编辑的 Word 格式,以便内容重复使用。
- 公共记录将公共记录 PDF 文件转换为 Word 文档以便编辑
- 监管文件将监管文件 PDF 转换为 Word 文档以进行内容修改
- 政府档案馆将政府PDF文件转换为Word格式以便内容重复使用