简介
扫描全能王 Agent 文档能力,是一组面向智能体、IDE、脚本和自动化工作流的底层文档处理能力。你可以通过 Skill、MCP 或 CLI,让现有 Agent 调用扫描全能王成熟的文档技术,完成从原始文件到可用结果的处理过程。
它不是一个新的 Agent 平台,也不会替代你正在使用的智能体。Agent 负责理解需求、规划步骤和组织任务,扫描全能王负责执行其中的文档处理环节。
一、核心能力
- 扫描与图像优化:处理阴影、模糊、网纹、摩尔纹和手写痕迹等问题,并支持图片高清化与老照片修复。
- 文字识别:从图片中提取纯文本、数学公式或发票票据的结构化字段。
- 格式转换:将图片、PDF 或 TXT 转换为当前支持的办公文档、文本、PDF 或图片格式。
- 批量处理:将最多 100 张图片按确认的顺序合并为 PDF、Word、Excel 或连续文本。
- 翻译与编辑:处理文档中的语言和内容,同时尽可能保留原有结构与版式。
- 水印与真实性检测:为图片和 PDF 添加或去除水印,并检测图片篡改与 AI 生成风险。
- 云端保存与文档管理:保存处理结果,并搜索、下载、移动和整理云端文档。
完整的能力范围和支持情况,请查看能力支持。
二、它如何参与一次任务
当用户向 Agent 提出文档需求时,一次典型的处理过程如下:
- 用户描述目标:例如“提取这份扫描合同的文字,并转换为可编辑文档”。
- Agent 理解并规划:判断需要调用哪些能力,并安排处理顺序。
- 扫描全能王执行:通过 Skill、MCP 或 CLI 完成识别、增强、转换等操作。
- Agent 继续交付:基于处理结果进行总结、归档,或衔接下一步业务流程。
因此,你不需要迁移到新的工作平台,也不需要重新搭建完整的文档处理链路。只需在已有环境中选择合适的接入方式,就可以把文档能力加入当前工作流。
三、适用场景
- 智能体处理用户文件:让面向用户的 Agent 看懂并处理图片、扫描件或 PDF,而不只是给出操作建议。
- 办公流程自动化:将识别、转换、合并、翻译等步骤接入固定流程,批量处理重复性文档任务。
- 开发与调试:在 IDE 或本地终端中直接调用能力,快速验证参数和处理结果。
- 产品能力集成:在现有应用中补充专业文档能力,由你的产品负责交互,扫描全能王负责底层处理。
四、与 Agent 平台如何配合
| 组成部分 | 主要职责 |
|---|---|
| Agent 平台 | 与用户交互,理解目标,管理上下文,规划并编排任务 |
| 扫描全能王 Agent 文档能力 | 接收调用,执行扫描、识别、转换、编辑和管理等具体文档操作 |
| 你的业务系统 | 提供文件、权限和业务规则,并使用最终处理结果 |
三者可以按需组合。无论你使用的是通用 Agent、垂直业务智能体、AI IDE,还是自建自动化流程,都可以将扫描全能王作为文档能力层接入。
五、选择接入方式
| 接入方式 | 适合你在…… |
|---|---|
| Skill | 使用支持 Skill 的 Agent,希望它理解能力说明并按任务自动组合调用 |
| MCP | 为 Agent、AI IDE 或工作流接入标准化工具,让模型按需调用 |
| CLI | 编写脚本、执行批处理、进行本地开发调试或接入 CI 流程 |
如果暂时不确定如何选择,可以先进入 接入 Agents 查看三种方式的完整说明。

