Skip to content

简介

扫描全能王 Agent 文档能力,是一组面向智能体、IDE、脚本和自动化工作流的底层文档处理能力。你可以通过 Skill、MCP 或 CLI,让现有 Agent 调用扫描全能王成熟的文档技术,完成从原始文件到可用结果的处理过程。

它不是一个新的 Agent 平台,也不会替代你正在使用的智能体。Agent 负责理解需求、规划步骤和组织任务,扫描全能王负责执行其中的文档处理环节。

一、核心能力

  • 扫描与图像优化:处理阴影、模糊、网纹、摩尔纹和手写痕迹等问题,并支持图片高清化与老照片修复。
  • 文字识别:从图片中提取纯文本、数学公式或发票票据的结构化字段。
  • 格式转换:将图片、PDF 或 TXT 转换为当前支持的办公文档、文本、PDF 或图片格式。
  • 批量处理:将最多 100 张图片按确认的顺序合并为 PDF、Word、Excel 或连续文本。
  • 翻译与编辑:处理文档中的语言和内容,同时尽可能保留原有结构与版式。
  • 水印与真实性检测:为图片和 PDF 添加或去除水印,并检测图片篡改与 AI 生成风险。
  • 云端保存与文档管理:保存处理结果,并搜索、下载、移动和整理云端文档。

完整的能力范围和支持情况,请查看能力支持

二、它如何参与一次任务

当用户向 Agent 提出文档需求时,一次典型的处理过程如下:

  1. 用户描述目标:例如“提取这份扫描合同的文字,并转换为可编辑文档”。
  2. Agent 理解并规划:判断需要调用哪些能力,并安排处理顺序。
  3. 扫描全能王执行:通过 Skill、MCP 或 CLI 完成识别、增强、转换等操作。
  4. Agent 继续交付:基于处理结果进行总结、归档,或衔接下一步业务流程。

因此,你不需要迁移到新的工作平台,也不需要重新搭建完整的文档处理链路。只需在已有环境中选择合适的接入方式,就可以把文档能力加入当前工作流。

三、适用场景

  • 智能体处理用户文件:让面向用户的 Agent 看懂并处理图片、扫描件或 PDF,而不只是给出操作建议。
  • 办公流程自动化:将识别、转换、合并、翻译等步骤接入固定流程,批量处理重复性文档任务。
  • 开发与调试:在 IDE 或本地终端中直接调用能力,快速验证参数和处理结果。
  • 产品能力集成:在现有应用中补充专业文档能力,由你的产品负责交互,扫描全能王负责底层处理。

四、与 Agent 平台如何配合

组成部分主要职责
Agent 平台与用户交互,理解目标,管理上下文,规划并编排任务
扫描全能王 Agent 文档能力接收调用,执行扫描、识别、转换、编辑和管理等具体文档操作
你的业务系统提供文件、权限和业务规则,并使用最终处理结果

三者可以按需组合。无论你使用的是通用 Agent、垂直业务智能体、AI IDE,还是自建自动化流程,都可以将扫描全能王作为文档能力层接入。

五、选择接入方式

接入方式适合你在……
Skill使用支持 Skill 的 Agent,希望它理解能力说明并按任务自动组合调用
MCP为 Agent、AI IDE 或工作流接入标准化工具,让模型按需调用
CLI编写脚本、执行批处理、进行本地开发调试或接入 CI 流程

如果暂时不确定如何选择,可以先进入 接入 Agents 查看三种方式的完整说明。

六、建议阅读顺序

  1. 能力支持:确认你的文档任务是否已有对应能力。
  2. 接入 Agents:根据当前使用的 Agent 或开发环境选择接入方式。
  3. 更新日志:了解新增能力、调整内容和兼容性变化。