Azure 文档智能 Java 技能
帮助 Java 开发者使用 Azure 文档智能提取和分类文档数据。
文档展示了使用环境变量读取端点、令牌凭据和 API 密钥,未要求硬编码秘密,且权限范围基本限于文档分析与模型管理;但未透明说明文档会发送至 Azure、未提供敏感身份证件处理或数据保留建议,删除模型示例没有用户确认、回滚或恢复说明,外部 URL/SAS 数据流也缺少安全边界,因此从中等基线扣分。
主 SKILL.md 与 examples.md 覆盖同步、异步、管理、轮询和异常路径,失败时有 HTTP 异常示例;但文档声明最新 GA 为 1.0.7,安装示例却固定为 1.0.0,示例缺少完整依赖/import 上下文,异常、超时、轮询失败和输入边界处理有限,静态证据不足以确认可编译运行,因此限制在 10 分以下。
触发词、Java SDK 受众及发票、收据、ID、布局、自定义模型和分类场景较清晰;但非适用范围、输入格式限制、区域/API 兼容边界和触发排除条件未充分声明,也没有中文使用指导。核心功能依赖 Azure 云端端点,未说明中国大陆网络、区域服务可用性或替代方案,因此扣分。
采用主文档加 references/examples.md 的分层结构,包含安装、认证、环境变量、迁移表、错误处理、模型列表和 MIT 许可证;但缺少技能自身的版本、变更日志、维护责任人和明确更新路径,依赖版本还存在 1.0.7 与 1.0.0 的不一致,限制、FAQ 和故障排查不完整,因此未给高分。
内容直接提供客户端创建、文件/URL 分析、字段提取、表格读取、自定义模型、分类、异步和迁移代码,能覆盖核心编码任务;但代码需要按具体 SDK 版本、imports、权限、资源区域和业务数据保护要求人工核验,静态材料没有证明代表性输出已验证或可直接运行,因此按静态上限给 6 分。
文档包含指向 Azure SDK migration guide 和 Microsoft Learn 的可追溯链接,仓库 README 还显示存在 CI/evaluation 工作流;但没有该技能路径的提交测试套件、编译结果或第三方执行证据,且引用覆盖不完整,静态审查只能给有限可验证性。
- 安装示例的 azure-ai-documentintelligence 版本为 1.0.0,但文档称最新 GA 为 1.0.7;实施前应核对实际 API。
- 身份证件、发票和收据可能含敏感信息;文档未说明上传、保留、区域和访问控制要求。
- 模型删除示例是不可逆风险操作,缺少确认、备份或恢复流程。
- Azure 端点和示例外部 URL 的可达性、区域合规性及中国大陆网络适用性未说明。
它能做什么 & 适用场景
该技能面向使用 Azure AI Document Intelligence Java SDK 的开发者,覆盖文本、表格、选择标记、键值对以及收据、发票和身份证件字段提取。它提供同步、异步和管理客户端的初始化方式,并说明密钥和 DefaultAzureCredential 身份验证。技能还涵盖预构建模型、自定义文档模型、文档分类器、错误处理及从旧版 Form Recognizer SDK 迁移。适合需要在 Java 应用中接入 Azure 文档分析能力的团队。
指导开发者安装 com.azure:azure-ai-documentintelligence 和可选的 azure-identity 依赖,配置 DOCUMENT_INTELLIGENCE_ENDPOINT 等环境变量,创建文档智能客户端,并从文件或 URL 启动文档分析。它展示如何读取页面、行、选择标记、表格和文档字段,使用预构建模型处理收据、发票、身份证件等文档,构建和管理自定义模型及分类器,并捕获 HttpResponseException。实现前还要求查询 microsoft-docs MCP,核对已安装 SDK 版本的 API 参数。
- Java 后端开发者需要从 PDF 中提取文本、页面布局、表格和选择标记。
- 财务应用开发者需要从收据或发票中读取商户名称、交易日期和其他字段。
- 身份或业务流程开发者需要分析护照、驾照、合同或美国税务表单。
- 需要处理非标准文档的团队希望构建、列出、获取和删除自定义文档模型。
- 文档入口需要区分发票、收据等类型的团队希望构建并调用文档分类器。
优缺点一览
- 覆盖文件和 URL 分析、预构建模型、自定义模型与文档分类。
- 同时提供 API Key、DefaultAzureCredential、同步客户端和异步客户端示例。
- 包含从 azure-ai-formrecognizer 到 azure-ai-documentintelligence 的迁移对照表。
- 提供错误处理、模型管理和分析选项等较完整的 Java API 模式。
- 依赖 Azure 文档智能资源、端点和相应身份验证配置。
- 实现前需要查询 microsoft-docs MCP 以确认当前 API 参数。
- 源文档没有给出独立测试套件、性能数据或成本信息。
- 部分旧模型已在 API 版本 2024-11-30 中退役,旧项目可能需要迁移。
如何安装
在项目中运行 npx skills add microsoft/skills,在安装向导中选择 azure-ai-formrecognizer-java。该技能位于 .github/plugins/azure-sdk-java/skills/azure-ai-formrecognizer-java/。Java 项目可加入 com.azure:azure-ai-documentintelligence;若使用 DefaultAzureCredential,再加入 com.azure:azure-identity。源文档示例使用的版本分别为 1.0.0 和 1.14.2,并注明最新 GA 版本为 1.0.7;实现前应核对已安装版本。
如何使用
安装后,可用类似“用 Java Document Intelligence 从 PDF 提取文本和表格”或“用 Java 分析发票并读取字段”的提示触发。配置 DOCUMENT_INTELLIGENCE_ENDPOINT;生产环境使用 DefaultAzureCredential 时配置 AZURE_TOKEN_CREDENTIALS=prod。随后根据场景调用 beginAnalyzeDocument、beginClassifyDocument 或管理客户端的模型操作。源文档未提供独立的运行脚本或完整项目模板。
对比同类
源文档明确将新版 azure-ai-documentintelligence 与旧版 azure-ai-formrecognizer 作了迁移对照。旧包仅针对 API 版本 2023-07-31;新项目应使用 Document Intelligence 包。退役的 prebuilt-businessCard 和 prebuilt-document 需要继续使用旧包。