What problem does it solve?
This Skill eliminates manual data extraction from documents by providing Java patterns and guidance to extract text, tables, key/value pairs, and classification labels from PDFs, images, receipts, invoices, and ID documents so developers can automate document ingestion and downstream workflows.
Core Features & Use Cases
- Prebuilt model usage: Use prebuilt models for layout, receipts, invoices, business cards and ID documents to quickly extract common fields.
- Custom model training and composition: Build, compose, and manage custom document models for specialized invoice or form layouts and classify mixed document sets.
- Programmatic analysis: Patterns for synchronous polling, URL and binary analysis, table parsing, and field confidence checks integrated into Java applications.
- Production considerations: Guidance for authentication with API key or managed identities, model lifecycle operations, and basic HTTP error handling and retries.
Quick Start
Analyze an invoice URL with the Java Azure Document Intelligence SDK to extract merchant, date, line items, and totals into structured fields.