OCR

Explorez les agent skills avec le tag OCR et comparez les workflows associes dans le repertoire.

17 skills
A
visa-doc-translate

par affaan-m

visa-doc-translate traduit en anglais les images de documents de demande de visa et génère un PDF bilingue avec la page originale et sa traduction. L’outil est conçu pour les dossiers de visa structurés, avec repli OCR, gestion de la rotation et préservation des noms, dates et montants.

Translation
Favoris 0GitHub 156.3k
A
nutrient-document-processing

par affaan-m

Skill nutrient-document-processing pour le traitement de PDF et l’automatisation documentaire avec l’API Nutrient DWS. Convertissez, faites de l’OCR, extrayez, caviardez, signez, appliquez un filigrane et remplissez des fichiers comme des PDF, DOCX, XLSX, PPTX, HTML et des images.

PDF Processing
Favoris 0GitHub 156.2k
A
pdf

par anthropics

Le skill pdf accompagne les tâches de traitement de PDF : extraction de texte, fusion et scission, rendu de pages en images et workflows autour des formulaires PDF. Il est particulièrement utile pour vérifier les champs remplissables, extraire les métadonnées de formulaires et valider par script la mise en page de formulaires non remplissables.

PDF Processing
Favoris 0GitHub 105.1k
C
invoice-organizer

par ComposioHQ

invoice-organizer aide les agents à extraire les champs de factures, renommer les reçus et classer les documents financiers dans des dossiers prêts pour la déclaration fiscale. Utilisez-le pour les workflows de Document Filing avec des PDFs, des scans et des téléchargements ; commencez par un essai à blanc, car le repo fournit des consignes dans SKILL.md, mais pas de scripts intégrés.

Document Filing
Favoris 0GitHub 67.5k
C
platerecognizer-automation

par ComposioHQ

platerecognizer-automation aide les agents Claude à utiliser Plate Recognizer via Composio Rube MCP, avec découverte des outils, vérification de connexion et exécution de workflows ALPR fondés sur les schémas.

Workflow Automation
Favoris 0GitHub 67.5k
C
google-cloud-vision-automation

par ComposioHQ

google-cloud-vision-automation aide les agents à lancer des workflows Google Cloud Vision via Composio Rube MCP, en recherchant les outils disponibles, en vérifiant la connexion google_cloud_vision et en exécutant des schémas validés.

Workflow Automation
Favoris 0GitHub 67.5k
C
docsumo-automation

par ComposioHQ

docsumo-automation aide les agents à automatiser Docsumo OCR Extraction via Rube MCP, avec découverte d’outils en direct, vérifications de connexion et workflows pilotés par les schémas.

OCR Extraction
Favoris 0GitHub 67.5k
C
affinda-automation

par ComposioHQ

affinda-automation aide les agents à exécuter des workflows Affinda via Composio Rube MCP en recherchant d’abord les schémas d’outils en direct, en vérifiant la connexion Affinda, puis en lançant des tâches d’automatisation documentaire avec moins d’incertitude.

Workflow Automation
Favoris 0GitHub 67.4k
M
azure-ai-vision-imageanalysis-py

par microsoft

Le skill azure-ai-vision-imageanalysis-py vous aide à installer et utiliser le SDK Azure AI Vision Image Analysis pour Python. Il couvre les légendes, les balises, les objets, l’OCR, la détection des personnes et le recadrage intelligent, avec des indications de configuration, d’authentification et d’environnement orientées backend pour des workflows de compréhension d’images basés sur Azure.

Backend Development
Favoris 0GitHub 2.3k
M
azure-ai-document-intelligence-ts

par microsoft

azure-ai-document-intelligence-ts est un skill TypeScript pour extraire du texte, des tableaux, des champs clé-valeur et des données structurées avec Azure Document Intelligence. Utilisez-le pour l’OCR Extraction de factures, reçus, pièces d’identité et formulaires, ou lorsque vous avez besoin de workflows avec modèles préconfigurés et personnalisés dans Node.js avec l’authentification Azure REST SDK.

OCR Extraction
Favoris 0GitHub 2.3k
M
azure-ai-contentunderstanding-py

par microsoft

azure-ai-contentunderstanding-py est le skill Python pour Azure AI Content Understanding. Il extrait du contenu structuré à partir de documents, d’images, d’audio et de vidéos pour les workflows RAG et l’automatisation. Utilisez-le lorsque vous avez besoin d’une extraction multimodale fiable, de l’authentification Azure et d’une sortie répétable, prête pour les pipelines.

RAG Workflows
Favoris 0GitHub 2.2k
M
azure-ai-vision-imageanalysis-java

par microsoft

azure-ai-vision-imageanalysis-java vous aide à créer des applications Java d’analyse d’images avec Azure AI Vision. Utilisez-le pour la génération de légendes, l’OCR, la détection d’objets, le balisage, la détection de personnes, le recadrage intelligent et le développement d’API avec configuration du SDK, authentification et exemples.

API Development
Favoris 0GitHub 2.2k
M
azure-ai-formrecognizer-java

par microsoft

Le skill azure-ai-formrecognizer-java aide les développeurs Java à utiliser Azure AI Document Intelligence pour l’extraction OCR, les tableaux, les paires clé-valeur, les factures, les reçus, les pièces d’identité et les modèles de documents personnalisés. Il est aligné sur le SDK actuel `com.azure:azure-ai-documentintelligence` et s’avère utile lorsque vous avez besoin d’une configuration Java concrète, de conseils sur l’API et d’une analyse documentaire reproductible.

OCR Extraction
Favoris 0GitHub 2.2k
M
azure-ai-document-intelligence-dotnet

par microsoft

azure-ai-document-intelligence-dotnet aide les développeurs .NET à installer et utiliser Azure AI Document Intelligence pour extraire du texte, des tableaux, des paires clé-valeur et des champs structurés à partir de factures, reçus, pièces d’identité et documents personnalisés. Le contenu fournit des indications pratiques sur la configuration, l’authentification et l’extraction OCR afin de fiabiliser l’analyse de documents.

OCR Extraction
Favoris 0GitHub 2.2k
K
pdf

par K-Dense-AI

Le skill pdf est un guide pratique pour le traitement PDF quand vous devez lire, extraire, transformer ou créer des fichiers PDF dans un workflow prêt à être déployé. Il couvre l’extraction de texte, la fusion, le découpage, la rotation, le remplissage de formulaires, le chiffrement, l’extraction d’images et l’OCR pour les PDF numérisés. Utilisez-le quand vous avez besoin d’un guide pdf reproductible plutôt que d’un prompt ponctuel.

PDF Processing
Favoris 0GitHub 0
K
markitdown

par K-Dense-AI

markitdown convertit des fichiers et des documents bureautiques en Markdown pour faciliter la lecture, le découpage en chunks, la recherche et les workflows LLM. Cette skill markitdown prend en charge les PDF, DOCX, PPTX, XLSX, HTML, CSV, JSON, XML, ZIP, EPUB, les images avec OCR et la transcription audio, ce qui en fait un guide markitdown pratique pour la conversion de formats.

Format Conversion
Favoris 0GitHub 0
P
nutrient-document-processing

par PSPDFKit-labs

nutrient-document-processing est un skill de workflow pour le traitement de PDF avec Nutrient DWS. Il aide à installer, comprendre et utiliser des workflows documentaires reproductibles pour convertir, fusionner, fractionner, faire de l’OCR, extraire, rédiger, signer, optimiser et produire des sorties conformes comme PDF/A ou PDF/UA.

PDF Processing
Favoris 0GitHub 0