Processeur de Documents pour Openclaw

Un ensemble d'outils professionnels pour automatiser les conversions, l'édition et le traitement OCR de documents PDF et Word.

youmu88
v1.0.0
Mar 3, 2026
0
4.8k
0

Installer & Télécharger

1. ClawHub CLI

Le moyen le plus rapide d'installer une compétence directement depuis le registre.

npx clawhub@latest install document-processor

2. Installation manuelle

Copiez le dossier de la compétence dans l'un de ces emplacements

Global
~/.openclaw/skills/
Espace de travail
<project>/skills/

Priorité : Espace de travail > Local > Intégré

3. Installation du prompt

Copiez ce prompt dans OpenClaw pour l'installer automatiquement.

Aide-moi à installer document-processor via Clawhub. Si Clawhub n'est pas installé, installe-le d'abord (npm i -g clawhub).

Vous préférez télécharger ?

Obtenez les fichiers bruts de la compétence dans une archive ZIP.

Qu'est-ce que Processeur de Documents ?

Le Processeur de Documents est une suite complète conçue pour la manipulation avancée de documents bureautiques au sein d'un environnement d'agent IA. En tant que composant clé d'Openclaw Skills, il sert de pont entre les fichiers bruts et les données structurées en offrant des conversions PDF vers Word haute fidélité, la suppression de filigranes et des extractions de pages complexes. Cette compétence permet aux développeurs d'intégrer des capacités sophistiquées de gestion de documents dans leurs flux de travail sans avoir besoin de logiciels propriétaires.

En s'appuyant sur des bibliothèques Python de qualité industrielle, la compétence garantit que le formatage des documents est préservé pendant la conversion et que les métadonnées restent intactes. Que vous construisiez un pipeline de rapports automatisés ou un système d'archivage de documents, cet ajout à votre bibliothèque Openclaw Skills offre la fiabilité et la flexibilité requises pour les environnements de production.

Cas d'utilisation de Processeur de Documents

  • Extraction de plages de pages spécifiques ou d'étiquettes ciblées à partir de rapports PDF volumineux pour l'analyse de données.
  • Conversion de documents Word existants en PDF pour un archivage et une distribution standardisés.
  • Suppression des filigranes existants ou ajout d'une image de marque et d'en-têtes personnalisés aux documents d'entreprise.
  • Réalisation d'OCR sur des documents numérisés pour mapper les numéros de page et extraire du texte dans plusieurs langues.
  • Traitement par lots de répertoires entiers de fichiers pour la normalisation du format et l'édition en masse.

Comment fonctionne Processeur de Documents

  1. Identifier la tâche spécifique au document telle que la conversion, la fusion, la division ou l'analyse OCR en fonction des besoins de l'utilisateur.
  2. Valider la présence des dépendances Python nécessaires et assurer l'intégrité du fichier d'entrée dans l'environnement Openclaw Skills.
  3. Sélectionner le script principal approprié dans la boîte à outils du Processeur de Documents, adapté au type de fichier spécifique.
  4. Exécuter l'interface de ligne de commande avec les paramètres souhaités tels que les plages de pages, les chemins de sortie ou les paramètres de langue.
  5. Vérifier le fichier de sortie généré pour s'assurer qu'il répond aux normes de qualité et nettoyer tous les artefacts temporaires.

Configuration de Processeur de Documents

Pour commencer à utiliser cet outil de documentation professionnel au sein d'Openclaw Skills, vous devez installer les dépendances Python principales à l'aide de la commande suivante :

pip install PyPDF2 python-docx pdf2docx pillow pdfplumber

Une fois installé, vous pouvez vérifier la configuration en exécutant le script de test inclus :

python3 test_skill.py

Schéma de données et taxonomie de Processeur de Documents

La compétence organise les données en fonction des types de fichiers et des sorties de traitement, maintenant une taxonomie claire pour les métadonnées et le mappage OCR. Cette structure est essentielle pour qu'Openclaw Skills gère correctement les cycles de vie des fichiers :

Composant Description Format de données
Fichiers sources Documents d'entrée originaux pour le traitement .pdf, .docx
Sortie traitée Résultats convertis, fusionnés ou édités .pdf, .docx, .png
Métadonnées OCR Mappage des étiquettes de pages physiques vers les index logiques Texte/JSON
Config lot Paramètres pour les tâches de traitement à haut volume Arguments CLI

Fonctionnalités avancées de Processeur de Documents

  • Reconnaissance des étiquettes de page pilotée par l'OCR pour extraire du contenu en fonction des numéros de page imprimés plutôt que des index logiques.
  • Capacités de traitement par lots multi-thread pour gérer les migrations et les conversions de documents à haut volume.
  • Injection dynamique de filigranes avec prise en charge de l'opacité, du positionnement et des ressources d'image externes personnalisés.
  • Algorithmes avancés de compression et d'optimisation PDF pour réduire la taille des fichiers pour la diffusion web et le stockage.
  • Support multilingue complet pour les tâches OCR, spécifiquement optimisé pour le chinois simplifié et l'anglais dans le cadre de l'écosystème Openclaw Skills.

SKILL.md


Chargement

Compétences Openclaw associées

METADATA

Github Stars: 0
forks: 0

En vedette*