Um utilitário versátil para extrair texto, metadados e converter vários formatos de documentos, incluindo PDF, Word e Excel.
A maneira mais rápida de instalar uma habilidade diretamente do registro.
npx clawhub@latest install document-handler
Copie a pasta da habilidade para um desses locais
~/.openclaw/skills/ <project>/skills/ Prioridade: Espaço de Trabalho > Local > Integrado
Copie este prompt para o OpenClaw para instalá-lo automaticamente.
Ajude-me a instalar o document-handler usando o Clawhub. Se o Clawhub não estiver instalado, instale-o primeiro (npm i -g clawhub).
Obtenha os arquivos originais da habilidade em um arquivo ZIP.
O Manipulador de Documentos é uma habilidade técnica abrangente projetada para agentes de IA interagirem com uma ampla gama de formatos de documentos. Ele fornece as ferramentas necessárias para ler conteúdo de PDFs, arquivos do Microsoft Office, EPUBs e formatos OpenDocument, tornando-se um componente essencial para qualquer fluxo de trabalho de processamento de dados automatizado dentro do ecossistema Openclaw Skills.
Aproveitando utilitários CLI padrão e scripts shell personalizados, esta habilidade permite a extração contínua de texto e metadados, bem como a conversão de formato de alta qualidade. Se você precisa extrair dados de uma planilha complexa ou resumir um relatório acadêmico em PDF, esta habilidade garante que seu agente de IA tenha acesso direto às informações subjacentes sem exigir suítes de software externas pesadas.
Para integrar esta capacidade ao seu ambiente Openclaw Skills, certifique-se de ter os utilitários CLI necessários instalados. No macOS, eles podem ser gerenciados via Homebrew.
# Instalar utilitários de PDF (pdftotext, pdfinfo, pdftoppm)
brew install poppler
# Instalar lynx para renderização de texto EPUB
brew install lynx
Execute os scripts fornecidos diretamente para processamento em lote:
# Extrair texto e metadados de qualquer arquivo suportado
./scripts/extract_document.sh <caminho_do_arquivo>
# Converter páginas de PDF em imagens PNG para processamento visual
./scripts/pdf_to_images.sh <caminho_do_pdf> <diretorio_de_saida> [dpi]
O Manipulador de Documentos processa vários arquivos de entrada e gera saídas estruturadas de texto ou imagem. Os metadados são frequentemente retornados como comentários formatados em JSON para fácil análise.
| Componente do Documento | Método de Extração | Saída Primária |
|---|---|---|
| Conteúdo de Texto | pdftotext, sed, textutil | Texto Simples |
| Metadados do Arquivo | pdfinfo, unzip | JSON / Chave-Valor |
| Visuais de Página | pdftoppm | Imagens PNG / JPEG |
| Dados de Planilha | unzip + parsing xml | Texto Normalizado |
Carregamento
Um kit de ferramentas abrangente de processamento de áudio para agentes de IA analisarem, converterem e manipularem arquivos de mídia usando ferramentas de CLI padrão da indústria.

Uma habilidade de segmentação de retratos de nível profissional para agentes de IA realizarem recorte automático de imagem e reconhecimento de contorno.

Uma habilidade de fusão de faces de nível profissional que combina perfeitamente os rostos dos usuários com imagens de modelo usando a IA de alto desempenho da Tencent Cloud.

Uma habilidade profissional de geração de imagens por AI que utiliza o modelo de grande escala Tencent Cloud HunYuan para síntese de alta qualidade de texto para imagem e imagem para imagem.

Um utilitário abrangente para ler, analisar e manipular uma grande variedade de formatos de imagem usando ferramentas nativas do macOS e ffmpeg.

Um poderoso utilitário de automação que transforma APIs REST em Openclaw Skills totalmente documentados usando especificações OpenAPI.








































