Eine Brücke, die es KI-Agenten ermöglicht, Echtzeit-Audiostreams von jedem Browser-Tab ohne plattformspezifische Integrationen zu erfassen und zu verarbeiten.
Der schnellste Weg, einen Skill direkt aus der Registry zu installieren.
npx clawhub@latest install browser-audio-capture
Kopiere den Skill-Ordner an einen dieser Orte
~/.openclaw/skills/ <project>/skills/ Priorität: Workspace > Lokal > Integriert (Bundled)
Kopiere diesen Prompt in OpenClaw, um ihn automatisch zu installieren.
Hilf mir, browser-audio-capture über Clawhub zu installieren. Falls Clawhub nicht installiert ist, installiere es bitte zuerst (npm i -g clawhub).
Hole dir die rohen Skill-Dateien in einem ZIP-Archiv.
Browser Audio Capture ist ein spezialisiertes Dienstprogramm, das entwickelt wurde, um KI-Agenten in einer Webumgebung auditive Fähigkeiten zu verleihen. Indem es als Brücke zwischen der Medienebene des Browsers und Ihrer KI-Pipeline fungiert, ermöglicht es die nahtlose Extraktion von Audio aus Meetings, Webinaren und Streaming-Plattformen. Als Teil des Openclaw Skills-Ökosystems macht dieses Tool komplexe API-Schlüssel oder plattformspezifische OAuth-Setups überflüssig und ist somit eine universelle Lösung für Entwickler, die intelligente Zuhörer erstellen.
Dieser Skill ist auf Flexibilität ausgelegt und unterstützt sowohl ein Python-basiertes CLI für automatisierte Workflows als auch eine dedizierte Chrome-Erweiterung für die manuelle, dauerhafte Erfassung. Egal, ob Sie einen Echtzeit-Meeting-Assistenten oder einen automatisierten Podcast-Notizschreiber erstellen, dieser Skill liefert die Rohaudiodaten, die für moderne Transkriptions- und Analysemodelle erforderlich sind.
Um zu starten, starten Sie Google Chrome mit aktiviertem Remote-Debugging-Port:
/Applications/Google\ Chrome.app/Contents/MacOS/Google\ Chrome \
--remote-debugging-port=9222 --user-data-dir=$HOME/.chrome-debug-profile &
Installieren Sie die erforderlichen Python-Abhängigkeiten:
pip install aiohttp
Verwenden Sie für das CLI-Erlebnis die folgenden Befehle, um Ihre Erfassungssitzungen zu verwalten:
# Audio von einem Meeting-Tab erkennen und erfassen
python3 -m browser_capture.cli capture
# Alle 15 Sekunden nach neuen Tabs suchen
python3 -m browser_capture.cli watch --interval 15
Um die Chrome-Erweiterung zu verwenden, navigieren Sie zu chrome://extensions/, aktivieren Sie den Entwicklermodus und wählen Sie 'Entpackte Erweiterung laden', um das Erweiterungsverzeichnis auszuwählen.
Der Skill streamt Daten als JSON-Nutzlast an den konfigurierten Endpunkt. Dieses strukturierte Format stellt sicher, dass der Openclaw Skills-Verbraucher alle notwendigen Kontexte für den Audiostream erhält.
| Eigenschaft | Typ | Beschreibung |
|---|---|---|
sessionId |
String | Eine eindeutige Kennung für die spezifische Erfassungssitzung. |
audio |
String | Base64-kodierte PCM16-Audiodaten. |
sampleRate |
Integer | Die Abtastrate des Streams (Standard 16000). |
format |
String | Das Audioformat (z. B. "pcm16"). |
tabUrl |
String | Die Quell-URL, von der das Audio erfasst wird. |
tabTitle |
String | Der HTML-Titel des Quell-Tabs. |
Laden
Ein automatisierter Watchdog zur Zustandsüberwachung und Wiederherstellung, der OpenClaw-Gateways vor fehlerhaften Konfigurationsänderungen schützt.

ShieldCortex bietet KI-Agenten ein sicheres, persistentes Speichersystem mit semantischer Suche, Wissensgraphen und einer 6-stufigen Verteidigungs-Pipeline.

Suchen und finden Sie die Verfügbarkeit von Prämienflügen in 24 Meilenprogrammen über die Partner-API von seats.aero.

Der Mermaid Diagramm-Skill ermöglicht die programmgesteuerte Erzeugung von visuellen Diagrammen direkt aus textbasierter Mermaid-Syntax.

Eine ständig aktive Ebene für Umgebungsintelligenz, die einen kontinuierlichen Wissensgraphen Ihrer Gespräche und Projekte aufbaut, ohne dass explizite Befehle erforderlich sind.

Umgebungs-Audio-Erfassung und lokale Transkription für KI-Agenten über Wearables wie Omi und Apple Watch.








































