Zum Inhalt springen

f5xc-firecrawl

Das f5xc-firecrawl-Plugin bietet lokales selbst gehostetes Web-Scraping über die Open-Source-Engine firecrawl. Keine API-Schlüssel, keine Abonnements, keine Cloud-Abhängigkeit. Alle Operationen werden gegen die lokale Firecrawl-Instanz auf localhost:3002 innerhalb des Entwicklungscontainers ausgeführt.

v1.1.0 Productivity
/plugin install f5xc-firecrawl@f5-sales-demo-marketplace

Scrapt eine einzelne URL und extrahiert den Inhalt als Markdown.

/scrape https://docs.example.com/getting-started
/scrape https://example.com --format markdown,links --wait 2000

Scrapt mehrere URLs gleichzeitig.

/batch-scrape https://example.com https://example.org https://example.net

Crawlt mehrere Seiten ausgehend von einer Start-URL.

/crawl https://docs.example.com --limit 20 --depth 2
/crawl https://docs.example.com --include /api/* --exclude /blog/*

Findet alle URLs einer Website.

/map https://docs.example.com
/map https://docs.example.com --search api --subdomains

Durchsucht das Web und scrapt optional die Ergebnisse.

/search "firecrawl web scraping" --limit 10
/search "AI tools 2026" --scrape --time month

KI-gestützte strukturierte Datenextraktion aus Webseiten.

/extract https://example.com "Extract the main heading and any links"
/extract https://example.com/pricing --schema '{"plans": [{"name": "string", "price": "string"}]}'

Generiert eine llms.txt-Datei für eine Website.

/llmstxt https://docs.example.com

Aktiviert sich automatisch, wenn Sie aufgefordert werden, eine URL zu scrapen, eine Website zu crawlen, Site-URLs zu mappen, das Web zu durchsuchen, strukturierte Daten zu extrahieren, eine llms.txt zu generieren, mehrere URLs als Batch zu scrapen oder eine Webseite in Markdown zu konvertieren. Delegiert unmittelbar an den firecrawl-operator-Agenten.

Autonomer Web-Scraping-Agent, der curl- und jq-Sequenzen gegen die lokale Firecrawl-API ausführt. Unterstützt 11 Protokolle, die alle v1-Endpunkte abdecken. Nur-Lese-Agent (keine Schreib-, Bearbeitungs- oder Agentenwerkzeuge).

ProtokollEndpunktTyp
HEALTHGET /Synchron
SCRAPEPOST /v1/scrapeSynchron
BATCH_SCRAPEPOST /v1/batch/scrapeAsynchron
CRAWLPOST /v1/crawlAsynchron
CRAWL_CANCELDELETE /v1/crawl/:idSynchron
CRAWL_ACTIVEGET /v1/crawl/activeSynchron
CRAWL_ERRORSGET /v1/crawl/:id/errorsSynchron
MAPPOST /v1/mapSynchron
SEARCHPOST /v1/searchSynchron
EXTRACTPOST /v1/extractAsynchron
LLMSTXTPOST /v1/llmstxtAsynchron

Das Plugin erfordert den im Entwicklungscontainer laufenden Firecrawl-Stack:

KomponentePortZweck
Firecrawl API3002Alle Scrape/Crawl/Map/Search/Extract-Endpunkte
Playwright3000JavaScript-Rendering-Engine
Redis6379Job-Queue-Backend
PostgreSQLsocketPersistenz für Crawl-/Batch-Jobs
LiteLLM-ProxyOPENAI_BASE_URLKI-Backend für Extract (optional)

Der Stack startet automatisch, wenn ENABLE_FIRECRAWL=true gesetzt ist (Standard). Ein SessionStart-Hook prüft, ob die API erreichbar ist, und warnt, wenn der Dienst nicht verfügbar ist.

Dieses Plugin verwendet die selbst gehostete Open-Source-Version:

  • Keine Authentifizierung oder API-Schlüssel für das Scraping erforderlich
  • Keine Kreditlimits oder Ratenbegrenzung
  • Verwendet v1-API-Endpunkte (nicht v2)
  • Browser-Sitzungen und tiefgehende Recherche nicht verfügbar
  • Extract verwendet Ihren eigenen KI-Proxy anstelle von gehosteten Modellen
  • Läuft vollständig innerhalb des lokalen Container-Netzwerks