تخطَّ إلى المحتوى

f5xc-firecrawl

يوفر مكوّن f5xc-firecrawl استخراج الويب المحلي المستضاف ذاتياً عبر محرك firecrawl مفتوح المصدر. لا مفاتيح API، ولا اشتراكات، ولا اعتماد على السحابة. تعمل جميع العمليات على مثيل firecrawl المحلي على localhost:3002 داخل حاوية التطوير.

v1.1.0 Productivity
/plugin install f5xc-firecrawl@f5-sales-demo-marketplace

استخراج محتوى URL واحد وتحويله إلى Markdown.

/scrape https://docs.example.com/getting-started
/scrape https://example.com --format markdown,links --wait 2000

استخراج محتوى عدة روابط URL في وقت واحد.

/batch-scrape https://example.com https://example.org https://example.net

زحف صفحات متعددة انطلاقاً من URL ابتدائي.

/crawl https://docs.example.com --limit 20 --depth 2
/crawl https://docs.example.com --include /api/* --exclude /blog/*

اكتشاف جميع روابط URL على موقع ويب.

/map https://docs.example.com
/map https://docs.example.com --search api --subdomains

البحث على الويب مع إمكانية استخراج النتائج اختيارياً.

/search "firecrawl web scraping" --limit 10
/search "AI tools 2026" --scrape --time month

استخراج البيانات المنظمة من صفحات الويب بواسطة نماذج اللغة الكبيرة (LLM).

/extract https://example.com "Extract the main heading and any links"
/extract https://example.com/pricing --schema '{"plans": [{"name": "string", "price": "string"}]}'

توليد ملف llms.txt لموقع ويب.

/llmstxt https://docs.example.com

يُفعَّل تلقائياً عند طلب استخراج محتوى URL، أو زحف موقع ويب، أو رسم خريطة روابط الموقع، أو البحث على الويب، أو استخراج البيانات المنظمة، أو توليد llms.txt، أو الاستخراج الجماعي لروابط متعددة، أو تحويل صفحة ويب إلى Markdown. يُفوَّض الأمر فوراً إلى وكيل firecrawl-operator.

وكيل استخراج ويب مستقل يُنفِّذ تسلسلات curl + jq على واجهة برمجة تطبيقات firecrawl المحلية. يدعم 11 بروتوكولاً تغطي جميع نقاط النهاية في الإصدار v1. وكيل للقراءة فقط (لا يدعم أدوات الكتابة أو التحرير أو الوكيل).

البروتوكولنقطة النهايةالنوع
HEALTHGET /متزامن
SCRAPEPOST /v1/scrapeمتزامن
BATCH_SCRAPEPOST /v1/batch/scrapeغير متزامن
CRAWLPOST /v1/crawlغير متزامن
CRAWL_CANCELDELETE /v1/crawl/:idمتزامن
CRAWL_ACTIVEGET /v1/crawl/activeمتزامن
CRAWL_ERRORSGET /v1/crawl/:id/errorsمتزامن
MAPPOST /v1/mapمتزامن
SEARCHPOST /v1/searchمتزامن
EXTRACTPOST /v1/extractغير متزامن
LLMSTXTPOST /v1/llmstxtغير متزامن

يتطلب المكوّن تشغيل حزمة firecrawl داخل حاوية التطوير:

المكوّنالمنفذالغرض
Firecrawl API3002جميع نقاط النهاية الخاصة بالاستخراج والزحف ورسم الخريطة والبحث والاستخراج
Playwright3000محرك تصيير JavaScript
Redis6379الخلفية لقائمة انتظار المهام
PostgreSQLsocketاستمرارية مهام الزحف والدفعات
LiteLLM proxyOPENAI_BASE_URLخلفية LLM للاستخراج (اختياري)

تبدأ الحزمة تلقائياً عند تعيين ENABLE_FIRECRAWL=true (الإعداد الافتراضي). يتحقق خطاف SessionStart من إمكانية الوصول إلى واجهة برمجة التطبيقات ويُصدر تحذيراً إذا كانت الخدمة متوقفة.

الاختلافات عن Firecrawl السحابي

Section titled “الاختلافات عن Firecrawl السحابي”

يستخدم هذا المكوّن الإصدار مفتوح المصدر المستضاف ذاتياً:

  • لا يلزم توثيق أو مفاتيح API لعمليات الاستخراج
  • لا حدود ائتمانية أو تقييد لمعدل الطلبات
  • يستخدم نقاط نهاية واجهة برمجة التطبيقات v1 (وليس v2)
  • جلسات المتصفح والبحث المعمّق غير متاحَين
  • يستخدم الاستخراج وكيل LLM الخاص بك بدلاً من النماذج المستضافة
  • يعمل بالكامل داخل شبكة الحاوية المحلية