f5xc-firecrawl
يوفر مكوّن f5xc-firecrawl استخراج الويب المحلي المستضاف ذاتياً
عبر محرك firecrawl مفتوح المصدر.
لا مفاتيح API، ولا اشتراكات، ولا اعتماد على السحابة. تعمل جميع
العمليات على مثيل firecrawl المحلي على localhost:3002
داخل حاوية التطوير.
التثبيت
Section titled “التثبيت”/plugin install f5xc-firecrawl@f5-sales-demo-marketplaceالأوامر
Section titled “الأوامر”/scrape
Section titled “/scrape”استخراج محتوى URL واحد وتحويله إلى Markdown.
/scrape https://docs.example.com/getting-started/scrape https://example.com --format markdown,links --wait 2000/batch-scrape
Section titled “/batch-scrape”استخراج محتوى عدة روابط URL في وقت واحد.
/batch-scrape https://example.com https://example.org https://example.net/crawl
Section titled “/crawl”زحف صفحات متعددة انطلاقاً من URL ابتدائي.
/crawl https://docs.example.com --limit 20 --depth 2/crawl https://docs.example.com --include /api/* --exclude /blog/*اكتشاف جميع روابط URL على موقع ويب.
/map https://docs.example.com/map https://docs.example.com --search api --subdomains/search
Section titled “/search”البحث على الويب مع إمكانية استخراج النتائج اختيارياً.
/search "firecrawl web scraping" --limit 10/search "AI tools 2026" --scrape --time month/extract
Section titled “/extract”استخراج البيانات المنظمة من صفحات الويب بواسطة نماذج اللغة الكبيرة (LLM).
/extract https://example.com "Extract the main heading and any links"/extract https://example.com/pricing --schema '{"plans": [{"name": "string", "price": "string"}]}'/llmstxt
Section titled “/llmstxt”توليد ملف llms.txt لموقع ويب.
/llmstxt https://docs.example.comالمهارات
Section titled “المهارات”web-scraper
Section titled “web-scraper”يُفعَّل تلقائياً عند طلب استخراج محتوى URL، أو زحف موقع ويب، أو رسم خريطة روابط الموقع، أو البحث على الويب، أو استخراج البيانات المنظمة، أو توليد llms.txt، أو الاستخراج الجماعي لروابط متعددة، أو تحويل صفحة ويب إلى Markdown. يُفوَّض الأمر فوراً إلى وكيل firecrawl-operator.
الوكلاء
Section titled “الوكلاء”firecrawl-operator
Section titled “firecrawl-operator”وكيل استخراج ويب مستقل يُنفِّذ تسلسلات curl + jq
على واجهة برمجة تطبيقات firecrawl المحلية. يدعم 11 بروتوكولاً تغطي جميع
نقاط النهاية في الإصدار v1. وكيل للقراءة فقط (لا يدعم أدوات الكتابة أو التحرير أو الوكيل).
| البروتوكول | نقطة النهاية | النوع |
|---|---|---|
| HEALTH | GET / | متزامن |
| SCRAPE | POST /v1/scrape | متزامن |
| BATCH_SCRAPE | POST /v1/batch/scrape | غير متزامن |
| CRAWL | POST /v1/crawl | غير متزامن |
| CRAWL_CANCEL | DELETE /v1/crawl/:id | متزامن |
| CRAWL_ACTIVE | GET /v1/crawl/active | متزامن |
| CRAWL_ERRORS | GET /v1/crawl/:id/errors | متزامن |
| MAP | POST /v1/map | متزامن |
| SEARCH | POST /v1/search | متزامن |
| EXTRACT | POST /v1/extract | غير متزامن |
| LLMSTXT | POST /v1/llmstxt | غير متزامن |
البنية التحتية
Section titled “البنية التحتية”يتطلب المكوّن تشغيل حزمة firecrawl داخل حاوية التطوير:
| المكوّن | المنفذ | الغرض |
|---|---|---|
| Firecrawl API | 3002 | جميع نقاط النهاية الخاصة بالاستخراج والزحف ورسم الخريطة والبحث والاستخراج |
| Playwright | 3000 | محرك تصيير JavaScript |
| Redis | 6379 | الخلفية لقائمة انتظار المهام |
| PostgreSQL | socket | استمرارية مهام الزحف والدفعات |
| LiteLLM proxy | OPENAI_BASE_URL | خلفية LLM للاستخراج (اختياري) |
تبدأ الحزمة تلقائياً عند تعيين ENABLE_FIRECRAWL=true (الإعداد
الافتراضي). يتحقق خطاف SessionStart من إمكانية الوصول إلى واجهة برمجة التطبيقات
ويُصدر تحذيراً إذا كانت الخدمة متوقفة.
الاختلافات عن Firecrawl السحابي
Section titled “الاختلافات عن Firecrawl السحابي”يستخدم هذا المكوّن الإصدار مفتوح المصدر المستضاف ذاتياً:
- لا يلزم توثيق أو مفاتيح API لعمليات الاستخراج
- لا حدود ائتمانية أو تقييد لمعدل الطلبات
- يستخدم نقاط نهاية واجهة برمجة التطبيقات v1 (وليس v2)
- جلسات المتصفح والبحث المعمّق غير متاحَين
- يستخدم الاستخراج وكيل LLM الخاص بك بدلاً من النماذج المستضافة
- يعمل بالكامل داخل شبكة الحاوية المحلية