لماذا تغيّرت فاتورة Datadog في 2026
يُفوتر Datadog بحسب المضيف وبالجيجابايت للسجلات المستوعَبة وبالـspan لـAPM. في 2026، تضمّنت التجديدات زيادات سنوية من 5 إلى 10% على كل محور من هذه المحاور، وبالنسبة للفرق التي فعّلت وحدات متعددة (البنية التحتية والسجلات وـAPM والأمن)، أنتج التأثير التراكمي زيادات فعلية من 30 إلى 50% من تجديد إلى آخر.
الحالة الأكثر استشهادًا هي حالة غابرييل أنهايا (dev.to، أبريل 2026): فريق تجاوزت فاتورة Datadog لديه 50,000 دولار سنويًا، مما أطلق التدقيق الذي أفضى إلى الترحيل نحو Prometheus وGrafana وLoki. التوفير الصافي في تراخيص البرمجيات: 100%. تكلفة الاستبدال: VPS مخصص لحزمة المراقبة.
Datadog مقابل حزمة Prometheus / Grafana / Loki
| المعيار | Datadog | الحزمة ذاتية الاستضافة |
|---|---|---|
| تكلفة البرمجيات | من 15 إلى 150 دولار / مضيف / شهر حسب الوحدات | 0 دولار (تراخيص مفتوحة المصدر) |
| تكلفة البنية التحتية | مدرجة في الفوترة | 99 درهم/شهر / شهر (VPS بنواتَين / 4 جيجا) |
| المقاييس | Datadog Agent | Prometheus + Node Exporter |
| السجلات | Datadog Logs (بالجيجابايت) | Loki + Promtail (تخزين محلي) |
| لوحات القيادة | واجهة Datadog المتكاملة | Grafana (آلاف القوالب) |
| التنبيهات | Datadog Monitors | Alertmanager + Grafana Alerting |
| APM / التتبع | Datadog APM (مدمج) | Tempo + OpenTelemetry (يتطلب إعدادًا) |
| ربط السجلات بالمقاييس | تلقائي | يدوي عبر ملصقات Loki / Prometheus |
| صيانة العمليات | معدومة (SaaS مُدار) | على عاتقك (تحديثات، تخزين) |
مكوّنات الاستبدال
تُغطي الحزمة الركائز الثلاث للمراقبة: المقاييس (Prometheus)، والسجلات (Loki)، والتصوير البياني والتنبيهات (Grafana + Alertmanager). للتتبع، يُكمل Tempo الصورة عبر OpenTelemetry — لكنه مكوّن رابع، مُغطَّى في المقال المخصص opentelemetry-grafana-tempo-vps.
Prometheus يجمع المقاييس عبر فحص HTTP: تعرض الـexporters نقاط نهاية /metrics، يستعلم عنها Prometheus بشكل دوري ويخزّن السلاسل الزمنية. Node Exporter يستبدل عميل Datadog لمقاييس النظام (المعالج، الذاكرة، القرص، الشبكة). Loki يخزّن السجلات بفهرس محدود (ملصقات فقط، لا نص كامل) — وهذا ما يُتيح له العمل بذاكرة RAM قليلة. Promtail يجمع ملفات السجلات ويُرسلها إلى Loki، تمامًا كعميل Datadog Logs. Grafana يُصوّر مقاييس Prometheus وسجلات Loki في لوحات قيادة موحّدة. Alertmanager يستقبل تنبيهات Prometheus ويوجّهها نحو قنوات الإشعارات.
الترحيل في 6 خطوات
تثبيت Prometheus وNode Exporter
ابدأ بمقاييس النظام: هذا هو الاستبدال الأكثر مباشرة لعميل Datadog. انشر Prometheus وNode Exporter عبر Docker Compose. يُغطي المقال installer-prometheus-vps هذه الخطوة بالتفصيل. تحقق أن Prometheus يفحص Node Exporter قبل المتابعة: افتح http://your-ip:9090/targets وتأكد أن الحالة UP. شغّل النظامَين بالتوازي لأسبوع على الأقل قبل إيقاف Datadog.
نشر Loki وPromtail
Loki يستقبل السجلات، Promtail يجمعها من ملفات السجلات على خادمك. أضف كلا الخدمتين إلى docker-compose.yml. اضبط Promtail للإشارة إلى ملفات سجلاتك (/var/log/syslog، سجلات التطبيقات). تحقق من الاستيعاب في Grafana قبل تعطيل جمع السجلات في عميل Datadog.
إعداد Grafana
Grafana هو محور الحزمة: يربط Prometheus (المقاييس) وLoki (السجلات) كمصادر بيانات. بمجرد إضافة كلا المصدرَين، استورد لوحات القيادة المجتمعية من grafana.com/grafana/dashboards — لوحة قيادة Node Exporter Full (الرقم 1860) هي المرجع لمقاييس النظام. أعد إنشاء لوحات القيادة في Grafana التي يُراجعها فريقك يوميًا من Datadog.
ترحيل التنبيهات نحو Alertmanager
صدّر قائمة مراقبي Datadog لديك (عبر API Datadog أو الواجهة). أعد إنشاء التنبيهات الحرجة في Prometheus (قواعد PrometheusRule) أو في Grafana Alerting. يعالج Alertmanager التوجيه نحو قنوات إشعاراتك: اضبط المستقبلات في alertmanager.yml.
التحقق بالتوازي على مدى أسبوعين
لا تقطع Datadog قبل أن يكون لديك أسبوعان من البيانات في حزمتك ذاتية الاستضافة. قارن المقاييس الرئيسية بين المصدرَين. شغّل يدويًا بعض تنبيهات الاختبار في Alertmanager. تحقق أن Loki يستقبل سجلات الإنتاج بشكل صحيح.
إيقاف Datadog واسترداد الفاتورة
بمجرد اكتمال التحقق، عطّل عميل Datadog على كل مضيف، ثم ألغِ اشتراكات وحدات Datadog بترتيب عكسي لأهميتها. احتفظ ببيانات Datadog التاريخية متاحة لمدة 30 يومًا بعد الإلغاء — صدّر لوحات القيادة والتقارير الحرجة قبل هذا الموعد.
المتطلبات المسبقة وموارد VPS
تعمل الحزمة الكاملة (Prometheus + Node Exporter + Loki + Promtail + Grafana + Alertmanager) على VPS بنواتَين / 4 جيجابايت RAM لمراقبة من مضيف إلى خمسة مضيفين مع احتفاظ بالمقاييس 15 يومًا. هذا هو الحد الأدنى الموصى به: دونه يبدأ Prometheus بالضغط تحت استعلامات Grafana.
للاحتفاظ بمدة أطول (30 إلى 90 يومًا) أو حجم سجلات مرتفع (أكثر من 10 جيجابايت يوميًا)، خطّط لـ4 نوى / 8 جيجابايت وحجم تخزين SSD إضافي.
البرمجيات المطلوبة: Docker وDocker Compose (إصدار حديث)، وكيل عكسي (Nginx أو Caddy) لعرض Grafana عبر HTTPS، ونطاق أو نطاق فرعي لـGrafana. افتح منفذ HTTPS فقط للخارج — لا يجب أن يكون Prometheus وLoki وAlertmanager مكشوفين علنيًا.
قائمة التحقق قبل البدء
- VPS بنواتَين / 4 جيجابايت RAM على الأقل، مع Docker وDocker Compose مثبّتَين.
- حجم تخزين إضافي مُحجَّم وفق الاحتفاظ المطلوب (15 جيجابايت كحد أدنى لـ30 يومًا).
- قائمة شاملة بمراقبي Datadog النشطين، مُصدَّرة قبل أي قطع.
- قائمة بلوحات قيادة Datadog التي يستخدمها الفريق مع لقطات شاشة مرجعية.
- قنوات الإشعارات (Slack webhook، عناوين البريد، مفتاح PagerDuty) جاهزة لإعداد Alertmanager.
- صلاحية كتابة على ملفات سجلات التطبيقات على كل مضيف مُراقَب (لـPromtail).
- نافذة ترحيل لأسبوعَين مخطَّطة مع الفريق — تعمل الحزمة ذاتية الاستضافة بالتوازي مع Datadog خلال هذه الفترة.
ما لا تفعله الحزمة ذاتية الاستضافة
ثلاثة قيود يجب قبولها قبل الترحيل.
لا ربط APM نصيًا. يُحدد Datadog تلقائيًا أثرًا بطيئًا ويربطه بمقاييس المضيف والسجلات المرتبطة. مع الحزمة مفتوحة المصدر، يتم هذا الربط يدويًا عبر الملصقات المشتركة — قابل للتطبيق لكنه يتطلب عمل إعداد.
الصيانة على عاتقك. تحديثات Prometheus وLoki وGrafana، إدارة التخزين مع نمو Loki، التنبيهات على الحزمة نفسها. خصّص ساعتَين إلى أربع ساعات شهريًا للعمليات الروتينية.
واجهة أقل تكاملًا. Datadog منتج واحد بتجربة مستخدم موحّدة. الحزمة مفتوحة المصدر تجميع: Grafana للتصوير، Alertmanager لتوجيه التنبيهات، واجهات منفصلة لكل مكوّن. للفريق المعتاد على Datadog، يستغرق الإلمام به بضعة أيام.
استكشاف الأخطاء الشائعة وإصلاحها
Prometheus لا يفحص Node Exporter. تحقق أن شبكة Docker بين الحاوييتَين صحيحة (نفس شبكة Docker Compose) وأن المنفذ 9100 لا تحجبه ufw. افتح http://node-exporter:9100/metrics من داخل حاوية Prometheus لتأكيد إمكانية الوصول.
Loki يستقبل السجلات لكن Grafana لا يعرض شيئًا. استكشاف Loki في Grafana يتطلب فلتر ملصق كحد أدنى — استعلام {} بدون ملصق يُعيد خطأ حصة. استخدم {job="varlogs"} كنقطة بداية.
Grafana بطيء على نطاقات زمنية طويلة. يخزّن Prometheus السلاسل الزمنية في الذاكرة قبل الكتابة على القرص. على VPS بـ2 جيجابايت RAM، اقصر الاحتفاظ على 15 يومًا وخفّض الدقة باستخدام معامل step في لوحات Grafana.
Alertmanager لا يُرسل الإشعارات. يجب أن تصل تنبيهات Prometheus إلى حالة firing قبل توجيهها لـAlertmanager. تحقق من تبويب Alerts في واجهة Prometheus وتأكد من تحميل قواعد التنبيه.