Data Flow

Oracle Cloud Infrastructure (OCI) Data Flow هي خدمة Apache Spark تتم إدارتها بالكامل وتقوم بتنفيذ مهام المعالجة على مجموعات البيانات الكبيرة للغاية - من دون بنية أساسية للتوزيع أو الإدارة. يمكن للمطورين أيضًا استخدام Spark Streaming لأداء الاستخراج والتحويل والتحميل السحابي على بيانات التدفق التي يتم إنتاجها باستمرار. يتيح ذلك تسليم التطبيقات بسرعة لأن المطورين يمكنهم التركيز على تطوير التطبيقات، وليس إدارة البنية الأساسية.

عرض تجريبي لـ OCI Data Flow (1:30)

ميزات Data Flow

البنية الأساسية المدارة

يعالج تدفق بيانات OCI توفير البنية الأساسية وإعداد الشبكة والتخلص منها عند اكتمال مهام Spark. كما تتم إدارة التخزين والأمان، ما يعني الحاجة إلى عمل أقل لإنشاء تطبيقات Spark وإدارتها لتحليل البيانات الكبيرة.

إدارة أسهل للمجموعات

باستخدام OCI Data Flow، لا توجد مجموعات لتثبيتها أو تصحيحها أو ترقيتها، مما يوفر الوقت والتكاليف التشغيلية للمشروعات.

تبسيط تخطيط السعة

يقوم OCI Data Flow بتشغيل كل مهمة في Spark في الموارد المخصصة الخاصة، مما يؤدي إلى التخلص من الحاجة إلى تخطيط مسبق للسعة.

تكاليف أقل

باستخدام تدفق بيانات OCI، تحتاج تكنولوجيا المعلومات فقط إلى الدفع مقابل موارد البنية الأساسية التي تستخدمها مهام Spark أثناء تشغيلها.


إمكانات دعم متطورة في التدفق

تدفق Spark من دون إدارة، والتحمل التلقائي للأخطاء، والتصحيح التلقائي.

تمكين المعالجة المستمرة

بفضل دعم Spark Streaming، يمكنك الحصول على إمكانات للاسترجاع المستمر والتوفر المستمر للبيانات المعالجة. يعالج OCI Data Flow الرفع الثقيل لمعالجة التدفق باستخدام Spark، بالإضافة إلى القدرة على إجراء التعلم الآلي على تدفق البيانات باستخدام MLLib. يدعمOCI Data Flow تخزين كائنات Oracle Cloud Infrastructure (OCI) وأي مصدر تدفق متوافق مع Kafka، بما في ذلك تدفق Oracle Cloud Infrastructure (OCI) كمصادر بيانات.

تحمل تلقائي للأعطال

تعالج Spark البيانات المتأخرة بسبب الانقطاعات المؤقتة ويمكنها التقاط البيانات المتراكمة بمرور الوقت من خلال وضع العلامات المائية - وهي ميزة في Spark تقوم بصيانة البيانات المتأخرة وتخزينها ثم تجميعها - دون الحاجة إلى إعادة تشغيل المهمة يدويًا. يقوم OCI Data Flow بإعادة تشغيل التطبيق تلقائيًا متى أمكن ويمكن للتطبيق المتابعة بسهولة من نقطة الاختبار الأخيرة.

مصادقة السحابة الأصلية

يمكن لتطبيقات تدفق OCI Data Flow استخدام مصادقة السحابة الأصلية عبر مديري الموارد حتى تتمكن التطبيقات من العمل لأكثر من 24 ساعة.


أمان وحوكمة السحابة الأصلي

الاستفادة من الأمان الذي لا مثيل له من Oracle Cloud Infrastructure. يتم التعامل مع المصادقة والعزل وجميع النقاط المهمة الأخرى. حماية البيانات المهمة للأعمال بأعلى مستويات الأمان.

أمان دقيق

يستخدم OCI Data Flow نظام Oracle Cloud لإدارة الهوية والوصول استخدامًا أصيلًا للتحكم في البيانات وصلاحيات الوصول، مما يحافظ على أمان البيانات.

الموارد المدارة

تعيين الحصص والحدود لإدارة الموارد المتاحة لـ OCI Data Flow وتكاليف التحكم.


عمليات مبسطة

يعمل OCI Data Flow على تبسيط المهام التشغيلية الشائعة مثل إدارة السجلات والوصول إلى واجهات المستخدم التشغيلية، ما يوفر وقت المطور للتركيز على إنشاء التطبيقات.

زيادة الرؤية

يسهّل OCI Data Flow رؤية ما يقوم به مستخدمو Spark من خلال تجميع المعلومات التشغيلية في واجهة مستخدم واحدة قابلة للبحث.

تصحيح الأخطاء والتشخيصات بشكل بسيط

يمكن أن يستغرق تتبع السجلات والأدوات لاستكشاف أخطاء مهمة Spark وإصلاحها ساعات، ولكن ليس من خلال عرض موحد لمخرجات السجل وخادم محفوظات Spark والمزيد.

تجنب التكاليف المستقبلية

الفرز والبحث والتصفية للتحقيق في التطبيقات التاريخية للتعامل بشكل أفضل مع المهام باهظة التكلفة وتجنب النفقات غير الضرورية.

إدارة مهام Spark الخارجة عن السيطرة.

يمكن للمسؤولين اكتشاف مهام Spark المباشرة وإيقافها بسهولة والتي تعمل لفترة طويلة جدًا أو تستهلك الكثير من الموارد وتحفيز التكاليف.


تطوير مُبسط

تتطلب النظم البيئية للبيانات الكبيرة العديد من الأجزاء والتكاملات المهمة - ولكن OCI Data Flow متوافق مع استثمارات Spark الحالية وخدمات البيانات الكبيرة، ما يسهل إدارة الخدمة وتقديم نتائجها عند الحاجة إليها.

متوافق مع التطبيقات الموجودة

قم بترحيل تطبيقات Spark الموجودة من Hadoop أو خدمات البيانات الكبيرة الأخرى.

إدارة الإنتاج الآمنة

يمكنك تسجيل مخرجات مهام Spark وتخزينها تلقائيًا وآمنًا، ثم الوصول إليها من خلال واجهة المستخدم أو واجهات برمجة تطبيقات REST لإتاحة التحليلات.

التحكم باستخدام واجهات برمجة تطبيقات REST

يمكن إدارة جميع جوانب OCI Data Flowءًا من إنشاء التطبيق وحتى التنفيذ وحتى الوصول إلى نتائج مهام Spark.


Oracle Cloud Infrastructure Data Flow يقلل التكلفة بنسبة 75%

باستخدام Oracle Cloud Infrastructure Data Flow، حققنا اتفاقيات مستوى الخدمة (SLA) للعملاء من خلال تقليل الوقت اللازم لمعالجة البيانات بنسبة 75% وخفض التكلفة بأكثر من 300%.

Arun Nimmala، مدير التسليم بنية التحليلات وتكامل الخدمات العالمية، Oracle

المزايا الرئيسية لـ OCI Data Flow

  • تسريع عمليات سير العمل باستخدام NVIDIA RAPIDS

    يتم دعم NVIDIA RAPIDS Accelerator لـ Apache Spark في تدفق بيانات OCI للمساعدة على تسريع عمليات سير عمل الذكاء الاصطناعي وتعلم البيانات والتعلم الآلي.

    تفريغ عبء أعمال الاستخراج والتحويل والتحميل

    يدير تدفق البيانات تفريغ عبء أعمال الاستخراج والتحويل والتحميل من خلال الإشراف على مهام Spark وتحسين التكلفة وتوفير السعة.

  • الأرشيف النشط

    تعمل إمكانات إدارة مخرجات تدفق البيانات على تحسين القدرة على الاستعلام عن البيانات باستخدام Spark.

  • أحمال عمل لا يمكن التنبؤ بها

    يمكن تحويل الموارد تلقائيًا للتعامل مع المهام التي لا يمكن التنبؤ بها وتقليل التكاليف. توفر لوحة المعلومات طريقة عرض للاستخدام والميزانية لأغراض التخطيط في المستقبل.

  • تدريب نموذج التعلم الآلي

    يمكن لمطوري التعلم الآلي وSpark استخدام مكتبة التعلم الآلي Spark وتشغيل النماذج بكفاءة أكبر باستخدام Data Flow.

  • Spark Streaming

    احصل على دعم Spark Streaming مع عدم وجود إدارة وتجاوز تلقائي للأخطاء مع أنظمة متكاملة ومرة واحدة فقط للتصحيح التلقائي.

    اقرأ عن بعض حالات الاستخدام المذكورة أعلاه

منتجات السحابة ذات الصلة

Oracle Cloud Infrastructure Data Science

التعلم الآلي الشامل

Oracle Cloud Infrastructure Data Catalog

اكتشاف بيانات الخدمة الذاتية

Oracle Autonomous Data Warehouse

خدمة مستودع بيانات السحابة

Oracle Cloud Infrastructure Object Storage

إنشاء بحيرة البيانات لديك

بدء استخدام OCI Data Flow


سجِّل الاشتراك للحصول على تجربة مجانية

سجِّل الاشتراك في حساب Oracle Cloud وجرّب خدمة Data Flow مجانًا.


الحصول على التدريب

تعرف على Oracle Cloud Infrastructure Data Flow.


التمارين العملية

قم بتجربة المنتج المباشر مجانًا.


الاتصال بالمبيعات

تحدث إلى عضو فريق حول Oracle Cloud Infrastructure Data Flow.