Flux de données

Oracle Infrastructure Cloud (OCI) Flux de données est un service Apache Spark entièrement géré qui effectue des tâches de traitement sur des ensembles de données extrêmement volumineux, sans infrastructure à déployer ou à gérer. Les développeurs peuvent également utiliser Streaming Spark pour effectuer une opération ETL cloud sur leurs données de diffusion en continu. Cela permet une livraison rapide des applications car les développeurs peuvent se concentrer sur le développement des applications, et non sur la gestion des infrastructures.

Démonstration d'OIC Flux de données (1:30)

Fonctionnalités de flux de données

Infrastructure gérée

OIC Flux de données s’occupe de la mise en place de l’infrastructure, de la configuration du réseau et du démontage lorsque les tâche Spark sont terminées. Le stockage et la sécurité sont également gérés, ce qui signifie qu’il faut moins de travail pour créer et gérer les applications Spark pour l’analyse de Big Data.

Gestion de cluster simplifiée

Avec OIC Flux de données, il n’y a pas de clusters à installer, à corriger ou à mettre à niveau, ce qui permet de gagner du temps et de réduire les coûts opérationnels des projets.

Planification simplifiée des capacités

OIC Flux de données exécute chaque tâche Spark avec des ressources privées spécialisées, ce qui élimine la nécessité d’une planification initiale des capacités.

Coûts réduits

Avec OIC Flux de données, le service informatique ne doit payer que les ressources d’infrastructure utilisées par les tâches Spark lorsqu’elles sont en cours d’exécution.


Fonctionnalités avancées de prise en charge de la diffusion en continu

Streaming Spark avec gestion zéro, tolérance automatique aux pannes et correctifs automatiques.

Activer le traitement continu

Grâce à la prise en charge de Streaming Spark, vous bénéficiez de fonctionnalités d'extraction continue et de disponibilité continue des données traitées. OIC Flux de données gère les tâches lourdes liées au traitement de flux avec Spark, ainsi que la possibilité d'effectuer du machine learning sur les données transmises en continu à l'aide de MLLib. OIC Flux de données prend en charge Oracle Infrastructure Cloud (OIC) Stockage d'objets et toute source de transmission en continu compatible avec Kafka, y compris Oracle Infrastructure Cloud (OCI) Streaming, comme sources et récepteurs de données.

Tolérance automatique aux pannes

Spark gère les données arrivant en retard en raison de pannes et peut rattraper les données en retard au fil du temps grâce au filigrane, une fonctionnalité de Spark qui maintient, stocke et regroupe les données en retard, sans qu'il soit nécessaire de relancer manuellement le travail. OIC Flux de données redémarre automatiquement l'application lorsque cela est possible et l'application peut simplement continuer à partir du dernier point de contrôle.

Authentification cloud native

Les applications OIC Flux de données Streaming peuvent utiliser l'authentification cloud native via des principaux de ressource afin que les applications puissent fonctionner pendant plus de 24 heures.


Sécurité et gouvernance Cloud natives

Tirez parti de la sécurité inégalée d’Oracle Infrastructure Cloud. L’authentification, l’isolement et tous les autres points critiques sont traités. Protégez les données critiques avec les plus hauts niveaux de sécurité.

Sécurité granulaire

OIC Flux de données utilise nativement le système Gestion des identités et des accès d’Oracle Cloud pour contrôler les données et l’accès, afin que les données restent sécurisées.

Ressources gérées

Définissez des quotas et des limites pour gérer les ressources disponibles pour OIC Flux de données et contrôler les coûts.


Opérations simplifiées

OIC Flux de données simplifie les tâches opérationnelles courantes telles que la gestion des journaux et l’accès aux interfaces utilisateur opérationnelles, libérant ainsi le temps des développeurs pour se concentrer sur la création d’applications.

Visibilité accrue

OIC Flux de données permet de voir facilement ce que font les utilisateurs de Spark en regroupant les informations opérationnelles dans une seule interface utilisateur interrogeable.

Débogage et diagnostic simples

Le suivi des journaux et des outils pour dépanner une tâche Spark peut prendre des heures, mais pas avec une vue consolidée de la sortie du journal, le serveur d’historique Spark, etc.

Évitez les coûts futurs

Triez, recherchez et filtrez pour étudier les applications historiques afin de mieux gérer les travaux coûteux et éviter les dépenses inutiles.

Gérez les emplois fugitifs Spark

Les administrateurs peuvent facilement découvrir et arrêter les tâches Spark en direct qui s’exécutent depuis trop longtemps ou qui consomment trop de ressources et qui augmentent les coûts.


Développement simplifié

Les écosystèmes de Big Data nécessitent de nombreuses pièces mobiles et intégrations, mais OIC Flux de données est compatible avec les investissements Spark existants et les services de Big Data, ce qui permet de gérer facilement le service et de fournir ses résultats là où ils sont nécessaires.

Compatible avec les applications existantes

Migrez les applications Spark existantes à partir de Hadoop ou d’autres services Big Data.

Gestion sécurisée des sorties

Capturez automatiquement et en toute sécurité les résultats des tâches Spark, puis accédez-y via l’interface utilisateur ou les API REST pour rendre les analyses disponibles.

Contrôle avec les API REST

Tous les aspects du flux de données OIC peuvent être gérés à l’aide de simples API REST, de la création de l’application à l’exécution en passant par l’accès aux résultats des tâches Spark.


Oracle Infrastructure Cloud Flux de données réduit les coûts de 75 %

Avec Oracle Infrastructure Cloud Flux de données, nous avons respecté les SLA client en réduisant le temps nécessaire au traitement des données de 75 % et en réduisant le coût de plus de 300 %.

Arun Nimmala, Directeur d’exécutionIntégration des services globaux et architecture analytique, Oracle

OIC Flux de données - Principaux avantages

  • Accélérez vos workflows avec NVIDIA RAPIDS

    L'accélérateur NVIDIA RAPIDS pour Apache Spark dans OIC Flux de données est pris en charge pour aider à accélérer les workflows de science des données, de machine learning et d'IA.

    Déchargement ETL

    Flux de données gère le déchargement ETL en supervisant les tâches Spark, en optimisant les coûts et en libérant de la capacité.

  • Archives actives

    Les capacités de gestion des sorties de Flux de données optimisent la capacité d'interroger les données à l'aide de Spark.

  • Charges de travail imprévisibles

    Les ressources peuvent être automatiquement transférées pour gérer des tâches imprévisibles et réduire les coûts. Un tableau de bord fournit une vue de l’utilisation et du budget à des fins de planification future.

  • Formation aux modèles de machine learning

    Les développeurs Spark et de machine learning peuvent utiliser la bibliothèque de Spark et exécuter des modèles plus efficacement à l'aide de Flux de données.

  • Streaming Spark

    Bénéficiez de la prise en charge de Streaming Spark sans aucune gestion et avec une tolérance automatique aux pannes et des garanties de bout en bout, une fois exactement et une application automatique des correctifs.

    En savoir plus sur certains des cas d'utilisation ci-dessus

Produits cloud associés

Oracle Infrastructure Cloud Data Science

Machine learning de bout en bout

Oracle Infrastructure Cloud Catalogue de données

Fonction en libre accès de découverte des données

Oracle Entrepôt de données autonome

Service Cloud de data warehouse

Oracle Infrastructure Cloud Stockage d'objet

Construisez votre lac de données

Lancez-vous avec OIC Flux de données


Inscrivez-vous pour un essai gratuit

Inscrivez-vous au compte Oracle Cloud et essayez gratuitement le service Flux de données.


Obtenez une formation

En savoir plus sur Oracle Infrastructure Cloud Flux de données.


Atelier pratique

Découvrez le produit en direct, gratuitement.


Contactez l’équipe commerciale

Parlez d’Oracle Infrastructure Cloud Flux de données à un membre de l’équipe.