


Comment les fichiers JAR sont-ils ajoutés à une tâche Spark à l'aide de Spark-Submit, et quelles sont les différentes options et considérations pour ce faire ?
Ajout de fichiers JAR à une tâche Spark avec Spark-Submit
Lors de l'utilisation de Spark-Submit, il existe plusieurs options pour ajouter des fichiers JAR à une tâche Spark, chacune avec ses propres implications pour le chemin de classe, la distribution des fichiers et la priorité.
Effets ClassPath
Spark-Submit influence les ClassPaths via ces options :
- spark.driver.extraClassPath ou --driver-class-path : Spécifie des chemins de classe supplémentaires pour le nœud de pilote.
- spark.executor.extraClassPath : Spécifie des chemins de classe supplémentaires pour les nœuds de travail.
Pour qu'un fichier soit inclus sur les deux ClassPaths, il doit être spécifié dans les les deux indicateurs.
Distribution des fichiers
La distribution des fichiers dépend du mode d'exécution :
- Mode client : Spark distribue les fichiers aux nœuds de travail via un serveur HTTP.
- Mode cluster : Spark ne distribue pas de fichiers et vous devez rendez-les manuellement disponibles à tous les nœuds de travail via HDFS ou un autre stockage partagé.
Formats d'URI acceptés
Spark-Submit prend en charge les préfixes d'URI suivants pour la distribution de fichiers :
- file : Servi par le serveur HTTP du pilote.
- hdfs :, http :, https :, ftp : Extrait de l'URI spécifié.
- local : Doit être un fichier local sur chaque nœud de travail.
Options concernées
Les options mentionnées dans la question affectent la gestion des fichiers JAR comme suit :
- --jars et SparkContext.addJar : options équivalentes qui n'ajoutent pas de fichiers JAR aux ClassPaths.
- SparkContext.addFile : utilisé pour les fichiers arbitraires qui ne sont pas des dépendances d'exécution.
- --conf spark.driver.extraClassPath ou - -driver-class-path : Alias pour les modifications du pilote ClassPath.
- --conf spark.driver.extraLibraryPath ou --driver-library-path : Alias pour les chemins de la bibliothèque de pilotes.
- -- conf spark.executor.extraClassPath : utilisé pour les dépendances d'exécution qui ne peuvent pas être incluses dans un über JAR.
- --conf spark.executor.extraLibraryPath : spécifie l'option java.library.path de la JVM.
Priorité
Les propriétés définies directement sur SparkConf ont la priorité la plus élevée, suivies des indicateurs Spark-Submit, puis des options dans spark-defaults.conf. Par conséquent, toutes les valeurs définies dans le code remplaceront les indicateurs ou options correspondants.
Ajout simultané de fichiers JAR
En mode client, il est sûr d'ajouter des fichiers JAR en utilisant les trois options principales :
spark-submit --jars additional1.jar,additional2.jar \ --driver-class-path additional1.jar:additional2.jar \ --conf spark.executor.extraClassPath=additional1.jar:additional2.jar \ --class MyClass main-application.jar
Cependant, en mode cluster, vous ne devez ajouter des fichiers qu'à l'aide de --jars et les distribuer manuellement vous-même aux nœuds de travail. Les arguments redondants comme la transmission de fichiers JAR à --driver-library-path doivent être évités.
Ce qui précède est le contenu détaillé de. pour plus d'informations, suivez d'autres articles connexes sur le site Web de PHP en chinois!

Outils d'IA chauds

Undresser.AI Undress
Application basée sur l'IA pour créer des photos de nu réalistes

AI Clothes Remover
Outil d'IA en ligne pour supprimer les vêtements des photos.

Undress AI Tool
Images de déshabillage gratuites

Clothoff.io
Dissolvant de vêtements AI

Video Face Swap
Échangez les visages dans n'importe quelle vidéo sans effort grâce à notre outil d'échange de visage AI entièrement gratuit !

Article chaud

Outils chauds

Bloc-notes++7.3.1
Éditeur de code facile à utiliser et gratuit

SublimeText3 version chinoise
Version chinoise, très simple à utiliser

Envoyer Studio 13.0.1
Puissant environnement de développement intégré PHP

Dreamweaver CS6
Outils de développement Web visuel

SublimeText3 version Mac
Logiciel d'édition de code au niveau de Dieu (SublimeText3)

Sujets chauds











Dépannage et solutions au logiciel de sécurité de l'entreprise qui fait que certaines applications ne fonctionnent pas correctement. De nombreuses entreprises déploieront des logiciels de sécurité afin d'assurer la sécurité des réseaux internes. ...

Solutions pour convertir les noms en nombres pour implémenter le tri dans de nombreux scénarios d'applications, les utilisateurs peuvent avoir besoin de trier en groupe, en particulier en un ...

Le traitement de la cartographie des champs dans l'amarrage du système rencontre souvent un problème difficile lors de l'exécution d'amarrage du système: comment cartographier efficacement les champs d'interface du système a ...

Commencez le printemps à l'aide de la version IntelliJideaultimate ...

Lorsque vous utilisez MyBatis-Plus ou d'autres cadres ORM pour les opérations de base de données, il est souvent nécessaire de construire des conditions de requête en fonction du nom d'attribut de la classe d'entité. Si vous manuellement à chaque fois ...

Conversion des objets et des tableaux Java: Discussion approfondie des risques et des méthodes correctes de la conversion de type de distribution De nombreux débutants Java rencontreront la conversion d'un objet en un tableau ...

Explication détaillée de la conception des tables SKU et SPU sur les plates-formes de commerce électronique Cet article discutera des problèmes de conception de la base de données de SKU et SPU dans les plateformes de commerce électronique, en particulier comment gérer les ventes définies par l'utilisateur ...

Comment la solution de mise en cache Redis réalise-t-elle les exigences de la liste de classement des produits? Pendant le processus de développement, nous devons souvent faire face aux exigences des classements, comme l'affichage d'un ...
