Les formations en direct animées par un instructeur, disponibles en ligne ou sur site, vous permettent de découvrir, par la pratique, comment utiliser Python et Spark ensemble pour analyser les mégadonnées (big data).
La formation PySpark est proposée en mode « formation en ligne en direct » ou « formation sur site en direct ». La formation en ligne en direct (également appelée « formation à distance en direct ») s'effectue via un bureau à distance interactif et bureau à distance. La formation sur site en direct peut être dispensée localement sur les installations du client dans Lyon ou dans les centres de formation corporate de NobleProg situés dans Lyon.
NobleProg -- Votre prestataire de formation local
Lyon, Gare Lyon Part-Dieu
NobleProg Lyon, 10 Place Charles Béraudier, Lyon, france, 69000
Situé à 200 mètres de la gare TGV, la Tour Suisse est l'immeuble de bureaux le plus emblématique de ce secteur de Lyon. Le centre d'affaires vous propose un lieu de qualité pour vos formations, séminaires et réunions.
Gares TGV
Gare TGV Part-Dieu à 100 mètres, sortie porte du Rhône
Aéroport
Lyon Saint Exupéry (Satolas) à 30 minutes
Rhône Express depuis l’aéroport Saint Exupéry
Cette formation en direct, animée par un formateur sur Lyon, couvre la plateforme Stratio, en mettant l'accent sur les modules Rocket et Intelligence avec PySpark. Les participants maîtriseront l'ingestion, la transformation et l'analyse avancée des données, acquérant des compétences pratiques dans les boucles, les UDF et les flux de données d'entreprise.
Dans cette formation en direct animée par un instructeur à Lyon, les participants apprendront comment utiliser conjointement Python et Spark pour analyser le Big Data, en s'appuyant sur des exercices pratiques.
À l'issue de cette formation, les participants seront en mesure de :
Apprendre à utiliser Spark avec Python pour analyser le Big Data.
Réaliser des exercices qui reproduisent des cas réels.
Utiliser différents outils et techniques pour l'analyse du Big Data au moyen de PySpark.
Ce formation en présentiel (en ligne ou sur site) s'adresse aux ingénieurs des données, analystes de données et professionnels des données souhaitant utiliser Databricks et PySpark pour créer des pipelines de données évolutifs et migrer leurs workflows SQL existants.
Cette formation offre une introduction pratique à la construction de workflows évolutifs de traitement de données et de Machine Learning utilisant PySpark. Les participants découvrent le fonctionnement d'Apache Spark au sein des écosystèmes modernes de Big Data et apprennent à traiter efficacement de grands volumes de données grâce aux principes du calcul distribué.
Ce cours pratique de trois jours se concentre sur la conception et l'optimisation de charges de travail de traitement de données efficaces à l'aide de PySpark, Pandas et Polars dans des environnements basés sur Kubernetes.
Les participants développeront une compréhension pratique de l'exécution des applications Spark sur Kubernetes et de la manière dont les décisions de configuration au niveau applicatif influencent les performances, la scalabilité, la consommation de ressources et les coûts. Le cours couvre des domaines clés d'optimisation, notamment la taille des exécuteurs, l'allocation de la mémoire, l'allocation dynamique, les stratégies de partitionnement, le comportement du shuffle, les problèmes de petits fichiers et le traitement efficace de Parquet.
Le cours aborde également les défis courants liés à l'utilisation de Pandas, tels que les limitations de mémoire et les erreurs de dépassement de mémoire, et introduit Polars comme alternative haute performance pour certaines charges de travail de traitement de données. À travers des exercices pratiques, les participants diagnostiqueront les problèmes de performance et de mémoire, compareront différentes stratégies de configuration et appliqueront des techniques d'optimisation à des scénarios réalistes d'ETL et d'apprentissage automatique.
La priorité tout au long du cours est donnée à la prise de décision pratique : comprendre comment identifier les goulets d'étranglement, sélectionner l'outil approprié, configurer Spark efficacement et trouver l'équilibre entre les performances et la consommation de ressources d'infrastructure et les coûts.
En savoir plus...
Dernière Mise À Jour:
Nos clients témoignent (1)
J'ai aimé qu'il soit pratique. J'ai adoré appliquer les connaissances théoriques avec des exemples pratiques.
Aurelia-Adriana - Allianz Services Romania
Formation - Python and Spark for Big Data (PySpark)
PySpark formation à Lyon, Weekend PySpark cours à Lyon, Soir PySpark formation à Lyon, PySpark formateur en ligne à Lyon, PySpark formation à Lyon, PySpark cours du soir à Lyon, PySpark formation Intra à Lyon, PySpark formation Intra Entreprise à Lyon, PySpark formation Inter à Lyon, PySpark formation Inter Entreprise à Lyon, PySpark sur place à Lyon, PySpark cours particuliers à Lyon, PySpark préparation aux examens à Lyon, PySpark entraînement à Lyon, PySpark coach à Lyon, PySpark cours privé à Lyon, PySpark professeur à Lyon,PySpark cours à Lyon, PySpark instructeur à Lyon, PySpark préparation à Lyon, PySpark coaching à Lyon, Soir PySpark cours à Lyon, PySpark stage de préparation à Lyon, Weekend PySpark formation à Lyon, PySpark formateur à Lyon