La formation alterne exposés théoriques courts et exercices pratiques sur notebooks Jupyter. Chaque concept est immédiatement mis en application. J'attache une attention particulière à ce que chaque participant suive, quel que soit son niveau initial, et je calibre la profondeur de chaque sujet en fonction du groupe.
Les supports sont fournis aux participants à l'issue de la formation, accompagnés des notebooks d'exercices corrigés.
ndarray de NumPy : création, indexation, slicing, reshapinggroupby, merge, pivotIl n'y a pas d'évaluation dans cette formation.
Directeur de Recherche à Inria, j'utilise Python depuis plus de 20 ans dans mes propres travaux de recherche, sur des données à très grande échelle : analyse complète du graphe social de Twitter (505 millions de comptes, 23 milliards de liens), traitement de l'intégralité du graphe de transactions Bitcoin (16,5 milliards de liens, 1,5 milliard d'adresses), mesures massives d'exposition aux ondes radio. Ces travaux ont donné lieu à une couverture par le New York Times, le Washington Post, Fortune et Le Monde. Quand j'enseigne Polars, le streaming engine ou les pièges du parallélisme, ce sont les outils que j'utilise au quotidien.
Co-créateur en 2014 avec Thierry Parmentelat du MOOC Python sur la plateforme FUN, suivi par plus de 200 000 inscrits et utilisé par Sorbonne Université et CentraleSupélec. Les supports et la progression pédagogique sont éprouvés sur un public extrêmement varié, du débutant complet au développeur expérimenté qui souhaite consolider ses fondations. Cette diversité m'a appris à identifier rapidement le niveau réel d'une équipe et à adapter le rythme en conséquence.
La spécificité de mon catalogue : aller au-delà de la data science d'introduction. Polars vs Pandas sur des volumes qui dépassent la RAM, parallélisme CPU-bound, accélération JIT avec Numba, gestion mémoire fine. Ce sont les sujets qui distinguent une équipe qui prototype d'une équipe qui livre en production. Les supports évoluent en continu pour suivre l'écosystème — nouvelles versions de Polars, évolutions du streaming engine, bonnes pratiques émergentes — parce que c'est aussi mon terrain de recherche au quotidien.
Public cible
Data scientists, ingénieurs, chercheurs et doctorants souhaitant maîtriser les outils Python fondamentaux pour l'analyse de données.
Prérequis
Maîtrise intermédiaire de Python : fonctions, itération, espaces de nommage, importation de modules. Si vos équipes n'ont pas ce niveau, je propose une mise à niveau Python en complément — voir le bloc Vos équipes ont-elles le niveau Python requis ? ci-dessus.
Tous publics
ndarray : structure mémoire, dtype, dimensions. Création de tableaux, slicing, reshaping, indexation avancée. Vectorisation et ufuncs. Broadcasting : règles et applications. Fonctions d'agrégation et de tri. Présentation de SciPy.concat, groupby, merge/join, pivot table. Gestion des dates et séries temporelles : DatetimeIndex, resample, rolling. Format Parquet : compression, partitionnement, interopérabilité avec PyArrow.relplot), de distribution (displot), catégoriels (catplot). Visualisations multivariées : distplot, pairplot. Personnalisation : thèmes, palettes, export de figures publiables.Sur la même thématique
Chambre de Commerce
et d’industrie Nice Côte d’Azur
20 Boulevard Carabacel
CS 11259
06005 NICE CEDEX 1