Open to work · CDI/CDD Data Engineer · Oct. 2026

martin.prevot

> |

Cliquez sur une base de données pour explorer

À propos

Data Engineer
en devenir

En formation Data Engineering & IA à Efrei Paris (diplôme prévu octobre 2026), j'accumule depuis trois ans une expérience chez SNCF d'abord en tant que développeur chez Réseau, puis sur la data chez Voyageurs.

Je m'intéresse particulièrement aux pipelines de données modernes, à l'orchestration avec Spark/Kafka, et aux architectures cloud AWS & Azure.

📍 Paris / Île-de-France 🎓 Efrei Paris · Oct. 2026 💼 Dispo Oct. 2026
martin.profile.py
class MartinPrevot:
  def __init__(self):
    self.role    = "Data Engineer"
    self.school  = "Efrei Paris"
    self.company = "SNCF Voyageurs"
    self.stack   = [
      "Python", "Spark",
      "AWS", "Kafka", "SQL"
    ]
    self.available = True

  def hire_me(self):
    return "martin@prevot.cloud"

Projets

Data Scientist

Churn Prediction System

Pipeline ML complet pour prédire le churn client : ingestion, feature engineering, entraînement et une API de scoring déployée en production.

PythonScikit-learnFastAPIPostgreSQLDocker
Data Analyst

AI Finance Dashboard

Dashboard Streamlit pour gérer ses finances perso : extraction automatique des relevés PDF, catégorisation par Gemini AI et 6 visualisations interactives.

PythonStreamlitPlotlyGemini AIpdfplumber
Data Engineer

Crypto Price Pipeline

Suivi de 50+ cryptos en temps réel : ingestion batch Binance, flux live CoinGecko, stockage TimescaleDB et API FastAPI, orchestré avec Airflow.

PythonFastAPITimescaleDBAirflowDocker
Data Engineer

Datalake Lambda Architecture

Architecture Lambda from scratch avec un batch layer HDFS/Spark et un speed layer Kafka + Spark Streaming pour le traitement en temps réel.

KafkaSparkHDFSDocker
Data Engineer

Pokémon Scraper & API

Scraping structuré de données Pokémon, stockage PostgreSQL et exposition via une API REST Jakarta EE avec pagination et filtres.

PythonBeautifulSoupJakarta EEPostgreSQL
Data Scientist

NLP News Classification

Benchmark de 8 pipelines NLP sur le BBC News Dataset : CountVectorizer, TF-IDF, Word2Vec, avec des modèles ML classiques et du Deep Learning (BiLSTM).

PythonNLTKKerasTensorFlow
Data Analyst

Dashboard Transilien KPIs

Tableaux de bord Power BI pour les KPIs Transilien, avec automatisation Python/VBA et intégration dans SharePoint et Power Apps.

Power BIDAXPythonVBASharePoint

Stack technique

Langages & Frameworks

PythonDjangoSQLAlchemyPandasScikit-learnSQLRScalaJavaScriptPHPVBA

Data Engineering & Big Data

Apache SparkHadoopKafkaDatabricksArchitecture ETLSpark SQL

Cloud & DevOps

AWS S3AWS EC2AWS RDSAWS GlueAWS AthenaAzureGitDockerBoto3

Data Visualisation & BI

Power BITableauPlotlyStreamlitAWS QuickSightDAX

Bases de données

PostgreSQLMySQLMongoDBBigQuery

Outils & Écosystème

Microsoft 365Power AutomatePower AppsSharePointMéthode Agile/Scrum

Expériences

2024 – 2026 Seine-Saint-Denis

Data Analyst (alternance)

SNCF Voyageurs

  • Dashboards Power BI pour les KPIs Transilien (ponctualité, affluence)
  • Automatisation de rapports via Python et VBA
  • Développement Power Apps & Power Automate sur SharePoint
  • Analyse exploratoire sur données de trafic voyageurs
2023 – 2024 Île-de-France

Développeur (alternance)

SNCF Réseau

  • Développement d'une application web MVC en PHP
  • Participation aux rituels Agile (sprints, rétros, planning)
  • Intégration et développement de fonctionnalités métier
  • Tests et recette fonctionnelle

Contact

Disponible pour des opportunités CDI/CDD Data Engineer à partir d'octobre 2026.

Email
martin@prevot.cloud
GitHub
github.com/martinprevot
in
LinkedIn
martin-prevot
Disponibilité
Open to work · Oct. 2026
CDI / CDD Data Engineer