Senior Data Engineer

Senior Data Engineer

Full-Time 120000 - 180000 € / anno (stimato) Smart working non possibile
Cerved Group SpA

In sintesi

  • Mansioni: Progetta e sviluppa pipeline di dati per supportare AI e Machine Learning.
  • Azienda: Cerved, leader nella tech italiana con focus su dati e analytics.
  • Benefit: Retribuzione competitiva, lavoro ibrido e opportunità di crescita professionale.
  • Altre informazioni: Ambiente dinamico con forte attenzione alla collaborazione e alla qualità.
  • Perché questo lavoro: Lavora con tecnologie all'avanguardia e contribuisci a progetti innovativi.
  • Qualifiche: Esperienza in data engineering e competenze in Python o Java.

La retribuzione prevista è compresa tra 120000 - 180000 € per anno.

About the Company
Cerved è la tech company italiana che, grazie a segnali predittivi unici e a un patrimonio esclusivo di dati e analytics, supporta la crescita sostenibile, la gestione del rischio e la trasformazione digitale di imprese e istituzioni. Con Cerved Rating Agency, elaboriamo valutazioni sul merito di credito, rating ESG e analisi sulle emissioni di debito. Dal 2021 Cerved è parte di ION Group, uno dei più grandi operatori FinTech internazionali.

Job Overview
Siamo alla ricerca di una figura di Senior Data Engineer per consolidare il nostro Team Data Models Tools & Processes. Il ruolo prevede la progettazione, lo sviluppo e l’ottimizzazione di pipeline di dati robuste e scalabili a supporto dei processi di business e delle iniziative di Analytics, AI e Machine Learning.

Responsibilities

  • Sviluppare, testare e mantenere pipeline di ingestione, trasformazione e distribuzione dei dati (ETL/ELT) usando Python, Java, Apache Spark e Databricks;
  • Implementare e ottimizzare job Spark (batch e streaming) su Databricks, garantendo performance, affidabilità e copertura dei test;
  • Integrare sorgenti dati eterogenee (database relazionali, API REST, file system, code di messaggistica) sfruttando i servizi AWS: S3, Glue, Kinesis, SQS, Lambda, Redshift;
  • Scrivere codice di qualità production‑grade in Python/Java, applicando principi SOLID, design pattern, code review e test automatizzati (unit, integration);
  • Costruire e gestire workflow di orchestrazione con Apache Airflow o Databricks Workflows, assicurando monitoraggio, alerting e gestione degli errori;
  • Applicare tecniche di data modeling e trasformazione con Databricks (Delta Live Tables, Databricks SQL, Auto Loader), garantendo tracciabilità e qualità dei dati;
  • Collaborare con i team di Data Architect, Data Science e BI;
  • Contribuire all’adozione di best practice DevOps/DataOps: versionamento del codice (Git), CI/CD per pipeline dati, Infrastructure as Code (Terraform) e ambienti containerizzati (Docker, Kubernetes);
  • Preparare e ottimizzare i dati a supporto di modelli ML e soluzioni AI: feature engineering, costruzione di Feature Store, pipeline di embedding e RAG per applicazioni di Generative AI.

Qualifications

  • Laurea in Informatica, Ingegneria Informatica, Matematica o discipline affini;
  • Almeno 3 anni di esperienza nello sviluppo di pipeline dati e soluzioni di data engineering in contesti produttivi;
  • Solide competenze di programmazione in Python (pandas, PySpark, asyncio, FastAPI) e/o Java (Spring Boot, Maven/Gradle);
  • Esperienza con Apache Spark (RDD, DataFrame API, Spark SQL, Structured Streaming) e con la piattaforma Databricks (notebooks, jobs, Delta Live Tables);
  • Conoscenza pratica dei servizi AWS per i dati: S3, Glue, Athena, Redshift, EMR, Kinesis Data Streams/Firehose, Lambda, Step Functions, IAM;
  • Esperienza con le funzionalità avanzate di Databricks per la trasformazione e qualità del dato (Delta Live Tables, Databricks SQL, Auto Loader, Delta Lake) e con formati di storage columnar (Parquet, Delta, Iceberg);
  • Familiarità con sistemi di orchestrazione (Apache Airflow, Databricks Workflows) e messaggistica event‑driven (Apache Kafka, Amazon Kinesis, SQS);
  • Buona padronanza di SQL avanzato su database relazionali e analitici (PostgreSQL, Redshift, Athena);
  • Esperienza con pratiche DevOps/DataOps: Git, CI/CD (GitHub Actions, GitLab CI, Jenkins), Docker, Kubernetes; conoscenza di base di Terraform o CloudFormation è un plus;
  • Conoscenza di base di tecniche ML/AI applicate ai dati costituisce un vantaggio;
  • Propensione al lavoro in team Agile, attitudine alla collaborazione cross‑funzionale, curiosità tecnologica e orientamento alla qualità del codice e alla continuous improvement.

Location & Working Mode
(Milano, Mangone (CS), Padova, Roma). Modalità di lavoro: ibrida.

Compensation
Inquadrata al 1° Livello secondo il CCNL Terziario, Distribuzione e Servizi (Commercio). Range retributivo iniziale previsto: Euro 45.000 – Euro 60.000, con attribuzione determinata su criteri oggettivi, trasparenti e neutrali.

Cerved Group garantisce (ai sensi del D.Lgs 198/2006, D.Lgs.215/2003 e D.Lgs.216/2003) pari opportunità di accesso al lavoro a tutti i/le candidat* e si impegna a favorire il rispetto delle diversità e l’inclusione sul posto di lavoro.

Senior Data Engineer datore di lavoro: Cerved Group SpA

Cerved è un datore di lavoro eccezionale, che offre un ambiente di lavoro stimolante e collaborativo, dove l'innovazione e la crescita personale sono al centro della cultura aziendale. Con opportunità di sviluppo professionale continuo e un forte impegno per la diversità e l'inclusione, i dipendenti possono prosperare in un contesto ibrido a Milano, Mangone, Padova o Roma, contribuendo a progetti significativi nel campo dei dati e dell'analisi. Inoltre, il pacchetto retributivo competitivo e le pratiche di lavoro flessibili rendono Cerved un luogo ideale per chi cerca una carriera gratificante nel settore tech.

Cerved Group SpA

Dettagli di contatto:

Team di recruiting di Cerved Group SpA

Pensiamo che ti servano queste competenze per eccellere come Senior Data Engineer

Python
Java
Apache Spark
Databricks
ETL/ELT
AWS (S3, Glue, Kinesis, Redshift)
Data Modeling