Data Platform Developer
IFOM è un istituto di ricerca sul cancro senza scopo di lucro, riconosciuto a livello internazionale e sostenuto dall'Associazione Italiana per la Ricerca sul Cancro (AIRC), con sede a Milano in un contesto urbano estremamente dinamico.
Il successo continuo dell'IFOM è garantito dal reclutamento di ricercatori altamente selezionati, provenienti da corsi di laurea, master e dottorato, di oltre 24 paesi in tutto il mondo.
L'IFOM ha sede all'interno di un campus di ricerca condiviso con l'Istituto Europeo di Oncologia e l'Istituto Italiano di Tecnologia.
IFOM si impegna a creare un ambiente sicuro e inclusivo, basato sul rispetto reciproco e sulla valorizzazione della diversità, offrendo pari opportunità di lavoro a tutti i candidati qualificati.
Per il nostro Istituto stiamo: sviluppatore di piattaforme dati
Informazioni sulla posizione
Il candidato riporterà direttamente al Responsabile del Dipartimento di Calcolo e Scienza dei Dati per la Ricerca e sarà responsabile del contributo allo sviluppo e alla gestione quotidiana della Piattaforma Dati per la Ricerca di IFOM: un ambiente governato e incentrato sui metadati che gestisce i dati di ricerca durante l'intero ciclo di vita (acquisizione, conservazione, trasferimento e pubblicazione) su un'infrastruttura ibrida. Il ruolo è principalmente orientato allo sviluppo: creazione ed estensione dei servizi e delle integrazioni della piattaforma, con la necessaria competenza per la gestione e la risoluzione dei problemi dell'infrastruttura sottostante. Lavorando a stretto contatto con il team di Calcolo e Scienza dei Dati per la Ricerca e con il partner di implementazione della piattaforma, il candidato acquisirà progressivamente maggiore autonomia nella gestione della piattaforma.
Cerchiamo una risorsa all'inizio della sua carriera, con un massimo di 2 anni di esperienza; sono benvenuti anche i neolaureati con esperienza in progetti pertinenti.
Il candidato sarà responsabile di:
- Sviluppare ed estendere i servizi, le pipeline di dati e le integrazioni della piattaforma, scrivendo codice pulito, manutenibile e sottoposto a controllo di versione.
- Creazione e manutenzione di pipeline di acquisizione dati e orchestrazione dei flussi di lavoro per acquisire, convalidare, organizzare e pubblicare dati di ricerca tra sistemi di archiviazione e repository esterni.
- Implementare e mantenere le politiche di governance dei dati e dei metadati (regole di convalida, ciclo di vita e classificazione) e supportare il catalogo dati della piattaforma.
- Gestione e monitoraggio dei componenti della piattaforma in esecuzione su infrastruttura containerizzata, con sufficiente consapevolezza per ispezionare e risolvere i problemi dell'infrastruttura sottostante quando necessario.
- Contribuire alla sicurezza e alla conformità della piattaforma – controlli di accesso, audit e gestione sicura dei dati di ricerca sensibili – in linea con il GDPR e le politiche istituzionali.
- Collaboriamo con istituti scientifici e gruppi di ricerca per tradurre i loro flussi di lavoro di dati in integrazioni con la piattaforma, considerando quest'ultima come un prodotto affidabile per i ricercatori.
- Applicare solide pratiche di ingegneria a tutto il lavoro: controllo delle versioni, test e implementazione automatizzati, ambienti riproducibili e procedure ripetibili anziché passaggi manuali una tantum.
- Contribuire alla documentazione, all'inserimento dei gruppi di ricerca e alla condivisione delle conoscenze all'interno del team.
Pacchetto di lavoro
Questo ruolo, incentrato sullo sviluppo, è pensato per la crescita professionale. Le competenze fondamentali sono una solida conoscenza della programmazione e, soprattutto, una forte propensione all'apprendimento nell'ambito dell'ingegneria dei dati e delle piattaforme. Le restanti competenze verranno sviluppate sul campo.
Essenziale
- Programmazione in Python per scripting, automazione e pipeline di dati, con particolare attenzione alla creazione di codice pulito e di facile manutenzione.
- Ottima conoscenza di Linux e della riga di comando.
- SQL e database relazionali (ad esempio PostgreSQL).
- Nozioni fondamentali di containerizzazione (Docker; la conoscenza di Kubernetes è un forte vantaggio).
- Controllo della versione con Git.
Apprezzato (e ulteriormente sviluppato sul lavoro)
- Strumenti di orchestrazione/integrazione dei dati (Apache Airflow, Apache NiFi o equivalenti).
- Automazione dell'infrastruttura e gestione della configurazione (la conoscenza di Ansible, Helm, Terraform o strumenti equivalenti è un plus).
- Pipeline CI/CD e test automatizzati (ad esempio GitLab CI, GitHub Actions).
- Familiarità con le architetture a microservizi e le API REST.
- Strumenti di monitoraggio e osservabilità (ad esempio Prometeo, Grafana).
- Consapevolezza delle pratiche di sicurezza e privacy dei dati (controllo degli accessi, audit) e degli obblighi previsti dal GDPR per i dati sensibili.
- Esposizione ad ambienti di calcolo ad alte prestazioni (HPC) o bioinformatica.
- Comprensione dei principi FAIR relativi ai dati e dei concetti di gestione del catalogo dati/metadati.
Titolo di Studio
Laurea magistrale in Informatica, Ingegneria del software/informatica, Bioinformatica o disciplina tecnica affine. Saranno prese in considerazione anche le lauree triennali abbinate a esperienza pertinente o progetti di ricerca.
Lingue
Italiano: padronanza a livello madrelingua;
L'inglese è essenziale all'IFOM: è richiesta una conoscenza avanzata dell'inglese parlato e scritto;
Competenze trasversali
Forte propensione all'apprendimento in diversi ambiti, dall'ingegneria dei dati all'ingegneria delle piattaforme, e un approccio pratico e proattivo; curiosità, crescente autonomia e un approccio collaborativo e umile alla creazione di strumenti su cui gli altri fanno affidamento. A proprio agio nel lavorare in un team agile basato su sprint.
Capacità di comunicazione. Lavoriamo in un ambiente multidisciplinare e ci rivolgiamo a una varietà di interlocutori tecnici, scientifici e organizzativi. Saranno privilegiati i candidati che dimostreranno la capacità di trasmettere idee con chiarezza e di adattare lo stile comunicativo a un pubblico eterogeneo.
Propensione all'apprendimento e al lavoro di squadra; capacità di problem solving; ottimi punti interpersonali; empatia; capacità di ascolto attivo, sincera apertura alle opinioni e ai feedback altruistici. Spirito collaborativo e disponibilità, in grado di promuovere la fiducia e un dialogo costruttivo all'interno del team.
Cosa offriamo
Ambiente di lavoro internazionale; formazione continua; orario flessibile; supporto per le spese di trasferimento; foresteria all'interno del campus; accordi con sconti per palestra, farmacia, servizio di psicologia e vari negozi nella zona di Ifom; bar e mensa all'interno del campus e pranzo gratuito; asilo nido aziendale; supporto continuo ai candidati e alle loro famiglie (compresi alloggio, istruzione, iscrizione al sistema sanitario nazionale, permesso di lavoro ecc.) grazie alle attività dell'ufficio di accoglienza; servizio medico; computer portatile; servizio bar - dichiarazione IVA; Laboratorio G: un laboratorio specificamente progettato per ricercatrici in gravidanza o in allattamento.
Tipo di contratto: Contratto a tempo indeterminato, a tempo pieno
Ubicazione : Milano - zona Scalo di Porta Romana
Informazioni di contatto: Se siete interessati a questa opportunità, vi preghiamo di inviare il vostro CV e una lettera di presentazione a: recruitment@ifom.eu
Il presente annuncio è rivolto ad entrambi i sessi ai sensi delle leggi 903/77 e 125/91 e alle persone di tutte le età e nazionalità ai sensi dei decreti legislativi 215/03 e 216/03.