Remote RL Research Engineer for Production AI

Remote RL Research Engineer for Production AI

Bergamo Full-Time 82800 - 101200 € / anno (stimato) Smart working possibile
Jobgether

In sintesi

  • Mansioni: Progetta ambienti di addestramento e migliora agenti AI vocali e testuali.
  • Azienda: Azienda innovativa nel campo dell'AI con un team esperto.
  • Benefit: Lavoro remoto, stipendio competitivo e opportunità di crescita professionale.
  • Altre informazioni: Ambiente dinamico con eccellenti opportunità di carriera.
  • Perché questo lavoro: Contribuisci a progetti all'avanguardia e fai la differenza nel mondo dell'AI.
  • Qualifiche: Esperienza in apprendimento per rinforzo e capacità di lavorare in team.

La retribuzione prevista è compresa tra 82800 - 101200 € per anno.

Jobgether, on behalf of a partner company, invites applications for a Research Engineer (Reinforcement Learning) based in Italy.

Join a small, senior team building voice- and text-driven AI agents and focus on post-training improvements.

You will design training environments, synthetic data pipelines, evaluations, and production deployments, tackling long-horizon interactions and robust tool use in a remote, collaborative setting.

#J-18808-Ljbffr

Remote RL Research Engineer for Production AI datore di lavoro: Jobgether

Jobgether è un datore di lavoro eccezionale, offrendo un ambiente di lavoro stimolante e innovativo per i professionisti della tecnologia. Con opportunità di crescita continua e un forte focus sulla collaborazione tra team, i dipendenti possono contribuire a progetti all'avanguardia nel settore delle criptovalute e della sicurezza finanziaria. Lavorare in Italia significa anche godere di un equilibrio tra vita professionale e personale, in una cultura aziendale che valorizza la diversità e l'inclusione.

Jobgether

Dettagli di contatto:

Team di recruiting di Jobgether

Pensiamo che ti servano queste competenze per eccellere come Remote RL Research Engineer for Production AI

Reinforcement Learning
Design di ambienti di addestramento
Pipeline di dati sintetici
Valutazioni
Distribuzioni in produzione
Interazioni a lungo termine
Utilizzo robusto degli strumenti