Langsung ke konten utama
Kembali ke Lowongan

Research Engineer (Reinforcement Learning)

Bangun dan pelatihan model AI untuk aplikasi suara dan teks di LiveKit

Sebagai Research Engineer Reinforcement Learning di LiveKit, Anda akan membangun lingkungan pelatihan dan verifikasi untuk model AI. Anda akan mengelola pipeline data sintetis, menjalankan eksperimen pelatihan, dan memastikan model dapat berfungsi baik untuk agen suara maupun teks. Kerja Anda akan berdampak pada aplikasi AI suara yang digunakan oleh ribuan pengguna di seluruh dunia.

Kenapa Menarik?

Anda akan bekerja dengan tim senior yang berfokus pada kreativitas dan memiliki kesempatan untuk mempengaruhi merek platform pengembang yang sedang berkembang.

Tanggung Jawab Utama

  • Membangun lingkungan dan verifikasi untuk model AI
  • Mengelola pipeline data sintetis dari generasi hingga penilaian kualitas
  • Menjalankan eksperimen pelatihan dan menjelaskan perubahan pada model
  • Membuat evaluasi yang harus dilewati sebelum rilis
  • Memilih dan menyesuaikan model dasar open-weight untuk tugas-tugas tertentu
  • Memastikan perilaku model tetap konsisten untuk agen suara dan teks

Persyaratan

  • Ahli Python yang kuat
  • Pengalaman membawa model dari data mentah hingga produksi
  • Memahami pentingnya kualitas data
  • Mampu bekerja dengan GPU dan memahami batasannya
  • Mampu bekerja secara kolaboratif dalam lingkungan remote

Skills Wajib

pythonmachine-learningreinforcement-learningdata-pipelinemodel-training
Lihat Deskripsi Asli dari Ashby Job Boards

Deskripsi asli dari Ashby Job Boards

ABOUT LIVEKIT LiveKit is building the infrastructure layer for the voice-driven era of computing. Our platform gives developers everything they need to build, test, deploy, scale, and observe agents in production. Founded in 2021, LiveKit powers voice AI applications for OpenAI, xAI, Salesforce, Coursera, Spotify, and thousands of others, collectively facilitating billions of calls each year. ABOUT THIS ROLE We are looking for an exceptional engineer to build post-training at LiveKit. Our agents run over voice and increasingly over text channels like SMS and chat, and the interesting problems show up over long horizons: staying useful across many sessions, working with context that accumulates over time, and using tools reliably in the middle of a live conversation. WHAT YOU'LL DO - Build the environments and verifiers our models train against - Own the synthetic data pipeline, from generation through the quality gates - Run training experiments end to end, and explain what moved the model - Build the evaluations a release has to clear - Choose and adapt open-weight base models for our tasks - Make trained behavior hold up for voice and text agents alike - Ship models into production and keep improving them on real usage WHO YOU ARE - A strong Python engineer - Have carried a model from raw data through to production - Treat data as the product: coverage, diversity, leakage - Assume a model will exploit a weak reward, and design against it - Comfortable with GPUs and honest about their limits - Know when to train, and when not to - Comfortable working collaboratively in a remote environment NICE TO HAVE - Experience with post-training: fine-tuning, reward design, or reinforcement learning such as GRPO - RL and fine-tuning frameworks such as TRL, verl, or OpenRLHF, or a training loop you wrote yourself - Fast rollouts with vLLM or SGLang, multi-GPU training with FSDP - Training tool-using or multi-turn agents - Execution sandboxes, verifiers, eval harnesses, or tooling other engineers depend on - Open-weight families such as Qwen or Llama, LoRA and similar OUR COMMITMENT TO YOU - The opportunity to shape the brand of a fast-growing developer platform - Collaboration with a small, senior team that deeply values craft and creativity - Competitive salary and equity package - Health, dental, and vision benefits - Flexible vacation policy LiveKit is an equal opportunity employer and does not discriminate on the basis of any characteristic protected by applicable law. If you require a reasonable accommodation during the application or interview process, please contact recruiting@livekit.io.

Konteks Gaji

Posisi Engineering serupa di LokerDollar dibayar sekitar $165k/yr (kisaran $1.8k–999.999k/yr, dari 626 listing aktif).

Perekrutan di LiveKit

LiveKit punya 12 lowongan aktif lain di LokerDollar dan telah merekrut di sini sejak 10 Mei 2026 — di kategori Engineering, Marketing.

Lihat semua lowongan LiveKit →

Pemberi kerja tidak menyatakan keterbukaan lokasi — cek langsung lowongannya

Perusahaan
LiveKit
Gaji
Lihat selisih gaji remote (USD) vs lokal →
Tipe Lowongan
full time
Lokasi
Remote · North America
Kategori
Level
mid
DipostingNewBaru & terverifikasi
18 Agu 2026

Bagikan lowongan ini

Bantu temanmu nemu kerja remote berikutnya.

Pertanyaan yang sering diajukan

Apakah Research Engineer (Reinforcement Learning) di LiveKit bisa dikerjakan remote?
Posisi ini berlokasi di Remote. Detail remote/onsite ada di deskripsi lowongan.
Berapa gaji untuk Research Engineer (Reinforcement Learning) di LiveKit?
Rentang gaji yang tercantum untuk posisi ini adalah $135k–300k/yr.
Jenis pekerjaan apa Research Engineer (Reinforcement Learning) di LiveKit?
Posisi ini adalah pekerjaan full time.
Bagaimana cara melamar?
Klik tombol "Lamar" pada halaman ini untuk menuju halaman aplikasi resmi LiveKit.

Jelajahi lebih lanjut

Data & laporan pasar

Riset gaji & permintaan skill dari data lowongan kami sendiri.

Dari blog kami