Data Engineer
Bangun dan optimalkan data pipelines untuk AI model terkuat di dunia
Sebagai Data Engineer di Wynd Labs, Anda akan mengembangkan dan memelihara infrastruktur data besar untuk mendukung AI model. Anda akan bekerja dengan data scraping, transformasi, dan validasi, dengan fokus pada skalabilitas dan kinerja. Tim ini menggunakan teknologi seperti Python, Docker, Kubernetes, dan data warehousing.
Kenapa Menarik?
Dapatkan pengalaman langsung dalam mengelola infrastruktur scraping web skala besar, menggunakan Celery atau Kafka, serta mengoptimalkan data untuk AI terkuat
Tanggung Jawab Utama
- Mengembangkan dan memelihara data pipelines untuk data scraping dan transformasi
- Mengoptimalkan kinerja dan skalabilitas infrastruktur data
- Menggunakan teknologi seperti Python, Docker, Kubernetes, dan data warehousing
- Mengelola dan memantau data scraping di skala besar
- Mengembangkan dan memelihara API yang dapat diskalakan
Persyaratan
- Pendidikan S1 atau pengalaman kerja setara
- Pengalaman lanjut dengan Python, termasuk async programming dan multiprocessing
- Pengalaman dengan web scraping di skala besar
- Pengalaman dengan distributed data pipelines dan data warehousing
- Pengalaman dengan Docker, Kubernetes, dan CI/CD
Skills Wajib
Konteks Indonesia
- Overlap Jam Kerja:
- Overlap minimal — jam kerja berlawanan
Lihat Deskripsi Asli dari Ashby Job Boards
Deskripsi asli dari Ashby Job Boards
Who We Are: We build infrastructure that delivers massive amounts of web data to the companies training the world’s most powerful AI models. We're the team that helps to power and support Grass, a bandwidth-sharing network that lets us operate a massive distributed crawler, giving us unique access to high-quality public web data at global scale. On top of that, we’ve built pipelines for ingesting, segmenting, and annotating billions of videos, transcripts, and audio files, powering dataset creation for frontier labs. We’re lean, technical, and move fast. No red tape, no slow decision-making; just a team of builders pushing to expand what’s possible for open web data and AI. The Role: We are seeking a Data Engineer to support and improve large-scale data pipelines and infrastructure. You’ll work across data collection, processing, transformation, validation, and delivery, with a focus on scalability, reliability, and performance. This is a hands-on role where you’ll work with distributed systems, large datasets, web scraping infrastructure, and production data workloads. Please note: This role requires a work schedule that overlaps sufficiently with EST business hours to collaborate effectively with the team. Who You Are: - Bachelor’s degree or equivalent work experience - Python (advanced) — strong grasp of async programming, multiprocessing, and writing production-grade code for long-running data jobs - Web scraping at scale — hands-on experience with high-volume scraping (proxies, rate limiting, anti-bot evasion). Experience with platform APIs and large media/metadata datasets (video platforms, social media) - Distributed data pipelines — experience designing and operating pipelines across many workers/servers using task queues (Celery, Kafka, RabbitMQ, or similar) - Data warehousing — practical experience with columnar/analytical warehouses; Databend, ClickHouse, or BigQuery strongly preferred; comfortable with complex analytical queries, partitioning strategies, cost-aware querying on cloud warehouses - Docker & Kubernetes — containerizing workloads, writing Helm charts/manifests, managing deployments, autoscaling scraping/processing workloads - Linux & bare-metal ops — comfortable managing services on Linux servers, debugging performance issues (disk I/O, network, memory) without managed-cloud abstractions - CI/CD for data workflows (GitHub Actions, ArgoCD) - Writing Scalable API What You'll Be Doing: - Maintain, optimize, and troubleshoot database queries and related data systems to support efficient data access, processing, and reliability. - Assist in creating, maintaining, and improving data pipelines used to collect, process, transform, validate, and deliver large-scale datasets. - Support web scraping and data collection initiatives, including developing, testing, and maintaining scripts or tools used to gather publicly available data in accordance with Company requirements. - Monitor and troubleshoot data pipeline issues, identify data quality concerns, and help implement timely fixes to maintain data accuracy and operational continuity. - Document engineering work, including database queries, pipeline processes, scraping workflows, technical decisions, issues encountered, and resolutions implemented. - Participate in research and development projects to improve the Company’s data products and workflows. Why Work With Us: - Opportunity. We are at the forefront of developing a web-scale crawler and knowledge graph that improves access to public web data and extends the value of AI to the people. - Culture. We're a lean team with a high bar. We come to work not to be comfortable, but to find out what we're capable of and to do work that matters. We're not calling for people who keep things moving. We're calling for people who make everyone around them better. We prioritize low ego and high output. This is a fully remote team. - Compensation. You’ll receive a competitive salary, benefits and equity package.
Konteks Gaji
Posisi Engineering serupa di LokerDollar dibayar sekitar $170k/yr (kisaran $855–1000k/yr, dari 887 listing aktif).
Pemberi kerja tidak menyatakan keterbukaan lokasi — cek langsung lowongannya
Lowongan ini menyebut jam kerja EST — cek apakah overlap-nya cocok buat kamu.
Pertanyaan yang sering diajukan
- Apakah Data Engineer di Wynd Labs bisa dikerjakan remote?
- Ya. Data Engineer di Wynd Labs adalah posisi remote yang terbuka untuk kandidat di seluruh dunia.
- Jenis pekerjaan apa Data Engineer di Wynd Labs?
- Posisi ini adalah pekerjaan full time.
- Bagaimana cara melamar?
- Klik tombol "Lamar" pada halaman ini untuk menuju halaman aplikasi resmi Wynd Labs.
Jelajahi lebih lanjut
Data & laporan pasar
Riset gaji & permintaan skill dari data lowongan kami sendiri.
- Lowongan IT Indonesia vs Remote Global (2026)Analisis data primer 2.049 lowongan: metodologi, klasifikasi, dataset bisa diunduh.
- Permintaan Skill AI: Indonesia vs Global (2026)10.000+ lowongan, classifier taxonomy-first, Wilson CI, pra-registrasi sebelum analisis.
- Remote ≠ Remote: Skill yang Membuka Kerja Global untuk Indonesia (2026)12.891 lowongan remote: skill coding bergaji tertinggi justru paling terkunci untuk pelamar Indonesia. Dataset agregat CC BY 4.0.
- Laporan Hiring Indonesia: Tech vs Non-TechPermintaan lowongan per bidang dari hitungan agregat — bukan listing per-listing.
- Benchmark Gaji IndonesiaKisaran gaji agregat lintas peran, dengan metodologi dan dataset terbuka.
- Indeks Gaji & Permintaan Kerja Remote untuk IndonesiaBerapa banyak lowongan remote global yang terbuka untuk Indonesia, dan gajinya (USD) per bidang.
- Laporan Kuartalan Pasar Kerja IndonesiaPHK, pendanaan, gaji & skill per kuartal — agregat terbuka.
- Laporan Pasar Remote per PeranLaporan otomatis per kelompok peran — skill, senioritas, perusahaan, gaji.
- Benchmark Gaji Remote GlobalGaji tahunan per bidang & mata uang, plus porsi lowongan terbuka untuk seluruh dunia.
Dari blog kami
- Tren Wawancara CIO Shift TechnologiesAnalisis lowongan remote dan wawancara CIO Shift Technologies: apa artinya untuk developer Indonesia di September 2026?
- 7 Lowongan Remote Terbaru September 2026Simak 7 lowongan remote terbaru September 2026, dari AWS Solutions Architect hingga Product Tester. Temukan peluang karier global yang fleksibel di sini.
- AI Jadi Wajib: Tren Lowongan Remote 2026Data terbaru menunjukkan skill AI semakin dicari di lowongan remote. Benarkah ini tren yang akan terus berlanjut bagi job seeker?