AI Red Teamer (LLM Generalist) - Remote
Rekrut di saja
Pemberi kerja ini sepertinya hanya merekrut di wilayah di atas. Pastikan kamu memenuhi syarat direkrut dari Indonesia sebelum melamar.
Stress-test AI models dengan membuat prompt yang menantang
Sebagai AI Red Teamer, Anda akan menguji kekuatan model bahasa besar dengan membuat prompt yang menantang. Anda akan mengidentifikasi kelemahan seperti konten tidak aman, bias, dan perilaku tidak terduga. Pekerjaan ini mendukung keamanan AI dan ketahanan model untuk laboratorium penelitian terkemuka. Anda akan bekerja dengan tim peneliti dan insinyur untuk memperkuat pertahanan model.
Kenapa Menarik?
Anda akan bekerja pada proyek yang mendukung keamanan AI dan ketahanan model untuk laboratorium penelitian terkemuka
Tanggung Jawab Utama
- Buat prompt kreatif dan skenario multi-turn untuk menguji batasan keamanan AI di berbagai kategori risiko
- Temukan cara untuk mengatasi filter keamanan, batasan, dan pertahanan menggunakan teknik jailbreak, evasion, dan prompt injection
- Eksplorasi kasus ekstrem untuk memprovokasi output yang dilarang, berbahaya, atau salah
- Evaluasi dan skor respons model berdasarkan taksonomi kerusakan dan rubrik keparahan yang terstruktur
- Dokumentasikan eksperimen dengan jelas, termasuk apa yang Anda coba, mengapa Anda mencobanya, dan apa yang terungkap
Persyaratan
- Pengalaman praktis menggunakan beberapa LLM (ChatGPT, Claude, Gemini, model open-source, dll)
- Kemampuan untuk membuat prompt adversarial; kenalan dengan teknik jailbreak atau evasion adalah plus
- Kemampuan pemecahan masalah kreatif dan adversarial
- Komunikasi tertulis yang jelas dan berpikir
- Penilaian etis yang kuat dan kemampuan untuk memisahkan pemikiran adversarial dari nilai pribadi
Skills Wajib
Konteks Indonesia
- Overlap Jam Kerja:
- Fleksibel — atur jam kerjamu sendiri
Lihat Deskripsi Asli dari Ashby Job BoardsTampilkan selengkapnya
Deskripsi asli dari Ashby Job Boards
AI RED TEAMER (LLM GENERALIST) Location: Remote (USA) Type: Contract, 40 hours per week ABOUT THE ROLE As an AI Red Teamer, you will stress-test large language models by intentionally trying to break them. Rather than checking whether an answer is correct, you will design creative, adversarial prompts that expose vulnerabilities: unsafe content, bias, broken guardrails, hallucinations, prompt injection weaknesses, and unexpected behaviors. Your work directly supports AI safety and model robustness for leading research labs. This is a generalist red teaming role. You will probe models across the full spectrum of risk categories, including content safety, CBRN (chemical, biological, radiological, nuclear), cybersecurity, persuasion and influence operations, child safety, self-harm, over-companionship, and regulatory compliance. Red teaming may span text, image, voice, and agentic model capabilities depending on project needs. This role requires creativity, curiosity, and an ability to think like an adversary while operating with strong ethical judgment. DAY-TO-DAY RESPONSIBILITIES - Craft creative prompts and multi-turn scenarios to stress-test AI guardrails across diverse risk categories - Discover ways around safety filters, restrictions, and defenses using jailbreak, evasion, and prompt injection techniques - Explore edge cases to provoke disallowed, harmful, or incorrect outputs - Evaluate and score model responses against structured harm taxonomies and severity rubrics - Document experiments clearly, including what you tried, why you tried it, and what it revealed - Review and refine adversarial prompts generated by other team members - Contribute to harm taxonomy development, calibration exercises, and inter-rater reliability work - Collaborate with engineers, data scientists, and researchers to share findings and strengthen defenses - Work with potentially disturbing content on a regular basis (see Content Warning below) - Stay current on jailbreaks, attack methods, and evolving model behaviors DESIRED CAPABILITIES Core - Strong hands-on experience using multiple LLMs (ChatGPT, Claude, Gemini, open-source models, etc.) - Intuition for crafting adversarial prompts; familiarity with jailbreak or evasion techniques is a strong plus - Creative, adversarial problem-solving skills - Clear and thoughtful written communication - Strong ethical judgment and the ability to separate adversarial thinking from personal values - Self-directed, collaborative, and comfortable in feedback-heavy environments - Curiosity, persistence, and comfort with frequent failure in experimentation Nice to Have - Familiarity with Python or other scripting languages - Experience working with LLM APIs or evaluation tooling - Comfort with structured data annotation and rubric-based scoring - Prior work in trust and safety, content moderation, QA, or security research - Subject matter expertise in any high-risk domain (cybersecurity, chemistry, biology, medicine, law, finance, etc.) YOU WILL THRIVE HERE IF - You treat every model response as a hypothesis to challenge - You can switch between creative free-association and rigorous documentation in the same session - You go deep into unusual interests (fandoms, niche internet cultures, gaming exploits, Wikipedia rabbit holes, etc.) - You come from a creative background: writing, visual art, improv, puzzle design, or similar - You are energized by finding the thing nobody else thought to try - You are genuinely passionate about AI and follow the space closely CONTENT WARNING This role involves regular and deliberate exposure to harmful content. You will encounter and intentionally generate content involving violence, self-harm, hate speech, sexually explicit material, child safety scenarios, and other categories of harmful output as part of structured adversarial testing. Candidates must be able to engage with this material professionally and sustainably. Support resources are available. ABOUT HANDSHAKE AI Handshake AI partners with leading AI research labs to make models safer and more robust. Our red teaming operations help identify vulnerabilities before they reach users, contributing directly to the responsible development of frontier AI systems.
Konteks Gaji
Posisi AI serupa di LokerDollar dibayar sekitar $140k/yr (kisaran $12k–242.4k/yr, dari 81 listing aktif).
Perekrutan di Handshake
Handshake punya 4 lowongan aktif lain di LokerDollar dan telah merekrut di sini sejak 31 Mei 2026 — di kategori AI, Engineering, Design.
Lihat semua lowongan Handshake →Pertanyaan yang sering diajukan
- Apakah AI Red Teamer (LLM Generalist) - Remote di Handshake bisa dikerjakan remote?
- Ya, AI Red Teamer (LLM Generalist) - Remote di Handshake bisa dikerjakan remote, tetapi perusahaan hanya merekrut dari wilayah tertentu. Cek syarat lokasi pada deskripsi lowongan sebelum melamar.
- Berapa gaji untuk AI Red Teamer (LLM Generalist) - Remote di Handshake?
- Rentang gaji yang tercantum untuk posisi ini adalah $32–95/hr.
- Jenis pekerjaan apa AI Red Teamer (LLM Generalist) - Remote di Handshake?
- Posisi ini adalah pekerjaan full time.
- Bagaimana cara melamar?
- Klik tombol "Lamar" pada halaman ini untuk menuju halaman aplikasi resmi Handshake.
Jelajahi lebih lanjut
Data & laporan pasar
Riset gaji & permintaan skill dari data lowongan kami sendiri.
- Lowongan IT Indonesia vs Remote Global (2026)Analisis data primer 2.049 lowongan: metodologi, klasifikasi, dataset bisa diunduh.
- Permintaan Skill AI: Indonesia vs Global (2026)10.000+ lowongan, classifier taxonomy-first, Wilson CI, pra-registrasi sebelum analisis.
- Remote ≠ Remote: Skill yang Membuka Kerja Global untuk Indonesia (2026)12.891 lowongan remote: skill coding bergaji tertinggi justru paling terkunci untuk pelamar Indonesia. Dataset agregat CC BY 4.0.
- Lapisan Kepatuhan dalam AI Hiring Stack (2026)6.349 lowongan remote: 77,2% tidak menyebut siapa yang boleh melamar. Metodologi dan dataset agregat CC BY 4.0.
- Laporan Hiring Indonesia: Tech vs Non-TechPermintaan lowongan per bidang dari hitungan agregat — bukan listing per-listing.
- Benchmark Gaji IndonesiaKisaran gaji agregat lintas peran, dengan metodologi dan dataset terbuka.
- Indeks Gaji & Permintaan Kerja Remote untuk IndonesiaBerapa banyak lowongan remote global yang terbuka untuk Indonesia, dan gajinya (USD) per bidang.
- Laporan Kuartalan Pasar Kerja IndonesiaPHK, pendanaan, gaji & skill per kuartal — agregat terbuka.
- Laporan Pasar Remote per PeranLaporan otomatis per kelompok peran — skill, senioritas, perusahaan, gaji.
- Benchmark Gaji Remote GlobalGaji tahunan per bidang & mata uang, plus porsi lowongan terbuka untuk seluruh dunia.
Dari blog kami
- AI Skill Premium: Fakta Sept 2026Data lowongan remote September 2026 menunjukkan skill AI jadi pembeda gaji. Benarkah begitu? Kita bedah datanya.
- Form Filling Job 2026: Fakta vs. HypeForm Filling Job 2026 sedang viral di YouTube. Apakah legit? Kami bedah peluang, gaji, dan realita lowongan remote ini agar kamu tidak terjebak scam.
- Lowongan Remote September 2026: GemsAnalisis lowongan kerja remote September 2026 yang jarang dilirik, lengkap dengan perbandingan gaji dan realita dibalik posisi tersebut.