远程工作雷达

AI安全专员 - 全远程 | 最高22美元/小时

AI Safety Specialist - Fully Remote | Upto $22/hr

AI开发工程职能支持未标注地域
公司Mercor
薪资未公开
工作地点Pakistan
地域资格未标注地域
时区要求日间重叠约 6 小时,基本正常作息
用工类型Contractor
发布时间今天
数据来源Himalayas
前往 Himalayas 查看并投递 →

Mercor 将顶尖的创意和技术人才与领先的 AI 研究实验室连接起来。公司总部位于旧金山,我们的投资方包括 Benchmark、General Catalyst、Peter Thiel、Adam D'Angelo、Larry Summers 和 Jack Dorsey。
职位:AI 安全专家 — 英语 & 旁遮普语
类型:合同工
薪资:20–22 美元/小时
地点:远程

岗位职责

  • 对对话式 AI 模型和代理进行红队测试。执行越狱、提示注入、滥用案例和偏见利用。
  • 生成高质量的人类数据。标注失败案例,分类漏洞,并标记系统性风险。
  • 使用分类法、基准测试和操作手册来保持一致的测试流程。
  • 可重复记录。为客户提供行动报告、数据集和攻击案例。

任职要求

必备条件

  • 英语和旁遮普语流利。
  • 具有红队经验(AI 对抗工作、网络安全、社会技术探测)。
  • 强大的沟通能力。能向技术人员和非技术人员清晰解释风险。
  • 适应能力强。能在不同项目和客户之间灵活切换。

优先考虑

  • 具有对抗性机器学习经验:越狱数据集、提示注入、RLHF/DPO 攻击、模型提取。
  • 网络安全技能:渗透测试、漏洞开发、逆向工程。
  • 社会技术风险专业知识:骚扰/虚假信息探测、滥用分析、对话式 AI 测试。
  • 创造性探测能力:心理学、表演、非常规对抗思维的写作。

申请流程(需 20–30 分钟完成)

  • 上传简历
  • 基于简历的 AI 面试
  • 提交申请表

资源与支持

  • 有关面试流程和平台信息的详细信息,请查看:
  • 如有任何帮助或支持,请联系:

备注:我们团队每天都会审核申请。请完成 AI 面试和申请步骤,以获得此次机会的考虑。
最初发布于 Himalayas

查看英文原文

About the job
Mercor connects elite creative and technical talent with leading AI research labs. Headquartered in San Francisco, our investors include Benchmark, General Catalyst, Peter Thiel, Adam D'Angelo, Larry Summers, and Jack Dorsey.
Position: AI Safety Experts — English & Punjabi
Type:Contract
Compensation:$20–$22/hour
Location:Remote
Role Responsibilities

  • Red team conversational AI models and agents. Conduct jailbreaks, prompt injections, misuse cases, and bias exploitation.
  • Generate high-quality human data. Annotate failures, classify vulnerabilities, and flag systemic risks.
  • Apply structure using taxonomies, benchmarks, and playbooks to maintain consistent testing.
  • Document reproducibly. Produce reports, datasets, and attack cases for customer action.

Qualifications

Must-Have

  • Fluent in English and Punjabi.
  • Prior experience in red teaming (AI adversarial work, cybersecurity, socio-technical probing).
  • Strong communication skills. Explain risks clearly to technical and non-technical stakeholders.
  • Adaptable. Thrive on moving across projects and customers.

Preferred

  • Experience in Adversarial ML: jailbreak datasets, prompt injection, RLHF/DPO attacks, model extraction.
  • Cybersecurity skills: penetration testing, exploit development, reverse engineering.
  • Socio-technical risk expertise: harassment/disinfo probing, abuse analysis, conversational AI testing.
  • Creative probing abilities: psychology, acting, writing for unconventional adversarial thinking.

Application Process (Takes 20–30 mins to complete)

  • Upload resume
  • AI interview based on your resume
  • Submit form

Resources & Support

  • For details about the interview process and platform information, please check:
  • For any help or support, reach out to:

PS: Our team reviews applications daily. Please complete your AI interview and application steps to be considered for this opportunity.
Originally posted on Himalayas

本页面信息整理自 Himalayas,版权归原发布方所有。职位可能随时关闭,投递请以原始页面为准。 本站只做信息聚合展示,不参与招聘流程,也不向求职者收取任何费用。

该公司其他在招职位

← 返回全部职位