远程工作雷达

LLM 后训练工程师

AI开发工程明确接受中国求职者中文
公司未知公司
薪资15k-25k
工作地点远程 · 中国
地域资格明确接受中国求职者
时区要求无特别要求
用工类型远程全职
发布时间16 天前
数据来源远程.work
前往 远程.work 查看并投递 →
明确接受中国求职者:该职位的地域要求包含中国,可正常投递。

岗位职责

  • 负责大语言模型的SFT、偏好优化及相关后训练工作
  • 建设训练数据的采集、清洗、去重、标注和质量评估流程
  • 设计模型评测集和评价指标,分析训练前后的能力变化

任职要求

  • 熟悉Python、PyTorch、Transformers等技术栈
  • 有大语言模型SFT、LoRA/QLoRA或偏好优化实战经验
  • 理解生成模型的数据格式、损失计算、上下文截断和训练流程
  • 能够独立完成数据处理、训练实验、效果评测和问题分析

加分项

  • 有对话模型、角色扮演、互动叙事或创意写作模型经验
  • 熟悉TRL、PEFT、vLLM、DeepSpeed或同类工具

其他说明

美国公司自有GPU集群,支持远程全职;投递需接受小型任务测试

本页面信息整理自 远程.work,版权归原发布方所有。职位可能随时关闭,投递请以原始页面为准。 本站只做信息聚合展示,不参与招聘流程,也不向求职者收取任何费用。

该公司其他在招职位

AI 工作流工程师

未知公司远程 · 中国25k-50k远程全职12 天前
AI开发工程明确接受中国求职者中文

← 返回全部职位