职位描述
岗位职责
- 负责大语言模型的SFT、偏好优化及相关后训练工作
- 建设训练数据的采集、清洗、去重、标注和质量评估流程
- 设计模型评测集和评价指标,分析训练前后的能力变化
任职要求
- 熟悉Python、PyTorch、Transformers等技术栈
- 有大语言模型SFT、LoRA/QLoRA或偏好优化实战经验
- 理解生成模型的数据格式、损失计算、上下文截断和训练流程
- 能够独立完成数据处理、训练实验、效果评测和问题分析
加分项
- 有对话模型、角色扮演、互动叙事或创意写作模型经验
- 熟悉TRL、PEFT、vLLM、DeepSpeed或同类工具
其他说明
美国公司自有GPU集群,支持远程全职;投递需接受小型任务测试