研究科学家/工程师 - 对齐微调团队
岗位摘要
使用合成数据生成和高级训练流程,开发和实施新颖的微调技术;运用这些技术训练模型,使其具备更好的对齐属性,包括诚实、品格和无害性;创建和维护评估框架,以衡量模型的对齐属性;跨团队协作,将对齐改进集成到生产模型中
岗位职责
- 使用合成数据生成和高级训练流程,开发和实施新颖的微调技术
- 运用这些技术训练模型,使其具备更好的对齐属性,包括诚实、品格和无害性
- 创建和维护评估框架,以衡量模型的对齐属性
- 跨团队协作,将对齐改进集成到生产模型中
- 开发流程,以帮助自动化和扩展团队的工作
任职要求
- 拥有计算机科学、机器学习或相关领域的硕士/博士学位,或同等经验
- 具备强大的编程技能,尤其是Python
- 拥有机器学习模型训练和实验经验
- 拥有实施机器学习研究的记录
- 展现出强大的分析技能,用于解释实验结果
- 拥有机器学习指标和评估框架的经验
- 擅长将研究想法转化为可运行的代码
- 能够识别并解决实际实施中的挑战