岗位基本信息

岗位职责

  1. 人工智能研发中心 岗位职责: 1.参与大语言模型完整训练链路,负责模型预训练、微调、监督微调(SFT)、直接偏好优化(DPO)等对齐实验的设计与执行,持续迭代优化模型输出质量、安全性与指令遵循能力。 2.基于PyTorch深度学习框架开展模型实验,深入研究Transformer、注意力机制等主流大模型基础架构;跟踪并验证混合专家模型(MoE)、长上下文建模等前沿技术,完成技术可行性评估与性能测试。 3.参与大规模分布式训练优化,评估并实施数据并行、模型并行、ZeRO优化器状态分片等训练加速方案;协助完成训练框架适配、显存优化、检查点管理及相关机器学习运维(MLOps)流程搭建。 4.参与检索增强生成(RAG)、智能体(Agent)相关业务项目开发,结合业务场景完成功能模块设计与方案验证;跟踪自然语言处理领域前沿研究,推动技术成果向业务场景转化。 岗位要求: 1.对NLP、大模型方向有浓厚兴趣。 2.熟练使用Python编程,掌握PyTorch/TensorFlow至少一种深度学习框架,了解相关基础工具,熟悉Transformer基础原理。 3.具备NLP、大模型相关项目、竞赛或科研实践经历,做过文本分类、生成、小模型微调等相关实验,了解分布式训练基础概念优先。 4.熟悉Linux开发环境,了解Docker基础使用,对模型推理优化、工程部署有概念认知,有数据集制作、模型上线相关实践经验加分。 5.有RAG、对话系统、智能Agent相关项目经验更佳,具备良好代码能力、逻辑思维与跨团队沟通能力;有相关学术论文、开源项目贡献者优先考虑。

岗位要求