5-10年硕士深度学习机器学习大模型算法自然语言AI算法工程师
学历要求:
计算机科学、人工智能或相关专业硕士及以上学位。
工作经验:
具有大模型研发或人工智能领域实际项目经验,熟悉大规模分布式训练架构,在深度学习、自然语言处理(NLP)/自然语言理解(NLU)算法方向具备扎实的技术积累与系统设计能力。
专业技能:
深入理解主流大模型的原理及其训练流程,包括GPT系列、LLaMA、ChatGLM等模型的RLHF三阶段训练机制和LoRA微调技术。
熟练使用TensorFlow、PyTorch、Megatron、DeepSpeed等主流框架,具备大规模模型分布式训练实战经验。
对大数据驱动的模型体系、云原生架构及前沿AI技术有系统性研究和实践认知。
管理能力:
具备较强的团队协作意识与组织协调能力,能有效带领团队推进研发任务落地。
能够统筹把控技术研发全过程,监督项目质量与执行进度,确保目标达成。
行业洞察能力:
具备数字化业务场景的理解力和行业发展趋势的预判能力,可为产品创新提供前瞻性技术储备与解决方案支持。
其他要求:
热爱技术创新,具备快速学习与适应新技术环境的能力。
拥有良好的应变能力和结果导向意识,能高效完成既定工作目标。
职位总结围绕职位描述,归纳工作内容、招聘要求
招聘人数1-2人
薪资报酬2.5-5万元/月
招聘有效期职位7天内有效
工作地点深圳南山区留学生创业大厦二期16楼
核心工作内容:
负责大模型算法的设计、训练与优化,包括自然语言处理、深度学习模型的架构设计与性能调优;主导大规模分布式训练系统搭建与问题解决;进行模型效果评估与迭代,推动算法在实际业务场景中的落地应用;参与前沿技术研究,为产品创新提供技术方案支持。
岗位基本条件:
学历要求:计算机科学、人工智能或相关专业硕士及以上学位。工作经验:具有大模型研发或人工智能领域实际项目经验,熟悉大规模分布式训练架构,在深度学习、自然语言处理(NLP)/自然语言理解(NLU)算法方向具备扎实的技术积累与系统设计能力。专业技能:深入理解主流大模型的原理及其训练流程,包括GPT系列、LLaMA、ChatGLM等模型的RLHF三阶段训练机制和LoRA微调技术。熟练使用TensorFlow、PyTorch、Megatron、DeepSpeed等主流框架,具备大规模模型分布式训练实战经验。对大数据驱动的模型体系、云原生架构及前沿AI技术有系统性研究和实践认知。管理能力:具备较强的团队协作意识与组织协调能力,能有效带领团队推进研发任务落地。能够统筹把控技术研发全过程,监督项目质量与执行进度,确保目标达成。行业洞察能力:具备数字化业务场景的理解力和行业发展趋势的预判能力,可为产品创新提供前瞻性技术储备与解决方案支持。其他要求:热爱技术创新,具备快速学习与适应新技术环境的能力。拥有良好的应变能力和结果导向意识,能高效完成既定工作目标。