5-10年硕士自然语言深度学习大模型互联网/AI技术总监
学历要求:
计算机科学、人工智能或相关专业硕士及以上学位,拥有博士学位者优先考虑。
工作经验:
需具备5年以上大模型研发或人工智能领域相关工作经验,熟悉大规模分布式训练、深度学习及NLP/NLU算法,在相关技术架构设计方面具备扎实积累。
专业技能:
深入理解主流大模型的原理及其训练与微调方法,包括GPT系列、LLaMA、ChatGLM等模型的RLHF三阶段训练流程和LoRA等微调技术。
熟练使用TensorFlow、PyTorch、Megatron、DeepSpeed等主流框架,具备实际的大规模分布式训练落地经验。
对大数据模型技术、云原生架构等前沿方向有系统性研究和深刻认知。
管理能力:
具备较强的团队协作意识与沟通协调能力,能够有效组织团队推进项目高效执行。
具备研发项目的整体把控能力,可对项目质量、进度进行有效监督与管理。
项目经验:
有带领团队实现关键技术突破的成功案例,曾在人工智能或大模型领域取得显著研究成果或获得相关专利者更具优势。
行业洞察能力:
具备敏锐的数字化业务洞察力和行业发展趋势预判能力,能为公司产品与服务提供具有前瞻性的技术储备与解决方案支持。
其他要求:
热爱技术,具备快速学习新技术和适应新环境的能力。
具备出色的应变能力和目标导向执行力。
职位总结围绕职位描述,归纳工作内容、招聘要求
招聘人数1-2人
薪资报酬4-7万元/月
招聘有效期职位25天内有效
工作地点深圳南山区留学生创业大厦二期16
核心工作内容:
作为研发总监,主要负责大模型算法研发团队的组建与管理,制定技术战略与研发计划,领导团队进行模型训练、优化及部署,推动技术创新与突破,确保项目高效执行与高质量交付,同时与业务部门紧密合作,提供前瞻性技术解决方案,持续提升产品竞争力与技术领先性。
岗位基本条件:
学历要求:计算机科学、人工智能或相关专业硕士及以上学位,拥有博士学位者优先考虑。工作经验:需具备5年以上大模型研发或人工智能领域相关工作经验,熟悉大规模分布式训练、深度学习及NLP/NLU算法,在相关技术架构设计方面具备扎实积累。专业技能:深入理解主流大模型的原理及其训练与微调方法,包括GPT系列、LLaMA、ChatGLM等模型的RLHF三阶段训练流程和LoRA等微调技术。熟练使用TensorFlow、PyTorch、Megatron、DeepSpeed等主流框架,具备实际的大规模分布式训练落地经验。对大数据模型技术、云原生架构等前沿方向有系统性研究和深刻认知。管理能力:具备较强的团队协作意识与沟通协调能力,能够有效组织团队推进项目高效执行。具备研发项目的整体把控能力,可对项目质量、进度进行有效监督与管理。项目经验:有带领团队实现关键技术突破的成功案例,曾在人工智能或大模型领域取得显著研究成果或获得相关专利者更具优势。行业洞察能力:具备敏锐的数字化业务洞察力和行业发展趋势预判能力,能为公司产品与服务提供具有前瞻性的技术储备与解决方案支持。其他要求:热爱技术,具备快速学习新技术和适应新环境的能力。具备出色的应变能力和目标导向执行力。