鱼泡网首页职位公司校园意外险下载APP

登录注册后可以:

直接与老板/牛人联系

更精准匹配求职意向

获取更多的求职信息

大模型应用算法组长(军工)

4-5万元/月
职位详情
微信扫码分享
举报
5-10年硕士sft/dpo/grpo军工大模型后训自动化评测基线智能体(Agent)研发大模型算法
职位概述 作为大模型算法组长,你将带领 3~6 人的算法团队,面向军工 ToB/ToG 场景,负责⼤模型的后训练、智能体(Agent)研发、场景化落地与国产化适配。你需要在确保信息安全和算力⾃主可控的前提下,持续提升模型能⼒、响应业务需求,并推动关键核⼼技术的突破。 主要职责 1. 大模型后训练算法研发 ○ 设计并落地 SFT、RLHF/RLAIF、DPO、LoRA/QLoRA 等后训练技术,构建符合军事安全要求的多模态大模型。 ○ 主导高质量军事语料与仿真数据清洗、标注、采样、评估及数据治理流程。 ○ 建立自动化评测基线,跟踪 MMLU、C-Eval、CMMLU、MilEval 等指标,并输出改进方案。 2. 大模型 Agent 框架设计与研发 ○ 搭建多角色、可组合的智能体体系(如 LangGraph、CrewAI、AutoGen),实现场景指令编排、长任务规划与工具调用。 ○ 结合实时 OSINT、C4ISR 数据流,研发弹性任务链路与推理加速策略(如 Function Calling + RAG + Toolformer)。 3. 场景化落地与评估 ○ 深度参与战场态势感知、兵棋推演、装备保障、情报分析等核心业务场景需求分析与算法方案定制。 ○ 与产品、工程、前线用户协作,完成 PoC→试点→部署全流程落地,并沉淀可复用交付件及技术文档。 4. 国产化适配与性能优化 ○ 负责大模型在 Ascend 910B、昆仑芯、LoongArch、x86+国产 GPU 等异构算力上的训练 / 推理性能优化。 ○ 推动 MindSpore、OneFlow、飞桨等国产深度学习框架的兼容适配与性能调优,确保自主可控。 5. 团队建设与技术治理 ○ 制定团队技术路线、OKR,培养梯队人才,推动内部知识共享与代码规范。 ○ 负责安全合规、保密管理、代码审计及交付质量把控。 任职资格 ● 计算机、电子工程、信息安全、应用数学等相关专业硕士及以上学历。 ● 5 年以上 NLP / 机器学习研发经验,2 年以上团队管理经验。 ● 精通 Transformer、MoE、深度微调与训练加速(DeepSpeed/Megatron/ColossalAI)。 ● 熟悉 RLHF/RLAIF、DPO 等对齐技术及其在安全场景下的改进方案。 ● 具备 Agent 编排、工具调用、多模态融合(文+图+遥感+时序)实践经验。 ● 熟悉国产芯片与深度学习框架(MindSpore、OneFlow、Paddle等),具备算子优化或并行推理经验。 ● 有较深度的ToB/ToG项目交付经验。 加分项 ● 拥有 LangGraph、CrewAI、AutoGen 等开源 Agent 框架落地经验。 ● 在顶会/期刊(NeurIPS、ICLR、ACL、IJCAI、国防科技期刊等)发表过 LLM/RLHF/工具学习相关论文。 ● 对AI Coding有过比较深度的实践。了解CLAUDE CODE实现原理。 你将获得 ● 核心使命—与一线部队和科研机构共创国家安全关键 AI 能力。 ● 成长空间—直面极端场景挑战,积累军工级大模型技术栈与项目经验。 ● 竞争薪酬—行业领先薪酬 + 年度奖金 + 弹性激励 + 安家补贴。 ● 专利论文—支持专利申请与学术发表,鼓励技术深耕与影响力扩散。

职位总结围绕职位描述,归纳工作内容、招聘要求

杜女士IP:广东佛山

迈动云智

·人事经理
工商信息

法定代表人:

董帆燕

成立日期:

2013-05-14

查看全部

工作地址
北京海淀区中关村768创意产业园b座5号门与6号门之间是正门
点击查看地图

海淀区

搜索

各大行业职位任你选

首次验证通过即注册鱼泡直聘账号

获取验证码
已阅读并同意
《隐私政策》《服务协议》
登录/注册
请选择城市
热门城市ABCDEFGHJKLMNPQRSTWXYZ
全国