蚂蚁数字科技-数字科技线-大语言模型算法工程师
Company 蚂蚁集团
Focus 技术 · 算法
北京, 上海, 杭州
July 30, 2026
岗位职责
- 参与大语言模型(LLM)的预训练、微调与对齐技术研发,以及工具构建;
- 探索大模型在垂直行业领域(金融/能源/医疗等)的高效适配与落地,推动模型能力与行业场景深度融合,支撑蚂蚁数字科技对外输出的大模型产品(如百灵大模型系列);
- 协助构建高质量数据集(如对话、工具调用、文档解析),设计数据清洗与增强策略,以及工具构建;
- 开发自动化评估工具,监控模型在准确性、安全性、公平性等维度的表现;
- 跟踪大模型前沿进展(如MoE、长上下文、Agent框架),参与内部技术复现与验证;
- 与产品、工程及行业解决方案团队紧密协作,将前沿算法能力转化为可交付、可复用的技术方案。
任职要求
- 计算机、人工智能、数学等相关专业硕士及以上学历,1-6年相关工作经验;
- 精通主流大语言模型架构(如 LLaMA、ChatGLM、Qwen 等),具备扎实的 NLP 和深度学习基础;
- 精通分布式训练框架(如 DeepSpeed、Megatron-LM);
- 精通 SFT、RLHF(如PPO/DPO/GRPO)及对齐算法,有实际的大模型预训练、微调或对齐经验,具备构建复杂奖励模型(Reward Model)的实战经验;
- 精通Agentic技术架构,对Claude Code、OpenClaw等有深入理解,有大规模沙箱环境构建、工具调用(Tool Use)及多轮决策轨迹合成的相关研发经验;
- 具备良好的工程实现能力,熟练使用 PyTorch/TensorFlow 等框架;
- 对大模型在产业落地中的挑战(如幻觉控制、领域泛化、问题修复)有深入理解者优先。 加分项 ● 在NeurIPS/ICML/ACL/EMNLP等顶会发表过大模型相关论文者优先; ● 有代表性开源大模型/智能体项目者优先。
岗位标签
NEW
特色标签
Agent框架、DeepSpeed、Megatron-LM、MoE模型、Python、优秀开源项目经历、公平性评估、分布式训练、医疗、医疗AI、参数微调、发表算法相关优秀论文、多模态大模型、大模型算法、大模型训练、安全性评估、对话数据、工具开发、数据增强、数据清洗、模型对齐、模型微调、模型评估、模型预训练、深度学习、算法工程化经验、能源、能源数字化、自动化工具、行为对齐、语言大模型、金融、金融科技、长上下文建模