Token Foundry-合版算法专家-Qwen
Company 通义实验室
Focus 技术 · 算法
北京, 杭州
July 29, 2026
岗位职责
- 合版核心算法研究:探索 On-policy Distillation、知识融合等先进技术,研究更优的 SFT Objective,实现多能力模型的高效合版,最大程度减少能力冲突与遗忘。
- 数据策略与冲突消解:深入分析不同能力域的数据配比,建立系统化的冲突检测与消解机制,制定科学的合版数据策略,保障模型在各项能力上的均衡与稳定。
- 合版评测体系建设:设计并推进高效、快速的合版评测方案,构建覆盖多维能力的自动化评测 Pipeline,实现合版效果的快速迭代与精准度量。
- 合版链路自动化:推动合版全流程的工程化与自动化,包括训练、评测、对比分析、版本管理等环节,提升模型交付的效率与可靠性。
- 前沿技术追踪与落地:持续关注模型融合、蒸馏、多任务学习等领域的前沿进展,将有效方法快速验证并落地到Qwen的合版实践中。
任职要求
- 计算机、机器学习、人工智能等相关专业,硕士及以上学历,博士优先。
- 具有大模型 Post-training(SFT / RL 等)或模型蒸馏、模型融合相关方向的实践经验。
- 精通 Python 及 PyTorch 等深度学习框架,具备扎实的工程实现能力,能够独立完成从算法研究到工程落地的全链路工作。
- 对数据敏感,具备良好的数据分析能力,能够系统性地定位模型能力瓶颈并制定优化策略。
加分项 熟悉 LLM 训练框架(如 Megatron-LM、DeepSpeed、FSDP)及推理引擎(如 vLLM、SGLang)的实现原理。 曾在 NeurIPS、ICLR、ICML、ACL 等顶级会议发表论文,在模型融合、知识蒸馏、多任务学习等方向具有一定学术影响力。 拥有知名开源项目贡献经历,在开源社区具有较好的影响力。 有大规模模型交付或版本迭代管理经验,熟悉模型从训练到上线的完整生命周期。
岗位标签
NEW