jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

Token Foundry-大模型Post-training算法工程师-Qwen

Company 通义实验室

Focus 技术 · 算法

北京, 杭州, 上海

July 29, 2026

岗位职责

千问(Qwen)是由通义实验室自主研发的超大规模语言模型,具备跨语言、跨任务的理解与生成能力。Qwen系列模型,涵盖参数量从几百 M 到 T 级的基座大语言模型,并相继推出Qwen-VL、Qwen-Audio、Qwen-Omni、Qwen-Coder、Qwen-Image等系列模型。从多轮对话到代码生成,从逻辑推理到内容创作,从单一多模态到全模态统一理解生成,Qwen 正在打造全球领先的全模态模型技术体系,推动AI在企业服务、开发者生态、个人用户等领域的深度应用,引领下一代人工智能的发展。 在蕴含丰富世界知识的预训练模型的基础上,我们利用 Post-train 打造出我们想要的能够服务人类的 AI 模型。我们通过 RL、SFT、RFT 等技术,探索大模型潜能的同时,也在塑造大模型的能力与性格。本着为人类服务的目标,我们的 Post-train 将会重点探索其推理能力,实现深度思考,并致力于提升其 Agent 能力,让大模型服务于真实世界的任务。

工作职责:

  1. 探索更多可 scalable 的 verifier 信号,并通过 RL 提升模型的各项能力。
  2. 提升 reward model 在创作、人类偏好、指令遵循等各专项上的能力,减少reward hacking和bias。
  3. 研究 reasoning path压缩和外推,实现更高质量的推理思考。
  4. 将LLM的推理能力和Agent以及其他模态相结合,探索统一模态的reasoning。

任职要求

  1. 计算机、机器学习等方向相关专业,博士及硕士优先。
  2. 具有 post-training 或强化学习相关方向经验。
  3. 精通 Python 以及 Pytorch 等深度学习框架,具有较强的代码工程能力。

加分项:

  1. 熟悉LLM推理引擎(如vLLM,SGLang)的实现。
  2. 曾发表顶级会议论文并具有一定的学术影响力,包括但不限于NeurIPS、ICLR、ICML、ACL等。
  3. 拥有知名开源项目,在开源社区具有较好的影响力。

岗位标签

NEW

Apply now

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.