jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

蚂蚁集团-大模型评测高级前端研发工程师-北京/杭州

Company Antgroup

Focus Tech · Algorithm

Location 北京, 杭州

Published July 31, 2026

岗位职责

评测正在成为驱动大模型能力迭代和发版决策的关键基础设施。我们希望通过优秀的产品交互和数据表达,让复杂评测能力真正转化为模型研发人员易用、可信、高效的工作平台。

  1. 参与建设支撑大模型研发与进化的下一代评测平台,围绕评测方案生产、模型能力分析和发版决策等核心场景,设计并实现清晰、高效的产品交互,持续降低复杂评测系统的使用门槛。
  2. 负责评测配置、开发调试、任务执行、失败诊断、版本对比、样本分析和结果报告等核心工作台建设,通过任务拓扑、运行时间线、轨迹、Diff 和多模型结果等可视化方式,帮助用户理解评测过程和结论依据。
  3. 建设可复用的评测前端基础能力,包括 Schema 驱动表单、状态与错误表达、复杂数据表格、可视化组件和统一交互规范,并持续提升大型任务和海量结果场景下的性能、稳定性和可维护性。
  4. 深入模型研发和评测一线,与产品、后端、测试开发及评测专家共同定义问题,参与领域模型和接口设计,对需求分析、技术方案、开发测试、灰度发布和用户反馈闭环承担端到端责任。

任职要求

  1. 【前端技术基础】具备扎实的计算机基础和前端工程能力,熟练掌握 JavaScript、TypeScript、HTML、CSS,以及 React、Vue 等至少一种主流前端技术栈。
  2. 【复杂平台研发】有复杂平台型产品的研发经验,能够独立负责中大型前端模块的架构设计和交付,熟悉组件设计、状态管理、数据流、权限、路由、构建发布及前端监控等工程机制。
  3. 【产品理解与复杂交互】具备较强的产品 sense,能够深入理解模型研发和评测用户的工作目标,参与信息架构与交互方案设计,并将配置关系、任务状态、执行轨迹、版本差异和分析结果转化为清晰、易理解的用户体验;有复杂表单、工作台、可观测或数据分析产品经验者优先。
  4. 【工程质量与诊断】具备较强的工程质量意识,重视类型安全、代码可维护性、性能优化、异常处理、自动化测试和兼容性,能够结合日志、监控及上下游接口定位并闭环复杂问题。
  5. 【学习与协作】具备快速学习能力和持续的技术热情,对大模型和复杂工程问题保持好奇心和主动性;具备良好的沟通协作能力,能够与产品、后端、测试及领域专家共同推进方案落地。
  6. 【加分项】有大模型或 Agent 平台、机器学习平台、研发工具、工作流系统、可观测平台、数据分析产品或低代码平台建设经验者优先。

岗位标签

NEW

特色标签

CSS、Diff视图、HTML5、JavaScript、Node.js、React、Vue、云计算、交互式图表、任务链路、前端工程化、前端开发、前端开发经验、前端技术栈、图表展示、基础设施、大模型平台、大语言模型、工作中心、执行链路、指标分析、控制台、操作台、数据可视化、数据安全、数据洞察、智能体、流程图、测评、测评工作台、测试、测试工具、测试平台、测试报告、版本对照、版本差异、研发效能、结果分析、计算机/软件工程相关专业、评价、评估、评估报告、评估系统、评测报告、超大预训练模型、金融

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.