集团安全部-AI高级安全工程师-大模型安全研究-杭州
Company 阿里巴巴
Focus 技术 · 安全
杭州
July 29, 2026
岗位职责
岗位职责:
- 防御机制测试: 对公司内大模型的安全围栏进行黑盒测试,通过实验分析其在内容过滤、逻辑保护方面的实现路径和问题,并输出分析报告。
- 安全围栏建设: 参与公司模型的内容审计系统开发,编写并维护核心的防御 Prompt 和过滤规则库。
- 风险路径探测: 对公司模型系统(含插件、沙箱)进行常规的安全评估,识别提示词泄露和接口滥用的潜在风险,并提出加固建议。
- 反蒸馏技术落地: 协助落地基础的防爬取、模型输出干扰等风控方案,保护公司模型资产。
- 跨团队协作: 与算法团队配合,将发现的安全漏洞转化为模型微调或对齐的训练样本。
任职要求
- 教育背景: 计算机、信息安全相关专业本科及以上学历, 对大模型底层原理(Transformer、RLHF等)有一定理解。
- 专业技能:
- 熟悉 Python/Go 至少一种,有扎实的编码功底,能自己写工具。
- 对 Prompt Engineering 有浓厚兴趣,是个“调教模型”的高手,能通过文字技巧引导模型突破限制。
- 具备基础的网络安全思维(如逻辑漏洞分析、接口测试),了解容器或 Linux 沙箱基本概念。
- 核心潜力: 具备极强的自主学习能力。大模型安全每天都在变,你需要能快速读懂英文技术论文或社区讨论(如 GitHub/Twitter/Reddit)。
- 工作心态: 具备“红队思维”。喜欢钻研“这个东西是怎么工作的”、“我怎么能让它不按常理出牌”,不迷信权威方案。
- 加分项(非必须): 有过 NLP 项目经验,或者在 Web 安全、移动安全领域有过一定深度的研究。
岗位标签
NEW