腾讯(tencent)招聘生态发展部-资深游戏测试工程师-Agent评测
招聘职位:
生态发展部-资深游戏测试工程师-Agent评测 搜索同类职位
岗位职责:
1.负责AI Agent全链路评测与质量保障工作,聚焦Agent能力基准测试、自动化评测基座建设及分级评测指标定义;
2.针对AI生成的非确定性与参数化特点,设计并量化评测标准,搭建科学的分级评测指标体系;
3.主导构建高质量的基准测试集(Benchmark),覆盖多轮交互、长短上下文等复杂场景,解决AI生成结果验证标准量化的核心难题;
4.参与设计和研发Agent自动化评测基座,通过构建自动化测试脚本和引入大模型交叉验证(LLM-as-a-Judge)机制,提升评测效率;
5.建立高效的缺陷定界机制,精准判断问题根因,输出多维度评测报告并协同开发团队推动问题解决。
岗位要求:
1.本科及以上学历,计算机、软件工程、人工智能等相关专业,3年及以上测试开发/评测经验,具备大模型或AI Agent核心评测经验;
2.深入理解大模型及AI Agent核心运行逻辑,能快速拆解Agent驱动游戏生成的业务链路;
3.具备优秀的逻辑思维与缺陷定界能力,能基于生成日志、链路追踪工具快速定位复杂AI生成异常的根因;
4.具备优秀的跨团队沟通协作能力和执行力,能高效对接算法、研发、产品团队,推动测试工作落地和问题闭环;
5.精通至少一门编程语言,具备扎实的编码基础。
加分项:
1.有从0到1搭建AI自动化评测基准平台的实战经验;
2.工作中独立开发过Agent应用,并达到提效预期;
3.熟悉小游戏功能,对游戏领域有浓厚兴趣;
4.具备良好的数据分析能力,能通过评测数据提炼产品质量趋势,反推Agent策略的迭代;
5.有丰富的跨领域合作经验,能够快速理解不同业务场景下的评测需求。
岗位介绍:
在腾讯,优秀的技术质量管理,保证腾讯每一个的产品与服务能更加稳定、顺畅、安心地被用户使用和体验。与技艺高超的同事们一同深化对架构设计、数据和产品的理解,在美好向善的世界里,成为一块闪耀的基石。
1.负责AI Agent全链路评测与质量保障工作,聚焦Agent能力基准测试、自动化评测基座建设及分级评测指标定义;
2.针对AI生成的非确定性与参数化特点,设计并量化评测标准,搭建科学的分级评测指标体系;
3.主导构建高质量的基准测试集(Benchmark),覆盖多轮交互、长短上下文等复杂场景,解决AI生成结果验证标准量化的核心难题;
4.参与设计和研发Agent自动化评测基座,通过构建自动化测试脚本和引入大模型交叉验证(LLM-as-a-Judge)机制,提升评测效率;
5.建立高效的缺陷定界机制,精准判断问题根因,输出多维度评测报告并协同开发团队推动问题解决。
岗位要求:
1.本科及以上学历,计算机、软件工程、人工智能等相关专业,3年及以上测试开发/评测经验,具备大模型或AI Agent核心评测经验;
2.深入理解大模型及AI Agent核心运行逻辑,能快速拆解Agent驱动游戏生成的业务链路;
3.具备优秀的逻辑思维与缺陷定界能力,能基于生成日志、链路追踪工具快速定位复杂AI生成异常的根因;
4.具备优秀的跨团队沟通协作能力和执行力,能高效对接算法、研发、产品团队,推动测试工作落地和问题闭环;
5.精通至少一门编程语言,具备扎实的编码基础。
加分项:
1.有从0到1搭建AI自动化评测基准平台的实战经验;
2.工作中独立开发过Agent应用,并达到提效预期;
3.熟悉小游戏功能,对游戏领域有浓厚兴趣;
4.具备良好的数据分析能力,能通过评测数据提炼产品质量趋势,反推Agent策略的迭代;
5.有丰富的跨领域合作经验,能够快速理解不同业务场景下的评测需求。
岗位介绍:
在腾讯,优秀的技术质量管理,保证腾讯每一个的产品与服务能更加稳定、顺畅、安心地被用户使用和体验。与技艺高超的同事们一同深化对架构设计、数据和产品的理解,在美好向善的世界里,成为一块闪耀的基石。
免责声明:
此信息由腾讯官网 (查看来源)审核并发布,我们转载该信息,仅出于传递更多就业招聘资讯、促进大学生及广大求职者就业之目的。该招聘职位信息的真实性、准确性、时效性及合法性均由原始发布方“腾讯官网”负责。我们作为信息转载平台,不构成求职建议,不涉及任何职业中介服务,不对其内容承担任何形式的保证责任。请用户在使用转载信息时保持审慎,自行判断并承担相应风险,求职请认准企业官方渠道!