哔哩哔哩(bilibili|b站)招聘bilibili-音视频理解算法工程师
招聘职位:
bilibili-音视频理解算法工程师 搜索同类职位
岗位介绍:
职位描述
工作职责:
1. 负责强化学习训练框架的架构设计、研发与性能优化,根据业务需求持续演进训练策略与系统能力,提升大规模模型训练效率。
2. 深度分析与定位训练系统中的性能瓶颈(包括计算、通信、存储等),实施针对性优化,提升训练吞吐、稳定性与可扩展性。
3. 持续跟踪并集成业界前沿的训练优化技术(如 MoE、异步RL、LoRA RL、Agentic RL 等)。
工作要求:
1. 本科及以上学历,计算机相关专业,2年以上工作经验。
2. 熟悉 Python/C++ 中至少一种编程语言,具备扎实的工程基础。
3. 深入理解自然语言处理、计算机视觉或多模态算法,熟悉主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构,具备分布式训练(如 FSDP、DeepSpeed、Megatron 等)实战经验。
4. 熟悉常见强化学习训练算法(如 GRPO、DAPO 等)及训练框架(如 verl),熟悉异步强化学习范式。
5. 有相关领域开源项目贡献经验者优先。
6. 具备大规模训练实操经验者优先。
投递简历
职位描述
工作职责:
1. 负责强化学习训练框架的架构设计、研发与性能优化,根据业务需求持续演进训练策略与系统能力,提升大规模模型训练效率。
2. 深度分析与定位训练系统中的性能瓶颈(包括计算、通信、存储等),实施针对性优化,提升训练吞吐、稳定性与可扩展性。
3. 持续跟踪并集成业界前沿的训练优化技术(如 MoE、异步RL、LoRA RL、Agentic RL 等)。
工作要求:
1. 本科及以上学历,计算机相关专业,2年以上工作经验。
2. 熟悉 Python/C++ 中至少一种编程语言,具备扎实的工程基础。
3. 深入理解自然语言处理、计算机视觉或多模态算法,熟悉主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构,具备分布式训练(如 FSDP、DeepSpeed、Megatron 等)实战经验。
4. 熟悉常见强化学习训练算法(如 GRPO、DAPO 等)及训练框架(如 verl),熟悉异步强化学习范式。
5. 有相关领域开源项目贡献经验者优先。
6. 具备大规模训练实操经验者优先。
投递简历
免责声明:
此信息由b站官网 (查看来源)审核并发布,我们转载该信息,仅出于传递更多就业招聘资讯、促进大学生及广大求职者就业之目的。该招聘职位信息的真实性、准确性、时效性及合法性均由原始发布方“b站官网”负责。我们作为信息转载平台,不构成求职建议,不涉及任何职业中介服务,不对其内容承担任何形式的保证责任。请用户在使用转载信息时保持审慎,自行判断并承担相应风险,求职请认准企业官方渠道!