小红书(xiaohongshu)招聘大模型 Platform 全栈研发工程师/专家
招聘职位:
大模型 Platform 全栈研发工程师/专家 搜索同类职位
岗位职责:
工作职责:
1.端到端平台研发与交付: 参与小红书大模型平台 QuickSilver 的全栈研发工作,借助 AI 编程工具高质量完成从前端交互界面到后端业务逻辑的端到端功能交付,构建覆盖全链路的监控告警与可观测数据体系。
2.AI Workflow 工程链路建设: 参与大模型数据管理、模型训练、模型压缩、推理部署等核心工具链的研发;协同算法与产品团队,优化云原生环境下的 AI 工作流范式,持续提升模型迭代效能。
3.分布式 GPU 调度与治理: 参与平台核心的 Quota 管理与资源调度模块开发,攻坚多机房、多集群、异构计算资源(GPU / NPU / PPU)下的多租户配额治理、弹性伸缩与碎片优化。
4.AI 前沿技术预研与落地: 持续追踪 AI 基础设施与大模型平台的前沿技术动态,探索并沉淀团队 AI Native 研发最佳实践,将业界领先的 AI 工程架构与实践理念引入团队。
任职要求:
任职要求:
1.AI Native 研发: 具备快速学习能力,熟练且高频地使用主流大模型与 AI 编程辅助工具(如 Claude Code、Cursor、GitHub Copilot 等),能够根据产品逻辑与用户行为,自主完成从架构设计到代码实现的全链路交付。
2.基础技术能力: 计算机/软件工程等相关专业,具备扎实的计算机系统基础,有强烈的全栈开发意愿,熟悉 Go / Python / Java 中的至少一门后端语言,同时熟悉 Vue 3 / TypeScript / HTML / CSS 等现代前端技术栈。
3.云原生架构认知: 熟悉 Linux 系统,了解 MySQL / Redis / MQ 等常见中间件;接触过 Kubernetes 生态技术栈(Docker / K8s 等),对云原生大模型系统有一定认知。
4.AI 技术栈认知: 对 AI 领域充满浓厚兴趣,了解大模型(LLM / CV / NLP)的基本原理与应用场景,对 PyTorch / Transformer 架构有基本认知。
软素质与极客精神: 具备良好的工程质量意识与代码风格;沟通协作顺畅,自驱力强,能在高技术密度的团队中快速成长。
加分项:
1.大模型部署与框架经验: 有大模型部署实践经验,对 vLLM / SGLang / Dynamo 等至少一种推理框架有使用经验;熟悉 DeepSeek / Qwen 等主流模型架构,有英伟达 GPU 或华为 Ascend NPU 使用经验。
2.云原生调度及实战经验: 接触过 Volcano / 联邦集群等云原生技术,对分布式系统、抢占、潮汐混部、PD 分离部署等有实践经验或深刻理解。
3.开源贡献与独立交付: 有优秀的个人开源项目贡献、技术博客写作经历,或曾基于 AI 工具独立设计并交付过完整的 Web / AI 应用。
工作职责:
1.端到端平台研发与交付: 参与小红书大模型平台 QuickSilver 的全栈研发工作,借助 AI 编程工具高质量完成从前端交互界面到后端业务逻辑的端到端功能交付,构建覆盖全链路的监控告警与可观测数据体系。
2.AI Workflow 工程链路建设: 参与大模型数据管理、模型训练、模型压缩、推理部署等核心工具链的研发;协同算法与产品团队,优化云原生环境下的 AI 工作流范式,持续提升模型迭代效能。
3.分布式 GPU 调度与治理: 参与平台核心的 Quota 管理与资源调度模块开发,攻坚多机房、多集群、异构计算资源(GPU / NPU / PPU)下的多租户配额治理、弹性伸缩与碎片优化。
4.AI 前沿技术预研与落地: 持续追踪 AI 基础设施与大模型平台的前沿技术动态,探索并沉淀团队 AI Native 研发最佳实践,将业界领先的 AI 工程架构与实践理念引入团队。
任职要求:
任职要求:
1.AI Native 研发: 具备快速学习能力,熟练且高频地使用主流大模型与 AI 编程辅助工具(如 Claude Code、Cursor、GitHub Copilot 等),能够根据产品逻辑与用户行为,自主完成从架构设计到代码实现的全链路交付。
2.基础技术能力: 计算机/软件工程等相关专业,具备扎实的计算机系统基础,有强烈的全栈开发意愿,熟悉 Go / Python / Java 中的至少一门后端语言,同时熟悉 Vue 3 / TypeScript / HTML / CSS 等现代前端技术栈。
3.云原生架构认知: 熟悉 Linux 系统,了解 MySQL / Redis / MQ 等常见中间件;接触过 Kubernetes 生态技术栈(Docker / K8s 等),对云原生大模型系统有一定认知。
4.AI 技术栈认知: 对 AI 领域充满浓厚兴趣,了解大模型(LLM / CV / NLP)的基本原理与应用场景,对 PyTorch / Transformer 架构有基本认知。
软素质与极客精神: 具备良好的工程质量意识与代码风格;沟通协作顺畅,自驱力强,能在高技术密度的团队中快速成长。
加分项:
1.大模型部署与框架经验: 有大模型部署实践经验,对 vLLM / SGLang / Dynamo 等至少一种推理框架有使用经验;熟悉 DeepSeek / Qwen 等主流模型架构,有英伟达 GPU 或华为 Ascend NPU 使用经验。
2.云原生调度及实战经验: 接触过 Volcano / 联邦集群等云原生技术,对分布式系统、抢占、潮汐混部、PD 分离部署等有实践经验或深刻理解。
3.开源贡献与独立交付: 有优秀的个人开源项目贡献、技术博客写作经历,或曾基于 AI 工具独立设计并交付过完整的 Web / AI 应用。
免责声明:
此信息由小红书官网 (查看来源)审核并发布,我们转载该信息,仅出于传递更多就业招聘资讯、促进大学生及广大求职者就业之目的。该招聘职位信息的真实性、准确性、时效性及合法性均由原始发布方“小红书官网”负责。我们作为信息转载平台,不构成求职建议,不涉及任何职业中介服务,不对其内容承担任何形式的保证责任。请用户在使用转载信息时保持审慎,自行判断并承担相应风险,求职请认准企业官方渠道!