← Back to job listings
MT
AI 产品经理(J10877)
Moore Threads · 北京市
About The Role
岗位职责
- AI Agent 框架产品设计,负责 AI Agent 框架的产品规格定义,覆盖 Tool use、多智能体编排、分层记忆系统及 MCP/CLI 集成;协调工程团队完成从架构设计到生产部署的完整交付;
- 产品需求定义与路线图规划,深入理解 GPU 并行编程模型与大模型系统架构,主导 GPU 软件路线图制定;
- 跨团队技术协作与决策支撑,与研发团队、市场团队、销售团队深入沟通密切配合,管理产品全生命周期;
- 技术布道与生态建设, 撰写面向客户与开发者社区的技术白皮书、性能测试报告及最佳实践文档;代表公司参与大模型推理、AI 基础设施等领域的技术交流,建立产品在 GPU 软件生态中的技术影响力;
- 任职要求
- ● 计算机体系结构、并行计算、软件工程等相关专业本科及以上学历,5 年以上产品经验,其中 2 年以上 GPU 软件 / AI 基础设施相关背景;
- ● 深入理解 GPU 微架构核心概念(SM、Warp 调度、显存层次、共享内存),熟悉 CUDA/Triton 编程模型;
- ● 精通 LLM 推理全链路原理,深入理解 Prefill/Decode 分离、Continuous Batching、Speculative Decoding 等核心机制,具备 vLLM、SGLang、TRT-LLM 或 TGI 等主流推理框架的实操与评估能力;
- ● 熟悉 AI Agent 系统架构(ReAct、Tool use、多智能体编排),具备将 Agent 框架从原型推进至生产部署的完整产品经验;
- ● 熟练掌握分布式并行策略(TP/PP/DP/EP/SP)的配置逻辑与性能权衡,能以 MFU、TGS、TTFT 等量化指标评估优化收益;
- ● 优秀的技术沟通与文档能力,能将 GPU 架构层的复杂技术方案转化为客户可理解、可执行的交付物;
- 加分项
- ● 有 CUDA/Triton kernel 实际编写或调优经验;
- ● 熟悉 PD 分离架构(Prefill-Decode Disaggregation)或 MoE 路由/GroupedGEMM 优化方案;
- ● 了解国产 GPU 软件生态(昇腾 CANN、摩尔线程 MUSA、沐曦 MXMACA 等);
- ● 参与过开源推理框架(vLLM、SGLang 等)的贡献或适配工作;
- ● 有 AI 可观测性平台(Langfuse、Phoenix 等)的产品设计或集成经验。
This is an external listing. JobSpring does not represent or verify the employer. Report this listing
JobSpring