小米科技有限责任公司 →

顶尖应届-具身大模型训练推理工程师-机器人事业部

北京汽车部校园招聘顶尖应届汽车部官网 · HTML
分享这个机会转给正在找工作的朋友

SHARE POSTER

职位分享海报

长按图片可保存;二维码直达职位详情,并标记匿名分享渠道。


职位说明

1、基于 PyTorch 生态(FSDP / DeepSpeed / Megatron 等)设计并实现具身大模型分布式训练方案(DP / TP / PP / MoE); 2、推动混合精度(BF16 / FP8)与算子融合(FlashAttention / Triton kernel)等性能优化,构建高吞吐数据 pipeline 与 shard 策略; 3、负责模型推理加速与部署优化,设计 Causal-DiT / MoE-DiT / AR-Diffusion 等混合架构提升吞吐与生成质量; 4、构建模型数据的自蒸馏 / 自进化框架,让模型能高效输出数据并持续优化; 5、支持大规模实验追踪、管理、指标可视化,与算法团队协同完成模型高效迭代。 1、扎实的 Python / C++ 基础,熟悉 Linux; 2、深入理解 PyTorch 分布式训练,熟悉至少一种分布式训练优化框架(FSDP / DeepSpeed / Megatron-LM); 3、深入理解 GPU / CPU / 内存 / 网络 基本原理;理解 Transformer / Diffusion / MoE 等主流结构的性能瓶颈与优化方法。 加分项 1、多模态 / VLA / 世界模型 / 视频生成 大规模训练经验; 2、熟悉 NCCL / RDMA / InfiniBand 调优;有自定义 CUDA / Triton kernel 经验; 3、熟悉 TensorRT / ONNX Runtime / Triton 等推理框架,具备量化、算子融合、显存优化实践经验; 4、在 NeurIPS / ICLR / ICML / CVPR / ICCV / ECCV / RSS / CoRL / ICRA 等顶会有相关成果。

该职位来自企业官方集团招聘门户。当前归入品牌招聘入口展示,具体用人法律主体、签约主体和劳动关系请以投递页及录用材料为准。