美团
校招【北斗】分布式AI推理/AI-Infra研发工程师
北京/深圳 · 校招 · 2027 届 · 本科
长期有效
任职要求
- 【岗位要求】
- 1、2027届获得本科及以上学历,计算机、数学等相关专业优先;
- 2、具有优秀的基础算法、代码能力,熟练掌握C/C++或Python编程语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 3、熟悉计算机体系结构,对 CPU/GPU 内存层次、PCIe/NVLink 带宽有清晰概念;理解操作系统核心原理(如进程调度、内存管理);
- 4、熟悉分布式系统的基本原理(如一致性协议、一致性哈希、负载均衡算法、集合通信 MPI/NCCL),具备良好的分布式思维;
- 5、具备 CUDA C/C++ 开发或优化经验,或了解 OpenAI Triton 算子编写者优先;
- 6、熟悉或阅读过主流推理/训练开源项目的源码者优先,如 vLLM、SGLang、TensorRT-LLM、Triton Inference Server、DeepSpeed、Megatron-LM 等
- 【岗位吸引力】
- 在这一职位上:
- 您将有机会参与无人机、机器人领域内大规模的数据处理分析系统的构建,进而为业务的深入发展做出贡献;
- 您处理的不是实验室的干净数据,而是自动驾驶、多模态智能体等真实物理世界的海量、高频、连续数据。你的代码将实时支撑物理与数字世界的万亿级流转;
- 您将全流程参与“底层算力 - 集合通信 - 显存调度 - 集群网关”的端到端优化,你的每一次延迟降低,都将直接变成物理实体更快的反应速度。
岗位描述
【岗位职责】
为了更好地提升城市即时配送的效率与体验,2017年,美团启动了无人机配送服务的探索,通过科技创新推动履约工具变革,加快建设空地协同的本地即时配送网络。目前,美团已初步完成了自主飞行无人机、智能化调度系统及高效率运营体系的研发建设工作,由此打造了一个服务于多场景、多天候的城市低空物流解决方案。
在该岗位中您将负责:
- 1、推理框架研发:参与构建与优化高性能分布式 AI 推理引擎,支持大模型在多卡、多机环境下的高效分布式部署与高效通信;
- 2、分布式任务调度:参与设计与实现面向大模型推理的高效任务调度算法。针对 Prefill与 Decoding阶段的不同资源需求,协助研发 PD 分离架构下的请求流转与精细化调度;
- 3、全局负载均衡:协助构建多节点、多实例集群的负载均衡策略。基于请求长度预测、全局 KV Cache 缓存命中率以及运行时显存状态,实现智能流量分发,避免集群局部热点与雪崩;
- 4、弹性伸缩与容错:参与大规模分布式推理集群的健康度监控,协同开发故障自动检测与动态隔离机制,提升高并发在线服务(LLM-as-a-Service)的可用性(SLA);
- 5、性能剖析与调优:协助排查高并发场景下,由网络延迟、长尾请求(Tail Latency)、线程锁竞争或集合通信(NCCL)瓶颈导致的全局吞吐跌落;
- 6.主动探索并运用各类AI工具优化日常工作流程,积极推动AI在无人机业务中的落地实践。
【任职要求】
【岗位要求】
- 1、2027届获得本科及以上学历,计算机、数学等相关专业优先;
- 2、具有优秀的基础算法、代码能力,熟练掌握C/C++或Python编程语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 3、熟悉计算机体系结构,对 CPU/GPU 内存层次、PCIe/NVLink 带宽有清晰概念;理解操作系统核心原理(如进程调度、内存管理);
- 4、熟悉分布式系统的基本原理(如一致性协议、一致性哈希、负载均衡算法、集合通信 MPI/NCCL),具备良好的分布式思维;
- 5、具备 CUDA C/C++ 开发或优化经验,或了解 OpenAI Triton 算子编写者优先;
- 6、熟悉或阅读过主流推理/训练开源项目的源码者优先,如 vLLM、SGLang、TensorRT-LLM、Triton Inference Server、DeepSpeed、Megatron-LM 等
【岗位吸引力】
在这一职位上:
您将有机会参与无人机、机器人领域内大规模的数据处理分析系统的构建,进而为业务的深入发展做出贡献;
您处理的不是实验室的干净数据,而是自动驾驶、多模态智能体等真实物理世界的海量、高频、连续数据。你的代码将实时支撑物理与数字世界的万亿级流转;
您将全流程参与“底层算力 - 集合通信 - 显存调度 - 集群网关”的端到端优化,你的每一次延迟降低,都将直接变成物理实体更快的反应速度。
你的简历匹配这个岗位吗?
上传简历,AI 会对照这份 JD 指出你的差距和需要补强的地方
该岗位可能会问的问题
基于 后端开发 岗位的常见面试问题整理
请解释 RESTful API 的设计原则,并举一个你实际设计过的例子
查看答题思路
1. 资源导向:URL 表示资源而非操作 2. HTTP 方法语义:GET/POST/PUT/DELETE 对应查增改删 3. 无状态:每个请求包含全部所需信息 4. 统一接口:一致的响应格式(如 JSON) 5. 举例:用户模块 /users/{id},GET 查/POST 创/PUT 改/DELETE 删,返回统一 {code, data, message}
MySQL 索引的底层数据结构是什么?为什么用 B+ 树而不是哈希表或红黑树
查看答题思路
1. B+ 树:非叶子节点只存 key 不存 data,单次 IO 读更多 key 2. 叶子节点形成有序链表,支持范围查询(哈希表不支持范围) 3. 高度低(3-4 层可存千万级数据),减少磁盘 IO 4. 对比红黑树:B+ 树是多叉的,高度更低,磁盘 IO 更少
你参与过的最复杂的后端项目是什么,你承担了什么角色
查看答题思路
1. 项目背景:一句话说清业务场景 2. 技术栈:语言/框架/数据库/中间件 3. 个人职责:你做的,不是团队做的——用「我设计了」「我优化了」 4. 难点:遇到了什么具体问题,怎么解决的 5. 数据佐证:QPS 从多少提到多少 / 延迟降了多少
什么是微服务架构,和单体架构相比各有什么优劣
查看答题思路
1. 单体:所有功能在一个进程,部署简单,初期开发快;缺点是耦合高、扩展难 2. 微服务:按业务拆分独立服务,独立部署/扩展/技术栈 3. 优点:故障隔离、团队自治、技术栈灵活 4. 缺点:网络开销、分布式事务、运维复杂度 5. 判断标准:团队<10 人或业务不复杂时,单体是更好的选择
如何设计一个高并发的秒杀系统
查看答题思路
1. 前端限流:按钮置灰、验证码 2. 网关层:Nginx 限流 + 负载均衡 3. 业务层:Redis 预减库存(原子操作),消息队列异步下单 4. 数据库:乐观锁扣库存,读写分离 5. 降级方案:流量过大时返回「已售罄」而非崩溃
更多面试题库功能即将上线
信息来源:企业官方招聘页。投递前请以官网信息为准。