提示:国家大学生就业服务平台提醒您注意甄别违法、虚假、高风险招聘信息,警惕索要隐私信息的行为。在投递简历前务必提前确认企业资质与职位真实性,若遇到诈骗、泄露个人隐私等情况,请向我们投诉举报。
  • 27-秋招 GPU集合通信研发工程师
  • [全职]
  • ——
  • 27-秋招 GPU集合通信研发工程师
  • 收藏
  • 取消
  • 举报
  • 分享给朋友
    分享
  • 28k-35k
  • |
  • 不限
  • |
  • 招聘 4人
  • 09-27 17:00 更新
微电子科学与工程,通信工程,计算机科学与技术,电子信息工程
来源: 中山大学
71k7hlbb13bdwcfqqngm2jjz95sxoi5y
  • 广东省深圳市

职位详情

职位描述 你将面向分布式推理基础设施(AI Infra),参与GPU高性能通信、分布式 KVCache 及超节点系统的研发。 岗位职责: 1. 参与自研 GPU 高性能通信库的研发,包括集合通信、DeepEP 类专家并行通信及 RDMA 高速传输。 2. 参与 GPU 超节点系统研发,围绕 GPU、片间互联、PCIe、NIC、交换网络等硬件资源,优化数据通路、任务调度和资源协同。 3. 参与大规模推理集群的 Scale-up/Scale-out 通信架构与组网优化。 4. 参与分布式 KV Cache 系统研发,包括跨节点传输、缓存管理、分层存储、节点间共享以及 Prefill/Decode 分离场景下的数据通路优化。 5. 参与超节点互联协议、内存池化、存储池化、网络仿真的研究及工程落地。 职位要求 任职要求: 1. 2027届本科及以上毕业生,计算机科学与技术、软件工程、电子信息、通信工程、自动化等相关专业。 2. 具备扎实的计算机基础,熟悉 C/C++、数据结构与算法,具备良好的系统编程、代码调试和问题分析能力。 3. 熟悉 Linux 开发环境,对多线程、异步编程、内存管理、网络通信和并发控制有一定理解。 4. 具备系统软件、并行计算、计算机网络、计算机体系结构或分布式系统相关项目经验。 5. 对硬件体系结构和系统性能优化有兴趣,能够从计算、通信、存储和内存访问等维度分析性能瓶颈。 加分项: 1. 参与过 GPU 通信库、分布式推理、MoE 专家并行、Prefill/Decode 分离或分布式 KV Cache 相关项目。 2. 熟悉 NCCL、RCCL、DeepEP、UCX、Mooncake 等项目,具备相关源码阅读或开源贡献经验。 3. 熟悉 RDMA Verbs、RoCE/InfiniBand、GPUDirect RDMA、PCIe、CXL或超节点 Scale-up 互联技术。 4. 熟悉 GPU 体系结构、DMA、NoC、片间互联、硬件队列或一致性与内存访问机制。 5. 具备 CUDA/ROCm、GPU Kernel、通信 Kernel 或通信计算重叠优化经验。 6. 熟悉 Tensor Parallel、Expert Parallel 和推理调度机制。 7. 在 ACM/ICPC、CCPC、ASC、ISC、HPC-AI 等相关竞赛中获奖。 8. 在并行计算、分布式系统、计算机网络或计算机体系结构领域具有高质量论文、专利或项目成果。 加入曦望,你将获得什么? - 难得的创造机会:参与 AI 推理 GPU 和算力基础设施从 0 到 1 到 N 的真实建设。 - 真问题、真战场、大空间:解决成本、稳定性、规模化落地中的关键问题,在核心岗位承担真实责任。 - 顶级人才共事:和行业优秀的工程、架构、产品与业务团队一起做复杂系统。 - 简单坦诚的文化:被信任、讲事实、少内耗,专业高效地把事做成。 - 长期回报与保障:有竞争力的薪酬激励、token 补贴、补充商保、员工及家人体检、晚餐与夜间出行支持等。

浙江曦望智能科技股份有限公司

-

  • 所属行业 学术/科研
  • 涉及领域 --
  • 公司性质 外商独资/外企代表处
  • 公司规模 500-999人
  • 公司网址 --
  • 所在地址 浙江省杭州市

看了该职位的人还会看 更多

    投诉
    举报

    意见
    反馈

    false
    false
    false
    false