-
AI算子开发与优化工程师
职位详情岗位职责:
AI芯片的深度学习算子开发和优化;
AI芯片编译工具链测试开发;
任职要求:
学历与专业背景:计算机、软件工程、自动化或相关专业重点本科及以上学历,具备扎实的计算机科学基础。
编程与底层能力:精通 C/C++ 编程,熟练掌握模板元编程;深入理解 GPU 体系结构(SM、Warp、内存层级等),了解 CUDA 编程模型。
对高性能计算库:掌握 CUTLASS、CUTE、CUB 等计算库的底层原理与源码,有基于这些库开发过高性能算子(如 GEMM、FlashAttention)的实战经验优先。
有PyTorch和Triton开发经验优先;
关闭详情 -
集合通信库工程师
职位详情岗位职责:
负责和参与研发 AI 芯片的集合通信库研发;
分析和优化 AI 集群中的通信算子性能,提升整体系统效率;
适配多种分布式训练/推理应用场景下的通信需求;
任职要求:
1. 熟练掌握 C/C++ 编程语言,具备扎实的编程基础,重点统招本科及以上学历;
2. 熟悉 Linux 开发,熟悉 Python/Shell 等脚本语言;
3. 具有良好的团队协作精神,责任心强,能够积极主动地完成工作。
4. 具备满足以下一种或多种条件者优先:
a. 有 AI 芯片(GPU/NPU)开发经验或者相关实习经验;
b. 熟悉通信库(如 MPI、NCCL、Gloo)的相关知识,或有集合通信库开发经验。
关闭详情 -
AI编译器工程师
职位详情岗位职责:
参与自研编译器、调试器及工具开发;
参与自研编程语言生态软件开发
任职要求:
掌握C/C++等编程语言,计算机科学或相关专业重点统招本科及以上学历。
深入理解编译原理、计算机体系结构;
熟悉X86、ARM或RISCV的指令集架构;
熟悉常见的编译器及工具的使用;
对编程语言有见解,做过相关项目或者有AI 芯片相关软件开发经验的优先;
良好的解决问题能力及英文文档阅读能力
关闭详情 -
AI芯片软件开发工程师
职位详情岗位职责:
基于RV嵌入式处理器与RT Thread的固件功能开发;
基于Linux内核的内核驱动开发;
配合软件栈Runtime等上层开发与调试。
任职要求:
本科及硕士以上相关学历,3年以上NPU/GPU/GPGPU相关工作经验;
熟悉芯片开发基本原理,有AI芯片开发经验者优先;
熟悉RV/ARM等常见嵌入式平台开发和Linux内核驱动开发,有任务调度、内存管理和异构通信经验者优先;
熟悉RV/ARM等常见嵌入式平台调试手段和Linux内核常见调试手段,性能优化方法;
在FPGA、Haps和EMU(Palladium/Zebu)等平台参与过芯片验证者优先;
熟悉AI软件业务者重点考虑。
关闭详情 -
AI 算法应用工程师
职位详情岗位职责:
负责高性能计算相关算法的研究与优化,提升计算效率;
负责第三方AI算法模型的导入;
负责AI demo的开发优化维护;
参与高性能计算系统的架构设计,解决复杂技术难题;
推动新技术在高性能计算领域的应用,包括但不限于AI、大数据处理;
任职要求:
计算机,数学及相关专业硕士以上学历;
具备一定深度学习算法训练和推理,优化加速相关经验优先;
熟练掌握CV/CG/NLP/加速计算某一领域常用算法,追踪行业最前沿技术,对某一方向有深入研究;
熟练使用CUDA C C++ Python至少某一编程语言;
良好的团队合作精神,能够有效沟通并推动项目进展;
关闭详情 -
AI分布式工程师
职位详情岗位职责:
基于自研芯片开发高性能训练/推理框架;
适配并深度优化主流分布式框架;
开发与优化混合并行及内核级策略;
调研前沿技术,实现超大规模分布式;
协同上下游解决分布式性能与精度问题;
任职要求:
计算机等相关专业本科及以上,精通Python/C++;
具备分布式系统、HPC或深度学习框架项目经验;
深入理解大模型分布式并行策略及主流模型架构;
熟悉集合通信原语,有CUDA/异构计算编程经验者优先;
有大规模分布式系统或机器学习平台开发经验者优先;
熟练使用Profiler等工具进行系统级瓶颈定位者优先;
关闭详情