AI模型优化工程师
岗位摘要
负责AI模型的网络级压缩与优化,涵盖量化(QAT/PTQ)、投机采样(Speculative Decoding)、Token压缩、知识蒸馏等技术;针对大小模型设计并实现差异化量化方案,如小模型的KL散度、Percentile、AdaRound等,大模型的SmoothQuant、AWQ等
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责AI模型的网络级压缩与优化,涵盖量化(QAT/PTQ)、投机采样(Speculative Decoding)、Token压缩、知识蒸馏等技术
- 针对大小模型设计并实现差异化量化方案,如小模型的KL散度、Percentile、AdaRound等,大模型的SmoothQuant、AWQ等
- 参与或主导模型网络结构的优化与重构,将现有网络的算子、Block替换为高效、硬件友好的架构
- 参与模型训练与微调,能够复现、分析并改进前沿模型结构
- 与硬件团队紧密合作,提供模型优化视角的硬件设计建议,推动下一代芯片对新型算子与网络结构的支持
任职要求
- 计算机科学、人工智能、数学等相关专业硕士及以上学历,2年以上模型优化或训练经验
- 深入理解模型量化技术(PTQ/QAT),至少熟悉一种小模型或大模型量化方案,并有实际部署经验
- 熟悉大模型推理优化技术,如投机采样、Token剪枝、稀疏化等
- 具备较强的模型训练与复现能力,能够阅读论文并快速实现网络结构改进
- 了解芯片计算特性,有与硬件团队协作进行模型-芯片协同设计经验者优先
- 代码能力强,熟练使用PyTorch/TensorFlow等框架,熟悉底层算子开发(如CUDA kernel)者更佳
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。