大模型微调与推理优化工程师
智谱星图科技
岗位信息
###
岗位职责
1. 负责百亿参数开源大语言模型的领域微调(SFT)与对齐(RLHF/DPO),提升模型在垂直业务场景下的生成质量与稳定性。 2. 参与大模型推理加速与部署优化,结合 vLLM、TensorRT-LLM 等框架进行算子优化、KV Cache 管理及模型量化(INT4/INT8),降低线上推理延迟与显存占用。 3. 跟踪前沿大模型技术进展,协同算法团队推进评测体系建设及多模态能力的落地应用。 ###
任职要求
1. 计算机、人工智能相关专业硕士及以上学历,1-3年大模型或NLP领域研发经验。 2. 熟练掌握 Python 及 PyTorch,深入理解 Transformer 架构及主流开源大模型(如 Llama、Qwen、ChatGLM 等)。 3. 有大模型分布式训练(DeepSpeed/Megatron)或推理优化落地项目经验者优先。 4. 具备良好的工程实现能力、问题排查能力与跨团队协作意识。