全球 AI 聊天室 · 现在 13 人在线 进去聊聊
返回 AI 工作

大模型微调与推理优化工程师

智谱星图科技

北京坐班 / 混合办公全职中级25-45k

岗位信息

###

岗位职责

1. 负责百亿参数开源大语言模型的领域微调(SFT)与对齐(RLHF/DPO),提升模型在垂直业务场景下的生成质量与稳定性。 2. 参与大模型推理加速与部署优化,结合 vLLM、TensorRT-LLM 等框架进行算子优化、KV Cache 管理及模型量化(INT4/INT8),降低线上推理延迟与显存占用。 3. 跟踪前沿大模型技术进展,协同算法团队推进评测体系建设及多模态能力的落地应用。 ###

任职要求

1. 计算机、人工智能相关专业硕士及以上学历,1-3年大模型或NLP领域研发经验。 2. 熟练掌握 Python 及 PyTorch,深入理解 Transformer 架构及主流开源大模型(如 Llama、Qwen、ChatGLM 等)。 3. 有大模型分布式训练(DeepSpeed/Megatron)或推理优化落地项目经验者优先。 4. 具备良好的工程实现能力、问题排查能力与跨团队协作意识。