大模型算法工程师(多模态方向)
深圳云知声技术股份有限公司
岗位信息
###
岗位职责
- 负责多模态大语言模型(如视觉-语言、音频-语言)的模型设计、训练与微调,支持跨模态检索、生成与理解任务; - 构建和优化大规模多模态数据预处理管道,包括数据清洗、对齐、标注增强与平衡采样策略; - 参与分布式训练框架(如DeepSpeed、FSDP、Megatron-LM)的集成与性能调优,降低训练成本并提升吞吐量; - 负责模型推理加速方案的研究与实施,包括量化、剪裁、蒸馏与TensorRT/LLM Engine适配; - 跟踪前沿学术进展(如LLava、Qwen-VL、InternLM-XComposer等),并将有价值的技术点转化为内部可落地的解决方案。 ###
任职要求
- 硕士及以上学历,计算机科学、人工智能、信息工程或相关专业;扎实的深度学习理论基础,熟悉Transformer架构及其变体; - 有大模型训练或微调实战经验,熟练使用PyTorch,了解DeepSpeed、Accelerate或Colossal-AI等训练加速框架; - 曾参与多模态项目(如图文匹配、视频字幕生成、语音转文本+上下文理解),有实际模型产出或开源贡献者优先; - 具备良好的工程能力,能编写清晰、可维护的代码,熟悉Linux环境、Git工作流及基本的性能 profiling 工具; - 具有强烈的学习驱动力和问题解决能力,能在快节奏环境中独立推进项目,良好的中文沟通能力和团队协作意识。 ### 我们提供 - 有竞争力的薪酬及年度奖金,六险一金及补充商业保险; - 灵活的混合办公安排,提供高性能开发机和云算力资源; - 定期技术分享、论文研讨会及顶会论文发表支持; - 宽松的创新氛围,鼓励内部技术专利申请与开源项目孵化。 欢迎对多模态智能系统充满热情、愿意为下一代人机交互技术贡献力量的你加入我们!