大疆集团
多模态大模型算法工程师(上海)
RESPONSIBILITIES
岗位职责
负责多模态大模型在边侧(手机/平板)的算法选型、后训练与轻量化研发;
负责语音/文本/图像多模态意图理解,将自然语言任务转化为端侧可执行信号;
负责边侧推理性能优化,包括算子加速、并行调度、内存压缩等关键技术;
与端侧、云端团队拉通边-端、边-云协同链路,参与下一代多模态交互范式定义。
REQUIREMENTS
任职要求
基本要求
计算机、电子、通信、自动化等相关专业,硕士及以上学历;
熟悉主流多模态大模型架构(LLaVA/Qwen-VL/InternVL/GPT-4V 类,视觉/语音 encoder + LLM 范式),熟练 PyTorch;
在大模型后训练(SFT/DPO/RLHF)或推理优化(量化/蒸馏/算子加速)任一方向有实战经验;
良好的代码与工程能力,能独立完成边侧(手机/平板/嵌入式 SoC)部署链路至少一个环节。 加分项
ACL/EMNLP/CVPR/NeurIPS/ICLR 等顶会一作论文,或开源大模型项目核心贡献者;
在手机/平板/端侧 NPU/GPU 上落地过 LLM 或 VLM 推理优化的实战经历;
熟悉 llama.cpp/MLC-LLM/TensorRT-LLM/MNN/NCNN 等推理框架及自定义算子开发;
对消费场景下的人机交互范式、语音/视觉多模态 UX 有自己的思考与作品。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
