vivo
高性能计算工程师(IOT方向)-27届秋招
岗位职责
负责智慧终端(平板、IoT、智能穿戴设备等)端侧 AI 算法与多媒体算法的高性能工程化落地,通过指令级优化、异构计算调度及软硬协同设计,将实验室算法转化为极致性能的生产级代码。
算法端侧高性能移植与优化:负责音频/图像/视频处理算法及深度学习模型(CNN/Transformer/Diffusion 等)在 ARM/GPU/NPU/DSP 异构平台上的指令级移植。熟练运用 NEON/SSE等 SIMD 指令集、Vulkan/CUDA等 GPU、HVX等DSP的并行计算框架,实现计算密集型模块的性能优化。针对端侧资源受限场景,开展内存访问优化(缓存友好性设计、数据排布优化)、计算图优化(算子融合、常量折叠、精度校准)及延时、功耗优化。
软硬协同与系统级工程化:深入理解芯片架构(CPU /DSP微架构、NPU 加速器特性、GPUWarp/Wavefront 调度)设计,与硬件团队协同完成算法-芯片联合调优。设计并实现算法部署在Android/RTOS等系统耦合,包括运行时调度及内存池管理,保障多算法并行的稳定性与实时性。沉淀高性能优化最佳实践与代码规范,推动团队技术能力提升。
性能分析、工具链与流程建设:建立算法性能基准测试体系,制定性能验收标准(FPS、Latency、Memory Footprint、功耗等),推动算法全链路性能达标。熟练使用 Profiling 工具进行性能瓶颈定位与根因分析,输出系统化优化方案。参与构建自动化性能测试与回归体系,持续监控端侧算法性能指标,防范性能劣化。
技术预研与前沿跟踪:跟踪端侧 AI 推理框架、编译优化技术及新一代推理芯片架构演进趋势。参与核心技术的专利布局与学术论文发表。
任职要求
学历背景:硕士及以上学历,计算机科学、软件工程、电子信息、自动化等相关专业;
编程基础:精通 C/C++,具备扎实的算法与数据结构功底,代码风格严谨,熟悉现代 C++(C++11/14/17)特性;
系统能力:深入理解操作系统原理(进程调度、内存管理、中断机制),熟悉 Linux 开发环境及嵌入式系统开发流程(交叉编译、调试、性能分析);
优化基础:了解ARM NEON / x86 SSE-AVX / RISC-V Vector 等 SIMD 指令集优化实战经验,或 GPU(OpenCL/CUDA)并行程序开发;
算法理解:熟悉 OpenCV 传统图像处理算法流程,了解深度学习模型结构(ResNet/MobileNet/Transformer/YOLO 等)及常见算子(Conv/Attention/Normalization 等)的计算特性;
问题驱动:对性能数字敏感,具备从 Profile 数据到根因定位的系统化分析能力;
工匠精神:追求代码极致性能与工程优雅性的平衡,注重代码可维护性与可移植性;
团队协作:具备良好的跨团队沟通能力,能有效对接算法研究员、硬件工程师与系统架构师;
持续学习:对底层技术有强烈热情,主动跟踪高性能计算与体系结构领域前沿进展; 优先条件(加分项)
熟悉至少一种端侧 AI 推理框架(MNN、ONNX Runtime 等)的底层实现或算子开发;
有模型量化(INT8/FP16)、知识蒸馏、算子融合等模型轻量化部署经验;
熟悉编译器优化技术(LLVM/TVM/MLIR)或高性能计算库(OpenBLAS、Eigen、oneDNN);
在计算机体系结构、高性能计算、计算机视觉顶会/期刊(CVPR/ICCV/ECCV/TPDS 等)发表过论文,或拥有相关技术专利。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
