快手
大模型数据架构工程师-【可灵AI专项】
岗位职责
负责打造可灵生成式大模型的数据基础设施,构建高性能、分布式、可扩展的数据系统,通过数据驱动模型生产,使模型可以在海量数据场景下完成高效的算法迭代;
构建 agentic 数据生产体系:将数据基建能力封装为 agent 可靠调用的工具与服务,研发数据链路的编排与运行框架——让数据管线的搭建、运维、排障逐步由 agent 自主完成;
攻坚以下领域之一的核心架构难题(详见任职要求的方向说明):大规模分布式计算与调度 / 海量多模态存储 / 跨模态检索 / 大规模批量推理优化 等;
建设数据管线的无人值守能力与全链路可追溯:作业级容错与自愈、自动化质量监测、数据版本化与血缘、数据实验归因体系;
与算法、数据交付团队进行紧密合作,共同定义算子与数据服务的接口标准,以Co-Design方式共同提升模型效果。
任职要求
计算机及相关专业本科及以上学历,3 年以上基础架构方向研发经验;
精通至少一种系统语言(C++/Go/Rust/Java)及 Python,有大规模生产系统的性能优化实战,吞吐/延迟/成本有可量能力;
对自己深耕的技术领域,能深刻理解其技术边界,深耕领域见下方描述;
具备能力抽象功底:能把复杂基建收敛为清晰的 API 与服务接口,以"agent 能可靠调用、失败可重试、状态可观测"为接口标准;
善用 AI-coding 与大模型工具(硬性要求),认同 agentic 研发理念;
沟通务实,尊重相邻方向的专业判断。 方向长板(以下四选一,至少一个方向达到深耕水平):
分布式计算与调度:精通 Ray/Spark/Flink 之一的内核机制与调优,有亿级样本处理管线或大规模混合负载(CPU 解码 × GPU 推理)的实战;熟悉 Kubernetes 批调度、GPU 调度、潮汐混部者优先;
存储与数据湖:精通对象存储/数据湖/分布式缓存之一的内核或深度实践,有海量小文件、高吞吐顺序读写、元数据规模化管理的实战;做过数据版本化或血缘系统者优先;
检索与索引:精通向量检索引擎(Faiss/Milvus/自研 ANN)或大规模倒排/多维索引,有亿级 embedding 的建库、召回调优、增量更新实战;做过跨模态检索(文搜视频/以图搜视频)者优先;
推理优化:精通 vLLM/SGLang/TensorRT 类推理框架,有大规模离线批量推理系统的建设经验——动态 batching、量化加速、多模型混部、显存与吞吐调优;做过视觉/多模态模型推理优化者优先。 加分项(各方向通用):
有多模态/视频数据处理基建经验(视频编解码、GPU 视频处理管线、BMF/Ray Data 类框架);
参与过知名开源基建项目。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。