长鑫存储
大数据平台运维运营工程师-Data Platform Operations Engineer(J20600)
RESPONSIBILITIES
岗位职责
平台稳定运营:主导StarRocks、向量数据库及图数据库的日常运维与架构设计,制定并落地标准建制与运维规范,保障数据库服务高可用运行;
大数据组件保障:保障CDH大数据平台相关组件的稳定运行,优化数据链路配置,提升查询性能与任务执行效率;
监控体系建设:基于Prometheus与Grafana搭建全链路监控、告警与可视化系统,配置关键指标与告警规则,实现异常主动预警;
自动化能力开发:编写Shell与Python运维脚本,实现数据库巡检、备份恢复、弹性扩缩容、日志分析与故障自愈等场景的自动化处置;
性能治理与方案输出:主导数据库性能调优与慢查询治理,制定容量规划与高可用架构方案,结合业务输出查询模型、存储及分片策略等最佳实践,并支撑数据服务与AI应用场景的技术落地。
REQUIREMENTS
任职要求
教育背景与专业知识:本科及以上学历,计算机、软件工程、数据科学等相关专业;
专业技能与资格:具备Shell及Python编程能力,能独立编写自动化巡检、备份、清理等运维脚本,并能配置Prometheus指标采集、告警规则及Grafana面板;
行业与专业经验:具有5年以上大数据平台或数据库运维经验,其中至少3年StarRocks或其他OLAP引擎运维经验,熟悉Hadoop/CDH生态(Hive、HBase、Flink、Kafka等);
项目/任务成果:主导过至少一个数据库性能优化或数据平台架构升级项目,并能量化产出(如查询耗时下降比例、资源利用率提升);
其他要求:具备SQL执行计划分析能力,能独立开展慢查询治理与索引优化,熟悉向量数据库(如Milvus)及图形数据库(如Neo4j)者优先考虑。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
