黑翼资产
算力平台高级开发工程师
岗位职责
投研算力平台核心开发 基于Python/Golang负责云原生投研算力平台的开发与迭代,主导Kubernetes调度插件的定制开发与性能优化。结合量化投研CPU、GPU异构算力的业务特性,优化资源分配、任务排队与资源抢占逻辑,保障大批量策略回测、仿真训练、因子计算等离线投研任务稳定高效运行。
基础设施全栈建设 负责投研体系底层基础设施的搭建与迭代优化,覆盖大规模异构计算集群、分布式存储、高速低延迟网络、统一认证授权、全链路监控等核心模块,搭建标准化、可运维、高可用的基础设施底座,支撑万核级投研集群稳定运行。
运维自动化与中台体系建设 基于Ansible、Helm、Terraform、ArgoCD等工具搭建自动化运维体系,全面落地基础设施即代码(IaC)理念,实现集群组件、业务服务、网络设备的标准化部署、配置管理与自动化运维,持续提升基础设施迭代效率与规范化、标准化水平。
任职要求
基础资质 ● 5年以上开发经验。 ● 本科及以上学历,计算机、电子工程、软件工程等相关专业。
具备金融科技、量化投研基础设施建设相关经验者优先,有开源项目贡献者优先。
通用开发与工程化能力 ● 熟练使用Python进行Web服务或工具开发,熟悉主流开发框架,具备分布式、高并发服务的开发与调优经验,能够熟练运用常用设计模式落地业务架构。
熟悉Celery、Airflow、Spark 等分布式任务队列的运行原理与落地实践,具备任务调度、异常重试、消息队列治理的实战经验。
熟练使用Ansible、Helm、Terraform等IaC工具,具备大规模基础设施自动化部署、配置管理与日常运维的落地经验。
熟悉PEP8、Ruff等代码规范与静态语法检查工具,具备良好的工程化编码习惯;熟练掌握Git,熟悉版本管理规范与团队协作流程。
云原生核心能力 ● 熟悉Kubernetes核心组件运行原理,了解Operator开发范式,具备CRD自定义资源与控制器开发能力;熟悉调度器插件定制与改造,了解Volcano、Kueue等批量调度组件,拥有大规模离线算力调度项目落地经验。
熟悉CSI、CNI插件生态,了解Cilium网络架构与运维方式,熟悉SR-IOV虚拟化网络、RoCEv2超低延迟高速网络的部署与基础调优,具备集群网络、存储故障排查与性能优化能力。
架构设计能力 具备扎实的基础设施架构设计能力,能够结合量化投研业务特性,独立完成算力调度、存储体系、监控告警、认证授权等系统的方案设计、落地实施与迭代优化,保障系统的稳定性、高性能与可扩展性。
加分项 ● 熟悉GPFS的常用概念与基本运维操作、熟悉对象存储,了解多副本,纠删码等不同配置;熟悉Zitadel、Dex、LDAP等统一认证授权系统的部署与运维,掌握PB级行情数据的存储架构与权限体系设计,具备高频计算场景下存储与权限架构的落地调优经验。
熟悉Postgres, OceanBase, Iceberg, Trino, Redis等基础设施,具备高可用部署、调优与运维经验,了解高频因子计算场景的缓存加速实现方案。
熟悉Prometheus监控体系,了解VictoriaMetric、VictoriaLogs等高性能可观测组件,具备大规模集群监控、日志、告警体系的搭建与落地经验。
熟悉CI/CD研发交付体系,了解Gitlab Pipeline等流水线生态,具备研发自动化交付、集群持续部署的落地经验。
技术成长方向 本岗位深耕量化金融核心基建场景,可接触行业顶尖的大规模基础设施架构,积累高稀缺的垂直领域实战经验: ● 深度参与万核级Kubernetes集群的稳定性治理与性能调优,掌握Slurm+K8s混合异构集群的资源调度策略,适配量化投研业务的弹性算力需求。
接触InfiniBand、RoCEv2金融级超低延迟高速网络,掌握低延迟网络架构的落地规范与性能调优方法。
实战金融数据湖架构,掌握GPFS/CPFS高性能存储调优、PB级行情数据的存储与治理方案。
深入理解分布式缓存、任务队列在高频因子计算、批量策略回测场景中的加速机制与优化方案。
岗位优势 ● 全权负责核心投研算力平台建设,主导大规模算力调度系统迭代升级,参与万亿级资管规模基础设施的架构规划与技术决策。
配备行业顶尖的异构计算资源与超低延迟网络环境,硬件资源充沛,可专注于技术落地与系统性能优化。
深耕量化金融基础设施垂直赛道,打通架构设计、核心开发、性能调优、集群治理全栈能力,打造高壁垒的核心技术竞争力
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。