曦望Sunrise
分布式资源调度工程师
岗位职责
聚焦云平台分布式资源调度领域,参与GPU云平台、推理平台调度模块研发与策略落地,优化异构算力调度能力,保障集群资源高效合理分配。 岗位职责 - 协助开展GPU云平台、AI推理平台分布式资源调度模块的功能开发、代码调试与功能测试工作,保障调度模块稳定高效运行。 - 系统学习多集群核心调度策略与调度逻辑,配合团队完成各类调度方案的业务落地、功能适配与线上问题调试排查。 - 梳理GPU、CPU异构计算资源的调度机制、业务场景与技术方案,协助团队完成标准化技术文档的撰写、整理与迭代更新。 - 跟进分布式调度领域前沿技术与行业方案,结合算力平台业务场景,协助优化资源调度效率与集群资源利用率。 - 围绕异构算力利用率和业务 SLA,参与调度策略从设计、验证到线上迭代的闭环建设。
任职要求
任职要求 - 2027届硕士及以上学历毕业生,计算机、软件工程、分布式系统、云计算等相关专业优先,对分布式调度、云原生领域具备浓厚探索兴趣。 - 了解分布式系统基础架构与核心原理,学习能力突出,愿意深耕Kubernetes等主流云原生调度框架与调度体系。 - 熟练掌握Go、C++任意一种编程语言,具备扎实的基础编码能力、代码编写规范与基础功能开发调试能力。 - 逻辑思维清晰,拥有快速学习、问题拆解与自主攻坚能力,能够快速适配新技术、新业务场景。 - 具备良好的团队协作与沟通能力,工作积极主动,执行力强,能够主动推进研发任务,保障项目高效落地迭代。 - 我们期待你理解资源调度背后的业务优先级和系统约束,能在异构算力、集群利用率和服务 SLA 之间做清晰判断并推动策略落地。 加分项 - 拥有分布式调度、K8s调度开发、云平台资源管理、算力调度相关实习经历或落地项目经验。 - 熟悉Kubernetes调度源码、多集群调度、异构算力调度策略,有调度算法优化、模块二次开发实战经验。 - 有分布式系统、云原生开发相关科研项目、学科竞赛获奖或开源项目贡献成果。 - 自驱力强,具备独立拆解复杂调度问题、自主调研前沿技术的能力,能够独立完成模块开发与方案优化。 加入曦望,你将获得什么 - 难得的创造机会:参与 AI 推理 GPU 和算力基础设施从 0 到 1 到 N 的真实建设。 - 真问题、真战场、大空间:解决成本、稳定性、规模化落地中的关键问题,在核心岗位承担真实责任。 - 顶级人才共事:和行业优秀的工程、架构、产品与业务团队一起做复杂系统。 - 简单坦诚的文化:被信任、讲事实、少内耗,专业高效地把事做成。 - 长期回报与保障:有竞争力的薪酬激励、token 补贴、补充商保、员工及家人体检、晚餐与夜间出行支持等。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。