内推原文
NO.ae54f3岗位名称:AI 基础设施运维实习生● 关于我们我们是一家专注于AI for Embodied AI的初创团队,核心成员来自清华、中科院、北大、北理、北邮及头部自动驾驶/具身智能公司。我们坚信下一代智能跃迁发生在物理世界。●
岗位职责
1、保障线上服务稳定运行,支撑 AI 大模型训练、推理任务调度,参与集群容量规划、系统架构持续优化;
2、参与基于 Kubernetes 的自动化运维平台建设,保障集群业务平稳发布与迭代;
3、搭建与完善全链路监控、可观测性体系,依托指标、日志、链路追踪定位并解决线上故障;
4、参与服务治理、性能调优、高可用方案落地,持续优化系统 SLA 指标;
5、结合业务场景沉淀运维方案,开发自动化脚本与运维工具,推动运维流程标准化、自动化。 ●
任职要求
1、本科 / 硕士在读,计算机、软件工程、网络工程等相关专业; 熟悉操作系统、计算机网络、存储 IO 基础原理;熟悉操作系统、计算机网络、存储 IO 原理,掌握云计算与分布式系统基础理论,具备问题排查思路。
2、熟练使用 Linux 常用运维命令;理解 K8s 核心概念与组件;掌握 Python / Go 至少一门编程语言;了解阿里云、AWS 等主流公有云基础产品;
3、接触 Prometheus、Grafana 监控体系,了解 CI/CD、IaC 基础设施即代码(Terraform/Crossplane)者优先;
4、了解大模型训练、推理业务流程,有 GPU 集群使用经验优先;
5、自学能力强,责任心良好,具备优秀跨团队沟通协作能力。● 你将获得
1、充足算力集群与机器人真机实验平台;
2、一线大厂资深研究员一对一指导,优秀成果可转全职或共同署名顶会;
3、待遇:日薪300
-500元+节假日福利,优秀者待遇一人一议。● 投递方式简历请发送至:lingyu.he@hexafuture.cn,并抄送hanyi.fu@hexafuture.cn邮件标题:【实习】姓名
-学校
-可实习时长