你在 OTOKO® 的角色
你将保障云环境在日常运营中的可靠性,并确保问题不仅得到解决,还能以可追溯的方式处理。你会将监控、事件分析和自动化结合起来,有针对性地减少重复的手动工作,同时保持对关键变更的控制。
事件分析与恢复
告警必须指向具体行动。你将利用指标和日志区分网络、身份和应用问题。运行手册会说明职责和升级路径。恢复尝试用于确认备份是否完整以及所需访问权限是否可用。故障发生后要记录原因和后续措施,避免同一错误长期反复依赖人工处理。
你的任务
- 监控云资源和应用,并维护职责明确、切实有用的告警。
- 缩小事件范围、协调措施,并记录原因和后续行动。
- 在技术层面陪伴补丁、备份和恢复流程,并验证其有效性。
- 自动化常规任务,并通过有文档记录的流程将变更投入运营。
- 创建包含测量点、行动边界和升级路径的运行手册。
- 执行恢复测试和维护,并据此改进监控与自动化。
你需要具备
关键在于具备可清晰证明且与该职位相关的经验。这些经验可以来自相关职业培训、高校学习、职业实践或扎实的转行经历。我们会根据你的知识水平共同确定具体职责。
- 具备 IT 或云运营经验,并能系统地分析故障。
- 理解监控、网络、操作系统和访问管理。
- 能够在时间压力下清晰沟通并记录技术决策。
这些经验会为你加分
这些知识会有所帮助,但无需同时全部具备。请在申请中说明你已在哪些领域积累了实践经验,以及希望深入学习哪些主题。
- 具备脚本编写、IaC 或事件管理流程经验。
- 了解 SLO、容量规划或云成本控制。
该职位重视的成果
你将提升运营的可追溯性和稳定性。可能的值班服务范围和组织方式将在合作前另行约定;该职位并不笼统要求全天候随时待命。
你的工作地点:科隆或远程办公
该职位可在科隆或远程办公。具体合作方式、项目要求以及可能需要参加的客户会议,将在入职前共同协商。
你的雇佣形式
该职位采用全职或兼职的正式雇佣形式。我们会根据职位要求和你的知识水平,就任务、工时、入职日期和薪酬达成一致。
你的申请
请在申请中向我们展示你能为该职位带来的经验或兴趣。简历以及相关项目实例、证书或作品样本将帮助我们进行专业评估。请勿发送客户机密数据、访问凭证或受保护的源代码。
请告知我们你期望的工作模式、可以入职的日期,以及希望全职还是兼职工作。
如对该职位有疑问,请发送邮件至 hr@otoko.com 联系我们的招聘团队。加入应聘者人才库完全出于自愿,且只有在另行征得同意后才会进行;这并非审核你的申请的前提条件。
