SRE(Site Reliability Engineer)
■同社の事業を支えるSREとして以下のような業務をチームで分担し対応いただきます。 【具体的には】 ・AWSを用いたインフラの設計/構築/運用 ・オブザーバビリティ向上 ・パフォーマンス分析/パフォーマンスチューニング ・コスト効率を意識した適切なキャパシティプランニング ・オペレーションの自動化/効率化、開発生産性の向上 ・セキュリティの向上 ・トラブルシューティング/オンコール対応 ・Infrastructure as CodeおよびObservability as Codeの推進 ・SLI/SLOの運用と定期的な見直し(SLO Review) <やりがい・身につけられるスキル> 業務を通して、以下のような知識や経験が得られます ・売上月数億円規模ECシステムの運用/改善の知見 ・New Relicを有効活用したパフォーマンス定点観測会の知見 ・SLI/SLOの決定・計測・定期的な見直し(SLO Review) ・効率的なインシデント対応フローのプロセス ・Webセキュリティ対策の知見(WAF/DDoS/発見的統制/予防的統制)