Skip to content
← Back to job listings

クラウドエンジニア, Site Reliability Engineering

株式会社スクウェア・エニックス · 東京都渋谷区桜丘町1番1号渋谷サクラステージSHIBUYAタワー

Software DevelopmentExternal listingfull-timeRecently

About The Role

業務内容 大規模オンラインRPGをはじめとする当社サービスを支える自社バックエンドシステムに対して、サイト信頼性エンジニアリング (SRE) を遂行していただきます。 私達のチームではSREを「コードが開発・実行されるクラウド環境全ての信頼性に対して責任を負うエンジニアリングを遂行すること」であると定義しており、幅広い裁量と責任範囲を担っています。 【具体的な業務内容】 ・IaCによるクラウドインフラ管理 ・CI/CDパイプラインの構築 ・APIの性能改善 ・SLOの定義と可視化 ・ログ基盤/監視基盤の改善 ・オブザーバビリティの活用促進 セキュリティ管理、AI活用による業務効率化など 幅広い業務を通じて、システムの信頼性向上のためのエンジニアリングに従事していただきます。 この仕事の面白み ・スクウェア・エニックスのゲームを支えるバックエンドシステムのパフォーマンスをモニタリングしながら、SREに関する幅広いエンジニアスキルを磨くことができます。 ・ボトムアップでの改善提案や新規技術の導入を推進することができます ・SREプラクティスの実践によりシステムの信頼性向上を達成することで、エンドユーザーのゲーム体験に直接貢献することができます。 必要なスキルと経験など ・AWS, Google Cloudなどのパブリッククラウドを利用したシステムの構築・運用経験 ・Docker, Kubernetesなどのコンテナ技術に関する知識や業務での利用経験 ・UbuntuなどのLinuxに関する知識や業務での利用経験 ・TerraformなどのIaCを用いたシステムの構築・運用経験 ・複数チームが関わる業務を円滑に推進することのできるコミュニケーション能力 ・現状に対して積極的な改善提案ができる姿勢 あると望ましいスキルと経験など ・SLOやCI/CDなどのSREに関するプラクティスの実践経験 ・MySQLなどのRDBMSに関する知識や業務での利用経験 ・NewRelic, Datadogなどのモニタリング基盤の構築・運用経験 ・Elastic CloudやCloud Loggingなどのログ基盤の構築・運用経験 ・SysdigやSecurity Command Centerなどのセキュリティ監視基盤の構築・運用経験 ・高負荷環境でのシステム運用やパフォーマンス最適化の経験 ・AIを用いた業務改善や自動化の実践経験 ・障害対応やトラブルシューティングの経験 ・チームやプロジェクトのリーディング経験 ・開発・運用を自動化するためのコーディングスキル (Go, Pythonなど)

This is an external listing. JobSpring does not represent or verify the employer. Report this listing