SREチームマネージャー【食べログ】
株式会社カカクコム · (雇入れ直後)本社:東京都渋谷区恵比寿南3-5-7 デジタルゲートビル(変更の範囲)会社の定める場所
About The Role
ポジション概要と部署説明 【ポジション概要】 月間約9,600万人を支える「食べログ」の大規模Kubernetes基盤における信頼性向上と、開発生産性を牽引するチームマネジメントリーダー 【部署説明】 ■食べログについて 2005年にスタートした「食べログ」は、口コミとランキングで探せるレストラン検索・予約サイトです。「失敗しないお店選び」という課題に向き合い続け、現在、月間約9,800万人のユーザーが利用する日本最大級の飲食店検索サービスに成長しました。目まぐるしく変化する外食産業を盛り上げるべく、近年は飲食店や卸売業者など外食を支える人たちの課題を解決するDXプロダクトにも挑戦しています。これらのサービスを通して人々とレストランをつなぐプラットフォームになるべく世の中に貢献していきます。 ■技術部の責務と文化 私たちは市場や事業の変化に素早く対応できるシステムと、それを実現させる開発組織を作る事を責務としています。システムが事業成長のボトルネックにならないよう、モノを作るだけでなく作ったモノの健全性を保ち続けることやビジネス理解もそのための大事な手段の一つと考えています。サービス開発のように組織の改善を行うべくFourKeysの計測とアクショナブルな指標への落とし込みや、よりインパクトの大きな成果を出すべく、1プロジェクト1チャレンジすること、人同士のつながりを大事にすること、部署やプロダクトの垣根を超えていくことを大切にし日々の業務にあたっています。 ■SREチームの責務 技術部SREチームは食べログのシステムの信頼性を向上させることで、エンジニアのシステム変更に対する負担を減らし、ユーザーが安心・快適に食べログを利用できるようにする事を責務としています。より良いユーザ体験を届けるためのシステム基盤の構築・改善や障害対応を日々行っています。また、サービス開発チームがより効率的にシステム開発を行えるようにアーキテクチャの提案などを行います。昨今ではアプリケーション基盤の全面Kubernetes化など果敢に技術的な挑戦を行っており、一緒にチャレンジしていく仲間を募集します。 SREチームのミッション ■Kubernetes化の推進と基盤戦略の策定 VMベースの基盤をKubernetesへ移行する最重要プロジェクトにおいて、大規模・複雑な既存システムを紐解き、安定稼働を担保しながら刷新を加速させる技術的・戦略的なリードを担います。 ■インフラの標準化と堅牢性の両立 属人化を排除したインフラ構成の標準化を進めます。デリバリの向上(リードタイム短縮)とサービス安定性を両立させるため、堅牢性と速度を同時に満たす基盤構築をリードします。 ■プラットフォームエンジニアリングの実現 インフラ提供者ではなく、サービス開発者が「自律的・高速・高品質」に開発運用できる「開発者体験の高い環境(IDP)」を整備し、組織全体の開発生産性を底上げする「武器」の提供と文化定着を主導します。 ■トイル削減とSRE文化の確立 トイルの肥大化を防ぎ、自動化を徹底することで、エンジニアが事業価値向上へ寄与する戦略的な業務に集中できる体制を作ります。SREプラクティスの組織的実践を推進します。 ■AI活用による運用プロセスの非連続な進化 従来の自動化にとどまらず、監視、障害検知、運用プロセス自体にAIを適用し、非連続なスピードと品質の向上へ挑戦します。 ■SREエンジニアの成長支援 組織ミッションと必要なスキルを見極め、メンバーの成果行動への後押しと成長支援を行います。事業貢献度の高いSREエンジニアリング組織の実現を主導します。 業務内容 食べログのシステムの信頼性を向上させることでエンジニアのシステム変更に対する負担を減らし、ユーザーが安心・快適に食べログを利用できるようにする目的に向かい、様々な課題の解決とチャレンジでチームをリードします。 【具体的な業務内容】 1. チームマネジメント・組織開発 └食べログ開発組織のビジョン実現のためのチームの方針付けと目標設定、および目標達成に向けたチーム活動のリード └メンバーの目標設定・評価・フィードバック └1on1などコミュニケーションとフィードバック └メンバーのキャリア志向を見据えた成長支援(アサインや役割の設定、業務における成果最大化の支援、キャリアディスカッションなど) └案件のマネジメント(進捗管理、アサイン、各種調整など) └エンジニア採用 SREチームの技術的業務 └Kubernetes, VMwareでの基盤設計・構築・運用 └各種オペレーションの自動化・セルフサービス化 └アプリケーション、ミドルウェアのパフォーマンス可視化、測定と改善 └新規システムのアーキテクチャの選定、提案 └CI/CDの運用、改善 └AWS/GCPなどのパブリッククラウド環境の運用 開発環境 ■開発言語 Ruby / ShellScript ■インフラ・ミドルウェア Docker / Kubernetes / VMware / ArgoCD / Tekton / CircleCI / nginx / MySQL / Redis / Ansible / Fluentd / Grafana / Prometheus / BigQuery / Cloud Logging ■プロジェクト管理・ドキュメンテーション GitHub / Microsoft Teams / Asana / Miro / Confluence 必須条件 ・SREやインフラチームでのマネジメント経験 ・インフラ設計・構築・運用経験 ・IaCやCI/CDツールによる自動化環境での運用経験 歓迎条件 ・エンジニアの採用業務の経験(書類選考、面接、スカウト、イベント主催や登壇) ・インフラ運用の標準化、セルフサービス化の経験 ・大規模で高可用性が求められるシステムにおけるインフラ設計・構築・運用経験 ・Kubernetesやその関連技術の導入・構築・運用経験 ・パフォーマンス改善や負荷対策の知識・経験 求める人物像 ・大規模システムの運用、改善、刷新にチャレンジしたい方(アプリケーションエンジニアからの転向も歓迎です) ・新しいソフトウェア・サービス・クラウドなどの知識を自ら学習して、取り組んでいける方 ・チーム作業を楽しめる方 ・モニタリングなどを通して、システムの品質や運用を改善することに興味のある方
This is an external listing. JobSpring does not represent or verify the employer. Report this listing
JobSpring