ヘッドハンター案件

最終更新日:2026/09/03

SRE/全社横断SRE部|60超のサービスを横断し、可観測性・自動化・AI Agentで運用のあり方そのものをアップデートする|エンタメ・プラットフォーム

800万円〜1,500万円

インフラエンジニア SE(Web・オープン系)

インターネットサービス

東京都

仕事内容

【募集背景】 サービス規模の拡大に伴い、当社のSRE部が向き合う運用課題は年々複雑化しています。障害対応、オンコール、コスト管理、設定変更の影響把握など、「判断が遅れること自体がリスクになる」場面も増えてきました。 これまで標準化・自動化・可観測性の整備によって運用を改善してきましたが、次のステップとして、運用データや過去の知見をAIに活用させるフェーズに進んでいます。SREの経験を持つエンジニアがAIを理解し、AIを理解したエンジニアがSREの現場を知ることでしか実現できない取り組みです。 運用の最前線で課題と向き合いながら、SREのあり方そのものをアップデートしていく仲間を募集しています。 【事業概要】 当社は、動画配信、電子書籍、EC、ゲーム、金融など、多様な事業を展開する多角化企業です。それぞれの事業は独立したスピード感で成長する一方、その基盤となるインフラと運用の信頼性が、全社の価値提供を支えています。 SRE部は、複数事業を横断して支える専門組織として、サービスの可用性・信頼性・パフォーマンス・コスト最適化を担っています。個別の基盤は各サービスの担当が担いますが、共通でメリットが出る部分は特定のプロダクトに閉じず、共通基盤・共通指針を整備することで、事業やチームの増減に左右されない安定した運用を実現しています。 また、可観測性基盤を中心としたデータに基づく運用や、自動化・標準化による運用負荷の低減にも継続的に取り組んできました。現在はさらに一歩進み、これらの運用データや知見をAIと組み合わせることで、障害対応や意思決定をより再現性の高い形へ進化させる挑戦を進めています。 SRE部のミッションは、単に「障害を防ぐ」ことではなく、事業が安心して挑戦できる土台を提供し続けることです。 【業務内容】 SRE部の一員として、当社が展開する複数の事業・サービスを横断的に支える信頼性・可用性・運用効率の向上に取り組んでいただきます。 ■AI Agentの開発を通した運用改善 ・運用データを活用した障害対応・判断支援の自動化 ・LLMを用いた運用ナレッジの整理・検索・活用の仕組みづくり ■サービス信頼性の向上 ・可用性・パフォーマンス・耐障害性を考慮したシステム設計・改善 ・障害発生時の原因分析および恒久対応の実施 ■可観測性の設計・運用 ・メトリクス/ログ/トレースを含む可観測性全体の設計・改善 ・特定ツールに依存しない、可観測性の考え方・設計方針の整理 ・サービス特性に応じた監視・アラート設計および運用改善 ・運用データを活用した課題発見・障害予兆の検知 ・クラウド/オンプレ双方のオブザーバビリティツール基盤(Datadog/New Relic/Prometheus)の構築・運用 ■運用の標準化・自動化 ・手作業に依存しない運用フローの設計・実装 ・Runbookや運用手順の整備・改善 ■コスト最適化の推進 ・クラウドリソースの利用状況の可視化 ・コスト削減施策の立案・実装・全社展開 ■事業部・開発チームとの協業 ・各事業のSRE/開発チームと連携した課題整理・改善提案 ・共通基盤・共通指針の整備による組織全体の信頼性向上 【ポジションの魅力】 ・特定のプロダクトに閉じず、横断的な視点でSREに取り組める ・可観測性・自動化・コスト最適化といったSREの王道領域をしっかり経験できる ・AI活用は「必須スキル」ではなく、現場課題から自然に使うフェーズ ・仕組みを作って終わりではなく、全社に広げ、定着させるところまで関われる

労働条件

【給与】 年収 8,000,000円 〜 15,000,000円 ※スキル、経験を考慮した上で年俸額を決定します(試用期間3ヶ月) 【勤務地】 東京都港区六本木 ※リモートと出社のハイブリッド勤務になります。 ※出社頻度は職種や部署によって異なるため、面談・面接を通じてご確認ください 【雇用形態】 正社員(試用期間3ヶ月) 【採用人数】 1名 【福利厚生】 社会保険完備(労災・雇用・年金・健康)、関東ITS健保、介護休業制度、産休育休制度(男女とも実績あり)、慶弔休暇・見舞金、入社時ウェルカム休暇、私服通勤可(部署による)、交通費支給(月上限5万円)ほか ※雇用形態等により一部制限あり 【受動喫煙対策】あり(拠点ごとに定め)

応募資格

必須(MUST)

【必須条件】 ・Webサービスにおける信頼性・可用性を意識した運用経験 ・障害や性能劣化に対し、事象の切り分けから恒久対応まで主導した経験 ・メトリクス/ログ/トレースを用いた状態把握および原因分析の経験 ・監視・アラートを運用負荷の観点で設計・改善した経験 ・運用上の判断や対応を再現可能な形で言語化・定着させた経験 ・アプリケーションまたは運用ツールの開発経験

歓迎(WANT)

【歓迎条件】 ■SRE・基盤領域 ・SREまたはそれに準ずる立場での業務経験 ・クラウド環境における設計・運用・変更管理の経験 ・Infrastructure as Codeを用いた構成管理・運用の体系化 ・可観測性基盤の設計・刷新・改善に関わった経験 ■AI・LLM活用 ・LLMやAIを用いた業務改善・運用効率化の実践経験 ・運用データ(ログ・メトリクス等)を入力としたAI Agentの開発経験 ・分析・要約・判断支援の仕組みを設計・実装した経験 ・APIやSDKを用いて、AIを既存システムや運用フローに組み込んだ経験

採用企業情報

company_default

企業名は会員のみ表示されます

求人番号:9976608

求人に関して不明な点はこの求人の取り扱いヘッドハンター様にご確認ください。

この求人の取り扱い担当者

この企業の求人