インフラエンジニア(SRE)
株式会社ケアネット · 千代田区, 東京都 ·
- Employment
- Full time
- Category
- Devops
- Salary
- JPY 8,508,000 – 13,008,000 / year
株式会社ケアネット · 千代田区, 東京都 ·
株式会社ドクターネット · 東京本社:東京都港区芝大門2-5-5 芝大門ビル8階 ※リモートワーク:可 (1日/週程度の出社あり)
株式会社カケハシ · 105-0003 東京都港区西新橋2-8-6 住友不動産日比谷ビル5F
株式会社メドレー · 港区, 東京都
株式会社ドクターネット · 東京本社:東京都港区芝大門2-5-5 芝大門ビル8階 ※リモートワーク:可 (1日/週程度の出社あり)
SRE/infrastructure engineer at CareNet, a medical information platform serving 240,000+ Japanese physicians. Day to day: consolidate multi-cloud infrastructure onto GCP, standardize Terraform-based IaC, build observability and SLO/SLI practices from scratch, and lead incident management, security hardening, and toil reduction.
当社は医療情報プラットフォーマーとして、国内医師の7割以上にあたる24万人超の会員基盤を築き、安定した成長を続けてきました。
2025年には、北欧発の世界有数の投資会社であるEQTによるTOBを経て、現在は新たな成長ステージへと大きく舵を切っています。
これまで築いてきた事業基盤を生かしながら、さらなる事業成長と変革に挑む「第二創業期」として、中長期的な投資と迅速な意思決定を進めています。
単なる組織拡大を目指すのではなく、この変革をともに推進するコアメンバーを求めています。
強固な会員基盤と、これからの成長を自らつくっていける挑戦機会が共存する環境を好機と捉え、医療の未来をともに動かしたい方からのご応募をお待ちしています。
■募集背景
配属予定部門のシステム開発部では、現在複数のクラウドプラットフォームに分散しているイン
フラ環境をGCPへ集約・一元管理する全社プロジェクトを今後は推進する予定です。これに伴
い、各開発グループに分散していたインフラ運用や外部委託領域の可視化を進め、部全体を横断
するSRE機能をゼロから立ち上げる方針です。
本番環境アクセス権限の最小化・監査ログ整備、IaC化、モニタリング・可観測性の標準化など
より高度なDevOps/SRE基盤を構築するため、インフラ・SREを専任で担うスペシャリストを
新たに募集します。
■ミッション
システム開発部全体のインフラ基盤およびサービス信頼性の向上をリードしていただきます。
GCPへの集約やIaCの標準化、マネージドサービス活用による運用負荷低減とコスト最適化を推
進。さらにSLO/SLIに基づく可観測性(Observability)基盤の構築、トイルの削減、将来的な
コンテナ化やPlatform Engineeringの立ち上げまで見据え、開発チームが安全・高速に価値を
提供できる先進的なプラットフォームを裁量を持って構築することがミッションです。
■本ポジションの魅力
開発組織全体において、監視・IaC・SLO運用といったSREプラクティスをまさにゼロから立ち
上げるフェーズです。既存のルールやレガシーな型に縛られることなく、可観測性(Observability)基盤の構築やSLO運用をはじめ、将来的なコンテナ化・PlatformEngineeringの立ち上げまで、大きな裁量を持ってゼロからデザインできます。
■業務内容
クラウド基盤・IaC・マネージドサービス活用
・GCPもしくはAWSへの集約に向けた全社実行計画の策定・推進
・Terraform等によるIaC基盤の標準化(現状評価・基準設定・計画策定、全グループへの展開)
・DB・キャッシュ・実行基盤等の棚卸しと、マネージドサービスへの移行推進
・FinOps観点に基づくクラウドコストの可視化・適正サイジングおよびコスト構造の見直し
速度改善・信頼性・可観測性(オブザーバビリティ)
・サービス構造・障害点の可視化、メトリクス・ログ・トレースを統合した可観測性基盤の設計・導入
・SLO/SLI・エラーバジェットの設計と運用の立ち上げ(現状、指標自体が存在しない状態からのゼロベース構築)
・インフラ・ミドルウェア観点でのボトルネック分析とパフォーマンスチューニングによる、レスポンスタイム・ページ表示速度等のサービス速度改善
・キャパシティプランニングによる安定運用の実現
アクセス管理・インフラセキュリティ
・最小権限の原則に基づく本番環境アクセス権限の適正化および監査ログ整備
・IAM・認証基盤の再設計、シークレット管理や脆弱性パッチ適用の自動化
インシデントマネジメント・トイル削減
・外部委託領域の可視化と内製化に向けた把握体制の確立
・オンコール体制・障害対応フローの設計、MTTR短縮に向けた自動化・一次対応の仕組み化(AI活用含む)
・ポストモーテム(Blameless Postmortem)文化の導入・運用、トイルの特定と自動化による継続的な削減
・デプロイ基盤・ロールバック機構の設計(テックリード・技術戦略Gと連携したCI/CD基盤標準化)
将来的なチャレンジ領域(ご経験・意向に応じて段階的に拡大)
・コンテナ化・Kubernetes等、モダンな実行基盤への刷新検討
・Platform Engineering(開発者向けセルフサービス基盤・ゴールデンパスの整備)の立ち上げ
・マルチクラウド構成やDR/BCP設計など、事業継続性を高めるアーキテクチャ検討
利用技術
クラウド:GCP、AWS(検討中)、IDCFクラウド(移行対象)、さくらのクラウド(移行対象)
マネージドサービス:Cloud SQL、Memorystore、Cloud Run、GKE Autopilot等(運用負荷低減・コスト最適化のための活用・移行を推進) IaC/DevOps:Terraform、CI/CDツール(グループごとに異なる現状を標準化)
監視・可観測性:メトリクス・ログ・トレース基盤(Cloud Monitoring/Datadog/Grafana/Prometheus等を想定)、外部監視委託先ツール(棚卸・内製化対象)
将来導入を見据える技術:Kubernetes等のコンテナオーケストレーション、Platform Engineering関連ツール(Backstage等) 言語・フレームワーク(関連理解):PHP(Laravel/FuelPHP)、Python、Node.js、TypeScript等
株式会社グリッド · 港区, 東京都