- どんな仕事か
-
【業務内容】
国内最大級のスケールを持つSaaSである「COMPANY」の商用環境において、IaCの高度化とAIOpsの共通基盤化における技術的リードをお任せします。SRE領域の技術責任者として「大規模運用をどう自動化・最適化するか」の道筋を立て、最適な技術選定とアーキテクチャ設計を行います。
■ アーキテクチャ設計・技術選定
・大規模環境(数千~数万インスタンス)における、プロビジョニング・パッチ適用・設定管理を徹底的に自動化するIaCの高度化・共通化のグランドデザイン
・膨大なインフラログ・メトリクスを効率的に集約し、AI/機械学習を活用して障害の予兆検知や根本原因特定を自動化する仕組み(AIOps)の共通基盤の設計
・スケーラブルかつコスト効率の高いAWSアーキテクチャの再設計・最適化
■ 開発リード・技術的品質担保
・難易度の高いコアコンポーネント(自動化基盤、オブザーバビリティ基盤、AIOpsパイプライン等)の自らによる実装(ハンズオン)
・PoC(概念実証)の実施による新技術の検証と本番適用のリード
・SLO/SLI等の信頼性指標を担保する非機能要件の設計
・コードレビューやADR(アーキテクチャ決定記録)を通じた、SREチーム全体の技術力底上げ・メンタリング
技術選定からコア実装、品質基準の策定までを一貫して牽引し、当社の開発プロセスにおける技術的支柱(テックリード)として、組織全体の開発者体験と技術力を一段引き上げていただくことを期待しています。
プレイヤーとして最前線で手を動かしながら、自ら確立した「型」を全社の標準として浸透させ、エンジニアが本質的な開発に集中できる環境を技術の力で実現していただきます。
【部門説明】
■組織体制
COMPANYのSRE組織には、以下のようなグループがあります。1グループは3~10名で、グループに関わらず全員で運用作業を分担しています。
・監視など運用基盤を開発、改善するグループ
・運用自動化(AIOps含む)を進めるグループ
・クラウドサービスインフラを設計し、改善するグループ
・セキュリティ、コンプライアンス強化を進めるグループ
採用後には1on1を実施し、お持ちのスキルや今後のキャリアパスを踏まえて配属先を - 求められるスキルは
-
必須 【必須スキル・経験】以下いずれかの経験をお持ちの方
・クラウド(AWS等)における設計・構築・運用経験
・IaCを用いたインフラ構築・運用の自動化経験
・パフォーマンス、スケーラビリティ、可用性、セキュリティなど非機能要件を主導して設計・改善した経験
・数名以上のチームにおいて技術的な意思決定を提案・推進した経験
・ネイティブレベルの日本語能力
【歓迎スキル・経験】
・大規模環境における、IaC(Terraform、CloudFormation、Ansible等)を用いたインフラ構築・運用の自動化経験
・Datadog、NewRelic、Zabbix、ELK Stackなどを用いた、大規模マルチアカウント/マルチインスタンスのオブザーバビリティ基盤の構築経験
・大量データのデータパイプライン構築経験、またはAI/機械学習を用いたアノマリー検知などの運用効率化(AIOps)の設計・実装経験・強い関心
・スケーラブルかつコスト効率の高いクラウドアーキテクチャの設計・最適化経験
・技術選定の背景をドキュメント化(ADR/RFC等)し、チームに浸透させた経験
・カンファレンス登壇、技術書執筆、OSSコントリビュート等のアウトプット経験
【求める人物像】
エンジニアリング視点での問題解決、定量データに基づく課題設定、実行力、根本解決へのこだわり、探求心、チームや組織を巻き込み主体的に成果を最大化できる方
※ご参考※
【服装】
パーカー、デニム、スニーカーもOKです!
エンジニアは基本カジュアルな服装で働いています。
(お客様との打ち合わせ時にはジャケットを着用することもあります。)
※下記のエンジニア採用ページの写真も参考にしてみてください。
https://www.caree - 雇用形態は
- 正社員
- どこで働くか
- 東京都
- 給与はどのくらい貰えるか
- 800~1200万円
NEW
掲載期間26/07/23~26/08/05
求人No.MYN-10694371





