- どんな仕事か
-
■業務概要
本ポジションは、ナレカン事業の信頼性を担う中核として、「インフラの絶対的な安定稼働」を最優先事項に掲げ、その仕組みづくりを推進する役割です。
「システムの信頼性こそ最高のUXである」という信念のもと、安定稼働を客観的に評価する指標としてSLO/SLIの策定・運用を推進します。
毎分数千リクエストに達するトラフィックを死守し、揺るぎない安定性をプロダクトの圧倒的な競争力へと昇華させるミッションを担っていただきます。
特に、ITに馴染みの薄い「非IT企業」のユーザーが日常業務で安心して使い続けられるよう、停止や遅延を許さない「止まらない・遅くならない・即復旧できる」環境の構築を重視しています。
そのため、インフラ設計から監視、パフォーマンス改善までを横断的にリードし、技術によってサービスの安定性という最大の顧客価値を実現する、極めて重要なポジションです。
■業務詳細
※経験や適性に合わせて、以下の業務を担っていただきます
(1)サービスの信頼性向上に向けたインフラ設計・運用
AWS環境を中心に、可用性・耐障害性・スケーラビリティを考慮したインフラ設計・構築・運用を担っていただきます。
サービスの成長に合わせて、安定した稼働を維持できる基盤づくりを推進していきます。
(2)障害対応および再発防止の仕組みづくり
障害発生時には迅速な対応を行いながら、原因分析を通じて再発防止策を設計・実装していただきます。
単なる復旧対応にとどまらず、「障害を繰り返さない仕組み」を構築することが重要な役割です。
(3)パフォーマンス改善およびシステム最適化
サービスのレスポンス速度や処理性能など、ユーザー体験に直結するパフォーマンス改善に取り組んでいただきます。
ボトルネックの特定やリソース最適化などを通じて、安定したサービス提供を実現していきます。
(4)監視・オブザーバビリティの整備
単なる死活監視に留まらず、未知の障害を早期に検知・分析できる可観測性基盤を整備、ログやメトリクスの収集だけでなく、分散トレーシング等を用いてシステムの状態を多角的に可視化していただきます。
SLO/SLIの策定、およびエラーバジェットの運用プロセスを確立し、データに基づいた「攻め(機能開発)」と「守り(信頼 - 求められるスキルは
-
必須 【必須スキル】
▼以下のいずれかに該当する方を求めています。
a)SREとしての実務経験
b)AWS環境におけるインフラ設計・構築・運用経験
c)可用性・耐障害性・スケーラビリティを考慮したシステム設計・運用経験
d)障害対応および原因分析、再発防止の仕組みづくりに関わった経験
e)チーム開発において、運用改善や自動化を意識しながら業務を進めた経験
【歓迎スキル】
▼下記のいずれかの経験
・Ruby on Railsを用いた開発・運用経験
・Reactを用いたフロントエンド開発経験
・B2B SaaSプロダクトの運用または開発経験
・Dockerやコンテナ技術を用いたシステム運用経験
・CI/CDパイプラインの設計・改善経験
・監視・ログ管理・オブザーバビリティ設計の経験
・パフォーマンスチューニングやシステム最適化の経験
・インフラのコード化(IaC)に関する経験
・スタートアップや成長フェーズ企業での勤務経験 - 雇用形態は
- 正社員
- どこで働くか
- 東京都
- 給与はどのくらい貰えるか
- 850~1100万円
NEW
掲載期間26/07/23~26/08/05
求人No.MYN-10693777





