【フルリモート/週5】AWS SRE・クラウドインフラエンジニア(大規模Webサービス・高可用性基盤構築と運用自動化)

案件要件
- 職種
- エンジニア
- 業務内容
- システム開発・運用SES
- 報酬目安
- 4,400 ~ 4,800円/時
- 稼働時間目安
- 週5日 (時間目安 160時間)
- はたらく場所
- フルリモート
- スキル
【フルリモート/週5】AWS SRE・クラウドインフラエンジニア(大規模Webサービス・高可用性基盤構築と運用自動化)
お任せしたいこと
自社の大規模Webサービス(または高トラフィックなSaaSプロダクト)において、AWSを基盤としたインフラの設計・構築、およびシステムの信頼性(Reliability)を継続的に向上させるためのSRE(Site Reliability Engineering)業務をお任せします。
「インフラが動いて当たり前」というプレッシャーの中で、手作業による属人的なサーバー管理(トイル)を徹底的に排除し、Terraformを用いたコード化(IaC)やDatadogを活用した高度な可観測性(オブザーバビリティ)の導入を通じて、開発スピードとシステムの安定稼働という相反する要件を高い次元で両立させる泥臭いエンジニアリングに取り組んでいただきます。
具体的な業務内容
・AWS(EKS, ECS, Aurora, ElastiCache等)を利用した、スケーラブルで耐障害性の高いクラウドインフラの設計・構築
・Terraformを用いたインフラストラクチャの完全なコード化(IaC)、およびレビュー・デプロイフローの自動化
・DatadogやOpenTelemetry等を利用した、SLI/SLOの定義、およびシステムのボトルネック(CPUスパイク、スロークエリ等)をプロアクティブに検知する監視基盤の構築
・トラフィックの急増に耐えうるオートスケール機構の設計、およびCDN(CloudFront, Fastly等)を利用したキャッシュ戦略の最適化
・GitHub Actions等を利用した、開発チームが安全かつ高速にデプロイできるCI/CDパイプラインの整備
・システム障害時のインシデントレスポンス(トラブルシューティング)、およびポストモーテム(非難なき振り返り)を通じた根本原因の排除
・バックエンドエンジニアと連携した、アプリケーションアーキテクチャの改善提案(マイクロサービス化の支援やDBチューニング)
必須スキル・経験
・AWSを用いたインフラ環境の設計、構築、および運用保守の実務経験(目安として3年以上)
・Terraform、またはAWS CDK等を用いたIaC(Infrastructure as Code)の実践経験
・Docker / Kubernetes(EKS)、またはECS等のコンテナ技術を利用した本番環境の運用経験
・Git / GitHubを用いた構成管理、およびプルリクエストベースでのチーム開発経験
・Linuxサーバーの基礎知識、およびネットワーク(TCP/IP, HTTP等)の深い理解
歓迎スキル・経験
・SREとしての実務経験、またはSLI/SLOの導入・運用経験
・月間数千万PV以上の大規模・高トラフィックなWebサービスのインフラ運用・負荷対策経験
・Datadog、New Relic等のAPMツールを用いたオブザーバビリティの構築・運用経験
・Go、Python、Node.js等のプログラミング言語を用いたアプリケーションの開発経験(自動化ツールの作成等)
・AWS認定資格(Solutions Architect Professional, DevOps Engineer Professional 等)
開発・業務環境
クラウド・インフラ:AWS (EKS, ECS, EC2, Aurora, S3, CloudFront 等)
IaC・構成管理:Terraform
コンテナ・オーケストレーション:Docker, Kubernetes (EKS)
CI/CD:GitHub Actions (または CircleCI, ArgoCD)
監視・可観測性:Datadog (APM, Log Management, Synthetics 等), PagerDuty
コミュニケーション・管理:GitHub, Jira, Slack, Zoom
プロジェクトチームについて
SRE(Site Reliability Engineering)チームへの配属となります。
「信頼性は最大の機能である(Reliability is the most important feature)」というGoogleのSRE哲学に共感し、インフラの運用を「気合いと根性」で乗り切ることを強く嫌う手堅いカルチャーです。障害が発生した際にも「誰がオペレーションを間違えたか」を追求するのではなく、「なぜ間違えるような仕組みになっていたのか」をシステムの問題として捉え、泥臭く自動化のコードを書くことで再発防止に努めています。
求める人物像
・「同じ手作業を2回繰り返すくらいなら自動化のスクリプトを書く」という、運用に対する良い意味での怠惰さを持っている方
・アラートが鳴った際にパニックにならず、ログとメトリクスから冷静に事実を切り分けて論理的にトラブルシューティングができる方
・インフラという枠に閉じこもらず、アプリケーションエンジニアと対等にコードやアーキテクチャについて議論ができる方
仕事の魅力
ビジネスの成長に伴い指数関数的に増加するトラフィックを、AWSのマネージドサービスと高度なアーキテクチャ設計によって捌き切る、エンジニアとして最も痺れる経験ができるポジションです。単なる「インフラのお守り」を脱却し、ソフトウェアエンジニアリングのアプローチでシステム全体の信頼性を底上げする経験を通じて、モダンなテック企業が喉から手が出るほど欲しがる「トップクラスのSRE・クラウドアキテクト」としての圧倒的な市場価値を着実に磨くことができます。
働き方
リモート環境
[フルリモート] 基本的にフルリモートで働いていただけます(※大規模障害時など、緊急のインシデント対応が必要な場合には、迅速な同期コミュニケーションが求められます)。
株式会社Kaizen Tech Agent
株式会社Kaizen Tech Agentは、「人と技術をつなぐ」ことを企業理念に掲げ、日々向上していく『技術』と『人』を最適な形でむつび付け提供することで、
お客様にとって真にプラスとなる価値でありたいと考えております。
私たちはそれぞれの個性を尊重し、ほっとする和みの社風でありながら、変化する時代に対して受け身にならず、未来への挑戦心を宿しています。
事業領域は、WEBアプリ開発、業務システム開発、スマホアプリ開発、インフラ構築など幅広く展開しており、
フリーランス様に対して最適な案件をご提案させて頂いております。どんな些細な事でも結構ですので是非いつでもお気軽にご相談ください。
