【フルリモート/週5】AWS SRE・プラットフォームエンジニア(マルチアカウント統制・EKS基盤の大規模プラットフォームエンジニアリング)

案件要件
- 職種
- エンジニア
- 業務内容
- システム開発・運用SES
- 報酬目安
- 4,700 ~ 5,200円/時
- 稼働時間目安
- 週5日 (時間目安 160時間)
- はたらく場所
- フルリモート
- スキル
【フルリモート/週5】AWS SRE・プラットフォームエンジニア(マルチアカウント統制・EKS基盤の大規模プラットフォームエンジニアリング)
お任せしたいこと
自社で展開する急成長中の大規模Webサービス、または数十のプロダクトが乱立するエンタープライズ環境において、AWS(Amazon Web Services)を活用したスケーラブルなインフラ基盤の構築と、開発者体験(DX)を極限まで高める「プラットフォームエンジニアリング」の実践をお任せします。
単なる「インフラのお守り(運用保守)」や「依頼されてサーバーを立てるだけの御用聞き」にとどまらず、AWS OrganizationsやControl Towerを用いたマルチアカウント環境のガバナンス統制と、Amazon EKS(Kubernetes)を中核としたコンテナ基盤の設計・運用を通じ、開発チームが自律的かつ最速で安全に価値をデプロイできる「舗装された道(Paved Road)」を泥臭く切り拓いていく中核的なポジションです。
具体的な業務内容
・Amazon EKS(Kubernetes)を活用した、高可用かつスケーラブルなマイクロサービス向けコンテナオーケストレーション基盤の設計・構築・運用
・Terraform、またはAWS CDKを用いたインフラストラクチャの完全なコード化(IaC)と、再利用可能なモジュール(Terraform Registry等)の社内提供
・AWS Organizations、AWS Control Towerを利用した、数十〜数百規模のAWSアカウントの一元管理、およびセキュリティ統制(SCP、AWS Config等)の自動化
・ArgoCD等を用いたGitOpsによる継続的デリバリー(CD)環境の構築、およびGitHub Actionsを利用したCIパイプラインの高速化
・Datadog、Prometheus、またはAWS X-Rayを活用した、分散システム全体の可観測性(Observability)の向上と、SLI/SLOに基づくデータドリブンなアラート設計
・Go、またはPythonを用いた、手作業(トイル)を排除するための社内向けCLIツールやKubernetesカスタムコントローラー(Operator)の開発
・AWSの利用コスト(FinOps)の分析と、Spot Instancesの活用やGravitonプロセッサへの移行等による泥臭いインフラコストの最適化
・障害発生時のインシデントコマンド、およびポストモーテム(事後検証)のファシリテーションを通じた、非難を伴わない(Blameless)システム改善の牽引
必須スキル・経験
・AWSを利用した本番環境でのインフラ設計・構築・運用実務経験(目安として3年以上)
・Terraform、またはAWS CDKを用いたIaC(Infrastructure as Code)の実践経験
・Docker、およびKubernetes(EKS等)を利用したコンテナ環境の構築・運用経験
・Linuxサーバーの深い知識、およびTCP/IPネットワークの基礎知識
・Git / GitHubを用いたプルリクエストベースでのチーム開発、およびCI/CDの構築経験
歓迎スキル・経験
・SRE(Site Reliability Engineering)の実践、またはSLI/SLOを定義し運用した経験
・AWS Organizations等を用いたマルチアカウント環境でのインフラ統制・運用経験
・Go、またはPythonを用いたバックエンド開発、またはツール開発経験
・ArgoCD等を用いたGitOpsの運用経験
・AWS Certified Solutions Architect - Professional (SAP)、または DevOps Engineer - Professional (DOP) 等の資格
開発・業務環境
クラウド・インフラ:AWS (EKS, EC2, RDS, ElastiCache, Control Tower, Organizations 等)
コンテナ・オーケストレーション:Docker, Kubernetes (Amazon EKS)
IaC・構成管理:Terraform (または AWS CDK)
CI/CD・GitOps:GitHub Actions, ArgoCD
監視・可観測性:Datadog, Prometheus, Grafana, PagerDuty
開発言語(ツール・スクリプト等):Go, Python, Bash
コミュニケーション・管理:GitHub, Jira, Slack, Zoom
プロジェクトチームについて
開発チームとインフラ環境の架け橋となり、システム全体の信頼性と生産性を底上げするSRE(Platform Engineering)チームへの配属となります。
「マネジメントコンソールから手作業でポチポチ設定する(ClickOps)」ことを極めて嫌い、同じ作業を二度繰り返すなら迷わずスクリプトを書いて自動化する手堅いカルチャーです。本番環境で未知の障害やリソース枯渇(OOMKilled等)が発生した際にも、パニックにならずカーネルレベルのログやメトリクスを泥臭く読み解き、根本原因(Root Cause)を論理的に突き止める実直なメンバーが集まっています。
求める人物像
・「システムが落ちないこと」以上に、「開発チームがいかに早く・安全にリリースできるか」という開発者体験(DX)の向上にエンジニアとしての喜びを感じる方
・クラウドインフラの複雑な権限管理(IAM)やネットワーク設計のパズルに直面しても、ベストプラクティスを読み込み、セキュリティと利便性のバランスを論理的に設計できる方
・インシデント(障害)を「誰かのミス」として片付けるのではなく、「システムが防げなかった課題」として捉え、仕組みで再発を防止することに執念を持てる方
仕事の魅力
世界中のテクノロジー企業が注目する「プラットフォームエンジニアリング」と「SRE」の最前線に立ち、AWSの高度なエコシステムを駆使して開発組織全体のパフォーマンスを何倍にも引き上げる、極めてレバレッジの効くポジションです。EKSを中心とした複雑なコンテナアーキテクチャと、マルチアカウントの厳格なガバナンス統制を泥臭く両立させる経験を通じて、単なる「インフラエンジニア」を完全に凌駕し、今後のクラウドネイティブ時代においてメガベンチャーから圧倒的な評価で迎えられる「AWS SRE・プラットフォームアーキテクト」としての市場価値を築くことができます。
働き方
リモート環境
[フルリモート] 基本的にフルリモートで働いていただけます。
株式会社Kaizen Tech Agent
株式会社Kaizen Tech Agentは、「人と技術をつなぐ」ことを企業理念に掲げ、日々向上していく『技術』と『人』を最適な形でむつび付け提供することで、
お客様にとって真にプラスとなる価値でありたいと考えております。
私たちはそれぞれの個性を尊重し、ほっとする和みの社風でありながら、変化する時代に対して受け身にならず、未来への挑戦心を宿しています。
事業領域は、WEBアプリ開発、業務システム開発、スマホアプリ開発、インフラ構築など幅広く展開しており、
フリーランス様に対して最適な案件をご提案させて頂いております。どんな些細な事でも結構ですので是非いつでもお気軽にご相談ください。
