クラウドエンジニア•SRE■フルリモート/正社員/フレックス■インフラの運用・改善に携わる
求人のポイント
■場所:フルリモート
■時間:専門業務型裁量労働制
※8時間勤務したものとみなされます。
※社内の会議のほとんどが10:00から19:00の間で行われています。
■形態:正社員
業務内容
━━━━━━━━━━━━━━━━
募集背景
━━━━━━━━━━━━━━━━
ピクスタでは、主力事業である「PIXTA」を安定的に運用しつつ、出張撮影プラットフォーム「fotowa」や「PIXTA オンデマンド」をはじめとする複数事業を展開しています。
さらに、機械学習やアノテーションの知見を活かした、AI開発のための機械学習用画像データサービスの提供にも取り組み、事業領域を拡大中です。
既存事業の拡大と新規事業の立ち上げに伴う開発組織拡充のため、各事業・プロダクトの開発速度や信頼性の維持・改善に貢献いただけるSite Reliability Engineer を募集しています。
━━━━━━━━━━━━━━━━
業務内容
━━━━━━━━━━━━━━━━
開発速度や信頼性の維持・改善をするために、ツール導入などによる仕組み化や各事業・プロダクトで利用しているインフラの運用・改善に携わっていただきます。
・コンテナ実行環境である Amazon EKS/ECS の運用・改善
・SLI/SLO の運用・改善やそれに基づいた仕組みの構築
・CI/CD 環境の運用・改善
・パブリッククラウドのコスト適正化
・インフラ領域における技術的負債(バージョンアップなど)の解消
▼直近の課題例
・SLI/SLO の運用・改善やそれに基づいた仕組みの構築
SLOの計測などSREのプラクティスを積極的に活用できるように、オブザーバビリティツールはDatadogを採用しています。
この数年は特にMTTRを改善するためにトレースやメトリクスの情報をDatadogに集め、問題発生時に早急に原因特定できるような環境を整備してきました。一方で、アクセスログなどのログ情報は別でセルフホストで運用しているため管理面も含めて同じくDatadogに集約したいと考えています。
・コンテナ実行環境である Amazon EKS/ECS の運用・改善
中長期的な信頼性の維持・改善の取り組みの一つとして、プロダクトが稼働するコンテナ実行環境などのインフラ周りをTerraformを使用してコード化(IaC)を進めています。現在はプロダクトが稼働するコンテナ実行環境をTerraformで管理できるようなっています。一方で、その周辺のパブリッククラウド周りのリソースについては手動で管理となっているものが多く、こちらもTerraformによるコード化を進めていきたいと考えています。
■業務内容の変更範囲
会社の定める業務
━━━━━━━━━━━━━━━━
業務の進め方
━━━━━━━━━━━━━━━━
本人の希望をベースとして上長と相談しつつ、半年ごとに担当いただく業務を決めて取り組んでいいただく形となります。
入社後半年程度は上長とのOJTを通して業務に取り組んでいただけるフォロー体制も整えています。
━━━━━━━━━━━━━━━━
利用技術
━━━━━━━━━━━━━━━━
パブリッククラウド: Amazon Web Services(AWS)
コンテナ実行環境: EKS/ECS
IaC: Terraform, CloudFormation
CI/CD: GitHub Actions, ArgoCD, CodePipeline, CodeBuild, HCP Terraform
モニタリング: Datadog, Rancher
データストア: MySQL(Aurora, RDS), PostgreSQL(RDS), Redis(ElastiCache), Memcache(ElastiCache)
その他ツール: GitHub, GitHub Copilot, Slack, ChatGPT, esa
━━━━━━━━━━━━━━━━
技術基盤グループのミッション
━━━━━━━━━━━━━━━━
・プロダクトの成長と安全・信頼とのバランスを継続的に最適化している状態をつくる
・クラウドコストによる価値が継続的に最大化されている状態をつくる
━━━━━━━━━━━━━━━━
本ポジションで求められる役割
━━━━━━━━━━━━━━━━
サービスをインターネット上で提供し続けるためには、エンジニアリングの活用が必要不可欠です。
技術基盤グループでは、PIXTA と fotowa を対象として、掲げるミッション・ビジョンの達成を通してそれらの実現に寄与します。
具体的には、本ポジションでは定量指標であるSLOをベースとして、コンテナ実行基盤やオブザーバビリティツールの運用・改善など、SREのプラクティスを活用して信頼性の維持・向上に貢献いただきます。将来的には、安全性やクラウドコストの最適化に向けた取り組みも期待しています。
━━━━━━━━━━━━━━━━
入社後のキャリアステップ例
━━━━━━━━━━━━━━━━
・入社後3か月~半年
┗会社や事業の理解を深め、組織やチームに馴染む。OJTを通して当社の技術スタックに慣れ、提示された課題に対し、自身のスキルを活かして取り組む
・入社後半年~1,2年
┗上長や周りのフォローを得ながら、一人で一定規模(1ヶ月以上)の課題やプロジェクトに取り組む
・入社後3年~
┗スキル、希望を鑑みてリーダーとしてマネジメント、技術を磨き続けるスペシャリストなどキャリア形成を進めていく
━━━━━━━━━━━━━━━━
仕事の魅力
━━━━━━━━━━━━━━━━
・各事業・プロダクトの開発速度や信頼性の維持・改善を通して、Site Reliability Engineer として市場価値を向上できる環境です。
・Kubernetes やその周辺のエコシステムなど、クラウドネイティブ技術を積極的に採用しています。それらに加えてパブリッククラウドを活用した大規模なインフラ設計・運用に携わることで、エンジニアとしてのスキルをさらに高めることができます。
・フルリモートでありながら、Slack内でのコミュニケーションが活発で先輩エンジニアや上長へいつでも気軽に相談できる環境です。
・年齢や社歴、役職にとらわれずに意見が歓迎されるボトムアップな雰囲気の社風です。 (平均残業時間 3.5時間/月、平均有給取得日数 15.9日/年)
求める人物像
━━━━━━━━━━━━━━━━
必要要件
━━━━━━━━━━━━━━━━
以下いずれかの経験を3年以上お持ちの方
・AWS/GCP/Azure などのパブリッククラウドを使った開発・運用経験
・EKS/GKE/k8s/ECS などのコンテナ実行環境を使った開発・運用経験
・Terraform/CloudFormation などの IaC を使った開発・運用経験
・Site Reliability Engineering の業務経験
━━━━━━━━━━━━━━━━
歓迎要件
━━━━━━━━━━━━━━━━
・Datadog/New Relic などのオブザーバビリティツールを使った運用経験
・CI/CD ツールの導入・運用経験
・何かしらのプログラミング言語を使った開発・運用経験
━━━━━━━━━━━━━━━━
求める人物像
━━━━━━━━━━━━━━━━
・大規模な自社サービスの開発・運用に関わりたい方
・問題発見や問題解決に対して興味・関心がある方
・開発速度や信頼性の維持・改善をするために技術をどう使うかという考え方ができる方
・自身を客観視して、自ら成長課題を捉えて自己研鑽していける方
選考フロー
・Reworker運営事務局による推薦可否判断
・書類選考
・一次面接(オンライン)開発部GL
・SPI
・最終面接(オンライン)CTO・開発部GL
・内定
※上記は変更となる可能性もございます。
必要書類
・履歴書
・職務経歴書
※選考フロー、必要書類は変更する可能性がございます
就業条件
| 就業場所 |
フルリモート
|
|---|---|
| 就業時間 |
専門業務型裁量労働制
|
| 契約形態 |
正社員
|
| 給与/報酬 |
年収600万円〜800万円
|
| 昇給・賞与 |
昇給:年2回 |
| 試用期間 |
3ヶ月(給与変動なし) |
| 休日・休暇 |
・完全週休2日制(土/日)
|
| 福利厚生 |
・リモートワーク手当(月1万円)
|
本求人は、採用企業よりReworkerがお預かりしている求人です。
応募を持ちましてReworkerが選考サポートを開始いたします。
※ご経験・ご要望によっては、サービスをご提供できない場合がございます。ご了承ください。