- 正社員
株式会社日本トレカセンター
SRE(Site Reliability Engineer)_トレカ
年俸10,000,000円~21,000,000円
この求人は職業紹介事業者による紹介案件です
応募情報は職業紹介事業者に送信されます
仕事内容
仕事内容: 募集背景 当社は「人間が手でコードを書く」工程を原則廃止し、 Claude Code、Cursor、MCP などを用いた AI 協働開発を前提としています。 事業が急成長するなかで、 プロダクトの信頼性・可用性・パフォーマンスを組織的に担保する仕組みの構築が急務となっています。 現在は開発チームがインフラ運用を兼務していますが、 1人目の専任 SRE として信頼性エンジニアリングの基盤をゼロから設計・確立し、 将来的な SRE チームの礎を築いていただける方を募集します。 業務内容 【概要】 プロダクト基盤全体の信頼性を技術的にリードする立場として、 SLO/SLI 設計から可観測性基盤の構築、インシデント対応プロセスの整備、インフラの IaC 化まで、 信頼性に関わるあらゆる領域を主導していただきます。AI 協働を前提に、運用の自動化・効率化も推進します。 【業務範囲】 - SLO/SLI の設計・運用・エラーバジェットに基づくリリース判断の仕組み化 - 可観測性基盤(メトリクス、ログ、トレース)の設計・構築・継続改善 - IaC(Terraform 等)によるインフラのコード管理と再現可能なプロビジョニング - AWS を中心としたクラウドアーキテクチャの設計・最適化 - CI/CD パイプラインの信頼性・速度の向上 - インシデント対応フロー・オンコール体制・ポストモーテム文化の確立 - キャパシティプランニング・コスト最適化・パフォーマンスチューニング - セキュリティベースラインの策定と脆弱性管理の仕組み化 - Claude Code、Cursor、各種 MCP を活用したインフラ運用の自動化・効率化 - 開発チームへの信頼性プラクティスの浸透とガイドライン整備 【利用するツール】 - AWS(メイン:ECS/EKS、RDS、CloudFront、Lambda、S3 等)/ GCP(一部利用) - Terraform / AWS CDK - Docker / コンテナオーケストレーション - Datadog(APM、Logs、Monitors、Synthetics) - GitHub / GitHub Actions - Claude / Claude Code / Cursor / 各種 MCP ツール - PagerDuty 等のインシデント管理ツール
対象となる方
求める人材: 必須要件 - インフラエンジニア / SRE / DevOps としての実務経験(5年以上) - AWS でのプロダクション環境の設計・構築・運用経験(3年以上) - IaC ツール(Terraform 等)を用いたインフラ管理の実務経験 - 本番障害の対応・原因究明・再発防止策の主導経験 - Git/GitHub を用いたチーム開発とコードレビュー経験 - AI 支援ツール(Claude Code、Cursor 等)を活用したインフラ運用への強い意欲 歓迎経験 - SRE チームまたは SRE 機能の立ち上げ経験 - Kubernetes(EKS / GKE)の本番運用経験 - GCP でのインフラ設計・運用経験 - 大規模トラフィック(数万 rps 以上)の高可用性システムの運用経験 - Go、Python、TypeScript 等でのツール・自動化スクリプト開発 - データベース運用の高度化(RDS、Aurora、DynamoDB、Redis 等のチューニング・可用性設計) - セキュリティ監査、ペネトレーションテスト、SOC2 / ISMS 等の対応経験 - Datadog、PagerDuty 等の監視・インシデント管理ツールの高度な活用経験 - AI/LLM を活用したインフラ運用自動化・障害検知の実践 - OSS への貢献、技術ブログ、カンファレンス登壇 求める人物像 - 1人目の SRE として、信頼性エンジニアリングのあり方をゼロから設計・確立する覚悟がある方 - 「AI を活用しつつも、プロダクションの信頼性を徹底的に担保する」姿勢を持つ方 - 障害やトラブルを「学びの機会」と捉え、組織の成熟度を引き上げることに情熱を持てる方 - 変化の早い環境で自律的に課題を構造化し、チームを巻き込みながら前進できる方 【資質】 - 専任 SRE 不在の組織で、信頼性の文化・プロセス・技術基盤を自ら設計し確立できる自律性 - 「落ちないシステム」ではなく「障害から素早く回復するシステム」を志向する信頼性思考 - 未整備な領域を構造化し、再現可能な仕組みとして定着させる構築力 【具体スキル】 - Linux/UNIX 系 OS のシステム管理・トラブルシューティングの深い知見 - AWS のマネージドサービスを活用したプロダクション環境の設計・構築・運用 - IaC(Terraform、CloudFormation、AWS CDK 等)によるインフラ管理 - 可観測性の3本柱(メトリクス、ログ、分散トレース)の設計・実装 - SLO/SLI 設計とエラーバジェットに基づく運用判断 - コンテナ技術(Docker)とオーケストレーション(ECS/EKS 等)の実践 - ネットワーク設計(VPC、DNS、ロードバランサ、CDN、WAF)の理解と運用 - CI/CD パイプラインの設計・改善とデプロイ戦略(Blue-Green、Canary 等) 【能力】 - システム全体を俯瞰し、信頼性リスクを先回りして特定・解消する構造的思考力 - 障害の根本原因を深掘りし、再発防止を仕組みとして組み込む問題解決力 - 開発チームと協働し、信頼性文化を組織に浸透させる推進力
仕事の特徴
- 固定時間制
- 交通費支給
給与/待遇
試用期間
待遇・福利厚生
その他
応募情報
採用予定人数
常時募集
紹介企業情報
会社名
健康コミュニケーションズ株式会社
事業内容
人事・人材サービス
所在住所
1600023 東京都新宿区西新宿8-17-1 住友不動産新宿グランドタワー36F
代表者
安達 豊
代表電話番号
0362790425
いま見ている求人へ応募しよう!
年俸10,000,000円~21,000,000円
勤務時間・曜日: 9:30~18:30(休憩1時間) 残業 あり(平均20h/月)
- 固定時間制
掲載開始日:2026/07/28
原稿ID:db92d8b9dd56b67d
他の条件で探す
勤務地
特徴
東京都
東京23区
東京都新宿区
新宿駅(東京都)
新大久保駅(東京都)
高田馬場駅(東京都)
四ツ谷駅(東京都)
大久保駅(東京都)
信濃町駅(東京都)
西武新宿駅(東京都)
下落合駅(東京都)
中井駅(東京都)
新線新宿駅(東京都)
四谷三丁目駅(東京都)
新宿御苑前駅(東京都)
新宿三丁目駅(東京都)
西新宿駅(東京都)
落合駅(東京都)
早稲田駅(東京都)
神楽坂駅(東京都)
西早稲田駅(東京都)
東新宿駅(東京都)
都庁前駅(東京都)
新宿西口駅(東京都)
若松河田駅(東京都)
牛込柳町駅(東京都)
牛込神楽坂駅(東京都)
国立競技場駅(東京都)
西新宿五丁目駅(東京都)
落合南長崎駅(東京都)
曙橋駅(東京都)
面影橋駅(東京都)
早稲田駅(東京都)
雇用形態
キーワード