Site Reliability Engineer(SRE)
給与・報酬応相談
- 業界:
- IT・インターネットサービス
- 職種:
- システムエンジニア(インフラ)
求人概要
信頼性を、運用の頑張りではなく、エンジニアリングで高める。
Bring OutのSREは、AIを活用するプロダクトと開発組織が、速くリリースしながら顧客の信頼を守れるよう、信頼性・Observability・自動化の基盤を設計し、つくるエンジニアです。アラートやチケットを処理する役割ではなく、どの信頼性指標を改善し、どの運用作業をなくし、開発者にどんな基盤を提供するのかを自分で決め、ソフトウェアで実現していく仕事です。
募集背景
Bring Outは、商談・社内会議・サービス現場の対話データをAIで解析し、経営判断に使える一次情報に変えるプロダクトを提供しています。エンタープライズ企業を中心に導入が広がり、サービス規模はこの1年で約3倍に成長しました。開発組織を「アプリケーション開発」と「基盤・SRE」の2層に整理し、LLM・課金・対話分析にオーナーシップを持つPlatformチームを新設します。SREはPlatformチームの一員として、LLMを含む基盤全体の信頼性に責任を持ちます。
お任せしたいこと
- Observabilityの整備(ログ・メトリクス・トレースの統合、アラート設計)
- SLI/SLOの導入と組織への浸透
- キャパシティプランニングとスケーリング(DB、ストレージ、GPU調達・需要予測)
- LLMの運用管理(レイテンシ、コスト、エラー率の可視化、リトライ・フォールバック設計)
- 基盤起因の障害の再発防止(技術的な原因究明、再発防止策の実装)
- トイル削減と自動化、開発者体験の向上、セキュリティ設計
応募要件
必須要件
- SRE、インフラエンジニア、プラットフォームエンジニアのいずれかとしての実務経験(目安3年以上)
- AWS上で稼働する本番サービスの運用経験(設計だけでなく、動いているものを直した経験)
- Terraform等のIaCによるインフラ管理の実務経験
- Python、TypeScript、Go等を使って、運用の自動化やツール開発を行った経験
- 監視・障害調査・原因究明を、自ら主体的に進めた経験
- 日本語で円滑に開発チームと議論できること(ネイティブレベル)
歓迎要件
- Datadog、OpenTelemetry、Prometheus等を使ったObservabilityの設計・導入経験
- SLI/SLOやエラーバジェットの設計・運用経験
- PostgreSQL等のデータベースのキャパシティプランニング、パフォーマンスチューニングの経験
- LLM APIやGPUを使うAIワークロードの運用、監視、コスト最適化の経験
- GitHub Actions等のCI/CDや、開発者向けセルフサービス基盤の構築経験
- IAMポリシー、最小権限、シークレット管理などのアクセス制御設計の経験
- 生成AIを使った運用自動化(アラート要約、障害調査支援、ランブックの自動化など)の経験
- 急成長期のSaaSやスタートアップでのインフラ運用経験
給与
応相談
- 候補者様の経歴・スキルによって柔軟に条件を検討
- 半期ごとにミッションシートを設定し評価を実施
※ストックオプション付与の可能性有り
労働条件
勤務地
リモートワーク
手当
- 交通費支給
- 出先での会議の場合の会議室代全額支給
- リモートワーク手当(ヘッドセットなどの準備として最大2万円補助)
- PC支給(ビズ15万円以内、開発20万円以内)
社会保険・福利厚生
- 社会保険完備
- 健康診断(年1回)
- 育休産休制度
勤務時間
- フレックスタイム制
- 始業 8:00〜10:30
- 終業 15:00〜20:00
- コアタイム 10:30〜15:00
- 労働時間 月160h + みなし残業40h以内
休日休暇
- 週休2日(土日)、祝日
- 有給休暇 年間10日
- 年末年始休暇(12月29日から翌年1月3日まで)
- 慶忌休暇
事業所名
リモートワーク
選考フロー
- 書類選考
- カジュアル面談
- 面接3回
更新日: 2026/10/8
本内容は、企業より受領した情報や公開資料を一部AIを用いて構成したものです。現時点の情報に基づき細心の注意を払っておりますが、その完全性を保証するものではありません。確定した詳細条件や最新状況については、選考の過程で適宜共有させていただきます。
無料登録で非公開求人を含む
0件の求人をご覧いただけます