◼️ミッション PoCフェーズから本番環境への移行、LLMを用いた高負荷・高信頼性システムの運用が本格化する中で、 AIプロダクトを安定的かつスケーラブルに支えるインフラ基盤の強化が急務となっています。 研究者・AIエンジニアと密に連携しながら、インフラの設計・構築・運用をリードいただける方を募集します。 ◼️このポジションの魅力 - AI・LLMプロダクトの中核インフラを設計段階から担える - 研究者・AIエンジニアと近い距離で開発できる - 技術選定・設計の裁量が大きい - PoC〜本番・スケールまで一貫して関われる - 「AIを社会で使える形にする」現場に直接関われる ◼️業務内容 AIプロダクトのライフサイクル全体を支えるインフラ業務をお任せします。 - GPU / 高性能計算環境を含む計算基盤の構築・最適化 - CI/CD パイプラインの設計・改善(モデル・アプリ両面) - Kubernetes 等を用いたコンテナ基盤の運用 - 可観測性(Monitoring / Logging / Alerting)の設計・運用 - セキュリティ・権限管理・コスト最適化 - 障害対応、パフォーマンスチューニング、SRE活動 - AIエンジニア・研究者と連携した開発基盤の改善 ※志向や経験に応じて、MLOps / Platform / SRE寄りの役割設計も可能です。 ◼️開発環境 - クラウド: AWS / Google Cloud / Azure - コンテナ: Docker, Kubernetes - 構成管理: Terraform, AWS CDK - CI/CD: GitHub Actions, GitLab CI - 監視: Prometheus, Grafana, CloudWatch - AI / ML: Python, PyTorch, Hugging Face, LLM API ※導入技術は課題に応じて柔軟に選定します。 ◼️選考フロー 書類選考→面接(2~3回/オンライン実施)→内定 ※職種やポジションに応じてリファレンスチェックを実施させていただく可能性があります