
都市

送信後、メールに届くリンクを開いてください




都市

正社員
英語必須
データセンター
オペレーション
ハードウェア
スタートアップ
日本国内のAI向けデータセンター設備を運用し、GPUクラスタの可用性と物理的な信頼性を担保します。NOC運営、監視基盤、障害対応、冷却・電力設備、拠点やベンダー管理まで担当します。
日本国内のAI計算基盤を支えるデータセンター設備運用のリードです。高密度GPUクラスタの稼働を支える機械・電気・冷却設備を管理し、日本拠点のNOCを運営します。インフラの状態を監視し、アラートの切り分け、インシデント対応、エスカレーション、シフト引き継ぎなどの運用プロセスを整備します。電力、温度、環境情報をリアルタイムで把握するオブザーバビリティおよびログ基盤を構築し、冷却異常や電力の問題をGPUへの影響前に検知します。ミッションクリティカルなGPUワークロードに対するSLAを定義・監視し、可用性に責任を持ちます。UPS、スイッチギア、発電機、チラーなどの設備を運用し、CDUやRear Door Heat Exchangerを含むAI向け冷却環境を最適化します。設備インシデントへの対応基準を整備し、GPUの健全性とワークロードへの影響を守ります。コロケーション事業者やハードウェアベンダーを管理し、物理監査とラックの仕様確認も行います。日本での新たな容量展開では、電気・システムチームと連携して物流や物理設置を支援します。勤務地は横浜または東京で、所属部門はInfrastructure、雇用形態はフルタイムです。ミッションクリティカルなデータセンター設備の運用経験、高密度環境や液冷に関する専門性、NOC運用経験、日本でグローバルチームと連携できるバイリンガルの業務能力が求められます。
求人詳細
これは企業の公式求人情報をもとにAIで作成した要約です。情報が不完全、古い、または誤っている可能性があります。応募前に必ず公式の求人情報ですべての内容をご確認ください。