Woven CityのVision AIチームで、コンピュータビジョンと深層学習を用いた空間知能の研究開発を担います。物理環境の理解や人と機械の相互作用に関するアルゴリズムを試作し、Web、モバイル、ロボットなどに対応する実用システムへ発展させます。研究成果の発表や論文投稿にも取り組みます。
この求人について
Woven Cityに関わるAIプロダクトで、QA主導の品質評価基盤を立ち上げるポジションです。LLMベースのシステムに特有の不確実性や非決定性を踏まえ、正確性、一貫性、安全性、公平性、UXなどの品質観点を定義します。シナリオベーステスト、探索的テスト、レッドチームを実施し、LLMの出力を分析して行動傾向や失敗パターンを特定します。ログ、評価、問い合わせなどのユーザーフィードバックを品質評価に取り込み、評価手順を標準化・再利用可能な形に整理します。評価データの収集・集約、定期的な品質チェック、自動化された評価ワークフローを設計し、開発チーム、MLOps、データエンジニアリングチームと連携して、継続的な品質フィードバックループを構築・運用します。実ユーザーからのフィードバックが限られる段階でも、実用的な評価の仕組みを立ち上げ、品質上の課題やリスクを文書化して関係チームへ明確に伝えます。LLMを利用したプロダクトのQAまたはテスト経験が3年以上あり、テスト観点の定義やテストケース作成を含むテスト設計の経験が必要です。仕様が曖昧で、唯一の正解が存在しないシステムを評価できることが求められます。Function Leaderにレポートし、ハイブリッド勤務に対応しています。Woven Cityへの出張が月に数回あります。勤務地は東京都です。
これは企業の公式求人情報をもとにAIで作成した要約です。情報が不完全、古い、または誤っている可能性があります。応募前に必ず公式の求人情報ですべての内容をご確認ください。