AI Quality Engineering Lead / AIの社会実装をリードするコアメンバー
Gen-AX株式会社 · 東京都港区海岸1丁目7-1 (WeWork 東京ポートシティ竹芝11F)
About The Role
ポジション概要 Gen-AXは音声AIプロダクトの品質保証体制を本格的に立ち上げるフェーズにあります。 音声AIプロダクトでは、機能の正確さだけでなく、会話の自然さ・丁寧さ・安心感・顧客ごとのカルチャー適合性など、人間の感性に依存する品質評価が重要です。しかし、これらを人間が毎回確認する体制ではスケールしません。 本ポジションのミッションは、人間の感性評価をルーブリック・評価データセット・AI Judgeに落とし込み、複数顧客環境でも品質を継続的に担保できる仕組みを設計・進化させることです。AIツールを活用したQAチームの自動化・高度化をリードしていただきます。 業務詳細 音声AIプロダクト全体のQAプロセス設計・構築・改善 「自然さ」「丁寧さ」「安心感」「顧客カルチャーへの適合性」など、感性に依存する品質基準を評価軸・ルーブリック・評価データセットに構造化 AI Judge・自動評価パイプラインの設計と導入 顧客環境ごとのリスク分類・リリースゲートの設計・運用 会話ログの分析基盤の整備 PdM・エンジニア・CS・パートナーQAとの横断的な連携 このポジションの魅力 音声AI領域のQA体制をゼロから設計できる、希少なポジションです 「人間の感性評価をどうAIに落とし込むか」という、まだ正解のない領域に挑戦できます 特定の顧客に閉じず、複数のエンタープライズ環境での品質設計に関われます QAの枠を超えて、プロダクト・エンジニアリング・CSと深く連携できる環境です 求める人物像 曖昧な違和感を言語化・構造化できる人 自動化された検証プロセスを設計・構築できる人 AI評価の限界を理解しつつ、人間評価と組み合わせて設計できる人 エンジニア・PdM・CSなど多様なチームと連携できる人 必要な経験/スキル 自動化・効率化・プロセス改善などのプロジェクトを自ら推進・リードした経験 品質保証プロセスやテスト設計の設計経験(テスト実行だけでなく、仕組みを作った経験) LLMやAIツールを業務改善・検証・分析に活用した経験 コードを読み、エンジニアと実装レベルで議論できるスキル(Python, Java, Kotlin 等) あると望ましい経験/スキル 音声プロダクト・会話AIのQA経験 AI Judge・自動評価パイプラインの構築経験 プロンプトエンジニアリングの実務経験 CI/CDを用いたテスト自動化の経験 QAチームのリード・立ち上げ経験 複数顧客環境での品質管理経験 参考情報 LLM as a Judge Zennブログ
This is an external listing. JobSpring does not represent or verify the employer. Report this listing
JobSpring