跳到正文
Google Research·· 2026-04-09AI 評分46

ConvApparel:衡量並彌合用戶模擬器的真實性差距

ConvApparel: Measuring and bridging the realism gap in user simulators

AI 導讀

Google Research 釋出 ConvApparel 資料集,旨在衡量並彌合 LLM 驅動的使用者模擬器的真實性差距。

  • 該資料集包含 4,000+ 人機多輪對話,近 15,000 輪,覆蓋服裝購物場景。
  • 通過雙代理收集協議、人口統計對齊、人類相似度評分和反事實驗證三大支柱,評估 Prompted、ICL 與 SFT 模擬器的真實性。

來源:Google Research · research.google