跳到正文
熱點事件持續更新

Harvey LAB-AA v1.1 benchmark update

1 篇報導1 個報導來源1 小時前更新

先了解這件事

AI 綜述

Grok 4.7 在法律領域獲得首位,並與 Harvey 合作推出 Harvey LAB-AA v1.1。

  • Grok 4.7 在 Legal Agent Benchmark (LAB) 中排名第一。
  • Harvey LAB-AA v1.1 更新評分方法,新增「hallucination check」並要求正確回答不包含重大誤述。
  • 這些更新有助於驗證模型在法律資訊處理上的準確性與可靠性。

AI 根據報導生成 · 1 小時前更新

最新進展10月9日 03:17
Grok 4.7 在法律領域排名第一

報導時間線

沿著報導,瞭解事件的不同面向。

10月9日
  1. Elon Musk (@elonmusk)
    Grok 4.7 在法律領域排名第一

    Grok 4.7 在法律領域獲得首位,並與 Harvey 合作推出 Harvey LAB-AA v1.1。 Grok 4.7 在 Legal Agent Benchmark (LAB) 中排名第一。 Harvey LAB-AA v1.1 更新評分方法,新增「hallucination check」並要求正確回答不包含重大誤述。 這些更新有助於驗證模型在法律資訊處理上的準確性與可靠性。

本事件熱度趨勢

還沒有足夠的連續觀測資料,暫不繪製趨勢。