跳到正文
熱點事件持續更新

Opus 4.6 連續獲得最多玩樂評分

1 篇報導1 個報導來源2 小時前更新

先了解這件事

AI 綜述

2026年10月6日凌晨05:52,Thom Wolf 在 Twitter 上分享對多款大型語言模型(LLM)的趣味性測試結果。

  • 測試中,他評估各模型在「玩樂」層面表現,發現新版 LLM 整體玩樂程度下降,主要集中於文字遊戲。
  • 相較之下,Opus 4.6 連續多次獲得「最多玩樂」評分,並創作出「水滴中矛盾世界」等短篇幻想,顯示其在趣味性方面仍具優勢。

AI 根據報導生成 · 19 分鐘前更新

報導時間線

沿著報導,瞭解事件的不同面向。

10月6日
  1. Thom Wolf (@Thom_Wolf)
    LLM 趣味測試:Opus 4.6 佔優

    我測試多個 LLM 的趣味性,結果新版模型較少玩樂,Opus 4.6 連續獲勝。 Opus 4.6:多次獲得「最多玩樂」評分,創造「水滴中矛盾世界」等短篇幻想。 新版 LLM:整體玩樂程度下降,主要以文字遊戲為主。

本事件熱度趨勢

還沒有足夠的連續觀測資料,暫不繪製趨勢。