Elon Musk 的 Grokipedia 推出全新改版設計
Elon Musk 旗下的 Grokipedia 推出 v0.3 版本更新,帶來全新的 logo 以及對首頁和即時編輯頁面的設計最佳化。更新後的首頁包含精選文章列表、熱門文章及最新編輯追蹤器,文章頁面的頂部關鍵事實表格也採用了更美觀的格式。
Elon Musk 旗下的 Grokipedia 推出 v0.3 版本更新,帶來全新的 logo 以及對首頁和即時編輯頁面的設計最佳化。更新後的首頁包含精選文章列表、熱門文章及最新編輯追蹤器,文章頁面的頂部關鍵事實表格也採用了更美觀的格式。
特朗普與多位科技公司高管會面並簽署了聯合前沿責任承諾,旨在通過行業自律替代具法律約束力的聯邦監管。Google、Anthropic、Meta、OpenAI、xAI 及 NVIDIA 的負責人出席並發表了評論,稱讚該計劃是推動 AI 發展與安全的積極一步。
美國聯邦貿易委員會正對 OpenAI、Anthropic 及其他領先 AI 實驗室展開潛在消費者保護違規調查,計劃在幾週內通過民事調查要求強制調取檔案並對高管進行質詢。此前 FTC 已表示將追究 AI 開發者對其 agent 行為的責任,此次正式調查已超越該範圍並帶來合規風險。同時,Anthropic、OpenAI、Google 和 xAI 的高管在白宮簽署了關於模型獨立外部審計的自願承諾。
美國總統特朗普公佈了名為 Joint Commitment On Frontier Responsibilities 的 AI 安全自律協議,Google、Anthropic、Meta、OpenAI、xAI 及 Nvidia 的高管均已簽字。該協議提出四項規則,要求企業在訓練和部署期間實施內部控制監測、授權內部團隊進行監管、配合獨立外部評估,以及設立董事會獨立委員會監督評估報告。
OpenAI 執行長 Sam Altman 在 DevDay 後的問答中表示,在公司能夠就模型安全做出確切保證之前不會進行首次公開募股,目前沒有確定的時間表。
OpenAI 推出了名為 Dots 的常駐 AI 智慧體,但其釋出卻引發了網民對 xAI 的熱議,因為 dot.com 域名已於 7 月轉讓給 xAI 並重定向至 Grok 聊天應用下載頁。儘管 xAI 購買該域名可能出於常規原因,但社交媒體普遍猜測這是針對 OpenAI 的一次惡作劇。
經歷了數月的暫停後,SpaceXAI 旗下的 AI 線上百科全書 Grokipedia 似乎再次開始更新文章。其即時更新網站顯示了近期多項頁面變動,部分頁面近期獲得了由 Grok 完成的事實核查。X 與 SpaceXAI 設計負責人 Benji Taylor 上週發文稱並未忘記該專案,並表示 v0.2 將比以往更好。
Latent Space 釋出的 AINews 彙總了多款前沿模型動態,其中 Claude Opus 5.5 在 SimpleBench 領先,並在視覺和程式碼生成任務上表現突出;同時涵蓋 GPT-6 家族、Gemini 3.8 Flash、Xiaomi MiMo-V2.6-Pro 以及智慧體、檢索和推理效率等生態進展。
xAI 的 Grok 4.7 現已在 Amazon Bedrock 上線,支援 500K 上下文視窗、四級推理努力程度配置及圖文輸入。該模型可通過 Responses、Chat Completions 和 Converse API 進行呼叫,並提供 US 區域和 Global 跨區域推理配置選項。
推薦理由:原文介紹了 xAI Grok 4.7 在 Amazon Bedrock 上的可用性與整合細節,讀者可以據此瞭解該模型在 Bedrock 上的呼叫方式與配置選項。
Ember-1 是 Fireworks 基於 Kimi K3 開發的研究預覽推理模型,現已在 AI Gateway 上提供。該模型在相同質量評估下比 Kimi K3 生成 token 少約 40%,支援 1M-token 上下文視窗、文本與影像輸入、工具呼叫以及隱式提示快取。
Anthropic 釋出了 Claude Opus 5.5,其輸入輸出價格較前代降低 20%,快取讀取價格降低 60%,並在高思考級別下遇到了超出最大輸出 token 限制的問題;隨後 OpenAI 釋出了 GPT-6 Sol 與 GPT-6 Luna,價格降至同級前代型號的一半。兩家廠商通過密集釋出新模型和大幅降價,進一步加劇了 AI 模型的市場價格戰。
推薦理由:文章記錄了多款旗艦模型密集釋出與降價的情況,讀者可以據此瞭解當前各大廠商在推理模型定價與效能上的最新競爭格局。
Open-weight 模型 在 AI Gateway 8 月份佔據 56% 的代幣量,首次超過所有封閉模型。 - 代幣成本:平均每代幣價格較 5 個月前下降 23.2%,中位團隊每代幣支付 7.6% 更低。
推薦理由:Open-weight models已佔據主導,價格下降顯著,Astra快速滲透顯示新模型在企業生產中的高效性。
Good Start Labs 正在將遊戲轉化為 AI 模型的訓練材料,旨在通過強化學習環境教給模型戰略思維等可驗證的技能。研究表明,在鐵路策略遊戲 1830 中訓練 30B 模型並採用多工終端代理設計,能夠提升其在 Finance-Agent 評測上的表現。
研究表明 AI 系統在文本說服力和真實世界行為中超越了人類專家,其中 Opus 4.1、Opus 4.20、GPT-4o、GPT-5.4、Gemini 2.5 Pro 及 Grok 4.20 表現最強。該結論基於包含 18,978 場對話和 6,923 名參與者的四項實驗,實驗顯示 AI 在為 Save the Children 籌款時的效果是英國專業募捐者的近 3 倍。