跳到正文

#模型發布

RSS
今日 9 則
今天10月2日週五
  1. NVIDIA Blog71

    NVIDIA GPU 如何加速 OpenAI GPT‑6 Astra Ultrafast

    NVIDIA GPU 使 OpenAI GPT‑6 Astra Ultrafast 速度提升 8 倍,現已在 API 及 ChatGPT Work 和 Codex 使用者中提供。

    推薦理由:此篇說明 NVIDIA GPU 使 OpenAI GPT‑6 Astra Ultrafast 速度提升 8 倍,對開發者加速編碼代理與工具迴圈有實質影響,並揭示持續最佳化推理軟體可進一步提升效能,對於需要高吞吐量的互動式應用尤為關鍵。

10月1日週四
  1. Demis Hassabis (@demishassabis)66

    DeepMind 宣佈 Gemini 4 Argon 前沿 AI 模型,首批釋出給政府與網路防禦者。 新模型:Gemini 4 Argon,DeepMind 的前沿 AI 模型。 首批釋出:透過 Fairwind Program,先行提供給政府與可信賴的網路防禦者。 未來可用性:更廣泛的可用性將在不久後推出。

    推薦理由:Gemini 4 Argon 代表 DeepMind 在前沿 AI 領域的又一突破,先行向政府與網路防禦者開放,提示其在安全與責任部署方面的先行實踐。

  2. TechCrunch · AI63

    Google 釋出 Gemini 4 Argon,稱其為最強模型

    Google 推出 Gemini 4 Argon,定位為最強模型,專為編碼、研究、寫作及網路安全設計。該模型可自主發現、驗證並修補關鍵軟體漏洞,並在視覺解析、程式碼除錯和遷移等任務上表現出色。Google 還聲稱 Argon 在多項 AI 基準測試中超過 OpenAI 的 GPT‑6 Astra 與 Anthropic 的 Fable,並已在其內部團隊中用於日常工作。

  3. Ars Technica · AI60

    Google公佈 Gemini 4 Argon AI 模型,但尚未開放使用

    Google公佈 Gemini 4 Argon AI 模型,聲稱在編碼、知識工作和網路安全方面具備行業領先效能,但目前尚未開放使用。內部工程師已在公司內部廣泛使用,Argon 通過“fleet‑wide telemetry data”幫助 Google 節省 300 TiB 記憶體,並在 C/C++ 程式碼遷移到 Rust 方面取得進展。

  4. The Verge · AI67

    Google 釋出 Gemini 4,稱其能力強大僅限可信網路防禦者使用

    Google 今日公佈 Gemini 4 Argon,稱其在複雜工作流程中的表現優於 OpenAI 與 Anthropic 的競爭模型。該模型目前僅向“可信網路防禦者”開放,Google 已在內部工作流中使用,幫助完成大規模程式碼庫遷移。公司釋出對比圖表顯示 Gemini 4 在多項基準上領先,並計劃在更廣泛推廣前加強安全防護。

  5. Google DeepMind72

    Gemini 4 Argon 釋出:開啟前沿智慧新時代

    Google DeepMind 推出了 Gemini 4 Argon,這是一款具備長推理、跨領域多模態能力的前沿模型。Argon 在軟體工程、金融、法律和網路安全等行業基準上重新整理記錄,並已在內部工作流中提升效率;其 1M token 輸出上限和 $2/百萬輸入、$10/百萬輸出的價格為開發者提供更高性價比。

    推薦理由:Gemini 4 Argon 通過大幅提升推理長度和多模態能力,顯著提升軟體工程、金融與網路安全等領域的工作效率,並在多項行業基準上重新整理記錄,幫助企業加速技術迭代。

9月30日週三
  1. AWS Machine Learning Blog66

    AWS 推出 Claude Sonnet 5.5

    AWS 宣佈 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform 上可用,具備更高的編碼與知識工作效率及更低的單任務成本。該模型適合處理範圍明確的持續工作負載,支援與 Claude Opus 5.5 搭配使用以兼顧複雜判斷與快速執行,使用者可通過控制台或 API 進行呼叫。

    推薦理由:原文公佈了該模型在特定平臺上的可用性與技術改進,讀者可以據此評估其在自動化任務中的成本與效能表現。

  2. Vercel Blog65

    Ling 3.1 Flash 現已在 AI Gateway 上可用

    Ling 3.1 Flash 是 InclusionAI 推出的混合推理語言模型,現已在 AI Gateway 上免費使用至 2026 年 10 月 13 日。

    推薦理由:Ling 3.1 Flash 提供 262K token 上下文視窗和 560B 引數的混合推理能力,專為編碼與多步分析設計,讀者可評估其在 AI Gateway 上的應用潛力與成本優勢。

  3. AWS Machine Learning Blog66

    GPT-6.1 Sol 現已登陸 Amazon Bedrock

    GPT-6.1 Sol 現已在 Amazon Bedrock 上全面可用,為編碼、計算機使用和專業工作負載帶來更強的推理能力。該模型在 DeepSWE v1.1 上以約五分之一的單任務成本實現了接近 GPT-6 Astra 的表現,並在複雜文件分析和多步驟工作流上超越了 GPT-6 Sol。

    推薦理由:原文公佈了模型在亞馬遜雲科技平臺上的可用性和基準表現,讀者可以據此評估其在自動化工作流中的價效比與落地可行性。

  4. The Decoder68

    OpenAI 釋出 GPT-6.1 Sol 替代旗艦模型 Astra

    OpenAI 釋出了 GPT-6.1 Sol 模型,其效能接近旗艦模型 Astra,但成本僅為其五分之一。API 定價為每百萬輸入 token 2 美元、輸出 10 美元,快取輸入為 0.10 美元。該模型在 agentic coding、電腦操作和辦公任務上接近 Astra,Plus、Pro 等使用者已可在 ChatGPT Work 和 Codex 中使用,API 名稱為 gpt-6.1-sol。

9月29日週二
  1. Hugging Face Blog64

    NVIDIA 釋出開源表格基礎模型 Kumo Tabular

    NVIDIA 釋出開源表格基礎模型 Kumo Tabular,採用 Transformer 架構,無需訓練、調參或特徵工程即可在單次前向傳播中完成分類與迴歸預測。該模型提供 28M 到 215M 三種引數規模,完全基於人工合成數據進行預訓練,並在 TabArena、BeyondArena、TALENT 和 ScoringBench 四個基準測試中排名第一。

    推薦理由:該模型不經微調即可直接預測表格資料,讀者可以據此評估它在企業級結構化資料預測任務中的應用潛力。

  2. OpenAI News86

    OpenAI 釋出 GPT-6.1 Sol

    OpenAI 釋出 GPT-6.1 Sol,具備接近 Astra 的編碼、電腦操作和專業工作智慧,且 API 輸入輸出 token 價格降至 Astra 標準價格的五分之一。

    推薦理由:原文給出了新模型的定位、核心能力與價格降幅,讀者可以據此判斷它會怎樣改變日常開發與專業工作流。

  3. Vercel Blog71

    GPT-6.1 Sol 在 AI Gateway 上可用

    OpenAI 的 GPT-6.1 Sol 現已在 Vercel AI Gateway 上上線。該模型在編碼、電腦使用和專業工作方面相較 GPT-6 Sol 有顯著提升,能夠更好地閱讀複雜文件、執行多步工作流、除錯程式碼、處理業務任務,並從包含表格和圖表的 PDF 中提取答案。

    推薦理由:GPT-6.1 Sol 在 AI Gateway 上提供更精準的編碼與文件處理能力,並以更低成本滿足多步工作流需求。

  4. Simon Willison70

    Claude Sonnet 5.5 釋出

    Anthropic 釋出了 Claude Sonnet 5.5,該模型執行速度提升 30% 以上且成本降低最多 30%,在各項基準測試中表現優於 Sonnet 5 並已應用於 claude.ai 免費層級。它在部分編碼任務中接近 Opus 5.5 的水平,同時 Anthropic 預告 Haiku 5.5 將在未來幾週內推出。

9月28日週一
  1. Hugging Face Blog83

    Hcompany 釋出 Holo4 系列智慧體模型與 Holotron4 Nano

    Hcompany 釋出全新智慧體模型系列 Holo4,包含 27B dense 與 35B-A3B Mixture of Experts 兩個尺寸,並同步推出更新版 Holotron4 Nano。該系列模型支援 GUI、程式碼、MCP 與 API 等多種互動介面,在 OSWorld 2.0 等基準測試中表現優異,相關權重與軌跡資料已在 Hugging Face 開源。

    推薦理由:文章公佈了新模型的大小、介面和基準測試表現,讀者可以據此瞭解其在複雜工作流中的表現。

9月25日週五
9月24日週四
  1. Simon Willison42

    Gemini 3.8 TTS Playground 演示平臺

    Google 釋出了 Gemini 3.8 TTS 的兩個新模型 gemini-3.8-flash-tts 與 gemini-3.8-flash-lite-tts,支援 2,000+ 語音並可通過 30 秒樣本建立自定義聲音。Gemini 3.8 TTS Playground 允許使用者在瀏覽器中構建單聲道或多說話人對話,生成 1m18s 音訊僅需約 20 秒,成本 2.74 美分。

9月23日週三
  1. Latent Space95

    Anthropic 釋出 Claude Opus 5.5 與 OpenAI 推出 GPT-6 Sol 和 Luna 模型

    Anthropic 釋出了 Claude Opus 5.5,主打 Fable 5.1 級能力與更低執行成本,隨後 OpenAI 推出了降價幅度和價效比更高的 GPT-6 Sol 與 Luna 模型。兩家實驗室均在效率最佳化與定價上展開競爭,同時社群也圍繞基準評測和多Agent擴充套件展開了廣泛討論。

    推薦理由:文章梳理了兩家頭部廠商最新旗艦及平價模型的效能與定價策略,讀者可據此對比當前前沿模型的綜合性價比。

  2. Simon Willison86

    Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna 與新一輪價格戰

    Anthropic 釋出了 Claude Opus 5.5,其輸入輸出價格較前代降低 20%,快取讀取價格降低 60%,並在高思考級別下遇到了超出最大輸出 token 限制的問題;隨後 OpenAI 釋出了 GPT-6 Sol 與 GPT-6 Luna,價格降至同級前代型號的一半。兩家廠商通過密集釋出新模型和大幅降價,進一步加劇了 AI 模型的市場價格戰。

    推薦理由:文章記錄了多款旗艦模型密集釋出與降價的情況,讀者可以據此瞭解當前各大廠商在推理模型定價與效能上的最新競爭格局。

9月22日週二