GPT-6 Sol 和 Luna — 更快、更實惠的模型,具備支撐 Astra 在專業工作、事實性、編碼、電腦使用與對齊方面 SOTA 表現的進步:93 1.8K 131K
#OpenAI
RSS 訂閱#OpenAI
RSSGreg Brockman (@gdb)@gdbAI 評分4646 Sam Altman (@sama)@samaAI 評分2323 The DecoderAI 評分6969 Google Gemini 4 Argon 與 OpenAI、Anthropic 差距縮小 但未領跑
Google 釋出 Gemini 4 Argon,首個七個月來的前沿模型,在多項基準上與 OpenAI 的 GPT-6 Astra 同級,且價格更低。Argon 支援文本、影像、影片、音訊輸入,輸出文本,並通過 Long Decode Continuation 解決長響應超時。
AWS Machine Learning Blog精選AI 評分6666 AWS 推出 Claude Sonnet 5.5
AWS 宣佈 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform 上可用,具備更高的編碼與知識工作效率及更低的單任務成本。該模型適合處理範圍明確的持續工作負載,支援與 Claude Opus 5.5 搭配使用以兼顧複雜判斷與快速執行,使用者可通過控制台或 API 進行呼叫。
推薦理由:原文公佈了該模型在特定平臺上的可用性與技術改進,讀者可以據此評估其在自動化任務中的成本與效能表現。
The DecoderAI 評分6666 Anthropic 稱智譜開源 GLM-5.3 漏洞利用能力接近 Claude Mythos Preview
Anthropic 評估顯示智譜的開源模型 GLM-5.3 在漏洞利用和網路攻擊能力上幾乎趕上了 Claude Mythos Preview。測試表明,GLM-5.3 在 ExploitBench 和內部二進位制測試中表現接近,且由於其開源權重,安全防護極易通過技術手段被剝離。美國機構 CAISI 的獨立評估也指出 GLM-5.3 是迄今為止網路能力最強的開源模型。
TechCrunch · AI精選AI 評分8383 OpenAI 推出 GPT-6.1 Sol,幾乎匹配 GPT-6 Astra,成本更低
OpenAI 在 DevDay 事件中釋出 GPT-6.1 Sol,聲稱其在代理式編碼、計算機使用和專業工作中的智慧水平幾乎與 GPT-6 Astra 相當,但標準輸入輸出 token 價格僅為其五分之一。
推薦理由:GPT-6.1 Sol 以五分之一的成本接近 GPT-6 Astra 的效能,為開發者提供更經濟的高效代理模型。
AWS Machine Learning Blog精選AI 評分6666 GPT-6.1 Sol 現已登陸 Amazon Bedrock
GPT-6.1 Sol 現已在 Amazon Bedrock 上全面可用,為編碼、計算機使用和專業工作負載帶來更強的推理能力。該模型在 DeepSWE v1.1 上以約五分之一的單任務成本實現了接近 GPT-6 Astra 的表現,並在複雜文件分析和多步驟工作流上超越了 GPT-6 Sol。
推薦理由:原文公佈了模型在亞馬遜雲科技平臺上的可用性和基準表現,讀者可以據此評估其在自動化工作流中的價效比與落地可行性。
Simon WillisonAI 評分1414 GPT 6.1 Sol: 價格降至五分之一的接近 Astra 級智慧
GPT 6.1 Sol 實現了接近 Astra 級別的智慧,而價格降至五分之一。這是 Simon Willison 在 2026 年 9 月 29 日釋出的月度簡報中披露的相關 LLM 進展。
The DecoderAI 評分6868 OpenAI 釋出 GPT-6.1 Sol 替代旗艦模型 Astra
OpenAI 釋出了 GPT-6.1 Sol 模型,其效能接近旗艦模型 Astra,但成本僅為其五分之一。API 定價為每百萬輸入 token 2 美元、輸出 10 美元,快取輸入為 0.10 美元。該模型在 agentic coding、電腦操作和辦公任務上接近 Astra,Plus、Pro 等使用者已可在 ChatGPT Work 和 Codex 中使用,API 名稱為 gpt-6.1-sol。
OpenAI News精選AI 評分8686 OpenAI 釋出 GPT-6.1 Sol
OpenAI 釋出 GPT-6.1 Sol,具備接近 Astra 的編碼、電腦操作和專業工作智慧,且 API 輸入輸出 token 價格降至 Astra 標準價格的五分之一。
推薦理由:原文給出了新模型的定位、核心能力與價格降幅,讀者可以據此判斷它會怎樣改變日常開發與專業工作流。
Latent SpaceAI 評分7474 Latent Space 彙總:Claude Opus 5.5 與多款前沿模型動態
Latent Space 釋出的 AINews 彙總了多款前沿模型動態,其中 Claude Opus 5.5 在 SimpleBench 領先,並在視覺和程式碼生成任務上表現突出;同時涵蓋 GPT-6 家族、Gemini 3.8 Flash、Xiaomi MiMo-V2.6-Pro 以及智慧體、檢索和推理效率等生態進展。
Vercel Blog精選AI 評分7171 GPT-6.1 Sol 在 AI Gateway 上可用
OpenAI 的 GPT-6.1 Sol 現已在 Vercel AI Gateway 上上線。該模型在編碼、電腦使用和專業工作方面相較 GPT-6 Sol 有顯著提升,能夠更好地閱讀複雜文件、執行多步工作流、除錯程式碼、處理業務任務,並從包含表格和圖表的 PDF 中提取答案。
推薦理由:GPT-6.1 Sol 在 AI Gateway 上提供更精準的編碼與文件處理能力,並以更低成本滿足多步工作流需求。
Simon WillisonAI 評分7070 Claude Sonnet 5.5 釋出
Anthropic 釋出了 Claude Sonnet 5.5,該模型執行速度提升 30% 以上且成本降低最多 30%,在各項基準測試中表現優於 Sonnet 5 並已應用於 claude.ai 免費層級。它在部分編碼任務中接近 Opus 5.5 的水平,同時 Anthropic 預告 Haiku 5.5 將在未來幾週內推出。
OpenAI NewsAI 評分1919 Basis 用 GPT-6 Astra 以 2 倍速度完成稅務工作簿
GPT-6 Astra 完成 50 個標籤頁的稅務工作簿的速度達到了 GPT-5.6 Sol 的 2 倍。其對使用者意圖更強的理解能力,讓 Basis 在實際應用中擁有了更高的信心。
Latent SpaceAI 評分6666 Latent Space 播客:前沿模型 wave、系統級決策模型與智慧體基礎設施進展
Latent Space 盤點了一週內 AI 行業的重大進展,涵蓋 Claude Opus 5.5、GPT-6 系列及 Gemini 3.8 Flash 等前沿模型的基準評測表現。同時梳理了決策模型、智慧體基礎設施、推理加速硬體以及生物基因領域的最新動態。
Latent SpaceAI 評分6666 Runway 的 WorldPrompt 與即時世界的工程實現
Runway 介紹了其最新的世界模型 GWM Worlds 2 以及提出的輸入格式 WorldPrompt,並闡述了其如何通過自迴歸擴散和蒸餾方法實現 720p 24fps 的即時互動式影片和音訊生成。文章還探討了真實物理模擬、長上下文、誤差累積等工程挑戰,以及在遊戲、機器人和智慧體模擬等領域的潛在應用。
Latent Space精選AI 評分9595 Anthropic 釋出 Claude Opus 5.5 與 OpenAI 推出 GPT-6 Sol 和 Luna 模型
Anthropic 釋出了 Claude Opus 5.5,主打 Fable 5.1 級能力與更低執行成本,隨後 OpenAI 推出了降價幅度和價效比更高的 GPT-6 Sol 與 Luna 模型。兩家實驗室均在效率最佳化與定價上展開競爭,同時社群也圍繞基準評測和多Agent擴充套件展開了廣泛討論。
推薦理由:文章梳理了兩家頭部廠商最新旗艦及平價模型的效能與定價策略,讀者可據此對比當前前沿模型的綜合性價比。
Simon Willison精選AI 評分8686 Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna 與新一輪價格戰
Anthropic 釋出了 Claude Opus 5.5,其輸入輸出價格較前代降低 20%,快取讀取價格降低 60%,並在高思考級別下遇到了超出最大輸出 token 限制的問題;隨後 OpenAI 釋出了 GPT-6 Sol 與 GPT-6 Luna,價格降至同級前代型號的一半。兩家廠商通過密集釋出新模型和大幅降價,進一步加劇了 AI 模型的市場價格戰。
推薦理由:文章記錄了多款旗艦模型密集釋出與降價的情況,讀者可以據此瞭解當前各大廠商在推理模型定價與效能上的最新競爭格局。
OpenAI News精選AI 評分6161 OpenAI 釋出 GPT-6 Sol 與 Luna 模型
OpenAI 釋出了 GPT-6 Sol 與 Luna 兩個新模型,為日常工作提供了不同能力與成本平衡的選擇。
推薦理由:官方推出了兩個新模型,為日常工作提供了不同能力與成本的平衡選擇。
Vercel Blog精選AI 評分6767 GPT‑6 Sol 與 Luna 在 AI Gateway 上線
OpenAI 的 GPT‑6 Sol 與 GPT‑6 Luna 現已在 AI Gateway 上線,價格低於 GPT‑6 Astra。Sol 適用於複雜編碼與持續性探究的 agent 工作流,Luna 則是低成本的高頻重複工作選項。兩者相較 GPT‑5.6 在事實可靠性、直白溝通和減少誤導性編碼宣告方面都有提升。使用時只需傳入模型 ID,即可在模型演練區體驗。
推薦理由:GPT‑6 Sol 與 Luna 在 AI Gateway 上線,價格更低且在程式碼與專業工作中提升事實可靠性,讀者可評估其高頻工作流價值。
Latent SpaceAI 評分6565 AINews 行業動態:Jev 決策模型、Periodic Labs 材料科學模型及 Gemini 3.8 Live 釋出
最新一期 AINews 彙總了多項行業動態,包括 TypeSafe 推出專注於分類和路由的非自迴歸決策模型 Jev,Periodic Labs 釋出用於材料科學的實驗資料模型 Neon,以及 Google 推出支援多語言和非同步工具呼叫的 Gemini 3.8 Live。
OpenAI News精選AI 評分8686 OpenAI 釋出 GPT-6 Astra 模型
OpenAI 推出 GPT-6 Astra,作為其迄今為止最具智慧與對齊能力的模型,現已在 ChatGPT Work、Codex 及 API 中可用。該模型在計算機使用、瀏覽、軟體工程及網路安全等專業任務上表現領先,API 定價為每百萬輸入 token 10 美元、每百萬輸出 token 50 美元。
推薦理由:原文公佈了新模型的各項能力基準、定價及企業級安全控制,讀者可以據此評估其在複雜工作流中的成本效益。
OpenAI NewsAI 評分2727 GPT-5.6 Sol 如何輔助執行量子計算實驗
一位 MIT 研究員使用 GPT-5.6 Sol 配合 Codex 自主執行量子計算實驗、分析結果並對量子位元進行校準。該方案展示了先進模型在科學研究領域的實際應用方式。
Mistral AI精選AI 評分6161 Mistral AI 釋出首個程式碼專用嵌入模型 Codestral Embed
Mistral AI 釋出首個專為程式碼最佳化的嵌入模型 Codestral Embed,在真實程式碼資料的檢索任務中表現優於多個市場同類模型。該模型支援多維度與多種精度輸出,可在檢索質量與儲存成本之間進行靈活權衡。Codestral Embed 已在 API 上線,定價為每百萬 token 0.15 美元,同時提供批次 API 折扣及本地部署支援。
推薦理由:原文公佈了專門針對程式碼檢索最佳化的嵌入模型及其定價和介面資訊,開發者可據此評估其在程式碼庫檢索和智慧體工作流中的效能與成本。