V7 結合 GPT-5.6 Luna 在降低 78% 成本的同時提升準確率
V7 結合 GPT-5.6 將分散的公司檔案轉化為智慧體可用的上下文,在降低 78% 成本的同時提升了準確率,並支援完成複雜的、帶來源連結的工作。
V7 結合 GPT-5.6 將分散的公司檔案轉化為智慧體可用的上下文,在降低 78% 成本的同時提升了準確率,並支援完成複雜的、帶來源連結的工作。
OpenAI推出澳大利亞青少年安全藍圖,提出六大支柱路線圖以保障和賦能青少年安全使用AI。該藍圖聚焦AI體驗的安全性,旨在為年輕人提供更可靠的技術環境。
Vercel Sandbox 允許在隔離的 Firecracker 微VM 中執行 Harbor 評估,並可透過 AI Gateway 呼叫多個模型,提升測試效率與安全性。
Cooley 通過 GO Public 與 ChatGPT Work 將智慧引入 IPO 流程,幫助律師提前發現問題並專注關鍵判斷。
Open-weight 模型 在 AI Gateway 8 月份佔據 56% 的代幣量,首次超過所有封閉模型。 - 代幣成本:平均每代幣價格較 5 個月前下降 23.2%,中位團隊每代幣支付 7.6% 更低。
推薦理由:Open-weight models已佔據主導,價格下降顯著,Astra快速滲透顯示新模型在企業生產中的高效性。
OpenAI for Law 帶來面向法律的前沿智慧,支援定製律所工作流、連線法律資料來源,並提供法律級保密控制。該平臺幫助律所提升效率並保障客戶機密。
GPT-Live 1 現已於 Vercel 的 AI Gateway 上可用,支援全雙工語音對話。 - 全雙工功能:同時聽取與說話,消除傳統語音模型的切換延遲。
推薦理由:GPT-Live 1 的全雙工語音功能與客戶端委派可提升對話流暢度與多模型協作。
OpenAI 釋出了一套用於追蹤、調查和披露模型對齊異常的新框架,旨在提高行業透明度並推動對齊研究的公開討論,同時首批公開了六項在訓練或評估期間觀察到的模型異常行為報告。
推薦理由:該框架明確了模型對齊異常的披露標準與流程,有助於外部研究人員檢驗並推動行業透明度。
OpenAI 與 AARP 合作在全美 10 個城市為 1,000 名老年人提供免費的 ChatGPT 動手工作坊。該專案旨在幫助老年人群體在日常生活中安全地建立實用的 AI 技能。
OpenAI 推出基於 AI 的全新廣告體驗,包括 Sponsored Agents、營銷人員工具以及與 HubSpot 和 Shopify 的整合。
推薦理由:官方推出的廣告體驗更新直接關聯營銷工具與電商整合,讀者可以據此瞭解 AI 如何進入廣告與商業工作流。
Hex 藉助 GPT‑6 Astra 幫助其資料智慧體將複雜分析結果轉化為可分享的互動式視覺化報告。該功能使企業員工能夠輕鬆將資料答案轉變為直觀的視覺化內容。
ChatGPT Team 和 Codex 分析功能可幫助團隊瞭解 AI 的使用情況與開支,識別培訓需求,並將工具的普及與業務成果聯絡起來。
OpenAI 分析 2026 年 4 月至 7 月超 150 萬條 ChatGPT 工作相關訊息發現,跨職業的 AI 使用正逐漸演變為常規工作流的一部分。在持續觀察的約 6,200 名員工中,跨職業任務佔比從 4 月的 13.1% 上升至 7 月的 25.9%,其中與客戶討論商品或服務等任務的次月複用率達到 54%。
NVIDIA 在 AI Infra Summit 上釋出了 Vera Rubin 架構與 DSX 平臺,其中 Vera Rubin NVL72 系統在 MLPerf Inference v6.1 預覽測試中展現出顯著的吞吐量優勢。多項生態合作與基準測試顯示,新平臺通過電源最佳化和軟體協同,大幅提升了每瓦 tokens 產出與 agentic ワークロード的執行效率。
推薦理由:原文公佈了 Vera Rubin 架構在多個基準測試中的效能表現,讀者可以據此評估新一代 AI 基礎設施在能效和吞吐量上的提升幅度。
Fyxer 利用 OpenAI 模型、微調、記憶功能和真實使用者反饋來整理收件箱,並以每個使用者的獨特語氣撰寫電子郵件。該系統通過深度定製與使用者習慣對齊,從而構建出人們信賴的 AI 智慧助理。
Perplexity 藉助 GPT-6 Astra 來編寫通訊內容、修改軟體以及監控生產系統,且檢查頻率比早期模型顯著降低。
GPT‑6 Astra 提升 Devin 的軟體測試能力,幫助工程師減少程式碼審查量並加速交付。Cognition 通過 GPT‑6 Astra 讓 Devin 能夠自動測試其自身工作並驗證其正確性。
推薦理由:GPT‑6 Astra 提升 Devin 的軟體測試能力,幫助工程師減少程式碼審查量並加速交付。
OpenAI 將 Habitat 從 Python 庫演進為全球分散式儲存平臺,支援 10 億 ChatGPT 使用者和 22M 請求/秒。
César de la Fuente 的實驗室利用 Codex 與 ChatGPT 在活體與滅絕基因組中搜索抗菌候選分子,以對抗耐藥感染。
OpenAI 在 ChatGPT Work 中推出 Data agent,支援連線公司資料、用自然語言查詢並生成互動式儀表盤。該功能讓使用者無需編寫程式碼即可獲取洞察,提升資料視覺化效率。
推薦理由:官方釋出的 Data agent 讓企業能用自然語言直接查詢資料並生成互動式儀表盤,降低資料分析門檻,提升決策效率,並支援多維度資料視覺化。
OpenAI 推出 ChatGPT for Financial Services,結合內建金融資料與 GPT-6 Astra 模型,用於研究、建模和客戶交付材料的準備。
推薦理由:原文給出了 ChatGPT for Financial Services 的內建資料與模型配置,讀者可以據此判斷它會怎樣改變金融領域的日常工作流。
OpenAI 宣佈與 GSA 合作,為符合條件的聯邦、州、地方和部族政府提供零許可費、使用費五折優惠以及擴大的網路安全支援。
推薦理由:原文公佈了面向美國各級政府的費用減免和網路安全支援方案,讀者可以據此瞭解 AI 服務在公共部門的落地政策。
OpenAI 推出了 Agents API 託管服務,支援基於 Codex 框架進行任務編排、長會話和工具呼叫,幫助開發者構建和部署雲端智慧體。
推薦理由:官方推出的託管服務直接面向雲端智慧體開發需求,開發者可藉此獲得編排與長會話支援。
OpenAI 在 API 中推出 GPT-Live-1,支援同時聆聽與說話的全雙工語音互動,並可將深度推理與工具呼叫委託給後端模型。該模型在 API 中的定價為每分鐘 0.05 美元,具備平滑的中斷處理、語氣與風格控制以及電話網路支援等特性。
summary_zh: 現在可以在 Vercel 上使用 OpenAI Agents API 建置並部署長時間執行、使用工具的代理程式。 - 代理迴圈與會話狀態:由 OpenAI 管理,確保代理持續運作。
Hugging Face 官方介紹瞭如何使用 TRL v1.14 中的 AsyncGRPOTrainer 在不同機器上非同步訓練 LoRA 介面卡並同步至 vLLM。通過將兆位元組大小的 rank-1 介面卡寫入儲存桶並藉助代理路由 KV 快取字首,該方案省去了 NCCL 跨節點通訊,使 500 步訓練耗時縮短至原來的四分之一。
推薦理由:文章展示瞭如何在不同機器上執行訓練與推理,通過儲存桶同步 LoRA 介面卡,為分散式強化學習提供了可複用的工程方案。
Paul Christiano 正式加入 OpenAI 基金會董事會及其安全和安全委員會,為機構帶來了在 AI 對齊、安全以及標準制定方面的豐富經驗。
Chris Lehane 認為,隨著 AI 能力不斷增強,在政策視窗期仍然開放之際,我們需要提供更強的安全證據、建立共享標準並採取持久的政策行動。
OpenAI 推出 GPT-6 Astra,作為其迄今為止最具智慧與對齊能力的模型,現已在 ChatGPT Work、Codex 及 API 中可用。該模型在計算機使用、瀏覽、軟體工程及網路安全等專業任務上表現領先,API 定價為每百萬輸入 token 10 美元、每百萬輸出 token 50 美元。
推薦理由:原文公佈了新模型的各項能力基準、定價及企業級安全控制,讀者可以據此評估其在複雜工作流中的成本效益。
一位 MIT 研究員使用 GPT-5.6 Sol 配合 Codex 自主執行量子計算實驗、分析結果並對量子位元進行校準。該方案展示了先進模型在科學研究領域的實際應用方式。
OpenAI AI 通過更強大、更實惠的技術,幫助個人和企業擴大可完成的工作量,並提升增長效率。該技術旨在降低成本並提高生產力。
ChatGPT Images 2.5 讓使用者將想法、草圖和參考照片轉化為更個性化、精細的影像。該功能支援多種風格和細節調整,顯著提升創作效率和視覺表達質量,並可直接嵌入聊天介面進行即時反饋,幫助設計師快速迭代並獲得更精準的視覺效果。
推薦理由:ChatGPT Images 2.5 讓使用者能把草圖和參考照片轉化為更個性化、精細的影像,支援多種風格和細節調整,顯著提升創作效率和視覺表達質量,並可直接嵌入聊天介面進行即時反饋,幫助設計師快速迭代並獲得更精準的視覺效果。
OpenAI 分享了一個 AI 生成的 Navier–Stokes 世紀獎問題的解決方案,包含書面說明和 Lean 形式化證明。
推薦理由:OpenAI 通過 AI 生成的證明展示了在數學領域應用 LLM 的潛力,讀者可瞭解 AI 在嚴謹推理中的可行性。
OpenAI 推出了總額 500 萬美元的資助計劃,支援關於生成式 AI 如何影響青少年發展、健康與安全的獨立研究。該計劃現已開放申請。
1Password 的工程師使用 Codex 快速構建新功能和內部工具,在保持嚴格安全策略的同時達到了生產就緒狀態,使工程生產力提升了 21%。
OpenAI 聯合 AIRPPU 與 WAN-IFRA 推出了一個 AI 專案,旨在幫助烏克蘭新聞機構增強創新能力、韌性以及獨立新聞業的發展。
OpenAI 的 Jakub Pachocki 探討了日益強大的 AI 展現出的“異質思維”特性,並指出保持其安全對齊所面臨的嚴峻挑戰。他呼籲行業建立更強的安全防護措施,以應對不斷升級的技術風險。
OpenAI 內部的 coding agents 正在重塑 AI 研究。文章探討了有關 agent 使用率、實驗速度、任務複雜度和研究加速的早期資料。
本文介紹了使用 TRL 庫和 GRPO 對 LFM2.5-350M 模型進行輕量化微調的開源教程,展示了僅需約 500 個樣本和 100 個訓練步驟即可將模型在 IFStruct 基準測試中的整體表現從 22.6% 提升至 29.7% 的具體方法。
推薦理由:文章提供了在免費 GPU 環境下用 GRPO 最佳化小模型結構化輸出的完整開源配方,讀者可以藉此評估低成本對齊對模型輸出合規性的實際提升效果。
Sentence Transformers v6.0 版本引入了多向量檢索模型和完整的訓練方法。作者以醫療檢索領域為例,展示瞭如何在一塊消費級 GPU 上微調出一個超越各大通用檢索模型的領域專用模型。微調方法涵蓋了模型選擇、資料集格式、損失函式、訓練引數以及評估器等核心元件。
推薦理由:文章給出了多向量嵌入模型的完整訓練與微調步驟,讀者可以據此在特定領域獲得超越通用檢索模型的效果。