跳到正文

#OpenAI

RSS
今日 2 則
今天10月1日週四
9月30日週三
  1. cloudflare blog64

    AI Gateway Auto Router 釋出,幫助企業降低 AI 成本

    Cloudflare 在 AI Gateway 中推出 Auto Router,自動為每個請求選擇合適的模型,幫助企業在保持效能的同時將 AI 費用降低 30%。

    推薦理由:Auto Router 能在不犧牲效能的前提下,將 AI 費用降低 30%,為企業內部 AI 部署提供自動化成本控制,並支援多模型動態路由。

  2. cloudflare blog64

    使用 User Insights 識別 AI 模型過度使用

    雲flare 在 AI Gateway 平臺推出 User Insights 更新,新增任務、模型、成本等維度的分析,幫助團隊識別模型過度使用並支援自動路由。該功能通過分類引擎將對話歸類為編碼、研究、寫作、摘要等任務,並提供模型適配、成本、延遲、對話輪數等指標,供團隊評估是否需要更換模型或調整工作流。

    推薦理由:雲flare AI Gateway 的 User Insights 通過任務、模型、成本等維度幫助團隊識別模型過度使用,支援自動路由和成本最佳化,為企業在大規模 AI 部署中實現更精準的資源分配和費用控制提供了實用工具,並可快速整合至現有監控體系。

  3. cloudflare blog75

    網際網路擁有第二個受眾

    Cloudflare 說明網際網路正出現第二個受眾——AI 代理,導致超過一半流量來自軟體而非人類。為此,Cloudflare 推出了 AI Crawl Control、BotBase、Web Bot Auth 等工具,並在 2026 年推出 Monetization Gateway,讓站點能識別、計費並從 AI 代理中獲得收入。

    推薦理由:Cloudflare推出面向 AI 代理的流量控制與計費方案,幫助站點在 AI 時代實現收入恢復,並提供視覺化監控與統一計費介面。

  4. AWS Machine Learning Blog66

    AWS 推出 Claude Sonnet 5.5

    AWS 宣佈 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform 上可用,具備更高的編碼與知識工作效率及更低的單任務成本。該模型適合處理範圍明確的持續工作負載,支援與 Claude Opus 5.5 搭配使用以兼顧複雜判斷與快速執行,使用者可通過控制台或 API 進行呼叫。

    推薦理由:原文公佈了該模型在特定平臺上的可用性與技術改進,讀者可以據此評估其在自動化任務中的成本與效能表現。

  5. AWS Machine Learning Blog66

    GPT-6.1 Sol 現已登陸 Amazon Bedrock

    GPT-6.1 Sol 現已在 Amazon Bedrock 上全面可用,為編碼、計算機使用和專業工作負載帶來更強的推理能力。該模型在 DeepSWE v1.1 上以約五分之一的單任務成本實現了接近 GPT-6 Astra 的表現,並在複雜文件分析和多步驟工作流上超越了 GPT-6 Sol。

    推薦理由:原文公佈了模型在亞馬遜雲科技平臺上的可用性和基準表現,讀者可以據此評估其在自動化工作流中的價效比與落地可行性。

9月29日週二
  1. OpenAI News66

    OpenAI DevDay 2026 回顧

    OpenAI 公佈了 DevDay 2026 的 20 多項更新,涵蓋 GPT-6 Astra、ChatGPT、Codex、API、安全及面向開發者的全新工具。

    推薦理由:原文彙總了 DevDay 2026 的多項更新,讀者可以據此瞭解 OpenAI 在模型和工具生態上的最新進展。

  2. OpenAI News86

    OpenAI 釋出 GPT-6.1 Sol

    OpenAI 釋出 GPT-6.1 Sol,具備接近 Astra 的編碼、電腦操作和專業工作智慧,且 API 輸入輸出 token 價格降至 Astra 標準價格的五分之一。

    推薦理由:原文給出了新模型的定位、核心能力與價格降幅,讀者可以據此判斷它會怎樣改變日常開發與專業工作流。

  3. Vercel Blog71

    GPT-6.1 Sol 在 AI Gateway 上可用

    OpenAI 的 GPT-6.1 Sol 現已在 Vercel AI Gateway 上上線。該模型在編碼、電腦使用和專業工作方面相較 GPT-6 Sol 有顯著提升,能夠更好地閱讀複雜文件、執行多步工作流、除錯程式碼、處理業務任務,並從包含表格和圖表的 PDF 中提取答案。

    推薦理由:GPT-6.1 Sol 在 AI Gateway 上提供更精準的編碼與文件處理能力,並以更低成本滿足多步工作流需求。

  4. AWS Machine Learning Blog62

    Grok 4.7 現已登陸 Amazon Bedrock

    xAI 的 Grok 4.7 現已在 Amazon Bedrock 上線,支援 500K 上下文視窗、四級推理努力程度配置及圖文輸入。該模型可通過 Responses、Chat Completions 和 Converse API 進行呼叫,並提供 US 區域和 Global 跨區域推理配置選項。

    推薦理由:原文介紹了 xAI Grok 4.7 在 Amazon Bedrock 上的可用性與整合細節,讀者可以據此瞭解該模型在 Bedrock 上的呼叫方式與配置選項。

9月28日週一
  1. cloudflare blog81

    Cloudflare 釋出面向智慧體的新命令列工具 cf

    Cloudflare 推出了全新的命令列工具 cf,旨在讓智慧體能夠訪問整個 Cloudflare 平臺中超過 3,000 種操作。該工具預設輸出 JSON 格式以節省上下文,內建自然語言搜尋功能,並採用基於 TypeScript 的全新配置格式和 Vite 開發服務。

    推薦理由:該產品直接將整個平臺的 API 能力適配給智慧體,讀者可以通過專屬配置和命令簡化相關工作流。

  2. OpenAI News13

    你是 Codex Original 嗎?

    OpenAI 正在為 Codex Originals 專案收集開發者、研究人員和創作者使用 Codex 構建專案的真實故事。符合條件的使用者可以提交自己的專案與故事,參與該專案的下一階段。

9月26日週六
9月24日週四
9月23日週三
  1. OpenAI News60

    OpenAI 執行長 Sam Altman 在聯合國安理會的發言

    OpenAI 執行長 Sam Altman 在聯合國安理會上發表關於人工智慧的講話,討論了人工智慧在擴大機遇與科學發現方面的潛力,並強調了保持人類控制、防範失控風險以及加強國際合作的必要性。

    推薦理由:原文完整記錄了 OpenAI 負責人向聯合國安全理事會發表的關於人工智慧安全與治理的發言,讀者可以據此瞭解官方對技術風險與國際合作的立場。

  2. OpenAI News70

    推出 MentalHealthBench 心理健康評測基準

    OpenAI推出MentalHealthBench,一個多語言、多情境的心理健康對話評測基準。該基準由80多名全球心理健康專家共同制定,覆蓋從日常對話到危機情境的多種場景,並提供專家評估標準和自動化評分工具。

    推薦理由:OpenAI釋出MentalHealthBench,提供多語言、多情境的心理健康評測基準,幫助研究者評估模型安全性與實用性。

  3. OpenAI News60

    OpenAI 釋出 GPT-6 的提示詞快取最佳化功能

    OpenAI 釋出了 GPT-6 的提示詞快取改進功能,通過更高的快取命中率、新診斷工具、顯式斷點和控制選項來降低延遲與成本。

    推薦理由:官方更新了提示詞快取機制,讀者可以根據具體的命中率最佳化和診斷手段來評估開發成本。

9月22日週二
  1. Vercel Blog67

    GPT‑6 Sol 與 Luna 在 AI Gateway 上線

    OpenAI 的 GPT‑6 Sol 與 GPT‑6 Luna 現已在 AI Gateway 上線,價格低於 GPT‑6 Astra。Sol 適用於複雜編碼與持續性探究的 agent 工作流,Luna 則是低成本的高頻重複工作選項。兩者相較 GPT‑5.6 在事實可靠性、直白溝通和減少誤導性編碼宣告方面都有提升。使用時只需傳入模型 ID,即可在模型演練區體驗。

    推薦理由:GPT‑6 Sol 與 Luna 在 AI Gateway 上線,價格更低且在程式碼與專業工作中提升事實可靠性,讀者可評估其高頻工作流價值。

  2. Hugging Face Blog59

    英國 AI 安全研究所與 EvalEval 如何讓評測結果可復現

    英國 AI 安全研究所正使用 EvalEval 的 Evaluation Cards 基礎設施公開分享評估結果,以支援更具可復現性和可驗證性的評估科學。此次釋出包含了五項基準測試和兩項安全評測的驗證結果、上下文及配置資訊,涵蓋了 Claude Opus 系列與 GPT-5 系列等六款前沿模型,並配合其關於推理計算如何塑造前沿 LLM 評測的研究論文一同釋出。

9月21日週一