TypeSafe AI 的 Jev 現已上線 AI Gateway
Jev 是 TypeSafe AI 的一個機率決策模型,現在已可在 Vercel 的 AI Gateway 上使用。 - 速度與成本:在工作流程評估中,Jev 的執行速度比 LLM 高 193.6 倍,成本低 444.6 倍。
Jev 是 TypeSafe AI 的一個機率決策模型,現在已可在 Vercel 的 AI Gateway 上使用。 - 速度與成本:在工作流程評估中,Jev 的執行速度比 LLM 高 193.6 倍,成本低 444.6 倍。
summary_zh: Is Agentic 讓使用者可依網站型別檢視審核結果,提供四種檢視:Docs & content、Business、App 與 Commerce。
Salesforce 推出了首個 CRM 推理模型 Koa,該模型基於 NVIDIA Nemotron 3 Super 構建並使用 NVIDIA NeMo 工具鏈進行訓練。
Google Research 推出了 Retrieve-for-Train 框架,通過離線強化學習將複雜的查詢分解與檢索最佳化編譯至輕量級擴散檢索器中,從而消除了推理時的 CoT 推理 token 開銷。
Google DeepMind 推出 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款先進的即時對話模型,帶來並行推理與近即時語音互動升級。
推薦理由:Google DeepMind 推出了 Gemini 3.8 Live 與 3.8 Live Extended Thinking,通過並行推理與近即時語音互動能力在多項語音基準測試中表現突出,讀者可藉此評估其在複雜語音智慧體開發和企業級工作流中的應用潛力。
NVIDIA 推出旨在最佳化 AI 工廠每兆瓦 token 吞吐量的技術套件 NVIDIA DSX,涵蓋動態功耗分配、網格協同排程及生命週期管理等功能。Lambda 的實測結果顯示,在固定電源預算下利用 NVIDIA DSX MaxLPS 執行叢集可提升 24% 的 token 吞吐量。該平臺通過智慧化排程與即時監控,有效釋放了傳統靜態配置下的閒置算力。
NVIDIA 在 AI Infra Summit 上釋出了 Vera Rubin 架構與 DSX 平臺,其中 Vera Rubin NVL72 系統在 MLPerf Inference v6.1 預覽測試中展現出顯著的吞吐量優勢。多項生態合作與基準測試顯示,新平臺通過電源最佳化和軟體協同,大幅提升了每瓦 tokens 產出與 agentic ワークロード的執行效率。
推薦理由:原文公佈了 Vera Rubin 架構在多個基準測試中的效能表現,讀者可以據此評估新一代 AI 基礎設施在能效和吞吐量上的提升幅度。
IBM Research 團隊指出當前基準測試中的平均準確率掩蓋了智慧體的可靠性問題,並推出了用於測量和改善該問題的 Consistency Analyzer 與一致性指南。實驗表明,該方法在 AppWorld 測試中將一致性差距從 24.4 個百分點縮小至 12.0 個百分點,且未降低平均準確率。相關開原始碼與技術報告已釋出。
推薦理由:文章提出了一種測量和緩解智慧體執行不一致性的方法,對評估和提升智慧體在生產環境中的可靠性有參考價值。
費城兒童醫院利用基於 MONAI 等開源 NVIDIA AI 工具的心臟建模服務,在幾秒鐘內將 CT 掃描和 MRI 等影像轉化為精確的心臟模型,使原本需要四小時的手術準備時間縮短至可用於臨床。目前全美有超過 20 家兒童醫院執行此類心臟建模程式,其中波士頓兒童醫院每年支援約 500 例手術。
summary_zh: Delphi 在 Vercel 上以 Python 後端每天釋出 100+ 次,透過 Vercel Workflows 與 Queues 讓部署流程簡化,並支援即時 A/B 測試與異常偵測。
Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking 現已可於 AI Gateway 使用,支援即時語音互動與多模態功能。
推薦理由:Gemini 3.8 Live 及其擴充套件思考功能可即時語音互動,開發者可透過 AI Gateway 直接使用 WebSocket 進行即時對話,提升語音助手與多模態應用的互動體驗。
AI SDK harness 現在支援原生訂閱驗證,讓開發者可在不改寫程式碼的情況下切換不同 AI 代理。 - 認證模式:直接模式使用明確的提供者環境憑證,或在缺少時使用主機上的原生訂閱;自動模式在未設定 AI Gateway 憑證時亦同樣行為;ai-gateway 模式不讀取原生訂閱。
Fyxer 利用 OpenAI 模型、微調、記憶功能和真實使用者反饋來整理收件箱,並以每個使用者的獨特語氣撰寫電子郵件。該系統通過深度定製與使用者習慣對齊,從而構建出人們信賴的 AI 智慧助理。
Perplexity 藉助 GPT-6 Astra 來編寫通訊內容、修改軟體以及監控生產系統,且檢查頻率比早期模型顯著降低。
GitHub 營銷負責人分享瞭如何利用 GitHub Copilot、GitHub Actions 及 API/CLI 工具將亞太區的活動運營流程實現程式碼化與自動化。通過將執行手冊轉化為 Markdown 技能並結合 Issue 觸發器,系統能夠自動生成落地頁、分發 UTM 連結、每日篩查註冊名單以及在活動後執行跟進。
推薦理由:作者通過自身實踐展示瞭如何用自然語言和平臺原生功能自動化營銷運營,為非技術背景人員提供了可複用的工作流改造方法。
GPT‑6 Astra 提升 Devin 的軟體測試能力,幫助工程師減少程式碼審查量並加速交付。Cognition 通過 GPT‑6 Astra 讓 Devin 能夠自動測試其自身工作並驗證其正確性。
推薦理由:GPT‑6 Astra 提升 Devin 的軟體測試能力,幫助工程師減少程式碼審查量並加速交付。
OpenAI 將 Habitat 從 Python 庫演進為全球分散式儲存平臺,支援 10 億 ChatGPT 使用者和 22M 請求/秒。
summary_zh: - **Featured 的使用者每月透過 Vercel 傳送超過 100,000 筆媒體投遞,並在一年內傳送超過 1 億封 Help A Reporter Out (HARO) 電子郵件。
Tailscale 利用 Vercel AI Gateway 快速搭建了客戶面向的模型路由器,並提供零資料保留與低延遲的安全執行環境。 - 核心功能:透過單一 API 管理數百個模型,並自動回傳成本與使用量。
Google Research 介紹了 ToolGrad 框架,這是一種採用“先生成工具使用鏈、再反向標註使用者提示詞”的答案優先範式,能夠以更低成本高效生成複雜的智慧體工具使用資料集。
推薦理由:該研究提出了一種反向生成智慧體工具使用資料集的方法,通過文本梯度迭代構建工作流,為解決合成數據成本與可擴充套件性瓶頸提供了新路徑。
GitHub Copilot app 推出了內建的 diff、終端和瀏覽器面板,讓使用者無需切換應用即可審查 AI 生成的程式碼、執行命令並測試介面。通過這些並排的內建面板,使用者可以閉環完成審查、執行和預覽,安全地合併程式碼並建立 pull request。
推薦理由:原文介紹了應用內嵌面板的具體功能和協作流程,讀者可以據此瞭解如何在一個介面內完成 AI 程式碼審查和測試。
summary_zh: GitHub Copilot 現已可透過官方 @ai-sdk/harness-github-copilot 連線至 AI SDK harness 層,讓開發者能以同一 HarnessAgent 介面執行多種 coding agents,無需改動程式碼。
César de la Fuente 的實驗室利用 Codex 與 ChatGPT 在活體與滅絕基因組中搜索抗菌候選分子,以對抗耐藥感染。
OpenAI 在 ChatGPT Work 中推出 Data agent,支援連線公司資料、用自然語言查詢並生成互動式儀表盤。該功能讓使用者無需編寫程式碼即可獲取洞察,提升資料視覺化效率。
推薦理由:官方釋出的 Data agent 讓企業能用自然語言直接查詢資料並生成互動式儀表盤,降低資料分析門檻,提升決策效率,並支援多維度資料視覺化。
Mistral AI 與 Cloudera 宣佈建立合作伙伴關係,將 Mistral 的模型整合至 Cloudera 的混合資料平臺中。雙方合作旨在滿足企業對主權 AI 的需求,支援企業在私有云、公有云、本地及完全隔離的環境中執行推理,並利用專有資料訓練定製模型以保持對資料和智慧的完全控制。
OpenAI 推出 ChatGPT for Financial Services,結合內建金融資料與 GPT-6 Astra 模型,用於研究、建模和客戶交付材料的準備。
推薦理由:原文給出了 ChatGPT for Financial Services 的內建資料與模型配置,讀者可以據此判斷它會怎樣改變金融領域的日常工作流。
OpenAI 宣佈與 GSA 合作,為符合條件的聯邦、州、地方和部族政府提供零許可費、使用費五折優惠以及擴大的網路安全支援。
推薦理由:原文公佈了面向美國各級政府的費用減免和網路安全支援方案,讀者可以據此瞭解 AI 服務在公共部門的落地政策。
OpenAI 推出了 Agents API 託管服務,支援基於 Codex 框架進行任務編排、長會話和工具呼叫,幫助開發者構建和部署雲端智慧體。
推薦理由:官方推出的託管服務直接面向雲端智慧體開發需求,開發者可藉此獲得編排與長會話支援。
summary_zh: Tako Search 在 AI Gateway 免費使用至 9 月 30 日,允許 AI 模型搜尋 Tako 的精選資料與即時網路,並以篩選域名或釋出日期的結果回答問題,附上引用與視覺化。
OpenAI 在 API 中推出 GPT-Live-1,支援同時聆聽與說話的全雙工語音互動,並可將深度推理與工具呼叫委託給後端模型。該模型在 API 中的定價為每分鐘 0.05 美元,具備平滑的中斷處理、語氣與風格控制以及電話網路支援等特性。
summary_zh: 現在可以在 Vercel 上使用 OpenAI Agents API 建置並部署長時間執行、使用工具的代理程式。 - 代理迴圈與會話狀態:由 OpenAI 管理,確保代理持續運作。
Hugging Face 官方介紹瞭如何使用 TRL v1.14 中的 AsyncGRPOTrainer 在不同機器上非同步訓練 LoRA 介面卡並同步至 vLLM。通過將兆位元組大小的 rank-1 介面卡寫入儲存桶並藉助代理路由 KV 快取字首,該方案省去了 NCCL 跨節點通訊,使 500 步訓練耗時縮短至原來的四分之一。
推薦理由:文章展示瞭如何在不同機器上執行訓練與推理,通過儲存桶同步 LoRA 介面卡,為分散式強化學習提供了可複用的工程方案。
Graidio 團隊釋出了 Workflow1111,這是一個基於 Gradio Workflow 重構 AUTOMATIC1111 功能集的單工作流畫布,包含由 73 個節點和 11 條媒體管線組成的圖表。
推薦理由:文章展示瞭如何用視覺化節點把多個媒體管線組合在一起,並自動生成介面和協議,為開發者搭建複雜多模態應用提供了新方案。
Paul Christiano 正式加入 OpenAI 基金會董事會及其安全和安全委員會,為機構帶來了在 AI 對齊、安全以及標準制定方面的豐富經驗。
Chris Lehane 認為,隨著 AI 能力不斷增強,在政策視窗期仍然開放之際,我們需要提供更強的安全證據、建立共享標準並採取持久的政策行動。
Mistral AI 幫助一家歐洲能源運營商將 40,000 行 Fortran 77 程式碼遷移至 C++,通過 AI 代理完成語法轉換、架構重構和測試。文章詳細闡述了構建數值一致性驗證 harness、文件化流程、以及人機協同的結構化工作流,並給出遷移經驗。
推薦理由:案例展示瞭如何用 AI 代理完成 Fortran 77 到 C++ 的遷移,並給出可複製的工作流程與經驗。
OpenAI 推出 GPT-6 Astra,作為其迄今為止最具智慧與對齊能力的模型,現已在 ChatGPT Work、Codex 及 API 中可用。該模型在計算機使用、瀏覽、軟體工程及網路安全等專業任務上表現領先,API 定價為每百萬輸入 token 10 美元、每百萬輸出 token 50 美元。
推薦理由:原文公佈了新模型的各項能力基準、定價及企業級安全控制,讀者可以據此評估其在複雜工作流中的成本效益。
一位 MIT 研究員使用 GPT-5.6 Sol 配合 Codex 自主執行量子計算實驗、分析結果並對量子位元進行校準。該方案展示了先進模型在科學研究領域的實際應用方式。
Google DeepMind 推出了 AlphaGenome Atlas 平臺,包含人類基因組中 90 億種單核苷酸變異的預測效應,並同步釋出了 AlphaGenome Variant Impact 評分。該平臺提供網站埠、API 以及 Google Antigravity 中的 skill,旨在幫助學術研究人員理解基因變異對分子生物學的影響。
推薦理由:該平臺預先計算了人類基因組中所有可能單核苷酸變異的分子效應預測併發布了配套評分指標,為研究人員快速評估基因變異影響提供了新資源。
OpenAI AI 通過更強大、更實惠的技術,幫助個人和企業擴大可完成的工作量,並提升增長效率。該技術旨在降低成本並提高生產力。