AI Gateway Auto Router 釋出,幫助企業降低 AI 成本
Cloudflare 在 AI Gateway 中推出 Auto Router,自動為每個請求選擇合適的模型,幫助企業在保持效能的同時將 AI 費用降低 30%。
推薦理由:Auto Router 能在不犧牲效能的前提下,將 AI 費用降低 30%,為企業內部 AI 部署提供自動化成本控制,並支援多模型動態路由。
Cloudflare 在 AI Gateway 中推出 Auto Router,自動為每個請求選擇合適的模型,幫助企業在保持效能的同時將 AI 費用降低 30%。
推薦理由:Auto Router 能在不犧牲效能的前提下,將 AI 費用降低 30%,為企業內部 AI 部署提供自動化成本控制,並支援多模型動態路由。
AWS 宣佈 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform 上可用,具備更高的編碼與知識工作效率及更低的單任務成本。該模型適合處理範圍明確的持續工作負載,支援與 Claude Opus 5.5 搭配使用以兼顧複雜判斷與快速執行,使用者可通過控制台或 API 進行呼叫。
推薦理由:原文公佈了該模型在特定平臺上的可用性與技術改進,讀者可以據此評估其在自動化任務中的成本與效能表現。
Amazon Bedrock 在印度推出 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5 的境內推理支援,允許客戶通過孟買和海得拉巴區域處理本地資料。該功能採用地理跨區域推理,在 ap-south-1 和 ap-south-2 之間路由請求,以滿足資料本地化合規需求。
Amazon Bedrock 現已在首爾和新加坡區域支援 Anthropic 的 Claude Opus 5 與 Claude Sonnet 5 模型並提供區域內推理服務。
Cloudflare 在部落格中公佈了面向 AI 時代的自適應應用安全框架,強調將程式碼、流量與情報連線以阻止攻擊。
推薦理由:文章闡述了 Cloudflare 如何通過 AI 驅動的安全框架,將發現、治理、執行時防護與響應整合,幫助企業在 AI 時代提升應用安全。
Cloudflare 推出了全新的命令列工具 cf,旨在讓智慧體能夠訪問整個 Cloudflare 平臺中超過 3,000 種操作。該工具預設輸出 JSON 格式以節省上下文,內建自然語言搜尋功能,並採用基於 TypeScript 的全新配置格式和 Vite 開發服務。
推薦理由:該產品直接將整個平臺的 API 能力適配給智慧體,讀者可以通過專屬配置和命令簡化相關工作流。
Claude Sonnet 5.5 已在 Vercel AI Gateway 上上線,支援 anthropic/claude-sonnet-5.5 模型標識。該版本在日常工作中提升文件、幻燈片、電子表格的質量,並在編碼任務中加入多步檢查。
Vercel 在部落格中公佈了 skills.sh 登錄檔在七個月內達到一百萬技能、近 2.8 億次安裝的報告。報告顯示,跨行業技能佔 66% 的註冊量,安裝量佔 87.5%,並指出安裝高度集中,最受歡迎的 0.04% 技能貢獻了 62% 的安裝。
推薦理由:報告展示了 skills.sh 生態的爆發式增長與安裝分佈,為評估 Agent 技能市場潛力提供資料依據。
使用 TanStack AI 構建的 Agent 現在可通過 Vercel Connect 呼叫 OAuth 保護的 MCP 伺服器,無需儲存或輪換憑證。新的 @vercel/connect/tanstack-ai 子路徑匯出 connectMCPTransport,自動為每次 MCP 請求附加 Connect 授權提供者,保證令牌始終新鮮。
英國 AI 安全研究所正使用 EvalEval 的 Evaluation Cards 基礎設施公開分享評估結果,以支援更具可復現性和可驗證性的評估科學。此次釋出包含了五項基準測試和兩項安全評測的驗證結果、上下文及配置資訊,涵蓋了 Claude Opus 系列與 GPT-5 系列等六款前沿模型,並配合其關於推理計算如何塑造前沿 LLM 評測的研究論文一同釋出。
Anthropic 的 Claude Opus 5.5 已在 AI Gateway 上上線,支援 1M-token 上下文視窗和 128K 輸出 token。與 Opus 5 相比,速度提升約 30%,成本降低約 40%。
推薦理由:Opus 5.5 在速度和成本上相較前代提升顯著,適合需要大上下文和長任務的智慧體工作,其 1M-token 上下文視窗和 128K 輸出令長任務更易監督,且支援自動工具選擇,提升開發效率。對開發者而言,Opus 5.5 的速度與成本優勢可顯著降低專案迭代週期。
Vercel Sandbox 允許在隔離的 Firecracker 微VM 中執行 Harbor 評估,並可透過 AI Gateway 呼叫多個模型,提升測試效率與安全性。
Open-weight 模型 在 AI Gateway 8 月份佔據 56% 的代幣量,首次超過所有封閉模型。 - 代幣成本:平均每代幣價格較 5 個月前下降 23.2%,中位團隊每代幣支付 7.6% 更低。
推薦理由:Open-weight models已佔據主導,價格下降顯著,Astra快速滲透顯示新模型在企業生產中的高效性。
Hugging Face 團隊釋出研究探討如何為 AI 智慧體配置自蒸餾記憶,評估了從 30B 到前沿模型的 8 款模型在 AppWorld 基準上的表現。研究發現智慧體記憶效果取決於模型能力層級:強模型適合注入完整記憶,較弱模型適合精選檢索,而已飽和模型則無明顯增益。精選檢索能在僅增加 5% token 的情況下使 gpt-oss-120b 任務完成度提升 16.1 個百分點。
推薦理由:研究表明智慧體記憶容量需要根據模型能力進行校準而非盲目堆砌,為提升準確率和控制成本提供了實踐參考。
伯克利人工智慧研究院(BAIR)團隊探討了推理成本大幅下降後資料系統面臨的新機遇與新挑戰,指出未來資料系統需要圍繞 Agent 的互動、底層協同及自主合成三個維度進行徹底重構。文章重點分析了 Agent 推理帶來的高併發複雜查詢需求、多 Agent 協作所需的狀態管理機制以及利用 Agent 從零自主合成專用資料系統的方法。
推薦理由:文章探討了零成本推理時代對資料系統的影響,提出了面向、由和基於 Agent 的三大數據系統設計方向,為理解未來智慧基礎設施演進提供了前瞻視角。