跳到正文

全部動態

RSS
今日 24 則
9月16日週三
  1. Google DeepMind66

    Google DeepMind 釋出 Gemini 3.8 Live 與 3.8 Live Extended Thinking 語音模型

    Google DeepMind 推出 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款先進的即時對話模型,帶來並行推理與近即時語音互動升級。

    推薦理由:Google DeepMind 推出了 Gemini 3.8 Live 與 3.8 Live Extended Thinking,通過並行推理與近即時語音互動能力在多項語音基準測試中表現突出,讀者可藉此評估其在複雜語音智慧體開發和企業級工作流中的應用潛力。

  2. NVIDIA Blog49

    NVIDIA 如何通過 DSX 最大化 AI 工廠產能:從兆瓦到 token

    NVIDIA 推出旨在最佳化 AI 工廠每兆瓦 token 吞吐量的技術套件 NVIDIA DSX,涵蓋動態功耗分配、網格協同排程及生命週期管理等功能。Lambda 的實測結果顯示,在固定電源預算下利用 NVIDIA DSX MaxLPS 執行叢集可提升 24% 的 token 吞吐量。該平臺通過智慧化排程與即時監控,有效釋放了傳統靜態配置下的閒置算力。

  3. NVIDIA Blog72

    NVIDIA 釋出 Vera Rubin 架構與 DSX 平臺,展示 AI 工廠能效與吞吐量提升

    NVIDIA 在 AI Infra Summit 上釋出了 Vera Rubin 架構與 DSX 平臺,其中 Vera Rubin NVL72 系統在 MLPerf Inference v6.1 預覽測試中展現出顯著的吞吐量優勢。多項生態合作與基準測試顯示,新平臺通過電源最佳化和軟體協同,大幅提升了每瓦 tokens 產出與 agentic ワークロード的執行效率。

    推薦理由:原文公佈了 Vera Rubin 架構在多個基準測試中的效能表現,讀者可以據此評估新一代 AI 基礎設施在能效和吞吐量上的提升幅度。

  4. Hugging Face Blog63

    AI 智慧體的任務一致性與 Consistency Analyzer 診斷方法

    IBM Research 團隊指出當前基準測試中的平均準確率掩蓋了智慧體的可靠性問題,並推出了用於測量和改善該問題的 Consistency Analyzer 與一致性指南。實驗表明,該方法在 AppWorld 測試中將一致性差距從 24.4 個百分點縮小至 12.0 個百分點,且未降低平均準確率。相關開原始碼與技術報告已釋出。

    推薦理由:文章提出了一種測量和緩解智慧體執行不一致性的方法,對評估和提升智慧體在生產環境中的可靠性有參考價值。

9月15日週二
  1. NVIDIA Blog31

    費城兒童醫院如何利用開源 NVIDIA AI 改善心臟護理

    費城兒童醫院利用基於 MONAI 等開源 NVIDIA AI 工具的心臟建模服務,在幾秒鐘內將 CT 掃描和 MRI 等影像轉化為精確的心臟模型,使原本需要四小時的手術準備時間縮短至可用於臨床。目前全美有超過 20 家兒童醫院執行此類心臟建模程式,其中波士頓兒童醫院每年支援約 500 例手術。

  2. Vercel Blog78

    Gemini 3.8 Live 模型現已可於 AI Gateway 使用

    Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking 現已可於 AI Gateway 使用,支援即時語音互動與多模態功能。

    推薦理由:Gemini 3.8 Live 及其擴充套件思考功能可即時語音互動,開發者可透過 AI Gateway 直接使用 WebSocket 進行即時對話,提升語音助手與多模態應用的互動體驗。

  3. Vercel Blog53

    AI SDK harness 層現在支援原生訂閱驗證

    AI SDK harness 現在支援原生訂閱驗證,讓開發者可在不改寫程式碼的情況下切換不同 AI 代理。 - 認證模式:直接模式使用明確的提供者環境憑證,或在缺少時使用主機上的原生訂閱;自動模式在未設定 AI Gateway 憑證時亦同樣行為;ai-gateway 模式不讀取原生訂閱。

9月14日週一
9月12日週六
  1. GitHub Blog · AI & ML62

    Marketing ops as code:在 GitHub 上將活動從規劃到跟進全流程自動化

    GitHub 營銷負責人分享瞭如何利用 GitHub Copilot、GitHub Actions 及 API/CLI 工具將亞太區的活動運營流程實現程式碼化與自動化。通過將執行手冊轉化為 Markdown 技能並結合 Issue 觸發器,系統能夠自動生成落地頁、分發 UTM 連結、每日篩查註冊名單以及在活動後執行跟進。

    推薦理由:作者通過自身實踐展示瞭如何用自然語言和平臺原生功能自動化營銷運營,為非技術背景人員提供了可複用的工作流改造方法。

  2. OpenAI News61

    Cognition 讓 Devin 用 GPT‑6 Astra 進行自測

    GPT‑6 Astra 提升 Devin 的軟體測試能力,幫助工程師減少程式碼審查量並加速交付。Cognition 通過 GPT‑6 Astra 讓 Devin 能夠自動測試其自身工作並驗證其正確性。

    推薦理由:GPT‑6 Astra 提升 Devin 的軟體測試能力,幫助工程師減少程式碼審查量並加速交付。

9月11日週五
  1. Google Research64

    ToolGrad:通過文本梯度實現高效工具使用資料集生成

    Google Research 介紹了 ToolGrad 框架,這是一種採用“先生成工具使用鏈、再反向標註使用者提示詞”的答案優先範式,能夠以更低成本高效生成複雜的智慧體工具使用資料集。

    推薦理由:該研究提出了一種反向生成智慧體工具使用資料集的方法,通過文本梯度迭代構建工作流,為解決合成數據成本與可擴充套件性瓶頸提供了新路徑。

  2. GitHub Blog · AI & ML62

    GitHub Copilot app 新手指南:如何使用 diff、終端和瀏覽器面板

    GitHub Copilot app 推出了內建的 diff、終端和瀏覽器面板,讓使用者無需切換應用即可審查 AI 生成的程式碼、執行命令並測試介面。通過這些並排的內建面板,使用者可以閉環完成審查、執行和預覽,安全地合併程式碼並建立 pull request。

    推薦理由:原文介紹了應用內嵌面板的具體功能和協作流程,讀者可以據此瞭解如何在一個介面內完成 AI 程式碼審查和測試。

9月10日週四
  1. OpenAI News64

    Data agent 在 ChatGPT Work 中上線,企業可用自然語言查詢資料並生成儀表盤

    OpenAI 在 ChatGPT Work 中推出 Data agent,支援連線公司資料、用自然語言查詢並生成互動式儀表盤。該功能讓使用者無需編寫程式碼即可獲取洞察,提升資料視覺化效率。

    推薦理由:官方釋出的 Data agent 讓企業能用自然語言直接查詢資料並生成互動式儀表盤,降低資料分析門檻,提升決策效率,並支援多維度資料視覺化。

  2. OpenAI News64

    OpenAI 推出 ChatGPT for Financial Services

    OpenAI 推出 ChatGPT for Financial Services,結合內建金融資料與 GPT-6 Astra 模型,用於研究、建模和客戶交付材料的準備。

    推薦理由:原文給出了 ChatGPT for Financial Services 的內建資料與模型配置,讀者可以據此判斷它會怎樣改變金融領域的日常工作流。

  3. OpenAI News65

    OpenAI 推出 Agents API

    OpenAI 推出了 Agents API 託管服務,支援基於 Codex 框架進行任務編排、長會話和工具呼叫,幫助開發者構建和部署雲端智慧體。

    推薦理由:官方推出的託管服務直接面向雲端智慧體開發需求,開發者可藉此獲得編排與長會話支援。

  4. OpenAI News86

    OpenAI 在 API 中釋出 GPT-Live-1 語音模型

    OpenAI 在 API 中推出 GPT-Live-1,支援同時聆聽與說話的全雙工語音互動,並可將深度推理與工具呼叫委託給後端模型。該模型在 API 中的定價為每分鐘 0.05 美元,具備平滑的中斷處理、語氣與風格控制以及電話網路支援等特性。

  5. Hugging Face Blog73

    基於 Hugging Face Jobs 與儲存桶跨節點非同步訓練 LoRA

    Hugging Face 官方介紹瞭如何使用 TRL v1.14 中的 AsyncGRPOTrainer 在不同機器上非同步訓練 LoRA 介面卡並同步至 vLLM。通過將兆位元組大小的 rank-1 介面卡寫入儲存桶並藉助代理路由 KV 快取字首,該方案省去了 NCCL 跨節點通訊,使 500 步訓練耗時縮短至原來的四分之一。

    推薦理由:文章展示瞭如何在不同機器上執行訓練與推理,通過儲存桶同步 LoRA 介面卡,為分散式強化學習提供了可複用的工程方案。

  6. Hugging Face Blog66

    Graidio Workflow 推出 Workflow1111

    Graidio 團隊釋出了 Workflow1111,這是一個基於 Gradio Workflow 重構 AUTOMATIC1111 功能集的單工作流畫布,包含由 73 個節點和 11 條媒體管線組成的圖表。

    推薦理由:文章展示瞭如何用視覺化節點把多個媒體管線組合在一起,並自動生成介面和協議,為開發者搭建複雜多模態應用提供了新方案。

9月9日週三
  1. Mistral AI65

    Mistral AI 用 AI 代理完成 Fortran 77 遷移至 C++

    Mistral AI 幫助一家歐洲能源運營商將 40,000 行 Fortran 77 程式碼遷移至 C++,通過 AI 代理完成語法轉換、架構重構和測試。文章詳細闡述了構建數值一致性驗證 harness、文件化流程、以及人機協同的結構化工作流,並給出遷移經驗。

    推薦理由:案例展示瞭如何用 AI 代理完成 Fortran 77 到 C++ 的遷移,並給出可複製的工作流程與經驗。

  2. OpenAI News86

    OpenAI 釋出 GPT-6 Astra 模型

    OpenAI 推出 GPT-6 Astra,作為其迄今為止最具智慧與對齊能力的模型,現已在 ChatGPT Work、Codex 及 API 中可用。該模型在計算機使用、瀏覽、軟體工程及網路安全等專業任務上表現領先,API 定價為每百萬輸入 token 10 美元、每百萬輸出 token 50 美元。

    推薦理由:原文公佈了新模型的各項能力基準、定價及企業級安全控制,讀者可以據此評估其在複雜工作流中的成本效益。

9月8日週二
  1. Google DeepMind89

    Google DeepMind 釋出 AlphaGenome Atlas:人類基因組變異預測圖譜

    Google DeepMind 推出了 AlphaGenome Atlas 平臺,包含人類基因組中 90 億種單核苷酸變異的預測效應,並同步釋出了 AlphaGenome Variant Impact 評分。該平臺提供網站埠、API 以及 Google Antigravity 中的 skill,旨在幫助學術研究人員理解基因變異對分子生物學的影響。

    推薦理由:該平臺預先計算了人類基因組中所有可能單核苷酸變異的分子效應預測併發布了配套評分指標,為研究人員快速評估基因變異影響提供了新資源。