跳到正文

#產品更新

RSS
今日 0 則
9月24日週四
  1. Microsoft Research69

    將推理遷移到雲端提升物理 AI 機器人效能

    Microsoft Research 在其 Physical AI Toolchain 中新增了將機器人推理遷移到雲端的功能,能夠顯著提升任務成功率、延長續航並支援更大模型。

    推薦理由:文章展示了將機器人推理遷移到雲端可顯著提升任務成功率和續航,幫助讀者評估分散式推理方案對工業機器人的影響。

9月23日週三
  1. OpenAI News70

    推出 MentalHealthBench 心理健康評測基準

    OpenAI推出MentalHealthBench,一個多語言、多情境的心理健康對話評測基準。該基準由80多名全球心理健康專家共同制定,覆蓋從日常對話到危機情境的多種場景,並提供專家評估標準和自動化評分工具。

    推薦理由:OpenAI釋出MentalHealthBench,提供多語言、多情境的心理健康評測基準,幫助研究者評估模型安全性與實用性。

9月18日週五
  1. Google Research63

    Google Research 推出基於生成式 UI 的定製化互動學習模擬研究專案

    Google Research 推出了可讓教師建立定製化、互動式教育模擬實驗的最新研究,利用針對教育最佳化的生成式 UI 動態生成符合課程目標的學習互動。官方同時釋出了包含 30 多箇中學 STEM 課程英文學習互動的樣本庫,並面向使用 Google Workspace for Education 的學校開放試點計劃以收集反饋。

    推薦理由:原文介紹了該研究成果及配套的試點專案,讀者可以從中瞭解大模型在定製化教學互動模擬方面的最新進展。

9月8日週二
  1. Google DeepMind89

    Google DeepMind 釋出 AlphaGenome Atlas:人類基因組變異預測圖譜

    Google DeepMind 推出了 AlphaGenome Atlas 平臺,包含人類基因組中 90 億種單核苷酸變異的預測效應,並同步釋出了 AlphaGenome Variant Impact 評分。該平臺提供網站埠、API 以及 Google Antigravity 中的 skill,旨在幫助學術研究人員理解基因變異對分子生物學的影響。

    推薦理由:該平臺預先計算了人類基因組中所有可能單核苷酸變異的分子效應預測併發布了配套評分指標,為研究人員快速評估基因變異影響提供了新資源。

8月17日週一
  1. Google Research65

    Google Research 推出 PhotoScan:通過智慧手機影像估算心臟代謝風險

    Google Research 推出了 PhotoScan,這是一個通過標準 2D 智慧手機照片估算 3D 身體成分指標(如體脂率、A/G 比和 V/S 比)的深度學習框架。該模型在英國生物銀行資料上進行預訓練,並利用 677 名成人的佇列進行了微調;獨立驗證顯示其在預測胰島素抵抗方面達到了接近 DXA 掃描的準確度。

    推薦理由:該研究展示了利用普通手機影像估算身體成分和評估胰島素抵抗的新方案,為降低代謝健康篩查門檻提供了技術參考。

8月4日週二
  1. Microsoft Research86

    Microsoft Research 釋出開源智慧體框架 Orchard

    Microsoft Research 推出了開源的可擴充套件智慧體框架 Orchard,其核心是提供可重用環境服務的 Kubernetes 架構 Orchard Env,支援在真實部署 harnesses 中直接訓練智慧體。專案同步開源了三個領域的訓練方案與資料,其中 Orchard-SWE 在 SWE-bench Verified 上取得了 69.7% 的表現。

    推薦理由:微軟研究院開源了可擴充套件智慧體框架 Orchard,並提供覆蓋軟體工程、網頁瀏覽和個人助理的完整訓練方案,降低了智慧體研究的基建門檻。

7月15日週三
  1. Hugging Face Blog75

    推出 Real World VoiceEQ:衡量語音 AI 的人類質量

    Hugging Face 釋出了 Real World VoiceEQ,一個評估語音 AI 人類質量的基準,涵蓋 60 多項指標,覆蓋 40 多個模型。該基準基於 100 萬條人類評分,評估 15+ 維度的 ASR、TTS、S2S 和 Speech Understanding,幫助開發者識別情感、背景噪聲等細粒度缺陷。

    推薦理由:Real World VoiceEQ 提供了超過 60 項指標的真實人類評估,幫助開發者識別模型在情感、背景噪聲等方面的細粒度缺陷。

7月1日週三