跳到正文

#開源/倉庫

RSS
今日 0 則
9月28日週一
  1. Hugging Face Blog83

    Hcompany 釋出 Holo4 系列智慧體模型與 Holotron4 Nano

    Hcompany 釋出全新智慧體模型系列 Holo4,包含 27B dense 與 35B-A3B Mixture of Experts 兩個尺寸,並同步推出更新版 Holotron4 Nano。該系列模型支援 GUI、程式碼、MCP 與 API 等多種互動介面,在 OSWorld 2.0 等基準測試中表現優異,相關權重與軌跡資料已在 Hugging Face 開源。

    推薦理由:文章公佈了新模型的大小、介面和基準測試表現,讀者可以據此瞭解其在複雜工作流中的表現。

9月22日週二
8月6日週四
  1. Google DeepMind66

    Google DeepMind 釋出 WeatherNext AI 模型並實現氣旋預測突破

    Google DeepMind 推出了 WeatherNext AI 模型,在氣旋的路徑、強度和風力結構預測上達到了 SOTA 精度,平均可提供額外一天的預警時間。該研究成果已在 Nature 發表,團隊宣佈開源 WeatherNext 2 與 WeatherNext Cyclones 模型程式碼及權重。

    推薦理由:該模型實現了氣旋路徑和強度預測的大幅準確率提升,並開源了程式碼與權重,為氣象研究和防災減災提供了新工具。

8月4日週二
  1. Mistral AI63

    Mistral AI 釋出 3B 開源多模態安全分類模型 Shieldstral

    Mistral AI 釋出了 Shieldstral,這是一款 3B 引數的開源多模態安全分類模型,採用 Apache 2.0 協議開源。該模型將內容稽核轉換為策略自適應的問答任務,允許在推理時通過自然語言指定策略,從而無需重新訓練即可統一處理文本和影像安全評估。

    推薦理由:該模型通過將內容稽核轉化為推理時的自然語言問答任務,避免了傳統方案因固定分類體系而需要重新訓練的限制。

7月2日週四
  1. Mistral AI64

    Mistral AI 釋出 Leanstral 1.5 形式化推理模型

    Mistral AI 釋出 Leanstral 1.5,這是一款採用 Apache-2.0 許可證、擁有 119B 總引數和 6B 啟用引數的開源形式化驗證模型。該模型經過中訓練、監督微調與 CISPO 強化學習,在 miniF2F、PutnamBench 以及 FATE-H 和 FATE-X 等基準測試中取得顯著效能提升,並支援通過 Hugging Face 和免費 API 獲取。

    推薦理由:文章詳細說明了 Leanstral 1.5 的引數規模、訓練階段與測試集表現,讀者可以據此評估該開源形式化驗證模型在數學推理和程式碼驗證上的實際效能。

6月30日週二
  1. Google Research63

    Google Research 釋出 TabFM:面向表格資料的零樣本基礎模型

    Google Research 推出了 TabFM,這是一個專為表格資料分類和迴歸設計的零樣本基礎模型。該模型通過將表格預測轉換為上下文學習問題,消除了傳統機器學習中的手動模型訓練、超引數調優和複雜特徵工程,能夠在單次前向傳遞中對未見過的表格生成高質量預測。

    推薦理由:Google Research 釋出了面向表格資料的零樣本基礎模型 TabFM,讀者可以據此瞭解大模型架構如何簡化分類和迴歸的工作流。

6月11日週四
  1. Google DeepMind75

    Google DeepMind 釋出 DiffusionGemma 開源文本擴散模型

    Google DeepMind 釋出了採用 Apache 2.0 協議開源的實驗性模型 DiffusionGemma,這是一款基於 Gemma 4 家族和 Gemini 擴散研究的 26B MoE 文本擴散模型,可在專用 GPU 上實現高達 4 倍的文本生成速度。

    推薦理由:該模型採用文本擴散架構實現數倍於傳統自迴歸模型的推理速度,為開發者探索本地即時互動工作流提供了新的硬體利用方式與微調路徑。

5月22日週五
  1. Mistral AI87

    Mistral AI 釋出 Mistral Medium 3.5 與 Vibe 雲端非同步智慧體

    Mistral AI 推出 128B 開源旗艦模型 Mistral Medium 3.5,具備 256k 上下文視窗、可配置推理強度以及從頭訓練的視覺編碼器,並在 SWE-Bench Verified 上取得 77.6% 的成績。

    推薦理由:Mistral Medium 3.5 的釋出和雲端非同步智慧體能力的上線,展示瞭如何通過長上下文與多工具呼叫降低開發者的任務阻塞成本。

7月15日週二
  1. Mistral AI86

    Mistral AI 釋出開源語音理解模型 Voxtral

    Mistral AI 釋出了開源語音理解模型 Voxtral,包含面向生產的 24B 規格與面向端側的 3B 規格,均採用 Apache 2.0 協議開源。該系列模型支援 32k 上下文、長達 30 至 40 分鐘的音訊處理、內建問答與摘要、多語言處理及函式呼叫功能,並在多項語音轉寫和理解基準測試中表現優異。

    推薦理由:該模型提供了兩種尺寸並開源,讀者可以根據自身算力條件選擇合適的版本進行本地部署或呼叫 API。

7月11日週五
  1. Mistral AI62

    Mistral AI 釋出 Devstral Medium 並升級 Devstral Small

    Mistral AI 與 All Hands AI 合作推出了 Devstral Medium 並升級了 Devstral Small 1.1。Devstral Small 1.1 採用 Apache 2.0 協議開源,在 SWE-Bench Verified 上獲得 53.6% 的分數;Devstral Medium 在 API 上線,得分達 61.6%,支援私有化部署與自定義微調。

    推薦理由:該釋出提供了兩款程式碼智慧體新模型的詳細效能和價格資訊,讀者可以藉此評估它們在特定開發任務中的價效比。

6月10日週二
3月17日週一
  1. Mistral AI65

    Mistral AI 釋出 Mistral Small 3.1 模型

    Mistral AI 宣佈推出 Mistral Small 3.1,這是一款在其體量級別表現出色的開源模型。該模型帶來改進的文本效能、多模態理解以及高達 128k tokens 的上下文視窗,並以 Apache 2.0 許可證開源。

    推薦理由:原文給出了開源模型的新版本效能與多維度升級,讀者可以據此評估其在端側和多模態任務中的應用潛力。