跳到正文

#模型釋出

RSS
今日 11 則
4月13日週一
  1. Google DeepMind75

    Gemini Robotics-ER 1.6:通過增強具身推理驅動真實世界機器人任務

    Google DeepMind 推出了 Gemini Robotics-ER 1.6,這是其專為機器人設計的最新模型,提升了空間推理、多視角理解和儀表讀取能力。該版本在安全性和物理約束遵守方面也有顯著改進,並已通過 Gemini API 和 Google AI Studio 對開發者開放。

    推薦理由:Gemini Robotics-ER 1.6 通過增強空間推理和多視角理解,顯著提升機器人在真實環境中的自主決策能力,並首次實現儀表讀取功能,為工業設施監測提供更高精度。該模型在安全性和物理約束遵守方面也表現出顯著改進,幫助機器人更安全地執行任務。

4月3日週五
  1. Google DeepMind69

    Gemma 4 釋出:最強開源模型

    Google DeepMind 推出了 Gemma 4,四種尺寸(E2B、E4B、26B MoE、31B Dense)支援多模態、長上下文(128K–256K)和 140+ 語言,具備高階推理、函式呼叫和程式碼生成能力,並以 Apache 2.0 許可免費開放,適用於從移動端到雲端的多場景部署。

    推薦理由:Gemma 4 以高效引數利用率和多模態能力,成為最強開源模型之一,支援從移動端到雲端的多場景部署,並提供 128K–256K 上下文視窗和 140+ 語言支援,兼具函式呼叫和結構化 JSON 輸出,滿足多行業需求。

3月24日週二
  1. Mistral AI75

    Mistral AI 釋出 Voxtral TTS 語音生成模型

    Mistral AI 釋出 4B 引數量的語音生成模型 Voxtral TTS,支援 9 種語言的高質量語音合成與低延遲流式傳輸。該模型具備上下文理解、說話人建模及零樣本跨語言語音適應能力,已通過 API、Mistral Studio 和 Hugging Face 開放。

    推薦理由:原文公佈了架構細節和零樣本跨語言能力,讀者可以據此評估它在即時語音工作流中的表現。

3月17日週二
  1. Mistral AI84

    釋出 Mistral Small 4

    Mistral AI 釋出了 Mistral Small 4,這是一款統一推理、多模態與編碼功能的模型,採用 119B 引數、256k 上下文視窗,支援可配置推理強度,提供 40% 的延遲降低和 3 倍的吞吐量提升。該模型採用 Apache 2.0 許可,支援 vLLM、llama.cpp、SGLang 等開源框架,並已加入 NVIDIA Nemotron 聯盟。

    推薦理由:Mistral Small 4 將推理、多模態與編碼功能統一,提供可配置推理強度和高效推理,幫助使用者在單一模型中完成多種任務。

  2. Mistral AI68

    Leanstral 釋出開源可信 Vibe 編碼基礎

    Leanstral 是 Mistral AI 推出的首款專為 Lean 4 設計的開原始碼代理,採用 6B 活躍引數,支援在 Mistral Vibe 中零設定使用,並提供免費 API 端點。

    推薦理由:Leanstral 以 6B 引數實現高效 Lean 4 程式碼生成,成本低於主流模型,展示了開原始碼代理在正式驗證場景中的可行性。

2月5日週四
12月17日週三
  1. Mistral AI63

    Mistral AI 釋出 Mistral OCR 3 模型

    Mistral AI 釋出 Mistral OCR 3,相比上一代在表單、手寫體、低質掃描件和複雜表格處理上實現突破,整體勝率提升 74%。該模型支援輸出 Markdown 及基於 HTML 的表格重建,API 定價為每千頁 2 美元且 Batch API 享半價優惠,現已通過 Mistral AI Studio 的 API 與 Document AI Playground 提供。

    推薦理由:文章公佈了新一代 OCR 模型的技術改進與定價,讀者可以據此評估其在企業文件處理與自動化流水線中的應用成本與效果。

12月9日週二
12月3日週三
  1. Mistral AI83

    Mistral AI 釋出 Mistral 3 模型系列

    Mistral AI 釋出新一代 Mistral 3 模型系列,包含 14B、8B 和 3B 的 Ministral 3 端側稠密模型,以及採用稀疏 MoE 架構、啟用引數 41B 總引數 675B 的旗艦模型 Mistral Large 3。所有模型均採用 Apache 2.0 許可證開源,支援多模態與多語言能力,推理版本也將很快推出。

    推薦理由:原文釋出了包含稠密小模型與 MoE 旗艦大模型的全新模型系列,並全部採用 Apache 2.0 許可證開源,開發者和企業可直接藉此在多端與雲端部署前沿智慧能力。

7月15日週二
  1. Mistral AI86

    Mistral AI 釋出開源語音理解模型 Voxtral

    Mistral AI 釋出了開源語音理解模型 Voxtral,包含面向生產的 24B 規格與面向端側的 3B 規格,均採用 Apache 2.0 協議開源。該系列模型支援 32k 上下文、長達 30 至 40 分鐘的音訊處理、內建問答與摘要、多語言處理及函式呼叫功能,並在多項語音轉寫和理解基準測試中表現優異。

    推薦理由:該模型提供了兩種尺寸並開源,讀者可以根據自身算力條件選擇合適的版本進行本地部署或呼叫 API。

7月11日週五
  1. Mistral AI62

    Mistral AI 釋出 Devstral Medium 並升級 Devstral Small

    Mistral AI 與 All Hands AI 合作推出了 Devstral Medium 並升級了 Devstral Small 1.1。Devstral Small 1.1 採用 Apache 2.0 協議開源,在 SWE-Bench Verified 上獲得 53.6% 的分數;Devstral Medium 在 API 上線,得分達 61.6%,支援私有化部署與自定義微調。

    推薦理由:該釋出提供了兩款程式碼智慧體新模型的詳細效能和價格資訊,讀者可以藉此評估它們在特定開發任務中的價效比。

6月10日週二
5月28日週三
  1. Mistral AI61

    Mistral AI 釋出首個程式碼專用嵌入模型 Codestral Embed

    Mistral AI 釋出首個專為程式碼最佳化的嵌入模型 Codestral Embed,在真實程式碼資料的檢索任務中表現優於多個市場同類模型。該模型支援多維度與多種精度輸出,可在檢索質量與儲存成本之間進行靈活權衡。Codestral Embed 已在 API 上線,定價為每百萬 token 0.15 美元,同時提供批次 API 折扣及本地部署支援。

    推薦理由:原文公佈了專門針對程式碼檢索最佳化的嵌入模型及其定價和介面資訊,開發者可據此評估其在程式碼庫檢索和智慧體工作流中的效能與成本。

5月21日週三
  1. Mistral AI83

    Mistral AI 釋出 Devstral

    Devstral 是 Mistral AI 與 All Hands AI 合作推出的面向軟體工程的智慧體 LLM,已在 SWE-Bench Verified 上取得 46.8% 的得分。

    推薦理由:Devstral 在 SWE-Bench Verified 上顯著領先開源模型,並可在單張 RTX 4090 上本地部署,適合企業私有程式碼庫。

5月7日週三
  1. Mistral AI86

    Mistral AI 釋出 Mistral Medium 3 模型

    Mistral AI 宣佈推出 Mistral Medium 3 模型,在編碼和多模態理解等專業用例中具備前沿級效能,同時顯著降低了成本。該模型支援混合部署或本地部署、自定義後訓練及企業工具整合,API 定價為每百萬 token 輸入 0.4 美元、輸出 2 美元,現已在 Mistral La Plateforme 和 Amazon Sagemaker 等平臺上線。

    推薦理由:官方公佈了該新模型的具體基準表現和定價,讀者可以據此評估其在企業級應用中的價效比。

3月17日週一
  1. Mistral AI65

    Mistral AI 釋出 Mistral Small 3.1 模型

    Mistral AI 宣佈推出 Mistral Small 3.1,這是一款在其體量級別表現出色的開源模型。該模型帶來改進的文本效能、多模態理解以及高達 128k tokens 的上下文視窗,並以 Apache 2.0 許可證開源。

    推薦理由:原文給出了開源模型的新版本效能與多維度升級,讀者可以據此評估其在端側和多模態任務中的應用潛力。

3月7日週五
  1. Mistral AI85

    Mistral AI 釋出 Mistral OCR 文件理解模型與 API

    Mistral AI 推出 Mistral OCR 光學字元識別 API,能夠高精度解析複雜文件中的文本、影像、表格和數學公式。該模型原生支援多語言與多模態,已在 Le Chat 中作為預設文件理解模型上線,並在 la Plateforme 提供 API,定價為每美元 1000 頁。

    推薦理由:該模型在多項複雜文件基準測試中表現突出,為文件理解與檢索增強生成系統提供了新的高精度處理方案。