Skip to content

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

126條精選相關主題模型发布行业动态AI 编码

最新精選

第 81–100 條 · 共 126 條
Jul 8Wed
  1. Hugging Face Blog61

    Hugging Face 发布原生速度的 vLLM transformers 建模后端

    Hugging Face 宣布 vLLM 的 transformers 建模后端在多项架构测试中达到或超过 vLLM 手动编写的原生实现速度。该后端通过 torch.fx 进行模型图静态分析并在运行时动态应用特定层融合,使模型作者无需编写额外代码即可直接获得原生级推理吞吐量。

    Why Recommended: 原文提供了将原生模型直接应用于高性能推理的具体方法与性能对比,读者可以据此评估新后端在实际部署中的收益。

Jul 7Tue
  1. Hugging Face Blog63

    Hugging Face 携手微软在 Microsoft Foundry 中推出托管计算与模型精选目录

    Hugging Face 与微软在 Microsoft Build 2026 上宣布推出 Foundry Managed Compute 以及 Hugging Face 模型的精选目录,每周更新并支持一键部署到托管计算平台。该平台提供企业级安全治理、多模态支持、统一端点和自动化运行时升级,让企业能够在 Azure 中安全、便捷地运行开源模型。

    Why Recommended: 微软与 Hugging Face 合作在 Microsoft Foundry 中推出了托管计算与精选开源模型目录,读者可以借此了解开源模型在企业级云平台中的部署与运维方案。

  2. Hugging Face Blog85

    Hugging Face 发布 LeRobot v0.6.0:引入世界模型与统一评测

    LeRobot v0.6.0 引入了世界模型策略、全新的视觉语言动作模型和统一的奖励模型 API,同时带来了六大仿真评测基准、全新的部署命令行工具以及深度感知和数据自动标注能力。此次更新还优化了数据集加载速度,实现了完全分片数据并行训练和云端训练支持,并大幅精简了基础安装包的依赖。

    Why Recommended: 该版本闭环了机器人学习流程,用户可以据此了解开源机器人框架在世界模型和评测方面的新能力。

  3. Hugging Face Blog75

    Hugging Face 与 SkyPilot 联合推出零出口费用云端存储后端

    Hugging Face 与 SkyPilot 共同推出原生的 Hugging Face Storage 存储后端,支持通过单一 hf:// 统一方案在任意云端或集群上挂载 Hub 上的模型与数据集。该方案具备零数据出口费、基于 Xet 的重复数据删除以及按需惰性读取等特性,可将模型直接加载至异构 GPU 资源中进行开发、训练或推理。

    Why Recommended: 原文介绍了 Hugging Face Storage 作为 SkyPilot 存储后端的具体接入方式,读者可以据此评估跨云训练和零出口费用的实际收益。

Jul 6Mon
  1. Hugging Face Blog63

    Hugging Face 宣布 🤗 Kernels 项目重大更新

    Hugging Face 推出了 🤗 Kernels 项目的重大更新,新增了名为 kernel 的 Hub 仓库类型,并带来改进的安全机制、重构的 CLI、更广泛的框架与后端支持,以及对智能体内核开发的基础支持。

    Why Recommended: 官方对自定义内核项目进行了重大改版并引入了新的仓库类型,为开发者了解内核分发与安全机制提供了参考。

Jul 1Wed
  1. Hugging Face Blog68

    Hugging Face 与 Cerebras 推出基于 Gemma 4 的实时语音 AI

    Hugging Face 与 Cerebras 联合推出将开源语音 AI 架构与高速推理相结合的实时语音方案,实现自然的语音到语音交互。该开源级联语音堆栈由 Nvidia Parakeet 进行语音识别、Cerebras 运行 Google DeepMind 的 Gemma 4 31B 模型进行推理、以及 Alibaba 的 Qwen3TTS 生成语音,并已应用于 Reachy Mini 机器人。

    Why Recommended: 原文展示了开源语音流水线如何结合硬件推理速度,读者可以评估这种架构在低延迟交互中的表现。

Jun 30Tue
  1. Hugging Face Blog62

    Every Eval Ever 结果现已支持在 Hugging Face 模型页面展示

    Every Eval Ever 与 Hugging Face Community Evals 达成互通,通过推出的转换工具支持将评估结果同步至 Hugging Face 模型页面并自动关联完整记录。该工具包含格式转换、冲突审计与本地预览功能,目前已支持 MMLU-Pro、GPQA、HLE 和 GSM8K 等官方基准。

    Why Recommended: 原文介绍了 Every Eval Ever 与 Hugging Face Community Evals 的互通方案,为评估结果的跨平台展示和溯源提供了可复用的自动化工具。

Jun 25Thu
  1. Google DeepMind64

    Google DeepMind 推出 Gemini 3.5 Flash 内置 computer use 功能

    Google DeepMind 宣布在 Gemini 3.5 Flash 中内置 computer use 功能,使其能够跨浏览器、移动端和桌面环境执行智能体任务。该功能支持长周期和企业自动化场景,并通过对抗性训练与可选的企业安全保护系统来降低提示词注入等风险。开发者现可通过 Gemini API 和 Gemini Enterprise Agent Platform 开始构建相关应用。

    Why Recommended: 官方将 computer use 能力直接集成至主模型,开发者可据此构建能跨平台操作的自定义智能体。

Jun 24Wed
Jun 9Tue
  1. Google DeepMind81

    Gemini 3.5 Live Translate 实时语音翻译实现流畅自然

    Gemini 3.5 Live Translate 是 Google DeepMind 推出的最新音频模型,支持 70+ 语言的实时语音对语音翻译。该模型可持续流式处理,几秒延迟,自动检测语言并保持语调、节奏与音高。

    Why Recommended: Gemini 3.5 Live Translate 提供 70+ 语言的实时语音翻译,减少停顿,适用于会议、通话等场景,帮助开发者快速构建多语言翻译应用。支持多语言输入,无需手动配置,噪声鲁棒性强,适合嘈杂环境。

Jun 5Fri
  1. Google Research64

    Gemini Enterprise Agent Platform 发布 Agentic RAG 提升可靠响应

    Google Research 推出了 Gemini Enterprise Agent Platform 的 Agentic RAG,利用多代理协同、规划与足够上下文机制,提升多源多跳查询的准确率至 34%,在跨语料库实验中保持 90.1% 的高准确率,且延迟与单语料库版本相近。该功能已作为公开预览提供。

    Why Recommended: 该系统在多源多跳查询中将准确率提升至 34%,为企业工作流提供更可靠的答案,并在跨语料库场景下保持 90.1% 的高准确率。

Jun 4Thu
  1. Google Research72

    Google开源水文框架,开启洪水韧性新篇章

    Google Research公开了其水文模型框架,供各国气象机构在GitHub上使用和构建AI洪水预报模型。该框架基于PyTorch实现LSTM网络,支持使用Caravan数据集训练,并已在Czech Hydrometeorological Institute验证,提升预测时效6天。

    Why Recommended: Google公开的水文框架让各国气象机构可自行训练AI洪水预报模型,提升预测时效并降低技术门槛。

May 29Fri
  1. Google Research69

    Google Research 在 I/O 2026 上开启新发现时代

    Google Research 在 I/O 2026 上公布了多款 AI 工具与模型,涵盖科研加速、健康应用、边缘计算与气候预测等领域。

    Why Recommended: Google Research 在 I/O 2026 上公布多款 AI 工具与模型,展示了从科研到产品的快速落地与实际影响,凸显代理式编码与多模态推理在科学与日常应用中的变革潜力,并为全球科研社区提供了可扩展的实验平台。

May 28Thu
  1. Mistral AI68

    Mistral AI 在 AI Now Summit 2026 发布工业工程 AI 堆栈与 Vibe 代理

    Mistral AI 在 AI Now Summit 2026 发布面向工业工程的全栈 AI 解决方案,并与空中客车、宝马集团和 ASML 合作,支持从设计到生产的安全高效工作流。新推出的 Vibe 代理可处理长周期任务,如编码与研究;法国 Les Ulis 10 MW 数据中心将于 2026 年第三季度投入使用,提升推理与安全控制。

    Why Recommended: Mistral 推出面向工业工程的 AI 堆栈和 Vibe 代理,展示如何在航空、汽车和半导体领域实现安全、高效的设计与生产。

  2. Mistral AI74

    Vibe 开始工作

    Vibe 是 Mistral 推出的统一 AI 代理,兼顾工作与编码。它提供 Work Mode 处理多步企业任务(如收件箱、日历、研究、文档起草)以及 Code Mode 进行远程编码(从功能开发到拉取请求),并可通过 VS Code、CLI 和 Web 进行无缝协作。

    Why Recommended: Vibe 将工作与编码整合为单一智能体,支持多步任务、可视化推理与可扩展部署,适合企业与个人使用

  3. Mistral AI74

    推出 Search Toolkit 搜索工具包

    Mistral AI 公布 Search Toolkit,开源框架整合搜索、检索与评估,支持多源索引、实时数据拉取,兼容 BM25、向量检索及混合模式,内置 recall、precision、MRR、NDCG 等指标,适用于 RAG 与智能体场景,可在云端、本地或边缘部署。

    Why Recommended: Search Toolkit 将搜索、检索和评估整合到单一框架,帮助企业减少工程时间并提升检索质量;其可在云端、边缘或本地部署,支持多源索引与实时数据拉取,适用于 RAG 与智能体场景。

May 27Wed
  1. Mistral AI62

    Mistral AI 推出面向工程加速的物理 AI

    Mistral AI 宣布推出物理 AI 基础能力,将 Emmi AI 整合至企业级产品栈中。该能力旨在通过数据驱动的模型在单张 GPU 上于数秒内直接预测物理行为,从而实现加速产品设计、加速工装流程设计以及构建实时数字孪生。

    Why Recommended: 该产品将物理 AI 引入企业解决方案,读者可以了解其如何通过单次前向传播将仿真模拟时间从数小时缩短至数秒。

May 22Fri
  1. Mistral AI83

    Mistral AI 发布 Studio 平台 Connectors 功能

    Mistral AI 在 Studio 中推出 Connectors 功能,支持开发者使用内置与自定义 MCP 构建企业级 AI 应用。该功能提供 API/SDK 接入、直接工具调用、人机协同审批流及统一的集中注册管理,适用于各类对话、智能体及复杂工作流。

    Why Recommended: 该功能将企业级数据集成统一封装为可重用的 MCP 实体,减少了重复开发和鉴权成本,为构建复杂智能体工作流提供了标准化方案。

May 20Wed
  1. Google Research74

    Google 发布科研辅助工具 Empirical Research Assistance 并推出 Computational Discovery

    Google 发布由 Gemini 驱动的科研辅助工具 Empirical Research Assistance(ERA),可用于编写和优化科学代码,并在《Nature》杂志上发表了相关论文。

    Why Recommended: Google 推出基于 Gemini 的科研辅助工具 Empirical Research Assistance,读者可以了解其在多学科科学发现中的应用实例和开放入口。

May 18Mon
  1. Google DeepMind63

    Google DeepMind 推出 Project Genie 街景接地功能并扩大访问范围

    Google DeepMind 推出了将 Project Genie 与 Google Street View 结合的新街景接地功能,允许用户利用真实街景图像生成互动虚拟环境,并面向全球 Google AI Ultra 订阅者逐步开放。新功能通过 Maps Imagery Grounding 技术支持,目前美国地区的街景图像已可用。

    Why Recommended: 该产品更新将世界模型与街景数据结合,为用户和智能体提供了在现实地点基础上生成互动环境的新能力。