跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精選

第 1–20 條 · 共 91 條
今天10月1日週四
  1. Demis Hassabis (@demishassabis)70

    Google 與白宮簽署《超級智慧協議》,標誌著 AI 產業與政府合作的新階段。 協議內容:確立超級智慧發展的合作框架。 投資規模:Google 在過去兩年投入數百億美元。 參與者:美國總統、國防部長、眾議院議長等高層領導。

    推薦理由:此公告揭示美國政府與 Google 在超級智慧領域的合作與投資規模,對 AI 產業未來走向提供關鍵參考。

  2. Demis Hassabis (@demishassabis)72

    SynthID 推出 AI 生成蛋白水印工具,首次實驗證明可在合成蛋白中嵌入可追溯標記。 - 功能:將 AI 設計的蛋白質進行水印,確保可追溯性。 - 開源:SynthID Bio 工具已公開,供研究社群擴充與應用。 - 影響:為 AI 生物合成安全提供新手段,促進科研與監管合作。

    推薦理由:此举为 AI 生物合成安全提供可追溯标记,利于科研与监管合作,并为后续生物安全标准奠定基础。

  3. Demis Hassabis (@demishassabis)66

    DeepMind 宣佈 Gemini 4 Argon 前沿 AI 模型,首批釋出給政府與網路防禦者。 新模型:Gemini 4 Argon,DeepMind 的前沿 AI 模型。 首批釋出:透過 Fairwind Program,先行提供給政府與可信賴的網路防禦者。 未來可用性:更廣泛的可用性將在不久後推出。

    推薦理由:Gemini 4 Argon 代表 DeepMind 在前沿 AI 领域的又一突破,先行向政府與網路防禦者開放,提示其在安全與責任部署方面的先行實踐。

  4. Google DeepMind72

    Gemini 4 Argon 发布:开启前沿智能新时代

    Google DeepMind 推出了 Gemini 4 Argon,这是一款具备长推理、跨领域多模态能力的前沿模型。Argon 在软件工程、金融、法律和网络安全等行业基准上刷新记录,并已在内部工作流中提升效率;其 1M token 输出上限和 $2/百万输入、$10/百万输出的价格为开发者提供更高性价比。

    推薦理由:Gemini 4 Argon 通过大幅提升推理长度和多模态能力,显著提升软件工程、金融与网络安全等领域的工作效率,并在多项行业基准上刷新记录,帮助企业加速技术迭代。

  5. Google DeepMind63

    Google DeepMind 发布 SynthID Bio 为生成式生物学引入水印技术

    Google DeepMind 推出了 SynthID Bio,这是一种专为合成生物学开发的水印技术,可在保持蛋白质生物功能的同时,将不可见的标记直接嵌入氨基酸序列和预测的 3D 结构中。该技术通过了湿实验室对靶向蛋白质的测试,并对 AlphaFold 3 的扩散网络及 Evo 2 基因组模型进行了适配,旨在加强生物安全性并确保科学数据的完整性。

9月30日週三
  1. Google Research60

    Google Research 推出 Diffusion Controller:统一并简化 AI 图像生成的连续控制框架

    Google Research 推出了 Diffusion Controller 框架,将扩散模型的去噪过程重构为连续控制问题,用轻量级附加网络实现了对图像生成轨迹的平滑动态调整。实验表明,其轻量级灰盒版本在匹配人类偏好的指标上表现优异,而白盒微调版本则取得了更高的胜率。

    推薦理由:原文介绍了将图像生成去噪过程建模为连续控制问题的框架,并展示了其在灰盒和白盒环境下的性能表现,读者可以据此了解如何兼顾生成画质与对齐控制。

9月25日週五
  1. Google Research71

    Google Research 推出自动化长视频生成的多智能体框架

    Google Research 介绍了用于自动化长视频生成的多智能体框架,包含 Co-Director、CANVAS、A²RD 和 VQQA 四个核心组件。该框架通过全局优化和世界状态追踪解决语义漂移与级联失败问题,能够将创意转化为分钟级、具备多镜头叙事一致性的视频。

    推薦理由:该研究通过多智能体框架解决长视频生成中的视觉一致性问题,为提升视频扩散模型的长时序叙事能力提供了可复用的系统架构参考。

  2. Google DeepMind64

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,为对话式 AI 带来近实时的视觉形象与流媒体视频支持。该功能原生耦合了实时对话与低延迟视频生成,具备精确唇形同步、动态视觉形象、异步工具调用以及跨 97 种语言的原生语音同步能力,现已在 Gemini Enterprise 中可用。

9月24日週四
  1. NVIDIA Blog64

    NVIDIA 如何联合全球研究机构发布超 2800 种病毒蛋白质复合物的预测 3D 结构

    NVIDIA 联合 Google DeepMind 及欧洲生物信息研究所(EMBL-EBI)等全球研究机构,通过 AlphaFold Database 免费发布了覆盖超 2,800 种病毒的蛋白质复合物预测 3D 结构数据集。

    推薦理由:原文介绍了由 NVIDIA 与 Google DeepMind 等机构合作开源的病毒蛋白质复合物预测数据集,读者可以据此了解 AI 在生物学研究中的最新应用进展。

  2. Google DeepMind62

    Google DeepMind 发布带有安全服务器端内存的 Private AI Compute 技术更新

    Google DeepMind 公布了 Private AI Compute 架构的技术更新,将引入可在云端持久保存记忆并保持设备端隐私标准的长期记忆层。该架构采用硬件级安全 enclave、端到端加密通道以及仅存放在个人设备上的加密密钥,使云端 AI 能够跨设备安全保留上下文,同时确保数据连 Google 也无法访问。

9月23日週三
  1. Google DeepMind84

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款全新语音生成模型,支持超过 100 种语言的自然语言提示词声音设计、30 秒声音复刻以及逐行台词精细导演。

    推薦理由:官方发布的最新语音生成模型提供了细粒度的台词导演和声音定制能力,读者可以据此评估其在多语言配音与智能体交互中的实际表现。

  2. Vercel Blog66

    Gemini 3.8 TTS模型现已在AI Gateway上线

    Gemini 3.8 Flash‑Lite TTS 与 Gemini 3.8 Flash TTS 现已在 AI Gateway 上线,支持 100 多种语言的文本转语音,支持长篇朗读、交付控制和双人对话。

    推薦理由:Gemini 3.8 TTS模型已在AI Gateway上线,支持100多种语言、长篇朗读和双人对话,开发者可通过AI SDK轻松生成语音。

9月18日週五
  1. Google Research63

    Google Research 推出基于生成式 UI 的定制化互动学习仿真研究项目

    Google Research 推出了可让教师创建定制化、互动式教育仿真实验的最新研究,利用针对教育优化的生成式 UI 动态生成符合课程目标的学习互动。官方同时发布了包含 30 多个中学 STEM 课程英文学习互动的样本库,并面向使用 Google Workspace for Education 的学校开放试点计划以收集反馈。

    推薦理由:原文介绍了该研究成果及配套的试点项目,读者可以从中了解大模型在定制化教学互动仿真方面的最新进展。

9月17日週四
  1. Latent Space77

    AINews:近期前沿模型动态、智能体工程落地与开源生态进展

    Latent Space 发布了最新一期 AINews,重点报道了多项前沿 AI 进展:OpenAI 推出了模型失配披露机制,Databricks 针对约 3500 名工程师部署了 GPT-6 Astra,部分团队开始在生产环境评估智能体编码的成本与收益。同时,开源与推理基础设施持续演进,多款开源模型及量化工具在社区获得广泛讨论。

    推薦理由:原文梳理了近期前沿模型的工程落地表现与行业动态,有助于读者直接评估智能体在实际生产环境中的成本与性能表现。

9月16日週三
  1. Google DeepMind66

    Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型

    Google DeepMind 推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款先进的实时对话模型,带来并行推理与近实时语音交互升级。

    推薦理由:Google DeepMind 推出了 Gemini 3.8 Live 与 3.8 Live Extended Thinking,通过并行推理与近实时语音交互能力在多项语音基准测试中表现突出,读者可借此评估其在复杂语音智能体开发和企业级工作流中的应用潜力。

9月15日週二
  1. Vercel Blog78

    Gemini 3.8 Live 模型現已可於 AI Gateway 使用

    Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking 現已可於 AI Gateway 使用,支援即時語音互動與多模態功能。

    推薦理由:Gemini 3.8 Live 及其擴展思考功能可即時語音互動,開發者可透過 AI Gateway 直接使用 WebSocket 進行實時對話,提升語音助手與多模態應用的互動體驗。

9月11日週五
  1. Google Research64

    ToolGrad:通过文本梯度实现高效工具使用数据集生成

    Google Research 介绍了 ToolGrad 框架,这是一种采用“先生成工具使用链、再反向标注用户提示词”的答案优先范式,能够以更低成本高效生成复杂的智能体工具使用数据集。

    推薦理由:该研究提出了一种反向生成智能体工具使用数据集的方法,通过文本梯度迭代构建工作流,为解决合成数据成本与可扩展性瓶颈提供了新路径。

9月8日週二
  1. Google DeepMind89

    Google DeepMind 发布 AlphaGenome Atlas:人类基因组变异预测图谱

    Google DeepMind 推出了 AlphaGenome Atlas 平台,包含人类基因组中 90 亿种单核苷酸变异的预测效应,并同步发布了 AlphaGenome Variant Impact 评分。该平台提供网站端口、API 以及 Google Antigravity 中的 skill,旨在帮助学术研究人员理解基因变异对分子生物学的影响。

    推薦理由:该平台预先计算了人类基因组中所有可能单核苷酸变异的分子效应预测并发布了配套评分指标,为研究人员快速评估基因变异影响提供了新资源。

9月4日週五
  1. Google Research74

    Google Research 发布雄性果蝇完整大脑连接图谱

    Google Research 与 HHMI Janelia 及多所高校合作,发布了包含超过 16.6 万个神经元和 1.25 亿个突触连接的雄性果蝇完整大脑及中枢神经系统连接图谱。该图谱利用 AI 技术将电子显微镜图像重建为 3D 结构,并经过人工校对验证,为研究大脑工作机制提供了重要资源。相关成果已发表在 Cell 期刊上。

    推薦理由:该研究发布了迄今规模最大的完整雄性果蝇大脑及中枢神经系统连接图谱,为神经科学研究提供了重要基础资源。