推薦理由:Gemini 4 Argon 代表 DeepMind 在前沿 AI 领域的又一突破,先行向政府與網路防禦者開放,提示其在安全與責任部署方面的先行實踐。
模型发布
全部主題新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。
最新精選
第 1–20 條 · 共 72 條Demis Hassabis (@demishassabis)@demishassabis精選AI 評分6666 Google DeepMind精選AI 評分7272 Gemini 4 Argon 发布:开启前沿智能新时代
Google DeepMind 推出了 Gemini 4 Argon,这是一款具备长推理、跨领域多模态能力的前沿模型。Argon 在软件工程、金融、法律和网络安全等行业基准上刷新记录,并已在内部工作流中提升效率;其 1M token 输出上限和 $2/百万输入、$10/百万输出的价格为开发者提供更高性价比。
推薦理由:Gemini 4 Argon 通过大幅提升推理长度和多模态能力,显著提升软件工程、金融与网络安全等领域的工作效率,并在多项行业基准上刷新记录,帮助企业加速技术迭代。
Google DeepMind精選AI 評分6363 Google DeepMind 发布 SynthID Bio 为生成式生物学引入水印技术
Google DeepMind 推出了 SynthID Bio,这是一种专为合成生物学开发的水印技术,可在保持蛋白质生物功能的同时,将不可见的标记直接嵌入氨基酸序列和预测的 3D 结构中。该技术通过了湿实验室对靶向蛋白质的测试,并对 AlphaFold 3 的扩散网络及 Evo 2 基因组模型进行了适配,旨在加强生物安全性并确保科学数据的完整性。
AWS Machine Learning Blog精選AI 評分6666 AWS 推出 Claude Sonnet 5.5
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform 上可用,具备更高的编码与知识工作效率及更低的单任务成本。该模型适合处理范围明确的持续工作负载,支持与 Claude Opus 5.5 搭配使用以兼顾复杂判断与快速执行,用户可通过控制台或 API 进行调用。
推薦理由:原文公布了该模型在特定平台上的可用性与技术改进,读者可以据此评估其在自动化任务中的成本与性能表现。
Vercel Blog精選AI 評分6565 Ling 3.1 Flash 现已在 AI Gateway 上可用
Ling 3.1 Flash 是 InclusionAI 推出的混合推理语言模型,现已在 AI Gateway 上免费使用至 2026 年 10 月 13 日。
推薦理由:Ling 3.1 Flash 提供 262K token 上下文窗口和 560B 参数的混合推理能力,专为编码与多步分析设计,读者可评估其在 AI Gateway 上的应用潜力与成本优势。
AWS Machine Learning Blog精選AI 評分6666 GPT-6.1 Sol 现已登陆 Amazon Bedrock
GPT-6.1 Sol 现已在 Amazon Bedrock 上全面可用,为编码、计算机使用和专业工作负载带来更强的推理能力。该模型在 DeepSWE v1.1 上以约五分之一的单任务成本实现了接近 GPT-6 Astra 的表现,并在复杂文档分析和多步骤工作流上超越了 GPT-6 Sol。
推薦理由:原文公布了模型在亚马逊云科技平台上的可用性和基准表现,读者可以据此评估其在自动化工作流中的性价比与落地可行性。
Hugging Face Blog精選AI 評分6464 NVIDIA 发布开源表格基础模型 Kumo Tabular
NVIDIA 发布开源表格基础模型 Kumo Tabular,采用 Transformer 架构,无需训练、调参或特征工程即可在单次前向传播中完成分类与回归预测。该模型提供 28M 到 215M 三种参数规模,完全基于人工合成数据进行预训练,并在 TabArena、BeyondArena、TALENT 和 ScoringBench 四个基准测试中排名第一。
推薦理由:该模型不经微调即可直接预测表格数据,读者可以据此评估它在企业级结构化数据预测任务中的应用潜力。
OpenAI News精選AI 評分8686 OpenAI 发布 GPT-6.1 Sol
OpenAI 发布 GPT-6.1 Sol,具备接近 Astra 的编码、电脑操作和专业工作智能,且 API 输入输出 token 价格降至 Astra 标准价格的五分之一。
推薦理由:原文给出了新模型的定位、核心能力与价格降幅,读者可以据此判断它会怎样改变日常开发与专业工作流。
Vercel Blog精選AI 評分7171 GPT-6.1 Sol 在 AI Gateway 上可用
OpenAI 的 GPT-6.1 Sol 现已在 Vercel AI Gateway 上上线。该模型在编码、电脑使用和专业工作方面相较 GPT-6 Sol 有显著提升,能够更好地阅读复杂文档、执行多步工作流、调试代码、处理业务任务,并从包含表格和图表的 PDF 中提取答案。
推薦理由:GPT-6.1 Sol 在 AI Gateway 上提供更精准的编码与文档处理能力,并以更低成本满足多步工作流需求。
Hugging Face Blog精選AI 評分8383 Hcompany 发布 Holo4 系列智能体模型与 Holotron4 Nano
Hcompany 发布全新智能体模型系列 Holo4,包含 27B dense 与 35B-A3B Mixture of Experts 两个尺寸,并同步推出更新版 Holotron4 Nano。该系列模型支持 GUI、代码、MCP 与 API 等多种交互界面,在 OSWorld 2.0 等基准测试中表现优异,相关权重与轨迹数据已在 Hugging Face 开源。
推薦理由:文章公布了新模型的大小、接口和基准测试表现,读者可以据此了解其在复杂工作流中的表现。
Google DeepMind精選AI 評分8484 Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款全新语音生成模型,支持超过 100 种语言的自然语言提示词声音设计、30 秒声音复刻以及逐行台词精细导演。
推薦理由:官方发布的最新语音生成模型提供了细粒度的台词导演和声音定制能力,读者可以据此评估其在多语言配音与智能体交互中的实际表现。
Latent Space精選AI 評分9595 Anthropic 发布 Claude Opus 5.5 与 OpenAI 推出 GPT-6 Sol 和 Luna 模型
Anthropic 发布了 Claude Opus 5.5,主打 Fable 5.1 级能力与更低运行成本,随后 OpenAI 推出了降价幅度和性价比更高的 GPT-6 Sol 与 Luna 模型。两家实验室均在效率优化与定价上展开竞争,同时社区也围绕基准评测和多Agent扩展展开了广泛讨论。
推薦理由:文章梳理了两家头部厂商最新旗舰及平价模型的性能与定价策略,读者可据此对比当前前沿模型的综合性价比。
Vercel Blog精選AI 評分6666 Gemini 3.8 TTS模型现已在AI Gateway上线
Gemini 3.8 Flash‑Lite TTS 与 Gemini 3.8 Flash TTS 现已在 AI Gateway 上线,支持 100 多种语言的文本转语音,支持长篇朗读、交付控制和双人对话。
推薦理由:Gemini 3.8 TTS模型已在AI Gateway上线,支持100多种语言、长篇朗读和双人对话,开发者可通过AI SDK轻松生成语音。
Simon Willison精選AI 評分8686 Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna 与新一轮价格战
Anthropic 发布了 Claude Opus 5.5,其输入输出价格较前代降低 20%,缓存读取价格降低 60%,并在高思考级别下遇到了超出最大输出 token 限制的问题;随后 OpenAI 发布了 GPT-6 Sol 与 GPT-6 Luna,价格降至同级前代型号的一半。两家厂商通过密集发布新模型和大幅降价,进一步加剧了 AI 模型的市场价格战。
推薦理由:文章记录了多款旗舰模型密集发布与降价的情况,读者可以据此了解当前各大厂商在推理模型定价与性能上的最新竞争格局。
OpenAI News精選AI 評分6161 OpenAI 发布 GPT-6 Sol 与 Luna 模型
OpenAI 发布了 GPT-6 Sol 与 Luna 两个新模型,为日常工作提供了不同能力与成本平衡的选择。
推薦理由:官方推出了两个新模型,为日常工作提供了不同能力与成本的平衡选择。
Vercel Blog精選AI 評分6767 GPT‑6 Sol 与 Luna 在 AI Gateway 上线
OpenAI 的 GPT‑6 Sol 与 GPT‑6 Luna 现已在 AI Gateway 上线,价格低于 GPT‑6 Astra。Sol 适用于复杂编码与持续性探究的 agent 工作流,Luna 则是低成本的高频重复工作选项。两者相较 GPT‑5.6 在事实可靠性、直白沟通和减少误导性编码声明方面都有提升。使用时只需传入模型 ID,即可在模型演练区体验。
推薦理由:GPT‑6 Sol 与 Luna 在 AI Gateway 上线,价格更低且在代码与专业工作中提升事实可靠性,读者可评估其高频工作流价值。
Vercel Blog精選AI 評分7878 Claude Opus 5.5 在 AI Gateway 上可用
Anthropic 的 Claude Opus 5.5 已在 AI Gateway 上上线,支持 1M-token 上下文窗口和 128K 输出 token。与 Opus 5 相比,速度提升约 30%,成本降低约 40%。
推薦理由:Opus 5.5 在速度和成本上相较前代提升显著,适合需要大上下文和长任务的智能体工作,其 1M-token 上下文窗口和 128K 输出令长任务更易监督,且支持自动工具选择,提升开发效率。对开发者而言,Opus 5.5 的速度与成本优势可显著降低项目迭代周期。
Simon Willison精選AI 評分8383 Simon Willison 评测 TypeSafe AI 推出的 Jev 决策模型
TypeSafe AI 近期推出了名为 Jev 的 System One 决策模型,它接收非结构化文本输入并返回对应类别的浮点数置信度分数。Jev 仅对输入收费且价格低至每百万 token 0.042 美元,支持 Yes/No、多选和评分三类问题并在后台并行评估。作者指出 Jev 的黑盒特性和偏差问题需要谨慎对待,但社区已围绕其展开了丰富的创意应用和开源复现尝试。
推薦理由:原文介绍了 TypeSafe AI 推出的决策模型 Jev 及其独特的工作机制和定价模式,读者可以借此了解这类新型模型在分类与检索重排场景中的应用与局限。
Vercel Blog精選AI 評分7272 Jev 是 AI Gateway 歷史上最快被採用的模型
Jev 在 AI Gateway 上的首日採用率突破 GPT‑5.6 兩倍,證明專門化決策模型能迅速進入實際工作流程。 - 首日採用率:24 小時內已達 13% 的付費團隊使用,超過 GPT‑5.6 兩倍、Fable 5.1 六倍。
推薦理由:Jev 在 AI Gateway 上的首日採用率突破 GPT‑5.6 兩倍,證明專門化決策模型能迅速進入實際工作流程。
Latent Space精選AI 評分7777 AINews:近期前沿模型动态、智能体工程落地与开源生态进展
Latent Space 发布了最新一期 AINews,重点报道了多项前沿 AI 进展:OpenAI 推出了模型失配披露机制,Databricks 针对约 3500 名工程师部署了 GPT-6 Astra,部分团队开始在生产环境评估智能体编码的成本与收益。同时,开源与推理基础设施持续演进,多款开源模型及量化工具在社区获得广泛讨论。
推薦理由:原文梳理了近期前沿模型的工程落地表现与行业动态,有助于读者直接评估智能体在实际生产环境中的成本与性能表现。