跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精選

第 61–64 條 · 共 64 條
8月19日週三
  1. Hugging Face Blog65

    智能体究竟需要多少记忆容量:ALTK-Evolve 评测与剂量校准方法

    Hugging Face 团队发布研究探讨如何为 AI 智能体配置自蒸馏记忆,评估了从 30B 到前沿模型的 8 款模型在 AppWorld 基准上的表现。研究发现智能体记忆效果取决于模型能力层级:强模型适合注入完整记忆,较弱模型适合精选检索,而已饱和模型则无明显增益。精选检索能在仅增加 5% token 的情况下使 gpt-oss-120b 任务完成度提升 16.1 个百分点。

    推薦理由:研究表明智能体记忆容量需要根据模型能力进行校准而非盲目堆砌,为提升准确率和控制成本提供了实践参考。

8月4日週二
7月27日週一
7月7日週二
  1. Berkeley AI Research62

    Intelligence is Free, Now What? Data Systems for, of, and by Agents

    伯克利人工智能研究院(BAIR)团队探讨了推理成本大幅下降后数据系统面临的新机遇与新挑战,指出未来数据系统需要围绕 Agent 的交互、底层协同及自主合成三个维度进行彻底重构。文章重点分析了 Agent 推理带来的高并发复杂查询需求、多 Agent 协作所需的状态管理机制以及利用 Agent 从零自主合成专用数据系统的方法。

    推薦理由:文章探讨了零成本推理时代对数据系统的影响,提出了面向、由和基于 Agent 的三大数据系统设计方向,为理解未来智能基础设施演进提供了前瞻视角。