跳到正文

DeepSeek

DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。

最新精選

第 1–2 條 · 共 2 條
9月17日週四
8月19日週三
  1. Hugging Face Blog65

    智能体究竟需要多少记忆容量:ALTK-Evolve 评测与剂量校准方法

    Hugging Face 团队发布研究探讨如何为 AI 智能体配置自蒸馏记忆,评估了从 30B 到前沿模型的 8 款模型在 AppWorld 基准上的表现。研究发现智能体记忆效果取决于模型能力层级:强模型适合注入完整记忆,较弱模型适合精选检索,而已饱和模型则无明显增益。精选检索能在仅增加 5% token 的情况下使 gpt-oss-120b 任务完成度提升 16.1 个百分点。

    推薦理由:研究表明智能体记忆容量需要根据模型能力进行校准而非盲目堆砌,为提升准确率和控制成本提供了实践参考。