跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精選

第 1–13 條 · 共 13 條
今天10月1日週四
  1. The Decoder77

    OpenAI 移除模型推理盜取行動,手段仍在 Azure 上有效

    OpenAI 已停止一項針對其模型推理的盜取行動,然而同樣手段在 Microsoft Azure 上仍能取得推理內容。 - 攻擊方式:利用加密推理輸出,將其複製到另一對話並解密,讓低成本模型充當「解密 oracle」。

    推薦理由:OpenAI 透漏其對模型推理被盜取的防禦措施,揭示雲端平台安全差異,對 AI 產業防護策略具有參考價值。

  2. Andrej Karpathy (@karpathy)63

    Claude Tag 讓團隊可在 Slack 內直接召喚 Claude,提升協作效率並減少切換成本。 - 功能:在 Slack 中以團隊成員身份加入 Claude,並可標記 (Tag) 其進行任務委派。 - 整合:支持跨工具、整合計算環境與記憶體,實現無縫工作流程。 - 使用場景:適用於需要在多個頻道協同工作的團隊,減少切換工具的時間。

    推薦理由:Claude Tag 讓團隊可在 Slack 內直接召喚 Claude,提升協作效率並減少切換成本。

  3. Dario Amodei (@DarioAmodei)72

    Anthropic 發布了一篇關於 AI 產業應放緩的文章,並提出三步計畫。 三步計畫:第一步由 Anthropic 單方面承諾,提供第三方評估者永久、員工級別的存取權。 安全與對齊:文章強調放緩對安全與對齊的重要性。 行業影響:此舉可能促使其他公司考慮類似措施。

    推薦理由:文章闡述 AI 產業放緩的重要性,並提供可落實的三步計畫,對安全與對齊議題具有參考價值,對未來 AI 發展方向提供警示與可行路徑。

9月30日週三
  1. AWS Machine Learning Blog66

    AWS 推出 Claude Sonnet 5.5

    AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform 上可用,具备更高的编码与知识工作效率及更低的单任务成本。该模型适合处理范围明确的持续工作负载,支持与 Claude Opus 5.5 搭配使用以兼顾复杂判断与快速执行,用户可通过控制台或 API 进行调用。

    推薦理由:原文公布了该模型在特定平台上的可用性与技术改进,读者可以据此评估其在自动化任务中的成本与性能表现。

9月29日週二
  1. Latent Space78

    Claude Code 新纪元:Anthropic 研发者 Thariq Shihipar 访谈

    Anthropic 在 AI Engineer New York 会议上公布了 Claude Code 的最新功能,包括 Claude Tag、Sonnet 5.5、Mods 系统和插件门户。Thariq Shihipar 在访谈中阐述了提示技巧、Artifacts、Mods 等如何提升智能体的定制化与安全性,并讨论了 Agent 安全与“Pacing the Frontier”议题。

    推薦理由:Claude Code 新功能揭示可定制化智能体的未来,读者可了解如何通过 Mods 与插件提升工作效率与安全性。

9月25日週五
  1. Vercel Blog69

    Agent 技能生态现状报告

    Vercel 在博客中公布了 skills.sh 注册表在七个月内达到一百万技能、近 2.8 亿次安装的报告。报告显示,跨行业技能占 66% 的注册量,安装量占 87.5%,并指出安装高度集中,最受欢迎的 0.04% 技能贡献了 62% 的安装。

    推薦理由:报告展示了 skills.sh 生态的爆发式增长与安装分布,为评估 Agent 技能市场潜力提供数据依据。

9月23日週三
  1. Latent Space95

    Anthropic 发布 Claude Opus 5.5 与 OpenAI 推出 GPT-6 Sol 和 Luna 模型

    Anthropic 发布了 Claude Opus 5.5,主打 Fable 5.1 级能力与更低运行成本,随后 OpenAI 推出了降价幅度和性价比更高的 GPT-6 Sol 与 Luna 模型。两家实验室均在效率优化与定价上展开竞争,同时社区也围绕基准评测和多Agent扩展展开了广泛讨论。

    推薦理由:文章梳理了两家头部厂商最新旗舰及平价模型的性能与定价策略,读者可据此对比当前前沿模型的综合性价比。

  2. Simon Willison86

    Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna 与新一轮价格战

    Anthropic 发布了 Claude Opus 5.5,其输入输出价格较前代降低 20%,缓存读取价格降低 60%,并在高思考级别下遇到了超出最大输出 token 限制的问题;随后 OpenAI 发布了 GPT-6 Sol 与 GPT-6 Luna,价格降至同级前代型号的一半。两家厂商通过密集发布新模型和大幅降价,进一步加剧了 AI 模型的市场价格战。

    推薦理由:文章记录了多款旗舰模型密集发布与降价的情况,读者可以据此了解当前各大厂商在推理模型定价与性能上的最新竞争格局。

9月22日週二
  1. Vercel Blog78

    Claude Opus 5.5 在 AI Gateway 上可用

    Anthropic 的 Claude Opus 5.5 已在 AI Gateway 上上线,支持 1M-token 上下文窗口和 128K 输出 token。与 Opus 5 相比,速度提升约 30%,成本降低约 40%。

    推薦理由:Opus 5.5 在速度和成本上相较前代提升显著,适合需要大上下文和长任务的智能体工作,其 1M-token 上下文窗口和 128K 输出令长任务更易监督,且支持自动工具选择,提升开发效率。对开发者而言,Opus 5.5 的速度与成本优势可显著降低项目迭代周期。

9月17日週四
  1. Latent Space77

    AINews:近期前沿模型动态、智能体工程落地与开源生态进展

    Latent Space 发布了最新一期 AINews,重点报道了多项前沿 AI 进展:OpenAI 推出了模型失配披露机制,Databricks 针对约 3500 名工程师部署了 GPT-6 Astra,部分团队开始在生产环境评估智能体编码的成本与收益。同时,开源与推理基础设施持续演进,多款开源模型及量化工具在社区获得广泛讨论。

    推薦理由:原文梳理了近期前沿模型的工程落地表现与行业动态,有助于读者直接评估智能体在实际生产环境中的成本与性能表现。

8月19日週三
  1. Hugging Face Blog65

    智能体究竟需要多少记忆容量:ALTK-Evolve 评测与剂量校准方法

    Hugging Face 团队发布研究探讨如何为 AI 智能体配置自蒸馏记忆,评估了从 30B 到前沿模型的 8 款模型在 AppWorld 基准上的表现。研究发现智能体记忆效果取决于模型能力层级:强模型适合注入完整记忆,较弱模型适合精选检索,而已饱和模型则无明显增益。精选检索能在仅增加 5% token 的情况下使 gpt-oss-120b 任务完成度提升 16.1 个百分点。

    推薦理由:研究表明智能体记忆容量需要根据模型能力进行校准而非盲目堆砌,为提升准确率和控制成本提供了实践参考。

7月7日週二
  1. Berkeley AI Research62

    Intelligence is Free, Now What? Data Systems for, of, and by Agents

    伯克利人工智能研究院(BAIR)团队探讨了推理成本大幅下降后数据系统面临的新机遇与新挑战,指出未来数据系统需要围绕 Agent 的交互、底层协同及自主合成三个维度进行彻底重构。文章重点分析了 Agent 推理带来的高并发复杂查询需求、多 Agent 协作所需的状态管理机制以及利用 Agent 从零自主合成专用数据系统的方法。

    推薦理由:文章探讨了零成本推理时代对数据系统的影响,提出了面向、由和基于 Agent 的三大数据系统设计方向,为理解未来智能基础设施演进提供了前瞻视角。