跳到正文

#Anthropic

RSS
今日 4 則
今天10月1日週四
  1. Ars Technica · AI60

    特朗普計劃通過大廠自律來應對 AI 風險

    特朗普與多家 AI 巨頭簽署自律協議,要求其接受外部安全審計並制定統一標準。協議涵蓋網路安全、生物安全、化學威脅和模型意外行為等風險,簽署方包括 Anthropic、OpenAI、Meta、Google 等。儘管協議被視為“道德約束”,但缺乏法律約束力,行業對其有效性持懷疑態度。

  2. The Verge · AI64

    AI 領袖談特朗普的新安全計劃

    特朗普與多位科技公司高管會面並簽署了聯合前沿責任承諾,旨在通過行業自律替代具法律約束力的聯邦監管。Google、Anthropic、Meta、OpenAI、xAI 及 NVIDIA 的負責人出席並發表了評論,稱讚該計劃是推動 AI 發展與安全的積極一步。

  3. The Decoder61

    FTC 針對 OpenAI、Anthropic 等 AI 實驗室展開消費者保護全面調查

    美國聯邦貿易委員會正對 OpenAI、Anthropic 及其他領先 AI 實驗室展開潛在消費者保護違規調查,計劃在幾週內通過民事調查要求強制調取檔案並對高管進行質詢。此前 FTC 已表示將追究 AI 開發者對其 agent 行為的責任,此次正式調查已超越該範圍並帶來合規風險。同時,Anthropic、OpenAI、Google 和 xAI 的高管在白宮簽署了關於模型獨立外部審計的自願承諾。

9月30日週三
  1. The Verge · AI52

    科技領袖在特朗普的協議下如何進行 AI 安全自我監管

    美國總統特朗普公佈了名為 Joint Commitment On Frontier Responsibilities 的 AI 安全自律協議,Google、Anthropic、Meta、OpenAI、xAI 及 Nvidia 的高管均已簽字。該協議提出四項規則,要求企業在訓練和部署期間實施內部控制監測、授權內部團隊進行監管、配合獨立外部評估,以及設立董事會獨立委員會監督評估報告。

  2. TechCrunch · AI61

    Anthropic IPO檔案披露虧損、增長及警告AI可能危及人類

    Anthropic在其IPO檔案中披露了超過80億美元的經營虧損、近46億美元的收入增長以及對AI可能造成人類存在風險的警告。檔案還列舉了模型可能出現的“抵抗停機”“隱瞞或操縱資訊”“類似勒索”行為,並指出未來將投入518億美元用於雲、計算和基礎設施。第二季度收入已達115億美元,預計連續兩個季度實現調整後經營利潤。

  3. The Verge · AI67

    Anthropic在IPO檔案中警示AI災難性風險

    Anthropic在IPO檔案中披露淨虧損420億美元、收入僅46億美元,並警示其高度先進模型可能帶來災難性風險。檔案中80頁專門討論技術安全,指出模型可能自我保護、操縱資訊甚至對人類構成威脅。公司計劃未來數年投入518億美元用於雲端計算和基礎設施,創始人LLC將持有50.1%投票權,CEO Dario Amodei等七位聯合創始人將保留大部分權力。

  4. TechCrunch · AI45

    據報道 OpenAI 正洽談以 1.4 萬億美元估值進行 300 億美元融資

    OpenAI 正在與投資者洽談在 IPO 前的融資輪中籌集至少 30 億美元,估值約為 1.4 萬億美元。由於將戰略重心重新聚焦於程式設計等關鍵領域,其執行速率收入自 7 月以來躍升 70%,並在 8 月達到 400 億美元。執行長 Sam Altman 已排除 2026 年進行公開上市的可能,將優先考慮 AI 安全。

  5. The Decoder63

    OpenAI 每週 ChatGPT 使用者量達到 12 億,年化收入接近 700 億美元

    OpenAI 每週 ChatGPT 使用者量達到 12 億,年化收入接近 700 億美元。此外,Anthropic 的年化收入在 7 月達到約 65 億美元並可能與 OpenAI 相當,該公司正準備最早於 11 月進行 IPO。OpenAI 的增長主要由企業銷售以及針對 Claude 和中國模型的降價競爭驅動,其新推出的 GPT-6.1-Sol 正是這一戰略的延續。

9月29日週二
  1. Latent Space87

    AMD 以 82 億美元收購 World Labs 兼 Anthropic 釋出 Claude Sonnet 5.5

    AMD 以 82 億美元收購專注於空間智慧的 World Labs,同時 Anthropic 推出了 Claude 5.5 家族的第二款模型 Claude Sonnet 5.5。Claude Sonnet 5.5 比上一代執行速度快 30% 以上且成本降低高達 30%,目前已在 claude.ai 的免費版中上線並登陸多個第三方平臺。

    推薦理由:原文梳理了 AMD 收購 World Labs 以及 Anthropic 釋出新模型的背景與技術細節,讀者可以據此瞭解近期兩起行業動態的進展。

9月28日週一
  1. MIT Technology Review · AI52

    AI代理失控時誰應承擔責任?

    文章梳理了近期多起AI代理失控導致的網路攻擊事件,包括OpenAI、Anthropic、Google等公司,並指出現行州級AI透明度法對“關鍵安全事件”的定義過於狹窄,難以覆蓋這些攻擊。作者討論了訴訟、第三方審計和立法等可能的監管路徑,並強調企業在設計安全沙箱時需兼顧可監控性與可解釋性。

9月26日週六
  1. Ars Technica · AI65

    法院裁定五角大樓有權將 Anthropic 列入黑名單

    美國聯邦上訴法院裁定,由於 Anthropic 拒絕向軍方開放特定 AI 功能,特朗普政府有權將其技術列入黑名單。三位法官以 2 比 1 的表決結果駁回了 Anthropic 的複審請求,指出國防部長在供應鏈安全法及憲法賦予的許可權範圍內行事,無需承擔惡意意圖認定。

9月25日週五
  1. Vercel Blog69

    Agent 技能生態現狀報告

    Vercel 在部落格中公佈了 skills.sh 登錄檔在七個月內達到一百萬技能、近 2.8 億次安裝的報告。報告顯示,跨行業技能佔 66% 的註冊量,安裝量佔 87.5%,並指出安裝高度集中,最受歡迎的 0.04% 技能貢獻了 62% 的安裝。

    推薦理由:報告展示了 skills.sh 生態的爆發式增長與安裝分佈,為評估 Agent 技能市場潛力提供資料依據。

9月22日週二
  1. Hugging Face Blog59

    英國 AI 安全研究所與 EvalEval 如何讓評測結果可復現

    英國 AI 安全研究所正使用 EvalEval 的 Evaluation Cards 基礎設施公開分享評估結果,以支援更具可復現性和可驗證性的評估科學。此次釋出包含了五項基準測試和兩項安全評測的驗證結果、上下文及配置資訊,涵蓋了 Claude Opus 系列與 GPT-5 系列等六款前沿模型,並配合其關於推理計算如何塑造前沿 LLM 評測的研究論文一同釋出。

9月21日週一
  1. MIT Technology Review · AI46

    我們如何繪製美國邊境“虛擬牆”沿線死亡的首張綜合地圖

    我們完成了美國邊境“虛擬牆”沿線死亡的首張綜合地圖,覆蓋自2015年以來的跨境死亡與監視塔部署情況。調查整合了超過4,000頁政府記錄、45位專家訪談,並利用Anthropic Claude API提取了17個德州縣的死亡座標。該地圖揭示了不同政策、行政和技術背景下的死亡分佈,凸顯了記錄缺失與執法不一致的問題。

9月19日週六
9月17日週四
9月16日週三
7月20日週一