AI 衝擊了應屆生就業嗎?最新經濟學研究資料表明並非如此
慕尼黑 CESifo 經濟學研究人員釋出的一項新工作論文顯示,目前沒有證據表明人工智慧對近期大學畢業生的絕對或相對就業水平造成了顯著、廣泛的替代或招聘減少。此前曾有斯坦福大學研究指出受 AI 影響職業的初級就業滯後,而該研究則聚焦於勞動力需求可能首先通過減少招聘體現的現象,並分析了近期企業增加 AI 支出和任務替代的背景。
慕尼黑 CESifo 經濟學研究人員釋出的一項新工作論文顯示,目前沒有證據表明人工智慧對近期大學畢業生的絕對或相對就業水平造成了顯著、廣泛的替代或招聘減少。此前曾有斯坦福大學研究指出受 AI 影響職業的初級就業滯後,而該研究則聚焦於勞動力需求可能首先通過減少招聘體現的現象,並分析了近期企業增加 AI 支出和任務替代的背景。
Latent Space 盤點了一週內 AI 行業的重大進展,涵蓋 Claude Opus 5.5、GPT-6 系列及 Gemini 3.8 Flash 等前沿模型的基準評測表現。同時梳理了決策模型、智慧體基礎設施、推理加速硬體以及生物基因領域的最新動態。
TypeSafe AI 近期推出了名為 Jev 的 System One 決策模型,它接收非結構化文本輸入並返回對應類別的浮點數置信度分數。Jev 僅對輸入收費且價格低至每百萬 token 0.042 美元,支援 Yes/No、多選和評分三類問題並在後臺並行評估。作者指出 Jev 的黑盒特性和偏差問題需要謹慎對待,但社群已圍繞其展開了豐富的創意應用和開源復現嘗試。
推薦理由:原文介紹了 TypeSafe AI 推出的決策模型 Jev 及其獨特的工作機制和定價模式,讀者可以藉此瞭解這類新型模型在分類與檢索重排場景中的應用與侷限。
Hugging Face 團隊推出了 NeoMME,這是一個包含 260M 和 800M 引數的多語言多模態基礎編碼器系列。該模型不使用單獨的視覺塔或因果語言模型,而是通過單個雙向 Transformer 同時處理文本 token 和原始影像塊。
推薦理由:原文釋出了不依賴獨立視覺塔的多模態雙向編碼器,讀者可以瞭解其單塔架構和檢索效能。
Allen Institute for AI 介紹了 BenchMIRT,這是一種用於在單個提示詞層面審計大模型基準測試的新方法。該方法將多維專案反應理論應用於 100 個大模型在 16 個基準測試中的表現,獨立恢復出安全與通用推理兩個主導維度,發現部分基準測試的實際測量結果與其宣稱的目標存在偏差。
Google Research 聯合 NASA JPL 推出了 MAPL-EMIT 深度學習框架,利用 Swin-S transformer 架構處理高光譜輻射測量資料,實現了甲烷羽流的自動檢測、定量增強預測和源頭定位。
Google DeepMind 推出全球首個專有前沿級別 AI 模型的雙盲評測,通過密碼學安全環境防止模型在測試前接觸到評測問題。該機制與新加坡人工智慧安全研究所、OpenMined、AVERI 及 MLCommons 合作,在隱私保護環境中對 Gemini Flash Lite 模型進行保密基準測試,以提升評測的完整性。
推薦理由:原文給出了基於密碼學環境開展模型評測的方案,讀者可以據此評估它將如何解決行業中普遍存在的基準汙染問題。
Sentence Transformers v6.0 版本引入了多向量檢索模型和完整的訓練方法。作者以醫療檢索領域為例,展示瞭如何在一塊消費級 GPU 上微調出一個超越各大通用檢索模型的領域專用模型。微調方法涵蓋了模型選擇、資料集格式、損失函式、訓練引數以及評估器等核心元件。
推薦理由:文章給出了多向量嵌入模型的完整訓練與微調步驟,讀者可以據此在特定領域獲得超越通用檢索模型的效果。
一項研究表明,大模型在網路安全領域帶來了大幅加速,在數學研究中帶來了較小加速,而在 AI 自身研究中尚未帶來可測量的加速。多所高校研究者聯合推出了 SPADE,這是一個通過自我對弈協同演化環境合成與智慧體能力的通用框架。該框架在 30B 規模下利用 Qwen3 骨幹網路進行了測試,在遊戲和工具使用環境評測中均提升了效能。
Hugging Face 最新研究引入了三項測試,用於量化語音識別模型中的基準測試最佳化(benchmaxxing)現象,評估了 11 個開源 ASR 模型後發現部分高分系統會復現基準測試中的錯誤轉錄、填補被靜音的數字並根據資料集調整拼寫習慣。
推薦理由:研究指出語音識別模型會利用音訊中的線索復現公開測試集的錯誤和拼寫習慣,這有助於理解如何通過獨立測試集評估模型真實效能。
Hugging Face 舉辦了一場使用編碼智慧體逐條復現 ICML 2026 論文的駭客松,1,221 名參與者在 19 天內釋出了 6,816 份日誌並嘗試復現了 2,226 篇論文。
推薦理由:文章公佈了大規模智慧體復現學術論文的成果與發現,讀者可以從中瞭解自動化復現對檢驗科研質量的實際效果與侷限。
Google Research 介紹了知識 profiling 行為框架和 WikiProfile 基準,用以衡量大語言模型的編碼與檢索能力。研究表明,在 Gemini 3 和 GPT-5 等前沿大模型中,95% 至 98% 的事實已被編碼,但模型仍無法直接檢索其中 26% 至 34% 的事實。這說明事實性錯誤主要源於知識無法可靠呼叫的檢索失敗,而非知識未被編碼的儲存缺失。
推薦理由:研究指出前沿大語言模型的知識編碼已接近飽和,準確率瓶頸在於檢索而非儲存,為後續訓練與推理最佳化提供了新方向。
本期 Import AI 涵蓋多項重要進展,包括研究人員開發出利用開源 LLM 自主傳播的 AI 計算機病毒原型,探討了智慧提升導致的算力成本變化,各大 AI 實驗室高管呼籲美政府支援國際協作以放緩前沿自動研發速度,分析了當前 AI 系統在工程能力與創造力上的表現差異,以及 OpenAI 使用內部模型 Astra 解決數學和電腦科學領域的十個開放問題。
本文闡述了多學科證據表明,在有限資源下,專業化是 AI 系統發展的必然趨勢。作者引用了最佳化理論、進化生物學、競爭市場和機器學習的研究,指出專注於特定任務的系統往往能獲得更高效能,並以 AlphaFold 等案例說明了這一點。
DiScoFormer 是一款基於 Transformer 架構的新型模型,只需單次前向傳播即可同時估計分佈的密度與得分且無需重新訓練。在 100 維測試中,它將得分誤差降低約 6.5 倍,密度誤差降低超過 37 倍。該模型以高斯混合模型進行訓練,能夠適應分佈外輸入並在多個領域中複用。
Google Research 提出了線性彈性快取方法,將頁面驅逐建模為滑雪租賃問題,並利用輕量級機器學習動態調整快取大小。在 Spanner 生產工作負載的測試中,該方法使記憶體使用量減少了 15.5%,快取命中率略有下降,並將總擁有成本(TCO)降低了約 5%。
研究表明 AI 系統在文本說服力和真實世界行為中超越了人類專家,其中 Opus 4.1、Opus 4.20、GPT-4o、GPT-5.4、Gemini 2.5 Pro 及 Grok 4.20 表現最強。該結論基於包含 18,978 場對話和 6,923 名參與者的四項實驗,實驗顯示 AI 在為 Save the Children 籌款時的效果是英國專業募捐者的近 3 倍。
Google DeepMind 釋出了採用 Apache 2.0 協議開源的實驗性模型 DiffusionGemma,這是一款基於 Gemma 4 家族和 Gemini 擴散研究的 26B MoE 文本擴散模型,可在專用 GPU 上實現高達 4 倍的文本生成速度。
推薦理由:該模型採用文本擴散架構實現數倍於傳統自迴歸模型的推理速度,為開發者探索本地即時互動工作流提供了新的硬體利用方式與微調路徑。
Mistral AI 通過收購 Emmi AI 致力於構建面向航空航天、汽車、半導體和能源等物理世界工業的基礎 Physics AI。相關研究涵蓋跨音速湍流神經代理模型資料集、計算流體力學中的 AI 基礎模型以及 AB-UPT 等前沿技術突破。
Google 釋出由 Gemini 驅動的科研輔助工具 Empirical Research Assistance(ERA),可用於編寫和最佳化科學程式碼,並在《Nature》雜誌上發表了相關論文。
推薦理由:Google 推出基於 Gemini 的科研輔助工具 Empirical Research Assistance,讀者可以瞭解其在多學科科學發現中的應用例項和開放入口。
GRASP 是一種新的梯度規劃器,針對學習到的世界模型實現長時序規劃。它通過將軌跡提升到虛擬狀態實現並行最佳化、在狀態迭代中加入噪聲以增強探索、並重塑梯度以避免脆弱的狀態輸入梯度,從而顯著提升規劃魯棒性和速度。實驗顯示在 Push‑T 任務中,GRASP 在更長時間步上取得更高成功率且耗時更短。詳情見論文 https://arxiv.org/abs/2602.00475。
推薦理由:GRASP 通過提升狀態、加入噪聲與梯度重塑,解決了大規模世界模型長時序規劃的梯度爆炸與不穩定問題。
Google Research 推出了名為 MoGen 的開源神經形態生成模型,利用 point cloud flow matching 模擬逼真的 3D 神經元形狀以增強訓練資料。將 MoGen 生成的合成數據加入訓練管道,使重構錯誤率降低了 4.4%,並顯著減少了未來全腦對映所需的人工校對工作量。
伯克利人工智慧研究團隊發表論文,為經典語言建模任務 word2vec 的學習過程提供瞭解析理論。研究證明在實際訓練設定下,該學習問題可簡化為無加權最小二乘矩陣分解,其梯度流動力學可通過閉式求解,學到的最終表徵即為主成分分析結果。