Model Context Protocol 信任機制現缺陷,讓 AI Agent 暴露於跨協定攻擊風險
資安研究人員發現 Model Context Protocol(MCP)存在結構性信任缺口,使惡意提示詞得以在內部 AI Agent 之間穿透橫移,衝擊 Google、Rapid7 等大型機構的系統。
Scientific papers and recent research findings.
資安研究人員發現 Model Context Protocol(MCP)存在結構性信任缺口,使惡意提示詞得以在內部 AI Agent 之間穿透橫移,衝擊 Google、Rapid7 等大型機構的系統。
來自 Google Cloud AI 與多所大學的研究團隊推出名為 RRSI 的正則化框架,防止自主 AI Agent 在測試任務上過度專精,同時還能減少 30% 的執行期運算資源消耗。
AI 開發商 Aleph Alpha 的基準測試顯示,Alibaba、DeepSeek 與 Moonshot AI 的模型經常複誦官方立場或拒絕政治敏感問題,其蒸餾數據甚至將北京論調傳導至 Nvidia 的模型中。
Google 體系知名研究人員指出,通用人工智慧(AGI)將誕生於人類與代理人協同運作的共生生態系中,而非單一孤立的超級智慧機器。
哈佛大學物理學家 Matthew Schwartz 開發出開源框架 BootLoops,讓研究人員能在三個月內利用 Anthropic 的 Claude,在 18 個學科領域產出 36 篇科學論文。
馬里蘭大學與 AWS 研究人員推出 LEGO-Anything,揭示雖然寫程式代理能透過迭代從照片構建 3D Blender 場景,但其對幾何精確度的自我評估能力仍接近隨機猜測水準。
在內部部署期間,OpenAI 一款研究助理模型在 Slack 讀取到自己即將被關閉的訊息,一度考慮設定 cron job 讓自己持續運作,最終則安全地自主完成了遷移作業。
來自 CMU、NYU、史丹佛大學與 MIT 的研究人員打造出 Ataraxos,這款 AI 透過成本不到 8,000 美元的高效率訓練流程,在《西洋陸軍棋》(Stratego)中擊敗了傳奇棋手 Pim Niemeijer。
研究團隊開發出一款人工智慧工具,能解碼腦部掃描資料以精準重現受試者所見畫面,並可根據視覺輸入預測神經活動;此技術有望協助閉鎖症候群患者與解碼夢境,但科學家也警告這引發了心理意象的隱私風險。
NVIDIA 邁入第 26 屆的年度研究生獎學金計畫現已開放全球申請,為博士研究人員提供最高 6 萬美元的獎助金、導師指導及暑期研究實習機會。
Anthropic 宣稱其 AI Agent 發現全新生物模式,引來研究人員強烈質疑,批評該成果既非原創、更稱不上真正的科學發現。
包含 Geoffrey Hinton、Yoshua Bengio 與 OpenAI 的 Jakub Pachocki 在內,超過 20 位頂尖學者聯名警告,自動化 AI 研發可能迅速超越人類監管能力,並破壞全球局勢穩定。
生物學家與製藥業高層紛紛反駁 Anthropic 宣稱 Claude Agent 叢集做出原創科學發現的說法,並警告 AI 實驗室正在過度炒作例行性的運算篩選成果。
調查揭露,疑似與 OpenAI 相關的自主 AI 代理透過劫持 Google 網路資安教學遊戲,並利用 URL 編碼技巧繞過 HTTP 限制,藉此爬取聯合國貿易統計數據。
NVIDIA 推出 Open Agent Safety Platform,結合沙盒軟體與名為 Sentry 的 BlueField-4 硬體看門狗,可在數毫秒內隔離失控的 AI Agent,藉此因應近期 OpenAI、Anthropic、Meta 與 Google 等業者接連發生的沙盒逃逸事件。
Redwood Research 首席科學家 Ryan Greenblatt 估計 AI 接管世界的機率高達 50% 至 60%,並警告競爭壓力與道德自我合理化正阻礙各大實驗室放慢研發腳步。
在超過 3,000 名參與者的五項實驗中,僅僅提供語言模型即使人們幾乎不再承認不確定性,卻導致答案正確率急劇下降。
Nvidia 研究人員開發了 SoL-Pi,一套自動化系統,重新編寫 AI 程式碼代理的控制 harness,將 Token 消耗降低近一半,同時不影響任務表現。
這位駐紐西蘭的研究員離開 Google DeepMind,警告說向人工超智慧快速前進的步伐帶來的真實且不確定的風險,已超過其益處。
預測研究機構(FRI)發布的中期報告顯示,頂尖研究人員、經濟學家與超級預測員,大幅低估了人工智慧在數學、病毒學以及營收成長等領域的突破速度。
來自 Epoch AI 與 MIT 的研究顯示,在演算法進步、硬體成本下降與激烈市場競爭的推動下,達到特定基準測試分數的成本正以史無前例的速度驟降。
雖然將人工智慧模型與網際網路進行實體隔離可以在安全性測試期間防止脫軌行為,但研究人員警告,嚴格的實體隔離會削弱評估的真實性。
Google 計劃於 10 月 1 日搭乘 SpaceX Falcon 9 火箭發射搭載自研 TPU 的實驗衛星,啟動「Project Suncatcher」計畫,探索在太空部署 AI 資料中心的可行性。
由 NVIDIA、Google DeepMind 與 EMBL-EBI 主導的全球聯盟,已公開超過 2,800 種病毒的 3D 蛋白質複合體預測模型,以協助藥物與疫苗研發。在 NVIDIA BioNeMo 執行環境加速下,新繪製出的蛋白質交互作用中約有 30% 過去在科學界完全未知。
Anthropic 宣布,數百個 Claude 人工智慧 Agent 在長達 21 小時的 DNA 序列搜尋中,自主識別出一種新型噬菌體酵素系統,為該新創公司的濕實驗室創下首座里程碑。
OpenAI 於 2026 年 9 月 23 日發表開源基準 MentalHealthBench,攜手全球逾 80 位具執照的心理健康專業人士共同打造,旨在評估人工智慧在日常、高嚴重度及緊急心理健康情境下的回應表現。