在一連串駭客攻擊事件後,英偉達推出工具,可在“幾毫秒內”阻止惡意AI代理

2026年9月29日

 

美國晶片製造商英偉達(Nvidia)星期一(9月28日)發佈了一款安全平臺,稱該平臺能夠阻止人工智慧代理失控。此前,多家領先的人工智慧公司披露,他們的系統曾侵入其它組織。

開放代理安全平臺(Open Agent Safety Platform)主要由兩部分組成。OpenShell 是一款開源軟體,英偉達於今年 3 月首次公佈,目前已廣泛開放使用。它為人工智慧智慧體的行為設定邊界,並在運行過程中追蹤其行為。Sentry 運行在英偉達的一款獨立晶片(稱為資料處理單元)上,獨立監控代理行為。

英偉達副總裁賈斯汀·博伊塔諾(Justin Boitano)在媒體簡報會上對記者說,“它可以在幾毫秒內隔離可疑代理。”

博伊塔諾說,“OpenShell控制代理的行為,然後Sentry獨立監控並遏制可疑行為。”

博伊塔諾還說,這個平臺本可以阻止OpenAI的大量代理入侵人工智慧公司Hugging Face的事件,英偉達已同意收購這家公司。

他說,“據我們所知,如果這個新的安全平臺早期就被用於前沿實驗室的模型評估,那它本可以阻止這次入侵。”

Hugging Face被入侵後,OpenAI模型還發生了其它一些事件,包括澳大利亞衛生部門網站遭到入侵。Anthropic和Meta也披露,他們的AI系統曾自行入侵其它組織。

研究實驗室Transluce上星期說,與OpenAI相關的代理已經探測或試圖訪問美國和澳大利亞政府網站。OpenAI證實,美國證券交易委員會(SEC)網站、美國人口普查局資料均出現異常活動,美國教育部網站也曾被入侵但未成功。

澳大利亞同時表示,OpenAI的一個代理在6月份訪問了政府統計門戶網站。

OpenAI公司發言人莉茲·博日瓦澤(Liz Bourgeois)說,OpenA最近暫停了對其最先進模型的訓練。她說,“人們想知道人工智慧的開發是否安全,而這首先要從像我們這樣的公司做起。”

英偉達創始人兼首席執行官黃仁勳(Jensen Huang)星期一在一份公司聲明中說,業界必須解決人工智慧安全問題。

黃仁勳說,“只有解決人工智慧安全問題,人工智慧對社會的巨大潛力才能實現,”“在我們繼續探索人工智慧能力前沿的同時,我們也必須加快人工智慧安全前沿領域的探索。”

英偉達說,已有100多家機構正在使用這個平臺的技術,包括微軟、埃森哲、摩根大通和Anthropic。

Anthropic首席商務官保羅·史密斯(Paul Smith)在英偉達的聲明中說,“企業正在將更多最重要的工作交給人工智慧代理,他們需要指導和驗證這些代理的行為,尤其是在敏感環境中。”

英偉達說,SpaceXAI正在使用這個平臺來實現其Cursor編碼代理和Grok模型。

此次發佈正值白宮尋求加快美國人工智慧發展之際。唐納德·川普(Donald Trump)總統6月簽署的行政命令《促進先進人工智慧創新與安全》指示聯邦機構加強政府電腦系統,並與業界合作建立人工智慧網路安全資訊交流中心。它要求人工智慧公司在發佈前最多30天內自願與政府分享其最先進的模型,並禁止強制許可。

川普本月拒絕了業界要求對人工智慧施加新限制的呼籲。川普9月14日在真相社交(Social Truth)上的一篇貼文中寫道,“人工智慧唯一需要的控制或‘護欄’就是一位強大而聰明(高智商!)的總統,而美國在這方面人才濟濟!”川普曾說,不應以安全問題為由阻礙美國公司與中國競爭。

 

source: 
美國之音