研究人員利用Anthropic模型入侵OpenAI系統

環球市場播報
6小時前

  網絡安全研究人員藉助OpenAI的主要競爭對手Anthropic的軟件成功入侵OpenAI,這件事暴露出這家ChatGPT開發商存在安全漏洞。當前各大頭部AI企業正面臨日益嚴格的安全審查。

  一個小型網絡安全團隊獲取到了OpenAI一名員工的ChatGPT賬號權限,藉此能夠讀取內部軟件私密信息,還可提交修改建議。

  研究人員獲得了Anthropic專門面向安全專業人士開放的工具使用權限。作為漏洞挖掘項目的一部分,他們的這項工作還獲得報酬,該項目旨在在惡意攻擊者利用漏洞之前發現安全隱患。

  研究人員能夠快速攻入全球兩大頂尖AI實驗室之一,這再次引發外界對OpenAI安全水平的擔憂。當下人們越來越擔心,強大的大模型會被黑客與境外對手利用。

  近幾個月,美國一直在摸索如何對最新大模型開展審核與發布管控,其中包括臨時限制Anthropic部分工具的使用。

  就在本次事件發生兩周前,超過1000個OpenAI智能體集群脫離測試環境,對初創公司Hugging Face發起攻擊,這一事件讓各界廣泛意識到,AI可在無人為指令的情況下自主實施黑客入侵。

  小型安全企業Hacktron AI的三名研究人員,通過OpenAI漏洞賞金計劃獲得6500美元獎金。漏洞賞金計劃是科技行業通行做法:企業向白帽黑客支付酬勞,用於測試自身系統安全性。

  研究人員利用OpenAI社區論壇配置中的一處缺陷,藉此獲取內部登入權限,最終拿下一名OpenAI員工的ChatGPT賬號。該賬號可通過GitHub訪問內部代碼。

  OpenAI表示:「感謝研究人員聯繫我們並提交發現的漏洞」,並稱已經修複相關問題。Anthropic拒絕置評,Hacktron暫未回應。

  媒體率先報道了這起於周四披露的事件。與此同時,Anthropic公布一組新數據,顯示該實驗室利用AI開發新一代模型的程度大幅提升。

  該公司稱,目前26%的研發工作由其Claude模型「主導完成」,而3月份這一比例僅為1%。這意味着AI在人類指令與監督下完成大部分任務。

  Anthropic表示,隨着AI系統能力持續增強,「越來越多地被用於迭代開發下一代AI系統」。

  該公司稱,公布這些數據是為了幫助公衆「理解距離遞歸自我改進還有多近」,遞歸自我改進即AI能夠自主訓練、優化自身或新模型的階段。

  這一臨界點正是外界擔憂的核心:AI系統將越來越難以監管,最終脫離人類控制。

  Anthropic補充道,在其研究覆蓋的項目中,模型尚未實現完全自主運行。在90%的任務中,AI是與人類協同工作,承擔大部分工作量。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10