1. 創(chuàng)業(yè)頭條
  2. 前沿領(lǐng)域
  3. AI智能
  4. 正文

大語言模型數(shù)據(jù)泄露堪憂,超自動化Agent成解決之道

 2023-11-13 16:19  來源:A5專欄  我來投稿 撤稿糾錯

  阿里云優(yōu)惠券 先領(lǐng)券再下單

 

大語言模型數(shù)據(jù)泄露堪憂,超自動化Agent成解決之道

數(shù)據(jù)泄露成LLM應(yīng)用最大障礙,看實在智能如何用AI Agent破解謎題

從實在RPA Agent智能體安全機制,看AI Agent如何破解LLM應(yīng)用安全謎題

文/王吉偉

阻礙廣大企業(yè)應(yīng)用大語言模型(LLM,Large Langeuage Models)的諸多因素中,無疑數(shù)據(jù)安全是最重要的。

3月份ChatGPT發(fā)生了用戶隱私數(shù)據(jù)泄露事件,OpenAI聲明由于開源代碼庫中存在一個漏洞,使得部分用戶能夠看到另一個用戶的聊天標(biāo)題記錄,并把ChatGPT短暫下線緊急修補了此漏洞。

此事件,讓大家認(rèn)識到大模型并不是“大安全”。

更要命的,是用戶使用LLM時會不經(jīng)意輸入敏感數(shù)據(jù)。僅在三月份,三星內(nèi)部就發(fā)生了三起誤用及濫用ChatGPT案例,其中兩起關(guān)于三星半導(dǎo)體設(shè)備,一起關(guān)于三星內(nèi)部會議內(nèi)容。

以致有網(wǎng)友調(diào)侃,三星再多幾次敏感數(shù)據(jù)泄露,ChatGPT就能教大家制造先進芯片了。

在三星等多家企業(yè)出現(xiàn)事故后,很多企業(yè)都意識到了LLM使用可能造成的數(shù)據(jù)泄露問題。就在5月份,蘋果公司也限制員工使用ChatGPT和其他外部AI工具。當(dāng)然,蘋果公司也在開發(fā)自己的LLM產(chǎn)品。

不只是蘋果公司,摩根大通、美國電信運營商Verizon等公司都已經(jīng)宣布禁止使用ChatGPT等應(yīng)用,亞馬遜也希望工程師們使用內(nèi)部AI工具。

就在11月10日,投資了OpenAI并為廣大企業(yè)提供OpenAI云服務(wù)的微軟,因為擔(dān)心公司機密數(shù)據(jù)泄露,竟然也開始禁止員工使用ChatGPT,建議員工使用自家的Bing Chat工具。

出于數(shù)據(jù)安全憂慮,美國銀行、花旗集團、德意志銀行、高盛集團等多家金融機構(gòu)已經(jīng)禁止員工使用ChatGPT聊天機器人處理工作任務(wù),日本的軟銀、富士通、瑞穗金融集團、三菱日聯(lián)銀行、三井住友銀行等企業(yè),同樣限制了ChatGPT和類似聊天機器人的商業(yè)用途。

現(xiàn)在,這些企業(yè)有的與OpenAI合作進行了私有化部署,有的已經(jīng)研發(fā)了自有大語言模型。

數(shù)據(jù)泄露對企業(yè)的危害

多家機構(gòu)如此重視,人為數(shù)據(jù)泄露到底能為企業(yè)造成多大傷害?

數(shù)據(jù)安全公司Cyberhaven曾在一個報告中,調(diào)查了不同行業(yè)客戶160萬員工的ChatGPT使用情況。

報告數(shù)據(jù)顯示,自ChatGPT推出以來至3月21日,8.2%的員工曾在工作場所使用過ChatGPT, 6.5%的員工曾將公司數(shù)據(jù)粘貼其中;僅3月14日一天,每10萬名員工就平均給ChatGPT發(fā)送了5267次企業(yè)數(shù)據(jù)。尤其是敏感數(shù)據(jù),占到員工粘貼到ChatGPT的數(shù)據(jù)的11%。

這意味著,ChatGPT的使用率越高,敏感數(shù)據(jù)泄露的也就越多。

試想如果不加限制地使用LLM,隨著更多敏感數(shù)據(jù)被傳輸LLM服務(wù)器,并被用作模型訓(xùn)練數(shù)據(jù)集,也就意味著競爭對手通過隨意的聊天對話就能獲悉了你的核心數(shù)據(jù)。如果競對用這些數(shù)據(jù)建模對你進行降維打擊,會對企業(yè)會造成多大損失?

數(shù)據(jù)泄露會造成嚴(yán)重的企業(yè)的信任度降低,讓業(yè)務(wù)連續(xù)性受到影響,并可能會帶來一定的法律責(zé)任。

看到這里,你就應(yīng)該明白為何大型企業(yè)都在構(gòu)建自有大語言模型了。

當(dāng)然,凡事皆有利弊。雖然對話式交互的生成式AI會造成敏感數(shù)據(jù)泄露,但AI和自動化的使用,整體上正在降低數(shù)據(jù)泄露的成本。

IBM的《2023年數(shù)據(jù)泄露成本》全球調(diào)查數(shù)據(jù)顯示,廣泛使用人工智能(AI)和自動化的組織受益,平均節(jié)省了近1萬美元的數(shù)據(jù)泄露成本,并將數(shù)據(jù)泄露識別和遏制速度加快了8 天。

也就是說,只要恰當(dāng)使用LLM,注意安全防控,它會對企業(yè)的增效降本起到明顯的作用。

LLM泄露數(shù)據(jù)的幾個原因

想要實現(xiàn)LLM的安全使用,需要分析數(shù)據(jù)泄露的相關(guān)因素。

從已經(jīng)發(fā)生的實踐案例來看,造成ChatGPT等LLM數(shù)據(jù)泄露的主要原因,大概有以下幾點:

1、用戶隱私泄露:在使用ChatGPT進行客戶服務(wù)時,企業(yè)通常需要獲取用戶的個人信息,如姓名、地址、電話等。這些信息一旦被未經(jīng)授權(quán)的第三方獲取,便可能導(dǎo)致用戶隱私泄露。

2、內(nèi)部安全風(fēng)險:ChatGPT作為一款人工智能語言模型,其生成和處理的敏感信息可能包括企業(yè)內(nèi)部的商業(yè)機密、計劃、策略等。如果這些信息被惡意利用,可能會對企業(yè)造成嚴(yán)重?fù)p失。

3、系統(tǒng)漏洞:盡管ChatGPT具有強大的技術(shù)實力,但其系統(tǒng)仍可能存在漏洞。如果黑客利用這些漏洞入侵企業(yè)服務(wù)器,便可能導(dǎo)致數(shù)據(jù)泄露。

理論上,只要我們針對性的解決這幾個問題,LLM的安全使用也就不在話下。

現(xiàn)在,很多引入LLM的企業(yè)基本都建立了風(fēng)控機制,按照LLM使用流程的先后順序,這些機制包括加強安全培訓(xùn)、定期審查系統(tǒng)、加密處理敏感信息、使用可靠的人工智能服務(wù)提供商、建立應(yīng)急預(yù)案等。

在這些安全措施中,大家會發(fā)現(xiàn)“使用可靠的人工智能服務(wù)提供商”這一點最為重要,畢竟引入一個具備高度安全機制的LLM會事半功倍。其他幾點也能起到一定的作用,但多是為了防患于未然以及事后補救,并且其中的很多人為因素難以避免。

與此同時,隨著技術(shù)的不斷發(fā)展,LLM的應(yīng)用也進入到了AI Agent階段。

AI Agent有效避免LLM數(shù)據(jù)泄露

AI Agent是由AI驅(qū)動的程序,當(dāng)給定目標(biāo)時,能夠自己創(chuàng)建任務(wù)、完成任務(wù)、創(chuàng)建新任務(wù)、重新確定任務(wù)列表的優(yōu)先級、完成新的頂級任務(wù),并循環(huán)直到達到目標(biāo)。

使用AI Agent,只需輸入一句話或者更簡單的指令,就能通過理解與分析獲悉用戶的意圖,進而規(guī)劃并執(zhí)行一系列任務(wù),最終輸出詳盡而具體的答案。

AI Agent不僅讓輸入更加簡單,也在一定程度上提高了安全系數(shù),有效避免了數(shù)據(jù)泄露的可能,還能最大限度發(fā)揮LLM的能力。

AI Agent正在快速影響更多領(lǐng)域,超自動化領(lǐng)域也是如此。目前廠商們都在積極引入或自研大模型,并基于這些大模型打造Agent,以從安全、易用性等各方面提升超自動化的應(yīng)用效率。

當(dāng)然,超自動化Agent在數(shù)據(jù)安全方面遠(yuǎn)不是減少提示詞輸入那么簡單。

超自動化Agent破解LLM安全謎題

超自動化領(lǐng)域如何通過AI Agent提升安全系數(shù)呢?

這里王吉偉頻道以實在智能業(yè)界首發(fā)的實在RPA Agent智能體為例,介紹超自動化Agents如何保障用戶數(shù)據(jù)安全。

實在RPA Agent智能體是基于實在智能自研垂直領(lǐng)域大模型TARS構(gòu)建的RPA\超自動化智能體,是一種能夠自主拆解任務(wù)、感知當(dāng)前環(huán)境、執(zhí)行并且反饋、記憶歷史經(jīng)驗的RPA全新模式。

為了讓用戶更安全的使用AI智能體,實在RPA Agent智能體在TARS大語言模型和RPA工具包都設(shè)置的多重安全機制。

TARS大語言模型的安全機制側(cè)重于敏感數(shù)據(jù)、內(nèi)部政策和提示檢查。在預(yù)訓(xùn)練或SFT階段通過數(shù)據(jù)處理和文本分類算法刪除敏感數(shù)據(jù),在大模型的輸出結(jié)果之上疊加一個輔助安全模型,RLHF(人類反饋強化學(xué)習(xí))階段使用內(nèi)部策略,檢查用戶查詢并添加安全提示等。

這樣就能保證用戶輸入內(nèi)容的多層過濾,防止敏感數(shù)據(jù)的外露。

TARS大型語言模型上基于充分細(xì)致的語料收集和清洗、數(shù)據(jù)處理及標(biāo)注,超千億Tokens的預(yù)訓(xùn)練語料和超百萬條指令微調(diào)數(shù)據(jù),實在智能獨立完整復(fù)現(xiàn)大模型構(gòu)建的預(yù)訓(xùn)練、指令微調(diào)和RLHF三階段,使大模型具備完整能力。

同時實在智能自主研發(fā)用于中文不當(dāng)言論判別和生成終止的Detoxify系統(tǒng),也提升了TARS的安全性和無害性,讓大模型“既懂事,又懂法”。

在RPA工具包上,TARS-RPA-Agent安全機制側(cè)重于機器人授權(quán)繼承和指揮官分配或分發(fā)授權(quán):

首先,RPA機器人的授權(quán)均繼承自創(chuàng)建機器人的用戶,同時其權(quán)限范圍也和所在賬號的權(quán)限是一致的,不會獲取超出其權(quán)限范圍的信息;

其次,RPA指揮官可以分配和控制TARS-RPA-Agent的授權(quán);

第三,在開發(fā)過程中,實在智能設(shè)計了一個易于處理敏感數(shù)據(jù)的模塊,使得敏感數(shù)據(jù)更易于通過配置、刪除、導(dǎo)入等方式進行設(shè)置。

除了LLM和RPA,TARS-RPA-Agent還包含其他輔助模塊,其中的安全機制側(cè)重于內(nèi)部知識庫認(rèn)證、內(nèi)部文檔訪問以及用戶確認(rèn)。

有了面向LLM、RPA和輔助模塊的多重安全機制,在十幾層防護墻的共同作用下,想要泄露隱私數(shù)據(jù)都很難,徹底杜絕了前文所講的人為泄露數(shù)據(jù)的情況。再加上應(yīng)對系統(tǒng)漏洞的相關(guān)安全機制,足以把LLM應(yīng)用安全打造得固若金湯。

當(dāng)然,這還是直接使用TARS大模型或者調(diào)用API的情況。如果你是現(xiàn)金流充沛的企業(yè),采用本地部署大語言模型的方式,安全情況會更上一層樓。

需要說明的是,這種整體安全解決方案非常適用于一些大型企業(yè)的LLM應(yīng)用安全過濾。

出于安全考慮,企業(yè)都希望在應(yīng)用LLM時過濾內(nèi)部敏感信息。

目前市面上的數(shù)據(jù)安全管理軟件,功能豐富但應(yīng)用復(fù)雜且價格不菲。為了LLM數(shù)據(jù)過濾這種單一應(yīng)用場景而斥巨資購買全數(shù)據(jù)監(jiān)控軟件,顯然過于浪費,并不是LLM數(shù)據(jù)過濾的最優(yōu)選。

事實上,這類需求更適合LLM技術(shù)供應(yīng)商基于大語言模型技術(shù)路徑去做。只需在其LLM產(chǎn)品體系中添加隱私數(shù)據(jù)過濾功能,為企業(yè)用戶開放不斷更新或增刪敏感數(shù)據(jù)庫內(nèi)容的權(quán)限。

這種模式,不僅能為本身大語言模型提供過濾安全功能,還能用于企業(yè)所使用的OpenAI、文心一言等第三方大語言模型,能夠在最大限度保護員工創(chuàng)造力的同時做好公司敏感數(shù)據(jù)的防護。

這樣,企業(yè)就能實現(xiàn)花一份錢去保障更多LLM的安全。

如果你的企業(yè)正在為LLM的應(yīng)用安全及預(yù)算而發(fā)愁,不妨試試實在智能的這種安全解決方案,或許會讓你眼前一亮。

全文完

【王吉偉頻道,關(guān)注AIGC與IoT,專注數(shù)字化轉(zhuǎn)型、業(yè)務(wù)流程自動化與RPA,歡迎關(guān)注與交流?!?/p>

 

申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!

相關(guān)標(biāo)簽
大模型

相關(guān)文章

  • 大模型是下一代操作系統(tǒng)的未來,在這屆云棲大會上已經(jīng)到來

    9月24日,2025云棲大會在杭州開幕,阿里巴巴集團CEO、阿里云智能集團董事長兼CEO吳泳銘發(fā)表主旨演講,首次系統(tǒng)性地闡述通往ASI的三階段演進路線,包括智能涌現(xiàn)、自主行動以及自我迭代等,實現(xiàn)從學(xué)習(xí)人、輔助人到超越人的發(fā)展脈絡(luò)?;谏鲜龅陌l(fā)展路線,吳泳銘對外做出判斷,大模型是下一代的操作系統(tǒng)?!拔?/p>

    標(biāo)簽:
    大模型
  • 大模型搶灘高考志愿填報,能否頂替「張雪峰」們?

    文/二風(fēng)來源/節(jié)點財經(jīng)每年高考成績放榜后,數(shù)千萬考生和家長將迎來另一場硬仗——填報志愿。今年,這一領(lǐng)域迎來了AI的全面介入,多家互聯(lián)網(wǎng)大廠和教育公司紛紛推出智能志愿填報產(chǎn)品,為考生提供院校和專業(yè)選擇建議。據(jù)艾媒咨詢數(shù)據(jù),2023年中國高考志愿填報市場付費規(guī)模約9.5億元,近九成考生愿意借助志愿填報服

    標(biāo)簽:
    大模型
  • 崔大寶:大模型降溫背后的難點、卡點、節(jié)點

    崔大寶|節(jié)點財經(jīng)創(chuàng)始人進入2024年,大模型似乎有熄火之勢:資本市場,與之關(guān)聯(lián)的概念炒不動了,英偉達股價動輒暴跌重挫,引發(fā)“泡沫戳破”的擔(dān)憂;消費市場,BATH們的推新活動少了,產(chǎn)品更新迭代的速度慢了,民眾的關(guān)注度降了……熱鬧的大概只剩下兩場酣仗:自5月15日字節(jié)跳動宣布“以厘計費”,打響國內(nèi)大模型

    標(biāo)簽:
    大模型
  • 兩分鐘“熟讀”《國史大綱》,大模型的下一個爆點是“書童”?

    年初大模型行業(yè)上演“長文本”大戰(zhàn)時,我們就萌生過做一個“讀書助理”的想法。測試了市面上主流的大模型后,發(fā)現(xiàn)普遍存在兩個不足:一種是可以處理的文本長度不夠,即使有些大模型將文本長度提升到了20萬字,像《紅樓夢》這樣近百萬字的名著,還是需要多次才能“讀”完。另一種是語言理解和生成能力不足,經(jīng)常出現(xiàn)“幻覺

    標(biāo)簽:
    大模型
  • 除了燒錢,互聯(lián)網(wǎng)留給大模型揮霍的“家底”不多了

    互聯(lián)網(wǎng)或許從未停止創(chuàng)新,只是對于創(chuàng)新的認(rèn)知下降了。

    標(biāo)簽:
    大模型
  • GDPS2025賽場直擊!開普勒大黃蜂助力華理斬獲搬運賽項桂冠

    12月12日-14日,2025全球開發(fā)者先鋒大會暨國際具身智能技能大賽(GDPS2025)于上海張江科學(xué)會堂舉行,大會以具身智能競技為核心,融合了技術(shù)比拼、產(chǎn)業(yè)展示與科普體驗,為全球觀眾呈現(xiàn)出具身智能的現(xiàn)在與未來。上海開普勒機器人有限公司(以下簡稱"開普勒機器人")攜明星產(chǎn)品K2"大黃蜂"亮相,并參

    標(biāo)簽:
    GDPS
    2025
  • 弈動 Dynamic·數(shù)智躍遷 博弈無界|2025TechWorld智慧安全大會在京召開

    在數(shù)字化與智能化深度交織的時代浪潮中,安全的邊界不斷延展,技術(shù)的演進正引領(lǐng)產(chǎn)業(yè)邁向新一輪變革。10月24日,以“弈動Dynamic·數(shù)智躍遷博弈無界”為主題的2025TechWorld智慧安全大會在北京盛大召開。來自國家部委、院士學(xué)者、高??蒲袡C構(gòu)和企業(yè)的權(quán)威專家與業(yè)界精英齊聚北京,共議AI安全、數(shù)

    標(biāo)簽:
    弈動
  • 甌江論道:AI賦能綠色發(fā)展

    2025年10月25日,2025世界青年科學(xué)家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術(shù)學(xué)會、中科先進技術(shù)溫州研究院與溫州市電力工程學(xué)會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,

    標(biāo)簽:
    ai技術(shù)
  • AI云“分野”:阿里云們“賣鏟”,火山引擎奇襲“MaaS”

    AI云“分野”:阿里云們“賣鏟”,火山引擎奇襲“MaaS”

    標(biāo)簽:
    阿里巴巴
  • 未來5年,中國AI的“大洗牌”和“內(nèi)循環(huán)”

    我覺得我們AI的目標(biāo)是:從芯片設(shè)計到軟件生態(tài),全鏈路自主開發(fā),建立可控的世界級AI體系。所以這是俺對未來5年中國AI圈的展望和判斷。(1)2026年,英偉達造車、國產(chǎn)開車26年國產(chǎn)芯片會在推理和垂直場景上發(fā)力。以DeepSeek為代表,大多數(shù)AI大模型會以軟件彌補硬件不足,所以訓(xùn)練和推理分開,訓(xùn)練就

  • H20芯片開賣即叫停,英偉達如何解圍?

    文/道哥在深陷“后門”風(fēng)波、接受網(wǎng)信辦問詢之后,英偉達的“特供版”H20芯片,又有了新消息。近日,美國科技媒體《TheInformation》援引知情人士消息稱,英偉達已悄然向其關(guān)鍵供應(yīng)商——包括負(fù)責(zé)封裝的安靠科技、供應(yīng)高帶寬內(nèi)存的三星電子、以及承擔(dān)后端處理的富士康發(fā)出指令,要求暫停所有與H20AI

    標(biāo)簽:
    英偉達