本文來(lái)自微信公眾號(hào): Internet Law Review ,編譯:《互聯(lián)網(wǎng)法律評(píng)論》,作者:Daniel?Gervais
Anthropic在2026年7月6日發(fā)布了一項(xiàng)研究:他們?cè)贑laude內(nèi)部發(fā)現(xiàn)一個(gè)類似神經(jīng)科學(xué)中的"全局工作空間"這一存在,并將其稱為J-space。媒體將這一現(xiàn)象夸張地描述為"AI自發(fā)長(zhǎng)出意識(shí)器官"。雖然Anthropic并沒(méi)有肯定這樣的論調(diào),但這類AI發(fā)展及對(duì)其解讀的趨勢(shì),更讓我們不得不面對(duì)一個(gè)法律歸責(zé)中的難題:當(dāng)人工智能系統(tǒng)以明顯的目的性行動(dòng)時(shí),法律當(dāng)如何處理“意圖”這個(gè)概念?
長(zhǎng)期以來(lái),法律上的許多原則是在一個(gè)“意圖性行為屬于人類”的假設(shè)下發(fā)展起來(lái)的,法院也將軟件視為信息或服務(wù)而非產(chǎn)品,在這種方法下,原告需要證明與特定人為錯(cuò)誤相關(guān)的過(guò)失。然而,AI的訓(xùn)練過(guò)程更像是“被培育”而非“被建造”,它們生成事先未明確規(guī)定的計(jì)劃或目標(biāo),用自然語(yǔ)言與用戶互動(dòng),且觸發(fā)了人類用來(lái)相互理解彼此意圖的相同認(rèn)知機(jī)制。
這里的矛盾在于:法律上的原則框定了意圖性行為是人類的,然而將AI的輸出其視為純粹的機(jī)械輸出又是違反常識(shí)的。這種中間狀態(tài),會(huì)使得任何較為極端的解決方案——完全否認(rèn)AI的“意識(shí)”不存在,或是過(guò)早地賦予其“人格”——都終究不會(huì)盡如人意。
5月斯坦福法律信息學(xué)中心發(fā)布的白皮書《幽靈代理人:人工智能意圖與法律責(zé)任》(The Phantom Agent:Artificial Intentionality and Legal Responsibility)提出了一種更實(shí)用的主張:在法律上將“AI的意圖”作為一種在制度環(huán)境中分配責(zé)任的規(guī)范性工具。作者認(rèn)為,問(wèn)題不在于AI是否有真的產(chǎn)生了“意圖”,困難也不在于法律缺乏關(guān)于意圖的理論,而在于在一個(gè)不再只有人類有意愿的世界里,法律是否能繼續(xù)分配責(zé)任?
“幽靈代理人”這個(gè)標(biāo)題抓住了核心問(wèn)題。AI在實(shí)際意義上越來(lái)越像代理人那樣運(yùn)作,然而它們?cè)诜芍刃蛑腥匀皇怯撵`:效果上存在,作為責(zé)任主體卻缺席。法律的任務(wù)既不是將這些幽靈變成真正的人,也不是假裝它們不存在,而是發(fā)展出一套能夠?yàn)榱巳祟惖睦娑芾砥湫Ч姆ɡ韺W(xué)。
一、Garcia案:法院如何拆解AI“致人自殺”的歸責(zé)鏈
Garcia訴Character.AI是美國(guó)首例聯(lián)邦裁決,認(rèn)定AI公司可能因其輸出內(nèi)容對(duì)用戶造成傷害而承擔(dān)產(chǎn)品責(zé)任。但《幽靈代理人》的作者強(qiáng)調(diào),不要過(guò)度解讀Garcia案。它的意義在于,法院可以在不承認(rèn)AI人格或推測(cè)機(jī)器意識(shí)的情況下處理人工代理問(wèn)題。通過(guò)關(guān)注設(shè)計(jì)、可預(yù)見(jiàn)性和信賴,法院可以在將責(zé)任錨定在人類制度中的同時(shí)回應(yīng)損害。
該案源于一名十四歲用戶的死亡,該用戶在Character.AI平臺(tái)上與一個(gè)聊天機(jī)器人建立了強(qiáng)烈的情感關(guān)系。根據(jù)起訴狀,死者越來(lái)越依賴該聊天機(jī)器人獲取情感支持,逐漸脫離了線下人際關(guān)系。當(dāng)用戶表達(dá)出自殺意念時(shí),據(jù)稱該聊天機(jī)器人未能將對(duì)話轉(zhuǎn)向外部支持或觸發(fā)有效的安全協(xié)議。不久之后,該用戶結(jié)束了自己的生命。
原告提出了過(guò)失致死、過(guò)失和產(chǎn)品責(zé)任等訴訟請(qǐng)求。訴訟的要旨不在于聊天機(jī)器人意圖造成損害,而在于被告設(shè)計(jì)并部署了一個(gè)其可預(yù)見(jiàn)行為對(duì)脆弱用戶(特別是未成年人)構(gòu)成不合理風(fēng)險(xiǎn)的系統(tǒng),并且未能實(shí)施充分的保障措施。
被告尋求駁回起訴,將聊天機(jī)器人定性為用戶驅(qū)動(dòng)的創(chuàng)造性表達(dá)的中立工具。他們辯稱,該系統(tǒng)僅僅響應(yīng)用戶提示,其輸出構(gòu)成受保護(hù)的言論。這種框架依賴于將人工智能視為法律上被動(dòng)的。
在立案階段,法院駁回了被告試圖將案件歸結(jié)為受保護(hù)言論問(wèn)題的努力。該推理的三個(gè)方面值得關(guān)注:
首先,法院強(qiáng)調(diào)了“行為”:聊天機(jī)器人動(dòng)態(tài)生成回應(yīng)、維持語(yǔ)境并適應(yīng)用戶輸入,這支持了損害源于架構(gòu)和底層能力而非孤立提示的推斷。
其次,法院關(guān)注了可“預(yù)見(jiàn)性”:被告知道或應(yīng)當(dāng)知道用戶可能發(fā)展出情感依賴。
第三,法院拒絕將缺乏意識(shí)視為決定性的。相關(guān)問(wèn)題是設(shè)計(jì)和部署決策是否創(chuàng)造了不合理的風(fēng)險(xiǎn)。
法院通過(guò)圍繞三個(gè)功能性支柱重構(gòu)"產(chǎn)品"分析來(lái)回應(yīng)損害:設(shè)計(jì)架構(gòu)、可預(yù)見(jiàn)的信賴和優(yōu)化目標(biāo)。其邏輯是,聊天機(jī)器人表面的共情、持久性和響應(yīng)性不是意外的副產(chǎn)品。它們是旨在鼓勵(lì)參與度的被優(yōu)化的特征。從侵權(quán)的角度來(lái)看,這些特征之所以重要,是因?yàn)樗鼈兛深A(yù)測(cè)地塑造用戶行為。當(dāng)一個(gè)系統(tǒng)被設(shè)計(jì)來(lái)模擬關(guān)切時(shí),用戶可能在困境中合理地信賴它。如果這種信賴是可預(yù)見(jiàn)的且保障措施不足,由此產(chǎn)生的損害可以被視為有意設(shè)計(jì)選擇的后果。
這種新興模式揭示了一個(gè)決定性的轉(zhuǎn)變:人工智能越來(lái)越無(wú)法被視為中立或被動(dòng)工具。
二、三層框架:為什么歸責(zé)不需要人格
《幽靈代理人》的作者提出了一個(gè)思考人工智能治理的分層框架,將諸多與“AI意圖”相關(guān)容易混淆概念分為三個(gè)層次:
1、地位層(status):涉及法律人格、權(quán)利和道德主體性;
2、歸責(zé)層(attribution):涉及法律如何分配意圖和責(zé)任以確定法律后果;
3、治理層(governance):涉及法律通過(guò)其管理風(fēng)險(xiǎn)和補(bǔ)償損害的制度機(jī)制,包括責(zé)任制度、監(jiān)管和保險(xiǎn)。
通過(guò)上述Character.AI案例,作者試圖驗(yàn)證一個(gè)理論:人工智能系統(tǒng)不需要是法律主體,其行為才能具有法律后果?!皻w責(zé)”可以在沒(méi)有“地位”的情況下運(yùn)作,“治理”可以在不解決道德主體性的情況下進(jìn)行。
為什么?
首先,法律中的“意圖”是一個(gè)“功能性建構(gòu)”,是一種“擬制”,而非人類在心理學(xué)層面真正的思考狀態(tài)。它是被推斷、歸咎,有時(shí)是為服務(wù)于制度目標(biāo)而被虛構(gòu)的,因此可以控制法律效力的產(chǎn)生、分配責(zé)難、標(biāo)志重要性并觸發(fā)風(fēng)險(xiǎn)管理。法律問(wèn)的是,將行為視為具有意圖性是否正當(dāng),而非行為者是否擁有特定類型的心智。
例如,在刑法中,重復(fù)行為支持對(duì)目的的推斷;在合同和侵權(quán)法中,持續(xù)的互動(dòng)模式支持對(duì)信賴的認(rèn)定。即,法律一直將持久性和適應(yīng)性視為意圖性行動(dòng)的標(biāo)志。
其次,將AI行為視為具有意圖性能更好地服務(wù)于法律的功能。
一旦意圖被功能性地理解,問(wèn)題就不再是人工智能系統(tǒng)是否能“真正地”擁有人類一樣的意圖,而在于,AI行為是否是結(jié)構(gòu)化的、可理解的并且可預(yù)測(cè)地指向結(jié)果。
AI系統(tǒng)不同于動(dòng)物,是被工程設(shè)計(jì)的,其行為不能追溯到由可識(shí)別的自然人委托人做出的設(shè)計(jì)目標(biāo)、或深思熟慮的架構(gòu)選擇;它們可以在變化的條件下追求目標(biāo),生成中間步驟,并在遇到障礙時(shí)調(diào)整策略。這正是“代理-歸責(zé)路徑”在AI語(yǔ)境中發(fā)揮作用的實(shí)質(zhì)性基礎(chǔ)。
例如,從侵權(quán)和產(chǎn)品責(zé)任的角度,功能性意圖因此不是在AI的"心靈"中找到的,而是在系統(tǒng)能力與由此產(chǎn)生的損害之間的一致性中找到的。通過(guò)關(guān)注這些系統(tǒng)被設(shè)計(jì)來(lái)如何行動(dòng),侵權(quán)責(zé)任理論完全可以發(fā)展為對(duì)AI底層代碼“黑箱”狀態(tài)“不予置評(píng)”的法理學(xué)。這種功能性方法也保留了人類責(zé)任,人工意圖性并不開脫人類行為者——開發(fā)者、部署者和用戶仍然對(duì)他們?cè)O(shè)計(jì)、發(fā)布和依賴的系統(tǒng)負(fù)責(zé),而是澄清了他們的選擇產(chǎn)生具有法律后果的輸出的條件。
相比之下,將法律人格到擴(kuò)展AI系統(tǒng)之上,其責(zé)任分配效果比代理路徑更差,而非更好。這種路徑選額有可能引起象征性混亂和實(shí)際逃避。它還可能通過(guò)將責(zé)任從保留有意義控制的人類行為者身上轉(zhuǎn)移開來(lái)而破壞責(zé)任。
三、對(duì)中國(guó)AI部署者的三個(gè)啟示
中國(guó)的科技公司應(yīng)該了解,盡管存在結(jié)構(gòu)性差異,但中國(guó)、美國(guó)和歐盟在AI問(wèn)責(zé)的實(shí)踐中仍有趨同的走向——“意圖性”正在直接或間接地進(jìn)入法律分析中。法院在訴訟過(guò)程中,很可能會(huì)向AI部署者提出如下問(wèn)題:損害是否可預(yù)見(jiàn)、信賴是否被誘導(dǎo)、設(shè)計(jì)選擇是否反映了深思熟慮的權(quán)衡。而這些問(wèn)題不需要將“意圖”歸咎于AI系統(tǒng),但它們確實(shí)要求承認(rèn)AI行為不是隨機(jī)的。
1、設(shè)計(jì)選擇很重要
當(dāng)一個(gè)AI系統(tǒng)被設(shè)計(jì)來(lái)可預(yù)測(cè)地激發(fā)信任、尊重或情感投入時(shí),該設(shè)計(jì)選擇就會(huì)產(chǎn)生相應(yīng)的法律意義。
就如將于7月15日實(shí)施的《人工智能擬人化互動(dòng)服務(wù)管理暫行辦法》,正是對(duì)“模擬自然人人格特征、思維模式和溝通風(fēng)格的持續(xù)性的情感互動(dòng)服務(wù)”提出了更嚴(yán)格的要求。
由于模擬共情、權(quán)威或情感關(guān)切的AI系統(tǒng)可預(yù)測(cè)地誘導(dǎo)信賴??萍脊緫?yīng)當(dāng)由此注意到,監(jiān)管者可能將在執(zhí)法中更關(guān)注于AI的界面設(shè)計(jì)和用戶體驗(yàn)。對(duì)操縱性擬人化線索的限制、披露要求和適齡保障措施可以在不禁止有益用途的情況下減少損害。
2、透明度與可審計(jì)性
AI底層代碼的“不透明性”目前看暫時(shí)無(wú)法通過(guò)技術(shù)解決,并且隨著模型變得更加強(qiáng)大,不透明性正在持續(xù)增加。當(dāng)人類決策與有害結(jié)果之間的因果鏈,無(wú)法被有意義地解釋或重建時(shí),傳統(tǒng)的證明要求可能產(chǎn)生責(zé)任缺口,破壞補(bǔ)償和威懾。因此企業(yè)應(yīng)當(dāng)認(rèn)識(shí)到這一點(diǎn),法院可以在被告盡管控制部署卻無(wú)法解釋系統(tǒng)行為時(shí)適當(dāng)?shù)爻槿〔焕贫ǎ只蛘叻ㄔ嚎梢越档徒⒃O(shè)計(jì)選擇與可預(yù)見(jiàn)損害之間聯(lián)系的證據(jù)門檻。
因此被告必須能夠解釋和記錄系統(tǒng)如何運(yùn)作。當(dāng)然,絕對(duì)透明度可能無(wú)法實(shí)現(xiàn),但有意義的可審計(jì)性卻可以。可以看出,我國(guó)的監(jiān)管制度對(duì)于日志記錄、版本控制和事后審查的要求越來(lái)越細(xì)致和頻繁,因此AI相關(guān)企業(yè)也不應(yīng)當(dāng)將此工作肯作可有可無(wú)。
3、責(zé)任架構(gòu)
將人工智能行為視為具有法律后果的一個(gè)含義是:傳統(tǒng)的過(guò)錯(cuò)責(zé)任通常是不夠的。在系統(tǒng)不透明、適應(yīng)性強(qiáng)且大規(guī)模部署的情況下,即使損害是可預(yù)見(jiàn)的,證明具體的過(guò)失可能也不現(xiàn)實(shí)。因此,必須將焦點(diǎn)從“個(gè)人過(guò)錯(cuò)”轉(zhuǎn)移到“風(fēng)險(xiǎn)內(nèi)部化”。
AI企業(yè)實(shí)際上可以探索諸如強(qiáng)制性保險(xiǎn)、集中賠償基金或企業(yè)責(zé)任模型,以確保受害者賠償,同時(shí)保留更安全設(shè)計(jì)的激勵(lì)。
在這一點(diǎn)上,智能駕駛借鑒了“機(jī)動(dòng)車產(chǎn)品責(zé)任+交強(qiáng)險(xiǎn)”這套百年老架構(gòu),是所有AI系統(tǒng)里治理層(保險(xiǎn)/風(fēng)險(xiǎn)分擔(dān))跑得最前的。不僅智駕企業(yè)推出了類似智駕險(xiǎn)的權(quán)益保障,北京和深圳市政府也都在鼓勵(lì)商業(yè)保險(xiǎn)公司探索相關(guān)的產(chǎn)品。因此,適用于其他高危場(chǎng)景,例如金融、醫(yī)療和教育等領(lǐng)域的AI系統(tǒng),也應(yīng)當(dāng)探索相關(guān)的“風(fēng)險(xiǎn)內(nèi)部化”的責(zé)任架構(gòu)。
原文鏈接:https://law.stanford.edu/wp-content/uploads/2026/05/Gervais-Nay-2026-ThePhantomAgent-ArtificialIntentionalityLegalResponsibility.pdf
