2023 年,紐約有律師用 ChatGPT 寫狀子、引用了一批根本不存在的判例,被法院制裁——當時是孤例,大家當笑話看。
到了 2026 年,法院已經不覺得好笑了。
2026 年 7 月 28 日,伊利諾州上訴法院第一區對一名律師開罰 1.5 萬美元——他提交的書狀裡有 10 處假造的法條引文與判例,法院按「每個假引用 1,500 美元」計算。
但真正值得注意的不是金額,是法院的理由:法院別無選擇,只能持續調高 AI 幻覺引用的罰款,直到罰款真的產生嚇阻效果為止。
罰則的邏輯,從「懲罰個案」變成「調到會痛為止」——這才是 2026 年的轉折點。
📊 這類案件到底有多少?去看那個資料庫
法律研究者 Damien Charlotin 維護了一個 AI 幻覺案件資料庫,逐案收錄各國法院處理過的 AI 假引用事件。這是目前最完整的公開追蹤來源,而且數字每週都在動。
與其在這裡抄一個很快就過期的統計,不如給你原始出處自己看即時的——這篇文章不會提供任何你無法點開驗證的數字。(提醒:該站對自動抓取有阻擋,用瀏覽器正常開啟即可。)
可以確定的方向是:案件數在增加,處分的重心正在從「訓誡」移到「罰到有感」——伊利諾這一案的「每個假引用 1,500 美元」,就是這個轉向具體長什麼樣子。
🔍 拆解伊利諾這一案:三個關鍵細節
細節 1:他不是「完全沒查」,是「查了還錯」 被罰的律師承認用 ChatGPT 消化複雜案情,但主張自己有再用 LexisNexis 核對引用。法院不接受——因為他為此提出的答辯狀本身,又出現新的錯誤引用,包括引用根本不存在的法條項次。
這點對台灣律師特別值得記:「我有查證」不構成抗辯。查了還錯,只會讓法院認定你的查核流程本身是無效的。
細節 2:法院按「件」計價 1.5 萬美元不是隨手開的數字,是 10 處錯誤 × 每處 1,500 美元。這種計價方式訊號很明確:你多塞一個假引用,就多付一次錢——不再是「一次事件罰一筆」。
細節 3:法院明說這是嚇阻,不是補償 法院直接寫明:之所以罰得比以往重,是因為過去的額度顯然不足以嚇阻,因此只能往上加。
這代表罰款金額未來只會更高——拿早期案件的金額當風險評估基準,會嚴重低估。
🤔 那法官自己用 AI 呢?
網路上常見「法官自己也在用 AI,憑什麼罰律師」的說法,通常還會附上一個看起來很精確的百分比。我查不到可信的原始出處,所以這裡不引用任何數字——但這個問題本身值得回答,因為律師和法官的責任結構確實不一樣:
1. 法官的 AI 用途不是「取代法律意見」 法官用 AI 主要是:整理案件事實時間線、研究法律詞彙、找相關判例的線索(然後人工查證)、起草 boilerplate 段落。法官不會把 AI 寫的判決理由直接交出來——他們的責任不需要靠 AI 證據支撐。
2. 法官的錯誤可被上訴審查 法官引用錯了,敗訴方可以上訴。律師寫狀子引用錯了,法庭直接受誤導——除非對方律師抓到,否則案件可能就這樣定下來。錯誤糾錯機制不對等。
3. 律師的角色定義是「對法庭忠誠」 律師作為「officer of the court」(法庭的執行人),其法律責任遠高於政府公務員(法官)。律師對法庭的虛假陳述構成獨立的紀律違規,不需要當事人受害也成立。
但即便邏輯上說得通,只要法官也在用 AI,觀感上的雙標就會存在——這個矛盾會在 2026-2027 形成新的政策辯論。預期會出現的修正方向:
- 法官的 AI 使用揭露:多州正在討論強制法官在判決中標註「本意見書部分內容由 AI 協助起草」
- AI 使用揭露變律師執業要求:狀子需附「AI 使用聲明」,類似目前的「無利益衝突聲明」
⚠️ AI 幻覺問題不只在「找不存在的判例」
媒體聚焦最多的是「虛構判例」(fabricated citations),但更難抓的是「微妙誤引」——Stanford HAI 的法律 AI 實測把這類問題歸為「缺乏依據」(misgrounded):引用的來源確實存在,但根本不支持它被拿來支持的那個主張。
實務上會長成三種樣子:
- 真實判例,但結論被反向:AI 引用了一個真實案例,卻拿來支持相反的主張——「A 訴 B 案,法院認為 X」,實際上案件結論是 not-X
- 真實判例,但管轄區錯誤:引用加州案例去打紐約的案子,而兩州法律恰好相反
- 真實判例,但條文編號錯誤:寫成 Section 1983,實際法條是 1981
這類錯誤比明顯的虛構引用更難發現——對方律師也得花時間查才知道。伊利諾那一案被抓到的,就包含「引用不存在的法條項次」這種類型。真正的法律 AI 災難會出在這個區塊,而不是「ChatGPT 編一個案號」。
💡 Mason 的判斷
這件事真正的教訓不是「律師不該用 AI」——律師當然該用 AI,生產力差太多。教訓是:
(1) AI 是新的「第一年實習生」,不是資深律師 你會把實習生寫的東西原封不動交給法庭嗎?不會。AI 也是同樣標準。AI 寫的稿,律師親自查證每一個引用、每一個結論、每一個條文——這是不能省的步驟。
(2) 「我以為 AI 不會錯」不再是合理抗辯 2023 年 Schwartz 律師說「我以為 ChatGPT 是個搜尋引擎」,當時還能贏得部分同情。到 2026 年,這個說法已經沒有說服力——所有從業者都被告知過 AI 會幻覺,不知道 = 失職。
(3) AI 政策變成事務所必備 過去事務所最多有「雲端使用政策」,現在需要明確的「AI 使用政策」——哪些 AI 可以用、什麼任務可以用、需要什麼審核流程。沒有這個政策,事務所合夥人未來會跟律師一起被罰。
(4) 對台灣律師業的延伸 台灣目前完全沒有等同的判例與政策框架,但案件遲早會出現——可能來自:用 ChatGPT / Gemini 寫狀子的小型事務所、自助訴訟者(litigants in person)、或財務糾紛的 AI 自動產出文件。
預期 2026-2027 台灣會有第一個律師 AI 幻覺懲戒案,屆時律師公會的反應會決定整個業界的應對方向。現在開始規劃 AI 使用守則,比事後補救划算。
🎯 不同角色的建議
給律師 / 法律從業:
- AI 寫的所有內容,逐一查證——尤其是判例、法條、引用。這是不能省的責任
- 用 Westlaw、Lexis+ 這類有判例庫反查機制的法律專用 AI,而不是純 ChatGPT / Claude——但務必知道它們實測幻覺率仍有 17% 到 34%,是「比較不糟」,不是「安全」
- 建立事務所 AI 政策——哪些工作可以用 AI、什麼工作必須人工、審核標準、客戶告知
- 提交狀子前最後一道「人工檢查每個引用」是不可省的——這 30 分鐘可能省掉執照
給法官 / 司法:
- 2026 是司法系統需要 AI 揭露政策的關鍵年——強制法官揭露 AI 使用,跟強制律師揭露,標準應該對等
- 鼓勵建立「AI 引用驗證系統」——像 Bluebook checker 一樣的工具,自動檢查狀子引用是否真實
- 對律師的紀律處分標準需要區分「單純 AI 失誤」與「AI + 撒謊」——前者教育,後者重罰
給法律 AI 工具開發商:
- 「減少幻覺」是值得繼續投入的研發方向,但完全消除不可能——商業模式應該設計成「輔助 + 強制審核流程」,而不是「自動化取代」
- 提供「信心分數 + 來源連結」是必備功能,讓律師能快速判斷哪些引用需要重點查證
- 跟律師公會合作做「AI 安全使用認證」——這是有商業價值的合規服務
給一般使用者(打官司、寫合約):
- 用 AI 起草合約 / 訴狀完全可以,但最後一定要請真人律師審核——AI 幻覺對你的代價可能是輸官司
- 不要相信「AI 律師服務」可以完全取代律師的廣告——目前法律 AI 的能力遠不足以獨立處理你的訴訟
- 如果你看到對方律師的狀子有「怪怪的引用」,主動查證——可能是 AI 幻覺的禮物
❓ FAQ
哪些法律 AI 比較不會幻覺?
先破除一個很常見的誤解:法律專用 AI 不等於不會幻覺。
Stanford HAI 2024 年實測三套主流法律研究工具的結果是:Lexis+ AI 與 Ask Practical Law AI 的幻覺率超過 17%,Westlaw 的 AI 輔助研究更超過 34%——後者等於每三個回答就有超過一個有問題。注意這個排序跟多數人的直覺相反。
純 LLM 更糟。同一批研究者先前的實驗發現,通用模型回答具體法律問題時,幻覺率落在 69% 到 88% 之間。
所以正確的結論不是「用專業工具就安全」,而是:專業工具把幻覺率從「幾乎必錯」降到「每幾次錯一次」——這離「可以免查證」還差得很遠。
那律師事務所的 AI 政策該怎麼寫?
最低限度應該包含:(1) 允許 / 禁止的 AI 工具清單——例如允許 Westlaw AI、Lexis+,禁止把客戶機密資料輸入 ChatGPT 免費版。(2) 哪些工作可以用 AI——例如:摘要、初稿、研究輔助;不能用:最終狀子、合約最終版、客戶法律意見書。(3) 審核流程——AI 產出後必須由律師逐項查證並簽核。(4) 客戶告知——如果使用 AI 處理客戶事務,事先告知。(5) 紀錄保存——保留 AI prompt、輸出、審核紀錄,作為紀律處分時的抗辯依據。
ABA 的「Formal Opinion 512」(生成式 AI 使用的執業倫理意見)可作為起點。
普通人寫合約用 AI 真的有幫助嗎?
有用,但有條件。AI 適合:(1) 解釋合約條款——把法律語言翻譯成白話,(2) 起草簡單合約——租賃、雇傭、NDA 等標準化文件,(3) 找出明顯陷阱——明顯不公平條款、漏洞。
不適合:(1) 訴訟文件——一錯影響大,(2) 涉及大筆金錢的合約——遺產、不動產、商業併購,(3) 跨境法律——AI 對不同管轄區法律的混淆率最高。
最划算的方式:用 AI 起草 + 真人律師審 1 小時,通常能比全程律師服務便宜 50-70%,但有真人風險把關。
Sources:
- 伊利諾上訴法院加重 AI 誤用制裁:10 處假引用罰 1.5 萬美元(2026-07-30)— ABA Journal
- AI Hallucination Cases Database(AI 幻覺案件資料庫)— Damien Charlotin
- AI on Trial:法律研究工具每 6 次查詢就幻覺 1 次以上(Lexis+ 逾 17%、Westlaw 逾 34%)— Stanford HAI
- Hallucinating Law:通用大型語言模型的法律幻覺率達 69-88% — Stanford HAI
(2026-08-01 來源勘誤:本文原引用的 ABA Journal、Above the Law、The Ethics Reporter、NCSC 四條連結經查證皆為 404,其所支撐的內布拉斯加吊照案、奧勒岡 11 萬美元罰款、Sullivan & Cromwell 道歉信,以及「61% 聯邦法官使用 AI」等敘述均無法查證,已全數移除。Damien Charlotin 資料庫連結為該站全站阻擋自動抓取,並非失效。)