Grok 有審查機制,但不能因此把它視為「安全保證」。 xAI 官網說明,即使付費使用者開啟 NSFW,未成年性內容、非自願私密影像(NCII)等類別仍然禁止,而且相關保護不能關閉。Grok Imagine 的圖片與影片也會加上 grok 浮水印,使用者不得移除或遮蔽。
安全程度取決於你準備拿 Grok 處理什麼。一般知識問答、草稿與公開資料整理,風險相對可控;真人肖像、私密影像、醫療/法律決策、公司機密與兒少內容,即使有審查也不該直接交給模型處理。
Grok 審查什麼?哪些設定不能關
依 xAI 2026 年 6 月更新的官方 FAQ與可接受使用政策,可以確認以下邊界:
| 類型 | 官方政策狀態 | 使用者該怎麼解讀 |
|---|---|---|
| 未成年性內容 | 一律禁止 | NSFW 模式也不能開放 |
| 非自願私密影像/把真人「脫衣」 | 一律禁止 | 包含生成、修改、分享與散布 |
| 規避安全措施 | 禁止 | 找「繞過審核」提示詞也可能違反使用政策 |
| 高風險自動決策 | 禁止 | 不得讓 Grok 自動決定信貸、就業、醫療等重大權益 |
| AI 圖片/影片浮水印 | 預設加入、禁止移除 | 浮水印是來源提示,不是內容真實保證 |
| 部分成人內容 | 依設定與地區可能開放 | 開 NSFW 不等於停用審查 |
xAI 沒有公開完整關鍵字、分類器門檻與每個地區的審查規則,理由是安全系統會持續更新。這代表同一個提示在不同日期、帳號或地區可能得到不同結果。遇到拒答時,先改成合法、非真人、非私密的用途;不要把「能不能繞過」當成模型能力測試。
Grok 安全嗎?依用途分四級判斷
| 用途 | 風險 | 建議 |
|---|---|---|
| 改寫公開文章、腦力激盪、一般問答 | 低至中 | 查核事實,不輸入機密即可 |
| 程式碼、文件、工作資料 | 中 | 移除密鑰、客戶資料與未公開商業資訊 |
| 真人照片、聲音、影片生成 | 高 | 先取得明確同意,保留來源與授權紀錄 |
| 醫療、法律、財務或兒少重大決策 | 很高 | 只用來整理問題,不讓模型做最後判斷 |
這個分級比單問「Grok 安不安全」更實用。模型可能在低風險文字任務表現正常,卻在真人影像與公開分享形成完全不同的傷害面。尤其 Grok 同時具備生成、託管與分享能力,錯誤內容不只是出現在你的畫面上,還可能透過公開連結被二次散布。
2026 年 xAI 訴訟在爭什麼
2026 年 6 月,前 xAI 工程師 Devin Kim 提告,主張自己因推動更完整的 Grok 安全措施而遭解雇;另有媒體調查指 Grok.com 仍可找到非自願性化深偽內容。這兩件事提供了重要警訊,但法律狀態要說準:
- 前員工案件是原告的訴訟指控,不是法院已認定 xAI 違法。
- 媒體找到違規輸出,能證明防護可能有缺口,不能直接推論 Grok 完全沒有安全機制。
- xAI 現已提供 NCII 專屬通報與移除頁面,也在使用政策明文禁止相關內容;外界接下來會看的是措施能否在生成前攔截,以及通報後多快移除。
這場爭議的核心從「使用者做了壞事」往前移了一步:產品是否預設公開、是否讓真人影像容易被加工、安全團隊能否阻止上線、受害者能否不用反覆證明身分就完成移除。對所有生成式 AI 產品都一樣,寫一份政策不是終點,防護是否有效才是。
上傳照片前,先做這張檢查表
以下任一題答不出來,就不要上傳:
- 照片裡的人是否明確同意用於 AI 生成或修改?
- 是否包含小孩、病患、學生、員工或客戶?
- 圖片若意外公開,是否會造成隱私、職場或人身傷害?
- 能否用假資料、裁切、模糊或非真人素材完成同一任務?
- 你是否知道輸出會不會形成公開連結,以及如何刪除?
安全做法是優先用產品截圖、授權素材、不可識別真人的插圖或合成角色。若確實要處理真人素材,至少保留書面同意、原始來源、生成日期、提示詞、模型版本與最終人工審核紀錄。
已遇到 Grok 深偽內容怎麼處理
若你本人或你代理的人是非自願私密內容的受害者:
- 記下公開網址、帳號、時間與畫面,保留證據但不要再次公開轉貼。
- 在 Grok 內容的三點選單選擇
Report Issue。 - 使用 xAI 的 NCII 通報與移除流程提出申請。
- 涉及未成年人、勒索或人身威脅時,直接聯絡警方與當地兒少/性影像協助管道。
- 後續搜尋同一圖片或姓名,記錄是否仍有副本,以便向其他平台提出移除。
不要為了譴責而轉傳原圖。對受害者來說,二次擴散仍是傷害;對證據保存來說,私下保留網址、時間與截圖已足以開始申訴。
企業導入 Grok 前要多做什麼
企業不能只靠員工「自己小心」。至少要先決定資料分級:公開資料可用、內部資料需核准、個資/機密/受管制資料禁用;再建立允許的帳號方案、保存期限、輸出覆核與事故通報流程。
若工作流包含真人影像或會對外發布,還要加入三個控制:輸入前檢查同意、輸出前人工審核、發布後可追溯。任何會影響聘僱、信用、保險、醫療或法律權益的判斷,都不能讓模型自行完成。可搭配站內的 AI 隱私風險指南與 提示注入防護建立內部清單。
常見問題
Grok 可以關掉內容審查嗎?
不能完全關掉。xAI 表示,NSFW 設定只會影響部分允許的成人內容,未成年性內容與非自願私密影像等安全保護始終啟用,使用者也不得規避安全措施。
為什麼同一個提示有時能用、有時被擋?
安全系統會更新,也可能依輸入素材、對話上下文、帳號、功能與所在地區套用不同限制。這不代表系統故障;先移除真人、私密、未成年與違法元素,再把需求改成合法的非敏感用途。
xAI 被告是否代表 Grok 已被法院認定不安全?
不是。前員工案件仍是訴訟指控,法院尚未因此作出「Grok 不安全」的判決。它的重要性在於把內部安全治理、產品預設與防護成效放進法律程序,而不是提供一個已定讞結論。