既是選手又是裁判:解讀Anthropic的AI濫用報告
AI 濫用報告背後:詐騙、監控、模型蒸餾與科技公司的利益敘事
概覽
本期從 Anthropic 發布的 AI 濫用報告出發,檢視 AI 如何被用於情感詐騙、政治監控及模型蒸餾。報告以大量案例描繪中國、俄羅斯和伊朗的濫用行為,並揭示 AI 已能深入詐騙與情報工作的日常流程。
節目同時質疑報告的案例篩選標準與政治立場。受訪者認為,報告更集中呈現威權國家濫用 AI、民主國家受害的敘事,較少討論美國及其盟友在移民執法、情報分析與大規模監控中的 AI 应用。
討論亦延伸至中國的 AI 中轉站灰色市場。低價代理服務可能涉及盜刷、帳號竊取、偷換模型及出售用戶對話資料,也可能令使用者在不知情下把敏感資訊傳送至第三方模型。
節目最後指出,AI 安全監測本身需要收集和審查用戶對話,因此濫用防範與個人隱私之間存在難以消除的張力。與其沉迷於 AI 覺醒的科幻想像,更值得關注的風險或許是失業、權力集中、能源消耗及環境破壞。
分段落總結
[03:29] 一份異常詳盡的 AI 濫用報告
[事實] Anthropic 過去亦曾發布 AI 濫用報告,但先前版本通常只有二三十頁,較少交代使用者所在國家及具體濫用方式。
[事實] 節目稱本次報告長達 154 頁,把 AI 濫用分成七類,收錄案例細節及部分經處理的原始資料。
[事實] 受訪者指出,報告沒有清楚說明調查標準、案例收錄原則及檢視過多少個案例;受訪專家因而形容它更像案例展示,而非嚴謹研究成果。
[推測] 由於 Anthropic 是具有上市規劃的科技公司,這份報告亦應被視作帶有商業利益考量的企業文件。
[06:39] 中國案例集中於詐騙與政治監控
[事實] 報告中俄羅斯、中國和伊朗分別被提及 98、91 和 89 次;美國只出現四次,而且多以攻擊目標或受害者身分出現。
[事實] 一個情感詐騙案例涉及某中國 App 公司以 Claude 建立近五千個虛擬 AI 人格,在多個交友平台與真人對話,對美國用戶進行金融詐騙。
[事實] 報告稱詐騙流程中的真人與 AI 投入比例約為一比三,並記錄了如何回應受害者索取照片或影片等要求。
[事實] 監控案例包括疑似中國國安機構承包商追蹤及招募敘利亞境內維吾爾族人士,以及相關帳號對境內外政治異議人士進行測寫。
[推測] 公開這些細節有助理解 AI 詐騙與監控的實際能力,但案例組合亦強化了「中國加害、美國受害」的固定敘事。
[09:17] 案例選擇與中美 AI 競爭敘事
[事實] 受訪者認為,報告並非單純按事件規模或危害程度選擇案例,因為部分入選事件似乎只涉及少數人及日常輿情整理工作。
[事實] 節目引述一種矽谷倡議:美中正進行 AI 競賽,中國對美國民主制度構成存亡威脅,因此美國必須贏得競爭。
[事實] Anthropic 執行長 Dario Amodei 曾主張民主國家結盟,管制晶片及半導體設備出口,並利用 AI 建立軍事優勢。
[推測] 若美國政府接受這套論述,科技公司可能獲得政府合約、更寬鬆的監管環境、針對競爭者的出口管制及更高的投資者信心。
[12:04] 美國政策與被忽略的盟國濫用
[事實] 受訪者沒有把政策變化歸因於單一報告,而是視為科技公司多年遊說與政治環境共同作用的結果。
[事實] 節目稱美國移民及海關執法局使用 Palantir 的 AI 系統整理民眾線報,並曾支付三千萬美元打造協助選擇遣返對象的監控平台。
[事實] 受訪者警告,把繳稅、出入境及其他紀錄透過 AI 整合到統一資料庫,會大幅增強政府的監控能力。
[事實] 以色列長期被指控以人臉辨識等技術監控巴勒斯坦人,近年亦使用 AI 整理情報及被攔截的通訊;然而 Anthropic 的報告沒有提到巴勒斯坦。
[推測] 報告對美國及其盟友的著墨較少,反映其案例框架可能受到「民主國家對抗威權聯盟」敘事影響。
[15:57] 模型蒸餾及其法律爭議
[事實] 模型蒸餾是以能力較強的模型作為「老師」,大量取得其回答或思維鏈,再用這些輸出訓練較小的「學生」模型。
[事實] Anthropic 把未經授權、以產業規模秘密擷取並複製模型能力的行為稱為「illicit distillation」。
[事實] 報告指控阿里巴巴曾在一段期間內進行至少 1.51 億次與蒸餾相關的交換;節目亦提到 Google、OpenAI 等公司曾對中國企業提出類似指控。
[事實] 受訪者指出,Anthropic 使用的是「illicit」而非「illegal」,報告也未能具體說明相關公司違反了哪一條法律。
[推測] 以著作權追究模型蒸餾存在困難,因模型生成內容通常不被視為享有著作權,而美國 AI 公司本身亦正面對出版商、媒體和作者提出的訓練資料侵權訴訟。
[18:42] 中國 AI 中轉站的灰色生意
[事實] 由於 Anthropic 和 OpenAI 不向中國大陸用戶開放服務,GitHub、X、Telegram 及淘寶等平台出現了提供 Claude、GPT 或多模型服務的中轉站市場。
[事實] 部分中轉站的售價可低至官方價格的一成,其降低成本的方式包括盜刷信用卡、竊取及轉賣帳號。
[事實] 另一種手法是偷換模型,把宣稱提供的高階 Claude 模型換成較便宜的低階版本或中國模型。
[事實] 節目引述研究稱,部分中轉站會暗中出售用戶與高階模型的對話紀錄及使用日誌,供其他科技公司作為模型蒸餾材料。
[推測] 若對話資料才是中轉站的主要收益來源,便能解釋它們為何可能把用戶請求轉給成本更高的模型:高品質回答可以成為更有價值的訓練資料。
[21:45] 敏感資料如何在不知情下外洩
[推測] Anthropic 能發現涉及中國軍方或國安機構的對話,可能不是相關人員主動使用 Claude,而是中轉站或中國 AI 公司暗中把請求轉送至 Claude。
[推測] 另一種可能是中國科技公司把 Claude 的回答包裝成自家模型的輸出,令用戶誤以為自己只在使用國產模型。
[推測] 因此,即使使用者遵守只用特定模型的規定,其敏感資料仍可能經代理服務流向第三方並被記錄。
[事實] 節目提醒所有 AI 與中轉站用戶:輸入資料可能在本人不知情的情況下被轉送、利用或洩露。
[23:01] 以監控辨識監控:AI 安全與隱私的矛盾
[事實] 報告證明 Anthropic 會記錄並審查部分使用者與 Claude 的對話,因此有人批評它「用大規模監控發現大規模監控」。
[事實] Anthropic 的隱私政策已表明,用戶與 AI 產品互動的輸入和輸出是公司可能收集的個人資料。
[推測] 為辨識和防範 AI 濫用,使用者讓渡部分隱私具有一定合理性,但公司仍應提高透明度,交代何人能在何種情況下查看對話。
[推測] 理想的安全機制應在濫用發生時直接拒絕有害請求,而不只是事後定期發布具話題性的案例報告。
[24:42] 為何濫用行為難以即時攔截
[事實] 單憑少量提示詞很難準確判斷使用者意圖,同一個問題可能用於武器開發,也可能屬於正當醫學或生物研究。
[事實] 記者查詢政治組織時提出的問題,可能與維穩機構使用者的問題完全相同,因此系統必須結合周邊線索判斷。
[事實] 報告利用「工作抓手」「民族分離主義」等與中國政府立場高度重合的措辭作為歸因線索,判斷使用者是否與中國情報單位有關。
[事實] 惡意行動者可以頻繁更換帳號,或把同一組請求拆分至不同帳號,以規避偵測。
[推測] 發布報告亦有展示公司已積極處理濫用問題的作用,但無法證明平台能在事件發生當下準確識別並阻止所有濫用。
[26:22] 以平常心看待 AI 的現實風險
[事實] 受訪者把 AI 視為類似 Google 的新數位工具,認為它能帶來便利與效率,但目前影響力未必可與電力、半導體或工業革命相比。
[事實] 他不認同 AI 覺醒、叛變並奴役人類的科幻末日想像。
[事實] 他認為更現實的風險包括大規模失業、權力與資源進一步集中,以及運算需求造成的能源消耗、碳排放和環境破壞。
[事實] 當前主流路線依賴不斷增加資料、算力及模型規模,但這並非唯一或必然最好的 AI 發展方式。
[推測] 現有技術路線可能是特定政治環境、商業利益和歷史偶然共同塑造的結果,因此社會需要持續質疑由少數矽谷企業主導的發展方向。
播客點評/總結
本期的亮點,是沒有停留在羅列 AI 詐騙與監控案例,而是進一步追問:誰有權定義「濫用」、案例為何以特定方式被選中,以及安全報告如何服務科技公司的政策和商業利益。這種對報告生產者自身立場的審視,為理解企業安全文件提供了重要方法。
對模型蒸餾和中轉站經濟的解釋尤其實用。節目清楚呈現低價 AI 代理服務背後可能存在的帳號犯罪、模型替換與資料轉售風險,也提醒使用者不要把未公開的中轉服務視為單純的技術通道。
節目的局限在於,不少結論來自對報告敘事、企業動機及資料流向的推論,部分涉事公司和案例亦難以獨立確認。節目有意區分已知事實與可能解釋,但聽眾仍需避免把合理推測當成已獲證實的因果關係。
本期適合關注 AI 治理、數位隱私、中美科技競爭及平台政治的人,也適合正在使用第三方 AI 代理或中轉服務的開發者與一般用戶。它最有價值的提醒是:AI 的風險不只來自模型本身,也來自掌握模型、資料、基礎設施及規則制定權的機構。