OpenAI 瓦解俄羅斯與伊朗的 AI「假門面」影響行動
Disrupting AI-enabled “false front” operations
OpenAI 表示已封禁兩組分別源自俄羅斯和伊朗、利用 ChatGPT 支援的秘密影響行動,並披露其以虛構人物與機構散播內容。俄羅斯行動經營拉丁美洲的 Social Research Center,評為 IO Breakout Scale 第 5 類;伊朗行動以七個假記者署名投稿,近 100 篇文章刊於約十多個網上媒體,評為第 4 類。
報告把兩宗行動放回傳統影響行動脈絡,並按突破程度分別評為第 5 類及第 4 類,呈現 AI 如何協助內容進入主流媒體。
瓦解利用 AI 的「假門面」行動
載入中…
分享
過去兩年半,我們曾報道過許多種不同方式,當中有威脅行為者嘗試利用我們的模型發動網絡攻擊、隱蔽影響行動(IO)、詐騙,以及其他違反《使用政策》的行為。我們發布這些報告,讓監管機構、業界同儕和更廣泛的社會瞭解我們觀察到威脅行為者如何嘗試利用 AI,並揭示他們試圖利用的漏洞。
我們最近封禁了兩項影響行動(IO),一項來自俄羅斯,另一項來自伊朗;這些行動利用我們的模型配合較傳統的手法和技術,支援精心策劃的「假門面」實體。他們利用這些實體,將地緣政治及衝突相關訊息包裝後傳播給目標受眾。伊朗行動安排了七個「記者」人設,向世界各地的中小型網上媒體推介長篇文章;俄羅斯行動則似乎招攬了拉丁美洲不知情的人士,在當地營運一個「智庫」。
兩項行動都涉及多個層面,並嘗試運用各種不同策略達成目標。除了撰寫長篇文章,伊朗行動亦大量生成社交媒體留言,內容通常與美伊戰爭有關。俄羅斯行動除了控制「智庫」,亦製作偽造的「外洩」文件和音訊稿件,其中部分被我們發現正在網上傳播。兩項行動亦大量使用 AI 撰寫內部報告(俄羅斯行動尤其如此);在兩個案例中,行動者都採用了可疑甚至公然欺騙的手法,誇大行動執行者的成效。
這些行動最值得注意之處,在於它們與 AI 出現前的複雜影響行動十分相似,但利用 AI 簡化了部分工作流程。伊朗行動所經營的「記者」人設,與假記者「Alice(在新視窗開啟)Donovan(在新視窗開啟)」十分相似;Alice Donovan 是俄羅斯軍事情報部門的掩護,其文章於 2016-17 年由多家西方媒體刊登。2020 年,與 Russian Internet Research Agency 過往活動有關的人士經營了一家名為「PeaceData(在新視窗開啟)」的假「新聞」媒體,並拉攏世界各地不知情的記者為其撰稿。
這些行動的潛在觸及範圍也相當罕見。使用 影響力行動突破規模(在新視窗開啟)(以 1(最低)至 6(最高)評定影響力行動),我們會將來自俄羅斯的行動評定為第 5 類。自我們開始發布報告以來,這是我們瓦解的首宗第 5 類行動。來自伊朗的行動則達到第 4 類。兩者均成功讓其內容登上主流媒體(當中並非全部由我們的模型生成),而非只是在社交媒體發布。這與我們在過去兩年半揭露的 30 宗隱蔽影響力行動中觀察到的模式一致:嘗試讓內容登上真正媒體,而非依賴虛假的社交媒體傳播的行動,往往具有最大的潛在觸及範圍和影響力。

自 2024 年初以來我們揭露的 30 宗影響力行動矩陣,按主要傳播方式(社交媒體、由行動方營運的網站、外部刊物)及突破規模評分列示。使用多於一種傳播方式的行動,例如營運網站並在社交媒體推廣該網站,會按看來構成行動核心的方式分類。
AI 可令這類偽裝門面行動更具規模、更有效率,並提升其語言流暢度和編輯能力。操作者可利用這些優勢,利用毫無戒心的受害者(例如僱員或編輯),並將內容呈現在受眾面前;受眾完全不知道幕後主使是誰,亦不知道其動機。這些行動亦展現了威脅行為者如何以複雜而精密的手法,利用虛假身份和實體達成目標。要在各機構維持穩健的防禦,必須瞭解威脅行為者在這些行動中利用的漏洞,以及這些漏洞如何令行動接觸受眾並擴大觸及範圍。
然而,這些偽裝門面行動的隱蔽性,也令它們特別容易受到負責任披露的影響。「Alice Donovan」和「PeaceData」在被揭露後均停止活動。因此,我們報告這些偽裝門面行動的目標,是讓後續研究和瓦解行動更容易,同時令這些行動更難以繼續。
俄羅斯:行動「Dark Clark」
來自俄羅斯的行動者在拉丁美洲各地執行影響力行動。
行動者
我們封禁了一組源自俄羅斯的 ChatGPT 帳戶。這些帳戶使用 ChatGPT 執行多種與針對拉丁美洲各國的隱蔽影響力行動相關的任務。大部分活動似乎旨在損害烏克蘭在該地區的聲譽,但部分活動似乎意在影響當地政治結果,尤其是在阿根廷和玻利維亞。大多數操作者以俄語輸入提示詞;其中一人以西班牙語輸入提示詞,但仍似乎身處俄羅斯。我們已向相關當局分享此個案的資訊。
行動人員使用 ChatGPT 完成三項主要工作:撰寫內部報告,記錄他們的活動(以及其他人所做、他們有可能冒認為己方成果的活動);為行動製作內容;以及撰寫有關拉丁美洲一個自稱為「研究平台」的機構 Social Research Center(SRC)表現的報告。他們似乎透過一個名為「Mia Clark」的虛構身份控制 SRC;為呼應這個名字,我們將這項行動暱稱為「Dark Clark」。由於我們不允許俄羅斯境內的用戶存取我們的模型,他們使用 VPN 連接我們的服務。
在內部報告中,行動人員聲稱曾在拉丁美洲散播虛假消息,以削弱烏克蘭或當地領導人的地位。其中一些虛假消息被開源(在新視窗中開啟)研究人員(在新視窗中開啟)歸因於一個名為「Politology」或「La Compania」的俄羅斯實體;據報該實體是 Wagner Group 及其他由俄羅斯寡頭 Yevgeniy Prigozhin 創立實體的後繼組織。行動人員也要求我們的模型翻譯或解釋有關 Politology 和 Wagner 的公開報道;他們查詢這些內容的次數,遠多於查詢任何其他源自俄羅斯的網絡。
這項行動有兩方面較為特殊。首先,它似乎成功吸納了拉丁美洲人士為 SRC 工作。俄羅斯行動人員有關 SRC 的報告提及薪酬級別、招聘及解僱等事項的決策,顯示他們是在控制該機構,而非與之合作。現有證據顯示,SRC 在拉丁美洲的員工並不知道自己是為一個俄羅斯組織工作。與我們最近揭露的另一個與俄羅斯有關的「智庫」不同,SRC 似乎透過吸納的員工製作了大部分原創內容。這是我們過去兩年半來瓦解的最複雜掩護身份運作嘗試。
其次,部分公開來源證據顯示,Dark Clark 散播的虛假消息廣泛流傳,足以引發事實查核(在新視窗中開啟)及官方否認聲明(在新視窗中開啟),顯示其滲透程度超越了我們過去兩年瓦解的任何影響力行動。這項行動聲稱曾在秘魯散播的一則假消息,甚至助長了烏克蘭與波蘭之間的公開緊張局勢。
內部報告
行動人員使用 ChatGPT 的主要方式,是為一名身分不明的上級撰寫及更新內部報告。這些定期報告記錄了他們在拉丁美洲各地進行秘密影響力行動的工作,涵蓋三個主要範疇:詆毀烏克蘭及削弱烏克蘭武裝部隊的招募工作;幹預若干國家的國內政治,尤其是玻利維亞和阿根廷;以及管理 SRC。在大多數情況下,我們沒有觀察到威脅行為者使用我們的模型為這些行動製作內容,只見他們用模型匯報相關行動(少數例外情況見下文)。
這些報告包含豐富的戰術細節,揭示該行動如何試圖削弱烏克蘭及部分國家領導人的地位,尤其是阿根廷、玻利維亞和厄瓜多爾的總統。部分報告提及誘騙當地人執行活動,讓行動人員可以將這些活動武器化利用;其他報告則提及行動人員聲稱曾散播虛假的「外洩消息」。
在兩宗個案中,證據將操作人員與有關「Politology」的公開報道聯繫起來。操作人員稱,他們在2024年發起兩項針對阿根廷總統Javier Milei的行動。首先,他們稱曾散播一則虛假消息,指Milei為他的狗購入Cartier鑲寶石項圈。其次,他們聲稱曾付錢給當地人士,讓他們在布宜諾斯艾利斯張貼反Milei塗鴉。根據外洩文件,這兩項説法均已被公開(在新視窗開啟)歸因於(在新視窗開啟)「Politology」及「La Compania」。
還有更多假消息此前未被指與俄羅斯資訊行動有關。例如,操作人員聲稱,他們在2026年5月建立了一個虛假電郵地址,冒充秘魯利馬區域教育局。他們利用該電郵指示區內學校,在全國文化及語言多樣性日(5月21日)舉辦以烏克蘭為主題的活動。電郵明確指示學校提及包括具爭議性的20世紀烏克蘭民族主義者Stepan Bandera在內的人物;部分烏克蘭人視他為獨立運動人物,但他在俄羅斯及波蘭則與法西斯主義、戰時通敵及暴行相聯繫。操作人員稱,有些學校回覆了這個虛假電郵地址,確認曾舉辦相關活動,甚至附上照片。
操作人員隨後聲稱,他們安排秘魯及波蘭媒體刊出有關活動的報道,並指控烏克蘭正在「輸出」極端民族主義思想,引發公憤。公開來源搜尋找到了與此説法相符的秘魯(在新視窗開啟)及(在新視窗開啟)波蘭(在新視窗開啟)媒體報道(在新視窗開啟),以及一份匈牙利(在新視窗開啟)英文刊物的報道(部分文章其後已被刪除)。部分(在新視窗開啟)文章(在新視窗開啟)引述一名波蘭籍歐洲議會議員的回應,建議將表現出「反波蘭」傾向的人列為在波蘭不受歡迎人物。這則俄羅斯假消息既利用了烏克蘭人與波蘭人之間的歷史矛盾,也進一步加劇了這些矛盾。
同樣地,6 月,操作者聲稱他們使用另一個虛假的電郵地址,誘騙厄瓜多爾的學校舉行儀式,宣誓效忠總統 Daniel Noboa 和私營軍事承包商 Blackwater 前主管 Erik Prince。操作者聲稱,這宗事件在厄瓜多爾引發公憤,並向政府施壓,要求政府否認這項虛假説法,從而將其傳播至全國受眾。同樣,開源研究發現,媒體(在新視窗中開啟)報道(在新視窗中開啟)厄瓜多爾的(在新視窗中開啟)新聞界(在新視窗中開啟)有與這項説法極為相似的報道,甚至還有厄瓜多爾教育部長發表的詳細反駁(在新視窗中開啟)。
操作人員採用多種手法支撐其虛假敍事。根據其內部報告,他們在3月散播了兩則針對厄瓜多爾的虛假內容。其中一則是偽造音訊,聲稱來自烏克蘭駐厄瓜多爾領事,內容據稱是他出言貶低厄瓜多爾人。我們的公開來源調查發現,TikTok 上有一則貼文與這項説法完全吻合;該貼文似乎只有有限的互動。另一則報告描述了一段偽造影片片段,該片段以一家真實新聞頻道的標誌在 X 和 TikTok 上傳播,聲稱 Noboa 政府正招募年輕男子前往烏克蘭參戰。厄瓜多爾的事實查核人員(在新視窗開啟)在4月初描述過一場與上述情況相符的行動。

2026年4月8日發布的 TikTok 影片,配有該行動聲稱散播、並指稱來自烏克蘭領事的偽造音訊。
另一份內部報告描述了操作人員在5月下旬、反政府示威最激烈期間於玻利維亞散播的一則虛假訊息。操作人員明確表示,這場行動旨在加劇示威引發的危機。行動中出現一段偽造錄音,聲稱是國營供水公司 EPSAS 的一名員工表示,政府將切斷行政首都拉巴斯的供水,並宣佈進入緊急狀態。我們的公開來源研究找到一項針對相同説法的闢謠(在新視窗開啟),以及 EPSAS 發布的官方否認(在新視窗開啟)。
其他內部報告亦提及一些虛假內容,但我們無法透過公開來源核實,可能是這些內容已被下架,或未能傳播開來。例如,操作人員聲稱曾在1月散播一則消息,指一名巴西網紅兼模特兒遭烏克蘭大使館代表販運至烏克蘭,並在基輔被殺。6月,他們聲稱在玻利維亞散播另一段偽造音訊,這次假稱是由玻利維亞中央銀行一名員工發出,警告該銀行即將限制現金提款。他們還聲稱散播一封偽造的該國碳氫化合物機構信件,警告將限制向私家車出售燃油。
在其他報告中,行動人員要求我們的模型協助找出目標國家的事件,讓他們可以認領功勞,即使他們並未參與其中。例如,在阿根廷,行動人員聲稱,阿根廷外交部長曾在聯合國一場討論福克蘭羣島/馬爾維納斯羣島的委員會會議上引用他們的行動。行動人員認領了散播以下論點的功勞:自決原則不適用於這些島嶼,而英國在當地維持的軍事存在不成比例。事實上,這兩項論點早已是阿根廷的官方立場多年(在新視窗中開啟)來(在新視窗中開啟)。同樣地,6 月,巴西媒體報道(在新視窗中開啟)一宗案件:一名巴西公民前往烏克蘭參軍,被俄軍俘虜,之後在電視上發表聲明,稱自己受騙參戰。ChatGPT 的行動人員試圖聲稱,這則報道重現了其行動的訊息;事實上,報道引用了俘虜本人的影片(在新視窗中開啟)。這顯示行動人員或試圖發動影響力行動,目標是自己的僱主,而非任何外部受眾。
「研究平台」
行動人員的部分報告提到一個自稱為「研究平台」的組織,名為 Social Research Center(俄文:Центр социологических исследований)。根據 SRC 網站的資料,該組織關注拉丁美洲的印度裔社羣,以及印度與該區各國的關係。
內部報告顯示,行動人員控制了這家智庫,而不只是與它合作。報告提及招聘和解僱決定、薪酬級別、人手計劃,以及正在進行的研究項目等。關鍵的是,報告亦指出,行動人員創造了一個名為「Mia Clark」的假身份,負責管理該行動的社交媒體活動,並與拉丁美洲當地員工交流。現有證據顯示,這些當地員工不知道自己是在為俄羅斯行動效力,並且本着誠信完成研究工作。這種利用不知情中間人的做法,與早前另一項同樣與普里戈任圈子有關的俄羅斯行動「PeaceData」十分相似。Meta 在 2020 年揭露(在新視窗中開啟)了該行動。
從俄羅斯行動人員的報告來看,他們在拉丁美洲當地的員工曾訪問區內各地的專家和評論員,並根據調查結果撰寫研究報告。研究主題涵蓋廣泛分析公眾對金磚國家的看法,以至詳細比較 Jair Bolsonaro 和 Luiz Inácio Lula da Silva 擔任總統期間的巴西經濟。有時,俄羅斯行動人員會在研究項目發表前撰寫進度報告,顯示他們密切參與製作過程。我們在 SRC 網站上找到逾 60 篇文章,絕大部分看來都是原創。這使 Dark Clark 有別於我們最近揭露的、同樣以智庫作掩護的俄羅斯源頭行動;該行動的大部分內容都是抄襲而來。這顯示其意圖是建立一個更持久的掩護機構,並在拉丁美洲各地建立聯繫。
為宣傳 SRC 的工作,俄羅斯操作人員聲稱曾嘗試建立社交媒體資產網絡。根據他們的報告,當世界各地不同地區的操作人員嘗試登入相同帳戶時,這些社交媒體活動遇到問題,導致帳戶受到限制。公開來源資料中可見相關痕跡:例如,SRC 在 X 的主要帳戶,其透明度設定顯示所在地為德國(可能是使用 VPN 所致),但顯示帳戶經俄羅斯聯邦 App Store 連線;其中一個 Instagram 帳戶的透明度設定則顯示管理員位於委內瑞拉。我們識別出的三個 SRC 品牌 Facebook 帳戶,追蹤者均不足以觸發管理員位置設定。

左:與 Social Research Center 有關的 X 帳戶。請留意其透明度設定顯示帳戶經俄羅斯聯邦 App Store 連線。右:SRC Instagram 帳戶;請留意委內瑞拉的位置。
操作人員報告稱,他們在 LinkedIn 遇到特別多問題。他們表示,曾建立一個明確屬於假帳戶的帳戶來代表 SRC,但之後難以為該帳戶建立人脈網絡。根據他們的報告,解決方法是建立更多假帳戶,追蹤第一個帳戶,令它看起來更可信。截至 8 月 17 日,一個採用相同 Social Research Center 品牌的 LinkedIn 帳戶有 961 名追蹤者,並聲稱有 200-500 名員工,但只列出兩名員工。
建立假帳戶
除了使用 AI 更新報告外,操作人員偶爾也會要求我們的模型協助設計和撰寫可用於其行動的文本:例如,請模型協助確保假帳戶使用符合不同國家的正確口音、詞彙和機構文風。這只佔整體工作量一小部分,可能是因為行動中似乎至少有一名來自拉丁美洲、以西班牙語為母語的人,因此較少需要 AI 提供語言支援。
例如,有一次,一名説俄語的操作人員要求模型以俄語草擬一封信,令烏克蘭駐巴拿馬名譽領事牽涉貪腐。其後,説西班牙語的操作人員要求模型把信件翻譯成西班牙語,並撰寫配合信件的音訊旁白稿。一個聲稱是新聞媒體的帳戶在 TikTok 發佈了一張與信件內容相符的照片,配上與操作人員旁白稿相符的配音;該帳戶使用了巴拿馬 TVN Noticias(在新視窗開啟) 的標誌。該 TikTok 頻道只有一名追蹤者,在散播這則假消息後便停止發文。

這則 TikTok 貼文展示了由該行動生成文字內容的信件,配音旁白稿同樣由該行動生成。
另一次,身處俄羅斯、説西班牙語的操作人員向模型提供一段俄語稿件,聲稱 Noboa 曾侮辱厄瓜多爾的窮人,並要求模型將其翻譯成厄瓜多爾西班牙語。第三次是在 3 月,同一名用戶要求模型校對一份西班牙語合約草稿。合約由一家名為「International Security Solutions FZE」的公司與一名厄瓜多爾人士簽訂,聲稱要在烏克蘭提供基建服務。用戶的問題集中於如何改善措辭和版面,包括詢問哪些字詞應以粗體顯示。
用戶就合約提出的提示詞,在措辭定稿後便告結束。然而,公開來源研究顯示,一張「合約」的圖片其後在社交媒體上流傳(在新視窗中開啟)。這張圖片被用來支持一項説法,指 Noboa 政府曾與一家掩護公司合作,誘騙厄瓜多爾人加入烏克蘭軍隊。這份偽造文件廣泛流傳,甚至促使事實查核機構在 4 月初進行查核(在新視窗中開啟):查核人員認為,該公司「並未出現在厄瓜多爾公司、證券及保險監管局的登記冊中」。
影響
評估這項行動的影響時,必須格外謹慎。如上所述,行動者的主要手法之一,是把與其行動毫無關係的活動歸功於自己。因此,他們在內部報告中自行聲稱的影響,不能盡信。同樣地,他們聲稱散播的部分假消息,未能在公開來源研究中找到;這可能是因為相關內容只在非公開渠道傳播、已被移除,或根本沒有發布。
然而,公開來源證據讓我們得以核實他們部分説法。行動聲稱散播的部分假消息,其後獲事實查核機構報道,並遭政府駁斥,顯示其傳播範圍可能廣泛到足以引起回應。在其他個案中,我們則在網上找到與這項行動生成的內容高度相似的內容。最值得注意的是,行動聲稱曾誘騙一所秘魯學校舉辦一場描繪 Bandera 的活動;這件事其後在拉丁美洲和歐洲均有報道,似乎也引來至少一名波蘭籍歐洲議會議員評論。
使用 IO Breakout Scale(在新視窗中開啟)評估。該尺度以 1(最低)至 6(最高)為 IO 評分;我們認為這項行動屬於第 5 類,有證據顯示,多個國家的政界人士曾就此公開發表評論。自我們開始發布報告以來,這是我們瓦解的首個第 5 類行動。
伊朗:「Bogus Bylines」行動
源自伊朗的行動,以欺騙性署名在網上新聞媒體散播長篇文章。
行動者
我們封鎖了一批源自伊朗的 ChatGPT 帳戶。這些帳戶以波斯語輸入提示詞,並生成波斯語及英文內容。行動者透過 VPN 使用 ChatGPT,以隱藏所在地。
這項行動利用我們的模型修訂長篇文章和編輯提案、生成社交媒體留言,以及潤飾內部報告。行動者以七個不同署名投稿,因此我們將這項行動稱為「Bogus Bylines」。長篇文章聚焦美伊衝突。大部分留言同樣圍繞這場衝突;少數則涉及美國政治,通常置於衝突更廣泛的背景下討論。
其主要工作範疇所造成的明顯影響差異甚大。我們在全球約十多家網上媒體上,找到近 100 篇以該行動的署名刊登或透過內容聯播發佈的文章。這些媒體規模由小型至中型不等,通常聚焦國際事務、地緣政治及中東局勢。相比之下,社交媒體留言似乎沒有引發大量互動,例如讚好、分享或後續回覆。事實上,操作人員的內部報告使用了一種具誤導性的計算方式來衡量其社交媒體影響力,可能是試圖誇大行動成效。
整體活動看來符合商業機構受聘執行影響力行動的模式,但我們未能確認涉事的特定機構。我們已向相關當局分享本案資訊。
刊登文章
這項行動影響最廣泛的活動,是要求 ChatGPT 審閲及潤飾探討美伊衝突地緣政治的英文長篇文章。常見提示詞會要求模型按特定網上媒體的投稿標準評估英文草稿,並建議修改方式以確保文章符合要求。操作人員批准修改內容後,便會要求模型撰寫電郵,供他們用來向相關網上媒體的編輯推介文章。
這些投稿推介訊息以七個不同的假署名撰寫:Ervin B. Hoskins、Noah Lamington、Sophia Gonzalez、Michael Harrison、Ericka Feusier、Jenny Williams 和 Alice Johnson。根據部分文章在網上刊登時附帶的簡介,這些人設都自稱是西方記者(通常是美國人,但 Noah Lamington 的簡介聲稱其身在新西蘭),並且經常專注於國際政治、中東、人權或衝突。其中一個人設「Michael Harrison」的簡介,是由操作人員要求模型撰寫的。(值得注意的是,Meta 於 3 月挫敗(在新視窗中開啟)一項伊朗影響力行動,當中也有一個名為「Michael Harrison」的記者人設。)
部分人設在多個社交媒體平台上都有帳戶作為支撐。例如,Michael Harrison 人設在 Medium、X 和 Facebook 上都有帳戶。Ervin B. Hoskins 人設則在 X、Facebook、Instagram 和 Threads 上設有帳戶。這個人設的簡介自稱「一名美國自由撰稿人」,但社交媒體的透明度設定顯示其帳戶位於伊朗。

上方:Ervin Hoskins 人設的 Instagram 簡介。左下:X 帳戶透明度資訊,顯示使用 West Asia Android app。右下:Instagram 帳戶透明度資訊,顯示所在地為伊朗。Meta 於 8 月封禁該 Instagram 帳戶。
我們運用公開來源調查方法,找到近 100 篇以操作人員其中一個署名刊登的文章,分佈於十多家不同刊物。這些刊物通常聚焦國際事務、地緣政治及中東局勢,有時會採取反戰或進步派觀點。我們找到最早的一篇文章於 2025 年 7 月刊登,最新的一篇則於 2026 年 10 月刊登。美伊衝突爆發後,文章刊登頻率大幅增加。

按作者及主題劃分的文章時間線,2025年7月至2026年9月。請注意,自2026年3月起,有關美伊關係的文章發表得相當密集。

2026年2月至7月期間,在多個網上媒體以與此行動相關的作者署名發表的文章標題示例。
相關媒體的社交媒體帳戶其後至少推廣了部分文章,讓伊朗操作者有機會接觸原本無法觸及的受眾。
大量留言
除了撰寫文章,威脅行為者亦要求 ChatGPT 以英文或波斯語,就地緣政治或政治議題生成多批留言。行動人員通常會輸入社交媒體貼文的文字或截圖,並要求模型生成一組符合其整體方向的回覆。這些回覆其後被發布到網上,往往彼此相隔只有幾分鐘。行動人員的內部報告提到人工及自動發布兩種方式;我們沒有證據顯示這種自動化是藉助我們的模型進行。

這項行動於7月生成並發布的英文推文(左)及波斯語推文(右)。英文留言回覆一則英文推文,該推文警告美國正準備對伊朗發動「大規模攻擊」。此圖片中的所有留言均在10分鐘內發布。波斯語留言回覆一則有關美國空襲伊朗的波斯語推文,並在13分鐘內發布。
部分成批留言活動是針對有關該行動自身新聞文章的社交媒體貼文生成回覆。行動人員在此輸入了推廣其文章的貼文截圖,然後生成讚揚或支持這些文章的留言,可能是為了令文章看起來更受歡迎。

美國地方新聞專頁在 Facebook 發布的貼文,分享了一篇由該行動生成的文章;該行動亦生成了這則貼文下的留言。
大部分留言批次較為廣泛地聚焦伊朗、美國與以色列之間的衝突。用戶要求就導彈襲擊、停火及外交角力等議題生成留言,並指定內容要把美國描繪成侵略者、把以色列描繪成不可靠的美國盟友,以及把伊朗描繪成堅決反抗但仍堅韌的受害者。行動人員尤其大量回覆英國衞星電視網 Iran International(批評伊朗政權的媒體)發布的貼文,生成了二十多批帶有敵意的波斯語回覆。少數留言批次則是回覆有關美國政治議題的社交媒體貼文,通常同樣置於這場衝突的大背景下。

該行動生成、用以回覆有關美國政治貼文的 Instagram 留言。
我們發現網上發布的這類回覆為數不多;在我們的公開來源搜尋中,更多回覆並未出現,可能是因為它們沒有被發布,或是由已遭停用的帳戶發布。(例如,三個記者身份——Ericka Feusier、Alice Johnson 及 Jenny Williams——在已發布的個人簡介中列出了 X 帳戶名稱;截至2026年8月,這些帳戶全已遭停用。)部分曾在網上發布留言的帳戶使用看似西方人名的名稱,但帳戶所在地顯示為伊朗。

發布上述留言的 Instagram 帳戶的透明度設定,顯示這些帳戶所在地為伊朗。
我們找到這些回覆時,它們通常只佔相關貼文留言總數的一小部分,顯示這些操作者並非真實回應中的主導聲音。這些回覆似乎也未獲得大量互動:事實上,行動回覆收到的許多讚好,來自本身亦與行動有關聯的帳戶。我們已與業界夥伴分享此個案的資訊,他們最適合就互動情況作全面評估。
內部報告
他們試圖讓自己的活動看起來更受歡迎,並不限於面向公眾的貼文。除了生成內容,這些操作者偶爾也會要求 ChatGPT 潤飾一些看似有關其社交媒體行動的內部報告。通常,他們會向模型提供一系列統計數據,並要求模型將其整理成經過潤飾的簡報。
這不是我們瓦解的首個利用 AI 撰寫自己的(在新視窗開啟)自我評估(在新視窗開啟)的行動。伊朗操作者自行評估成效的方式最令人注目。他們採用的主要「影響力」指標,是他們回覆的貼文瀏覽次數(並非實際回覆的瀏覽次數),分別在回覆發佈前,以及發佈後一段未有説明的時間計算。這種計算方式沒有考慮到可能由其他因素帶來的瀏覽次數,例如原貼文的受歡迎程度或其他留言。因此,這大大誇大了該行動的影響力數字,顯示操作者可能不知道更有效的計算方法,或選擇不採用這種方法。
影響力
事實上,根據可從公開來源觀察所得的證據,該行動的兩項主要工作似乎有截然不同的潛在影響力。
我們能夠識別的社交媒體回覆,通常只有少量讚好、瀏覽和留言(個位數或兩位數)。如上所述,這些回覆通常只佔相關貼文留言總數的一小部分。根據 IO Breakout Scale(在新視窗開啟)(以 1(最低)至 6(最高)評定 IO),我們會將這部分行動評為第 2 類:在多個平台發佈留言,但幾乎沒有擴散或主導回覆的跡象。
相比之下,記者人設成功讓多間媒體刊登其文章,其中一些媒體擁有大量追蹤者。例如,截至 2026 年 8 月,其中一間刊登該行動文章的網上媒體在 Facebook 有近 2 million 名追蹤者、在 X 有近 355,000 名追蹤者,並在 Instagram 有超過 544,000 名追蹤者。由於該行動的內容持續在多間媒體擴散,我們會將這部分評為第 4 類。
作者
OpenAI
來源:OpenAI News · openai.com