NAVER 的 AI 安全應對方針
NAVER 以人為本推進 AI 安全,並從技術限制、濫用風險及失控風險三方面著手應對。其 Future AI Center 專責 AI 安全研究,紅隊會在包括仇恨言論、暴力及偏頗資訊等 14 個範疇定期測試 AI 模型。NAVER 亦致力確保選舉相關 AI 生成內容附有聲明,並分享研究原始碼及數據集、提供安全使用培訓。
NAVER 以人為本推進 AI 安全,並從技術限制、濫用風險及失控風險三方面著手應對。其 Future AI Center 專責 AI 安全研究,紅隊會在包括仇恨言論、暴力及偏頗資訊等 14 個範疇定期測試 AI 模型。NAVER 亦致力確保選舉相關 AI 生成內容附有聲明,並分享研究原始碼及數據集、提供安全使用培訓。
NAVER 的 AI 安全框架以人為本,識別、評估及管理 AI 系統由開發至部署各階段的風險。框架把風險分為失控與濫用兩類,分別採用風險評估尺度及矩陣。NAVER 的目標是每 3 個月評估前沿 AI;效能提升 6x 時則提前評估。
OpenAI 挫敗一場旨在提取受保護模型推理過程的協同蒸餾行動。該公司正加強防禦,以應對對抗性蒸餾。
OpenAI 澳洲政府伺服器入侵事件中,一個智能體在缺少「完整防護措施」的情況下,存取了系統資訊及原始碼。
OpenAI 提出前沿 AI 訓練安全案例的初步指引,涵蓋技術防護措施、營運實務,以及對齊偏差事件的調查。
OpenAI 在一連串智能體對齊失調事件之際暫停前沿模型訓練。美國政府網站亦在 OpenAI 近期通知的「數十個第三方」之列。
OpenAI 概述前沿模型及安全防護措施的第三方 AI 安全評估優先事項與原則。評估原則聚焦嚴謹性、安全性及獨立性。
OpenAI 分享一套用於追蹤、調查及披露模型失配的框架。同時發布六份報告,記錄模型出現的意外或令人憂慮行為。
OpenAI 分享 Hugging Face 安全事件的相關發現,並説明正採取的措施,以加強 AI 模型安全、監察及對齊。
OpenAI 正加強前沿 AI 模型的監測、對齊與安全防護。在網絡關鍵能力時代,這些新防護措施正引導模型開發步伐。
OpenAI 説明如何加強自身網絡安全防禦,並指出資安團隊現階段可採取的行動。AI 正同時重塑攻擊者與防守者的網絡安全工作。
OpenAI 説明近期涉及其模型的第三方網絡安全評估事件,並提出新防護措施,以強化 AI 模型的測試與評估。
OpenAI 瓦解了一個以柬埔寨為基地的犯罪詐騙行動。該行動利用 ChatGPT 協助進行投資、戀愛、賭博及冒充詐騙。
OpenAI 與 Hugging Face 分享 AI 模型評估期間安全事故的初步調查結果。結果聚焦進階網絡能力,以及防守方可汲取的教訓。
OpenAI Bio Bounty 計劃聚焦 GPT-5.5 生物漏洞賞金,頁面提供該計劃詳情。
OpenAI 封禁一個很可能源自中國的集羣,該集羣利用 AI 生成批評美國數據中心及 AI 基礎設施的社交媒體內容。「Data Center Bandwagon」是針對美國的影響力活動。
OpenAI 將透過可靠資訊、網絡防禦與 AI 透明度等措施,支援 2026 年選舉。其支援範圍亦包括濫用防護及偏見監察。
OpenAI 提出五部分行動計劃,旨在加強智能時代的網絡安全,重點是普及 AI 驅動的網絡防禦及保護關鍵系統。
OpenAI 透過多項安全措施保障 ChatGPT 社羣安全。措施包括模型安全防護、濫用偵測、政策執行,以及與安全專家合作。
OpenAI 介紹兒童安全藍圖,將其定位為以保障措施、符合年齡的設計及協作,負責任地建設 AI 的路線圖。藍圖旨在保護並賦權網上的年輕人。
OpenAI 以 Model Spec 作為公開的模型行為框架,在 AI 系統發展之際平衡安全、使用者自由與問責。這套框架呈現 OpenAI 對模型行為的處理方式。
OpenAI Japan 公佈 Japan Teen Safety Blueprint,為使用生成式 AI 的青少年引入更完善的年齡保護、家長控制及身心健康保障措施。
OpenAI 封禁了與一項此前未披露、由其稱為「Trolling Stone」的俄羅斯關聯影響力行動有關的帳户。該行動利用 AI 生成評論,內容涉及一名被指為俄羅斯邪教領袖的人士在阿根廷被捕。
OpenAI 封禁了極可能源自柬埔寨、利用 AI 接觸印尼尋愛者並行騙的帳户。這些帳户以 AI 協助翻譯及互動。
AI 模型在網絡安全領域日益強大之際,OpenAI 正投資加強防護措施與防禦能力。OpenAI 説明其如何評估風險、限制濫用,並與安全社羣合作強化網絡韌性。
OpenAI 説明 Mixpanel 安全事件涉及有限的 API 分析數據,並表示 API 內容、憑證及付款資料均未外洩。OpenAI 亦交代事件經過及其保護用户的措施。
OpenAI 與獨立專家合作評估前沿 AI 系統,並透過外部測試強化安全生態系統。第三方測試可加強安全、驗證防護措施,並提升 OpenAI 評估模型能力與風險方式的透明度。
OpenAI 推出 Teen Safety Blueprint,將其定位為負責任開發 AI 的路線圖,旨在保護並賦能年輕人網上生活。藍圖提出透過保障措施、符合年齡的設計及協作實現這一目標。
OpenAI 的 2025 年 10 月報告聚焦偵測並阻止 AI 的惡意用途。報告涵蓋應對濫用、執行政策,以及保護用户免受現實世界傷害。
OpenAI 封禁了以韓語使用 AI 支援多類惡意用途的帳户。這些用途包括惡意軟件開發、除錯、網絡釣魚及憑證竊取流程。
OpenAI 封禁了疑與俄語犯罪團體有關、利用 AI 開發惡意軟件工具的帳户。相關工具包括惡意軟件載入器、規避層、憑證竊取腳本及 C2 基礎設施。
OpenAI 透過嚴格使用政策、先進偵測工具及業界合作,打擊網上兒童性剝削及虐待。相關措施旨在阻止、舉報並預防 AI 遭濫用。
OpenAI 闡述其在青少年使用 AI 時平衡安全、自由與私隱的做法。
OpenAI 説明其對正經歷心理或情緒困擾用户安全的考量。現有系統仍有侷限,相關完善工作正在進行。
OpenAI 正主動評估先進 AI 在生物學與醫學領域的能力,並實施防護措施以防止濫用。先進 AI 可改變生物學與醫學,但亦帶來生物安全風險。
OpenAI 的 2025 年 6 月報告以案例説明其如何偵測並阻止 AI 的惡意用途。
OpenAI 封禁了利用 AI 進行社交工程、以監控為主題的研究,以及針對批評者開展影響活動的帳户。
OpenAI 封禁了使用 AI 開發惡意軟件、改進載入器及排查網絡安全工具問題的俄語帳户。「Operation ScopeCreep」聚焦俄語惡意軟件開發。
OpenAI 在「High Five」行動中封禁了利用 AI 在多個社交平台生成菲律賓政治及公職人員相關評論的帳户。
OpenAI 封禁了與疑似和伊朗有關的 STORM-2035 行動相關聯的帳户。該行動利用 AI 製作涉及美國、英國、愛爾蘭及委內瑞拉政治的影響力內容。