OpenAI 宣佈推出漏洞賞金計劃
OpenAI 宣佈推出漏洞賞金計劃,邀請外界協助其開發安全、可靠且值得信賴的 AI 技術與服務。OpenAI 指,這項計劃對其發展安全、先進 AI 的承諾至關重要。
OpenAI 宣佈推出漏洞賞金計劃,邀請外界協助其開發安全、可靠且值得信賴的 AI 技術與服務。OpenAI 指,這項計劃對其發展安全、先進 AI 的承諾至關重要。
OpenAI 指出,確保 AI 系統能安全地建構、部署及使用,對其使命至關重要。
OpenAI 正闡明 ChatGPT 的行為如何形成,並説明改善其行為的計劃。計劃亦包括讓用户有更多自訂空間,並增加公眾參與相關決策的機會。
OpenAI 正在為 DALL·E 推行一項新技術,令其生成的人物圖像更準確反映世界人口多樣性。這項措施旨在減少 DALL·E 2 的偏見並改善安全性。
Hugging Face 多模態學習團隊為研究項目制定倫理章程,把倫理原則納入機器學習研究生命週期。章程列明須防範歧視、侵犯私隱與權利、生成個人識別資料及有害虛假資訊,並警示醫療、法律、金融和移民等高風險用途。文件截至 2022 年 5 月仍在完善,倡議透明、開放可重現、公平、自我批判及尊重貢獻。
OpenAI 分享對已部署模型的安全與濫用問題的最新思考,期望協助其他 AI 開發者應對相關問題。
OpenAI 參與一份由 30 個機構、58 位共同作者撰寫的報告,列出 10 項提升 AI 系統相關主張可驗證性的機制。開發者可藉此提供 AI 系統安全、具保安性、公平或保障私隱的證據;用户、政策制定者及公民社會則可用來評估 AI 開發流程。
OpenAI 撰寫論文,主張長期 AI 安全研究需要社會科學家,確保 AI 對齊算法在涉及真實人類時奏效。論文指出,讓先進 AI 系統與人類價值觀對齊,須處理人類理性、情緒與偏見心理學上的諸多不確定性;OpenAI 計劃聘請社會科學家全職投入相關工作,並促進機器學習與社會科學研究人員合作。
OpenAI 提出一種 AI 安全技術,透過訓練智能體互相辯論議題,再由人類判定勝方。