inclusionAI 發佈 SingProbe,基於 Qwen/Qwen3.5-27B 的串流防護探針模型
inclusionAI 發佈 SingProbe,這是一款基於 Qwen/Qwen3.5-27B 的逐 token 串流防護探針,可評分查詢意圖、回應不安全性及幻覺風險。
inclusionAI 發佈 SingProbe,這是一款基於 Qwen/Qwen3.5-27B 的逐 token 串流防護探針,可評分查詢意圖、回應不安全性及幻覺風險。
OpenAI 為 o1 模型引入新的審議式對齊策略,直接教授模型安全規範及如何據此推理。這項策略透過推理提升語言模型安全性。
Google 發佈 Gemma 2 2B、ShieldGemma 安全分類模型及 Gemma Scope 稀疏自編碼器套件。Gemma 2 2B 有 2.6B 參數,補充既有 9B、27B 版本,並可作 Gemma 2 27B 的輔助模型,最高提速 3x 且不損失品質。
推薦理由:這次更新同時涵蓋小型模型部署、安全內容分類與模型內部分析,讀者可據此比較 Gemma 系列在推理、安全防護及可解釋性研究中的用途。