AI & ML分析GPT毒性分數連年下降,新研究:危害只是換了形狀三名研究人員讓從GPT-2到GPT-5共15個模型產生45萬則指定性別的回應,結果發現安全訓練並未移除露骨的歧視內容,而是把它轉換成分類器判定為無害的文字。Seung Jung·昨天5分鐘