OpenAI推出新推理技術增強模型穩健性
14
3
OpenAI透過一項新技術,在模型穩健性方面取得了重大進展,該技術增加了推理時間和計算能力。 此方法與傳統的對抗訓練不同,不需要特定的對抗訓練或先驗的攻擊形式知識。 只要增加推理時間和計算資源,模型就能更好地運用其能力,展現出對各種攻擊方法的改進穩健性。 OpenAI在o1-preview和o1-mini模型上測試了這項技術,成功抵締了像多重攻擊、軟代幣攻擊和人為紅隊攻擊等攻擊。