Biztonság

Tréning GPT‑Red ellen: a GPT‑5.6 Sol jelentősen ellenállóbbá vált

A GPT‑5.6 fejlesztői GPT‑Red ellenes tréninggel növelték a modell ellenállását: visszajátszották GPT‑Red legerősebb támadásait, amelyeket a modell nem látott a tanulás során.

Tréning GPT‑Red ellen: a GPT‑5.6 Sol jelentősen ellenállóbbá vált

A GPT‑5.6 fejlesztői GPT‑Red ellenes tréninggel növelték a modell ellenállását: visszajátszották GPT‑Red legerősebb támadásait, amelyeket a modell nem látott a tanulás során. A GPT‑5.6 Sol hatékonynak bizonyult, és 6× kevesebb hibát produkált a promptinjekciók során a négy hónappal korábbi legjobb üzemelő modellhez képest, ami fontos előrelépés a modellbiztonságban.