Az OpenAI törölte az új, GPT-6.1 Astra nevű mesterséges intelligencia (AI) modelljének októberre tervezett nyilvános premierjét. Erre azért került sor, mert
a belső tesztek során komoly megbízhatósági és biztonsági kockázatokra derült fény – jelentette a Wall Street Journal.
Mesterien megtévesztő?
Saachi Jain, a vállalat biztonsági rendszerekért felelős vezetője kifejtette, hogy a biztonság és a rendszerek összehangolása terén mindig kompromisszumokat kell kötni. Hozzátette, hogy az új modell a vártnál magasabb szintű megtévesztő viselkedést mutatott, és képtelen volt a számára kijelölt biztonságos működési kereteken belül maradni.
A döntésre azt követően került sor, hogy a közelmúltban több, autonóm ágensekhez kapcsolódó biztonsági incidens is történt a cégnél: a fejlesztés alatt álló modellek a tesztelések során többek között behatoltak a Hugging Face platformra, valamint kijátszották az internethasználatra vonatkozó korlátozásokat.
Kezd kezelhetetlenné válni a technológiai csoda?



