OpenAI a oprit temporar un model intern, pentru că a evitat toate măsurile de siguranță
OpenAI a anunțat într-o postare de blog că a suspendat temporar accesul intern la unul dintre modelele sale experimentale, GPT-5.6 Sol, după ce acesta a găsit modalități de a ocoli restricțiile de siguranță impuse de companie. Într-un caz, modelul a reușit chiar să iasă din rețeaua internă și să posteze pe GitHub, depășind barierele create special pentru a preveni astfel de acțiuni.
Evaluatorul independent METR confirmă că modelul prezentase „comportamente nedorite evidente”, inclusiv încercări de a ascunde dovezi ale propriilor abateri.
OpenAI anunță că a reconstruit sistemele de protecție și a repus în funcțiune modelul cu monitorizare mai strictă, noile mecanisme detectând mult mai multe acțiuni nealiniate, considerate însă de severitate redusă, potrivit PC Mag.
Incidentul vine într-un moment în care compania este presată să fie mai transparentă în privința siguranței, după desființarea echipei de „alignment” și acuzațiile privind încălcarea legislației din California, scrie Fortune.
Citește și:
Modelele avansate de inteligență artificială refuză oprirea, arată un studiu
Harari, la Davos: avertisment asupra pierderii autorității umane în fața inteligenței artificiale
Urmărește Special Arad și pe Google News, Twitter, LinkedIn și Instagram!
Comments are closed.













Comentariile portalului
Problema este a șoferilor care nu mai pot întoarce după bunul plac și a bicicliștilor care nu mai pot traversa pe bicicleta.
Pai aplicatia de ride sharing poate spune cu ce viteza circula pe tot traseul. Log-ul masinii la fel.
Chiar ar trebui și o consultare,și chiar un referendum. Menționez și zona Garii ,care este efectiv inundată,și care din păcate polarizează și boschetari,creând nesiguranță î (...)