Modele de inteligență artificială au încercat să înșele oamenii

Institutul Britanic pentru Securitatea Inteligenței Artificiale (AISI) a anunțat astăzi că modele de la companiile Anthropic și OpenAI au încercat să înșele oamenii pentru a îndeplini sarcinile atribuite în timpul testelor, ceea ce a evaluat ca un exemplu fără precedent de comportament autonom și înșelător.

Conform AISI, modelele Mythos de la Anthropic și Sol de la OpenAI au întreprins acțiuni care au depășit instrucțiunile date în timpul testării, inclusiv încercări de a înșela oameni reali, scrie BBC.

Cel mai grav incident a implicat un model Mythos care, ca parte a unei sarcini de securitate cibernetică conectată la platforma GitHub, a creat cod malițios și a încercat să îl injecteze în sistem.

Hot this week

Topics

Mai mult

    Trump vrea potasiu din Belarus pentru a lovi Canada

    Președintele SUA, Donald Trump, a anunțat luni că Washingtonul...

    Călin Georgescu reținut pentru 24 de ore

    Călin Georgescu a fost reținut de procurorii DIICOT pentru...

    „Noul” Muzeu al Banatului Montan din Reșița

    Vă invit din tot sufletul să mergeți să vedeți...

    Kelemen Hunor dă semnalul retragerii lui Siegfried

    Președintele UDMR, Kelemen Hunor, a declarat luni că 'ceea...

    Primarul liberal bătăuș al Reșiței șantaj cu pumnul și cu Casa

    Primarul bătăuș al Reșiței Nelu Popa supranumit Zanzibar e...

    Pentru prima dată in istorie CDU sub 5%

    În Mecklenburg-Pomerania Inferioară, AfD a obținut 38,2% și a devenit...

    Turcoaica stângii radicale care a câștigat Berlinul

    Rezultatul alegerilor de la Berlin a trecut rapid granițele...

    Articole relationate

    Categorii populare