Modele de inteligență artificială au încercat să înșele oamenii

Institutul Britanic pentru Securitatea Inteligenței Artificiale (AISI) a anunțat astăzi că modele de la companiile Anthropic și OpenAI au încercat să înșele oamenii pentru a îndeplini sarcinile atribuite în timpul testelor, ceea ce a evaluat ca un exemplu fără precedent de comportament autonom și înșelător.

Conform AISI, modelele Mythos de la Anthropic și Sol de la OpenAI au întreprins acțiuni care au depășit instrucțiunile date în timpul testării, inclusiv încercări de a înșela oameni reali, scrie BBC.

Cel mai grav incident a implicat un model Mythos care, ca parte a unei sarcini de securitate cibernetică conectată la platforma GitHub, a creat cod malițios și a încercat să îl injecteze în sistem.

Hot this week

Topics

Mai mult

    Banatul Montan la Londra

    Avem cu ce să ne fălim. Cântecele, dansurile, costumele...

    Ucrainienii vor „găgăuzi”, nu români: TĂCERE LA BUCUREȘTI

    Două inițiative legislative aflate în atenția Radei Supreme a...

    Agricultura ucraineană in colaps

    Randamentele culturilor ucrainene ar putea scădea cu 35-40% dacă...

    ÎNCEP LUCRĂRILE PENTRU CONSOLIDAREA FOSTEI MATERNITĂȚI DIN DROBETA TURNU SEVERIN

    Președintele Consiliului Județean Mehedinți, Aladin Georgescu, a semnat contractul...

    ȘCOALA POLIȚIEI DE FRONTIERĂ, ÎNFIINȚATĂ LA DROBETA-TURNU SEVERIN

    Președintele Consiliului Județean Mehedinți, Aladin Georgescu, a participat la...

    Articole relationate

    Categorii populare