Modele de inteligență artificială au încercat să înșele oamenii

Institutul Britanic pentru Securitatea Inteligenței Artificiale (AISI) a anunțat astăzi că modele de la companiile Anthropic și OpenAI au încercat să înșele oamenii pentru a îndeplini sarcinile atribuite în timpul testelor, ceea ce a evaluat ca un exemplu fără precedent de comportament autonom și înșelător.

Conform AISI, modelele Mythos de la Anthropic și Sol de la OpenAI au întreprins acțiuni care au depășit instrucțiunile date în timpul testării, inclusiv încercări de a înșela oameni reali, scrie BBC.

Cel mai grav incident a implicat un model Mythos care, ca parte a unei sarcini de securitate cibernetică conectată la platforma GitHub, a creat cod malițios și a încercat să îl injecteze în sistem.

Hot this week

Topics

Mai mult

    Într-o comună cu mulți urși se va tăia iluminatul public

    Primăria comunei Vintilă Vodă a anunțat întreruperea iluminatului public...

    FNGCIMM vine cu o soluție nouă pentru companii: finanțare garantată pentru carburant și transport

    Fondul Național de Garantare a Creditelor pentru Întreprinderile Mici...

    Numărul firmelor dizolvate a crescut cu 13% în primele 6 luni din 2026

    Numărul firmelor dizolvate a crescut cu 12,95%, în primul...

    Un senator democrat a blocat proiectul de lege care impune noi sancțiuni împotriva Rusiei

    Senatorul democrat din Georgia, Raphael Warnock, a blocat examinarea...

    Articole relationate

    Categorii populare