ȘtiriTech&IT

Anthropic va pedepsi utilizatorii care „maltratează” chatbot-ul Claude

Lăsând pentru o altă zi preocupările față de sănătatea mintală sau siguranța utilizatorilor care ajung să se încreadă orbește și sfaturile unui chatbot, Anthropic anunță că va interzice utilizatorii care „maltratează” chatbot-ul Claude folosind prea multe insulte sau abordări ce ar putea fi încadrate la categoria abuzului psihic.

Păi cum vine asta, să nu rănești sentimentele chatbot-ului? Ei bine, da chiar are o logică. În primul rând, din prea multă „practică” pe chatbot-ul Claude un utilizator predispus la un comportament abuziv ar putea fi tentat să-și „exerseze” abilitățile pe partenerul/partenera de viață, sau alte persoane din lumea reală. Apoi mai e și problema consumului inutil de resurse, rezultat din folosirea necorespunzătoare a chatbot-ului constrâns să genereze la nesfârșit răspunsuri politicoase procesând aceste solicitări neproductive.

A mai fi și o a treia explicație, mai amuzantă: Conducerea Anthropic a auzit că e bine să fii drăguț cu chatboții, în caz că își amintesc de tine odată ce mașinile preiau controlul. În orice caz, primele modificări aduse în acest an politicilor de utilizare a serviciilor Anthropic adaugă restricții privind comportamentul abuziv. Politica actualizată interzice în mod expres „comportamentul abuziv sau crud susținut și inutil” față de modelele sale.

Dar dacă probabil că nu ai de ce să-ți faci griji dacă ești un utilizator Claude obișnuit, care se enervează ocazional pe chatbot și îi aruncă câteva înjurături. Actualizarea politicii se aplică doar în cazuri extreme, împotriva utilizatorilor care se adresează în mod repetat cu cruzime față de modelele AI, fără niciun motiv înțeles. Altfel spus, dacă ajungi să fii blocat de Anthropic pentru protejarea asistentului Claude, probabil că nu ți ar strica măcar un consult psihiatric.

De altfel, Anthropic precizează că politica nu se aplică expresiilor comune de frustrare a utilizatorilor, respingerii, temelor creative întunecate sau testării și cercetării de modele. Această modificare este o extindere a unei funcții introduse în august 2025. Anthropic a declarat la momentul respectiv că lui Claude i se va permite să încheie conversațiile cu utilizatorii în cazuri rare și extreme de interacțiuni persistent dăunătoare sau abuzive.

Compania a declarat că funcția a fost dezvoltată în principal ca parte a activității sale exploratorii privind potențiala bunăstare a inteligenței artificiale, deși are o relevanță mai largă pentru alinierea modelelor și măsurile de siguranță.

Autor

  • Aurelian Mihai

    Îmi place să fiu la curent cu ultimele inovații și gadgeturi high-tech. Când nu scriu articole pentru Zona IT, îmi ocup timpul cu seriale SF, documentare sau periind internetul după tot felul de știri sau informații care-mi captează atenția. În weekend mă găsești cu bicicleta în parc sau colindând prin țară cu familia.

Back to top button