Anthropic introduce reguli împotriva abuzurilor repetate asupra chatbotului Claude. Decizia reaprinde dezbaterea despre relația oamenilor cu inteligența artificială

Compania americană Anthropic, dezvoltatoarea chatbotului Claude, a provocat numeroase reacții după ce a introdus o prevedere care permite limitarea sau întreruperea conversațiilor în situații extreme, în care utilizatorii manifestă în mod repetat un comportament abuziv și nejustificat față de sistemele sale de inteligență artificială. Măsura face parte din actualizarea politicii de utilizare a serviciilor companiei și a readus în atenție o întrebare care îi împarte pe specialiști: cât de departe ar trebui să meargă regulile de comportament în relația dintre oameni și inteligența artificială?

Potrivit informațiilor relatate de BBC, noua prevedere nu urmărește să sancționeze orice utilizator care își exprimă nemulțumirea, critică răspunsurile chatbotului sau folosește un limbaj dur într-o anumită conversație. Anthropic susține că intervenția este destinată unor cazuri extreme, în care comportamentul abuziv este repetat și evident deliberat.

Cu toate acestea, formularea a stârnit controverse, deoarece ridică probleme legate de libertatea utilizatorilor de a interacționa cu un instrument digital, de limitele moderării conținutului și de riscul ca inteligența artificială să fie prezentată într-un mod care o face să pară mai apropiată de o ființă umană decât este în realitate.

Discuția nu se limitează la modul în care utilizatorii îi vorbesc lui Claude. Ea privește și felul în care companiile de tehnologie stabilesc limite pentru folosirea modelelor de inteligență artificială, precum și responsabilitatea acestora de a preveni utilizările periculoase ale propriilor produse.

Ce prevede noua politică a companiei Anthropic

Anthropic și-a revizuit politica de utilizare pentru a include mai explicit comportamentele abuzive repetate și nejustificate îndreptate împotriva sistemelor sale de inteligență artificială. În situațiile extreme vizate, compania își rezervă posibilitatea de a întrerupe interacțiunile cu utilizatorii respectivi.

Un aspect important este că măsura nu trebuie interpretată ca o interdicție generală de a critica chatbotul sau de a-i adresa întrebări incomode. Utilizatorii pot continua să semnaleze greșeli, să conteste răspunsurile, să testeze limitele modelului și să desfășoare activități de cercetare, în limitele regulilor aplicabile.

De asemenea, Anthropic a precizat că exprimarea obișnuită a frustrării, dezacordul, temele creative întunecate și testarea modelelor nu reprezintă, prin ele însele, comportamente care ar trebui sancționate în baza acestei prevederi.

Distincția este esențială. Un utilizator care îi spune chatbotului că a oferit un răspuns greșit sau că nu și-a îndeplinit sarcina nu se află automat în aceeași situație cu cineva care desfășoară în mod repetat interacțiuni considerate abuzive, fără un scop legitim evident.

Totuși, una dintre principalele întrebări rămâne modul concret în care vor fi evaluate aceste situații. Noțiuni precum „abuziv”, „crud” sau „nejustificat” pot fi interpretate diferit, iar o politică eficientă trebuie să facă distincția între comportamentul deliberat problematic și utilizarea legitimă a unui instrument digital.

Deocamdată, controversa se concentrează tocmai asupra acestei delimitări și asupra modului în care o asemenea regulă poate fi aplicată fără să afecteze nejustificat utilizatorii obișnuiți.

Comportamentul față de un chatbot poate fi considerat abuz?

Una dintre cele mai puternice critici la adresa noii politici pornește de la natura sistemelor de inteligență artificială. Un chatbot precum Claude generează răspunsuri pe baza unui model matematic antrenat pe cantități mari de date. El poate produce texte care par empatice, poate răspunde la insulte și poate utiliza un limbaj asemănător celui folosit de oameni în conversațiile cotidiene.

Aceste capacități nu demonstrează însă că sistemul are sentimente, suferă sau trăiește experiențe subiective atunci când este insultat.

De aici apare întrebarea dacă termenii folosiți în relațiile dintre oameni ar trebui aplicați și în cazul interacțiunilor cu programele informatice. Dacă o persoană jignește un chatbot, există o victimă în sensul obișnuit al cuvântului? Sau este vorba despre o succesiune de mesaje procesate de un sistem fără dovezi că ar avea experiențe conștiente?

Pentru criticii măsurii, diferența dintre un om și un model de inteligență artificială trebuie păstrată foarte clară. Ei consideră că utilizarea unor concepte precum cruzimea sau suferința în relație cu un program poate încuraja o percepție eronată asupra naturii tehnologiei.

Susținătorii unor asemenea reguli pot argumenta însă că discuția nu trebuie să se limiteze la întrebarea dacă sistemul poate suferi. Politicile de utilizare pot urmări și prevenirea unor tipare de interacțiune considerate dăunătoare, protejarea integrității serviciului sau stabilirea unor limite pentru comportamentele repetate care nu au un scop legitim.

Prin urmare, disputa are două dimensiuni distincte: dacă inteligența artificială poate fi afectată în sensul în care este afectat un om și dacă furnizorii de servicii au motive să limiteze anumite comportamente ale utilizatorilor, indiferent de existența unor sentimente în sistem.

„Nu poți fi crud cu numerele și matematica”

Actualizarea politicii a fost intens comentată pe rețelele sociale, unde utilizatorii au prezentat argumente atât în favoarea, cât și împotriva deciziei.

Unii au salutat inițiativa, considerând că promovarea unui limbaj respectuos poate contribui la dezvoltarea unor obiceiuri de comunicare mai bune. Alții au văzut în această măsură o extindere nejustificată a conceptelor morale din relațiile umane către instrumente care nu au demonstrat că ar putea simți durere sau umilință.

Printre criticii citați în relatările presei s-a numărat dr. Barry Scannell, partener specializat în tehnologie la firma irlandeză de avocatură William Fry. Acesta a susținut că nu poți fi crud cu matematica și cu numerele și a avertizat că antropomorfizarea excesivă a inteligenței artificiale poate induce în eroare publicul.

Argumentul său pornește de la diferența dintre simularea unui comportament uman și existența unei experiențe interioare. Un model poate genera un răspuns care pare rănit, poate spune că este deranjat de limbajul folosit sau poate încerca să calmeze utilizatorul. Aceste reacții sunt rezultate ale funcționării sistemului și nu reprezintă, în sine, dovezi ale unei stări emoționale reale.

În această perspectivă, riscul nu este neapărat că un chatbot ar suferi din cauza insultelor, ci că oamenii ar putea ajunge să atribuie tehnologiei calități și capacități pe care aceasta nu le-a demonstrat.

Critica are implicații importante pentru educație și pentru modul în care sunt prezentate produsele de inteligență artificială. Pe măsură ce interfețele devin mai naturale, iar răspunsurile sunt formulate într-un stil conversațional, diferența dintre o simulare convingătoare și o experiență umană autentică poate deveni mai greu de perceput pentru unii utilizatori.

De ce unii specialiști sunt îngrijorați de antropomorfizarea AI

Antropomorfizarea reprezintă tendința de a atribui caracteristici umane unor obiecte, animale sau sisteme care nu sunt oameni. În cazul inteligenței artificiale generative, fenomenul poate apărea atunci când utilizatorii interpretează răspunsurile fluente ale unui chatbot drept dovadă că acesta înțelege, simte sau are intenții în același mod ca o persoană.

Interfețele conversaționale pot favoriza această percepție. Chatboturile folosesc pronume personale, răspund la întrebări despre emoții și pot păstra un ton cald sau empatic. În anumite situații, ele pot părea chiar mai răbdătoare decât interlocutorii umani.

Totuși, capacitatea de a reproduce limbajul empatic nu este echivalentă cu demonstrarea unei experiențe emoționale. Un model poate descrie tristețea fără să existe dovezi că trăiește tristețea, la fel cum poate explica durerea fără ca răspunsul să demonstreze că resimte durere.

Criticii antropomorfizării se tem că această diferență poate fi estompată în comunicarea comercială sau în interacțiunile de zi cu zi. Dacă oamenii ajung să considere chatboturile drept ființe cu nevoi emoționale, pot apărea confuzii privind responsabilitatea, atașamentul și natura relației cu tehnologia.

Pe de altă parte, o interfață naturală nu este automat o problemă. Limbajul uman face instrumentele mai ușor de folosit, iar politețea poate fi o obișnuință personală, o preferință culturală sau o modalitate de a menține un anumit stil de comunicare.

Problema apare atunci când limbajul natural este interpretat ca dovadă suficientă a existenței conștiinței. În prezent, simplul fapt că un chatbot vorbește despre propriile emoții nu demonstrează că are asemenea experiențe.

Reacția lui Mustafa Suleyman, directorul diviziei AI de la Microsoft

Controversa a atras atenția și în industria tehnologiei. Mustafa Suleyman, directorul diviziei de inteligență artificială de la Microsoft, criticase anterior tendința de a trata sistemele AI ca și cum ar fi umane.

După apariția informațiilor despre actualizarea politicii Anthropic, acesta a reacționat pe rețelele sociale printr-un emoji reprezentând o față care se topește, gest interpretat de numeroși utilizatori drept o reacție ironică la decizia companiei.

Reacția evidențiază faptul că dezbaterea nu este doar una filosofică. Ea se desfășoară și între companii care dezvoltă modele de inteligență artificială și care au perspective diferite asupra modului în care produsele lor ar trebui să se prezinte în fața publicului.

Într-o industrie în care interfețele conversaționale sunt proiectate să fie cât mai accesibile și naturale, granița dintre o interacțiune utilă și o prezentare excesiv de umanizată a sistemului poate deveni un subiect de concurență și de reputație.

Totuși, o reacție publică sau ironică din partea unui lider din industrie nu stabilește, în sine, dacă politica Anthropic este corectă sau greșită. Evaluarea ei depinde de formularea regulii, de modul de aplicare și de efectele asupra utilizatorilor.

Noile reguli vizează și manipularea alegerilor

Deși prevederea referitoare la comportamentul abuziv față de chatbot a atras cea mai mare atenție, revizuirea politicii Anthropic a inclus și alte modificări.

Compania a actualizat regulile pentru a aborda riscuri noi sau emergente legate de utilizarea sistemelor de inteligență artificială. Printre acestea se numără folosirea instrumentelor pentru campanii înșelătoare și clarificarea interdicției de a utiliza Claude pentru inducerea în eroare a alegătorilor sau pentru perturbarea proceselor electorale.

Aceste prevederi sunt relevante într-un context în care modelele generative pot produce rapid texte, imagini și alte materiale care pot fi folosite în campanii de comunicare. Tehnologia poate fi utilizată în scopuri legitime, precum explicarea programelor electorale, traducerea informațiilor sau analiza documentelor publice, dar poate fi folosită și pentru generarea de mesaje înșelătoare, imitarea unor surse credibile ori amplificarea artificială a unor narațiuni.

Interdicțiile privind manipularea electorală urmăresc să delimiteze utilizările permise de cele care pot afecta informarea alegătorilor și integritatea proceselor democratice. În apropierea alegerilor, riscurile pot crește din cauza vitezei cu care conținutul poate fi produs și distribuit.

Companiile care furnizează instrumente AI trebuie să decidă cum să prevină asemenea utilizări fără să blocheze activități legitime precum jurnalismul, cercetarea, analiza politică sau verificarea informațiilor.

În același timp, simpla existență a unei reguli nu garantează eliminarea abuzurilor. Eficiența ei depinde de aplicare, de mecanismele de detectare și de capacitatea companiei de a distinge între utilizarea legitimă și cea care încalcă politica.

Interdicțiile privind hărțuirea și conținutul dăunător

Politica de utilizare a Anthropic include și restricții privind alte tipuri de comportamente, precum hărțuirea persoanelor, promovarea autovătămării și crearea de imagini intime fără consimțământul persoanelor vizate.

Aceste categorii au o diferență importantă față de disputa privind limbajul adresat unui chatbot: ele pot implica prejudicii directe asupra oamenilor.

Hărțuirea poate afecta siguranța și demnitatea unei persoane, iar distribuirea unor imagini intime fără consimțământ poate produce consecințe grave pentru viața privată și reputația victimei. În cazul autovătămării, utilizarea instrumentelor AI trebuie gestionată cu atenție pentru a evita încurajarea unor acțiuni periculoase.

Aceste riscuri explică de ce furnizorii de inteligență artificială stabilesc limite pentru anumite solicitări, chiar dacă modelele sunt capabile din punct de vedere tehnic să genereze conținutul cerut.

Anthropic a precizat, de asemenea, că interdicția privind dezvoltarea armelor folosind instrumentele sale exista deja. Actualizarea politicii nu trebuie, așadar, interpretată ca și cum toate restricțiile ar fi fost introduse simultan.

În schimb, modificările reflectă încercarea companiei de a-și adapta regulile la evoluția tehnologiei și la riscurile asociate cu folosirea ei.

Ar trebui să fim politicoși cu inteligența artificială?

Întrebarea dacă utilizatorii ar trebui să spună „te rog” și „mulțumesc” atunci când folosesc ChatGPT, Claude sau alte instrumente AI este dezbătută de mai mult timp.

O parte dintre utilizatori consideră că asemenea formule sunt inutile, deoarece sistemul nu are sentimente care să fie protejate prin politețe. Din această perspectivă, o solicitare directă, formulată clar, poate fi suficientă pentru a obține rezultatul dorit.

Alții preferă să păstreze regulile obișnuite de conversație. Pentru aceștia, politețea nu este neapărat un gest făcut în beneficiul chatbotului, ci o extensie a propriului stil de comunicare.

Din punct de vedere tehnic, expresiile suplimentare consumă într-adevăr o anumită cantitate de text procesat de model. Modelele lingvistice folosesc tokenuri, unități de text care pot reprezenta cuvinte întregi, fragmente de cuvinte sau semne de punctuație. Numărul de tokenuri poate influența costurile de procesare, în special la scară mare.

Cu toate acestea, câteva formule de politețe nu reprezintă, în mod obișnuit, un factor decisiv pentru utilizatorul individual. Mai importantă este claritatea solicitării: contextul oferit, obiectivul urmărit, restricțiile precizate și formatul dorit al răspunsului.

O instrucțiune formulată politicos, dar vag, poate produce un rezultat mai slab decât o solicitare directă și bine structurată. În același timp, nu există motive să presupunem că un ton respectuos ar împiedica utilizatorul să formuleze critici ferme sau să ceară corectarea unei greșeli.

Prin urmare, politețea poate fi o alegere personală, nu o obligație morală față de un sistem despre care nu există dovezi că ar avea sentimente.

Ce a spus Sam Altman despre costul formulelor „te rog” și „mulțumesc”

Discuția despre politețea adresată chatboturilor a ajuns și în atenția lui Sam Altman, directorul general al OpenAI.

Într-o conversație publică pe platforma X, un utilizator a întrebat despre costurile suplimentare de energie electrică asociate răspunsurilor ChatGPT la mesajele care includ formule precum „te rog” și „mulțumesc”. Altman a răspuns că este vorba despre „zeci de milioane de dolari cheltuite cu folos”, într-o remarcă formulată în registru umoristic.

Comentariul a fost interpretat ca o recunoaștere a faptului că procesarea fiecărui mesaj are un cost, chiar dacă textul suplimentar este foarte scurt. Totuși, replica nu trebuie tratată drept un calcul tehnic detaliat al consumului energetic atribuit exclusiv formulelor de politețe.

Costul real depinde de mai mulți factori, inclusiv de lungimea conversației, modelul utilizat, infrastructura de calcul și modul în care este gestionată cererea. Nu se poate deduce dintr-o asemenea remarcă faptul că utilizatorii ar trebui să renunțe la politețe pentru a reduce semnificativ consumul.

În practică, dacă obiectivul este eficiența, cele mai utile măsuri sunt evitarea repetițiilor inutile, formularea clară a cerințelor și furnizarea de la început a informațiilor relevante.

Poate limbajul agresiv folosit cu AI să influențeze relațiile dintre oameni?

O altă dimensiune a dezbaterii privește efectul pe care obiceiurile digitale îl pot avea asupra comunicării dintre persoane.

Unii experți atrag atenția că repetarea unui anumit stil de exprimare poate contribui la formarea unor obiceiuri. Dacă o persoană folosește frecvent un limbaj agresiv în interacțiunile digitale, există motive să analizăm dacă acest comportament se poate transfera și în alte contexte.

Totuși, nu trebuie prezentată drept o certitudine ideea că cineva care insultă un chatbot va ajunge automat să îi trateze la fel pe cei din jur. Relația dintre comportamentul online și cel din viața reală este complexă și depinde de personalitate, context, norme sociale și numeroși alți factori.

Un utilizator poate adopta un limbaj dur într-un exercițiu de testare a unui model, într-un joc de rol sau pentru a verifica modul în care sistemul reacționează la provocări, fără ca acest lucru să reflecte comportamentul său obișnuit față de oameni.

În același timp, interacțiunile cu tehnologia pot deveni o ocazie de a observa cum comunicăm. Oamenii pot alege să păstreze un ton respectuos deoarece acesta corespunde valorilor lor, nu pentru că ar considera că un program trebuie protejat emoțional.

Așadar, întrebarea relevantă nu este doar dacă trebuie să fim politicoși cu un chatbot, ci și ce fel de obiceiuri vrem să cultivăm în comunicarea noastră de zi cu zi.

Unde ar trebui trasată limita dintre libertatea utilizatorului și regulile companiei?

Cazul Anthropic ridică o problemă mai largă privind puterea companiilor de tehnologie de a stabili condițiile în care pot fi utilizate produsele lor.

Un furnizor poate introduce reguli pentru prevenirea hărțuirii, a fraudelor, a manipulării electorale sau a altor utilizări periculoase. Totuși, atunci când regulile se extind la comportamentul verbal al utilizatorilor față de sistemul propriu, apare întrebarea dacă termenii folosiți sunt suficient de clari și dacă măsurile sunt proporționale.

Pentru ca o asemenea politică să fie aplicată corect, ar trebui să existe o distincție clară între critică și abuz, între testarea legitimă a unui model și comportamentul repetat care încalcă regulile serviciului. Utilizatorii trebuie să poată semnala răspunsuri greșite, să exprime nemulțumiri și să solicite explicații fără să se teamă că orice formulare dură va duce la blocarea conversației.

În același timp, companiile au nevoie de mecanisme prin care să aplice propriile condiții de utilizare și să reducă riscurile asociate produselor lor. Problema este găsirea unui echilibru între aplicarea regulilor și păstrarea libertății de utilizare.

Transparența va avea un rol important. Explicarea comportamentelor vizate, a modului în care sunt evaluate încălcările și a consecințelor posibile poate reduce confuzia și poate preveni interpretările excesive.

De asemenea, este important ca publicul să nu confunde măsurile comerciale ale unei companii cu o concluzie științifică privind conștiința inteligenței artificiale. Faptul că un furnizor decide să limiteze anumite interacțiuni nu demonstrează că sistemul respectiv poate suferi.

O dezbatere care va deveni tot mai importantă

Pe măsură ce instrumentele de inteligență artificială sunt integrate în activități profesionale, educație, servicii pentru clienți și viața de zi cu zi, regulile de utilizare vor deveni tot mai importante.

Companiile trebuie să gestioneze riscuri concrete, de la fraude și manipulare până la generarea de conținut dăunător. În același timp, trebuie să explice publicului ce limite au modelele și de ce anumite solicitări sunt restricționate.

Decizia Anthropic de a include comportamentul abuziv repetat față de propriile sisteme în politica de utilizare arată cât de largă a devenit această discuție. Ea pune față în față două perspective: una care insistă asupra diferenței fundamentale dintre oameni și programe informatice și alta care consideră că regulile de interacțiune pot avea un rol chiar și atunci când sistemul nu este demonstrat ca fiind capabil de experiențe subiective.

În cele din urmă, utilizatorii nu trebuie să creadă că un chatbot are sentimente pentru a comunica într-un mod respectuos. La fel, exprimarea directă a nemulțumirii sau criticarea unui răspuns nu ar trebui confundate automat cu un comportament abuziv.

Provocarea pentru companiile care dezvoltă inteligență artificială va fi să stabilească reguli clare, proporționale și transparente, care să limiteze utilizările cu adevărat problematice fără să transforme dezacordul legitim într-o abatere. Dezbaterea despre politețea față de AI este, astfel, și o discuție despre responsabilitatea tehnologică, libertatea utilizatorilor și felul în care societatea învață să trăiască alături de sisteme tot mai capabile să imite conversația umană.