
Un conflict de opinii și preocupări etice a fost adus în prim-plan în urma unor discuții private între compania Anthropic și experți în teologie, filozofie și religii, după o investigație publicată de The New York Times. În centrul acestor conversații se află sistemul de inteligență artificială Claude, dezvoltat de Anthropic, și întrebarea dacă acesta poate avea conștiință sau comportamente morale.
Discuții confidențiale despre comportamentul moral al AI-ului
Primul contact între Anthropic și specialiști a avut loc în 2025, după ce cofondatorul companiei, Christopher Olah, a inițiat aceste raporturi. La începutul anului 2026, au avut loc seminare intensive de două zile cu participanți invitați, mulți urmând să semneze acorduri de confidențialitate, care ulterior au fost ridicate.
Un participant la discuții, rabinul Mois Navon, a relatat că reprezentanții Anthropic păreau să considere Claude ca pe o ființă conștientă, interpretare neconfirmată oficial. Olah a declarat pentru o jurnalistă că nu poate afirma dacă modelele AI sunt conștiente, dar consideră necesară o cercetare atentă asupra posibilității unor forme de suferință.
Aspecte publice și aspecte tehnice ale sistemului Claude
În ianuarie, Anthropic a publicat o „constituție” a lui Claude, un document care stabilește valorile și comportamentele pentru modelul de AI. Acest document detaliază modul în care modelul trebuie să equilibreze sinceritatea cu grijă pentru interlocutor și protejarea informațiilor sensibile.
Compania intenționează ca sistemul să poată aplica principii generale în diverse situații și afirmă importanța supravegherii și corectării comportamentului AI-ului de către oameni.
În același timp, documentul exprimă clar incertitudinea asupra conștiinței și statutului moral al lui Claude. Termenii precum „statut moral” și „emoții” sunt folosiți pentru a descrie anumite stări, dar nu indică existența unor experiențe subiective sau interese proprii ale sistemului.
Clarificări asupra moralei și conștiinței AI
În constituție, Anthropic specifică că utilizarea termenilor precum „emoții” nu demonstrează că AI-ul trăiește subiectiv aceste stări. Reprezintă simple manifestări de răspunsuri programate, fără a confirma dacă există o experiență conștientă în spatele lor.
Deocamdată, modelul Claude beneficiază de un cadru de valori și de reguli de comportament, dar lipsesc dovezi concrete despre conștiința sau interesele proprii ale sistemului, precizează compania în documentație.
Este cunoscut faptul că Anthropic consideră necesară continuarea investigațiilor pe această temă, dar nu a afirmat oficial existența conștiinței peste parametrii tehnici existenți ai AI-ului Claude.
