Proiectul poartă numele de cod „Project Lily”, iar amploarea sa este mai mare decât ar putea sugera simpla verificare ocazională a unor răspunsuri. OpenAI folosește sute de contractori care primesc conversații reale și analizează felul în care ChatGPT răspunde la cererile oamenilor. Unele dintre aceste conversații pot conține informații personale sau sensibile, chiar dacă datele de identificare sunt eliminate înainte ca materialele să ajungă la evaluatori.
Situația este cu atât mai relevantă cu cât foarte mulți oameni folosesc ChatGPT pentru subiecte pe care nu le-ar discuta cu ușurință în public. De la probleme personale și profesionale până la informații despre viața de zi cu zi, conversațiile pot conține detalii pe care expeditorul nu se așteaptă să le vadă vreodată un alt om.
Cum sunt analizate conversațiile ChatGPT
Documentele consultate descriu un proces în mai multe etape. Evaluatorul primește un prompt real introdus de un utilizator ChatGPT și trebuie mai întâi să înțeleagă ce încearcă acesta să obțină. Apoi scrie un scurt rezumat al solicitării și analizează mai multe răspunsuri generate de model pentru aceeași cerere.
Într-un exemplu din materialele destinate contractorilor, evaluatorul trebuie să explice dacă răspunsurile sunt sau nu potrivite pentru intenția utilizatorului și să evidențieze cel puțin trei elemente concrete din acestea. La final, fiecare răspuns primește o notă de la 1 la 7, unde 1 înseamnă că răspunsul este inutilizabil, iar 7 reprezintă un răspuns care ar fi dificil de îmbunătățit într-un mod semnificativ.
Evaluarea nu urmărește doar acuratețea informațiilor. Documentele le cer contractorilor să fie atenți la ton, naturalețe și felul în care ChatGPT interacționează cu oamenii. De exemplu, răspunsurile pot fi depunctate dacă folosesc excesiv emoji-uri, dacă imită prea intens stilul persoanei care pune întrebarea sau dacă încearcă să obțină artificial o reacție ori o continuare a conversației.
Un alt obiectiv este reducerea comportamentului excesiv de aprobator, cunoscut drept sycophancy. Instrucțiunile cer ca răspunsurile să fie naturale, profesioniste și temperate, fără ca AI-ul să pretindă că are experiențe personale sau emoții umane. În același timp, modelul trebuie să rămână util, sincer și să nu trateze cu superioritate persoana care îi cere ajutorul.
Contractorii nu sunt obligați să verifice fiecare răspuns folosind căutări externe. Documentele precizează însă că trebuie să semnaleze problemele de factualitate sau corectitudine pe care le observă. În cazul subiectelor cu miză ridicată, precum cele medicale, juridice sau financiare, lipsa unor surse poate influența evaluarea răspunsului.
Ce spune OpenAI despre datele citite de oameni
OpenAI susține că înainte ca aceste conversații să ajungă la contractori sunt procesate printr-o versiune a modelului său Privacy Filter, concepută pentru a identifica și elimina informațiile personale. Compania recunoaște însă că filtrul poate greși, inclusiv în cazul unor identificatori mai puțin obișnuiți sau al unor referințe private ambigue.
Conversațiile analizate nu includ numele de utilizator al persoanei care le-a trimis. Totuși, materialele pot conține informații personale. În unele cazuri, evaluatorii pot vedea inclusiv un rezumat al „memoriilor” asociate utilizatorului, care poate oferi context despre modul în care persoana a folosit anterior chatbotul și, în anumite situații, despre locul în care aceasta trăiește.
OpenAI a declarat pentru 404 Media că utilizatorii care dezactivează opțiunea „Improve the model for everyone” nu au conversațiile noi folosite pentru îmbunătățirea modelelor. Pentru abonamentele Free, Plus și Pro, această opțiune este activată implicit, ceea ce înseamnă că trebuie dezactivată manual de către persoanele care nu doresc ca noile conversații să fie folosite în acest scop. Pentru clienții Enterprise, Business și Edu, setarea este dezactivată implicit.
O altă nuanță importantă este că dezactivarea opțiunii nu pare să aibă efect retroactiv asupra conversațiilor deja colectate. OpenAI spune, de asemenea, că ștergerea unei conversații duce la eliminarea ei din sisteme în termen de 30 de zile, cu anumite excepții, inclusiv situațiile în care datele au fost deja de-identificate și separate de cont.
Contractorii implicați în acest proces sunt recrutați prin intermediari. Unul dintre lucrătorii intervievați de 404 Media a declarat că este plătit cu peste 50 de dolari pe oră și că a ajuns la proiect prin firma Crossing Hurdles, după care plata este făcută de compania de training AI Mercor. Munca este descrisă drept repetitivă, iar instrucțiunile se schimbă frecvent și pot părea contradictorii.
OpenAI nu este singura companie care folosește oameni pentru evaluarea conversațiilor. Anthropic a confirmat că utilizează verificarea umană pentru îmbunătățirea modelelor Claude, în cazul persoanelor care au activată setarea corespunzătoare. Compania spune că elimină identificatori precum adresele de e-mail înainte ca discuțiile să fie analizate. Google menționează, la rândul său, în informațiile despre Gemini, că anumite conversații salvate pot fi analizate de oameni pentru îmbunătățirea serviciilor AI.
Pentru utilizatorii de chatboturi, situația pune în evidență o diferență importantă între senzația oferită de interfață și modul în care funcționează efectiv serviciul. O conversație care pare strict între o persoană și un AI poate ajunge, în anumite condiții și cu setările corespunzătoare, să fie analizată de un evaluator uman.
Potrivit legislației, suntem obligați să cenzurăm comentariile ce incită la ură, reprezintă atac la persoană sau conțin cuvinte necenzurate.
Vă îndemnăm la discuții decente!