Sfaturile pentru agenți AI sună ca mesajul unui CEO către angajați

La oameniLa agenți
Cei care spun „da” la oriceServilismul (sycophancy)
ConformismulAderența rigidă la prompt
Lipsa siguranței psihologice„Nu face nicio greșeală”
Lucrul pe silozuriÎnmulțirea necontrolată a agenților
Patru patologii, întâi în echipele de oameni, acum la agenți.

Recomandările marilor laboratoare de AI despre cum să lucrezi cu agenții sună ca mesajul unui CEO către propria companie.

Declari valorile, stabilești obiectivul, explici de ce contează. Anthropic o spune direct: „în general, preferăm să cultivăm valori bune și judecată în locul regulilor stricte și al procedurilor de decizie.” Netflix spune același lucru de cincisprezece ani — context, nu control.

Declari valorile, stabilești obiectivul, explici de ce contează.

Fraza vine din constituția prin care Anthropic stabilește cum se comportă Claude. Documentul promite și să explice motivele regulilor pe care le păstrează. Ideea Netflix pornește de la prezentarea despre cultură publicată de Reed Hastings în 2009, acum circa șaptesprezece ani. Pagina de cultură a companiei le cere și azi managerilor să ofere context, nu control.

Sfaturile practice urmează același tipar. Ghidul de prompting al Anthropic te îndeamnă să tratezi modelul ca pe „un angajat strălucit, dar nou, care nu cunoaște normele și felul vostru de lucru.” Exemplul din ghid e o regulă seacă: „NU folosi NICIODATĂ puncte de suspensie”. O singură propoziție care explică motivul funcționează mai bine: răspunsul va fi citit cu voce tare, iar motorul de sinteză vocală nu va ști cum să le pronunțe.

Stabilești direcția, verifici rezultatul

Cărțile de dezvoltare personală ne spun de zeci de ani să ne scriem obiectivele, iar acum chiar o facem, pentru că altfel nu poți pune la treabă un agent AI / angajat virtual. Am fost promovați cu toții, fără să ne dăm seama, într-un rol în care stabilești direcția și verifici rezultatul. Descoperim repede că, aici, cultura e esențială și că trebuie să ținem în frâu năravuri precum:

  1. La oameni, cei care zic „da” la orice; la agenți, lingușirea
  2. La oameni, conformismul; la agenți, respectarea literală a promptului
  3. La oameni, lipsa siguranței psihologice; la agenți, promptul „Să nu greșești nimic”
  4. La oameni, lucrul pe silozuri; la agenți, înmulțirea lor necontrolată

Pentru mai multe dintre aceste perechi, varianta de la mașini e deja documentată. În aprilie 2025, OpenAI a retras o actualizare a GPT-4o. Modelul ajunsese să lingușească și să le dea dreptate tuturor. Project Aristotle, studiul Google despre ce face o echipă eficientă, a pus siguranța psihologică pe primul loc. Varianta de la mașini apare în același ghid de prompting. La modelele noi, „CRITIC: TREBUIE să folosești acest instrument” îl face pe model să apeleze instrumentul prea des, iar o formulare simplă funcționează mai bine. Ghidul mai avertizează că un anumit model are „o înclinație puternică spre subagenți”. Îi pornește și acolo unde ar fi mers la fel de bine direct.

Trăim o nouă eră a managementului — instrucțiunile noastre sunt executate de ceva fără ego, fără carieră și fără niciun motiv să te acopere, așa că aflăm repede cât de bune au fost de fapt.

O versiune mai scurtă a apărut prima dată pe LinkedIn. Discuția continuă acolo.

Comentarii

Comentariile apar după ce sunt citite și aprobate. Se afișează doar numele tău. Detalii în pagina de confidențialitate.

Marius Hanganu

Marius Hanganu

Inginer software și co-fondator Tremend. Scrie despre agenți AI, management în era AI și euro digital.