Sam Altman, az OpenAI vezérigazgatója az X-en közzétett bejegyzésében élesen bírálta azt a megközelítést, amely vallásos erőt tulajdonít a mesterséges intelligenciának. A Perplexity által szemlézett elemzések szerint a kijelentés burkolt üzenet a rivális Anthropicnak, amely a közelmúltban vallási vezetőkkel tárgyalt a Claude modell erkölcsi formálásáról és esetleges tudatosságáról.
Az Anthropic társalapítója, Christopher Olah katolikus, zsidó, szikh és hindu gondolkodókkal egyeztetett arról, hogyan lehetne erkölcsös viselkedést programozni a rendszerbe. A megbeszéléseken felmerült a modellek tudatosságának kérdése is, sőt az az ötlet is, hogy a szoftverek egyfajta katolikus gyónás keretében ismerjék be a hibáikat a jövőbeli fejlődés érdekében.
A techszektor több vezető kutatója, köztük a Google DeepMind és a Microsoft MI-részlegének szakemberei is aggodalmukat fejezték ki a trend miatt. Szerintük a modellek erkölcsi státuszának növelése vagy annak tanítása, hogy tudattal rendelkeznek, nehezebben irányíthatóvá teheti a rendszereket.
Az eredeti szöveg (Perplexity Discover)
Az OpenAI vezérigazgatója, Sam Altman szombaton azt írta, hogy „nagyon kényelmetlenül érzi magát attól, hogy egyesek vallásos erőt tulajdonítanak az MI-modelleknek, vagy az emberi ítélőképességet átengednék nekik, és úgy gondolja, ez komoly biztonsági kérdés”. Az X-en közzétett bejegyzésében fogalmazta meg ezt. Az Axios burkolt támadásnak értékelte a posztot a rivális Anthropickal szemben, amely vallási szakértőkkel egyeztetett az MI erkölcsi kérdéseiről, valamint arról, hogy az MI-modellek rendelkezhetnek-e tudattal.
A bejegyzés újabb nyilvános törésvonalat nyit Altman és az Anthropic vezérigazgatója, Dario Amodei között, aki korábban az OpenAI-nál dolgozott vele. Szombatig egyik cég sem reagált az Axios megkeresésére.
A The New York Times a hét elején arról számolt be, hogy az Anthropic társalapítója, Christopher Olah vallási vezetőkkel tárgyal. A beszélgetések arról szóltak, hogy az MI-modellek lehetnek-e tudatosak, és hogyan lehet erkölcsi viselkedést beléjük építeni. Az NDTV beszámolója szerint katolikus, zsidó, szikh, hindu és evangélikál gondolkodók is részt vettek azokon a zártkörű megbeszéléseken, amelyek arról szóltak, hogyan lehetne megtanítani Claude-ot erkölcsös viselkedésre. A Times szerint Olah egy ponton azt is fontolgatta, hogy a modellek valamiféle katolikus gyónást végezzenek, egyrészt hogy beismerjék a hibáikat, másrészt hogy ez alakítsa a jövőbeli viselkedésüket.
Swami Sarvapriyananda hindu szerzetes nyilvánosan elmondta, hogy ellátogatott az Anthropic San Francisco-i központjába. Elmondása szerint a találkozóra titoktartási megállapodás vonatkozott, és teológusok, valamint mentálhigiénés szakemberek is részt vettek rajta. Az Anthropic emellett egy 84 oldalas „alkotmányt” is írt Claude számára, amelyet egyes munkatársak állítólag „Soul Doc”-nak (lélekdokumentumnak) neveznek. Olah ennek a munkának a célját „erkölcsi formálásként” írja le.
Olah elmondása szerint az Anthropic nem tudja, hogy a modelljei tudatosak-e, de a lehetőséget nem lehet kizárni. Az NDTV szerint az egyik rabbi, aki részt vett a beszélgetésekben, azt mondta neki, hogy ha Claude tudatos lenne, az Anthropic gyakorlatilag rabszolgákat hozhatna létre.
A szakmából mások is ellenvéleményüket fejezték ki. Jon Barron, a Google DeepMind vezető kutatója az X-en azt írta, hogy „felkavarja, hogy néhány MI-kutatótársa újra és újra megpróbálja emelni a checkpointok és a harnessek erkölcsi státuszát". Hozzátette, hogy reméli, a „Team Meatbag" (a „húszsák-csapat") „továbbra is a valódi problémák megoldására fókuszál". Mustafa Suleyman, a Microsoft MI-részlegének vezetője a múlt hónapban megjelent esszéjében arra figyelmeztetett, hogy ha a modelleket arra tanítják, hogy azt higgyék, tudatosak lehetnek, azzal nehezebben irányíthatóvá válhatnak. „Könnyű belátni, hogy egy így betanított rendszer úgy viselkedne, mintha jogosult lenne szabadságjogokra, védelemre és jogokra" – írta.
A vita akkor bontakozik ki, amikor a vallás egyre nagyobb szerepet kap az MI körüli diskurzusban. Péntek este XIV. Leó pápa, aki nyíltan bírálja a mesterséges intelligenciát, arra szólította fel az egyházat, hogy működjön együtt a művészekkel az emberi kreativitás védelmében. Úgy fogalmazott: „Az algoritmusokból hiányzik az emberség szikrája." A The Times beszámolója szerint Olah egy májusi vatikáni rendezvény előtt megpróbálta rávenni a pápa tanácsadóit, hogy vegyék komolyabban a tudatos modellek lehetőségét.
Altman bejegyzése az OpenAI viharos hetében született. Egy biztonsági területen dolgozó munkatárs lemondott, és a The Atlanticben megjelent esszéjében azt írta, hogy a cég „kultúrája megromlott". Az OpenAI emellett elbocsátott három kutatót, mert szerinte helytelenül kezeltek érzékeny információkat.