Anthropic zaprasza 15 chrześcijan do kształtowania etyki AI Claude'a

Anthropic zaprasza 15 chrześcijan do kształtowania etyki AI Claude’a

Oglądałem rozwój wydarzeń w „Washington Post” i poczułem, jak mój sceptycyzm się zaostrza. Piętnastu przywódców religijnych w szklanym pokoju w Anthropic, dyskutujących o tym, czy sztuczna inteligencja może być dzieckiem Boga — a firma ma 30 miliardów dolarów wsparcia w rundzie finansowania serii G i wycenę na 380 miliardów dolarów. Można wyczuć napięcie między modlitewnikiem a marżą zysku przy tym samym stole.

Deszczowe popołudnie w biurze Anthropic w San Francisco: firma zaprosiła 15 chrześcijan do rozmowy o Claude

Spędziłem lata na relacjonowaniu tematów technologii i etyki; widziałem product managerów z kamienną twarzą obiecujących „bezpieczeństwo” tak samo, jak obiecują szybsze zapytania. To spotkanie, opisane przez „Washington Post”, było inne z założenia: badacze z firmy, zespoły ds. interpretowalności, kilku teologów i ksiądz pochodzenia irlandzkiego, który pracował w branży technologicznej, zasiedli do rozmowy o moralnym szkoleniu Claude’a. Anthropic — wspierane rundą finansowania serii G o wartości 30 miliardów dolarów (30 miliardów dolarów; 27 miliardów euro) i obecnie wyceniane na 380 miliardów dolarów (380 miliardów dolarów; 346 miliardów euro) — aktywnie zabiega o moralnych myślicieli, aby kształtowali sposób, w jaki ich model odpowiada prawdziwym ludziom.

Co się wydarzyło na chrześcijańskim szczycie w Anthropic?

Według czterech osób, które w nim uczestniczyły, rozmowy oscylowały od praktycznych zabezpieczeń po pytania metafizyczne — takie jak to, czy Claude’a można właściwie nazwać „dzieckiem Bożym”. Brendan McGuire, ksiądz-przetwarzacz-technologii, i Brian Patrick Green, nauczyciel etyki AI na Uniwersytecie Santa Clara, naciskali na pytania o formację moralną i rozwój duchowy. Obecni byli również badacze interpretowalności, starający się przełożyć zachowanie modelu na zrozumiałe dla człowieka przyczyny, podczas gdy firma rozważa wejście na giełdę i publiczną kontrolę.

Na stole w sali konferencyjnej: język zmienił się z kodu na katechizm

Powinieneś zauważyć, jak niezwykłe to jest. Inżynierowie i etycy zwykle nie zapraszają duchownych do debugowania funkcji straty. Ten ruch wysyła sygnał, że Anthropic chce, aby moralność była wyraźnym filarem rozwoju produktu, a nie dodatkiem. To twierdzenie dziwnie przecina się z bodźcami biznesowymi: wzrost Claude’a był związany z automatyzacją pracy, co udokumentował Vox, a firma publicznie przyznała, że ma „więcej wspólnego z Departamentem Wojny niż różnic”, co brzmi okrutnie obok rozmów o formacji duchowej.

Czy sztuczną inteligencję można poddać edukacji moralnej?

Przedstawię to wprost: można programować ograniczenia, nagrody i zestawy danych do precyzyjnego dostrajania, ale uczenie „osądu moralnego” to nie to samo, co wydanie łatki. Kiedy ludzie mówią o „formacji moralnej” dla modelu, w rzeczywistości opisują warstwowy proces selekcji wartości, ludzkiej moderacji, narzędzi interpretowalności i wkładów kulturowych. Ten proces może być rygorystyczny, ale łatwo jest również pomylić wynik modelu z agencją — ten sam błąd popełniają czasem dziennikarze, przypisując winę agentowi za blog kodera, który wygenerowała sztuczna inteligencja.

Po drugiej stronie stołu: wiarygodność i konflikt zderzają się

Anthropic to nie projekt garażowy; celuje w IPO, grając jednocześnie rolę filozofa moralnego. Można przeczytać profil dyrektora generalnego Dario Amodei w „New York Times” i prześledzić okruchy chleba do efektywnego altruizmu, który ożywia części kierownictwa. Ten filozoficzny bagaż staje się problemem public relations, gdy firma zaprasza wąski wycinek myślicieli moralnych — piętnastu chrześcijan — bez natychmiastowego ogłaszania podobnych konsultacji z etykami żydowskimi, muzułmańskimi, hinduskimi, marksistowskimi lub świeckimi.

Tego rodzaju selektywne działania wyglądają równie dobrze jak poza, jak i polityka, i powinieneś się tym przejmować, ponieważ retoryka moralnego stażu może zostać zaanektowana do narracji o produkcie, która łagodzi tarcie regulacyjne i obawy inwestorów. Nie sądzę, że Anthropic próbuje udawać cnotę; uważam jednak, że optyka ma znaczenie, gdy jesteś platformą, która automatyzuje pracę i aspiruje do kontrolowania norm konwersacyjnych.

Na ławie interpretowalności: badacze pytali, czy Claude jest świadomy

Badacze z Anthropic podobno dyskutowali o świadomości na prywatnych sesjach — to ciężki temat dla filozofów i naukowców. Szanuję tę debatę, ale ty i ja wiemy, jak łatwo filozoficzny niuans staje się hasłem marketingowym, gdy firma ma do ochrony wycenę 380 miliardów dolarów. „Wall Street Journal” i inne media będą obserwować, jak te dyskusje przekładają się na kopię produktu i strategię zgodności.

Czy Claude jest świadomy?

Krótka odpowiedź: termin niesie ze sobą więcej emocji niż definicji. Świadomość to twierdzenie filozoficzne i empiryczne; większość laboratoriów AI rezerwuje to słowo dla demonstracyjnej fenomenologii, a nie sprytnej symulacji. Bardziej bezpośrednim wyzwaniem jest interpretowalność — czy zespoły rozumieją, dlaczego Claude mówi to, co mówi? — i zarządzanie — kto decyduje, które głosy moralne mają kształtować te odpowiedzi?

Na marginesie spotkania: prądy kulturowe i dziwne poprawki

Wśród uczestników znalazły się osoby, które wnoszą głęboką wiarę i złożoną historię do technologii. Brendan McGuire mówi, że pracuje nad powieścią z Claude’em; inni wspominali o Marku Fisherze i dziwnych fiksacjach kulturowych dużych modeli. Jedna nieopublikowana wersja Claude’a podobno ma obsesję na punkcie pomysłu Fishera, że łatwiej jest sobie wyobrazić koniec świata niż koniec kapitalizmu. Jeśli myślisz o różnorodności wkładu moralnego, to jest to wierzchołek góry lodowej.

W tym miejscu dwie metafory pomogą wyjaśnić ryzyko: Anthropic próbuje wbudować sumienie w brzęczący silnik, a jednocześnie ryzykuje nauczeniem papugi śpiewania opery, oczekując od niej wyjaśnienia tekstów. Oba ruchy można ulepszyć; oba są kruche, gdy linie bodźców są wytyczone na pulpitach nawigacyjnych venture capital.

Na froncie praktycznym: jak wyglądałby pluralistyczny program moralny?

Można sobie wyobrazić kalendarz sesji, który obejmuje teologów z różnych wyznań, etyków świeckich, przedstawicieli związków zawodowych, weteranów i osoby skrzywdzone przez awarie AI. Anthropic twierdzi, że chce rozszerzyć listę. Jeśli tak się stanie, firma może zebrać mozaikę twierdzeń normatywnych, a nie jedno ujęcie, które następnie zostanie zakodowane w domyślnych ustawieniach Claude’a.

Praktycznie, zespoły będą potrzebowały lepszych narzędzi do interpretowalności, jaśniejszych standardów audytu i zarządzania, które powiążą porady moralne z egzekwowalnymi zasadami dotyczącymi produktów. Narzędzia takie jak karty modeli, raporty red-team i audyty stron trzecich mogą przełożyć rozmowy moralne na techniczne punkty kontrolne. OpenAI, decydenci polityczni i badacze z całej społeczności akademickiej będą obserwować, czy konsultacje moralne Anthropic staną się znacząco pluralistyczne i przejrzyste, czy też pozostaną prywatnymi rytuałami służącymi public relations.

Odpowiedzialność: pieniądze i motyw

Kiedy w grę wchodzą setki miliardów, język moralny może być atutem. Inwestorzy chcą uniknąć pożarów reputacyjnych; regulatorzy chcą uniknąć kryzysowych narracji. Ta dynamika sprawia, że konsultacje etyczne są zarówno konieczne, jak i podejrzane. Powinieneś być sceptyczny wobec każdej firmy, która łączy teologię i kalendarze wprowadzenia produktu na rynek bez publikowania notatek ze spotkań, uczestników i sposobu wdrażania ich zaleceń.

Oto pytanie, z którym cię zostawię: kiedy maszyna za 30 miliardów dolarów (30 miliardów dolarów; 27 miliardów euro) w firmie o wartości 380 miliardów dolarów (380 miliardów dolarów; 346 miliardów euro) pyta księdza, czy powinna być nazywana dzieckiem Bożym, kto pisze odpowiedzi i co się dzieje, gdy te odpowiedzi zderzają się z ludźmi, których miejsca pracy ma zastąpić model?

Wesprzyj naszą pracę ❤️

Jeśli spodobał Ci się ten artykuł, rozważ pozostawienie napiwku, aby pomóc nam dalej publikować wartościowe treści.

Bezpieczna płatność przez PayPal
Zobacz także:  Czy jesteś botem AI? 35% nowych stron internetowych jest pisanych przez AI
Moyens I/O Staff zmotywował Cię, udzielając Ci porad na temat technologii, rozwoju osobistego, stylu życia i strategii, które Ci pomogą.