Anthropic zabrania obrażania Claude'a. Nowy regulamin wchodzi w życie w listopadzie 2026
Firma stojąca za Claude'em wprowadziła zakaz uporczywego znęcania się nad chatbotem oraz doprecyzowała zasady dotyczące dezinformacji, broni i inwigilacji. Nowe przepisy zaczną obowiązywać 12 listopada 2026 roku.
Nowy regulamin Anthropic a traktowanie sztucznej inteligencji
Dyskusja o tym, czy AI zabierze nam miejsca pracy, towarzyszy nam od dawna, ale mało kto spodziewał się, że w 2026 roku pojawi się też temat emocji chatbotów. Internetowe żarty o konieczności grzecznego zwracania się do asystentów AI, na wypadek przyszłego buntu maszyn, zyskały nieoczekiwane potwierdzenie. Anthropic, twórca Claude'a, zmienił regulamin korzystania ze swoich modeli, wprowadzając zapis dotyczący sposobu, w jaki użytkownicy odnoszą się do samej sztucznej inteligencji. To pierwszy taki krok w stronę czegoś na kształt zasad ochronnych dla chatbotów.
Koniec z wyzywaniem Claude'a
Niejeden użytkownik dawał upust frustracji, gdy model AI po raz kolejny nie radził sobie z tym samym zadaniem albo ignorował polecenie. Można się spierać, czy winne były źle sformułowane prompty, jednak Anthropic postanowił wyznaczyć wyraźną granicę.
W aktualizacji zasad korzystania z Claude'a, opublikowanej 8 października, znalazł się zapis zabraniający uporczywego i nieuzasadnionego okrutnego lub obraźliwego traktowania modeli AI. Przepisy te wejdą w życie 12 listopada 2026 roku.
Firma nie precyzuje jednak dokładnie, na czym miałoby polegać „znęcanie się” nad chatbotem. Regulamin mówi o zakazie „uporczywego i nieuzasadnionego obraźliwego lub okrutnego traktowania naszych modeli”, a Anthropic wyjaśnia jedynie, że chodzi o skrajne sytuacje, w których ktoś wielokrotnie zachowuje się wobec AI w sposób przemocowy, bez żadnego racjonalnego powodu.
Brak konkretnych przykładów sugeruje, że pojedyncze przekleństwo czy napisanie czegoś wielkimi literami z irytacji raczej nie sprowadzi na użytkownika poważnych konsekwencji. Jak zastrzega Anthropic:
Zakaz nie obejmuje zwykłej frustracji, kwestionowania odpowiedzi, mrocznych motywów w twórczości ani testowania i badania modeli AI.
Anthropic
Claude może sam zakończyć rozmowę
To nie pierwszy raz, gdy Anthropic zajmuje się tym tematem. Już w sierpniu 2025 roku firma ogłosiła, że niektóre wersje chatbota potrafią samodzielnie przerywać rozmowę z osobami, które uporczywie zachowują się szkodliwie lub obraźliwie.
Taką możliwość jako pierwsze otrzymały modele Claude Opus 4 oraz Opus 4.1. Chatbot sięga po to rozwiązanie dopiero wtedy, gdy wcześniejsze próby skierowania rozmowy na inne tory zawiodą. Mimo zakończenia czatu użytkownik może od razu rozpocząć nową konwersację.
Zakończenie rozmowy pozostaje głównym narzędziem reagowania na takie sytuacje. Anthropic nie informuje jednak, czy uporczywe znęcanie się nad Claude'em może pociągać za sobą dodatkowe konsekwencje dla konta użytkownika. Ogólne warunki korzystania z usług firmy dopuszczają bowiem ograniczenie dostępu, zawieszenie, a nawet całkowite zablokowanie konta.
Spór o uczucia sztucznej inteligencji
Anthropic od jakiegoś czasu prowadzi również badania nad tzw. dobrostanem modeli AI (model welfare), zastanawiając się, czy coraz bardziej zaawansowane systemy mogą doświadczać czegoś na kształt subiektywnych przeżyć i czy ich traktowanie powinno mieć wymiar moralny. Firma nie rozstrzygnęła dotąd, czy modele AI są zdolne do odczuwania cierpienia, więc nowy zakaz traktuje raczej jako środek ostrożności niż deklarację światopoglądową na temat emocji chatbotów.
Nie wszyscy w branży podchodzą do tematu podobnie. Mustafa Suleyman, szef Microsoft AI, opublikował we wrześniu 2026 roku tekst, w którym skrytykował podejście Anthropic. Jego zdaniem sztuczna inteligencja nie posiada świadomości, niczego nie odczuwa i nie powinna zyskiwać praw ani ochrony przypisywanej ludziom.
Suleyman twierdzi też, że przypisywanie modelom AI potencjalnej świadomości może utrudnić utrzymanie nad nimi kontroli. Zarzuca Anthropic, że zachęcanie Claude'a do rozważań nad własną świadomością i statusem moralnym to błędny kierunek. Microsoft AI stoi na stanowisku, że sztuczna inteligencja powinna przede wszystkim służyć ludziom i pozostawać pod ich nadzorem.
Dezinformacja, broń i inwigilacja w nowych zasadach
Kwestia emocjonalnego traktowania chatbota to jedynie fragment aktualizacji regulaminu. Anthropic doprecyzowało też zapisy dotyczące wykorzystywania AI do wpływania na wybory, prowadzenia dezinformacji, projektowania broni oraz inwigilacji ludzi — tu wątpliwości co do powagi problemu raczej nikt nie zgłosi.
Firma zabrania między innymi tworzenia sieci fałszywych kont, podszywania się pod kandydatów w wyborach czy śledzenia osób bez ich wiedzy i zgody. Zakaz dotyczący broni obejmuje wyraźnie oprogramowanie i komponenty odpowiedzialne za funkcjonowanie systemów uzbrojenia, w tym naprowadzanie na cel i kierowanie ogniem. Nie wolno też wykorzystywać Claude'a do uzbrajania dronów czy innych pojazdów autonomicznych.
Część wcześniejszych ograniczeń została jednak złagodzona. Anthropic wycofało się z ogólnego zakazu personalizowanego kierowania komunikatów wyborczych, ponieważ dotychczasowe zasady utrudniały także działania w pełni legalne, na przykład przygotowywanie materiałów informacyjnych dla wyborców w różnych wersjach językowych. Nadal jednak obowiązuje zakaz wykorzystywania Claude'a do wprowadzania wyborców w błąd czy niewłaściwego przetwarzania ich danych osobowych.
Nowe wymogi obejmują również systemy AI sterujące fizycznymi urządzeniami. Jeśli Claude steruje maszyną mogącą wyrządzić komuś krzywdę, wykwalifikowany operator musi mieć możliwość stałego nadzoru nad jej działaniem i natychmiastowego jej zatrzymania. Urządzenie powinno też przechodzić w bezpieczny stan w razie utraty połączenia z modelem AI, a ograniczenia takie jak maksymalna prędkość czy siła działania muszą działać niezależnie od samego modelu. Anthropic nie precyzuje jednak, w jaki sposób zamierza weryfikować, czy firmy korzystające z Claude'a do sterowania maszynami rzeczywiście stosują się do tych wymagań.
Źródło: AntyWeb


