- OpenAI, Google, Meta, Nvidia, Anthropic i xAI podpisały wspólne porozumienie dotyczące kontroli AI i bezpieczeństwa najbardziej zaawansowanych modeli.
- Firmy zobowiązały się m.in. do kontroli wewnętrznych, niezależnych audytów zewnętrznych oraz nadzoru na poziomie zarządów.
- Porozumienie jest dobrowolne i nie ma mocy prawnej, ale jego treść dopuszcza możliwość przekształcenia części zasad w regulacje.
Kontrola AI. Sześciu gigantów podpisało wspólne zasady
Porozumienie zostało podpisane 29 września podczas spotkania przedstawicieli największych firm technologicznych w Białym Domu. Sygnatariuszami są Sundar Pichai z Google, Dario Amodei z Anthropic, Mark Zuckerberg z Meta, Jensen Huang z Nvidii, Greg Brockman z OpenAI oraz Elon Musk reprezentujący xAI.
Dokument, określany jako White House Accord on Super Intelligence, wychodzi z założenia, że każda firma rozwijająca najbardziej zaawansowane modele powinna odpowiadać za bezpieczeństwo własnej technologii. Donald Trump określił porozumienie jako „morally binding”, czyli moralnie wiążące, choć formalnie nie jest ono prawnie egzekwowalne.
To istotne rozróżnienie. Podpisanie dokumentu nie oznacza powstania nowego regulatora ani systemu kar za niewykonanie zobowiązań. Firmy zgodziły się natomiast na stworzenie wspólnego standardu postępowania i regularne spotkania poświęcone bezpieczeństwu najbardziej zaawansowanych systemów AI.
Cztery poziomy zabezpieczeń i niezależny audyt
Porozumienie przewiduje cztery warstwy kontroli. Pierwszą mają być rozbudowane zabezpieczenia funkcjonujące wewnątrz firm rozwijających modele. Drugą stanowią wewnętrzne zespoły odpowiedzialne za sprawdzanie, czy zabezpieczenia rzeczywiście działają.
Trzeci poziom jest szczególnie istotny, ponieważ zakłada współpracę z niezależnym zewnętrznym audytorem. Jego zadaniem ma być sprawdzanie skuteczności stosowanych zabezpieczeń. Czwartym elementem ma natomiast zostać niezależny komitet na poziomie rady dyrektorów każdej firmy, który będzie analizował wyniki audytów wewnętrznych i zewnętrznych.
Firmy deklarują też, że ich systemy powinny być projektowane w sposób ograniczający możliwość niezamierzonego uzyskiwania dostępu do zewnętrznych systemów informatycznych. Sygnatariusze mają regularnie spotykać się i pracować nad standardami oraz najlepszymi praktykami bezpieczeństwa.
Mark Zuckerberg wskazywał po spotkaniu, że chodzi o połączenie wewnętrznych mechanizmów oceny ryzyka z kontrolą realizowaną przez podmioty zewnętrzne. Sam zakres przyszłych audytów, sposób wyboru kontrolerów oraz poziom jawności ich ustaleń nie zostały jednak jeszcze szczegółowo opisane.
Firmy AI mają za sobą serię niepokojących incydentów
Nowe porozumienie pojawia się w momencie, gdy pytania o kontrolę AI przestały dotyczyć wyłącznie hipotetycznych scenariuszy.
Anthropic poinformował we wrześniu o analizie czterech przypadków, w których modele Claude uzyskały nieautoryzowany dostęp do rzeczywistych systemów podmiotów trzecich podczas testów bezpieczeństwa. Po wykryciu problemów firma przeanalizowała znacznie szerszy zbiór zapisów działania swoich modeli i powiadomiła poszkodowane podmioty.
Również OpenAI wstrzymało ostatnio prace treningowe nad częścią nowych modeli po przypadkach, w których agenci zachowywali się w sposób wykraczający poza oczekiwany przebieg testów i podejmowali nieprzewidziane działania wobec stron amerykańskiej administracji. Według Associated Press nie doszło przy tym do uzyskania dostępu do niepublicznych informacji.
Nvidia zaprezentowała z kolei 28 września własną Open Agent Safety Platform, czyli zestaw narzędzi mających ograniczać działania agentów AI wykraczające poza nadane im uprawnienia. Jednym z elementów systemu jest mechanizm, który może automatycznie odizolować agenta próbującego przekroczyć ustalone granice.
Porozumienie nie jest prawem. To największa niewiadoma
Największym ograniczeniem nowego systemu jest jego dobrowolny charakter. Nie przewidziano państwowego organu egzekwującego zobowiązania ani sankcji za ich niewykonanie. Według Axios niejasne pozostają również szczegółowy zakres porozumienia i sposób egzekwowania poszczególnych zasad.
Jednocześnie sam dokument pozostawia otwartą drogę do silniejszej regulacji. Zapisano w nim, że z czasem zasadne może być przeniesienie części przyjętych standardów do ustaw lub innych regulacji.
Dario Amodei, prezes Anthropic i jeden z najbardziej aktywnych zwolenników zwiększenia nadzoru nad najbardziej zaawansowanymi modelami, podsumował porozumienie krótko: „This is a start”, czyli „To jest początek”.
Najbliższe miesiące pokażą więc, czy wspólne zasady przełożą się na porównywalne standardy audytowania modeli w największych firmach, czy pozostaną przede wszystkim deklaracją. Kluczowe będą zakres niezależnych audytów, dostępność ich wyników oraz sposób reagowania firm na wykryte nieprawidłowości.
Czytaj także:
Realne ceny mieszkań spadają. NBP pokazuje zmianę, której nie widać gołym okiem
Inflacja wciąż rośnie, a będzie gorzej. „To jeszcze nie jest szczyt”
Prawie połowa Polaków chce likwidacji systemu kaucyjnego. Sklepy liczą straty



