Lato nie powinno usypiać naszej czujności, bo w świecie regulacji praw i rozwoju AI czas nie zwalnia i dzieje się bardzo dużo. Lipiec przyniósł kilka wydarzeń, które układają się w jeden wyraźny obraz, pomimo tego, że dotyczą różnych krajów i obszarów. Wydawcy zaczynają traktować swoje katalogi jak aktywa technologiczne. Prześledźmy, jak sztuczna inteligencja wchodzi w świat prawa i ekonomii twórczości oraz co ważnego się wydarzyło i jakie mogą być tego konsekwencje.

Łatwo zachwycić się możliwościami AI. Już chyba każdy z nas wie, jak szybko AI potrafi pisać, tłumaczyć, tworzyć obrazy czy analizować dane. Teraz coraz częściej w dyskusjach medialnych i środowiskowych wybrzmiewa pytanie, na jakich zasadach i w jakich ramach prawnych powinna to robić. Ministerstwo Cyfryzacji pracuje nad ustawą o systemach sztucznej inteligencji, która ma wdrożyć w Polsce europejski AI Act.

Polska przygotowuje się do ery AI

Skoro pojawia się ustawa, to sztuczna inteligencja przestaje być eksperymentem, a staje się elementem infrastruktury państwa. Jej projekt zakłada m.in. powołanie krajowego systemu nadzoru nad AI (Komisja Rozwoju i Bezpieczeństwa Sztucznej Inteligencji (KRiBSI)) i określa obowiązki dla dostawców systemów wysokiego ryzyka oraz wprowadza mechanizmy kontroli i odpowiedzialności. Szczegóły prac opisane są TUTAJ, ale najistotniejsze wydaje się ustanowienie w całej Unii Europejskiej jednolitych zasad dotyczących systemów sztucznej inteligencji, zapewnienia ochrony praw podstawowych i bezpieczeństwa obywateli przy użytkowaniu systemów AI i, tym samym, zwiększenie społecznego zaufania do nowych technologii oraz tworzenia korzystnych warunków rozwoju technologii AI.

KRiBSI ma być niezależnym organem, obsługiwanym od strony organizacyjnej przez Ministerstwo Cyfryzacji. Pracami Komisji będzie kierował jej przewodniczący, powoływany przez Sejm za zgodą Senatu na 5 lat, a z przepisów ustawy wynika, że przewodniczący KRiBSI ma zostać powołany w ciągu dwóch miesięcy od wejścia ustawy w życie. Oznacza to, że w październiku 2026 r. będzie przewodniczący, a w listopadzie Komisja rozpocznie działalność. 

1,5 miliarda dolarów za naruszenie praw autorskich i licencja na wykorzystanie książki do trenowania modeli AI

Drugim wydarzeniem, które ostatnio odbiło się szerokim echem, a jest już ściśle powiązane z naszą książkową branżą, jest ugoda firmy Anthropic z wydawcami książek. Jej wartość – około 1,5 miliarda dolarów – robi ogromne wrażenie, ale nie sama kwota jest tutaj chyba najważniejsza, a znacznie ciekawsze jest to, co ta sprawa wydaje się mówić o przyszłości rynku. Wydaje mi się, że po raz pierwszy na taką skalę zobaczyliśmy ekonomiczną wartość treści wykorzystywanych do trenowania modeli AI. Chciałabym jednak zwrócić uwagę na pewien niuans, który umknął wielu medialnym nagłówkom. Spór nie dotyczył wyłącznie samego procesu trenowania modeli, ale przede wszystkim sposobu pozyskania materiałów. Coraz wyraźniej widać, że firmy rozwijające AI zaczynają dochodzić do wniosku, że znacznie bezpieczniej i długofalowo taniej jest budować modele w oparciu o legalnie licencjonowane treści niż prowadzić wieloletnie spory sądowe. Być może obserwujemy właśnie narodziny nowego rynku i będzie to rynek licencjonowania treści dla sztucznej inteligencji. Książka pozostanie dziełem kultury, ale stanie się również aktywem technologicznym, którego wartość nie kończy się na sprzedaży egzemplarzy, e-booków czy audiobooków. Coraz częściej będzie obejmowała także możliwość legalnego licencjonowania treści na potrzeby trenowania modeli AI. Czyli nie unikniemy skanowania książek, aby karmić AI, ale chociaż będą za to wypłacane tantiemy…

Tutaj trzeba będzie dobrze policzyć, co i komu się opłaca. Zrobiło to już brytyjskie wydawnictwo Bloomsbury (wydawca m.in. serii o Harrym Potterze, książek Sarah J. Maas czy Susanny Clarke). Poinformowało swoich inwestorów, że otrzymają znaczącą część środków z ugody pomiędzy Anthropic a autorami i wydawcami. Sąd uznał, że w ugodzie znajduje się aż 14 087 tytułów należących do Bloomsbury, a za każdy z nich przewidziano około 3 000 dolarów odszkodowania (źródło: The Guardian).

W mojej ocenie najważniejsze jest to, co Bloomsbury zrobiło równolegle. Wydawnictwo uruchomiło własny program licencjonowania treści na potrzeby AI. Autorzy mogą zdecydować, czy chcą udostępnić swoje utwory do trenowania modeli sztucznej inteligencji, a jeśli wyrażą zgodę, będą otrzymywać z tego tytułu wynagrodzenie.

Dlaczego firmy technologiczne wykupują książki z europejskich antykwariatów?

A teraz coś, co dla nas czytelników brzmi jak najgorszy horror. W ostatnich miesiącach europejscy antykwariusze zaczęli informować o nietypowych zamówieniach tysiące specjalistycznych końcówek nakładów oraz tytułów, które nie są już wznawiane. Relacje pochodzą m.in. z Holandii, Niemiec, Hiszpanii i Szwajcarii. Według sprzedawców książki mają trafiać do procesu tzw. destructive scanning, czyli przemysłowego skanowania na potrzeby trenowania modeli AI, po którym papierowe egzemplarze są po prostu niszczone.

Dlaczego właśnie takie książki? Paradoks polega na tym, że dla modeli AI najcenniejsze są dziś właśnie te treści, które nigdy wcześniej nie trafiły do internetu. To one wnoszą nową wiedzę i różnorodność do zbiorów treningowych. Kilkanaście lat temu ogromne emocje budził projekt Google Books. Wielu z nas pamięta dyskusje i protesty wydawców oraz autorów, gdy Google rozpoczęło masową digitalizację książek, tworząc największą na świecie cyfrową bibliotekę. Spór dotyczył nie tylko samej technologii, ale przede wszystkim prawa do skanowania i udostępniania fragmentów książek bez zgody właścicieli praw. Dziś historia zatacza koło, choć na znacznie większą skalę. Okazuje się, że jednym z najbardziej poszukiwanych zasobów są tytuły, które nie mają cyfrowego odpowiednika. Od razu nasuwają się kolejne pytania: Czy to znaczy, że wszystkie książki dostępne w e-formacie już wyszkoliły komercyjne modele AI? Czy zakup egzemplarza oznacza również prawo do wykorzystania jego treści do trenowania modeli? Gdzie przebiega granica między własnością fizycznego nośnika a prawami autorskimi do zawartego w nim utworu? Europejskie prawo wciąż szuka odpowiedzi i zmienia się nie tylko prawo, a sposób myślenia o twórczości i jej wartości.

Powyższe przykłady pokazują, że tak jak kiedyś zastanawialiśmy się czy AI może korzystać z książek, dzisiaj wydaje się, że nikt nie potrafi tego procesu zatrzymać, więc szybko trzeba wykombinować, na jakich zasadach firmy mogą korzystać z treści i kto będzie otrzymywał za to wynagrodzenie. Myślę, że jest już dość późno na takie regulacje, bo widzimy jak szybko ta luka prawna jest wykorzystywana, ale w końcu pojawiają się próby zbudowania rynku, w którym rozwój technologii będzie szedł w parze z poszanowaniem twórców.

Staram się zawsze podkreślać, że technologia sama w sobie nie jest zagrożeniem, ale rozwój nowych narzędzi nie powinien odbywać się kosztem autorów, tłumaczy, ilustratorów, wydawców i wszystkich osób, dzięki którym powstają wartościowe treści. Legalny dostęp do kultury jest zresztą fundamentem działalności Stowarzyszenia Czytam i Słucham Legalnie i dziś warto to same wartości podkreślać w odniesieniu do sztucznej inteligencji. Jeżeli AI ma korzystać z dorobku twórców, powinna robić to w sposób przejrzysty, zgodny z obowiązującym prawem oraz z poszanowaniem ich pracy.

Co dalej?

Skoro już wiemy, że rozwój generatywnej AI w wielu przypadkach odbywał się z wykorzystaniem treści pozyskanych z naruszeniem praw autorskich, a firmy technologiczne prześcigają się w nielegalnym pozyskiwaniu treści do szkolenia swoich modeli, to im szybciej zaczniemy pytać, ile warte są prawa autorskie w erze AI i ustalać warunki, tym lepiej. Rynek powoli odchodzi od myślenia wyłącznie w kategoriach sporów sądowych i zaczyna budować modele współpracy, w których twórczość staje się nie tylko chronionym dobrem kultury, ale również świadomie licencjonowanym zasobem dla rozwoju nowych technologii. Przez lata mówiliśmy o ochronie książek przed piractwem. Dziś stajemy przed zupełnie nowym wyzwaniem – ochroną twórczości w epoce sztucznej inteligencji. To próba wypracowania zasad, dzięki którym rozwój AI będzie możliwy bez odbierania twórcom prawa do wynagrodzenia za ich pracę i jestem przekonana, że jeśli uda się znaleźć tę równowagę, skorzystają na tym wszyscy: autorzy, wydawcy, firmy technologiczne oraz czytelnicy. Jeżeli nie będziemy działać szybko, to zamiast budować zdrowy rynek, będziemy przez kolejne lata toczyć sprawy sądowe i gasić pożary.

Kiedyś książki były skanowane po to, żeby mogli je czytać ludzie. Dziś skanuje się je po to, żeby czytały je maszyny...

Dodaj komentarz

Twój adres email nie zostanie opublikowany. Wymagane pola są oznaczone *