Tag: analiza narracyjna

  • W fabule powieści o sztucznej inteligencji widać, o co chodzi

    W fabule powieści o sztucznej inteligencji widać, o co chodzi

    Spis treści

    W marcu 2026 roku wydawnictwo Hachette wycofało z rynku powieść grozy zatytułowaną „Shy Girl” po tym, jak wskazano, że została ona w około 78% wygenerowana przez sztuczną inteligencję. Jak wynika z najnowszego artykułu poświęconego literaturze generowanej przez sztuczną inteligencję, była to pierwsza powieść wydana na rynku, której publikacja została wstrzymana w związku z zarzutami dotyczącymi wykorzystania sztucznej inteligencji.

    W tym samym artykule podano dane liczbowe dotyczące tego, jak wiele powieści opartych na sztucznej inteligencji jest już dostępnych na rynku. Prawie 20% z próby 14 000 powieści wydanych własnym sumptem na Amazonie zostało oznaczonych jako w znacznej mierze wygenerowane przez sztuczną inteligencję. Udział ten wzrósł o 41% w ujęciu rok do roku, a książki to tylko jeden z aspektów tego W sieci gromadzą się treści generowane przez sztuczną inteligencję.

    Czytelnicy kupują więc już książki napisane przez maszyny, ale wydane pod nazwiskami ludzi, a pytanie brzmi: jak ktokolwiek może to udowodnić?.

    Słowa łatwo zmienić

    Obecne narzędzia do wykrywania treści generowanych przez sztuczną inteligencję opierają się głównie na stylu – na takich elementach jak dobór słów czy słynny myślnik.

    Opowiadania science fiction z motywem sztucznej inteligencji

    Ten sygnał szybko zanika. Autorzy zwracają uwagę, że model GPT-5.4 porzucił nawyk stosowania myślnika, i powołują się na wcześniejsze badania, w których dostrojenie modelu w celu naśladowania ludzkiego stylu spowodowało spadek wskaźników wykrywalności sztucznej inteligencji w tekstach twórczych z 97% do 3%.

    Widzę to na własnym biurku, gdzie każdy numer “Dossier” przed wysłaniem przechodzi przez listę kontrolną błędów stylistycznych oraz jest sprawdzany przez zewnętrznego recenzenta zwanego „Slop Cop”. Wykrywają oni zakazane słowa, powtórzenia trzech słów w jednym zdaniu, podwójne dwukropki oraz zdania, które przechodzą w zdanie z końcówką „-ing”. Po poprawieniu tych błędów tekst zostaje zatwierdzony, co pokazuje mi jedynie, że słowa zostały oczyszczone. Kto je napisał, to już osobna kwestia.

    Co zamiast tego mierzy StoryScope

    Jenna Russell wraz z czterema współautorami stworzyła StoryScope, aby pójść o krok dalej i zbadać, w jaki sposób powstają opowiadania generowane przez sztuczną inteligencję. Zespół opracował Kod StoryScope na GitHubie.

    Pobrano 10 272 opowiadania autorstwa ludzi z serwisu Books3, a następnie za pomocą modelu Gemini 2.5 Flash przeprowadzono inżynierię odwrotną w celu odtworzenia podpowiedzi pisarskiej stojącej za każdym z nich. Podpowiedź ta została następnie przekazana pięciu aktualnym modelom, od Claude Sonnet 4.6 po Kimi K2.5. Każda z tych podpowiedzi zaowocowała sześcioma wersjami opowiadania. Pełny korpus zawiera 61 608 opowiadań, z których każde liczy około 5 000 słów.

    Następnie przestali skupiać się na samych słowach i wyodrębnili 304 cechy narracyjne w 10 wymiarach, takich jak sposób, w jaki przebiega oś czasu, oraz to, kto ma decydujący wpływ na zakończenie.

    Już same cechy narracyjne pozwoliły odróżnić ludzi od sztucznej inteligencji przy wskaźniku makro-F1 wynoszącym 93,21 TP3T.

    Cechy charakterystyczne powieści o sztucznej inteligencji

    Wyniki badań brzmią jak notatki zmęczonego redaktora.

    Narratorzy oparci na sztucznej inteligencji wymawiają temat 77%, podczas gdy w przypadku narratorów ludzkich jest to 52%. Wątek postaci pogrążonej w żałobie zazwyczaj kończy się stwierdzeniem narratora, w którym podsumowuje on wyciągniętą lekcję.

    79% opowieści stworzonych przez sztuczną inteligencję nie zawiera wątków pobocznych, podczas gdy w przypadku opowieści autorstwa ludzi liczba ta wynosi 57%. Zakończenia opowieści tworzonych przez sztuczną inteligencję w 47% przypadków opierają się na wewnętrznym zrozumieniu lub akceptacji, a w przypadku opowieści autorstwa ludzi – w 27%. Ludzie częściej tworzą bohaterów o ambiwalentnym nastawieniu moralnym (59% w porównaniu z 38%) i częściej pozostawiają zakończenia otwarte.

    Sztuczna inteligencja opisuje również emocje poprzez ciało, jako doznania fizyczne, w 81% opowiadań stworzonych przez sztuczną inteligencję i 38% opowiadań autorstwa ludzi. Zapach pojawia się w 82% opowiadań stworzonych przez sztuczną inteligencję, w porównaniu z 57% opowiadań autorstwa ludzi.

    Każdy model pozostawia również swój własny ślad w literaturze opartej na sztucznej inteligencji, a w przypadku Claude’a przejawia się to płaskim tempem akcji, ponieważ intensywność wydarzeń rośnie tam w mniejszym stopniu niż w jakimkolwiek innym źródle. Claude preferuje spokojne zakończenia zamiast zakończeń typu “lawina”. GPT wykorzystuje plotki i pogłoski jako element fabularny w 64% opowiadań. Gemini tworzy najbardziej uporządkowane zakończenia i najponurejsze scenerie – 88% opowiadań zostało oznaczonych jako ponure i przytłaczające. Kimi plasuje się w środku pod względem gatunkowym, nie wykazując żadnych charakterystycznych preferencji.

    Najważniejszym wynikiem jest to, co łączy wszystkie pięć modeli, lub – jak to ujęto w artykule – modele sztucznej inteligencji “zbiegły się w wspólnej przestrzeni narracyjnej”. Ludzka wersja opowieści była najrzadsza spośród sześciu (57,81 TP3T) w danym okresie, podczas gdy wynik losowy wyniósłby 16,71 TP3T.

    W czym większość ludzi popełnia błąd

    Najprostszym wnioskiem byłoby stwierdzenie, że nowy detektor przewyższa stare modele, jednak w przypadku surowego tekstu jest to nieprawda. Dopracowany model ModernBERT uzyskał wynik 99,91 TP3T na tym zbiorze danych, a TF-IDF z XGBoost – 99,71 TP3T. Na tych danych klasyfikatory oparte na stylu nadal wygrywają.

    Najważniejsza jest jednak trwałość wyników, przetestowana na 278 opowiadaniach Gemini przetworzonych za pomocą LAMP – narzędzia do przepisywania tekstu, które usuwa siedem kategorii artefaktów sztucznej inteligencji, takich jak frazesy i przesadnie kwiecisty styl. Po oczyszczeniu tekstu wynik wykrywania narracji nadal wynosił 93,91 TP3T, co stanowi spadek w stosunku do 95,51 TP3T.

    Zmiana słów to nic trudnego. Zmiana fabuły opowiadania o sztucznej inteligencji oznacza jednak przepisanie całej historii od podstaw.

    Artykuł ma też swoje ograniczenia, a największym z nich jest to, że wskazanie konkretnego modelu jest znacznie trudniejsze niż ogólne wykrycie sztucznej inteligencji – wynik dla sześciokierunkowej identyfikacji opartej wyłącznie na cechach narracyjnych wyniósł 68,41 TP3T. Nie znalazłem również testu, w którym modelowi nakazano by wprost napisać nieliniową, wieloznaczną fikcję pełną wątków pobocznych. Taki atak na system wykrywania fikcji generowanej przez sztuczną inteligencję jest oczywistym kolejnym krokiem.

    Dlaczego pracownik ochrony interesuje się literaturą piękną

    Fikcja związana ze sztuczną inteligencją wykracza poza zakres mojej specjalizacji. Czytam głównie raporty o zagrożeniach oraz popularne posty “osób z wewnątrz”, a pierwszą rzeczą, o którą pytam w każdym z nich, jest to, skąd pochodzą.

    Ta logika przenosi się z fantastyki poświęconej sztucznej inteligencji na wszelkie teksty mające na celu przekonanie odbiorców. Operacje wpływowe opierają się również na generowanych tekstach i nic nie stoi na przeszkodzie, by zastosować w nich takie samo “oczyszczanie” na poziomie słów. Struktura rodzi trudniejsze pytania, na przykład czy każdy tekst kończy się jasno sformułowaną morałem, czy też każdy „świadek” rozwiewa swoje wątpliwości już w ostatnim akapicie. Prawdziwe relacje zazwyczaj pozostawiają pewien bałagan.

    Aby zadawać te pytania, trzeba wyrobić sobie nawyk, a ten nawyk nic nie kosztuje.

    Warto więc traktować każdy wynik “78% AI” jako wskazówkę i sprawdzić wykres, zanim uwierzysz w podaną wartość procentową.

    Źródło | https://arxiv.org/abs/2604.03136


    Chcesz więcej? Subskrybuj The Dossier

    Co tydzień w skrzynce odbiorczej:

    📡 KANAŁ WYWIADOWCZY - 3-5 wyselekcjonowanych linków: [Badania] [Polityka] [Narzędzia] [Incydenty]
    💡 JEDNA RADA - Jedna praktyczna wskazówka dotycząca AI/cyberbezpieczeństwa, z której możesz skorzystać już dziś