Открыть сервисСервис

Генерация фанфикшена нейросетями

Генерация фанфикшена нейросетями — создание фанфикшена (фанатского художественного текста, написанного на основе существующего произведения) с использованием больших языковых моделей. Практика получила распространение с конца 2010-х годов и стала одним из наиболее заметных проявлений применения искусственного интеллекта в любительской литературе, вызвав дискуссии о творчестве, авторстве и правах правообладателей.

История

Первые попытки автоматической генерации художественного текста предшествовали эпохе больших языковых моделей: ещё в 2010-х годах использовались марковские цепи и нейросети на базе рекуррентных архитектур (RNN, LSTM), обучавшиеся на корпусах фанфиков с сайтов типа Archive of Our Own и FanFiction.net. Качество таких текстов было низким — сюжетные связи и грамматика часто разрушались.

Существенный перелом произошёл после выхода моделей GPT-2 (2019) и GPT-3 (2020) от OpenAI, а затем открытых моделей семейства LLaMA (Meta, 2023) и их клонов. Появились инструменты, ориентированные на фанфикшн-сообщество: NovelAI (2021), KoboldAI, SillyTavern, а также локальные генераторы на базе моделей Mistral, Qwen и других. К 2023–2024 годам генерация фанфиков нейросетями стала массовой практикой.

Инструменты и методы

Для генерации фанфикшена используются несколько подходов:

  • Облачные сервисы — NovelAI, Character.AI, ChatGPT и аналоги, где пользователь задаёт контекст (персонажи, сеттинг, жанр) и получает продолжение текста.
  • Локальные модели — запускаемые на собственном оборудовании открытые модели (LLaMA, Mistral, Qwen), часто дообученные на корпусах фанфикшена для стилизации под определённые фандомы.
  • Промпт-инжиниринг — подготовка развёрнутых описаний сценария, характеров и стиля, направляющих генерацию.

Часто используется метод «предзаполнения» (prefilling): модель продолжает уже написанный автором фрагмент, а не создаёт текст с нуля.

Правовые и этические вопросы

Генерация фанфикшена нейросетями затрагивает несколько правовых коллизий:

  1. Права правообладателей оригинала. Фанфикшн исторически существовал в зоне неформальной терпимости правообладателей (по аналогии с фэндомом), но коммерческое использование нейрогенерированного текста, основанного на узнаваемом персонаже или сеттинге, может квалифицироваться как нарушение авторских прав.
  2. Права на обучение моделей. Корпуса фанфикшена (в частности, Archive of Our Own) использовались для обучения языковых моделей, что вызвало протесты части сообщества. Сайт AO3 в 2023 году ввёл ограничения на скрапинг.
  3. Авторство. Открытый вопрос о том, может ли текст, сгенерированный нейросетью, считаться произведением и кто выступает его автором.

Отношение сообщества

Фандом-сообщество неоднородно в оценке нейрогенерации. Часть авторов и читателей рассматривает её как инструмент преодоления «писательского блока» или способ получить быстрый черновик. Другие считают генерацию фанфикшена нейросетями нарушением этики фэндома, где ценится личное авторство и труд. Ряд крупных фандом-площадок (включая Archive of Our Own) ввёл обязательную маркировку или запрет на публикацию текстов, созданных преимущественно нейросетью.

Значение

Генерация фанфикшена нейросетями стала одним из массовых сценариев применения генеративного ИИ в гуманитарной сфере. Она демонстрирует как возможности современных языковых моделей в воспроизведении нарративных структур, так и границы их творческого потенциала, а также обостряет дискуссию о статусе любительского творчества в цифровую эпоху.

Источники

  • NovelAI — официальная документация и блог
  • Archive of Our Own — политика в отношении машинного обучения
  • Статьи о применении GPT-моделей в фанфикшн-сообществе (FanFiction.net, AO3)
  • Материалы о правовых аспектах генеративного ИИ и авторских прав
Заметили ошибку или не согласны с информацией в статье? Напишите нам support@bfometr.ru