Генерация фанфикшена нейросетями¶
Генерация фанфикшена нейросетями — создание фанфикшена (фанатского художественного текста, написанного на основе существующего произведения) с использованием больших языковых моделей. Практика получила распространение с конца 2010-х годов и стала одним из наиболее заметных проявлений применения искусственного интеллекта в любительской литературе, вызвав дискуссии о творчестве, авторстве и правах правообладателей.
¶История
Первые попытки автоматической генерации художественного текста предшествовали эпохе больших языковых моделей: ещё в 2010-х годах использовались марковские цепи и нейросети на базе рекуррентных архитектур (RNN, LSTM), обучавшиеся на корпусах фанфиков с сайтов типа Archive of Our Own и FanFiction.net. Качество таких текстов было низким — сюжетные связи и грамматика часто разрушались.
Существенный перелом произошёл после выхода моделей GPT-2 (2019) и GPT-3 (2020) от OpenAI, а затем открытых моделей семейства LLaMA (Meta, 2023) и их клонов. Появились инструменты, ориентированные на фанфикшн-сообщество: NovelAI (2021), KoboldAI, SillyTavern, а также локальные генераторы на базе моделей Mistral, Qwen и других. К 2023–2024 годам генерация фанфиков нейросетями стала массовой практикой.
¶Инструменты и методы
Для генерации фанфикшена используются несколько подходов:
- Облачные сервисы — NovelAI, Character.AI, ChatGPT и аналоги, где пользователь задаёт контекст (персонажи, сеттинг, жанр) и получает продолжение текста.
- Локальные модели — запускаемые на собственном оборудовании открытые модели (LLaMA, Mistral, Qwen), часто дообученные на корпусах фанфикшена для стилизации под определённые фандомы.
- Промпт-инжиниринг — подготовка развёрнутых описаний сценария, характеров и стиля, направляющих генерацию.
Часто используется метод «предзаполнения» (prefilling): модель продолжает уже написанный автором фрагмент, а не создаёт текст с нуля.
¶Правовые и этические вопросы
Генерация фанфикшена нейросетями затрагивает несколько правовых коллизий:
- Права правообладателей оригинала. Фанфикшн исторически существовал в зоне неформальной терпимости правообладателей (по аналогии с фэндомом), но коммерческое использование нейрогенерированного текста, основанного на узнаваемом персонаже или сеттинге, может квалифицироваться как нарушение авторских прав.
- Права на обучение моделей. Корпуса фанфикшена (в частности, Archive of Our Own) использовались для обучения языковых моделей, что вызвало протесты части сообщества. Сайт AO3 в 2023 году ввёл ограничения на скрапинг.
- Авторство. Открытый вопрос о том, может ли текст, сгенерированный нейросетью, считаться произведением и кто выступает его автором.
¶Отношение сообщества
Фандом-сообщество неоднородно в оценке нейрогенерации. Часть авторов и читателей рассматривает её как инструмент преодоления «писательского блока» или способ получить быстрый черновик. Другие считают генерацию фанфикшена нейросетями нарушением этики фэндома, где ценится личное авторство и труд. Ряд крупных фандом-площадок (включая Archive of Our Own) ввёл обязательную маркировку или запрет на публикацию текстов, созданных преимущественно нейросетью.
¶Значение
Генерация фанфикшена нейросетями стала одним из массовых сценариев применения генеративного ИИ в гуманитарной сфере. Она демонстрирует как возможности современных языковых моделей в воспроизведении нарративных структур, так и границы их творческого потенциала, а также обостряет дискуссию о статусе любительского творчества в цифровую эпоху.
¶Источники
- NovelAI — официальная документация и блог
- Archive of Our Own — политика в отношении машинного обучения
- Статьи о применении GPT-моделей в фанфикшн-сообществе (FanFiction.net, AO3)
- Материалы о правовых аспектах генеративного ИИ и авторских прав