textmachine/docs/research/08-legal.md
Claude (backend session) 9bb00d49f2 Initial commit: documentation, eval polygon, backend step 0 verdict
TextMachine project repository (AI translation of literary books).
Includes: v2 architecture decisions, MVP plan, research 01-12,
polygon experiments 01-03, backend-session revalidation verdict
(03-implementation-notes.md).

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
2026-07-04 06:50:59 +03:00

40 KiB
Raw Permalink Blame History

Юридические аспекты AI-перевода книг: инструмент, переводы, 18+, ToS провайдеров

Дата исследования: 2026-07-04. Юрисдикции: US, EU/UK, РФ, Китай/Япония/Корея (как источники контента).

TL;DR

  1. Перевод без разрешения правообладателя — нарушение почти везде: Бернская конвенция (ст. 8) даёт автору исключительное право на перевод; в США перевод — derivative work (17 U.S.C. §101, §106(2)); в РФ — ст. 1260 и 1270 ГК РФ. Нарушением является использование (публикация/распространение) перевода; частный перевод «в стол» практически непреследуем.
  2. Инструмент для перевода легален — как Photoshop, MS Word или Trados. Доктрина Sony Betamax («substantial non-infringing uses»), сужение вторичной ответственности в Cox v. Sony (SCOTUS, 2026) и отсутствие хоть одного прецедента против CAT-инструментов это подтверждают. Ключевое ограничение — не «индуцировать» пиратство маркетингом (MGM v. Grokster, 2005).
  3. Чисто машинный AI-перевод не охраняется авторским правом в США (USCO Part 2, январь 2025; Thaler v. Perlmutter, D.C. Cir. 2025). Человекоредактированный перевод охраняем в части человеческого вклада. В РФ практика (дело о дипфейке А40-200471/2023) признаёт охрану при доказанном творческом вкладе человека. Human-in-the-loop — юридическая необходимость, а не только качество.
  4. Правообладатели Азии активно давят фан-сцену: Qidian/China Literature слали DMCA переводчикам вплоть до Patreon; Kakao закрыла Reaper Scans (2023); японские издатели добились ареста админа Mangamura и выиграли суд против Cloudflare (2025). Платформы типа Rulate живут в серой зоне на DMCA-процедурах.
  5. ToS провайдеров не запрещают переводить чужой текст напрямую — они перекладывают ответственность на пользователя («you warrant you have all rights to Inputs» — OpenAI, DeepSeek; аналогично Anthropic). Нарушает ToS тот, кто не имеет прав на вход, но случаев enforcement против переводчиков по этому основанию не найдено (не проверено — прецеденты не обнаружены).
  6. 18+ радикально различается по провайдерам: xAI — самый разрешительный для текстовой эротики; OpenAI с декабря 2025 разрешил erotica для верифицированных взрослых (Model Spec 18.12.2025: «only sexual content involving minors is prohibited»); Google — запрет с исключениями для «artistic»; Anthropic — полный запрет sexually explicit (политика от 15.09.2025).
  7. Риск 18+ лежит на распространителе, а не на инструменте: в США текст почти всегда защищён Miller-тестом («serious literary value»), в РФ ст. 242 УК прямо включает «литературные произведения» в порнографические материалы + маркировка 18+ (436-ФЗ) + законы о «ЛГБТ-пропаганде» — существенный риск для данмэй/яой-сегмента.
  8. Стратегия: позиционировать TextMachine как B2B/prosumer-инструмент (аналог CAT-tool) для правообладателей и лицензированных переводчиков, не хостить чужой контент, фиксировать человеческие правки (доказательство авторства), не упоминать пиратские сценарии в маркетинге.

1. Перевод как производное произведение

1.1 Международный уровень: Бернская конвенция

  • Ст. 8: авторы «пользуются исключительным правом переводить и разрешать переводы своих произведений» в течение всего срока охраны (Cornell LII).
  • Ст. 2(3): переводы охраняются «наравне с оригинальными произведениями», без ущерба правам автора оригинала (WIPO summary).
  • 181 страна-участница, включая США, РФ, Китай, Японию. Приложение Парижского акта допускает принудительные лицензии на перевод только для развивающихся стран и образовательных целей — к коммерческому фан-переводу неприменимо.

1.2 США

  • 17 U.S.C. §101: «derivative work» прямо включает «translation». §106(2): исключительное право «to prepare derivative works». Формально сам акт подготовки перевода без лицензии — уже нарушение, даже без публикации; на практике иски строятся вокруг распространения, потому что частное создание недоказуемо и не даёт измеримых убытков.
  • Незаконно созданный перевод не получает собственной охраны в части, где неправомерно использован оригинал (17 U.S.C. §103(a)).

1.3 РФ

  • Ст. 1260 ГК РФ: переводчику принадлежат авторские права на перевод, но он «осуществляет свои авторские права при условии соблюдения прав авторов произведений, использованных для создания производного произведения» (КонсультантПлюс). Права переводчика возникают в силу факта создания (п. 4), но использование перевода без согласия правообладателя оригинала нарушает исключительное право (ст. 1270 п. 2 пп. 9: перевод/переработка — способ использования произведения).
  • Санкции: ст. 1301 ГК — компенсация 10 тыс. — 5 млн руб. за нарушение; блокировки сайтов по «антипиратскому» механизму (ст. 15.2 закона 149-ФЗ).

1.4 Почему ИНСТРУМЕНТ легален (аргументация «как Photoshop»)

  1. Sony Corp. v. Universal City Studios (1984): производитель технологии не несёт вторичной ответственности, если она «capable of substantial non-infringing uses» (CRS обзор). У переводческого софта таких применений масса: перевод собственных текстов, лицензированных текстов, public domain, документов, UGC самих пользователей.
  2. MGM v. Grokster (2005): ответственность возникает при inducement — «активных шагах, поощряющих нарушение», например рекламе инфрингового применения (CCBJ). Вывод: инструмент легален, пока маркетинг не строится на «переведи и выложи чужую новеллу».
  3. Cox v. Sony (SCOTUS, апрель 2026): Верховный суд сузил вторичную ответственность — простого знания, что сервисом пользуются нарушители, недостаточно; нужен culpable conduct (Arnold & Porter, CRS). Это прямо снижает риски для нейтральных инструментов, включая AI-сервисы.
  4. Индустриальная практика: CAT-инструменты (Trados, memoQ, Smartcat), Google Translate, DeepL десятилетиями переводят любые загруженные тексты — ни одного иска к ним как к инструментам нарушения не найдено. Photoshop не отвечает за коллажи из чужих фото; Word — за перепечатку книг.
  5. РФ: ответственность «информационного посредника» (ст. 1253.1 ГК) применима к хостингам/платформам, а не к десктопному/SaaS-инструменту, который не хранит и не доводит контент до всеобщего сведения.

Граница: инструмент превращается в мишень, если (а) хостит/распространяет результаты публично, (б) рекламирует пиратские сценарии, (в) встраивает каталоги чужого контента (сценарий «встроенная библиотека новелл» — худшее, что можно сделать).


2. Фан-переводы: реальная практика правоприменения

2.1 Китай (Qidian / China Literature / Tencent)

  • До 2017 фан-переводчики договаривались напрямую с авторами, но права уже принадлежали Qidian; Wuxiaworld в декабре 2016 получил 10-летнюю лицензию на 20 новелл, после чего конфликт с Qidian чуть не уничтожил сайт (Rice Media).
  • Qidian рассылал DMCA-уведомления даже Patreon-аккаунтам переводчиков (webnovel.forum). Сегодня Wuxiaworld — полностью лицензированная платформа-партнёр China Literature (Wuxiaworld support).
  • Вывод: китайские правообладатели консолидированы (права у платформ, не у авторов) и активно применяют DMCA против переводчиков, агрегаторов и их монетизации.

2.2 Корея (Kakao)

  • Kakao Entertainment создала спецкоманду P.CoK (2021); фиксирует >10 000 сканлейт-групп в мире; закрыла Reaper Scans (веб-новеллы и вебтуны) через cease-and-desist в мае 2023 (Forbes, Anime Corner, TorrentFreak).

2.3 Япония

  • Дело Mangamura: уголовные жалобы издателей (2017), закрытие (2018), арест администратора Romi Hoshino (2019) (Japan Today).
  • Shueisha, Kodansha, Shogakukan, Kadokawa судятся экстерриториально: иск в Нью-Йорке против «наследников Mangamura», выигранный иск против Cloudflare (Токио, ноябрь 2025) (ANN).
  • Поправки в Copyright Act (в силе с 01.10.2020 / 01.01.2021): скачивание пиратской манги/текстов — до 2 лет тюрьмы или ¥2 млн штрафа; операторы «личных» (leech) сайтов — до 5 лет / ¥3 млн (TorrentFreak, ICLG Japan).

2.4 Rulate и русскоязычная сцена

  • Tl.Rulate.ru — UGC-платформа: заявляет соблюдение DMCA, удаление по уведомлениям, counter-notification процедуру и блокировку рецидивистов (правила Rulate, для правообладателей). Фактически большая часть контента — нелицензированные переводы; модель выживает за счёт (а) DMCA safe-harbor-подобной процедуры, (б) низкого интереса азиатских правообладателей к ru-юрисдикции, (в) платёжной инфраструктуры вне карточных сетей.
  • Риски таких платформ: блокировка по «антипиратскому закону» через Мосгорсуд, претензии Qidian/Kakao при выходе на видимый масштаб, а также претензии РКН по 18+/запрещённому контенту (специфические кейсы блокировок Rulate не проверено).
  • Для TextMachine важно: клиенты-переводчики фан-сцены сами несут риск, инструмент — нет (см. 1.4), но интеграции «в один клик на Rulate» повышали бы inducement-риск.

3. Копирайт на AI-выход: кому принадлежит AI-перевод

3.1 США

  • USCO, Part 2 «Copyrightability» (29.01.2025): человеческое авторство обязательно; выход, сгенерированный целиком AI, не охраняется; промпты сами по себе, даже детальные, не создают авторства; в смешанных произведениях охраняются только человеческие вклады (отбор, аранжировка, правки) — оценка case-by-case (copyright.gov/ai, Skadden, Jones Day).
  • Thaler v. Perlmutter (D.C. Cir., 18.03.2025): «human authorship — bedrock requirement», AI не может быть автором; SCOTUS отказал в certiorari (март 2026) (опинион, Mayer Brown).
  • Следствие для перевода: сырой машинный перевод в США — без охраны (кроме сохраняющихся прав автора оригинала на underlying work!). Отредактированный человеком перевод охраняем в объёме правок/стилистических решений. Публикуемый перевод «без копирайта переводчика» может свободно перепечатываться конкурентами — весомый коммерческий аргумент за постредактуру.
  • Part 3 «Generative AI Training» (pre-publication, 09.05.2025): обучение на пиратских копиях выходит за рамки fair use (Crowell); фон — Bartz v. Anthropic: settlement ≥$1,5 млрд (~$3000/книгу за ~500 тыс. книг из shadow-библиотек), при этом суд признал само обучение «exceedingly transformative» fair use (Norton Rose, Kluwer). Это риск слоя моделей, не слоя приложений — TextMachine не обучает базовые модели, риск не транзитивен.

3.2 ЕС

  • AI Act не регулирует принадлежность прав на выход. Он налагает на провайдеров GPAI-моделей: политику соблюдения авторского права ЕС и opt-out'ов по ст. 4(3) DSM-директивы 2019/790, публикацию summary обучающих данных по шаблону AI Office (июль 2025), маркировку AI-контента (ст. 50) (Clifford Chance, artificialintelligenceact.eu). Обязанность маркировки касается deepfake и «текстов, информирующих общественность» — художественный перевод под обязательную маркировку не подпадает (ст. 50(4) содержит исключение для явно художественного/креативного контента; формулировку применительно к переводам суды не тестировали — не проверено).
  • Авторство выхода — национальное право + критерий CJEU «own intellectual creation»: чисто машинный выход, скорее всего, не охраняется; постредактированный — охраняем (судебной практики именно по AI-переводам нет — не проверено).

3.3 РФ

  • Ст. 1257 ГК: автор — «гражданин, творческим трудом которого создано произведение». Контент «чистой» нейросети без творческого вмешательства человека авторского права не порождает (Гарант, обзор практики 2024).
  • Дело № А40-200471/2023 (дипфейк с Киану Ривзом, «Рефейс технолоджис»): суд признал ролик объектом авторского права, т.к. ИИ был «дополнительным инструментом обработки», а творческий вклад внесли люди (сценарий, съёмка, монтаж); взыскано 500 тыс. руб.; апелляция согласилась (Право.ру, Zuykov).
  • Вывод: в РФ человекоредактированный AI-перевод с документированным творческим вкладом охраняем; права — у редактора/переводчика (или его работодателя/заказчика по договору).

3.4 Сводка по AI-переводу

Сценарий US EU РФ
Сырой MT-выход не охраняется скорее нет (не проверено) скорее нет
Человекоредактированный охраняются человеческие вклады охраняем при творческом выборе охраняем (практика дипфейк-дела)
Права автора оригинала сохраняются всегда сохраняются всегда сохраняются всегда (ст. 1260)

4. ToS LLM-провайдеров: копирайтные входы и 18+

4.1 Отправка чужого копирайтного текста в API

Все провайдеры используют одну модель: гарантии пользователя + переуступка прав на выход.

  • OpenAI: «You retain ownership rights in Input and own the Output»; пользователь «represent and warrant that you have all rights, licenses, and permissions needed to provide Input» (Terms of Use).
  • DeepSeek: пользователь отвечает за Inputs и Outputs, гарантирует наличие прав; DeepSeek переуступает права на Outputs пользователю (DeepSeek Terms, Open Platform ToS).
  • Anthropic: Usage Policy (в силе с 15.09.2025) запрещает «infringe, misappropriate, or violate the intellectual property rights» (AUP); коммерческие условия аналогично возлагают права на Inputs на клиента.
  • Google, xAI: аналогичные положения об ответственности пользователя (единый паттерн отрасли).

Практический ответ на вопрос «нарушаем ли ToS, отправляя копирайтный текст в API»: сам по себе ввод не запрещён; нарушение возникает, если у пользователя нет прав на текст — тогда нарушены и warranty в ToS, и (при распространении результата) копирайт. Провайдеры технически не проверяют права на вход; кейсов блокировки за перевод чужих книг не обнаружено (не проверено — прецеденты не найдены). Юридически чистая конструкция для TextMachine: транслировать это же требование в собственные ToS («пользователь гарантирует права на загружаемые тексты»).

Отдельный аспект — конфиденциальность входа: отправка неопубликованной рукописи клиента в API затрагивает договорные NDA; у OpenAI/Anthropic/Google API-данные по умолчанию не используются для обучения, у DeepSeek возможна обработка для улучшения сервиса с opt-out и хранением в КНР (Ropes & Gray) — для издательских клиентов это аргумент против DeepSeek для неопубликованных текстов.

4.2 18+ генерация по провайдерам (на середину 2026)

Провайдер Политика по текстовой эротике
OpenAI Разворот октября-декабря 2025: erotica для верифицированных взрослых; Model Spec 18.12.2025: «erotica and gore» допустимы «in appropriate contexts», «transformations are allowed», запрещён только сексуальный контент с несовершеннолетними (Model Spec, CBC). Применимость к API (а не ChatGPT) и требования к age-verification для API-клиентов — не проверено.
Anthropic Полный запрет: «Do Not Generate Sexually Explicit Content» — включая «sexual intercourse or sex acts», «erotic chats», без исключений для фикшена (AUP, 15.09.2025). Исключения из политики — только для гос. заказчиков (Exceptions).
Google Запрет sexually explicit «for the purpose of pornography or sexual gratification», но явные исключения «educational, documentary, scientific, or artistic» (обновление декабря 2024) (Prohibited Use Policy). Художественный роман — аргументируемая «artistic» зона, на практике модерация консервативна.
xAI Самый разрешительный: AUP запрещает только порнографические изображения реальных лиц и сексуализацию детей; текстовая эротика с вымышленными взрослыми персонажами допускается (xAI AUP).
DeepSeek ToS требуют законности контента; модель подчиняется праву КНР, где порнография запрещена как таковая — облачный API склонен к отказам на explicit (степень фильтрации — не проверено). Открытые веса DeepSeek/Qwen локально — вне ToS облака.

Вывод для пайплайна: маршрутизация NSFW-сегментов на xAI, OpenAI (после верификации) или локальные open-weights модели (8GB VRAM: квантованные 7-12B); Anthropic — только для SFW-ролей (редактор, судья, консультант) либо для всего текста кроме явных сцен.


5. Распространение 18+ контента: obscenity и возрастные режимы

  • США: Miller v. California (1973) — трёхчастный тест; текст признаётся obscene только если «taken as a whole, lacks serious literary, artistic, political, or scientific value» (Miller test, DOJ). Художественная проза практически всегда проходит по «literary value»; реальный риск для текстов — не уголовный, а инфраструктурный: правила платёжных систем (Visa/Mastercard) и сторов, давление на платформы с NSFW-контентом (волна ограничений Steam/itch.io лета 2025 — не проверено в деталях).
  • РФ: ст. 242 УК — незаконное распространение порнографии, причём практика относит к порноматериалам и «литературные произведения» (КонсультантПлюс); распространение среди несовершеннолетних — от 2 до 5 лет (ст. 242 ч. 2). 436-ФЗ требует маркировки 18+ и ограничения доступа (selfpub.ru обзор требований). Плюс запрет «пропаганды ЛГБТ» (в ред. 2022) — прямой риск для данмэй/BL-новелл, значимой доли рынка веб-новелл; были административные дела против издателей (не проверено в деталях).
  • UK: Online Safety Act — с 25.07.2025 «highly effective age assurance» для платформ с порнографическим контентом (Ofcom, GOV.UK); применимость к чисто текстовой эротике неоднозначна — фокус регулятора на визуальном контенте (не проверено).
  • ЕС: единого obscenity-права нет; тренд — age assurance по DSA guidelines для порноплатформ; текстовые библиотеки пока вне фокуса.
  • Ключевое разграничение: все режимы выше нацелены на распространителя контента (платформу/издателя), а не на инструмент обработки текста. Пока TextMachine не хостит публичную библиотеку, obscenity-режимы её почти не касаются.

6. Выводы для TextMachine

  1. Позиционирование — «профессиональный инструмент», не платформа. Юридически безопасная ниша: «AI-CAT-система для издателей, правообладателей и переводчиков с лицензией» (аналогия Trados/Photoshop). Продукт не хранит публично и не распространяет тексты — тогда цепочка ответственности за права остаётся на пользователе, а инструмент защищён логикой Sony/Grokster/Cox.
  2. Никакого inducement в маркетинге. Не публиковать кейсы «переведи новеллу с Qidian и продавай на Rulate», не встраивать каталоги/парсеры пиратских библиотек, не давать кнопку «опубликовать на агрегаторе». Это единственное, что реально превращает нейтральный инструмент в соответчика.
  3. ToS продукта: (а) пользователь гарантирует наличие прав/лицензии на загружаемые тексты (зеркалирует warranty OpenAI/DeepSeek — переносит риск дальше по цепочке); (б) запрет CSAM и контента, незаконного в юрисдикции пользователя; (в) дисклеймер, что права на AI-выход зависят от юрисдикции и вклада пользователя.
  4. Фича «журнал творческого вклада»: логирование человеческих правок, выборов вариантов, глоссарных решений редактора → готовое доказательство human authorship для регистрации копирайта (USCO Part 2) и для споров в РФ (стандарт дипфейк-дела). Это одновременно и продуктовая ценность: «наш перевод принадлежит вам, потому что мы фиксируем ваш вклад».
  5. Фан-сцена — канал роста, но не публичное позиционирование. Фан-переводчики будут пользоваться инструментом так же, как пользуются DeepL, — это их риск. Продукту достаточно нейтральности: не знать и не обязан проверять источник текста (Cox v. Sony подтверждает, что общее знание о нарушителях среди клиентов ответственности не создаёт).
  6. Мультипровайдерный роутинг по контент-политикам: SFW-роли — любой провайдер (включая Anthropic для редактора/судьи); explicit-сегменты — xAI / OpenAI (verified) / локальные open-weights на GPU владельца. Детектор NSFW-сегментов до отправки в API — обязательный компонент, чтобы не ловить баны аккаунтов у строгих провайдеров.
  7. Для неопубликованных рукописей (издательский B2B) — режим конфиденциальности: провайдеры с zero-retention/без обучения на данных, без DeepSeek-облака; это продающий пункт для правообладателей.
  8. 18+ распространение — ответственность клиента, но помочь можно: автоматическая маркировка 18+, экспорт с age-gate-метаданными, предупреждения о юрисдикционных рисках (РФ: ст. 242 УК, «ЛГБТ-пропаганда»; UK: OSA age assurance). Самому TextMachine не размещать витрину переведённого 18+ контента.

Источники