textmachine/docs/research/09-cost-model.md

29 KiB
Raw Permalink Blame History

09. Модель стоимости перевода книги через мультиагентный пайплайн и оценка маржи

SUPERSEDED (09.07.2026). Денежная модель заменена ../experiments/08-cost-model-v2.md (стек grok-редактора: ~$0.69/ранобэ, ~$10.94/вебновелла-500; редактор ≈ 90% стоимости). Пороги $0.6/$5/$30 и Sonnet-премиум-микс мертвы (D11); доктрина «caching-first» опровергнута на текущем стеке (кэш ≈ 2% стандарта — рычаг это цена редактора). Отсюда живы только методика и множители токенизации (уточнены exp01).

Дата: 2026-07-04. Все цены проверены по официальным страницам / актуальным агрегаторам на эту дату; отдельные пункты помечены «(не проверено)». Курс для пересчёта: ~80 ₽/$ (допущение, не проверено — уточнить на дату расчёта).

TL;DR

  1. Себестоимость API — копейки на фоне рынка. Том ранобэ (~150k токенов исходника) в сценарии «стандарт» стоит от $0.23 (Qwen-Flash / GPT-5 nano) до $9.5 (Claude Sonnet). 500-главная вебновелла (~1.1M токенов) — от $1.7 до $92 соответственно.
  2. Рекомендуемый «премиум-микс» (черновик+редактор на дешёвой модели, финальный проход Sonnet): ~$4/том ранобэ, ~$28/вебновелла 500 глав; с Batch API (50%) — ~$2 и ~$15.
  3. Человеческий худ. перевод: РФ — 3 00010 000 ₽/а.л. (том ранобэ ≈ 7 а.л. ≈ 2170 тыс. ₽ ≈ $260880); Запад — $0.080.20/слово ($820k за роман). Разрыв с себестоимостью API — 24 порядка.
  4. Ценовой якорь AI-конкурента: GlobeScribe — $100/книга/язык. Наш COGS премиум-микса ($428) оставляет под этим якорем маржу 7096%.
  5. CJK-токенизация подтверждена как «дорогая»: китайский ≈ 0.650.75 токена/иероглиф (1.331.54 символа/токен у GPT-4o/DeepSeek), японский ≈ 0.71.5 токена/знак в зависимости от токенизатора и доли кандзи. Кириллица на выходе тоже дороже английского (~1.62 токена/слово).
  6. Prompt caching и Batch — главные рычаги COGS: DeepSeek cache-hit = $0.0028/MTok (повторное чтение контекста почти бесплатно), Anthropic cache-read ≈ 0.1× цены input, batch-скидка 50% у OpenAI/Anthropic/Gemini/Qwen. Вместе снижают модельные цифры таблиц ещё на 3060%.
  7. Худший сценарий чувствительности (двойной проход Sonnet по всей книге) — ~$25/том, ~$185/вебновелла: вебновелла вылетает за якорь $100, поэтому дорогая модель должна работать только точечно (судья/финал/сложные места), а не сплошняком.
  8. Выдерживаемый рынком прайсинг: за главу 525 ₽ (сегмент Rulate-переводчиков), за том $25100 (авторы/малые издатели), подписка $1540/мес с квотой. Валовая маржа во всех разумных конфигурациях 8095%.

1. Объёмы текстов в токенах

1.1 Токенизация: сколько стоит символ

Язык Символов/токен Токенов на 1 символ/слово Источник
Английский ~4.75 симв./токен ~1.3 токена/слово замеры на GPT-4o (tonybaloney, arxiv 2604.14210)
Китайский (GPT-4o) ~1.33 симв./токен ~0.75 токена/иероглиф arxiv 2604.14210
Китайский (DeepSeek V3) ~1.54 симв./токен ~0.65 токена/иероглиф llm-calculator benchmark
Японский ~13 симв./токен (сильно зависит от доли кана/кандзи) ~0.71.5 токена/знак; для смешанного текста ранобэ закладываем ~1.01.2 tonybaloney CJK guide, promptcost
Русский (выход) ~2.53 симв./токен ~1.62 токена/слово (не проверено на конкретных токенизаторах — замерить на своих текстах через count_tokens) оценка по общим данным о кириллице

Вывод: тезис задачи «~11.5 токена/иероглиф» подтверждается: у современных токенизаторов китайский — 0.650.75 ток./иероглиф, японский — около 1 (хуже у старых токенизаторов, до 1.5). Важно: и вход (CJK), и выход (кириллица) токенизируются дороже английского, поэтому «1M токенов» наступает быстрее, чем интуитивно кажется по объёму текста.

1.2 Эталонные книги

Книга Объём оригинала Токены исходника (B) Токены перевода (RU)
Глава вебновеллы (zh) 24k иероглифов (среднее 3k) ~2.02.3k ~22.5k
Вебновелла 500 глав (zh) ~1.5M иероглифов ~1.01.15M → берём 1.1M ~1.01.3M
Вебновелла 2000 глав (zh) ~6M иероглифов ~4.4M ~4.55M
Том ранобэ (ja) 120150k знаков ~130180k → берём 150k ~110150k
Англ. роман 90120k слов ~120160k → берём 140k ~150190k

Для модели упрощаем: объём перевода в токенах ≈ объёму исходника (±20%), и вся арифметика ведётся от B (токены исходника).


2. Множитель пайплайна: сценарии

Каждый чанк проходит через несколько ролей; в каждый вызов инжектируется глоссарий, банк памяти и хвост предыдущего контекста. Итоговые множители относительно B:

Сценарий Состав Input (×B) Output (×B)
Эконом переводчик (1 проход) + глоссарий-инъекции + скользящий контекст; редактор только на 10% выборке 4× 2×
Стандарт переводчик + полный проход редактора + судья на выборке + глоссарий/контекст в каждом вызове 6× 3×
Премиум переводчик + редактор + судья на каждом чанке + консультант поп-культуры/языковой аналитик по триггерам + повторное чтение контекста 8× 4×

Обоснование input-множителя: чанк (1×) читается переводчиком с глоссарием+контекстом (≈2× на вызов), редактором (чанк+черновик+глоссарий ≈2.5×), судьёй (оригинал+2 варианта ≈23×). Output: черновик (1×), правка редактора (1×), вердикты/фиксы (0.52×). Это согласуется с эмпирическим диапазоном 48× input / 24× output.

Смешанный «премиум-микс» (рекомендуемая архитектура): черновик+редактура на дешёвой модели (множители «стандарта»), поверх — один финальный проход дорогой моделью (Claude Sonnet): +2×B input, +1.2×B output по тарифам дорогой модели. Судья-выборка и «трудные места» (диалоги, идиомы, стихи) — тоже на дорогой.


3. Актуальные цены API (июль 2026, $ за 1M токенов)

Модель Input Output Cache-hit input Batch 50% Источник
DeepSeek V4 Flash $0.14 $0.28 $0.0028 нет batch-API api-docs.deepseek.com
DeepSeek V4 Pro $0.435 $0.87 $0.003625 нет api-docs.deepseek.com
Gemini 2.5 Flash $0.30 $2.50 ~0.25× input да ai.google.dev/gemini-api/docs/pricing, aicostcheck
Gemini 2.5 Flash-Lite $0.10 $0.40 да pricepertoken (сверить с оф. страницей — вышли и более новые поколения Gemini 3.x)
GPT-5 mini $0.25 $2.00 ~$0.025 (не проверено) да developers.openai.com/api/docs/pricing, pricepertoken
GPT-5 nano $0.05 $0.40 да pricepertoken
Claude Haiku 4.5 $1.00 $5.00 0.1× чтение / 1.25× запись да оф. данные Anthropic (кэш прайс-листа 2026-06)
Claude Sonnet (4.6 / Sonnet 5) $3.00 $15.00 (Sonnet 5 промо $2/$10 до 2026-08-31) 0.1× / 1.25× да оф. данные Anthropic
Grok 4.1 Fast (xAI) $0.20 $0.50 pricepertoken, aipricing.guru
Qwen-Flash (Alibaba, Singapore) $0.05 $0.40 да (скидка на input) да, 50% alibabacloud.com model-pricing
Qwen-Plus $0.40 $1.20 да да там же; Пекинский эндпоинт на 6070% дешевле (eesel)

Замечания:

  • deepseek-chat как имя модели депрекировано с 24.07.2026 — использовать deepseek-v4-flash/-pro.
  • Для zh→ru у DeepSeek/Qwen дополнительный плюс: их токенизаторы эффективнее сжимают китайский (1.54 симв./токен против 1.33 у GPT-4o) — тот же текст на ~15% дешевле в токенах.
  • Цензура: DeepSeek/Qwen жёстко фильтруют политический контент КНР, но заметно либеральнее к 18+; Gemini/OpenAI/Anthropic — наоборот. Для «жёсткого» контента резерв — Grok (слабые фильтры) и локальные модели (см. док. по цензуре).

4. Стоимость перевода: расчёты

Формула: C = B/1M × (M_in × P_in + M_out × P_out), где B — токены исходника, M — множители сценария, P — цены из §3.

4.1 Том ранобэ (B = 0.15M токенов)

Токены: эконом 0.6M in / 0.3M out; стандарт 0.9M / 0.45M; премиум 1.2M / 0.6M.

Модель Эконом Стандарт Премиум
DeepSeek V4 Flash $0.17 $0.25 $0.34
DeepSeek V4 Pro $0.52 $0.78 $1.04
Gemini 2.5 Flash-Lite $0.18 $0.27 $0.36
Gemini 2.5 Flash $0.93 $1.40 $1.86
GPT-5 nano $0.15 $0.23 $0.30
GPT-5 mini $0.75 $1.13 $1.50
Grok 4.1 Fast $0.27 $0.41 $0.54
Qwen-Flash $0.15 $0.23 $0.30
Qwen-Plus $0.60 $0.90 $1.20
Claude Haiku 4.5 $2.10 $3.15 $4.20
Claude Sonnet $6.30 $9.45 $12.60
Премиум-микс (DeepSeek Flash стандарт + Sonnet-проход 2×/1.2×) ≈$3.9 (с batch у Anthropic ≈$2.1)

4.2 Вебновелла 500 глав (B = 1.1M токенов)

Токены: эконом 4.4M in / 2.2M out; стандарт 6.6M / 3.3M; премиум 8.8M / 4.4M.

Модель Эконом Стандарт Премиум
DeepSeek V4 Flash $1.23 $1.85 $2.46
DeepSeek V4 Pro $3.83 $5.74 $7.66
Gemini 2.5 Flash-Lite $1.32 $1.98 $2.64
Gemini 2.5 Flash $6.82 $10.23 $13.64
GPT-5 nano $1.10 $1.65 $2.20
GPT-5 mini $5.50 $8.25 $11.00
Grok 4.1 Fast $1.98 $2.97 $3.96
Qwen-Flash $1.10 $1.65 $2.20
Qwen-Plus $4.40 $6.60 $8.80
Claude Haiku 4.5 $15.40 $23.10 $30.80
Claude Sonnet $46.20 $69.30 $92.40
Премиум-микс (DeepSeek Flash стандарт + Sonnet 2×/1.2×) ≈$28 (с batch ≈$15)

Масштабирование: 100-главная вебновелла ≈ 1/5 этих цифр, 2000-главная ≈ ×4. Англ. роман (B=0.14M) ≈ цифрам тома ранобэ 7%.

4.3 Эффект кэша и Batch (не учтён в таблицах — это запас)

  • Prompt caching. В нашем пайплайне бóльшая часть input — повторяющиеся глоссарий, системный промпт и контекст. При грамотной организации префикса 5070% input-токенов идут по cache-hit тарифу: у DeepSeek это $0.0028/MTok (в 50 раз дешевле), у Anthropic 0.1× (запись 1.25× для 5-мин TTL). Реальный input-счёт падает в 1.52.5 раза от табличного.
  • Batch API 50% (OpenAI, Anthropic, Gemini, Qwen): перевод книги — идеальная batch-нагрузка (латентность не критична, окно 24 ч). Дорогие проходы (Sonnet-финал, судья) обязаны идти батчем.
  • Совокупно табличные цифры — верхняя оценка; реалистичный COGS на 3060% ниже.

5. Сравнение с рынком

5.1 Человеческий перевод

Рынок Ставка За том ранобэ (≈7 а.л. / ~40k слов) За вебновеллу 500 гл. (≈60 а.л.)
РФ, издательства 3 00010 000 ₽/а.л. (типично 56 тыс. ₽; максимум ~9 тыс.) 2170 тыс. ₽ ≈ $260880 ~180600 тыс. ₽ ≈ $2.27.5k (гипотетически — издательства такое не заказывают)
РФ, «серый» сегмент/новички 5001 200 ₽/а.л. 3.58.5 тыс. ₽ ≈ $45105 3072 тыс. ₽
Запад, литперевод $0.080.20/слово (диапазон рынка $0.020.30) $3 2008 000 $30100k (не существует как заказ)
Запад, MTPE (постредактура) $0.050.15/слово (3050% от полного перевода) $2 0006 000

Источники: leon-shrugged (расценки издательств РФ), ru-translate, pishi.pro, Authors Guild survey, gtelocalize, docbabel.

5.2 AI-сервисы перевода книг

  • GlobeScribe (теперь часть Luman Technology): $100 за книгу за язык, срок 24 часа, плоский тариф без тиров (globescribe.ai/pricing, MultiLingual). Это главный публичный ценовой якорь.
  • Nuanxed (Стокгольм): B2B-модель «AI + человеческая постредактура», публичного прайса нет; ~50 переводов/мес, ~800 переводов выполнено; декларируют «экономию издателю при рыночной ставке переводчику» (Publishers Weekly). Оценочно их чек — тысячи $ за книгу (не проверено).
  • Booktranslator.ai / BookTranslate.ai и пр.: per-word AI-тарифы, порядок $0.0050.02/слово (не проверено детально).

5.3 Rulate (целевой сегмент ru-переводчиков вебновелл)

  • Читатель платит за главу в RC (внутренняя валюта, ≈1 ₽); типичная цена главы 310 ₽, подписочные пакеты со скидками (например, 50 глав по 0.8 RC) (tl.rulate.ru).
  • Доход переводчика крайне неравномерен: на непопулярных проектах — «меньше 5 ₽ за 1000 знаков» и сборы ~100 ₽; заработок появляется на тайтлах 500+ глав с ежедневными релизами (tl.rulate.ru/blog/45800). Т.е. типичный Rulate-переводчик — «просьюмер», который уже сейчас массово пользуется MTL+правкой и чувствителен к цене инструмента, но монетизирует сотни глав.

6. Прайсинг и маржа

6.1 Что выдержит рынок

Сегмент Модель прайсинга Ориентир цены Наш COGS Валовая маржа
Rulate-переводчики (RU) за главу, «эконом/стандарт» 210 ₽/глава ($0.0250.125) 0.20.4 ₽/глава (эконом-стандарт на DeepSeek/Qwen, ~$0.00250.005) 9096%
Rulate-переводчики, премиум-качество за главу, «премиум-микс» 1530 ₽/глава ~4.5 ₽/глава ($0.056) 7085%
Авторы/малые издатели (EN↔RU, selfpub) за книгу $25100/книга (под якорем GlobeScribe $100) $215 (премиум-микс с batch) 8595%
Профи-переводчики/студии подписка + квота $1540/мес (квота 3001500 глав эконом или 25 книг премиум) $220/мес на активного юзера ~5090% (зависит от утилизации квоты)

Разумная стартовая сетка: подписка $19/мес (≈1500 ₽) с квотой ~500 «стандарт»-глав + доплата за премиум-проход; разовая книга $49 (том ранобэ/роман, премиум-микс) / $99 (вебновелла до 500 глав, стандарт+выборочный премиум).

6.2 Когда проект окупается / ломается

  • При COGS премиум-микса $1528 за 500-главную книгу проект выдерживает демпинг до ~$50/книга с маржой >40%.
  • Порог поломки юнит-экономики: если COGS/глава превышает ~50% цены главы. Для цены 3 ₽/глава это COGS $0.019/глава — выполняется даже «стандартом» на DeepSeek с запасом 4×.
  • Рост цен API опасен только для дорогого сегмента: удвоение цен Anthropic поднимает премиум-микс вебновеллы с $28 до ~$54 — всё ещё под якорем $100, но маржа B2C-премиума падает с ~80% до ~60%.

6.3 Скрытые статьи себестоимости (не в модели, но помнить)

Ретраи/невалидные ответы (+515% токенов), построение глоссария на старте книги (~0.5×B одноразово), эксперименты/регенерация по требованию пользователя, эквайринг (35%), инфраструктура (при локальном бэкенде — незначительна). Закладывать буфер +25% к COGS.


7. Чувствительность: а если качество потребует 2× проходов дорогой моделью?

Сценарий: поверх стандартного пайплайна — два полных прохода Claude Sonnet (например, редактор+финал оба на Sonnet, 8×/4× по тарифам Sonnet):

Книга Премиум весь на Sonnet ×2 прохода Sonnet с Batch 50%
Том ранобэ $12.6 ~$25 ~$13
Вебновелла 500 гл. $92.4 ~$185 ~$92

Выводы:

  • Том ранобэ переживает даже полный Sonnet-максимализм: $25 против человеческих $260+ (РФ) — маржа сохраняется при цене от $49.
  • Вебновелла — нет: $185 > якоря GlobeScribe ($100) и > психологической цены сегмента. Значит, для больших вебновелл дорогая модель применима только адресно: финальный проход по выборке, «сложные» чанки по эвристике (диалоги, поэзия, низкий скор судьи), топ-главы.
  • Промежуточный рычаг: заменить Sonnet на Haiku 4.5 ($1/$5) или DeepSeek V4 Pro ($0.435/$0.87) в роли редактора — двойной проход Haiku по вебновелле стоит ~$62, V4 Pro — ~$15.
  • Промо Sonnet 5 ($2/$10 до 31.08.2026) временно снижает Sonnet-цифры на треть — можно использовать для калибровки качества, но не закладывать в долгосрочный прайс.

Выводы для TextMachine

  1. Юнит-экономика великолепная, ценовой риск — не в API. Себестоимость даже премиум-качества на 24 порядка ниже человеческих ставок; конкуренция будет по качеству и якорю $100/книга (GlobeScribe), а не по себестоимости.
  2. Базовый стек: DeepSeek V4 Flash / Qwen-Flash / GPT-5 nano для черновика и редактора; Sonnet (или Haiku/V4 Pro) — точечно. DeepSeek дополнительно выигрывает на zh-исходниках за счёт токенизатора и почти бесплатного cache-hit ($0.0028/MTok) — идеален для многократного перечитывания контекста.
  3. Архитектурно проектировать под кэш и батч с первого дня: стабильный префикс (системный промпт + глоссарий) для prompt caching; все несрочные проходы — через Batch API (50%). Это минус 3060% COGS без потери качества.
  4. Дорогая модель — по бюджету на книгу, а не по роли. Ввести «бюджет премиум-токенов» на книгу (например, ≤2×B input по дорогим тарифам) и тратить его по сигналу судьи. Полный двойной Sonnet-проход по 500-главной вебновелле ($185) ломает прайс.
  5. Прайсинг двухуровневый: (а) подписка для Rulate-сегмента (~$19/мес, квота глав, апселл премиум-прохода); (б) per-book $4999 для авторов/издателей — под якорем GlobeScribe при качестве выше (у них плоский AI-перевод без мультиагентности). Маржа 8095% валовой.
  6. Считать в токенах исходника (B) и калибровать на своих текстах: перед запуском прогнать count_tokens по реальным главам zh/ja/en и русским переводам на всех целевых токенизаторах — оценки «(не проверено)» по кириллице (~1.62 ток./слово) влияют на output-статью, самую дорогую у Gemini/GPT-mini.
  7. Мониторить цены ежеквартально: рынок дешёвых моделей падает в цене (DeepSeek V4 Pro получил 75%, Qwen-Max промо 50%); депрекация имён моделей (deepseek-chat → 24.07.2026) должна обрабатываться конфигом, а не кодом.

Источники