29 KiB
09. Модель стоимости перевода книги через мультиагентный пайплайн и оценка маржи
⚠ SUPERSEDED (09.07.2026). Денежная модель заменена
../experiments/08-cost-model-v2.md(стек grok-редактора: ~$0.69/ранобэ, ~$10.94/вебновелла-500; редактор ≈ 90% стоимости). Пороги $0.6/$5/$30 и Sonnet-премиум-микс мертвы (D11); доктрина «caching-first» опровергнута на текущем стеке (кэш ≈ 2% стандарта — рычаг это цена редактора). Отсюда живы только методика и множители токенизации (уточнены exp01).
Дата: 2026-07-04. Все цены проверены по официальным страницам / актуальным агрегаторам на эту дату; отдельные пункты помечены «(не проверено)». Курс для пересчёта: ~80 ₽/$ (допущение, не проверено — уточнить на дату расчёта).
TL;DR
- Себестоимость API — копейки на фоне рынка. Том ранобэ (~150k токенов исходника) в сценарии «стандарт» стоит от $0.23 (Qwen-Flash / GPT-5 nano) до $9.5 (Claude Sonnet). 500-главная вебновелла (~1.1M токенов) — от $1.7 до $92 соответственно.
- Рекомендуемый «премиум-микс» (черновик+редактор на дешёвой модели, финальный проход Sonnet): ~$4/том ранобэ, ~$28/вебновелла 500 глав; с Batch API (−50%) — ~$2 и ~$15.
- Человеческий худ. перевод: РФ — 3 000–10 000 ₽/а.л. (том ранобэ ≈ 7 а.л. ≈ 21–70 тыс. ₽ ≈ $260–880); Запад — $0.08–0.20/слово ($8–20k за роман). Разрыв с себестоимостью API — 2–4 порядка.
- Ценовой якорь AI-конкурента: GlobeScribe — $100/книга/язык. Наш COGS премиум-микса ($4–28) оставляет под этим якорем маржу 70–96%.
- CJK-токенизация подтверждена как «дорогая»: китайский ≈ 0.65–0.75 токена/иероглиф (1.33–1.54 символа/токен у GPT-4o/DeepSeek), японский ≈ 0.7–1.5 токена/знак в зависимости от токенизатора и доли кандзи. Кириллица на выходе тоже дороже английского (~1.6–2 токена/слово).
- Prompt caching и Batch — главные рычаги COGS: DeepSeek cache-hit = $0.0028/MTok (повторное чтение контекста почти бесплатно), Anthropic cache-read ≈ 0.1× цены input, batch-скидка 50% у OpenAI/Anthropic/Gemini/Qwen. Вместе снижают модельные цифры таблиц ещё на 30–60%.
- Худший сценарий чувствительности (двойной проход Sonnet по всей книге) — ~$25/том, ~$185/вебновелла: вебновелла вылетает за якорь $100, поэтому дорогая модель должна работать только точечно (судья/финал/сложные места), а не сплошняком.
- Выдерживаемый рынком прайсинг: за главу 5–25 ₽ (сегмент Rulate-переводчиков), за том $25–100 (авторы/малые издатели), подписка $15–40/мес с квотой. Валовая маржа во всех разумных конфигурациях 80–95%.
1. Объёмы текстов в токенах
1.1 Токенизация: сколько стоит символ
| Язык | Символов/токен | Токенов на 1 символ/слово | Источник |
|---|---|---|---|
| Английский | ~4.75 симв./токен | ~1.3 токена/слово | замеры на GPT-4o (tonybaloney, arxiv 2604.14210) |
| Китайский (GPT-4o) | ~1.33 симв./токен | ~0.75 токена/иероглиф | arxiv 2604.14210 |
| Китайский (DeepSeek V3) | ~1.54 симв./токен | ~0.65 токена/иероглиф | llm-calculator benchmark |
| Японский | ~1–3 симв./токен (сильно зависит от доли кана/кандзи) | ~0.7–1.5 токена/знак; для смешанного текста ранобэ закладываем ~1.0–1.2 | tonybaloney CJK guide, promptcost |
| Русский (выход) | ~2.5–3 симв./токен | ~1.6–2 токена/слово (не проверено на конкретных токенизаторах — замерить на своих текстах через count_tokens) | оценка по общим данным о кириллице |
Вывод: тезис задачи «~1–1.5 токена/иероглиф» подтверждается: у современных токенизаторов китайский — 0.65–0.75 ток./иероглиф, японский — около 1 (хуже у старых токенизаторов, до 1.5). Важно: и вход (CJK), и выход (кириллица) токенизируются дороже английского, поэтому «1M токенов» наступает быстрее, чем интуитивно кажется по объёму текста.
1.2 Эталонные книги
| Книга | Объём оригинала | Токены исходника (B) | Токены перевода (RU) |
|---|---|---|---|
| Глава вебновеллы (zh) | 2–4k иероглифов (среднее 3k) | ~2.0–2.3k | ~2–2.5k |
| Вебновелла 500 глав (zh) | ~1.5M иероглифов | ~1.0–1.15M → берём 1.1M | ~1.0–1.3M |
| Вебновелла 2000 глав (zh) | ~6M иероглифов | ~4.4M | ~4.5–5M |
| Том ранобэ (ja) | 120–150k знаков | ~130–180k → берём 150k | ~110–150k |
| Англ. роман | 90–120k слов | ~120–160k → берём 140k | ~150–190k |
Для модели упрощаем: объём перевода в токенах ≈ объёму исходника (±20%), и вся арифметика ведётся от B (токены исходника).
2. Множитель пайплайна: сценарии
Каждый чанк проходит через несколько ролей; в каждый вызов инжектируется глоссарий, банк памяти и хвост предыдущего контекста. Итоговые множители относительно B:
| Сценарий | Состав | Input (×B) | Output (×B) |
|---|---|---|---|
| Эконом | переводчик (1 проход) + глоссарий-инъекции + скользящий контекст; редактор только на 10% выборке | 4× | 2× |
| Стандарт | переводчик + полный проход редактора + судья на выборке + глоссарий/контекст в каждом вызове | 6× | 3× |
| Премиум | переводчик + редактор + судья на каждом чанке + консультант поп-культуры/языковой аналитик по триггерам + повторное чтение контекста | 8× | 4× |
Обоснование input-множителя: чанк (1×) читается переводчиком с глоссарием+контекстом (≈2× на вызов), редактором (чанк+черновик+глоссарий ≈2.5×), судьёй (оригинал+2 варианта ≈2–3×). Output: черновик (1×), правка редактора (1×), вердикты/фиксы (0.5–2×). Это согласуется с эмпирическим диапазоном 4–8× input / 2–4× output.
Смешанный «премиум-микс» (рекомендуемая архитектура): черновик+редактура на дешёвой модели (множители «стандарта»), поверх — один финальный проход дорогой моделью (Claude Sonnet): +2×B input, +1.2×B output по тарифам дорогой модели. Судья-выборка и «трудные места» (диалоги, идиомы, стихи) — тоже на дорогой.
3. Актуальные цены API (июль 2026, $ за 1M токенов)
| Модель | Input | Output | Cache-hit input | Batch −50% | Источник |
|---|---|---|---|---|---|
| DeepSeek V4 Flash | $0.14 | $0.28 | $0.0028 | нет batch-API | api-docs.deepseek.com |
| DeepSeek V4 Pro | $0.435 | $0.87 | $0.003625 | нет | api-docs.deepseek.com |
| Gemini 2.5 Flash | $0.30 | $2.50 | ~0.25× input | да | ai.google.dev/gemini-api/docs/pricing, aicostcheck |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | — | да | pricepertoken (сверить с оф. страницей — вышли и более новые поколения Gemini 3.x) |
| GPT-5 mini | $0.25 | $2.00 | ~$0.025 (не проверено) | да | developers.openai.com/api/docs/pricing, pricepertoken |
| GPT-5 nano | $0.05 | $0.40 | — | да | pricepertoken |
| Claude Haiku 4.5 | $1.00 | $5.00 | 0.1× чтение / 1.25× запись | да | оф. данные Anthropic (кэш прайс-листа 2026-06) |
| Claude Sonnet (4.6 / Sonnet 5) | $3.00 | $15.00 (Sonnet 5 промо $2/$10 до 2026-08-31) | 0.1× / 1.25× | да | оф. данные Anthropic |
| Grok 4.1 Fast (xAI) | $0.20 | $0.50 | — | — | pricepertoken, aipricing.guru |
| Qwen-Flash (Alibaba, Singapore) | $0.05 | $0.40 | да (скидка на input) | да, −50% | alibabacloud.com model-pricing |
| Qwen-Plus | $0.40 | $1.20 | да | да | там же; Пекинский эндпоинт на 60–70% дешевле (eesel) |
Замечания:
deepseek-chatкак имя модели депрекировано с 24.07.2026 — использоватьdeepseek-v4-flash/-pro.- Для zh→ru у DeepSeek/Qwen дополнительный плюс: их токенизаторы эффективнее сжимают китайский (1.54 симв./токен против 1.33 у GPT-4o) — тот же текст на ~15% дешевле в токенах.
- Цензура: DeepSeek/Qwen жёстко фильтруют политический контент КНР, но заметно либеральнее к 18+; Gemini/OpenAI/Anthropic — наоборот. Для «жёсткого» контента резерв — Grok (слабые фильтры) и локальные модели (см. док. по цензуре).
4. Стоимость перевода: расчёты
Формула: C = B/1M × (M_in × P_in + M_out × P_out), где B — токены исходника, M — множители сценария, P — цены из §3.
4.1 Том ранобэ (B = 0.15M токенов)
Токены: эконом 0.6M in / 0.3M out; стандарт 0.9M / 0.45M; премиум 1.2M / 0.6M.
| Модель | Эконом | Стандарт | Премиум |
|---|---|---|---|
| DeepSeek V4 Flash | $0.17 | $0.25 | $0.34 |
| DeepSeek V4 Pro | $0.52 | $0.78 | $1.04 |
| Gemini 2.5 Flash-Lite | $0.18 | $0.27 | $0.36 |
| Gemini 2.5 Flash | $0.93 | $1.40 | $1.86 |
| GPT-5 nano | $0.15 | $0.23 | $0.30 |
| GPT-5 mini | $0.75 | $1.13 | $1.50 |
| Grok 4.1 Fast | $0.27 | $0.41 | $0.54 |
| Qwen-Flash | $0.15 | $0.23 | $0.30 |
| Qwen-Plus | $0.60 | $0.90 | $1.20 |
| Claude Haiku 4.5 | $2.10 | $3.15 | $4.20 |
| Claude Sonnet | $6.30 | $9.45 | $12.60 |
| Премиум-микс (DeepSeek Flash стандарт + Sonnet-проход 2×/1.2×) | — | — | ≈$3.9 (с batch у Anthropic ≈$2.1) |
4.2 Вебновелла 500 глав (B = 1.1M токенов)
Токены: эконом 4.4M in / 2.2M out; стандарт 6.6M / 3.3M; премиум 8.8M / 4.4M.
| Модель | Эконом | Стандарт | Премиум |
|---|---|---|---|
| DeepSeek V4 Flash | $1.23 | $1.85 | $2.46 |
| DeepSeek V4 Pro | $3.83 | $5.74 | $7.66 |
| Gemini 2.5 Flash-Lite | $1.32 | $1.98 | $2.64 |
| Gemini 2.5 Flash | $6.82 | $10.23 | $13.64 |
| GPT-5 nano | $1.10 | $1.65 | $2.20 |
| GPT-5 mini | $5.50 | $8.25 | $11.00 |
| Grok 4.1 Fast | $1.98 | $2.97 | $3.96 |
| Qwen-Flash | $1.10 | $1.65 | $2.20 |
| Qwen-Plus | $4.40 | $6.60 | $8.80 |
| Claude Haiku 4.5 | $15.40 | $23.10 | $30.80 |
| Claude Sonnet | $46.20 | $69.30 | $92.40 |
| Премиум-микс (DeepSeek Flash стандарт + Sonnet 2×/1.2×) | — | — | ≈$28 (с batch ≈$15) |
Масштабирование: 100-главная вебновелла ≈ 1/5 этих цифр, 2000-главная ≈ ×4. Англ. роман (B=0.14M) ≈ цифрам тома ранобэ −7%.
4.3 Эффект кэша и Batch (не учтён в таблицах — это запас)
- Prompt caching. В нашем пайплайне бóльшая часть input — повторяющиеся глоссарий, системный промпт и контекст. При грамотной организации префикса 50–70% input-токенов идут по cache-hit тарифу: у DeepSeek это $0.0028/MTok (в 50 раз дешевле), у Anthropic 0.1× (запись 1.25× для 5-мин TTL). Реальный input-счёт падает в 1.5–2.5 раза от табличного.
- Batch API −50% (OpenAI, Anthropic, Gemini, Qwen): перевод книги — идеальная batch-нагрузка (латентность не критична, окно 24 ч). Дорогие проходы (Sonnet-финал, судья) обязаны идти батчем.
- Совокупно табличные цифры — верхняя оценка; реалистичный COGS на 30–60% ниже.
5. Сравнение с рынком
5.1 Человеческий перевод
| Рынок | Ставка | За том ранобэ (≈7 а.л. / ~40k слов) | За вебновеллу 500 гл. (≈60 а.л.) |
|---|---|---|---|
| РФ, издательства | 3 000–10 000 ₽/а.л. (типично 5–6 тыс. ₽; максимум ~9 тыс.) | 21–70 тыс. ₽ ≈ $260–880 | ~180–600 тыс. ₽ ≈ $2.2–7.5k (гипотетически — издательства такое не заказывают) |
| РФ, «серый» сегмент/новички | 500–1 200 ₽/а.л. | 3.5–8.5 тыс. ₽ ≈ $45–105 | 30–72 тыс. ₽ |
| Запад, литперевод | $0.08–0.20/слово (диапазон рынка $0.02–0.30) | $3 200–8 000 | $30–100k (не существует как заказ) |
| Запад, MTPE (постредактура) | $0.05–0.15/слово (−30–50% от полного перевода) | $2 000–6 000 | — |
Источники: leon-shrugged (расценки издательств РФ), ru-translate, pishi.pro, Authors Guild survey, gtelocalize, docbabel.
5.2 AI-сервисы перевода книг
- GlobeScribe (теперь часть Luman Technology): $100 за книгу за язык, срок 24 часа, плоский тариф без тиров (globescribe.ai/pricing, MultiLingual). Это главный публичный ценовой якорь.
- Nuanxed (Стокгольм): B2B-модель «AI + человеческая постредактура», публичного прайса нет; ~50 переводов/мес, ~800 переводов выполнено; декларируют «экономию издателю при рыночной ставке переводчику» (Publishers Weekly). Оценочно их чек — тысячи $ за книгу (не проверено).
- Booktranslator.ai / BookTranslate.ai и пр.: per-word AI-тарифы, порядок $0.005–0.02/слово (не проверено детально).
5.3 Rulate (целевой сегмент ru-переводчиков вебновелл)
- Читатель платит за главу в RC (внутренняя валюта, ≈1 ₽); типичная цена главы 3–10 ₽, подписочные пакеты со скидками (например, 50 глав по 0.8 RC) (tl.rulate.ru).
- Доход переводчика крайне неравномерен: на непопулярных проектах — «меньше 5 ₽ за 1000 знаков» и сборы ~100 ₽; заработок появляется на тайтлах 500+ глав с ежедневными релизами (tl.rulate.ru/blog/45800). Т.е. типичный Rulate-переводчик — «просьюмер», который уже сейчас массово пользуется MTL+правкой и чувствителен к цене инструмента, но монетизирует сотни глав.
6. Прайсинг и маржа
6.1 Что выдержит рынок
| Сегмент | Модель прайсинга | Ориентир цены | Наш COGS | Валовая маржа |
|---|---|---|---|---|
| Rulate-переводчики (RU) | за главу, «эконом/стандарт» | 2–10 ₽/глава ($0.025–0.125) | 0.2–0.4 ₽/глава (эконом-стандарт на DeepSeek/Qwen, ~$0.0025–0.005) | 90–96% |
| Rulate-переводчики, премиум-качество | за главу, «премиум-микс» | 15–30 ₽/глава | ~4.5 ₽/глава ($0.056) | 70–85% |
| Авторы/малые издатели (EN↔RU, selfpub) | за книгу | $25–100/книга (под якорем GlobeScribe $100) | $2–15 (премиум-микс с batch) | 85–95% |
| Профи-переводчики/студии | подписка + квота | $15–40/мес (квота 300–1500 глав эконом или 2–5 книг премиум) | $2–20/мес на активного юзера | ~50–90% (зависит от утилизации квоты) |
Разумная стартовая сетка: подписка $19/мес (≈1500 ₽) с квотой ~500 «стандарт»-глав + доплата за премиум-проход; разовая книга $49 (том ранобэ/роман, премиум-микс) / $99 (вебновелла до 500 глав, стандарт+выборочный премиум).
6.2 Когда проект окупается / ломается
- При COGS премиум-микса $15–28 за 500-главную книгу проект выдерживает демпинг до ~$50/книга с маржой >40%.
- Порог поломки юнит-экономики: если COGS/глава превышает ~50% цены главы. Для цены 3 ₽/глава это COGS $0.019/глава — выполняется даже «стандартом» на DeepSeek с запасом 4×.
- Рост цен API опасен только для дорогого сегмента: удвоение цен Anthropic поднимает премиум-микс вебновеллы с $28 до ~$54 — всё ещё под якорем $100, но маржа B2C-премиума падает с ~80% до ~60%.
6.3 Скрытые статьи себестоимости (не в модели, но помнить)
Ретраи/невалидные ответы (+5–15% токенов), построение глоссария на старте книги (~0.5×B одноразово), эксперименты/регенерация по требованию пользователя, эквайринг (3–5%), инфраструктура (при локальном бэкенде — незначительна). Закладывать буфер +25% к COGS.
7. Чувствительность: а если качество потребует 2× проходов дорогой моделью?
Сценарий: поверх стандартного пайплайна — два полных прохода Claude Sonnet (например, редактор+финал оба на Sonnet, 8×/4× по тарифам Sonnet):
| Книга | Премиум весь на Sonnet | ×2 прохода Sonnet | с Batch −50% |
|---|---|---|---|
| Том ранобэ | $12.6 | ~$25 | ~$13 |
| Вебновелла 500 гл. | $92.4 | ~$185 | ~$92 |
Выводы:
- Том ранобэ переживает даже полный Sonnet-максимализм: $25 против человеческих $260+ (РФ) — маржа сохраняется при цене от $49.
- Вебновелла — нет: $185 > якоря GlobeScribe ($100) и > психологической цены сегмента. Значит, для больших вебновелл дорогая модель применима только адресно: финальный проход по выборке, «сложные» чанки по эвристике (диалоги, поэзия, низкий скор судьи), топ-главы.
- Промежуточный рычаг: заменить Sonnet на Haiku 4.5 ($1/$5) или DeepSeek V4 Pro ($0.435/$0.87) в роли редактора — двойной проход Haiku по вебновелле стоит ~$62, V4 Pro — ~$15.
- Промо Sonnet 5 ($2/$10 до 31.08.2026) временно снижает Sonnet-цифры на треть — можно использовать для калибровки качества, но не закладывать в долгосрочный прайс.
Выводы для TextMachine
- Юнит-экономика великолепная, ценовой риск — не в API. Себестоимость даже премиум-качества на 2–4 порядка ниже человеческих ставок; конкуренция будет по качеству и якорю $100/книга (GlobeScribe), а не по себестоимости.
- Базовый стек: DeepSeek V4 Flash / Qwen-Flash / GPT-5 nano для черновика и редактора; Sonnet (или Haiku/V4 Pro) — точечно. DeepSeek дополнительно выигрывает на zh-исходниках за счёт токенизатора и почти бесплатного cache-hit ($0.0028/MTok) — идеален для многократного перечитывания контекста.
- Архитектурно проектировать под кэш и батч с первого дня: стабильный префикс (системный промпт + глоссарий) для prompt caching; все несрочные проходы — через Batch API (−50%). Это минус 30–60% COGS без потери качества.
- Дорогая модель — по бюджету на книгу, а не по роли. Ввести «бюджет премиум-токенов» на книгу (например, ≤2×B input по дорогим тарифам) и тратить его по сигналу судьи. Полный двойной Sonnet-проход по 500-главной вебновелле ($185) ломает прайс.
- Прайсинг двухуровневый: (а) подписка для Rulate-сегмента (~$19/мес, квота глав, апселл премиум-прохода); (б) per-book $49–99 для авторов/издателей — под якорем GlobeScribe при качестве выше (у них плоский AI-перевод без мультиагентности). Маржа 80–95% валовой.
- Считать в токенах исходника (B) и калибровать на своих текстах: перед запуском прогнать count_tokens по реальным главам zh/ja/en и русским переводам на всех целевых токенизаторах — оценки «(не проверено)» по кириллице (~1.6–2 ток./слово) влияют на output-статью, самую дорогую у Gemini/GPT-mini.
- Мониторить цены ежеквартально: рынок дешёвых моделей падает в цене (DeepSeek V4 Pro получил −75%, Qwen-Max промо −50%); депрекация имён моделей (deepseek-chat → 24.07.2026) должна обрабатываться конфигом, а не кодом.
Источники
- DeepSeek pricing (офиц.): https://api-docs.deepseek.com/quick_start/pricing
- Gemini API pricing (офиц.): https://ai.google.dev/gemini-api/docs/pricing ; обзор: https://aicostcheck.com/blog/google-gemini-pricing-guide-2026
- OpenAI pricing (офиц.): https://developers.openai.com/api/docs/pricing ; GPT-5 mini/nano: https://pricepertoken.com/pricing-page/model/openai-gpt-5-mini , https://pricepertoken.com/pricing-page/model/openai-gpt-5-nano
- xAI Grok pricing: https://pricepertoken.com/pricing-page/model/xai-grok-4.1-fast , https://www.aipricing.guru/xai-pricing/
- Alibaba Qwen pricing (офиц.): https://www.alibabacloud.com/help/en/model-studio/model-pricing ; обзор: https://www.eesel.ai/blog/qwen-pricing
- Anthropic (Haiku 4.5 $1/$5, Sonnet $3/$15, batch −50%, cache 0.1×/1.25×): официальный прайс-лист Anthropic (platform.claude.com/docs/en/pricing), кэш от 2026-06.
- Токенизация CJK: https://arxiv.org/html/2604.14210v1 ; https://llm-calculator.com/blog/tokenization-performance-benchmark/ ; https://tonybaloney.github.io/posts/cjk-chinese-japanese-korean-llm-ai-best-practices.html ; https://promptcost.org/en/blog/llm-tokenization-explained/
- Ставки РФ: https://leon-shrugged.livejournal.com/338054.html ; https://ru-translate.livejournal.com/12754343.html ; https://pishi.pro/work/literary-editing/how-to-become-a-translator-of-fiction.html
- Ставки Запад: https://go.authorsguild.org/translator_contract_sections/4 ; https://gtelocalize.net/how-much-does-it-cost-to-translate-a-book/ ; https://docbabel.com/en/how-much-cost-translate-book/
- GlobeScribe: https://globescribe.ai/pricing-and-solutions ; https://multilingual.com/globescribe-book-translation-launch/ ; https://www.atanet.org/industry-news/ai-translation-service-launched-for-fiction-writers-and-publishers-prompts-dismay-among-translators/
- Nuanxed: https://www.publishersweekly.com/pw/by-topic/industry-news/publisher-news/article/96529-sweden-s-nuanxed-promises-fast-accurate-ai-book-translations.html ; https://janefriedman.com/ai-appears-likely-to-grow-the-market-for-translated-works/
- Rulate: https://tl.rulate.ru/blog/44275 ; https://tl.rulate.ru/blog/45800 ; https://tl.rulate.ru/blog/12673