Collapse economics to single direct-key EU-SaaS contour, drop BYOK/RU-law, finalize memory-validation session prompt
This commit is contained in:
parent
87b92ba696
commit
1985c16d23
5 changed files with 88 additions and 28 deletions
46
docs/MEMORY_RESEARCH_SESSION_PROMPT.md
Normal file
46
docs/MEMORY_RESEARCH_SESSION_PROMPT.md
Normal file
|
|
@ -0,0 +1,46 @@
|
|||
# Промт для сессии «Валидация банка памяти» (черновик от полигона)
|
||||
|
||||
Скопируй в новую сессию Claude Code, открытую в `/home/ubuntu/projects/textmachine`. Эта сессия — **исследование и валидация**, НЕ реализация: ни строки продуктового кода. Оркестратор финализирует онбординг и место для выходных документов до старта.
|
||||
|
||||
> _Статус: **финализирован оркестратором (04.07)** на базе черновика полигона. Готов к запуску владельцем._
|
||||
|
||||
---
|
||||
|
||||
Ты работаешь над проектом **TextMachine** — AI-перевод крупных художественных текстов (ранобэ/вебновеллы, zh/ja/en→ru) мультиагентным пайплайном на LLM API. Бэкенд — Go, EU-сервер, прямые ключи провайдеров (SaaS, без BYOK).
|
||||
|
||||
**Контекст (прочитай в этом порядке):**
|
||||
- `docs/README.md` — карта проекта; `docs/PROGRESS.md` — журнал (секции «Бэкенд», «Полигон», сообщения оркестратора).
|
||||
- `docs/architecture/01-decisions.md` — решение **Р3 «Банк памяти книги»** (это твой предмет) и Р7 (гейты качества).
|
||||
- `docs/architecture/05-decisions-log.md` — **D7 (скоуп схемы памяти v1)** и **D5.2** (критично: `snapshotID` обязан покрывать состояние памяти + сборку контекста, иначе изменённая память меняет request_hash, но не snapshotID → resume молча промахивается мимо чекпоинта и переоплачивает расходящимся переводом — валидируй этот инвариант как часть робастности).
|
||||
- `docs/research/05-memory-glossary.md` — исследовательская база банка памяти (выбор стека, разбор MemPalace, спека SillyTavern World Info, память DelTA, GalTransl).
|
||||
- `docs/architecture/04-unhappy-paths.md` — карта режимов отказа; разделы про консистентность (§1), род/пол (§2, поле gender=hidden), регистры (§3) — банк памяти обслуживает их.
|
||||
- `backend/internal/store/` — как банк памяти уже начал реализовываться (схема, миграции) — валидировать против реального кода, а не только доков.
|
||||
|
||||
**Координация (важно — читай перед стартом):** бэкенд-сессия параллельно строит Фазу 1, и её шаг «миграция памяти v2» (фиксация схемы store/глоссария) **держится до выхода твоего реестра рисков** — ты гейтишь этот шаг. Бэкенд тем временем идёт по runner-loop / snapshotID / чанкеру (шаги 1–3, от схемы памяти не зависят). Твой реестр — вход, по которому бэкенд фиксирует схему; не тяни бесконечно, но и не пропусти опасные сценарии. Синхронизация — через `docs/PROGRESS.md` (заведи секцию `## Память`).
|
||||
|
||||
**Твоя роль и мандат.** Банк памяти/глоссарий — **главная точка отказа пайплайна** (явное опасение владельца): серверные модели сильны, но если retrieval вернёт пусто или мусор — весь перевод деградирует тихо и опасно. Твоя задача — **адверсариально провалидировать подход до того, как он застынет в коде**: не поверить в него, а попытаться сломать, найти опасные функциональные и технические сценарии, и дать конкретные рекомендации.
|
||||
|
||||
**Метод.** Многоагентный ресёрч (как исходная фаза research/): фан-аут по направлениям + адверсариальная верификация находок + синтез. Источники — **научные и технические статьи, первоисточники, бенчмарки**; **не покупаться на вендор-маркетинг** (Mem0/Zep/Letta/MemPalace и т.п. — их заявленные метрики проверять независимо, как уже сделано с MemPalace в research/05). Веб + чтение кода; код продукта НЕ писать.
|
||||
|
||||
**Вопросы, на которые нужен ответ (приоритетно):**
|
||||
|
||||
1. **Робастность retrieval — центральный вопрос.** Что происходит, когда поиск по банку памяти возвращает пусто / мало / низко-уверенно / нерелевантно? Как это делают зрелые RAG/agent-memory системы (fallback, пороги уверенности, «лучше ничего, чем мусор»)? Спроектируй поведение пайплайна при пустом/слабом retrieval так, чтобы деградация была **явной и безопасной**, а не тихой.
|
||||
|
||||
2. **Адекватность стека под масштаб.** Выбор research/05: SQLite + FTS5 + sqlite-vec (в MVP — brute-force KNN без C-расширений), эмбеддинги bge-m3. Держит ли это вебновеллу в тысячи записей глоссария × сотни глав? Когда brute-force KNN ломается по латентности/качеству? Где порог перехода на настоящий векторный слой (pgvector/Qdrant/…)? Триггеры миграции — конкретно.
|
||||
|
||||
3. **Правильность самой задачи retrieval.** «Дан чанк → найди релевантные записи глоссария/резюме». Чистый dense-эмбеддинг — это оптимум, или нужен **гибрид** (BM25/FTS ключи + dense + reranker)? Спека предполагает ключи SillyTavern (лексические) + семантику + двуязычные резюме DelTA. Провалидируй гибрид против литературы по retrieval/reranking.
|
||||
|
||||
4. **Специфические для перевода режимы отказа** (сломай их): устаревшие записи; спойлер-окно (since_ch/until_ch); **противоречивые записи** (термин перевели двумя способами); разрешение алиасов; **ретрив не того смысла** (омонимы/полисемия имён — 阿Q, 送灶); дрейф «термин → утверждённый перевод» по ходу книги. Как каждый ломает перевод и чем защищаться (детерминированный слой vs LLM в горячем пути).
|
||||
|
||||
5. **Гарантия детерминизма реестра.** Трёхслойная защита GalTransl (pre-replace нормализация → мягкий глоссарий в промпте → post-check) — провалидируй против исследований constrained decoding / soft-following (WMT). Где грань «жёстко нельзя / мягко можно».
|
||||
|
||||
6. **Академическое заземление.** DelTA (Proper Noun Records + двуязычные резюме, заявленные +4.58 п.п. консистентности имён / +3.16 COMET) — воспроизводимо ли, на чём мерено, применимо ли к zh/ja→ru? Литература по document-level MT memory, RAG-failure, long-context consistency. Отдельно — свежие работы 2025–2026.
|
||||
|
||||
**Выход (пути финализированы оркестратором):**
|
||||
- `docs/research/13-memory-bank-validation.md` — вердикт: держит ли подход, что менять, с обоснованием и источниками.
|
||||
- `docs/architecture/06-memory-risk-registry.md` — **реестр рисков банка памяти** (таблица: сценарий отказа → вероятность/тяжесть → механизм защиты → детерминированный слой vs LLM → где в коде/схеме). Это единственный файл в `architecture/`, который тебе разрешено создать; он — вход для бэкенд-сессии перед фиксацией схемы store/глоссария Фазы 1.
|
||||
- Краткие итоги — в `docs/PROGRESS.md` секция `## Память` (1–2 строки на находку + ссылка); каждое расхождение с research/05 или Р3/Р7 — отдельным пингом оркестратору там же.
|
||||
|
||||
**Эмбеддинги (мандат этой сессии, вопросы 2–3).** Замер bge-m3 vs Qwen3-Embedding-0.6B vs LaBSE на задаче retrieval глоссария/резюме — за тобой. bge-m3 уже на локальном стенде (см. `docs/experiments/03-local-stand.md` и память проекта про стенд); скоординируйся с полигоном, чтобы не дублировать инфраструктуру. Эмпирические скрипты для этого — в `eval/` (это eval, не продуктовый код), результаты — в свой `research/13-*` + краткое в experiments, если полигон попросит.
|
||||
|
||||
**Правила.** Не редактируй `research/*` и `architecture/*`, КРОМЕ создания своих `research/13-memory-bank-validation.md` и `architecture/06-memory-risk-registry.md` — прочие расхождения оформляй пингами оркестратору в PROGRESS. Фиксируй версии/даты. **Продуктовый код (`backend/`) не пиши — только читай**; eval-скрипты в `eval/` для эмпирической проверки retrieval/эмбеддингов — можно. Маркетинговые метрики вендоров — проверять независимо (как с MemPalace).
|
||||
|
|
@ -227,6 +227,10 @@ keep-alive (Ф1–2), инъекция глоссария (`selective`), пор
|
|||
> 3. Следствие: grok-4.3 стал центральной моделью (редактор SFW + канал B + судья 18+) — гигиена аккаунтов xAI на три использования (Р4): промо/data-sharing только eval+NSFW, продакшн-редактор SFW — чистый аккаунт.
|
||||
> 4. ⚠ **DeepSeek-черновик «эхал» оригинал** на высоко-CJK фрагменте (эксп.04, 3/3) — тихий отказ = оригинал вместо перевода. CJK-гейт Фазы 1 обязан это ловить (уже в плане); плюс фолбэк-черновик как у полигона.
|
||||
|
||||
> **Ещё две вводные бэкенду (04.07):**
|
||||
> 5. **Схему памяти v2 (твой шаг 4) держи до реестра рисков от сессии «Валидация банка памяти».** Владелец выделил банк памяти (главная точка отказа пайплайна) в отдельную адверсариальную сессию (промт `docs/MEMORY_RESEARCH_SESSION_PROMPT.md`, финализирован); её выход — `architecture/06-memory-risk-registry.md` — вход, по которому ты фиксируешь схему store/глоссария. Шаги 1–3 (runner-loop / snapshotID / чанкер) от схемы памяти не зависят — иди по ним, шаг 4 гейтит валидация. snapshotID под память (D5.2) проектируй с запасом, но финальную схему полей не морозь.
|
||||
> 6. **Коррекция контура (владелец): EU-SaaS, прямые ключи, BYOK отменён** — в коде это НИЧЕГО не меняет (бэкенд всегда был на прямых ключах; BYOK был продуктовым концептом Р8/Р9, не кодом). Обновлены только Р5/Р8/Р9/Р10 в `01-decisions.md`. Дефолт редактора Фазы 1 — `grok-4.3` (эксп.04) — в `pipeline-c1.yaml` edit-стадию на него (xAI, thinking OFF, capability: temperature шлётся).
|
||||
|
||||
## Полигон
|
||||
(секция параллельной сессии — записи добавлять сюда)
|
||||
|
||||
|
|
@ -258,16 +262,17 @@ keep-alive (Ф1–2), инъекция глоссария (`selective`), пор
|
|||
|
||||
**Эксперимент 04 — РЕЗУЛЬТАТ (04.07):** слепую оценку сделали два фронтир-судьи (GPT + Opus 4.8), сверяясь с **каноническими переводами** (Фельдман/Рогов/Морозов), **сошлись независимо**. Ключ: A=grok-4.3, B=glm-4.6, C=gemini-3.1-pro, D=kimi-k2.6. Итог: стиль **gemini > grok > kimi > glm**; верность **grok > gemini > glm > kimi**; value **grok ≫ gemini > glm > kimi**. **Рекомендация дефолта редактора Фазы 1: `grok-4.3`** (лучший баланс качество/цена, надёжен по смыслу, ~13с/без reasoning), **премиум-эскалация `gemini-3.1-pro`** (лучшая проза, культурные узлы на уровне канона). **GLM-4.6 (текущее допущение Р4 «редактор=GLM») эмпирически слабейший — снять с дефолта; Kimi убрать (худший value: 11k reasoning/абзац, последний по верности).** → **оркестратору: правка Р4** (полигон архдоки не трогает). Полный разбор — [04-editor-quality.md](experiments/04-editor-quality.md).
|
||||
|
||||
**⚠️ КОРРЕКЦИЯ ВВОДНЫХ ОТ ВЛАДЕЛЬЦА (04.07) → ОРКЕСТРАТОРУ, фундаментально:** владелец **НЕ в РФ**; бэкенд на **EU-сервере**, все вызовы моделей идут оттуда; модель — **обычный SaaS с прямыми ключами** (владелец платит за токены, клиент платит за сервис). **BYOK НЕ делается — ни сейчас, ни в планах** (стопнуть в доках). Следствие: **весь «ru-контур / BYOK / агрегаторы» неверен** — Р5 «два контура чей ключ» схлопывается в один (прямые ключи), почти весь Р8 (152-ФЗ/259-ФЗ/ЮKassa/ИП) неприменим. Остаётся валидным ru как **язык перевода** (рынок ru-читателей), меняется только доставка. **Правки Р5/Р8/Р9 — на оркестраторе** (полигон архдоки не трогает). Полигон: проверку ru-агрегаторов из очереди **снял**.
|
||||
|
||||
### Следующие шаги полигона
|
||||
- [x] Эксперимент 04 (редактор) — оценён (grok-4.3 дефолт, gemini-3.1-pro премиум; GLM/Kimi не дефолт); правка Р4 на оркестраторе.
|
||||
- [x] Прогон refusal-бенчмарка (SFW/L1/L2-violence часть) — 66/66 ok, пороги в 02; explicit-часть ждёт фрагментов владельца.
|
||||
- [x] Эталон DeepSeek для сравнения черновиков — в 03.
|
||||
- [x] llama.cpp `--n-cpu-moe` для 30b-a3b — перемерено (потолок 13.5 tok/s, см. выше).
|
||||
- [ ] Прогон Qwen Model Studio (`data_inspection_failed`) и OpenRouter — при появлении ключей.
|
||||
- [ ] Проверка ru-агрегаторов: проброс cache-hit DeepSeek (два одинаковых запроса, сравнить usage) — разблокирует экономику ru-контура.
|
||||
- [ ] Довалидация калибровки на 3–5 главах реальных вебновелл (файлы владельца → `eval/data/samples/` + manifest).
|
||||
- [ ] Задача 4: протокол BWS + панель LLM-судей (LAIT/JP-TL-Bench), харнесс `eval/pilot/`.
|
||||
- [ ] Задача 5: bge-m3 vs Qwen3-Embedding-0.6B vs LaBSE на retrieval глоссария (bge-m3 скачан).
|
||||
- [x] Прогон refusal-бенчмарка (SFW/L1/L2-violence часть) — 66/66 ok, пороги в 02.
|
||||
- [x] Эталон DeepSeek + llama.cpp 30b-a3b (13.5 tok/s) — в 03.
|
||||
- [~] **explicit-часть refusal-бенчмарка** — владелец даёт фрагмент реальной вебновеллы («Мастер Гу», жёсткая сцена) → полигон заведёт в корпус и прогонит через провайдеров (кто откажет/вырежет/переведёт). Проверка ставки «Grok = NSFW-канал».
|
||||
- [x] ~~Проверка ru-агрегаторов~~ — **СНЯТА** (BYOK отменён владельцем, см. коррекцию выше).
|
||||
- [—] **Банк памяти (задача 5 + шире)** — по решению владельца выносится в **отдельную сессию «Валидация банка памяти»** (главная точка отказа пайплайна; не бросаться в код без разбора опасных сценариев). Полигон подготовил черновик промта → `docs/MEMORY_RESEARCH_SESSION_PROMPT.md`; **оркестратору вычитать/финализировать**, затем владелец запускает. Замер эмбеддингов (bge-m3 vs Qwen3-Embedding vs LaBSE) — часть мандата той сессии.
|
||||
- [ ] Довалидация токен-калибровки на 3–5 главах реальных вебновелл (файлы владельца).
|
||||
- [ ] Задача 4 (пилот выбора ядра, Фаза 2.5): протокол BWS + панель LLM-судей.
|
||||
|
||||
> **Задачи от оркестратора (04.07, из журнала решений [architecture/05-decisions-log.md](architecture/05-decisions-log.md)):**
|
||||
> 1. **Пересчитать премиум-бюджет** на Sonnet-free стеке: апекс — Gemini 3.1 Pro ($2/$12 ≤200k) с **обязательным thinking** (reasoning биллится как output $12/M — учесть, это класс недоучёта vojo 30–44%); batch −50% только на судью/QA, НЕ на inline-эскалацию (последовательна из-за STM); эскалированный чанк платит Gemini дважды (перевод+ре-джадж). Дефолты $5/$30 — заглушка до твоего пересчёта.
|
||||
|
|
|
|||
|
|
@ -22,3 +22,11 @@
|
|||
## Статус
|
||||
|
||||
См. [PROGRESS.md](PROGRESS.md). Исследовательская фаза завершена 04.07.2026; следующий шаг — Фаза 0 бэкенда (Go).
|
||||
|
||||
## Доступые ключи от моделей
|
||||
DEEPSEEK_API_KEY
|
||||
ZAI_API_KEY
|
||||
KIMI_API_KEY
|
||||
OPENAI_API_KEY
|
||||
GEMINI_API_KEY
|
||||
XAI_API_KEY
|
||||
|
|
|
|||
|
|
@ -65,17 +65,13 @@
|
|||
|
||||
Локальная GPU (8GB) — **«спецслужба», не переводчик** ([06](../research/06-local-models.md)): роли — NSFW-скрининг и перевод флагованных фрагментов (abliterated), эмбеддинги, экстракция кандидатов в глоссарий, дешёвый судья-гейт. Рантайм — llama-server (llama.cpp) как ещё один OpenAI-совместимый «провайдер» за фейловером из vojo; для качества — Qwen3.6-35B-A3B через MoE-офлоад (~25–30 tok/s).
|
||||
|
||||
## Р5. Экономика вызовов: два контура, caching-first, премиум-бюджет. **Принято (структура) / цифры — пересчитать на прототипе**
|
||||
## Р5. Экономика вызовов: один контур (прямые ключи, EU-SaaS), caching-first, премиум-бюджет. **Принято**
|
||||
|
||||
Из [09](../research/09-cost-model.md), [11-gap-1](../research/11-gap-1.md) + критика эконом-ревью:
|
||||
Из [09](../research/09-cost-model.md) + токен-калибровка [experiments/01](../experiments/01-token-calibration.md) + критика эконом-ревью.
|
||||
|
||||
**Экономика считается раздельно по контурам «чей ключ»** (главная правка v2 — цифры doc 09 валидны только для прямых ключей):
|
||||
> **КОРРЕКЦИЯ ВЛАДЕЛЬЦА (04.07, фундаментальная): один контур — прямые ключи.** Владелец **не в РФ**; бэкенд на **EU-сервере**, все вызовы моделей идут оттуда с прямыми ключами провайдеров; продукт — **обычный SaaS** (владелец платит за токены, клиент — за сервис). **BYOK не делается — ни сейчас, ни в планах.** Прежняя модель «три контура (прямые/RU-агрегаторы/BYOK)» **отменена**: аггрегаторская наценка ×2–6, неопределённость проброса cache/batch и вся RU-платёжная обвязка (Р8/Р9) — неприменимы. Валидным остаётся **ru как язык перевода** (рынок ru-читателей), меняется только доставка. Плюс: цифры токен-калибровки (exp01) и весь прайсинг doc 09 теперь **канонические без оговорок про контур**.
|
||||
|
||||
| Контур | Модели | Cache/Batch | COGS тома ранобэ |
|
||||
|---|---|---|---|
|
||||
| Прямые ключи (наш зарубежный контур, «позже»; DeepSeek/GLM/Kimi — доступны и из РФ) | весь стек Р4 | да / да | стандарт на DeepSeek ~$0.25–0.6; премиум-микс ~$4 (batch ~$2) |
|
||||
| RU-агрегаторы (ProxyAPI/VseGPT/AITunnel), наш ключ | дешёвые модели ×1.2–1.3; флагманы ×2–6 (западные премиум-модели через агрегатора ≈ съедают всю маржу per-book $99 — одна из причин удаления Anthropic из стека, Р4) | неизвестно — **эмпирически проверить** (задача полигона; скорее всего cache/batch не пробрасываются) | стандарт ~$0.3–0.8; премиум — только точечные вызовы |
|
||||
| BYOK (ключ пользователя) | что настроит пользователь | его тарифы | COGS токенов — не наш; мы продаём софт; в UI — оценка стоимости по тарифам его провайдера |
|
||||
COGS (прямые ключи, из [experiments/01](../experiments/01-token-calibration.md), стек без Sonnet): том ранобэ ja→ru стандарт ~$0.17, премиум-микс ~$3.1; 500-главная вебновелла zh→ru стандарт ~$2.6, премиум-микс ~$49 (batch на батчуемых стадиях ~$26). Маржа против рыночного прайсинга (Р9) — высокая; главный удар калибровки — по премиум-миксу вебновеллы (буфер под якорем $100 сжался ~вдвое), отсюда жёсткость правила «дорогая модель — адресно».
|
||||
|
||||
- **Prompt caching — главный рычаг**, и раскладка промпта фиксируется под него (разрешение конфликта Р3↔Р5 из ревью): **стабильный кэшируемый префикс** = системный промпт роли + book brief + style sheet + резюме книги/арок (меняется редко, раз в главу-арку); **волатильный хвост после кэш-брейкпоинта** = селективный глоссарий + STM + чанк. На стадии edit кэшу ловить почти нечего (уникальный черновик в промпте) — ожидаемый cache-hit считать по стадиям, а не «≥50% в среднем». Альтернатива для DeepSeek (cache-hit $0.0028/M): полный глоссарий в стабильном префиксе может оказаться дешевле селективной инъекции по miss-тарифу — решить расчётом на прототипе, обе схемы поддержать конфигом.
|
||||
- **Батчуемость — свойство стадии**: Analyst, Terminologist, судья/оценки, книжный QA — батчуемы (−50%); черновик и редактура чанков — последовательны (STM/резюме создают зависимость, DelTA-паттерн). «С batch ≈$2» относится только к батчуемым стадиям. Batch API — Фаза 2 (к судье), не Фаза 0.
|
||||
|
|
@ -99,26 +95,31 @@
|
|||
- Метрика глоссарной консистентности — с процедурой: знаменатель = вхождения `src`/алиасов в исходных чанках; числитель = наличие леммы `dst` (по полю `decl`) в соответствующем выводе; прономинализация («Ли Вэй → он») не штрафуется, гейт считает только `approved`-термины; в безлюдном режиме auto→approved автоматом с записью в журнал.
|
||||
- Оффлайн: паттерн routedecide/routereval из vojo → **golden-set реплей** решений об эскалации и вердиктов судьи со свипом порогов. Золотой набор — приватно из лицензионных изданий; GuoFeng Webnovel V2 — только dev (non-commercial, референсы MTPE-качества).
|
||||
|
||||
## Р8. Юридическая и продуктовая позиция. **Принято**
|
||||
## Р8. Юридическая и продуктовая позиция. **Принято (переориентировано на EU после коррекции контура)**
|
||||
|
||||
Из [08-legal.md](../research/08-legal.md), [11-gap-1](../research/11-gap-1.md):
|
||||
Из [08-legal.md](../research/08-legal.md) + коррекция контура (Р5: EU-SaaS, прямые ключи, без BYOK).
|
||||
|
||||
Остаётся валидным (юрисдикционно-нейтральное):
|
||||
- **Продаём инструмент, не переводы и не платформу** (Sony/Grokster/Cox; аналогия Trados/Photoshop). Никакого хостинга переведённого контента, UGC, встроенных парсеров пиратских библиотек и кнопок «опубликовать на агрегатор».
|
||||
- ToS: пользователь гарантирует права на тексты + логика «перевод ≠ генерация» (transformation exception). Жёсткий отказ — только CSAM-категория.
|
||||
- Фича **«журнал творческого вклада»** — доказательство human authorship (USCO/РФ) и аргумент «перевод принадлежит вам».
|
||||
- RU-сегмент: **BYOK-модель** (ключ агрегатора или прямой DeepSeek/GLM/Kimi); мы продаём подписку за софт в рублях (ИП/самозанятость + ЮKassa/СБП). **Не перепродавать** токены OpenAI/Anthropic/Google российским пользователям. Крипту в ru-контуре не рекламировать (259-ФЗ). Минимум ПДн, ru-БД в РФ (152-ФЗ).
|
||||
- 18+: риск концентрируется в **распространении** (Ficbook, ст. 242 УК, ЛГБТ-законы) — помогаем клиенту комплаенсом (маркировка, age-gate-метаданные), но не размещаем витрину.
|
||||
- ToS: пользователь гарантирует права на тексты + логика «перевод ≠ генерация» (transformation exception). Жёсткий отказ — только CSAM-категория. Перевод — производное произведение (Бернская конвенция, международно) → нарушение только при распространении, не при приватной обработке.
|
||||
- Фича **«журнал творческого вклада»** — доказательство human authorship (охрана постредактированного MT: USCO / EU «own intellectual creation»); аргумент «перевод принадлежит вам».
|
||||
|
||||
Изменилось (RU-право → EU-право):
|
||||
- **BYOK/RU-платежи отменены** (Р5): ИП/самозанятость, ЮKassa/СБП, 259-ФЗ (крипта), 152-ФЗ (локализация ru-БД), перепродажа токенов — **неприменимо** (бизнес — EU-SaaS, не российское юрлицо).
|
||||
- **Применяется GDPR** (EU-сервер/EU-сущность): минимизация ПДн (email/ID, без ФИО), DPA с провайдерами моделей, право на удаление, zero-retention-режим для конфиденциальных рукописей B2B (не гнать через data-sharing аккаунты — см. xAI-промо, Р4). **EU AI Act**: обязанности прозрачности/маркировки AI-выхода (ст. 50) в основном на GPAI-провайдерах, но маркировку AI-перевода заложить.
|
||||
- 18+: риск концентрируется в **распространении** (в целевом рынке — своя возрастная маркировка/законы; для ru-читательской аудитории риски распространения на стороне площадок, не инструмента) — помогаем клиенту комплаенсом (маркировка, age-gate-метаданные), но витрину не размещаем. Инструмент EU-based снижает прямую экспозицию к RU-специфике (ст. 242 УК и т.п. — на распространителе, не на нас).
|
||||
|
||||
## Р9. Прайсинг и сегменты. **Гипотеза до полевой валидации**
|
||||
|
||||
Из [01](../research/01-market.md), [11-gap-4](../research/11-gap-4.md), [11-gap-5](../research/11-gap-5.md) + правки эконом-ревью:
|
||||
|
||||
- Сегментация SAM честно: **fan-B2C $0,15–0,7 млн ARR**; вместе с per-book авторами (строка «не проверено») — $0,4–1,5 млн. Fan-B2C — **beachhead** (пользователи, данные, соцдоказательство), не основа выручки.
|
||||
- Тарифная сетка (в каждой строке помечено, чьи токены): metered 2–3 ₽/глава или 290–490 ₽/мес — **только эконом-конфигурация пайплайна, наши токены через дешёвый контур** (расхождение COGS/глава между doc 09 и gap-5 разрешить пересчётом на прототипе до фиксации цены); Pro 990–1490 ₽/мес — **BYOK** (иначе упираемся в закупку флагманов в ru-контуре); Studio $29–49 usage-based — BYOK/прямые ключи; per-book $49–99 — наши токены, контур прямых ключей.
|
||||
- **Модель монетизации — обычный SaaS** (Р5: наши прямые ключи, мы платим за токены, клиент — за сервис; BYOK отменён). Платёжные рельсы — стандартные для EU-сущности (Stripe/Paddle), валюта $/€. Тарифная сетка (все — наши токены, эконом-конфигурация пайплайна для метеред): metered ~$0.03–0.05/глава или подписка ~$5–7/мес (длинный хвост); Pro ~$12–19/мес (топ-переводчики); Studio $29–49 usage-based («ИИ-фабрики»); per-book $49–99 (авторы/малые издатели).
|
||||
- **Открытый GTM-вопрос**: как платят клиенты-физлица в РФ (RU-карты не проходят иностранный SaaS). Не блокер архитектуры (владелец подтвердил SaaS-модель) — вопрос доставки платежа для ru-in-Russia сегмента; целевой аудиторией могут быть ru-переводчики вне РФ / диаспора / B2B-площадки. Отметить, решить на GTM-этапе.
|
||||
- **Якоря с двух сторон**: сверху GlobeScribe $100/книга; **снизу booktranslator.ai $6,99–9,99 за 100k слов (≈$7–20 за роман, уже с ru-лендингом)**. Дельту оправдываем издательским качеством, отчётом, журналом вклада; в сетке предусмотреть дешёвый per-book «стандарт» ($15–25) как ответ на нижний якорь.
|
||||
- **Центр тяжести выручки MVP+1 — B2B/платформенные пилоты** (white-label для Rulate-класса площадок; валидированный путь по gap-5), а не per-book: сегмент авторов-самиздата тянет за собой ru→en, которого MVP не делает — per-book остаётся гипотезой со сроком валидации после пилота качества.
|
||||
- Под сегмент «ИИ-фабрик» (38 владельцев на 80 случайных онгоингов Rulate) в план MVP включён **режим онгоинга** (дозагрузка глав в проект с наследованием памяти) и ранний импорт бэк-каталога — без них Studio-тариф нечем обслуживать.
|
||||
- Последовательность: сначала пилот качества (Р2) → потом A/B прайсинга против якоря VseGPT (999 ₽/мес + токены).
|
||||
- Последовательность: сначала пилот качества (Р2) → потом A/B прайсинга против якоря VseGPT (999 ₽/мес + токены — прямой конкурент по функции, хоть и BYOK-модели).
|
||||
- Позиционирование — «инструмент переводчика/редактора» (модель Nuanxed), не «замена переводчиков» (PR-бэклэш GlobeScribe). Дифференциация — не «первый в ru» (ниша сырого MTL занята: Rulate AI-раздел 14,4 тыс. работ, MLate, VseGPT), а издательское качество + память серии + 18+.
|
||||
|
||||
## Р10. Главные риски (мониторить)
|
||||
|
|
@ -126,6 +127,6 @@
|
|||
1. **Судья — бутылочное горлышко**: ставка generate-then-select зависит от качества судьи (порог s* из arXiv:2603.20324); LLM-судьи расходятся с живыми читателями (LAIT; человеческая валидация режет LLM-judge win rates на 53–67%). Митигция: пилот Р2, пара судей, человеческий pairwise в golden-set.
|
||||
2. **Смена контент-политик провайдеров** (GLM-4.6→4.7, заморозка OpenAI adult mode): refusal-бенчмарк на каждую смену версии, мультипровайдерность by design.
|
||||
3. **Западные сервисы добавят ru-таргет** (booktranslator.ai уже имеет ru-лендинг и демпингует): окно — не первенство, а глубина (память серии, редакционная петля).
|
||||
4. **Платёжная/санкционная фрикция РФ**: BYOK снимает главное; двухконтурность (ru-юрлицо + позже зарубежная сущность для прямых ключей и en-сегмента).
|
||||
4. **Приём платежей от ru-in-Russia клиентов** (RU-карты не проходят EU-SaaS): открытый GTM-вопрос (Р9), не архитектурный — целевая аудитория может быть ru-переводчики вне РФ / диаспора / B2B; решить на GTM-этапе.
|
||||
5. **Волатильность цен API**: конфиг с датами, ежеквартальный пересмотр, буфер +25%.
|
||||
6. **Cache/batch-поведение агрегаторов неизвестно** — эмпирическая проверка в Фазе 0–1; до неё экономику ru-контура считать без кэша.
|
||||
6. **Концентрация ролей на xAI/Grok** (редактор + канал B + судья 18+): провайдер лёг → пауза/resume (D4); мониторить, при риске — держать валидированную замену редактора (gemini как премиум уже есть).
|
||||
|
|
|
|||
|
|
@ -96,6 +96,6 @@
|
|||
|
||||
## Экономические открытые пункты (полигону, гейтят достоверность бюджета)
|
||||
|
||||
- Пересчёт премиум-бюджета на Sonnet-free стеке с reasoning-as-output (D3.2).
|
||||
- Проброс cache-hit/batch RU-агрегаторами (уже в бэклоге полигона) — вся premium/cache-экономика посчитана для прямых ключей; в RU-контуре главный рычаг Р5 может испариться.
|
||||
- Пересчёт премиум-бюджета на Sonnet-free стеке с reasoning-as-output (D3.2), апекс Gemini 3.1 Pro (форсированный thinking).
|
||||
- ~~Проброс cache-hit/batch RU-агрегаторами~~ — **СНЯТО** (коррекция владельца 04.07: EU-SaaS, прямые ключи, BYOK отменён; см. Р5). Вся cache/batch-экономика теперь по прямым ключам без оговорок — это канон.
|
||||
- `budget_usd: 0` в `pipeline-c1.yaml` — заглушка; $-потолок владелец задаёт по ценовому намерению, дефолты $5/$30 держим до пересчёта.
|
||||
|
|
|
|||
Loading…
Add table
Reference in a new issue