| backend | ||
| docs | ||
| eval | ||
| .gitignore | ||
| CLAUDE.md | ||
| START_PROMT.MD | ||
TextMachine — документация
Проект: бэкенд (позже — фронтенд-IDE) художественного перевода крупных текстов (книги, ранобэ, вебновеллы; zh/ja/en→ru) через мультиагентный пайплайн поверх LLM API. Стартовый бриф: ../START_PROMT.MD. Онбординг Claude-сессий: ../CLAUDE.md.
Ключевые цели:
- Максимальное художественное качество — победить «нехудожественность» AI-переводов.
- Низкая себестоимость: пайплайн из дешёвых моделей + редкие адресные вызовы дорогих.
- Банк памяти / глоссарий на всю книгу — консистентность имён, терминов, стиля.
- Обработка 18+ с учётом цензуры провайдеров (мультипровайдерность).
- Телеметрия токенов/стоимости/качества с первого дня.
Структура
architecture/— синтез. Источник истины по решениям —05-decisions-log.md(D1–D31); при конфликте с любым доком он выше.01-decisions.md— принципы Р1–Р10;02-mvp-plan.md— фазы и приёмка (v3, 09.07);03-implementation-notes.md— контракты Фазы 0;04-unhappy-paths.md— ~70 режимов отказа → механизм;06-memory-risk-registry.md— реестр рисков банка памяти;07-strategic-review.md— стратегический аудит (09.07): вердикт end-to-end, топ-риски, курс-коррекции;components.puml/pipeline.puml— диаграммы v3 (владелец смотрит PlantUML-расширением VS Code; вручную НЕ рендерить).
experiments/— эмпирика «Полигона»:00-provider-quirks(читать перед любым вызовом провайдера),01-token-calibration,02-refusal-benchmark,03-local-stand,04-editor-quality,06-local-extraction,07-coverage-precision,08-cost-model-v2(актуальная денежная модель),09-pilot-protocol(пилот Ф2.5 + поправки D13),10-explicit-benchmark(18+ violence-рука канала B),11-erotica-benchmark(erotica по трём парам/регистрам — закрытие D14.4, D22).research/— фактура исследований 04–05.07:01–10базовые,11-gap-*добор критиком,12-*режимы отказа/отзывы/таксономии (+ два внешних материала с провенанс-шапками),13валидация памяти,14адаптивная память,15голос и состояние (принят, D21),16ридер-IDE (принят с ревью-шапкой, D29),17внешняя критика GPT-5.6 (принят с ревью-шапкой, D25) — у 16/17 читать шапку прежде тела. ⚠ Часть под superseded-баннерами (01/02/03/04/05/09 и gap-1/2/5) — читай баннер прежде содержимого.PROGRESS.md— журнал (CURRENT-STATE сверху, ниже хронология; НЕ источник решений).- Активные хендофф-промты:
ORCHESTRATOR_SESSION_PROMPT.md(роль оркестратора) ·BACKEND_D152_SESSION_PROMPT.md(пакет D15.2: этап А промпты/санитайзер D30 — гейтит пере-прогон; Б реализация v3.1; В экспорт/override D29) ·POLYGON_EXP13_SESSION_PROMPT.md(exp13: бейк-офф переводчиков + сид v2 — приоритет №1 полигона, D30) ·POLYGON_PACKAGE4_SESSION_PROMPT.md(полигон №4: D22.8-остаток — второй приоритет) ·ACCEPTANCE_SESSION_PROMPT.md(приёмка Ф1: этап A ✅ D24; этап B ЗАМОРОЖЕН D26; следующий шаг — пере-прогон 25 глав кандидатом D30). Закрытые (пакеты №3–5, erotica, «Голос и состояние», GPT-восхождение → research/17, ридер-IDE → research/16, exp12 → D30) — вarchive/prompts/. archive/— закрытые сессионные промты (только история, инструкции оттуда не исполнять).
Статус (2026-07-12)
Фаза 0 ✅; Ф1-машинерия ✅ (пакеты №1–5 — D20–D28); приёмка этап A ✅ (D24), этап B заморожен (D26). exp12-диагностика принята (D30): «нечитаемо» = пассивный моно-редактор + сид + построчная вёрстка от промптов + нет санитайзера; дефекты смысла — в черновике. Ратифицированы: флип D1 (редактор БИЛИНГВ, supersede D17.в), reflow, output-санитайзер, глоссарий v2 (спорные — под подпись владельца), exp13 бейк-офф переводчиков. Очередь: бэкенд D15.2 (этап А гейтит пере-прогон) ∥ полигон exp13 → единый resnapshot → пере-прогон 25 глав кандидатом (re-gate верности обязателен) → чтение владельца → этап B. Трек: дешёвые модели сейчас, фронтир потом (конфиг-первая архитектура — D30.7). Решающая точка — пилот Ф2.5; блокеры — билингв-якорь/аннотаторы ≥3 (D25.9-Q1), корпус, проба судьи-дублёра 18+ (D22.6). Ключ xAI: единый, data-sharing, off перед продом (D27).
Доступные ключи от моделей
DEEPSEEK_API_KEY, ZAI_API_KEY, KIMI_API_KEY, OPENAI_API_KEY, GEMINI_API_KEY, XAI_API_KEY, MISTRAL_API_KEY