No description
Find a file
2026-07-11 23:29:52 +03:00
backend Land sanitizer fix D33.1: trailing gemini-leak now caught, false-positive broken-word class removed, minor narrowings, golden version-fold verified; re-run sanitizer blocker cleared 2026-07-11 15:41:38 +03:00
docs Fold exp14 batch-1 trap-judge corroboration: cross-family panel unanimously confirms the T1 comprehension catastrophe on all cheap arms and clears both frontier arms 2026-07-11 23:29:52 +03:00
eval Land exp14 batch-1: empirics show claim-1 paragraphs is a cheap prompt/pipeline lever while claim-2 within-chunk comprehension is a frontier-model-capability floor 2026-07-11 22:50:09 +03:00
.gitignore Ratify external-review verdicts for both packages, block D15.2 implementation pending spec rework, add fix-lists, multisession git rule, and key-file gitignore 2026-07-09 19:07:55 +03:00
CLAUDE.md Update orchestrator handoff to role №4 post-D35 pivot: quality-first roadmap (research→polygon→backend), immediate tasks incl reviewing research/18, bump contract range to D35 2026-07-11 20:38:02 +03:00
START_PROMT.MD Commit owner's V1-V3 brief additions and two externally sourced failure-mode notes with provenance headers pending origin confirmation 2026-07-09 16:16:11 +03:00

TextMachine — документация

Проект: бэкенд (позже — фронтенд-IDE) художественного перевода крупных текстов (книги, ранобэ, вебновеллы; zh/ja/en→ru) через мультиагентный пайплайн поверх LLM API. Стартовый бриф: ../START_PROMT.MD. Онбординг Claude-сессий: ../CLAUDE.md.

Ключевые цели:

  1. Максимальное художественное качество — победить «нехудожественность» AI-переводов.
  2. Низкая себестоимость: пайплайн из дешёвых моделей + редкие адресные вызовы дорогих.
  3. Банк памяти / глоссарий на всю книгу — консистентность имён, терминов, стиля.
  4. Обработка 18+ с учётом цензуры провайдеров (мультипровайдерность).
  5. Телеметрия токенов/стоимости/качества с первого дня.

Структура

  • architecture/ — синтез. Источник истины по решениям — 05-decisions-log.md (D1D35); при конфликте с любым доком он выше.
    • 01-decisions.md — принципы Р1Р10; 02-mvp-plan.md — фазы и приёмка (v3, 09.07); 03-implementation-notes.md — контракты Фазы 0; 04-unhappy-paths.md — ~70 режимов отказа → механизм; 06-memory-risk-registry.md — реестр рисков банка памяти; 07-strategic-review.md — стратегический аудит (09.07): вердикт end-to-end, топ-риски, курс-коррекции; components.puml/pipeline.puml — диаграммы v3 (владелец смотрит PlantUML-расширением VS Code; вручную НЕ рендерить).
  • experiments/ — эмпирика «Полигона»: 00-provider-quirks (читать перед любым вызовом провайдера), 01-token-calibration, 02-refusal-benchmark, 03-local-stand, 04-editor-quality, 06-local-extraction, 07-coverage-precision, 08-cost-model-v2 (актуальная денежная модель), 09-pilot-protocol (пилот Ф2.5 + поправки D13), 10-explicit-benchmark (18+ violence-рука канала B), 11-erotica-benchmark (erotica по трём парам/регистрам — закрытие D14.4, D22).
  • research/ — фактура исследований 0405.07: 0110 базовые, 11-gap-* добор критиком, 12-* режимы отказа/отзывы/таксономии (+ два внешних материала с провенанс-шапками), 13 валидация памяти, 14 адаптивная память, 15 голос и состояние (принят, D21), 16 ридер-IDE (принят с ревью-шапкой, D29), 17 внешняя критика GPT-5.6 (принят с ревью-шапкой, D25)у 16/17 читать шапку прежде тела. ⚠ Часть под superseded-баннерами (01/02/03/04/05/09 и gap-1/2/5) — читай баннер прежде содержимого.
  • PROGRESS.mdжурнал (CURRENT-STATE сверху, ниже хронология; НЕ источник решений).
  • Активные хендофф-промты (пивот D35→D36, очередь «мерить→строить»): ORCHESTRATOR_SESSION_PROMPT.md (роль оркестратора) · POLYGON_QUALITY_EMPIRICS_SESSION_PROMPT.md (СЛЕДУЮЩИЙ: эмпирика рычагов качества exp14 — нарезка×промпт + фронтир-диагностик + кривая нарезки, D36) · fidelity re-gate rerun/FIDELITY_REGATE_HANDOFF.md (полигон, параллельно, D34.3) · POLYGON_PACKAGE4_SESSION_PROMPT.md (ОТЛОЖЕН, пилот-residual: task-1 закрыт exp13/D32; открыты D22.6 судья-дублёр + D25.7 echo-кал + пилот-пре-рег + P4-хвост — НЕ для exp14, для пилота) · далее — бэкенд под доказанный ROI (стейдж Б/В D15.2 — СВЕЖИЙ промт после развязки; дизайн = спека v3.1). Закрытые в archive/prompts/ (D36.1): research/18-ресёрчер→D36, exp13→D32, санитайзер-фикс→D33.1, приёмка v2-пере-прогон (цикл ЗАКРЫТ D35), D152-этап-А→D33, пакеты №35, erotica, «Голос», r/17, r/16, exp12→D30.
  • archive/ — закрытые сессионные промты (только история, инструкции оттуда не исполнять).

Статус (2026-07-12, пост-пивот D35)

Фаза 0 ; Ф1-инфра (D20D28); приёмка этап A (D24). Путь D26→D35 «качество-первым»: флип D1 моно→БИЛИНГВ (D30), reflow + output-санитайзер (D30/D33), сид v2 подписан (D34), переводчик flash сохранён (exp13/D32). Пере-прогон 25 глав связкой выполнен; вердикт владельца: «лучше, но крайне слабо художественно» (2 претензии: абзацы/конвенции + понимание связей). ПИВОТ D35: цикл прогонов ЗАКРЫТ (инфра /читаемость = не провал; диагноз «Ф2-недострой + near-term промпт/нарезка-рычаги, не баг» верифицирован). Планка = 2 претензии (интерим). Очередь «мерить→строить»: ресёрч рычагов качества (research/18 Claude + ChatGPT — ждут ревью оркестратором) → полигон-эмпирика (нарезка×промпт + диагностик-фронтир-арм + fidelity re-gate) → бэкенд под доказанный ROI. Вопрос эмпирики: потолок в дешёвых моделях или в нашей нарезке/промпте. Трек: дешёвые сейчас, фронтир потом (D30.7). Решающая точка — пилот Ф2.5; блокеры — билингв-якорь/аннотаторы ≥3 (D25.9-Q1), корпус, судья-дублёр 18+ (D22.6). Ключ xAI: единый, data-sharing, off перед продом (D27).

Доступные ключи от моделей

DEEPSEEK_API_KEY, ZAI_API_KEY, KIMI_API_KEY, OPENAI_API_KEY, GEMINI_API_KEY, XAI_API_KEY, MISTRAL_API_KEY