Record the owner's V4 idea set in START_PROMT: parallelism/speed as the main V4 idea, glossary construction, and the per-language and prompt-language questions

This commit is contained in:
Claude (backend session) 2026-07-13 01:51:02 +03:00
parent d42d01e75a
commit e9b801ff5f

View file

@ -81,3 +81,10 @@ hello my dear
2) художественность и смыслы, понятное дело что оценить художественность довольно трудно, но неполноценность ИИ-переводов обосновать можно: у ИИ просто напросто нет всего контекста, модели не могут додумать то чего не знаю или попытаться понять, иногда написанное в книге лежит за пределами самой книги и модель не может сложить воедино паззл, так вот помимо валидатора пайплайна который вызывается редко чтоб оценить перевод, возможно стоит так же редко вызывать модель на крайне узком специализированном участке перевода который и будет решать 1 раз за книгу эту диллему. но это лишь предложение и примеры, всегда к ним можно критически отнестись или предложить что то другое более эффективное
Возможно две перечисленные основные задачи стоит поставить eval сессии чтоб она точками выдернула механизмы пайплайна и верифицировала их и оценила влияние, так же нужно чтоб валидировалось не только положительное но и пагубное влияние каких то решений.
Идеи проекта V4, 12.07.2026
1) Как сейчас происходит работа бэкенда над главами? Она идет просто параллельно по главам? Как это работает в архитектуре? Можем ли мы значительно ускорить перевод, сначала нарезав книгу как нам нужно (чанки, главы, неважно что это будет), потом всю эту пачку параллельно запулить в модели и получить книгу в N раз быстрее? Но это наверное на конец по фазам можно ставить так как это такие, полировочные работы. Да и вообще хороший вопрос, как ускорить перевод книг значительно? Считаю это главной идеей V4
2) Считаю что идея со встраиванием в пайплайн фронтир модели -- бессмысленна. Она нам в принципе ничего не дает такого интересного
3) Проход книг наперед тоже считаю идеей изначальной не очень удачливой. Что именно и как нам это может дать? Это вообще полезно потенциально? Бустанет перевод хоть как то? Или это оверкилл непонятный и лучше пока сосредоточиться на другом?
4) Как мы будем собирать глоссарий? Я так понимаю переводом терминов будет заниматься сама модель, и я считаю глоссарий крайне важным, нужно исследовать как делать запросы для перевода в глоссарий, нужно записывать контекст в котором эти слова чаще всего встречаются, плюс передавать жанр книги наверное. И самое важно некоторые запросы перевода в глоссарий мне кажется надо юзать модель с вебфетчем, например гемини лайт с вебфетчем или любую другую
5) Так же задача на будущее для полигона, сейчас все переводы идут с какого-то языка на русский, но в целом глупо делать бэкенд только под русский. Например промт запросы сейчас идут на русском в модели. Скорее всего надо делать запросы на языке на который мы переводим. Но это вообще не точно. Может нужно писать на яызке оригинала? В любом случае мне кажется в переводе с китайского на анлийский -- русский вообще не должен учавствовать чтоб не сбивать модель с вероятностного прогона