textmachine/START_PROMT.MD
Claude (backend session) 9bb00d49f2 Initial commit: documentation, eval polygon, backend step 0 verdict
TextMachine project repository (AI translation of literary books).
Includes: v2 architecture decisions, MVP plan, research 01-12,
polygon experiments 01-03, backend-session revalidation verdict
(03-implementation-notes.md).

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
2026-07-04 06:50:59 +03:00

19 KiB
Raw Blame History

Стартуем новый проект. Идея у меня такая: реализовать бэкенд c фронтендом переводов крупных текстов, то есть книг (прицелюсь пока что в японские/китайские/английские ранобэ и вебновеллы), который будет ходить в ИИ апи для того чтобы переводить поп культурный текст.

Значит я хочу в целом анализ этого рынка отдельно, чтобы понять перспективы, мои идеи, возможность продать такой софт и нужен ли он вообще хоть кому-то и какой на него спрос.

Главная цель -- максимальное качество и решение проблемы "нехудожественности" ИИ-переводов, стоит подойти креативно к вопросу, возможно применить какие-то мльные математические подходы дообучения под конкретную книгу, интернет ресерча для перевеода конкретной книги, сосдених бэкендов которые будут выполнять какую то совсем другую работу и тп.

Набор немного разрозненных идей таков:

  1. построить пайплайн из разных агентов
  2. агенты будут выступать в разных ролях: судьи, переводчики, редакторы, консультанты поп культуры, писатели, языковые анализаторы и другие возможны роли если ты понимаешь в этом лучше меня
  3. построить пайплайн из дешевых агентов, чтоб перевод книги не превращался в дикую стоимость по цене
  4. так же именно бэкендово мне кажется возможным поднятие перевода до уровня хороших моделей из-за свежего исследования arXiv, март 2026 про мультиагентные пайплайны с судьей селектором
  5. возможно стоит провести исследование по цене/качестве апи разных операторов
  6. у меня есть локальная не самая мощная видеокарта с 8гб памяти и 32 гб рам, можно ради экономии запускать на ней какую-нибдь модельку, я уже поигрался с оллама, вроде она нормально отвечает, но можно и что то еще позапускать и поисследовать, сам у меня бэкенд будет пока локально работать пока мне поиграться просто
  7. подход к переводу огромных текстов, понятное дело что весь текст книги не загрузить в модель, так что тут придется при переводе создавать какой-то банк памяти для модели, или глоссарий перевода, вот тут неплохо было бы применить какую нибудь технологию или подход для экономии токенов и запоминании всего контекста книги
  8. этот глоссарий мне кажется и места для большего внимания и контрибьюта моделей
  9. сами текста могут быть агрессивными с точки зрения морали или перевода 18+, нужно учитывать цензуру моделей, например можно спрашивать локальную разцензуренную модель есть ли тут текст который модель не захочет переводить и надо решать что дальше с подобными ситуациями делать и как их обходить чтоб модели не бредили из-за своих настроек -- вот тут мне кажется будет сильный подход со стороны мультиагентности потому что у разных провайдеров и системные промты разные и они будут по-разному переводить одно и то же.
  10. как раз о незацензуренных качественных моделей -- мне видится тут решение от xAi
  11. переводить я в основом хочу с китайского и английского и русского и японского во все стороны, думаю это основные языки будут
  12. одна из целей высокая маржа при дешевых токенах, исследовать модели и их биллинг
  13. в целом исследовать подходы профессиональных переводчиков к сложным текстам, потому что как ты понимаешь при написании текста у автора часто есть видение в целом, поэтому тут надо промтить в модели так как будто весь текст уже прочитан или вообще оставлять рефернс книгу предыдущих частей
  14. про отдельные части хорошо бы отдельно подумать, потому что возможность загружать в бэкенд рефернс переводы или предыдущие части -- это сильно улучшит качество переводов, так как они будут держаться единого стиля, но тут количество текста растет конечно сильно
  15. отдельно меня интересует вопрос с подходом к художественному переводу и смыслам которые текстовые модели считывают бывают хуже чем люди, особенно дешевые модели, потому что именно дорогие модели обучены на большом разноборазии и могут считать больше смыслов чем слабая модель, возможно тут стоит вызывать какой-нибудь опус, но тк он дорогой не слишком часто это делать разумеется. И он кстати зацензуренный так что возможно стоит выбрать модель более подходящую
  16. возможно стоит прикрутить вебфетч в случаях когда модели не хватает культурного контекста чтоб понять о каком именно термине идет речь, но тут осторожно надо потому что у слов бывает крайне много значений
  17. нужно определится с языком бэкенда, я лучше всего знаю c++/userver, но другие технологии тоже можно взять вроде go/rust, так как скорее все реализовывать будешь ты, а мне не придется смотреть сам код
  18. думаю прежде чем кодить стоит нарисовать какую-то диаграмму на puml которую я мог бы посмотреть и мы по ней могли строить наш бэкенд
  19. в целом возможно стоит синкануться с интернетом, комьюнити чтобы узнать больше об этой индустрии, какие уже есть решения, какие у них проблемы, что не нравится людям и куда это все движется и что является фронтиром
  20. мне в целом помимо бэкенд технологии хочется еще и написать фронт к бэкенду который будет работать по принципу ide для агентного перевода, только понятное дело которые будут переводить огромные текста и взаимодействовать с бэкендом и юзером
  21. подробнее про фронт, хотя мне кажется сначала бэкенд займет у нас много времени, а потом уже фронт будем делать, но планы на фронт такие: иметь возможность одновременного чтения двух текстов которые будут размечаться от начала и конца растягивая друг друга по границам смыслов, тут надо как то заложить возможно такую функциональность, ну например как это выровнено будет выглядеть: hello my dear привет дорогой понятно о чем речь тут? тут разумеется текст может разъзжать, но это будущая функциональность, как ее реализовать мне не понятно, если это будет размечать нейросеть не забредит ли она? Или лучше размечать как то чанки что заливались в перевод
  22. так же я хотел бы задать с фронта настроики, типа это текст 18+ или нет, жанр фэнтези или сайфай, ну в общем что то такое что поможет моделям от человека
  23. так как фронт будет работь как ide вроде того же vs code и claude code в нем (это ты), то возможно тупо стоит перетянуть фишки, вроде загрузил на фронт книгу, агенты поехали ее разбирать, разобрали, потом задали вопрос на согласование глоссария (если фронтом будут пользоваться проффесиональные переводчики/редактора), возможно что то такое можно просто скопирвать с vs code/Cursor/Windsurf, тут принимаются свежие идеи
  24. фронт пока понятное дело реализовывать не будем, у нас бэкенд приоритет, но все эти фичи будут влиять и на бэк, поэтому какую то минимальную функциональность заложить стоит, но возможно первое MVP просто переводит фул книгу просто так
  25. нужен какой то учет токенов в бэкенде чтоб понимать стоимость, что отжирает и так далее, вообще тут телеметрия мне кажется будет очень важна, чтоб по ней можно было дебажиться, возможно бд какое то поднимать
  26. что касается технологии для выбора фронта -- тут я не знаю, мне кажется работать это все будет на нативной платформе, то есть целевое это windows, но наверное и веб не помешает, думаешь тут электрон? Хотя он дорогой по ресурсам и тп, вобщем хз
  27. возможно стоит провести какое то исследование апи операторов моделей, собрать golden set, протестировать их с разной стороны, у меня уже есть несколько апи кеев, думаю тут стоит идти со стороны бэкенда в общие какие-то решение, но наверное написать адаптеры для дерганья разных моделей будет довольно просто, вот я уже подобный бэкенд писал для чат бота в мессенджере, можешь посмотреть код /home/ubuntu/projects/vojo/apps/ai-bot
  28. так как индустрия бешенно несется вперед возможно стоит пройтись по последним научным исследованиям и гипотезам от топовых (ну или просто компетентных вузов всего мира), возможно они придумали технологию или гипотезы которые еще никто не реализовал, но они интересны и вероятно выстрелят
  29. вероятно стоит еще оценить юридический аспект подобного софта и распространение подобных переводов
  30. неплохо было бы приценить сколько будет стоит перевод 1 такой книги
  31. как то неплохо было бы измерять онлайн и оффлайн качество, опять же я говорил про телеметрию которую можно собирать при переводе, но пока не понимаю какую
  32. что касается тулзов, а агентного бэкенда мне кажется должны быть свои тулзы, чисто переводческие тулзы, какие я не очень пока знаю и понимаю, но возможно какие то могут быть
  33. я тебе уже говорил что для качественного перевода надо знать контекст вперед и назад, так что тут возможно стоит проектировать агентов так чтобы они действовали как профессиональные переводчики, сначала все читали, потом брались за перевод, но я тебе об этом уже писал
  34. запросы к моделям, так как через апи можно передавать температуру и прочие параметры, надо понять каким образом и качеством это вообще влияет на переводы текстов
  35. помимо исследования чисто технического мультагентных систем и ии, возможно стоит обратится к исследованием чисто филологическим, переводческим и возможно более старым решениям, возможно где то в истории уже есть предложения людьми из разряда все новое хорошо забытое старое, тут важно проявить смекалку и творческий подход под задачу, возможно нестандартные решения, возможно даже костыльные которые будет пораждать сам фронт
  36. я за переиспользуемые решения, по тому же решению банка памяти или глоссария использовать что то готовое или перетянуть готовое решение вроде MemPalace или его форкнуть, допилить, оценить
  37. тебе доступны вообще все тулзы на этом компьютере: вебфетч, gh, просмотр репозиториев, клонирование в /tmp и так далее, делай что захочешь чтоб достигнуть цели

Мысли получились довольно сумбурные, плюс я накидывал по мере вдохновения, возможно я где-то мог ошибиться, можешь меня поправлять. В целом я тебя нигде и ни в чем не ограничиваю, полная творческая свобода с учетом задачи, выслушаю предложения, гипотезы, твои сомнения и критику, можешь сам дополнить перечисленные пункты, перефразировать их, синтезировать и придумать свои, так же я думаю стоит выделать некоторые пункты жирным курсивом и уделить им максимум внимания, потому что какие-то из них будут определять или могут неожиданным образом определить качество таких переводов. Сам промт у меня получился довольно большой и очень много задач, которые возможно будут решаться аж несколькими сессиями воркфлоу, которые я могу в принципе запустить и отдельно в отдельных окнах vs code. Ты на данный момент центральный судья с которого вообще весь проект стартует как гипотеза. Думаю по мере исследований стоит завести в проекте отдельную папку где будет сохранятся какой-то прогресс аля документация, возможно первое форкфлоу стоит отдать приоритетным пунктам MVP а по ходу мне ты можешь выдать промт где я в другом окне стартану другую сессию которая будет в эти же доки параллельно контрибьютить или последовательно можем передать эти дела, в общем как тебе удобно чтоб не забивать контекст так как он у тебя ограничен. Но в целом у нас тут стартует для начала такая MVP-сессия прицел в подобное приложение и перспективы его продажи на рынки ru/en переводчиков, копирайтеров и редакторов.