Разработчик под псевдонимом sukamenev опубликовал на GitHub проект BookTrans — конвейер с открытым исходным кодом, который переводит книги целиком с помощью платных подписок на LLM. Инструмент поддерживает три агента: Claude Code, Antigravity CLI и Codex. Установка возможна через git clone или pipx install booktrans, а запуск — через обертки bt_agy, bt_claude, bt_codex, которые загружают предварительно сконфигурированные профили.
Поводом для создания конвейера стала личная потребность автора: он прочитал первые две книги Сью Берк из научно-фантастического цикла «Семиозис» и захотел прочесть третью часть — «Узурпацию», которая не была переведена на русский. Аналогичная ситуация была с романом Поля Мелкоу «Singularity’s Ring». Попытки переводить книги вручную через веб-версии LLM, например, фотографируя страницы и загружая их в Gemini, оказались крайне медленными и неэффективными: модели пропускают абзацы при больших объемах текста, а терминология разъезжается.
| Слой | Что получает модель |
|---|---|
| Мир и стиль | справочник персонажей, реалий, голосов и обязательных переводов терминов |
| Сюжет | накопительный конспект всех предыдущих событий, который периодически сжимается |
| Стык | последние два-три абзаца уже переведённого текста |
| Взгляд вперёд | начало следующего фрагмента в оригинале, чтобы не оборвать мысль |
| Работа | текущий фрагмент |
Архитектура BookTrans решает эти проблемы. Конвейер использует две модели: самую сильную у данного агента для интеллектуальной работы и вторую по силе для технической. Перед переводом выполняются дешевые проверки: определение преобладающего языка по абзацам, проверка кодировки и достаточности текста. Затем собирается список тегов и стилей, а недорогая модель определяет, каким тегам и классам соответствуют заголовки, проза, цитаты. Это необходимо, потому что универсальный парсер epub создать нельзя: один и тот же класс в разных издательствах может означать разные вещи.
Поддерживаются Claude Code, Antigravity CLI и Codex; установка через git clone или pipx install booktrans.
Основная работа разбита на три этапа. Первый — разведка: модель просматривает всю книгу, составляет описание мира, персонажей и реалий, формирует единый глоссарий и справочник. Для персонажей фиксируются возраст, род, отношения, формы обращения и особенности речи. Если герой меняется по ходу сюжета, справочник хранит оба состояния и главу, где произошла перемена. Каждому сложному слову или имени назначается единственный вариант перевода, который затем попадает в каждый запрос.
Второй этап — последовательный перевод. Автор подчеркивает, что нельзя переводить главы параллельно: сюжет развивается линейно, и модель должна «находиться на месте читателя». Перед каждой следующей главой конвейер передает модели пересказ предыдущих, а когда конспект разрастается, отдельный проход его сжимает. Третий этап — слепая литературная редактура: редактор не видит оригинал на английском, что снижает риск сохранения калек. В контекст редактора попадает русскоязычное описание мира и уже переведенные главы. Черновик остается нетронутым, все правки можно просмотреть перед сборкой.
BookTrans — пример того, как LLM можно использовать для трудоемких задач, требующих консистентности и контекста. Подобные конвейеры могут быть полезны не только для перевода книг, но и для других длинных текстов, где важна единая терминология. Однако стоит учитывать, что проект ориентирован на платные подписки, что может ограничить его доступность. Тем не менее, открытый исходный код позволяет адаптировать конвейер под свои нужды.

