TGViewer
Сохранёнки программиста Сохранёнки программиста @prog_stuff · 6.52K subscribers
Post #3045 232
Как переводить целые книги с LLM и не терять контекст

Практический разбор Python-пайплайна для EPUB и PDF. Книгу делят по главам, затем на фрагменты по 2 000–4 000 токенов. В новый запрос обычно добавляют два последних абзаца только как контекст и словарь имён и терминов: так связность сохраняется без повторного перевода.

В разборе пайплайна есть код для подсчёта токенов и разбиения абзацев. Внутри главы запросы идут по очереди: следующий зависит от предыдущего. Параллельно обрабатывают разные книги. Для романа на 100 000 токенов авторы приводят ориентир: около 30 запросов и 4–6 минут.

Сохраните разбор, если работаете с длинными документами. Инженерный вывод: перекрытие фрагментов и отдельная память о терминах улучшают связность, но зависимые части придётся обрабатывать по очереди.
  • ❤‍🔥 1
More from @prog_stuff
  1. Oct 2, 2026Как ИИ меняет большие миграции: опыт Asana, Airbnb и Uber В обстоятельном разборе крупных…
  2. Oct 1, 2026Почему 118 зелёных тестов не спасли MQTT-брокер на Rust Обстоятельный инженерный разбор MQ…
  3. Sep 30, 2026Как запускать асинхронное GRPO без общей машины Обстоятельный разбор рабочей системы: трен…
  4. Sep 30, 2026Как исследовать легаси-код с ИИ до первого рефакторинга Гайд по «археологии» незнакомой си…
  5. Sep 29, 2026Как устроена криптография Ethereum-кошелька на Go Статья о цепочке «создать ключ, получить…
  6. Sep 29, 2026Как вынести тени в отдельные проходы Custom SRP в Unity Обстоятельное продолжение серии о…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →