TGViewer
Координация профанации Координация профанации @cynexp · 4.95K subscribers
Post #6887 1.14K
Но еще смешнее выглядела вторая рекомендация - "Если тебе нужно, загрузи файл еще раз"
Естественно, у меня возникло сомнение в целостности файла после повторной загрузки:
Ты утверждаешь:
"Если вам нужно, чтобы я поработал именно с оригинальным PDF (например, извлёк что-то ещё или пересобрал текст точнее) — проще всего загрузить файл в чат ещё раз; тогда он попадёт мне в рабочую папку как настоящий бинарник, а не только как повреждённая текстовая версия"
А где гарантия, что опять не случится создание поврежденной текстовой версии, как в первый раз?

Ничтоже сумняшеся ИИ выдал ответ:
Гарантии нет — это будет зависеть от того же самого конвертера на стороне платформы, а не от меня. Когда файл прикрепляется к чату, текстовая версия PDF генерируется автоматически, до того как я его вообще вижу; я не выбираю этот пайплайн и не могу его отключить или заменить на другой. Если у PDF та же проблема со шрифтом (нет корректной таблицы соответствия глифов → Unicode), конвертер с высокой вероятностью снова выдаст такую же «дырявую» кириллицу — это свойство конкретного файла, а не случайность.
Что при этом важно: в прошлый раз сломалась не сама передача файла мне, а то, что бинарник PDF вообще не попал в мою рабочую папку — я получил только испорченный .txt. Обычно вместе с текстовой версией должен приходить и сам файл as is, и тогда я мог бы просто читать его напрямую (в обход конвертера) или прогнать через собственный OCR. Так что нет гарантии, что текст не будет повреждён — но если оригинал реально долетит до меня как файл (а не только как авто-извлечённый текст), я смогу это обойти сам, не полагаясь на встроенный конвертер.
Честно говоря, у нас уже есть более надёжный путь для этого конкретного документа: вчера я вытащил точный текст библиографии прямо с исходной страницы на warlib.site через браузер — так я получил абсолютно надёжный, нечиповатый текст, без зависимости от конвертера вообще. Если нужно ещё что-то из этой диссертации (например, текст самих глав, а не только список литературы), проще и надёжнее сделать то же самое: я снова открою PDF на warlib.site постранично и прочитаю нужные фрагменты визуально — так результат гарантированно не будет испорчен. Так что вопрос в том, что конкретно вам нужно извлечь дальше — тогда решим, каким путём это делать.

Занавес! Зрители аплодируют, аплодируют... Кончили аплодировать
  • 😁 6
  • 🥰 5
  • 👏 3
  • 👍 1
  • 🥱 1
More from @cynexp
  1. Sep 25, 2026Рубрика "Циничные картинки" Ослик ИИ (Иа-Иа) оценивает ИИ-компетенции нового председателя…
  2. Sep 25, 2026Рубрика "ИИзация цинизма" Сегодня у меня в(на) канале праздник - "День Сидякина". Начав с…
  3. Sep 25, 2026Ну, собственно, вот. Я практически ничего не менял в ИИ-досье Сидякина - только вычеркнул…
  4. Sep 25, 2026Рубрика "ИИзация цинизма" Попросил ИИ собрать профессиональное досье на А.Сидякина - предп…
  5. Sep 23, 2026Рубрика "Циничные слухи" Из одного тут канала, делающего вид, что он осведомлен в инсайдах…
  6. Sep 22, 2026Я решил проверить, что же было не так в загруженном мною файле. Зашел во вчерашний чат, на…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →