ذهن خوانی :
پاسخ به سوال شما:
تعداد تصاویر استخراج شده (515) بیشتر از تعداد اضافه شده (258) است، اما تعداد ارجاعهای تصویر در HTML هم 258 است. یعنی همه ارجاعهای تصویر پیدا و اضافه شدهاند.
علت تفاوت:
تصاویر بدون ارجاع: برخی تصاویر در فایل EPUB وجود دارند اما در محتوای HTML ارجاع داده نشدهاند (مثل تصاویر پشتیبان یا استفاده نشده).
تصاویر تکراری: تصاویر ممکن است با نامهای مختلف ذخیره شوند اما محتوای یکسان داشته باشند، بنابراین در دیکشنری استخراجشده تعداد بیشتری دارند.
ذخیرهسازی دوگانه: در کد، هر تصویر هم با نام کامل و هم با نام ساده ذخیره میشود، بنابراین اگر تصویری با نام images/pic.png ذخیره شود، هم با کلید images/pic.png و هم با کلید pic.png در دیکشنری قرار میگیرد.
بنابراین تفاوت طبیعی است و نشاندهنده این است که همه تصاویر مورد استفاده در کتاب اضافه شدهاند. 🎯
Post #233
1.48K
refhub یکی از بزرگ ترین و زمان بر ترین مشکلات Operation در رفهاب ، وقتی بود که مشتری کتابی رو میخرید که سورسش .epub بود، به مرور کشف کردیم که به نسخه های pdf شون در بازار دل نبندیم چون خیلی جاها صرفا برای مطالعه در موبایل تبدیل شده بودند و حتی شماره صفحه نداشتند،…