How I Reversed Amazon's Kindle Web Obfuscation Because Their App Sucked
a day ago
- 作者从亚马逊购买了一本电子书,但发现Kindle安卓应用漏洞百出且容易崩溃。
- 他们发现亚马逊不再允许下载已购电子书用于其他阅读器。
- 受挫之下,他们逆向分析了亚马逊的网页混淆技术以提取书籍内容。
- 亚马逊的混淆机制包括每五页随机更换字形ID,导致映射不一致。
- 多种字体变体(粗体、斜体、粗斜体)和连字增加了混淆的复杂度。
- 由于单字符识别准确率低,OCR未能识别一半的字形。
- 成功的解决方案是将SVG渲染为图像,生成感知哈希,并通过SSIM与Bookerly字体进行字符匹配。
- 最终解码输出完美地将920页的书籍重构为无损EPUB格式并保留排版。
- 作者强调此举仅为备份合法购买的书籍,不应被用于盗版。