阅读导出电子书的各种方法以及阅读导出的.epub文件的内部结构

8 我的世界肝帝玩家 1天前 109次点击

众所周知,月读还是挺好用的

无障碍好,耗电低,自定义还非常的完善

所以说导出数据有很多种方法

第1种方法,直接在阅读软件内操作

首先打开阅读,然后到阅读的书架界面

然后再点右上角更多,里面再点缓存/导出

点进去,里面就有书籍列表了,列表中会显示该书籍的下载进度

然后每一本书都自带一个开始按钮和导出按钮

开始按钮是下载的,导出按钮就是把下载好的东西导出

是下载了多少就导出多少,所以如果一本小说没有下载完,可以点一下开始按钮,将它下载完整,再导出

然后右上角更多里面可以调一些参数配置啊啥的

里面有两种导出格式可以选

txt,epub

配置都调好之后就可以点导出了,然后就到了选择文件存放位置的地方了,选好也就导出完成了

用这种导出文件的方法导出来的,也就是一本书就是一个文件,

好了,那现在上第2种方法,手动导出

还是打开阅读,在书架这个界面

找到要导出的书或小说,要确认他已经下载完毕,缓存完毕

确认好之后,打开第三方文件管理器

访问以下目录

/storage/emulated/0/Android/data/io.legado.app.release/files/book_cache

访问之后就会看到里面有一堆文件夹,文件夹的名称都是以书籍名称来命名的,如果小说书名太长,后面会被省略掉一部分

找到要下载的小说对应的文件夹

点进去之后就会发现有一堆.nb的文件,这些文件都能当.txt用的,改个后缀就行

00456-841fd52b4ffcbf7c.nb

00455-53116631f403b0c7.nb

00454-6ba43e536b3396b6.nb

看文件名都能看得出来,最前面的数字就代表的对应的章节

我正在使用的版本3.25,我这里的文件命名规则是这样的,00000是第1张,00001是第2张,就这样循环下去了,其他版本就不太清楚了

所以用第2种方法导出,那么每一张就是一个独立的文件了

所以恭喜你可能学会了两种导出方法

然后还有一种方法,也能实现每一张就是一个文件

首先还是用第1种方法导出,但是导出的文件不是.txt,而是.epub

导出好之后也是正常的得到了一个.epub文件

然后拿这个文件重命名,直接在文件名称的最后面加上.zip

然后这个文件就变成了一个压缩包,我们可以直接点击它打开,你会发现它可以正常打开。里面有着文件以及文件夹

文件夹有这几个

OEBPS,META-INF

文件有一个叫做mimetype

这个mimetype文件里面写的东西都是一样的,用于说明这个文件是干嘛的,里面写的内容也就是application/epub+zip

现在讲OEBPS文件夹

点进去就会发现里面还有一堆文件夹

先讲第1个文件夹,也就是Text

点进去你会发现里面放了一大堆的.html网页文件

chapter_2.html

chapter_1.html

chapter_0.html

没错,这些文件就是书籍

文件名后面的数字就对应的章节,命名规则还是跟上次一样的,0里面的内容是第1章,1里面的内容是第2章,2里面的内容是第3章

然后除了章节的.html文件以外,还有两个文件,分别是

intro.html,cover.html

先讲第1个,也就是intro.html

里面塞的是这本书的书名和简介

然后这个cover.html文件

里面塞的是这本书的封面页面,以及一些调用文件的代码

那么这个文件夹里面的东西都看完了,我们看第2个,也就是Styles文件夹

里面塞了两个文件,这些文件分别是

第1个main.css

看文件名都能看得出来,里面是写css样式的

然后第2个fonts.css

这个也是css样式,太复杂了,不讲先

这个文件夹里面就这两个文件也讲完了,再讲下一个文件夹,也就是Images文件夹

这里面放了图片,上面讲过的那个封面.html文件,调用的就是这里的图片

然后OEBPS文件夹里面除了那三个文件夹以外,还有两个文件

分别是第1个,也就是toc.ncx

这里面放了一些代码,这些代码告诉了文档加载器,在加载文档的时候,如何加载那一堆.html章节的顺序。所以这里面的代码也就是目录

第2个文件也就是content.opf

这里面也是一些代码,类似于目录的这一种的

那么现在OEBPS文件夹里面的内容也讲完了,现在讲另外一个文件夹,也就是META-INF

这里面只有一个文件,也就是container.xml

这个文件告诉了加载器,这个电子书里面的结构是什么样的?目录都有什么

好了那么现在也讲完了

那么恭喜你又学会了一种提取的方法,成功的了解到了.epub文件的内部结构

然后很多文档都是差不多的结构的,底层还是压缩包,所以你可以把后缀改成.zip,改好了之后呢,你就可以提取里面的内容了

OK,未完待续

共 7 条评论
火华 1天前
一点毛病也没有啊。
可以,可以。
这个不错 本楼来自:智慧人生
老葫芦 1天前

其实就第1种最方便!第3种也能用,只是麻烦点,可以转换一下!第2种是最鸡肋的,有了第1种,干嘛去弄那个第2种?!我都是用第1种!问题,现在阅读很多都是防盗章节,就一个标题。这正文就几句话。甚至只有半张,后半张是其他的东西!他专门后半章也不知道哪儿弄来的小说,其中一个章节的一半加进去的!每个章节都是那一段,有一次看了一下,还挺好看,后面去找那本小说叫啥,愣是没找出来

君莫言 1天前
总感觉用阅读导出的epub格式,特别是那种套装书。不能智能分卷,感觉很别扭。比如说,我现在有一套书,一共八册,用阅读导出来的epub格式。它是从第一册的第一章,然后依次到第八册的最后一章,这么顺序排,也就跟TXT没什么区别。可是,同样的一本书,在番茄小说上,人家那个目录就是可以分成第一册是什么,第二册是什么,人家可以智能分卷。可以想看哪册看哪册。当然,我也有好久没用过那玩意了,不知道现在的阅读导出来的书,还是不是那样。但是番茄小说也有缺点,估计是那些epub格式电子书的制作上传的问题。有些个别的套装,它的排列次序会乱。比如那个摸金传奇共五册的那一个,正常情况下应该是圣泉寻踪排在第一,可是他那个就不是。他那个是把腐仙毒骨排在第一,本来正常情况下腐仙毒骨应该是排在第二的。除了这种少部分的。绝大多数都是排列正确的。

感谢楼主分享。这很有用。。涨知识了。以前还真不知道还能导出epub.

这个功能也不是很难找啊,阅读也就这么大,翻一翻都知道大概是干嘛的啊,有空翻一翻应该就能翻到了