这个功能解决什么问题
从网页、OCR、PDF 转换工具或不同电子书工具复制出来的小说,常见问题包括中文和英文标点混用、引号不统一、全角/半角字符混杂、行尾空格过多,以及一句话被错误拆成多行。
勾选“自动整理内容”后,NovelLint 会在章节分析前先处理文本,再用整理后的文本建立行索引、识别章节和保存本次项目结果。这个选项可用于新建文件导入、直接粘贴文本和已有项目追加内容;追加时只处理本次新增文本,已有正文不会重新排版。
导入文件
选择 TXT 或 EPUB 后,在确认卡片中开启整理,再开始扫描。
直接粘贴
粘贴文本新建项目时,在弹窗中单独选择整理方式。
追加连载
从本地项目历史打开“追加文本”,只整理本次新增内容。
自动整理不是只读预览。整理后的文本会成为本次项目或本次追加结果的一部分;如果必须保留原文排版,请先备份原文件并关闭该选项。
具体怎么操作
- 1
选择输入方式
在首页选择 TXT/EPUB 文件,或打开“直接粘贴文本内容”;追加内容则从项目历史进入“追加文本”。
- 2
确认编码和原文可读性
TXT 先确认编码。若预览已经乱码,应先切换 UTF-8、GB18030 / GBK 或 Big5;格式整理不能修复错误解码。
- 3
开启自动整理内容
勾选“自动整理内容”后,下面才会显示两个整理方式;不勾选时保留原文格式。
- 4
选择整理深度
段落边界可信时优先选择标准整理;只有确认存在大量误断行时再选择深度整理。
- 5
开始分析并复核
整理会先于章节分析执行。进入工作区后,检查正文段落、引号行和章节目录,再继续编辑或导出。
两个选项有什么差异
| 整理方式 | 主要处理 | 适合与风险 |
|---|---|---|
| 标准整理 | 规范换行、空白、标点、引号、全角/半角字符和章节相关格式。 | 适合段落边界已经可靠的文本;不以合并普通段落断行为目标,但仍可能改变符号和标题写法。 |
| 深度整理 | 包含标准整理,并额外合并疑似误断行、处理部分章节错位和完结标记,尝试保护部分诗歌/歌词短行。 | 适合复制或转换造成断行混乱的文本;可能合并相邻短句、对话或引号行,明显改变段落结构。 |
用一个例子理解深度整理
输入文本
"这里的对话太简单" 太专注细节描写, 过于啰嗦
标准整理结果
“这里的对话太简单” 太专注细节描写, 过于啰嗦
深度整理结果
“这里的对话太简单”太专注细节描写,过于啰嗦
深度整理会更积极地合并断行。像上例这样,它不仅可能把“过于啰嗦”并到上一行,也可能继续把前面的引号行合并;如果只希望修正标点而保留三行结构,应选择标准整理。
适合使用和需要谨慎的场景
适合开启
- 网页复制或网络抓取后,标点、引号和空白格式混乱。
- OCR 或格式转换把一句完整叙述拆成多行,且这些换行明显不是段落边界。
- 追加的连载文本来自不同来源,希望先统一排版再进入章节识别。
- 希望在导入时就让章节标题和正文使用同一套基础格式。
建议谨慎或关闭
- 诗歌、歌词、剧本对白或短句排版本来就依赖换行。
- 需要逐字保留原始版本,或段落结构本身就是校对依据。
- TXT 还没有确认编码,或者当前预览已经出现乱码。
- 只想检查章节,不希望导入结果改变正文格式。
出现问题时怎么处理
- 合并过多:保留原文件,重新导入时关闭整理或改选标准整理;不要拿已经深度整理后的正文继续反复整理。
- 引号行被合并:这是深度整理可能产生的段落重排副作用。若该换行是有意的,请改用标准整理或关闭整理。
- 标点或标题写法变化:这是标准整理和深度整理都会执行的格式规范化,不能把它当作原文逐字副本。
- 章节数量变化:整理发生在章节分析前,断行和标题格式变化可能影响候选识别;进入工作区后要同时检查正文和目录。
- 追加后旧内容不变:追加模式只整理本次新增文本。如果新旧内容风格不一致,需要分别核对,而不是期待系统重排整本书。
- 仍然乱码:先返回文件选择处核对 TXT 编码;自动整理只能处理已经正确解码的文本。
推荐的使用顺序
- 1. 先备份 TXT 或 EPUB 原文件。
- 2. 确认 TXT 编码和文本可读性。
- 3. 段落边界不确定时,先关闭整理或使用标准整理。
- 4. 只有在确认存在大量误断行时,才尝试深度整理。
- 5. 进入工作区后检查正文、章节候选和编号异常,确认无误再导出。
继续了解TXT 章节识别或TXT 转 EPUB的后续审核步骤。
自动整理默认关闭,是否使用以及选择哪种深度由您决定。
用自己的小说检查一遍
TXT 解码、章节扫描、目录审核与 EPUB 生成默认都在当前浏览器本地完成。
打开 NovelLint