何扰(HeRao Reader)使用说明书
极简界面,硬核解析 —— 把难读的 TXT 目录,读清楚
1. 产品概述
何扰是一款以本地 TXT 纯文本为主力场景的阅读工具,由何扰软件工作室(HeRao Software Studio)开发。核心解决网文 TXT 目录解析困难的问题——面对目录难认、章节乱跳、标题样式不统一的 TXT 文件,何扰在您的设备上本地分析章节结构,让阅读重新变得顺畅。
核心能力
| 能力 | 说明 |
|---|---|
| 多模式目录解析 | 常规、探索、回响、超时空等多种分析模式 |
| 阅读档案 | 累计字数/时长/连续天数统计,支持云端同步 |
| 书架管理 | 本地导入、WiFi 传书、收藏、算法/自定义封面、.uutx 容器;Pro/试用可用书架归类 |
| 阅读增强 | 分页/滚动阅读、自动阅读、语音听书、断行合并、正文搜索、笔记、可选字体 |
| 账户与云同步 | 注册登录、多设备绑定(最多 3 台)、云端 Pro 权益同步 |
支持格式
- TXT(主力):纯文本,本地解析章节结构
- EPUB(有限支持):可提取文字与目录,版式因书而异
.uutx(容器):何扰专用容器;可打包正文、目录、封面等;公开版全员可导出/导入,含私密数据的版本有额外权限要求(见第 4 章)
版本说明
| 版本 | 获取方式 | 包名 |
|---|---|---|
| 国内正式版 | GitHub Releases 下载 APK | com.uutxtreader |
| 国际版 | Google Play | com.uutxtreader.intl |
2. 安装与获取
国内版安装
- 访问 何扰 GitHub Releases
- 下载最新版
.apk文件(herao-official-v*.apk) - 核对 Release 页面提供的 SHA-256 校验值
- 在系统设置中允许「安装未知来源应用」
- 点击 APK 完成安装
国际版安装
在 Google Play 搜索「HeRao Reader」或直接访问 https://play.google.com/store/apps/details?id=com.uutxtreader.intl
系统要求
Android 8.0(API 26)及以上
请仅从何扰官方渠道获取安装包,自行承担第三方来源风险。
3. 快速入门
第一次使用
- 打开应用:首次启动进入书架页面(空白状态)
- 导入书籍:点击顶部右上角溢出菜单(⋮),选择「打开文件」「本地导入」或「WiFi 传书」
- 自动解析:打开书籍后,何扰自动分析章节结构并生成目录
- 开始阅读:点击章节开始阅读,支持手势翻页
主界面导航
应用底部采用浮动导航栏,包含以下入口:
- 书架:管理所有导入的书籍
- 阅读档案:统计数据与洞察
- 设置:个性化配置
阅读时还会出现阅读器专用的顶部工具栏和底部章节进度条。
4. 书架与导入
所有书籍导入均通过书架页面右上角的溢出菜单(⋮)完成,提供三种导入方式。
打开文件
点击溢出菜单中的「打开文件」,调用 Android 系统文件选择器。您可以浏览设备存储中的任意位置,选择一个 TXT 或 EPUB 文件直接打开阅读。
- 适合单本快速打开,不经过书架
- 支持 TXT(
text/plain)和 EPUB(application/epub+zip) - 打开后自动解析目录并进入阅读
本地导入
点击溢出菜单中的「本地导入」,弹出批量导入对话框。何扰会扫描设备存储中的 TXT 和 EPUB 文件,列出所有可导入的书籍供勾选,确认后批量加入书架。
- 适合批量添加多本书到书架
- 导入后书籍保留在书架中,随时继续阅读
- 支持 TXT 和 EPUB 格式
书架功能
| 功能 | 操作 |
|---|---|
| 搜索 | 书架顶部搜索框按书名、归类名过滤(支持拼音) |
| 书籍排序 | 按书名、最近阅读、导入时间排序 |
| 收藏 | 长按多选时点星标收藏/取消;溢出菜单「进入收藏」查看收藏列表 |
| 删除书籍 | 长按进入多选模式后批量删除 |
| 多选导出 | 选中多本书后导出文件(含 .uutx 公开/私密,见下文) |
| 书籍信息 | 查看文件大小、格式、编码等详情;可更改封面 |
| 书架归类 | 见下文() |
书架归类
将多本书收进虚拟「归类」容器,像文件夹一样占用书架一格,不会移动或改写真实文件路径。一本书同一时间只在根层或某一个归类中。
权限:本机 Pro、云端 Pro 或安装试用有效期内开放。无权限时不显示相关入口;若此前已建归类,书架会临时展平显示全部在架书籍,关系保留,续期后自动恢复折叠。
入口(有权限时):
| 操作 | 路径 |
|---|---|
| 新建归类 | 书架 → 溢出菜单(⋮)→ 新建归类(可选:从书架隐藏、进入时系统验证) |
| 归类管理 | 溢出菜单 → 归类管理(找回隐藏归类、重命名、隐藏/加锁、删除) |
| 移入归类 | 长按多选书籍 → 底栏 移动 → 选择目标归类;或进入归类后 添加到当前归类 |
| 移出归类 | 进入归类 → 多选 → 底栏 移出归类 |
| 删除归类 | 归类管理或长按归类菜单 → 删除(书回到根层,不删文件与阅读记录) |
交互要点:
- 归类卡片显示在书架根层最前;点击进入二级列表,返回键回到根层。
- 隐藏归类不在根层显示,可通过搜索归类名或「归类管理」找回。
- 加锁归类进入前需系统生物识别或设备锁屏密码;未解锁前不暴露内部书名与封面拼图。解锁在进程内短时有效,应用进后台或切换账号后需重新验证。
- 隐藏与加锁均为界面级收纳/访问门槛,不是文件加密,请勿当作绝对隐私方案。
完整迁移与登出隔离会一并导出/恢复归类结构(旧迁移包无此字段时按无归类处理)。
算法封面与自定义封面
何扰会为每本书自动生成算法艺术封面——根据书名哈希生成独特的渐变色彩和几何图案,即使没有实体封面的 TXT 也能一眼辨认。可在设置中关闭「算法艺术封面」。
也可在书籍详情中选择更改封面:从相册选取图片并裁切为约 5:7 比例,或恢复为默认算法封面。
.uutx 容器
.uutx 是何扰的书籍容器格式,便于携带正文与目录等阅读相关数据。
| 操作 | 权限 | 说明 |
|---|---|---|
| 导入 / 打开 | 与 TXT/EPUB 一样可打开或导入书架 | |
| 导出公开版 | 保留正文、目录、多音字标注与封面;不含笔记/书签/阅读位置等私密数据 | |
| 导出含私密数据 | 笔记与阅读位置等加密写入,需设置密码;换机打开时需同一密码 | |
| 制作公开分享版 | 从已有 .uutx 再生成一份不含私密 vault 与来源元数据的分享包 |
入口示例:书架多选导出,或书籍相关菜单中的「导出为 .uutx」「制作公开分享版」。
EPUB 导入
导入 EPUB 时,何扰提取文字内容和内嵌目录结构,转换为可阅读格式。复杂版式(表格、多栏、内嵌字体等)的还原效果因书而异。TXT 是主要使用场景,EPUB 为有限支持。
WiFi 传书
通过局域网从电脑或另一台手机浏览器上传文件,无需数据线。
入口:书架 → 右上角溢出菜单(⋮)→ WiFi 传书
使用前:手机须已连接 Wi‑Fi,且与上传端处于同一局域网(访客网络若开启 AP 隔离可能无法连通)。
| 传书模式(默认) | |
|---|---|
| 支持格式 | .txt、.text、.epub |
| 单文件上限 | 200 MB |
| 效果 | 上传成功后自动解析并加入书架 |
| 操作 | 页面显示访问地址与二维码;浏览器打开地址即可上传 |
文件传输服务(可选):在传书页开启开关并选择保存文件夹后,浏览器可上传任意类型文件到所选文件夹,不加入书架。
传书期间以前台服务运行;切到后台可通过通知栏回到传书页。点击「停止传书」或离开传书页即结束服务。
5. TXT 目录解析
这是何扰的核心能力。面对不同结构的 TXT 文件,提供多套分析模式。
5.1 日常主力模式(免费可用)
常规模式(默认优先)
- 适用场景:章节标题较规范的书——如常见的「第 X 章」「卷名 · 章节」等
- 特点:速度快、结果稳定,多数 TXT 默认走此路径
- 使用方式:目录页选择「常规模式」,或在章节识别中选择「自动识别」
探索模式
- 适用场景:标题写法比较「野」、卷标混用、常规方式目录仍对不齐时
- 特点:按这本书自己的行文习惯重新辨认章节,结果会被记住
- 使用方式:目录页选择「探索模式」,或在章节识别中主动切换
5.2 进阶模式
回响模式
- 适用场景:常规与探索仍不满意时,用更强的分析梳理整本书的章节脉络
- 特点:适合结构特别难缠的文本
超时空模式
- 适用场景:排版个性明显的文本——古文、习惯使用非常规符号的书
- 特点:有概率识别出可用章节,效果因书而异
5.3 目录自动竞优
可开启「自动选择目录解析模式」:何扰会先尝试常规,目录结构异常时自动升级到更强的分析模式,全程无需手动干预。还可开启「仅目录异常时竞优」子开关,仅在必要时才自动升级。
5.4 目录界面操作
- 模式切换:手动选择当前使用的解析模式
- 重新解析:切换模式后重新生成目录
- 章节跳转:点击章节标题快速跳转阅读
- 当前章节定位:阅读时点击目录自动定位到当前章节
6. 手势系统详解
何扰的阅读界面采用完整的手势交互体系。阅读页菜单中的「操作指南」按三步引导;以下文档结构与之一致,便于对照。
6.1 翻页与状态呼出
屏幕划分为三个纵向区域(左 30% / 中 40% / 右 30%)。
点击翻页与工具栏
| 区域 | 操作 | 效果 |
|---|---|---|
| 左侧 30% | 点击 | 上一页 |
| 右侧 30% | 点击 | 下一页 |
| 中间 40% | 点击 | 显示 / 隐藏顶部工具栏和底部进度条 |
滑动翻页(带动画)
| 手势 | 效果 |
|---|---|
| 从右向左横向滑动 | 翻到下一页 |
| 从左向右横向滑动 | 翻到上一页 |
滑动超过一定阈值后松手,页面以动画完成翻页;未超过阈值则回弹。
底部进度条拖拽
| 手势 | 效果 |
|---|---|
| 拖动底部 SeekBar | 在当前章节内快速定位阅读位置 |
松手后自动跳转到对应页面。进度条同时显示章节进度百分比。
6.2 调速与右缘手势
右侧边缘约 10% 宽度为感应区;进入自动阅读后,同一区域用于调速,并可配合全屏纵拖与左缘跟读校准。
普通模式 · 右侧边缘
| 区域 | 手势 | 效果 |
|---|---|---|
| 上半区 | 下滑 | 手势启动自动阅读 |
| 上半区 | 上滑 | 手势启动语音听书(需在设置中启用) |
自动阅读 · 调速与进度
| 手势 | 效果 |
|---|---|
| 右侧约 10% 区域上下滑动 | 实时调整自动阅读滚动速度(上滑加快,下滑减慢) |
| 屏幕任意位置上下拖动 | 临时暂停自动阅读,手动拖动当前章节进度;松手后恢复 |
调速时屏幕中央会短暂显示倍速指示器:上方为当前倍率(如 2.9x),下方为约 X 字/分(800 字/分基线 × 倍率)。
左侧边缘跟读校准
| 手势 | 效果 |
|---|---|
| 左边缘按下后向下滑动 | 进入「跟读校准」模式,按实际阅读速度计算 CPM 并校准滚动速度 |
提示:首次启用自动阅读时尤为有用——先用跟读手势读 3~5 行,系统即可根据您的实际阅读节奏自动匹配合适的滚动速度。
自动阅读 · 点击翻页(补充)
| 区域 | 操作 | 效果 |
|---|---|---|
| 左侧 30% | 点击 | 上一页 |
| 右侧 30% | 点击 | 下一页 |
| 中间 40% | 点击 | 暂停/恢复 + 显示/隐藏工具栏 |
6.3 阅读舱与时空回溯
阅读舱统计
| 入口 | 操作 | 效果 |
|---|---|---|
| 底部状态栏区域 | 长按 | 打开阅读舱数据统计面板(进度、CPM、剩余时间等) |
| 阅读菜单 | 「阅读舱状态」 | 同上 |
时空回溯
在目录跳转、搜索跳转等产生阅读位置变化后,会记录回溯节点。有记录时左下角出现回溯图标(带数量角标)。
| 入口 | 操作 | 效果 |
|---|---|---|
| 左下回溯图标 | 点击 | 打开「时光胶囊」列表,点选节点回到当时位置 |
| 左下 / 右下感应区 | 上滑 | 同上 |
免费版列表显示 3 个节点;Pro 可保留更多回溯节点(以应用内说明为准)。每条节点显示章节标题、当时阅读进度、快照记录时间(月-日 时:分)及正文片段预览。
6.4 长按选词
| 操作 | 效果 |
|---|---|
| 长按正文任意位置 | 进入文字选择模式 |
| 拖动选区两端圆形拨杆 | 调整选区范围 |
| 拨杆拖到屏幕顶部/底部边缘 | 连续跨页翻动继续选择 |
| 选区内点击 | 弹出操作菜单(复制、搜索、添加笔记、反推正则等;菜单项较多时可横向滑动查看) |
| 选区外点击 | 取消选择 |
自动阅读模式下长按选词行为与普通模式相同。
6.5 物理按键
| 场景 | 按键 | 效果 |
|---|---|---|
| 普通阅读 | 音量加 / 减 | 上一页 / 下一页 |
| 语音听书 | 音量加 / 减 | 调节系统音量(切句见听书控制面板或通知栏) |
7. 阅读体验
阅读器界面
何扰采用自研 Canvas 渲染引擎:
| 功能 | 说明 |
|---|---|
| 翻页动画 | 滑动翻页带弹性动画,支持横向滑动跟随 |
| 阅读模式 | 分页(默认)或 滚动(连续纵滑);滚动模式与语音听书、自动阅读互斥 |
| 字体调整 | 字号、行距、字间距、段间距均可独立调节 |
| 夜间模式 | 纯黑或深灰背景 + 浅色文字,OLED 友好 |
| 阅读进度 | 底部 SeekBar 显示章节进度,顶部工具栏显示全书进度 |
| 断行合并 | 自动检测并合并硬换行,呈现流畅段落 |
| 自动阅读 | 全屏自动匀速滚动,支持手势调速和跟读校准(分页模式) |
| 语音听书 | TTS 朗读正文,句级高亮同步,支持跨页连续听(分页模式) |
| 屏幕电源管理 | 可分别配置手动阅读 / 自动阅读下的熄屏或常亮策略 |
字体
支持系统内置字体和用户导入的自定义字体(通过字体选择器导入 .ttf 或 .otf 文件:设置 → 字体 → 从文件导入)。
语音听书
语音听书(TTS)的引擎、控制面板、Sherpa 自备包与 ZipVoice 等说明见第 8 章。
阅读模式(分页 / 滚动)
阅读设置中可切换:
| 模式 | 说明 |
|---|---|
| 分页 | 默认;支持翻页动画、自动阅读、语音听书 |
| 滚动 | 连续纵向滑动阅读;不可与听书或自动阅读同时使用;仍可长按划线添加笔记 |
自动阅读
自动阅读可通过以下方式启动(须为分页模式):
- 阅读工具栏菜单 → 自动阅读
- 右侧边缘下滑手势
可启用「智能初始化速度」:根据您在该书的历史阅读速度(CPM),自动计算匹配的初始滚动速度。
屏幕电源管理
设置 → 屏幕电源管理(阅读设置中亦有入口):可分别配置手动阅读与自动阅读下的熄屏策略(如按阅读速度智能熄屏、固定分钟数、或保持常亮)。常亮请注意 OLED 烧屏风险。
护眼提示
可在设置中开启「护眼提醒」:每隔 40/60/80/120 分钟,屏幕顶部弹出半透明提示条。点击自动消失。
阅读进度同步
应用自动记录每本书的最后阅读位置和章节,退出后重新打开自动恢复。同时记录阅读统计数据(字数、时长),用于阅读档案。
8. 语音听书(TTS)
语音听书与自动阅读互斥,且仅在分页阅读模式下可用。句级同步:每句开始时整句高亮并滚到句首,朗读完成后自动切下一句并跨页补给正文。播放期间默认持有唤醒锁以支持息屏续听(仍可能受系统省电策略影响,建议按需将何扰加入电池白名单)。
8.1 启动方式
- 阅读工具栏菜单 → 语音听书
- 右侧边缘上滑手势(需在设置中启用语音听书)
设置入口:设置 → 语音听书 → 启用、选择引擎、语速/音高/句级高亮延迟;云引擎需配置提供商与密钥;Sherpa 首次使用会解压内置离线引擎,再下载或导入语音包。
8.2 听书控制面板
播放中可通过悬浮控制面板或通知栏操作。面板主要能力:
| 能力 | 说明 |
|---|---|
| 播放 | 暂停/继续、切句;显示约字/分钟与本次已听时长 |
| 定时停止 | 按章节(读 N 章后停)或按时长(30/60/90/120 分钟) |
| 看正文 / 返回听书列表 | 「看正文」临时查看阅读画面;「返回听书列表」回到听书面板语境 |
| 离线缓存 | 云 TTS 下可开启边听边存,缓存已合成音频供弱网复播;可管理占用 |
云/Sherpa 合成失败时会自动降级为系统语音一次。可在设置中开启「启动听书时自动展示听书面板」。
8.3 朗读引擎
| 引擎 | 权限 | 说明 |
|---|---|---|
| 系统语音 | 使用设备自带 TTS 引擎 | |
| 云 TTS | 通义千问、腾讯云(用户自备 API 密钥)。调用费用由用户自行承担 | |
| AngeVoice 自托管 | 连接用户自行部署的 AngeVoice 服务;支持局域网主地址与可选备用地址,服务器及网络成本由用户承担 | |
| Sherpa 本地 | 离线 ONNX 语音包;需 arm64;Release 版内置离线引擎(首次使用自动解压),再下载或导入语音包 | |
| Sherpa ZipVoice | 克隆音色;须启用 ZipVoice 且选用 ZipVoice 语音包(详见 8.5) |
AngeVoice 自托管云 TTS
AngeVoice 不是 App 内置模型,而是连接您自行部署和维护的 AngeVoice 服务。API Key、服务器地址、模型及音色配置均由用户提供;App 只负责调用接口和播放音频。
配置步骤
- 确认手机能够访问 AngeVoice 服务。服务须监听局域网地址(通常是
0.0.0.0),不能只监听服务器本机的127.0.0.1。 - 设置 → 语音听书 → 朗读引擎选择 云 TTS → 云 TTS 提供商选择 AngeVoice(自托管)。
- 打开“云 TTS API 密钥”,填写 AngeVoice API Key 和主服务地址;备用服务地址、Model、Voice 均可选。
- 点击“完成”。App 会自动调用
/health检查连接,并提示实际连通的是主服务还是备用服务。
服务地址填写规则
- 填写 Base URL,例如
http://192.168.100.147:8101;末尾/可有可无。 - 不要填写控制台网页中的具体页面路径,也不要自行追加
/health、/v1/audio/voices或/v1/audio/speech;App 会自动拼接接口路径。 - 主服务地址必填,备用地址可留空。典型配置是局域网 HTTP 为主、公网 HTTPS 反向代理为备用。
- 国内正式版和内部版允许连接可信局域网 HTTP;国际版仅允许 HTTPS。局域网 HTTP 中的 Bearer Key 为明文传输,只应在可信网络使用。
Model 与音色
- App 当前不会自动获取 Model 列表。Model 留空时使用服务端默认模型;需要指定时,请手动填写服务端认可的准确 Model ID。
- 配置成功后,点击设置页单独的“音色”一栏,App 会请求
/v1/audio/voices?detail=true获取音色列表;填写了 Model 时,会按该 Model 查询音色。 - 配置弹窗中的 Voice 输入框是手动备用入口:音色列表获取失败或服务端不提供列表时,可直接填写准确的 Voice ID;留空使用服务端默认音色。
- 健康检查成功只表示
/health可达,不保证 Model 或音色列表一定存在。
局域网与故障排查
- 建议先用手机浏览器访问
主服务地址/health,例如http://192.168.100.147:8101/health。能够看到ok、idle、loading、restarting或degraded等 JSON 状态,才说明手机到服务的网络路径已连通。 - “Failed to connect” 通常是 IP/端口填错、服务只监听
127.0.0.1、服务器防火墙未放行、手机与服务器不在可互通的局域网,或 VPN 禁止访问局域网。 .local地址依赖同一链路的 mDNS;跨子网或 VLAN 隔离时请改用局域网 IP 或普通 LAN DNS 名称。- 模型冷加载可能耗时较长;前台等待超过 10 秒时,听书面板会提示模型可能正在加载。
- 使用服务端默认音色时,如果服务端在相同 Model/Voice 标识下更换实际模型或默认音色,旧离线缓存不会自动失效,请在听书面板或空间管理中清理对应云 TTS 缓存。
8.4 引擎选择建议
| 引擎 | 特点 |
|---|---|
| 系统语音 | 效率高、省电,适合长时间听书 |
| 云 TTS | 厂商音色自然、音感好;按量计费,可能产生高额费用,请留意控制台用量 |
| AngeVoice 自托管 | 音质和速度取决于服务器模型、硬件及网络;局域网可减少公网延迟,但需要用户自行部署、维护并保障 API Key 安全 |
| Sherpa(VITS / Kokoro / Matcha 等) | 本地合成、无额外费用;听感取决于所选语音包,请选用合适的 TTS 包 |
| Sherpa ZipVoice | 克隆音色;合成速度与音感高度依赖参考音频品质;参考音推荐 1–3 秒(超过 3 秒合成效率明显下降);默认线程数推荐 3 |
8.5 ZipVoice 克隆音色
ZipVoice 为 Sherpa 下的克隆音色能力:用您自己的短参考音频「学」出近似音色,再离线朗读正文。须选用 ZipVoice 语音包,并配置参考音频(录制或导入 1–3 秒样本及一致逐字稿)。
权限与音色数量
- 权限:Pro、云端 Pro 或安装试用有效期内可用(须构建启用 ZipVoice)
- 音色数量:安装试用 / 测试 SN 最多 2 个用户音色;正式付费 / 已验证云端 Pro 不限制
使用步骤
- 设置 → 语音听书 → 朗读引擎选 Sherpa 本地,并启用 ZipVoice。
- Sherpa 语音模型 → 选择/下载或导入 ZipVoice 包(
sherpa-onnx-zipvoice-*.tar.bz2)。 - 若提示缺少 vocoder:将
vocos_24khz.onnx放到模型目录,或应用内在线补充;也可按 8.7 自行下载后「导入本地 vocoder」。 - 新建音色 / 音色列表:录制或导入参考音(推荐 1–3 秒、安静环境),并填写与录音完全一致的逐字稿。
- 返回听书,选用该音色开始朗读。
参考音频建议
- 时长 1–3 秒;超过 3 秒合成效率明显下降。
- 安静环境、吐字清晰;逐字稿与录音逐字一致。
- 默认线程数推荐 3。
Lexicon 与预取
- Lexicon 扩展:可批量添加专名、生僻词与固定读法(多音字需确认);影响所有书,下次朗读生效。
- 预取倍数(测试):1.0x–3.0x,仅放大档位预取覆盖目标/上限;默认 1.0x 即可,盲目调高可能更耗电。
ZipVoice 专用 vocoder
ZipVoice 必须配套 24 kHz vocoder 文件 vocos_24khz.onnx(与 Matcha 的 16/22 kHz vocoder 不是同一文件)。直链见 8.7。
8.6 Sherpa 自备语音包格式(自行搜寻时必读)
若从 sherpa-onnx 的 tts-models 发布页 等处自行下载,请确认是语音合成(TTS)包且布局符合下表。语音识别(ASR)包无法用于听书,导入时会被拒绝。
导入方式:设置 → 语音听书 → Sherpa 语音模型 → 导入自备语音包,选择 .tar.bz2 压缩包(与官方发布格式一致)。
VITS、Kokoro、Matcha、Melo、ZipVoice 等请从发布页自行下载后导入。
| 类型 | 支持 | 典型特征 | 说明 |
|---|---|---|---|
| VITS | ✅ | vits-piper-*.tar.bz2、vits-melo-*.tar.bz2;tokens.txt + *.onnx | Piper、Melo 等;最常见 |
| Kokoro 多语 | ✅ | model.onnx + voices.bin + 双 lexicon + espeak-ng-data | 音质好但手机端较慢,建议自备导入 |
| Matcha | ✅* | model-steps-*.onnx、lexicon.txt、dict/ | *须对应采样率 vocoder,见 8.7 |
| ZipVoice | ✅* | sherpa-onnx-zipvoice-*.tar.bz2;encoder/decoder + tokens.txt | *须 vocos_24khz.onnx;详见 8.5 |
| Paraformer / SenseVoice / Whisper | ❌ | 文件名含 paraformer 等,或含 am.mvn | 语音识别,非朗读合成 |
自行下载时快速核对:① 发布页选 tts-models,勿选 asr-models;② 解压后应有 tokens.txt 与 .onnx(ZipVoice 为 encoder/decoder);③ Matcha 须对应采样率 vocoder、ZipVoice 须 24k vocos_24khz.onnx;④ 带 ASR、识别、转写字样的均非听书包。
与离线引擎的区别:离线引擎(Sherpa JNI)随 Release 安装包内置,首次使用解压一次;语音包可单独下载或导入,换语音包无需重解压引擎。
8.7 vocoder 自行下载
Matcha、ZipVoice 的声学包与 vocoder(声码器)分开发布。缺 vocoder 时应用内可引导在线下载;若 GitHub 访问不便,也可自行下载后:设置 → 语音听书 → Sherpa → vocoder 管理 → 导入本地 vocoder。
发布页:sherpa-onnx vocoder-models
| 用途 | 文件名 | 约大小 | 直链(GitHub Release) |
|---|---|---|---|
| ZipVoice(必用) | vocos_24khz.onnx | ~52 MB | vocos_24khz.onnx |
| Matcha(常见 22 kHz) | vocos-22khz-univ.onnx | ~52 MB | vocos-22khz-univ.onnx |
| Matcha(部分中英包 16 kHz) | vocos-16khz-univ.onnx | ~51 MB | vocos-16khz-univ.onnx |
- ZipVoice 只能用
vocos_24khz.onnx,勿与 Matcha 的 16/22 kHz 文件混用。 - Matcha 多数包用 22 kHz;部分中英包需 16 kHz。导入后若仍提示缺 vocoder,请对照上表换用对应文件。
- 将下载的
.onnx放到对应语音包模型目录,或通过应用内「导入本地 vocoder」选择该文件。
9. 搜索与笔记
全文搜索
| 模式 | 权限 | 说明 |
|---|---|---|
| 普通匹配 | 精确匹配关键词 | |
| 模糊匹配 | 容忍字符差异,扩大匹配范围 | |
| 正则表达式 | 高级正则搜索 |
搜索结果以列表展示,点击跳转到匹配位置,匹配词高亮显示。
笔记
- 添加笔记:工具栏笔记按钮,或长按选词菜单中选择(分页与滚动模式均可划线添加)
- 管理笔记:笔记列表查看、跳转、删除,支持附言
- 划线自动添加笔记:阅读设置中开启后,选中文本时自动添加笔记
- 选区菜单项较多时,可横向滑动浏览全部操作
10. 阅读档案
统计数据
| 指标 | 说明 |
|---|---|
| 累计字数 | 阅读过的总字数 |
| 累计时长 | 阅读总时间 |
| 连续阅读天数 | 连续达成阅读目标的日期数 |
| 近 7 日分布 | 最近一周每日阅读字数柱状图 |
| 完本数量 | 已完全阅读的书籍数 |
| 接触书籍数 | 至少打开过的书籍数 |
统计长图导出
- 权限:正式付费 Pro 可离线导出;试用/测试需联网并在首 7 天可用
- 功能:将阅读统计生成为可分享的长图
- 操作:阅读档案页点击导出按钮
云端同步
- 功能:上传阅读统计数据到何扰服务器,换机后恢复
- 合并策略:云端与本地取大值,不丢失数据
- 操作:阅读档案 → 同步按钮
数据备份与恢复
- 权限:正式付费 Pro 可离线;试用/测试须登录
- 备份:将阅读档案导出为加密备份文件
- 恢复:从备份文件恢复阅读统计数据
- 存储位置:本地 SAF 目录或 WebDAV
11. 账户系统
注册与登录
何扰提供可选账户系统,用于云端同步和多设备管理。
- 注册:设置或权益中心 →「登录/注册」页面
- 输入用户名(全局唯一)
- 设置密码(≥ 6 位,不支持纯重复数字和连续序列)
- 可选设置密保问题
- 登录:输入用户名和密码
- 退出:登录态释放当前设备绑定
多设备管理
- 设备限制:单账号最多绑定 3 台设备
- 远程解绑:登录后可在设备管理列表踢出其他设备
- 紧急自救:当所有设备都被占用时,通过密保答案在登录页清空所有绑定
密码使用加盐哈希,不同用户即使相同密码在数据库中密文也不同。弱密码会被 C++ NDK 层拦截。设备 ID 通过 Android ID 脱敏后生成。
12. 授权与会员
档位说明
| 版本 | 说明 |
|---|---|
| 免费版 | 基础阅读与书架管理;系统语音与云 TTS(通义/腾讯,自备密钥) |
| Pro 版 | 回响/超时空、AngeVoice 自托管、Sherpa、ZipVoice、阅读档案云同步、书架归类、目录竞优等 |
未特别说明时,「Pro 及以上」含安装试用与云端 Pro。
获取 Pro
在应用内查看当前档位、购买或激活 Pro:
- 设置 → 订阅与激活
- 阅读档案 → 当前状态(顶部档位卡片)
国内版支持支付宝 / 微信;国际版通过 Google Play 结算。套餐种类、价格与有效期以应用内页面展示为准,可能随时调整。
安装试用
新安装用户自动获得 7 天安装试用 Pro(算力与正式 Pro 一致,离线可用)。试用/测试档导出与迁移(统计长图、加密备份、完整迁移)需联网,且限新设备或新账户首 7 天;迁移与档案备份还须登录。
- 本地试用天数从首次安装或账号注册时间计算(取 min 封顶)
- 设备首次联网后,算力试用与服务器记录的设备首见时间对齐;清数据重装不能刷满 7 天算力试用
- 试用导出限新设备或新账户首 7 天;清数据重装不能重复获得导出窗口
- 登录老账号且非 Pro 时,试用天数不会超过该账号首次注册后的 7 天
SN 码激活
设置 → 订阅与激活 → 输入 SN 码,用于测试或赠送 Pro 授权激活。
测试 / 赠送 Pro 能力边界
- 与正式付费 Pro 算力一致(解析、阅读、档案视图等),可离线使用
- 导出与迁移:与安装试用相同,需联网并在首 7 天可用;迁移与档案备份须登录
- 正式付费 Pro 可离线导出与迁移
云端 Pro 权益同步
- 登录后自动拉取云端 Pro 到期时间
- 云端 Pro 有效时,本机即使过期也可继续使用 Pro 能力
13. 设置详解
阅读设置
| 设置项 | 说明 |
|---|---|
| 字号 | 阅读正文大小 |
| 行距 | 行与行之间的间距 |
| 字间距 | 字符间距 |
| 段间距 | 段落间的空白 |
| 字体 | 选择正文字体(支持导入自定义字体) |
| 阅读模式 | 分页 / 滚动(滚动与听书、自动阅读互斥) |
| 翻页模式 | 滑动翻页动画 / 无动画直切(分页模式下) |
| 主题 | 日间 / 夜间 / 纯黑背景 |
| 护眼提示 | 定时提醒休息(间隔可选 40/60/80/120 分钟) |
| 屏幕电源管理 | 手动/自动阅读下的熄屏或常亮策略 |
语音听书设置
| 设置项 | 权限 | 说明 |
|---|---|---|
| 启用语音听书 | 关闭后隐藏阅读菜单项与右缘听书手势 | |
| 启动听书时自动展示面板 | 每本书本轮阅读首次启动听书时展开控制面板 | |
| 朗读引擎 | 系统、通义/腾讯免费;AngeVoice/Sherpa 需 Pro | 系统 / 云 TTS / Sherpa 本地 |
| 云 TTS 提供商与密钥 | 通义/腾讯免费(自备密钥) | 密钥仅存本机加密存储;调用费用自担 |
| AngeVoice 自托管 | API Key 严格加密保存;主地址必填,备用地址、Model、Voice 可选;Model 手填,音色可从服务器获取或手填 | |
| Sherpa 离线引擎 | Release 内置,首次使用解压 | |
| Sherpa 语音模型 | 导入自备 .tar.bz2(格式见上文) | |
| ZipVoice 克隆音色 | 参考音、音色列表;试用/测试最多 2 个音色 | |
| ZipVoice Lexicon 扩展 | 专名/固定读法;多音字需确认 | |
| ZipVoice 预取倍数(测试) | 1.0x–3.0x,默认 1.0x | |
| 语速 / 音高 / 句级高亮延迟 | 影响朗读节奏与句首高亮时机 | |
| 边听边存(云 TTS) | 听书面板「离线缓存」页;缓存已合成云音频供弱网复播 |
解析设置
| 设置项 | 权限 | 说明 |
|---|---|---|
| 断行合并 | 自动检测并合并硬换行 | |
| 全局回响模式 | 对所有书默认启用回响分析 | |
| 全局超时空模式 | 对所有书默认启用超时空分析 | |
| 自动选择目录解析模式 | 目录异常时自动升级分析模式 | |
| 仅目录异常时竞优 | 仅在必要时自动升级 |
搜索设置
| 设置项 | 权限 | 说明 |
|---|---|---|
| 搜索模式 | 普通 / 模糊 / 正则(免费仅普通) |
阅读档案设置
| 设置项 | 权限 | 说明 |
|---|---|---|
| 档案本地备份 | 正式可离线;试用/测试须登录 | |
| 档案恢复 | 正式可离线;试用/测试须登录 | |
| WebDAV 备份 | 正式可离线;试用/测试须登录 | |
| 自动备份 | 正式可离线;试用/测试须登录 |
数据管理
| 功能 | 权限 | 说明 |
|---|---|---|
| 完整迁移导出 | 正式可离线;试用/测试须登录 | |
| 完整迁移恢复 | 正式可离线;试用/测试须登录 |
14. 数据迁移与备份
阅读档案备份
- 导出:设置 → 阅读档案 → 备份 → 选择存储位置
- 恢复:设置 → 阅读档案 → 恢复 → 选择备份文件
- 格式:加密的何扰专用备份格式
完整迁移
- 导出:设置 → 数据管理 → 完整迁移导出。包含:书架列表(含归类结构)、阅读进度、阅读档案、设置偏好等。存储位置:本地或 WebDAV。
- 恢复:设置 → 数据管理 → 完整迁移恢复。选择迁移包文件,恢复所有数据。
15. 常见问题
目录解析
Q: 为什么某本书的目录不对?
尝试在目录页手动切换到「探索模式」重新解析。如果仍不理想,Pro 用户可尝试「回响」「超时空」。不同模式适用性因文本而异。
Q: 怎么知道当前用的是哪个解析模式?
目录页顶部显示当前模式名称,也可手动切换。
Q: 能保存某本书的解析结果吗?
探索模式会自动记忆当前书的解析结果,下次打开直接使用。
手势与阅读
Q: 自动阅读速度如何调整?
三种方式:① 右侧边缘上下滑动调速;② 左边缘下滑跟读校准;③ 底部的自动阅读控制面板调整倍速。
Q: 如何快速退出自动阅读?
点击屏幕中间区域或按音量键,可暂停自动阅读并显示工具栏,再次点击工具栏的自动阅读按钮关闭。
Q: 滚动模式能听书吗?
不能。滚动模式与语音听书、自动阅读互斥;请先切回分页模式。滚动模式下仍可长按划线添加笔记。
Q: 语音听书与自动阅读有什么区别?
自动阅读是屏幕匀速滚动;语音听书是 TTS 朗读,句级高亮同步,可息屏/后台续听(受系统省电策略影响)。两者互斥。右缘上半区:下滑启动自动阅读,上滑启动听书。
Q: 云 TTS 或 Sherpa 听书失败怎么办?
当次会话会自动降级为系统语音继续朗读;请检查网络、API 密钥、Sherpa 离线引擎与语音包是否已就绪。
Q: AngeVoice 显示“主备服务均不可用”怎么办?
先确认地址和端口没有填错,再用手机浏览器访问 主服务地址/health。若浏览器也打不开,请检查 AngeVoice 是否监听 0.0.0.0、服务器防火墙、手机与服务器的局域网互通,以及 VPN 是否允许访问局域网。主地址只填 Base URL,例如 http://192.168.100.147:8101,不要追加接口路径。
Q: AngeVoice 配置成功后为什么看不到 Model 或音色?
连接成功只代表 /health 可达。App 当前不获取 Model 列表:Model 请手动填写,或留空使用服务端默认值。音色需要点击设置页单独的“音色”一栏才会从 /v1/audio/voices 获取;若服务端未返回列表,可在 AngeVoice 配置弹窗中手动填写 Voice ID。
Q: 云 TTS 要 Pro 吗?
通义千问与腾讯云为免费可用(自备密钥,调用费用自担)。AngeVoice 自托管、Sherpa 与 ZipVoice 需 Pro / 试用。
Q: WiFi 传书连不上怎么办?
确认手机与电脑在同一 Wi‑Fi;访客网络请关闭 AP 隔离或换用主网络;传书页展开「无法连接?」查看提示。
Q: 自行下载的 Sherpa 语音包无法导入或闪退?
请对照第 8 章「Sherpa 自备语音包格式」与「vocoder 自行下载」:常见误选 Paraformer 等 ASR 识别包(非 TTS);Matcha 须对应采样率 vocoder、ZipVoice 须 24k vocos_24khz.onnx(应用内可引导下载,亦可按说明书直链自行下载后导入)。支持 VITS、Kokoro、Matcha+vocoder、ZipVoice+vocoder 布局的 .tar.bz2 包。
Q: ZipVoice 合成慢或音色不对?
参考音频品质影响极大:推荐 1–3 秒、安静环境、逐字稿与录音完全一致;默认线程数 3;过长参考音会明显拖慢合成。安装试用 / 测试 SN 最多 2 个用户音色。
Q: 为什么有些 EPUB 显示不正常?
何扰对 EPUB 是有限支持(提取文字与目录)。复杂版式可能无法完美还原。TXT 是主要使用场景。
Q: 支持哪些编码的 TXT?
支持 UTF-8、GBK、GB2312、Big5 等常见中文编码,自动检测。
Q: .uutx 和 TXT 有什么区别?
.uutx 是何扰容器:可携带目录、封面等;公开版不含笔记等私密数据,含私密数据的导出需设置密码且受数据搬运权限约束。
Q: 书架上找不到某本已导入的书?
请先确认是否在「收藏」视图、或已移入「归类」:在根层查看归类卡片,或用搜索框搜书名。若开启了归类加锁,须先通过系统验证才能看到内部书籍。无 Pro/试用权限时,原归类会展平显示,书应仍在根层列表中。
Q: 隐藏/加锁归类是不是加密了?
不是。隐藏只是从根层收起;加锁只是进入前要求系统身份验证。真实文件路径与内容不会因此加密。
账户与授权
Q: 试用到期后会怎样?
到期后恢复为免费版,Pro 独占功能(回响/超时空全局模式、AngeVoice 自托管、Sherpa、模糊/正则搜索、书架归类等)将不可用。系统语音与通义/腾讯云 TTS 仍可用。书架和阅读进度不受影响。
Q: 换了手机怎么恢复 Pro?
登录同一账号,在权益中心点击「同步云端权益」。
Q: 为什么我的设备无法登录?
检查账号是否超过 3 台设备绑定上限。如所有设备均不可用,在登录页使用密保答案执行「紧急解绑」清空所有绑定。
Q: 测试 SN 和正式 Pro 有什么区别?
算力一致且可离线使用。导出与迁移(统计长图、备份、迁移、含私密的 uutx)与安装试用相同:需联网并在首 7 天可用;迁移与档案备份还须登录。正式付费 Pro 可离线导出与迁移。
数据
Q: 删除应用会丢失数据吗?
会。书架、阅读进度、档案统计等数据存储在应用内,卸载后不可恢复。建议在权限允许时定期导出完整迁移包。
Q: 如何备份数据?
设置 → 数据管理 → 完整迁移导出(正式付费可离线;试用/测试须登录)。
16. 联系与支持
| 渠道 | 地址 / 方式 |
|---|---|
| 官网 | https://herao.uurj.com |
| 邮箱 | [email protected] |
| 隐私政策(国内) | https://herao.uurj.com/privacy.html |
| 服务协议(国内) | https://herao.uurj.com/service.html |
| 隐私政策(国际) | https://herao.uurj.com/privacy-intl.html |
| 服务协议(国际) | https://herao.uurj.com/service-intl.html |