功能详解
inVoice 语记不再只是一个录音 App,而是一套「说出口 → AI 整理 → 一键分发」的灵感创作流水线。你对着手机说一段话,AI 按你设定的创作分身把它整理成会议纪要、读书笔记、小红书短文或公众号文章,再一键同步到公众号草稿箱、inBox 笔记或生成封面图。
下面按模块详细介绍每个能力,包括可选项和默认行为。
创作分身(AI Personas)
核心概念
「创作分身」是 0.3.0 起替代旧版「项目/文件夹」的核心概念。每个分身不是简单的分类文件夹,而是一个独立的 AI 助手:同一段录音,在不同分身下会被整理成完全不同的内容。
什么是创作分身
打开 App 底部导航的「分身」页,可以看到你创建的所有分身。每个分身由四部分构成:
| 配置项 | 作用 | 示例 |
|---|---|---|
| 分身名称 + 图标 + 颜色 | 在列表里识别分身 | 「会议秘书」📋 蓝色 |
| AI 秘书人设(System Prompt) | 决定写作风格、语气、输出格式 | 「你是专业会议纪要秘书,输出待办 + 决策清单」 |
| 专属背景记忆(Custom Memory) | 让 AI 认识你的人和事,不再拼错专有名词 | 「团队代号 Voice,成员咕咚负责开发」 |
| 默认输出格式 | 录音完成后的默认润色格式 | 文章稿 / 逐字稿 / 要点提取 |
分身如何影响内容
同一段原始录音,分身不同,结果天差地别:
- 在「会议秘书」分身下 → 结构化的会议纪要(待办、决策、责任人)
- 在「小红书爆款」分身下 → 带 Emoji 排版的种草短文 + 热门标签
- 在「读书笔记本」分身下 → 核心概念 + 金句 + 行动清单
内置分身模板
新建分身时,可以从 8 个内置模板一键套用,无需从零写人设:
| 模板 | 默认格式 | 适合场景 |
|---|---|---|
| 会议秘书 | 要点提取 | 会议纪要、待办梳理 |
| 读书笔记本 | 文章稿 | 读书感想、知识卡片 |
| 小红书爆款 | 文章稿 | 种草文案、流量短文 |
| 情绪微日记 | 逐字稿 | 日常随笔、情绪记录 |
| 会议稿整理 | 文章稿 | 把口语录音转成流利书面稿 |
| (其余模板) | — | 覆盖写作、工作等多种场景 |
模板里已经预填好人设指令和背景记忆,选中后可以再按需修改。
分身成长建议
每次录音润色完成后,AI 会自动分析「本次内容 vs 当前分身配置」,判断是否需要给分身升级:
- 发现你口述中出现了新的专有名词、新项目、新背景信息 → 建议追加到「专属背景记忆」
- 发现你反复表现出新的风格偏好(比如总是不要 Emoji) → 建议更新「秘书人设」
- 没有新信息时 → 不打扰
建议会以卡片形式弹出,你确认后才会写入分身,分身越用越懂你。
首次画像引导
第一次进入分身相关功能时,会弹出「开启你的创作分身」引导卡片,用 5 秒倒计时确保你了解分身的三大价值(千人千面的写作风格、专属记忆与专有名词、专属整理偏好),再开始创建第一个分身。
图标与配色
每个分身可以从 12 种图标(语音、电话、人物、学习、工作、会议、收藏、星标、灵感、音乐、文档、重要)和 8 种颜色中自由组合,让灵感列表一眼分得清归属哪个分身。
录音
高质量录音引擎
inVoice 使用 Android 原生 AudioRecord 引擎 + 自研 WavWriter,输出专业级 WAV 无损录音。录音参数可在设置中调整:
| 参数 | 可选项 | 默认值 |
|---|---|---|
| 采样率 | 44100 Hz | 44100 Hz |
| 声道 | 单声道 / 立体声 | 单声道 |
| 位深度 | 16 bit | 16 bit |
录音时屏幕保持常亮,避免录到一半自动熄屏。
后台录音
录音过程中切到其他 App 不会中断,通知栏会持续显示录音状态和已录时长,随时回看进度。
录音书签
录音中点书签按钮,可以在当前时间点打一个标记,支持自定义标签。播放时点击书签就能跳回这个时间点,方便定位长录音里的关键段落。
免费版限制
免费版每条录音最多 3 个书签,PRO 及以上版本不限数量。
极速录音(开屏直录)
在「设置 → 录音启动偏好」里开启「开屏直录」,启动 App 时会立刻自动拉起录音,省去点按钮的步骤,适合灵感来了必须马上抓住的高频场景。
同一个偏好页还能开关「记录前选择分身」——开启后,触发录音前会先问一句本次灵感归哪个分身,录音面板上也会直观展示当前归属的分身。
AI 转写
录音结束后,inVoice 会自动把语音转成文字。转写支持两种管道:
文件转写(FileVoicePipeline)
录音完成后,把整个音频文件提交给阿里云 NLS「录音文件识别(极速版)」,适合长录音、对准确率要求高的场景。支持 MP3、AMR、AAC、WAV 等全格式,非 WAV 格式会先做预处理再上传。
实时转写(RealtimeVoicePipeline)
录音过程中通过 WebSocket 实时把语音流送给阿里云 NLS 边录边转,录音一结束文字几乎立刻就能出来。如果实时通道连接失败,会自动回退到文件转写,保证不会转不出来。
多 AI 引擎
转写后的润色、标题、封面、灵感观察等 AI 能力,支持三个引擎自由切换:
| 引擎 | 特点 | 适用场景 |
|---|---|---|
| 智谱 GLM | 中文优化,响应快 | 日常中文创作 |
| DeepSeek | 深度推理,性价比高 | 大量转写需求 |
| 自定义 | 支持任意 OpenAI 兼容 API | 已有 AI 服务 |
免费版和订阅版用户开箱即用,无需配置;永久版用户需自行配置阿里云 NLS 和 AI 引擎密钥,详见 永久版配置指南。
自动标题
AI 会根据转写内容自动给录音起一个标题,省去手动命名。
AI 润色
转写完成后,可以用 AI 对文字做润色处理,这是「把语音变成可发布内容」的关键一步。润色会按当前分身的人设和输出格式来执行:
| 输出格式 | 结果 |
|---|---|
| 文章稿 | 段落分明、过渡自然的成文,可直接发公众号 |
| 逐字稿 | 去掉口语词和重复,保留原意的干净文字稿 |
| 要点提取 | 提炼成 Markdown 列表的要点清单 |
润色在后台异步执行,详情页会显示润色状态。如果润色失败,详情页顶部会出横幅提示、并附后台 Toast 提醒,按提示重试即可。原始稿和润色稿通过标签页切换查看,互不覆盖。
分发中心
详情页右上角的分享入口打开「分发中心」——一个 2×3 宫格的统一分发面板,把内容送到你想去的地方:
| 入口 | 作用 |
|---|---|
| 发送文本 | 以纯文本形式发到微信、邮件等其他 App |
| 生成分享图 | 生成带精美排版的小红书风格分享卡片 |
| 公众号文章 | 同步纯文章到微信公众号草稿箱 |
| 公众号图文 | 同步带封面图的文章到公众号草稿箱 |
| 导出录音 | 把原始音频文件导出保存或转发 |
| 发送到 inBox | 把灵感作为笔记存进 inBox 笔记 |
分发中心会智能判断当前发送的是「原始稿」还是「润色稿」标签页的内容,按你正在看的版本分发。
一键同步微信公众号草稿
0.4.0 起,inVoice 可以把整理好的内容直接同步到你的微信公众号草稿箱,不用复制粘贴、不用切换 App。
配置
进入「设置 → 发布配置 → 微信公众号」,填入公众号的 AppID 和 AppSecret(在公众号后台「设置与开发 → 基本配置」获取)。配置完成后,分发中心的「公众号文章」入口才会可用,未配置时会弹出引导提示。
两种同步模式
| 模式 | 说明 |
|---|---|
| 公众号文章 | 只同步正文,生成一篇纯文字草稿 |
| 公众号图文 | 先用 AI 生成封面图上传到公众号素材库,再生成带封面的图文草稿 |
未生成封面时
选「公众号文章」但还没生成封面时,会先询问是否生成封面;封面就绪后再同步。
AI 智能封面
0.4.0 起,inVoice 可以根据内容自动生成公众号、小红书风格的封面图。
生成流程
CoverPrompts把内容送给 AI,让模型扮演「极简主义设计大师 + 标题党文案总监」,提炼出不超过 8 个字的灵魂主标题 + 一句极短副标题。- AI 返回一段内联样式的纯 HTML 封面代码(1080×460 画布)。
HtmlCoverWebView+CoverRenderer在 App 内渲染这张 HTML 并截图,得到可发布的封面图。- 封面可以保存到本地、分享出去,或随图文一起同步到公众号草稿箱。
封面生成和上传是 PRO 功能,免费用户会弹出付费引导。
发送到 inBox 笔记
0.4.2 起,详情页分发中心新增 inBox 入口,一键把灵感笔记(标题 + 润色稿)发送到 inBox 笔记沉淀,让零散的语音灵感和你的笔记体系统一起来。
配置
进入「设置 → 发布配置 → inBox 笔记」,支持三种输入格式,InBoxUrlResolver 会自动归一化:
| 输入格式 | 示例 | 说明 |
|---|---|---|
| 完整 URL(线上) | https://api.gudong.site/inbox/{token} | 直接用 |
| 完整 URL(自建/内网) | http://host:port/inbox/{token} | 适合自建部署 |
| 纯 token | x4zZcOEKEUAT35LYNlAufkI12Bm0Ti | 自动用默认 host 拼接 |
配置页内置「发送测试笔记」功能,填完点一下就能验证地址是否有效。发送到 inBox 是 PRO 功能。
AI 灵感观察
0.4.0 起,详情页可以触发「灵感观察」——InsightPrompts 让 AI 扮演「深度观察者和思维教练」,基于你的助理画像(分身背景)对本次录入的内容做一段客观、敏锐的评价,帮你发现思维里的闪光点、潜在偏见或未察觉的深层联系,启发更深层的思考。每次观察控制在 100 字以内,精炼不啰嗦。
沉浸式素材库
详情页底部常驻一个「灵感素材」抽屉,可以半屏或全屏切换,集中展示当前灵感的所有版本(转写稿、各次润色稿、封面图等),方便对比和回溯历史版本。
播放器
播放控制
进入录音详情页即可控制播放:
- 播放 / 暂停:一键控制
- Slider 进度拖动:拖动进度条精确跳转,实时显示当前进度与总时长
- 波形显示:可视化整段录音的音量波形,直观定位讲话段落
变速播放
支持 5 档播放速度,适合快速浏览或精听:
| 速度 | 0.5× | 1× | 1.5× | 2× | 3× |
|---|
A-B 循环
选择两个时间点之间的片段反复播放,适合语言学习、听写或精听某一段。
书签导航
播放页会显示该录音的所有书签,点击任意书签即可跳转到对应时间点。
桌面小组件与快捷录音
桌面小组件
在桌面长按添加 inVoice 小组件,无需打开 App 即可一键开始录音,小组件会显示当前录音状态。
快捷设置磁贴
下拉通知栏,在快捷设置里添加 inVoice 磁贴,点击即可快速启动录音,适合需要频繁录音的场景。
极速录音入口
通过小组件或磁贴触发后,会显示一个轻量的录音界面,录音完成后自动保存到默认分身(或按「记录前选择分身」设置询问归属)。
扫描导入与音频工具箱
扫描导入
启动 App 时会自动检测设备里的新音频文件,发现后提示「前往导入」。导入页支持多选、试听预览、查看文件详情,并可按分身归类导入。基于文件物理指纹做去重,重复导入相同文件会自动识别。
权限说明
扫描导入是 PRO 功能,免费版不可用。
音频工具箱
在「灵感工具」里提供三件套,对录音做二次加工:
| 工具 | 作用 |
|---|---|
| 片段截取 | 从原始音频中截取一段保存为新录音 |
| 格式转换 | 在 WAV / AAC / MP3 等格式之间互转 |
| 片段删除 | 删除选中片段,保留其余部分 |
格式转换已修复早期 WAV 转 AAC 出现刺啦噪音、外部音频转 AAC 失败等问题,全格式互转均可用,失败时会弹出具体错误原因。
导出
可以把录音导出到设备任意目录(通过系统目录选择器),或打包分享出去。
统计与搜索
统计
进入「设置 → 账号卡片 → 统计」,可以看到:
- 累计灵感时长:你一共录了多久
- 累计转写:转写了多少分钟
- 转写额度:今日已用 / 总额度,免费版每日 6 分钟,PRO 每日 30 分钟,永久版不限
搜索
底部导航的搜索页支持按关键词检索所有灵感(标题、转写文本等),快速回找历史录音。
数据备份与本地存储
本地优先
所有录音文件和数据都存在你的设备本地,inVoice 默认不会把你的数据上传到任何服务器(仅在你主动触发 AI 转写 / 润色 / 同步时,把对应内容送到你配置的 AI 或发布服务)。
备份与恢复
进入「设置 → 数据管理」:
- 手动备份:随时创建一份本地备份
- 自动备份:开启后在充电且连接 WiFi 时自动执行每日备份
- 备份历史:查看和管理所有备份记录
- 导入导出:把所有录音和元数据打包成 ZIP 文件,方便迁移到新设备或恢复
云备份
永久版(FOREVER)权益包含云备份能力。
数据清除
如需清除所有数据,可在数据管理中操作,请务必先备份重要内容。
账号与付费
三档权益
| 权益 | 免费版 | PRO 年度版 | 永久版 |
|---|---|---|---|
| 每日转写额度 | 6 分钟 | 30 分钟 | 不限 |
| 单条录音时长 | 不限 | 不限 | 不限 |
| AI 润色 | ❌ | ✅ | ✅ |
| 扫描导入 | ❌ | ✅ | ✅ |
| 书签数 | 3 个/条 | 不限 | 不限 |
| 云备份 | ❌ | ❌ | ✅ |
| AI 封面 / 发送 inBox | ❌ | ✅ | ✅ |
| 自定义 AI 引擎与 NLS | ❌ | ❌ | ✅ |
付费引导
触发 PRO 功能时(如润色、导入、封面生成、发送 inBox),会弹出 PayWallDialog 付费引导,可选择登录账号或查看套餐。
ProManager
ProManager 统一管理你的账号权益状态(UserTier),实时同步当前套餐、转写额度、Pro 身份,影响全 App 的功能开关。权益登录后即时生效,跨设备登录也能继承。