常见问题

支持哪些音频格式?

声咚咚支持 MP3、AAC、WAV、FLAC、OGG、M4A 等常见音频格式。格式转换功能可以在这些格式之间自由转换。

支持哪些视频格式提取音频?

支持 MP4、MOV、AVI、MKV 等常见视频格式。

导出的音频文件保存在哪里?

所有导出的音频文件保存在设备的 Documents 目录下,按工具类型分文件夹管理。你也可以在「作品」页面统一查看和管理。

录音的音质如何?

默认使用 44.1kHz 采样率进行录制,保证高音质输出。

处理过程需要联网吗?

不需要。声咚咚的所有音频处理均在本地完成,基于 FFmpeg 引擎,无需上传到云端。语音合成(TTS)使用离线 AI 模型,首次使用需下载约 50MB 的模型文件,之后可完全离线使用。

处理后的文件可以分享吗?

可以。在「作品」页面点击任意文件,选择分享即可发送到微信、邮件等应用。

音频裁剪支持精确到什么程度?

支持波形可视化预览,可以精确到毫秒级别进行裁剪。

声咚咚是免费的吗?哪些是 PRO 功能?

声咚咚的基础工具(裁剪、提取、转换、录音、合并)免费可用。部分高级能力为 PRO 专属:

功能免费PRO
音频裁剪 / 提取 / 格式转换 / 录音 / 音频合并✅✅
变速(标准格式)✅✅
变速(高品质格式 / 高比特率 / 高采样率)❌✅
语音合成 TTS(标准音质)✅✅
语音合成 TTS(离线高音质模型)❌✅
多轨录音室(STUDIO)✅✅

人声分离、智能降噪仍在规划开发中,尚未上线。

什么是多轨录音室?

多轨录音室是声咚咚的旗舰功能,支持 4 轨同时混音,提供可视化时间轴、独立音量控制、Solo/Mute 等专业功能,可以制作简单的混音作品。

语音合成需要联网吗?

首次使用时需要下载离线语音模型(约 50MB),下载完成后即可完全离线使用,不需要联网。

Last Updated:
Contributors: ruibin3