---
NZG73 软件文档与使用指南
开发者: Muhammad Noman | 公司: NZG73
---
## ⚠️ 重要警示(严禁滥用)
> 🚨 **NZG73 郑重指示所有用户,本软件仅限用于积极和建设性的目的。**
> 滥用他人声音、针对特定个人或造成任何形式的伤害是极度不道德的行为。
> 我们应当敬畏法律与道德,杜绝此类行为。
> **此工具旨在简化复杂任务,请务必负责任地使用。** 🤝
---
## 🌟 软件核心功能 (Key Features)
本系统分为多个先进模块,以确保各项任务都能发挥最佳性能。详细说明如下:
---
### 🔊 第一步:TTS CPU (文本转语音)
此模块专为没有昂贵显卡 (GPU) 的用户设计。
- 🌍 **支持语言:** 完美支持 **英文** 和 **中文**。
- ⚡ **性能:** 在 **CPU** 上运行极其流畅,无需任何重型 GPU 支持。
- 🎙️ **声音克隆:** 内置声音克隆功能,效果出色。*请注意,严禁将其用于非法用途。*
---
### 🎤 第二步:Voice Clone (高级版)
这是一个功能极其强大的声音克隆模块,支持广泛的语言种类。
- 🌍 **支持语言:** 支持多达 **600 种** 不同语言。
- 💻 **硬件要求:** 由于模型非常先进且庞大,在 CPU 上运行速度极慢。
- 🚀 **性能:** 为获得最佳效果,必须使用 **GPU**。建议使用 **4GB 至 8GB 显存 (VRAM)** 的显卡。显卡性能越强,处理速度越快。
---
### 💎 第三步:Voice Clone Metadata (特色功能)
> 🌟 **这是本软件最独特且先进的部分!**
> 以往用户需要手动分别录制音频和文本文件来进行语音训练,这通常会耗费数小时。
✨ "数据集准备现在变得前所未有的简单!" ✨
- **自动化流程:** 您无需再手动切割数百个音频片段、命名并逐一编写文本文件。
- **工作原理:** 只需输入文本并点击按钮,系统会自动生成声音,按顺序编号并存入独立文件夹,同时同步更新元数据 (Metadata) 文件。
- **优势:** 您的数据集将以专业标准自动生成,杜绝人为错误。制作训练数据集现在轻而易举!
---
### 📝 第四步:Speech to Text (ASR - 语音转文本)
该模块可以精准地将音频内容识别并转换为文本。
- 🌍 **支持语言:** 完美支持 **99 种** 语言。
- 💻 **硬件要求:** 这是一个高性能模型,至少需要 **3GB 显存的 GPU** 才能顺畅运行。在 CPU 上运行速度极慢,几乎无法完成处理。
---
### 🔄 第五步:Voice to Voice (语调转换)
此功能可将一种声音完全转化为另一种声音。
**🔧 工作原理:**
假设您用 AI 生成了一段故事(**目标声音**),但希望这段音频呈现为您自己的声音。您只需提供目标音频和一段您的原声样本(约 **30 秒参考音频**),点击**生成**后,整个故事就会变换成您的声音。🎉
> ⚡ **性能:** 在 CPU 上运行速度较慢(但可以使用);若配备 **GPU**,处理过程将如流水般顺畅。🚀
---
## 🚀 未来计划 (Upcoming Releases)
**NZG73** 的征程永不止步,我们即将推出更多精彩更新:
### 📱 N Preva (移动端应用)
> 我们的移动 App 即将发布,让您在手机上也能享受强大的 AI 功能。
### 🌐 高级 Web UI
> 全新的网页界面即将面世。它将支持多种 AI 模型,允许您与不同的 AI 系统交互,并能同时处理多项复杂任务。
---
🌟 联系我 🌟
---
✨ Muhammad Noman | NZG73 用 ❤️ 制作 ✨