![图片[1]-AI 元声造影 开发版 欢迎大家下载测试 免费-聆曦博客](https://www.aizzx.top/wp-content/uploads/2026/09/20260903032020431-MetaSound-01-1024x576.jpg)
软件简介
这款小工具,可以说是我把这么多年积攒下来的作经验,加上自己对 AI 开发的一点热爱,慢慢打磨出来的作品。
现在开源的 AI 模型越来越多,看上去选择很多,但真正想要在自己电脑上跑起来,那一套本地部署环境,真的劝退了绝大多数普通人。 就拿 ComfyUI 来说,熟悉流程的朋友上手自然轻松,可还有一大半的创作者,光是搭建环境、调试流程就被挡在了门外。
为了解决这个痛点,这段时间我投入了不少精力,也自费几百美元,也想尽各种办法白嫖了不少token和积分,挨个测试、参考了 GPT、Claude、GLM、QWEN、DeepSeek 等多款大模型,最终做出了这款桌面工具。
我的目标很简单:打造一个面向本地 AI 创作的一站式工作台。 以后语音设计、声音克隆、音乐生成、视频创作、数字人制作,全都可以放在这一个软件里完成。 你只管在界面上规划好自己的创作思路,那些耗时长、占资源的运算任务全部交给后台悄悄运行。模型管理、参数配置、任务进度查看,所有东西都收纳在同一个工作空间,不用再来回切换一堆工具。
希望能用自己一点点技术,帮更多想玩本地 AI 创作的人,跨过部署这道门槛,把更多精力放回创作本身。
软件下载
以上网盘链接包括软件的安装包以及所需模型文件,软件正在开发阶段,有新的进展都会打包发布
软件:MetaSound v0.0.2 Windows x64.exe
模型:
- 语音合成模型:
MetaSoundVoiceEngine.7z压缩包大小:4.97GB【2026-08-29开放】 - 音乐创作模型:
MetaSoundMusicEngine.7z压缩包大小:22.1GB【2026-09-03开放】 - 视频生成模型:即将开放
- 数字人生成模型:即将开放
硬件配置
本软件目前仅支持 N 卡(CUDA),后续可能会发布纯CPU版本模型,到时候只需要指定CPU版本模型即可,具体根据大家反馈看要不要开发对应的服务。
语音合成:
- 最低要求:显存 8GB,可以运行基础语音功能
- 推荐配置:显存 12GB 及以上(RTX3060‑12G、RTX4070 等)
- 模型峰值显存占用:约 7‑8GB
音乐创作:
- 最低要求:显存 12GB,可以运行基础语音功能
- 推荐配置:显存 24GB 及以上(RTX3090、RTX4090等)
- 模型峰值显存占用:约 12‑24GB
使用教程
第一步:安装主程序
运行安装包 MetaSound v0.0.2 Windows x64.exe,按照安装向导完成软件本体安装
第二步:解压模型包
把下载好的 MetaSoundVoiceEngine.7z 、MetaSoundMusicEngine.7z 完整解压到你电脑上好找的英文路径文件夹
❗重要提醒:
- 路径尽量不要包含中文、空格、特殊符号,避免程序读取模型出错
- 记住这个解压后的文件夹位置,后面软件内要选中这个目录
第三步:软件内关联模型引擎
- 打开 MetaSound(AI 元声造影)软件
- 点击左下角【偏好设置】,切换到【模型管理】标签页
- 点击【选择位置】,选中刚刚解压完成的模型根文件夹
后续版本会新增模型在线下载功能,就不需要手动网盘下载解压了
第四步:启动模型
- 在模型管理列表,点击想要启动模型的右侧【启动】按钮
- 等待加载,直到上方引擎状态显示【运行中】,出现引擎版本、采样率等日志信息即为成功。
⚠️注意:受于显存大小原因,同一时间只能运行一个模型引擎,如果需要切换其他模型,请先点击【停止】关闭当前引擎,再启动别的模型。
第五步:开始使用
回到软件左侧菜单栏,选择【语音合成】等模块使用,后续会录制相关视频教程。
















暂无评论内容