AI 元声造影 开发版 欢迎大家下载测试 免费

图片[1]-AI 元声造影 开发版 欢迎大家下载测试 免费-聆曦博客

软件简介

这款小工具,可以说是我把这么多年积攒下来的作经验,加上自己对 AI 开发的一点热爱,慢慢打磨出来的作品。

现在开源的 AI 模型越来越多,看上去选择很多,但真正想要在自己电脑上跑起来,那一套本地部署环境,真的劝退了绝大多数普通人。 就拿 ComfyUI 来说,熟悉流程的朋友上手自然轻松,可还有一大半的创作者,光是搭建环境、调试流程就被挡在了门外。

为了解决这个痛点,这段时间我投入了不少精力,也自费几百美元,也想尽各种办法白嫖了不少token和积分,挨个测试、参考了 GPT、Claude、GLM、QWEN、DeepSeek 等多款大模型,最终做出了这款桌面工具。

我的目标很简单:打造一个面向本地 AI 创作的一站式工作台。 以后语音设计、声音克隆、音乐生成、视频创作、数字人制作,全都可以放在这一个软件里完成。 你只管在界面上规划好自己的创作思路,那些耗时长、占资源的运算任务全部交给后台悄悄运行。模型管理、参数配置、任务进度查看,所有东西都收纳在同一个工作空间,不用再来回切换一堆工具。

希望能用自己一点点技术,帮更多想玩本地 AI 创作的人,跨过部署这道门槛,把更多精力放回创作本身。

软件下载

下载图标
AI 元声造影【MetaSound】
当前版本
0.0.2
更新日期
2026-09-03
下载图标
AI 元声造影【MetaSound】
当前版本
0.0.2
更新日期
2026-09-03

以上网盘链接包括软件的安装包以及所需模型文件,软件正在开发阶段,有新的进展都会打包发布

软件:MetaSound v0.0.2 Windows x64.exe

模型:

  • 语音合成模型:MetaSoundVoiceEngine.7z 压缩包大小:4.97GB【2026-08-29开放】
  • 音乐创作模型:MetaSoundMusicEngine.7z 压缩包大小:22.1GB【2026-09-03开放】
  • 视频生成模型:即将开放
  • 数字人生成模型:即将开放

硬件配置

本软件目前仅支持 N 卡(CUDA),后续可能会发布纯CPU版本模型,到时候只需要指定CPU版本模型即可,具体根据大家反馈看要不要开发对应的服务。

语音合成:

  • 最低要求:显存 8GB,可以运行基础语音功能
  • 推荐配置:显存 12GB 及以上(RTX3060‑12G、RTX4070 等)
  • 模型峰值显存占用:约 7‑8GB

音乐创作:

  • 最低要求:显存 12GB,可以运行基础语音功能
  • 推荐配置:显存 24GB 及以上(RTX3090、RTX4090等)
  • 模型峰值显存占用:约 12‑24GB

使用教程

第一步:安装主程序

运行安装包 MetaSound v0.0.2 Windows x64.exe,按照安装向导完成软件本体安装

第二步:解压模型包

把下载好的 MetaSoundVoiceEngine.7zMetaSoundMusicEngine.7z 完整解压到你电脑上好找的英文路径文件夹

❗重要提醒:

  1. 路径尽量不要包含中文、空格、特殊符号,避免程序读取模型出错
  2. 记住这个解压后的文件夹位置,后面软件内要选中这个目录

第三步:软件内关联模型引擎

  1. 打开 MetaSound(AI 元声造影)软件
  2. 点击左下角【偏好设置】,切换到【模型管理】标签页
  3. 点击【选择位置】,选中刚刚解压完成的模型根文件夹

后续版本会新增模型在线下载功能,就不需要手动网盘下载解压了

第四步:启动模型

  1. 在模型管理列表,点击想要启动模型的右侧【启动】按钮
  2. 等待加载,直到上方引擎状态显示【运行中】,出现引擎版本、采样率等日志信息即为成功。

⚠️注意:受于显存大小原因,同一时间只能运行一个模型引擎,如果需要切换其他模型,请先点击【停止】关闭当前引擎,再启动别的模型。

第五步:开始使用

回到软件左侧菜单栏,选择【语音合成】等模块使用,后续会录制相关视频教程。

© 版权声明
THE END
喜欢就支持一下吧
点赞9 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容