jamiepine/voicebox

来源
GitHub
首次上榜日期
领域
媒体
GitHub 星标数
55,114
主要语言
TypeScript
网站
voicebox.sh (在新标签页中打开)

本页介绍外部开源仓库,并非 HDATF 产品。

jamiepine/voicebox

它做什么

一款本地AI语音工作室,可用简短音频样本克隆声音,用多种TTS引擎生成语音,并通过快捷键在任意文本框中听写输入。它还可以为支持MCP的AI agent提供声音。

对 ATF 的帮助

与我们的产品无关,因进入排行榜而一并收录。

许可证

MIT 宽松许可。保留版权声明即可商用和修改。

同领域的其他仓库

  • waooAI/waoowaoo
    用于制作图片和视频的AI工作空间。用户与助手一起完善创意简报,上传参考素材,在画布上生成和修改结果;将结果修改为新版本时会保留原版本。
  • dwzhu-pku/PaperBanana
    这是一个利用VLM和图像生成模型为学术论文制作插图的工具,提供可选择模型的Streamlit界面。它是从Google Research的PaperVizAgent fork而来的项目。
  • nikopueringer/CorridorKey
    CorridorKey 是用于绿幕抠像的神经网络。它从原始绿幕画面中,为每个像素预测前景颜色和干净的线性 alpha 通道,包括半透明边缘和运动模糊。
  • ace-step/ACE-Step-1.5
    ACE-Step 1.5是一个可在Mac、AMD、Intel和CUDA设备上本地运行的开源音乐生成模型。用户可以用几首歌曲训练LoRA,以体现自己的风格。
  • hacksider/Deep-Live-Cam
    Deep-Live-Cam是只用一张图片即可实时换脸并制作视频deepfake的工具。它内置检查功能,用于阻止裸露或血腥画面等不当媒体。

只收录进入 Trendshift 排行榜的仓库,榜单仅用于寻找候选项目,不转载名次。说明、许可证和星标数来自各 GitHub 仓库。解读是我们自己的判断。我们尚未测试这些项目,上榜并不证明质量。

在 GitHub 上查看 (在新标签页中打开)