jamiepine/voicebox
- 来源
- GitHub
- 首次上榜日期
- 领域
- 媒体
- GitHub 星标数
- 55,114
- 主要语言
- TypeScript
本页介绍外部开源仓库,并非 HDATF 产品。

它做什么
一款本地AI语音工作室,可用简短音频样本克隆声音,用多种TTS引擎生成语音,并通过快捷键在任意文本框中听写输入。它还可以为支持MCP的AI agent提供声音。
对 ATF 的帮助
与我们的产品无关,因进入排行榜而一并收录。
许可证
MIT 宽松许可。保留版权声明即可商用和修改。
同领域的其他仓库
- waooAI/waoowaoo
用于制作图片和视频的AI工作空间。用户与助手一起完善创意简报,上传参考素材,在画布上生成和修改结果;将结果修改为新版本时会保留原版本。 - dwzhu-pku/PaperBanana
这是一个利用VLM和图像生成模型为学术论文制作插图的工具,提供可选择模型的Streamlit界面。它是从Google Research的PaperVizAgent fork而来的项目。 - nikopueringer/CorridorKey
CorridorKey 是用于绿幕抠像的神经网络。它从原始绿幕画面中,为每个像素预测前景颜色和干净的线性 alpha 通道,包括半透明边缘和运动模糊。 - ace-step/ACE-Step-1.5
ACE-Step 1.5是一个可在Mac、AMD、Intel和CUDA设备上本地运行的开源音乐生成模型。用户可以用几首歌曲训练LoRA,以体现自己的风格。 - hacksider/Deep-Live-Cam
Deep-Live-Cam是只用一张图片即可实时换脸并制作视频deepfake的工具。它内置检查功能,用于阻止裸露或血腥画面等不当媒体。
只收录进入 Trendshift 排行榜的仓库,榜单仅用于寻找候选项目,不转载名次。说明、许可证和星标数来自各 GitHub 仓库。解读是我们自己的判断。我们尚未测试这些项目,上榜并不证明质量。