chatfire-AI/huobao-drama

出典
GitHub
初登場日
分野
メディア
GitHubスター数
15,275
主な言語
Vue

外部のオープンソース リポジトリを紹介するページです。HDATFの製品ではありません。

chatfire-AI/huobao-drama

何をするか

ショートドラマ制作を自動化するフルスタックのプラットフォームです。LLMが脚本から人物、シーン、絵コンテを抽出し、画像と動画のモデルがデザインとクリップを作って1話の映像に合成します。

ATFへの役立ち方

動画制作そのものは私たちの製品の範囲外です。ただし、agent skillの定義をSKILL.mdファイルとして置き、UIで編集できるようにした方式は、ATF Worksで開発者以外の人がAI assistantのskillを調整できるようにする際の参考になり得ます。

ライセンス

独自ライセンス 標準ではない独自ライセンスです。再利用の前にライセンスファイルを確認してください。

同じ分野のリポジトリ

  • kyutai-labs/pocket-tts
    GPUなしでCPU上で動く小さなTTS(text-to-speech)モデルで、音声ストリーミング、音声クローン、Python API、CLIを提供します。英語、フランス語、ドイツ語、ポルトガル語、イタリア語、スペイン語に対応し、ブラウザでも動かせます。
  • cjpais/Handy
    オフラインで動くクロスプラットフォームのデスクトップ音声認識アプリです。ショートカットを押し続けるか切り替えて話すと、書き起こした文章が使用中のアプリに貼り付けられます。無音はSilero VADで除き、書き起こしはローカルのWhisperまたはParakeetモデルで行います。
  • originalankur/maptoposter
    都市のミニマルな地図ポスターを作成して書き出すPythonスクリプトです。blueprintやjapanese_inkなどのテーマを選べます。
  • Lightricks/LTX-2
    LTX-2は、音声と同期した動画を生成するLTX-2モデルを実行し、そのモデル用のLoRAを学習するための公式Pythonパッケージです。
  • torvalds/AudioNoise
    AudioNoiseは、デジタル音声処理の基礎を学ぶために作られた、phaserやechoなどのシンプルな音声エフェクト集です。IIRフィルターとdelay loopを使い、1サンプルを受けて1サンプルを出す方式で処理します。

Trendshiftのランキングに入ったリポジトリだけを載せ、リストは候補を探すためだけに使いました。順位の数字は転載していません。説明、ライセンス、スター数は各GitHubリポジトリで確認しました。解説は私たちの判断です。これらを試験したわけではなく、上昇リストに載ったことは品質の証明ではありません。

GitHubで見る (新しいタブで開きます)