Lordog/dive-into-llms

出典
GitHub
初登場日
分野
モデル推論
GitHubスター数
54,476
主な言語
Jupyter Notebook

外部のオープンソース リポジトリを紹介するページです。HDATFの製品ではありません。

Lordog/dive-into-llms

何をするか

上海交通大学の講義から生まれた無料の中国語LLM実践チュートリアルシリーズです。fine-tuningとデプロイ、promptとchain of thought、知識編集、数学推論、GUI agent、alignmentを、スライド、解説、notebookで扱います。

ATFへの役立ち方

Harnessに関わるエンジニアがfine-tuning、prompt、GUI agentを学ぶ資料として、ゆるやかな参考になり得ます。再利用できるコンポーネントではなく、講義資料です。

ライセンス

ライセンスなし ライセンスファイルがありません。ライセンスがない場合、コードの再利用は原則として許可されません。

同じ分野のリポジトリ

  • microsoft/BitNet
    bitnet.cppは1ビットLLM向けの公式推論フレームワークで、CPUとGPU向けに最適化されたカーネルを備えます。1ビットの埋め込みモデルと、その変換と実行のガイドも公開しています。
  • deepseek-ai/Engram
    Engramは、大規模言語モデルのconditional memoryに関する論文の公式実装です。N-gram embeddingを定数時間で引けるよう改良したモジュールで静的なmemoryを取り出してhidden stateと融合し、Mixture-of-Expertsを補完します。
  • RunanywhereAI/runanywhere-sdks
    一つのC++コアを共有するSDK群で、LLM、ビジョン、音声、voice agent、embedding、RAG、画像生成を、スマートフォン、ブラウザ、デスクトップ、サーバー上でローカルに実行します。capability registryが各呼び出しを端末上のエンジンに振り分けます。
  • p-e-w/heretic
    directional ablationにより、transformer言語モデルからsafety alignmentによる拒否動作を取り除くCLIツールです。Optunaベースのoptimizerが、拒否を減らしつつ元のモデルから大きく離れないパラメータを探します。
  • AlexsJones/llmfit
    llmfitはマシンのCPU、RAM、GPU、VRAMを調べ、その環境で動かせるオープンソースLLMと量子化形式を推奨します。ターミナルUI、Webダッシュボード、REST APIを備え、ローカルで実際の毎秒トークン数を測るベンチマークもできます。

Trendshiftのランキングに入ったリポジトリだけを載せ、リストは候補を探すためだけに使いました。順位の数字は転載していません。説明、ライセンス、スター数は各GitHubリポジトリで確認しました。解説は私たちの判断です。これらを試験したわけではなく、上昇リストに載ったことは品質の証明ではありません。

GitHubで見る (新しいタブで開きます)