p-e-w/heretic

出典
GitHub
初登場日
分野
モデル推論
GitHubスター数
31,616
主な言語
Python
ウェブサイト
heretic-project.org (新しいタブで開きます)

外部のオープンソース リポジトリを紹介するページです。HDATFの製品ではありません。

p-e-w/heretic

何をするか

directional ablationにより、transformer言語モデルからsafety alignmentによる拒否動作を取り除くCLIツールです。Optunaベースのoptimizerが、拒否を減らしつつ元のモデルから大きく離れないパラメータを探します。

ATFへの役立ち方

私たちの製品とは関係がありません。ランキングに入ったため掲載しています。

ライセンス

AGPL-3.0 ネットワーク コピーレフトです。改変版をサービスとして提供する場合もソース公開が必要です。製品利用の前に確認が必要です。

同じ分野のリポジトリ

  • AlexsJones/llmfit
    llmfitはマシンのCPU、RAM、GPU、VRAMを調べ、その環境で動かせるオープンソースLLMと量子化形式を推奨します。ターミナルUI、Webダッシュボード、REST APIを備え、ローカルで実際の毎秒トークン数を測るベンチマークもできます。
  • RunanywhereAI/runanywhere-sdks
    一つのC++コアを共有するSDK群で、LLM、ビジョン、音声、voice agent、embedding、RAG、画像生成を、スマートフォン、ブラウザ、デスクトップ、サーバー上でローカルに実行します。capability registryが各呼び出しを端末上のエンジンに振り分けます。
  • maderix/ANE
    リバースエンジニアリングで得た非公開APIを使い、Apple Neural Engine上で直接ニューラルネットワークを学習させる研究用の概念実証です。CoreMLの学習API、Metal、GPUは使わず、作者は保守されるフレームワークではないと明言しています。
  • microsoft/BitNet
    bitnet.cppは1ビットLLM向けの公式推論フレームワークで、CPUとGPU向けに最適化されたカーネルを備えます。1ビットの埋め込みモデルと、その変換と実行のガイドも公開しています。
  • karpathy/nanochat
    GPUノード1台で独自のchat LLMを学習して対話できる小さなコードベースで、tokenization、pretraining、finetuning、評価、推論をすべて扱います。depth設定一つで残りのハイパーパラメータが決まります。

Trendshiftのランキングに入ったリポジトリだけを載せ、リストは候補を探すためだけに使いました。順位の数字は転載していません。説明、ライセンス、スター数は各GitHubリポジトリで確認しました。解説は私たちの判断です。これらを試験したわけではなく、上昇リストに載ったことは品質の証明ではありません。

GitHubで見る (新しいタブで開きます)