p-e-w/heretic
- 出典
- GitHub
- 初登場日
- 分野
- モデル推論
- GitHubスター数
- 31,616
- 主な言語
- Python
外部のオープンソース リポジトリを紹介するページです。HDATFの製品ではありません。

何をするか
directional ablationにより、transformer言語モデルからsafety alignmentによる拒否動作を取り除くCLIツールです。Optunaベースのoptimizerが、拒否を減らしつつ元のモデルから大きく離れないパラメータを探します。
ATFへの役立ち方
私たちの製品とは関係がありません。ランキングに入ったため掲載しています。
ライセンス
AGPL-3.0 ネットワーク コピーレフトです。改変版をサービスとして提供する場合もソース公開が必要です。製品利用の前に確認が必要です。
同じ分野のリポジトリ
- AlexsJones/llmfit
llmfitはマシンのCPU、RAM、GPU、VRAMを調べ、その環境で動かせるオープンソースLLMと量子化形式を推奨します。ターミナルUI、Webダッシュボード、REST APIを備え、ローカルで実際の毎秒トークン数を測るベンチマークもできます。 - RunanywhereAI/runanywhere-sdks
一つのC++コアを共有するSDK群で、LLM、ビジョン、音声、voice agent、embedding、RAG、画像生成を、スマートフォン、ブラウザ、デスクトップ、サーバー上でローカルに実行します。capability registryが各呼び出しを端末上のエンジンに振り分けます。 - maderix/ANE
リバースエンジニアリングで得た非公開APIを使い、Apple Neural Engine上で直接ニューラルネットワークを学習させる研究用の概念実証です。CoreMLの学習API、Metal、GPUは使わず、作者は保守されるフレームワークではないと明言しています。 - microsoft/BitNet
bitnet.cppは1ビットLLM向けの公式推論フレームワークで、CPUとGPU向けに最適化されたカーネルを備えます。1ビットの埋め込みモデルと、その変換と実行のガイドも公開しています。 - karpathy/nanochat
GPUノード1台で独自のchat LLMを学習して対話できる小さなコードベースで、tokenization、pretraining、finetuning、評価、推論をすべて扱います。depth設定一つで残りのハイパーパラメータが決まります。
Trendshiftのランキングに入ったリポジトリだけを載せ、リストは候補を探すためだけに使いました。順位の数字は転載していません。説明、ライセンス、スター数は各GitHubリポジトリで確認しました。解説は私たちの判断です。これらを試験したわけではなく、上昇リストに載ったことは品質の証明ではありません。