whitecircle/halo
- 来源
- GitHub
- 首次上榜日期
- 领域
- 模型推理
- GitHub 星标数
- 327
- 主要语言
- Python
本页介绍外部开源仓库,并非 HDATF 产品。

它做什么
这是面向语言和多模态模型的训练框架,支持预训练、监督微调、偏好优化及异步多轮强化学习,可在单个GPU或多个节点上训练Hugging Face模型。
对 ATF 的帮助
LabChin在规划不同模型训练方法的实验时,可以比较其共用训练基础结构。
许可证
自定义许可 自定义或非标准许可。复用前请阅读许可证文件。
同领域的其他仓库
- jaredpalmer/kev
这是基于Qwen3.5的小型决策模型,提供预训练权重、训练代码和评估数据。API支持是非、选择及评分问题,并兼容TypeSafe System One格式。 - dexmal/dexbotic
这是基于PyTorch的视觉语言动作研究工具,涵盖预训练、微调、推理及评估,提供多种模型配置、统一机器人训练数据格式和部署脚本。 - mizorewww/laya-mlx
这是在Apple Silicon上运行Laya类型化决策模型的原生MLX运行时,无需文本生成、PyTorch运行时或云端API即可进行本地推理。 - NandhaKishorM/laya
这是多语言决策引擎,通过一次前向传播回答关于文本、邮件、工单或JSON的类型化问题。路由器为每个请求选择检查点。 - mizorewww/laya-coreml
这是把Laya类型化决策模型移植到Apple Core ML与Neural Engine的项目,在设备端运行且不生成token,并公开了速度与能耗基准和一个贪吃蛇演示。
只收录进入 Trendshift 排行榜的仓库,榜单仅用于寻找候选项目,不转载名次。说明、许可证和星标数来自各 GitHub 仓库。解读是我们自己的判断。我们尚未测试这些项目,上榜并不证明质量。