Tencent-Hunyuan/Hy-MT2
- 来源
- GitHub
- 首次上榜日期
- 领域
- 模型推理
- GitHub 星标数
- 814
- 主要语言
- Python
本页介绍外部开源仓库,并非 HDATF 产品。

它做什么
Hy-MT2是腾讯混元团队发布的翻译专用语言模型系列,有1.8B、7B和混合专家(MoE)结构的30B-A3B三种规模。它支持33种语言之间的互译,支持语言表中包括韩语和日语。把原文和翻译指令作为提示词输入即可得到译文,README提供了术语指定、文风、个性化、分隔符和结构化数据的提示词模板。最大上下文长度为8192个token,且没有默认系统提示词,因此长文档需要先切分再输入。用于缩小模型文件的FP8和GGUF量化版本最低到2位和1.25位格式,README称1.8B模型经1.25位量化后存储空间约为440MB。运行需要开启trust_remote_code(会执行模型仓库中代码的设置)的transformers 5.6.0及以上版本,或从源码构建的vLLM和SGLang,README还说明在llama.cpp中使用低位格式需要拉取请求22836中的STQ内核。可通过LLaMA-Factory和DeepSpeed进行LoRA或全量微调,训练说明要求1.8B使用1张24GB以上的GPU,7B的LoRA使用1张80GB GPU,30B使用8张80GB GPU。用于评估指令遵循翻译的IFMTBench也以CC-BY-4.0公开,以规则和LLM评分评估6类约束。根据LICENSE.txt,模型许可证为Apache 2.0,README中的性能对比数据此次未能独立核实。
许可证
自定义许可 自定义或非标准许可。复用前请阅读许可证文件。
同领域的其他仓库
- Ebony-Vinyl/dsh-our-free-model
这是把dsh智能体连接到外部模型服务的插件,并不在本地运行模型权重。它把对话、工具结果和可选图像发送到上游网关,接收回答或工具调用。适配器会刷新模型目录、探测可用性,并把多种响应协议转换为宿主的流式格式。它还提供供其他程序调用的OpenAI兼容本地转发服务和本地用量记录。开始使用需要兼容的dsh宿主、受支持的Node.js运行环境和网络连接。Kilo官方允许匿名调用免费模型,但会按IP限制请求次数。OpenCode路径还会模拟客户端识别信息,因此不能把所有路径都视为官方支持的公共API,需要单独审查授权和服务条款。其他账号渠道和桌面EAC渠道需要各自的登录或授权,免费网关也不能被视为无限量、私有或适合敏感生产数据的服务。 - deepseek-ai/DeepGEMM
面向语言模型计算的CUDA张量核心内核库,包括矩阵乘法和融合MoE。通过DeepJIT在运行时编译内核。 - Edge0-AI/Edge0
Edge0是使用SSD专家卸载、Recover-LoRA和路由预测的流式MoE推理框架。README区分了已发布的平台引擎与计划于2026年第四季度推出的统一框架。 - Vibra-Ingenn/Janus
这是一个单一的Go可执行文件,在本机运行gguf模型,通过llama.cpp使用AMD、Intel、NVIDIA显卡的Vulkan,并可回退到CPU,同时提供与OpenAI兼容的API,包括chat completions和models。它支持不重启热切换模型、把推理内容拆分到单独字段,并从gguf元数据读取chat template,无需Python和Docker。 - magnitudedev/magnitude
这是在用户硬件上编译和调优内核的智能体推理引擎。它在Apple Silicon、NVIDIA、AMD或CPU上运行开放模型,并通过桌面应用和CLI连接现有智能体。
只收录进入 Trendshift 排行榜的仓库,榜单仅用于寻找候选项目,不转载名次。说明、许可证和星标数来自各 GitHub 仓库。解读是我们自己的判断。我们尚未测试这些项目,上榜并不证明质量。