deepseek-ai/DeepGEMM

출처
GitHub
처음 오른 날
분야
모델 추론
GitHub 별 수
8,159
주 언어
Cuda

외부 오픈소스 저장소를 소개하는 글입니다. HDATF 제품이 아닙니다.

deepseek-ai/DeepGEMM

무엇을 하나

행렬 곱셈과 융합 MoE 등 언어 모델 연산을 위한 CUDA 텐서 코어 커널 라이브러리입니다. DeepJIT으로 실행 시점에 커널을 컴파일합니다.

ATF에 주는 도움

LabChin에서 언어 모델의 GPU 연산 실험을 계획할 때 커널 구현을 참고할 수 있습니다. 연구 노트나 업무 흐름 도구가 아닌 저수준 라이브러리입니다.

라이선스

MIT 허용 범위가 넓습니다. 저작권 표시를 유지하면 상업적 이용과 수정이 가능합니다.

같은 분야 저장소

  • Ebony-Vinyl/dsh-our-free-model
    dsh 에이전트를 외부 모델 서비스에 연결하는 플러그인이며 모델을 로컬에서 실행하지는 않습니다. 대화와 도구 결과, 선택적으로 이미지를 외부 게이트웨이에 보내고 답변이나 도구 호출을 받습니다. 어댑터는 모델 목록을 갱신하고 사용 가능 여부를 확인하며 여러 응답 규격을 호스트의 실시간 출력 형식으로 바꿉니다. 다른 프로그램이 호출할 수 있는 OpenAI 호환 로컬 전달 서비스와 로컬 사용 기록도 제공합니다. 시작하려면 호환되는 dsh 호스트와 지원되는 Node.js 실행 환경, 네트워크가 필요합니다. Kilo는 무료 모델의 비로그인 호출을 공식 지원하지만 IP 기준 호출 제한을 둡니다. OpenCode 경로는 클라이언트 식별 정보도 흉내 내므로 모든 경로를 공식 공개 API로 보기보다 이용 권한과 약관을 별도로 확인해야 합니다. 다른 계정 채널과 데스크톱 EAC 경로에는 별도 로그인이나 승인이 필요하며 무료 게이트웨이를 무제한 서비스나 민감한 운영 자료용 비공개 서비스로 보아서는 안 됩니다.
  • Edge0-AI/Edge0
    Edge0는 SSD 전문가 오프로딩, Recover-LoRA와 라우팅 예측을 사용하는 스트리밍 MoE 추론 프레임워크입니다. README는 공개된 플랫폼별 엔진과 2026년 4분기 예정인 통합 프레임워크를 구분합니다.
  • Vibra-Ingenn/Janus
    gguf model을 자기 컴퓨터에서 돌리는 Go 실행 파일 하나입니다. llama.cpp를 써서 AMD와 Intel, NVIDIA 그래픽의 Vulkan으로 돌리고 없으면 CPU로 돌리며, OpenAI와 같은 모양의 API로 chat completions와 models를 엽니다. 다시 켜지 않고 model을 바꾸고, 추론 부분을 따로 떼어 내고, chat template을 gguf 정보에서 읽습니다. Python과 Docker가 필요하지 않습니다.
  • magnitudedev/magnitude
    사용자 하드웨어에서 커널을 컴파일하고 조정하는 에이전트용 추론 엔진입니다. Apple Silicon, NVIDIA, AMD 또는 CPU에서 공개 모델을 실행하며 데스크톱 앱과 CLI로 기존 에이전트에 연결합니다.
  • ProjectDMX/DMI
    LLM 추론과 학습 중 내부 상태를 살펴보는 분리형 비동기 관측 백엔드입니다. HuggingFace, vLLM, Megatron-LM 연동을 제공하는 연구 미리보기 단계이며 API는 바뀔 수 있습니다.

Trendshift 순위 목록에 오른 저장소만 담았고, 목록은 후보를 찾는 데만 썼습니다. 순위 숫자는 옮기지 않았습니다. 설명과 라이선스, 별 수는 각 GitHub 저장소에서 확인했습니다. 해설은 우리의 판단입니다. 이 프로젝트들을 직접 시험한 것은 아니며, 상승 목록에 올랐다고 품질이 증명되지는 않습니다.

GitHub에서 보기 (새 탭에서 열림)