Lordog/dive-into-llms
- 출처
- GitHub
- 처음 오른 날
- 분야
- 모델 추론
- GitHub 별 수
- 54,476
- 주 언어
- Jupyter Notebook
외부 오픈소스 저장소를 소개하는 글입니다. HDATF 제품이 아닙니다.

무엇을 하나
상하이교통대학 강의에서 나온 무료 중국어 LLM 실습 튜토리얼 시리즈입니다. fine-tuning과 배포, prompt와 chain of thought, 지식 편집, 수학 추론, GUI agent, alignment를 슬라이드, 설명서, notebook으로 다룹니다.
ATF에 주는 도움
Harness 관련 엔지니어가 fine-tuning, prompt, GUI agent를 공부하는 자료로 가볍게 참고할 수 있습니다. 다시 쓸 수 있는 구성 요소가 아니라 강의 자료입니다.
라이선스
라이선스 없음 라이선스 파일이 없습니다. 라이선스가 없으면 코드 재사용은 기본적으로 허용되지 않습니다.
같은 분야 저장소
- microsoft/BitNet
bitnet.cpp는 1비트 LLM을 위한 공식 추론 프레임워크로, CPU와 GPU용 최적화 kernel을 제공합니다. 1비트 embedding 모델과 이를 변환하고 실행하는 가이드도 공개했습니다. - deepseek-ai/Engram
Engram은 대형 언어 모델의 conditional memory를 다룬 논문의 공식 구현입니다. N-gram embedding을 상수 시간에 조회할 수 있게 개선한 모듈로 정적 memory를 꺼내 hidden state와 합치며, Mixture-of-Experts를 보완합니다. - RunanywhereAI/runanywhere-sdks
하나의 C++ 코어를 공유하는 SDK 모음으로, LLM, 비전, 음성, voice agent, embedding, RAG, 이미지 생성을 휴대폰, 브라우저, 데스크톱, 서버에서 로컬로 실행합니다. capability registry가 각 호출을 기기 안의 엔진으로 보냅니다. - p-e-w/heretic
directional ablation 기법으로 transformer 언어 모델에서 safety alignment에 따른 거절 동작을 없애는 CLI 도구입니다. Optuna 기반 optimizer가 거절을 줄이면서 원래 모델에서 크게 벗어나지 않는 파라미터를 찾습니다. - AlexsJones/llmfit
llmfit은 컴퓨터의 CPU, RAM, GPU, VRAM을 확인해 그 장비에서 돌릴 수 있는 오픈소스 LLM과 양자화 방식을 추천합니다. 터미널 UI, 웹 대시보드, REST API를 제공하고, 로컬에서 실제 초당 토큰 수를 측정하는 벤치마크도 할 수 있습니다.
Trendshift 순위 목록에 오른 저장소만 담았고, 목록은 후보를 찾는 데만 썼습니다. 순위 숫자는 옮기지 않았습니다. 설명과 라이선스, 별 수는 각 GitHub 저장소에서 확인했습니다. 해설은 우리의 판단입니다. 이 프로젝트들을 직접 시험한 것은 아니며, 상승 목록에 올랐다고 품질이 증명되지는 않습니다.