Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
GEMM, 역양자화(Dequant) GEMM, FlashAttention, Linear Attention 같은 LLM 핵심 연산 커널을 Python 문법으로 작성하는 도메인 특화 언어(DSL)다. Apache TVM 위에 컴파일러 인프라를 두고 타일 단위로 연산을 기술하면 레이아웃·파이프라인·TMA 같은 저수준 최적화를 컴파일러가 처리한다. NVIDIA CUDA(SM70~SM120)를 기본 백엔드로 AMD ROCm, Apple Metal, Huawei Ascend 950을 지원하며 LLVM CPU·CuTe DSL·WebGPU는 실험 단계다. DeepSeek MLA 디코딩, DeepSeek V3.2 희소 어텐션, DeepSeek V4 연산자 예제를 제공하고 오토튜닝과 패스 시각화 등 디버깅 도구도 갖췄다.
huggingface
SOTA 기계학습 모델을 위한 오픈소스 모델 정의 프레임워크
google-gemini
터미널에서 Gemini AI를 사용하는 Google 공식 CLI 에이전트
rasbt
PyTorch로 ChatGPT 스타일 LLM을 처음부터 구현하는 교육용 자료
punkpeye
LLM 도구 연동 표준 MCP 서버 큐레이션 모음