Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
이기종 GPU 클러스터에서 대규모 언어모델 서빙을 관리하는 오픈소스 플랫폼이다. vLLM, SGLang 등 주요 추론 엔진을 통합해 NVIDIA CUDA, Huawei Ascend, AMD ROCm 등 서로 다른 GPU 하드웨어를 하나의 클러스터로 묶어 운영할 수 있다. Qwen, DeepSeek, Llama 등 인기 오픈소스 모델을 몇 번의 클릭만으로 배포할 수 있으며, OpenAI 호환 API를 제공해 기존 애플리케이션과의 연동이 간단하다. on-demand SSH 접속이 가능한 GPU 인스턴스 기능도 함께 제공해, 기업이 자체 인프라에서 모델 서빙과 개발 환경 운영을 동시에 처리할 수 있게 돕는다.
huggingface
SOTA 기계학습 모델을 위한 오픈소스 모델 정의 프레임워크
google-gemini
터미널에서 Gemini AI를 사용하는 Google 공식 CLI 에이전트
rasbt
PyTorch로 ChatGPT 스타일 LLM을 처음부터 구현하는 교육용 자료
punkpeye
LLM 도구 연동 표준 MCP 서버 큐레이션 모음