Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
GPU 워크로드 전용 분산 스토리지 엔진입니다. Rust와 리눅스 io_uring 위에 구현했고, LLM 추론의 KV 캐시 오프로드, 체크포인트 저장, 벡터 인덱스, 학습용 소형 파일 I/O를 하나의 엔진으로 처리합니다. vLLM에는 코드 수정 없이 openlake-vllm 커넥터를 설치하고 --kv-transfer-config로 OpenLakeConnector를 지정하는 방식으로 붙습니다. 저장소가 공개한 측정값은 128K 컨텍스트 캐시 적중 시 TTFT 66배 단축입니다. 다만 RDMA와 GPUDirect Storage 경로는 리눅스 전용이라 macOS는 TCP 모드 개발 환경으로만 지원되며, 벤치마크는 프로젝트 자체 측정치입니다.
huggingface
SOTA 기계학습 모델을 위한 오픈소스 모델 정의 프레임워크
google-gemini
터미널에서 Gemini AI를 사용하는 Google 공식 CLI 에이전트
rasbt
PyTorch로 ChatGPT 스타일 LLM을 처음부터 구현하는 교육용 자료
punkpeye
LLM 도구 연동 표준 MCP 서버 큐레이션 모음