Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
PicoLM은 C11 약 2,500줄로 작성된 최소 구성의 LLM 추론 엔진으로, 512MB 안팎의 싱글보드 컴퓨터에서 10억 파라미터 모델을 돌리는 것을 목표로 합니다. 638MB짜리 GGUF 모델을 메모리에 통째로 올리지 않고 mmap으로 매핑해 OS가 레이어 단위로 페이지인하도록 만들어, 실행 중 RAM 사용량을 FP16 KV 캐시를 포함해 약 45MB로 유지합니다. 바이너리는 약 80KB이고 libc, libm, libpthread 외에는 의존성이 없어 라즈베리파이 제로 2W나 RISC-V 보드인 Sipeed LicheeRV Nano에서도 빌드됩니다. Sipeed의 Go 기반 경량 에이전트 PicoClaw가 로컬 LLM 백엔드로 이 엔진을 호출하는 구조를 함께 제공합니다.

ollama
로컬 LLM을 쉽게 실행하는 도구

ggml-org
C/C++로 작성된 로컬 LLM 추론 엔진

exo-explore
일상 기기를 AI 클러스터로 연결하는 분산 추론 플랫폼
mozilla-ai
단일 파일 하나로 LLM을 설치 없이 즉시 실행하는 배포 도구