Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
Intel이 개발한 오픈소스 딥러닝 추론 최적화 툴킷으로, PyTorch·TensorFlow·ONNX·PaddlePaddle·JAX/Flax 등 다양한 프레임워크로 학습된 모델을 원본 프레임워크 없이 변환·컴파일하여 CPU(x86, ARM)·Intel 내장 및 개별 GPU·NPU 등 폭넓은 하드웨어에서 실행할 수 있게 해준다. 모델을 중간 표현(IR)으로 변환한 뒤 대상 디바이스에 맞춰 그래프 최적화·연산자 융합·저정밀 연산 등을 적용해 지연 시간과 메모리 사용량을 줄이는 것이 핵심 구조다. 컴퓨터 비전, 음성 인식뿐 아니라 OpenVINO GenAI API를 통해 LLM·LLaVA류 멀티모달 모델·Whisper 등 생성형 AI 파이프라인도 최적화해 서빙할 수 있으며, 양자화·희소화를 담당하는 NNCF, 확장형 모델 서버인 OpenVINO Model Server(OVMS), Hugging Face 연동용 Optimum Intel, vLLM·ONNX Runtime·LangChain·LlamaIndex 등과의 통합을 포함한 생태계를 갖췄다. C++·Python·C·Node.js API를 제공해 엣지 디바이스부터 클라우드까지 동일한 코드로 배포 가능하다는 점이 차별점이며, Apache-2.0 라이선스로 공개되어 있다.

ollama
로컬 LLM을 쉽게 실행하는 도구

ggml-org
C/C++로 작성된 로컬 LLM 추론 엔진

exo-explore
일상 기기를 AI 클러스터로 연결하는 분산 추론 플랫폼
mozilla-ai
단일 파일 하나로 LLM을 설치 없이 즉시 실행하는 배포 도구