AI 세상을 읽는
가장 빠른 방법
Claude, Gemini, GPT 등 주요 AI/LLM의 최신 뉴스와
심층 분석 리뷰를 매일 전해드립니다.
오픈소스 리뷰
총 34개의 리뷰
Google EmbeddingGemma 2 공개: 5개 모달리티를 한 공간에, Apache 2.0
Google DeepMind가 2026년 10월 6일 EmbeddingGemma 2를 공개했다. 텍스트·이미지·오디오·비디오·코드를 하나의 임베딩 공간에 매핑하는 Apache 2.0 오픈 모델이다.
Reflection AI Beam 발표: 501B 희소 MoE 오픈웨이트 모델, 가중치는 공개 예정
Reflection AI가 2026년 10월 5일 첫 오픈웨이트 모델 Beam을 발표했다. 총 501B, 활성 23B의 희소 MoE이며 Apache 2.0 가중치는 10월 중 공개 예정이다. 벤치마크는 자체 보고다.
Ai2 Olmo-core 3: 오픈 MoE 학습 스택, B300 처리량 2.7배
Ai2가 대형 MoE 모델 학습용 오픈 스택 Olmo-core 3를 공개했다. 8개 B300에서 47B MoE 처리량이 19,400에서 52,000 tokens/s로 올랐다고 밝혔다. 대규모 학습 인프라 팀에 유용하다.
Perplexity pplx-embed-v2-context-9b-preview: 근거 청크까지 찾는 임베딩
Perplexity가 문서 맥락 속에서 청크를 인코딩하는 컨텍스트 임베딩 모델을 MIT 라이선스로 공개했다. 정답과 근거 청크를 함께 검색하도록 학습했으며 RAG 개발자에게 유용하다.
Google Gemma 오픈모델 다운로드 10억 건 돌파, 변형 10만 종 확산
Google이 Gemma 오픈모델 누적 다운로드 10억 건 돌파를 공식 발표했다(2026-08-20). 커뮤니티 변형 모델 10만 종 이상, 우주·헬스케어·암 연구 등에 활용된다.
엔비디아 Nemotron 3.5 Lightning 출시: 30B 경량모델+NeMo Switchyard
엔비디아가 30B(활성 3B) 파라미터 경량 오픈모델 Nemotron 3.5 Lightning과 자동 모델 라우팅 라이브러리 NeMo Switchyard를 공개했다. 단일 GPU로 구동 가능한 에이전트용 모델이다.
Meta Muse Glimmer 출시: 24GB GPU 한 대로 돌리는 로컬 에이전트 모델
Meta Superintelligence Labs가 30B 파라미터 오픈소스 모델 Muse Glimmer를 Apache 2.0으로 공개했다. 4bit 양자화로 소비자용 GPU 한 장에서 로컬 에이전트 워크플로우를 지원한다.
Inkling-Small 출시: 276B 오픈웨이트 멀티모달 MoE 모델 분석
Thinking Machines Lab이 276B 파라미터 오픈웨이트 모델 Inkling-Small을 공개했다. 상위 모델 Inkling보다 코딩·추론 벤치마크는 앞섰지만 사실성 벤치마크는 하락했다.
MCP 새 스펙 2026-07-28 발표: Stateful에서 Stateless 코어로 전환
MCP의 다섯 번째 스펙 2026-07-28이 공개됐다. 양방향 stateful 구조를 버리고 stateless 코어로 전환해 서버리스·엣지 배포를 지원하지만 하위 호환은 깨진다.
VIDraft Aether-7B-5Attn 리뷰: 데이터·코드까지 공개한 국산 오픈소스 LLM
한국 스타트업 VIDraft가 5종 이종 어텐션을 결합한 Aether-7B-5Attn을 공개했다. 학습 데이터·코드·체크포인트까지 전부 오픈해 재현 가능성을 극대화했다.
알리바바 T-Head, AI칩 스택 SAIL 오픈소스 공개…탈CUDA 시동
알리바바 칩 설계 자회사 T-Head가 자사 Zhenwu AI칩용 소프트웨어 스택 SAIL을 WAIC 2026에서 오픈소스로 공개했다. 엔비디아 CUDA 의존 탈피가 목표다.
Robbyant LingBot-VA 2.0 오픈소스 공개: 로봇 제어 추론 6.5배 가속
Ant Group 산하 Robbyant가 로봇 조작용 인과적 비디오-액션 모델 LingBot-VA 2.0을 오픈소스로 공개했다. RoboTwin 2.0에서 평균 93.6% 성공률, 추론 속도는 6.5배 향상됐다(공식 발표).
