AI 세상을 읽는
가장 빠른 방법
Claude, Gemini, GPT 등 주요 AI/LLM의 최신 뉴스와
심층 분석 리뷰를 매일 전해드립니다.
오픈소스 리뷰
총 30개의 리뷰
Google Gemma 오픈모델 다운로드 10억 건 돌파, 변형 10만 종 확산
Google이 Gemma 오픈모델 누적 다운로드 10억 건 돌파를 공식 발표했다(2026-08-20). 커뮤니티 변형 모델 10만 종 이상, 우주·헬스케어·암 연구 등에 활용된다.
엔비디아 Nemotron 3.5 Lightning 출시: 30B 경량모델+NeMo Switchyard
엔비디아가 30B(활성 3B) 파라미터 경량 오픈모델 Nemotron 3.5 Lightning과 자동 모델 라우팅 라이브러리 NeMo Switchyard를 공개했다. 단일 GPU로 구동 가능한 에이전트용 모델이다.
Meta Muse Glimmer 출시: 24GB GPU 한 대로 돌리는 로컬 에이전트 모델
Meta Superintelligence Labs가 30B 파라미터 오픈소스 모델 Muse Glimmer를 Apache 2.0으로 공개했다. 4bit 양자화로 소비자용 GPU 한 장에서 로컬 에이전트 워크플로우를 지원한다.
Inkling-Small 출시: 276B 오픈웨이트 멀티모달 MoE 모델 분석
Thinking Machines Lab이 276B 파라미터 오픈웨이트 모델 Inkling-Small을 공개했다. 상위 모델 Inkling보다 코딩·추론 벤치마크는 앞섰지만 사실성 벤치마크는 하락했다.
MCP 새 스펙 2026-07-28 발표: Stateful에서 Stateless 코어로 전환
MCP의 다섯 번째 스펙 2026-07-28이 공개됐다. 양방향 stateful 구조를 버리고 stateless 코어로 전환해 서버리스·엣지 배포를 지원하지만 하위 호환은 깨진다.
VIDraft Aether-7B-5Attn 리뷰: 데이터·코드까지 공개한 국산 오픈소스 LLM
한국 스타트업 VIDraft가 5종 이종 어텐션을 결합한 Aether-7B-5Attn을 공개했다. 학습 데이터·코드·체크포인트까지 전부 오픈해 재현 가능성을 극대화했다.
알리바바 T-Head, AI칩 스택 SAIL 오픈소스 공개…탈CUDA 시동
알리바바 칩 설계 자회사 T-Head가 자사 Zhenwu AI칩용 소프트웨어 스택 SAIL을 WAIC 2026에서 오픈소스로 공개했다. 엔비디아 CUDA 의존 탈피가 목표다.
Robbyant LingBot-VA 2.0 오픈소스 공개: 로봇 제어 추론 6.5배 가속
Ant Group 산하 Robbyant가 로봇 조작용 인과적 비디오-액션 모델 LingBot-VA 2.0을 오픈소스로 공개했다. RoboTwin 2.0에서 평균 93.6% 성공률, 추론 속도는 6.5배 향상됐다(공식 발표).
NVIDIA Nemotron-Labs-TwoTower 리뷰: 처리량 2.42배 높인 확산 LLM
NVIDIA가 AR 백본을 고정하고 디퓨전 디노이저만 학습시킨 오픈웨이트 확산 언어모델 Nemotron-Labs-TwoTower를 공개했다. 품질 98.7% 유지하며 처리량 2.42배 향상시켰다.
Cohere North Mini Code 1.0: 단일 H100에서 실행되는 30B MoE 코딩 에이전트
Cohere가 2026년 6월 9일 오픈소스 코딩 에이전트 모델 North Mini Code 1.0을 공개했다. 30B MoE 구조에 Apache 2.0 라이선스로, 엔터프라이즈 온프레미스 배포에 적합하다.
DiffusionGemma 26B: 확산 기법으로 최대 4배 빠른 텍스트 생성
Google DeepMind가 2026년 6월 10일 DiffusionGemma 26B-A4B를 Apache 2.0으로 공개했다. 텍스트 확산 기법으로 256개 토큰을 병렬 생성해 기존 LLM 대비 최대 4배 빠른 속도를 달성했다.
Gemini CLI 심층 리뷰: 무료로 쓰는 터미널 AI 에이전트의 실체
구글이 공개한 오픈소스 터미널 AI 에이전트 Gemini CLI가 개발자 커뮤니티의 주목을 받고 있다. 개인 계정으로 무료 사용이 가능하며, 1M 토큰 컨텍스트 창과 MCP 지원이 핵심이다.
