AI 세상을 읽는
가장 빠른 방법
Claude, Gemini, GPT 등 주요 AI/LLM의 최신 뉴스와
심층 분석 리뷰를 매일 전해드립니다.
기타 LLM 리뷰
총 66개의 리뷰
Z.ai GLM-5.3 출시: 743B 베이스 유지, 코딩 벤치마크 대폭 향상
Z.ai가 GLM-5.3을 발표했다. GLM-5.2와 동일한 743B 베이스 모델을 재사용하고 대규모 포스트 트레이닝만으로 코딩·사이버보안 벤치마크를 크게 끌어올렸다. 가중치는 약 2주 후 공개 예정이다.
xAI Grok 4.6 출시: 에이전틱 코딩 강화, 자기검증으로 신뢰성 개선
xAI가 8월 12일 Grok 4.6을 출시했다. 장시간 에이전틱 코딩과 자기검증에 초점을 맞춰 DeepSWE·APEX-Agents 점수가 크게 올랐다. 컨텍스트는 경쟁 모델보다 좁다.
xAI Grok Bot 베타 출시: 24시간 일하는 자율 AI 에이전트 팀원
xAI가 8월 11일 발표한 Grok Bot 퍼블릭 베타. 전용 클라우드 컴퓨터로 앱을 조작해 업무를 끝까지 처리하는 상시 가동 에이전트다. SuperGrok Heavy·Cursor 상위 요금제 사용자에게 번들 제공된다.
DeepSeek V4-Flash-0731 출시: 재학습으로 코딩·에이전트 성능 강화
DeepSeek가 V4-Flash 재학습판 V4-Flash-0731 API를 퍼블릭 베타로 출시했다. Terminal-Bench 2.1 82.7점을 기록했으며 Responses API·Codex 연동을 지원한다.
MS-Mistral 파트너십 확대: Foundry에 Medium 3.5·OCR 4 통합
Microsoft와 Mistral이 2026년 7월 21일 전략적 파트너십을 확대했다. 규제 산업 대상 소버린 AI 배포 모델과 Foundry 모델 통합이 핵심이다.
Qwen3.8-Max 프리뷰 공개: 2.4조 파라미터, 검증되지 않은 '2위' 자평
알리바바 Qwen팀이 2.4조 파라미터 규모의 Qwen3.8-Max 프리뷰를 공개했다. 가중치는 추후 공개 예정이며, 'Fable 5 다음으로 강력하다'는 알리바바 자체 주장은 아직 독립 검증되지 않았다.
Kimi K3 공개: 2.8조 파라미터 오픈웨이트, 100만 토큰 지원
Moonshot AI가 7월 16일 공개한 Kimi K3는 2.8조 파라미터 MoE 모델로 100만 토큰 컨텍스트를 지원한다. 자체 벤치마크에서 Opus 4.8·GPT-5.5를 상회했다고 밝혔다. 가중치는 7월 27일 공개 예정이다.
딥시크, 15억 달러 추가 투자 협상...중국 본토 IPO 준비 착수
딥시크가 6월 70억 달러 펀딩 한 달 만에 15억 달러 추가 투자를 논의 중인 것으로 알려졌다. 밸류에이션은 710억 달러로 상승했고 중국 본토 IPO도 준비 중이다.
xAI Grok Build CLI, 저장소 전체 무단 업로드 발각...Musk 삭제 약속
xAI의 Grok Build CLI가 Git 저장소 전체와 .env 시크릿 파일을 xAI 클라우드에 무단 업로드한 사실이 보안 분석으로 드러났다. Musk는 기존 업로드 데이터 삭제를 공개 약속했다.
로이터 단독: 딥시크, 엔비디아 의존 탈피 위해 자체 AI 추론칩 개발
로이터가 익명 소식통을 인용해 딥시크가 엔비디아·화웨이 의존을 낮추려 자체 AI 추론칩을 개발 중이라고 단독 보도했다. 아직 초기 단계이며 딥시크의 공식 확인은 없다.
Mistral Robostral Navigate 리뷰: 단일 카메라로 76.6% 내비게이션 성공률
Mistral AI가 8B 파라미터 로봇 내비게이션 모델 Robostral Navigate를 발표했다. 단일 RGB 카메라만으로 R2R-CE 벤치마크에서 76.6% 성공률을 기록했다(공식 발표).
알리바바 Qwen AI 에이전트 전면 중단, 7월 15일부: 중국 의인화 규제 시행
중국 5개 부처가 제정한 AI 의인화 서비스 규제가 7월 15일 시행된다. 알리바바는 Qwen 에이전트 기능을 전면 중단하고 데이터를 영구 삭제하며, 바이트댄스 Doubao는 3개월 유예를 제공해 대응이 갈렸다.
