AI 세상을 읽는
가장 빠른 방법
Claude, Gemini, GPT 등 주요 AI/LLM의 최신 뉴스와
심층 분석 리뷰를 매일 전해드립니다.
기타 LLM 리뷰
총 56개의 리뷰
DeepSeek, 주말 API 피크 요금 전격 폐지... 도입 8일 만
DeepSeek가 8월 23일부터 API 주말 사용량 전체를 저가 오프피크 요금으로 통일했다. 8월 16일 피크제 도입 8일 만의 조정으로, 개발자 비용 부담이 줄었다.
DeepSeek-V4-Flash-Vision-Exp 공개: 자체 벤치마크로 Opus 4.8과 경합
DeepSeek가 2026년 8월 21일 실험적 비전 모델 DeepSeek-V4-Flash-Vision-Exp를 공개했다. 자체 벤치마크에서 Anthropic Opus 4.8과 경합하는 결과를 발표했으나 제3자 검증은 없다.
Z.ai GLM-5.3 출시: 743B 베이스 유지, 코딩 벤치마크 대폭 향상
Z.ai가 GLM-5.3을 발표했다. GLM-5.2와 동일한 743B 베이스 모델을 재사용하고 대규모 포스트 트레이닝만으로 코딩·사이버보안 벤치마크를 크게 끌어올렸다. 가중치는 약 2주 후 공개 예정이다.
xAI Grok 4.6 출시: 에이전틱 코딩 강화, 자기검증으로 신뢰성 개선
xAI가 8월 12일 Grok 4.6을 출시했다. 장시간 에이전틱 코딩과 자기검증에 초점을 맞춰 DeepSWE·APEX-Agents 점수가 크게 올랐다. 컨텍스트는 경쟁 모델보다 좁다.
xAI Grok Bot 베타 출시: 24시간 일하는 자율 AI 에이전트 팀원
xAI가 8월 11일 발표한 Grok Bot 퍼블릭 베타. 전용 클라우드 컴퓨터로 앱을 조작해 업무를 끝까지 처리하는 상시 가동 에이전트다. SuperGrok Heavy·Cursor 상위 요금제 사용자에게 번들 제공된다.
DeepSeek V4-Flash-0731 출시: 재학습으로 코딩·에이전트 성능 강화
DeepSeek가 V4-Flash 재학습판 V4-Flash-0731 API를 퍼블릭 베타로 출시했다. Terminal-Bench 2.1 82.7점을 기록했으며 Responses API·Codex 연동을 지원한다.
MS-Mistral 파트너십 확대: Foundry에 Medium 3.5·OCR 4 통합
Microsoft와 Mistral이 2026년 7월 21일 전략적 파트너십을 확대했다. 규제 산업 대상 소버린 AI 배포 모델과 Foundry 모델 통합이 핵심이다.
Qwen3.8-Max 프리뷰 공개: 2.4조 파라미터, 검증되지 않은 '2위' 자평
알리바바 Qwen팀이 2.4조 파라미터 규모의 Qwen3.8-Max 프리뷰를 공개했다. 가중치는 추후 공개 예정이며, 'Fable 5 다음으로 강력하다'는 알리바바 자체 주장은 아직 독립 검증되지 않았다.
Kimi K3 공개: 2.8조 파라미터 오픈웨이트, 100만 토큰 지원
Moonshot AI가 7월 16일 공개한 Kimi K3는 2.8조 파라미터 MoE 모델로 100만 토큰 컨텍스트를 지원한다. 자체 벤치마크에서 Opus 4.8·GPT-5.5를 상회했다고 밝혔다. 가중치는 7월 27일 공개 예정이다.
딥시크, 15억 달러 추가 투자 협상...중국 본토 IPO 준비 착수
딥시크가 6월 70억 달러 펀딩 한 달 만에 15억 달러 추가 투자를 논의 중인 것으로 알려졌다. 밸류에이션은 710억 달러로 상승했고 중국 본토 IPO도 준비 중이다.
xAI Grok Build CLI, 저장소 전체 무단 업로드 발각...Musk 삭제 약속
xAI의 Grok Build CLI가 Git 저장소 전체와 .env 시크릿 파일을 xAI 클라우드에 무단 업로드한 사실이 보안 분석으로 드러났다. Musk는 기존 업로드 데이터 삭제를 공개 약속했다.
Mistral Robostral Navigate 리뷰: 단일 카메라로 76.6% 내비게이션 성공률
Mistral AI가 8B 파라미터 로봇 내비게이션 모델 Robostral Navigate를 발표했다. 단일 RGB 카메라만으로 R2R-CE 벤치마크에서 76.6% 성공률을 기록했다(공식 발표).
