AI 세상을 읽는
가장 빠른 방법
Claude, Gemini, GPT 등 주요 AI/LLM의 최신 뉴스와
심층 분석 리뷰를 매일 전해드립니다.
AI 분석 리뷰
총 522개의 리뷰
Claude Code, 자동화 '루틴' 기능과 데스크톱 앱 전면 개편 동시 발표
Anthropic이 2026년 4월 14일 Claude Code에 반복 자동화 기능 '루틴(Routines)'과 대규모 데스크톱 앱 리디자인을 동시 공개했다. 루틴은 원격 인프라에서 스케줄 실행되며, 개발자의 로컬 환경 의존성을 제거한다.
OpenAI, ChatGPT $100 Pro 플랜 출시: Codex 5배 제공으로 Claude Max에 정면 도전
OpenAI가 2026년 4월 9일 월 100달러짜리 새 ChatGPT Pro 플랜을 출시했다. $20 Plus와 $200 Pro 사이 공백을 채우며, Codex 사용량 5배를 제공해 Anthropic의 Claude Max를 직접 겨냥한다.
Stanford AI Index 2026: 미중 AI 격차 소멸, 생성AI 53% 글로벌 도달
Stanford HAI의 AI Index 2026 보고서에 따르면 미중 AI 모델 성능 격차가 2.7%로 사실상 소멸됐다. 생성AI는 3년 내 전 세계 인구 53%에 도달했고, SWE-bench 코딩 점수는 1년 새 60%에서 100% 근접까지 치솟았다.
Gemini Robotics-ER 1.6 출시: 로봇 시각·공간 추론 혁신, 계기 판독 93% 정확도
Google DeepMind가 2026년 4월 14일 Gemini Robotics-ER 1.6을 공개했다. 향상된 공간 추론으로 로봇의 물체 계수, 계기 판독, 작업 계획 능력이 개선됐으며, 에이전틱 비전 활성화 시 계기 판독 정확도 93%를 달성했다.
OpenAI GPT-5.4-Cyber 공개: 사이버 보안 전문 AI, 바이너리 역공학 지원
OpenAI가 2026년 4월 15일 사이버 보안 전문 모델 GPT-5.4-Cyber를 발표했다. 방어적 보안에 특화된 이 모델은 바이너리 역공학, 취약점 분석을 지원하며 TAC 프로그램을 통해 수천 명의 검증된 보안 전문가에게 제공된다.
Claude Code Review 출시: 멀티에이전트로 PR의 54%에서 버그 발견
Anthropic이 Claude Code에 자율 PR 코드 리뷰 기능을 출시했다. 멀티에이전트 병렬 분석으로 대형 PR(1000줄+)의 84%에서 평균 7.5개 문제를 발견하며, 팀·엔터프라이즈 플랜 연구 프리뷰로 이용 가능하다.
GPT-6 'Spud' 출시 카운트다운: 프리트레이닝 완료 후 4월 내 78% 확률
OpenAI의 차세대 플래그십 모델 GPT-6(코드명 'Spud')이 3월 24일 프리트레이닝을 완료하고 출시 대기 중이다. Sam Altman은 '수주 내 출시'를 예고했으며 Polymarket 예측 시장에서 4월 30일 이전 출시 확률은 78%로 나타나고 있다.
Google Chrome에 Gemini AI Skills 추가: 재사용 가능한 AI 워크플로우 시대
Google이 Chrome 브라우저에 Gemini 기반 'Skills' 기능을 도입했다. 자주 쓰는 AI 프롬프트를 저장하고 어느 웹페이지에서나 단축키로 재실행할 수 있어 AI 브라우저 에이전트화가 본격화됐다.
Mistral Small 4 출시: 추론·비전·코딩 통합 멀티모달 모델, Apache 2.0 오픈소스
Mistral AI가 3월 16일 Mistral Small 4를 출시했다. 119B MoE 구조에 256K 컨텍스트를 갖추며 추론(Magistral), 비전(Pixtral), 코딩(Devstral) 기능을 단일 모델로 통합해 Apache 2.0 오픈소스로 공개됐다.
OpenAI Responses API, 쉘 도구·컨테이너 환경 추가: 에이전트 런타임 완성
OpenAI가 Responses API에 쉘 도구, 호스팅 컨테이너, 에이전트 실행 루프, 재사용 가능한 스킬을 추가했다. GPT-5.2 이상 모델이 Unix 쉘 명령을 실행하고 격리된 Debian 환경에서 장기 작업을 처리할 수 있게 됐다.
Claude Opus 4.6, LMSYS 아레나 텍스트·코딩·검색 3관왕 달성
Anthropic의 Claude Opus 4.6이 LMSYS Chatbot Arena 리더보드에서 텍스트·코딩·검색 3개 부문 동시 1위를 달성했다. 아레나 Elo 1504를 기록하며 GPT-5.4와 Gemini 3.1 Pro를 제치고 2개월 이상 정상을 유지 중이다.
인도 AI 굴기: Sarvam AI $350M 유치, 주권 AI 모델 경쟁 본격화
인도 AI 스타트업 Sarvam AI가 $350M 투자를 유치하며 기업 가치 $1.55B을 달성했다. 인도 정부의 12개 주권 AI 모델 지원과 맞물려 미중을 넘어선 제3의 AI 세력으로 부상하고 있다.
