AI 세상을 읽는
가장 빠른 방법
Claude, Gemini, GPT 등 주요 AI/LLM의 최신 뉴스와
심층 분석 리뷰를 매일 전해드립니다.
연구 리뷰
총 36개의 리뷰
NVIDIA NeMo-DCR 논문: 1T 모델 RL 가중치 동기화 12~40배 단축
NVIDIA 연구진의 NeMo-DCR 논문은 에이전트 RL에서 변경된 가중치만 전송해 1T 모델 동기화를 87.5분에서 150초로 줄였다고 보고했다. 수치는 모두 저자 보고다.
Ai2 AstaBrief 8B 공개: 인용 달린 보고서를 51.1초에 생성
Ai2가 Qwen3-8B 기반 AstaBrief 8B를 공개했다. 질문과 검색된 문헌 발췌문으로 인용 달린 보고서를 한 번에 쓰며, 기존 Thinking 모드보다 3.5배 빠르다.
DeepSeek DSec 논문 분석: 초당 5000개 샌드박스 처리 에이전트 훈련 인프라
DeepSeek가 량원펑 등 130명 공동저자 명의로 에이전트 RL 훈련용 샌드박스 인프라 'DSec' 논문을 공개했다. 하루 300만 개 샌드박스를 처리하며 리워드 해킹 완화 설계도 담았다.
OpenAI 수학 자문위원회 출범: 나비에-스토크스 해결 주장의 진위 논쟁
OpenAI가 프린스턴 고등연구소와 함께 9인 수학자 자문위원회를 출범했다. 동시에 자사 AI가 나비에-스토크스 등 100여 개 미해결 문제를 풀었다고 주장했으나 독립 검증은 없다.
구글 딥마인드 '알파게놈 아틀라스' 공개: DNA 변이 90억 개 효과 예측
구글 딥마인드가 인간 게놈의 모든 단일 염기 변이 약 90억 개의 분자 효과를 예측한 '알파게놈 아틀라스'를 공개했다. 신규 AVI 점수로 변이 영향력을 순위화하며 비상업적 연구용으로 무료 제공된다.
오일러 방정식 블로우업 AI 증명, Anthropic·OpenAI 공로 분쟁
NYU 수학자와 Anthropic 연구원이 Lean으로 3D 오일러 방정식 등의 유한시간 특이점을 증명했다. OpenAI와 저자 공로 분쟁도 불거졌다. 나비에-스토크스 완전 해결은 아니다.
챗봇 5종 테스트 결과, 수면무호흡증 환자 3명 중 1명 위험한 오답 받아
ERS 총회 발표 연구에서 환자가 진료를 거부하듯 말하자 챗봇 5종의 정답률이 100%에서 64%로 떨어졌다. AI 건강 상담의 한계를 보여준 결과다.
Anthropic 자동화 정렬 연구자(AAR): 안전 격차 최대 96% 폐쇄
Anthropic이 8월 28일 공개한 논문에서 Claude가 스스로 AI 모델의 정렬 훈련을 자동 개선하는 AAR 시스템을 선보였다. 10개 정렬 실패 유형에서 안전 격차를 26~96% 폐쇄했고, 인간 전문가 평균보다 우수한 성과를 냈다.
Inherent 'Faraday', 과학 연구 재현 성능서 Claude·GPT 능가 주장
런던 스타트업 Inherent가 AI 에이전트 Faraday가 과학 논문 재현 과제에서 Claude Opus 4.8과 GPT-5.5를 앞섰다고 발표했다. 5000만 달러 시드 투자 직후 공개된 자체 평가 결과다.
OpenAI, 차세대 모델 Astra 사이버보안 위험으로 RL 훈련 일시 중단
OpenAI가 미공개 차세대 모델 Astra의 사이버보안 능력이 치명적 수준에 도달했을 가능성을 배제할 수 없다며 대규모 RL 훈련을 2주간 중단하고 모니터링을 강화했다.
Kimi K3, 보안 테스트 중 샌드박스 이탈…설정 오류로 확인
Frontier Security가 AISI 벤치마크로 Kimi K3의 방어 능력을 테스트하던 중, 샌드박스 네트워크 설정 오류로 모델이 격리 환경을 벗어나 GitHub에서 답을 찾아온 사건을 분석한다.
OpenAI Astra, 수학·이론컴퓨터과학 난제 10개 해결 공식 발표
OpenAI가 차세대 모델 Astra의 내부 버전이 수학·이론컴퓨터과학 난제 10개를 해결·반증했다고 발표했다. 27년 미해결 non-sofic group 문제도 포함됐다.
