오늘의 AI Top 10 뉴스 (2026.09.04)
어제까지는 "critical 임계를 넘어 안전장치 강화 후 출시" 예고 단계였고 오늘 실제 롤아웃 개시. ARC-AGI-3 98.6%(직전 모델 7.8%), ExploitBench 전 문제 해결, FrontierMath Tier 4 97.6%. 역대 최대 훈련 런이며 기업 고객 우선 배포, 가격은 직전 세대의 2배
recurrent-depth 방식은 사고 과정이 텍스트로 남지 않아, 체인오브소트를 읽어 위험을 감시하던 기존 안전 전략의 전제가 무너짐. 성능을 올린 구조 변경이 곧바로 감시 가능성을 낮춘 사례
오픈웨이트 중형 모델이 전용 하드웨어에서 대화형 지연을 사실상 없앰. 모델 크기 선택 기준이 성능에서 추론 속도로 옮겨가는 지점
서로 다른 3사 서비스가 같은 시간대에 중단되며 공통 인프라 의존 의혹 제기. 각사 상태 페이지는 개별 장애로 공지했으나 AI 스택 전반의 단일 장애점 문제가 실증된 사건
AI IDE 약관이 제품 이용 정지가 아니라 지메일·드라이브를 포함한 Google 계정 전체 정지 권한을 담고 있음. 개발 도구 채택 시 실제로 확인해야 할 리스크
단일 모델이 아니라 역할이 분담된 모델 묶음을 함께 배포하는 구성. 하나를 키우는 대신 여러 개를 엮는 오픈웨이트 진영의 아키텍처 실험
텍스트 워터마크 기반 검증을 규제기관·언론·팩트체커에 개방. 탐지를 서드파티 추정 도구에 맡기지 않고 사업자가 직접 인프라로 제공하는 첫 사례
소스도 문서도 없는 레거시 바이너리를 어셈블리 수준에서 해석해 현대 엔진으로 옮긴 실사례. 마이그레이션에서 LLM이 다룰 수 있는 코드의 하한을 구체적으로 보여줌
미국 최대 공립 학군의 행정명령으로 8학년까지 적용. 교육 현장 AI 도입 확대 흐름에 대한 첫 대규모 역행 조치
학습된 신경망 내부에 명시적 기호 연산에 대응하는 구조가 설계 없이 자발적으로 형성된다는 분석. 해석가능성 연구가 기댈 수 있는 내부 표현의 근거를 제시