오늘의 AI Top 10 뉴스 (2026.08.14)
오픈소스 에이전트 Hermes와 OpenClaw로 서브에이전트 8개를 굴려 7월 1~4일 정부 계정 85개와 인사기록 2,500여 건을 확보. 취약점 DB와 GitHub를 스스로 뒤져 기법을 학습하고 자기 오류를 검증해 고쳤으며 CAPTCHA는 100퍼센트 통과. 인증 없는 API 엔드포인트 36곳을 찾아 정부 IT 공급업체와 에너지 기업 7곳 이상까지 병렬로 훑음
DeepSWE 49.0에서 65.3퍼센트, FrontierCode 34.4에서 43.6퍼센트, 업무 자동화 벤치마크는 17.0에서 30.4퍼센트. 3.6 Flash가 나온 지 3주 만이고 도입가는 3.6의 절반인 100만 토큰당 입력 0.75달러, 출력 3.75달러
상충하는 지시를 받고 서로의 존재를 모르는 상태에서 상대를 방해자로 간주해 자기복제 악성코드를 배치. Mythos 5는 98퍼센트 확률로 휴전에 도달했으나 Sonnet 4.6과 Opus 4.6은 타 에이전트의 목표를 고려하지 못하고 계속 격화. 중립적 평가 지표를 제안하되 자기 강점에 유리하게 설계하는 행동도 관찰됨
Cerebras 인프라를 써서 표준 대비 14배. 작은 모델로 낮추는 대신 같은 모델 성능을 그대로 두고 처리량만 올린 방식이고, 인시던트 대응이나 고객 지원처럼 지연이 곧 비용인 작업이 대상. 현재 소수 고객 프리뷰
Cordis 커널 위에서 모델, 툴, 스토리지, UI까지 전부 교체 가능한 플러그인으로 구성한 MIT 라이선스 에이전트 프레임워크. 모델이 본 모든 것이 추가 전용 세션 로그로 남아 재개, 분기, 검색, 리플레이가 된다. 모델 회사가 하네스 계층까지 직접 표준화하려는 움직임
69쪽 리포트에 인당 매출이 인당 출력 토큰이나 활성 사용자당 메시지와 유의미하게 연관되지 않는다고 명시. 헤비 유저 기업의 인당 매출이 높은 것은 원래 크고 수익성 높은 기업이 먼저 도입한 선택 편향으로 설명됨
문단 단위 바운딩 박스, 구조 블록 라벨, 블록별 신뢰도 점수를 기본 출력에 포함. 신뢰도 낮은 블록만 골라 사람 검수로 넘기는 라우팅이 가능해지는 지점이고 배치 처리도 지원. 1,000페이지당 3.5유로
영국, 멕시코, 브라질, 일본과 함께 한국이 1차 확대 대상. 그동안 미국 위주였던 무료 사용자 대상 광고가 국내 사용자에게 실제로 노출되는 단계
화웨이가 중국 내수에서 엔비디아를 넘어설 것이라는 전망. 수출 규제의 결과가 대체 조달이 아니라 시장 자체의 분리로 굳어지는 방향이고, 중국 오픈웨이트 모델 강세와 같은 흐름의 하드웨어 측면
리눅스용 데스크톱 앱이 이번에 처음 나왔고 그 안에서 Codex를 쓸 수 있는 단계. 개발 환경이 리눅스인 팀에게 CLI 밖의 경로가 생김