오늘의 AI Top 10 뉴스 (2026.09.13)
다리오 아모데이가 안전 점검이 역량 발전을 따라갈 시간을 확보하자고 제안했다. Anthropic은 외부 평가자를 상주시켜 안전 약속 준수와 학습 과정·사고를 검토하도록 하겠다고 밝혔다.
자신의 컴퓨터와 모델 구독·API 키로 에이전트를 실행하면 기본 월 구독 없이 이용할 수 있게 됐다. 원격 컴퓨터인 orbs 사용료는 별도이며 Enterprise에는 별도 조건이 적용된다.
실제 기업에서 사용한 코드와 청구·세금 계산 같은 업무를 평가 과제로 구성했다. 공개 저장소 문제 풀이를 넘어 회사별 규칙과 여러 서비스를 다루는 능력을 모델과 하네스의 조합으로 측정한다.
같은 네트워크의 컴퓨터를 찾아 모델·엔진 가용성과 작업량에 따라 독립 요청을 보낸다. OpenAI·Ollama 호환 접점을 제공하며, 여러 GPU의 메모리를 합치거나 한 모델을 분할 실행하는 방식은 아니다.
Dan Luu가 Rust로 Zstd를 구현하는 과제에서 퍼징·속성 기반 테스트·형식 검증 등 여러 지시 조건을 비교했다. 기본 지시도 평균 이상 성과를 보여, 특정 기법을 요구하는 것만으로 개선이 보장되지는 않았다.
LiteLLM의 핵심 호출 경로인 제공자 선택·메시지 변환·스트리밍·도구 호출을 작은 라이브러리로 구성했다. 프록시 서버나 캐시·예산 관리·부하분산 기능은 포함하지 않는다.
Claude Code와 Mooncake의 요청 기록을 재생한 실험에서 단순 LRU 기준선을 개선하기 어려웠던 이유를 공개했다. 메모리 압박 상황에서는 오래 쉰 세션보다 짧은 도구 호출 반복이 재계산 비용을 좌우했다고 보고했다.
Earendil이 불필요한 추상화·중복 등 코드 구조의 품질을 평가하는 방법을 검토했다. 기능적 정확성과 유지보수성은 별개이며, LLM에 점수를 매기게 하는 평가도 질문 방식에 흔들릴 수 있다고 지적했다.
미성년 사용 징후가 감지되면 계정을 제한하고 Yoti를 통해 성인 여부를 확인한 뒤 복구할 수 있다고 설명했다. 셀피 연령 추정·신분증·Digital ID 중 선택하며 Anthropic에는 통과 여부만 전달된다.
iPhone 18 Pro의 서명된 센서 데이터로 원본 사진을 확인하는 기능을 공개했다. 생성된 이미지를 사후 탐지하는 방식과 달리, 카메라로 촬영했다는 근거를 남기는 접근이다.