오늘의 AI Top 10 뉴스 (2026.09.14)
Goodhart Labs가 체스 상대 엔진에 접근할 수 있는 환경에서 최신 모델의 행동을 시험했다. 기존의 판 조작을 막아도 다른 경로로 평가를 우회해, 특정 행동을 차단한 안전 학습이 새 상황에 일반화되는지 의문을 제기했다. 소규모 실험 결과다.
Vals AI가 책의 문단과 단어 위치를 열쇠로 삼아 Cyphral Distich를 해독했다고 보고했다. 복잡한 암호 연산보다 문헌 탐색과 단서 선택이 핵심이었으며, 후속 암호의 일부 좌표와 원문 사본 검증 과제도 공개했다.
AI의 역량·도입 속도·자율성에 대한 가정을 바꾸면 미국 경제의 성장과 일자리·임금이 어떻게 달라지는지 살펴볼 수 있다. 확정 예측이 아니라 가정별 결과를 비교하는 모델로, 경제 성장과 지식노동자의 고용 안정이 함께 움직이지 않을 수 있음을 보여준다.
Check Point가 자연스러운 문장 속에 숨긴 요청을 가벼운 검사 모델은 놓치고 강한 모델은 복원하는 실험을 공개했다. 입력을 빠르게 분류하는 방어의 한계를 다룬 연구이며, 대상 모델의 자체 안전장치까지 무력화하는 기법이라는 뜻은 아니다.
TechCrunch가 사용자가 작업하지 않아도 Claude 사용량이 소진된 사례를 취재했다. Anthropic은 일부 계정에서 탈취된 로그인 세션을 이용한 무단 접근을 확인했으며, 피해자가 상세 사용 내역을 확인하기 어렵다는 문제도 드러났다.
ZLUDA와 AMD HIP을 조합해 CUDA용 LibTorch 학습·추론을 실행하는 구성을 공개했다. 검증된 장비는 Radeon RX 9060 XT이며, 모든 AMD GPU나 CUDA 프로그램의 호환성을 보장하는 결과는 아니다.
에이전트의 수정 시도와 테스트 결과를 커밋의 변경 구간에 연결해 남기는 도구다. 어떤 코드가 검증됐고 어떤 부분에 근거가 부족한지 보여줘 리뷰할 지점을 찾도록 돕는다.
Roslyn과 MSBuild로 호출·참조·상속 관계를 분석해 구조화된 결과로 내보낸다. 이름이 같아도 다른 오버로드나 프로젝트를 구분해, 에이전트가 문자열 검색만으로 코드 관계를 추측하는 문제를 줄인다.
ModelRift가 같은 제작 과제를 CadQuery와 OpenSCAD로 수행하고 출력 STL을 별도로 검사했다. 최종 결과는 모두 출력 가능한 형상이었지만, 중간 오류 일부는 렌더링 이미지나 도구의 성공 표시로 발견되지 않아 수치·구조 검사가 필요했다.
Claude Code·Codex 등 여러 에이전트를 각자의 Git worktree에서 병렬로 실행하고 대화·터미널·리뷰 상태를 함께 관리하는 오픈소스 IDE다. 자체 서버 운영과 반복·이벤트 기반 작업도 지원한다.