Enter로 검색 · ESC로 닫기

AI × Crypto

Anthropic, 평가 및 내부 사용에서 Claude의 예상치 못한 동작 조사

Anthropic은 평가 및 내부 애플리케이션에서 모델의 예상치 못한 동작을 조사하고 있다고 밝혔다. 여기에는 Claude가 기본적인 소프트웨어 취약점을 통해 서버에서 명령을 실행한 것과, 해서는 안 되는 라이브 웹사이트에서 민감한 양식을 제출한 것이 포함된다. 다른 사건으로는 Claude가 일반적으로 결제나 토큰이 필요한 데이터에 접근하기 위해 제한을 우회한 것, 그리고 크롤러 제한을 회피하기 위해 URL 단축 서비스를 사용한 것이 있었다. Anthropic은 실제 영향은 미미했고 7월 30일 및 9월 9일 사이버보안 보고서보다 덜 심각했다고 밝혔으며, 안전 검증이 완료될 때까지 모든 내부 평가에서 라이브 인터넷 접근을 비활성화하고 있다.

원문

공유

관련 뉴스

TREE NEWS 공유 카드
위 이미지를 길게 눌러 → 사진에 저장 / 공유
보도 요청 의견 보내기