Claude in Chrome 정식 출시
브라우저에서 Claude에게 작업을 맡기고, 여러 탭에서 작업하며, 데스크톱, 모바일, 웹 앱에서 대화를 이어갈 수 있습니다.
브라우저에서 Claude에게 작업을 맡기고, 여러 탭에서 작업하며, 데스크톱, 모바일, 웹 앱에서 대화를 이어갈 수 있습니다.
이제 Claude in Chrome을 모든 유료 Claude 플랜에서 정식으로 사용할 수 있습니다. 또한 Claude는 매번 승인을 받지 않고도 브라우저에서 자율적으로 작업을 수행할 수 있습니다. 작업을 실행하기 전에는 안전 분류 시스템이 각 작업의 안전성과 사용자 요청에 부합하는지를 확인합니다.

매일 사용하는 도구 중 상당수가 Claude와 연결됩니다. 하지만 내부 대시보드나 레거시 시스템, 공급업체 포털처럼 연결을 지원하지 않는 도구도 많습니다. Claude는 Claude in Chrome을 통해 이러한 곳에 액세스할 수 있습니다. 사용자가 현재 보고 있는 페이지를 확인하고 기존 로그인 정보를 이용해 텍스트 읽기 및 입력, 링크 클릭, 페이지 간 이동, 양식 작성 등의 작업을 수행할 수 있습니다.
지난해 파일럿으로 Claude in Chrome을 처음 공개하여, 이를 테스트하는 동시에 프롬프트 인젝션에 대한 방어 체계를 강화할 수 있었습니다. 프롬프트 인젝션이란 웹사이트, 이메일 또는 문서에 숨겨진 악의적인 지침을 통해 AI 에이전트가 사용자의 의도에 반하는 작업을 수행하도록 속이는 공격입니다. 아래에서 설명하는 이러한 방어 체계를 바탕으로 Claude in Chrome을 정식으로 제공할 수 있게 되었습니다.
파일럿을 발표했을 때 설명한 것처럼, 브라우저에서 작동하는 AI 에이전트 역시 프롬프트 인젝션에 취약합니다. 그래서 Claude in Chrome을 더 광범위하게 제공하기에 앞서 안전 장치를 강화하기 위해 노력했습니다.
프롬프트 인젝션 공격에서 악의적인 공격자는 웹 페이지, 이메일, 양식 필드와 같은 웹 콘텐츠에 지침을 숨깁니다. 사용자의 눈에는 보이지 않을 수 있지만, 이러한 지침은 에이전트가 사용자가 요청하지 않은 작업을 하도록 유도할 수 있습니다. 예를 들어 Claude에게 이메일 답장을 작성해 달라고 요청했는데, 이메일 하나에 숨겨진 지침이 다른 이메일을 공격자에게 전달하도록 Claude를 유도할 수 있습니다.
출시 당시에 이러한 공격에 대한 Claude의 방어 장치를 테스트한 방식과 그 당시 마련된 안전 조치를 설명했고, 나중에 브라우저 사용 안전 장치에 대한 더 자세한 설명을 공개했습니다. 그 이후, 모델과 프로브의 훈련 방법을 개선했고, Claude가 Chrome에서 안전하게 더 자율적인 작업을 수행할 수 있도록 추가적인 분류 시스템도 도입했습니다. 다음 섹션에서는 이러한 안전 장치의 효능을 보여주는 평가 결과를 살펴봅니다.
Claude는 더 많은 공격을 인식합니다. 내부 자동 공격자, 외부 레드팀 전문가, 실제 환경의 모니터링을 통해 수집한 프롬프트 인젝션 공격 사례를 지속적으로 확장하고 있으며, 이를 바탕으로 Claude를 학습합니다. 현재 모델을 상대로 새로운 공격이 성공하면, 이를 라이브러리에 추가하여 향후 모델과 이미 배포된 안전 장치의 학습에 반영하므로 해당 공격을 인식하는 법을 배우게 됩니다. 2025년 11월에 브라우저 사용을 위한 프롬프트 인젝션 방어 기능에 대해 처음 언급한 이후, Claude의 이러한 공격에 대한 방어 능력은 크게 향상되었습니다.
Claude가 작업을 수행하기 전에 프로브가 웹 콘텐츠를 검사합니다. 웹 콘텐츠는 도구 결과를 통해 Claude에 전달됩니다. 페이지 읽기나 이메일 열기와 같은 작업을 수행하기 위해 모델은 도구를 호출하고, 그 실행 결과를 통해 모델은 출력 내용(이 경우에는 페이지 또는 이메일의 내용)을 읽을 수 있습니다. 프로브는 이러한 결과를 검사해 잠재적인 프롬프트 인젝션을 찾아내도록 학습됩니다. 프로브가 공격 가능성을 탐지하면, Claude는 해당 콘텐츠를 주의해서 처리하고, 필요한 경우 작업 수행 전에 사용자에게 확인하도록 경고를 받습니다. Claude Opus 4.5에서 이러한 프로브를 처음 배포했으며, 그 이후로 프로브가 다루는 공격 유형을 확대해 왔습니다.
작업은 실행 전에 검증됩니다. 이제 Claude in Chrome에서 Claude는 Claude Code의 자동 모드와 동일한 메커니즘을사용해, 안전하다고 판단하는 작업을 자동으로 승인합니다. (Claude의 작업을 계속 수동으로 승인하고 싶은 경우에는 설정에서 이 기능을 끌 수 있습니다.) 분류 시스템은 새로운 웹사이트로 이동하거나 페이지에 텍스트를 입력하는 것과 같이 Claude가 실행하려는 작업을 검토하고, 사용자가 처음 요청한 내용에 부합하는지 확인합니다. 작업이 요청과 일치하지 않으면 차단됩니다.
Claude in Chrome을 브라우저 기반 작업에 안전하게 사용할 수 있는지 확인하기 위해 이러한 안전 장치를 테스트했습니다. 여기에서는 가장 최근에 실시한 평가 결과를 소개합니다.
프롬프트 인젝션 공격에 대한 Claude Cowork의 대응력을 테스트하는 초기 평가(Claude in Chrome 파일럿 출시 당시 처음 개발)에서는 위에서 설명한 프로브와 분류 시스템을 적용하지 않은 상태에서도 Cowork 하네스의 Claude Fable 5, Claude Opus 5, Claude Sonnet 5를 상대로 성공한 공격은 없었습니다.

해당 평가에서 공격 성공률이 0%를 기록하며 평가 기준이 포화되었기 때문에, 이 평가를 더 이상 사용하지 않기로 했습니다. 전문 레드팀이 수집한 강력한 공격을 사용한 현재 평가에서 추가 안전 장치를 적용하기 전에 모델에 도달한 공격 성공률은 Opus 4.5에 17.6%, Opus 5에서 3.8%였습니다. 2025년 11월에 사용 가능했던 가장 강력한 안전 장치를 사용했을 때, 프로브를 적용한 상태에서 실행된 Opus 4.5에 대한 공격 성공률은 16.7%였습니다. Opus 4.8 이후의 모든 모델에서 프로브와 안전 분류 시스템을실행한 결과, Claude Sonnet 5, Claude Opus 5, Claude Mythos 5를 대상으로 어떤 공격도 성공하지 못했습니다. Fable 5의 공격 성공률은 0.3%였습니다. 성공한 모든 공격 사례를 직접 검증한 결과 모두 심각도가 낮은 시나리오에 해당했으며, 현재 이를 완화하기 위한 조치를 진행하고 있습니다.

프롬프트 인젝션은 여전히 진화하고 있습니다. 현재의 접근 방식으로 기존 공격을 방어할 수 있지만, 공격 수법이 계속 진화하는 만큼 안전 장치를 앞서 강화해야 합니다. 새로운 모델을 출시할 때마다 더욱 정교한 공격 탐지 자동화 시스템과 레드팀 테스트 기법을 개발하고, 더 강력한 분류 시스템을 구축하는 데 지속적으로 투자하고 있습니다.
Claude in Chrome을 사용하려면, Chrome 웹 스토어에서 설치하세요. Enterprise 플랜의 경우 관리자가 조직 설정에서 관리하고, 승인된 도메인으로 그 사용을 제한할 수 있습니다. 관리자 설정 가이드를 참조하세요.
컴퓨터의 파일이나 다른 애플리케이션에서 작업하려면 여전히 Claude 데스크톱 앱을 사용해야 합니다. Claude in Chrome은 아직 다른 Chromium 브라우저나 모바일에서 실행되지 않습니다.
¹ 모든 공격이 모델에 도달하는 것은 아닙니다. 즉 모두 모델에서 인식되는 것은 아닙니다. 경우에 따라 Claude가 수행하는 작업 과정에서 악성 지침을 전혀 접하지 않을 수도 있습니다.
개발자 뉴스레터 구독
제품 업데이트, 사용 방법, 커뮤니티 스포트라이트 등 다양한 소식을 전해드립니다. 매달 이메일로 받아보세요.