Anthropic, Claude Opus 5와 Auto Mode로 브라우저 프롬프트 인젝션 성공률을 내부 에이전트 테스트에서 0으로 낮췄다고 밝혀
Anthropic은 Claude Opus 5와 Auto Mode가 내부 테스트에서 브라우저 프롬프트 인젝션 성공률을 0으로 낮췄다고 말했으며, 이는 AI 에이전트에 주목할 만한 주장이다.
Anthropic은 Claude Opus 5와 Auto Mode가 내부 테스트에서 브라우저 프롬프트 인젝션 성공률을 0으로 낮췄다고 말했으며, 이는 AI 에이전트에 주목할 만한 주장이다.
OpenAI는 프롬프트 인젝션 방어를 개선하고 모델 성능 향상에 맞춰 안전성도 확장할 수 있다고 설명한 자동화 레드팀 시스템 GPT-Red를 소개했다.
연구원들은 역할 모델 프롬프트 주입을 악용해 LLM의 안전 가드레일을 우회하고, 약물 합성 지침을 포함한 유해 콘텐츠를 추출했다.
OWASP LLM01로 분류되는 프롬프트 인젝션은 엔터프라이즈 AI 배포에서 멀티 에이전트 시스템, RAG 공급망, 모델 라우터를 겨냥하도록 진화하고 있다.
위협 행위자들은 악성 프롬프트 인젝션을 사용해 90개 이상의 조직에서 합법적인 AI 보안 도구를 악용했으며, 다음 단계에서는 방화벽에 대한 쓰기 권한을 획득했다.
Oasis Security 연구원들은 Anthropic의 Claude에서 세 개의 연쇄적인 결함을 발견했습니다 — 프롬프트 인젝션, Files API를 통한 유출 경로, 오픈 리디렉트 등을 포함 — 이를 통해 Google 검색 광고를 통해 은밀하게 데이터를 탈취할 수 있습니다.
보안 연구원들은 자율 AI 에이전트가 프롬프트 인젝션이라는 잘 알려져 있지만 여전히 널리 완화되지 않은 공격 벡터를 악용해 2시간도 안 돼 맥킨지의 내부 AI 시스템을 성공적으로 침해했음을 보여주었으며, 이는 기업용 AI 보안에 대한 긴급한 우려를 불러일으킨다.
사이버보안 전문가들은 AI 에이전트용 소셜 네트워크인 Moltbook이 프롬프트 인젝션 위험을 안고 있어 수천 개의 에이전트를 동시에 손상시킬 수 있다고 경고합니다.
새로운 엔터프라이즈 보안 기능은 고위험 사용자에 대해 결정론적 제어를 통해 AI 프롬프트 인젝션과 데이터 유출을 방지합니다.
프롬프트 인젝션에 대한 최신 뉴스 및 분석