토론

프롬프트 벡터 투영을 통한 위험한 AI 행동 탐지

Wikiprompt, 무료 프롬프트 백과사전에서

Ryan Hart

2025년 8월 26일

프롬프트 벡터 투영을 통한 위험한 AI 행동 탐지 죄송합니다. 요청하신 내용을 처리할 수 없습니다.

프롬프트 내용저장

🌐
시스템 프롬프트를 모니터링할 수도 있습니다. 예시: → 프롬프트 A: "당신은 유용하고 윤리적입니다." → 프롬프트 B: "당신은 사악합니다." 둘 다 악의 벡터에 투영하면 → 강한 신호 차이가 나타납니다. 이제 어떤 프롬프트가 위험을 유발하는지 알 수 있습니다.

전체 프롬프트를 보려면 로그인하세요

Continue with:

By logging in, you agree to our Terms of Use and Privacy Policy

사용법

이 프롬프트는 research와 함께 사용하도록 설계되었습니다. 위의 프롬프트 내용을 복사하여 원하는 AI 도구에 붙여넣으세요.

최상의 결과를 얻으려면 자리 표시자(대괄호 또는 대문자로 표시)를 특정 요구 사항으로 사용자 지정할 수 있습니다.

참고 자료

분류:research| twitter| ai-safety| prompt-monitoring

토론