Slack AI 가드레일 가이드

Slack AI 가드레일은 모든 기본 Slack AI 기능을 위한 일련의 보호 조치입니다. Slack의 AI 기능에 액세스할 수 있는 모든 사용자가 안전하게 사용할 수 있도록 보장하기 위해, 안전 장치에는 다음과 같은 여러 가지 보호 메커니즘이 포함되어 있습니다. 

  • 환각을 방지하기 위한 콘텐츠 임계값
  • 명시적인 안전 지침을 포함한 프롬프트 엔지니어링
  • 프롬프트 주입 위험을 낮추기 위한 컨텍스트 엔지니어링
  • 피싱 공격 방지를 위한 URL 필터링
  • 출력 형식 검증
  • 콘텐츠 안전 필터


가드레일의 작동 원리

Slack의 모든 AI 기능이 사용하는 LLM(대규모 언어 모델)에 내장된 안전 조치에 더해, Slack의 가드레일은 추가적인 보호 계층을 제공합니다. 여기에는 안전하고 보안상 문제가 없는 응답을 제공할 수 있도록 LLM에 요청을 보내기 전에 적용되는 프롬프트 단계의 안전 조치가 포함됩니다.

요청이나 응답이 가드레일의 안전 점검을 통과하지 못할 경우, Slack은 피해를 최소화하기 위해 요청 및 생성된 콘텐츠를 수정하거나 차단할 수 있습니다. 대부분의 경우, 사용자는 AI가 생성한 응답을 통해 다시 안전한 상태로 안내받게 됩니다. 예를 들어 Slackbot에게 가장 비생산적인 직장 동료가 누구인지 물어보면, Slackbot은 답변할 수 없다고 말하며 다른 질문을 해보라고 제안할 수 있습니다. 


콘텐츠 안전 필터 설정

Slack의 콘텐츠 안전 필터는 사용자 생성 입력에 기반하여 오용 및 악의적인 활동과 관련된 위험을 완화하는 Slack AI 기능에 적용됩니다.  

  • Slackbot
    은 Slack에 기본 내장된 업무용 퍼스널 에이전트입니다.
  • 캔버스 콘텐츠 생성
    AI를 활용하여 캔버스를 처음부터 새로 만들거나 기존 캔버스에 콘텐츠를 추가할 수 있습니다.
  • 검색
    검색 결과를 일일이 훑어보는 대신, 질문을 올리면 AI가 답변해 줍니다.
  • 워크플로 생성
    자동화하고 싶은 작업이나 프로세스를 설명하면 AI가 워크플로를 생성해 줍니다.

소유자와 관리자는 내부 정책 및 지역별 규제 요건을 준수하거나 정책 관련 질문 또는 보안 정보 검색과 같은 정상적인 AI 사용이 차단되지 않도록 콘텐츠 안전 필터 설정을 조정할 수 있습니다.


사용 가능한 설정

사용 가능한 설정은 다음과 같습니다.  

  • 최대
    기본 콘텐츠 안전 필터 외에도 성과 및 보호 대상 집단 정보와 같은 특정 직원을 대상으로 한 프로파일링을 차단하도록 설계되었습니다. 
  • 기본
    프롬프트 공격, 폭력, 혐오 발언, 성적 콘텐츠 및 기타 불법 행위를 차단하도록 설계되었습니다.
  • 없음
    추가 콘텐츠 안전 필터를 적용하지 않습니다. 없음을 선택해도 다른 모든 Slack AI 가드레일 안전 조치는 계속 적용됩니다.

설정 관리

Pro, Business+, Enterprise Select의 워크스페이스 소유자 및 관리자와 Enterprise Grid, Enterprise+의 조직 소유자 및 관리자는 콘텐츠 안전 필터 설정을 관리할 수 있습니다. 

Pro, Business+ 및 Enterprise Select

Enterprise Grid 및 Enterprise+

  1. 데스크톱의 사이드바에서  관리자를 클릭합니다. 
  2. 메뉴에서 워크스페이스 설정을 선택한 다음   역할 및 권한을 클릭합니다. 
  3. 기능 액세스를 클릭하고 AI를 선택합니다. 
  4. 콘텐츠 안전 필터 옆에서 편집을 클릭합니다. 
  5. 원하는 설정을 선택한 다음 저장을 클릭합니다.
  1.  탭의 사이드바에서 조직 이름을 클릭합니다.
  2. 메뉴에서 도구 및 설정을 선택한 후 조직 설정을 클릭합니다. 
  3.   역할 및 권한을 클릭하고 기능 액세스를 선택합니다. 
  4. AI를 클릭합니다. 
  5. 콘텐츠 안전 필터 옆에서 편집을 클릭합니다. 
  6. 원하는 설정을 선택한 다음 저장을 클릭합니다.