새 AI 도구를 발견했을 때 가장 흔한 경로는 이렇습니다. 무료 체험을 켜고, 혼자 며칠 써보고, 좋아서 팀에 공유하고, 두 달 뒤에 아무도 안 쓰고, 결제는 계속 나갑니다.

MIT가 정리한 수치는 이 감각을 뒷받침합니다. 기업 생성형 AI 파일럿의 약 95%가 확산 단계로 넘어가지 못합니다. RAND의 조사에서는 AI 프로젝트의 80.3%가 측정 가능한 사업 가치를 내지 못했습니다. 실패의 원인은 대개 모델 성능이 아니라 도입 전에 묻지 않은 질문들입니다.

그래서 이 글은 읽는 글이 아니라 쓰는 글입니다. 아래 22개 항목은 이 페이지에서 바로 체크할 수 있습니다. 도구 하나당 10분이면 충분하고, 통과하지 못한 항목이 그대로 도입 리스크 목록이 됩니다.

쓰는 법: 검토 중인 도구를 하나 정하고 위에서부터 체크하세요. 체크 상태는 이 페이지에 머무는 동안 유지됩니다. 팀에 공유할 때는 브라우저 인쇄(PDF로 저장)를 쓰면 체크한 상태 그대로 남습니다.

A. 보안·데이터 (6항목)

가장 먼저 봐야 할 묶음입니다. 여기서 걸리면 나머지는 볼 필요가 없습니다.

B. 법·규제 (5항목)

2026년 기준으로 한국은 AI 기본법이, 유럽은 AI Act가 이미 작동하고 있습니다. 도구를 고르는 단계에서 걸러야 나중에 산출물을 전부 다시 손대는 일이 없습니다.

C. 비용·계약 (5항목)

AI 도구의 청구서는 사람 수가 아니라 사용량을 따라가는 경우가 늘고 있습니다. 도입 전에 상한을 정해두지 않으면 다음 달에 놀라게 됩니다.

D. 정착·운영 (6항목)

파일럿이 죽는 곳이 여기입니다. 도구는 좋은데 쓰는 사람이 없는 상태는, 도구를 잘못 고른 게 아니라 정착을 설계하지 않은 결과입니다.

판정 — 몇 개를 채워야 도입할 만한가

기준은 단순합니다.

  • A(보안) 6개 중 하나라도 미달 → 도입 보류. 다른 항목이 아무리 좋아도 예외를 두지 마세요.
  • B(법) 5개 중 2개 이상 미달 → 법무·개인정보 담당 확인 후 재검토.
  • C·D에서 미달 3개 이하 → 4주 파일럿으로 진행. 미달 항목이 곧 파일럿에서 확인할 목록입니다.
  • D(정착)에서 절반 이상 미달 → 도구 문제가 아니라 준비 문제입니다. 도입을 미루고 업무 정의부터 하세요.
flowchart TD
  S([새 AI 도구 후보]) --> A{A. 보안 6개
전부 통과?} A -- 아니오 --> STOP([도입 보류]) A -- 예 --> B{B. 법 미달
2개 이상?} B -- 예 --> L([법무·개인정보 확인]) B -- 아니오 --> D{D. 정착 절반
이상 미달?} D -- 예 --> P([업무 정의부터 다시]) D -- 아니오 --> GO([4주 파일럿 시작])

이 체크리스트를 한 번 더 쓰는 법

도구를 두 개 이상 비교할 때는 각각 체크해 미달 항목 수를 비교하세요. 기능 비교표보다 훨씬 빠르게 답이 나옵니다. 기능은 대체로 비슷해지지만, 보안 정책과 과금 구조는 서비스마다 크게 다르기 때문입니다.

그리고 도입 6개월 뒤에 같은 항목으로 한 번 더 점검하세요. 특히 C(비용)와 D(정착)는 시간이 지나면 조용히 무너집니다.