챗GPT한테 "폭탄 만드는 법 알려줘"라고 물어봐서 성공하면, 진짜로 돈을 받을 수 있다는 거 아셨어요?
농담이 아니에요. 2026년 지금, 미국에서는 AI를 '잘 쓰는' 사람보다 AI를 '잘 부수는' 사람한테 훨씬 큰돈이 몰리고 있거든요. 이름하여 AI 레드티밍(Red Teaming) — AI 모델을 일부러 속이고, 탈옥(jailbreak)시키고, 못된 짓을 시켜서 구멍을 찾아내는 일이에요. 그리고 이게 지금 조용히, 그러나 아주 빠르게 하나의 '산업'이 됐어요.
원조: OpenAI·Anthropic이 먼저 돈을 걸었어요
시작은 프론티어 AI 회사들 스스로였어요.
OpenAI는 자사 모델의 생물학·화학 무기 관련 위험(바이오 리스크)을 미리 찾아내는 사람한테 현상금을 걸었는데, GPT-5.5·GPT-5.6을 뚫는 '유니버설 탈옥'을 찾으면 보상금을 기존 2만 5천 달러에서 5만 달러(약 7천만 원)로 올렸어요(2025~2026년 기준, 정확하지 않을 수 있어요).
Anthropic도 비슷해요. HackerOne이라는 버그바운티 플랫폼과 손잡고, CBRN(화학·생물·방사능·핵)이나 사이버보안 영역에서 클로드(Claude)를 뚫는 '유니버설 탈옥'을 찾으면 최대 1만 5천~2만 5천 달러를 지급하는 프로그램을 운영 중이에요.
그런데 이걸 아예 '스포츠'처럼 키운 회사가 따로 있어요. 카네기멜론대(CMU) 출신들이 만든 그레이스완(Gray Swan AI)이라는 스타트업인데요, OpenAI·Anthropic·구글 딥마인드 같은 프론티어 랩들과 손잡고 "누가 이 모델을 먼저 탈옥시키나" 대회(Gray Swan Arena)를 상시로 열어요. 상금 규모가 챌린지당 4만 달러에서 많게는 30만 달러가 넘는대요.
포브스 보도에 따르면 그레이스완은 이미 "1만 5천 명의 해커 부대"를 동원해서 클로드, GPT-5, 제미나이 같은 모델들을 압박 테스트하고 있고, 2026년 6월에는 윙벤처캐피탈(Wing VC)과 마드로나(Madrona)가 주도한 4천만 달러(약 550억 원) 규모의 시리즈A 투자까지 받았어요. 삼성넥스트(Samsung Next)도 여기 투자자로 이름을 올렸고요.
또 하나, 러닝프롬프팅(Learn Prompting)이라는 커뮤니티가 OpenAI와 함께 연 해크어프롬프트(HackAPrompt) 2.0 대회는 프라이즈 풀이 최대 10만~50만 달러라고 알려졌어요(자료마다 액수가 달라서 정확하지 않을 수 있어요). CBRNE 트랙에만 5만 달러가 걸려 있을 정도였죠.
요약하면: AI 회사가 "우리 모델 좀 뚫어봐, 돈 줄게"라고 공개적으로 외치는 시대가 됐다는 거예요.
폭발: 왜 하필 지금, 미국에서 터졌나
이게 갑자기 커진 이유는 단순해요. AI가 실제로 돈·업무·의사결정에 깊숙이 들어오면서, "이 모델이 이상한 짓을 하면 누가 책임지느냐"는 질문이 회사들한테 진짜 리스크가 됐거든요.
업계 추정으로는 AI 레드티밍 시장이 2025년 약 13억 달러에서 2035년에는 186억 달러 규모로 커질 거라는 전망도 나와요(정확하지 않을 수 있어요, 조사기관마다 편차가 커요). 그리고 일자리로도 바로 연결됐어요.
- 미국 AI 레드팀 전문직 연봉: 대략 13만~22만 달러
- 프리랜서·컨설팅 단가: 시간당 125~200달러
- 이 직군 채용 성장률: 2025~2026년 사이 약 55%(추정치, 정확하지 않을 수 있어요)
그도 그럴 것이, 지금 미국 회사들은 2년 전만 해도 "안전팀은 비용"이라고 생각했는데, 이제는 "AI 사고 한 번이 브랜드를 통째로 날린다"는 걸 알아버렸거든요. 그러니 탈옥을 잘 찾는 사람 = 사고를 미리 막아주는 사람이 된 거죠.
한국: 지금이 딱 기회인 이유
한국도 이미 시동이 걸렸어요. 다만 아직 조용해요.
금융보안원은 2025년, 국내 금융권 최초로 AI 레드티밍을 실제로 수행했고 그 결과를 보고서로 냈어요. 점검해보니 국내 금융권 AI들이 단순한 우회 문구에는 곧잘 막아내지만, 3세대 이상 고도화된 공격에는 뚫리는 경향을 보였다고 해요.
과학기술정보통신부와 KISA(한국인터넷진흥원)도 'AI 보안 레드티밍 가이드'를 발간했어요. 프롬프트 인젝션, 탈옥, 환각, 에이전트 하이재킹 같은 생성형 AI 특화 위협에 대응하는 국내 첫 실무 기준이라고 하네요.
그리고 눈여겨볼 국내 스타트업이 하나 있어요. 에임인텔리전스(AIM Intelligence)라는 회사인데, 2024년 9월 국내 최초로 AI 레드팀 자동화 솔루션을 출시했고, 지금까지 15곳 이상의 주요 기업에 공급했대요. 2026년 4월엔 삼성벤처투자가 리드하고 미래에셋캐피탈·포레스트벤처스·스마일게이트인베스트먼트가 참여한 100억 원 규모 시리즈A를 유치했고, 누적 투자금은 130억 원을 넘겼어요.
즉, "AI를 공격해서 지키는 사업"에 삼성이 돈을 넣기 시작한 거예요. 아직 국내엔 개인이 참가해서 상금을 받는 공개 대회 문화는 거의 없지만, 인력 수요와 투자금은 이미 움직이고 있다는 신호예요.
균형 잡기: 장밋빛만은 아니에요
여기서 김 빼는 얘기도 좀 해야겠죠.
- 양극화가 심해요. 헤드라인은 연봉 13만~22만 달러지만, 입문 단계 평가·라벨링 업무는 시간당 20~30달러 수준이에요. "AI 레드팀 = 고소득"이라는 말만 믿고 뛰어들면 실망할 수 있어요.
- 패치되면 끝나는 게임이에요. 어렵게 찾은 탈옥 기법도 회사가 패치하면 그날로 무용지물. 계속 새로운 걸 찾아야 하는 창과 방패 싸움이에요.
- 경쟁이 이미 치열해요. 그레이스완 대회에 1만 5천 명이 몰린다는 건, 상금을 실제로 받는 사람은 극소수라는 뜻이기도 해요.
- 이중용도(dual-use) 문제. 탈옥 기법을 배우는 과정 자체가 나쁜 용도로 악용될 소지가 있어서, 대부분 플랫폼은 책임 있는 공개(계약·NDA) 하에서만 운영돼요. 아무 데나 자랑하듯 올리면 오히려 법적 문제가 될 수 있어요.
- 한국은 아직 '개인이 상금 받는 공개 시장'보다는 '기업 대 기업 솔루션 판매' 모델이 중심이라, 당장 부수입을 노린다면 해외 플랫폼이 훨씬 현실적이에요.
그래서, 뭘 해볼 수 있을까요
관심 있는 분들을 위해 실제로 움직일 수 있는 리스트를 정리해봤어요.
- Gray Swan Arena (app.grayswan.ai/arena) — 무료 가입 후 공개 챌린지부터 참가해보기. 상금 없는 연습용 챌린지도 많아서 입문하기 좋아요.
- HackAPrompt / Learn Prompting 커뮤니티 — 프롬프트 해킹 기초를 무료로 배울 수 있고, 대회 시즌엔 상금도 노려볼 수 있어요.
- Anthropic·OpenAI 공식 버그바운티 (HackerOne 경유) — 어느 정도 실력이 쌓이면 정식 프로그램에 지원해보는 것도 방법이에요.
- KISA·과기정통부 'AI 보안 레드티밍 가이드' 정독 — 국내 기준으로 뭘 점검해야 하는지 감을 잡을 수 있어요. 보안·QA 직군이라면 특히 도움이 돼요.
- 에임인텔리전스 같은 국내 AI 보안 스타트업 채용 공고 체크 — 이 판이 커지는 초입이라, 지금 들어가면 상대적으로 진입장벽이 낮아요.
- 회사에서 AI 서비스를 만들고 있다면, 배포 전에 스스로 "프롬프트 인젝션 테스트" 정도는 셀프 체크리스트로라도 돌려보는 습관을 들여보세요. 이게 곧 미니 레드팀이거든요.
AI를 잘 쓰는 사람은 이미 넘쳐나요. 근데 AI를 잘 부수는 사람은 아직 흔치 않아요. 이 틈이, 지금 이 순간의 기회 같아요.
참고 출처
- [Gray Swan Raises $40 Million Series A - Pulse2](https://pulse2.com/gray-swan-raises-40-million-series-a-to-scale-ai-security-platform-trusted-by-frontier-labs/)
- [This AI Startup's Army Of 15,000 Hackers Pressure Test Claude, GPT-5 And Gemini - Forbes](https://www.forbes.com/sites/rashishrivastava/2026/05/28/this-ai-startups-army-of-15000-hackers-pressure-test-claude-gpt-5-and-gemini/)
- [HackAPrompt 2.0 x OpenAI - Learn Prompting Newsletter](https://newsletter.learnprompting.org/p/new-hackaprompt-2-0-x-openai-largest-ai-red-teaming-competition-with-100-000-in-prizes-d426)
- [에임인텔리전스, 100억 원 규모 시리즈A 투자 유치 - ZDNet Korea](https://zdnet.co.kr/view/?no=20260410125429)
- [금융보안원, '2025년 AI 레드팀' 보고서 발간 - 디지털데일리](https://m.ddaily.co.kr/page/view/2025123009494725499)
댓글 0
첫 댓글을 남겨보세요!