AI 코딩 도구

AgentKit를 30일 동안 사용해봤다: $99를 내고 얻은 실제 결과 (2026 케이스 스터디)

2026년 8월 21일10분 읽기

저는 1인 개발 업무에서 AgentKit(Claude Code용 킷, CLI는 ak ― OpenAI의 AgentKit이 아니에요)을 30일 동안 사용했고, Engineer Kit에 $99를 지불했어요. 이건 솔직한 케이스 스터디예요. 0일차 기준값, 측정 방법, 주차별 타임라인, 전후 수치 표, 비용과 ROI, 그리고 제가 잘못 예상했던 부분까지 담았어요. 30일간의 결론은 이미 Claude Code에 익숙한 개발자에게는 살 만하다, 5/5예요. 다만 요술 방망이는 아니고, 첫 주는 속도가 빨라지기 전에 오히려 느려져요.

⚠️ 어느 AgentKit일까요? (이건 OpenAI AgentKit이 「아니에요」)

케이스 스터디에 들어가기 전에, 엉뚱한 글을 읽지 않도록 분명히 해둘게요. "AgentKit"이라고 불리는 건 적어도 두 가지가 있어요.

  • 이 글의 AgentKit = agentkit.best에 있는 Claude Code용 킷으로, ak CLI로 사용해요. 옛 ClaudeKit의 후속작이며(ckak로 바뀌었어요), 108개 이상의 skill과 45개의 agent를 묶어 Claude Code / Codex / Copilot을 "AI 개발·마케팅 팀"으로 바꿔줘요.
  • OpenAI AgentKit = OpenAI의 에이전트 구축 툴킷(Agent Builder, ChatKit)으로, 2025년 10월 6일에 Ramp, Canva 같은 기업 사례와 함께 출시됐어요(OpenAI 출처). 여기서 리뷰하는 것과는 완전히 달라요.

agentkit.today(n8n 워크플로)나 dev.to/agentkit 같은 것도 있어요 ― 이름은 같지만 다른 제품이에요. 만약 OpenAI AgentKit 케이스 스터디를 찾아 오셨다면, 이 글은 맞지 않아요. 하지만 Claude Code용 킷에 $99를 쓸지 고민 중이라면 계속 읽어보세요.

배경: AgentKit을 설치하기 전의 저와 제 프로젝트

저는 베트남의 1인 개발자로, 작은 클라이언트 프로젝트 몇 개에 개인 제품 하나까지 풀스택으로 작업해요. 익숙한 스택은 프런트엔드는 TypeScript/Next.js, 백엔드는 Node와 약간의 Python, 그리고 Postgres, 배포는 Vercel/VPS로 이것저것이에요. 이번 달 전에는 약 반 년 동안 순수 Claude Code(킷 없이)를 썼어요 ― 대개는 터미널을 열고, 즉석 프롬프트를 치고, 에러를 붙여넣어 수정을 부탁한 뒤 직접 이어 붙이는 식이었죠. CLAUDE.md는 최소한만 있었고, subagent도 skill도 없었으며, 정해진 프로세스도 없었어요.

그 방식으로도 일은 됐지만, 반복되는 세 가지 고충에 계속 부딪혔어요. (1) 새 작업마다 프로젝트 맥락을 처음부터 다시 설명하기, (2) 테스트 작성, 디프 리뷰, CRUD 뼈대 만들기 같은 반복 작업을 매번 손으로 프롬프트하기, (3) 그날 프롬프트를 잘했는지에 따라 출력 품질이 크게 흔들리기.

0일차 기준값(나중에 비교하려고 제가 직접 기록한 수치):

  • 중간 규모 작업 하나(CRUD 기능 1개 + 테스트)를 끝내는 평균 시간: 15분
  • 제 테스트를 빠져나가 리뷰나 런타임에서 드러난 버그: 0
  • 프로세스: 즉흥적이고, 정해진 brainstorm/plan 단계 없음.

킷을 더했을 때 순수 Claude Code와 어떻게 다른지 잘 모르겠다면, 별도로 AgentKit vs 순수 Claude Code 비교를 준비해 뒀어요.

어떻게 측정했나(제 말을 그냥 믿지 않아도 되도록)

방법을 설명하지 않는 케이스 스터디는 그저 광고일 뿐이에요. 30일 동안 수치를 어떻게 기록했는지 알려드릴게요.

  • 작업당 시간: 시작부터 머지까지 수동 스톱워치로 재서 간단한 시트에 적었어요. 조건을 맞추려고 "중간" 작업만 셌어요.
  • 출시한 기능과 버그: 리포지토리의 실제 커밋/PR에서 셌어요. 여기서 버그란 다 됐다고 생각한 뒤 되돌아가 고쳐야 했던 것을 말해요.
  • 비용: 킷 가격($99)에 여전히 지불 중인 Claude Code(Pro, $20/월)를 더한 거예요. 토큰 종량제 API는 쓰지 않아서, 토큰 쪽은 정성적 추정일 뿐이에요.

분명히 밝혀야 할 한계: 이건 n=1, 자기 보고예요. 대조군이 없고, 측정하고 있다는 사실을 스스로 알았다는 것만으로 제가 더 집중했을 수도 있어요. 아래 수치는 한 사람의 추세일 뿐, 연구가 아니라고 읽어주세요.

1주차 ― ak 설치와 적응(설정은 5분 미만)

설치는 사이트가 주장하는 그대로 5분 미만에 끝났어요. ak CLI는 macOS/Linux/Windows용 네이티브 바이너리로, Node나 Bun이 필요 없어요. 설치 프로그램이 OS/아키텍처를 자동 감지해 안정 빌드를 내려받고 SHA-256을 검증한 뒤 ~/.local/bin에 넣어줘요. 인증은 이메일이나 API 키로 해요(자세한 내용은 docs.agentkit.best). 저는 이미 옛 ClaudeKit을 쓰고 있어서 추가로 마이그레이션 단계를 실행했어요.

# preview the changes (read-only by default)
ak migrate --from=ck

# apply for real once you are happy
ak migrate --from=ck --dry-run=false --yes

# list the available skills
ak list skills

1주차의 진실: 저는 느려졌어요. 108개 이상의 skill과 45개의 agent를 앞에 두니, 처음 든 느낌은 즉각적인 속도 향상이 아니라 압도감이었어요. 며칠은 그저 각 skill이 무슨 일을 하는지 파악하는 데 썼고, 그래도 옛 습관 탓에 반사적으로 몇 번이나 손으로 프롬프트했어요. 이건 어떤 경쟁 제품도 말해주지 않는 부분이에요 ― 첫 주의 학습 곡선은 진짜예요. Claude Code가 완전히 처음이라면, 덜 헤매도록 먼저 자세한 ak CLI 설치 가이드를 훑어보세요.

2주차 ― 가장 많이 쓴 skill/subagent(그리고 버린 것들)

여기가 공유할 가치가 가장 크다고 생각하는 부분이에요. 마케팅은 "108개 이상의 skill"이라고 자랑하기 좋아하지만, 실제로 한 사람이 쓰는 건 한 줌뿐이거든요. 2주차가 되어 압도감이 옅어지자, 하루 작업 속에서 반복해 등장하는 skill/subagent 몇 개가 보이기 시작했어요 ― 반면 나머지 대부분은 한 번도 건드리지 않았어요. 그리고 그래도 괜찮아요. 킷은 공구함 같은 것이지, 전부 써야 하는 체크리스트가 아니에요.

솔직한 추정: 108개 이상의 skill 중 상시로 쓰는 건 대략 70개 정도, 45개의 agent 중 자주 부르는 건 아마 15~20개예요. 아래 표는 제게 가장 뚜렷한 가치를 만들어 준 것들이에요(작업은 사람마다 다르니, 여러분의 목록도 다를 거예요).

Skill / Agent무엇에 쓰는가유용도
Code review커밋 전에 디프를 훑어 놓친 버그를 잡기높음
Backend/API리포지토리 패턴에 맞춰 엔드포인트 + 검증 + 테스트를 만들기높음
Frontend/React기존 관례를 따르는 컴포넌트 + 상태 관리높음
Plan을 지휘하는 subagent큰 작업을 확인 가능한 단계로 쪼개기중간
제쳐둔 skill 그룹마케팅/디자인·팀 계열 그룹(ak:design, ak:copywriting, ak:team)제겐 낮음

Engineer Kit에 무엇이 들었고 살 값어치가 있는지 통째로 알고 싶다면, 전용 글을 준비해 뒀어요: Engineer Kit에 무엇이 들었고, 살 만한가, 그리고 108개 이상의 skill 개요45개의 agent 개요도 있어요. 기억해 주셨으면 하는 요점은, "108개 이상"이라는 숫자를 보고 사지 말라는 거예요. 여러분의 일에 맞는 8~12개의 skill을 위해 사세요.

3주차 ― 워크플로가 어떻게 바뀌었나(brainstorm에서 plan, cook, ship으로)

3주차가 가장 큰 변화였는데, 타이핑 속도가 아니라 작업을 바라보는 방식에서였어요. 예전엔 곧장 "X를 만들어줘"라고 프롬프트했어요. 킷을 쓰면서는 4박자 틀로 옮겨갔어요 ― 등뼈로 brainstorm에서 plan, cook, ship으로 이어지는 워크플로를 따라요.

  1. Brainstorm: 원하는 결과, 제약, 비목표를 확정해요 ― 코드에 손대기 전에.
  2. Plan: subagent가 확인 가능한 단계로 쪼개게 하고, 제가 그 계획을 승인해요.
  3. Cook: 맥락에 맞는 skill(백엔드, 프런트엔드, 리뷰 등)로 실행해요.
  4. Ship: code-review skill로 디프를 리뷰하고, 테스트를 돌린 다음에야 머지해요.

진짜 차이는, 매번 맥락을 다시 설명하는 일이 훨씬 줄고, 프롬프트 운이 아니라 프로세스에서 나오기 때문에 출력의 흔들림이 작아진 거예요. 트레이드오프는 더 느리고 더 절제된 리듬이 되는 것 ― 아주 작은 작업에는 이 틀이 과해서, 속도를 위해 그런 건 지금도 손으로 프롬프트해요.

4주차 ― 안정된 결과와 유지한 습관

4주차가 되자 여러 가지가 "자리를 잡았어요". 이제 각 skill이 뭘 하는지 찾아보지 않고, 언제 킷을 쓰지 말아야 하는지(패턴에 비해 너무 작거나 너무 특이한 작업)도 알게 됐어요. 유지한 습관:

  • 중간 규모 이상엔 항상 brainstorm + plan을 하고, 작은 작업엔 건너뛰어요.
  • 커밋 전엔 항상 review skill을 돌려요 ― 더 빨리 하지 않은 걸 가장 후회하는 습관이에요.
  • 제게 맞는 한 줌의 skill만 머릿속에 두고, 나머지는 그냥 놔둬요.

4주차는 광고가 약속하는 "두 배 빨라짐"처럼 느껴지진 않았어요. 느껴진 건 덜한 마찰더한 일관성이었어요. 저를 붙잡아 두는 건 그거지, 충격적인 숫자 하나가 아니에요.

30일 수치: 전 vs 후

여러분이 읽으러 온 부분이에요. 다시 말하지만: n=1, 자기 보고, 추세로 읽어주세요.

지표전(0일차 기준값)후(30일차)측정 방법
중간 작업 평균 시간2시간15분수동 스톱워치, 같은 유형 작업
주당 출시 기능10~20약 40머지된 PR로 집계
주당 되돌아가 고친 버그약 30약 10실제로 집계
작업당 리뷰/디버그 시간2~3시간30분수동 스톱워치
월 도구 비용Claude Code Pro $20$20 + $99 킷(일회성)실제 청구서

정성적 체감(수치보다 확실해요): 시간이 가장 뚜렷이 준 건 반복 작업(CRUD, 테스트, 리뷰)이고, 머리를 많이 써야 하는 조사나 어려운 작업에선 거의 변화가 없었어요. 달리 말하면, 킷은 "근육" 작업을 줄여줄 뿐 "두뇌" 작업은 줄여주지 않아요.

스스로 측정할 때 하나 더 적어둘 만한 것: 배우는 중이라 여러분의 1주차 수치는 기준값보다 나쁠 거고, 2~3주차부터야 나아져요. 첫 3일만 재고 "킷이 나를 느리게 한다"고 결론지으면 잘못 읽는 거예요. 그래서 저는 30일 전체로 평균을 내고, 추세를 제대로 보려고 1주차를 따로 떼어냈어요. 그게 판단하기 전에 킷에 적어도 2주는 주라고 권하는 이유이기도 해요.

실제로 통한 것 ― 그리고 잘못 예상한 것

이 섹션을 가진 경쟁 제품은 없고, 가장 솔직한 섹션이기도 해요.

진짜 성과(반가운 놀라움):

  • code-review skill이 제가 놓치기 쉬운 버그를 잡아줬어요 ― 기대보다 값졌고, ship 박자에서 자동으로 돌기 때문에 노력 면에선 사실상 "공짜"예요.
  • 틀이 갖춰진 프로세스로 하니 즉석 프롬프트보다 출력이 훨씬 일관됐어요. "오늘은 AI가 멍청하네" 하는 날이 크게 줄었어요.
  • 작업마다 "맥락 다시 설명하기"가 줄었어요 ― 작게 쌓이는 미세한 마찰이 많이 절약됐어요.

예상과 달랐던 것:

  • 108개 이상의 skill 대부분을 쓸 줄 알았어요. 실제론 한 줌뿐. 큰 숫자는 판매 포인트지 사용 포인트가 아니에요.
  • 1주차는 바로 빨라지기는커녕 느려졌어요 ― "꽂으면 바로 날아간다"를 기대하는 사람은 실망할 거예요.
  • 킷은 Claude Code 초보를 프로로 바꿔주지 않아요. 기존 실력을 증폭할 뿐이니, Claude Code가 아직 탄탄하지 않다면 그것부터 익히세요.
  • 아주 작은 작업엔 워크플로 틀이 짐이 돼서, 저는 손 프롬프트로 돌아가요.

30일 후의 비용과 ROI

이 글을 쓸 당시의 가격이에요(사이트에서 확인함. 가격은 바뀔 수 있으니 직접 확인하세요).

  • Engineer Kit ― $99: 60개 이상의 skill, 30개 이상의 워크플로, 17개의 엔지니어 agent. 사이트는 킷에 대해 반복 요금을 명시하지 않아요($99 가격에 "갱신" 문구가 없어요).
  • Marketing Kit ― $99; 둘 묶음 Bundle ― $149.
  • Desktop App이 연간짜리예요: $19/년 얼리 액세스(첫해, 이후 표준 가격으로 갱신), 또는 선착순 100명 대상 App + 2개 킷 $99/년. 그게 킷과 별개인 구독 부분이에요.
  • 환불 보장이 있고(사이트는 구체적 일수를 적지 않았어요), 킷에는 평생 업데이트가 따라와요.

제가 직접 ROI를 계산하는 법(여러분의 숫자를 넣어보세요):

Kit cost = $99 (one-time)
Hours saved/month = 40
Value of one hour = $50
Value saved = 40 x $50
Month-1 ROI = $2000 - $99

제게 요점은, 킷은 일회성 $99인데 시간 절약은 매달 반복된다는 거예요 ― 그러니 꾸준히 코딩한다면 손익분기점은 꽤 낮아요. 그래도 허황된 ROI 수치를 건네지는 않을게요. 여러분이 실제로 측정한 시간을 넣으세요. 더 깊은 분석은 AgentKit 비용과 살 만한가와 제 자세한 AgentKit ROI 계산을 보세요.

가격과 플랜을 직접 확인하고 싶으세요? 가격 페이지를 바로 보세요 ― 킷 $99, 번들 $149, 환불 보장과 평생 업데이트 포함: 지금 AgentKit 가격 보기(링크로 20% 할인).

30일 후의 장단점

장점단점
프로세스 덕분에 출력이 더 일관됨USD 가격($99)이라, 미국 밖 구매자에겐 실제 고려 사항
Code-review skill이 버그를 자동으로 잡음Claude Code를 먼저 알아야 함 ― 완전 초보용은 아님
일회성 결제에 평생 업데이트1주차 학습 곡선(처음엔 느리고, 나중엔 빠름)
작업당 맥락 반복이 줄어듦108개 이상의 skill 대부분은 안 씀 ― "과잉"처럼 느껴질 수 있음
시험 삼아 쓸 환불 보장킷과 그 프로세스에 어느 정도 의존이 생김

30일 후, AgentKit은 살 만한가요? (사야 할 사람 / 사지 말아야 할 사람)

사람 유형별 제 결론:

  • 이미 Claude Code에 익숙한 1인/인디 개발자: 예. 가장 뚜렷하게 이득을 보는 층이에요 ― 킷이 증폭할 기본 실력이 있고, 자주 코딩한다면 일회성 $99는 쉽게 회수돼요.
  • 반복 작업이 많은 바쁜 개발자: , 특히 review skill + 워크플로가 하루의 마찰을 줄여주니까요.
  • Claude Code 완전 초보: 미루세요. 먼저 순수 Claude Code를 익히세요. 킷은 기초를 대신할 수 없어요. 구체적 비교는 AgentKit vs 순수 Claude Code를 보세요.
  • 소규모 팀: 가능성은 있지만, 이 글은 1인 관점이에요 ― 팀 규모에서는 측정하지 않았으니, 여러분을 위해 결론짓지는 않을게요.

결정 전에 일반적인 제품 리뷰가 필요하다면 AgentKit이 무엇인가 ― 일반 리뷰를 보세요. 이미 "예" 층이라고 확신한다면, $79.20에 AgentKit 구매(링크로 20% 할인) 후 환불 보장을 이용해 처음 며칠 동안 직접 시험해 볼 수 있어요.

자주 묻는 질문(FAQ)

30일로 결론 내리기에 충분한가요?

추세를 보고 살지 말지 정하기엔 충분하지만, 연구는 아니에요. 이건 n=1, 자기 보고 수치예요. 한 사람의 경험으로 여기고, 여러분의 작업에서 다시 측정하세요.

이 AgentKit은 OpenAI AgentKit과 어떻게 다른가요?

완전히 달라요. 이 글은 Claude Code용 AgentKit(agentkit.best, ak CLI)에 관한 거예요. OpenAI AgentKit은 OpenAI의 에이전트 구축 스위트(Agent Builder/ChatKit)로, 2025년 10월 6일에 출시된 ― 다른 회사의 다른 제품이에요.

킷에 연간 요금이 붙나요?

킷은 $99(Engineer) / $149(Bundle) 가격으로 표시되고, 사이트는 킷에 대해 반복 요금을 명시하지 않으며, 평생 업데이트가 따라와요. 연간 부분은 Desktop App($19/년 얼리 액세스)이에요 ― 그건 킷과 별개인 제품이에요.

맞지 않으면 환불이 되나요?

사이트에 환불 보장이 있어요. 구체적인 일수나 조건은 밝히지 않았으니, 사기 전에 정책을 잘 읽어보세요.

Claude Code Pro가 필요한가요?

킷을 쓰려면 Claude Code가 필요해요. 저는 Pro 플랜을 $20/월에 내고 있어요. 제한된 무료 등급도 있지만, 꾸준한 작업엔 유료 플랜이 더 편해요.

어느 링크로 사야 하나요?

링크는 글 끝의 박스와 비용·ROI 섹션에 넣어 뒀어요. 그걸로 사도 가격은 바뀌지 않아요. 저는 장점과 단점 양쪽에서 리뷰의 균형을 지켜, 여러분에 대한 신뢰를 잃지 않으려 해요.

결론과 구매 링크

30일 후의 솔직한 결론: AgentKit은 요술 방망이가 아니지만, 이미 Claude Code에 익숙한 개발자에겐 합리적인 $99예요 ― 가치는 일관된 프로세스와 review skill에서 오지, "108개 이상의 skill"이라는 숫자에서 오지 않아요. 느린 1주차는 정상이에요. 그 고비를 넘기면 마찰이 눈에 띄게 줄어요. 위의 "사야 할" 층에 해당하고 직접 확인하고 싶다면, 환불 보장을 이용해 시험해 보세요.

여러분의 Claude Code가 덜 흔들리고 반복 작업을 덜 하길 원하세요? 이미 Claude Code에 익숙하다면, $99의 Engineer Kit(일회성, 평생 업데이트, 환불 보장)은 여러분만의 케이스 스터디를 돌려보기에 합리적인 출발점이에요.

AgentKit 시험해 보기(링크로 20% 할인)→

J

Jasmine

작성자 · Jasmine Daily

Jasmine Daily를 써 내려가는 사람 - 생각과 경험, 그리고 하루하루의 순간을 적어 두어요. 솔직하고, 서두르지 않고, 완벽하지 않게.

Jasmine Daily

아직 읽을 이야기가 더 있어요.

이 글이 마음에 닿았다면, 일기의 다른 페이지들도 몇 장 넘겨 보세요.

다음 읽을거리

관련 글