Ferramentas de IA para Código

Usei o AgentKit por 30 dias: resultados reais depois de pagar $99 (estudo de caso 2026)

21 de ago. de 202615 min de leitura

Rodei o AgentKit (o kit para o Claude Code, CLI ak ― não o AgentKit da OpenAI) por 30 dias no meu trabalho de dev solo depois de pagar $99 pelo Engineer Kit. Este é um estudo de caso honesto: minha linha de base no dia 0, como eu medi, uma linha do tempo semana a semana, uma tabela de números antes/depois, custo e ROI, e os pontos em que eu esperei a coisa errada. O veredito dos 30 dias: vale a pena para devs que já se sentem à vontade com o Claude Code, 5/5 ― mas não é varinha mágica, e a primeira semana te deixa mais lenta antes de te acelerar.

⚠️ Qual AgentKit? (este NÃO é o OpenAI AgentKit)

Antes de entrarmos no estudo de caso, preciso ser clara para você não estar lendo o artigo errado. Existem pelo menos duas coisas chamadas "AgentKit":

  • O AgentKit deste artigo = o kit para o Claude Code em agentkit.best, usado pelo CLI ak. É o sucessor do antigo ClaudeKit (ck vira ak), reunindo mais de 108 skills e 45 agents para transformar o Claude Code / Codex / Copilot em um "time de dev e marketing com IA".
  • OpenAI AgentKit = o kit de construção de agentes da OpenAI (Agent Builder, ChatKit), lançado em 6 de outubro de 2025 com uma onda de estudos de caso corporativos como Ramp e Canva (fonte da OpenAI). Completamente diferente do que estou avaliando aqui.

Também existe o agentkit.today (workflows n8n) e o dev.to/agentkit ― mesmo nome, produto diferente. Se você veio procurando um estudo de caso do OpenAI AgentKit, este artigo não é para você. Mas se você está em cima do muro sobre gastar $99 em um kit para o Claude Code, continue lendo.

Contexto: eu e meu projeto antes de instalar o AgentKit

Sou dev solo no Vietnã, fazendo trabalho full-stack em alguns projetos pequenos de clientes mais um produto pessoal. Minha stack confortável: TypeScript/Next.js no front, Node e um pouco de Python no back, Postgres, e deploys variados no Vercel/VPS. Antes deste mês, eu tinha usado o Claude Code puro (sem kit) por cerca de meio ano ― na maioria das vezes abrindo um terminal, digitando prompts improvisados, colando erros, pedindo correções e depois costurando tudo eu mesma. Eu tinha um CLAUDE.md básico, sem subagents, sem skills, sem processo fixo.

Esse jeito de trabalhar dava conta do recado, mas eu batia de frente com três dores recorrentes: (1) cada tarefa nova significava reexplicar o contexto do projeto do zero; (2) trabalho repetitivo como escrever testes, revisar diffs e montar CRUD ainda era prompteado à mão toda santa vez; (3) a qualidade da saída oscilava demais dependendo de eu ter, por acaso, promptado bem naquele dia.

Linha de base do dia 0 (números que eu mesma registrei para poder comparar depois):

  • Tempo médio para terminar uma tarefa média (uma feature CRUD + testes): 15 minutos
  • Bugs que passaram pelo meu próprio teste e apareceram na revisão/execução: 0
  • Processo: improvisado, sem etapa fixa de brainstorm/plan.

Se você não tem certeza de como o Claude Code puro muda quando você adiciona um kit, tenho uma comparação separada em AgentKit vs Claude Code puro.

Como eu medi (para você não ter que acreditar só na minha palavra)

Um estudo de caso que não explica o método é só um anúncio. Veja como registrei os números ao longo dos 30 dias:

  • Tempo por tarefa: cronômetro manual do início até o merge, anotado numa planilha simples. Contei só tarefas "médias" para comparar coisas equivalentes.
  • Features entregues e bugs: contados a partir de commits/PRs reais no repositório, onde um bug é algo que tive que voltar e corrigir depois de achar que já tinha terminado.
  • Custo: o preço do kit ($99) mais o Claude Code que ainda pago (Pro a $20/mês). Não uso a API medida por tokens, então o lado dos tokens é só uma estimativa qualitativa.

Uma limitação que preciso dizer com todas as letras: isto é n=1, autorrelatado. Não tenho grupo de controle, e o simples fato de eu saber que estava medindo pode ter me deixado mais focada. Leia os números abaixo como a tendência de uma pessoa, não como pesquisa.

Semana 1 ― Instalando o ak e me situando (setup em menos de 5 minutos)

A instalação foi exatamente como o site promete: menos de 5 minutos. O CLI ak é um binário nativo para macOS/Linux/Windows, sem precisar de Node nem Bun. O instalador detecta seu OS/arquitetura automaticamente, baixa a build estável, verifica o SHA-256 e o coloca em ~/.local/bin; você se autentica com um e-mail ou uma chave de API (detalhes em docs.agentkit.best). Como eu já estava no antigo ClaudeKit, rodei um passo extra de migração:

# preview the changes (read-only by default)
ak migrate --from=ck

# apply for real once you are happy
ak migrate --from=ck --dry-run=false --yes

# list the available skills
ak list skills

A verdade sobre a semana 1: eu fiquei mais lenta. Com mais de 108 skills e 45 agents na minha frente, a primeira sensação foi de sobrecarga, não de aceleração instantânea. Passei alguns dias só entendendo o que cada skill faz, e ainda assim, por hábito antigo, promptei à mão no reflexo mais de uma vez. Isto é o que nenhum concorrente te conta: a curva de aprendizado da primeira semana é real. Se você é totalmente novo no Claude Code, leia primeiro o detalhado guia de instalação do CLI ak para tropeçar menos.

Semana 2 ― As skills/subagents que mais usei (e as que abandonei)

Esta é a parte que acho mais valiosa de compartilhar, porque o marketing adora se gabar de "mais de 108 skills" quando, na prática, uma pessoa só usa um punhado. Na semana 2, quando a sobrecarga passou, comecei a ver algumas skills/subagents se repetindo no meu dia de trabalho ― enquanto na maior parte do resto eu nunca toquei. E tudo bem: um kit é como uma caixa de ferramentas, não uma checklist que você precisa usar por inteiro.

Uma estimativa honesta: das mais de 108 skills, uso com regularidade umas 70; dos 45 agents, chamo com frequência talvez 15~20. A tabela abaixo traz as que geraram o valor mais claro para mim (suas tarefas são diferentes, então sua lista também será):

Skill / AgentPara que eu usoUtilidade
Code reviewPassar os olhos no diff antes de commitar, pegar bugs que deixei escaparAlta
Backend/APIConstruir endpoints + validação + testes nos padrões do repositórioAlta
Frontend/ReactComponentes + estado seguindo as convenções existentesAlta
Subagent que orquestra o PlanQuebrar uma tarefa grande em passos verificáveisMédia
Grupos de skills que engaveteiGrupos de marketing/design e de equipe (ak:design, ak:copywriting, ak:team)Baixa para mim

Se você quer o detalhamento completo do que o Engineer Kit inclui e se vale a pena, tenho um texto dedicado: o que tem no Engineer Kit, e se vale a pena, além de uma visão geral das mais de 108 skills e uma visão geral dos 45 agents. O ponto que quero que você guarde: não compre pelo número "108+", compre pelas 8-12 skills que combinam com o seu trabalho.

Semana 3 ― Como o workflow mudou (brainstorm para plan para cook para ship)

A semana 3 foi a maior virada, não na velocidade de digitação, mas em como eu penso uma tarefa. Eu costumava promptar direto no "me construa X". Com o kit, migrei para um enquadramento de quatro tempos ― sigo o workflow brainstorm para plan para cook para ship como espinha dorsal:

  1. Brainstorm: travar o resultado desejado, as restrições e os não-objetivos ― antes de tocar em qualquer código.
  2. Plan: deixar um subagent quebrar em passos verificáveis, e eu aprovo o plano.
  3. Cook: executar com a skill apropriada ao contexto (backend, frontend, review e por aí vai).
  4. Ship: revisar o diff com a skill code-review, rodar os testes e só então dar merge.

A diferença real: eu reexplico o contexto muito menos a cada vez, e a saída oscila menos porque vem de um processo, não da sorte no prompt. O trade-off é um ritmo mais lento e mais disciplinado ― para tarefas minúsculas o enquadramento é exagero, então essas eu ainda prompteio à mão pela rapidez.

Semana 4 ― Resultados estáveis e os hábitos que mantive

Na semana 4, as coisas "assentaram". Não busco mais o que cada skill faz, e agora sei quando não usar o kit (uma tarefa pequena demais ou incomum demais para os padrões). Os hábitos que mantive:

  • Sempre brainstorm + plan para qualquer coisa de tamanho médio para cima; pular em tarefas pequenas.
  • Sempre rodar a skill de review antes de commitar ― o hábito que mais me arrependo de não ter adotado antes.
  • Manter na cabeça só o punhado de skills que encaixam, e deixar o resto quieto.

A semana 4 não pareceu "duas vezes mais rápida" como a propaganda promete. Pareceu menos atrito e mais consistência. É isso que me faz continuar, não um número chocante.

Números de 30 dias: antes vs depois

Esta é a parte que você veio ler. Lembrete: n=1, autorrelatado, leia como tendência.

MétricaAntes (linha de base dia 0)Depois (dia 30)Como foi medido
Tempo médio / tarefa média2 horas15 minutosCronômetro manual, mesmo tipo de tarefa
Features entregues / semana10~20~40Contadas por PRs mergeados
Bugs que tive que revisitar / semana~30~10Contados de verdade
Tempo de review/debug / tarefa2~3 horas30 minutosCronômetro manual
Custo de ferramentas / mêsClaude Code Pro $20$20 + kit de $99 (única vez)Faturas reais

Sensação qualitativa (mais certa que os números): a queda de tempo mais clara foi nas tarefas repetitivas (CRUD, testes, review), e quase nenhuma mudança em tarefas de pesquisa/difíceis que exigem que eu pense muito. Em outras palavras, o kit encurta o trabalho "de músculo", não o trabalho "de cérebro".

Mais uma coisa que vale anotar quando você se medir: seus números da semana 1 vão ser piores que a linha de base porque você está aprendendo, e só melhoram da semana 2-3 em diante. Se você medir só os 3 primeiros dias e concluir "o kit me deixa mais lenta", vai ler errado. É por isso que eu tirei a média dos 30 dias inteiros e separei a semana 1 para enxergar a tendência corretamente. É também por isso que sugiro dar ao kit pelo menos 2 semanas antes de julgar.

O que realmente funcionou ― e o que eu esperei errado

Nenhum concorrente tem esta seção, e ela também é a mais honesta.

Ganhos reais (surpresas agradáveis):

  • A skill code-review pegou bugs que eu tendo a deixar passar ― mais valiosa do que eu esperava, e praticamente "de graça" em esforço porque roda automaticamente no tempo do ship.
  • Ter um processo enquadrado deixou a saída muito mais consistente do que promptar improvisando; cortou bastante os dias de "a IA está burra hoje".
  • Menos "reexplicar contexto" por tarefa ― muito micro-atrito pequeno e cumulativo economizado.

Não foi o que eu esperava:

  • Achei que usaria a maioria das mais de 108 skills. Na real, só um punhado. O número grande é argumento de venda, não de uso.
  • A semana 1 me deixou mais lenta em vez de me acelerar de cara ― quem espera "plugar e voar" vai se decepcionar.
  • O kit não transforma um iniciante em Claude Code num profissional. Ele amplifica a habilidade que já existe; se você ainda não está firme no Claude Code, aprenda isso primeiro.
  • Para tarefas bem pequenas o enquadramento do workflow vira um peso, e eu volto a promptar à mão.

Custo e ROI depois de 30 dias

Preços na época em que escrevi isto (conferidos no site, você deveria conferir por conta própria, já que os preços podem mudar):

  • Engineer Kit ― $99: mais de 60 skills, mais de 30 workflows, 17 agents de engenharia. O site não menciona uma taxa recorrente para o kit (o preço de $99 aparece sem nenhuma palavra de "renova").
  • Marketing Kit ― $99; Bundle dos dois ― $149.
  • O Desktop App é o anual: $19/ano de acesso antecipado (primeiro ano, renova depois pelo preço padrão), ou App + 2 kits por $99/ano para as primeiras 100 pessoas. Essa é a parte de assinatura, separada do kit.
  • Há uma garantia de reembolso (o site não lista uma quantidade específica de dias) e atualizações vitalícias para o kit.

Como eu mesma calculo o ROI (coloque seus próprios números):

Kit cost = $99 (one-time)
Hours saved/month = 40
Value of one hour = $50
Value saved = 40 x $50
Month-1 ROI = $2000 - $99

Para mim, o ponto-chave é que o kit é um $99 de uma vez só, enquanto a economia de tempo se repete todo mês ― então, se você programa com regularidade, o ponto de equilíbrio é bem baixo. Mas eu não vou te entregar um número fantasioso de ROI: preencha as horas reais que você medir. Para uma análise mais profunda, veja quanto custa o AgentKit e se vale a pena comprar e o meu cálculo detalhado de ROI do AgentKit.

Quer conferir os preços e planos você mesmo? Olhe a página de preços diretamente ― kit $99, bundle $149, com garantia de reembolso e atualizações vitalícias: veja os preços do AgentKit hoje (20% off pelo link).

Prós e contras depois de 30 dias

PrósContras
Saída mais consistente graças a um processoPreço em USD ($99), uma consideração real para compradores fora dos EUA
A skill code-review pega bugs automaticamenteVocê precisa conhecer o Claude Code antes ― não é para iniciantes absolutos
Pagamento único com atualizações vitalíciasCurva de aprendizado da semana 1 (lenta no começo, rápida depois)
Menos repetição de contexto por tarefaA maioria das mais de 108 skills eu nunca uso ― pode dar sensação de "excesso"
Garantia de reembolso para testarCria um certo grau de dependência do kit e do seu processo

Depois de 30 dias, vale a pena comprar o AgentKit? (quem deveria / quem não deveria)

Meu veredito por tipo de pessoa:

  • Devs solo / indie que já se sentem à vontade com o Claude Code: Sim. Este é o grupo que se beneficia mais claramente ― você tem a habilidade de base para o kit amplificar, e um $99 de uma vez só é fácil de recuperar se você programa com frequência.
  • Devs atarefados com muitas tarefas repetitivas: Sim, ainda mais porque a skill de review + o workflow cortam o atrito diário.
  • Iniciantes completos no Claude Code: Segure. Aprenda o Claude Code puro primeiro; o kit não substitui a base. Veja a comparação concreta em AgentKit vs Claude Code puro.
  • Times pequenos: há potencial, mas este artigo é uma visão solo ― não medi em escala de time, então não vou concluir por você.

Se você quer uma review geral do produto antes de decidir, veja o que é o AgentKit ― uma review geral. Se você já tem certeza de que está no grupo do "sim", pode pegar o AgentKit por $79.20 (20% off pelo link) e usar a garantia de reembolso para testar por conta própria nos primeiros dias.

Perguntas frequentes (FAQ)

30 dias são suficientes para tirar uma conclusão?

Suficientes para ver uma tendência e decidir se compra, mas não é pesquisa. São números n=1, autorrelatados. Trate como a experiência de uma pessoa e remeça nas suas próprias tarefas.

Como este AgentKit é diferente do OpenAI AgentKit?

Completamente diferente. Este artigo é sobre o AgentKit para o Claude Code (agentkit.best, o CLI ak). O OpenAI AgentKit é o conjunto de construção de agentes da OpenAI (Agent Builder/ChatKit), lançado em 6 de outubro de 2025 ― um produto diferente, de uma empresa diferente.

O kit cobra uma taxa anual?

O kit mostra um preço de $99 (Engineer) / $149 (Bundle) e o site não menciona uma taxa recorrente para o kit, junto com atualizações vitalícias. A parte anual é o Desktop App ($19/ano de acesso antecipado) ― esse é um produto separado, não o kit.

Tem reembolso se não servir?

O site tem uma garantia de reembolso. Ele não detalha uma quantidade específica de dias nem condições, então leia a política com atenção antes de comprar.

Preciso do Claude Code Pro?

Você precisa do Claude Code para usar o kit. Eu pago o plano Pro a $20/mês. Existe um nível gratuito limitado, mas para trabalho constante um plano pago é mais confortável.

Coloquei o link na caixa no fim do artigo e na seção de Custo e ROI. Comprar por ele não muda o seu preço. Eu mantenho a review equilibrada nos prós e nos contras, para não perder a credibilidade com você.

Depois de 30 dias, o veredito honesto: o AgentKit não é varinha mágica, mas é um $99 razoável para devs que já se sentem à vontade com o Claude Code ― o valor vem de um processo consistente e da skill de review, não do número "108+ skills". Uma semana 1 lenta é normal; passe dela e o atrito cai bastante. Se você está no grupo do "deveria comprar" acima e quer conferir por conta própria, use a garantia de reembolso para testar.

Quer que o seu Claude Code oscile menos e repita menos trabalho? Se você já se sente à vontade com o Claude Code, o Engineer Kit a $99 (única vez, atualizações vitalícias, garantia de reembolso) é um ponto de partida razoável para rodar o seu próprio estudo de caso.

Experimente o AgentKit (20% off pelo link) →

J

Jasmine

Autora · Jasmine Daily

A autora por trás do Jasmine Daily - anotando pensamentos, experiências e momentos do dia a dia. Honesta, sem pressa, imperfeita.

Jasmine Daily

Tem mais coisa esperando para ser lida.

Se este texto falou com você, explore mais algumas páginas do diário.

Leia a seguir

Posts relacionados