Usé AgentKit durante 30 días: resultados reales tras pagar $99 (estudio de caso 2026)
Usé AgentKit (el kit para Claude Code, CLI ak ― no el AgentKit de OpenAI) durante 30 días en mi trabajo de dev en solitario después de pagar $99 por el Engineer Kit. Este es un estudio de caso honesto: mi línea base del día 0, cómo medí, una cronología semana a semana, una tabla de números antes/después, costo y ROI, y los puntos en los que esperé lo equivocado. El veredicto de los 30 días: vale la pena para devs que ya se sienten cómodos con Claude Code, 5/5 ― pero no es una varita mágica, y la primera semana te frena antes de acelerarte.
⚠️ ¿Cuál AgentKit? (este NO es el AgentKit de OpenAI)
Antes de entrar en el estudio de caso, tengo que ser clara para que no estés leyendo el artículo equivocado. Hay al menos dos cosas llamadas "AgentKit":
- El AgentKit de este artículo = el kit para Claude Code en agentkit.best, usado a través del CLI
ak. Es el sucesor del antiguo ClaudeKit (ckpasa a serak), y reúne más de 108 skills y 45 agents para convertir Claude Code / Codex / Copilot en un "equipo de dev y marketing con IA". - OpenAI AgentKit = el kit de construcción de agentes de OpenAI (Agent Builder, ChatKit), lanzado el 6 de octubre de 2025 con una oleada de estudios de caso empresariales como Ramp y Canva (fuente de OpenAI). Completamente distinto de lo que reseño aquí.
También está agentkit.today (workflows de n8n) y dev.to/agentkit ― mismo nombre, producto distinto. Si viniste buscando un estudio de caso del AgentKit de OpenAI, este artículo no es para ti. Pero si estás dudando entre gastar $99 en un kit para Claude Code, sigue leyendo.
Contexto: yo y mi proyecto antes de instalar AgentKit
Soy dev en solitario en Vietnam, hago trabajo full-stack en unos cuantos proyectos pequeños de clientes más un producto personal. Mi stack cómodo: TypeScript/Next.js en el front, Node y un poco de Python en el back, Postgres, y despliegues variados en Vercel/VPS. Antes de este mes había usado Claude Code puro (sin kit) durante alrededor de medio año ― casi siempre abriendo una terminal, escribiendo prompts improvisados, pegando errores, pidiendo correcciones y luego cosiéndolo todo yo misma. Tenía un CLAUDE.md mínimo, sin subagents, sin skills, sin proceso fijo.
Esa forma de trabajar sacaba el trabajo adelante, pero seguía chocando con tres dolores recurrentes: (1) cada tarea nueva significaba reexplicar el contexto del proyecto desde cero; (2) el trabajo repetitivo como escribir tests, revisar diffs y armar CRUD seguía prompteándose a mano cada vez; (3) la calidad de la salida oscilaba muchísimo según si ese día me tocaba promptear bien.
Línea base del día 0 (números que registré yo misma para poder comparar después):
- Tiempo medio para terminar una tarea media (una feature CRUD + tests): 15 minutos
- Bugs que se colaron por mi propia prueba y aparecieron en la revisión/ejecución: 0
- Proceso: improvisado, sin paso fijo de brainstorm/plan.
Si no tienes claro cómo cambia Claude Code puro cuando le agregas un kit, tengo una comparación aparte en AgentKit vs Claude Code puro.
Cómo medí (para que no tengas que creerme solo de palabra)
Un estudio de caso que no explica su método es solo un anuncio. Así registré los números a lo largo de los 30 días:
- Tiempo por tarea: cronómetro manual desde el inicio hasta el merge, anotado en una hoja simple. Solo conté tareas "medias" para comparar cosas equivalentes.
- Features entregadas y bugs: contados a partir de commits/PRs reales en el repositorio, donde un bug es algo que tuve que volver a corregir después de creer que ya había terminado.
- Costo: el precio del kit ($99) más el Claude Code que sigo pagando (Pro a $20/mes). No uso la API medida por tokens, así que el lado de los tokens es solo una estimación cualitativa.
Una limitación que tengo que decir con todas las letras: esto es n=1, autorreportado. No tengo grupo de control, y el mero hecho de saber que estaba midiendo pudo haberme hecho estar más concentrada. Lee los números de abajo como la tendencia de una persona, no como investigación.
Semana 1 ― Instalando ak y ubicándome (setup en menos de 5 minutos)
La instalación fue exactamente como promete el sitio: menos de 5 minutos. El CLI ak es un binario nativo para macOS/Linux/Windows, sin necesidad de Node ni Bun. El instalador detecta tu OS/arquitectura automáticamente, descarga la build estable, verifica el SHA-256 y lo deja en ~/.local/bin; te autenticas con un correo o una clave de API (detalles en docs.agentkit.best). Como yo ya estaba en el antiguo ClaudeKit, ejecuté un paso extra de migración:
# preview the changes (read-only by default)
ak migrate --from=ck
# apply for real once you are happy
ak migrate --from=ck --dry-run=false --yes
# list the available skills
ak list skillsLa verdad sobre la semana 1: me volví más lenta. Con más de 108 skills y 45 agents delante, la primera sensación fue de agobio, no de aceleración instantánea. Pasé unos días solo averiguando qué hace cada skill, y aun así, por vieja costumbre, prompteé a mano por reflejo más de una vez. Esto es lo que ningún competidor te cuenta: la curva de aprendizaje de la primera semana es real. Si eres completamente nuevo en Claude Code, léete primero la detallada guía de instalación del CLI ak para tropezar menos.
Semana 2 ― Las skills/subagents que más usé (y las que dejé de lado)
Esta es la parte que me parece más valiosa de compartir, porque al marketing le encanta presumir de "más de 108 skills" cuando, en realidad, una sola persona usa un puñado. Para la semana 2, cuando el agobio se disipó, empecé a ver unas cuantas skills/subagents repetirse en mi jornada de trabajo ― mientras que la mayor parte del resto nunca la toqué. Y está bien: un kit es como una caja de herramientas, no una checklist que tengas que usar entera.
Una estimación honesta: de las más de 108 skills, uso con regularidad unas 70; de los 45 agents, llamo con frecuencia quizá 15~20. La tabla de abajo son las que me generaron el valor más claro (tus tareas son distintas, así que tu lista también lo será):
| Skill / Agent | Para qué la uso | Utilidad |
|---|---|---|
| Code review | Repasar el diff antes de commitear, cazar bugs que se me pasaron | Alta |
| Backend/API | Construir endpoints + validación + tests según los patrones del repositorio | Alta |
| Frontend/React | Componentes + estado siguiendo las convenciones existentes | Alta |
| Subagent que orquesta el Plan | Partir una tarea grande en pasos verificables | Media |
| Grupos de skills que archivé | Grupos de marketing/diseño y de equipo (ak:design, ak:copywriting, ak:team) | Baja para mí |
Si quieres el desglose completo de lo que incluye el Engineer Kit y si vale la pena, tengo un texto dedicado: qué trae el Engineer Kit, y si vale la pena, además de una visión general de las más de 108 skills y una visión general de los 45 agents. El punto que quiero que recuerdes: no compres por el número "108+", compra por las 8-12 skills que encajan con tu trabajo.
Semana 3 ― Cómo cambió el workflow (brainstorm a plan a cook a ship)
La semana 3 fue el mayor giro, no en velocidad de tecleo sino en cómo pienso una tarea. Antes prompteaba directo al "constrúyeme X". Con el kit, me pasé a un encuadre de cuatro tiempos ― sigo el workflow brainstorm a plan a cook a ship como columna vertebral:
- Brainstorm: fijar el resultado deseado, las restricciones y los no-objetivos ― antes de tocar código.
- Plan: dejar que un subagent lo parta en pasos verificables, y yo apruebo el plan.
- Cook: ejecutar con la skill apropiada al contexto (backend, frontend, review, etcétera).
- Ship: revisar el diff con la skill code-review, correr los tests y solo entonces hacer merge.
La diferencia real: reexplico el contexto mucho menos cada vez, y la salida oscila menos porque viene de un proceso y no de la suerte del prompt. El trade-off es un ritmo más lento y más disciplinado ― para tareas diminutas el encuadre es excesivo, así que esas todavía las prompteo a mano por rapidez.
Semana 4 ― Resultados estables y los hábitos que mantuve
Para la semana 4, las cosas "se asentaron". Ya no busco qué hace cada skill, y ahora sé cuándo no usar el kit (una tarea demasiado pequeña o demasiado inusual para los patrones). Los hábitos que mantuve:
- Siempre brainstorm + plan para cualquier cosa de tamaño medio en adelante; saltármelo en tareas pequeñas.
- Siempre correr la skill de review antes de commitear ― el hábito que más lamento no haber adoptado antes.
- Mantener en la cabeza solo el puñado de skills que encajan, y dejar el resto ahí quieto.
La semana 4 no se sintió "dos veces más rápida" como promete la publicidad. Se sintió como menos fricción y más consistencia. Eso es lo que me hace quedarme, no un número impactante.
Números de 30 días: antes vs después
Esta es la parte que viniste a leer. Recordatorio: n=1, autorreportado, léelo como tendencia.
| Métrica | Antes (línea base día 0) | Después (día 30) | Cómo se midió |
|---|---|---|---|
| Tiempo medio / tarea media | 2 horas | 15 minutos | Cronómetro manual, mismo tipo de tarea |
| Features entregadas / semana | 10~20 | ~40 | Contadas por PRs mergeados |
| Bugs que tuve que revisitar / semana | ~30 | ~10 | Contados de verdad |
| Tiempo de review/debug / tarea | 2~3 horas | 30 minutos | Cronómetro manual |
| Costo de herramientas / mes | Claude Code Pro $20 | $20 + kit de $99 (una sola vez) | Facturas reales |
Sensación cualitativa (más segura que los números): la caída de tiempo más clara fue en las tareas repetitivas (CRUD, tests, review), y casi ningún cambio en tareas de investigación/difíciles que me exigen pensar mucho. Dicho de otro modo, el kit acorta el trabajo "de músculo", no el trabajo "de cerebro".
Otra cosa que vale anotar cuando te midas: tus números de la semana 1 van a ser peores que la línea base porque estás aprendiendo, y solo mejoran de la semana 2-3 en adelante. Si mides solo los primeros 3 días y concluyes "el kit me hace más lenta", lo vas a leer mal. Por eso saqué el promedio de los 30 días completos y separé la semana 1 para ver la tendencia correctamente. También por eso sugiero darle al kit al menos 2 semanas antes de juzgar.
Lo que de verdad funcionó ― y lo que esperé mal
Ningún competidor tiene esta sección, y también es la más honesta.
Ganancias reales (sorpresas agradables):
- La skill code-review cazó bugs que suelo pasar por alto ― más valiosa de lo que esperaba, y prácticamente "gratis" en esfuerzo porque corre automáticamente en el tiempo del ship.
- Tener un proceso encuadrado hizo la salida mucho más consistente que promptear improvisando; recortó bastante los días de "la IA está tonta hoy".
- Menos "reexplicar contexto" por tarea ― mucho micro-roce pequeño y acumulativo que se ahorra.
No fue lo que esperaba:
- Creí que usaría la mayoría de las más de 108 skills. En realidad, solo un puñado. El número grande es argumento de venta, no de uso.
- La semana 1 me hizo más lenta en lugar de acelerarme de inmediato ― quien espere "enchufar y volar" quedará decepcionado.
- El kit no convierte a un principiante en Claude Code en un profesional. Amplifica la habilidad que ya existe; si aún no estás firme en Claude Code, aprende eso primero.
- Para tareas muy pequeñas el encuadre del workflow se vuelve un lastre, y vuelvo a promptear a mano.
Costo y ROI después de 30 días
Precios al momento en que escribí esto (verificados en el sitio, deberías verificarlos por tu cuenta, ya que los precios pueden cambiar):
- Engineer Kit ― $99: más de 60 skills, más de 30 workflows, 17 agents de ingeniería. El sitio no indica una tarifa recurrente para el kit (el precio de $99 aparece sin ninguna palabra de "se renueva").
- Marketing Kit ― $99; Bundle de ambos ― $149.
- El Desktop App es el anual: $19/año de acceso anticipado (primer año, luego se renueva al precio estándar), o App + 2 kits por $99/año para las primeras 100 personas. Esa es la parte de suscripción, separada del kit.
- Hay una garantía de reembolso (el sitio no indica una cantidad específica de días) y actualizaciones de por vida para el kit.
Cómo calculo yo misma el ROI (pon tus propios números):
Kit cost = $99 (one-time)
Hours saved/month = 40
Value of one hour = $50
Value saved = 40 x $50
Month-1 ROI = $2000 - $99Para mí, el punto clave es que el kit es un $99 de una sola vez mientras que el ahorro de tiempo se repite cada mes ― así que, si programas con regularidad, el punto de equilibrio es bastante bajo. Pero no te voy a entregar una cifra fantasiosa de ROI: rellena las horas reales que midas. Para un análisis más a fondo, mira cuánto cuesta AgentKit y si vale la pena comprarlo y mi cálculo detallado del ROI de AgentKit.
¿Quieres revisar los precios y planes tú mismo? Mira la página de precios directamente ― kit $99, bundle $149, con garantía de reembolso y actualizaciones de por vida: mira los precios de AgentKit hoy (20% de descuento por el enlace).
Pros y contras después de 30 días
| Pros | Contras |
|---|---|
| Salida más consistente gracias a un proceso | Precio en USD ($99), una consideración real para compradores fuera de EE. UU. |
| La skill code-review caza bugs automáticamente | Necesitas conocer Claude Code antes ― no es para principiantes absolutos |
| Pago único con actualizaciones de por vida | Curva de aprendizaje de la semana 1 (lenta al principio, rápida después) |
| Menos repetición de contexto por tarea | La mayoría de las más de 108 skills nunca las uso ― puede dar sensación de "exceso" |
| Garantía de reembolso para probarlo | Crea cierto grado de dependencia del kit y su proceso |
Después de 30 días, ¿vale la pena comprar AgentKit? (quién debería / quién no)
Mi veredicto por tipo de persona:
- Devs solo / indie que ya se sienten cómodos con Claude Code: Sí. Este es el grupo que más claramente se beneficia ― tienes la habilidad base para que el kit la amplifique, y un $99 de una sola vez es fácil de recuperar si programas seguido.
- Devs ocupados con muchas tareas repetitivas: Sí, sobre todo porque la skill de review + el workflow recortan la fricción diaria.
- Principiantes completos en Claude Code: Espera. Aprende Claude Code puro primero; el kit no reemplaza la base. Mira la comparación concreta en AgentKit vs Claude Code puro.
- Equipos pequeños: hay potencial, pero este artículo es una mirada en solitario ― no medí a escala de equipo, así que no voy a concluir por ti.
Si quieres una reseña general del producto antes de decidir, mira qué es AgentKit ― una reseña general. Si ya tienes claro que estás en el grupo del "sí", puedes conseguir AgentKit por $79.20 (20% de descuento por el enlace) y usar la garantía de reembolso para probarlo tú mismo durante los primeros días.
Preguntas frecuentes (FAQ)
¿30 días son suficientes para sacar una conclusión?
Suficientes para ver una tendencia y decidir si comprar, pero no es investigación. Son números n=1, autorreportados. Trátalo como la experiencia de una persona y vuelve a medir en tus propias tareas.
¿En qué se diferencia este AgentKit del AgentKit de OpenAI?
Completamente distinto. Este artículo es sobre AgentKit para Claude Code (agentkit.best, el CLI ak). El AgentKit de OpenAI es la suite de construcción de agentes de OpenAI (Agent Builder/ChatKit), lanzada el 6 de octubre de 2025 ― un producto distinto, de una empresa distinta.
¿El kit cobra una tarifa anual?
El kit muestra un precio de $99 (Engineer) / $149 (Bundle) y el sitio no indica una tarifa recurrente para el kit, junto con actualizaciones de por vida. La parte anual es el Desktop App ($19/año de acceso anticipado) ― ese es un producto separado, no el kit.
¿Hay reembolso si no encaja?
El sitio tiene una garantía de reembolso. No detalla una cantidad específica de días ni condiciones, así que lee la política con atención antes de comprar.
¿Necesito Claude Code Pro?
Necesitas Claude Code para usar el kit. Yo pago el plan Pro a $20/mes. Hay un nivel gratuito limitado, pero para trabajo constante un plan de pago es más cómodo.
¿Por qué enlace debería comprar?
Puse el enlace en el recuadro al final del artículo y en la sección de Costo y ROI. Comprar por él no cambia tu precio. Mantengo la reseña equilibrada en pros y contras, para no perder credibilidad contigo.
Conclusión y enlace de compra
Después de 30 días, el veredicto honesto: AgentKit no es una varita mágica, pero es un $99 razonable para devs que ya se sienten cómodos con Claude Code ― el valor viene de un proceso consistente y de la skill de review, no del número "108+ skills". Una semana 1 lenta es normal; supérala y la fricción baja notablemente. Si estás en el grupo del "debería comprar" de arriba y quieres verificarlo por tu cuenta, usa la garantía de reembolso para probarlo.
¿Quieres que tu Claude Code oscile menos y repita menos trabajo? Si ya te sientes cómodo con Claude Code, el Engineer Kit a $99 (una sola vez, actualizaciones de por vida, garantía de reembolso) es un punto de partida razonable para correr tu propio estudio de caso.