Claude termina el código y no lo entrega directamente: pasa por 4 Skills de autoverificación, lo corrige y luego vuelve a buscarte

marsbitPublicado em 2026-07-27Última atualização em 2026-07-27

Resumo

Anthropic ha introducido una innovación clave en Claude Code: los "bucles de verificación". En lugar de entregar código directamente, Claude ahora ejecuta automáticamente cuatro verificaciones en bucle antes de considerar completada una tarea: `/code-review` para detectar bugs, `/simplify` para limpiar implementaciones redundantes, `/verify` para una validación de extremo a extremo, y `/design` (cuando se modifica la UI) para comprobar la coherencia visual con las especificaciones. Esto traslada el cuello de botella del desarrollo de "escribir código" a "verificar que el código sea correcto", permitiendo que los agentes de IA funcionen de manera más autónoma y prolongada. La clave está en encapsular los pasos de verificación manual repetitiva en "Skills" personalizables (módulos reutilizables que contienen instrucciones, flujos de trabajo y configuraciones). Los usuarios pueden crear sus propios Skills documentando sus reglas de revisión específicas. La automatización puede configurarse en cuatro niveles: manual (Standalone), integrada en un flujo (Embedded), encadenada (Chained) o ejecutada en cada Pull Request (On every PR). Este enfoque marca un cambio en la competencia de la programación con IA, que evoluciona de la generación de código hacia su verificación automática. Skills se está convirtiendo en un estándabierto adoptado por varias herramientas, lo que permite que el conocimiento y los flujos de trabajo del equipo sean portables y no dependan de un solo proveedor....

Escribir código, eso ya lo hace la IA por ti. Pero revisarlo, eso aún recae sobre tus hombros.

Si un código está bien escrito o no, la IA no se hace responsable, al final tienes que revisarlo línea por línea tú mismo: este obstáculo ha atascado a mucha gente.

Recientemente, Anthropic también ha integrado la verificación por IA en el ciclo.

Han hecho que Claude, después de escribir el código, no lo entregue directamente, sino que continúe ejecutando cuatro comprobaciones:

/code-review para detectar bugs primero, /simplify para limpiar la implementación redundante, /verify para hacer una verificación de extremo a extremo, y si esta vez se modificó la interfaz, usar /design para verificar el aspecto visual contra DESIGN.md.

Después de pasar estas cuatro comprobaciones, se considera entregado.

El 22 de julio, el equipo de Claude Code hizo público este "ciclo de verificación" interno.

En otras palabras, después de que Claude escribe el código, primero busca errores por sí mismo, los corrige hasta que no haya problemas y luego vuelve a buscarte.

Esto significa que la IA ha comenzado a evolucionar desde "saber escribir código" hasta "saber verificar el código que escribe".

El ciclo de trabajo del agente inteligente, ahora incluye una verificación

Anthropic le ha dado un nombre a esto: ciclo de verificación (verification loop).

La definición oficial es simple: es un proceso iterativo en el que Claude verifica e intenta corregir su propio trabajo.

Lo que modifica es el ciclo de trabajo del agente inteligente.

Antes era "recopilar contexto → ejecutar acción → verificación manual", donde el último paso recaía en la persona: la IA entregaba el trabajo y tú tenías que revisarlo línea por línea.

Ahora esta línea se ha alargado a "recopilar contexto → ejecutar acción → verificación automática → corrección → nueva verificación". La verificación y la corrección se han reintegrado en el ciclo.

Diagrama del ciclo del agente inteligente oficial de Anthropic: después de recibir la instrucción, Claude recopila el contexto, ejecuta la acción, verifica el resultado; si la verificación falla, se devuelve para volver a ejecutar, y solo se devuelve si pasa.

Algunas comprobaciones Claude ya las hace. Señales deterministas en el repositorio de código, como el verificador de tipos, el linter, ejecutar pruebas, errores en tiempo de ejecución, puede leerlos y también corregirlos sobre la marcha.

Lo realmente problemático es otro tipo: si la interfaz se modificó correctamente, si el flujo del usuario es fluido, si este cambio ha dejado fallos ocultos...

Esto antes solo podía confiarse a la supervisión humana, realizando las mismas comprobaciones docenas o cientos de veces.

La solución de Anthropic es escribir una a una esas comprobaciones que siempre tienes que hacer manualmente, encapsularlas en Skills y dárselas a Claude para que las ejecute automáticamente en cada tarea.

En las últimas décadas, todos los procesos de ingeniería de software: escribir requisitos, planificar, revisiones por capas, interminables reuniones, en esencia se deben a que: escribir código es demasiado lento, el tiempo de los ingenieros es demasiado valioso.

Pero cuando la IA hace que escribir código sea más rápido y barato, esta premisa deja de existir.

El propio juicio del equipo de Claude Code es: el cuello de botella no ha desaparecido, solo se ha trasladado: de "escribir código" a la verificación, revisión de código, seguridad y otros aspectos.

El código se genera demasiado rápido, y el nuevo problema se convierte en si ese código es correcto, quién lo mantiene y si las personas pueden seguir el ritmo de revisar el código.

Ante este nuevo cuello de botella, el equipo de Claude Code primero experimentó consigo mismo.

Los 4 Skills de autoverificación que el equipo de Claude Code usa diariamente

Internamente, el equipo de Claude Code usa diariamente estos cuatro Skills de autoverificación.

/code-review, revisa específicamente los cambios en el código, detecta posibles bugs y, de paso, da una opinión de revisión.

Esto equivale a tener un revisor incansable a tu disposición.

/simplify, limpia el diff de esta modificación, elimina implementaciones complejas y enrevesadas, haciendo la estructura más simple.

No añade funciones, sino que elimina redundancias, simplifica la implementación, reduciendo los costes de mantenimiento futuros.

Esto es muy importante y demuestra gran habilidad. La mayoría de la gente escribe código acumulando, una herramienta que activamente hace reducción es especialmente valiosa.

/verify, realiza una verificación de extremo a extremo, la ejecuta de verdad, confirmando que la funcionalidad realmente se ha completado, y no solo "parece completada".

/design, solo entra en acción cuando se modifica la interfaz de usuario. Verifica punto por punto contra el DESIGN.md en el repositorio si tu implementación visual se ha desviado.

Estos 4 Skills no han surgido de la nada.

En su base, Claude Code ya ha establecido una capa de soporte de verificación lista para usar:

El /verify incorporado puede ejecutar la aplicación para observar cambios, tú escribes claramente los comandos de construcción y prueba en CLAUDE.md, y él los ejecuta; también hay Code Review específico para revisiones multiagente en PRs, y GitHub Actions que se disparan automáticamente en cada commit.

Los 4 Skills del equipo equivalen a añadir su propio proceso adicional sobre esta base genérica.

¿Cómo escribir tu propio Skill de verificación?

El método que da Anthropic también es simple:

Escribe con palabras sencillas ese paso que siempre tienes que hacer manualmente, como si le estuvieras explicando las precauciones a un nuevo compañero en su primer día.

Si te atas incluso al describir cómo debe ser esta comprobación, primero puedes pedirle a Claude que dé una versión de mejores prácticas genéricas y luego modificarla.

Es muy probable que tu versión difiera de la práctica genérica en algunos puntos, y esas diferencias son precisamente lo que más debe registrarse.

La verificación tampoco tiene que ser necesariamente un juicio vago como "sentir si está bien".

Por ejemplo: cualquier cambio que elimine un campo de la base de datos pero no tenga pasos de migración de datos asociados, será rechazado. Esta es una "regla local" que un linter genérico nunca captará, pero es exclusiva de tu proyecto.

Cualquier línea roja que solo hayas podido mantener mediante supervisión manual, merece la pena escribirla como un ciclo.

¿Y después de escribirla?

Dásela a skill-creator para que te haga algunas preguntas inversamente, o simplemente añade un archivo Markdown en .claude/skills/.

El Skill de verificación más simple son unas pocas líneas de explicación y un párrafo de texto. Luego llámalo en una nueva tarea, confirma que esta comprobación realmente se ejecuta, y si no, corrígelo.

Para esos Skills que no puedes modificar, como los incorporados o gestionados por plugins, también hay una solución: escribe un Skill envoltorio (wrapper) que llame primero al original y luego a tu verificación. Rodéalo, e igualmente integra la comprobación.

La verificación no es de talla única, tiene 4 niveles

Después de encapsular la comprobación en un Skill, la siguiente pregunta es: ¿cuándo se activa esto?

Anthropic da 4 niveles de automatización, de más flexible a más estricto.

Standalone: Tú mismo lo recuerdas y lo llamas manualmente.

Embedded: Integrado en el flujo de una tarea, se ejecuta junto con ella.

Chained: Varios Skills de verificación encadenados en una cadena, se ejecutan automáticamente uno tras otro.

On every PR: El nivel más duro, cada vez que se envía código pasa automáticamente por él.

La transición intermedia, oficialmente la llaman "del hábito al contrato".

Lo que antes era el hábito personal de "siempre recuerdo ejecutar /verify después de /simplify", después de encadenarlo, se convierte en el contrato fijo de "después de ejecutar /simplify, automáticamente se llama a /verify".

Toda la cadena recorre el ciclo de desarrollo por sí misma, y solo vuelve a buscarte cuando necesita tu aprobación.

Cuanto más larga es la cadena, mayor es la fiabilidad, pero oficialmente advierten específicamente: la verificación en cadena consume tokens de verdad.

Así que no establezcas desde el principio todas las comprobaciones como puerta de PR, que bloquee cada envío. La postura correcta es primero ver si es estable, y luego añadir gradualmente.

Detrás de los 4 Skills, la programación con IA está cambiando de carril

Detrás de los 4 Skills, la competencia en programación con IA está pasando de la generación a la verificación.

El padre de Claude Code también ha dado el mismo juicio.

El 9 de junio de este año, tuiteó: En la era en que los modelos potentes pueden ejecutarse de forma autónoma durante largos periodos, la autoverificación es clave para que el modelo se ejecute durante más tiempo y los resultados se acerquen más a tus expectativas: no tienes que estar frecuentemente supervisando a Claude, y puedes confiarle más trabajo.

En pocas palabras, cuanto más sólida sea la verificación, más libertad tendrá el agente para ejecutarse; cuanto más tiempo se ejecute, más tranquila estará la persona.

Antes confiábamos en las instrucciones (prompts), pero también tienen un límite: solo resuelven la tarea de esta vez, la próxima hay que empezar de nuevo.

Aquí primero corrijamos un malentendido común: un Skill no es un prompt en Markdown.

Es un módulo de capacidad, que contiene instrucciones, estructura de archivos, scripts, llamadas a herramientas, configuración y un conjunto completo de flujos de trabajo. Es la sedimentación de los pasos de verificación del equipo, normas de diseño, errores cometidos, en un paquete disponible a demanda, que Claude consulta por sí mismo cuando lo necesita.

Lo más crucial es que los Skills están pasando de ser una característica de Claude Code a un estándar abierto entre fabricantes.

Según el análisis de la industria, GitHub Copilot, Cursor, OpenAI Codex, Gemini CLI ya han adoptado el mismo formato.

Esto significa que los Skills que sedimentas para tu equipo no quedarán encerrados en una sola herramienta, sino que sedimentarán la experiencia, normas y procesos de verificación del equipo, convirtiéndose en una capacidad reutilizable.

Esto también lleva a una realidad punzante: el mismo Claude, utilizado por diferentes equipos, puede tener una eficiencia varias veces diferente. La causa de esta diferencia no está en el modelo, sino en el flujo de trabajo:

Si has escrito las comprobaciones como Skills, si has establecido ciclos de verificación, si has hecho que el agente inteligente cierre él mismo el ciclo de retroalimentación.

En definitiva, la capacidad del agente inteligente es una suma: modelo, más herramientas, más mecanismo de verificación, más flujo de trabajo.

El modelo, en este aspecto, cada vez es más similar entre todos. Lo que realmente marca la diferencia son los otros tres aspectos, y todos ellos están en manos del usuario.

Por supuesto, lo que muestra este blog es la optimización del flujo de desarrollo asistido por IA, no que "la IA ya pueda escribir software de forma independiente". Aún depende de los ingenieros y no puede hacer entregas a nivel de producción sin intervención humana.

Por lo tanto, no es que los agentes inteligentes vayan a quitar el trabajo a los ingenieros humanos, pero la dirección ya es clara.

Antes, siempre estábamos enseñando a la IA cómo escribir código, ahora hay que empezar a enseñarle a verificar si lo que escribe está bien.

Para alguien que usa la IA a diario para escribir código, el día en que finalmente pueda confiar con tranquilidad a la IA esa tarea de "tener que revisar manualmente antes de salir del trabajo", entonces realmente comenzará a hacer el trabajo por ti.

Referencias:

https://claude.com/blog/building-verification-loops-in-claude-code-with-skills

https://claude.com/blog/getting-started-with-loops?utm_source=chatgpt.com

Este artículo proviene del WeChat público "新智元" (Nueva Era de la Inteligencia), autor: ASI启示录

Criptomoedas em alta

Perguntas relacionadas

Q¿Qué es el 'verification loop' que ha implementado Claude Code según el artículo?

AEs un proceso iterativo donde Claude revisa e intenta corregir su propio trabajo automáticamente, en lugar de entregar el código directamente. Incluye cuatro pasos principales: /code-review para encontrar errores, /simplify para limpiar implementaciones redundantes, /verify para una validación de extremo a extremo y /design para revisar cambios visuales contra DESIGN.md.

Q¿Cuáles son los cuatro 'Skill' (habilidades) de autoverificación que el equipo de Claude Code utiliza internamente?

ALos cuatro Skill son: 1) /code-review para detectar errores potenciales, 2) /simplify para limpiar el código complejo o redundante, 3) /verify para ejecutar pruebas de extremo a extremo y confirmar la funcionalidad, y 4) /design (cuando se modifica la interfaz) para verificar que los cambios visuales cumplan con las especificaciones de DESIGN.md.

QSegún el artículo, ¿qué significa que un Skill no es solo un prompt de Markdown?

AUn Skill es un módulo de capacidad que contiene instrucciones, estructura de archivos, scripts, llamadas a herramientas, configuración y un flujo de trabajo completo. Es la forma de encapsular y reutilizar los pasos de verificación, normas de diseño y lecciones aprendidas por un equipo, haciéndolo un paquete de conocimientos accesible para Claude y transferible entre herramientas.

Q¿Qué cuatro niveles de automatización describe Anthropic para activar un Skill de verificación?

ALos cuatro niveles son: 1) Standalone (se invoca manualmente), 2) Embedded (se ejecuta automáticamente dentro de un flujo de tareas específico), 3) Chained (varios Skills se ejecutan en cadena, uno tras otro) y 4) On every PR (se ejecuta automáticamente en cada solicitud de cambios).

Q¿Por qué el artículo sugiere que la competencia en la programación con IA está cambiando de la generación a la verificación?

APorque la generación de código se ha vuelto rápida y barata, desplazando el cuello de botella a la verificación, revisión y mantenimiento del código producido. La capacidad de un agente de IA para auto-verificarse de forma sólida permite que funcione de manera más autónoma y prolongada, liberando a los ingenieros humanos de tareas de revisión manual repetitivas.

Leituras Relacionadas

Must-Watch Events Next Week|CLARITY Act Could Face Senate Vote; SpaceX, Circle to Report Earnings (8.3-8.9)

**Summary: Key Events and Developments to Watch (August 3-9)** The upcoming week is marked by significant financial disclosures, key legislative deadlines, and notable product updates. **Major Financial Events:** Several companies are scheduled to release their Q2 2026 earnings. American Bitcoin (ABTC) will report on August 3, followed by SpaceX and Hut 8 Mining Corp. on August 4, and Circle on August 5. Notably, a significant portion of SpaceX shares (up to 12% of total shares) will be unlocked on August 6 following their earnings release. **Key Legislative Deadline:** The U.S. Senate faces an August 7 deadline to secure 60 votes for the CLARITY Act, a bipartisan bill aiming to establish a federal regulatory framework for cryptocurrencies. The Senate may hold a full vote on the bill during the week. **Economic Data:** The U.S. July Non-Farm Payrolls report will be released on August 7, providing crucial labor market data. **Technology & Product Updates:** * **Shutdowns:** DeFi portfolio tracker Zapper and wallet app Ctrl Wallet will cease operations on August 3. * **Upgrades:** LayerZero will deprecate its v1 relayers on August 3. XRP Ledger's new version 3.3.0, featuring five new functions, is expected next week. * **AI:** Elon Musk announced that the advanced Grok 4.6 AI model is set for release around August 7. * **Bitcoin:** The BIP-110 forced signaling for a potential Bitcoin network change is scheduled to begin around August 8. **Other Notable Events:** Chinese robotics firm Unitree Tech has set its preliminary price inquiry for its IPO for August 5. South Korean exchange Upbit will delist AQT and AERGO tokens on August 3.

marsbitHá 39m

Must-Watch Events Next Week|CLARITY Act Could Face Senate Vote; SpaceX, Circle to Report Earnings (8.3-8.9)

marsbitHá 39m

Stocks Are Plummeting More Sharply Than Cryptocurrencies. Where Has the Money Gone?

Stock Markets Plunge Deeper Than Cryptocurrencies: Where Did the Money Go? In late July, Seoul's Kospi index triggered circuit breakers for two consecutive days, plummeting over 40% from its June high. The collapse was led by heavyweight stocks like SK Hynix, whose record profits still disappointed investors, and devastating leveraged ETFs, with one major product losing over 83% of its value. This signaled a global, forced deleveraging targeting the most crowded trades. Interestingly, while stocks exhibited extreme volatility akin to crypto markets, Bitcoin rose nearly 15% in July after a prior steep drop. Analysis shows the money fleeing equities did not flow into Bitcoin. Instead, Bitcoin had already absorbed its sell-off in May-June, when U.S. spot Bitcoin ETFs saw historic outflows. The true safe-haven beneficiary was gold, whose price rose over 20% year-on-year, highlighting a decoupling between Bitcoin and gold as "digital gold." The sell-off was a targeted unwinding of leveraged positions in tech and semiconductors, accelerated by broker-dealer risk management and shifts in the AI narrative, including new competition from Chinese memory chipmakers. The retreat path was clear: from high-valuation tech stocks to cash and U.S. Treasuries, then to gold. For Bitcoin to attract sustained institutional inflows, conditions like eased global liquidity pressure, a "soft-landing" Fed rate cut, and U.S. regulatory clarity via legislation like the stalled CLARITY Act are needed. Currently, Bitcoin is not a safe haven but an already-cleared asset. Its low correlation with tech stocks, however, makes it a potential diversification play for institutional portfolios once the storm passes. The money isn't here yet, but the positioning is underway.

marsbitHá 39m

Stocks Are Plummeting More Sharply Than Cryptocurrencies. Where Has the Money Gone?

marsbitHá 39m

In Conversation with Ray Dalio: We Are Currently in an AI Bubble, with 1% of My Portfolio in Bitcoin

Ray Dalio, founder of Bridgewater Associates, warns in an interview that the current AI boom shows classic bubble characteristics, which could lead to significant economic downturns as seen in past cycles like 1929 or 2000. He explains that speculative enthusiasm, fueled by debt and overvaluation, often precedes a crash when rising rates or taxation force asset sales, causing widespread losses and recession. Dalio also outlines his "Big Cycle" theory, describing an approximate 80-year pattern where widening wealth gaps, massive government deficits, and shifting geopolitical power (like China's rise) create internal conflict and global instability. He emphasizes that we are in a late-cycle, transitional phase where traditional powers like the US and UK face decline. For personal wealth protection, Dalio advises diversification beyond cash into assets like stocks, bonds, real estate, and particularly gold, which he prefers over Bitcoin. While he holds about 1% of his portfolio in Bitcoin as a non-printable hard asset, he views gold as more secure from technological or governmental threats. Regarding AI's impact, Dalio believes it will disproportionately benefit capital owners, worsening inequality by replacing both physical and cognitive labor. He suggests that human intuition and emotional intelligence, combined with AI, will be key for future workers. On taxation, Dalio argues that wealth taxes are impractical and risk triggering asset sell-offs, reducing productive investment. He points to the UK as a cautionary example of debt, low productivity, and political strife. Geopolitically, Dalio foresees a more regionalized world, with the US showing weakness in prolonged conflicts like with Iran, akin to past imperial declines. The ideal outcome, he suggests, is coexisting powerful blocs (e.g., Americas, China-Asia Pacific) without major war.

marsbitHá 4h

In Conversation with Ray Dalio: We Are Currently in an AI Bubble, with 1% of My Portfolio in Bitcoin

marsbitHá 4h

Daily 7.2 Trillion KRW: Foreign Capital's Record Net Buying on Friday! Wall Street Says Headwinds for Korean Stock Fund Flows Have Subsided

South Korean stock market sees a dramatic shift in fund flows. On July 31, foreign investors made a record net purchase of approximately KRW 7.2 trillion in KOSPI stocks, marking a fundamental reversal from the persistent large-scale net outflows seen in previous months. This contributed to a significant narrowing of foreign net selling in July to KRW 9.8 trillion, down sharply from KRW 48.4 trillion in June and KRW 44.5 trillion in May. Simultaneously, domestic institutional pressure eased. South Korean pension funds and asset managers turned to a net buying position in July, purchasing KRW 1.0 trillion worth of KOSPI shares, contrasting with net sales in May and June. Market volatility is expected to be dampened by new financial regulations. Effective July 31, the Financial Services Commission tightened access for retail investors to single-stock leveraged ETFs by raising the minimum cash deposit requirement. Trading volumes for these products subsequently dropped to about 50% of their monthly average. Citigroup Research maintains its year-end KOSPI target of 10,000 points. The firm cites several supportive factors: the substantial easing of headwinds from capital outflows, a robust fundamental outlook for the semiconductor sector, historically low market valuations, strong economic fundamentals, and the potential for policy support from financial authorities if needed.

marsbitHá 4h

Daily 7.2 Trillion KRW: Foreign Capital's Record Net Buying on Friday! Wall Street Says Headwinds for Korean Stock Fund Flows Have Subsided

marsbitHá 4h

Trading

Spot

Artigos em Destaque

Como comprar 4

Bem-vindo à HTX.com!Tornámos a compra de 4 (4) simples e conveniente.Segue o nosso guia passo a passo para iniciar a tua jornada no mundo das criptos.Passo 1: cria a tua conta HTXUtiliza o teu e-mail ou número de telefone para te inscreveres numa conta gratuita na HTX.Desfruta de um processo de inscrição sem complicações e desbloqueia todas as funcionalidades.Obter a minha contaPasso 2: vai para Comprar Cripto e escolhe o teu método de pagamentoCartão de crédito/débito: usa o teu visa ou mastercard para comprar 4 (4) instantaneamente.Saldo: usa os fundos da tua conta HTX para transacionar sem problemas.Terceiros: adicionamos métodos de pagamento populares, como Google Pay e Apple Pay, para aumentar a conveniência.P2P: transaciona diretamente com outros utilizadores na HTX.Mercado de balcão (OTC): oferecemos serviços personalizados e taxas de câmbio competitivas para os traders.Passo 3: armazena teu 4 (4)Depois de comprar o teu 4 (4), armazena-o na tua conta HTX.Alternativamente, podes enviá-lo para outro lugar através de transferência blockchain ou usá-lo para transacionar outras criptomoedas.Passo 4: transaciona 4 (4)Transaciona facilmente 4 (4) no mercado à vista da HTX.Acede simplesmente à tua conta, seleciona o teu par de trading, executa as tuas transações e monitoriza em tempo real.Oferecemos uma experiência de fácil utilização tanto para principiantes como para traders experientes.

701 Visualizações TotaisPublicado em {updateTime}Atualizado em 2026.06.02

Como comprar 4

Discussões

Bem-vindo à Comunidade HTX. Aqui, pode manter-se informado sobre os mais recentes desenvolvimentos da plataforma e obter acesso a análises profissionais de mercado. As opiniões dos utilizadores sobre o preço de 4 (4) são apresentadas abaixo.

活动图片