Claude termina el código y no lo entrega directamente: pasa por 4 Skills de autoverificación, lo corrige y luego vuelve a buscarte

marsbit2026-07-27 tarihinde yayınlandı2026-07-27 tarihinde güncellendi

Özet

Anthropic ha introducido una innovación clave en Claude Code: los "bucles de verificación". En lugar de entregar código directamente, Claude ahora ejecuta automáticamente cuatro verificaciones en bucle antes de considerar completada una tarea: `/code-review` para detectar bugs, `/simplify` para limpiar implementaciones redundantes, `/verify` para una validación de extremo a extremo, y `/design` (cuando se modifica la UI) para comprobar la coherencia visual con las especificaciones. Esto traslada el cuello de botella del desarrollo de "escribir código" a "verificar que el código sea correcto", permitiendo que los agentes de IA funcionen de manera más autónoma y prolongada. La clave está en encapsular los pasos de verificación manual repetitiva en "Skills" personalizables (módulos reutilizables que contienen instrucciones, flujos de trabajo y configuraciones). Los usuarios pueden crear sus propios Skills documentando sus reglas de revisión específicas. La automatización puede configurarse en cuatro niveles: manual (Standalone), integrada en un flujo (Embedded), encadenada (Chained) o ejecutada en cada Pull Request (On every PR). Este enfoque marca un cambio en la competencia de la programación con IA, que evoluciona de la generación de código hacia su verificación automática. Skills se está convirtiendo en un estándabierto adoptado por varias herramientas, lo que permite que el conocimiento y los flujos de trabajo del equipo sean portables y no dependan de un solo proveedor....

Escribir código, eso ya lo hace la IA por ti. Pero revisarlo, eso aún recae sobre tus hombros.

Si un código está bien escrito o no, la IA no se hace responsable, al final tienes que revisarlo línea por línea tú mismo: este obstáculo ha atascado a mucha gente.

Recientemente, Anthropic también ha integrado la verificación por IA en el ciclo.

Han hecho que Claude, después de escribir el código, no lo entregue directamente, sino que continúe ejecutando cuatro comprobaciones:

/code-review para detectar bugs primero, /simplify para limpiar la implementación redundante, /verify para hacer una verificación de extremo a extremo, y si esta vez se modificó la interfaz, usar /design para verificar el aspecto visual contra DESIGN.md.

Después de pasar estas cuatro comprobaciones, se considera entregado.

El 22 de julio, el equipo de Claude Code hizo público este "ciclo de verificación" interno.

En otras palabras, después de que Claude escribe el código, primero busca errores por sí mismo, los corrige hasta que no haya problemas y luego vuelve a buscarte.

Esto significa que la IA ha comenzado a evolucionar desde "saber escribir código" hasta "saber verificar el código que escribe".

El ciclo de trabajo del agente inteligente, ahora incluye una verificación

Anthropic le ha dado un nombre a esto: ciclo de verificación (verification loop).

La definición oficial es simple: es un proceso iterativo en el que Claude verifica e intenta corregir su propio trabajo.

Lo que modifica es el ciclo de trabajo del agente inteligente.

Antes era "recopilar contexto → ejecutar acción → verificación manual", donde el último paso recaía en la persona: la IA entregaba el trabajo y tú tenías que revisarlo línea por línea.

Ahora esta línea se ha alargado a "recopilar contexto → ejecutar acción → verificación automática → corrección → nueva verificación". La verificación y la corrección se han reintegrado en el ciclo.

Diagrama del ciclo del agente inteligente oficial de Anthropic: después de recibir la instrucción, Claude recopila el contexto, ejecuta la acción, verifica el resultado; si la verificación falla, se devuelve para volver a ejecutar, y solo se devuelve si pasa.

Algunas comprobaciones Claude ya las hace. Señales deterministas en el repositorio de código, como el verificador de tipos, el linter, ejecutar pruebas, errores en tiempo de ejecución, puede leerlos y también corregirlos sobre la marcha.

Lo realmente problemático es otro tipo: si la interfaz se modificó correctamente, si el flujo del usuario es fluido, si este cambio ha dejado fallos ocultos...

Esto antes solo podía confiarse a la supervisión humana, realizando las mismas comprobaciones docenas o cientos de veces.

La solución de Anthropic es escribir una a una esas comprobaciones que siempre tienes que hacer manualmente, encapsularlas en Skills y dárselas a Claude para que las ejecute automáticamente en cada tarea.

En las últimas décadas, todos los procesos de ingeniería de software: escribir requisitos, planificar, revisiones por capas, interminables reuniones, en esencia se deben a que: escribir código es demasiado lento, el tiempo de los ingenieros es demasiado valioso.

Pero cuando la IA hace que escribir código sea más rápido y barato, esta premisa deja de existir.

El propio juicio del equipo de Claude Code es: el cuello de botella no ha desaparecido, solo se ha trasladado: de "escribir código" a la verificación, revisión de código, seguridad y otros aspectos.

El código se genera demasiado rápido, y el nuevo problema se convierte en si ese código es correcto, quién lo mantiene y si las personas pueden seguir el ritmo de revisar el código.

Ante este nuevo cuello de botella, el equipo de Claude Code primero experimentó consigo mismo.

Los 4 Skills de autoverificación que el equipo de Claude Code usa diariamente

Internamente, el equipo de Claude Code usa diariamente estos cuatro Skills de autoverificación.

/code-review, revisa específicamente los cambios en el código, detecta posibles bugs y, de paso, da una opinión de revisión.

Esto equivale a tener un revisor incansable a tu disposición.

/simplify, limpia el diff de esta modificación, elimina implementaciones complejas y enrevesadas, haciendo la estructura más simple.

No añade funciones, sino que elimina redundancias, simplifica la implementación, reduciendo los costes de mantenimiento futuros.

Esto es muy importante y demuestra gran habilidad. La mayoría de la gente escribe código acumulando, una herramienta que activamente hace reducción es especialmente valiosa.

/verify, realiza una verificación de extremo a extremo, la ejecuta de verdad, confirmando que la funcionalidad realmente se ha completado, y no solo "parece completada".

/design, solo entra en acción cuando se modifica la interfaz de usuario. Verifica punto por punto contra el DESIGN.md en el repositorio si tu implementación visual se ha desviado.

Estos 4 Skills no han surgido de la nada.

En su base, Claude Code ya ha establecido una capa de soporte de verificación lista para usar:

El /verify incorporado puede ejecutar la aplicación para observar cambios, tú escribes claramente los comandos de construcción y prueba en CLAUDE.md, y él los ejecuta; también hay Code Review específico para revisiones multiagente en PRs, y GitHub Actions que se disparan automáticamente en cada commit.

Los 4 Skills del equipo equivalen a añadir su propio proceso adicional sobre esta base genérica.

¿Cómo escribir tu propio Skill de verificación?

El método que da Anthropic también es simple:

Escribe con palabras sencillas ese paso que siempre tienes que hacer manualmente, como si le estuvieras explicando las precauciones a un nuevo compañero en su primer día.

Si te atas incluso al describir cómo debe ser esta comprobación, primero puedes pedirle a Claude que dé una versión de mejores prácticas genéricas y luego modificarla.

Es muy probable que tu versión difiera de la práctica genérica en algunos puntos, y esas diferencias son precisamente lo que más debe registrarse.

La verificación tampoco tiene que ser necesariamente un juicio vago como "sentir si está bien".

Por ejemplo: cualquier cambio que elimine un campo de la base de datos pero no tenga pasos de migración de datos asociados, será rechazado. Esta es una "regla local" que un linter genérico nunca captará, pero es exclusiva de tu proyecto.

Cualquier línea roja que solo hayas podido mantener mediante supervisión manual, merece la pena escribirla como un ciclo.

¿Y después de escribirla?

Dásela a skill-creator para que te haga algunas preguntas inversamente, o simplemente añade un archivo Markdown en .claude/skills/.

El Skill de verificación más simple son unas pocas líneas de explicación y un párrafo de texto. Luego llámalo en una nueva tarea, confirma que esta comprobación realmente se ejecuta, y si no, corrígelo.

Para esos Skills que no puedes modificar, como los incorporados o gestionados por plugins, también hay una solución: escribe un Skill envoltorio (wrapper) que llame primero al original y luego a tu verificación. Rodéalo, e igualmente integra la comprobación.

La verificación no es de talla única, tiene 4 niveles

Después de encapsular la comprobación en un Skill, la siguiente pregunta es: ¿cuándo se activa esto?

Anthropic da 4 niveles de automatización, de más flexible a más estricto.

Standalone: Tú mismo lo recuerdas y lo llamas manualmente.

Embedded: Integrado en el flujo de una tarea, se ejecuta junto con ella.

Chained: Varios Skills de verificación encadenados en una cadena, se ejecutan automáticamente uno tras otro.

On every PR: El nivel más duro, cada vez que se envía código pasa automáticamente por él.

La transición intermedia, oficialmente la llaman "del hábito al contrato".

Lo que antes era el hábito personal de "siempre recuerdo ejecutar /verify después de /simplify", después de encadenarlo, se convierte en el contrato fijo de "después de ejecutar /simplify, automáticamente se llama a /verify".

Toda la cadena recorre el ciclo de desarrollo por sí misma, y solo vuelve a buscarte cuando necesita tu aprobación.

Cuanto más larga es la cadena, mayor es la fiabilidad, pero oficialmente advierten específicamente: la verificación en cadena consume tokens de verdad.

Así que no establezcas desde el principio todas las comprobaciones como puerta de PR, que bloquee cada envío. La postura correcta es primero ver si es estable, y luego añadir gradualmente.

Detrás de los 4 Skills, la programación con IA está cambiando de carril

Detrás de los 4 Skills, la competencia en programación con IA está pasando de la generación a la verificación.

El padre de Claude Code también ha dado el mismo juicio.

El 9 de junio de este año, tuiteó: En la era en que los modelos potentes pueden ejecutarse de forma autónoma durante largos periodos, la autoverificación es clave para que el modelo se ejecute durante más tiempo y los resultados se acerquen más a tus expectativas: no tienes que estar frecuentemente supervisando a Claude, y puedes confiarle más trabajo.

En pocas palabras, cuanto más sólida sea la verificación, más libertad tendrá el agente para ejecutarse; cuanto más tiempo se ejecute, más tranquila estará la persona.

Antes confiábamos en las instrucciones (prompts), pero también tienen un límite: solo resuelven la tarea de esta vez, la próxima hay que empezar de nuevo.

Aquí primero corrijamos un malentendido común: un Skill no es un prompt en Markdown.

Es un módulo de capacidad, que contiene instrucciones, estructura de archivos, scripts, llamadas a herramientas, configuración y un conjunto completo de flujos de trabajo. Es la sedimentación de los pasos de verificación del equipo, normas de diseño, errores cometidos, en un paquete disponible a demanda, que Claude consulta por sí mismo cuando lo necesita.

Lo más crucial es que los Skills están pasando de ser una característica de Claude Code a un estándar abierto entre fabricantes.

Según el análisis de la industria, GitHub Copilot, Cursor, OpenAI Codex, Gemini CLI ya han adoptado el mismo formato.

Esto significa que los Skills que sedimentas para tu equipo no quedarán encerrados en una sola herramienta, sino que sedimentarán la experiencia, normas y procesos de verificación del equipo, convirtiéndose en una capacidad reutilizable.

Esto también lleva a una realidad punzante: el mismo Claude, utilizado por diferentes equipos, puede tener una eficiencia varias veces diferente. La causa de esta diferencia no está en el modelo, sino en el flujo de trabajo:

Si has escrito las comprobaciones como Skills, si has establecido ciclos de verificación, si has hecho que el agente inteligente cierre él mismo el ciclo de retroalimentación.

En definitiva, la capacidad del agente inteligente es una suma: modelo, más herramientas, más mecanismo de verificación, más flujo de trabajo.

El modelo, en este aspecto, cada vez es más similar entre todos. Lo que realmente marca la diferencia son los otros tres aspectos, y todos ellos están en manos del usuario.

Por supuesto, lo que muestra este blog es la optimización del flujo de desarrollo asistido por IA, no que "la IA ya pueda escribir software de forma independiente". Aún depende de los ingenieros y no puede hacer entregas a nivel de producción sin intervención humana.

Por lo tanto, no es que los agentes inteligentes vayan a quitar el trabajo a los ingenieros humanos, pero la dirección ya es clara.

Antes, siempre estábamos enseñando a la IA cómo escribir código, ahora hay que empezar a enseñarle a verificar si lo que escribe está bien.

Para alguien que usa la IA a diario para escribir código, el día en que finalmente pueda confiar con tranquilidad a la IA esa tarea de "tener que revisar manualmente antes de salir del trabajo", entonces realmente comenzará a hacer el trabajo por ti.

Referencias:

https://claude.com/blog/building-verification-loops-in-claude-code-with-skills

https://claude.com/blog/getting-started-with-loops?utm_source=chatgpt.com

Este artículo proviene del WeChat público "新智元" (Nueva Era de la Inteligencia), autor: ASI启示录

Trend Kriptolar

İlgili Sorular

Q¿Qué es el 'verification loop' que ha implementado Claude Code según el artículo?

AEs un proceso iterativo donde Claude revisa e intenta corregir su propio trabajo automáticamente, en lugar de entregar el código directamente. Incluye cuatro pasos principales: /code-review para encontrar errores, /simplify para limpiar implementaciones redundantes, /verify para una validación de extremo a extremo y /design para revisar cambios visuales contra DESIGN.md.

Q¿Cuáles son los cuatro 'Skill' (habilidades) de autoverificación que el equipo de Claude Code utiliza internamente?

ALos cuatro Skill son: 1) /code-review para detectar errores potenciales, 2) /simplify para limpiar el código complejo o redundante, 3) /verify para ejecutar pruebas de extremo a extremo y confirmar la funcionalidad, y 4) /design (cuando se modifica la interfaz) para verificar que los cambios visuales cumplan con las especificaciones de DESIGN.md.

QSegún el artículo, ¿qué significa que un Skill no es solo un prompt de Markdown?

AUn Skill es un módulo de capacidad que contiene instrucciones, estructura de archivos, scripts, llamadas a herramientas, configuración y un flujo de trabajo completo. Es la forma de encapsular y reutilizar los pasos de verificación, normas de diseño y lecciones aprendidas por un equipo, haciéndolo un paquete de conocimientos accesible para Claude y transferible entre herramientas.

Q¿Qué cuatro niveles de automatización describe Anthropic para activar un Skill de verificación?

ALos cuatro niveles son: 1) Standalone (se invoca manualmente), 2) Embedded (se ejecuta automáticamente dentro de un flujo de tareas específico), 3) Chained (varios Skills se ejecutan en cadena, uno tras otro) y 4) On every PR (se ejecuta automáticamente en cada solicitud de cambios).

Q¿Por qué el artículo sugiere que la competencia en la programación con IA está cambiando de la generación a la verificación?

APorque la generación de código se ha vuelto rápida y barata, desplazando el cuello de botella a la verificación, revisión y mantenimiento del código producido. La capacidad de un agente de IA para auto-verificarse de forma sólida permite que funcione de manera más autónoma y prolongada, liberando a los ingenieros humanos de tareas de revisión manual repetitivas.

İlgili Okumalar

In Jinjiang, Fujian, a Storage Super Unicorn Lies Quiet

In Fujian's Jinjiang, a city known for sportswear, lies a quiet semiconductor giant: Fujian Jinhua Integrated Circuit Co. (JHICC). Once a promising domestic DRAM manufacturer alongside Yangtze Memory and ChangXin Memory Technologies (CXMT), its journey was derailed in 2018 when the U.S. placed it on an Entity List and filed criminal charges for alleged trade secret theft. This halted production for years. A turning point came in February 2024 when a U.S. federal court found JHICC not guilty. However, it had lost crucial time. While CXMT soared to become a top-valued A-share company in 2024, JHICC, with an estimated valuation of 80 billion RMB, was just restarting. Its current output is primarily customized DDR4 chips, not the advanced DDR5/HBM demanded for AI, but it still benefits from the broader memory chip upcycle. JHICC's story is tied to Chen Zhengkun, a veteran engineer who left Micron to lead the venture. Founded in 2016 with state-backed funding, JHICC partnered with Taiwan's UMC to develop DRAM technology. Rapid progress was cut short by the U.S. actions, which Micron initiated, partly due to its heavy reliance on the Chinese market. Post-sanctions, Chen's team worked to rebuild the production line with reduced reliance on U.S. technology. According to its records, JHICC achieved small-scale production and revenue growth under immense pressure. It now focuses on the stable "niche" DRAM market (e.g., TVs, routers) with a monthly capacity of ~40,000 wafers, aiming for 60,000 by 2026. It holds over 1,000 patents but remains on the Entity List. For Jinjiang, investing in JHICC was a bold industrial leap. The local government provided unwavering financial and logistical support during the crisis, helping the company survive. JHICC has become the anchor for a growing local semiconductor cluster. Though its scale lags behind domestic peers, JHICC's persistence symbolizes a hard-won foothold in a global market long dominated by Samsung, SK Hynix, and Micron. Having missed one boom, it seeks a place in the new AI-driven memory supercycle.

marsbit32 dk önce

In Jinjiang, Fujian, a Storage Super Unicorn Lies Quiet

marsbit32 dk önce

Must-Watch Events Next Week|CLARITY Act Could Face Senate Vote; SpaceX, Circle to Report Earnings (8.3-8.9)

**Summary: Key Events and Developments to Watch (August 3-9)** The upcoming week is marked by significant financial disclosures, key legislative deadlines, and notable product updates. **Major Financial Events:** Several companies are scheduled to release their Q2 2026 earnings. American Bitcoin (ABTC) will report on August 3, followed by SpaceX and Hut 8 Mining Corp. on August 4, and Circle on August 5. Notably, a significant portion of SpaceX shares (up to 12% of total shares) will be unlocked on August 6 following their earnings release. **Key Legislative Deadline:** The U.S. Senate faces an August 7 deadline to secure 60 votes for the CLARITY Act, a bipartisan bill aiming to establish a federal regulatory framework for cryptocurrencies. The Senate may hold a full vote on the bill during the week. **Economic Data:** The U.S. July Non-Farm Payrolls report will be released on August 7, providing crucial labor market data. **Technology & Product Updates:** * **Shutdowns:** DeFi portfolio tracker Zapper and wallet app Ctrl Wallet will cease operations on August 3. * **Upgrades:** LayerZero will deprecate its v1 relayers on August 3. XRP Ledger's new version 3.3.0, featuring five new functions, is expected next week. * **AI:** Elon Musk announced that the advanced Grok 4.6 AI model is set for release around August 7. * **Bitcoin:** The BIP-110 forced signaling for a potential Bitcoin network change is scheduled to begin around August 8. **Other Notable Events:** Chinese robotics firm Unitree Tech has set its preliminary price inquiry for its IPO for August 5. South Korean exchange Upbit will delist AQT and AERGO tokens on August 3.

marsbit2 saat önce

Must-Watch Events Next Week|CLARITY Act Could Face Senate Vote; SpaceX, Circle to Report Earnings (8.3-8.9)

marsbit2 saat önce

İşlemler

Spot

Popüler Makaleler

4 Nasıl Satın Alınır

HTX.com’a hoş geldiniz! 4 (4) satın alma işlemlerini basit ve kullanışlı bir hâle getirdik. Adım adım açıkladığımız rehberimizi takip ederek kripto yolculuğunuza başlayın. 1. Adım: HTX Hesabınızı OluşturunHTX'te ücretsiz bir hesap açmak için e-posta adresinizi veya telefon numaranızı kullanın. Sorunsuzca kaydolun ve tüm özelliklerin kilidini açın. Hesabımı Aç2. Adım: Kripto Satın Al Bölümüne Gidin ve Ödeme Yönteminizi SeçinKredi/Banka Kartı: Visa veya Mastercard'ınızı kullanarak anında 4 (4) satın alın.Bakiye: Sorunsuz bir şekilde işlem yapmak için HTX hesap bakiyenizdeki fonları kullanın.Üçüncü Taraflar: Kullanımı kolaylaştırmak için Google Pay ve Apple Pay gibi popüler ödeme yöntemlerini ekledik.P2P: HTX'teki diğer kullanıcılarla doğrudan işlem yapın.Borsa Dışı (OTC): Yatırımcılar için kişiye özel hizmetler ve rekabetçi döviz kurları sunuyoruz.3. Adım: 4 (4) Varlıklarınızı Saklayın4 (4) satın aldıktan sonra HTX hesabınızda saklayın. Alternatif olarak, blok zinciri transferi yoluyla başka bir yere gönderebilir veya diğer kripto para birimlerini takas etmek için kullanabilirsiniz.4. Adım: 4 (4) Varlıklarınızla İşlem YapınHTX'in spot piyasasında 4 (4) ile kolayca işlemler yapın.Hesabınıza erişin, işlem çiftinizi seçin, işlemlerinizi gerçekleştirin ve gerçek zamanlı olarak izleyin. Hem yeni başlayanlar hem de deneyimli yatırımcılar için kullanıcı dostu bir deneyim sunuyoruz.

492 Toplam GörüntülenmeYayınlanma 2025.10.20Güncellenme 2026.06.02

4 Nasıl Satın Alınır

Tartışmalar

HTX Topluluğuna hoş geldiniz. Burada, en son platform gelişmeleri hakkında bilgi sahibi olabilir ve profesyonel piyasa görüşlerine erişebilirsiniz. Kullanıcıların 4 (4) fiyatı hakkındaki görüşleri aşağıda sunulmaktadır.

活动图片