LeanImprovementsLeanImprovements
Servicios · QA con IA

Calidad que se puede demostrar.

Llevamos la IA a todo el ciclo de calidad: criterios de aceptación en Gherkin desde el refinamiento, tests BDD que la IA escribe a partir de ellos, una regresión que corre sola y un informe que cualquiera entiende en la propia pull request. La IA escribe los tests; las personas deciden qué se prueba y cuándo algo está terminado.

1.000+
escenarios BDD en Facturitus, nuestro propio SaaS
97%
cobertura mínima del backend, exigida en CI
El problema

Qué duele hoy.

La calidad suele llegar al final, cuando cambiar algo ya es caro. Y la automatización que se promete acaba siendo una suite frágil en la que nadie confía.

  • Criterios de aceptación que se escriben tarde, o no se escriben, y que cada uno entiende a su manera.
  • Tests de extremo a extremo lentos y frágiles: fallan por ruido y el equipo deja de mirarlos.
  • La revisión de diseño se hace a ojo, con el Figma en una pestaña y la aplicación en otra.
  • Cuatro herramientas de test, cuatro informes distintos y nadie sabe si la release está lista.
Qué hacemos con IA

Lo que hacemos contigo.

01

Criterios de aceptación desde el refinamiento

La IA propone escenarios en Gherkin (Dado/Cuando/Entonces) para cada historia y la revisa contra vuestra Definition of Ready. Revisa y sugiere; nunca inventa la evidencia que falta.

02

Estrategia por capas, cadencias y gates

Decidimos qué se prueba en cada capa (unitaria, integración, API e interfaz) y cuándo: humo en cada pull request, regresión completa programada y críticos antes de cada release, con una cobertura que solo puede subir y gates de seguridad bloqueantes.

03

Un mismo Gherkin, tests ejecutables

El escenario acordado se convierte en tests de interfaz con Playwright y de API con behave. Trabajamos test-first: el test existe antes que el código.

04En piloto

QA visual contra Figma

Un ojo de IA compara el diseño con la pantalla implementada, separa el ruido de renderizado de las desviaciones reales y emite un veredicto por regiones que se adjunta a la pull request.

Ver el experimento
05En exploración

Cobertura de pruebas contra la base de conocimiento

Analizamos los flujos de negocio del cliente y los cruzamos con la base de conocimiento en Qdrant para saber qué escenarios de prueba ya existen y cuáles faltan.

Ver base de conocimiento y RAG
06

Un solo informe, en la pull request

Nuestro reporting propio une los resultados de pytest, behave, Vitest y Playwright en un único informe dentro de cada pull request. Cualquiera, no solo QA, sabe en qué estado está la release.

Quién hace qué

La IA escribe. Nuestros profesionales deciden.

Delegamos en la IA la escritura de los tests. La estrategia, el criterio de qué importa y la decisión de dar algo por terminado son siempre de nuestros profesionales: ningún cambio se mergea sin que una persona lo haya revisado.

La IA

  • Propone escenarios en Gherkin a partir de cada historia.
  • Escribe los tests unitarios, de API y de interfaz.
  • Revisa cada historia contra la Definition of Ready.
  • Compara la pantalla con el Figma y marca las regiones que se desvían.

Nuestros profesionales

  • Deciden la estrategia: qué se prueba, en qué capa y con qué cadencia.
  • Validan los escenarios con negocio antes de escribir una línea.
  • Ejecutan las suites e interpretan los resultados.
  • Deciden cuándo una historia está terminada y cuándo sale una release.
Cómo se nota

Antes y con IA.

  • Criterios de aceptación

    Antes

    Se escriben tarde o no se escriben

    Con IA

    En Gherkin desde el refinamiento, revisados contra la DoR

  • Automatización

    Antes

    Una suite frágil en la que nadie confía

    Con IA

    Tests por capas: humo en cada PR y regresión programada

  • Fidelidad al diseño

    Antes

    A ojo, comparando dos pestañas

    Con IA

    Veredicto por regiones contra el Figma (en piloto)

  • Estado de la release

    Antes

    Cuatro herramientas, cuatro informes

    Con IA

    Un único informe en cada pull request

Stack

Con qué trabajamos.

  • BDD

    Gherkinbehaveplaywright-bdd
  • Interfaz

    PlaywrightVitestTesting LibraryMSW
  • API y datos

    pytestTestcontainersPostgreSQL
  • Pipeline

    GitHub ActionsSonarQubeGates de seguridad
  • Propio

    Runner de suites por capasInforme unificado en la PR
Prueba

Lo usamos en nuestros productos.

Facturitus

Nuestro SaaS de facturación VERI*FACTU, conectado a la AEAT: un dominio regulado en el que un fallo no es solo un bug. En CI corren humo y cobertura sobre lo que cambia cada pull request, y la regresión completa, cada semana.

1.050+
escenarios de API con behave
100+
escenarios de interfaz con Playwright

LeanPortfolio

Nuestra plataforma de gestión de portfolio. Su IA convierte un business case en épicas e historias con criterios en Gherkin y puntúa cada historia contra la Definition of Ready. El modelo revisa y sugiere; nunca inventa evidencia.

300+
escenarios BDD
0–100
puntuación de cada historia contra la DoR
Preguntas frecuentes

Dudas habituales.

¿La IA sustituye a nuestro equipo de QA?

No. La IA escribe tests; vuestros profesionales deciden qué se prueba, en qué capa y cuándo algo está terminado. El objetivo es que QA dedique su tiempo al criterio y a la exploración, no a mantener scripts.

¿Qué es BDD y por qué Gherkin?

BDD es describir el comportamiento esperado en lenguaje de negocio (Dado/Cuando/Entonces) antes de construir. Con Gherkin, ese mismo texto es a la vez el acuerdo con negocio y el test que se ejecuta.

¿Tenemos que cambiar nuestras herramientas de testing?

No necesariamente. Partimos de lo que ya tenéis y proponemos cambiar solo cuando el coste de mantener la suite actual lo justifica, con números.

¿El QA visual contra Figma está listo?

Todavía es un piloto: nació como experimento en nuestro Lean Improvements Day. Podemos probarlo con vosotros, con revisión humana de cada veredicto y contándoos sus límites sin rodeos.

¿Cómo empezamos?

Con una sesión de 30 minutos para ver vuestra suite y vuestro pipeline actuales. De ahí sale qué merece la pena automatizar primero.

¿Listo para empezar?

Reserva 30 minutos. Revisamos tu suite y tu pipeline y salimos con lo primero que merece la pena automatizar.