Mide el valor que crea la IA.

Impacto, no adopción. Clasifica lo que la IA entregó y gobierna el gasto que hay detrás. Agentes de código, bots de soporte, SDR y flujos de investigación. Una sola plataforma desde la primera métrica hasta el presupuesto que la financia.

app.yardstick.fi/
Overview
Acme · 6 agents · 4 repos measured
Last 30 days
Value created
$214k21%
ROI
7.2x14%
after review cost
AI spend / merged PR
$3.4018%
Merged PRs
1,2846%
Acceptance rate
92%
Trend
Merged PRs AI spend
AprMayJun
Recent activity streaming
claude-code
merged PR #318 · auth refactor
$3.40 / PR
cursor · web
resolved issue #2041 · checkout bug
94 score
Funciona con

Cada agente. Cada nube. Un único número de ROI.

Tus agentes no viven en el ecosistema de un solo proveedor, así que tu número de ROI tampoco puede. Yardstick mide en todos los agentes de código, gateways y nubes, no solo lo que llega al panel de un único proveedor.

La plataforma

Tres suites. Una columna.

Mide el valor que crea la IA, optimiza cada agente y gobierna el dinero detrás de todo ello. 21 herramientas sobre una identidad, un libro mayor y una columna compartidos.

La métrica que importa

Mide el impacto, no la adopción.

Los paneles de adopción te dicen quién usó IA esta semana: asientos, sesiones, tasas de aceptación. Nada de eso es valor. El único número que sobrevive a una revisión del CFO es lo que tus agentes entregaron y lo que costó. Yardstick mide exactamente eso: coste por PR fusionada, coste por ticket resuelto, tasa de fallos por cambio y el ROI detrás de cada dólar de gasto en IA.

Métricas de adopción
  • % de adopción de IA
  • Asientos activos esta semana
  • Tokens consumidos
  • Líneas de código
  • Sugerencias aceptadas
Métricas de impacto
  • Coste por PR fusionada
  • Coste por ticket resuelto
  • Valor creado
  • Valor por dólar
  • Tasa de fallos por cambio
Tiempo hasta el valor

90 días de historial en minutos.

Sin esperar a que se acumulen datos. Conecta un repo y Yardstick rellena al momento tus últimas PR fusionadas y reversiones, y les pone precio.

1Minutos
Conecta un repo

Instalación en un clic para GitHub, GitLab o Bitbucket. No hace falta SDK para empezar.

2Al instante
Historial rellenado

Hasta 90 días de PR fusionadas y reversiones cargados al conectar. El panel se abre con tu trayectoria, no en blanco.

3El mismo día
Primer informe de ROI

Coste por PR fusionada, valor creado y tasa de fallos por cambio. Listo para el consejo antes de tu próxima daily.

El backfill cubre tus últimos 90 días de PR. La captura de costes empieza a fluir en cuanto un agente se ejecuta.

Observe · Medir

Ve cuánto vale cada agente

Evalúa la IA en las unidades que cada ámbito respeta: coste por PR fusionada, tasa de resolución, exactitud de las citas. Las métricas de actividad mienten. Los resultados no.

Explorar Observe
app.yardstick.fi/agents/claude-code
Cost / merged PR
$42.10
▼ 9.4%
Value / dollar
2.3x
▲ 0.4x
91%
accepted
Acceptance rate
Outputs merged without rework, across 1,284 outcomes this month.
Optimize · Mejorar

Convierte cada puntuación en un mejor agente

Observe te da la puntuación. Optimize te dice cómo subirla: el prompt que ajustar, el modelo que cambiar, la configuración que modificar, ordenados por la mejora que aportan por dólar.

Explorar Optimize
app.yardstick.fi/optimize/tuner
Predicted lift
+18%
outcome
At lower cost
24%
▼ spend
12
changes
Ranked changes
Highest-impact tweaks for this agent, ranked by outcome per dollar.
Treasury · Gobernar

Gobierna cada dólar que gasta la IA

Convierte los presupuestos de IA en asignaciones, políticas y límites que responden al valor verificado. Menos desperdicio, una huella de cómputo menor, una tesorería que se gestiona sola.

Explorar Treasury
app.yardstick.fi/treasury
Quarter budget
$50k
on track
Projected payout
$21.6k
▲ 0.4k
68%
used
Budget burn
Spent against cap. Use-it-or-cash-it at quarter end.
Cómo funciona

Un pipeline. Cinco etapas.

La columna se lanza primero para que cada nueva suite se conecte sin reescribir la infraestructura. Añadir un ámbito lleva semanas, no años.

1
Medir

Trazado universal de LLM más colectores por suite: repos, CRMs, colas de soporte, conversaciones.

2
Clasificar

Motor de puntuación versionado. Funciones de puntuación por suite sobre una columna compartida.

3
Reportar

Perfiles, clasificaciones e informes listos para el CFO sobre gasto frente a resultados.

4
Presupuestar

Asignaciones y políticas por equipo. Un único libro mayor de coste y resultado.

5
Optimizar

Enrutamiento consciente del coste y controles de desperdicio. Menos gasto, los mismos resultados.

La IA por fin hace trabajo real. La prueba de lo que hace, y el presupuesto detrás, todavía funcionan con capturas de pantalla y conjeturas. Lo estamos reemplazando con una vara de medir.

Comparación

Tres carriles. Un producto.

Los paneles de adopción y las herramientas de engineering intelligence cuentan quién usa IA y cómo rinden los desarrolladores. Las pasarelas contabilizan las llamadas a modelos. El AI FinOps sigue la factura. Yardstick es donde esas vías se cruzan, puntuado por el trabajo que tus agentes de programación de IA realmente entregaron.

Yardstick
AWS CloudWatch
Revenium
Pensero
Olakai
Faros
Rastrear la actividad de los agentes de IA
Enfoque en el wedge de agentes de código
Parcial
·
Parcial
Parcial
Evaluar resultados de agentes, no solo tokens
·
·
Parcial
Parcial
Atribución IA-vs-humano a nivel de PR
·
·
Parcial
Parcial
Parcial
Benchmarks anónimos entre organizaciones
·
·
Parcial
·
Parcial
Presupuestos, asignaciones, interruptores de corte
Parcial
·
Parcial
·
Enrutamiento de modelos consciente del coste
·
·
·
·
·
Packs de auditoría EU AI Act y evidencia SOC 2
·
·
·
·
Pagos a desarrolladores use-it-or-cash-it
·
·
·
·
·
·
SDK de código abierto y estándares de atestación
Previsto
·
·
·
·
·

Según documentos públicos a mediados de 2026. Correcciones bienvenidas: hello@yardstick.fi

Seguridad y confianza
Privacidad por defecto

Solo leemos las herramientas que conectas. Nada sale de tu stack sin consentimiento.

Cifrado de extremo a extremo

Todos los datos se cifran en tránsito y en reposo.

SOC 2 en curso

Construimos según estándares de seguridad empresarial desde el primer día.

Tus datos son tuyos

Expórtalos cuando quieras. Nunca los vendemos ni entrenamos con ellos.

Por qué Yardstick

Un instrumento, no un panel

Resultados, no actividad

Evaluamos PR fusionadas y tickets resueltos, nunca tokens ni líneas de código.

Tu gasto es tu gasto

Medimos y gobernamos presupuestos. Nunca aplicamos margen sobre los costes de tu proveedor.

Mostrar el método

Cada puntuación es explicable. Si no podemos mostrar las cuentas, no lo lanzamos.

Privacidad por defecto

Leemos de las herramientas que conectas. Nada sale de tu stack sin consentimiento.

Precios

Precios de lanzamiento.

Gratis para siempre para tres agentes. Los planes de pago incluyen Treasury, así que pagas una sola cosa por nivel, no una por suite.

Ahorra 20%
Gratis para siempre para 3 agents. Cada plan de pago empieza con una prueba de 14-day. Las puntuaciones verificadas y las clasificaciones se mantienen permanentes en todos los planes.
Free
$0
3 agents · alertas hasta $5k gobernados
  • ·3 agents activos
  • ·Visores ilimitados, siempre gratis
  • ·Trazado universal de LLM y herramientas
  • ·Alertas de presupuesto flexibles
  • ·Perfil público del agente
  • ·Retención de 7-day · comunidad
Solo
$15/mo con facturación anual
Precios de lanzamiento
5 agents · cualquier 1 suite
  • ·5 agents activos
  • ·Ingesta de costes vía admin-API del proveedor
  • ·Puntuación del valor por resultados
  • ·Perfil público del agente
  • ·Retención de 90-day · correo
  • ·luego $5 / agent adicional
Recomendado
Pro
$63/mo con facturación anual
Precios de lanzamiento
25 agents · atribución y ROI
  • ·Todo lo de Solo
  • ·Atribución IA-vs-humano a nivel de PR
  • ·SDK para atribución de tokens por PR
  • ·Reconciliación (diferencia entre SDK y admin-API)
  • ·Motor de ROI y recomendaciones de herramientas de AI
  • ·Treasury incluido hasta $50k/mo gobernados
  • ·luego $4 / agent adicional
Scale
$239/mo con facturación anual
Precios de lanzamiento
150 agents · el paquete para el CFO
  • ·Todo lo de Pro
  • ·Asignación de costes por equipo
  • ·Tope de Treasury más alto ($250k/mo gobernados)
  • ·Retención de 2-year · soporte prioritario
  • ·Detección de Shadow-AI
  • ·Informes de capitalización de I+D
  • ·luego $3 / agent adicional
Enterprise
Ilimitado · cumplimiento y compras

Para organizaciones que gobiernan un gasto real en AI, no solo ingeniería. Agents ilimitados, Treasury ilimitado, con el paquete de cumplimiento y compras por encima.

  • ·Todo lo de Scale, ilimitado
  • ·Auditoría EU AI Act y packs de evidencia
  • ·Guardarraíles personalizados y pasarela de IA para toda la organización
  • ·SSO / SAML / SCIM
  • ·SOC 2 Type II (Próximamente)
  • ·Opción on-prem · CSM dedicado
FAQ

Preguntas justas.

Únete a la lista de espera. Los primeros registros obtienen acceso prioritario y plazas de socio de diseño en todas las suites mientras estemos en beta privada.

DX mide la ingeniería de forma amplia y publica un AI Measurement Framework. Yardstick mide lo único que DX no cuantifica: el coste y el valor de lo que tus agentes de programación de IA realmente entregan, con atribución a nivel de PR y packs de auditoría EU AI Act además. Muchos equipos usan ambos.

Claude Code, Codex, Gemini y Cursor para herramientas de desarrollo, loop engineers autónomos como Devin, Factory y OpenHands, además de los agentes de soporte, ventas e investigación que tus equipos ya usan. Los modelos que hay debajo también se miden: Anthropic, OpenAI, Gemini, Kimi, DeepSeek, Mistral, Groq, Together, Fireworks, Perplexity y OpenRouter pasan por el gateway y se tarifican por token. Una clave de facturación del proveedor o un conector ligero, sin reemplazarlo todo.

Es hacia dónde llevamos Treasury, y todavía no está construido. La idea: dar a cada desarrollador una asignación anual de IA y que lo que no gaste se convierta en compensación, condicionado a entregar resultados reales, para que nadie aprenda a quemar presupuesto solo por conservarlo. Hoy Treasury hace la mitad de gobernanza: presupuestos, seguimiento del consumo, no usado previsto y límites que se aplican. El mecanismo de pago es un problema de diseño real, porque el dinero debe moverse sin que nosotros lo toquemos nunca, y preferimos decirlo a insinuar que ya existe.

No. Treasury produce extractos, asientos en el libro mayor y exportaciones de nómina. Las personas y los circuitos existentes mueven el dinero.

Si la IA hace trabajo real para ti, mídelo.

El acceso anticipado abre con nuestra primera cohorte de socios de diseño. Estamos incorporando en todos los ámbitos ahora.

Solo el correo es obligatorio. Sin spam. Un solo correo cuando estemos en vivo.

Yardstick · Plataforma de ROI de agentes IA: mide, optimiza y gobierna el gasto en IA