Mide el valor que crea la IA.
Impacto, no adopción. Clasifica lo que la IA entregó y gobierna el gasto que hay detrás. Agentes de código, bots de soporte, SDR y flujos de investigación. Una sola plataforma desde la primera métrica hasta el presupuesto que la financia.
Cada agente. Cada nube. Un único número de ROI.
Tus agentes no viven en el ecosistema de un solo proveedor, así que tu número de ROI tampoco puede. Yardstick mide en todos los agentes de código, gateways y nubes, no solo lo que llega al panel de un único proveedor.
Tres suites. Una columna.
Mide el valor que crea la IA, optimiza cada agente y gobierna el dinero detrás de todo ello. 21 herramientas sobre una identidad, un libro mayor y una columna compartidos.
Mide el impacto, no la adopción.
Los paneles de adopción te dicen quién usó IA esta semana: asientos, sesiones, tasas de aceptación. Nada de eso es valor. El único número que sobrevive a una revisión del CFO es lo que tus agentes entregaron y lo que costó. Yardstick mide exactamente eso: coste por PR fusionada, coste por ticket resuelto, tasa de fallos por cambio y el ROI detrás de cada dólar de gasto en IA.
- % de adopción de IA
- Asientos activos esta semana
- Tokens consumidos
- Líneas de código
- Sugerencias aceptadas
- Coste por PR fusionada
- Coste por ticket resuelto
- Valor creado
- Valor por dólar
- Tasa de fallos por cambio
90 días de historial en minutos.
Sin esperar a que se acumulen datos. Conecta un repo y Yardstick rellena al momento tus últimas PR fusionadas y reversiones, y les pone precio.
Instalación en un clic para GitHub, GitLab o Bitbucket. No hace falta SDK para empezar.
Hasta 90 días de PR fusionadas y reversiones cargados al conectar. El panel se abre con tu trayectoria, no en blanco.
Coste por PR fusionada, valor creado y tasa de fallos por cambio. Listo para el consejo antes de tu próxima daily.
El backfill cubre tus últimos 90 días de PR. La captura de costes empieza a fluir en cuanto un agente se ejecuta.
Ve cuánto vale cada agente
Evalúa la IA en las unidades que cada ámbito respeta: coste por PR fusionada, tasa de resolución, exactitud de las citas. Las métricas de actividad mienten. Los resultados no.
Explorar ObserveConvierte cada puntuación en un mejor agente
Observe te da la puntuación. Optimize te dice cómo subirla: el prompt que ajustar, el modelo que cambiar, la configuración que modificar, ordenados por la mejora que aportan por dólar.
Explorar OptimizeGobierna cada dólar que gasta la IA
Convierte los presupuestos de IA en asignaciones, políticas y límites que responden al valor verificado. Menos desperdicio, una huella de cómputo menor, una tesorería que se gestiona sola.
Explorar TreasuryUn pipeline. Cinco etapas.
La columna se lanza primero para que cada nueva suite se conecte sin reescribir la infraestructura. Añadir un ámbito lleva semanas, no años.
Trazado universal de LLM más colectores por suite: repos, CRMs, colas de soporte, conversaciones.
Motor de puntuación versionado. Funciones de puntuación por suite sobre una columna compartida.
Perfiles, clasificaciones e informes listos para el CFO sobre gasto frente a resultados.
Asignaciones y políticas por equipo. Un único libro mayor de coste y resultado.
Enrutamiento consciente del coste y controles de desperdicio. Menos gasto, los mismos resultados.
La IA por fin hace trabajo real. La prueba de lo que hace, y el presupuesto detrás, todavía funcionan con capturas de pantalla y conjeturas. Lo estamos reemplazando con una vara de medir.
Tres carriles. Un producto.
Los paneles de adopción y las herramientas de engineering intelligence cuentan quién usa IA y cómo rinden los desarrolladores. Las pasarelas contabilizan las llamadas a modelos. El AI FinOps sigue la factura. Yardstick es donde esas vías se cruzan, puntuado por el trabajo que tus agentes de programación de IA realmente entregaron.
Según documentos públicos a mediados de 2026. Correcciones bienvenidas: hello@yardstick.fi
Solo leemos las herramientas que conectas. Nada sale de tu stack sin consentimiento.
Todos los datos se cifran en tránsito y en reposo.
Construimos según estándares de seguridad empresarial desde el primer día.
Expórtalos cuando quieras. Nunca los vendemos ni entrenamos con ellos.
Un instrumento, no un panel
Evaluamos PR fusionadas y tickets resueltos, nunca tokens ni líneas de código.
Medimos y gobernamos presupuestos. Nunca aplicamos margen sobre los costes de tu proveedor.
Cada puntuación es explicable. Si no podemos mostrar las cuentas, no lo lanzamos.
Leemos de las herramientas que conectas. Nada sale de tu stack sin consentimiento.
Precios de lanzamiento.
Gratis para siempre para tres agentes. Los planes de pago incluyen Treasury, así que pagas una sola cosa por nivel, no una por suite.
- ·3 agents activos
- ·Visores ilimitados, siempre gratis
- ·Trazado universal de LLM y herramientas
- ·Alertas de presupuesto flexibles
- ·Perfil público del agente
- ·Retención de 7-day · comunidad
- ·5 agents activos
- ·Ingesta de costes vía admin-API del proveedor
- ·Puntuación del valor por resultados
- ·Perfil público del agente
- ·Retención de 90-day · correo
- ·luego $5 / agent adicional
- ·Todo lo de Solo
- ·Atribución IA-vs-humano a nivel de PR
- ·SDK para atribución de tokens por PR
- ·Reconciliación (diferencia entre SDK y admin-API)
- ·Motor de ROI y recomendaciones de herramientas de AI
- ·Treasury incluido hasta $50k/mo gobernados
- ·luego $4 / agent adicional
- ·Todo lo de Pro
- ·Asignación de costes por equipo
- ·Tope de Treasury más alto ($250k/mo gobernados)
- ·Retención de 2-year · soporte prioritario
- ·Detección de Shadow-AI
- ·Informes de capitalización de I+D
- ·luego $3 / agent adicional
Para organizaciones que gobiernan un gasto real en AI, no solo ingeniería. Agents ilimitados, Treasury ilimitado, con el paquete de cumplimiento y compras por encima.
- ·Todo lo de Scale, ilimitado
- ·Auditoría EU AI Act y packs de evidencia
- ·Guardarraíles personalizados y pasarela de IA para toda la organización
- ·SSO / SAML / SCIM
- ·SOC 2 Type II (Próximamente)
- ·Opción on-prem · CSM dedicado
Preguntas justas.
Únete a la lista de espera. Los primeros registros obtienen acceso prioritario y plazas de socio de diseño en todas las suites mientras estemos en beta privada.
DX mide la ingeniería de forma amplia y publica un AI Measurement Framework. Yardstick mide lo único que DX no cuantifica: el coste y el valor de lo que tus agentes de programación de IA realmente entregan, con atribución a nivel de PR y packs de auditoría EU AI Act además. Muchos equipos usan ambos.
Claude Code, Codex, Gemini y Cursor para herramientas de desarrollo, loop engineers autónomos como Devin, Factory y OpenHands, además de los agentes de soporte, ventas e investigación que tus equipos ya usan. Los modelos que hay debajo también se miden: Anthropic, OpenAI, Gemini, Kimi, DeepSeek, Mistral, Groq, Together, Fireworks, Perplexity y OpenRouter pasan por el gateway y se tarifican por token. Una clave de facturación del proveedor o un conector ligero, sin reemplazarlo todo.
Es hacia dónde llevamos Treasury, y todavía no está construido. La idea: dar a cada desarrollador una asignación anual de IA y que lo que no gaste se convierta en compensación, condicionado a entregar resultados reales, para que nadie aprenda a quemar presupuesto solo por conservarlo. Hoy Treasury hace la mitad de gobernanza: presupuestos, seguimiento del consumo, no usado previsto y límites que se aplican. El mecanismo de pago es un problema de diseño real, porque el dinero debe moverse sin que nosotros lo toquemos nunca, y preferimos decirlo a insinuar que ya existe.
No. Treasury produce extractos, asientos en el libro mayor y exportaciones de nómina. Las personas y los circuitos existentes mueven el dinero.
Si la IA hace trabajo real para ti, mídelo.
El acceso anticipado abre con nuestra primera cohorte de socios de diseño. Estamos incorporando en todos los ámbitos ahora.
Solo el correo es obligatorio. Sin spam. Un solo correo cuando estemos en vivo.