Messen Sie den Wert, den KI schafft.
Wirkung statt Adoption. Bewerten Sie, was KI geliefert hat, und steuern Sie die Ausgaben dahinter. Coding-Agenten, Support-Bots, SDRs und Research-Workflows. Eine Plattform von der ersten Kennzahl bis zum Budget, das sie finanziert.
Jeder Agent. Jede Cloud. Eine ROI-Zahl.
Ihre Agenten leben nicht im Ökosystem eines einzigen Anbieters, also kann es Ihre ROI-Zahl auch nicht. Yardstick misst über jeden Coding-Agenten, jedes Gateway und jede Cloud hinweg, nicht nur das, was das Dashboard eines einzelnen Anbieters erreicht.
Drei Suiten. Ein Rückgrat.
Messen Sie den Wert, den KI schafft, optimieren Sie jeden Agenten und steuern Sie das Geld dahinter. 21 Tools auf einer gemeinsamen Identität, einem Ledger und einem Rückgrat.
Wirkung messen, nicht Adoption.
Adoption-Dashboards zeigen, wer diese Woche KI benutzt hat: Seats, Sessions, Akzeptanzraten. Nichts davon ist Wert. Die einzige Zahl, die ein CFO-Review übersteht, ist, was Ihre Agenten geliefert haben und was es gekostet hat. Genau das misst Yardstick: Kosten pro gemergtem PR, Kosten pro gelöstem Ticket, Change-Failure-Rate und den ROI hinter jedem Dollar KI-Ausgaben.
- KI-Adoptionsrate
- Aktive Seats diese Woche
- Verbrauchte Tokens
- Codezeilen
- Angenommene Vorschläge
- Kosten pro gemergtem PR
- Kosten pro gelöstem Ticket
- Geschaffener Wert
- Wert pro Dollar
- Change-Failure-Rate
90 Tage Historie in Minuten.
Kein Warten, bis Daten auflaufen. Verbinden Sie ein Repo und Yardstick lädt Ihre letzten gemergten PRs und Reverts sofort nach und bepreist sie.
Ein-Klick-Installation für GitHub, GitLab oder Bitbucket. Kein SDK nötig, um zu starten.
Bis zu 90 Tage gemergte PRs und Reverts werden beim Verbinden geladen. Das Dashboard öffnet mit Ihrer Bilanz statt mit leerem Zustand.
Kosten pro gemergtem PR, geschaffener Wert und Change-Failure-Rate. Board-tauglich vor Ihrem nächsten Standup.
Der Backfill deckt Ihre letzten 90 Tage an PRs ab. Die Kostenerfassung streamt ab dem ersten Agent-Lauf.
Sehen Sie, was jeder Agent wert ist
Bewerten Sie KI in den Einheiten, die jede Domäne respektiert: Kosten pro gemergtem PR, Lösungsquote, Zitationsgenauigkeit. Aktivitätsmetriken lügen. Ergebnisse nicht.
Observe entdeckenAus jedem Score einen besseren Agenten machen
Observe liefert den Score. Optimize sagt Ihnen, wie Sie ihn steigern: der Prompt zum Schärfen, das Modell zum Wechseln, die Konfiguration zum Ändern, nach dem Zugewinn pro Dollar geordnet.
Optimize entdeckenSteuern Sie jeden Dollar, den KI ausgibt
Verwandeln Sie KI-Budgets in Kontingente, Richtlinien und Obergrenzen, die auf verifizierten Wert reagieren. Weniger Verschwendung, ein kleinerer Compute-Footprint, eine Treasury, die sich selbst steuert.
Treasury entdeckenEine Pipeline. Fünf Stufen.
Das Rückgrat wird zuerst ausgeliefert, damit jede neue Suite andockt, ohne die Infrastruktur neu zu schreiben. Eine Domäne hinzuzufügen dauert Wochen, nicht Jahre.
Universelles LLM-Tracing plus Suite-Collectors: Repos, CRMs, Support-Queues, Konversationen.
Versionierte Scoring-Engine. Score-Funktionen pro Suite auf einem gemeinsamen Rückgrat.
Profile, Leaderboards und CFO-fertige Berichte zu Ausgaben versus Ergebnissen.
Kontingente und Richtlinien pro Team. Ein Ledger aus Kosten und Ergebnis.
Kostenbewusstes Routing und Verschwendungskontrollen. Weniger Ausgaben, gleiche Ergebnisse.
KI leistet endlich echte Arbeit. Der Nachweis dessen, was sie tut, und das Budget dahinter laufen noch über Screenshots und Vermutungen. Wir ersetzen das durch einen echten Maßstab.
Drei Bahnen. Ein Produkt.
Adoption-Dashboards und Engineering-Intelligence-Tools zählen, wer KI benutzt und wie Entwickler performen. Gateways erfassen Modellaufrufe. AI FinOps verfolgt die Rechnung. Yardstick ist der Ort, an dem diese Spuren zusammenlaufen, bewertet an der Arbeit, die Ihre KI-Coding-Agenten tatsächlich ausgeliefert haben.
Basierend auf öffentlichen Dokumenten, Stand Mitte 2026. Korrekturen willkommen: hello@yardstick.fi
Wir lesen nur die Tools, die Sie verbinden. Nichts verlässt Ihren Stack ohne Zustimmung.
Alle Daten sind bei der Übertragung und im Ruhezustand verschlüsselt.
Wir bauen von Tag eins an auf Enterprise-Sicherheitsstandards.
Jederzeit exportierbar. Wir verkaufen sie nie und trainieren nie damit.
Ein Instrument, kein Dashboard
Wir bewerten gemergte PRs und gelöste Tickets, nie Tokens oder Codezeilen.
Wir messen und steuern Budgets. Wir schlagen nie auf Ihre Provider-Kosten auf.
Jeder Score ist erklärbar. Wenn wir die Rechnung nicht zeigen können, liefern wir sie nicht aus.
Wir lesen aus den Tools, die Sie verbinden. Nichts verlässt Ihren Stack ohne Zustimmung.
Launch-Preise.
Für immer kostenlos für drei Agenten. Bezahlte Pläne bündeln Treasury, sodass Sie pro Stufe nur eines zahlen, nicht eines pro Suite.
- ·3 aktive agents
- ·Unbegrenzte Betrachter, immer kostenlos
- ·Universelles LLM- & Tool-Tracing
- ·Weiche Budget-Alerts
- ·Öffentliches agent-Profil
- ·7-day-Aufbewahrung · Community
- ·5 aktive agents
- ·Kostenerfassung über Vendor-admin-API
- ·Outcome-Value-Scoring
- ·Öffentliches agent-Profil
- ·90-day-Aufbewahrung · E-Mail
- ·danach $5 / zusätzlichem agent
- ·Alles aus Solo
- ·KI-vs-Mensch-Attribution auf PR-Ebene
- ·SDK für Token-Attribution pro PR
- ·Abgleich (Lücke zwischen SDK und admin-API)
- ·KI-Tool-ROI & Empfehlungs-Engine
- ·Treasury inklusive bis $50k/mo gesteuert
- ·danach $4 / zusätzlichem agent
- ·Alles aus Pro
- ·Kostenzuteilung pro Team
- ·Höheres Treasury-Limit ($250k/mo gesteuert)
- ·2-year-Aufbewahrung · Priority-Support
- ·Shadow-AI-Erkennung
- ·R&D-Aktivierungsberichte
- ·danach $3 / zusätzlichem agent
Für Organisationen, die echte KI-Ausgaben steuern, nicht nur Engineering. Unbegrenzte agents, unbegrenztes Treasury, mit dem Compliance- & Beschaffungs-Paket obendrauf.
- ·Alles aus Scale, unbegrenzt
- ·EU AI Act-Audit & Nachweispakete
- ·Individuelle Guardrails & organisationsweites AI-Gateway
- ·SSO / SAML / SCIM
- ·SOC 2 Type II (Demnächst)
- ·On-Prem-Option · dedizierter CSM
Faire Fragen.
Tragen Sie sich in die Warteliste ein. Frühe Anmeldungen erhalten als Erste Zugang und Design-Partner-Plätze über alle Suiten, solange wir in der privaten Beta sind.
DX misst Engineering breit und liefert ein AI Measurement Framework. Yardstick misst das eine, was DX nicht bepreist: die Kosten und den Wert dessen, was Ihre KI-Coding-Agenten tatsächlich liefern, mit Attribution auf PR-Ebene und EU-AI-Act-Audit-Paketen obendrauf. Viele Teams nutzen beides.
Claude Code, Codex, Gemini und Cursor für Dev-Tools, autonome Loop-Engineers wie Devin, Factory und OpenHands, plus die Support-, Sales- und Research-Agenten, die Ihre Teams bereits nutzen. Die Modelle darunter werden ebenfalls erfasst: Anthropic, OpenAI, Gemini, Kimi, DeepSeek, Mistral, Groq, Together, Fireworks, Perplexity und OpenRouter laufen über das Gateway und werden pro Token bepreist. Ein Provider-Abrechnungsschlüssel oder ein leichtgewichtiger Connector, kein Rip-and-Replace.
Dorthin entwickeln wir Treasury, gebaut ist es noch nicht. Die Idee: jeder Entwickler erhält ein jährliches KI-Kontingent, und was nicht ausgegeben wird, wird zu Vergütung, gekoppelt an tatsächlich gelieferte Ergebnisse, damit niemand lernt, Budget nur zum Behalten zu verbrennen. Heute leistet Treasury die Governance-Hälfte: Budgets, Verbrauchskontrolle, prognostizierter ungenutzter Anteil und durchgesetzte Obergrenzen. Der Auszahlungsweg ist ein echtes Designproblem, denn das Geld muss fließen, ohne dass wir es je anfassen. Das sagen wir lieber, als so zu tun, als sei es fertig.
Nein. Treasury erstellt Abrechnungen, Ledger-Einträge und Payroll-Exporte. Menschen und bestehende Systeme bewegen das Geld.
Wenn KI echte Arbeit für Sie leistet, messen Sie sie.
Der frühe Zugang öffnet mit unserer ersten Design-Partner-Kohorte. Wir onboarden gerade über alle Bereiche hinweg.
Nur die E-Mail ist erforderlich. Kein Spam. Eine E-Mail, wenn wir live gehen.