衡量 AI 创造的价值.
看影响,不看采用率。为 AI 交付的价值排名,并管控背后的支出。编码智能体、客服机器人、SDR 和研究工作流。从第一个指标到为其提供资金的预算,尽在一个平台。
每一个智能体。每一朵云。一个 ROI 数字。
你的智能体并不只生活在单一供应商的生态里,你的 ROI 数字也不该如此。Yardstick 覆盖每一个编程智能体、每一个网关和每一朵云进行度量,而不只是到达单一供应商仪表盘的那部分。
三个套件。一条主干.
衡量 AI 创造的价值,优化每个智能体,并管控其背后的资金。共享一套身份、账本与主干之上的21款工具。
衡量影响,而不是采用率.
采用率仪表盘告诉你这周谁用了 AI:席位、会话、采纳率。这些都不是价值。唯一能通过 CFO 审查的数字,是你的智能体交付了什么、花了多少钱。Yardstick 衡量的正是这些:每个合并 PR 的成本、每个已解决工单的成本、变更失败率,以及每一美元 AI 支出背后的 ROI。
- AI 采用率
- 本周活跃席位
- 消耗的 token
- 代码行数
- 被采纳的建议
- 每个合并 PR 的成本
- 每个已解决工单的成本
- 创造的价值
- 每美元的价值
- 变更失败率
几分钟看到 90 天历史.
无需等待数据积累。连接仓库后,Yardstick 立即回填你最近的合并 PR 和回滚记录,并为其定价。
GitHub、GitLab 或 Bitbucket 一键安装。无需 SDK 即可开始。
连接时拉取最多 90 天的合并 PR 和回滚记录。仪表盘打开即是你的过往战绩,而不是一片空白。
每个合并 PR 的成本、创造的价值、变更失败率。在下一次站会前就能拿给董事会看。
回填覆盖你最近 90 天的 PR。成本采集从智能体运行的那一刻起实时流入。
把每一个分数变成更好的智能体
Observe 给出分数,Optimize 告诉你如何提升:要收紧的提示词、要更换的模型、要修改的配置,按每美元带来的提升排序。
了解 Optimize一条流水线。五个阶段。
主干先行交付,因此每个新套件都能接入,而无需重写基础设施。新增一个领域只需数周,而非数年。
通用 LLM 追踪,加上各套件的采集器:代码库、CRM、支持队列、对话。
带版本的评分引擎。共享主干之上、各套件各自的评分函数。
档案、排行榜,以及面向 CFO 的支出对成果报告。
按团队设定额度与策略。成本与成果同在一个账本。
成本感知路由与浪费管控。花得更少,成果不变。
AI 终于在做真正的工作。但它做了什么的证明,以及背后的预算,仍靠截图和猜测在运转。 我们用一把真正的标尺取而代之。
三条赛道。一个产品。
采用率仪表盘和工程智能工具统计谁在用 AI、开发者表现如何。网关计量模型调用。AI FinOps 追踪账单。Yardstick 是这些赛道交汇之处,依据你的 AI 编码智能体真正交付的成果来评分。
依据 2026 年年中的公开文档。欢迎指正:hello@yardstick.fi
我们只读取你接入的工具。未经同意,任何数据都不会离开你的技术栈。
所有数据在传输中和静态时都经过加密。
从第一天起就按企业级安全标准来构建。
随时导出。我们绝不出售,也绝不用于训练。
一台仪器,而非一个仪表盘
我们评估合并的 PR 和已解决的工单,绝不评估 token 或代码行数。
我们衡量并治理预算,绝不在你的供应商成本上加价。
每个分数都可解释。如果算不清楚,我们就不发布。
我们只读取你接入的工具。未经同意,任何数据都不会离开你的技术栈。
上线定价。
三个智能体永久免费。付费方案捆绑 Treasury,因此你每个层级只付一次,而不是每个套件付一次。
- ·5 个活跃智能体
- ·供应商 admin-API 成本采集
- ·成果价值评分
- ·公开智能体档案
- ·90-day 数据留存 · 邮件支持
- ·之后每多一个智能体 $5
- ·Solo 的全部功能
- ·PR 级别的 AI 与人类归因
- ·用于每个 PR token 归因的 SDK
- ·对账(SDK 与 admin-API 的差异)
- ·AI 工具 ROI 与推荐引擎
- ·包含 Treasury,管控规模至多 $50k/月
- ·之后每多一个智能体 $4
- ·Pro 的全部功能
- ·按团队分摊成本
- ·更高的 Treasury 上限(管控规模 $250k/月)
- ·2-year 数据留存 · 优先支持
- ·Shadow-AI 检测
- ·研发资本化报告
- ·之后每多一个智能体 $3
面向治理真实 AI 支出的组织,而不仅是工程团队。无限智能体、无限 Treasury,再加上合规与采购组合包。
- ·Scale 的全部功能,无限量
- ·EU AI Act 审计与证据包
- ·自定义护栏与组织级 AI 网关
- ·SSO / SAML / SCIM
- ·SOC 2 Type II(即将推出)
- ·本地部署选项 · 专属 CSM
合理的问题。
加入等候名单。在私有测试期间,越早注册越能优先获得使用权限和各套件的设计合作伙伴名额。
DX 广泛地衡量工程,并发布 AI Measurement Framework。Yardstick 衡量 DX 没有定价的那一件事:你的 AI 编码智能体真正交付内容的成本与价值,并附带 PR 级归因与 EU AI Act 审计包。许多团队会同时使用两者。
开发工具方面有 Claude Code、Codex、Gemini 和 Cursor,还有 Devin、Factory、OpenHands 等自主型循环工程师,以及你的团队已经在用的支持、销售和研究智能体。底层调用的模型同样会被计量:Anthropic、OpenAI、Gemini、Kimi、DeepSeek、Mistral、Groq、Together、Fireworks、Perplexity 和 OpenRouter 都会经过网关,并按 token 计价。使用供应商计费密钥或轻量连接器接入,无需推倒重来。
这是 Treasury 要去的方向,目前还没有做。思路是:给每位开发者一份年度 AI 额度,没用完的部分在确实交付了成果的前提下转为薪酬,这样就没人会学会为了保住预算而把它烧掉。今天的 Treasury 做的是治理的那一半:预算、消耗追踪、预计未用完以及强制上限。支付通道是一个真正的设计难题,因为钱必须在我们从不经手的情况下流动。我们宁愿说清楚,也不暗示它已经上线。
不会。Treasury 生成对账单、账本分录和薪资导出。资金由人和现有渠道来转移。
如果 AI 真的在为你工作,那就衡量它。
早期使用权限将随我们首批设计合作伙伴开放。我们正在各个领域进行接入。
只需填写邮箱。 没有垃圾邮件。上线时只发一封邮件。