计划中
Research.
衡量 AI 研究产出的可信度,而非召回率。
Research 衡量 AI 研究智能体产出的结论是否真的可信。它摄取“查询与回答”配对、来源引用和人工审阅标记,对引用准确度、来源覆盖度和事实可靠性进行评分。
96% verified
Findingcited
Revenue grew 24% YoY, led by enterprise.
✓[1]10-K 2024, p.45
✓[2]Q3 earnings call
✓[3]Press release, Mar
$7.40 / finding
工作原理
Ingest, measure, trust.
01
Ingest
Feed in query-answer pairs, source citations, and reviewer flags.
02
Measure
Score citation accuracy, source coverage, and factual error rate.
03
Trust
Ship only the findings that clear the trust bar.
衡量项
它衡量什么。
01
引用准确度
确实支撑该论点的被引来源,对照抓取到的内容进行核验。
02
来源覆盖度
每个论点的独立来源数。避免单点可信的结论。
03
事实错误率
被标记的幻觉、错误日期、错误数字。在分数上为负向权重。
04
时效性评分
被引来源相对于该主题时间线的新鲜程度。
05
深度分
智能体是否走到了搜索结果首页之外。
06
每个已验证结论的成本
token 支出除以经人工验证的结论数。
适合谁
谁会选择 Research。
- ·研究运营负责人
- ·咨询公司
- ·市场情报团队
同一套件
与 Observe 的其余工具搭配使用。
想把 Research 加入你的技术栈?
我们正在招募设计合作伙伴。加入等候名单,进入 Research 的合作批次。
只需填写邮箱。 Research 上线时只发一封邮件。别无其他。