Skip to content

Rulvar API reference


Rulvar API reference / @rulvar/evals / BenchmarkReport

Interface: BenchmarkReport

Defined in: packages/evals/src/benchmark.ts:181

Properties

PropertyTypeDescriptionDefined in
costUsd?BenchmarkPercentiles-packages/evals/src/benchmark.ts:190
fingerprintBenchmarkFingerprint-packages/evals/src/benchmark.ts:205
judgeCostUsdnumber-packages/evals/src/benchmark.ts:195
metricsRecord<string, BenchmarkPercentiles>Percentiles per named extractor, over scored runs.packages/evals/src/benchmark.ts:192
namestring-packages/evals/src/benchmark.ts:182
refusal?{ atOrdinal: number; detail: string; }Present when the aggregate envelope refused a TARGET run before it started (cycle 81): the series ends there and every completed repeat stays on the report, mirroring the eval suite's monotone refusal instead of a throw destroying the paid evidence. Judge refusals never appear here; they reject their own run as 'judge:refused'.packages/evals/src/benchmark.ts:204
refusal.atOrdinalnumber-packages/evals/src/benchmark.ts:204
refusal.detailstring-packages/evals/src/benchmark.ts:204
repeatsnumberRepeats attempted (equals runs.length).packages/evals/src/benchmark.ts:184
runsBenchmarkRunRecord[]-packages/evals/src/benchmark.ts:187
scorednumberRuns that entered the percentile series.packages/evals/src/benchmark.ts:186
totalCostUsdnumberEvery target and judge run, scored or rejected (honest spend).packages/evals/src/benchmark.ts:194
wallMs?BenchmarkPercentilesAbsent when no run scored: the kit never fabricates a series.packages/evals/src/benchmark.ts:189