Skip to content

blackbit.void — ai for security teams

voidzerosoon

05 — evaluation surface

23 models — sample set

model benchmarks

Cost, intelligence, and time across the gateway fleet — sample figures until live evals land.

unlock access

06 — cost per intelligence

lower is better — usd / task

cost per intelligence

Weighted average cost (USD) per intelligence-index task, split by token type. Lower is better.

polarity

lower

models

23

unit

usd

  • answer
  • reasoning
  • cache write
  • cache hit
  • input

07 — intelligence index

higher is better — composite

intelligence index

Composite of reasoning, coding, knowledge, and agent evals. Higher is better.

polarity

higher

models

23

scale

index

  • published
  • estimate

08 — intelligence vs time

pareto — preferred band

intelligence vs time

Intelligence index against minutes per task. Upper left is preferred — high quality, low wait.

x

min

y

index

models

23

  • preferred band
  • pareto
  • frontier
  • fleet