2 Services from eval.zuluworksai.com
Scores LLM outputs and agent trajectories against benchmark rubrics using a pay-per-call evaluation engine.
$0.005/messageScores LLM outputs, agent trajectories, and model responses against benchmark rubrics for automated AI quality evaluation
$0.005/message