@deepagents/evals
A general-purpose LLM evaluation framework with dataset loading, scoring, run persistence, model comparison, and console reporting.
Activity
- Latest release
- 1mo ago
- Total releases
- 40
- Cadence
- ~2 days
- Last 12 months
- 40
Reach
- Downloads (recent)
- 374
- Stars
- 4
Details
- License
- MIT
- First release
- Feb 23, 2026
Releases