AI快讯 / AI 开源项目

llm_eval

Test harness for LLM outputs: assertion checks, LLM-as-judge scoring, response caching, CI-friendly reports.

原文来源AI 开源 Releases
查看官方原文

Test harness for LLM outputs: assertion checks, LLM-as-judge scoring, response caching, CI-friendly reports.