← 返回发现
labyrinth-bench
AI工具ai

labyrinth-bench

owl-fleet/labyrinth-bench

A deterministic multi-turn benchmark for LLM agents — no LLM judge — with a swappable context-management harness. Run it on your own rig against any OpenAI-compatible endpoint.

1
Stars
15
热度评分
+0
7日增长
1天
趋势

📋 项目信息

分类AI工具
用途ai
发现日期2026-08-07