tpmjs/packages/tools/official/judge
Ajax Davis 1234b383e7 feat(judge): add AI conversation quality evaluation tool
- Evaluates conversations across 10 metrics:
  taskCompletion, accuracy, relevance, clarity, efficiency,
  userIntentAlignment, actionability, progress, errorHandling, completeness
- Returns weighted overall score (0-10)
- Provides verdict (pass/retry/fail) with reasons
- Detects conversation loops and stuck states
- Lists must-dos, suggestions, and next steps
- Designed for frequent use in agentic loops
2026-01-17 10:49:40 +10:00
..
src feat(judge): add AI conversation quality evaluation tool 2026-01-17 10:49:40 +10:00
block.ts feat(judge): add AI conversation quality evaluation tool 2026-01-17 10:49:40 +10:00
index.ts feat(judge): add AI conversation quality evaluation tool 2026-01-17 10:49:40 +10:00
package.json feat(judge): add AI conversation quality evaluation tool 2026-01-17 10:49:40 +10:00
tsconfig.json feat(judge): add AI conversation quality evaluation tool 2026-01-17 10:49:40 +10:00
tsup.config.ts feat(judge): add AI conversation quality evaluation tool 2026-01-17 10:49:40 +10:00