01
Annotation Queues
Evaluates LangSmith's Annotation Queues across 7 scenario-based test cases, each graded against an expected-behavior rubric by an LLM judge, from Corsac's LLM observability and evaluation eval coverage.
Mapped capabilities
7 scenarios
- Queue creation
- SDK queue management
- create_feedback
Public sample case
- Input
- Moderators need queue filtered to feedback.score<0.5 safety runs.
- Expected behavior
- Create annotation queue in UI or SDK with project scope and filter; route flagged runs; document queue purpose and reviewer RBAC.
- Check
- Pass / fail check






