RUN TERMINAL-BENCH-SCIENCE
ANNOUNCEMENT
CONTRIBUTORS
TERMINAL-BENCH-
SCIENCE
Version
0.
0
9
8
7
6
5
4
3
2
1
0
A benchmark for evaluating AI agents on research workflows across scientific domains
Run Terminal-Bench-Science
Read the announcement