Exact model identity
GPT-Rosalind
OpenAI · version status: reported
Similar model names are never merged automatically. Evaluation membership and numeric result rows only reference the exact ID
gpt-rosalind.Evaluation settings
| Benchmark | Work | Run / group | Scope |
|---|---|---|---|
| LifeSciBench | LifeSciBench: Evaluating Language Models on Realistic, Expert-Level Tasks in the Life Sciences | lifescibench-official-full lifescibench-initial-release-full-official | full · n=750 |
Numeric results
| Benchmark | Work | Run / group | Metric | Value |
|---|---|---|---|---|
| LifeSciBench | LifeSciBench: Evaluating Language Models on Realistic, Expert-Level Tasks in the Life Sciences | lifescibench-official-full lifescibench-initial-release-full-official | Normalized rubric score | 0.576 proportion |
| LifeSciBench | LifeSciBench: Evaluating Language Models on Realistic, Expert-Level Tasks in the Life Sciences | lifescibench-official-full lifescibench-initial-release-full-official | Task pass rate | 36.1 percent |