Neura Intelligence Index
Subset of BIG-Bench tasks that are challenging for language models — tests reasoning
| # | Model | Score | Provider | Source |
|---|---|---|---|---|
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated | ||||
| aggregated |