Fetching from the wire…
Source-backed findings, relationship evidence, citations, and briefing history from the public MindPattern archive.
Fable 5.1 achieved 52.6% on Terminal-Bench-Science, up 24.7% from prior version.
Source findingKimi K3 scored 7.1% on Terminal-Bench-Science.
Source findingGLM 5.3 scored 8.1% on Terminal-Bench-Science.
Source findingClaude Opus 4.8 scored 10.5% on Terminal-Bench-Science.
Source findingClaude Fable 5 scored 21.4% on Terminal-Bench-Science.
Source findingGPT-5.6 Sol scored 22.4% on Terminal-Bench-Science.
Source findingClaude Opus 5 led at 30.0% on Terminal-Bench-Science.
Source findingGLM 5.3 scored 8.1% on Terminal-Bench-Science.
Source findingGPT-5.6 Terra scored 8.6% on Terminal-Bench-Science.
Source findingClaude Opus 4.8 scored 10.5% on Terminal-Bench-Science.
Source findingClaude Fable 5 scored 21.4% on Terminal-Bench-Science.
Source findingGPT-5.6 Sol scored 22.4% on Terminal-Bench-Science.
Source finding