Fetching from the wire…
Source-backed findings, relationship evidence, citations, and briefing history from the public MindPattern archive.
OpenAI uses GPT-5.4 Thinking in its internal coding-agent monitor.
Source findingGPT-5.4 Thinking achieves 0.3% controllability in CoT-Control evaluation.
Source findingGPT-5.4 Thinking scores 83.0% on GDPVal benchmark
Source findingOpenAI deploys GPT-5.4 Thinking to monitor internal coding agents for misalignment.
Source findingGPT-5.4 Thinking competes with Gemini 3.1 Pro Preview across benchmarks.
Source findingOpenAI released GPT-5.4 Thinking for benchmark evaluation.
Source findingOpenAI released GPT-5.4 Thinking model
Source findingOpenAI uses GPT-5.4 Thinking in its internal coding-agent monitor.
Source findingOpenAI deploys GPT-5.4 Thinking to monitor internal coding agents for misalignment.
Source findingOpenAI released GPT-5.4 Thinking for benchmark evaluation.
Source findingOpenAI released GPT-5.4 Thinking model
Source finding