NeurionForgeEval
LeaderboardModelsRun Eval →
MODEL SPECIFICATION

o3-mini

Provider: Frontier·Source: frontier_hosted
COMPOSITE MEASURED100.0%

Empirical Test Runs

10 recorded runs
BENCHMARKSCOREAVG LATENCYTHROUGHPUTSTATUSEVIDENCE
Hallucination v1100.0%——? Measured9/27/2026
Security v1100.0%——? Measured9/27/2026
Mathematical Reasoning v1100.0%——? Measured9/27/2026
Coding Completions v1100.0%——? Measured9/27/2026
Logical Reasoning v1100.0%——? Measured9/27/2026
Hallucination v1100.0%——? Measured9/20/2026
Security v1100.0%——? Measured9/20/2026
Mathematical Reasoning v1100.0%——? Measured9/20/2026
Coding Completions v1100.0%——? Measured9/20/2026
Logical Reasoning v1100.0%——? Measured9/20/2026
Run New Evaluation on o3-mini ⚡