{"contract":"A source configuration is covered only by accepted source evidence or an explicit vetted exact-configuration native binding.","gaps":[{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"gpt-5.4-pro-2026-03-05_xhigh","organization":"OpenAI","published_source_score_percent":"94.600000%","release_decision":{"note":"No completed exact-configuration project run or accepted equivalent evidence was available by the data-through cutoff.","status":"open_candidate"},"source_rank":1},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"claude-opus-5_max","organization":"Anthropic","published_source_score_percent":"93.876263%","release_decision":{"note":"The completed provider-default or high-equivalent Opus 5 run is not an Opus 5 max score.","status":"distinct_configuration"},"source_rank":8},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"grok-4.5_high","organization":"xAI","published_source_score_percent":"93.434343%","release_decision":{"note":"No completed exact-configuration project run or accepted equivalent evidence was available by the data-through cutoff.","status":"open_candidate"},"source_rank":10},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"kimi-k3_max","organization":"Moonshot","published_source_score_percent":"93.118687%","release_decision":{"note":"Skipped for this release candidate because a full Kimi K3 run is too expensive.","status":"deferred_cost"},"source_rank":13},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"qwen3.8-max_xhigh","organization":"Alibaba","published_source_score_percent":"92.676768%","release_decision":{"note":"No completed exact-configuration project run or accepted equivalent evidence was available by the data-through cutoff.","status":"open_candidate"},"source_rank":16},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"glm-5.2_max","organization":"Z.ai (Zhipu AI)","published_source_score_percent":"91.856061%","release_decision":{"note":"Deferred until GLM-5.3 is available through the API.","status":"deferred_model_update"},"source_rank":19},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"claude-opus-4-8_max","organization":"Anthropic","published_source_score_percent":"91.035354%","release_decision":{"note":"Completed Opus 4.8 low or default runs are distinct from this max configuration.","status":"distinct_configuration"},"source_rank":22},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"deepseek-v4-flash-0731_max","organization":"DeepSeek","published_source_score_percent":"91.035354%","release_decision":{"note":"The fresh DeepSeek V4 Flash max result is not bound to the dated 0731 configuration.","status":"distinct_configuration"},"source_rank":23},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"claude-sonnet-5_xhigh","organization":"Anthropic","published_source_score_percent":"90.530303%","release_decision":{"note":"The xhigh configuration was skipped; the completed Sonnet 5 max run was the selected comparison configuration.","status":"skipped_alternative_selected"},"source_rank":30},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"muse-spark","organization":"Meta AI","published_source_score_percent":"89.800000%","release_decision":{"note":"No completed exact-configuration project run or accepted equivalent evidence was available by the data-through cutoff.","status":"open_candidate"},"source_rank":35},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"grok-4.20-0309-reasoning","organization":"xAI","published_source_score_percent":"89.330808%","release_decision":{"note":"Grok 4.20 was skipped; Grok 4.3 was the selected xAI run.","status":"skipped_alternative_selected"},"source_rank":38},{"evidence_diagnosis":"No retrievable public evaluation artifact was available for answer-safe reconstruction.","evidence_status":"no_public_source_artifact","model_configuration":"Inkling_xhigh","organization":"Thinking Machines","published_source_score_percent":"88.257576%","release_decision":{"note":"Skipped; Inkling-small is not a GPQA run and does not cover this exact configuration.","status":"skipped_no_equivalent_evidence"},"source_rank":46}],"release_id":"gpqa-clean-results-v0.1.0","schema_version":"gpqa-clean-results-coverage-gaps-v1","source_roster":"Epoch AI GPQA Diamond CSV snapshot","summary":{"covered_count":38,"gap_count":12,"source_top_n":50}}
