Clinical Benchmarks

DeepSeek V4 Flash 0731

Released 31 Jul 2026284B A13BAlso written as deepseek/deepseek-v4-flash-0731Compare with other models

Clinical Benchmarks Index
28.6rank 114 of 148; 49.5 × 0.577 = 28.6, from 1 of 10 boards
Boards
1 of 13
Results
1
Latest measurement
Sep 2026

Results

Each line is placed on its own board. Dark tick: the board leader.

Documentation and coding

  1. MedCode (Vals AI)
    model ID deepseek/deepseek-v4-flash-0731; reasoning_effort=high; max_output_tokens=30000
    41.41
    Rank 50 of 103Leader Claude Opus 5 63.57
    Official leaderboard
    Measured Sep 2026

Sources

Open a line for the quote and page.

  1. 50MedCode (Vals AI) model ID deepseek/deepseek-v4-flash-0731; reasoning_effort=high; max_output_tok… 41.41
    Printed as 41.41%Official leaderboard, measured Sep 2026Configuration: model ID deepseek/deepseek-v4-flash-0731; reasoning_effort=high; max_output_tokens=30000
    Vals AI MedCode leaderboard official leaderboard, Vals AI, 29 Sep 2026. MedCode leaderboard, Overall task, All Models expanded, rank 50 of 103; Accuracy column; board Updated 9/29/2026. Rendered table row; configuration from embedded BenchmarkView props benchmarkView.default.tasks.overall["deepseek/deepseek-v4-flash-0731"].
    50 | DeepSeek V4 Flash 0731 | 41.41%±2.15 | $0.44/$1.32 | 2m07s
    Every result from this document

Other DeepSeek models: DeepSeek R1, DeepSeek-V3.1, DeepSeek-V3.2-Exp, DeepSeek V4.1 Flash, DeepSeek V4 Flash, DeepSeek V4 Pro