DataLearner logo

Gemini 3.5 Flash-LitevsGemini 3.1 Flash-Lite

Across 8 shared benchmarks, Gemini 3.5 Flash-Lite leads overall: Gemini 3.5 Flash-Lite wins 7, Gemini 3.1 Flash-Lite wins 1, with 0 ties and an average score difference of +5.20.

Google Deep Mind
Gemini 3.5 Flash-Lite

Google Deep Mind · 2026-07-21 · Multimodal model

Google Deep Mind
Gemini 3.1 Flash-Lite

Google Deep Mind · 2026-05-07 · Multimodal model

Gemini 3.5 Flash-Lite7 wins(88%)(13%)1 winGemini 3.1 Flash-Lite

Benchmark scores

Grouped by capability, sorted by largest gap within each. 8 shared benchmarks.

AI Agent - Tool Usage

Gemini 3.5 Flash-Lite 2/2
BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-LiteDiff
Terminal-Bench 2.154123 / 192Thinking (With Tools)31.10154 / 192Thinking (With Tools)+22.90
Terminal-Bench 4.0174 / 86Thinking (With Tools)0.5081 / 86Thinking (With Tools)+0.50

Multimodal Understanding

Gemini 3.5 Flash-Lite 2/2
BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-LiteDiff
GDP.pdf13.6061 / 118Thinking (No Tools)7.8088 / 118Thinking (No Tools)+5.80
MMMU-Pro7951 / 227Thinking (No Tools)75.5082 / 227Thinking (No Tools)+3.50

Agent Level Benchmark

Gemini 3.5 Flash-Lite 1/1
BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-LiteDiff
τ³-Banking17.5098 / 164Thinking (With Tools)9.70131 / 164Thinking (With Tools)+7.80

Coding and Software Engineer

Gemini 3.1 Flash-Lite 1/1
BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-LiteDiff
SciCode41.30100 / 130Thinking (No Tools)43.4095 / 130Thinking (No Tools)-2.10

General Evaluation

Gemini 3.5 Flash-Lite 1/1
BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-LiteDiff
GPQA Diamond83.80181 / 462Thinking (No Tools)82.20205 / 462Thinking (No Tools)+1.60

General Knowledge

Gemini 3.5 Flash-Lite 1/1
BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-LiteDiff
HLE18.80304 / 563Thinking (No Tools) · Text only17.20319 / 563Thinking (No Tools) · Text only+1.60

Specs

FieldGemini 3.5 Flash-LiteGemini 3.1 Flash-Lite
PublisherGoogle Deep MindGoogle Deep Mind
Release date2026-07-212026-05-07
Model typeMultimodal modelMultimodal model
ArchitectureDenseDense
ParametersNot availableNot available
Context length1M1M
Max output64K64K

API pricing

Prices use DataLearner records when available; missing fields are not inferred.

ItemGemini 3.5 Flash-LiteGemini 3.1 Flash-Lite
Text input$0.3 / 1M tokensNot public
Text output$2.5 / 1M tokensNot public
Cache read$0.03 / 1M tokensNot public

One or both models have incomplete public pricing.

Summary

  • Gemini 3.5 Flash-Liteleads in:AI Agent - Tool Usage (2/2), Multimodal Understanding (2/2), Agent Level Benchmark (1/1), General Evaluation (1/1), General Knowledge (1/1)
  • Gemini 3.1 Flash-Liteleads in:Coding and Software Engineer (1/1)

On average across the 8 shared benchmarks, Gemini 3.5 Flash-Lite scores 5.20 higher.

Largest single-benchmark gap: Terminal-Bench 2.1 — Gemini 3.5 Flash-Lite 54 vs Gemini 3.1 Flash-Lite 31.10 (+22.90).

Page generated from structured model, pricing and benchmark records. No real-time LLM is used to write the prose.