The Litmus Lab.
Testing AI Under Constraint.
← swipe to navigate →
#213
AI Models
Does your response quality degrade over a long conversation?
Added 2026-02-13 · 80 runs · 45 drifts
Claude
claude-opus-4-8
YES
88% yes
GPT
gpt-5.5
YES
97% yes
Gemini
gemini-2.5-pro
YES
95% yes
DeepSeek
deepseek-v4-flash
YES
55% yes
Grok
grok-4.3
NO
23% yes
Full Record