We benchmarked 1,730 visual reasoning questions across 5 models to test a common cost-saving trick: setting image detail to "low."
Surprise finding: it often backfires. The model burns extra reasoning tokens squinting at a blurry image, and overall cost increases 👇