正文 · AI 翻译
我们在 5 个模型上运行了 1,730 道视觉推理题。将图像细节降至“低”会损失实际准确率,而在 gpt-5.5 上,账单反而还增加了。真正能可靠降低成本的手段是推理努力度。
OpenRouter 用 1730 道题的实验告诉你,降图像细节未必省钱,GPT-5.5 上反而更贵,真正靠谱的开关是控制推理努力。做视觉应用的不看这个容易踩坑。
在5个模型上测试了1730道视觉推理题,发现将图像细节降至"low"会损失准确率,且在gpt-5.5上费用反而上升。真正可靠降低成本的手段是调节推理努力(reasoning effort)。
我们在 5 个模型上运行了 1,730 道视觉推理题。将图像细节降至“低”会损失实际准确率,而在 gpt-5.5 上,账单反而还增加了。真正能可靠降低成本的手段是推理努力度。
OpenRouter 用 1730 道题的实验告诉你,降图像细节未必省钱,GPT-5.5 上反而更贵,真正靠谱的开关是控制推理努力。做视觉应用的不看这个容易踩坑。
在5个模型上测试了1730道视觉推理题,发现将图像细节降至"low"会损失准确率,且在gpt-5.5上费用反而上升。真正可靠降低成本的手段是调节推理努力(reasoning effort)。
我们在 5 个模型上运行了 1,730 道视觉推理题。将图像细节降至“低”会损失实际准确率,而在 gpt-5.5 上,账单反而还增加了。真正能可靠降低成本的手段是推理努力度。