跳到主要内容
Router One

Claude Haiku 4.5 vs Gemini 3.5 Flash

Gemini 3.5 Flash 按 1M 输入 + 1M 输出配比约低 5%,但 Claude Haiku 4.5 的输入单价更低——真实负载偏向输入。Claude Haiku 4.5 上下文 200K,Gemini 3.5 Flash 为 1.05M。Claude Haiku 4.5 可走 /v1/chat/completions、/v1/messages(Claude Code);Gemini 3.5 Flash 可走 /v1/chat/completions。

Claude Haiku 4.5 与 Gemini 3.5 Flash 的当前单价、上下文窗口与能力对比——两者都能通过同一个 OpenAI 兼容端点调用,每次请求带成本 trace。

Claude Haiku 4.5 与 Gemini 3.5 Flash:单价、上下文窗口与能力对比

规格Claude Haiku 4.5Gemini 3.5 Flash
输入 / 1M tokens$0.30$0.45
输出 / 1M tokens$3.00$2.70
缓存输入 / 1M tokens$0.12$0.45
上下文窗口200K1.05M
能力对话、流式输出、工具调用、视觉理解对话、流式输出、工具调用、视觉理解
详情页Claude Haiku 4.5Gemini 3.5 Flash

Claude Haiku 4.5 与 Gemini 3.5 Flash 跑 1M tokens 各要多少钱?

按当前单价计算 1M 输入 + 1M 输出 tokens 的负载:Claude Haiku 4.5 合计 $3.30,Gemini 3.5 Flash 合计 $3.15——在这个配比下 Gemini 3.5 Flash 约便宜 5%。真实负载通常严重偏向输入 tokens,请按你自己的输入/输出比例衡量;上表的「缓存输入」一行是该模型的目录公示价。

在 Claude Haiku 4.5 与 Gemini 3.5 Flash 之间切换,不改代码

两个模型都在同一个 OpenAI 兼容端点后面,A/B 测试只是改一个 model 字符串——key、base URL、请求结构都不变,每次请求的 tokens、花费、延迟都记录在控制台:

compare.sh
curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-router-one-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "anthropic/claude-haiku-4.5", "messages": [{"role": "user", "content": "Hello"}]}'

# Same request, other model — change one string:
#   "model": "google/gemini-3.5-flash"

常见问题

Claude Haiku 4.5 比 Gemini 3.5 Flash 便宜吗?

按当前公示单价,Gemini 3.5 Flash 更便宜(输入 $0.30 vs $0.45,输出 $3.00 vs $2.70,均为每 1M tokens)。价格会调整,/models 页是实时的事实来源。

在 Claude Haiku 4.5 和 Gemini 3.5 Flash 之间切换要改代码吗?

不用。两者走同一个 OpenAI 兼容端点,切换就是改请求里的 model 字符串——key、base URL、请求结构完全不变。

这些数字从哪来?

本页的规格和价格直接渲染自 Router One 实时模型目录——与 /models 页同源,并随之刷新。定价方法见 /pricing-methodology。本页价格于 2026-08-30(UTC)读取自实时目录,一小时内自动刷新。