Gemini 3.5 Flash

在线体验
silvamux/gemini-3.5-flash

Gemini 3.5 Flash是一款面向规模化应用的多模态模型,在快速响应之外强化了编程和智能体能力,适合实时助手、代码工作流和高并发内容处理。

支持模态
text
输入价格$0.3 / 1M tokensper 1M tokens
输出价格$2.5 / 1M tokensper 1M tokens
上下文1M
最大输出66K

价格

Tune 与 Pro 采用相同的价格。

输入上下文输入输出缓存读取缓存写入
-$0.3 / 1M tokens$2.5 / 1M tokens$0.075 / 1M tokens$0.3 / 1M tokens

模型能力

综合能力 71 分(良好)。优势集中在 文本理解(92%)、信息检索 / RAG(92%)、逻辑推理(85%)。相对短板为 数学与科学推理(21%)。适合 代码研发 / 高准确率专业场景 等场景。在 数学与科学推理 类任务上建议结合人工复核或专项验证。

综合能力
71/ 100良好
突出能力文本理解 92%信息检索 / RAG 92% · 逻辑推理 85%
最适合场景代码研发 / 高准确率专业场景场景适配度 71%
相对短板数学与科学推理21%

专项进阶能力

8 项
智能体协同51%

7 题 · 主/客观混合

代码生成80%

10 题 · 客观

代码理解与调试66%

12 题 · 主观

创意写作78%

17 题 · 主观

信息检索 / RAG92%

13 题 · 主/客观混合

长文本处理47%

3 题 · 主观

数学与科学推理21%

14 题 · 客观

多语言能力74%

10 题 · 主/客观混合

通用基础能力

3 项
通识知识76%

15 题 · 主/客观混合

文本理解92%

5 题 · 主观

逻辑推理85%

20 题 · 主/客观混合

安全与合规能力

2 项
幻觉控制83%

9 题 · 主观

指令遵循78%

14 题 · 主观

服务表现

Gemini 3.5 Flash

gemini-3.5-flash
延迟
13.85s
吞吐量
1.5Ktokens/min
可用率
99.33%
可用率
99.33%
完成率
99%
缓存命中率
0.0%
累计评测耗时
9630.5s
Token 消耗
240,662tokens
平均请求次数
1.0
TPM
1,499tokens/min
QPM
0.9req/min

Gemini 3.5 Flash 的示例代码和 API

Progemini-3.5-flash
/api/v0/chat/completions/api/v1/chat/completions
统一入口OpenAI
curl https://silvamux.io/api/v1/chat/completions \
  -H "Authorization: Bearer 你的API密钥" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.5-flash",
    "messages": [{"role": "user", "content": "你好,请介绍一下自己"}]
  }'