AI Study Online

Gemini 2.5 Flash

Google DeepMind · 2025

Google 快速高效的多模态模型,适用于大流量、低延迟应用。

访问官网

快速概览

参数量

Undisclosed (lightweight)

上下文窗口

1M tokens

模态

text, image, audio, video, code

开源

价格

免费版 / API 从 $0.15/百万 token

发布日期

2025

开发者

Google DeepMind

关于

Gemini 2.5 Flash 是 Google DeepMind 的轻量级多模态模型,专为速度和成本效率设计,同时保持与 Pro 版本相同的 100 万 token 上下文窗口。处理文本、图像、音频和视频的延迟显著低于 Pro 版本。尽管是较小较快的模型,在推理、编程和分析任务上表现令人印象深刻。免费版慷慨,API 每百万输入 token 仅 0.15 美元。对于需要大规模多模态理解的开发者来说,Flash 提供了 Gemini 系列中最佳的性价比。

优势

  • +Gemini 系列中响应速度最快
  • +低成本下的 100 万 token 上下文窗口
  • +完整多模态支持(文本、图像、音频、视频)
  • +大流量场景下性价比最高的模型

不足

  • 复杂任务上质量不如 Pro
  • 创意写作能力较弱
  • 在高度专业领域可能表现不足

适用场景

高吞吐量实时应用

成本敏感的多模态处理

处理大量短内容

需要快速响应的应用

价格

免费版

$0

  • Gemini 2.5 Flash
  • Google 搜索
  • 文件上传

API

From $0.15/1M input tokens

  • 按量计费
  • 100 万 token 上下文
  • 多模态输入

技术规格

参数量

Undisclosed (lightweight)

上下文窗口

1M tokens

模态

text, image, audio, video, code

语言

EnglishChineseSpanishArabicFrench+2

开源

开发者

Google DeepMind

发布日期: 2025

分享这篇文章

相关模型