Skip to main content
本页介绍 Gemini 系列模型在 YeLin AI 的使用方式。 你用 OpenAI 兼容接口即可调用 Gemini。

对话补全

用同一个端点调用 Gemini。

模型列表

找到 Gemini 的模型 id。

模型简介

Google Gemini是谷歌开发的先进多模态AI模型,具有强大的文本理解、代码生成、图像分析和推理能力。在YeLIn AI平台上,你可以使用Gemini的最新模型版本。

🚀 模型概览

Gemini 1.5 Pro

最新旗舰模型,支持超长上下文和多模态

Gemini 1.5 Flash

轻量快速版本,高性价比选择

Gemini 1.0 Pro

经典版本,稳定可靠

Gemini Vision

专门优化的视觉理解模型

Gemini 1.5 Pro (推荐)

Gemini 1.5 Pro是Google最新的旗舰模型,支持长达200万token的上下文长度。

🎯 核心特性

模型ID: gemini-1.5-pro-latest 特点:
  • 🧠 强大的推理和分析能力
  • 📚 超长上下文支持(2M tokens)
  • 🖼️ 多模态能力:文本、图像、视频、音频
  • 🔍 优秀的文档理解能力
  • 💻 卓越的代码生成能力
  • 🌍 优秀的多语言支持
价格: 输入 3.5/1Mtokens,输出3.5/1M tokens,输出 3.5/1Mtokens,输出10.5/1M tokens Python Node.js cURL

📚 超长文档分析

Gemini 1.5 Pro的超长上下文特别适合处理大型文档:

🖼️ 多模态能力

Gemini 1.5 Pro支持图像、视频和音频分析:

💻 代码生成和审查

Gemini 1.5 Flash (高性价比)

Gemini 1.5 Flash是轻量级版本,提供快速响应和优异的性价比。

⚡ 核心特性

模型ID: gemini-1.5-flash-latest 特点:
  • 🚀 超快响应速度
  • 💰 极高性价比
  • 🎯 保持核心能力
  • 📱 移动端友好
  • 🔄 适合高频调用
价格: 输入 0.075/1Mtokens,输出0.075/1M tokens,输出 0.075/1Mtokens,输出0.3/1M tokens

🎮 使用场景

实时对话
快速翻译
代码辅助

📱 移动应用集成

Gemini 1.0 Pro (经典版)

稳定可靠的经典版本,适合生产环境。

🏛️ 核心特性

模型ID: gemini-1.0-pro 特点:
  • 🎯 稳定可靠的性能
  • 💼 适合生产环境
  • 📊 良好的商业应用表现
  • 🔄 长期支持
价格: 输入 0.5/1Mtokens,输出0.5/1M tokens,输出 0.5/1Mtokens,输出1.5/1M tokens

💼 商业应用

Gemini Vision (视觉专家)

专门针对视觉任务优化的模型。

👁️ 核心特性

模型ID: gemini-pro-vision 特点:
  • 🖼️ 专业的图像理解能力
  • 🎨 设计元素分析
  • 📊 图表和数据可视化解读
  • 🏗️ 建筑和空间分析
  • 🎭 艺术作品鉴赏
价格: 输入 0.25/1Mtokens,输出0.25/1M tokens,输出 0.25/1Mtokens,输出0.5/1M tokens

🎨 图像分析应用

设计分析 数据图表解读

🏗️ 建筑和空间分析

Gemini的独特优势

1. 🧠 强大的推理能力

Gemini在逻辑推理和问题解决方面表现出色:

2. 📚 超长上下文处理

Gemini 1.5 Pro支持高达200万token的上下文:

3. 🎯 精准的多模态理解

Gemini在多模态任务中表现优异:

使用技巧和最佳实践

1. 模型选择策略

复杂分析任务 推荐: Gemini 1.5 Pro
  • 学术研究分析
  • 长文档处理
  • 多模态任务
  • 复杂推理问题
快速响应场景 推荐: Gemini 1.5 Flash
  • 实时对话
  • 快速翻译
  • 代码补全
  • 移动应用
视觉任务 推荐: Gemini Pro Vision
  • 图像分析
  • 设计审查
  • 图表解读
  • 艺术鉴赏
成本敏感场景 推荐: Gemini 1.0 Pro
  • 生产环境
  • 批量处理
  • 基础对话
  • 内容生成

2. 性能优化

上下文管理

充分利用Gemini的长上下文能力

并行处理

并行处理多个任务提高效率

缓存策略

缓存常用结果减少API调用

流式响应

使用流式响应提升用户体验

3. 错误处理和监控

与其他模型的对比

Gemini vs GPT-4

长文本处理 Gemini优势:
  • 支持高达200万token的上下文
  • 更好的长文档理解能力
  • 优秀的信息提取和总结
适用场景: 长文档分析、大数据处理、复杂研究 多模态能力 Gemini优势:
  • 原生多模态设计
  • 更强的图像理解能力
  • 支持视频和音频分析
适用场景: 视觉分析、媒体处理、设计审查 成本效益 Gemini优势:
  • 更具竞争力的价格
  • 高性价比的Flash版本
  • 长上下文的性价比优势
适用场景: 成本敏感的应用、大规模部署

Gemini vs Claude

推理能力 Gemini优势:
  • 强大的数学推理能力
  • 优秀的逻辑分析能力
  • 更好的代码生成能力
适用场景: 数学问题、逻辑推理、编程任务 多语言支持 Gemini优势:
  • 更广泛的语言支持
  • 更好的跨语言理解能力
  • 优秀的本地化能力
适用场景: 国际化应用、多语言内容处理

探索国产大模型

了解通义千问、文心一言、智谱ChatGLM等国产大模型

查看完整API参考

查看详细的API调用参数和示例