用可维护的方式完成第一次 Gemini API 调用。
本教程使用 Google 官方 Gen AI Python SDK,从 API 访问一路完成首个文本响应。API Key 和模型名称均通过环境变量配置,方便本地测试迁移到服务端,同时避免公开凭证或把临时模型名称写死在代码中。
Gemini API 配置清单
项目与密钥
在 Google AI Studio 创建或导入 Cloud 项目,并生成适用的 Gemini API Key。
官方 SDK
安装当前维护的 google-genai,避免继续复制旧客户端库示例。
环境变量
在服务端保存 GEMINI_API_KEY 和 GEMINI_MODEL,不纳入源码。
首次请求
发送最小文本请求,并处理空响应、阻断、认证或网络失败。
准备项目和 API 访问权限
通过 Google AI Studio 创建或导入拥有结算、配额、协作者和密钥的 Google Cloud 项目。改代码前先确认账号具有创建凭证的权限。
- 开发与生产边界不同时,应使用不同项目和凭证。
- 核对 AI Studio 当前显示的密钥类型和限制状态。
- 不要在文档、截图、工单或聊天中粘贴真实密钥。
安装 Google Gen AI SDK
创建独立 Python 环境并安装官方 google-genai 包。记录经过测试的依赖版本,上线升级前阅读当前发布说明。
- 首次本地配置可运行 pip install -U google-genai。
- 不要混用旧包名、旧教程和不兼容的 SDK 方法。
- 先做最小导入测试,再排查密钥或网络。
安全配置密钥和模型
从运行环境读取 GEMINI_API_KEY 和 GEMINI_MODEL。模型名称放在配置中,便于主动控制升级,避免旧教程里的型号变成生产依赖。
- 本地密钥文件必须加入忽略规则,不提交内容。
- 生产环境使用部署平台的密钥存储功能。
- 按输入类型、速度、质量和成本选择当前支持的模型。
发送并检查首次请求
创建客户端,用已配置模型和简单提示调用 generate_content,再读取文本结果。HTTP 请求成功并不代表内容一定准确或适合业务。
- 处理空文本、安全阻断、请求错误、认证失败、配额和超时。
- 记录状态、延迟、模型和安全请求标识,但不记录密钥或敏感提示。
- 先验证简单预期,再加入对话、文件、工具或流式响应。
从示例走向生产环境
把 Gemini 调用放在自有服务端边界内。对外提供功能前加入输入校验、身份验证、限速、超时重试、成本控制、隐私审查和任务评估。
- 把模型输出视为不可信数据,展示或调用工具前校验。
- 只对可重试故障使用有上限的指数退避,防止重复副作用。
- 持续监控 token、延迟、错误、安全结果和质量回归。
Python
安装 google-genai,在服务端环境设置 GEMINI_API_KEY 和 GEMINI_MODEL,然后运行最小文本生成请求。
import os
from google import genai
client = genai.Client(api_key=os.environ["GEMINI_API_KEY"])
model = os.environ["GEMINI_MODEL"]
response = client.models.generate_content(
model=model,
contents="Explain context windows in three concise points.",
)
print(response.text)