凌晨两点,我第一次把模型接进脚本
那晚办公室只剩下空调低低的风声,杯底的咖啡已经凉了。我盯着终端里闪烁的光标,忽然觉得所谓“AI开发”,其实不像电影里那样神秘,它更像深夜电台的一根线:你把问题递过去,另一端传回一段有温度的回答。很多人搜索“Gemini API怎么用”“Gemini API教程”,真正卡住的并不是概念,而是第一步:密钥放哪、SDK装什么、为什么返回401或429。
先说免费和官方路径。Gemini API可以通过 Google AI Studio 获取 API Key,适合个人原型、内部工具、小规模测试。它的限制也要诚实面对:免费额度会变化,速率限制可能触发429;如果你在公司网络或代理环境下开发,还可能遇到连接超时。与“Claude注册方法”“Claude怎么用”“Claude免费使用”这类问题类似,第一关通常不是模型能力,而是账号、网络和配额。
最小可运行版本:Python接入Gemini API
我的建议是先别急着做复杂应用,先让一次请求稳定跑通。环境我用的是 Python 3.11,在一台普通笔记本上测试,1000字中文摘要请求平均耗时约1.8到3.2秒,网络波动时会到5秒以上。步骤如下:
安装官方SDK:
pip install google-genai把密钥写进环境变量,不要硬编码进代码:
export GEMINI_API_KEY="你的API_KEY"Windows PowerShell 可用:
$env:GEMINI_API_KEY="你的API_KEY"创建
demo.py:from google import genai
import os
client = genai.Client(api_key=os.environ["GEMINI_API_KEY"])
text = "请把下面这段会议记录压缩成三条待办事项:明天下午确认供应商报价,周五前完成页面文案,预算表需要财务复核。"
response = client.models.generate_content(
model="gemini-1.5-flash",
contents=text
)
print(response.text)运行:
python demo.py
如果你只是在做Gemini API入门开发,建议先用 gemini-1.5-flash,响应快、成本低,适合摘要、分类、客服草稿。需要更复杂推理时,再切到能力更强的模型。别一上来就追求“最强”,开发里最珍贵的往往是可重复、可调试。
一个真实小案例:把长文自动整理成工作摘要
我曾帮一个内容团队做过一个小工具:他们每天要读十几份产品反馈,手工归类很累。我们没有一开始做后台系统,只写了一个脚本,把 feedback.txt 里的内容读入,让 Gemini 输出“问题类型、用户情绪、建议动作”。核心提示词是这样的:
请阅读以下用户反馈,按JSON格式输出:category、sentiment、action。category只能是:价格、功能、性能、售后、其他。不要输出解释。
这样做的好处是后续程序容易解析。第一次测试50条反馈,人工抽查准确率约82%;把提示词补充“如果信息不足,category填其他,不要猜测”后,准确率升到约88%。这就是API开发最朴素的真相:不是一次写出神奇提示词,而是测、改、再测。
常见报错也给你一张简表:401 多半是密钥错误或环境变量未生效;429 是频率或额度限制,先降低并发、加重试;timeout 检查网络、代理和DNS;返回内容不稳定,就要求固定JSON格式,并在代码里做校验。
一个简单的重试思路是:失败后等待2秒、4秒、8秒再试,最多3次。不要无限重试,否则只是把一个小故障变成更大的配额浪费。
如何验证它真的跑通了
验证不要只看“有没有返回文字”。你可以用三步确认:第一,终端没有401、429、timeout;第二,同一段输入连续运行3次,输出结构基本一致;第三,把结果复制到JSON解析器或Python的 json.loads() 中能通过。如果做摘要应用,再抽样20条,让人工标注是否可用,达到80%以上再进入下一步集成。
如果你愿意走官方免费路线,Google AI Studio、官方SDK和本地脚本已经足够完成大多数Gemini API开发入门实验;如果你还需要集中整理AI工具、教程和替代方案,也可以把睿盈工具的 wizzegroup.com 当作一个参考入口。技术终究不是夜里的霓虹,它更像一盏台灯:照亮手边那一小块地方,然后让你继续往前走。