AI AI Club
← 返回文章列表

Gemini Files API:上传音讯与影片的流程

数小时的长视频或超大音频怎么给大模型?手把手教你使用官方 Files API 进行云端托管与状态轮询分析实战。

一、为什么大文件必须使用 Files API

超过 20MB 的视频或音频文件,如果将其转换为 Base64 字符串嵌入 HTTP POST 请求体,会极易引发网络超时与内存溢出。
官方 Files API 提供了专属的云端临时托管空间(免费暂存 48 小时)。

二、上传视频并分析的完整实战代码

import time
import google.generativeai as genai

# 1. 上传视频文件
video_file = genai.upload_file(path="meeting_recording.mp4")

# 2. 轮询等待云端解码完成
while video_file.state.name == "PROCESSING":
time.sleep(5)
video_file = genai.get_file(video_file.name)

# 3. 传入模型提问
model = genai.GenerativeModel("gemini-1.5-flash")
response = model.generate_content([
"请整理本场会议讨论的核心争议点,并标明争议发生的具体视频时间戳:",
video_file
])
print(response.text)

三、生命周期管理

上传的文件将在 48 小时后由谷歌云端自动清理,开发者也可在代码中随时调用 genai.delete_file() 主动销毁。
基础入门参考:[Gemini API 入门总指南](https://aihuiyuan.club/articles/gemini-api-key-google-ai-studio-free)。

联系我们

会员开通、订单问题或合作咨询,欢迎联系。

QQ1192214187
邮箱winky20000401@gmail.com