ZToken Pro
API登录
ZToken官网
API登录
ZToken官网
Google接口
欢迎使用ZToken
概述
HelloWord-第一个示例
API最新消息
模型和价格说明
渠道路由策略
base_url地址到底是哪个?
联系我们&bug反馈
发票与报销
推广合伙人赚钱计划
OpenAI接口
OpenAI概述
使用OpenAI官方SDK
使用 Codex CLI
Audio
Chat
Completions
Embeddings
Fine Tuning
Batches
Files
Images
Models
Moderations
Videos
Responses
Realtime
Assistants
Vector stores
Anthropic接口
Claude概述
使用Claude官方SDK
使用 Claude Code
Messages
Models
Google接口
Gemini概述
使用Gemini官方SDK
使用 Gemini CLI
Generating content
Interactions API
Files
Gemini文本生成
Gemini深度思考
Gemini函数调用
Gemini图片生成
Gemini图片理解
Gemini文档理解
Gemini视频理解
Gemini音频理解
Gemini代码执行
Gemini网页上下文
Gemini支持谷歌搜索
Gemini结构化输出
xAI接口
Grok概述
Chat
Responses
Images
Videos
DeepSeek接口
阿里千问接口
字节豆包接口
MiniMax接口
快手可灵接口
ZToken系统接口
查询余额
模型说明
其它模型示例
费用计算说明
其它说明
主要概念
常见问题
错误码
示例代码
兼容openai的python库
兼容openai的Node.js库
兼容openai的其它各种库
流式示例stream
函数调用
文字生成图片
图片理解
python
js
java
php
c++
object-c
c#
curl
audio_transcriptions
translation
tts
langchain
batch
batch示例
batch特别注意事项
video
video示例
video特别注意事项
文章列表
ZToken-AI工具配置使用指南
在 Cursor 中配置ZToken API
大模型怎么实现连续对话(记忆上下文)
为什么调用chatgpt的api接口没有返回??怎么查问题
废弃
Google接口
Gemini视频理解
Gemini 模型可以处理视频,从而支持许多先进的开发者用例,而这些用例在过去需要使用特定领域的模型。Gemini 的部分视觉功能包括:
描述视频、对其进行细分并提取信息
回答与视频内容相关的问题
提及视频中的特定时间戳
Gemini 从一开始就是作为多模态模型来构建的,我们将不断突破极限,探索更多可能。本指南介绍了如何使用 Gemini API 根据视频输入生成文本回答。
视频输入
#
您可以通过以下方式将视频作为输入提供给 Gemini:
使用 File API 上传视频文件,然后向 generateContent 发出请求。对于大于 20MB 的文件、时长超过大约 1 分钟的视频,或者您想在多个请求中重复使用文件时,请使用此方法。
通过请求将内嵌视频数据传递给 generateContent。适用于较小的文件(小于 20 MB)和较短时长的文件。
直接在问题中添加 YouTube 网址。
支持的视频格式
#
Gemini 支持以下视频格式 MIME 类型:
video/mp4
video/mpeg
video/mov
video/avi
video/x-flv
video/mpg
video/webm
video/wmv
video/3gpp
示例
#
输入:
返回:
修改于
2026-07-03 13:55:25
上一页
Gemini文档理解
下一页
Gemini音频理解