模型与能力
本平台模型值、能力分类和模型列表接口
模型值是本平台对外暴露的稳定名称。业务方只需要传本平台模型值,平台会根据渠道配置和请求字段选择对应上游接口。
列出模型
GET /v1/modelscurl https://geekapi.net/v1/models \
-H "Authorization: Bearer sk-你的令牌"返回结构兼容 OpenAI 模型列表格式。模型是否可用还会受账号分组、令牌限制、余额、渠道状态影响。
模型值规则
model必填,必须使用本平台发布的模型值。
文本模型能力
| 模型值 | 系列 | Chat Completions | Responses | 流式输出 | 工具调用 | JSON 输出 | 调用规则 | 说明 |
|---|---|---|---|---|---|---|---|---|
| gemini-3.5-flash | Gemini | 支持 | 支持 | 支持 | 部分支持 | 部分支持 | 通过 /v1/chat/completions 或 /v1/responses 提交。 | 工具调用和 JSON 输出取决于当前渠道兼容能力,建议业务侧做结果校验。 |
| gemini-3-pro-preview | Gemini | 支持 | 支持 | 支持 | 部分支持 | 部分支持 | 通过 /v1/chat/completions 或 /v1/responses 提交。 | 预览模型能力可能随上游调整;工具调用和 JSON 输出取决于当前渠道兼容能力。 |
工具调用和 JSON 输出为兼容能力,具体支持程度取决于当前模型渠道;需要严格结构化输出时建议业务侧校验。
视频模型能力
| 模型值 | 显示名称 | 文生视频 | 图生视频 | 参考图生视频 | 视频参考 | 音频参考 | 首尾帧 | 全能参考 | 自动识别规则 | 限制 |
|---|---|---|---|---|---|---|---|---|---|---|
| 正在读取已启用的全局视频模型… | ||||||||||
表格根据当前已启用的全局视频模型及其规则生成;视频参考使用 videoUrls,音频参考使用 audioUrls;全能参考表示可组合接收多种参考输入。
图片模型能力
| 模型值 | 系列 | 文生图 | 图生图 | 自动识别规则 | 限制 |
|---|---|---|---|---|---|
| gpt-image-2 | OpenAI Image | 支持 | 支持 | 无图片按文生图;有 image/images/imageUrl 按图生图或参考图。 | 支持 size 推导 aspectRatio/resolution;参考图字段会归一为 imageUrls。 |
| gemini-3-pro-image | Gemini Image | 支持 | 支持 | 无图片按文生图;有 image/images/imageUrl 按图生图或参考图。 | 支持 size 推导 aspectRatio/resolution;参考图字段会归一为 imageUrls。 |
图生图为参考图能力,不等同于带 mask 的局部编辑。
音频模型能力
| 模型值 | 系列 | 音频生成 | 调用规则 | 说明 |
|---|---|---|---|---|
| elevenlabs-v3 | ElevenLabs | 支持 | 通过 /v1/audio/speech 提交文本转语音。 | 字段以 OpenAI speech 兼容格式为主,voice 由上游渠道支持情况决定。 |
能力术语
| 能力 | 含义 |
|---|---|
| 文本生成 | 通过 messages 或 input 生成文本回复。 |
| 流式输出 | 传 stream: true,用 SSE 持续接收增量内容。 |
| 工具调用 | 传 tools 和 tool_choice,让模型返回函数调用意图。 |
| JSON 输出 | 通过 response_format 或提示词约束输出 JSON。 |
| 文生视频 | 只传 prompt,不传图片、视频、音频输入。 |
| 图生视频 | 推荐传单张图片统一字段 imageUrl。入口仍兼容 image、image_url。 |
| 参考图生视频 | 推荐传多张参考图统一字段 imageUrls。入口仍兼容 images、image_urls。 |
| 视频参考 | 推荐传参考视频统一字段 videoUrls。入口仍兼容 video、videoUrl、video_urls。 |
| 音频参考 | 推荐传参考音频统一字段 audioUrls。入口仍兼容 audio、audioUrl、audio_urls。 |
| 首尾帧生视频 | 同时传统一字段 firstFrameUrl 和 lastFrameUrl。 |
| 全能参考 | 在同一套规范字段中组合接收参考图、参考视频、参考音频等多媒体输入。 |
| 文生图 | 只传 prompt 生成图片。 |
| 图生图 | 传 image、imageUrl、images 等图片输入作为参考或编辑输入。 |