1. 文本接口
魔芋AI开发文档
  • API快速配置
    • CC-Switch快速配置(推荐)
    • Claude Code 与 Codex 安装配置
    • 智能体集成魔芋Skills
  • 魔芋SDK
    • SDK接口规范文档
    • SDK 完整示例
  • API文档
    • 文本接口
      • Anthropic 文本接口
      • 豆包文本接口
      • Gemini 文本接口
      • 多模态接口
      • OpenAI 文本接口
    • 图片接口
      • Doubao 图片接口
      • Seedream 图生图接口
      • Gemini 图片生成接口
      • GPT-Image-2 图片接口
      • MiniMax-Hailuo 图片接口
      • OpenAI 图片接口
      • Gemini 图生图调用示例
      • 即梦 & 生数异步图片接口
    • 视频接口
      • kling-v3-传入参考视频
      • 豆包(Doubao)视频接口
      • Happy Horse 视频接口
      • 即梦视频接口
      • Kling 视频接口
      • Kling-v3 系列视频接口
      • Seedance 2.0 多图生视频调用示例
      • Sora 视频接口
      • Veo 视频生成 API 接口文档
  • API接口
    • 模型
      • 获取可用模型列表
    • 文本对话
      • OpenAI 对话补全
      • OpenAI Responses
      • Anthropic 消息接口
      • Gemini 内容生成
    • 图片生成
      • 图片编辑
      • 图片生成
    • 视频生成
      • 提交视频生成任务
      • 查询视频生成任务
      • 查询豆包视频任务状态
      • 按令牌获取视频任务列表
    • 素材库
      • 真人素材 API 接口文档(H5 人脸认证)
      • 创建素材 / 批量上传
      • 查询素材列表
      • 查询单个素材
      • 按批次查询素材
      • 更新素材名称
      • 删除素材
      • 获取素材库列表
      • 创建素材库
      • 删除素材库
      • 转移素材库
  • Seedance2文档
    • Seedance 2.0 视频生成接口
    • 按令牌获取视频任务列表
    • 素材库 API 接口文档
  • 数据模型
    • ChatMessage
    • ChatCompletionRequest
    • ChatCompletionResponse
    • OpenAIUsage
    • ResponsesRequest
    • ResponsesResponse
    • AnthropicMessageRequest
    • AnthropicMessageResponse
    • GeminiPart
    • GeminiContent
    • GeminiGenerateContentRequest
    • GeminiGenerateContentResponse
    • ModelListResponse
    • ImageGenerationRequest
    • ImageGenerationResponse
    • SeedanceContentItem
    • SeedanceMetadata
    • VideoGenerationRequest
    • VideoTaskSubmitResponse
    • VideoTaskQueryResponse
    • VideoTaskListResponse
    • VideoTaskListItem
    • VideoAutoUploadRequest
    • VideoAutoUploadSubmitResponse
    • VideoFlatQueryResponse
    • AssetItem
    • CreateAssetRequest
    • CreateAssetResponse
    • ListAssetsRequest
    • ListAssetsResponse
    • GetAssetResponse
    • BatchGetAssetsResponse
    • AssetIdResponse
    • AssetGroupListResponse
    • ErrorResponse
  1. 文本接口

多模态接口

多模态模型接口文档。多模态模型可在一次请求中混合输入文本、图片、音频等内容,并返回文本结果。
多模态模型统一使用 Responses 接口(/v1/responses)。

接口地址#

POST https://www.moyu.info/v1/responses

请求示例#

纯文本#

cURL#

图文混合输入#

将文本与图片放入同一条消息的 content 数组中,type 分别为 input_text 与 input_image。

cURL#

image_url 也支持 Base64 Data URL(data:image/jpeg;base64,...),适合上传本地图片。

其他语言#

响应格式#

{
  "id": "resp_xxx",
  "object": "response",
  "created_at": 0,
  "model": "MODEL_NAME",
  "status": "completed",
  "output": [
    {
      "id": "msg_xxx",
      "type": "message",
      "role": "assistant",
      "status": "completed",
      "content": [
        {
          "type": "output_text",
          "text": "图片中是一只坐在草地上的橘色猫咪。"
        }
      ]
    }
  ],
  "usage": {
    "input_tokens": 258,
    "output_tokens": 24,
    "total_tokens": 282,
    "input_tokens_details": {
      "cached_tokens": 0
    },
    "output_tokens_details": {
      "reasoning_tokens": 0
    }
  }
}

请求参数#

基础参数#

参数类型必填说明
modelstring是多模态模型名称
inputstring/array是输入内容,可以是字符串或消息数组。混合多模态输入时使用数组格式

input 格式#

支持两种格式:
字符串格式(纯文本):
{
  "model": "MODEL_NAME",
  "input": "你好"
}
消息数组格式(多模态 / 多轮对话):
{
  "model": "MODEL_NAME",
  "input": [
    {
      "role": "user",
      "content": [
        {"type": "input_text", "text": "描述这张图片"},
        {"type": "input_image", "image_url": "https://example.com/a.jpg"}
      ]
    }
  ]
}

content 内容类型#

数组格式下,每条消息的 content 是一个内容块数组,常用类型如下:
type说明关键字段
input_text文本内容text:文本字符串
input_image图片内容image_url:图片的 URL 或 Base64 Data URL
一条消息的 content 中可以同时包含多个文本块与图片块,顺序即为模型看到的顺序。

采样参数#

参数类型必填默认值说明
temperaturenumber否1采样温度,范围 0-2
top_pnumber否1核采样参数,范围 0-1
max_output_tokensinteger否模型最大值生成的最大 token 数量

控制参数#

参数类型必填默认值说明
instructionsstring否-系统指令,用于设定助手的行为
streamboolean否false是否流式输出。true 时以 SSE 事件流返回
previous_response_idstring否-上一次响应的 ID,用于多轮对话上下文衔接

高级参数#

参数类型必填默认值说明
toolsarray否[]可用工具列表(函数调用等)
tool_choiceobject否-工具选择策略
reasoningobject否-推理配置,如 {"effort": "medium"}
metadataobject否{}自定义元数据
userstring否-终端用户的唯一标识符

响应字段说明#

字段类型说明
idstring本次响应的唯一标识符,格式为 resp_xxx
objectstring对象类型,固定为 response
created_atinteger创建时间戳
modelstring使用的模型名称
statusstring响应状态:completed(完成)、failed(失败)、in_progress(进行中)
outputarray输出内容列表
output[].typestring输出项类型,如 message
output[].rolestring角色,固定为 assistant
output[].contentarray内容列表
output[].content[].typestring内容类型,如 output_text
output[].content[].textstring助手的回复文本
usageobjecttoken 使用情况统计
usage.input_tokensinteger输入使用的 token 数(含文本与图片折算)
usage.output_tokensinteger输出使用的 token 数
usage.total_tokensinteger总 token 数
usage.input_tokens_detailsobject输入 token 详情
usage.input_tokens_details.cached_tokensinteger缓存命中的输入 token 数(未命中缓存时为 0)
usage.output_tokens_detailsobject输出 token 详情
usage.output_tokens_details.reasoning_tokensinteger推理过程消耗的 token 数(不支持推理的模型为 0)
修改于 2026-08-05 01:35:17
上一页
Gemini 文本接口
下一页
OpenAI 文本接口
Built with