阿里云AI模型API调用全指南

1.调用

client = OpenAI(
    api_key="sk-ws自己的阿里云",
    base_url="阿里云"
)

在阿里云模型中查找自己的api_key

def get_ai_response(messages: list):
    completions = client.chat.completions.create(
        model="qwen-plus",
        messages=messages
    )
    return completions.choices[0].message.content

封装一个方法 调用我们的ai模型 model 是我们的模型类型 messages是我们要输入的内容

messages = [
    {"role": "system", "content": "你是一个助手"},
    {"role": "user", "content": question}
]

2.role 是消息类型 分为:

1.System Message object(可选)
系统消息,用于设定大模型的角色、语气、任务目标或约束条件等。一般放在messages数组的第一位。
QwQ模型不建议设置SystemMessage,QVQ模型设置SystemMessage不会生效。

2.User Message object (必选)
用户消息,用于向模型传递问题、指令或上下文等。

3.Assistant Message object(可选)
模型的回复。通常用于在多轮对话中作为上下文回传给模型。

4.Tool Message object(可选)
工具的输出信息。

常用的只有1和2 system和user system是定义系统的角色模型

3.文本输入

import os
from openai import OpenAI

client = OpenAI(
    # 若没有配置环境变量,请用百炼API Key将下行替换为:api_key="sk-xxx"
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)

completion = client.chat.completions.create(
    # 模型列表:https://help.aliyun.com/zh/model-studio/getting-started/models
    model="qwen3.8-max",
    messages=[
        {"role": "system", "content": "You are a helpful assistant."},
        {"role": "user", "content": "你是谁?"},
    ]
)
print(completion.model_dump_json())

4.流式输入

需要配置环境然后 流程式输入

import os
from openai import OpenAI

client = OpenAI(
    # 若没有配置环境变量,请用百炼API Key将下行替换为:api_key="sk-xxx"
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
    model="qwen3.8-max",  # 此处以qwen3.8-max为例,可按需更换模型名称。模型列表:https://help.aliyun.com/zh/model-studio/getting-started/models
    messages=[{'role': 'system', 'content': 'You are a helpful assistant.'},
                {'role': 'user', 'content': '你是谁?'}],
    stream=True,
    stream_options={"include_usage": True}
    )
for chunk in completion:
    print(chunk.model_dump_json())

temperature float (可选)

采样温度,控制模型生成文本的多样性。

temperature越高,生成的文本更多样,反之,生成的文本更确定。

取值范围: [0, 2)

temperature与top_p均可以控制生成文本的多样性,建议只设置其中一个值。更多说明,请参见概述

temperature默认值

不建议修改QVQ模型的默认temperature值 。

response_format object (可选) 默认值为{"type": "text"}

返回内容的格式。可选值:

  • {"type": "text"}:输出文字回复;

  • {"type": "json_object"}:输出标准格式的JSON字符串。

相关文档: 结构化输出
若指定为 {"type": "json_object"},需在提示词中明确指示模型输出JSON,如:“请按照json格式输出”,否则会报错。
支持的模型参见 结构化输出

5.模型

max_completion_tokens integer (可选)

模型输出的最大长度,包含思维链和模型回答。模型输出超过此值时生成将提前停止,返回的 finish_reason 为 length

默认值与最大值均为模型的最大输出长度。

与 max_tokens 的区别:max_completion_tokens 限制模型完整输出(思维链 + 回答),而 max_tokens 仅限制回答部分。思考类模型推荐使用 max_completion_tokens

支持以下模型:

  • 千问 Max:Qwen3.7-Max 及之后的模型

  • 千问 Plus:Qwen3.5-Plus 及之后的模型

  • 千问 Flash:Qwen3.5-Flash 及之后的模型

  • Kimi:kimi-k2.5 及其之后推出的Kimi模型

  • GLM:glm-5 及其之后推出的GLM系列模型

  • MiniMax:MiniMax-M2.5 及之后推出的MiniMax模型

  • DeepSeek:deepseek-v3、deepseek-r1、deepseek-r1-0528、deepseek-v3.1、deepseek-v3.2、deepseek-v3.2-exp、deepseek-v4-pro、deepseek-v4-flash 及之后推出的DeepSeek模型

以上模型均不包含三方直供模型。
实际输出 Token 数与设置的  max_completion_tokens 值之间最多可能存在 10 个 Token 的误差。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值