1.调用
client = OpenAI(
api_key="sk-ws自己的阿里云",
base_url="阿里云"
)
在阿里云模型中查找自己的api_key
def get_ai_response(messages: list):
completions = client.chat.completions.create(
model="qwen-plus",
messages=messages
)
return completions.choices[0].message.content
封装一个方法 调用我们的ai模型 model 是我们的模型类型 messages是我们要输入的内容
messages = [
{"role": "system", "content": "你是一个助手"},
{"role": "user", "content": question}
]
2.role 是消息类型 分为:
1.System Message object(可选)
系统消息,用于设定大模型的角色、语气、任务目标或约束条件等。一般放在messages数组的第一位。
QwQ模型不建议设置SystemMessage,QVQ模型设置SystemMessage不会生效。
2.User Message object (必选)
用户消息,用于向模型传递问题、指令或上下文等。
3.Assistant Message object(可选)
模型的回复。通常用于在多轮对话中作为上下文回传给模型。
4.Tool Message object(可选)
工具的输出信息。
常用的只有1和2 system和user system是定义系统的角色模型
3.文本输入
import os
from openai import OpenAI
client = OpenAI(
# 若没有配置环境变量,请用百炼API Key将下行替换为:api_key="sk-xxx"
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
# 模型列表:https://help.aliyun.com/zh/model-studio/getting-started/models
model="qwen3.8-max",
messages=[
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "你是谁?"},
]
)
print(completion.model_dump_json())
4.流式输入
需要配置环境然后 流程式输入
import os
from openai import OpenAI
client = OpenAI(
# 若没有配置环境变量,请用百炼API Key将下行替换为:api_key="sk-xxx"
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="qwen3.8-max", # 此处以qwen3.8-max为例,可按需更换模型名称。模型列表:https://help.aliyun.com/zh/model-studio/getting-started/models
messages=[{'role': 'system', 'content': 'You are a helpful assistant.'},
{'role': 'user', 'content': '你是谁?'}],
stream=True,
stream_options={"include_usage": True}
)
for chunk in completion:
print(chunk.model_dump_json())
temperature float (可选)
采样温度,控制模型生成文本的多样性。
temperature越高,生成的文本更多样,反之,生成的文本更确定。
取值范围: [0, 2)
temperature与top_p均可以控制生成文本的多样性,建议只设置其中一个值。更多说明,请参见概述。
temperature默认值
不建议修改QVQ模型的默认temperature值 。
response_format object (可选) 默认值为{"type": "text"}
返回内容的格式。可选值:
-
{"type": "text"}:输出文字回复; -
{"type": "json_object"}:输出标准格式的JSON字符串。
相关文档: 结构化输出。
若指定为
{"type": "json_object"},需在提示词中明确指示模型输出JSON,如:“请按照json格式输出”,否则会报错。
支持的模型参见 结构化输出。
5.模型
max_completion_tokens integer (可选)
模型输出的最大长度,包含思维链和模型回答。模型输出超过此值时生成将提前停止,返回的 finish_reason 为 length。
默认值与最大值均为模型的最大输出长度。
与 max_tokens 的区别:max_completion_tokens 限制模型完整输出(思维链 + 回答),而 max_tokens 仅限制回答部分。思考类模型推荐使用 max_completion_tokens。
支持以下模型:
-
千问 Max:Qwen3.7-Max 及之后的模型
-
千问 Plus:Qwen3.5-Plus 及之后的模型
-
千问 Flash:Qwen3.5-Flash 及之后的模型
-
Kimi:kimi-k2.5 及其之后推出的Kimi模型
-
GLM:glm-5 及其之后推出的GLM系列模型
-
MiniMax:MiniMax-M2.5 及之后推出的MiniMax模型
-
DeepSeek:deepseek-v3、deepseek-r1、deepseek-r1-0528、deepseek-v3.1、deepseek-v3.2、deepseek-v3.2-exp、deepseek-v4-pro、deepseek-v4-flash 及之后推出的DeepSeek模型
以上模型均不包含三方直供模型。
实际输出 Token 数与设置的
max_completion_tokens 值之间最多可能存在 10 个 Token 的误差。
5580

被折叠的 条评论
为什么被折叠?



