
文章目录前言一、OpenAI GPT API 调用二、Google Gemini API 调用三、Anthropic Claude API 调用四、DeepSeek API 调用五、阿里 Qwen API 调用六、xAI Grok API 调用七、六大模型 API 接口与 SDK 对比八、多模型接入解决方案九、大模型 API 常见报错与排查十、总结前言本文整理了当前主流大模型 API 的调用方式涵盖多种常见平台的接口使用方法以 Python 最小可运行示例为主说明 SDK 用法、接口结构及差异帮助快速完成本地测试与对比。同时还提供通用调用思路用于构建多模型兼容的基础框架并补充常见错误与调试方法便于快速上手与实践。一、OpenAI GPT API 调用1.1 接口与模型说明OpenAI 目前推荐新项目使用 Responses API本文也以 Responses API 为主要示例。Chat Completions 是较早的接口目前仍然支持主要用于已有项目兼容和部分第三方 OpenAI-compatible 服务。当前 GPT-5.6 系列主要包括模型适合场景GPT-5.6 Sol适合复杂推理和代码任务GPT-5.6 Terra兼顾能力和成本GPT-5.6 Luna更适合成本敏感、高并发场景1.2 GPT API 调用示例打开PowerShell 或PyCharm 底部的 Terminal执行以下代码安装 OpenAI SDKpython-m pip install openai安装完成后运行以下代码完成最小验证fromopenaiimportOpenAI api_key你的_OpenAI_API_Key# 填写你在 OpenAI API 平台创建的 API Keybase_urlhttps://api.openai.com/v1# OpenAI 官方 API 地址使用官方接口时无需修改model_idgpt-5.6# gpt-5.6 默认使用 gpt-5.6-sol如需其他版本可改为 gpt-5.6-terra 或 gpt-5.6-lunaclientOpenAI(api_keyapi_key,base_urlbase_url)responseclient.responses.create(modelmodel_id,reasoning{effort:medium},# 推理强度none/low/medium/high/xhigh/max默认 mediuminput请用一句话解释什么是大语言模型。)print(response.output_text)官方文档地址https://developers.openai.com/api/docsGPT API Key 获取https://platform.openai.com/api-keys二、Google Gemini API 调用2.1 接口与模型说明Google 目前推荐新项目使用 Interactions API并配合官方的 Google GenAI SDK 调用 Gemini。Interactions API 已在 2026 年 6 月正式 GA后续新的模型和 Agent 能力也会优先接入该接口。本文使用gemini-3.6-flash 作为示例模型。它是当前稳定版本适合文本生成、代码、多模态理解和 Agent 等常见任务。Gemini 也提供 OpenAI-compatible 接口。如果已有项目使用 OpenAI SDK可以通过修改 API Key、Base URL 和 Model ID 接入 Gemini如果是第一次调用 Gemini直接使用 Google GenAI SDK 更简单。2.2 Gemini API 调用示例打开PowerShell 或PyCharm 底部的 Terminal执行以下代码安装Google GenAI SDKpython-m pip install google-genai安装完成后运行以下代码完成最小验证fromgoogleimportgenai api_key你的_Gemini_API_Key# 在 Google AI Studio 创建的 API Keymodel_idgemini-3.6-flash# 要调用的 Gemini 模型clientgenai.Client(api_keyapi_key)responseclient.interactions.create(modelmodel_id,input请用一句话解释什么是大语言模型。)print(response.output_text)官方文档地址https://ai.google.dev/gemini-api/docsGemini API Key 获取https://aistudio.google.com/api-keys三、Anthropic Claude API 调用3.1 接口与模型说明Claude 是 Anthropic 推出的大模型系列官方 API 主要通过 Messages API 调用。Python 可以直接使用 Anthropic 官方的 anthropic SDK。当前 GPT-5.6 系列主要包括模型适合场景claude-sonnet-5速度和能力比较均衡适合作为通用选择claude-opus-5复杂 Agent、代码和高难度任务claude-fable-5长时间运行的 Agent 等复杂任务claude-haiku-4-5更看重速度和成本的任务3.2 Claude API 调用示例打开PowerShell 或PyCharm 底部的 Terminal执行以下代码Anthropic SDKpython-m pip install anthropic安装完成后运行以下代码完成最小验证fromanthropicimportAnthropic api_key你的_Anthropic_API_Key# 在 Anthropic Console 创建的 API Keymodel_idclaude-sonnet-5# 要调用的 Claude 模型max_tokens1024# 本次最多生成的 Token 数量clientAnthropic(api_keyapi_key)responseclient.messages.create(modelmodel_id,max_tokensmax_tokens,messages[{role:user,content:请用一句话解释什么是大语言模型。}])print(response.content[0].text)官方文档地址https://platform.claude.com/docsClaudeAPI Key 获取https://platform.claude.com/settings/keys四、DeepSeek API 调用4.1 接口与模型说明DeepSeek API 兼容 OpenAI 和 Anthropic 接口格式Python 可以直接使用 OpenAI SDK 调用。本文使用更通用的 OpenAI Chat Completions 方式。目前 DeepSeek API 主要提供两个模型模型适合场景deepseek-v4-flash速度和成本优先适合日常调用deepseek-v4-pro能力优先适合复杂推理和 Agent 任务两个模型都支持 Thinking / Non-Thinking 模式并支持最高 1M 上下文。本文使用deepseek-v4-flash作为入门示例。需要注意旧模型名 deepseek-chat 和 deepseek-reasoner 已于 2026 年 7 月停止使用新项目应直接使用 deepseek-v4-flash 或 deepseek-v4-pro。DeepSeek 目前也支持 Responses API但暂时只支持 deepseek-v4-flash因此本文的基础示例优先使用兼容范围更广的 Chat Completions。4.2 DeepSeek API 调用示例打开PowerShell 或PyCharm 底部的 Terminal执行以下代码安装 OpenAI SDKpython-m pip install openai安装完成后运行以下代码完成最小验证fromopenaiimportOpenAI api_key你的_DeepSeek_API_Key# 在 DeepSeek 开放平台创建的 API Keybase_urlhttps://api.deepseek.com# DeepSeek 官方 API 地址model_iddeepseek-v4-flash# 要调用的 DeepSeek 模型clientOpenAI(api_keyapi_key,base_urlbase_url)responseclient.chat.completions.create(modelmodel_id,messages[{role:user,content:请用一句话解释什么是大语言模型。}])print(response.choices[0].message.content)官方文档地址https://api-docs.deepseek.com/DeepSeek API Key 获取https://platform.deepseek.com/api_keys五、阿里 Qwen API 调用5.1 接口与模型说明Qwen 是阿里通义千问系列模型可以通过 阿里云百炼 调用 API。百炼目前支持多种接口形式包括 OpenAI 兼容接口、Anthropic 兼容接口和 DashScope 原生接口。为了让调用方式更简单本文使用 OpenAI 兼容接口。本文使用qwen3.8-max 作为示例模型。qwen3.8-max 是当前千问 Max 系列模型之一支持 OpenAI 兼容接口。5.2 Qwen API 调用示例打开PowerShell 或PyCharm 底部的 Terminal执行以下代码安装 OpenAI SDKpython-m pip install openai安装完成后运行以下代码完成最小验证fromopenaiimportOpenAI api_key你的_阿里云百炼_API_Key# 在阿里云百炼控制台创建的 API Keybase_urlhttps://dashscope.aliyuncs.com/compatible-mode/v1# 中国大陆北京OpenAI 兼容接口地址model_idqwen3.8-max# 要调用的 Qwen 模型clientOpenAI(api_keyapi_key,base_urlbase_url)responseclient.chat.completions.create(modelmodel_id,messages[{role:user,content:请用一句话解释什么是大语言模型。}])print(response.choices[0].message.content)官方文档地址https://help.aliyun.com/zh/model-studio/qwen-api-reference/Qwen API Key 获取https://www.alibabacloud.com/help/en/model-studio/get-api-key六、xAI Grok API 调用6.1 接口与模型说明Grok 是 xAI 推出的大模型系列。xAI 当前推荐通过 Responses API 调用文本模型并兼容 OpenAI Python SDK。本文使用grok-4.5作为示例模型。grok-4.5 是当前 xAI 的主力模型适合代码、Agent、推理和知识类任务。Grok 4.5 支持推理强度设置low / medium / high默认是 high而且推理不能关闭。零基础测试时不设置也可以直接调用。除了文本生成xAI 还提供 Grok Imagine 图片生成 API当前可使用grok-imagine-image-quality生成图片。6.2 文本与图片生成示例打开PowerShell 或PyCharm 底部的 Terminal执行以下代码安装 OpenAI SDKpython-m pip install openai文本代码示例fromopenaiimportOpenAI api_key你的_xAI_API_Key# 在 xAI Console 创建的 API Keybase_urlhttps://api.x.ai/v1# xAI 官方 API 地址model_idgrok-4.5# 要调用的 Grok 模型clientOpenAI(api_keyapi_key,base_urlbase_url)responseclient.responses.create(modelmodel_id,reasoning{effort:medium},# 推理强度low / medium / high默认 highinput请用一句话解释什么是大语言模型。)print(response.output_text)图片代码示例fromopenaiimportOpenAI api_key你的_xAI_API_Key# 在 xAI Console 创建的 API Keybase_urlhttps://api.x.ai/v1# xAI 官方 API 地址model_idgrok-imagine-image-quality# Grok Imagine 图片生成模型clientOpenAI(api_keyapi_key,base_urlbase_url)responseclient.images.generate(modelmodel_id,prompt一座未来城市的夜景电影感高细节)print(response.data[0].url)官方文档地址https://docs.x.ai/developers/quickstartxAI Grok API Key 获取https://console.x.ai/team/default/api-keys七、六大模型 API 接口与 SDK 对比前面分别介绍了 6 个平台的调用方式。放在一起看可以发现它们的官方接口不同但越来越多平台开始兼容 OpenAI 的接口格式。7.1 调用方式与 SDK 对比平台主要接口Python 常用 SDKOpenAI 兼容OpenAI GPTResponses APIopenai原生Google GeminiInteractions APIgoogle-genai支持Anthropic ClaudeMessages APIanthropic支持DeepSeekChat Completions / Responsesopenai支持阿里 QwenChat Completions / Responsesopenai/ DashScope支持xAI GrokResponses APIopenai/ xAI SDK支持从表中可以看出6 个平台的调用方式虽然不同但整体已经出现一定的兼容趋势。OpenAI、DeepSeek、Qwen 和 Grok 都可以使用 openai SDKGemini 和 Claude 则主要使用各自的官方 SDK。如果只使用一个模型直接按照对应平台的官方方式接入是最简单的选择。但实际业务中不同任务对模型的要求并不一样。日常问答更关注速度和成本复杂任务更看重推理能力代码、长文本和多模态任务也可能各有更合适的模型如果还要考虑限流或服务异常通常还需要准备备用模型。随着业务复杂度提升一个项目可能会同时接入多个模型。此时不仅要维护各平台的 API Key、Base URL 和 Model ID还要处理不同 SDK、参数和返回格式带来的适配成本。虽然 OpenAI-compatible 接口能减少部分重复工作但不同模型的能力和参数仍无法完全统一。对于小型测试或简单应用分别调用官方 API 已经足够当模型数量增加、需要频繁切换或者同一业务需要根据任务选择不同模型时统一管理接口会更合适。八、多模型接入解决方案8.1 多模型接入的常见方案方式适合场景特点直接调用官方 API单模型、简单应用最直接原生能力完整自建模型网关有研发能力的团队可控性高但需要自行维护使用统一接入服务多模型、Agent、开发工具接入简单减少重复配置这三种方式各有适用场景。模型较少时直接调用官方 API 最简单需要自定义路由、权限或监控时可以自建模型网关如果主要需求是快速接入多个模型、减少重复配置也可以使用现成的统一接入服务。8.2 统一接口示例统一接入的调用方式与前面的单模型 API 基本一致。这里以 10086 AI 平台为例调用前需要准备三个参数Base URL、API Key 和 Model ID。Base URL 是 API 请求的基础地址用来告诉代码或工具请求应该发送到哪里。常用地址为https://10086ai.hk/v1部分工具对地址格式要求不同也可能需要填写https://10086ai.hk/或完整接口地址https://10086ai.hk/v1/chat/completionsBase URL 打到服务器后需要API KEY才能访问大模型在10086 AI 官网进入控制台「API密钥」→「创建API密钥」 中生成 Key。一个 API Key 可以调用对应分组内的模型后续可在控制台调整分组。进入平台右上角的 「模型广场」找到 API Key 对应的模型分组复制需要调用的模型名称。准备好三个参数后即可使用下面的代码测试接口fromopenaiimportOpenAI api_key你的_10086_AI_API_Key# 在 10086 AI 平台获取的 API Keybase_urlhttps://10086ai.hk/v1# 10086 AI 统一 API 地址model_id你要调用的模型_ID# 从平台模型列表中选择对应的 Model IDclientOpenAI(api_keyapi_key,base_urlbase_url)responseclient.responses.create(modelmodel_id,input请用一句话解释什么是大语言模型。)print(response.output_text)接入成功后api_key 和 base_url 通常可以保持不变切换模型时主要修改 model_id。具体支持的模型和接口能力以平台实际列表为准。10086AI官方文档地址https://10086ai.hk/docs/#/quickstart九、大模型 API 常见报错与排查9.1 常见 HTTP 报错码大模型 API 调用失败时先看返回的 HTTP 状态码和错误信息通常就能快速定位问题。状态码常见原因优先检查400请求格式或参数错误请求体、参数名称、接口格式401API Key 无效或认证失败API Key 是否正确、是否失效403没有访问权限账号权限、地区或模型权限404接口或资源不存在Base URL、接口路径、Model ID429请求过快或额度受限调用频率、余额、账户限额5xx服务端异常稍后重试、查看服务状态9.2 API 调用排查顺序调用失败时可以按下面的顺序排查API Key → Base URL → Model ID → 请求参数 → 账户额度 / 调用频率 → 网络与服务状态一般来说401 优先检查 API Key404 检查 Base URL 和 Model ID429 检查调用频率和账户额度。如果是参数、认证或模型名称错误应先修正配置如果是临时限流、超时或 5xx 服务异常可以等待后重试。正式应用还可以设置有限次数重试并在必要时切换备用模型。十、总结本文整理了 2026 年 6 个主流大模型的 API 调用方式并介绍了多模型接入和常见报错排查。如果只使用单一模型直接调用官方 API 通常最简单如果需要同时接入多个模型也可以根据团队能力选择自建网关或 10086 AI 这类统一接入服务减少重复配置和接口适配。后续还会继续更新更多主流大模型的 API 调用与实战内容。