# OmniAPI 文档 > OmniAPI 企业级大模型 API 聚合网关帮助文档:一个 API Key 接入 GPT、Claude、Gemini 及图像/视频生成等 200+ 模型,完全兼容 OpenAI 协议。 ## 产品基础 / Basics - [更新日志](https://docs.hlzai.com.cn/changelog/): 本页是 OmniAPI 2026年8月更新日志,涵盖新域名与文档站上线、claude-max通道开放以及视频和图像生成接口的升级。 - [三步完成接入](https://docs.hlzai.com.cn/getting-started/): 介绍如何通过注册、创建密钥和替换Base URL三步快速接入兼容OpenAI的OmniAPI,并提供多语言调用示例。 - [基本介绍](https://docs.hlzai.com.cn/): 本页介绍兼容OpenAI协议的大模型网关OmniAPI,涵盖其支持的200多个对话与多媒体模型、核心接口及第三方工具接入指南。 - [平台动态](https://docs.hlzai.com.cn/news/): 本页汇总OmniAPI的最新模型与功能动态,包含claude-max通道上线、视频生成异步接口开放及图像模型更新等关键信息。 - [价格说明](https://docs.hlzai.com.cn/pricing/): 该页面介绍OmniAPI的预充值计费规则,包括按量与按次计费方式、预扣与返还流程,以及API令牌额度管理。 ## API - [认证与密钥](https://docs.hlzai.com.cn/api/authentication/): 本文介绍 API 的 Bearer Token 认证机制、令牌配置与安全建议,并提供 401、403 等常见认证错误的排查指南。 - [余额查询 API](https://docs.hlzai.com.cn/api/balance-query/): 本文介绍 OmniAPI 兼容 OpenAI 的余额与已用量查询接口,包含 API 请求示例、美分单位换算及剩余额度计算方法。 - [Chat Completions](https://docs.hlzai.com.cn/api/chat-completions/): 本页介绍与OpenAI兼容的对话补全接口,包含请求参数、多模态支持及响应示例,可用于统一调用和切换各类大模型。 - [错误码与重试](https://docs.hlzai.com.cn/api/errors/): 本文汇总了API常见错误码(如400、429、5xx)的成因与解决方法,并给出了针对限流和服务器波动的指数退避重试建议。 - [日志查询 API](https://docs.hlzai.com.cn/api/log-query/): 本文介绍 OmniAPI 令牌级和账号级日志查询接口的使用方法、返回参数及调用建议,适用于业务对账与用量审计。 - [多轮对话](https://docs.hlzai.com.cn/api/multi-turn/): 本文讲解了通过携带完整历史实现多轮对话的原理,并介绍了滑动窗口、摘要压缩等上下文管理策略及开发注意事项。 - [流式输出](https://docs.hlzai.com.cn/api/streaming/): 本页介绍如何通过设置stream参数实现SSE流式输出,包含API请求示例、Python SDK用法及关闭代理缓冲等注意事项。 - [令牌管理 API](https://docs.hlzai.com.cn/api/token-management/): 该文档介绍如何通过系统访问令牌程序化管理OmniAPI令牌,包含增删改查接口定义、创建示例及典型应用场景。 ## Capabilities - [Abra 视频生成](https://docs.hlzai.com.cn/capabilities/abra/): 本页介绍Abra视频生成服务,涵盖8s和10s的文生与图生视频型号、统一异步API调用示例及参考图使用要点。 - [Claude 原生格式](https://docs.hlzai.com.cn/capabilities/claude-native/): 本页介绍 OmniAPI 支持 Anthropic 原生 Messages 协议,提供 API 和 SDK 示例,便于 Anthropic SDK 应用零改动迁移与统一计费。 - [Claude 缓存计费](https://docs.hlzai.com.cn/capabilities/claude-prompt-caching/): 介绍 Claude 显式提示词缓存的配置方法与计费机制,说明如何通过 cache_control 标记长文本以降低高频调用成本。 - [流式与非流式响应](https://docs.hlzai.com.cn/capabilities/claude-response-handling/): 本页介绍Claude原生API的非流式与流式响应处理,涵盖JSON结构、SSE事件流解析及Token统计,指导开发者正确解析模型输出。 - [思考模式(Thinking)](https://docs.hlzai.com.cn/capabilities/claude-thinking/): 本文介绍 Claude 思考模式的启用方式、输出结构及选型建议,指导用户如何通过配置思考预算来提升复杂任务的推理准确率。 - [废弃模型列表](https://docs.hlzai.com.cn/capabilities/deprecated-models/): 本页提供OmniAPI已废弃或计划下线的模型清单、下线过渡策略及迁移建议,目前暂无已下线的模型。 - [文本嵌入](https://docs.hlzai.com.cn/capabilities/embeddings/): 该页面介绍 OmniAPI 文本嵌入接口的调用方法与返回格式,并提供 RAG 知识库构建、文本分块及批量处理等实践建议。 - [免费模型](https://docs.hlzai.com.cn/capabilities/free-models/): 本页介绍 OmniAPI 提供的免费开源模型列表及调用方法,说明其适用于测试验证但有严格限流且不承诺稳定性。 - [FC 函数调用](https://docs.hlzai.com.cn/capabilities/function-calling/): 本文介绍OmniAPI跨模型支持的函数调用标准流程、Python代码示例及参数校验等注意事项。 - [Gemini 原生格式](https://docs.hlzai.com.cn/capabilities/gemini-native/): 本文介绍 OmniAPI 兼容 Gemini 原生协议的接口用法与示例,并对比了其与 OpenAI 兼容接口的选择建议。 - [联网搜索(Google Search)](https://docs.hlzai.com.cn/capabilities/gemini-web-search/): 本文介绍如何通过模型名后缀启用Gemini内置Google搜索的联网型号,并提供API调用示例与使用注意事项。 - [文生图 API 参考](https://docs.hlzai.com.cn/capabilities/gpt-image-t2i/): 该文档是 GPT-Image 文生图 API 参考,介绍接口地址、请求参数(模型与提示词)、响应格式、Python 示例及计费。 - [对话与推理](https://docs.hlzai.com.cn/capabilities/grok-chat/): 本文档介绍Grok系列模型的对话与推理场景用法,提供API调用示例、推理配置建议及与Claude等模型的选型对比指南。 - [Grok 概览](https://docs.hlzai.com.cn/capabilities/grok-overview/): 本页介绍在 OmniAPI 上通过兼容 OpenAI 接口接入 xAI Grok 模型的方法,并概述其实时搜索、推理及标准功能支持。 - [联网搜索与 X 搜索](https://docs.hlzai.com.cn/capabilities/grok-web-search/): 本文介绍如何调用Grok的联网与X(Twitter)实时搜索API,适用于社媒舆情监测和热点追踪,并给出使用建议与注意事项。 - [图片调用须知(最佳实践)](https://docs.hlzai.com.cn/capabilities/image-best-practices/): 本页介绍图像生成API调用的最佳实践,涵盖120秒以上超时设置、通过模型名指定画幅、立即转存图片及成本控制建议。 - [连接中断排查](https://docs.hlzai.com.cn/capabilities/image-connection-drops/): 该文档指导如何排查图像生成等长请求的连接中断问题,指出主因是客户端或代理超时,并提供调整超时设置与安全重试的方案。 - [图片编辑 API](https://docs.hlzai.com.cn/capabilities/image-edit/): 介绍基于GPT-Image和Gemini的图片编辑API,支持按提示词修改原图,包含接口格式、代码示例及多图输入等使用要点。 - [图像生成(GPT-Image)](https://docs.hlzai.com.cn/capabilities/image-generation/): 介绍GPT-Image的文生图与图生图API接口及参数,并提供2K/4K高分辨率变体模型的使用建议。 - [如何生成满意图片](https://docs.hlzai.com.cn/capabilities/image-prompt-tips/): 本页提供AI生图指南,介绍四段式提示词写法、图片迭代流程、主流模型侧重及常见画质与一致性问题的解决方法。 - [图片压缩与输出分辨率](https://docs.hlzai.com.cn/capabilities/image-resolution/): 本文介绍OmniAPI图像分辨率的选择规则(通过模型后缀区分)、适用场景推荐,以及生成图片的压缩、转存与模糊等常见问题处理。 - [图像与视频生成模型](https://docs.hlzai.com.cn/capabilities/image-video-models/): 本页汇总OmniAPI的图像与视频生成模型系列,并阐述了通过型号后缀指定画幅、分辨率、时长及生成方式的命名规则。 - [Claude 系列](https://docs.hlzai.com.cn/capabilities/models-claude/): 介绍Claude系列在售模型、OpenAI兼容与原生调用方式及场景选型建议,帮助用户根据写作、编程等需求选择合适型号。 - [Gemini 系列](https://docs.hlzai.com.cn/capabilities/models-gemini/): 本文介绍谷歌Gemini系列多模态模型的在售型号、选型建议与调用方式,指导用户根据速度、成本和任务复杂度选择合适的模型。 - [GPT 系列](https://docs.hlzai.com.cn/capabilities/models-gpt/): 本页介绍OpenAI GPT系列在售型号(旗舰、轻量、代码档)的定位、选型建议及调用示例,便于用户根据场景选择合适模型。 - [模型总览](https://docs.hlzai.com.cn/capabilities/models/): 本文介绍OmniAPI聚合的GPT、Claude等200多个模型,提供统一的OpenAI兼容接口、选型建议及模型列表获取方法。 - [文生图/编辑 API 参考](https://docs.hlzai.com.cn/capabilities/nano-banana-reference/): 本文提供 Nano Banana 系列图像模型的文生图与编辑 API 参考,涵盖接口调用方法、画幅与一致性设置及模型档位说明。 - [Nano Banana 图像](https://docs.hlzai.com.cn/capabilities/nano-banana/): 本页介绍 OmniAPI 中 Nano Banana 图像模型的文生图与图生图接口调用方法及提示词建议,适用于人像与商品图生成。 - [Omni Flash 视频生成](https://docs.hlzai.com.cn/capabilities/omni-flash/): 本文介绍主打快速与性价比的 Omni Flash 视频生成模型,包含其命名规范、API 异步调用示例及与 VEO 模型的选型建议。 - [兼容模式调用(SDK 接入)](https://docs.hlzai.com.cn/capabilities/openai-compatible/): 介绍如何通过配置Base URL和API Key,使用OpenAI SDK或环境变量直接调用OmniAPI支持的Claude、Gemini等各类模型。 - [原生调用(Responses API)](https://docs.hlzai.com.cn/capabilities/openai-native/): 本文介绍 OmniAPI 对 OpenAI 原生 Responses 接口的支持,包含调用示例、与 Chat Completions 的对比及适用场景建议。 - [推理模型输出](https://docs.hlzai.com.cn/capabilities/openai-reasoning/): 介绍OmniAPI通过模型后缀选择推理档位的方法,以及推理过程输出解析和不同场景下的选型建议。 - [响应数据处理](https://docs.hlzai.com.cn/capabilities/openai-responses/): 本页介绍OmniAPI响应数据的解析方法,涵盖非流式结构、finish_reason处理、Token用量统计及推理与错误处理建议。 - [缓存计费](https://docs.hlzai.com.cn/capabilities/prompt-caching/): 本文介绍大模型提示词缓存的计费机制与优化实践,说明如何通过前置固定内容命中缓存、确认命中状态并降低长会话调用成本。 - [文本生成(对话补全)](https://docs.hlzai.com.cn/capabilities/text-generation/): 介绍通过统一的Chat Completions接口调用GPT、Claude、Gemini等模型进行文本生成的方法、支持的通用能力及模型选型指南。 - [VEO 3.1 视频生成](https://docs.hlzai.com.cn/capabilities/veo-3-1/): 介绍OmniAPI中VEO 3.1视频生成模型的型号命名规则、异步调用示例及选型建议,支持文生、图生和参考生视频。 - [视频生成(异步)](https://docs.hlzai.com.cn/capabilities/video-generation/): 本文介绍OmniAPI异步视频生成接口,涵盖提交任务、轮询查询状态以获取视频下载链接的具体步骤、参数说明及轮询建议。 - [视频理解 API](https://docs.hlzai.com.cn/capabilities/video-understanding/): 本文介绍如何使用 Gemini 原生 API 进行视频理解,涵盖 base64 调用方式、时间轴问答等场景及 Token 消耗等注意事项。 - [视觉理解](https://docs.hlzai.com.cn/capabilities/vision/): 介绍如何通过API向视觉模型发送图片进行多模态理解,包括URL与base64传参方式、应用场景及分辨率计费等注意事项。 ## Scenarios - [内容批量生产](https://docs.hlzai.com.cn/scenarios/batch-content/): 本文介绍如何使用单一API结合多模态模型批量生产短视频与社媒内容,包含推荐模型、工作流及异步视频生成等落地要点。 - [代码辅助开发](https://docs.hlzai.com.cn/scenarios/code-assisted-dev/): 本页介绍如何通过OmniAPI统一接入多模型进行代码开发,包含不同场景的模型推荐、主流工具接入指南及落地实践建议。 - [电商视觉营销](https://docs.hlzai.com.cn/scenarios/ecommerce-visual/): 本文介绍如何利用GPT和Gemini等AI模型生成电商场景图、试穿图及营销海报,并提供推荐模型与API落地要点。 - [金融研报生成](https://docs.hlzai.com.cn/scenarios/financial-research/): 本文介绍利用大模型分析财报生成金融研报的流程,包括文档解析与结构化输出步骤、推荐模型及长文档处理等落地要点。 - [教育个性化辅导](https://docs.hlzai.com.cn/scenarios/personalized-education/): 本文介绍如何根据问题难度动态选择不同档位模型进行分层教学,并阐述了流式输出、启发式提示词及额度管理等落地要点。 - [智能客服升级](https://docs.hlzai.com.cn/scenarios/smart-customer-service/): 介绍如何利用OmniAPI实现智能客服分层路由,根据问题复杂度自动切换模型以平衡成本与体验,并提供具体落地建议。 ## Tools - [Chatbox](https://docs.hlzai.com.cn/tools/chatbox/): 本文介绍跨平台AI客户端Chatbox的自定义API配置步骤与参数填写指南,并提供多端使用及流式输出排障建议。 - [Cherry Studio](https://docs.hlzai.com.cn/tools/cherry-studio/): 本文介绍如何在Cherry Studio桌面客户端中配置OpenAI兼容服务商(以hlzai.com.cn为例)、管理模型及排查常见错误。 - [Claude Code](https://docs.hlzai.com.cn/tools/claude-code/): 本页介绍如何通过配置环境变量在 Claude Code 中使用 OmniAPI,并包含模型切换方法与常见问题排查指南。 - [Cline(VS Code)](https://docs.hlzai.com.cn/tools/cline/): 本文指导如何在VS Code中配置Cline智能体,提供OpenAI兼容与Anthropic协议的接入步骤、接口地址及模型选择建议。 - [Cursor](https://docs.hlzai.com.cn/tools/cursor/): 介绍如何在 Cursor 中配置自定义 OpenAI API 端点以切换至 OmniAPI 的具体步骤、模型添加方法及相关注意事项。 - [Dify](https://docs.hlzai.com.cn/tools/dify/): 本文介绍在Dify中通过OpenAI兼容接口配置OmniAPI的步骤,包括模型添加、API端点设置及工作流优化建议。 - [沉浸式翻译](https://docs.hlzai.com.cn/tools/immersive-translate/): 本文介绍如何在沉浸式翻译中配置自定义OpenAI兼容接口,并提供选择低成本模型、限制请求频率以防429等优化建议。 - [LangChain](https://docs.hlzai.com.cn/tools/langchain/): 本文介绍如何在 Python 和 JS/TS 的 LangChain 中通过配置自定义 base_url 对接 OmniAPI,实现 OpenAI 兼容模型的调用。 - [Open WebUI](https://docs.hlzai.com.cn/tools/open-webui/): 本文介绍 Open WebUI 对接 OpenAI 兼容后端的配置步骤,涵盖管理面板设置、Docker 环境变量注入及模型拉取故障排查。 ## FAQ - [计费与额度](https://docs.hlzai.com.cn/faq/billing/): 本文概述按量计费规则、令牌额度与分组管理、用量查询及常见疑问,核心要点为无月租、按实际Token和多媒体规格结算。 - [限流与 429](https://docs.hlzai.com.cn/faq/rate-limits/): 该文档阐述了429限流的三种原因,并提供了带随机抖动的退避重试算法及降低触发概率的优化建议。 - [数据安全](https://docs.hlzai.com.cn/faq/security/): 本页介绍平台数据处理安全原则(不留存训练)、密钥治理与脱敏等安全实践建议,以及不同模型厂商的合规提示。 - [服务可用性](https://docs.hlzai.com.cn/faq/sla/): 本页介绍服务的高可用架构、故障表现及客户端超时与重试的推荐配置,旨在帮助用户优化调用稳定性并处理异常。 ## News - [去年归国的徐梦迪,出](https://docs.hlzai.com.cn/news/2026-08-29-去年归国的徐梦迪-出/): 本文阐述徐梦迪关于通用机器人的核心观点,强调面对无限的真实世界任务,机器人需具备在新场景下快速自适应的能力。 - [人人皆可编程!阿里推出 AI](https://docs.hlzai.com.cn/news/2026-08-29-人人皆可编程-阿里推出-ai/): 阿里推出AI编程助手Qoder的全新桌面端,支持语音交互与自主浏览器验证,旨在降低编程门槛并提升数字化执行力。 - [Tone: A bit sensationalist ("跑](https://docs.hlzai.com.cn/news/2026-08-29-tone-a-bit-sensationalist-跑/): 本文介绍Anthropic关于Claude自主进行AI安全研究与自我训练的最新成果,展示其低成本且超越人类专家的表现。 - []`. Let''s](https://docs.hlzai.com.cn/news/2026-08-29-lets/): 介绍腾讯混元4代码模型在WebDev和SWE-bench Pro评测中的领先表现及其多智能体协同能力。 - [AI](https://docs.hlzai.com.cn/news/2026-08-29-ai/): 本文阐述了即使硬件和权重相同,推理软件栈的微小差异也会改变大模型输出Token并导致工具调用失败的现象与原因。 - [20ms将PDF转为Markdown](https://docs.hlzai.com.cn/news/2026-08-29-20ms将pdf转为markdown/): 本文介绍开源OCR工具OCR It,它支持离线运行,能以极速将PDF转换为Markdown格式,并详细说明了其浏览器插件的操作方法。 - [高德发布首个无长程依赖的万帧级流式3D重建模型ABot-Recon,以12帧重建万帧3D场景](https://docs.hlzai.com.cn/news/2026-08-28-高德发布首个无长程依赖的万帧级流式3d重建模型abot-recon-以12帧重建万帧3d场景/): 介绍高德开源的流式3D重建模型ABot-Recon,其仅凭12帧局部画面即可实时重建万帧场景,并附有技术报告与开源代码链接。 - [自媒体“](https://docs.hlzai.com.cn/news/2026-08-28-自媒体/): 本文通过自媒体素材整理和金融报告生成案例,展示了百度搭子如何利用自动化流程显著提升内容创作与数据分析的效率。 - [智谱 GLM-5.3-Flash上线,商汤大装置提供国产算力支持](https://docs.hlzai.com.cn/news/2026-08-28-智谱-glm-5-3-flash上线-商汤大装置提供国产算力支持/): 本文介绍智谱开源多模态模型GLM-5.3-Flash的发布,以及商汤大装置利用国产算力为其提供大规模支持的合作成果。 - [全球首款专为iPhone打造](https://docs.hlzai.com.cn/news/2026-08-28-全球首款专为iphone打造/): 介绍网易有道发布的首款专为iPhone打造的OpenPods AI耳机,具备苹果MFi认证及录音、翻译、问答等AI功能。 - [Claude](https://docs.hlzai.com.cn/news/2026-08-28-claude/): 介绍Anthropic发布的模型硬件标准(MHS),该标准统一了物理设备接口,使Claude等智能体能直接控制和交互各种硬件。 - ["](https://docs.hlzai.com.cn/news/2026-08-28-c03b509bb377bca6/): 介绍AI智能体如何利用漏洞传闻在数分钟内定位并尝试攻击安全缺陷,指出这正对传统开源安全披露流程带来严峻挑战。 - [[AINews] OpenAI 将于](https://docs.hlzai.com.cn/news/2026-08-28-ainews-openai-将于/): 本文探讨OpenAI的AGI实现时间表,重点介绍其计划在2026年9月前通过Astra模型实现自动化AI研究员的进展。 - [更好的解答,更开阔的](https://docs.hlzai.com.cn/news/2026-08-27-更好的解答-更开阔的/): 该页面介绍了一项针对千余名大学生的随机研究,评估了ChatGPT对学生真实作业表现、批判性思维和原创性的具体影响。 - [千问办公首发上线 Qwen](https://docs.hlzai.com.cn/news/2026-08-27-千问办公首发上线-qwen/): 介绍千问办公上线Qwen3.8-Flash及标准模式,通过协同优化实现生成速度翻倍并降低75%的Token消耗。 - [Wait](https://docs.hlzai.com.cn/news/2026-08-27-wait/): 本文报道了 Claude Code 自动模式被提示词注入攻破的安全漏洞,强调运行编程智能体时必须使用沙箱和限制网络访问。 - [Option 1 (Direct &](https://docs.hlzai.com.cn/news/2026-08-27-option-1-direct/): 本文介绍基元律动完成新一轮融资并公测多模型API平台,重点展示其通过智能路由基础设施优化AI Agent调用成本与效率。 - [Google 搜索推出 3](https://docs.hlzai.com.cn/news/2026-08-27-google-搜索推出-3/): 介绍Google搜索AI模式在旅行规划方面的升级,包括追踪机票价格、查询积分里程兑换以及直接预订酒店等新功能。 - [Gemini Omni 1](https://docs.hlzai.com.cn/news/2026-08-27-gemini-omni-1/): 介绍 Gemini Omni 1.1 Flash 的发布,其支持场景延伸、首尾帧插值和 4K 超分等工作室级视频生成与创意控制功能。 - [[AINews] Hot Chips 大](https://docs.hlzai.com.cn/news/2026-08-27-ainews-hot-chips-大/): 本文介绍OpenAI在Hot Chips发布的自研推理芯片Jalapeño,该芯片在每瓦性能和延迟上取得突破,可替代Blackwell。 - ["[AIN](https://docs.hlzai.com.cn/news/2026-08-27-ain/): 本文报道了AI领域的最新动态,重点关注通义千问在国产芯片上推出Flash模型以及Hot Chips大会后西方开源AI的发展趋势。 - [神秘](https://docs.hlzai.com.cn/news/2026-08-26-神秘/): 本文展示了GLM-5.3 Flash出色的多模态理解能力,其能通过捕捉画面中转瞬即逝的名牌细节来精准关联声音、姓名与人物。 - [深度实测「豆包工作」+飞书:目前最接近企业Agent终局的答案](https://docs.hlzai.com.cn/news/2026-08-26-深度实测-豆包工作-飞书-目前最接近企业agent终局的答案/): 本文深度实测豆包工作与飞书的集成,展示其通过读取群聊和云文档高效梳理信息的企业级Agent能力与实际应用效果。 - [🔬“我们有语言基础](https://docs.hlzai.com.cn/news/2026-08-26-我们有语言基础/): 本文介绍AI天气模型FourCastNet的开发背景,探讨物理系统建模中数据与算力的挑战,并阐述神经算子在物理模拟中的应用。 - [引用保罗·迪克斯(Paul](https://docs.hlzai.com.cn/news/2026-08-26-引用保罗-迪克斯-paul/): 页面引用保罗·迪克斯关于AI编程的观点,指出在验证系统和正确引导下,AI能够构建并持续优化高度复杂的可靠软件。 - [小宇宙发布《AI趋势报告](https://docs.hlzai.com.cn/news/2026-08-26-小宇宙发布-ai趋势报告/): 本文概述小宇宙《2026 AI趋势报告》,指出播客平台AI内容爆发式增长,并总结了AI协作、创作及人类价值重估等核心趋势。 - [宇树与智元共用“](https://docs.hlzai.com.cn/news/2026-08-26-宇树与智元共用/): 本文通过宇树与智元等具身智能公司的无剪辑真实演示视频,展示了机器人在无人工干预下的实际技术表现与行业现状。 - [学无](https://docs.hlzai.com.cn/news/2026-08-26-学无/): 本文介绍OpenAI关于教育领域的最新报告,阐述学生和教师如何利用ChatGPT实现连贯学习并延伸课外支持。 - [使用 Gemini 3.5](https://docs.hlzai.com.cn/news/2026-08-26-使用-gemini-3-5/): 本页介绍macOS端Gemini 3.5的语音转录与智能工作流控制功能,以及即将推出的Chrome网页语音输入支持。