零一万物开放平台开发者文档:把 Yi 大模型塞进你代码的「一站式说明书」
如果你只想把一块能写会算、懂中文也懂代码的大模型接进自己的应用,最省事的入口不是再训练一个模型,而是读明白零一万物开放平台的开发者文档。这份文档把模型能力、鉴权方式、SDK 调用、视觉理解和视频混剪全部摊开成可复制的代码片段——它解决的不是「模型有多强」,而是「我到底怎么三行代码就调起来」。
一句话认识它:零一万物开放平台开发者文档与 SDK,是 01.AI(北京零一万物科技有限公司,由李开复博士于 2023 年 5 月创立)[6]面向开发者发布的大模型 API 接入指引与客户端工具集合;其 API 与 OpenAI 接口完全兼容,只需把请求地址改为 https://api.lingyiwanwu.com/v1 即可平移迁移[2],当前主推的 Yi-Lightning 以 ¥0.99 / 百万 token 的合并计费定价提供高性价比推理服务[1]。
模块网格:开发文档不是一本手册,是六个能直接跑的模块
零一万物的文档没有把内容揉成一团,而是按「你能做什么」切成六块独立模块。每块都能单独读、单独抄、单独跑通,下面是每块到底给你什么。
模块一:API 接入与鉴权
核心端点 /v1/chat/completions,请求头带 Authorization: Bearer $API_KEY,正文传 model 与 messages。支持 temperature、top_p、max_tokens、stream 等标准参数,控制台可创建与查看 API Key[2]。
模块二:OpenAI 兼容层
只需把 OpenAI 官方 SDK 的 base_url 指向 https://api.lingyiwanwu.com/v1,其余调用代码几乎不用改;要求 Python ≥ 3.7.1、openai SDK ≥ 1.0.0,迁移成本极低[1]。
模块三:模型矩阵与智能路由
Yi-Lightning 会按输入智能路由到 DeepSeek-V3、Qwen3-30B-A3B 或 Yi-Lightning 自身,提供统一 ¥0.99/1M token 的合并计费;Yi-Vision-v2 负责视觉理解,路由到 Qwen2.5-VL-72B 或 Yi-Vision-V2,定价 ¥6/1M token[1]。
模块四:视觉理解 API
单张或多张图片输入,覆盖图片问答、图表理解、OCR、视觉推理、教育、研究报告与多语种文档阅读;单次最多 8 张图,单图约消耗 500~700 token,支持 JPEG/PNG 及 Base64[2]。
模块五:混剪视频 API
/v1/mix_cut_video 提供视频上传、脚本生成、一键混剪全流程;约束为竖屏 9:16、时长 120 秒内、单次 3~5 个视频,适合短视频批量生产场景[3]。
模块六:生态集成
文档给出 LangChain(ChatOpenAI 配 openai_api_base)与 LlamaIndex(OpenAILike)的直接示例,无需自写适配层即可把 Yi 模型塞进主流 Agent 框架[1]。
工作流步骤:从注册到上线,五步走完第一次调用
把上面六个模块串成一条可执行的接入路径,一个典型的「今天接、今天用」流程如下。你可以只取其中几步,不必全用。
- 注册与实名:在零一万物大模型开放平台注册账号并完成用户信息认证,这是创建 API Key 与前置调用的硬性前提。
- 创建 API Key:进入「API Key 管理」页面生成密钥,妥善保存到环境变量,切勿写死在代码或前端暴露,避免被他人盗刷。
- 装 SDK 配 base_url:
pip install openai后,把OpenAI(api_key=..., base_url="https://api.lingyiwanwu.com/v1")写好,一行切换即完成兼容层接入。 - 发起首个请求:用
model="yi-lightning"发一条同步或流式chat.completions.create,确认返回usage字段能拿到 token 用量,证明链路通了。 - 上生产或接框架:需要 Agent 能力时把 base_url 喂给 LangChain / LlamaIndex;需要视觉或多模态时切到
yi-vision-v2并传图;需要批量视频时走混剪 API。
场景对照表:不同需求,翻哪页文档
文档再全,也得先知道自己该看哪块。下面把常见诉求映射到具体模块、推荐模型与关键注意点,方便你直接对号入座。
| 业务场景 | 该翻的模块 | 推荐模型 | 关键参数 / 注意 |
|---|---|---|---|
| 中文客服 / 对话机器人 | 模块一 + 模块二 | Yi-Lightning | 合并计费 ¥0.99/1M token,Free 档限 10 RPM / 8 万 TPM |
| 图表、截图、文档 OCR 理解 | 模块四 视觉理解 | Yi-Vision-v2 | 单图 500~700 token,单次最多 8 张,2K 内、≤10MB |
| 短视频批量混剪 | 模块五 混剪 API | 混剪专用端点 | 竖屏 9:16、120s 内、3~5 个视频,三步子任务编排 |
| 私有化 / 本地代码补全 | 开源 Yi-Coder / Yi-34B | 本地部署 | 不消耗 API 额度,适合无 GPU 预算外的隐私诉求 |
| 企业知识库 Agent | 模块六 生态集成 | Yi-Lightning | 用 LangChain / LlamaIndex 接 RAG,base_url 一行切换 |
| 成本敏感批量推理 | 模块三 模型矩阵 | Yi-Lightning | 智能路由自动选最便宜底层,输入输出同价、账目简单 |
和竞品开发者文档,到底差在哪
把零一万物文档和 OpenAI、DeepSeek、阿里百炼横向摆开看,差异主要集中在「兼容姿势、路由黑盒、价格结构、独有模块」四件事上。
零一万物文档的显性差异
需要提前认清的取舍
- 黑盒路由不可指定:你不能强制锁定某个底层模型,对「必须 reproducible」的实验类需求不友好。
- 模型数量偏少:公开 API 主推 Yi-Lightning 与 Yi-Vision-v2 两款,不像某些平台几十个 checkpoint 任选。
- 合并计费不透明:输入/输出同价看似省心,但无法分别核算 prompt 与生成成本,大输出场景要心里有数。
与阿里云百炼上的零一万物接入相比,百炼走的是 DashScope SDK(dashscope.Generation.call),而官方平台直接走 OpenAI 兼容端点;前者便于已在阿里云体系内的团队,后者对从 OpenAI 迁移的团队更顺手[5]。价格横向看,Yi-Lightning 的 ¥0.99/1M 在 2026 年国内旗舰模型里属于极低位,低于同档 DeepSeek V4-Pro、智谱 GLM-5.2、Kimi K2 等[8]。
三个最容易踩的坑
把路由当指定模型。Yi-Lightning 是智能路由入口,平台可能返回 DeepSeek-V3、Qwen3 或自研结果,你不能假设「这次一定是 Yi」。需要确定底层模型时,应改用可指定模型的其他端点或本地开源版本。
低估视觉 token 成本。视觉模型单张图约耗 500~700 token,一次塞 8 张图就是数千 token 起步;批量 OCR / 图表解析前先估算用量,避免账单超出预期[2]。
忽视限速与密钥安全。Free 档 yi-lightning 仅 10 RPM / 8 万 TPM,生产流量要先升级 Tier;API Key 必须存环境变量、加服务端代理,切勿嵌前端公开代码,防止被盗刷[1]。
常见问答
零一万物文档和 OpenAI 文档能互相套用吗?
能。平台 API 与 OpenAI 完全兼容,你只需把 SDK 的 base_url 改成 https://api.lingyiwanwu.com/v1,请求体、参数名、响应结构基本一致,原有 OpenAI 调用代码几乎不用改即可迁移。
Yi-Lightning 和 Yi-Vision-v2 分别什么时候用?
纯文本对话、推理、写作、代码用 Yi-Lightning,价格 ¥0.99/1M token;涉及图片问答、图表理解、OCR、视觉推理等任务用 Yi-Vision-v2,定价 ¥6/1M token,单次最多传 8 张图。
智能路由会不会让我调不到真正的 Yi 模型?
有可能。Yi-Lightning 是路由入口,平台会按请求特征在 DeepSeek-V3、Qwen3-30B-A3B、Yi-Lightning 之间自动选最优;你无法锁定底层模型。若必须 reproducible 或指定自研模型,应改用其他可指定端点或本地开源权重。
视觉理解对图片有什么限制?
单次调用最多 8 张图片,支持 JPEG、PNG 与 Base64 格式,分辨率 2K 及以下、单张大小不超过 10MB;每张图约消耗 500~700 token,计费时计入总 token 用量。
能在 LangChain / LlamaIndex 里直接用吗?
可以。文档给出 LangChain(ChatOpenAI(openai_api_base=...))与 LlamaIndex(OpenAILike(api_base=...))的现成示例,把 base_url 与 api_key 填好即可作为普通模型接入 RAG 或 Agent 流程。
混剪视频 API 适合什么业务?
面向短视频批量生产:上传 3~5 个竖屏 9:16、120 秒以内的视频,平台先做内容摘要、再生成混剪脚本、最后产出成片,适合营销号、电商素材、培训切片等需要规模化出片的场景。
价格比 DeepSeek、智谱、Kimi 有优势吗?
在 2026 年国内旗舰档位里,Yi-Lightning 的 ¥0.99/1M token 输入输出同价属于极低区间,明显低于同档 DeepSeek V4-Pro、智谱 GLM-5.2、Kimi K2 等;但模型数量选择较少,需按业务权衡性价比与可控性。
参考资料
- 来源:零一万物开放平台官方文档(平台简介、OpenAI 兼容、模型矩阵、计费与视觉理解):https://platform.lingyiwanwu.com/docs
- 来源:零一万物 API Reference(端点、鉴权、参数、视觉与函数调用详规):https://platform.lingyiwanwu.com/docs/api-reference
- 来源:零一万物混剪视频 API 文档(上传、脚本生成、一键混剪接口):https://platform.lingyiwanwu.com/playground/yi-mixed-docs
- 来源:阿里云帮助中心 — 零一万物大语言模型调用说明(DashScope SDK 接入):https://help.aliyun.com/document_detail/2716247.html
- 来源:阿里云帮助中心 — 零一万物模型快速开始(yi-medium 等接入示例):https://help.aliyun.com/document_detail/2716251.html
- 来源:零一万物官网「关于我们」(公司成立、李开复创立、Yi 系列与万智平台历程):https://www.01.ai/about.html
- 来源:APIRank — 01.AI Yi (零一万物) API 定价与模型评测(¥0.99/1M、智能路由分析):https://apirank.vip/providers/lingyi
- 来源:掘金 — 2026 年 7 月国内大模型价格汇总(Yi-Lightning 性价比横向对比):https://juejin.cn/post/7663860193306804258
青衣网络 AI 观察团队 · 最后更新 2026-08-25 | 本文基于零一万物开放平台官方公开文档与第三方权威资料整理,用于帮助开发者理解文档结构与接入路径;模型、价格、限速与接口细节随时可能调整,实际使用请以官方最新公告与文档为准。