API 调用文档

依稀码统一API接口,兼容OpenAI格式,一行代码接入全部算力服务

快速开始
1. 获取Token

注册登录后,在 API Token 页面创建Token

2. 发起请求
curl https://api.yixima.cn/v1/chat/completions \
  -H "Authorization: Bearer YOUR_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "yxm-qwen-plus",
    "messages": [{"role":"user","content":"你好"}]
  }'
Python 示例
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_TOKEN",
    base_url="https://api.yixima.cn/v1"
)

resp = client.chat.completions.create(
    model="yxm-qwen-plus",
    messages=[{"role":"user","content":"你好"}]
)
print(resp.choices[0].message.content)
接口列表
接口方法路径说明
对话补全POST/v1/chat/completions大语言模型对话
文本向量POST/v1/embeddings文本向量化
图片OCRPOST/v1/ocr/recognize图片文字识别
图像生成POST/v1/images/generationsAI绘画
语音识别POST/v1/audio/transcriptions语音转文字
视频生成POST/v1/video/generationsAI视频生成
模型列表GET/v1/models获取可用模型

可用模型/服务 13

大语言模型 12
qwen3.7-plus
阿里云
输入¥2.00/百万tokens
输出¥8.00/百万tokens

256K+:输入¥6.00 输出¥24.00

中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。 该模型版本功能等同于快照模型qwen3.7-plus-2026-05-26

qwen3.6-flash
阿里云
输入¥3.00/百万tokens
输出¥13.00/百万tokens

256K+:输入¥7.00 输出¥25.00

原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。

vanchin/deepseek-v4-pro
阿里云
输入¥5.00/百万tokens
输出¥13.00/百万tokens

256K+:输入¥9.00 输出¥24.00

DeepSeek-V4系列是强大的混合专家(MoE)语言模型,包含DeepSeek-V4-Pro(1.6T总参数,49B激活参数)。支持高达100万(1M)token的上下文长度,是在超过32T高质量多样化token上预训练的开源模型。

deepseek-v4-pro
阿里云
输入¥13.00/百万tokens
输出¥25.00/百万tokens

256K+:输入¥13.00 输出¥25.00

旗舰级 MoE 大模型,总参1.6T、激活 49B,原生支持百万级超长上下文。依托海量高质量训练数据,具备顶尖数学逻辑、复杂推理、专业代码与长文本深度解析能力,适配高阶科研、复杂办公、深度智能代理等高难度场景。

qwen3-vl-plus
阿里云
输入¥1.60/百万tokens
输出¥16.00/百万tokens

256K+:输入¥4.00 输出¥32.00

Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。 该模型版本功能等同于快照模型qwen3-vl-plus-2025-12-19

deepseek-v4-pro
阿里云
输入¥14.50/百万tokens
输出¥28.50/百万tokens

256K+:输入¥15.50 输出¥29.50

旗舰级 MoE 大模型,总参1.6T、激活 49B,原生支持百万级超长上下文。依托海量高质量训练数据,具备顶尖数学逻辑、复杂推理、专业代码与长文本深度解析能力,适配高阶科研、复杂办公、深度智能代理等高难度场景。

qwen3-asr-flash
阿里云
¥0.00/秒

千问3-ASR-Flash是一款基于大语言模型的高精度、高智能、高鲁棒性的多语种语音识别模型。依托强大的基座模型、海量的文本与多模态数据、千万小时音频数据,千问3-ASR-Flash实现了高精度的语音识别功能,能够自动判断语种并准确识别多个语种的语音,在复杂的音频环境下能够保证精确转录。

fun-asr-flash-2026-06-15
阿里云
¥0.00/秒

百聆2026年6月更新的大模型ASR版本,全面支持汉语传统七大方言体系(官话/吴/湘/赣/客/闽/粤),并适配 20+ 地区口音官话。针对中文古诗词的韵律、节奏与文言表达特点进行专项优化,提升对古诗词内容的识别准确率,适用于文化传承、教育讲解、有声读物等场景。优化标点预测与文本归一化能力,使输出文本更符合书面表达习惯,数字、日期、金额等信息自动转换为标准格式,增强内容的可读性与专业性。同时语种扩展至英语、日语、韩语、越南语、泰语、印尼语、马来语、菲律宾语、印地语、阿拉伯语、法语、德语、西班牙语、葡萄牙语、俄语、意大利语、荷兰语、瑞典语、丹麦语、芬兰语、挪威语、希腊语、波兰语、捷克语、匈牙利语、罗马尼亚、保加利亚语、克罗地亚语、斯洛伐克语等,共计30个语种。支持context上下文能力,可转写5分钟以内的音频。

glm-5.2-fast-preview
阿里云
输入¥16.00/百万tokens
输出¥56.00/百万tokens

256K+:输入¥40.00 输出¥56.00

GLM-5.2-Fast-Preview 是智谱 AI 旗舰模型 GLM-5.2 的高速版本,支持 1M 超长上下文,模型能力对齐 GLM-5.2 标准版,具备逻辑推理、长文本理解与代码生成能力。通过推理加速优化,输出 TPS 可达 GLM-5.2 标准版的 1.5~2 倍,显著提升输出速度,适用于实时对话、Agent 多轮调用、流式代码生成等对输出速度敏感的场景。

kimi/kimi-k3
阿里云
输入¥23.00/百万tokens
输出¥57.00/百万tokens

256K+:输入¥56.00 输出¥112.00

Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

qwen3-vl-rerank
阿里云
输入¥2.10/百万tokens
输出¥4.80/百万tokens

256K+:输入¥20.00 输出¥40.00

Qwen3-VL-Rerank重排模型,它能够深入理解文本、图片、视频的丰富多模态信息。在初步检索获得结果后,Qwen3-VL-Rerank 能够运用其先进的跨模态关联能力,对候选项目进行智能化的二次排序,将最相关的结果置于显要位置。通用用于提升跨模态搜索的准确率、优化图搜和视频检索的精准度、辅助图像聚类的分组质量、以及实现复杂多模态信息的高效检索和精确打标。

text-embedding-v4
阿里云
输入¥0.32/百万tokens
输出¥0.00/百万tokens

256K+:输入¥2.80 输出¥0.00

通用文本向量V4版本,是通义实验室基于Qwen3训练的多语言文本统一向量模型,相较V3版本在文本检索、聚类、分类性能大幅提升;在MTEB多语言、中英、Code检索等评测任务上效果提升15%~40%;支持64~2048维用户自定义向量维度。

视频生成 1
happyhorse-1.1-i2v
阿里云
¥1.48/秒

HappyHorse-1.1-I2V支持图生视频,进一步提升画面质感、动态表现与跨片段一致性。模型能够更精准地理解输入图像并延续创作意图,在人物皮肤质感、ID跨片段保持、动作流畅度、文字渲染稳定性以及音画同步上带来显著改善,输出更真实自然、细节丰富且一致性更高的高质量视频。

错误码说明
HTTP状态码错误类型说明
401authentication_errorToken无效或已过期
402insufficient_balance余额不足
403permission_deniedToken无此接口权限
429rate_limit请求频率超限
500server_error服务暂时不可用,请稍后重试