个人开发者 & 小规模测试
标准延迟流式推理
7B 参数量级支持
- 统一 API 与模型路由
- 用量与成本管理
- 按需扩展服务能力
从开发验证到大规模交付,使用统一模型网关承载不同阶段的调用需求。
标准延迟流式推理
7B 参数量级支持
低延迟高性能推理
7B~70B 全精度量产支持
超低延迟超高速推理
支持私有化部署
| 能力说明 | 计量方式 | 当前价格 |
|---|---|---|
| 文本与推理模型 | 按 Token 计量 | 实时配置 |
| 图像生成与编辑 | 按次 / 按量计量 | 实时配置 |
| 视频生成 | 按时长与模型计量 | 实时配置 |
| 嵌入与重排 | 按 Token 计量 | 实时配置 |
场景素材用于演示能力分类,不代表对应厂商生成结果;正式可用能力以租户 AI 算力引擎配置为准。

多镜头生成与场景迁移

图生视频与运动控制

图像生成与创意编辑
按文本推理、图像、视频、音频与开发能力组织模型入口,具体启用状态由 AI 算力引擎管理。
文本 · 推理 · 多模态
长文本 · 编码 · 智能体
原生多模态 · 长上下文
推理 · 编码 · 高性价比
文本 · 图像 · 音视频
文本 · 图像 · 视频
文生视频 · 图生视频
文生视频 · 图生视频
从统一接入到企业交付,覆盖模型调用的核心生产链路。
单一入口连接主流文本、图像、音频与视频模型。
连接 AI 算力引擎与 AI创作平台,支持模型能力进入创作流程。
按实际调用和租户分组配置计量,价格由 AI 算力引擎统一管理。
账号、令牌、权限、审计和私有部署边界清晰。
使用熟悉的协议和工具快速接入羽宇 AI 算力。
const response = await fetch("https://api.yu-yu.ai/v1/chat/completions", {
method: "POST",
headers: {
"Content-Type": "application/json",
Authorization: "Bearer " + process.env.AI_API_KEY,
},
body: JSON.stringify({ model: "your-model-id", messages: [{ role: "user", content: "你好" }] }),
});替换 Base URL 与令牌即可迁移现有应用。
POST /v1/chat/completions支持对应原生协议与兼容端点。
x-api-key: sk-...查看端点、参数和可用模型,快速验证调用。
GET /v1/models面向开发工作流连接多模型服务。
export AI_API_BASE_URL=...