Skip to main content
在 GitHub 上查看 -> 一个网关连接多个 LLM。 通过 AIsa 和单个 API key,在 OpenAI 兼容模型之间路由 Agent 请求。

安装

如果还没有安装 AIsa CLI,请先安装:
然后安装该技能:

Agent 可以用它做什么?

模型匹配

根据任务类型和约束选择模型。

提供商覆盖

在 GPT、Claude、Gemini、Qwen、DeepSeek、Grok 等模型间路由。

成本感知路由

在质量需求允许时选择更便宜的模型。

回退规划

当模型不可用时建议替代模型。

🔥 可以做什么?

多模型聊天

模型对比

视觉分析

成本优化

回退策略

为什么需要 LLM Router?

支持的模型家族

注意:模型可用性可能变化。请查看 console.aisa.one/pricing 获取完整的当前可用模型和价格列表。

快速开始

API 端点

OpenAI 兼容 Chat Completions

请求

参数

消息格式

响应

流式响应

Streaming 返回 Server-Sent Events(SSE):

视觉 / 图像分析

通过图片 URL 或 base64 数据分析图像:

函数调用

启用 tools/functions 以获得结构化输出:

Google Gemini 格式

对于 Gemini 模型,也可以使用 native 格式:

Python 客户端

安装

不需要安装额外依赖,只使用标准库。

CLI 用法

Python SDK 用法

使用场景

1. 成本优化路由

简单任务使用更便宜的模型:

2. Fallback 策略

失败后自动 fallback:

3. 模型 A/B 测试

对比模型输出:

4. 专项模型选择

为每种任务选择最合适的模型:

错误处理

错误以 JSON 返回,包含 error 字段:
常见错误码:
  • 401 - API key 无效或缺失
  • 402 - 额度不足
  • 404 - 模型不存在
  • 429 - 超出速率限制
  • 500 - 服务器错误

最佳实践

  1. 使用 streaming 改善长响应体验
  2. 设置 max_tokens 控制成本
  3. 实现 fallback 提高生产可靠性
  4. 缓存响应 处理重复查询
  5. 监控 usage 使用响应元数据
  6. 使用合适模型 —— 不要把 GPT-4 用在简单任务上

OpenAI SDK 兼容性

只需修改 base URL 和 key:

价格

模型价格按 tokens 计费,并随模型变化。查看 console.aisa.one/pricing 获取当前费率。 每个响应包含 usage.costusage.credits_remaining

开始使用

  1. aisa.one 注册(新账户有 $2 免费额度)。
  2. 从控制台生成 API key。
  3. 设置 key 并安装技能:
  4. 启动新的 Agent 会话,让运行时加载更新后的技能说明。

相关

模型目录

浏览支持的 model ID 和模型家族。

对比模型

在生产路由前对比模型。

AIsa CN-LLM Route

中文模型路由。