安装
如果还没有安装 AIsa CLI,请先安装:Agent 可以用它做什么?
模型匹配
根据任务类型和约束选择模型。
提供商覆盖
在 GPT、Claude、Gemini、Qwen、DeepSeek、Grok 等模型间路由。
成本感知路由
在质量需求允许时选择更便宜的模型。
回退规划
当模型不可用时建议替代模型。
🔥 可以做什么?
多模型聊天
模型对比
视觉分析
成本优化
回退策略
为什么需要 LLM Router?
支持的模型家族
注意:模型可用性可能变化。请查看 console.aisa.one/pricing 获取完整的当前可用模型和价格列表。
快速开始
API 端点
OpenAI 兼容 Chat Completions
请求
参数
消息格式
响应
流式响应
视觉 / 图像分析
通过图片 URL 或 base64 数据分析图像:函数调用
启用 tools/functions 以获得结构化输出:Google Gemini 格式
对于 Gemini 模型,也可以使用 native 格式:Python 客户端
安装
不需要安装额外依赖,只使用标准库。CLI 用法
Python SDK 用法
使用场景
1. 成本优化路由
简单任务使用更便宜的模型:2. Fallback 策略
失败后自动 fallback:3. 模型 A/B 测试
对比模型输出:4. 专项模型选择
为每种任务选择最合适的模型:错误处理
错误以 JSON 返回,包含error 字段:
401- API key 无效或缺失402- 额度不足404- 模型不存在429- 超出速率限制500- 服务器错误
最佳实践
- 使用 streaming 改善长响应体验
- 设置 max_tokens 控制成本
- 实现 fallback 提高生产可靠性
- 缓存响应 处理重复查询
- 监控 usage 使用响应元数据
- 使用合适模型 —— 不要把 GPT-4 用在简单任务上
OpenAI SDK 兼容性
只需修改 base URL 和 key:价格
模型价格按 tokens 计费,并随模型变化。查看 console.aisa.one/pricing 获取当前费率。
每个响应包含
usage.cost 和 usage.credits_remaining。
开始使用
- 在 aisa.one 注册(新账户有 $2 免费额度)。
- 从控制台生成 API key。
- 设置 key 并安装技能:
- 启动新的 Agent 会话,让运行时加载更新后的技能说明。
相关
模型目录
浏览支持的 model ID 和模型家族。
对比模型
在生产路由前对比模型。
AIsa CN-LLM Route
中文模型路由。