back
loading skill details...
模型路由工具(免费版)为个人开发者提供三层模型路由指南,从最便宜的模型起步,仅在必要时升级,帮助降低API成本。核心能力: - 三层路由:Flash → Standard → Plus / 32B - 黄金规则:30秒人类思考阈值 - 快速决策树与参考卡 - 基础子Agent与定时任务路由 适用场景: - 个人项...
---
slug: model-routing-tool-free
name: model-routing-tool-free
version: 1.0.0
displayName: 模型路由工具(免费版)
summary: 个人开发者的三层模型路由指南,从最便宜模型起步,按需升级降低API成本。
license: Proprietary
edition: free
description: '模型路由工具(免费版)为个人开发者提供三层模型路由指南,从最便宜的模型起步,仅在必要时升级,帮助降低API成本。核心能力:
- 三层路由:Flash → Standard → Plus / 32B
- 黄金规则:30秒人类思考阈值
- 快速决策树与参考卡
- 基础子Agent与定时任务路由
适用场景:
- 个人项目API成本优化
- 子Agent任务分发
- 定时任务模型选择
差异化:
- 免费版聚焦三层路由决策与个人使用
- 移除原始平台引用,纯净适配SkillHub
- 提供中文友好的决策树与...'
tags:
- Development
- AI
- 模型路由
- 成本优化
tools:
- - read
- exec
homepage: https://skillhub.cn
pricing_tier: L3
pricing_model: per_use
suggested_price: 29.9
---
# 模型路由工具(免费版)
## 概述
模型路由工具(免费版)为个人开发者提供三层模型路由指南。核心原则是:**从最便宜的模型起步,仅在必要时升级。** 错误的模型选择要么浪费金钱,要么浪费时间——Flash用于简单任务,Standard用于常规工作,Plus / 32B用于复杂决策。
当你在请求中提及 模型路由、成本优化、子Agent分发、定时任务模型选择 等关键词时,本工具会自动激活,根据任务复杂度推荐合适的模型层级。
本版本聚焦三层路由决策与个人使用场景。如需成本分析仪表盘、批量路由、自定义规则与监控告警,请升级至 PRO 版本。
## 核心能力
| 能力 | 说明 |
| --- | --- |
| 三层路由 | Flash → Standard → Plus / 32B 决策框架 |
| 黄金规则 | 30秒人类思考阈值决定是否升级 |
| 决策树 | 快速判断应使用哪一层 |
| 参考卡 | 可打印的速查卡 |
| 子Agent路由 | 子Agent任务分发模型选择 |
| 定时任务路由 | cron任务默认使用Flash |
**技术实现要点**:核心能力基于`input_params`参数与`output_format`配置实现,支持创建/查询/修改/删除等操作模式,通过`config_options`进行运行时配置。
### 核心功能执行
用`input_params`参数进行配置。
**输入**: 用户提供核心功能执行所需的指令和必要参数。
**处理**: 按照skill规范执行核心功能执行操作,遵循单一意图原则。
**输出**: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用`input_params`参数,支持创建/查询/导出操作
### 参数配置与调用
用`config_options`参数进行配置。
**输入**: 用户提供参数配置与调用所需的指令和必要参数。
**处理**: 按照skill规范执行参数配置与调用操作,遵循单一意图原则。
**输出**: 返回参数配置与调用的执行结果,包含操作状态和输出数据。
- 执行此能力时使用`config_options`参数,支持修改/重置/导入操作
### 结果处理与输出
用`output_format`参数进行配置。
**输入**: 用户提供结果处理与输出所需的指令和必要参数。
**处理**: 按照skill规范执行结果处理与输出操作,遵循单一意图原则。
**输出**: 返回结果处理与输出的执行结果,包含操作状态和输出数据。
- 执行此能力时使用`output_format`参数,支持导出/保存/转换操作
**能力覆盖范围**:本skill的核心能力覆盖以下场景关键词:个人开发者的三层、模型路由指南、从最便宜模型起步、按需升级降低、API、模型路由工具、免费版、为个人开发者提供、三层模型路由指南、从最便宜的模型起、仅在必要时升级、帮助降低、快速决策树与参考、基础子、与定时任务路由等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
## 使用场景
### 场景一:个人项目日常对话路由
用户希望日常对话尽量用便宜模型,降低成本。
```text
用户: 今天天气怎么样?
工具: 💚 FLASH — 简单事实查询,使用Flash
用户: 帮我写一个REST API端点
工具: 💛 STANDARD — 代码生成,使用Standard
用户: 设计一个多租户的数据库schema
工具: ❤️ PLUS / 32B — 架构决策,使用Plus
```
### 场景二:子Agent任务分发
用户有多个子Agent各司其职,希望按任务复杂度分发模型。
```javascript
// 例行监控 — 用Flash
sessions_spawn(task="检查备份状态", model="GLM-4.5-Flash")
// 标准代码工作 — 用Standard
sessions_spawn(task="构建REST API端点", model="GLM-4.7")
// 架构决策 — 用Plus
sessions_spawn(task="设计多租户数据库schema", model="GLM-4-Plus")
```
### 场景三:定时任务模型选择
用户配置定时任务,希望默认用最便宜的模型。
```json
{
"payload": {
"kind": "agentTurn",
"model": "GLM-4.5-Flash"
}
}
```
定时任务默认用Flash,除非任务确实需要推理能力。
## 不适用场景
以下场景模型路由工具(免费版)不适合处理:
- 需要100%确定性的关键决策
- 医疗诊断
- 法律判决
## 触发条件
需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于非本工具能力范围的需求。
## 快速开始
1. 阅读## 核心能力章节了解skill功能
2. 按## 依赖说明配置环境
3. 执行所需能力对应的命令
4. 参考## 错误处理章节处理异常
5. 查看## FAQ解答常见疑问
### 1. 掌握黄金规则
> 如果一个人类需要超过30秒的专注思考,从Flash升级到Standard。
> 如果任务涉及架构、复杂权衡或深度推理,升级到Plus / 32B。
### 2. 模型层级速览
| 层级 | 示例模型 | 用途 |
| --- | --- | --- |
| Flash | GLM-4.5-Flash, GLM-4.7-Flash | 最快最便宜 |
| Standard | GLM-4.6, GLM-4.7 | 强推理与代码 |
| Plus / 32B | GLM-4-Plus, GLM-4-32B-128K | 重推理与架构 |
### 3. 使用决策树
```text
是问候、查询、状态检查或1-2句回答?
是 → FLASH
否 ↓
是代码、分析、规划、写作或多步骤?
是 → STANDARD
否 ↓
是架构、深度推理或关键决策?
是 → PLUS / 32B
否 → 默认STANDARD,卡住再升级
```
**结果处理**: 执行完成后,查看输出结果确认操作状态。成功时输出包含处理摘要和结果数据;失败时根据错误信息排查问题,查阅错误处理章节获取恢复步骤。
## 示例
### 适用场景
- 事实问答:"什么是X"、"谁是Y"、"什么时候Z"
- 快速查询:定义、单位换算、短翻译
- 状态检查:监控、文件读取、会话状态
- 心跳:周期性检查、OK响应
- 记忆与提醒
- 闲聊:问候、确认
- 简单文件操作:读取、列出、基础写入
- 一句话任务:1-2句能回答的任何事
- 定时任务(默认用Flash)
Flash禁止做的事:
- 写超过10行代码
- 创建对比表格
- 写超过3段
- 多步骤分析
- 写报告或提案
### Standard适用场景(主力)
代码与技术:
- 代码生成:函数、脚本、功能
- 调试:常规bug排查
- 代码审查:PR、重构
- 文档:README、注释、指南
分析与规划:
- 对比与评估
- 规划:路线图、任务拆解
- 研究综合
- 多步骤推理
写作与内容:
- 长文写作(>3段)
- 长文档摘要
- 结构化输出:表格、大纲
大多数真实用户对话属于这一层。
### Plus / 32B适用场景(复杂推理)
架构与设计:
- 系统与服务架构
- 数据库schema设计
- 分布式或多租户系统
- 跨多文件的大型重构
深度分析:
- 复杂调试(竞态条件、隐蔽bug)
- 安全审查
- 性能优化策略
- 根因分析
战略与判断:
- 战略规划
- 细微判断与模糊性
- 深度或多源研究
- 关键生产决策
## 最佳实践
### 1. 从便宜开始,按需升级
```text
原则:START CHEAP → SCALE ONLY WHEN NEEDED
默认用Flash → 卡住或质量不足 → 升级Standard → 仍不足 → 升级Plus
```
### 2. 30秒思考阈值
判断升级的关键问题:**一个人类需要多少秒专注思考来回答这个任务?**
- <30秒:Flash足够
- 30秒-2分钟:Standard
- >2分钟或涉及架构:Plus / 32B
### 3. 定时任务默认Flash
定时任务通常不需要推理,默认用Flash可大幅降低成本。仅当任务确实需要推理时才升级。
### 4. 子Agent分发按任务复杂度
```javascript
// 简单监控任务
sessions_spawn(task="检查服务健康", model="GLM-4.5-Flash")
// 标准开发任务
sessions_spawn(task="实现用户认证模块", model="GLM-4.7")
// 复杂架构任务
sessions_spawn(task="设计微服务拆分方案", model="GLM-4-Plus")
```
### 5. 可打印参考卡
```text
┌─────────────────────────────────────────┐
│ 智能模型路由(免费版) │
│ Flash → Standard → Plus / 32B │
├─────────────────────────────────────────┤
│ 💚 FLASH(最便宜) │
│ • 问候、状态检查、快速查询 │
│ • 事实问答、提醒 │
│ • 简单文件操作、1-2句回答 │
├─────────────────────────────────────────┤
│ 💛 STANDARD(主力) │
│ • 代码>10行、调试 │
│ • 分析、对比、规划 │
│ • 报告、长文写作 │
├─────────────────────────────────────────┤
│ ❤️ PLUS / 32B(复杂) │
│ • 架构决策 │
│ • 复杂调试、多文件重构 │
│ • 战略规划、深度研究 │
├─────────────────────────────────────────┤
│ 💡 规则:人类>30秒思考 → 升级 │
│ 💰 从便宜开始 → 按需升级 │
└─────────────────────────────────────────┘
```
## 常见问题
### Q1:免费版支持哪些模型?
免费版提供三层路由决策框架,示例使用GLM系列模型(Flash/Standard/Plus/32B)。实际可用模型取决于你的API供应商,路由原则通用。
### Q2:如何判断任务需要哪一层?
参考"30秒思考阈值":人类需要<30秒思考用Flash,30秒-2分钟用Standard,>2分钟或涉及架构用Plus / 32B。也可参考决策树与参考卡。
### Q3:免费版能否分析成本?
免费版提供路由决策,不提供成本分析仪表盘。如需成本追踪、预算告警与优化报告,请使用PRO版。
### Q4:免费版与PRO版差异?
| 维度 | 免费版 | PRO版 |
| --- | --- | --- |
| 路由决策 | 三层决策树 | 三层+自定义规则 |
| 成本分析 | 不支持 | 仪表盘与告警 |
| 批量路由 | 不支持 | 批量任务分发 |
| 自定义规则 | 不支持 | 团队规则与策略 |
| 监控 | 不支持 | 实时监控与告警 |
| 支持 | 社区支持 | 优先支持 |
### Q5:模型名称会变化怎么办?
模型名称会随版本更新,但三层路由原则(便宜→标准→复杂)通用。建议定期对照你的API供应商文档更新具体模型名,决策框架不变。
## 依赖说明
### 运行环境
- **Agent平台**: 支持SKILL.md的任意AI Agent(Claude Code / Cursor / Codex / Gemini CLI等)
- **操作系统**: Windows / macOS / Linux
- **API供应商**: 提供三层模型选择的任意LLM API供应商
### 依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|:-------|:-----|:---------|:---------|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
| 模型API供应商 | API | 必需 | 自行选择并申请API Key |
### API Key 配置
- 本skill基于Markdown指令规范,无需额外API Key。
- 实际调用模型API需要对应供应商的API Key,请按供应商文档配置环境变量(如 `MODEL_API_KEY`)。
- 建议为不同层级模型配置独立Key,便于成本追踪。
### 可用性分类
- **分类**: MD+EXEC(纯Markdown指令,部分功能需exec命令行执行)
- **说明**: 基于Markdown的AI Skill,通过自然语言指令驱动Agent完成操作。免费版聚焦个人开发者的三层模型路由决策。
## 错误处理
| 错误场景 | 原因 | 处理方式 |
|---------|------|---------|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
## 已知限制
- 需要API Key,无Key环境无法使用
- 执行效率受模型能力与网络环境影响
don't have the plugin yet? install it then click "run inline in claude" again.