OpenSquilla 教程:领取 68 元 Token 并利用智能路由降低 Agent 成本
OpenSquilla 是基元律动推出的开源桌面 Agent 框架,支持 Windows 10/11 和 macOS(含 Apple Silicon 原生版本)。它本身不提供大模型,而是在应用与大模型之间做调度,通过智能路由、上下文管控、MetaSkills、多层记忆和安全沙箱等模块,让同一个预算下 Agent 能做更多、更省 token 的活。官方提到智能路由最高可节省 60%~80% 的 token 成本。

一、先领 68 元 Token 额度
目前基元律动有注册即送 68 元 token 额度的活动。注册后,界面会显示一个 API Key,这个 Key 只完整显示一次,需要第一时间复制保存。如果忘记保存,可以点击右上角用户图标,进入“API Key”页面重新新建一个。这个活动属于产品体验官计划,好友注册也能拿到 68 元额度;作为邀请人,需要与被邀请的好友双方都完成一次有效的 OpenSquilla 调用,邀请奖励才会到账。
二、额度能调哪些模型
TokenRhythm API 平台接入了阿里云、火山方舟、美团 LongCat、无问、智谱 AI、DeepSeek 等供应商,目前有 14 个文本模型和 2 个图像模型。常见的有 deepseek-v4-flash-0731、deepseek-v4-pro、glm-5.2、glm-5.3、kimi-k2.7-code、qwen3.8-max、qwen3.8-27b 以及图像模型 qwen-image-2.0。部分模型仍在测试中,遇到个别模型不稳定属于正常情况。
三、用智能路由节省 Token
OpenSquilla 的核心是本地运行的路由模型。它会结合关键词、语义、上下文长度和任务类型判断难度:简单分类、摘要、格式整理等轻量任务自动交给低成本模型,复杂代码、深度推理、长文本分析才调用旗舰模型。除智能路由外,还可以切换为多模型融合(多个模型并行作答再汇总,质量优先)或固定模型(所有请求走同一模型,行为可控)。智能路由内部将请求分为 C0~C3 四个档位:C0 适合快速简单任务,可配置 deepseek-v4-flash;C1 作为日常主力,可配置 deepseek-v4-pro;C2 用于代码与复杂推理,可配置 kimi-k2.7-code;C3 处理攻坚难题,可配置 glm-5.2。这样该省的省,该花的花。
四、其他省心能力
OpenSquilla 的 MetaSkills 协议允许 Agent 自主检索和组合技能,自动拆分目标、编排步骤,不用手动规划工作流。四层记忆(工作记忆、情节记忆、语义记忆、原始记忆)只召回与当前任务相关的内容,不会把全部历史塞进 Prompt,减少无效 token 消耗。如果你经常跑 Agent 任务、月底看着 token 账单心疼,或者开发者想找可二次开发、可私有化部署的 Agent 底座,都可以试试它。











