
节省90%的Tokenportal-ai-plugins的shunt插件如何把大文件读取委托给廉价模型【免费下载链接】portal-ai-plugins项目地址: https://gitcode.com/gh_mirrors/po/portal-ai-pluginsshunt 是 portal-ai-plugins 仓库中的一款 Claude Code 插件它能把大文件读取、样板代码生成这类高 I/O、低智力的活儿自动委托给运行廉价模型的 AiKA worker实测在大批量读取场景中平均节省 90% 的 Token最高达 94%。对于经常让 AI 助手通读上千行源码的开发者来说这意味着更长的上下文寿命和更低的账单。为什么读文件这么烧钱AI 编程助手回答问题之前往往要先把相关文件全部读进上下文。一个 4000 行的 Java 文件约等于 3 万多 Token——读一次就吃掉上下文预算的一大块而这些内容对总结、检索类问题来说其实并不需要逐字记住。shunt 的思路很简单把文件正文发给便宜的 worker 模型去读、去回答只把精简后的答案几百个 Token带回到主力模型的上下文里。原始文件永远不进入你的 Claude 上下文。工作原理三层拦截从硬门槛到软建议shunt 采用硬拦截 → 脚本执行 → 技能引导的三层架构详见 plugins/shunt/README.md第一层Hooks 硬拦截两个钩子脚本挂在工具调用之前注册配置见 hooks.jsoncheck-file-size拦截对超过 350 行文件的整文件 Read 请求提示改用 bulk-reader 技能。定向读取带 offset/limit不受影响见 check-file-sizecheck-bash-read拦截cat、head、tail等对大文件的 Bash 读取管道、重定向等不读进上下文的用法正常放行第二层Scripts 执行委托主力模型从不自己拼 bash 管道只调用带命名参数的脚本一切细节脚本内部处理bulk-read把文件包进 XML 标签发给 bulk-reader 模式提问见 bulk-readcode-write按规格说明 参考文件生成样板代码可直接写盘见 code-write两者共用 lib/aika.sh 的底层管道通过 Portal CLI 的动作注册表发起委托因此兼容任何启用了 AiKA 的 Portal 实例第三层Skills 告诉模型何时用技能文件用一句话描述触发时机让 Claude 自动识别该委托的场景bulk-reader/SKILL.md读超过 350 行的文件、跨 3 个以上文件提问、总结大型 diff 时使用code-writer/SKILL.md测试、配置、类型桩等80% 可从参考文件推断的生成任务使用安装步骤与快速上手前置条件jq工具以及本市场提供的 portal 插件shunt 依赖它发起委托。1️⃣ 安装插件新开会话claude plugin install portalportal claude plugin install shuntportal2️⃣ 运行/portal:setup完成 CLI 认证3️⃣ 确认你的 Portal 实例上已有bulk-reader、code-writer两个 AiKA 模式——很多实例自带公共模式没有的话按 plugins/shunt/README.md 中的命令创建即可。自建的私有模式会优先于公共模式生效无需额外配置。之后正常使用 Claude Code当它试图读大文件时会被 Hook 拦下并自动改走 bulk-reader全程无感。基准测试真实节省了多少 Token以下数据来自对 16.2 万行 Java 单体仓库的实测场景定义见 benchmarks.json场景行数无 shunt有 shunt节省单个大文件4,01433,684 tokens5,737 tokens82%源码 测试对7,40875,990 tokens4,148 tokens94%多文件跨服务1,28116,221 tokens821 tokens94%样板代码生成3,66740,614 tokens直接写盘 833 行—bulk-read 平均节省 90%。而且每次委托相互独立——追问时重发文件不会累加你的上下文成本因为文件发给的是 worker不是你的 Claude。什么时候 shunt 会让路shunt 刻意设计了几种不委托的场景避免省了 Token 却降了质量调试需要主力模型的推理而不是摘要✏️编辑精确修改需要完整内容在上下文中——用带 offset/limit 的定向读取即可绕过拦截小文件350 行以下委托开销大于收益️架构决策判断类工作始终保留给主力模型常用配置项速查所有设置均为环境变量写在.claude/settings.json的env块中变量默认值用途SHUNT_MIN_LINES350触发拦截的行数阈值SHUNT_TIMEOUT_SECONDS180单次委托超时SHUNT_MAX_PAYLOAD_BYTES400000Linux 120000单次请求大小上限SHUNT_PORTAL_INSTANCECLI 默认指定 Portal 实例⚠️ 小提示请求体通过命令行传递超大文件请分批读取生成时间过长可调大超时或拆小规格说明。小结shunt 插件用三层极简架构解决了一个很实际的问题让贵的模型专注推理让便宜模型干搬砖活。如果你的 Claude Code 工作流频繁涉及通读大文件、跨文件检索或批量生成样板代码它值得装上试一周——90% 的读取 Token 节省几乎是即插即用的。【免费下载链接】portal-ai-plugins项目地址: https://gitcode.com/gh_mirrors/po/portal-ai-plugins创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考