pi-sub-agent

Solid

将具体执行委派给 pi coding agent + ZenMux 便宜执行模型(默认强档 deepseek/deepseek-v4-pro:1M 上下文、推理型;廉价快档 inclusionai/ling-3.0-flash:256K、非思考、更省),Claude 负责任务-模型匹配判断、任务书编写、驱动(一次性 pi -p 或 tmux 交互长程)、硬超时重试、独立验收与失败裁决。含双模型选型、3D 素材来源、Spec-Driven、强类型可验证节点、推理档位开关等最佳实践。触发词:pi 委派、把执行外包给便宜模型、deepseek、deepseek-v4-pro、v4 pro 执行、ling、ling-3.0-flash、ling flash 执行、pi sub agent

AI & Automation 85 stars 6 forks Updated yesterday

Install

View on GitHub

Quality Score: 81/100

Stars 20%
64
Recency 20%
100
Frontmatter 20%
70
Documentation 15%
100
Issue Health 10%
80
License 10%
0
Description 5%
100

Skill Content

# Pi Sub-Agent:贵模型编排,便宜模型执行 把写码/生成类执行工作委派给 `pi + zenmux`,Claude 只做编排、驱动、验收。省的不只是钱,更是 Claude 自己的上下文——执行细节全部留在 pi 会话里,Claude 只接收结论。 > **两个执行模型,按任务选**(都经 ZenMux 聚合,复用同一 ZenMux key): > > | | `deepseek/deepseek-v4-pro`(默认/强档) | `inclusionai/ling-3.0-flash`(廉价快档) | > |---|---|---| > | 上下文 | 1M | 256K(pi 显示 262K) | > | 推理 | **推理型** `reasoning=true` | **非思考** `reasoning=false`(ZenMux 上 `reasoning_effort=none` 仍漏少量 reasoning) | > | 多模态 | 无(纯文本) | 无(纯文本) | > | 计费 /M token | ~$0.44 输入 / $0.87 输出 | 2026-07 ZenMux **促销期免费**(07-23 上线,正式价待定——**别把"免费/便宜N倍"写进长期结论或对外话术**,随时会变) | > | 适合 | 复杂调试、多轮联动、需推理的任务 | 结构化转换、模板化组装、照确切 spec 施工的高频快活 | > > **选型原则**:任务难度高 / 要跨多轮推理纠错 → deepseek-v4-pro;任务形状规整、有强类型可验证节点、主要是"照 spec 装配" → ling-3.0-flash 更省更快。拿不准先按 §0 匹配表判断,宁可起手用强档。**下文正文以 deepseek-v4-pro 为默认书写;用 ling 时叠加下面的「ling 实测画像」,纪律收得更紧。** > > **方法论溯源(诚实标注)**:本 skill 的核心方法论与多数「坑」来自 **ling-3.0-flash 的实测对照实验**(含 2026-07 一次 xlsx→TS 建站长程实测,见「ling 实测画像」)。`deepseek-v4-pro` 能力档更高,凡标 `⚠️待实测` 的模型专属弱区判断是**尚未在 deepseek 上独立复测的稳妥默认**,按保守做法执行、别当已验证结论。与模型无关的流程纪律(Spec-Driven、独立验收、硬超时、失败裁决)与**仍走 ZenMux 通道**的坑(请求级死挂)对两个模型都适用。 ### ling-3.0-flash 实测画像(2026-07,一次干净的 xlsx→TS 数据站长程实测) 带 `tsc` 可验证节点、无空间几何的 TS 建站任务上,ling-3.0-flash 能产出专业成品,但短板明确、纪律要更紧: - **强区(放心交)**:结构化 `NL→typed JSON + Zod/schema 校验`(R0 一次过,stats 全中);模板化组件组装;Recharts 图表配置(4 图中 3 图数值一次全对);**照 Claude 给的确切代码/比较器施工**。 - **实测弱区(必须防)**: 1. **自报双向都不可信**——自报 "$1.31k" 实渲染 "$1.31b"(代码对、话报错);反过来也会报"已完成"而实际长歪。**一律 Claude 亲自渲染/断言核对**(§5)。 2. **模糊逻辑反馈会带歪**——排序"null 恒沉底"用口头...

Details

Author
wquguru
Repository
wquguru/skills
Created
4 months ago
Last Updated
yesterday
Language
HTML
License
None

Similar Skills

Semantically similar based on skill content — not just same category

AI & Automation Solid

hekouwang-claude-skill-doctor-skill

会勇禾口王的AI笔记 · Agent Skill(SKILL.md)体检器。检查一个 Claude/Agent Skill 是否 符合"按需加载的指令包,不是单文件巨石"的最佳实践——评 description 触发质量、SKILL.md 篇幅、渐进披露(references/ 拆分)、脚本外置、可移植性(无硬编码绝对路径)、安全(无硬编码 密钥),给出评分卡 + 按优先级的修复建议,并可代为重构。触发:用户说「检查我的 skill / SKILL.md 体检 / 这个 skill 规范吗 / claude-skill-doctor / audit skill / lint SKILL.md / 我的 skill 太长了 / skill 拆分 / 看看我的 skill 合不合规 / skill 对齐官方规范」。 任何"评估/审查/优化某个 Agent Skill 质量或结构"的请求都应触发。

1 Updated today
huiyonghkw
AI & Automation Listed

ks-deep-claim-audit

对【别人】在网上(X 推文 / 文章 / 截图 / 营销话 / 朋友转发)宣称的某个 GitHub 开源项目 · AI 工具 · 产品 · 数据/性能/热度, 做毫无遗漏的深度地毯式核查与尽职调查——客观判定每条声称是 真实/部分真实/夸大/虚假/无法证实,而不是附和宣传。 触发:用户贴来【别人的】宣传/推文/截图/repo 链接要求核真伪,或要求「深度地毯式 挖掘/核实/审查/验证/分析/判断」「毫无遗漏」 「可以大胆用 dynamic workflow / agent teams」;或直接问「这个项目/工具/repo 靠谱吗 / 是不是真的 / 是不是夸大 / 值不值得用 / 这个推文可信吗 / 帮我查查这个 GitHub / 这个 benchmark·数据·性能数字成立吗 / 这个声称有没有水分」。 不触发:① 核查【用户自己写的文章稿】→ article-fact-check;② 开放主题的多源研究报告(非核查特定宣称)→ deep-research; ③ 精读理解一篇论文/文章的思想 → deep-reading-analyst。 核心动作:先自己侦察事实底座 → 派 Workflow 多 Sonnet agent 按维度扇出 → 亲自交叉核对载重结论 → 客观出逐条 verdict 的 .md 报告。 触发词:深度核查、地毯式、毫无遗漏、挖掘洞察、核实验证、是不是真的、是不是夸大、靠谱吗、可信吗、查查这个项目、 推文核查、X 博主、宣称、尽调、due diligence、fact-check this repo/tool/claim、verify this hype。

0 Updated 2 weeks ago
KaiSky0823
AI & Automation Listed

cost-model

AI 模型调用与 agent 运行的成本核算。当对话涉及「跑这个要多少钱」「用哪个模型划算」「token 单价」「限流 / RPM / 并发够不够」「文生视频 / 图生视频报价」「批量推理折扣」「区域可用性 / 出海能否接入」「历史调价 / 价格何时变了」「给客户报价里的 AI 算力那部分」,或任何需要把「用哪个模型」换算成「多少钱、能跑多快、官方声明在哪些地区可用、当前价是否附有可溯源的历史调价注脚」的场景时使用。含核算方法、口径规则、报价失效检查、54 个文本 API/网关 SKU、区域可用性,以及当前价格快照的 SKU 历史调价附注和 GPU、实例、预留吞吐公开快照。只要提到成本、报价、预算、划不划算、够不够跑、贵不贵、区域可用性、历史调价,就该用这个 skill——即使没明说要核算。

1 Updated today
techdolphinJ