git clone https://github.com/rocsgh/ppt-zen cd ppt-zen ./install.sh auto # 探测你装了哪些运行时;想逐个装看下面的矩阵
| 运行时 | 命令 | 装到哪 | 触发方式 |
|---|---|---|---|
| Claude Code | ./install.sh claude [--global] | .claude/skills/ppt-zen/ | /ppt-zen,或直接说要做 deck |
| OpenClaw | ./install.sh openclaw [--global] | .openclaw/skills/ppt-zen/ | 直接说要做 deck |
| Hermes | ./install.sh hermes | ~/.hermes/skills/creative/ppt-zen/ | 直接说要做 deck |
| Codex CLI | ./install.sh codex [--global] | AGENTS.md / ~/.codex/AGENTS.md | 被动——自动读取 |
| Cursor | ./install.sh cursor | .cursor/rules/ppt-zen.mdc | 被动——自动生效 |
| Windsurf | ./install.sh windsurf | .windsurf/rules/ppt-zen.md | 被动——自动生效 |
| GitHub Copilot | ./install.sh copilot | .github/instructions/ | 被动——自动生效 |
| 全部 | ./install.sh all | 以上全部 | — |
| 自动探测 | ./install.sh auto | 本机探测到的每个运行时 | — |
项目级的那几行装在「当前目录」——Codex、Cursor、Windsurf、Copilot 都是往你此刻所在的项目里写,所以要在你的项目里跑安装脚本,而不是在克隆下来的仓库里跑:cd my-project && /path/to/ppt-zen/install.sh codex。脚本会把技能里引用的文件路径改写成绝对路径,换个目录也照样能找到。
技能安装是自包含的(SKILL.md + references + styles + scripts + examples + styles.json + requirements.txt)。完全没有 skill 系统?把 SKILL.md 整段贴进会话当上下文即可。
Hermes:它没有项目级技能目录——安装脚本一律写入 $HERMES_HOME/skills(默认 ~/.hermes/skills),--global 不起作用。装完请重启 Hermes 网关/进程:技能索引缓存在进程内。Hermes 自带的 powerpoint 技能(文本框式 deck)会继续共存;做设计过的整页出图 deck 时,以 ppt-zen 为准。
每一页都是生成的图,而 PPT-Zen 不带图像模型。看你属于哪一半:
| 你的运行时 | 你要做什么 |
|---|---|
| Claude Code · Codex · Cursor · Windsurf · Copilot | 你需要一个图像 key——照下面 30 秒配好 .env。 |
| Hermes(或任何自带图像工具的 agent) | 什么都不用配,skill 直接用 agent 已有的工具。 |
已经 export 过 OPENAI_API_KEY? | 也什么都不用配——脚本会自动复用它。 |
自备 key:实现了 OpenAI /images/generations 接口的任意端点都行(接受 {model, prompt, size, n}、返回 b64_json 或 url——只兼容 chat 的"兼容"网关不算):
cp .env.example .env # IMAGE_API_BASE_URL / IMAGE_API_KEY / IMAGE_MODEL / IMAGE_SIZE python3 scripts/gen_image.py --check # 体检:读你的配置,试生成一张图
--check 就是全部的排障入口:它遮掉你的 key、探一次端点,把任何失败翻译成一句人话结论 + 怎么修——key 不对、只兼容 chat 的网关、连不上。OpenAI、通用中转、火山方舟 / 豆包 Seedream 的 .env 模板可直接粘贴: references/providers.md。
PPT-Zen 不带任何 key、不绑定任何模型——判断是开源的,像素是你自己的。省掉这一步的托管版试用,正在做。
今天没有 key?照样让它做。你会拿到一份判断包:逐页计划 + 每页一段可直接粘贴的 prompt、占位页、以及拼好的 draft.pptx。把任意一段 prompt 贴进你已有的出图工具,把图放回 slides/,重拼一次即可。key 从此只是可选的最后一步。
在任何项目里打开你的 agent,直接说话。一句话就能开始;剩下的它来判断,绝不会反问你版式问题:
「用航海图(Portolan)风格,给〈你的项目〉做一套 10 页 pitch。」 「把我们 Q3 业绩做成一套 keynote——材质你来选。」 # 材质它自己选 「就一页:『23 分钟才能重新专注』,把它做得掷地有声。」 # 单页也行
agent 会先写 slides/PLAN.md(页 · 详略 · 器物 · 逐字文案 · 风格)——想过目就过目——然后逐页出图到 slides/。之后对着页迭代:
「第 6 页重出——数字挤在一起了。」
「整套片换成金缮(Kintsugi)材质。」 # 同一计划,换个世界
「第 4 页的器物看不明白,换成漏斗试试。」
把真实数据喂给它。附上提纲 / 指标 / 链接——真数字会上片;缺的只会显示 [TO CONFIRM] 占位,绝不编造。页面都校对干净之后:
pip install python-pptx python3 scripts/assemble_pptx.py slides/ deck.pptx
任何走 OpenAI 兼容 /images/generations 路由的——OpenAI 的 gpt-image 系、各类中转、网关。风格库里的样张用 gpt-image 级模型在 1536×1024 生成。非 16:9 的输出会在拼装时居中裁切,所以 prompt 会让关键内容避开上下约 8%。
它是图片型的:每页一整张满幅图。放映、导 PDF、导入 Keynote/Google Slides 都行——但文字不可编辑。改错字 = 重出那一页(skill 支持单页重出)。
不会——这是硬规则。事实只来自你的输入;缺的会显示成 [TO CONFIRM] 占位。skill 只定版式,绝不编事实。
能——复制 styles/_template/,填好 STYLE.md(材质配方 + 一张样张),提 PR。风格库和 styles.json 自动重建。风格是 CC-BY-4.0,贡献走 DCO。
取决于你的图像端点收费——10 页 = 10 张图,外加你选择的单页重试。量级参考(OpenAI gpt-image 官方价,2026 年中):1536×1024 每张约 $0.06–0.25(看质量档),首轮 10 页约 $1–3;含逐页校对预留 20–40 分钟。以你自己端点的价格为准。