Top AI Repos — open-source AI, indexed and scored
Top AI Repos tracks AI repositories on GitHub and answers two different questions about each one: is it moving right now, and would you bet a product on it.
Top AI Repos tracks AI repositories on GitHub and answers two different questions about each one: is it moving right now, and would you bet a product on it.
Codex skill for converting slide images, PDFs, and image-based PPTX files into editable PowerPoint decks.
| Date | Stars |
|---|---|
| 2026-07-24 | 1586 |
| 2026-07-25 | 1595 |
| 2026-07-28 | 1595 |
| 2026-07-30 | 1595 |
| 2026-08-06 | 1595 |
Today
— stars today
This week
— stars this week
This month
— stars this month
Momentum
35.0
growth rate 0.00%/day
# Image to Editable PPT Skill
**简体中文** · [English](README_en.md) · [한국어](README_ko.md)
[](https://ningzimu.github.io/image-to-editable-ppt-skill/#/) [](https://github.com/ningzimu/image-to-editable-ppt-skill/stargazers) [](https://github.com/ningzimu/image-to-editable-ppt-skill/forks)

一个用于把图片、PDF、图片版PPT 转成可编辑 PowerPoint 的 skill。它先把输入归一化为逐页任务,再重建为 `.pptx`:可读文字尽量恢复为原生文本框,简单几何尽量恢复为 PowerPoint 形状,复杂视觉元素保留为带来源记录的独立图片资产。
它适合把截图式或图片式幻灯片变成更容易二次编辑的 PPT,让文字、简单形状和视觉素材尽量分开调整。
> [!IMPORTANT]
> **建议在 Codex 中使用“完全访问权限”执行本 skill。**
>
> 本 skill 运行时间较长,并且会自动执行 OCR、图片生成/编辑、文件读写、子 agent 分派和长时间轮询等步骤。“请求批准”模式会频繁打断执行,可能阻塞部分步骤,尤其是在子 agent 环境里。
>
> “替我审批”模式已知仍可能在 OCR 阶段、ChatGPT 图片生成/编辑阶段或第三方 API 调用阶段拦截请求,要求你手动审批;如果你不在电脑旁,转换流程会停住。
>
> 本 skill 会在转换过程中自动调用百度 PaddleOCR-VL 接口(如果已配置 Token)来校正页面文字框、字体大小和字号分组。图片生成/编辑会优先调用 Codex 内置 `image_gen.imagegen`;只有内置工具不可用、调用报错、编辑输入不可读或没有返回有效本地图片时,才降级到 `editppt image`(Codex OAuth → OpenAI-compatible API)。这些调用是把图片式页面重建成可编辑 PPT 的必要步骤。
>
> 
> [!WARNING]
> 目前该skill 采用了多智能体协作复原流程,有着复杂的流程控制,不是轻量转换器。AI 会执行“**重建 → 自我检查 → 页面内修正**”的循环,并可能进行多轮迭代,直到它认为结果足够接近原图。在这个过程中,page worker 可能会对页面做很**多轮尝试**,因此整体上比较费 token。
>
> **推荐 ChatGPT Pro 用户使用;Plus 用户请谨慎使用。**
>
> 复原一个 10 页 PPT 有可能消耗完你的 5 小时额度。单页PPT复原时间可能在10min以上。单页/单图输入可由主 agent 按同一页面重建流程本地执行;多页输入会按并发槽位分派给 page worker 处理。
>
> **如果没有强烈的可编辑需求,请不要使用这个 skill。**
>
> 更轻量的做法是直接使用 gpt-image-2 的图像编辑能力:把你不满意的那一页 PPT 图片发给它,让它针对性修改,并返回修改后的图片。
> [!TIP]
> 本 skill 不负责从文章、报告、大纲或想法直接生成全新 PPT。如果你要做的是“生成一份 PPT”,可以使用 [codex-ppt-skill](https://github.com/ningzimu/codex-ppt-skill)。
>
> 关于 `codex-ppt` 和 `image-to-editable-ppt` 这两个技能的详细介绍,参见 [skill_duo_intro.pdf](assets/skill_duo_intro.pdf)。该 PPT 由 `codex-ppt` skill 生成,提示词为:“请分别阅读 Codex PPT和 Image to Editable PPT 这两个技能的内容,然后用 Codex PPT 帮我做一个PPT吧,20页,每个技能的介绍10页。”
>
> 另外,关于这个可编辑 PPT Skill 设计和调优的实践经验,可以看这篇文章:[2000 个 GitHub Star 换来的经验:好的 AI Skill 是调出来的,不是写出来的](https://mp.weixin.qq.com/s/LaxWBX-nogHPpSxlk-Vs8Q)。
## 转换效果示例
<table>
<tr>
<th>原图</th>
<th>转换后可编辑效果</th>
</tr>
<tr>
<td><img src="assets/showcase-origin-investment-platform.png" alt="投资平台信息图原图" width="420"></td>
<td><img src="assets/showcase-editable-ppt-result-investment-platform.png" alt="投资平台信息图转换后可编辑效果" width="420"></td>
</tr>
<tr>
<td><img src="assets/showcase-origin-market-snapshot.png" alt="市场概览原图" width="420"></td>
<td><img src="assets/showcase-editable-ppt-result-market-snapshot.png" alt="市场概览转换后可编辑效果" width="420"></td>
</tr>
<tr>
<td><img src="assets/showcase-origin-status-report.png" alt="项目进展汇报原图" width="420"></td>
<td><img src="assets/showcase-editable-ppt-result-status-report.png" alt="项目进展汇报转换后可编辑效果" width="420"></td>
</tr>
<tr>
<td><img src="assets/showcase-origin-mdt-kidney-cancer.jpg" alt="肾癌 MDT 信息图原图" width="420"></td>
<td><img src="assets/showcase-editable-ppt-result-mdt-kidney-cancer.png" alt="肾癌 MDT 信息图转换后可编辑效果" width="420"></td>
</tr>
</table>
## 特点
- 适用场景广泛,支持多种输入:单张图片、多张图片、多页 PDF、图片版PPT 到可编辑 `.pptx`。
- 单页/单图输入可由主 agent 本地执行同一页面重建流程;多页输入由主 agent 分派给 page worker/subagent,并按 `max_concurrent_pages` 并行处理。
- 图片生成和编辑优先使用 Codex 内置 `image_gen.imagegen`;满足明确降级条件时才进入 `editppt image` CLI,由 CLI 依次选择本机 Codex OAuth 和 OpenAI-compatible API。
- 第三方 API fallback 配置保存在 `~/.editppt/config.yaml`;Windows 下对应 `%USERPROFILE%\.editppt\config.yaml`。
- 文字大小与位置由测量驱动:prepare 阶段为每页生成文字标注(框坐标 + 字号 + 字号分组),模型按测量值还原文字,同级文字字号自动保持一致。
- 多张图片按提供顺序生成页面;PDF 和 `.pptx` 保留原页码顺序。
- `.pptx` 输入的页面备注会复制到输出对应页,备注内容不改动。
- 根据具体页面情况决定是否通过已确认 image backend 做图片分层抽取;需要时用稀疏 asset sheet 合并前景素材,优先把图标放Excerpt of 11,542 characters
Read on GitHub78
Would you bet a product on this? Bounded 0–100 and slow moving.
matched fp:5f2cc5df7cbcb340, topic:multi-agent