Codex 實戰指南:10 個你必備的 Essential 技能

@miles_mazy
簡體中文2026年9月04日
195K
384
79
17
709

TL;DR

Miles Ma 為你介紹 10 個強大的 Codex 技能,助你優化 AI 工作流程,包括新聞策展、視覺設計、知識提取以及自訂技能開發等工具。

大家好,我是 Miles,这段时间写内容、整理资料、做演示、做交付,Codex 已经成了我手边最常用的工具。

今天想分享的,就是目前对我来说最好用的 10 个 Skills。看资讯、做封面、解码一本书、把图片变成可编辑的 PPT,各有各的用处。我把具体样例和效果也放进来了,喜欢哪个,可以直接照着试。

Miles Ma - inline image

1. follow-builders:给自己配一个 AI 资讯编辑

关注了几十位 AI 创作者,想知道他们最近在做什么,得挨个翻动态、找播客,再从英文里挑出值得读的部分。张咋啦 Zara Zhang 做的 follow-builders,就是把这件事整理成一份简报。

它跟踪一组 AI 研究者、创始人、产品经理和工程师,汇总他们的动态,以及相关博客、播客内容。你可以指定中文、英文或双语,也可以告诉它自己更关心产品、技术还是创作。

拿中文资讯简报来说,给它这样的要求就够了:

text
1使用 follow-builders,整理一份给 AI 内容创作者看的中文简报。
2重点关注产品的新用法、真实操作演示和创作者的经验。
3每条写清楚谁说了什么、为什么值得看,保留来源链接。
4把你补充的建议单独列出来。

下面是生成的简报:

Miles Ma - inline image

中文简报试用结果。

比如其中一条,Zara 建议产品演示多保留真实界面的操作,以及操作背后的思考。读到这里,已经能知道这条动态和做教程有什么关系;感兴趣,再顺着链接看具体内容。

它值得装的地方,是帮你维持一份能读得下去的关注列表。对于长期跟踪 AI 产品的人,固定看这样一份简报,比每天重新决定要搜谁、看什么省心。想每天收到,还可以结合 Codex 的定时任务安排投递;先在对话里试一份,看看内容是否对胃口。

安装地址:zarazhangrui/follow-builders

2. Punk Skill:选一种风格,把文章做成有辨识度的封面

Punk Skill 是我创作时的核心配图工具。其中的 punk-cover 会读取文章或主题,根据平台、画幅和所选风格组织画面,再调用生图工具完成封面。

做内容时,最费劲的往往是把「这篇文章在说什么」转换成一张图。只给 AI 一个标题,它可能放上一堆电脑、机器人和发光线条。Punk 的风格库把主体、文字、留白和材质一起考虑了,选定风格后,画面有更明确的方向。

看这张「从 0 到 1 搭建 Obsidian 知识库」:

Miles Ma - inline image

层叠纸张、紫色结构和笔记卡片,把知识库的主题做成了可见的空间;大标题仍然是第一眼能读到的东西。纸张的厚度和阴影也让画面有了手工搭建的感觉。

换成像素风,效果又完全不同:

Miles Ma - inline image

两图均为 Punk Skill 风格样例。

角色、地图和道具组成一个完整的游戏场景。用来讲工具升级、闯关式学习或者搭建项目,都有很直接的画面联想。

你可以把自己的文章放进去:

text
1使用 punk-cover,为下面这篇文章生成封面。
2平台:X;画幅:5:2;风格:立体纸雕概念海报。
3主标题控制在两行,画面用一个主体表达核心观点。
4请实际生成图片。
5
6这里粘贴文章全文。

它值得长期留着,因为同一系列内容可以沿用喜欢的风格,再换主题和主体,不必每篇重新摸索视觉方向。实际出图需要 Codex 能调用生图工具;封面里的中文标题,完成后看一眼再用。

安装地址:adrianpunk/Punk-Skill

3. cangjie-skill:让课程里的方法,真的参与下一次工作

cangjie-skill,仓颉,会从课程稿、讲座文字、教程等材料中提取方法,整理成能调用的 Skill。它要处理的是「什么情况下用、先检查什么、怎么判断」,适合那些步骤清楚、你又想反复照着做的知识。

比如一份讲客户访谈的课程,里面提醒:少问用户对假设功能的态度,多问最近发生过的具体经历。这句话放在笔记里很容易划过去;编成技能后,就能拿来检查访谈题。

用一份自编的访谈教学稿做例子:

text
1使用 cangjie-skill,把这份「客户访谈提纲检查」课程稿编成 Skill。
2让它能逐题判断:这个问题能收集到什么证据,有没有暗示答案。
3遇到不合适的题目,给出更具体的问法。

编好的技能拿到一道新题:「你喜欢自动提醒吗?」背景是准备在报销提醒和进度查询之间选一个产品方向。它给出的检查结果如下:

Miles Ma - inline image

自编教学材料生成技能后的调用结果。

这道题只能问到用户对提醒的态度,无法比较两个方向。回答把问题改成了更容易获得经历的问法,例如:

请回想一次近期报销,从准备材料到提交是怎样进行的?有没有需要补充或重新处理的地方?


那次提交后,你是否了解过处理进度?如果有,当时为什么想了解、用了什么方式?

两个问题分别去找提交过程和进度查询中的实际麻烦,后面才有材料判断该做什么。

值得装它,是因为学过的判断标准能直接落到下一份作业上。输入的课程越具体,编出来的技能越有东西可用;只有几句口号的材料,很难凭空长出一套可靠方法。

安装地址:kangarooking/cangjie-skill

4. GordenImage2PPTX:好看的 PPT 图片,终于能继续改了

AI 生图做了一页很满意的 PPT,偏偏标题要换两个字。这时整页只有一张图片,点哪里都选中整张,改一个小地方也麻烦。

GordenImage2PPTX 专门解决这个问题:把页面里的背景、框架、图标装饰和文字分开处理,再组合成 PowerPoint 文件。

先看这张输入图片,标题、金字塔、图标和右侧说明都在同一张图里:

Miles Ma - inline image

转换之后,文字和图形元素周围出现了各自的选择框:

Miles Ma - inline image

图片来源:Gorden Sun 项目示例。

图里最值得看的,就是这些选择框。标题有自己的文本框,右侧几条说明可以分别修改,拆出的图标可以单独移动、缩放或替换。原先要重新生成一整页才能处理的调整,现在可以回到 PPT 里继续做。

这样给任务:

text
1使用 GordenImage2PPTX,把这张幻灯片图片转换成可编辑的 PPTX。
2文字做成可修改的文本框,图标分别拆出。
3框架中需要独立调整的模块,也请分开处理。
4尽量保持原图的布局和配色。

我会把它推荐给经常用 AI 做课件、提案和分享页面的人。它补上了图片生成之后经常缺少的修改能力。

这里的「可编辑」也要看具体对象:文字可以直接改字;独立图片可以挪动和替换;图表不一定恢复成带数据的原生图表,复杂框架也可能仍是一张图。安装后还需要配好项目要求的图像处理能力。

安装地址:GordenSun/GordenSuperPPTSkills · GordenImage2PPTX

5. book-to-skill:解码一本书,把里面的方法留下来

book-to-skill 可以把一本书整理成可调用的阅读技能:章节在哪里、重要概念是什么意思、遇到一个问题该查哪部分,都有对应的入口。

如果一本书只是读一遍,普通摘要可能就够了。方法书、专业书需要反复用,才更适合这么处理。你不必每次把整本书重新交代一遍,也能要求回答回到具体章节,看看建议究竟依据了什么。

以《孙子兵法》为例,可以这样交任务:

text
1使用 book-to-skill,把这份《孙子兵法》全文整理成阅读技能。
2按十三篇保留章节入口,整理核心概念、判断方法和容易误用的地方。
3之后回答问题时,先指出相关篇目,再给建议。
4现代场景中的类比,要与原书含义分开。

它会留下章节资料、术语表和速查表。真正能体现用途的是下一次提问:「我只有 20 分钟做读书分享,想把整本书都讲完,该怎么安排?」

Miles Ma - inline image

生成阅读技能后的调用结果。

回答把分享集中到「做一件事前,应该比较哪些条件、考虑哪些代价」,再定位《始计》和《作战》。分享可以用 2 分钟提出问题,6 分钟讲条件,5 分钟讲消耗,余下时间留给讨论和说明类比的边界。

这比把十三篇各压缩成一句话,更适合一场时间有限的分享。书里的内容仍按篇保留,但你可以带着眼前的问题去查。这里的分享安排是教学建议,不能反过来说成原书就是在教人做演讲。

安装地址:virgiliojr94/book-to-skill

6. show-me:让代码解释变成一张能看懂的图

Codex 改完代码,解释里出现十几个文件名、组件名和调用关系,读起来仍然费劲。show-me 会把这些关系整理成流程图、组件树、调用树或前后对照,需要时也能生成 HTML 说明页。

这是 Matt Pocock 推荐过的 Skill,来自 HumanLayer,作者是 Dexter Horthy。适合想理解项目结构、审查代码修改,又不想逐段追着长说明找重点的人。

下面这个案例,解释的是阅读位置如何恢复:页面更新以后,什么时候接受保存的位置,什么时候等待,什么时候因为用户主动滚动而取消。

Miles Ma - inline image

HumanLayer 的 HTML 图示案例。

图中三个方框分别代表空闲、等待和完成。箭头上的条件说明状态何时切换;红色路径标出取消,绿色路径标出完成。沿着箭头看,就能找到「用户这时滚动了,程序会怎么做」这个问题的答案。

有了图,再回到代码里找对应判断,阅读范围会清楚很多。你也可以直接对刚才没看懂的回答说:

text
1使用 show-me,把刚才的解释画出来。
2用中文标注:从哪里开始,经过哪些判断,最后得到什么结果。
3如果涉及代码修改,突出修改前后的差别。
4复杂的内容做成可以打开的 HTML 图示。

它值得装,是因为检查 AI 做了什么,本来就不该比让它做还费劲。图的重点是帮你看清关系,涉及具体代码时,仍要让它根据真实文件来画。

安装地址:humanlayer/skills · show-me

7. grill-me:开工之前,先把需求问明白

grill-me 是 Matt Pocock 的一个需求追问技能。把计划或想法交给它,它会找出还没决定、却会影响后面工作的地方,给出问题和建议,等你回答后继续往下问。

它尤其适合「我大概知道想做什么,但说不清具体要求」的时候。AI 很会补齐一份看起来完整的方案,可登录、收费、分享方式这些决定,应该有实际理由。

例如想做一个读书资料领取站:

text
1使用 grill-me,帮我想清楚「读书资料领取站」的需求。
2先问会影响制作方向的问题,说明不同选择会带来什么差别。
3每个问题给出你的建议,等我回答后再继续。

它第一轮的追问是这样的:

Miles Ma - inline image

首轮追问的试用结果。

先问服务谁:参加过工作坊的人,还是所有公开读者?前者已经有共同背景,资料可以直接配合课程;后者可能还需要介绍、分类和浏览入口。

再问可以提供哪些材料。自己制作的讲义、可以分发的资料,决定了第一版站点究竟放什么。问题停在这些关键选择上,比提前讨论按钮颜色有用。

你需要做的是回答它,然后让它继续追问。它的价值,是把方案里默认替你做掉的决定,拿出来让你看见

安装地址:mattpocock/skills · grill-me。安装时一起处理它依赖的 grilling。

8. last30days:先看别人怎么用,再决定自己怎么做

准备试一个新工具,直接问 AI「有什么好用的技巧」,很容易得到一组到处都能套的建议。last30days 会先查最近一段时间的社区讨论,整理大家在尝试什么、遇到什么问题,以及哪些做法值得继续研究。

它能围绕一个工具、一个话题或一组产品展开调研,支持 Reddit、X、YouTube 等来源,具体能查哪些取决于接入情况。对于做选题、找玩法的人,它很实用:你可以从一个很宽的问题开始,再把找到的线索变成能照着用的提示词。

项目展示过一个宠物图片案例。最初的问题只是「大家怎样用 ChatGPT 做狗的图片」,调研里找到了「把狗变成人」等玩法。接着追问具体提示词,得到的要求包括:先上传宠物照片,把毛色对应到发色,保留神态和有辨识度的配饰。

Miles Ma - inline image

项目展示案例:last30days 负责调研和提示词,人物图片由 ChatGPT 生成。

对照着看,毛色、吐舌头的神态、胸前的配饰,都成为人物设计的线索。这个例子最有用的地方,是让一个模糊的「想做点宠物内容」,变成了有参考图、有具体要求的创作任务。

你可以换成自己感兴趣的话题:

text
1使用 last30days,调研最近 30 天大家怎样用 ChatGPT 制作宠物图片。
2找出有实际作品的玩法,说明每种玩法要准备什么照片。
3选一个适合新手的,给我一段能直接复制的中文提示词。
4保留参考来源,标明没有查到的平台。

上面的图片是项目已有案例,用来说明它怎样把调研推进到创作;现在运行,搜到的玩法会随时间变化。

安装地址:mvanhorn/last30days-skill

9. Defuddle:把一个网页,收成干净的正文

Defuddle 做的事很单纯:从网页里提取主要内容,保存成 Markdown。Markdown 就是带标题、列表和链接的纯文本,能直接放进笔记软件,也方便继续交给 Codex 阅读。

它适合经常收集网页资料的人。全选复制会带上导航、按钮、推荐阅读;截图又不方便查找和摘录。把正文存下来,后面做笔记、翻译、比较几篇文章,都有一份清楚的底稿。

例如 NASA 的月球科普页面,网站上有任务导航、新闻入口和很多栏目。交给 Defuddle:

text
1使用 defuddle,提取这个网页的主要内容:
2https://science.nasa.gov/moon/facts/
3
4保存成 moon-facts.md,保留小节标题、正文和链接。
5先保留英文原文,不要翻译或概括。

提取后的文件,打开是这样:

Miles Ma - inline image

NASA 网页提取结果,在编辑器中打开。

「月球名字的由来」「大小与距离」「公转与自转」这些小节都留下了,段落里的相关链接也还在。网站的大段导航消失了,眼前主要就是要读的内容。

它省下的是复制以后重新整理格式的那段时间。需要留意的是,提取质量取决于网页结构;这个例子仍保留了少量图片署名和相对链接。准备长期存档时,让 Codex 顺手补全链接即可。查看提取文件。

安装地址:kepano/obsidian-skills · defuddle

10. skill-creator:把自己反复交代的要求,做成一个 Skill

skill-creator 是用来创建和完善技能的工具。你把任务、规则和希望拿到的结果告诉它,它会帮你组织技能说明;需要固定检查的部分,还可以配上脚本。

它适合那些已经重复做过、也知道怎样算做好的工作。比如交付资料前检查文件链接:哪些要查,哪些跳过,发现问题报什么,都能说清楚。

可以这样要求:

text
1使用 skill-creator,创建一个检查 Markdown 本地文件链接的 Skill。
2报告链接所在行号、目标文件和文件是否存在。
3跳过远程网址、图片和代码示例。
4只检查,不修改原文。准备几个不同情况的样本验证它。

生成的技能拿到一份演示文档后,给出这样的结果:

Miles Ma - inline image

生成链接检查技能后的调用结果。

表里第 4 行的 not-created.md 被标成缺失,其余能找到的文件显示正常。你可以直接回到那一行补文件或改地址,不需要自己从头点一遍。

这个例子的用途很小,但重复做时很实在。把检查对象、排除范围和输出格式留进 Skill,下次只要说「检查这份文档」,就能按同一套要求来。

我更建议从这种边界清楚的小任务开始。一个能稳定检查文件的技能,已经能帮上忙;等用顺了,再补新的规则。

安装地址:openai/skills · skill-creator

怎么安装

选好一个,把对应安装地址发给 Codex,连同 Skill 的名字一起说明。一个仓库里可能有多个技能,记得点名要装哪一个:

text
1请从下面这个地址安装【Skill 名称】,并检查它需要的依赖。
2安装完成后,用我提供的材料演示一次。
3
4安装地址:【粘贴上面的链接】

不必一次装完十个,选一个马上用得上的,把自己的材料放进去,效果会比看十段功能介绍更明白。

Miles Ma - inline image

我是 Miles,一名从大厂转型 FDE 的 AI 算法专家,做过算法研发、优化部署,也做过企业培训、落地交付,我的 X 账号,15 天做到 1 万粉,一周写出三篇百万曝光长文,其中两篇后来超过 200 万。

关注我@miles_mazy一起成长,一起赚钱

Miles Ma - inline image
二次創作

使用 YouMind 創作爆款文章

收集素材、拆解爆點、生成視覺資產、撰寫內容,並在一個 AI 工作空間裡完成分發。

了解 YouMind
寫給創作者

把你的 Markdown 變成乾淨的 𝕏 文章

圖片上傳、表格、程式碼區塊,往 𝕏 上手動重排太痛苦。YouMind 把整篇 Markdown 一鍵轉成乾淨、可直接發佈的 𝕏 文章草稿。

試試 Markdown 轉 𝕏

更多可拆解樣本

近期爆款文章

探索更多爆款文章