2F · 幸福的猴子数字花园

不会设计,也能用Codex做出自己的视觉 Skill:一份小白实践指南

2026-09-16 · 视觉创作实践 · Jamee 加米

在 X 阅读原文 ↗

AI 时代,审美不必再停留在「我喜欢」;普通人也能把它做成作品,甚至变成一套可复用的系统。

上周,我做了人生中第一个开源视觉Skill。

发布了一条推文,没想到反馈还不错,有人转发、收藏,也有人真的去用了(收获了11颗星星,有一颗是自己给自己的哈哈)。这给了我很多信心。

这个 Skill 最初的想法,来自我给自己的诗做视觉卡片。

我一直喜欢多媒介表达,第一份工作在一家互联网教育公司,写过很多知识付费产品的落地页。怎么用一句话抓住注意力,怎样让文字、图片和视频共同讲一个故事,大概从那时起,就成了我的习惯。

后来开始写诗,我也很自然地想:这些文字能不能不只躺在文档里?能不能让它们拥有自己的颜色、光线和形状?

在 ChatGPT 的文生图功能进化到现在这个版本之前,我一直觉得,普通人要做好这样的视觉卡片还是挺费劲的。

Claude Code 很适合搭建工作流、整理文件和编写规则,但我使用的 Claude 本身不生成照片或插画;Nano Banana 在我的使用中更适合信息图和解释性配图;Midjourney、Stability 能生成很有视觉表现力的图片,却又在另一套工作流里。真正麻烦的不是没有好工具,而是每个工具都很强,却没有生活在一起。

现在不一样了。ChatGPT 和 Codex 可以在同一条链路里理解文字、讨论意向、生成画面、调整风格、渲染文字,再把反复试验出来的经验保存成 Skill。

所以我想写下这次经历,分享给那些想把「某种感觉」固定成自己的视觉 Skill,用来给文章配图、制作社交媒体图片,却又觉得自己不懂设计、不懂代码的人。

但我不准备一上来就讲教程。对于一个相对小白的人来说,步骤和技巧不是最重要的。最重要的是先相信两件事:

  1. 你有能力使用 AI 工具!
  2. 你也有权利对视觉拥有自己的喜好和判断!

第一,相信自己可以使用 Coding 工具

我是文科生,今年年初才开始使用 AI Coding 产品。

在这之前,我已经使用 ChatGPT 这样的对话产品很久了,但 Coding 产品出现以后,即使一直关注别人在玩什么,心里还是觉得:这不是文科生可以玩的东西。会不会要懂编程?会不会把电脑搞坏?别人已经做出网站和产品了,我连终端是什么都没有弄明白,现在开始是不是太晚?

有一次,我和一位经常玩 Vibe Coding 的朋友聊起这件事。我说自己有点害怕,觉得这些工具离我很远,朋友对我说:不要给自己设限。

还有一次,我看到一个朋友谈起自己如何用 AI 做产品,说话的时候眼睛在发光。那种状态让我非常好奇,也让我开始想,也许不需要先把所有概念学明白,先上手试试就好了。

于是我开始学习,一边做,一边在推特、公众号分享自己的学习记录。后来也部分因为这些分享,被推进了一家国内的 AI 公司做开发者社区。虽然后面因为一些原因,还是离开了,但这段经历让我更加确定:行动不会保证你成功,却会把你带到原来不可能出现的地方。

如果你对 AI 工具感兴趣,不要想太多,直接用就好了。至少在这类创作里,它面对你的入口就是自然语言。你会打字、会说话,能够表达自己的感受,就已经可以开始。

至于能不能用得很好,那是后面的事情。先用起来。

第二,相信自己有权利判断什么是美

我为什么这么强调这件事,还和一段很小的经历有关。

以前有位同事问我,怎么看新版本 App 的视觉风格。既然对方问了,我就认真提了一些建议,结果对方说:因为你是一个「岁月静好的人」,所以才不喜欢这种风格。

这句话被我放在心里很久。后来很长一段时间,我甚至刻意避开自己喜欢文学、有点文艺的那部分。

现在想想,喜欢就是喜欢,不喜欢就是不喜欢,别人不同意,是别人的事。

说得直接一点:别人又算什么东西,凭什么决定你应该喜欢什么?

我非常尊重设计师和美术师。专业人士积累多年的训练,不会因为 AI 出现就失去价值,真正优秀的设计依然需要知识、技巧和长时间的练习。

但个人表达不是只有专业人士才拥有的权利,我们当然可以判断自己喜欢什么,也可以亲手制作属于自己的东西。

这种判断可以不那么专业,不那么所谓的「高级」,但是你喜欢就好了呀。美和愉快的感受,属于每一个人。专业能力有门槛,表达自己的权利没有。

为什么这是制作视觉 Skill 最重要的前提?因为 AI 可以生成图片,却不能替你喜欢。

如果你没有判断,就很难告诉它哪里不对,很难分辨一张看似漂亮的图究竟是不是你想要的,也很难把它继续修改、整理成一种稳定的风格,最后大胆地推荐给别人。

审美当然可以学习和提升,但美本来就是多元的。

这个世界上有几十亿人,你觉得美的东西,大概率至少还有几个人也会觉得美。所以,大胆表达自己的喜欢吧。

如果你也想做视觉Skill,可以从这几步开始

做完这套 Skill 以后,我觉得小白真正需要的,不是一百条复杂的提示词,而是一个很自然的过程:先用自己的话说需求,看到结果以后再继续判断。

1.直接用自然语言告诉 Codex,你想要什么

不用先学习提示词公式,也不用准确说出某种艺术流派。最开始,我只是告诉 AI:我想给自己的诗做视觉卡片,喜欢日常摄影里的真实感,也想保留克制的文学排版,希望画面有泥土感,不要太像精致的商业产品。

这段话并不专业,却已经足够让 AI 做出第一版。自然语言的作用不是一次把结果规定完美,而是先把你脑子里的方向交给它。你会描述自己的需求和感受,就可以开始。

2.效果不满意,就增加参考图

第一版出来以后,我觉得画面不错,却还不够像自己。这时,与其继续堆抽象形容词,不如直接发参考图,并告诉 AI 具体喜欢哪里。

我先发了一张喜欢的水族馆照片,告诉它我喜欢深蓝水波、暖金光线,以及人物隔着玻璃留下的模糊影子;

后来又发了儿童视角的绘画,告诉它我喜欢线条的笨拙、比例的不准确,以及那种还没有被训练得太成熟的感觉。

参考图不是让 AI 原样复制,而是帮我们指认:我喜欢的是这里的光、那里的颜色,还是某一种材质和情绪。

3.调整时,把不喜欢的地方说清楚

有了参考图,生成结果依然可能不对。我当时说过很多非常普通的话:

「太像油画了」「孩子气还不够」「画面太成熟」「背景很好看,但是字放上去看不清」。

这些反馈已经足够有效。

例如,《玫瑰》的第一版虽然有垃圾桶、玫瑰和树影,却太像成熟油画;把主体画得更笨拙以后,下一版又变成了普通儿童插画,真实光线消失了。

正是在这种来回调整里,我才逐渐说清楚:我要的不是单独的儿童画,也不是漂亮的光影摄影,而是让孩子般不成熟的线条,生长在真实的窗光和树影里。

你不需要先会专业术语。先指出哪一部分不喜欢、为什么不喜欢,以及希望保留什么,AI 可以再帮你把这些感受翻译成更明确的修改要求。

4.感觉对了,就让 AI 把规则固定下来

认出了自己要的感觉这个时候,不要只保存图片,还要告诉 AI:把这次做对的地方总结下来,写进 Skill。

于是,「时光蜡笔」慢慢固定了几条规则:

保留真实窗光、墙面或生活空间,使用粗粝纸张和儿童般不成熟的线条;
人物、物件、主色和具体场景可以随着文字变化;
避免成熟油画笔触、工整商业插画和刻意卖萌的卡通感。

Skill 的作用,就是让这些已经确认过的判断,下次不必从头再说一遍。

当然,规则也不能写得太死。我曾经因为一张「旧梦丝网」颜色不够有张力,就让 AI 写下「浓色占画面百分之七十」,结果下一张几乎全部变成红色。后来又把它改成根据内容选择主色和大致面积。固定的是审美判断,不是把每一次具体修改都变成铁律。

5.换内容测试,看看风格能包容什么

一张成功的图,还不能证明风格已经成立。

换内容测试,不是要求所有作品看起来一模一样,而是看这套风格能不能在保留辨识度的同时,容纳不同的文字、情绪和场景。

每解决一个反复出现的问题,Skill 才稳定一点。

Skill 不是写出来的,而是跑出来、撞坏、修好,再重新跑出来的。

比如我做的这个Skill,就用《教父》和《英雄本色》电影里的两句台词进行了测试(其实理论上可以测试更多的,主要是怕Token额度用光了😂)。

做出第一张,比读完十篇教程重要

回头看,这次最有价值的,不只是得到了四种风格,也不是终于在 GitHub 上发布了人生中第一个开源 Skill,而是以前只能说「我喜欢这种感觉」,现在开始能够说出:

我喜欢真实的光,却不喜欢过度写实;
喜欢孩子般的笨拙,但不喜欢刻意装可爱;
喜欢浓烈的颜色,也需要给文字留下呼吸;
喜欢画面有象征,却不希望它把文字解释得一览无余。

AI 没有替我决定什么是美。它只是不断把可能摆在面前,逼着我们一次次回答:

这个为什么不对?那个为什么让我停下来?回答得多了,模糊的感觉就会逐渐成为清晰的判断。

如果你也想拥有自己的视觉风格,不用先学完设计,也不用急着写出一套完整的 Skill。

现在就打开相册,找出三张你真正喜欢的图片,发给 AI,问问它:这三张图有什么共同点?我喜欢的究竟是什么?然后拿出自己写过的一句话,做第一张图。

它可能不好看,也可能和你想象得完全不同。没关系,告诉 AI 哪里不对,再生成一张。审美不是想清楚以后才开始的,而是在一次次选择、拒绝和修改里慢慢长出来的。

先动起来。做出第一张,比读完十篇教程重要⚡️

最后,也别忘了版权和 credit。AI 降低了创作门槛,不代表所有图片、字体、文字和艺术作品都可以被随意使用。提供参考图时,如果来自其他人的作品,尽量确认图片来源和使用权限;引用他人的文字或作品,要标明作者与出处;准备公开发布或商业使用时,也要再次检查素材和工具的授权范围。

参考可以帮助我们找到自己的语言,但不要把别人的作品直接变成自己的署名。

*本文由我和Codex协作完成。

附录 · 原文配图

原文封面
1 · 原文封面
我创建的Skill,最后生成的文字卡片效果
2 · 我创建的Skill,最后生成的文字卡片效果
年初写的推特/公众号文章
3 · 年初写的推特/公众号文章
《玫瑰》视觉卡片调整实验
4 · 《玫瑰》视觉卡片调整实验
用时光蜡笔风格,批量生成诗集视觉卡
5 · 用时光蜡笔风格,批量生成诗集视觉卡
《教父》四种风格卡片
6 · 《教父》四种风格卡片
《英雄本色》四种风格卡片
7 · 《英雄本色》四种风格卡片
回到写作工坊 →回到树下