ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

十张图丢给AI,提示词自己出来了(附生图提示词skill安装地址)

十张图丢给AI,提示词自己出来了(附生图提示词skill安装地址) 摘要本文分享如何用 AI 把参考图逆向拆解成结构化提示词解决看得懂图、写不出提示词的痛点。作者从手写提示词反复翻车的经历出发总结了三个核心坑缺结构锁、文字不逐字、容器形态不写死并介绍了 image-prompt-reverse 技能的四拍工作法先切片再拆图、12 类元素逐格验收、配方先行、质检后再出图。文章还覆盖了复刻参考图、换主体保版式、批量出图等使用场景列出了五个真实踩坑经验并坦诚说明了当前局限多模态依赖、中文字密集图需人工兜底、配方未全覆盖等最后给出可直接抄走的指令头六槽模板、12 类元素剥离清单和书本知识卡骨架。十张图一晚上交稿还要逐字保留中英文图注——这种活儿以前我能从天黑憋到天亮。上周这批图又来了Q 版小人堆叠壁纸、穿搭九宫格、服装设计手稿卡、水彩植物、巴黎公寓剖面图、古董珠宝史图鉴、装饰版画、洛丽塔少女插画……有的带中英文图注要逐字保留有的必须把品牌字和水印剥得干干净净还有一张点名要换个品种的花效果不能变。一、以前对着图憋词一晚烧几十次生成额度打开生图工具对着图憋提示词。先写「复刻这张图」——模型当成风格参考自由发挥补一段复古奶油色调、精致排版——构图对了版式跑得亲妈都不认识好不容易版式像了画面里的中文变成一团乱码。改一版抽一次卡。一晚上过去十张图还剩八张没开工。二、现在一个下午十条全部过质检十张图一个下午。每张都拿到一条85 分以上的提示词直接出图版式、文字、配色一次命中。区别只有一个——我不再写提示词而是让 AI 把图拆成提示词。本文总览痛点 / 场景 / 用法 / 优点 / 局限 / 展望一张图看完。三、手写提示词的真坑不在文笔你以为的坑是不会写提示词其实不是。对着 50 多条实战样本复盘完真坑是这三个——眼睛看得见手却写不全1、没有结构锁。你写参考这张图的风格模型拿它当风格参考自由发挥版式全跑。真正管用的写法是100%复刻参考图的2×5网格、米黄底色、鎏金油画框——一句话顶十句形容词。2、文字不逐字。画面里每个字都要用「」原样抄出来。写加上标题两个字模型就敢替你编八个字还带错别字。3、容器形态不写死。内容全对、容器错了照样翻车——8 个色卡被画成拍立得小图意思全变。N个小圆框、拍立得小图必须点名。一张复杂信息图里的元素是12 大类画布规格、版式骨架、底色、边框、主视觉、色彩系统、光影、文字层、容器、信息模块、装饰符号、风格用途。人脑装不下 12 类但清单装得下。四、把图交给逆向工程师使用说明·装与验这时候我用上了自己攒的一个技能image-prompt-reverse。它是什么一句话参考图的逆向工程师。你丢给它一张图它还你一张施工图纸——不是风格描述是能让生图模型照着施工的结构化提示词指令头六槽画质/文字安全/结构锁/事实锁/调性/用途 ▌分区元素清单 排除要求。装起来三步1在 WorkBuddy 技能市场安装 image-prompt-reverse2对话里带上它image-prompt-reverse把图丢进去3它会先跑预处理脚本切图再逐步拆给你看最后交付一份带质检评分的报告。先考一道再派活。拿一张简单图让它拆把产出的12 类元素剥离表跟原图对一遍——文字逐字对、数量逐个对。这一步不验后面全白做。五、实录四拍工作法使用说明·用第一拍先切片再拆图。python prep_image.py 参考图.png --rows 3它先出全览定版式再按行切片抠小字顺手统计每区主色。拆欧洲古董珠宝史图鉴时12 件珠宝的中英双语标签一个字都没漏。为什么巨图直接看会被压缩密集小字全糊——只看全览就动笔剥出来的永远是大概。大概喂给模型出来的就是随缘。第二拍12 类元素一个格子都不许空。它按剥离清单逐类过写不出答案的格子就是漏掉的元素。我拿文艺复兴十大建筑的拆解结果对照过标准答案几乎1:1 吻合10 座建筑、2×5 排布、序号徽章、羊皮纸悬浮标注框、鎏金油画框一样不少。清单不是纸面框架是可执行的验收标准。第三拍配方先行不裸写。它内置16 套版式配方非遗海报 / 知识卡片 / 图鉴 / 长卷 / 四宫格 / 工程科普 / 摄影写实 / 界面截图 / 数据图表 / 品牌视觉……按内容类型直接匹配分区比例、必写要素和该类型的翻车点。拆高奢浮雕花卉时我顺手要了换花母本——只挖 5 个花种槽位郁金香、山茶、虞美人填进去就是同款不同花。为什么配方先行同类的图翻车点是一样的配方把已经踩过的坑变成默认避开。第四拍先质检再出图。python lint_prompt.py 提示词.txt每条提示词出门前过12 项质检指令头六槽、比例、分区、编号连续性、「」配对、占位符残留、空话词、字数区间……85 分以下不许出门。拆摩根石双联时首轮只有 69 分——指令头里嵌套了一个【】把槽位统计截断了修掉后 85 分。分数不是装饰是揪错器。手写提示词没人给你打分坏在哪全靠抽卡试错。六、这些活儿都交给过它使用场景复刻参考图。海报、信息图、IP 群像、单图角色插画——拆完直接出同款抖音截图里的插画剥掉 UI 就能复现。换主体保版式。换花不换味高奢花卉母本、换书不换模板《孙子兵法》和《写给大家看的设计书》共用一套知识卡片母本93 分、换文明不换构图天宫圣殿城骨架可换中式仙宫。批量出图。10 张图一条流水线切片 → 剥离 → 渲染 → 统一质检全部 85–93 分。以书为单位做知识卡片。给书名 一份知识骨架一键出萌系 Q 版图解卡看图懂道理。去品牌字、留设计感。品牌字只是签名贵感来自质感、配色、留白——拆出来的是可以合规复用的设计语言。七、五个真实的坑都是踩出来的一、指令头里嵌套【】。质检的槽位统计会被截断6 个槽数成 4 个白扣 12 分。解法【】只留给正文物件名强调用引号。二、把合法强调当占位符。【汝窑三足炉】这种既定物件名曾被误判成没填的模板。解法只有待填/占位/示例类语义词才算占位符。三、摄影图被画成 3D。指令头没写禁止3D渲染或CGI或插画风模型自作主张加了立体感。摄影/产品/人像类必写。四、文字密集图硬上。UI 截图、数据图表这类先生成无文字版、再在设计工具贴字比让模型写一屏小字稳得多。五、无事实错误不如符合××设定。同样一句事实锁换一种写法差 8 分。措辞也是工程。这五条全部写进了技能的已知经验下次先撞坑的不再是你。八、数字收束它凭什么比手写强AI 干的切图、取色、12 类剥离、渲染提示词、12 项质检、评分。我干的说清用途、选对配方、核对文字。成果全部是数字16套版式配方、17组逐句解剖的黄金范例、50条实战样本索引、550条开源案例入库、单轮 10 图85–93 分全部过线。方法论参考了 Robin Williams《写给大家看的设计书》的 CRAP 四原则和郭浩、李健明《中国传统色》的 70 中文色名体系。顺手送你一个圈内冷知识模型对藕荷紫这类中文色名的响应比对#B58BB5这类十六进制色码稳得多——色名自带语境色码只是数字。以前写提示词是抽卡现在是填表。你要判断的只剩一件事——这张图该走哪套配方。剩下的交给清单。九、说实话它现在不能干什么局限性1、语义理解仍靠多模态模型。本地脚本只能切图、取色图里画了什么必须靠视觉模型看像素。没有多模态能力的环境里它只能做文字推断风格结论要标待验证。2、中文字密集图仍需人工兜底。AI 生成小字仍可能错字文字越多越要准备无文字版 后期贴字的双保险路线。3、配方覆盖未满。摄影写实、界面截图、数据图表、品牌视觉刚补齐骨架与范例3D、包装、地图、日漫分镜还在待补清单里。4、为中文生图模型优化。即梦 / 可灵 / GPT Image 直接可用Midjourney、SD 需要翻译改写成短语堆叠或 tag骨架不直接通用。十、下一步未来展望类别覆盖的路标已经立好我按社区开源案例库的分布做了 21 行覆盖度矩阵缺口按 P0/P1/P2 分级。peterRooo/awesome-gpt-image-2-prompts550 条、带分类与评级已整库入库当参照系社区还有 GoEnhanceAI、wuyoscar 等同类案例库可对照。接下来三件事1配方从 16 到全品类——按案例库热度继续补 P1/P23D 场景、包装、美食地图、日漫分镜2母本复用链更自动化——一句话换书 / 换花 / 换文明已经跑通下一步是批量系列图3质检与生图闭环——生成后自动比对复现率让85 分从提示词质检变成成品质检。十一、可抄走的资产包P0 · 指令头六槽模板替换【】即用【最高优先级指令{①画质}{②文字安全}{③结构锁100%复刻参考图的X版式、Y底色、Z边框}{④事实锁所有内容符合X设定}{⑤调性}适配{⑥用途}】P1 · 12 类元素剥离清单画布规格 / 版式骨架 / 背景底色 / 边框装饰 / 主视觉主体 / 色彩系统 / 光影质感 / 文字层逐字「」/ 图像元素与容器N个小圆框…/ 信息模块 / 装饰符号 / 风格与用途。写不出答案的格子就是漏掉的元素。P2 · 书本知识卡骨架以书为单位# 排 标题 色块N 知识点 | 2字核心 | Q版插画填好骨架一条命令出萌系 Q 版知识卡片提示词自动补指令头、自动质检。本文提及的技能为 WorkBuddy 技能 image-prompt-reversev2.8案例覆盖度参照 peterRooo/awesome-gpt-image-2-prompts 开源案例库。写给每一个看得懂图却写不出提示词的人。你卡得最多的是哪一类图评论区聊聊觉得有用转给那个还在抽卡的朋友。下述图片均gpt image生成我觉得比参考图的效果还更惊艳的
返回列表