当前位置: 首页 > news >正文

用一句话需求,做完一张 9:16 的 Skill 发布海报:我把设计生图交给 Agent 试了一次

大家好,我是吾鳴。专注于分享提升工作与生活效率的工具,持续关注AI的前沿动向。

这阵子,我做了一个设计图片的Skill,它的名字叫做gen-ai-image。它的作用可以让Agent根据不同的需求,去使用像Nano Banana Pro、Nano Banana 2、Nano Banana 2 Lite和GPT Image 2等这些前沿顶尖的图片大模型来生成图片,你只要配置好自己的API Token,描述你想要的图片画面,简述你的想法,Agent便会吭哧吭哧去做提示词整理、模型调用、任务提交、等待任务结果和下载结果这系列流程。

在做完这个Skill,我想给它制作一张发布海报,这张海报我是用来发布到我的社交媒体账号上用的,我希望它的尺寸是9:16,画面需要有一点儿科技感,却不能满屏都是芯片、代码和宇宙星空这些技术元素,标题需要直接生成在海报里面,整体看起来需要是一个立马就能用上的宣传海报。

以前遇到这样类似的生图需求,我都需要在网上先找一圈图,看看哪些与自己想要的比较符合,然后再编写绘图提示词。

这次我决定就用我做的这个Skill,让它自己给自己制作一张宣传海报。

我只说了一句话

我给Agent的需求是:

为 gen-ai-image 设计一张Skill发布海报,用于社交媒体网络发布,要有科技感,排版简洁,且要有高级感。

这次我没有去指定某个生图大模型,也没有自己去指定生图比例、尺寸等参数。

我只是把几个关键点给说清楚了:

  1. 海报是给gen-ai-image这个skill设计的宣传海报,这是任务目的。
  2. 海报是用于社交媒体网络发布,这是它的实际用途。
  3. 整体是需要科技感、高级感且排版需要简洁,这是一些附加的要求。

剩下的事情都交给Agent去处理。

生成之前,先预览

在真正进行生图之前需要先看一篇完整的预览,这一点我觉得非常有必要。

Skill不会一接收到需求之后,就立马开始直接生成图片,它会把这次生成使用哪个生图大模型、图片比例、尺寸、绘图提示词和预计消耗的积分都给你提前展示出来。

也就是说,在真正开始生图之前,我可以确认这几个问题:

  1. 图片的比例,是不是我需求的?
  2. 海报中的文案有没有写错?
  3. 画面的主体符不符合要求?
  4. 用的什么模型、消耗多少积分?

确认没有问题之后,再让它提交任务去生成图片。

对于制作海报来说,这一步骤很重要,因为在制作海报的时候,经常会需要有产品名称、功能点和固定的文案,如果输入的文案错了,或者是使用了错误的模型,生成之后才发现,那么相当浪费了一次绘图的额度。

这一次,文字也直接让模型生成

之前我做“自媒体封面图生成专家”时,采用的是另外的一种方式,就是AI只是生成底图,图文中的文案内容让程序给填充上去。

但是这次的gen-ai-image这个Skill不一样,它是把完整的绘图提示词直接扔给图片大模型来生成,所以这次海报中出现的“设计生图Skill”、“把生图交给Agent”等这些文案,都是在绘图提示词中有做声明的,让文案和画面一起生成。

因为我要的并不只是一张好看的图片,而是一张完整的宣传海报,需要有产品名称、功能点介绍,要有一些能让人看懂的卖点,也需要有明确的视觉重点。

所以,在真正的生图之前,Agent给你预览的提示词,你就可以通过提示词描述的画面,来判断提示词是否有把你的绘图需求给描述清楚。

比如我希望标题可以更加醒目,那可以补充:

“设计生图Skill” 使用大号中文字体,位于画面的中央上方,占据明显的视觉位置。

如果我希望副标题不要做显眼包,那可以加上:

“把生图交给Agent”使用较小号字体,放在标题下方,保持清晰,但是不要喧宾夺主。

这些要求都可以直接交给Agent,让它整理到绘图提示词中。

生图不满意,不要只说“再来一张”

图片生成以后,我主要会看下面这几件事:

  1. 标题是不是足够的清晰
  2. 别人能不能一眼就看明白这是一张“设计生图Skill”的发布海报
  3. 画面中有没有把重点放在了“Agent帮你生图”这件事情上
  4. 整体的画风气质符不符合“设计生图”这么件事

如果第一版,你觉得技术感太重了,像是做芯片或者是云计算产品的,那么你可以说:

减少芯片、代码和机械元素,画面更偏创意设计与图像生成,不要赛博朋克风格。

如果画面虽然好看,但是标题不够突出,也可以继续进行调整:

提高标题区域的对比度,标题背景保持干净,避免装饰元素遮挡文字。

如果是海报整个画面中央的主体元素太小了,那么就补充:

中央悬浮卡片占画面主要区域,清晰表现一张图片正在被生成。

以前绘图单单凭运气,多抽几次,总会有一次好的?但是实际上,生成的图片结果能否越来越接近预期,是取决于你能不能将你不满意的地方说的具体,但前提是你用的生图模型需要给力。

这也是Agent生图流程里面比较大的一个亮点,它可以帮你把你模糊不清的修改意见,变成一个可以直接执行的完整提示词。

用自己的Skill做自己的海报,才算一次真实的测试

我觉得这次最有意思的地方,不是AI有生成了一张多么多么好看的图,而是我用gen-ai-image这个Skill,为它自己制作了一张发布海报。

如果一个设计生图的Skill,连自己的宣传海报都没法制作出来,那么它再怎么去介绍模型、参数和能力,都会显得非常的空洞。

但是反过来,如果你只需要将你模糊的想法描述出来,Agent便可以帮助你去整理提示词,并且把你的想法一步步的指引变成可落地的提示词,那么它在日常的工作中便可以实际的排上用场了。

这个Skill比较适合的场景:

  1. 制作新产品、Skill、工具或插件的发布海报。
  2. 自媒体运营,需要生成素材配图等。
  3. 模糊想法,需要Agent帮助理清,整理提示词。
  4. 不想每次都去研究模型参数、提示词、图片尺寸的人。
  5. 已经在使用Agent,希望可以把生图接进工作流。
  6. 希望可以使用一线生图模型Nano Banana 和 GPT Image的人。

这次我使用一句需求,便做完了一张gen-ai-image的skill发布海报。

下一次,也许下一次可以试试将你的产品介绍、活动主体以及创意想法,发给它,让它帮助你把想法都通通变成可视化的图片。

好了,本文分享就到这里。如果觉得有收获,来个一键三连,这是对吾鸣持续输出的最大动力。

http://www.cnnetsun.cn/news/3972513.html

相关文章:

  • Comskip与SDL图形界面:可视化广告标记功能的启用与使用教程
  • react-use-wizard实战教程:构建带异步验证的多步骤表单
  • 思源宋体CN:7种字重的免费商用字体完整实用指南
  • hexo-theme-flexblock核心功能解析:评论系统、多媒体支持与数学公式
  • Java 对接大模型基础
  • Objective-C项目集成COSTouchVisualizer指南:兼容旧项目的触摸可视化方案
  • 如何快速部署开源AI生成平台:Open Generative AI完整实战指南
  • 终极指南:如何快速掌握KMS-Tools-Portable便携激活工具
  • 5分钟搞定本地语音合成:Piper文本转语音系统完全指南
  • Agent如何接入API?(包含work Buddy、Trae、Claude等)
  • 数据库入门:核心概念、架构与SQL实战指南
  • 如何使用Electra Jailbreak:iOS 11完美越狱的完整新手教程
  • 【单片机毕业设计】基于 OLED 与 RTC 时钟的充电桩状态显示终端开发 基于 LM393 电压检测的多路充电识别控制系统设计(017002)
  • Milvus与Dify离线部署连接问题排查与优化
  • 机械原理三维动画怎么做才专业?安徽尚格创意拆解关键技术
  • 自己用 NIO 写服务端那天,半包把一条连接挂了 40 分钟:Reactor 模型到底帮你挡了什么
  • Jellium Desktop音频增强教程:提升家庭影院体验的完整指南
  • AI 海报设计工具记录:多款海报制作工具能力边界整理
  • 提升GIF动画质量:gh_mirrors/gif1/gif的参数调优与性能优化指南
  • 013、无人机影像图传架构:低延迟低功耗的ISP与编码链路设计实战
  • 3分钟搞定字体乱码:Warcraft Font Merger终极字体合并解决方案
  • 3步掌握专业激光雕刻:免费开源工具LaserGRBL终极指南
  • SeaweedFS在Kubernetes中创建NodePort服务的实践指南
  • 数字孪生水电站建设方案:打通数据孤岛,构建面向智慧运营的新一代数字化底座
  • 香山开源处理器:从零开始掌握高性能RISC-V芯片的完整指南 [特殊字符]
  • 面向公众终端的扫码前置校验机制研究 —— 基于日常场景二维码钓鱼风险防控实践
  • SQL迁移实战:从MySQL到达梦的国产化替代指南
  • CSSG多语言格式输出:C/C++/F/UUID shellcode转换技巧
  • Ryujinx终极指南:如何快速上手Switch游戏模拟器
  • Sipdroid源码解读:从UserAgent到RtpStream的实现原理