当前位置: 首页 > news >正文

AI画家助手:OpenClaw+GLM-4.7-Flash自动生成Midjourney提示词并管理作品

AI画家助手:OpenClaw+GLM-4.7-Flash自动生成Midjourney提示词并管理作品

1. 为什么需要AI画家助手?

去年我开始尝试用Midjourney进行艺术创作时,遇到了两个头疼的问题:一是提示词(prompt)优化需要反复调试,二是生成的作品散落在不同频道难以管理。每次想找三个月前画过的那张星空图,都得翻上半小时聊天记录。

直到发现OpenClaw这个开源自动化框架,配合GLM-4.7-Flash模型的自然语言理解能力,我搭建了一套个人创作流水线。现在只需要用自然语言描述创意雏形,系统就能自动生成多个版本的Midjourney提示词,并将最终作品按主题分类存档。这套方案特别适合独立创作者和小型工作室,下面分享我的具体实现过程。

2. 环境准备与核心组件

2.1 硬件配置建议

我的工作设备是M1 MacBook Pro(16GB内存),实测运行GLM-4.7-Flash量化版时,生成单个提示词约消耗3-5秒。如果使用Windows系统,建议配备NVIDIA显卡以获得更好性能。以下是关键组件:

  • OpenClaw框架:负责任务调度和自动化执行
  • GLM-4.7-Flash模型:处理自然语言理解和提示词优化
  • Midjourney Discord Bot:实际图像生成接口
  • 本地文件系统:用于作品归档管理

2.2 快速部署GLM-4.7-Flash

通过CSDN星图平台获取GLM-4.7-Flash的Ollama镜像后,用以下命令启动服务:

ollama pull glm-4.7-flash ollama run glm-4.7-flash --port 11434

模型服务启动后,我们需要在OpenClaw中配置模型端点。编辑~/.openclaw/openclaw.json文件,在models部分添加:

"providers": { "glm-flash": { "baseUrl": "http://localhost:11434", "api": "openai-completions", "models": [ { "id": "glm-4.7-flash", "name": "GLM-4.7-Flash Local", "contextWindow": 32768 } ] } }

3. 构建提示词优化流水线

3.1 核心工作流程设计

整个系统的工作流程分为三个阶段:

  1. 创意输入:用自然语言描述创作意图(如"想要赛博朋克风格的城市夜景,有霓虹灯和全息广告")
  2. 提示词优化:GLM-4.7-Flash生成多个风格的Midjourney提示词版本
  3. 作品管理:自动将生成图片按主题/日期分类存储

3.2 关键技能配置

安装OpenClaw的MJ技能包:

clawhub install midjourney-helper

然后在技能配置文件中设置Discord凭证和存储路径:

{ "midjourney": { "discordToken": "你的Discord Token", "channelId": "你的频道ID", "savePath": "~/Documents/MJ_Artworks" } }

4. 实战:从创意到成品的全过程

4.1 创意输入阶段

在OpenClaw的Web控制台输入:

我想创作一幅东方奇幻风格的水墨画,主题是"月下竹林与剑客",希望保留传统水墨的留白韵味,同时加入些现代元素

4.2 自动生成的提示词示例

GLM-4.7-Flash会输出多个优化版本,例如:

  1. 传统风格版
    Chinese ink painting of bamboo forest under moonlight, a swordsman in traditional hanfu standing on the rocks, misty atmosphere, monochrome with subtle color accents, empty space composition, by Wu Guanzhong --ar 16:9

  2. 现代融合版
    Cyberpunk x Chinese ink painting, neon-lit bamboo forest with holographic calligraphy, futuristic ronin with energy sword, digital ink brush strokes, by Jamie Hewlett and Qi Baishi --v 6

4.3 作品管理与检索

所有生成图片会自动保存在预设目录,按主题/日期分类。OpenClaw还会生成元数据文件记录提示词和生成参数:

MJ_Artworks/ └── 水墨剑客/ ├── 2024-05-20/ │ ├── traditional_version.jpg │ ├── modern_version.jpg │ └── metadata.json └── theme_description.txt

5. 踩坑与优化经验

5.1 提示词质量控制

初期发现部分生成提示词效果不稳定,通过以下方法改进:

  1. 在GLM-4.7-Flash的system prompt中加入Midjourney的官方风格指南
  2. 对输出结果设置质量检查规则,过滤掉包含冲突描述的词组
  3. 建立个人偏好词库,优先使用已验证有效的艺术风格关键词

5.2 文件管理优化

原始方案会遇到文件名冲突问题,改进措施包括:

  1. 采用时间戳+哈希值的命名规则
  2. 自动生成缩略图预览目录
  3. 添加CLI工具快速搜索作品:
mj-search --theme "水墨" --date "2024-05"

6. 创作效率提升对比

使用这套系统后,我的创作流程发生了明显变化:

  • 提示词迭代速度:从手动调试的20-30分钟/版,缩短到自动生成多个版本共2-3分钟
  • 作品找回时间:从平均15分钟搜索,变为10秒内精准定位
  • 创意实验成本:敢尝试更多风格组合,因为试错成本大幅降低

最惊喜的是系统会记住我的风格偏好。当第三次生成"赛博朋克+水墨"主题时,自动给出的提示词已经非常接近我想要的效果。


获取更多AI镜像

想探索更多AI镜像和应用场景?访问 CSDN星图镜像广场,提供丰富的预置镜像,覆盖大模型推理、图像生成、视频生成、模型微调等多个领域,支持一键部署。

http://www.cnnetsun.cn/news/1481445.html

相关文章:

  • 效率向|小成本做大项目,VP+三易串口屏是秘密武器
  • 【ETestDEV5教程26】通信协议管理之动态属性
  • OpenClaw多模型切换:Qwen3.5-4B-Claude与本地Llama3混用方案
  • 如何构建算法面试知识体系:从数据结构到系统设计的完整攻略
  • Duix Mobile:构建全离线实时数字人交互的突破性方案
  • JAVA旅行攻略旅游手册旅行搭子系统源码支持小程序+公众号+APP+H5
  • 为什么高端耳机都是开放式?2026十大开放式耳机入手推荐
  • OpenClaw版本升级:GLM-4.7-Flash兼容性测试指南
  • Spring Boot 3 项目中接入国内外主流 AI 大模型(Qwen、DeepSeek、GLM、Kimi、豆包、Minimax 及国外模型),适配优先级选择
  • 隐私优先方案:OpenClaw+nanobot本地化邮件处理助手
  • STM32与毫米波雷达的非接触健康监测系统设计
  • 3大突破:让中医药AI技术走进基层医疗
  • GEO 合规场景下技术革新的价值重构:从合规约束到竞争优势
  • OpenClaw权限管理:Qwen3-VL:30B在飞书中的访问控制实践
  • OSEK-NM直接网络管理一:逻辑环构建与状态机解析
  • 【deepseek】pcie 12v 和3.3v 上电时序
  • 用Python从零实现带遗忘因子的递推最小二乘法(附完整代码与调参指南)
  • 无需本地GPU:星图平台OpenClaw镜像+百川2-13B云端体验指南
  • 嵌入式MCU轻量级命令行工具nr_micro_shell解析
  • 颠覆式音频编辑:Audacity AI插件的OpenVINO技术应用指南
  • C语言单元测试框架CuTest设计与实现详解
  • Zeek流量分析实战:从PCAP解析到自定义脚本开发(含flowN/flowmeter配置)
  • C++内联函数:彻底搞懂引用内联函数的核心用法
  • GitLab中解除默认保护并删除主分支的完整指南
  • 广东大巴模式影响内陆,各地都出现低价大巴,与高铁、绿皮抢客,低价出行惠民
  • 英特尔Linux处理器微码更新:保障系统安全与稳定的关键指南
  • Win10蓝牙接收文件失败?22H2版本最新解决方案(附自动接收设置)
  • 从零到国三:常州工学院Robocon团队的逆袭之路
  • 企业级微信自动化框架:WeChatFerry的技术实现与商业价值分析
  • Polars 2.0清洗效能天花板在哪?我们用金融/电商/物联网三大行业真实数据集压力测试后,终于敢说这句话