各位同学好,这节课我们来讲解如何用 MidJourney 生成高质量的美食效果图。
首先打开 Discord,输入斜杠(/),选择 image 命令。经过长期使用 MidJourney,大家不难总结出:生成一张高质量图片的常用描述方式主要包括三部分——主体、细节 和 拍摄手法。
例如,我们现在想生成一张苹果的美食照片,提示词可以这样写:“一张关于苹果的美食照片,苹果表面有清晰可见的水滴,采用正面光拍摄,使用微距特写,是一张商业摄影作品。”
其中,“苹果”是主体,“水滴”是细节,“正面光拍摄”“微距特写”“商业摄影作品”则是对拍摄手法的描述。
将翻译好的英文提示词复制下来,回到 Discord,按 Ctrl+V 粘贴,回车发送。可以看到,MidJourney 会生成一组细节丰富、写实感强的苹果带水滴摄影效果图。
这类偏写实、细节多的图像效果,通常模型版本越高,生成质量越好。因此建议大家使用当前最新版本的 MidJourney 模型,以获得更佳效果。
如果希望画面更具视觉表现力,还可以在原有提示词基础上加入动态元素,比如“苹果切片”“水花飞溅”。将优化后的英文提示词复制粘贴到 Discord 中,再次执行 /image 命令并发送,就能得到更具张力的画面效果。这样的图像配合当下主流的图生视频工具,即可快速制作一段苹果落入水面、水花四溅的短视频素材。
接下来我们讲解生成食物类图像的提示词公式。相比水果,食物的提示词构建更复杂,因为一盘菜往往包含多种食材,还需描述盛装器皿、摆放环境等要素。
以“四川抄手”为例,在翻译软件中撰写提示词:“A Sichuan-style wonton dish, served in a brown ceramic bowl, chopsticks placed beside the bowl, red chili oil drizzled over the wontons, topped with chopped green onions and cilantro, on a wooden table, soft lighting, commercial food photography, professionally color-graded, shallow depth of field.”
注意:这里使用的是“wonton”(馄饨)而非“Chao Shou”(抄手),因为“wonton”是国际通用、更易被 MidJourney 模型识别的词汇。MidJourney 是基于大量英文标注图像训练的国外 AI 模型,对非英语母语地区的专有名词理解有限。“抄手”和“馄饨”虽有差异(抄手个头较大、皮厚;馄饨较小、皮薄),但在跨语言生成场景下,“wonton”更利于模型准确理解主体形态。
将上述英文提示词复制粘贴至 Discord,执行 /image 命令后发送,生成结果整体效果良好,既有干拌也有红汤风格,食欲感较强。但需指出的是,当前 MidJourney 版本对中国传统菜肴的理解仍存在局限,常将中式食物向西式外形靠拢——本次生成的“抄手”在外形上更接近饺子,这已是现阶段相对理想的结果。
再来看一类特殊菜名:名称与实际食材无直接关联的中国菜,如“鱼香肉丝”。它并不含鱼,而是以泡椒、葱姜蒜、糖醋等调制出“鱼香”风味的肉丝菜肴。
若直接翻译“fish-flavored shredded pork”并提交,MidJourney 很可能误判为含鱼肉的菜品,导致生成结果偏离预期(例如出现碎肉配香菜,却无胡萝卜丝、木耳丝、青红椒丝等典型配料)。
对此类菜名,推荐借助 ChatGPT 辅助生成精准提示词。在 Discord 中 @GPT,输入需求:“请为 MidJourney 写一段英文提示词,用于生成‘鱼香肉丝’的高清美食图片。请详细描述其外观特征(包括主料、辅料、色泽、摆盘等),并指定为专业食品摄影风格,含后期调色与景深效果。”
提问重点在于“详细描述外形”,确保 GPT 输出的是具象、可视觉化的英文描述,而非直译菜名。获取回复后,将内容复制粘贴至 Discord,执行 /image 命令,即可获得更贴近真实鱼香肉丝外观的图像结果。
当然,AI 生成仍存在一定偏差,建议多次尝试,从中筛选最符合认知的一版。例如某次生成结果中,左下方那盘鱼香肉丝就更接近日常所见形态。
总结来说,所有美食类提示词的基本结构是统一的:食物本身状态 + 盛装器皿描述 + 拍摄角度 + 光线设定 + 呈现风格(如商业摄影、微距、柔焦等)。其中中文菜名需特别注意术语本地化问题——当菜名无法直译或易引发歧义时,优先使用国际通用名称,或通过 GPT 获取准确、具象的英文描述,从而提升 MidJourney 的生成准确性。