Floniks
返回博客
教程10 分钟阅读

让 AI 夏日泳装照片像真抓拍:一套 39 条 skill 的八条精华

我们把一套流传很广的 39 条夏日泳装抓拍提示词 skill 提炼成八条规则——一帧、一个事件、一台具名相机、真实皮肤、生活痕迹、摄影式不完美、角色 DNA 转译——并在 Floniks 上用五个图像模型和一个视频模型跑出结果,附可复制的提示词骨架与模型对比。

作者: Elena Park
让 AI 夏日泳装照片像真抓拍:一套 39 条 skill 的八条精华

为什么大多数 AI"夏日照片"看着假,以及修好它的那套 39 条 skill

大多数 AI 生成的海边、泳池图片,失败方式都一样:人在摆姿势,皮肤像瓷器,地平线绝对水平,光是柔光箱假装的太阳,所有人都盯着一台没人拿着的相机。它读起来是渲染,不是照片。本文拿一套广为流传的、由提示词作者 @94vanAI 撰写的 39 条夏日泳装抓拍提示词 skill,把它提炼成八条真正记得住的规则,并展示我们在 Floniks 上用五个图像模型和一个视频模型跑出来的结果。

快速答案: 想生成一张像是朋友相册里随手抓拍的夏日泳装照片,就描述一帧、一个事件、一台相机:一个仍在发生的瞬间(泼水、起跳、眯眼躲太阳),由旅伴用一台你叫得出名字的相机拍下(35mm 胶片、90 年代傻瓜机、一次性相机、2000 年代 CCD、早期手机),28–40mm 镜头,腰部或泳池边缘的高度。坚持要真实皮肤、至少一种水元素、有生活痕迹的杂物,以及摄影式的不完美——歪一点的地平线、被裁掉的手臂、镜头上的水珠——同时禁止生成式的瑕疵。在 Floniks 上,把它贴进 AI Image,选 Seedream 5.0 Pro 或 Nano Banana 2,生成即可。

黄金时刻的屋顶泳池,两位朋友正在泼水,Seedream 5.0 Pro 的 35mm 胶片质感
黄金时刻的屋顶泳池,两位朋友正在泼水,Seedream 5.0 Pro 的 35mm 胶片质感

Seedream 5.0 Pro,16:9。一个事件(泼水),没人看镜头,前景一条被裁掉的手臂,镜头上有水珠。整套方法都在这一帧里。

这套 skill 从哪来,我们保留了什么

原文是一篇 X Article,标题为「未审核版抓拍skill(泳装篇)」,2026 年 9 月发布。篇幅很长:39 个编号章节,从"一次调用只出一张图"的硬规则,一直讲到湿发程度该如何取决于主体刚刚做了什么。它自己的概括是私人相册感 × 夏季旅行感 × 亲密视角 × 自然抓拍感

我们读完了全部 39 节,保留了其中的摄影部分。我们刻意没有沿用的,是"未审核"这个包装。本文以及所有示例里的主体都是穿普通度假泳装的成年人,相机属于旅途中的朋友,每张图都经过了与 Floniks 上任何生成内容相同的审核。这套 skill 有意思的地方从来不在泳装,而在于那组让画面看起来是拍出来的而非渲染出来的规则——它们可以迁移到你想做的任何抓拍:街头、旅行、家庭、产品使用场景。

真正起作用的八条规则

39 节可以压缩成八条指令。提示词覆盖了这八条,结果就像照片;漏掉两三条,就像 AI。

  1. 一帧、一个场景、一个瞬间。 明确说出来:一张单独的照片,不要拼贴、不要九宫格、不要分镜。一提到"抓拍"或"快照",模型就爱给你一张联络表。
  2. 一个核心事件,仍在发生。 还没落下的水花。还没入水的起跳。说到一半的笑。画面里所有人都对同一个事件做出反应;没人摆姿势,没人看镜头——除非事件本身就是"她刚发现朋友在偷拍"。
  3. 一台你叫得出名字的相机。 每张图只选一种媒介,描述它的指纹:35mm 彩色胶片(颗粒、光晕、暖肤色)、90 年代傻瓜机(暗角、对焦失误)、一次性相机(直闪、高光过曝、日期戳)、2000 年代 CCD 数码相机(彩色噪点、偏冷的白)、早期手机(软、噪、眩光)。
  4. 28–40mm,人的高度。 skill 对此很具体:28、35 或 40mm 镜头,由坐在礁石上或站在水里的人,在腰部、胸口或泳池边缘的高度手持。不是 85mm 人像镜头,不是无人机,不是架在视线高度的三脚架。
  5. 真实皮肤,真实的水。 毛孔、汗毛、不均匀的晒痕、一点晒红、肩上的水珠,湿发状态要符合刚发生的事(游完泳全湿,擦过毛巾后半干)。点名禁止塑料皮肤、娃娃皮肤、CGI 皮肤和美颜滤镜。
  6. 有生活痕迹的环境。 用过的浴巾、两杯冰饮、一瓶防晒霜、湿拖鞋、被踩乱的沙。几件就够,不是商品陈列。
  7. 摄影式的失误,绝不要生成式的。 非中心构图、略微倾斜的地平线、被画框裁掉的手臂、脚上的运动模糊、镜头上的水滴、眩光。并且在同一句里写上:解剖正确、五根手指、肢体不融合。模型需要知道哪些不完美是欢迎的,哪些不是。
  8. 转译角色 DNA,不要贴戏服。 对于 COS 灵感的照片,skill 最有用的想法是角色灵感泳装转译:把角色的配色、剪裁和图形语言,变成真人买得到的泳装,穿在一位戴真假发、有真皮肤的成年 COSER 身上,在真实的海滩上,而不是在角色的原作世界里。

如果你读过我们的 商品摄影提示词 指南,会认出同一个模式:好提示词和绝佳提示词的差别,很少在于更多形容词,而在于把模型原本要靠猜的约束点名说出来。

提示词骨架

这是八条规则的填空卡片。下面每个示例都由它写出。

[ONE FRAME]  A single candid summer travel photograph with a private-album feel.
             One photo, one frame, one scene, one moment. No collage, no grid.
[WHO]        <N> adult(s) in their twenties, friends on a trip.
[EVENT]      One core event, mid-action: <who is doing what to whom>. Everyone
             reacts to it. Nobody looks at the camera.
[WARDROBE]   Ordinary vacation swimwear, a different silhouette per person: <…>.
[SKIN+WATER] Real skin: pores, fine hair, uneven tan, droplets. Wet hair that
             matches what just happened. At least one water element.
[PLACE]      <scene> with lived-in traces: <towel, drinks, sunscreen, wet tiles>.
[CAMERA]     Shot by a travel companion from <waist / pool-edge / sitting> height
             on <35mm film | 90s compact | disposable | 2000s CCD | early phone>,
             28–40mm lens, <light: golden hour / midday haze / dappled shade>.
[IMPERFECT]  Off-center framing, slight tilt, cropped arm, flare or a droplet on
             the lens. Photographic mistakes only — correct anatomy, five fingers.

五个结果,五个模型

我们把骨架在 Floniks 的五个文生图模型上各跑了一遍,每次换一台相机、换一个事件,这样你能看出这种质感有多少来自提示词,有多少来自模型。

礁石海湾里一位女性眯眼躲太阳,半干的头发,带日期戳的 90 年代傻瓜机胶片质感,Nano Banana 2
礁石海湾里一位女性眯眼躲太阳,半干的头发,带日期戳的 90 年代傻瓜机胶片质感,Nano Banana 2

Nano Banana 2,3:4。规则 3 的实例:90 年代傻瓜胶片机、暗角、左上角漏光、日期戳。事件很小——眯眼、说到一半笑出来——这正是它读起来像抓拍的原因。

一位女性从木码头跃入林间溪潭的半空瞬间,一次性相机的闪光质感,画框边缘有朋友的手,GPT-Image-2
一位女性从木码头跃入林间溪潭的半空瞬间,一次性相机的闪光质感,画框边缘有朋友的手,GPT-Image-2

GPT-Image-2,2:3。过渡姿势(屈膝、张臂、还没入水),树荫下生硬的直闪,日期戳,以及画框边缘作为第一视角证据的拍摄者的手。五个模型里,GPT-Image-2 对"一次性相机"的要求执行得最字面。

湖边码头上的三位朋友,对其中一人被推下水做出反应,早期手机质感,Nano Banana Pro
湖边码头上的三位朋友,对其中一人被推下水做出反应,早期手机质感,Nano Banana Pro

Nano Banana Pro,3:2。多人规则:一个事件(推人),三种不同反应,三种不同的泳装剪裁,不对称站位——一人近景被裁、一人中景、一人躲在柱子后——没有人看镜头。

角色 DNA 转译:前后对比

skill 的 COS 章节是模型选择影响最大的地方。我们用同一条提示词——一个原创科幻飞行员角色、银色假发、藏青-白-橙配色转译成连体泳衣、海滩屋外淋浴、2000 年代 CCD 质感——跑了两个模型。

海滩淋浴下的 COS 灵感照片,皮肤像娃娃、脸是动漫脸,Seedream 4
海滩淋浴下的 COS 灵感照片,皮肤像娃娃、脸是动漫脸,Seedream 4

Seedream 4。配色转译成功了,但皮肤正是规则 5 禁止的样子:光滑、无毛孔、一张渲染出来的脸。另外注意画幅比例被忽略了——这个模型期望的是尺寸参数,而不是比例。

同一条 COS 灵感提示词,真实皮肤、湿的假发纤维和 CCD 彩色噪点,Seedream 5.0 Pro
同一条 COS 灵感提示词,真实皮肤、湿的假发纤维和 CCD 彩色噪点,Seedream 5.0 Pro

Seedream 5.0 Pro,同一条提示词。真实皮肤、湿透的合成假发纤维、镜头上的水滴、偏冷的 CCD 白。仅凭配色角色依然认得出——这正是"转译 DNA 而不是贴戏服"的全部意义。

结论可以推广:提示词决定上限,模型决定你离上限多近。就这种风格而言,Seedream 5.0 Pro 和 Nano Banana Pro 在皮肤上最可靠;Nano Banana 2 性价比最高;GPT-Image-2 对相机瑕疵的指令最听话。

让它动起来

一张仍在发生的抓拍,天然就是视频的首帧——事件已经在半空中,模型只需要把它做完。我们把屋顶泳池那张图拿进 AI Video,用 Kling 2.6 生成五秒、720p、16:9,只要求一件事收尾:水花落下、笑延续、手持相机自己飘一下。

Kling 2.6,五秒,以屋顶那张静帧为首帧。一个事件收尾——不剪辑、不推拉,相机仍在朋友手里。

动态提示词比图片提示词短得多,而这正是关键。静帧里已经写好了服装、光线、镜头和场地;再重复一遍,等于请模型重新渲染这个场景,而不是让它动起来。只描述变化的部分:

[CONTINUE]   延续画面里已经在发生的瞬间,不要重新摆布。
[MOTION]     <那一个事件的收尾:水花落下 / 她笑着转开脸>。
[BODIES]     重心自然转移,头发与水珠有跟随惯性,没有人定住不动。
[CAMERA]     手持,仍在同一位同伴手里。轻微漂移与呼吸感。
             不剪辑、不推拉、不环绕、不慢动作、不换机位。
[HOLD]       服装、光线、场地与胶片质感与首帧完全一致。

三件事决定它读起来是「会动的照片」还是「AI 片段」:

  1. 一个事件,且是收尾。 五秒装得下一个动作的尾巴,装不下一串动作。「她跳下去、游到池边、爬上来」是三个事件,结果必然是剪切或形变。
  2. 不要出现朋友做不出来的运镜。 环绕、升降、顺滑推轨是「一眼 AI」的最快途径。手持的轻微漂移本身就是这个风格。
  3. 把描述交给静帧。 如果你把泳装和光线又写了一遍,你要的就是一个「碰巧长得像首帧」的新场景。

建议从自己最满意的静帧起步,而不是从文字起步:AI Video 支持上传图片作首帧;在工作流里,imageGeneration 节点可以直接接进 videoGeneration 节点的关键帧端口——一次运行就能把一句话简报做成成片。

在 Floniks 上跑这套方法的四种方式

  • 直接用模板,什么都不用配。 我们把这八条规则的骨架打包成了一个公开工作流:Candid Summer Snapshot。写一句话描述你想要的画面,它会自动套进骨架并用 Seedream 5.0 Pro 出图。只想要结果的话从这里开始。
  • 一次生成,用你自己的提示词。 打开 AI Image,选 Text to Image,贴入填好的骨架,选模型和画幅,生成。上面所有示例都是这样做的。
  • 做成工作流里可复用的 skill。工作流编辑器 里,把八条规则卡片放进一个 text-to-text 节点作为提示词优化器,喂给它一句话简报("两位朋友,屋顶泳池,黄金时刻,35mm 胶片"),再把输出接到文生图节点。把图像节点复制到多个模型上做 A/B,或者一次跑完整趟旅行的所有场景。这和我们的 工作流与一次性提示词 指南是同一个模式。
  • 从 agent 调用。 这里的一切都可以通过 Floniks MCP 服务 触达:list_model_aliases 选模型,single_task 生成,get_task 取结果,publish_task 放到分享页。本文的配图正是这样产出的。

常见问题

是什么让 AI 夏日照片看起来真实而不是渲染的? 三件事起了大部分作用:一个仍在发生的事件而不是摆姿势,一台有自己指纹(胶片颗粒、直闪、CCD 噪点)的具名相机,以及倾斜地平线、被裁手臂这类摄影式不完美,同时明确禁止多手指这类生成式瑕疵。

这种抓拍胶片质感,Floniks 上哪个模型最合适? Seedream 5.0 Pro 和 Nano Banana Pro 的皮肤与水最可信。Nano Banana 2 是迭代时性价比最高的。GPT-Image-2 对直闪、日期戳这类相机瑕疵指令执行得最字面。

我需要把整套 39 条 skill 都写进提示词吗? 不需要。本文的八条骨架已经覆盖了会改变结果的部分。长提示词大多在重复自己;关键是画框、事件、相机、皮肤、环境和不完美各自被清晰地说过一次。

可以用真人的参考照片吗? 可以,通过 AI Image 页面的 Image to Image。给参考图一个职责——身份、姿势、构图或色彩——并在提示词里说明。原 skill 的建议是:参考图只约束它负责的那部分,绝不约束整张画面。

这只适用于泳装吗? 不是。泳装篇只是这套 skill 发布时的载体,每条规则讲的都是抓拍摄影本身。换掉服装和场景,同一个骨架能产出可信的街头、徒步、家庭或产品使用快照。

生成会扣积分吗?失败了怎么办? 会,每个模型在运行前都会显示积分成本,失败的生成会自动退款。Floniks 的积分永不过期。

试试看

复制骨架,填上一个事件和一台相机,打开 AI Image。然后用两个模型做同一张图,看皮肤。这个对比教给你的抓拍 AI 摄影知识,比任何形容词清单都多。

标签

#tutorial#prompt-engineering#ai-photography#film-look#text-to-image#model-comparison

相关文章

AI 夏日抓拍照片提示词:像真的一样 | Floniks