拍了很多年照片,原本以为摄影的边界就是器材、光线和场地预算。直到去年我开始系统地把AIGC塞进自己的拍摄流程里,才发现以前为了找一处合适的海边日落外景满城跑、或者花大几千租影棚置景的折腾,真的可以换一种方式解决。AIGC摄影不是让你丢掉相机,而是把置景、合成、精修这三个最吃时间和预算的环节交给AI提速。这篇内容是我带AIGC摄影训练营时的完整实操记录,围绕AI置景、合成精修、多工具协同这条主线,拆解从拍摄原片到交付成片的每一步。内容适合在职摄影师、电商视觉设计师、自媒体创作者,以及想转行做AIGC应用方向的从业者参考。
1. 为什么"摄影+AI"不是简单P图,而是一条完整的新工作流
1.1 AIGC摄影到底改变了哪个环节
先明确一个概念:AIGC摄影并不是用AI直接生成一张"假照片",而是把AI当作一个虚拟置景师、合成师和修图师。传统商业摄影的一条片子,从策划到交付,最贵的往往不是拍摄本身,而是置景。租影棚、买道具、搭实景、找外景地,动辄几千上万,而且改一次方案就要重新折腾一轮。AI置景把这一环变成了"输入参数、批量出方案",十几张候选场景几分钟就能出来。
我自己这些年拍过服装、人像、美食、地产,发现真正耗时间的永远是三件事:置景、抠图合成、精修。这三件事恰好是AI目前最擅长的领域。以前一单电商服装拍摄,客户要好看又不愿意出外景费,我只能搬一堆道具去影棚硬搭,拍完再一点点修掉瑕疵。现在我的流程变成了:实拍模特原片、AI生成场景、合成精修,三件事分开处理,效率完全不同。
1.2 这套能力到底适合谁学
训练营里学员背景五花八门,我把适合学AIGC摄影的人分成了四类:
- 摄影师:给客片增加场景方案,同样的模特底片能出好几套完全不同风格的精修片,客单价和过片率都上去了。我有学员靠这套能力,把一套原本只能出"普通棚拍"的片子,扩成了"海边度假风+赛博都市风+古风庭院风"三个系列,客户当场加单。
- 电商视觉设计师:产品主图、详情页需要大量场景图,AI置景可以批量生产,不再受限于外拍和影棚档期。尤其是鞋包、服装这类需要"场景氛围"的品类,AI置景简直是为它们量身定做的。
- 自媒体创作者:头像、封面、vlog封面、直播间背景,通通可以AI生成,不用每次找场地、等光线。我自己公众号头图已经全部改用这套流程产出。
- 想转行做AIGC应用岗位的人:AIGC应用工程师、AI修图师、视觉训练师这些新出现的岗位,核心能力就是"会用工具把AI生成内容和真实摄影无缝结合",这不只是一门手艺,更是一个岗位方向。
训练营里很多学员问过同一个问题:是不是摄影基本功就不重要了?恰恰相反。AI置景生成的结果再好看,如果你不懂机位、焦距、透视、光影,合成就一定会穿帮。摄影基本功是地基,AI工具是外挂,缺一不可。
2. AI置景:从一张灰底原片开始搭建"万能场景"
2.1 拍摄环节就要为AI留好"后门"
很多学员第一次直接把以前拍的成片拿去AI置景,效果惨不忍睹。原因很简单:原片背景太复杂,人物和背景分离困难,AI重建出来的空间和人物透视对不上。我在训练营里定了一个标准:拍摄原片尽量用干净的影棚灰底或者一块纯色背景,同时记录下人物的站位、机位高度、镜头焦段。
为什么必须记录这些参数?因为AI置景的前提是空间匹配。你只有知道原片是用50mm还是85mm镜头拍的,才知道生成场景时该用什么透视关系。这里有个小经验:50mm镜头拍摄的画面更接近人眼视角,透视自然,AI场景用"50mm lens, natural perspective"这类提示词比较容易匹配;85mm压缩感强,背景会显得更近更大,AI场景如果对不上,合成后人物就像一个贴纸浮在画面上。
如果手里已经只有拍好的废片,也不是完全没救。Photoshop的"主体抠选"配合AI生成式填充,可以把复杂背景先清理成接近纯底,但边缘细节会有损伤,后期得多花时间修发丝和轮廓。所以最好的方式还是在拍摄时就预留"后门"。
2.2 生成场景时的三个关键控制项
AI置景不是写一句"海边日落背景"就完事的。想做出能用的场景,生成时就要控制三样东西:光线、透视和画幅。
光线方向。原片的高光从左边来还是右边来?是顶光还是逆光?如果你的原片是左侧晨光,生成的场景却给了右侧黄昏光,合成之后怎么调色都救不回来。Midjourney提示词里可以明确写"light from left, soft morning glow";如果用Stable Diffusion,可以通过ControlNet和提示词一起控制明暗倾向。
透视关系。这里要尤其小心。一张50mm镜头拍摄的半身人像,身后场景如果是广角大透视,人物会立刻变成"贴纸"。我给学员的方法是,用关键词"50mm lens, eye-level shot, natural perspective"锁定透视,宁可场景普通一点,也不能透视穿帮。场景进PS后还要做一次矫正:把场景里的地平线与人物脚底所在的水平线对齐,这一步放在合成最开始做。
画幅与留白。AI生成时一般会填满整个画面,但人物需要有自己的位置。提示词里加"empty center"或"empty foreground",给人物留出干净的区域。如果AI总是在画面里塞进路人、动物或者奇怪的雕塑,直接加"--no people, no human"这类负向提示,一劳永逸。
2.3 一套可以直接套用的置景提示词结构
训练营上了几天课之后,我归纳出一套固定的提示词写法,学员照着填空就行:
[画面内容] + [光线条件] + [镜头焦距] + [风格倾向] + [留白要求] + [画质词]
举两个实际用过的例子:
- 商业服装海报场景:"abandoned desert house, ruins with warm sunlight, light from right, 50mm lens, cinematic photography, empty area at center, photorealistic, 8k, highly detailed"
- 东方庭院产品图:"ancient Chinese courtyard, plum blossom branches shadow, soft diffused light, 35mm lens, clean composition, empty foreground, photorealistic, 4k"
注意一点:一定不要忘了加photorealistic或realistic photo。不加的话,很容易出来一张插画感很强的图,后期怎么调都救不回写实质感。另外,如果AI生成画面里总出现人物干扰构图,直接加"--no people, no human, no person",这个负向提示细节特别重要。我第一次做的时候AI自己生成的人物总是挤进画面,而且手部经常崩坏,加了负向提示才清净下来。
提示:置景场景宁多勿精。我一般让MJ一次出4组各4张,选1-2张构图和光线能用的,其余全部废弃。场景筛选标准很简单:透视不怪、光线方向对得上、留白够放人。满足这三条就进合成,不要贪多。
3. 合成不是拼贴:让人物"长"进AI场景里的核心手法
3.1 先对透视和比例,再谈调色
把人物从原片抠出来放进生成的场景里,第一眼要做的不是调色,而是检查比例和透视。人物脚底所在的水平面,是不是和场景里的地平线统一?人物大小和场景里的参考物(门框、汽车、树木、台阶)是否成比例?这一步在PS里用自由变换微调人物大小,必要时做轻微液化变形,让人物身体姿态符合场景透视。
训练营里有一道必作题:把一张竖构图的人物放进一张横构图的AI场景。很多学员一上来就傻眼,不知道怎么下手。我的做法是:先把场景图裁切成与原片一致的画幅,然后再放人物。宁可损失场景边缘,也不能把人物拉伸变形。人物高度、肩宽、头身比例,都必须先按原片等比缩放,再微调位置。
3.2 光影统一的三板斧
合成照之所以假,一半原因在于光线各讲各的。统一光线我一般按下面这个顺序来:
- 色温对齐。AI场景偏暖、人物偏冷,就用"匹配颜色"或Camera Raw滤镜,先把人物色温拉向场景主色调。这里不要一次拉到底,调到肤色还能保持自然即可。
- 背光与边缘光。如果场景是逆光,人物边缘也要补一圈轮廓光。用曲线配合图层蒙版,在人物边缘手动拉出高光。这一步做不做,直接决定照片是"贴在背景上"还是"站在环境里"。边缘光我习惯用柔边画笔,低流量反复涂抹,比一次性拖一个曲线好看得多。
- 环境色回染。人物脚下的地面如果是绿色草地,人物的裤脚、裙摆处也要带一点绿色反光。用"色彩平衡"或者低透明度的颜色图层给人物底部染上环境色,透明度控制在10%-30%慢慢试。
这套方法本质上是模拟光的物理反射。做得越细致,照片越可信。很多学员一上来就纠结"这个场景不够高级",其实一张合成照的高级感,很大程度来自光影的合理性,而非场景本身的复杂度。
3.3 边缘、皮肤与细节,精修的三个重灾区
- 头发丝边缘:AI生成的背景清晰度高,如果人物发丝带着白色边缘线,一眼假。我的做法是用图层的"去边"功能先处理,再用蒙版手动擦除残留白边。深色背景尤其要检查这里。
- 皮肤质感:人物如果是从手机或普通相机拍的,放进高清晰度的AI场景里,皮肤噪点会一下暴露。我用Topaz Photo AI做一次皮肤修复和降噪,强度控制在30%左右,过了就成了网络磨皮脸,完全失去质感。处理完记得在面部纹理区域(眉毛、毛孔部位)用蒙版恢复一部分原始细节。
- 细节一致性:如果AI场景里有飘落的落叶、灰尘、飞鸟,想让画面更融合,可以把背景里的元素复制到人物前方做"前景遮挡",制造前后层次。这个方法训练营半个月后几乎人人会用,出片率大幅提升。
3.4 一张海报片的前后对比拆解
训练营中段,我让学员做了一张"咖啡品牌海报",大家平常都会遇到这种主题。原片是模特坐在一张米色背景前,我加了一个AI生成的中世纪图书馆场景,深色木书架、暖黄灯光、灰尘从窗口斜射进来。
合成过程中遇到最大的问题是:人物肤色偏冷,而AI场景是暖黄为主。学员一开始只调了人物色温,还是觉得不融。后来按上面"背光与边缘光"的步骤,在人物左侧(窗口方向)补了一层金色轮廓光,又在右侧(书架阴影方向)加了一层20%的暗褐色环境色,整张片子一下子就有"坐在那里"的实感了。最后给整张画面叠了一层5%左右的胶片颗粒,把AI场景那种过度平滑的纹理感盖掉,成品放到4K屏上看也不露馅。
4. 多工具实操:Midjourney、SD、PS与Topaz的配合节奏
4.1 各工具分工:谁出场景,谁控构图,谁做精修
训练营第一天,我就让所有人记一张工具分工表:
| 工具 | 角色 | 擅长 | 短板 |
|---|---|---|---|
| Midjourney | 场景创意引擎 | 出图审美高,风格多样,适合快速出方案 | 构图控制力弱,随机性强 |
| Stable Diffusion + ControlNet | 精密置景 | 能严格控制构图、姿势、透视 | 需本地显卡,调参成本高 |
| Photoshop | 合成主战场 | 抠图、蒙版、光影、融合 | AI能力属于辅助,别当主力 |
| Topaz Photo AI / Gigapixel | 精修与放大 | 降噪、修皮肤、补像素 | 单张处理,不擅长创意 |
| Lightroom | 统一输出 | 批量色调统一、白平衡 | 不能生成虚拟内容 |
这套分工背后的逻辑很清楚:用MJ快速出场景创意,用SD处理需要精密控制的构图和透视,用PS完成人物与场景的物理合成,再用Topaz把画面质感和细节拉齐,最后用Lightroom统一交付色调。比如Topaz Gigapixel AI,它的核心价值在于把低像素原片放大到高清交付尺寸时保留细节,是出大图必备的"救场工具";Topaz Video AI则适合短片修复和画质增强,视频向的玩法以后再单独展开。
4.2 一套成片在多工具间流转的完整过程
我拿训练营里的小组作业举例:给一位模特拍一组"赛博城市夜跑"商业片。
第一步,实拍。模特站在灰背景前,用50mm镜头,侧逆光,记录下光线方向和机位高度,顺便拍一块灰卡用于校色。
第二步,PS抠图。模特从灰底中抠出,输出带透明通道的PNG,同时保留一份原底作为调色参考。注意抠图时头发丝要细修到每根都干净,不然后面合成时边缘会像锯齿。
第三步,MJ生成场景。提示词大概是这样:"cyberpunk night city street, neon lights, wet asphalt reflections, light from right-back, 50mm lens, empty center, --no people, photorealistic"。出4组16张,选2张构图和光线对得上的。
第四步,如果MJ出的构图还不够准——比如街道透视有点歪——就用SD加ControlNet的Canny模型,把一张线稿放进控制条件里,让SD严格按照线稿生成新场景,重新跑一遍。这里就体现多工具的好处:MJ给你审美灵感,SD给你工程精度。
第五步,PS合成。先调比例再调色,用曲线给人物补边缘光,确认人物脚底的倒影和场景里地面的反光一致。
第六步,Topaz Photo AI做降噪和皮肤修复,再用Gigapixel放大到交付尺寸。
第七步,Lightroom统一整套片的色调和颗粒,输出。
全程下来,一张成片从原图到交付大概40分钟到一个小时。同等质量的纯人工合成精修,没有半天下不来。而且方案可以从MJ批量出,客户选片的空间大得多,这也是这套工作流在商业上很占便宜的地方。
4.3 训练营学员最爱问的"哪台电脑才跑得动"
这里必须说实话。如果只跑Midjourney和Photoshop,任何一台能带得动PS2023的电脑都够用,AI的部分都发生在云端,本地几乎不吃性能。但如果你要跑本地Stable Diffusion,显卡显存8G是最低门槛,建议12G以上。12G可以跑常规人像场景,16G以上可以带ControlNet加高清放大。训练营里我用的是3060 12G笔记本,普通项目完全够用。如果你是Mac用户,优先用云端GPU平台跑SD,不然本地出图速度会让你怀疑人生。另外,SSD硬盘和32G内存这两个配置容易被忽略,SD出图过程中临时文件读写频繁,这两个配件直接决定你的耐心程度。
4.4 效率进阶:批量化交付的流程设计
多工具配合一旦跑顺,下一件事就是批量化。训练营后半段,我给学员布置了一个进阶任务:同一套模特原片,批量产出10张不同场景的海报图。流程是:
- 先把10张原片统一抠图,导出PNG序列;
- 写好20组场景提示词,MJ批量生成;
- 筛选构图能用的场景,PS中一张张合入人物;
- 最后用Lightroom预设统一输出。
这一套下来,10张成片大约需要半天时间。单人工作室完全可以支撑起"一天接一单AI视觉外包"的节奏。我给几个学员算过账,他们从训练营结束后接电商主图外包,单张根据场景复杂度报价,一个月下来基本能覆盖生活成本。
5. 实操作业最常翻的5个车,以及对应排查思路
5.1 人物像"贴纸":透视和比例问题
这是训练营里出现频率最高的问题。症状:人物的轮廓很干净,但借位感极强,像一张高清贴纸贴在照片上。根因基本是透视不对。排查顺序:先看地平线,人物脚底与场景地面是否在同一水平高度;再看头部大小,和场景里的门框、汽车、树木比对是否合理;最后确认镜头的畸变方向是否统一。多数情况下,缩一下人物、把地面水平线对齐,问题就解决了。
5.2 脸是亮的,背景是暗的:色温没统一
这不是调色差的问题,而是"全局光"没有匹配。AI场景如果是阴天漫射光,人物的脸上却带着硬朗的阳光投影,怎么拉都别扭。最简单的检查办法:把人物图层和背景图层都转成黑白,看两者高光、中间调、阴影的分布方向是否一致。方向对了再调色相,方向错了先改光源。我训练营里几乎每天都有学员卡在这一步,转黑白检查这个招,大家学了都说值。
5.3 AI置景颜色太"AI":失真感从哪来
很多学员生成的场景一眼假,不是因为细节不清晰,恰恰是"太清晰"了。AI生成图普遍有过度锐化的倾向,放到全尺寸看会带一种轻微的"塑料感"。我的处理方式:场景图进PS后先做一次轻微高斯模糊,0.5-1像素,再做智能锐化,这一招能消掉很大一部分"AI味"。
另外,整张成片可以叠一层胶片颗粒,掩盖AI生成图那种过度均匀的纹理。颗粒别加在人脸上太多,强调皮肤质感的区域会受影响。做商业交付时,颗粒浓度控制在3%-8%之间最为稳妥。
5.4 换了平台,AI图被标"疑似AI生成"
这是个合规和交付层面的坑。现在不少社交平台会为AI生成内容打标识,一些客户和图库平台也有相应要求。如果做商业交付,我建议在合同里注明"部分场景为AI生成",交片时附上置景用到的提示词、原始素材和处理记录。这不是给自己找麻烦,而是把制作流程留档,客户清楚每个环节的来源,合作会顺畅很多。
5.5 作品集里全是AI图,面试反而减分
训练营最后一天是作品集评审,我发现一个有意思的现象:作品集里放的全套AI图,面试官反而不太买账。后来大家调整策略,每套作品都保留实拍原片、抠图过程截图、AI场景生成记录和最终成片,展示的是"我可以控制AI,而不是被AI控制"。这个思路,比单纯展示十张好看的AI图有说服力得多。还有学员把整套制作过程的耗时、成本也写上去,向客户展示投入产出比,签约率提升了不止一倍。
6. 训练营外的思考:AIGC摄影怎么在真实市场中变现
6.1 商业端:电商、广告和自媒体最认什么
在真实市场上,客户不会因为"用了AI"就给你加钱,他们只关心结果。我用下来最容易被认可的几个方向:
- 电商服装、鞋包主图:同一件商品翻出十个风格场景,测图成本极低,款式决策空间大。
- 模特图场景替换:客户原片背景杂乱,AI置景成极简棚、街头、度假风,一组片变三组片。
- 综艺海报、短视频封面、直播背景板:这类内容需要频繁换场景,AI出方案效率优势明显。
- 本地生活商家:一家餐厅没有海景露台,用AI置景出一张"海边露台美食大片",商家愿意为这种"卖点前置"买单。我有个学员接了几家本地咖啡馆的订单,就是用这套逻辑谈下来的。
6.2 训练营毕业之后,实际岗位和市场机会
训练营学员经常问,学完AIGC到底能找什么工作。我按真实观察整理了一下:
| 方向 | 市场需求 | 核心技能 |
|---|---|---|
| AI修图师 | 电商、影楼需求量大 | PS精修 + Topaz系列 |
| AIGC视觉设计师 | 广告、游戏、直播 | MJ + SD + 合成 |
| AIGC应用工程师 | 企业批量流程搭建 | SD工作流 + 脚本基础 |
| 自媒体素材生产者 | 短视频、图文内容 | 全流程单人交付 |
宣讲这些岗位时我会强调:专业技能只是入场券,最终变现能力还是取决于作品集和交付速度。训练营结束时能独立完成一套全流程作品的学员,找工作的反馈普遍好于只拿着零散AI图的学员。
6.3 关于版权的最后提醒
AIGC摄影这块目前处于快速演变期,版权问题很敏感。我自己的原则是:
- 商用场景图尽量用Midjourney的付费商业授权方案,并保存每次生成记录和提示词备份。
- 人物素材一定来自自己实拍或已获授权的素材库,绝不直接拿网上的照片丢给AI处理。
- 给客户交付时,主动说明哪些环节由AI完成、哪些是实拍素材。多数客户不但不会反感,反而更信任你的专业度。
这套流程我带了好几期训练营,也亲手改过上百份学员作业。说实话,AIGC摄影的门槛比你想象的低,天花板比你想象的高。低在工具已经很顺手,高在光线、构图、透视和视觉审美上的积累,最终决定一张合成片是"作品"还是"事故"。如果你手里正好有一些实拍原片,建议今天就从一张最简单的灰底人像开始,按文中的置景公式生成十个场景,挑两张合成看看。跑通一遍全流程,你对"AI到底能帮我省多少时间"就有了具体的体感,接下来怎么输出、怎么变现,思路自己就会冒出来。