把CAD图纸或手绘线稿丢给AI,十分钟内拿到一张带真实光影和材质的效果图,这件事如今已经不再新鲜。过去出一张室内方案图,要建模、贴材质、打灯光、渲染、后期,少则三四个小时,多则一整天;现在只要工具链搭得对,一个下午就能交齐三套风格的方案。
动手之前,先把工具的角色分清楚
目前市面上能做效果图的AI工具不少,但真正能用到项目里的,其实就是这么几类:
Midjourney 适合做概念阶段的灵感探索。它出的图构图讲究、审美在线,但有个致命弱点——没法精确控制布局。你让它画一个客厅,沙发在左边还是右边全看它心情。所以行内常见做法是拿它跑风格参考,不拿它出最终图。
Stable Diffusion(本地部署,配ControlNet插件) 才是出交付级效果图的主力。它免费、可控性强,配合ControlNet可以严格约束空间结构,不至于出现墙体歪斜、门窗错位这种低级错误。对显卡有一定要求,RTX 3060起步,显存越大越从容。
ComfyUI 是节点式的工作流工具,上手门槛比WebUI高,但一旦搭好节点,可以反复复用同一套流程,适合接单量大的设计师。
SketchUp + AI插件、D5 Render 这类传统建模软件也开始内置AI功能,用来把AI生成的二维图转成能用于施工的三维模型。
不想折腾本地部署的话,Leonardo.ai、RoomGPT、PromptRender这些在线工具也能应付简单需求,只是可控性打了不少折扣。
实际项目里,比较成熟的搭配是:Midjourney找方向,Stable Diffusion细化,SketchUp或Blender修正结构,D5或传统渲染器出最终交付图。这套组合拳跑下来,比纯手工快三倍不止。
从图纸到效果图,完整跑一遍流程
假设你手头是一张CAD导出的户型平面图,客户要求两天内出三套不同风格的3D效果图。传统做法光建一个厨房柜体就要半天,AI介入后这套路径可以压到三小时以内。
第一步,图纸预处理(15分钟)
拿到CAD平面图别直接丢给AI,先在CAD里关闭所有标注层和尺寸层,只留墙体、门窗、柜体轮廓,导出成PNG,分辨率建议2000像素以上。如果层高、梁下高度这些关键尺寸对方案有影响,在图片角落用文字标出来,比如”层高2800mm”。
用Photoshop或免费的GIMP把图调成白底黑线:图像-调整-阈值,参数设为128。这一步是为了让AI能清晰读出线条。
第二步,ControlNet锁住空间骨架(15分钟)
打开Stable Diffusion WebUI,展开ControlNet面板,把处理好的平面图拖进去:
Preprocessor(预处理器)选Canny(边缘检测),它能提取出清晰的轮廓线,让AI严格按照你的线稿生成
Canny低阈值100,高阈值200,先用默认值
Control Weight(控制权重)设1.0到1.2,越高越严格遵循原始结构
Starting Control Step设0.1,让它在生成早期就介入锁定结构
如果是手绘草图,Canny偶尔会识别不干净,换成Scribble模式更宽容;画建筑外立面或直线结构多的场景,MLSD(多线段检测)比Canny更准。
基础参数方面:采样器选DPM++ 2M Karras,步数25到40,CFG Scale 7到9,尺寸和线稿比例保持一致。
模型(Checkpoint)推荐Realistic Vision V5.1或DreamShaper XL,这两个对室内空间的理解最准。
第三步,先出”骨架图”,别急着出风格
第一次生成时,正向提示词写得朴素一点:
interior design, empty room, white walls, wooden floor,
perspective view from entrance, natural lighting,
architectural visualization, 8k, photorealistic
负向提示词:
low quality, blurry, distorted perspective, furniture,
decorations, people, text, watermark
这一步出来的是一张带透视关系的空房间。它的作用是验证AI有没有理解对空间结构——如果发现墙歪了、门窗位置不对,把ControlNet权重调到1.5,或者改用MLSD模式重来。
第四步,风格化迭代(30分钟)
骨架没问题后,才轮到风格上场。改写提示词,加入风格、材质、灯光的具体描述,重新生成。也可以把骨架图上传到Midjourney,作为image prompt让它做美化。
同一张线稿,换三组提示词,就能出轻奢、原木、侘寂三种风格,给客户对比选方向。
第五步,局部修改和细节微调(30分钟)
AI一次出图很难十全十美。整体满意但某个细节不对——比如地毯颜色太跳、柜门样式错了——用Stable Diffusion的Inpainting功能,框选那块区域,单独输入新的材质提示词,只改这一处,其他部分不动。
想换整体风格的话,做风格迁移;想只换家具材质的话,用蒙版局部重绘。Inpainting的Mask blur设4左右,太低边缘生硬,太高会糊。
第六步,导入建模软件核对结构(20分钟)
AI生成的图终究是二维的,不能直接用于施工。把它导入SketchUp当参考图,照着拉墙、放家具,遇到不确定的尺寸用插件估算。模型和AI图的匹配度能到七成以上。
对透视要求高的项目,可以先用Blender的Grease Pencil画出墙面、地面、天花板的边界线,用”Camera to View”功能匹配透视,确保线条对齐再继续,这一步能避免后期渲染出现”墙在奇怪位置”的问题。
提示词怎么写,才是决定出图质量的关键
很多新手把提示词当成堆砌关键词的填空题,结果出图千篇一律。真正有效的提示词是有结构的。
一个可以反复套用的公式是:空间类型 + 具体材质 + 光照(方向+时段) + 环境 + 相机角度 + 渲染质量。
比如室内设计:
Japandi living room, white oak floors, linen modular sofa,
low travertine table, soft morning light from the left,
eye-level wide-angle view, photorealistic architectural
visualization
建筑外立面的话,把家具换成立面材质:
Modern tropical villa, natural stone walls, teak soffits,
floor-to-ceiling glass, late-afternoon raking light,
three-quarter street view, relaxed resort mood,
photorealistic
实操要点:
词序就是权重。 扩散模型对提示词开头的词更敏感。材质对你这个方案重要,就把材质写前面;灯光重要,就把灯光前置。
具体永远胜过笼统。 “清水混凝土”不如”板成型混凝土,带可见拉结孔”——后者在训练数据里有对应的视觉特征,AI能准确复现;前者太模糊,每次出来的效果都不一样。
材质写品牌名或具体品类。 “瓷砖”不如”卡拉拉白大理石纹瓷砖、600×1200规格、亚光面”。AI见过这类描述的图片,脑补得更准。
灯光必须写方向和时段。 “soft morning light from the left”比”natural lighting”好得多。黄昏、正午、傍晚的色温和影子形态完全不同,不写清楚就全靠抽卡。
中文提示词对Midjourney支持不好,建议直接用英文写。 一个好用的句式是:”[空间类型],[风格],[主要元素],[光照条件],[视角]”。
负向提示词别省。 low quality、blurry、deformed、watermark、text这一组基本是标配。做室内的话,加上cartoon、anime,防止出卡通感。
室内风格的可复用提示词模板
直接抄这几套,改材质就能用:
现代轻奢客厅:
interior design, modern luxury style, living room, golden
accents, marble coffee table, velvet sofa, crystal
chandelier, large floor-to-ceiling windows, natural
lighting, soft shadows, 8k, photorealistic, architectural
photography
日式原木风:
japanese style interior, wabi-sabi, natural wood furniture,
tatami mat, paper lantern, white walls, potted plants, warm
ambient lighting, cozy atmosphere, minimalism, 8k
奶油法式:
french cream style bedroom, curved plaster details, herringbone
oak floor, boucle armchair, brass wall sconce, linen curtains,
diffused afternoon light, eye-level view, photorealistic,
architectural render
新中式:
new chinese style study, dark walnut lattice screen, ink
painting scroll, celadon vase, rice paper pendant light,
bamboo blinds filtering afternoon sun, warm tones,
photorealistic, 8k
意式极简:
italian minimalist kitchen, handleless matte lacquer cabinets,
carrara quartz waterfall island, integrated appliances,
under-cabinet lighting, backsplash tile, cool north-facing
window light, photorealistic, 8k
建筑外观的话,把”空间”换成”建筑体量”,把家具换成立面材料:
modern minimalist villa, three-storey cantilevered volume,
board-formed concrete with visible tie holes, floor-to-ceiling
glass, cedar cladding, reflecting pool at foreground,
dusk blue-hour sky with warm interior glow, three-quarter
aerial view, photorealistic architectural visualization, 8k
景观园林的话:
contemporary chinese garden courtyard, raked gravel, moss
carpet, weathered limestone path, japanese black pine, bamboo
fence, stone lantern, soft overcast light, morning mist,
eye-level view, photorealistic, 8k
高频坑点和对应的修法
AI出效果图踩的坑其实就那么几类,知道原因就能修。
结构跑偏——墙歪了、门窗位置不对。 通常是ControlNet权重不够,调到1.0以上;如果还是不行,换MLSD模式,它对直线的检测比Canny更准。另一个常见原因是图纸预处理不干净,线条有杂色,AI读出错误的结构信息。
权重过高导致画面死板。 反过来的问题:Control Weight拉到1.5以上,AI确实听话了,但出来的图僵硬、没细节,像贴图。降到0.7左右,让AI有一点自由发挥的空间,细节会更丰富。
材质出错——大理石变瓷砖、木地板变复合板。 大概率是提示词不够具体。写”600×1200卡拉拉白大理石纹瓷砖”比”瓷砖”准确得多。另一个办法是用LoRA,这是针对特定风格或材质训练的小模型,加载后AI对这类材质的复现精度会大幅提升。
光影很假——影子方向不对、光太硬。 提示词里写清方向和时段:”soft morning light from the left”、”late-afternoon raking light”。出图后用Photoshop加一层真实光效叠加,能救回不少。
出图有AI味,一眼假。 这个问题最常见也最要命。几个有效手段:
出图后在Photoshop里手动补真实光效,加一点胶片颗粒和轻微暗角
故意加轻微透视畸变,AI生成的图透视往往太”完美”反而假
色彩上往暖色偏移一点点,或者加个LUT,让整体色调不那么”AI”
用Topaz Photo AI这类工具做超分放大,同时保留真实的噪点纹理,别全抹掉
手部或人物变形。 如果图里有人,用OpenPose姿态控制锁定骨骼关键点,能大幅减少畸形。做室内和建筑效果图时,负向提示词里加上”people, person”直接避免出人,更省事。

