主图卖点文字怎么排?AI出图与文案版式设计

主图卖点文字怎么排?文案精简、版式留白与可读性。

2026-09-28 15:44

主图上的文字越堆越多,是很多店铺在出图阶段的一个惯性。上新时担心卖点说不完,就把材质、工艺、尺寸、活动、售后全部排上去,结果整张图被文字占去大半,商品反而缩在角落里。买家在货架上滑动的速度很快,一张主图停在他眼前的时间通常只有一两秒,文字太密,他来不及读,也不会读。

主图文字真正要解决的问题只有两个:这是什么,以及它与我看到的其他同类有什么不同。这两个问题回答清楚,一张主图就成立了;回答不清,再多的形容词也只是背景噪音。

文字压图这件事可以拆成三个可操作的判断:放在画面的哪个位置、用多大的字号和什么样的对比度、总共写多少字。这三个判断互相牵制——位置让给了文字,商品就被挤;字号放大了,字数就得减;字数和位置都定了,对比度决定它能不能被看清。

青虎AI 的主图套图模式可以从一张产品图出发,生成包含卖点文字的主图初稿,把「排版骨架」这一步先跑出来。但骨架之上写什么、留多少、怎么调,仍然属于人的判断范围,工具不会替你把关。这篇按版式、可读性、字数上限的顺序讲完,再给一份可以直接参照的版式表、四个误区、四个技巧和三个场景。

一、先定判断标准:主图文字服务于「一眼看懂」

判断主图文字排得好不好,有一个很朴素的标准:把图缩小到手机屏幕宽度的一半,还能不能读出主要信息。这个尺寸接近买家在搜索结果页看到的主图实际大小。如果在这个尺寸下文字糊成一团,需要点进去放大才看得清,那么它在货架场景里就是无效的。

按这个标准往回推,主图文字的排布有三条硬约束。第一条,文字块不能压住商品的主体轮廓,尤其是商品的识别特征部位;第二条,单块文字的行数不超过两行,超过之后阅读意愿会明显下降;第三条,主图中的文字总量要控制在一个上限之内,超出部分宁可移到详情图去讲。

这三条约束听起来像是在限制表达,实际效果恰好相反。被压到极简之后,保留下来的那几个字必须是最重要的,文案撰写反而会变得更认真。促销信息、规格参数、品牌故事这些内容并不是不重要,只是它们的合适位置在详情图,不在主图。

还要区分主图与场景图的分工。同一套套图里,场景图承担氛围与情绪,白底图承担识别与合规,卖点图承担信息说明。给卖点图留出足够的文字空间,主图就能轻装上阵;如果把卖点图的内容也塞进主图,一整组素材的分工就乱了,后面每张图都在重复表达同一件事。

商品主图版式对照示意,画面左右各放置一张主图,左侧商品居中占满画面、四周拥挤多个文字块,右侧商品占画面下方三分之二、上方三分之一留白并排布三个大小递减的文字块

图1:同样的商品,文字密度不同,货架上的可读性差别很大

把这三条约束固定下来,制作时就有一个可以自我检查的标尺。生成出来的初稿先按这个标尺过一遍,不合格的地方再进入微调,比凭感觉反复改要快得多。

二、文字压图的版式处理:放哪不挡商品

文字与商品争夺的是同一块画布,位置的安排本质上是一次取舍。经验上比较稳的做法,是把画面按功能切成几块,文字只在固定的区域里活动,商品占据主视觉区不受侵扰。

最常用的是上留白、下主体的结构。商品占据画面下方约三分之二,上方三分之一处理成留白或低干扰背景,卖点文字排在这一层。这个结构的好处是商品的识别特征完整露出,文字又有一块相对干净的底子承接。对于体积感强、轮廓复杂或者有明确使用场景的商品,这种结构适用面最广。

商品主体偏小或形态细长的品类,可以换成左右分栏的结构。商品占据画面一侧的六成宽度,另一侧做成文字栏,文字自上而下依次排布。分栏结构需要留意的一点是商品不能贴边,边缘留出四分之一商品宽度的空隙,否则在货架上与其他图并排显示时会显得局促。

形态方正、占据画面中心最自然的品类,适合采用环绕式,把文字布置在商品四周的空白带上,各块文字之间保持均衡。环绕式对留白的要求最高,商品本身必须在拍摄或生成时就留出足够的边缘余量,后期才排得下文字。如果产品图本身已经拍得很满,这种结构就不适合。

还有一种常见的处理是文字压底。在画面底部叠一条横向色带或半透明遮罩,把文字放在色带上,让文字与商品在视觉层次上分开。压底结构在横版素材里用得多,竖版使用时要注意色带高度不能过大,否则会挤压商品的可视面积。

无论选哪一种结构,位置安排上有两条通用的判断要遵守。文字块不要横跨商品的关键识别部位,比如包装上的品牌标识、服装的领口袖型、数码产品的屏幕区域;文字块之间不要形成与商品边缘完全平行的贴边排列,留一点错落的间距,画面才不会显得僵硬。这两条在生成图初稿上就能看出来,发现遮挡直接在编辑器里挪一次位置即可,不需要重新生成整张。

位置判断的两个前提

文字块避开商品的关键识别部位;文字块之间保留横向间距,不贴着商品边缘排。前者保证商品看起来完整,后者保证画面看起来不紧张。

四种结构之间没有优劣,只有匹配与否。判断该用哪一种,可以先看产品图本身的留白分布:上方留白多的适合上留白结构,一侧留白多的适合分栏,四周均有余量的才排得下环绕式。如果产品图拍得很满、四周都没有余量,剪裁时又不想缩商品,那最省事的做法是重新出一次图,而不是硬挤文字。

还要留意文字块与画面的比例关系。同一组文字块放在较大的画布上显得轻,放到较小的画布上就会显得满。做多尺寸版本时,建议先在目标尺寸的画布上定版式,再推到其他尺寸,避免出现「大图上刚好、小图上挤死」的情况。

主图文字四种版式结构对照示意,画面分成四个等大的方格区域,左上格商品居中占满并配四角环绕文字块,右上格商品位于下方三分之二、上方三分之一为三行文字块,左下格商品在右侧、左侧一列三行文字块,右下格底部一条横向色带承载一行文字

图2:上留白、左右分栏、环绕、压底四种结构的取舍关系

三、可读性保障:对比度与字号下限

文字放对位置只解决了一半问题。压在商品上或压在场景上的文字,能不能被看清,取决于对比度和字号这两个变量。

对比度指的是文字颜色与其背后画面的明度差。白底图上的深灰文字对比度天然充足,但一旦文字压在场景图上,背景可能是浅色的草地、深色的桌面或者明暗交错的室内,同一段文字在不同区域的清晰程度就完全不同。处理办法有三种:给文字加描边或阴影,让它在任何背景上都有轮廓;给文字加一块底色块,把背景干扰一次性隔开;或者把该区域的背景做一层压暗,人为拉开明度差。

字号需要设一个下限。经验上的判断方法是按成品图的短边计算,一行文字的字高不宜低于短边的十八分之一到十五分之一。低于这个区间,缩到货架尺寸之后笔画会糊在一起,尤其是笔画密集的汉字。这个下限不需要精确到像素,只要每次出图后按「把图缩到手机屏幕上一半大小再看一眼」的方式验证一次,就能校准出自己店铺的下限。

字重和字体的选择同样影响可读性。同一字号下,中等偏粗的字重比细字重更容易在复杂背景上被识别,但字重过粗会让小字号的笔画粘连,尤其是笔画多的汉字。字体方面,无衬线结构在电商主图上更稳,辨认成本低,衬线体和手写体适合做点缀,不适合承担主要信息。

还有一个容易被忽略的变量是文字与商品的距离。文字紧贴商品边缘时,视觉上会被商品的轮廓「吃掉」一部分,读起来更吃力;把文字与商品之间拉开一段明显的间距,即使字号相同,可读性也会提升。这一条在调整版式时最容易被跳过,但改动成本几乎为零。

可读性维度常见问题处理方向验证方式
对比度文字压在明暗交错的背景上,局部消失加描边、加底色块或压暗局部背景缩到货架尺寸看文字是否仍连贯
字号字高过小,缩图后笔画粘连按短边比例设置字号下限手机屏幕一半宽度下逐句试读
字重笔画密集汉字在细字重下发虚主要信息用中等偏粗字重对比相邻文字块,确认层级清楚
字体装饰字体承担主信息,辨认成本高主信息用无衬线,装饰体只做点缀陌生路人能否一次读对
间距文字紧贴商品轮廓,被边缘割裂文字与商品之间留出明确空隙整体拉远看是否显得拥挤

这张表按维度拆开,实际调整时却是同时起作用的。改字号的同时往往需要重新考虑对比度,去掉描边之后字重可能就要调一调。稳妥的做法是先定位置,再定字号,最后调对比度与字重,顺序固定下来,返工次数会明显减少。

对比度还有一个和品类相关的细节。食品、美妆这类商品的主图常有大量浅色背景与柔和光影,文字压在浅色区域上时,深色文字读起来更稳;数码、工具类商品常用深色背景与金属质感,浅色文字更清楚。按商品本身的明度基调选文字颜色,比固定用某一种颜色更省事,后续也不用反复调。

字号下限的校准可以借助一个简单的对照方法。把同一段文字用三档不同字号排一版,缩到货架尺寸并排放在一起看,能认清的那一档就是自己类目的下限。这个下限在换品类后需要重新校准一次——服饰类主图的背景通常更复杂,下限会比白底为主的品类更高一些。

四、字数上限怎么判断

主图该写多少字,没有适用于所有类目的固定答案,但有一套可以自己推出答案的判断方法。核心变量有三个:单块文字的阅读时间、文字块的数量限制、以及商品本身的识别难度。

阅读时间这一条最好理解。买家在主图上停留的可用时间有限,单块文字超过一行的长度,视线就要做一次从行尾回到行首的移动,移动本身就消耗注意力。把每一块文字压缩到一行能说完,文字块总数再乘以单块的字数,就是这张主图文字量的粗略上限。

文字块的数量也需要设限。三块是多数品类比较舒服的数量,四块开始显得零碎,超过四块就接近详情图的表达密度了。如果卖点确实多,更合适的做法是把其中最重要的一条留在主图,其余放进卖点图,用一整套素材分担信息量。

商品本身的识别难度会影响这个上限。外形辨识度高的商品,买家扫一眼就知道是什么,主图的文字可以更集中在差异点上;外形普通、与同类差别不大的商品,需要多花一点文字解释清楚品类与用途。这是少数可以适度突破字数上限的情形,但突破的仍应是必要性信息,不是修饰性信息。

文字量档位表现特征适合的商品类型需要注意
偏低(一到两块)文字只保留品类与一条差异点外形辨识度高、卖点单一的品类差异点必须足够具体,否则信息量为空
中等(三块)品类加两条差异点,或品类加规格与场景多数日用、服饰、家居品类三条之间的优先级要能一眼分开
偏高(四块及以上)文字块接近饱和,留白明显减少功能复杂、需要解释用途的品类建议改为拆分到卖点图,主图保持三块以内

用这张表对照自己的主图,可以得到一个粗略判断。需要说明的是,这里给出的只是文字量的档位分布,不涉及任何流量或转化的结果。文字量合理只是让信息更容易被读进去,它本身不构成一个可以用来承诺结果的变量。

读一遍计时

把主图上的文字按顺序读两遍,读完需要的时间如果明显超过扫一眼的节奏,说明文字量偏多,需要往下砍。

遮住文字猜商品

用手遮住全部文字,看商品能不能被认出是什么。能认出说明文字可以只留差异点;认不出说明品类信息本身需要保留。

看竞品分布区间

翻同一品类搜索结果的前几屏,记下文字块数量大致落在哪个区间,用于确认自己是否有明确的理由偏离这个区间。

这三个动作的共同点是都不需要额外工具,看完就能做判断。其中第二个动作最容易被跳过,但它恰恰是最能反映真实情况的一条:文字的作用是补足商品本身没说清的部分,商品图本身已经说清的,再用文字重复一遍就是浪费。

还有一个判断角度是从竞品横向看。同一品类搜索结果的前几屏里,文字块数量分布大致落在什么区间,自己偏离太远就需要检查。这个检查的目的不是向多数靠拢,而是确认自己是否有明确的理由偏离——没有理由的偏离,通常只是没想清楚。

五、青虎AI 生成含卖点文字主图的操作路径

前面讲的判断,落到执行上需要一个能快速出初稿的环节。青虎AI 的主图套图生成适合承担这一步,它从一张产品图出发,把白底图、场景图、细节图、卖点图这类素材一次性铺开,主图上的卖点文字也在生成范围内。

从上传产品图到下载成品的六步流程示意,画面自上而下排列六个等距的步骤块,每一步块内有一个图形标识,块与块之间用竖直箭头连接,整体呈单列纵向布局

图3:主图套图的一条直线流程,上线前用在初稿环节最省时间

入口位置比较直接。登录青虎AI 工作台,在功能栏找到图像生成,勾选套图模式,系统即进入主图套图功能。上传一张能看清产品主体的商品图,手机随手拍也可以,系统会自动完成抠图与产品提取。这一步的素材质量直接影响后续文字版式的可用空间,拍摄时四周多留一点余量,后面排文字会宽松很多。

接下来在产品名称框中填写产品名称,名称按品类加核心特征来写会更精准。比如只写品类名称,系统能理解的范围就比较宽;写成带核心特征的表述,定位会收得更紧。产品名称中的关键词会参与后续生成,所以这一步值得多花十几秒斟酌。

步骤一:进入套图模式

登录青虎AI 工作台,在功能栏找到图像生成,勾选套图模式,系统自动进入主图套图功能。

步骤二:上传商品图

上传一张能看清产品主体的商品图片,手机随手拍即可,系统会自动抠图与产品提取。建议选正面清晰、四周留有余量的图。

步骤三:填写产品名称

在产品名称框中填写产品名称,按品类加核心特征的方式写,系统会自动解析产品属性并据此匹配构图与文案。

步骤四:选择平台与套图参数

设置目标平台、套图类型与风格偏好。这一步对最终效果影响最大,平台规则差异大的情况下建议按平台分别生成。

步骤五:一键生成

点击生成按钮,等待完成后获得整套主图素材。初稿阶段看的是版式结构是否合理,文字内容细调留到下一步。

步骤六:预览与单张重生成

在线预览生成结果,套图中某一张不满意可以单独重新生成微调,不必整套重来。确认后下载无水印高清图。

这套流程走完之后,得到的是带卖点文字的版式初稿。初稿的价值在于把构图和文字位置的骨架定下来,剩下的工作就是按前面的判断标准做取舍:哪一块文字多余、哪一块位置挡到了商品、哪一处对比度不够。

参数配置上有几个选项值得留意。套图类型按品类选择会更有针对性,服装类侧重场景图与卖点图,数码类侧重细节图与白底图,食品类适合温馨场景配卖点标注,饰品类适合风格化主图配细节放大。风格选项上,食品与暖色调、数码与冷色调、饰品与风格化视觉的匹配度通常更高,风格与品类一致时主图的专业感会更完整。这些参数的作用是让初稿更接近可用状态,不能替代上架前的人工确认。

属地化的选项在跨境场景下值得用上。设置销售国家与语言之后,生成的素材会按当地表述习惯输出文字,一些在中文语境里顺理成章的表述,换到其他市场之后读起来会不自然,这一步能挡掉一部分这类问题。素材生成完之后,成品可以下载为无水印高清图,直接进入后续的整理环节。

初稿环节的判断重点

看三件事:商品是否完整露出且没有被文字遮挡关键识别部位;文字块数量是否在自己类目的合理区间;把图缩小之后文字是否仍能读清。三件事里有任何一条不合格,先调版式再谈文案。

六、四个常见误区

文字压图这件事看着简单,用多了之后容易形成几个惯性判断,下面四条踩中的概率最高。

误区一:卖点写得越多,信息越完整

主图的阅读时间有限,文字块数量超过四块之后,买家通常只能记住其中一块。信息完整度不是靠堆数量达成的,把次要信息放到卖点图,主图的传达效率反而更高。

误区二:字号越大越醒目

字号放大确实更容易被看到,但同时也挤占了商品的可视面积。字高超过画面短边的一定比例之后,商品会被挤到边缘,主图的识别功能受损。醒目的前提是商品先被看清。

误区三:文字压在商品上显得更整体

文字直接压在商品主体上,短时间看确实更紧凑,但它会遮住商品的识别特征。同一品类里,被遮挡的商品往往需要买家多点一次才能确认是什么,这一层成本容易被忽略。

误区四:生成出来就能直接上架

生成结果适合当作待确认的初稿。文字内容是否与实物一致、表述是否符合平台规则,都需要人工逐条核对。工具负责出稿,判断仍然留在人手里,这一步不能省。

四个误区的共同点是把「信息量」直接等同于「表达效果」。信息量增加确实让内容更全面,但主图的任务不是全面,而是在极短时间里让买家确认这是一件什么东西。目的和手段错位,越努力越偏。

还有一个变体是照搬别人主图的文字密度。看到同类目里的爆款主图文字少,就一律减到一两个字;看到另一类目文字多,又跟着加回去。文字密度的合适值取决于商品自身的识别难度和差异点的数量,别人的密度只能作为参照,不能直接抄过来用。

七、四个提效技巧

技巧一:上留白结构先当默认模板

商品占下方三分之二、文字排在上方三分之一的版式,对多数品类都成立。把它设成店铺的默认结构,新商品直接套用,省掉每次重新考虑位置的时间。

技巧二:先写文案再排位置

把要写的文字先按重要性排成三行,压到每行一句话,再决定这三行放在哪。反过来先定版式再填文字,很容易因为排版空间富余而不断加字。

技巧三:把图缩到一半再看一眼

调整完成后把成品缩到手机屏幕宽度的一半,在这个尺寸下逐句试读。糊成一团的文字就是需要改字号或改对比度的位置,这个动作每次只要十几秒。

技巧四:留一组只改文字不重生成的母版

同一款商品的不同卖点版本,尽量共用同一套构图,只换文字内容。这样对比差异时变量只有一个,判断成本低,系列商品之间的视觉也更统一。

四个技巧的落地成本都不高,真正起作用的是把它们固定成动作。写文案前先排序,排完版先缩图试读,做新商品先套默认结构,系列商品先定母版。这几步做完,主图文字的大部分返工都能在生成阶段之前被挡住。

技巧之间还有一层配合关系。默认结构决定了文字块的数量与位置,文案排序决定了每块里写什么,母版管理让同一系列的图不至于走形,缩图试读则是最后一道把关。四条里任何一条缺位,前面的判断都会在成品上打折:只做母版不做试读,尺寸合适但字号可能偏小;只做试读不做母版,单张合格但系列不统一。

还有一个和团队协作有关的做法:把每次新品的文字版式存档,注明商品品类、文字块结构、字数档位和最终采用的版本。这个档案积累到十几个商品之后,做新品类时可以直接翻出结构相近的先套用,试错次数会明显减少。文档不必复杂,一张表登记三四个字段就够用。

顺序上建议先固定第一条和第三条。默认结构决定了每张主图的起点,缩图试读决定了每张主图的终点,两点定住之后,中间的过程怎么调整都不会偏太远。文案排序和母版管理属于效率优化,可以在流程跑顺之后再补上。

八、三个可以照做的场景

场景一:同一商品的多个卖点版本

一款商品需要针对不同人群强调不同差异点,比如同一件外套分别强调保暖、版型与面料。做法是共用一套构图,只替换文字内容,生成几张并列对比。变量只有一个,哪一版表述更具体一眼能看出来。

场景二:系列商品的版式统一

一个系列有多款商品,先用版式最顺的那一款作为母版,其余款按同一结构换商品图和文字块内容。系列商品在搜索结果里并排出现时视觉语言一致,买家的认知成本更低。

场景三:多平台版本的尺寸适配

同一款商品要在多个渠道上架,先在主尺寸下把文字版式全部定稿,再按目标平台切换尺寸重新生成。定稿在前的做法能保证各平台版本的文字位置与层级关系保持一致,不必逐张重排。

多平台主图尺寸适配示意,画面中央是一张完成排版的主图,向左右两侧各延伸出两张比例不同的衍生图,衍生图保持相同的图文结构与文字块层级,整体呈中心发散的横向布局

图4:主尺寸定稿之后,多平台版本按同一套文字结构衍生

三个场景的共同点是先把文字与版式的关系定下来,再去做数量的铺开。定稿在前的做法看起来多花了一步,实际省掉的是后续每张图单独调整的时间。

如果只打算先做一件事,建议把系列商品的那套母版先建起来。母版一旦固定,上面三个场景都能直接套用,新商品的处理方式会从「每次重新设计」变成「在既定结构里换内容」,效率和质量都更稳。

九、总结

总结:主图卖点文字的版式要点

主图文字要解决的问题只有两个:这是什么,以及它与同类有什么不同。位置判断上,上留白下主体的结构适用面最广,商品占画面下方约三分之二,文字排在留白层,文字块避开商品的品牌标识、领口袖型、屏幕区域这类关键识别部位,块与块之间保留横向间距。可读性上按短边比例设置字号下限,必要时用描边、底色块或压暗背景来拉开对比度,主要信息用无衬线字体与中等偏粗字重。字数上按档位控制,偏低到中等区间更稳,文字块超过四块建议把次要信息移到卖点图。青虎AI 的主图套图模式从工作台的图像生成勾选套图模式进入,上传一张产品图、填写产品名称、选择平台与套图参数后一键生成整套素材,单张不满意可以单独重新生成。生成结果属于初稿,文字内容与实物的一致性、表述是否符合平台规范,仍需上架前人工逐条确认。

十、常见问题解答

问:主图上最多写几个文字块合适?

多数品类三块是比较舒服的数量。四块开始显得零碎,超过四块就接近详情图的表达密度了。卖点确实多时,建议把最重要的留在主图,其余放进卖点图,用一整套素材分担信息。

问:文字放在商品上方还是下方?

取决于商品的形态和构图。商品占下方三分之二、文字排在上方留白层,这种结构对多数品类适用;商品形态细长的品类可以改用左右分栏,文字占一侧六成宽度。判断标准是商品的关键识别部位不被遮挡。

问:怎么判断字号够不够大?

把成品缩到手机屏幕宽度的一半再看一眼,在这个尺寸下能连贯读出的字号就是够的。经验上字高不宜低于成品图短边的十八分之一,具体数值按自己类目的实拍效果校准即可。

问:文字压在场景图上总是看不清怎么办?

三种处理方式:给文字加描边或阴影,让它在任何背景上都有轮廓;给文字加一块底色块,把背景干扰隔开;或者把该区域的背景压暗,人为拉开明度差。三种方式可以叠加使用。

问:青虎AI 主图套图从哪里进入?

登录青虎AI 工作台,在功能栏找到图像生成,勾选套图模式,系统自动进入主图套图功能。上传产品图、填写产品名称、选择平台与套图参数之后点击生成即可。

问:上传的产品图有什么要求?

建议上传正面清晰、能看清产品主体的图片,手机随手拍也可以,系统会自动抠图与产品提取。拍摄时四周多留一点余量,后续排文字的空间会更宽松。

问:产品名称怎么写效果更好?

按品类加核心特征的方式写,比只写品类更精准。名称中的关键词会参与生成过程,写得具体一些,系统对产品的定位会更聚焦,生成的卖点文字也更贴合。

问:生成的某一版文字位置不好,能只改那一张吗?

可以。套图中任何一张不满意都可以单独重新生成微调,不必整套重来。确认之后下载无水印高清图,再按自己的判断做取舍。

问:一次能生成几张主图?

单次生成可输出整套主图素材,覆盖主图、白底图、场景图、细节图、卖点图等类型。初稿阶段多看几版版式结构,挑出文字排布最顺的一版再定稿,比在一版上反复改更省时间。

问:套图类型和风格该怎么选?

套图类型按品类选择更有针对性,服装类侧重场景图与卖点图,数码类侧重细节图与白底图,食品类适合温馨场景配卖点标注。风格上食品与暖色调、数码与冷色调的匹配度通常更高,风格与品类一致时专业感更完整。

问:多平台的主图需要分别生成吗?

平台规则差异较大时建议分别生成,确保每套主图符合对应平台的要求。做法上先在主尺寸下把文字版式定稿,再切换平台尺寸生成,各版本的文字层级关系能保持一致。

问:生成的主图能直接上架吗?

建议上架前再做一次人工确认。重点核对文字内容与实物是否一致、表述是否符合平台规范。工具解决的是出图效率,内容准确性的判断仍然需要人工完成。

把位置、字号、字数这三件事的判断固定成自己店铺的检查动作,主图文字的返工量会明显下降。生成工具负责快速出稿,取舍标准留在人手里,两边各做各的部分,成品质量比单靠工具或单靠人工都更稳。