Seedream 5.0 Pro同一张图付0.3还是0.6元,分界线在像素不在档位
本文目录
- 同样一张16:9的图,为什么有人付0.30元有人付0.60元?
- 236万像素这条线,到底能卡出多少便宜?
- 叫Pro的模型,分辨率上限为什么反而比Lite低?
- 这个命名会咬到评估流程
- 还有一条藏得更深的限制
- 参考图也要钱,这笔账你算进去了吗?
- 交互编辑到底怎么用?标记得你自己画上去
- 官方示例把模板给全了
- 为什么这件事值得单独做个工具
- 图层这件事,发布稿和接口文档说的不是一回事
- 榜单上为什么至今找不到它?
- 厂商自测数据该怎么读
- 接进独立站素材管线,哪几步最容易卡住?
- 图片链接只活24小时
- 水印默认是开的
- 提示词超长是丢元素,不是慢慢变糊
- 极速模式是个没人提的开关
- 参考图本身也有硬限制
- 多语种文字:做外贸站的先测这一项
- 接口兼容OpenAI SDK
- 跑一个月的账,具体长什么样?
- 怎么验证这笔账没算错
- 谁该换,谁别动?
- 先说四种直接划掉的情况
- 一条容易漏掉的合规提醒
- 再说三类人的三个答案
- 常见问题解答
- Seedream 5.0 Pro到底怎么计费,按张还是按token?
- 怎么用最少的钱拿到最大的图?
- Seedream 5.0 Pro和Lite该怎么选?
- 交互编辑需要传什么特殊参数吗?
- Seedream 5.0 Pro的图层分离到底上线了没有?
- 生成的图片链接能存多久?
- Seedream 5.0 Pro真的超过Gemini了吗?
- 权威参考资料
摘要:Seedream 5.0 Pro按张计费,0.30元和0.60元的分界线是236万总像素,而不是你在参数里填的1K或2K。用档位模式,16:9只有1424×800(0.30元)和2816×1584(0.60元)两个选项;改用像素模式填2048x1152,像素比1K档多出107%,价钱还是0.30元。这一条差别,在月产万张的素材管线上就是三千块。下面把官方参数表、计费阈值、参考图这笔隐藏账,以及发布稿和接口文档打架的地方,一次讲清楚。
字节在2026年7月8日把Seedream 5.0 Pro挂上火山方舟的时候,社交媒体上传得最响的一句是“生图超过Gemini”。这句话字节自己从来没说过,第三方榜单到今天也还没给出任何一边的证据。
但真正值钱的东西不在那句口号里。我把火山方舟的三份官方文档(API参考、图片生成教程、模型价格)逐行读完之后,发现最该被讨论的是一件很不性感的事:这个模型的报价单有两套读法,而大多数人只知道其中一套,还是贵的那套。
先交代边界:本文所有参数、价格、能力对照均来自官方文档,我没有充值跑图。这类文章最容易翻车的地方恰恰不是主观体验,而是把过时的数字当成现状——所以这篇的重点放在把账算对、把参数钉死上。
同样一张16:9的图,为什么有人付0.30元有人付0.60元?
火山方舟的模型价格页把图片生成的计费写得很短,短到容易被扫过去:
doubao-seedream-5-0-pro:输出图≤236万像素0.30元/张,>236万像素0.60元/张- 输入参考图:首张免费,第2张起0.02元/张
- 因审核等原因未成功输出的图片不计费
注意这里的定价变量是总像素,不是分辨率档位。而你在API里指定尺寸时,官方给了两种互斥的写法:填档位(1K、2K),或者填宽高像素值(2048x1152)。这两种写法不能混用。
问题就出在这儿。填档位的时候,宽高比由模型根据你的提示词描述来定,最终落在官方的映射表上。而那张映射表,把16:9的两个选项定死成了1424×800和2816×1584。
算一下:1424×800是113.92万像素,落在0.30元档;2816×1584是446.05万像素,落在0.60元档。中间是空的。你想要一张比1424×800大、但还想按0.30元付钱的图?档位模式不给你这个选项。
236万像素这条线,到底能卡出多少便宜?
换成像素模式,情况完全不同。图片生成教程里写明了Pro的总像素取值范围是[1280x720(921600), 2048x2048x1.1025(4624220)],宽高比范围[1/16, 16]。也就是说,92.16万到462.42万之间的任意组合都合法。
而计费阈值卡在236万。那么最优解就很清楚了:在不超过236万总像素的前提下,把图开到最大。
| 宽高比 | 档位模式(1K) | 档位模式(2K) | 像素模式的0.30元天花板 |
|---|---|---|---|
| 1:1 | 1024×1024(0.30元) | 2048×2048(0.60元) | 1536×1536=235.93万 |
| 16:9 | 1424×800(0.30元) | 2816×1584(0.60元) | 2048×1152=235.93万 |
| 4:3 | 1152×864(0.30元) | 2368×1776(0.60元) | 1760×1320=232.32万 |
| 3:2 | 1248×832(0.30元) | 2496×1664(0.60元) | 1872×1248=233.63万 |
| 21:9 | 1568×672(0.30元) | 3136×1344(0.60元) | 2340×1003=234.70万 |
看16:9那一行。1424×800换成2048×1152,像素数从113.92万涨到235.93万,翻了2.07倍,账单一分钱没变。距离236万这条线只差704个像素——不多不少,刚好够你把电商主图从“勉强能用”推到“印在详情页顶部不虚”。
1:1那行同理,1536×1536是所有正方形里能免费拿到的最大边长。做商品方图、社媒头图的,这个数字建议直接写进配置文件。
这里插一句读参数表的通用经验:凡是“档位”和“实际计量单位”不是同一个东西的服务,中间几乎一定有套利空间。档位是给人看的,计费是按机器读的那个数走的。保哥这些年做出海站的技术选型,在CDN流量、云存储请求数、翻译API字符数上都遇到过同一个结构——供应商用一套好记的标签包装,实际结算用另一套。写进代码的应该是后者。
叫Pro的模型,分辨率上限为什么反而比Lite低?
这是我读官方能力对照表时最意外的一格。同一张表里,四个模型并排:
| 能力 | Seedream 5.0 Pro | Seedream 5.0 Lite | Seedream 4.5 | Seedream 4.0 |
|---|---|---|---|---|
| 分辨率档位 | 1K、2K | 2K、3K、4K | 2K、4K | 1K、2K、4K |
| 交互编辑 | ✓ | ✗ | ✗ | ✗ |
| 文生组图/图生组图 | 暂不支持 | ✓ | ✓ | ✓ |
| 流式输出 | 暂不支持 | ✓ | ✓ | ✓ |
| 联网搜索 | 暂不支持 | ✓ | ✗ | ✗ |
| 输出格式 | png、jpeg | png、jpeg | jpeg | jpeg |
| 提示词优化模式 | 标准、极速 | 标准 | 标准 | 标准、极速 |
| 参考图上限 | 10张 | 14张 | 14张 | 14张 |
| 限流 | 四款统一500张/分钟 | |||
Pro的分辨率上限是2K,Lite能到4K。组图、流式、联网三项Pro全是“暂不支持”,参考图还比Lite少4张。单看这张表,Pro像个功能被阉过的版本。
字节这里的Pro指的是精度,不是功能全。它换来的东西只有一格:交互编辑。整张表里只有Pro那一列打了勾,另外三款全是叉。
这个命名会咬到评估流程
大部分产品线里,贵的型号规格全面碾压便宜的,所以团队评估新模型的本能动作是:拿最贵的那个跑一遍最重的批量任务。在Seedream这里,这个本能会直接把你带沟里——你拿Pro跑组图,它报错;你拿Pro要4K交付,它给不了;然后你得出“又贵又残”的结论,把整个系列拉黑。
正确的分工是:一次只出一张、但这张的文字位置人物特征必须分毫不差,用Pro;一次出一组、或者要4K,用Lite。这两句话应该写在团队的模型选型文档第一行。
还有一条藏得更深的限制
Lite的总像素下限是2560x1440(3686400),比Pro的1280x720(921600)高出整整4倍。翻译成人话:Lite根本出不了小图。
所以如果你的管线里有“生成缩略图”“生成图标”这类需求,Lite这条路直接堵死,Pro也只能给你92.16万像素起步的图,剩下的还得自己缩。API不给小图,低于下限是直接拒绝而不是自动放大——这个行为差异,在写重试逻辑的时候要提前判掉。
参考图也要钱,这笔账你算进去了吗?
这是价格表里最容易被跳过的一行,也是Pro和其他三款差别最大的地方:
- Seedream 5.0 Pro:输入图首张免费,第2张起0.02元/张
- Seedream 5.0 Lite/4.5/4.0:输入图免费
只有Pro对参考图收费。而Pro恰恰是那个主打“多图生图”“交互编辑”的型号——这两种玩法天生就要传多张图。
算一笔满配的账。用Pro做多图融合,传满10张参考图,出一张1536×1536的图:
0.30元(输出)+9×0.02元(第2到第10张参考图)=0.48元。参考图占了整单成本的37.5%。
如果输出图开到2K档,0.60+0.18=0.78元,参考图占23%。跑量的时候这不是零头。做服饰换装、模特套图这类必须堆参考图的管线,建账的时候得把参考图单独列一行,别只盯着输出单价。
这个成本结构和视频那边是同一套思路。我之前拆Seedance 2.0的提示词与计费时算过,那边是按token走的,输入含不含视频差出接近一倍的单价;生图这边换成了按张,但“你喂进去的东西也要收钱”这个原则没变。
交互编辑到底怎么用?标记得你自己画上去
Pro唯一独占的能力,实现方式比大多数人想的原始,而这恰恰是它最好用的地方。
API参考文档里对交互编辑的描述是“支持通过坐标、框选、箭头等多种方式指定编辑位置”。Seed团队的官方发布博客说得更细,列了点选、套索、框选、涂鸦四种。
但翻遍请求参数表,你找不到任何一个叫region、mask或者coordinates的字段。Body参数一共就那么几个:model、prompt、image、size、optimize_prompt_options、output_format、response_format、sequential_image_generation、stream、tools、watermark。
答案是:框、箭头、坐标号、涂鸦,全都是你自己画在参考图上传进去的。模型识别图上那些标记,再对照prompt里的文字描述执行。
官方示例把模板给全了
教程里那条交互编辑的示例提示词值得原样抄下来:
根据手绘草图对图像进行编辑。在左下角标记区域添加一叠真实的杂志或艺术画册,并在右侧标记区域添加一个带杯碟的陶瓷杯咖啡。移除所有草图线条。保持构图不变。
四句话,每句都有活儿:第一句声明这是草图编辑任务;第二句用方位词绑定标记区域和要生成的内容;第三句移除所有草图线条——不写这句,你画的那些框和箭头会被当成画面元素一起渲染进去;第四句保持构图不变,防止模型顺手把整张图重新排一遍。
后两句是很多人第一次试会漏掉的,然后得出“交互编辑不准”的结论。它准,只是你没告诉它标记不是内容。
为什么这件事值得单独做个工具
标记既然是画上去的,那就能程序化生成。用Pillow在图上画一个矩形、写一个序号,二十行代码的事。这意味着Seedream 5.0 Pro实际上是一个可脚本化的区域编辑器:
- 批量给一百张商品图的右下角换标签,坐标固定,标记框循环画
- 做多语种本地化,同一版海报,文字区域框住,prompt换语言
- 模特图统一改背景,人物区域涂蓝保留,其余重绘
这三类活以前要么手动PS,要么靠不太稳的抠图管线。现在的路径是:一个画标记的脚本,一次API调用。这比模型本身的画质提升实在得多。
想走完全本地、零边际成本那条路的,我写过Claude Code加Draw Things的本地出图工作流,跑在Mac上,适合素材不能出内网的场景,代价是自己扛显存和调度。
图层这件事,发布稿和接口文档说的不是一回事
这一节是本文时效性最强的部分,也是最容易在别处读到错误说法的地方。
发布当天大量文章写“Seedream 5.0 Pro支持图层分离,一张海报能拆成10多个独立图层”。这句话的来源是Seed团队的官方博客,原文确实把智能图层分离作为已有能力介绍,没有标注即将推出。
但7月8日刚上线时,火山方舟的API参考里找不到对应字段,能力清单也只写了交互编辑——这就是那段时间“图层分离还没上线”说法的由来,当时它是对的。
到我核对这一版(图片生成教程最近更新时间2026年7月15日,API参考2026年7月21日)的时候,情况已经变了。教程里的能力对照表,Pro那一列的“生成数量”一格写着:支持生成单图/多张图层。
所以现在的准确说法是:图层能力已经进了官方文档,但它的位置不在一个独立参数上,而是挂在“生成数量”这个维度下——一次调用可以返回单张图,也可以返回多张图层。这也解释了为什么Pro的组图能力标着“暂不支持”却又能返回多张:组图是多张不同的图,图层是同一张图的多个层,两码事。
结论给两条:一,7月上旬那批“图层还没上线”的文章现在已经过期,别再照抄;二,凡是同一款产品的发布稿和接口文档说法对不上,以接口文档为准,并记下核对日期——发布稿描述的是模型能力,接口文档描述的是你今天真能调到的东西,这两者中间隔着上线排期。
榜单上为什么至今找不到它?
模型发布已经三周了。我复核了Artificial Analysis的文生图榜,榜首仍然是GPT Image 2 (high),Elo 1340;后面依次是Reve 2.1(1299)、MAI-Image-2.5(1270)、Nano Banana 2和GPT Image 1.5 (high)(并列1263)。
Seedream 5.0 Pro至今没有拿到有效名次——不是排得靠后,是投票量还不足以给出可靠评分。三周没上榜,比发布当天没上榜信息量大得多。
唯一的官方对照数据来自字节内部测试:Pro的可用率24.02%,Nano Banana 2是23.95%,在营销场景高出20.20%、电商场景高出10.17%。这是厂商自测,按惯例打折听;但它至少说明字节自己也认为差距在小数点后面,卖点不在画质天花板。
厂商自测数据该怎么读
顺着这组数字讲个通用的读法,比记住数字本身有用。24.02%对23.95%——这两个数放在一起,能读出来的信息其实是发布方主动选择了一个“我们赢,但赢得很少”的对照。
厂商愿意公布的对照组,永远是精心挑过的。真要拉开差距,公布的会是一个大比分;只差0.07个百分点还拿出来说,说明在这个维度上找不到更好看的数了。而后面那两个大数字——营销高20.20%、电商高10.17%——才是它真正想让你看的:不比通用画质,比你那个具体场景。
这个套路本身不算耍赖,反而是个有用的信号:厂商把细分场景的数字摆在整体数字前面,通常意味着它的产品定义就是围绕那几个场景做的。Seedream 5.0 Pro的交互编辑、多语种文字、信息密集排版,确实全都指向营销和电商物料,不指向艺术创作。看懂这层,你就不会再纠结它有没有超过Gemini——它压根没打算在那条赛道上跟人比。
把这些拼起来,Seedream 5.0 Pro的真实定位就清楚了:它不是一台更大的攻城锤,是从定价地板下面挖了条隧道,顺手卖一把对手货架上没有的工具。画质是第一梯队里的普通一员,价格是对手的一半到四分之一,坐标级编辑全场独一份。
接进独立站素材管线,哪几步最容易卡住?
把模型接进真实的内容生产流程,翻车点几乎都不在生成质量上,而在这些边角规则里。按被坑概率从高到低排:
图片链接只活24小时
官方原话是“图片URL仅保留24小时,超时后会被自动清除”。默认的response_format是url,很多人拿到链接直接写进数据库或者CMS里,第二天整批图变成404。
正确做法只有一个:拿到响应立刻下载转存到自己的对象存储,数据库里存自己的地址。要么就把response_format改成b64_json,直接拿Base64,省掉一次网络往返。
水印默认是开的
watermark默认值true,会在图片右下角加“AI生成”字样。生产素材必须显式传false。这个默认值本身合理,但它意味着你少写一个参数,产出的就是一批带角标的废图——而且往往是批量跑完才发现。
提示词超长是丢元素,不是慢慢变糊
官方建议不超过300个汉字或600个英文单词,并且明确写了超长后的行为:“字数过多信息容易分散,模型可能因此忽略细节,只关注重点,造成图片缺失部分元素”。
注意这是缺失不是降质。从别的生图服务迁过来、习惯了堆长提示词的,务必先做一轮压缩,否则你会遇到一种很难排查的现象:图很好看,就是少了个东西,而且每次少的还不一样。
极速模式是个没人提的开关
optimize_prompt_options.mode可以设成standard或fast。Pro和4.0支持fast,Lite和4.5只有standard。官方对fast的描述是“显著提升生成速度,但会在一定程度上牺牲图片质量”。
这个开关在两类场景里很值:给运营做草稿预览、以及A/B测多个构图方向。先用极速跑二十版挑方向,选定后用标准模式出终稿。发布报道里几乎没人提它,但它是这套参数里ROI最高的一个。
参考图本身也有硬限制
- 格式:jpeg、png、webp、bmp、tiff、gif、heic、heif
- 单张不超过30MB
- 总像素不超过6000×6000=3600万
- 宽高比在1/16到16之间,宽高各自大于14像素
- Base64传入时格式必须是
data:image/<格式>;base64,<编码>,且格式名必须小写
最后那条小写要求,是那种排查半小时才发现的错误。用户上传的手机原图经常是HEIC且尺寸巨大,管线前面得有一道压缩和转码,不能直接透传。
多语种文字:做外贸站的先测这一项
Seed团队的发布博客里,除了交互编辑,另一个被反复强调的是原生多语种文字生成——官方口径是“十余种全球常用语言的直接输入与高质量生成”,点名列了法语、德语、俄语、日语、韩语、西班牙语和阿拉伯语,其中阿拉伯语意味着它处理了从右往左的书写方向。
这一项对做多市场独立站的人价值远大于画质。海报本地化这件事,过去的常规路径是设计师出一版母版,然后每个语种手动排一遍——文字长度一变,整个版式就得重调,德语尤其擅长把一个英文单词膨胀成三倍长度。现在的路径变成:母版生成一次,文字区域框住,prompt换语言重出。
但别把官方口径直接当成验收标准。官方自己在文档里承认小字结构仍存在不稳定问题,而多语种和小字这两件事经常同时出现——比如成分表、规格参数、免责声明。所以接入前值得花半天做一件事:拿你真实要投放的那几个语种,各出十张带小字的图,人工数一遍错字率。这个数字比任何榜单都更能决定你要不要改流程。字符集不常见的语种(比如波兰语的ę、匈牙利语的ő)更要单独验,字形缺失往往不报错,只是悄悄画歪。
接口兼容OpenAI SDK
官方文档里每个示例都给了Curl、Python、Java、Go和OpenAI五个版本。client.images.generate(...)可以直接用,从既有的生图服务迁过来基本是改base_url和模型名的工作量。海外账号走BytePlus ModelArk,Model ID换成dola-seedream-5-0-pro-260628,计费口径是同一套:≤236万像素每张0.045美元,超过0.09美元,参考图首张免费、之后每张0.003美元。
跑一个月的账,具体长什么样?
假设一个中等体量的独立站,每月需要1万张商品和营销图,其中7000张是16:9的横图(详情页、广告位),3000张是1:1方图(列表页、社媒)。
| 方案 | 参数写法 | 单价 | 月成本 |
|---|---|---|---|
| 档位模式保守派 | size: "1K" | 0.30元 | 3000元(图偏小) |
| 档位模式豪华派 | size: "2K" | 0.60元 | 6000元 |
| 像素模式卡阈值 | 2048x1152/1536x1536 | 0.30元 | 3000元(图接近2K) |
| Seedream 5.0 Lite | size: "2K" | 0.22元 | 2200元(无交互编辑) |
第一行和第三行价钱一样,第三行的图大了一倍多。第二行和第三行图差不多,第二行贵一倍。整张表里最值得记住的,就是第三行那个格子。
顺带把同门另外两款的价钱也放这儿,方便对照:Seedream 4.5是0.25元/张,4.0是0.20元/张,Lite是0.22元/张——Lite比上一代的4.5还便宜,输入参考图还完全免费。所以如果你的活儿不需要交互编辑,Lite才是那个默认答案,Pro只在“必须指哪改哪”的时候才叫出来。
怎么验证这笔账没算错
省钱的算法再漂亮,也得用真账单验一次。验证成本很低,三步:
- 用
2048x1152调一次,把返回的data[0].size记下来——确认模型没有替你四舍五入到别的尺寸。官方在档位模式下会自己定宽高,但像素模式是你说了算,返回值应该原样等于你传的数。 - 再用
size: "2K"调一次同样的提示词,返回的size应该是2816x1584那一档。 - 隔一个计费周期去费用中心拉明细,看这两笔分别落在0.30元还是0.60元。
第三步是唯一不能省的。阈值类计费最常见的坑不是算错,而是供应商的取整规则和你以为的不一样——比如“≤236万”到底是不是含等号、超出一个像素怎么算。文档写“≤”就该含等号,但把真账单和文档对一次,这个假设才从推测变成事实。235.93万距离阈值有704像素的余量,正是留给这类不确定性的安全垫;真要贴着2360000去凑,一旦对方按别的口径取整,你就整批掉进0.60元档还不知道为什么。
保哥做跨境技术选型这些年,凡是带阈值、带阶梯、带免费额度的计费项,第一个月一定单独拉一次明细对账。省下来的钱是次要的,重要的是知道自己那套成本模型到底成不成立——模型不对,后面所有的预算和报价都是虚的。
这套“按用途分层调用”的思路,和内容生产的其他环节是一样的。我在AI内容生产工作流的6阶段拆解里讲过同一个原则:管线的成本优化从来不是找一个最便宜的工具,而是让每个环节都调用刚好够用的那一档。
谁该换,谁别动?
先说四种直接划掉的情况
说清楚不适合的场景,比堆适合场景有用。以下四类,Seedream 5.0 Pro可以直接排除:
主产英文密集信息图的。字节自己在文档里承认小字结构仍存在不稳定问题,而英文文字渲染这个维度上,GPT Image 2目前仍然是更稳的选择。信息图返工一次的人力成本,远高于那点单价差。
要4K交付的。Pro的上限就是2K档(实际约446万像素)。要4K去找Lite或者4.5,这是硬边界,没有绕法。
要一次出一组的。分镜、连环画、品牌视觉套图——组图能力Pro标着“暂不支持”。硬用Pro循环调用也行,但你会失去组图那种“一组图之间保持一致性”的效果,那才是组图模式的价值所在。
素材不能出内网的。API这条路直接堵死,只能走本地方案。
一条容易漏掉的合规提醒
做数字人、真人素材二次创作的,把审核这道门提前确认清楚。生图和视频串起来的管线里,中间往往卡着一道人脸相关的审核规则,排期之前先跟商务对齐,别等管线搭完才发现走不通。这类事在跨境业务里格外要紧——你在国内跑通的流程,换个市场可能整条重来。
再说三类人的三个答案
做“改图多于生图”的生产管线:这次发布就是给你的。电商详情页、广告物料、多语种海报本地化,坐标级编辑目前在主流生图API里独一份。OpenAI兼容接口让试错成本压到半天以内,先跑通再谈规模。
已经在给别家生图API付费、且量上了千:先算那张卡阈值的账。不用换模型都能省的钱,是最容易拿到的那部分。算完再决定要不要动供应商。
只是偶尔出几张配图:别折腾。月产几十张的时候,0.30和0.60的差别不值得你花一个下午读参数表。这时候更该关心的是图本身有没有帮到内容——我做过一轮原创配图对自然流量影响的半年实测,结论是配图的独特性对流量的贡献,比它是2K还是1K重要得多。
最后提一句节奏。生图这个赛道现在的价格和能力都在按周变,任何一篇写死的对比文,保质期都不会超过一个季度。真正能留下来的是方法:读接口文档而不是发布稿,按计费单位而不是营销档位建模,把核对日期写进你的选型文档。这套动作我在评估其他AI工具时也一直在用,比如拆Lovable、v0和Bolt三款应用生成器的计费机制时,最有价值的发现同样不在功能对比里,而在那些藏在额度规则里的成本曲线。
常见问题解答
Seedream 5.0 Pro到底怎么计费,按张还是按token?
按张。响应体里有个output_tokens字段容易让人误会成按token算,但官方价格页写得很清楚:输出图≤236万像素0.30元/张,超过0.60元/张;输入参考图首张免费、第2张起0.02元/张。因审核等原因未成功输出的图片不计费。海外走BytePlus ModelArk,对应0.045和0.09美元,参考图0.003美元。
怎么用最少的钱拿到最大的图?
不要填档位,改填宽高像素值,把总像素卡在236万以下。16:9填2048x1152(235.93万),1:1填1536x1536(235.93万),都按0.30元计费。对比档位模式的1K(16:9只有1424×800),像素数多出107%,价钱完全一样。注意档位模式和像素模式不能混用,二选一。
Seedream 5.0 Pro和Lite该怎么选?
只有一条判据:需不需要交互编辑(在参考图上画框、点坐标、涂鸦来指定改哪儿)。需要就用Pro,不需要一律用Lite。因为Lite在其他所有维度上都更强:分辨率能到4K(Pro只到2K)、支持组图(一次最多15张)、支持流式输出和联网搜索、参考图能传14张(Pro只有10张)、单价0.22元比Pro的0.30元便宜,而且输入参考图完全免费。
交互编辑需要传什么特殊参数吗?
不需要。请求参数表里没有任何区域或蒙版字段。框、箭头、坐标号、涂鸦全都是你自己画在参考图上再上传,然后用prompt文字描述要在哪个标记区域做什么。提示词里记得补两句:“移除所有草图线条”和“保持构图不变”,否则你画的标记会被当成画面内容渲染进去。
Seedream 5.0 Pro的图层分离到底上线了没有?
已经在官方文档里了。7月8日刚发布时API参考中确实找不到对应能力,所以当时那批“即将上线”的说法是准确的;但在2026年7月15日更新的图片生成教程里,能力对照表中Pro那一列的“生成数量”写的是“支持生成单图/多张图层”。它不是一个独立参数,而是挂在生成数量这个维度下。需要注意的是,图层和组图是两回事:组图是多张不同的图(Pro不支持),图层是同一张图的多个层。
生成的图片链接能存多久?
只有24小时,超时自动清除。默认response_format就是url,所以务必在拿到响应后立刻下载转存到自己的存储,数据库里存自己的地址。或者把response_format设成b64_json直接拿Base64编码,省一次网络往返。这是接入时最高频的翻车点。
Seedream 5.0 Pro真的超过Gemini了吗?
截至2026年7月底没有第三方证据支持这个说法,字节官方也从未这样表述过。Artificial Analysis的文生图榜上,榜首是GPT Image 2 (high)(Elo 1340),Seedream 5.0 Pro发布三周后仍未获得有效名次——不是排名靠后,是投票量不足。唯一的官方数据是字节内部测试的可用率24.02%对Nano Banana 2的23.95%,差距在小数点后面。它的真实优势是价格和坐标级编辑,不是画质登顶。
权威参考资料
本文标题:《Seedream 5.0 Pro同一张图付0.3还是0.6元,分界线在像素不在档位》
本文链接:https://zhangwenbao.com/seedream-5-pro-image-api-pricing.html
版权声明:本文原创,转载与引用请注明作者与原文链接。许可协议: CC BY 4.0