Seedream 5.0 Pro同一张图付0.3还是0.6元,分界线在像素不在档位

Seedream 5.0 Pro同一张图付0.3还是0.6元,分界线在像素不在档位
张文保 更新 28 分钟阅读 4,462 阅读
本文目录
  1. 同样一张16:9的图,为什么有人付0.30元有人付0.60元?
  2. 236万像素这条线,到底能卡出多少便宜?
  3. 叫Pro的模型,分辨率上限为什么反而比Lite低?
  4. 这个命名会咬到评估流程
  5. 还有一条藏得更深的限制
  6. 参考图也要钱,这笔账你算进去了吗?
  7. 交互编辑到底怎么用?标记得你自己画上去
  8. 官方示例把模板给全了
  9. 为什么这件事值得单独做个工具
  10. 图层这件事,发布稿和接口文档说的不是一回事
  11. 榜单上为什么至今找不到它?
  12. 厂商自测数据该怎么读
  13. 接进独立站素材管线,哪几步最容易卡住?
  14. 图片链接只活24小时
  15. 水印默认是开的
  16. 提示词超长是丢元素,不是慢慢变糊
  17. 极速模式是个没人提的开关
  18. 参考图本身也有硬限制
  19. 多语种文字:做外贸站的先测这一项
  20. 接口兼容OpenAI SDK
  21. 跑一个月的账,具体长什么样?
  22. 怎么验证这笔账没算错
  23. 谁该换,谁别动?
  24. 先说四种直接划掉的情况
  25. 一条容易漏掉的合规提醒
  26. 再说三类人的三个答案
  27. 常见问题解答
  28. Seedream 5.0 Pro到底怎么计费,按张还是按token?
  29. 怎么用最少的钱拿到最大的图?
  30. Seedream 5.0 Pro和Lite该怎么选?
  31. 交互编辑需要传什么特殊参数吗?
  32. Seedream 5.0 Pro的图层分离到底上线了没有?
  33. 生成的图片链接能存多久?
  34. Seedream 5.0 Pro真的超过Gemini了吗?
  35. 权威参考资料
摘要:Seedream 5.0 Pro按张计费,0.30元和0.60元的分界线是236万总像素,而不是你在参数里填的1K2K。用档位模式,16:9只有1424×800(0.30元)和2816×1584(0.60元)两个选项;改用像素模式填2048x1152,像素比1K档多出107%,价钱还是0.30元。这一条差别,在月产万张的素材管线上就是三千块。下面把官方参数表、计费阈值、参考图这笔隐藏账,以及发布稿和接口文档打架的地方,一次讲清楚。

字节在2026年7月8日把Seedream 5.0 Pro挂上火山方舟的时候,社交媒体上传得最响的一句是“生图超过Gemini”。这句话字节自己从来没说过,第三方榜单到今天也还没给出任何一边的证据。

但真正值钱的东西不在那句口号里。我把火山方舟的三份官方文档(API参考、图片生成教程、模型价格)逐行读完之后,发现最该被讨论的是一件很不性感的事:这个模型的报价单有两套读法,而大多数人只知道其中一套,还是贵的那套。

先交代边界:本文所有参数、价格、能力对照均来自官方文档,我没有充值跑图。这类文章最容易翻车的地方恰恰不是主观体验,而是把过时的数字当成现状——所以这篇的重点放在把账算对、把参数钉死上。

同样一张16:9的图,为什么有人付0.30元有人付0.60元?

火山方舟的模型价格页把图片生成的计费写得很短,短到容易被扫过去:

  • doubao-seedream-5-0-pro:输出图≤236万像素0.30元/张,>236万像素0.60元/张
  • 输入参考图:首张免费,第2张起0.02元/张
  • 因审核等原因未成功输出的图片不计费

注意这里的定价变量是总像素,不是分辨率档位。而你在API里指定尺寸时,官方给了两种互斥的写法:填档位(1K2K),或者填宽高像素值(2048x1152)。这两种写法不能混用。

问题就出在这儿。填档位的时候,宽高比由模型根据你的提示词描述来定,最终落在官方的映射表上。而那张映射表,把16:9的两个选项定死成了1424×800和2816×1584。

算一下:1424×800是113.92万像素,落在0.30元档;2816×1584是446.05万像素,落在0.60元档。中间是空的。你想要一张比1424×800大、但还想按0.30元付钱的图?档位模式不给你这个选项。

236万像素这条线,到底能卡出多少便宜?

换成像素模式,情况完全不同。图片生成教程里写明了Pro的总像素取值范围是[1280x720(921600), 2048x2048x1.1025(4624220)],宽高比范围[1/16, 16]。也就是说,92.16万到462.42万之间的任意组合都合法。

而计费阈值卡在236万。那么最优解就很清楚了:在不超过236万总像素的前提下,把图开到最大。

宽高比档位模式(1K)档位模式(2K)像素模式的0.30元天花板
1:11024×1024(0.30元)2048×2048(0.60元)1536×1536=235.93万
16:91424×800(0.30元)2816×1584(0.60元)2048×1152=235.93万
4:31152×864(0.30元)2368×1776(0.60元)1760×1320=232.32万
3:21248×832(0.30元)2496×1664(0.60元)1872×1248=233.63万
21:91568×672(0.30元)3136×1344(0.60元)2340×1003=234.70万

看16:9那一行。1424×800换成2048×1152,像素数从113.92万涨到235.93万,翻了2.07倍,账单一分钱没变。距离236万这条线只差704个像素——不多不少,刚好够你把电商主图从“勉强能用”推到“印在详情页顶部不虚”。

1:1那行同理,1536×1536是所有正方形里能免费拿到的最大边长。做商品方图、社媒头图的,这个数字建议直接写进配置文件。

这里插一句读参数表的通用经验:凡是“档位”和“实际计量单位”不是同一个东西的服务,中间几乎一定有套利空间。档位是给人看的,计费是按机器读的那个数走的。保哥这些年做出海站的技术选型,在CDN流量、云存储请求数、翻译API字符数上都遇到过同一个结构——供应商用一套好记的标签包装,实际结算用另一套。写进代码的应该是后者。

叫Pro的模型,分辨率上限为什么反而比Lite低?

这是我读官方能力对照表时最意外的一格。同一张表里,四个模型并排:

能力Seedream 5.0 ProSeedream 5.0 LiteSeedream 4.5Seedream 4.0
分辨率档位1K、2K2K、3K、4K2K、4K1K、2K、4K
交互编辑
文生组图/图生组图暂不支持
流式输出暂不支持
联网搜索暂不支持
输出格式png、jpegpng、jpegjpegjpeg
提示词优化模式标准、极速标准标准标准、极速
参考图上限10张14张14张14张
限流四款统一500张/分钟

Pro的分辨率上限是2K,Lite能到4K。组图、流式、联网三项Pro全是“暂不支持”,参考图还比Lite少4张。单看这张表,Pro像个功能被阉过的版本。

字节这里的Pro指的是精度,不是功能全。它换来的东西只有一格:交互编辑。整张表里只有Pro那一列打了勾,另外三款全是叉。

这个命名会咬到评估流程

大部分产品线里,贵的型号规格全面碾压便宜的,所以团队评估新模型的本能动作是:拿最贵的那个跑一遍最重的批量任务。在Seedream这里,这个本能会直接把你带沟里——你拿Pro跑组图,它报错;你拿Pro要4K交付,它给不了;然后你得出“又贵又残”的结论,把整个系列拉黑。

正确的分工是:一次只出一张、但这张的文字位置人物特征必须分毫不差,用Pro;一次出一组、或者要4K,用Lite。这两句话应该写在团队的模型选型文档第一行。

还有一条藏得更深的限制

Lite的总像素下限是2560x1440(3686400),比Pro的1280x720(921600)高出整整4倍。翻译成人话:Lite根本出不了小图。

所以如果你的管线里有“生成缩略图”“生成图标”这类需求,Lite这条路直接堵死,Pro也只能给你92.16万像素起步的图,剩下的还得自己缩。API不给小图,低于下限是直接拒绝而不是自动放大——这个行为差异,在写重试逻辑的时候要提前判掉。

参考图也要钱,这笔账你算进去了吗?

这是价格表里最容易被跳过的一行,也是Pro和其他三款差别最大的地方:

  • Seedream 5.0 Pro:输入图首张免费,第2张起0.02元/张
  • Seedream 5.0 Lite/4.5/4.0:输入图免费

只有Pro对参考图收费。而Pro恰恰是那个主打“多图生图”“交互编辑”的型号——这两种玩法天生就要传多张图。

算一笔满配的账。用Pro做多图融合,传满10张参考图,出一张1536×1536的图:

0.30元(输出)+9×0.02元(第2到第10张参考图)=0.48元。参考图占了整单成本的37.5%。

如果输出图开到2K档,0.60+0.18=0.78元,参考图占23%。跑量的时候这不是零头。做服饰换装、模特套图这类必须堆参考图的管线,建账的时候得把参考图单独列一行,别只盯着输出单价。

这个成本结构和视频那边是同一套思路。我之前拆Seedance 2.0的提示词与计费时算过,那边是按token走的,输入含不含视频差出接近一倍的单价;生图这边换成了按张,但“你喂进去的东西也要收钱”这个原则没变。

交互编辑到底怎么用?标记得你自己画上去

Pro唯一独占的能力,实现方式比大多数人想的原始,而这恰恰是它最好用的地方。

API参考文档里对交互编辑的描述是“支持通过坐标、框选、箭头等多种方式指定编辑位置”。Seed团队的官方发布博客说得更细,列了点选、套索、框选、涂鸦四种。

但翻遍请求参数表,你找不到任何一个叫regionmask或者coordinates的字段。Body参数一共就那么几个:modelpromptimagesizeoptimize_prompt_optionsoutput_formatresponse_formatsequential_image_generationstreamtoolswatermark

答案是:框、箭头、坐标号、涂鸦,全都是你自己画在参考图上传进去的。模型识别图上那些标记,再对照prompt里的文字描述执行。

官方示例把模板给全了

教程里那条交互编辑的示例提示词值得原样抄下来:

根据手绘草图对图像进行编辑。在左下角标记区域添加一叠真实的杂志或艺术画册,并在右侧标记区域添加一个带杯碟的陶瓷杯咖啡。移除所有草图线条。保持构图不变。

四句话,每句都有活儿:第一句声明这是草图编辑任务;第二句用方位词绑定标记区域和要生成的内容;第三句移除所有草图线条——不写这句,你画的那些框和箭头会被当成画面元素一起渲染进去;第四句保持构图不变,防止模型顺手把整张图重新排一遍。

后两句是很多人第一次试会漏掉的,然后得出“交互编辑不准”的结论。它准,只是你没告诉它标记不是内容。

为什么这件事值得单独做个工具

标记既然是画上去的,那就能程序化生成。用Pillow在图上画一个矩形、写一个序号,二十行代码的事。这意味着Seedream 5.0 Pro实际上是一个可脚本化的区域编辑器

  • 批量给一百张商品图的右下角换标签,坐标固定,标记框循环画
  • 做多语种本地化,同一版海报,文字区域框住,prompt换语言
  • 模特图统一改背景,人物区域涂蓝保留,其余重绘

这三类活以前要么手动PS,要么靠不太稳的抠图管线。现在的路径是:一个画标记的脚本,一次API调用。这比模型本身的画质提升实在得多。

想走完全本地、零边际成本那条路的,我写过Claude Code加Draw Things的本地出图工作流,跑在Mac上,适合素材不能出内网的场景,代价是自己扛显存和调度。

图层这件事,发布稿和接口文档说的不是一回事

这一节是本文时效性最强的部分,也是最容易在别处读到错误说法的地方。

发布当天大量文章写“Seedream 5.0 Pro支持图层分离,一张海报能拆成10多个独立图层”。这句话的来源是Seed团队的官方博客,原文确实把智能图层分离作为已有能力介绍,没有标注即将推出。

但7月8日刚上线时,火山方舟的API参考里找不到对应字段,能力清单也只写了交互编辑——这就是那段时间“图层分离还没上线”说法的由来,当时它是对的。

到我核对这一版(图片生成教程最近更新时间2026年7月15日,API参考2026年7月21日)的时候,情况已经变了。教程里的能力对照表,Pro那一列的“生成数量”一格写着:支持生成单图/多张图层

所以现在的准确说法是:图层能力已经进了官方文档,但它的位置不在一个独立参数上,而是挂在“生成数量”这个维度下——一次调用可以返回单张图,也可以返回多张图层。这也解释了为什么Pro的组图能力标着“暂不支持”却又能返回多张:组图是多张不同的图,图层是同一张图的多个层,两码事。

结论给两条:一,7月上旬那批“图层还没上线”的文章现在已经过期,别再照抄;二,凡是同一款产品的发布稿和接口文档说法对不上,以接口文档为准,并记下核对日期——发布稿描述的是模型能力,接口文档描述的是你今天真能调到的东西,这两者中间隔着上线排期。

榜单上为什么至今找不到它?

模型发布已经三周了。我复核了Artificial Analysis的文生图榜,榜首仍然是GPT Image 2 (high),Elo 1340;后面依次是Reve 2.1(1299)、MAI-Image-2.5(1270)、Nano Banana 2和GPT Image 1.5 (high)(并列1263)。

Seedream 5.0 Pro至今没有拿到有效名次——不是排得靠后,是投票量还不足以给出可靠评分。三周没上榜,比发布当天没上榜信息量大得多。

唯一的官方对照数据来自字节内部测试:Pro的可用率24.02%,Nano Banana 2是23.95%,在营销场景高出20.20%、电商场景高出10.17%。这是厂商自测,按惯例打折听;但它至少说明字节自己也认为差距在小数点后面,卖点不在画质天花板。

厂商自测数据该怎么读

顺着这组数字讲个通用的读法,比记住数字本身有用。24.02%对23.95%——这两个数放在一起,能读出来的信息其实是发布方主动选择了一个“我们赢,但赢得很少”的对照

厂商愿意公布的对照组,永远是精心挑过的。真要拉开差距,公布的会是一个大比分;只差0.07个百分点还拿出来说,说明在这个维度上找不到更好看的数了。而后面那两个大数字——营销高20.20%、电商高10.17%——才是它真正想让你看的:不比通用画质,比你那个具体场景。

这个套路本身不算耍赖,反而是个有用的信号:厂商把细分场景的数字摆在整体数字前面,通常意味着它的产品定义就是围绕那几个场景做的。Seedream 5.0 Pro的交互编辑、多语种文字、信息密集排版,确实全都指向营销和电商物料,不指向艺术创作。看懂这层,你就不会再纠结它有没有超过Gemini——它压根没打算在那条赛道上跟人比。

把这些拼起来,Seedream 5.0 Pro的真实定位就清楚了:它不是一台更大的攻城锤,是从定价地板下面挖了条隧道,顺手卖一把对手货架上没有的工具。画质是第一梯队里的普通一员,价格是对手的一半到四分之一,坐标级编辑全场独一份。

接进独立站素材管线,哪几步最容易卡住?

把模型接进真实的内容生产流程,翻车点几乎都不在生成质量上,而在这些边角规则里。按被坑概率从高到低排:

图片链接只活24小时

官方原话是“图片URL仅保留24小时,超时后会被自动清除”。默认的response_formaturl,很多人拿到链接直接写进数据库或者CMS里,第二天整批图变成404。

正确做法只有一个:拿到响应立刻下载转存到自己的对象存储,数据库里存自己的地址。要么就把response_format改成b64_json,直接拿Base64,省掉一次网络往返。

水印默认是开的

watermark默认值true,会在图片右下角加“AI生成”字样。生产素材必须显式传false。这个默认值本身合理,但它意味着你少写一个参数,产出的就是一批带角标的废图——而且往往是批量跑完才发现。

提示词超长是丢元素,不是慢慢变糊

官方建议不超过300个汉字或600个英文单词,并且明确写了超长后的行为:“字数过多信息容易分散,模型可能因此忽略细节,只关注重点,造成图片缺失部分元素”。

注意这是缺失不是降质。从别的生图服务迁过来、习惯了堆长提示词的,务必先做一轮压缩,否则你会遇到一种很难排查的现象:图很好看,就是少了个东西,而且每次少的还不一样。

极速模式是个没人提的开关

optimize_prompt_options.mode可以设成standardfast。Pro和4.0支持fast,Lite和4.5只有standard。官方对fast的描述是“显著提升生成速度,但会在一定程度上牺牲图片质量”。

这个开关在两类场景里很值:给运营做草稿预览、以及A/B测多个构图方向。先用极速跑二十版挑方向,选定后用标准模式出终稿。发布报道里几乎没人提它,但它是这套参数里ROI最高的一个。

参考图本身也有硬限制

  • 格式:jpeg、png、webp、bmp、tiff、gif、heic、heif
  • 单张不超过30MB
  • 总像素不超过6000×6000=3600万
  • 宽高比在1/16到16之间,宽高各自大于14像素
  • Base64传入时格式必须是data:image/<格式>;base64,<编码>,且格式名必须小写

最后那条小写要求,是那种排查半小时才发现的错误。用户上传的手机原图经常是HEIC且尺寸巨大,管线前面得有一道压缩和转码,不能直接透传。

多语种文字:做外贸站的先测这一项

Seed团队的发布博客里,除了交互编辑,另一个被反复强调的是原生多语种文字生成——官方口径是“十余种全球常用语言的直接输入与高质量生成”,点名列了法语、德语、俄语、日语、韩语、西班牙语和阿拉伯语,其中阿拉伯语意味着它处理了从右往左的书写方向。

这一项对做多市场独立站的人价值远大于画质。海报本地化这件事,过去的常规路径是设计师出一版母版,然后每个语种手动排一遍——文字长度一变,整个版式就得重调,德语尤其擅长把一个英文单词膨胀成三倍长度。现在的路径变成:母版生成一次,文字区域框住,prompt换语言重出。

但别把官方口径直接当成验收标准。官方自己在文档里承认小字结构仍存在不稳定问题,而多语种和小字这两件事经常同时出现——比如成分表、规格参数、免责声明。所以接入前值得花半天做一件事:拿你真实要投放的那几个语种,各出十张带小字的图,人工数一遍错字率。这个数字比任何榜单都更能决定你要不要改流程。字符集不常见的语种(比如波兰语的ę、匈牙利语的ő)更要单独验,字形缺失往往不报错,只是悄悄画歪。

接口兼容OpenAI SDK

官方文档里每个示例都给了Curl、Python、Java、Go和OpenAI五个版本。client.images.generate(...)可以直接用,从既有的生图服务迁过来基本是改base_url和模型名的工作量。海外账号走BytePlus ModelArk,Model ID换成dola-seedream-5-0-pro-260628,计费口径是同一套:≤236万像素每张0.045美元,超过0.09美元,参考图首张免费、之后每张0.003美元。

跑一个月的账,具体长什么样?

假设一个中等体量的独立站,每月需要1万张商品和营销图,其中7000张是16:9的横图(详情页、广告位),3000张是1:1方图(列表页、社媒)。

方案参数写法单价月成本
档位模式保守派size: "1K"0.30元3000元(图偏小)
档位模式豪华派size: "2K"0.60元6000元
像素模式卡阈值2048x11521536x15360.30元3000元(图接近2K)
Seedream 5.0 Litesize: "2K"0.22元2200元(无交互编辑)

第一行和第三行价钱一样,第三行的图大了一倍多。第二行和第三行图差不多,第二行贵一倍。整张表里最值得记住的,就是第三行那个格子。

顺带把同门另外两款的价钱也放这儿,方便对照:Seedream 4.5是0.25元/张,4.0是0.20元/张,Lite是0.22元/张——Lite比上一代的4.5还便宜,输入参考图还完全免费。所以如果你的活儿不需要交互编辑,Lite才是那个默认答案,Pro只在“必须指哪改哪”的时候才叫出来。

怎么验证这笔账没算错

省钱的算法再漂亮,也得用真账单验一次。验证成本很低,三步:

  1. 2048x1152调一次,把返回的data[0].size记下来——确认模型没有替你四舍五入到别的尺寸。官方在档位模式下会自己定宽高,但像素模式是你说了算,返回值应该原样等于你传的数。
  2. 再用size: "2K"调一次同样的提示词,返回的size应该是2816x1584那一档。
  3. 隔一个计费周期去费用中心拉明细,看这两笔分别落在0.30元还是0.60元。

第三步是唯一不能省的。阈值类计费最常见的坑不是算错,而是供应商的取整规则和你以为的不一样——比如“≤236万”到底是不是含等号、超出一个像素怎么算。文档写“≤”就该含等号,但把真账单和文档对一次,这个假设才从推测变成事实。235.93万距离阈值有704像素的余量,正是留给这类不确定性的安全垫;真要贴着2360000去凑,一旦对方按别的口径取整,你就整批掉进0.60元档还不知道为什么。

保哥做跨境技术选型这些年,凡是带阈值、带阶梯、带免费额度的计费项,第一个月一定单独拉一次明细对账。省下来的钱是次要的,重要的是知道自己那套成本模型到底成不成立——模型不对,后面所有的预算和报价都是虚的。

这套“按用途分层调用”的思路,和内容生产的其他环节是一样的。我在AI内容生产工作流的6阶段拆解里讲过同一个原则:管线的成本优化从来不是找一个最便宜的工具,而是让每个环节都调用刚好够用的那一档。

谁该换,谁别动?

先说四种直接划掉的情况

说清楚不适合的场景,比堆适合场景有用。以下四类,Seedream 5.0 Pro可以直接排除:

主产英文密集信息图的。字节自己在文档里承认小字结构仍存在不稳定问题,而英文文字渲染这个维度上,GPT Image 2目前仍然是更稳的选择。信息图返工一次的人力成本,远高于那点单价差。

要4K交付的。Pro的上限就是2K档(实际约446万像素)。要4K去找Lite或者4.5,这是硬边界,没有绕法。

要一次出一组的。分镜、连环画、品牌视觉套图——组图能力Pro标着“暂不支持”。硬用Pro循环调用也行,但你会失去组图那种“一组图之间保持一致性”的效果,那才是组图模式的价值所在。

素材不能出内网的。API这条路直接堵死,只能走本地方案。

一条容易漏掉的合规提醒

做数字人、真人素材二次创作的,把审核这道门提前确认清楚。生图和视频串起来的管线里,中间往往卡着一道人脸相关的审核规则,排期之前先跟商务对齐,别等管线搭完才发现走不通。这类事在跨境业务里格外要紧——你在国内跑通的流程,换个市场可能整条重来。

再说三类人的三个答案

做“改图多于生图”的生产管线:这次发布就是给你的。电商详情页、广告物料、多语种海报本地化,坐标级编辑目前在主流生图API里独一份。OpenAI兼容接口让试错成本压到半天以内,先跑通再谈规模。

已经在给别家生图API付费、且量上了千:先算那张卡阈值的账。不用换模型都能省的钱,是最容易拿到的那部分。算完再决定要不要动供应商。

只是偶尔出几张配图:别折腾。月产几十张的时候,0.30和0.60的差别不值得你花一个下午读参数表。这时候更该关心的是图本身有没有帮到内容——我做过一轮原创配图对自然流量影响的半年实测,结论是配图的独特性对流量的贡献,比它是2K还是1K重要得多。

最后提一句节奏。生图这个赛道现在的价格和能力都在按周变,任何一篇写死的对比文,保质期都不会超过一个季度。真正能留下来的是方法:读接口文档而不是发布稿,按计费单位而不是营销档位建模,把核对日期写进你的选型文档。这套动作我在评估其他AI工具时也一直在用,比如拆Lovable、v0和Bolt三款应用生成器的计费机制时,最有价值的发现同样不在功能对比里,而在那些藏在额度规则里的成本曲线。

常见问题解答

Seedream 5.0 Pro到底怎么计费,按张还是按token?

按张。响应体里有个output_tokens字段容易让人误会成按token算,但官方价格页写得很清楚:输出图≤236万像素0.30元/张,超过0.60元/张;输入参考图首张免费、第2张起0.02元/张。因审核等原因未成功输出的图片不计费。海外走BytePlus ModelArk,对应0.045和0.09美元,参考图0.003美元。

怎么用最少的钱拿到最大的图?

不要填档位,改填宽高像素值,把总像素卡在236万以下。16:9填2048x1152(235.93万),1:1填1536x1536(235.93万),都按0.30元计费。对比档位模式的1K(16:9只有1424×800),像素数多出107%,价钱完全一样。注意档位模式和像素模式不能混用,二选一。

Seedream 5.0 Pro和Lite该怎么选?

只有一条判据:需不需要交互编辑(在参考图上画框、点坐标、涂鸦来指定改哪儿)。需要就用Pro,不需要一律用Lite。因为Lite在其他所有维度上都更强:分辨率能到4K(Pro只到2K)、支持组图(一次最多15张)、支持流式输出和联网搜索、参考图能传14张(Pro只有10张)、单价0.22元比Pro的0.30元便宜,而且输入参考图完全免费。

交互编辑需要传什么特殊参数吗?

不需要。请求参数表里没有任何区域或蒙版字段。框、箭头、坐标号、涂鸦全都是你自己画在参考图上再上传,然后用prompt文字描述要在哪个标记区域做什么。提示词里记得补两句:“移除所有草图线条”和“保持构图不变”,否则你画的标记会被当成画面内容渲染进去。

Seedream 5.0 Pro的图层分离到底上线了没有?

已经在官方文档里了。7月8日刚发布时API参考中确实找不到对应能力,所以当时那批“即将上线”的说法是准确的;但在2026年7月15日更新的图片生成教程里,能力对照表中Pro那一列的“生成数量”写的是“支持生成单图/多张图层”。它不是一个独立参数,而是挂在生成数量这个维度下。需要注意的是,图层和组图是两回事:组图是多张不同的图(Pro不支持),图层是同一张图的多个层。

生成的图片链接能存多久?

只有24小时,超时自动清除。默认response_format就是url,所以务必在拿到响应后立刻下载转存到自己的存储,数据库里存自己的地址。或者把response_format设成b64_json直接拿Base64编码,省一次网络往返。这是接入时最高频的翻车点。

Seedream 5.0 Pro真的超过Gemini了吗?

截至2026年7月底没有第三方证据支持这个说法,字节官方也从未这样表述过。Artificial Analysis的文生图榜上,榜首是GPT Image 2 (high)(Elo 1340),Seedream 5.0 Pro发布三周后仍未获得有效名次——不是排名靠后,是投票量不足。唯一的官方数据是字节内部测试的可用率24.02%对Nano Banana 2的23.95%,差距在小数点后面。它的真实优势是价格和坐标级编辑,不是画质登顶。

权威参考资料

分享到
标签
版权声明

本文标题:《Seedream 5.0 Pro同一张图付0.3还是0.6元,分界线在像素不在档位》

本文链接:https://zhangwenbao.com/seedream-5-pro-image-api-pricing.html

版权声明:本文原创,转载与引用请注明作者与原文链接。许可协议: CC BY 4.0

继续阅读
发表评论
分享到微信 或在下方手动填写
支持 Ctrl + Enter 提交