依据项目实际经历整理的流程示意。
一张图好看,一组图还要把话说完
ContentOS 的定位是“绘你所想,一键生成系列图文内容”。我在意的是“系列”两个字:一张图让人眼前一亮,一组图还要有先后,把一件事讲清楚。
产品从 2026 年 5 月开始正式运营,长期使用用户 UV 接近 100。我作为创始人,负责产品战略、设计、项目管理与运营,与独立团队一起推进。这里记录的是长期使用用户,不是日活、月活或付费人数。
我希望用户说一次想法、选好图片数量,就能得到围绕同一主题展开的图文。想把话说清楚,不该先花一番功夫学着写提示词。
像编辑一本小杂志那样安排图片
我把多图创作理解成编辑一本小杂志:封面吸引注意,后面的页面解释观点、补充信息,最后把意思收住。如果每一页都争着当封面,读者可能觉得热闹,却没弄懂究竟在说什么。
所以我把每张图看成一个“信息帧”,先想清它要讲什么,再安排风格、构图和细节。检查时也得把整组放在一起看:这两张是不是重复了,中间有没有少讲一步,图和文字能不能对得上。
产品按这个顺序组织生成。导演式 Agent 先列大纲,把内容拆开,确定各部分的核心意思,再生成图片提示词和图片。先分好每张图的任务,后面的生成才有依据。
改个标题,需要多复杂的工具
我们最初尝试过 Canvas 区域选择,让用户圈出要改的位置。后来发现,在这个场景里,用文字描述也能达到相近的修改精准度,于是简化了界面。
用户想要的,是把图片改成自己需要的样子。如果用文字就能说清楚要改什么,模型也能照着修改,还需要让用户多学一套操作吗?多一个控制项,确实可能让人改得更细,也会多一件要学的事。我得看它带来的好处,是否值得这份麻烦。
复杂的局部修改仍可能需要区域工具。这次去掉一些操作,是根据眼前任务作出的选择。花时间做出来了,不代表每个场景都需要它。
生成以后,用户还要能改、能拿走
ContentOS 提供预览、复制、下载、重新生成和历史记录。多模态模型辅助检查图文,用户看过结果,再判断哪里需要改、是否继续生成。
我想继续观察的是,用户要改几次,才会愿意拿这一组内容去用。第一次出图让人惊喜,后面如果每改一处都得从头来,很快就会觉得麻烦。目前还没有一个统一的效率指标能回答这个问题。
“一键生成”也只说到生成。平台预览可以帮助检查呈现,事实核验和发布决定仍由创作者完成,不能理解成全平台一键自动发布。下方的真实截图保留了样例原有的文字渲染问题。这些地方用起来会碰到,也需要继续改。
下一次,先弄清为什么要重做
做这个产品,让我更关心用户能不能看懂生成过程,出了问题能不能接着改。模型会换,提示词也会调整,但内容是给谁看的、每张图要讲什么,仍然得先想清楚。
后续迭代,我想把修改原因记得更具体一些:大纲没分好,图文对不上,还是图里的字写错了?原因不同,下一步可能是改大纲、改提示词,也可能确实需要重出一张图。至少别每次都只留下“又生成了一次”。
