优劣不是绝对的,要看它落进谁的流程里。下表左两列是竞品事实,右两列是我们的判断——这张表是整份报告的重点。
| 竞品做法 | 在它的场景里 | 在我们的场景里 | 我们的取舍 |
|---|---|---|---|
| 三模式并列 一键成片 / 批量混剪 / 分镜剪辑 |
优 覆盖三类用户,各自有明确入口 | 劣 我们已有经典混剪、分镜剪辑、脚本生成三条路径,互相矛盾、配置打架——再多一种分类只会加剧分裂 | 合并为唯一五步流程;旧入口置灰不删,置灰即回退开关 |
| 出片配置暴露 30+ 引擎参数 镜头数、单镜秒数、变速、滤镜、转场、三路音量、亮度/对比度/饱和度、字幕字号 |
优 代运营团队需要逐项精调,控制力即价值 | 劣 用户既看不懂也不该决定;更糟的是参数之间会互相冲突(镜头数 × 单镜秒数 × 变速共同决定时长,用户配完必然对不上目标时长) | 收敛到 4 项(音色 / BGM / 字体 / 原音开关);镜头数、镜长由 N + T 推导,不交给用户 |
| 去重靠随机转场 / 滤镜 / 加速 0.75–2.0x | 优 视觉指纹 + 时长指纹,简单有效 | 部分劣 滤镜、转场、变速已被我们收进策略内部(不再暴露),不能再作为用户侧的差异化手段 | 抄目标,换路径:改为四维度随机实例化(口播 / 素材编排含入出点 / 音色 / BGM / 字体),随机种子固化进任务快照 |
| 素材「使用状态」筛选 从未使用 / 1-3 / 4-6 / 7-9 / 10 次以上 |
优 把去重下沉到素材层,用户可主动避开用爆的素材 | 不够 它依赖用户自觉去筛;我们的用户不配参数,靠自觉拦不住 | 升级为系统侧硬拦截:每组素材 ≥3 段达标,不足禁止生成;且下限与 N 无关 |
| AI 帮写一次 ≤24 条 字幕 50 条 / 标题 50 条 / 音乐 100 首的大池子 |
优 铺量场景的瓶颈在写文案,一次给足候选 | 劣 一个镜头组只讲 1 条口播,池是文案变体不是凑数;按条数补齐会产生大量废文案,且用户改一次 N,已生成的口播全作废 | 每组 ≥1 条硬性、建议 ≥3 条,更多变体由用户主动仿写追加,不由系统按 N 补齐 |
| 镜头组模板市场 行业 → 子品类两层(餐饮 → 火锅) |
优 降低策划门槛,是分镜剪辑的成立前提 | 暂不适用 我们已有脚本生成能力,缺的不是模板而是入口统一 | 不做独立模板市场;脚本生成内嵌为流程第二步的组件,同源同数据,不重复实现 |
| (竞品没有) 存量链路兼容 |
— | 我们的硬约束 改造对象是一条已在生产环境出片的核心链路,老数据、老用户、老行为都不能动 | 竞品给不了,只能自己定:老脚本只读映射、老请求等价翻译、老作品收纳「未分组」且行为完全一致、置灰即回退 |
取舍不是一次想清楚的。下表第三列是「曾经的方案」,第四列是推翻原因——被推翻的部分才是这次重构真正花时间的地方。
| 编号 | 当前结论 | 曾经的方案 | 推翻原因 |
|---|---|---|---|
| D1 | 三条路径合并为唯一五步流程,旧入口置灰保留作回退开关 | 保留三条路径,各自优化 | 脚本与素材强绑定、配置互相矛盾是结构问题,不是参数问题——补参数救不了 |
| D2 | 用户只决定 N 与 T;镜头数、镜长由 N+T 推导;高级配置折叠为 4 项 | 沿用暴露引擎参数的做法(竞品即如此) | 这些参数要么由内容推导(镜头数、镜长),要么属策略内部(变速、滤镜、转场、音量),交给用户只会制造矛盾配置 |
| D3 | 差异来自四维随机实例化(口播 / 素材编排含入出点 / 音色 / BGM / 字体),种子固化进任务快照 | 靠「素材段数 ≥ N」保证每条画面不重复 | 取段区间、顺序、变速与文案变体的组合空间已足够,不必靠堆素材;堆素材会把成本转嫁给用户 |
| D4 | 素材达标线固定为每组 ≥3 段,与 N 无关,不足禁止生成不降级 | 达标线与 N 联动(组池容量 ≥ N 才达标) | 镜头组是情节段落,段数下限是组的固有属性;与 N 联动会让用户为多出几条片被迫上传大量素材,且长素材折算口径说不清 |
| D5 | 老链路零漂移 + 随时可回退:老脚本只读映射、老作品「未分组」行为完全一致、置灰即开关 | — | 竞品无此约束可参考,只能自己定义:改造对象在生产环境出片,回退能力优先于新流程体验 |
口播池规模:每组 ≥1 条硬性、建议 ≥3 条,想要更多由用户主动仿写追加,而不是系统按 N 自动补齐。原因是「一个镜头组只讲 1 条口播,池是文案变体不是凑数」——按 N 补齐会产生大量废文案,且用户改一次 N,已生成的口播全部作废。