我们和 Seko 到底差在哪,又强在哪
本页关于 Seko 的所有陈述,来自 2026-09-09 保存的 一次完整使用存档(网页 + 49 个资源文件,共 491,243 字符), 内容是一部短片从上传参考图 → 资产标准化 → 画风选择 → 剧本润色 → 分镜表 → 批量生图 → 角色三视图 → 提交视频生成的完整过程。
存档里有原文,可以当场翻出来对。
这次记录里没出现。不等于产品没有 —— 说成「他们没有」被当场戳穿,这页就白做了。
存档全文词频
一个团队的词汇量长在哪,产品的能力就长在哪。下面是这次存档全文(含 Agent 对话与全部节点内容)的出现次数。
「三视图」28 次、「运镜」14 次 —— 他们对画面和一致性是认真的。 但「景别」「焦距」「轴线」「正反打」「改写」各 0 次, 「机位」仅有的 2 次也只是「低机位跟拍」这样的形容词。
这不是说他们做得不好,是说他们解决的问题跟我们不是同一个: 他们在解决「怎么做出一条好看的片子」,我们在解决「怎么把一百集管住」。
逐项对照
运镜、机位以自然语言写在分镜文本里,例如「低机位跟拍」「稳定器平移跟随」。存档中未见结构化的景别 / 机位字段。
12 个结构化字段:景别 / 机位角度 / 运镜 / 时长 / 画面 / 对白 / 角色 / 道具 / 情绪 / 光效 / 转场 / 音效,取值域固定。
为什么这件事重要:字段化才能逐项统计改写率,才知道 AI 到底哪一项不专业。写成一段话就只能整段重写。
本次存档未见机位平面图、焦距、视锥或景别推算。
俯视机位平面图:拖角色 / 相机 / 光源,焦距 14–135mm 实时改变视锥,相机到主体的距离按全画幅传感器反算景别并写回分镜表。
为什么这件事重要:分镜的核心是空间关系。没有平面图,机位就只是一句形容词。
本次存档未见「轴线」「跳轴」「正反打」任何一处。
两个主要角色之间自动画轴线,相机越到另一侧且与上一镜不一致时报跳轴警告。
为什么这件事重要:跳轴是观众会立刻察觉方位错乱的硬错误。做这件事的前提是知道拍戏是怎么回事。
从风格库中推荐若干个供选择(本次推荐 6 个,另有「更多画风」入口)。选定后落成「基础画风风格词 + 一段画风描述」整块文本。
八层提示词:画风 / 影调 / 构图 / 主体一致性 / 表演 / 场景道具 / 运镜 / 负向,逐层可开关、可覆写;外挂真人感增强包与古装规制包(唐宋明各一套形制词库)。
为什么这件事重要:差别不在风格库大不大,在能不能拆开单独调。整块文本改不动其中一层。
角色三视图 + 参考图引用 + 标准化资产图。存档中出现 28 次「三视图」,工作流成熟。
角色外形锚点强制注入每个出场镜头的提示词 L4 层(写死眉骨、衣料、发式等)。三视图槽位已留,本期未做生成。
为什么这件事重要:这一项他们做得比我们完整,我们只做了文本锚点这一半。
本次存档未见改写率、认可率或任何质量指标。
AI 首版字段快照永不覆写,人工每改一个格子落一条流水;实时算总体与分字段改写率、文本字段的字符级改写率、镜头切分点认可率。
为什么这件事重要:这是 P0 唯一的考核项。没有这个数,「分镜够不够专业」就只是各说各话。
顶部横幅公开售卖「Seedance 2.5 普惠版,仅 9 积分/秒」,生成节点的模型芯片如实显示该名称 —— 降配档是公开商品,并未隐瞒。存档中未见调用回执或校验机制。
哈希链、降级判定、退款字段、严格模式开关与回执展示已经实现;当前回执为演示数据,真实图片/视频生成接入后再由厂商回包自动写入。
为什么这件事重要:问题不是谁不诚实,是同名模型有多档之后,调用方没有任何核对手段。我们把它变成可核对的。
本次存档为单一作品的工作区,未见「项目」「审校」「成本」等词。
剧目 → 集 → 场 → 镜 四级;每个剧目独立的资产库、风格、存证账本与指标看板。
为什么这件事重要:客户要交付的是一百集,不是一条片子。
React Flow 无限画布,节点类型含文本 / 图片 / 视频 / 音频生成与上传,节点工具条有全景、多角度、九宫格、画面切分、打光、故事推演、对口型、消除笔、图片超清、合成视频。
同样是 React Flow,按场→镜自动布局成收敛结构,节点带模型芯片与存证徽章,双击进导演台;布局、备注和助手会话目前只保存在本次浏览器会话。
为什么这件事重要:他们的画布是发散的,适合做一条片子;我们的是收敛的,因为要管一百集。这是取舍不是优劣。
我们明确不如它的地方
这一节是故意放进来的。一份只说自己好的对照表,看的人一眼就知道不能信。
Seko 是跑通的商用产品,接了即梦、Seedance、MiniMax 等多个模型。我们本期出图出视频是预置素材,只跑通了分镜这一段。
他们右栏的 Agent 能从一句话推进到资产、画风、分镜、生成全流程,还有 Skill 体系(故事成片制作、分镜设计、角色三视图生成)。我们已补齐对话面板与镜头引用交互,但目前是本地规则助手,尚未接真实模型和技能编排。
他们把三视图做成了一致性工作流的核心环节,且能真实生成。我们只留了槽位和文本锚点。
我们已补齐全景、多角度、九宫格、画面切分、打光和故事推演入口,其中九宫格可整理画布、打光可进入导演台;真实多角度/切分生成、消除笔、图片超清和对口型仍未接入。
他们有真实用户和商业化验证,我们只有一个演示环境。
这些差距我们不打算在 P0 补。因为它们都不影响「自动拆出来的分镜,专业创作者是改几处就能用,还是不如自己重写」这个问题的答案 —— 而这是种子阶段唯一要回答的问题。
存档原文在项目根目录:Seko - World Class AI Video Generation Platform.html。 有疑问的条目可以当场打开搜关键词核对。