统一 6 秒
每次请求使用同一目标时长。
研究方法 · 2026 R1
这是四模型计划测试的公开机器可读合同。它先固定生成范围、失败计入方式、评审可见内容与发布门,再允许任何质量结论出现。
尚未完成供应商生成、人工评分、结果或排名。本页先公开方法,再等待证据。
它检查短视频能否保持人物与物件身份、按正确顺序完成变化、维持可读的镜头地理、表现真实接触与反应,并交付经过完整直接监听的同步声音。它只是六任务的 Tovaki 接入样本,不是供应商通用排行榜。
下方摘要覆盖完整私人协议的每一个字节,包括精确提示词、本轮模型名单、权重、重试和发布门。日后披露的文件若摘要相同,可证明协议没有变化;摘要本身不能证明实验已经执行。
SHA-256 · 协议摘要
3efa03ed5fb305054069571bee501e0a06cb247e3334530c9dd7820cff8840d7每个任务内,所有候选接收同一创作要求。不能用模型专属提示词或只挑更漂亮的重跑结果修饰差异。
每次请求使用同一目标时长。
统一竖屏格式与公开接入分辨率档。
可选音频会开启,强制音频保持开启;静音与有声条件不会混在一起。
不为供应商改写,不做隐藏增强,不允许创意性重试。
保留原始文件;评审只接收同一 H.264/AAC 配方。
同一个匿名字母不会跨任务永久对应某个模型。
任务刻意覆盖明亮、温暖、喜剧、动感、触感、观察与诗意风格,避免一种狭窄审美替代电影制作能力。
评审使用 0–5 分、0.5 步长。权重总计 100;一张漂亮静帧无法掩盖时间、接触、声音或故事因果错误。
要求的人物、物件、动作、顺序、场景和禁止项都实际出现。
运动发展过程中没有闪烁、突然替换或无法解释的时间断裂。
人物和可追踪物件在运动、遮挡前后保持同一身份。
接近、接触、受力、转移、释放和物理反馈都清楚可读。
镜头服务事件,人物方向和空间关系保持可理解。
视线、停顿、倾听和反应发生在引发它们的事件之后。
对白与音效可听、同步、空间一致,并经过完整直接监听。
镜头无需遮住关键事件就能完成预定的叙事工作。
核对协议摘要,并在任何请求前取得具名积分上限审批。
记录每次首发、技术失败、重试、实扣积分、时间戳和 SHA-256。
每个单元生成一个匿名代理,完整直接监听全部音轨。
三位评审使用不同随机顺序,看不到模型、厂商、价格、元数据或私人映射。
身份公开前锁定三份评分卡哈希;锁分后修改会使分析失效。
每个单元最多重试一次,且只限供应商错误、超时、文件损坏、返回错误时长或分辨率、缺少必要音轨。构图弱、表演怪或故事没有完成,都必须保留为证据。
首轮计划 1620 Tovaki 积分。若每个单元都发生一次允许的技术失败,协议绝对上限为 3240。具名负责人批准前,生成仍未获授权。
范围、设置、任务类别、评分权重、重试规则、锁分规则、预算上限、发布语言和协议摘要。
精确提示词、本轮模型名单、样本哈希、脱敏失败台账、匿名原始评分、实际积分和局限。
未经同意的评审个人身份、供应商凭证或令牌,以及复现实验不需要的私人供应商元数据。
以下来源只影响具体控制项;它们不为 Tovaki 背书,也不会把这项小型接入研究变成对应论文的基准。
拆分时间质量、单帧质量与条件一致性。
测试要求的状态与关系是否按时间完成变化。
把人工判断绑定到明确维度,并公开综合分的局限。
分开有声音条件,并明确固定设置与端点范围。