Seis segundos
Todas las solicitudes usan la misma duración.
Metodología de investigación · 2026 R1
Este es el contrato público y legible por máquinas de una prueba prevista con cuatro modelos. Fija qué se genera, cómo cuentan los fallos, qué ven los revisores y qué debe publicarse antes de permitir una afirmación de calidad.
No se ha completado ninguna generación, puntuación humana, resultado ni clasificación. La metodología se publica antes del resultado.
Comprueba si tomas cortas conservan personas y objetos, completan un cambio en el orden pedido, mantienen legible la geografía, muestran contacto y reacción, y entregan sonido sincronizado escuchado directamente. Es una muestra de seis tareas en la integración de Tovaki, no un ranking universal de proveedores.
El resumen cubre cada byte del protocolo privado, incluidos prompts exactos, lista de modelos, pesos, reintentos y puerta de publicación. Una divulgación posterior con el mismo resumen demuestra que el archivo no cambió; el hash por sí solo no demuestra que se ejecutó la prueba.
SHA-256 · Resumen del protocolo
3efa03ed5fb305054069571bee501e0a06cb247e3334530c9dd7820cff8840d7Todos los candidatos reciben la misma exigencia creativa dentro de cada tarea. No se corrigen diferencias con prompts específicos ni eligiendo una repetición más bonita.
Todas las solicitudes usan la misma duración.
Un formato vertical y un nivel declarado de integración.
El audio opcional se activa y el audio permanente sigue activo; no se mezclan condiciones mudas y con sonido.
Sin reescritura por proveedor, mejora oculta ni reintento creativo.
Se conservan los originales y todos reciben la misma entrega H.264/AAC.
Una letra no identifica permanentemente al mismo modelo entre tareas.
El conjunto cubre deliberadamente trabajo luminoso, cálido, cómico, cinético, táctil, observacional y poético para que una estética estrecha no represente toda la capacidad cinematográfica.
Los revisores puntúan de 0 a 5 en pasos de 0,5. Los pesos suman 100; un fotograma bonito no oculta fallos de tiempo, contacto, sonido o causalidad.
Aparecen personas, objetos, acciones, orden, entorno y prohibiciones solicitados.
El movimiento progresa sin parpadeos, sustituciones ni saltos temporales inexplicables.
Las mismas personas y objetos rastreables persisten durante movimiento y oclusión.
Aproximación, contacto, fuerza, transferencia, liberación y respuesta son legibles.
El movimiento revela el evento y mantiene comprensibles dirección y espacio.
Mirada, pausa, escucha y reacción siguen al evento que las provoca.
Voz y efectos son audibles, sincronizados, coherentes en perspectiva y escuchados directamente.
La toma cumple su función narrativa sin esconder el evento importante.
Verificar el resumen y obtener un límite de créditos con responsable antes de solicitar nada.
Registrar primera toma, fallo técnico, reintento, crédito real, fecha y SHA-256.
Crear un proxy anónimo por celda y escuchar directamente todo el audio.
Tres revisores usan órdenes distintos sin nombres, proveedores, precios, metadatos ni mapa privado.
Se bloquean por hash las tres tarjetas antes de revelar identidad; un cambio invalida el análisis.
Cada celda permite un solo reintento por error del proveedor, timeout, archivo dañado, duración o resolución devuelta incorrecta, o pista de audio obligatoria ausente. Una composición débil, interpretación extraña o historia fallida permanece como evidencia.
Primera pasada prevista: 1620 créditos Tovaki. Techo absoluto si cada celda necesita un reintento técnico permitido: 3240. La generación no está autorizada hasta que un responsable apruebe un límite.
Alcance, ajustes, categorías, pesos, reintentos, bloqueo, presupuesto, lenguaje de publicación y resumen del protocolo.
Prompts exactos, lista de modelos, hashes de muestras, fallos redactados, puntuaciones anónimas, créditos reales y limitaciones.
Identidad personal de revisores sin consentimiento, credenciales o tokens y metadatos privados innecesarios para reproducir el resultado.
Estas fuentes informan controles concretos; no respaldan a Tovaki ni convierten este pequeño estudio en su benchmark.
Separar calidad temporal, calidad de fotogramas y consistencia con la condición.
Probar cambios de estado y relación solicitados a través del tiempo.
Vincular el juicio humano a dimensiones explícitas y limitaciones.
Separar condiciones con audio y declarar ajustes y alcance del endpoint.