El primer libro blanco sistemático sobre la industria cinematográfica de IA del mundo
Lanzamiento conjunto
Resumen ejecutivo
El cine de IA ha trascendido la temprana pregunta sobre si los equipos de producción utilizarán herramientas generativas. La pregunta estratégica ahora es cómo el vídeo generativo, los modelos nativos de audio y vídeo, los modelos de mundo interactivos, los agentes, el cálculo espacial y la infraestructura de procedencia se combinan para crear un nuevo medio, un nuevo sistema industrial y un nuevo problema de gobernanza. El resultado no es simplemente una versión más barata de la producción cinematográfica convencional. Es una transición desde archivos audiovisuales fijos hacia sistemas culturales que pueden generar, responder, persistir, transaccionar y mantener la rendición de cuentas a lo largo del tiempo.
Este libro blanco define el cine nativo de IA como una obra audiovisual en la que la inteligencia artificial tiene un papel material y constitutivo en las dimensiones creativas centrales —incluyendo la narrativa, la imagen, el sonido, el personaje y la interacción— y en la que la obra no puede separarse completamente del proceso habilitado por IA que la hace posible. Para mantener el juicio artístico separado de la clasificación técnica, el documento introduce un modelo de doble eje: Agencia Creativa P0–P4 y Generación en Tiempo de Ejecución R0–R4. El umbral del 51%+ es un marcador de calificación en el eje de agencia creativa; no es una cuenta de píxeles, una cuenta de modelos ni una puntuación de calidad.
El frente técnico se está desplazando de la plausibilidad visual de formato corto a la coherencia de largo alcance. La identidad, la geografía, la causalidad, la permanencia de los objetos, el desarrollo emocional y la continuidad imagen-sonido deben mantenerse estables entre escenas y sesiones. Los sistemas en tiempo real añaden un requisito de ingeniería: la pila debe interpretar la intención, mantener el estado del mundo, asignar modelos, generar dentro de un presupuesto de latencia, imponer políticas de seguridad, registrar eventos y degradarse de forma segura cuando fallen. Los sistemas públicos han demostrado interacción en tiempo real significativa, pero la estabilidad de larga duración, la acción sin fin, la consistencia multiusuario, el control de costos y la gobernanza permanecen como puertas de productización [R07–R10].
Las gafas de IA y la computación espacial extienden esta transición hacia el mundo físico. Una cámara, un micrófono, una señal de mirada, la posición y la comprensión del entorno pueden convertirse en entradas narrativas; un personaje puede acompañar a una persona a través de lugares y tiempos. Esto crea nuevas formas—eventos conscientes de la ubicación, narrativas compartidas en espacios públicos, compañeros persistentes y superposiciones privadas—pero también plantea deberes más fuertes respecto a la privacidad de los transeúntes, la atención, el consentimiento, la memoria y la interrupción segura [R24–R27].
El mercado se reorganizará alrededor de cinco nuevas escaseces: descubrimiento confiable, juicio artístico, personajes y mundos persistentes, autorización legal y relaciones comunitarias duraderas. Los ingresos pueden expandirse desde la taquilla y la licencia hacia suscripciones a mundos, servicios de personajes, eventos interactivos, entornos empresariales, servicios de activos y solicitudes mediadas por agentes. Sin embargo, la generación continua también convierte parte de una empresa de contenidos en un operador de servicios en la nube. Por lo tanto, el crecimiento sostenible depende de la economía unitaria por minuto aceptable, por sesión y por mundo activo—no por el costo de producir una sola toma de prueba.
La base de activos se expande desde una película terminada hasta una familia de activos: obra, flujo de trabajo, personaje, mundo, comportamiento y registro. Cada tipo de activo necesita identificadores distintos, lógica de versiones, envoltorios de permisos y controles de ciclo de vida. Index.Film™ se posiciona como infraestructura para identificación, registro, búsqueda y colaboración. El indexado no crea, transfiere ni confirma derechos legales; la inclusión no es una recomendación.
Los registros de procedencia pueden demostrar que las afirmaciones se asocian con un activo y no han sido alteradas, pero no determinan si el contenido en sí es verdadero o valioso [R11].
El documento rechaza el uso casual de la frase «PIB del mundo IA» como si fuera una economía nacional adicional. Propone Cuentas de Valor Dual-Dominio Humano–IA y una cuenta satelital audiovisual nativa de IA en su lugar. Estos marcos distinguen entradas humanas, ejecución de IA, uso de mundos virtuales, retornos observables de la economía real y transacciones intermedias para que el análisis de inversión y política pueda evitar el doble conteo y mantenerse compatible con los principios de la contabilidad nacional [R22–R23].
La perspectiva de 2026–2035 se organiza en tres ventanas de observación: un periodo de infraestructura, un periodo de expansión de forma y un periodo de mundo persistente. Se utilizan cuatro escenarios —crecimiento gobernado, encerramiento de plataformas, crisis de confianza y mundos abiertos— para probar la resiliencia estratégica. La recomendación central no es apostar por una sola fecha ni por un único modelo. Consiste en construir activos portátiles, evidencia creativa, pipelines de gobernanza, capacidad de operación de mundo y talento humano–IA que mantengan su valor bajo varios futuros.
Quince Juicios Centrales
El costo de producción se está reescribiendo, no se está impulsando automáticamente a cero
La generación de candidatos E1/E2 se vuelve más barata, mientras que el control, la selección, la revisión, la autorización y la gobernanza representan una mayor parte del costo de una segunda aceptable finalizada.
El cine nativo de IA es un método creativo, no una etiqueta de herramienta
La Clasificación por marco depende del papel de la IA en las decisiones creativas centrales y de si la obra puede existir de forma independiente del proceso habilitado por IA.
El audio–video nativo y la editabilidad precisa son el siguiente frente competitivo
E1/E2 El mercado se mueve desde la calidad de imagen en una sola toma hacia la sincronización, la continuidad de identidad, la revisión dirigida, el control de múltiples tomas y la plausibilidad física.
Los modelos de mundo hacen ejecutables las imágenes en movimiento
E2/E3 · Un modelo de mundo debe mantener el estado dependiente de la acción, la memoria y las relaciones causales, en lugar de simplemente predecir el siguiente marco visualmente plausible.
La generación en tiempo real es experiencial pero aún no es una plataforma universalmente madura
E2 · Las demostraciones públicas muestran 720p, 20–24 fps e interacción a escala de minuto; la estabilidad de larga duración, el control amplio, el costo y la seguridad permanecen como puertas de entrada para la adopción [R07–R10].
La escasez se mueve desde la producción hacia la confianza y el descubrimiento
E1/E2 La evaluación, la identidad, la procedencia, la autorización legal, la comunidad y la marca se vuelven más valiosas a medida que se expande la oferta de contenido.
La entrada del público se convierte en agencia
E2/E3 La voz, la mirada, el gesto, la ubicación y la acción grupal pueden modificar el estado, pero la interacción solo tiene sentido si el sistema comprende, recuerda y responde a las consecuencias.
Los gafas de IA convierten el mundo físico en una interfaz narrativa
El sensor siempre disponible y la pantalla privada de E2/E3 pueden hacer que los lugares, las personas y los eventos sean condiciones de historia, siempre que los derechos de privacidad y atención vayan primero.
La convergencia cine-juego se mueve desde la propiedad intelectual compartida hacia mundos compartidos
Los personajes, estados del mundo, reglas y procedencia de E1/E2 pueden renderizarse repetidamente a través del cine, los juegos, los medios en vivo, las experiencias espaciales y la creación comunitaria.
La unidad de activo se expande desde una película hasta una familia de activos
Framewo Works, flujos de trabajo, personajes, mundos, comportamientos y sistemas de interacción requieren metadatos diferentes, lógica de versión rk y límites de permisos.
La indexación no es el título legal y la procedencia no es un veredicto de verdad
El índice de E1/Gober Index.Film™ apoya la identificación, el registro, la búsqueda y la colaboración; no sustituye el registro legal, la determinación judicial o la evaluación crítica.
Los agentes crean un mercado de contenido del lado de la máquina
Los agentes de E2/E3 pueden buscar, comparar, solicitar permiso y desencadenar pagos, pero la intención probabilística debe permanecer separada de la autorización y el liquidación deterministas [R21–R22].
La economía de IA necesita cuentas, no un segundo PIB ficticio
La medición de Framewo debe separar la entrada humana, la ejecución de IA, el uso virtual y el retorno en el mundo real, y eliminar el conteo doble intermedio rk.
La transparencia se está convirtiendo en una obligación del sistema
E1 Las normas de etiquetado de China y los deberes de transparencia de la UE apuntan a una divulgación explícita, marcas legibles por máquina y registros de responsabilidad [R12–R14].
La gobernanza e infraestructura moldearán el 2035 tanto como la capacidad del modelo
**E3/E4** Estándares abiertos, energía, computación, diversidad cultural y participación en beneficios decidirán si el sector se convierte en una economía creativa plural o en un sistema de alquiler cerrado.
CAPÍTULO ESPECIAL · MANIFIESTO
Manifiesto del cine AI-Native
- El cine AI-native no es un sustituto de bajo costo del cine tradicional; es una forma de arte emergente construida mediante la colaboración humano-máquina y sistemas generativos.
- El valor humano no desaparece a medida que las herramientas se vuelven más capaces. Los creadores permanecen responsables de la intención, las reglas, la selección, la composición y las consecuencias del lanzamiento.
- El marcador del 51%+ mide una agencia creativa sustantiva. No es una proporción de píxeles, un conteo de modelos ni una puntuación de calidad artística.
- El cine lineal, la imagen en movimiento interactiva, los medios generativos en directo, la narrativa espacial y los mundos persistentes pueden coexistir. Un nuevo medio no requiere que el medio antiguo desaparezca.
- Las obras AI-native deben preservar suficiente evidencia creativa para apoyar la identificación, la revisión y la rendición de cuentas, al tiempo que protegen la información confidencial legítima.
- La procedencia no es un veredicto de verdad, el índice no es el título legal y una etiqueta técnica no es una recomendación. La confianza comienza con un relato honesto de los límites institucionales.
- Los creadores, intérpretes y titulares de derechos deben tener términos claros y ejecutables para réplicas digitales, uso de entrenamiento, generación derivada, territorio, duración, remuneración y retirada.
- Los modelos del mundo y las gafas de IA pueden llevar las imágenes en movimiento al espacio físico, pero ninguna nueva experiencia debe sacrificar la privacidad, la seguridad infantil, la autonomía de la atención o la diversidad cultural.
- Las obras, los flujos de trabajo, los personajes, los mundos y los comportamientos deben formar redes de activos verificables, buscables y licenciables para que el valor pueda moverse de manera justa entre creadores, plataformas y comunidades.
- Este manifiesto, su marco de clasificación y este libro blanco están diseñados para revisión anual. Una definición para una nueva era debe permanecer abierta a la evidencia y la corrección.
CAMBIO DE PARADIGMA
¿Por qué el cine se está convirtiendo en un mundo ejecutable
PARTE PROPUESTA El archivo audiovisual fijo está dando paso a un sistema de computación cultural que puede generar, responder, recordar y evolucionar.
01 El punto de inflexión tecnológico en la industria cinematográfica global · 02 Definición del cine nativo en IA: el modelo de doble eje y el marcador del 51%+ · 03 La evolución de G0 a G5 en los medios audiovisuales generados por IA · 04 Metodología, grados de evidencia y evolución de los estándares
01El punto de inflexión tecnológico en la industria cinematográfica global
FIGURA 1 · De archivos fijos a sistemas de cálculo cultural
1.1 De oferta generativa a competencia de sistemas
La narrativa de mercado más temprana se centraba en la caída del precio de producir una imagen plausible. Esa métrica es incompleta. Un proyecto profesional paga por la intención, la consistencia, la selección, la revisión, el control de la ejecución, el sonido, la liberación de derechos, la documentación y la responsabilidad de lanzamiento. A medida que crece el número de salidas candidatas, el costo de decidir qué puede ser aceptado —y demostrar por qué— puede aumentar. Por lo tanto, la gestión debe seguir el costo total por segundo final aceptado, el número de revisiones requeridas, la cobertura de control y la proporción de activos que permanecen portables cuando se sustituye un modelo.
1.2 Cinco migraciones estructurales
La producción pasa de una capacidad de rodaje escasa a una producción aceptable escasa; la organización pasa de transferencias departamentales fijas a una orquestación a través de personas, modelos y herramientas; la distribución pasa de la escasez de contenidos a un descubrimiento confiable; el diseño de producto pasa de un master final hacia una relación mantenida; y la base de activos pasa de un título completado a una familia reutilizable de mundos, personajes, flujos de trabajo y registros. Cada migración crea una ventaja competitiva diferente y un modo de fallo diferente.
1.3 La implicación de la decisión: construir una pila de capacidades sustituibles
Ningún estudio debería hacer que su memoria creativa dependa de la interfaz de un proveedor o de un modelo de generación.
Una pila resiliente separa el estado de la historia y del mundo, el almacenamiento de activos, el enrutamiento de modelos, la evaluación, los derechos, la procedencia y la entrega. Los modelos pueden entonces sustituirse según cambios de rendimiento, costo o política. La ventaja duradera es la calidad de las decisiones creativas de la organización y la memoria institucional, no el acceso temporal a un único líder de referencia.
TABLA 1 · MARCO ANALÍTICO DEL CAPÍTULO
| Cambio estructural | Escasez antigua | Nueva escasez | Métrica de gestión |
|---|---|---|---|
| Producción | Capacidad de rodaje | Producción aceptable | Costo por segundo aceptado |
| Organización | Proceso fijo | Orquestación de modelos | Revisión / portabilidad |
| Distribución | Suministro de contenido | Descubrimiento confiable | Alcance cualificado / confianza |
| Producto | Archivo final | Relación continua | Retención / estado del mundo |
| Activos | Un título | Familia de activos | Reutilización / completitud de permisos |
02Definición de cine nativo en IA: El modelo de doble eje y el marcador del 51%+
FIGURA 2 · El Mapa de Cine AI-Nativo de Eje Doble
2.1 El eje P: cinco dimensiones de agencia creativa
P se evalúa a través de narrativa, imagen, sonido, personaje e interacción. Los revisadores preguntan si la IA afecta la estructura de la obra, no si una herramienta de IA tocó un archivo. P0 denota ausencia de rol generativo; P1, asistencia local; P2, participación profunda en una etapa central; P3, liderazgo sustantivo a través de las dimensiones creativas ponderadas; y P4, una obra cuya identidad artística es en sí misma un sistema generativo. El marcador de 51%+ indica entrada en P3 cuando los pesos revelados y la evidencia muestran que la IA lidera materialmente las dimensiones relevantes.
2.2 El eje R: generación en tiempo de ejecución
R0 es reproducción totalmente preproducida. R1 se adapta antes de la presentación; R2 combina componentes preproducidos y generados; R3 genera la mayor parte del contenido experimentado en respuesta a la sesión; y R4 es generado continuamente, con estado y no exactamente reproducible. Debido a que la generación en tiempo de ejecución aumenta el riesgo operativo, R debe evaluarse independientemente de P. Un puntaje R alto requiere presupuestos de latencia, controles de estado, políticas de seguridad, registro, mecanismos de respaldo y un operador responsable claramente identificado.
2.3 El principio del director y la responsabilidad
La autoría humana en un proceso AI-nativo a menudo se asemeja a dirigir una orquesta: definir la intención, seleccionar sistemas, construir restricciones, decidir qué rechazar, organizar los resultados y aceptar la responsabilidad. Esto no hace que cada prompt sea una obra de autor. Significa que el control creativo debe evidenciarse a través de las elecciones y sus consecuencias. El registro relevante es una cadena de decisiones —no una captura de pantalla de un prompt y no una afirmación de que el modelo actuó solo.
TABLA 2 · MARCO ANALÍTICO DEL CAPÍTULO
| Nivel | Eje P: Agencia Creativa | Eje R: Generación en Tiempo de Ejecución |
|---|---|---|
| 0 | Sin IA generativa | Totalmente preproducido |
| 1 | Asistencia local | Adaptación pre-sesión |
| 2 | Papel central en una obra de teatro principal | Preproducido y generado en mezcla |
| 3 | Más del 51% de liderazgo sustantivo | La mayor parte del contenido se genera en vivo |
| 4 | La obra es un sistema generativo | Persistente e irrepetible en su totalidad |
03La evolución de los medios audiovisuales generados por IA de la G0 a la G5
FIGURA 3 · La evolución de los medios audiovisuales generados por IA de la G0 a la G5
3.1 Qué significan la G0 a la G5
La G0 es la producción audiovisual convencional. La G1 utiliza la IA como herramienta asistiva. La G2 genera componentes sustanciales. La G3 es nativa de IA según la prueba de agencia creativa. La G4 introduce generación en tiempo real y reactiva al público. La G5 describe un mundo persistente con identidad duradera, estado multiusuario, reglas sociales y economía. La clasificación se centra en la ontología de la obra: ¿si el resultado es un archivo, una obra generada, una experiencia interactiva o un mundo operativo?
3.2 La posición de 2026: capacidad visible, instituciones incompletas
Para 2026, existe evidencia sólida para flujos de trabajo de producción de la G2 y la G3, mientras que la G4 ha entrado en la exploración de productos públicos mediante modelos de mundos interactivos y generación de baja latencia [R07–R10]. La G5 permanece como un horizonte de escenarios. Sus componentes individuales—identidad, economías virtuales, agentes, interfaces espaciales y estado persistente—existen por separado, pero su combinación en un mundo cultural abierto, duradero y gobernable no ha alcanzado la madurez general.
3.3 Puertas de fase y condiciones de salida
De G2 a G3 se requiere evidencia de autoría humano–IA integrada en lugar de tomas generadas de forma aislada. De G3 a G4 se requiere respuesta en tiempo de ejecución, persistencia de estado, latencia acotada, seguridad y mecanismos de recuperación. De G4 a G5 se requiere consistencia multiusuario, identidad, reglas económicas, gestión de disputas y custodia a largo plazo. Un producto debe describirse en la fase más alta en la que pueda operar de forma fiable, no en la fase más alta imaginada en su hoja de ruta.
TABLA 3 · MARCO ANALÍTICO DEL CAPÍTULO
| Transición | Capacidad agregada | Evidencia mínima |
|---|---|---|
| G2 → G3 | Creación humana–IA integrada | Evidencia creativa / flujo de trabajo coherente |
| G3 → G4 | Respuesta en tiempo de ejecución | Latencia / estado / recuperación / seguridad |
| G4 → G5 | Mundo persistente multiusuario | Identidad / consistencia / economía / gobernanza |
04Metodología, grados de evidencia y evolución de los estándares
FIGURA 4 · Cuatro grados de evidencia y lenguaje permitido
4.1 Cuatro grados y cuatro lenguajes permitidos
E1 soporta lenguaje como implementado, disponible o requerido —dentro de una jurisdicción o límite de producto declarados. E2 soporta demostrado o reportado, no universalmente maduro. E3 soporta que la investigación indica una posible capacidad, no una promesa comercial. E4 debe escribirse condicionalmente: si se mantienen las suposiciones definidas, una configuración futura se vuelve plausible. El rendimiento reportado por la empresa permanece en E2 a menos que tenga validación independiente significativa.
4.2 Escaneo tecnológico y pronóstico
El proceso de investigación separa capacidad, fiabilidad, asequibilidad, desplegabilidad y legitimidad. Una mejora de referencia es una señal de capacidad; no es prueba de fiabilidad de producción. Una demostración pública es una señal de desplegabilidad; no es prueba de sostenibilidad de la economía unitaria. Una regulación es una restricción de legitimidad; también puede crear demanda de infraestructura. Los pronósticos se construyen a partir de la interacción de estas variables en lugar de una única curva de rendimiento exponencial.
4.3 Revisión anual y falsación
El libro blanco debe mantener un registro de predicciones con suposiciones, indicadores líderes y evidencia desconfirmatoria. Si un pronóstico falla, la edición debe registrar por qué. Esta disciplina convierte la publicación en un programa de investigación pública acumulativo y previene que la credibilidad institucional dependa del teatro de la certeza.
TABLA 4 · MARCO ANALÍTICO DEL CAPÍTULO
| Grado | Evidencia | Idioma permitido | Evitar |
|---|---|---|---|
| E1 | Hecho comercial / institucional | Implementado / disponible | Omitiendo condiciones |
| E2 | Demo público / informe técnico | Demostrado / reportado | Universalmente maduro |
| E3 | Prototipo de investigación | La investigación indica | Promesa comercial |
| E4 | Inferencia de escenario | Si se mantienen las suposiciones | Un lenguaje determinado |
FUNDAMENTOS TÉCNICOS
Desde modelos de fundación de video hasta modelos del mundo
PROPUESTA PARCIAL: La competencia se mueve desde la calidad de imagen en una sola pasada hacia el control, la memoria, la gestión de estado, la respuesta en tiempo real y la seguridad operativa.
05 La Evolución Técnica de los Modelos de Fundación de Video · 06 Los Cuellos de Botella Técnicos Reales de la Generación de Características de Largo Aliento · 07 Modelos del Mundo: Desde Predecir el Marco Siguiente hasta Simular un Mundo · 08 Arquitectura de Referencia para Sistemas Audiovisuales de IA en Tiempo Real · 09 Agentes de IA y Actores Virtuales
05La Evolución Técnica de los Modelos de Fundación de Video
FIGURA 5 · La Pila de Capacidades de Modelo de Fundación de Video
5.1 Desde la síntesis de píxeles hasta los modelos de fundación audiovisual
Los sistemas basados en difusión y transformadores han mejorado el movimiento, la composición, el cumplimiento de la solicitud y la duración, mientras que los enfoques nativos de audio y video mueven el sonido desde la producción posterior hacia una representación temporal compartida [R02–R06]. El objetivo técnico ya no es una toma coherente única. Es una representación controlable de identidad, acción, cámara, sonido, tiempo y contexto físico que puede ser editada repetidamente sin colapsar elementos no relacionados.
5.2 La Controlabilidad como la División Industrial
Los flujos de trabajo profesionales requieren cambios selectivos: alterar un gesto sin cambiar la cara; extender una toma sin mover el vestuario; sustituir el diálogo manteniendo el cronometraje de la actuación; mover una cámara manteniendo estable la geografía. Por lo tanto, el control debe medirse como cobertura creativa a través de variables y como el tamaño del radio de explosión no intencionado tras la revisión. Un modelo que requiere una regeneración completa para cada cambio transfiere el costo desde la grabación hacia la iteración.
5.3 Audio y video nativos y una línea de tiempo común
La generación conjunta puede mejorar la sincronización labial, el cronometraje ambiental y el acoplamiento del ritmo, el habla y la acción. También expande la superficie de derechos y seguridad. Un registro de producción debe identificar qué voces, música, efectos y señales de actuación fueron generadas, adaptadas o obtenidas de fuentes externas, y cómo fueron aprobadas.
La generación temporal compartida debe, por lo tanto, ir acompañada de una procedencia temporal compartida.
TABLA 5 · MARCO ANALÍTICO DEL CAPÍTULO
| Dimensión | Pregunta | Métrica de ejemplo |
|---|---|---|
| Control | ¿Puede cambiar un elemento por sí solo? | Cobertura de control |
| Consistencia | ¿Persiste la identidad? | Deriva de identidad / escena |
| Editabilidad | ¿Puede permanecer la revisión local? | Radio de explosión de la revisión |
| Economía | ¿Cuánta salida es aceptable? | Costo por segundo aceptado |
| Gobernanza | ¿Pueden registrarse el origen y los límites? | Completitud del campo |
06Los reales cuellos de botella técnicos de la generación de largometrajes
FIGURA 6 · El bucle de estado de mundo de largometraje
6.1 Un largometraje es una base de datos de estado
Cada escena depende de los hechos establecidos anteriormente: quién sabe qué, qué objeto se movió, cómo cambió una relación y qué restricciones físicas aún aplican. Estos hechos deben representarse explícitamente en lugar de dejarse dentro de una ventana de contexto opaca. Un sistema de estado de grado de producción vincula el libro de la historia, el estado de los personajes, el mapa espacial, las versiones de activos, las tomas aprobadas y los riesgos de continuidad sin resolver. Luego, la salida generada se verifica contra el estado antes de que se convierta en canónica.
6.2 Planificación jerárquica: mundo, secuencia, escena, toma y cuadro
El control de formatos largos requiere múltiples horizontes de planificación. Las reglas del mundo restringen el proyecto completo; las secuencias llevan el movimiento dramático; las escenas actualizan relaciones e información; las tomas especifican acción, cámara y sonido; los cuadros renderizan el resultado local. La evaluación y la regeneración deben ocurrir en el nivel más pequeño que pueda corregir el problema sin desestabilizar la intención de niveles superiores. Esta jerarquía también permite que diferentes modelos y especialistas humanos trabajen en capas separadas.
6.3 Métricas más allá de la calidad visual
A nivel de toma, las métricas incluyen la finalización de la acción y la sincronización audio-video. A nivel de escena, son relevantes la continuidad de la identidad, el vestuario, los objetos y el lugar. A nivel de secuencia, dominan la coherencia causal y espacial. A nivel de obra completa, el desarrollo emocional, el tema y el ritmo deben mantenerse inteligibles. La métrica más útil suele ser el costo y el tiempo necesarios para restaurar la obra tras detectar una inconsistencia.
TABLA 6 · MARCO ANALÍTICO DEL CAPÍTULO
| Escala | Métrica | Ejemplo de fallo |
|---|---|---|
| Toma | Acción / sincronización | Gesto o desviación de labios |
| Escena | Continuidad de personaje / objeto | Mutación de vestuario u objeto |
| Secuencia | Espacio / causalidad | Posición o evento contradictorio |
| Obra completa | Emoción / tema | Motivación rota |
07Modelos del mundo: Desde predecir el siguiente cuadro hasta simular un mundo
FIGURA 7 · Bucle mínimo de modelo del mundo interactivo
7.1 El bucle interactivo mínimo
El bucle útil más pequeño observa la entrada, interpreta la intención, selecciona una acción, actualiza el estado, genera una respuesta y escribe el evento resultante en la memoria. Si el sistema no puede distinguir la observación del estado autoritativo, o no puede explicar qué acción produjo un cambio, es una interfaz generativa en lugar de un modelo del mundo operativo. Para el cine, esta distinción determina si una acción del espectador tiene un significado narrativo duradero.
7.2 El límite de capacidad de 2026
Los sistemas públicos han demostrado interacción en tiempo real a 720p y 20–24 fps durante sesiones de escala de minutos, mientras que la investigación explora la generación en streaming y una memoria más larga [R07–R10]. Estas son señales significativas de E2 y E3. Aún no establecen estabilidad multi-hora sin fin, adherencia a la acción sin restricciones, asequibilidad de dispositivos amplios, sincronización de múltiples usuarios o gobernanza a nivel de evento. Las afirmaciones de producto deben preservar ese límite.
7.3 Colaboración con la infraestructura de motores de juego
Una arquitectura práctica a corto plazo combina geometría explícita, física, navegación y reglas deterministas con renderizado generativo, diálogo, actuación y variación. El motor controla lo que debe ser reproducible; el modelo provee lo que se beneficia de la probabilidad y la amplitud expresiva. El diseño híbrido también hace que la seguridad y la depuración sean más manejables porque el estado crítico puede permanecer inspeccionable incluso cuando la superficie se genera.
TABLA 7 · MARCO ANALÍTICO DEL CAPÍTULO
| Capacidad | Estado 2026 | Puerta de escala |
|---|---|---|
| Imagen en tiempo real | Demostración pública | Asequible en todos los dispositivos |
| Memoria larga | Minutos / investigación | Estable durante horas |
| Acción precisa | Controles acotados | Adherencia a acciones abiertas |
| Mundos multiusuario | Exploración temprana | Consistencia y gobernanza |
| Procedencia segura | Esquemas tempranos | Estándar de nivel de evento |
08Arquitectura de referencia para sistemas audiovisuales de IA en tiempo real
FIGURA 8 · Arquitectura de cine de IA en tiempo real de ocho capas
8.1 La pila de ocho capas
La percepción convierte voz, mirada, gestos, entrada de control y eventos del mundo en señales acotadas. La interpretación de intenciones separa una solicitud del usuario de una observación incidental. La política narrativa restringe lo que puede suceder; el estado y la memoria preservan lo que ha sucedido. El enrutamiento de modelos asigna modelos especializados; la generación y el renderizado producen el resultado audiovisual; el control de personajes y voz mantiene el rendimiento; la coordinación de entrega sincroniza dispositivo, borde y nube; la procedencia y la seguridad registran el evento y aplican la política de liberación.
8.2 Presupuestos de latencia y degradación elegante
No todas las operaciones pertenecen al mismo límite de tiempo. La retroalimentación perceptiva puede requerir latencia muy baja, mientras que una respuesta narrativa compleja puede utilizar salida escalonada. Los sistemas deben almacenar activos seguros, predecir acciones probables, utilizar modelos locales más ligeros, transmitir calidad progresiva y volver a material pregenerado aprobado. Cuando las verificaciones de política o las llamadas a modelos fallan, la experiencia debe volverse más simple —no insegura, incoherente o inaccesible sin explicación.
8.3 Procedencia dinámica
La procedencia a nivel de archivo es insuficiente para una sesión generada continuamente. El registro del evento debe identificar la intención presentada, la política activa, el modelo y la versión, los activos referenciados, el resultado generado, la decisión de seguridad, el operador y la marca temporal. La divulgación pública puede permanecer como un resumen conciso, mientras que los registros sensibles se mantienen con acceso controlado. El objetivo no es la vigilancia de la audiencia; es la rendición de cuentas por el comportamiento del sistema con consecuencias.
TABLA 8 · MARCO ANALÍTICO DEL CAPÍTULO
| Capa | Objetivo | Enfoque principal |
|---|---|---|
| Detección | Latencia muy baja | Procesamiento local |
| Intención y política | Jerarquizada | Modelos ligeros / caché |
| Generación | Presupuesto de cuadros | Destilación / hardware especializado |
| Red y pantalla | Jitter estable | Borde / flujo foveado |
| Seguridad | Nunca omitir | Prever / degradar / bloquear |
09Agentes de IA y actores virtuales
FIGURA 9 · Seis componentes de un personaje operativo
9.1 Un agente es más que una superficie de personaje
Un agente listo para producción requiere un modelo de identidad estable, un conjunto explícito de objetivos, memoria delimitada, capacidades permitidas, política de comportamiento y una capa de rendimiento. Estos componentes deben versionarse por separado. Un nuevo modelo de voz no debe alterar silenciosamente la ética del personaje; una memoria ampliada no debe ampliar automáticamente el consentimiento; y un cambio en la capacidad de acción debe desencadenar una revisión incluso cuando la apariencia permanece inalterada.
9.2 Control de rendimiento y réplicas digitales
Rostro, voz, movimiento, personalidad y comportamiento autónomo son dominios de permiso distintos. El consentimiento debe especificar el medio, el contexto, la audiencia, el territorio, la duración, la remuneración, la retirada y las exclusiones de alto riesgo. Convertir una imagen pasiva en un agente autónomo es un cambio material, no un uso rutinario.
El sistema también debe distinguir entre un personaje ficticio propiedad de una producción y la identidad protegida de un intérprete [R15–R16].
9.3 Producción y operaciones multiagente
Los agentes pueden apoyar la descomposición, la revisión de continuidad, la búsqueda de activos, la localización, la verificación de políticas y las operaciones del mundo. Su trabajo debe organizarse como propuestas que ingresan en una pipeline de aprobación determinista.
Las decisiones importantes — cambios canónicos en la historia, transacciones de alto valor, representaciones sensibles y lanzamiento público — requieren una autoridad aprobadora identificable. La colaboración de agentes es útil únicamente cuando la responsabilidad no se disuelve a lo largo de una cadena de acciones automatizadas.
TABLA 9 · MARCO ANALÍTICO DEL CAPÍTULO
| Elemento | Debe especificar | Cambio de alto riesgo |
|---|---|---|
| Identidad | Rostro / voz / movimiento / personaje | Fusión de personajes |
| Uso | Medio / escena / audiencia | Político / adulto / médico |
| Capacidad | Generar / conversar / actuar | Pasivo a autónomo |
| Duración | Inicio / fin / retirada | Permanente / póstumo |
| Indemnización | Adquisición / uso / participación en los ingresos | Reutilización no revelada |
LA REVOLUCIÓN DEL DISPOSITIVO
Desde la pantalla y el smartphone hasta las gafas de IA
PROPUESTA PARCIAL Cuando la visualización, la detección y la generación convergen, el espacio físico se convierte en parte de la interfaz narrativa.
10 Cuatro Migraciones del Dispositivo Audiovisual · 11 Nuevas Formas Cinematográficas Habilitadas por Gafas de IA · 12 Cine Espacial y Generación Remota
10Cuatro Migraciones del Dispositivo Audiovisual
FIGURA 10 · Cuatro Migraciones del Dispositivo Audiovisual
10.1 De sesiones colectivas a eventos contextuales
La unidad teatral es la sesión programada; la unidad de televisión es el programa; la unidad del smartphone es el flujo, video corto o transmisión en vivo. Las gafas de IA introducen una posible unidad basada en el lugar, la relación y el evento.
Una escena puede comenzar porque una persona entra en un lugar, se encuentra con otro participante o pide a un personaje que revele una capa del mundo. Esto desplaza la contratación desde minutos de contenido hacia reglas sobre cuándo y por qué aparece una experiencia.
10.2 Colaboración dispositivo-borde-nube
El procesamiento local es esencial para la detección sensible, la retroalimentación inmediata y la seguridad básica. La infraestructura de borde puede reducir la latencia y apoyar el estado regional, mientras que los sistemas de nube proporcionan la inferencia de modelos grandes y servicios de mundo persistentes. Un producto bien diseñado decide qué información nunca sale del dispositivo, qué eventos requieren estado compartido y qué salidas pueden generarse a partir de señales anonimizadas o minimizadas.
10.3 Las puertas reales de la adopción
El peso, el calor, la duración de la batería, el campo de visión, la legibilidad de la pantalla, el soporte para gafas de prescripción, el precio y el estilo son factores determinantes. Igualmente lo son el estado de grabación visible, las expectativas de los espectadores, la etiqueta social y la capacidad del usuario para silenciar el sistema.
Los prototipos públicos y el trabajo en plataformas demuestran impulso [R24–R27], pero el mercado solo se expandirá cuando las personas comunes puedan usar el dispositivo sin fricción técnica, social o psicológica.
TABLA 10 · MARCO ANALÍTICO DEL CAPÍTULO
| Dispositivo | Capacidad central | Unidad de contenido | Límite principal |
|---|---|---|---|
| Cine | Atención compartida | Sesión programada | Tiempo y lugar |
| Televisión | Inmersión en el hogar | Programa / serie | Baja interacción |
| Teléfono inteligente | Frecuencia personal | Corto / en vivo | Pantalla pequeña / fragmentación |
| Gafas de IA | Contexto y presencia | Lugar / evento relacional | Privacidad / batería / aceptación |
11Nuevas formas cinematográficas habilitadas por gafas de IA
FIGURA 11 · El bucle de contenido contextual para gafas de IA
11.1 Narrativa de ubicación y personajes ambientales
Una calle, un museo, un distrito teatral o un viaje de transporte pueden convertirse en un espacio de historia activo. Los personajes pueden comprender el contexto amplio, referirse a eventos mundiales persistentes y revelar contenido que depende de la ubicación o el tiempo. Las experiencias más fuertes no cubrirán la realidad con gráficos constantes. Usarán una intervención escasa, anclajes espaciales legibles y transiciones claras entre el entorno factual y la capa ficticia.
11.2 Personajes acompañantes y diseño de atención
Un personaje acompañante puede apoyar la continuidad entre sesiones, pero el diseño de relaciones persistentes también puede crear dependencia o manipular la vulnerabilidad. Los productos necesitan límites de intervención, modos silenciosos, controles de memoria, valores por defecto apropiados para la edad y una divulgación comercial clara. El compromiso emocional no debe utilizarse para obtener el consentimiento, aumentar los precios o eludir los límites de atención declarados por el usuario.
11.3 Una nueva gramática del encuadre
El encuadre ya no está completamente controlado por un director, ya que el usuario puede mirar hacia otros lados y moverse por el espacio. Por lo tanto, la composición se desplaza hacia campos de relevancia, orientación acústica, revelaciones a tiempo, puesta en escena espacial y prioridad de eventos. Los creadores diseñan lo que puede ser percibido, cómo se invita la atención y qué sucede si se pierde una señal. El resultado se acerca más a la coreografía de la percepción que a la edición de una secuencia fija.
TABLA 11 · MARCO ANALÍTICO DEL CAPÍTULO
| Riesgo | Control | Derecho del usuario |
|---|---|---|
| Detección de testigos | Estado visible / filtro local | Percepción y queja |
| Captación de atención | Límites de intervención | Silencio / salida |
| Mal uso de la memoria | Propósito y duración | Inspeccionar / corregir / eliminar |
| Manipulación comercial | Revelación de publicidad / reglas de precios | Rechazar la personalización |
12Cine espacial y generación remota
FIGURA 12 · Tubería de contenido espacial híbrida
12.1 Tres rutas hacia el contenido espacial
La preproducción 3D ofrece calidad determinista pero un alto costo de activos. La reconstrucción y las representaciones neuronales pueden captar entornos reales rápidamente, pero complican la edición, la identidad y los derechos. La generación de mundos ofrece variabilidad y responsividad, pero debe gestionar la consistencia y la seguridad. Los productos profesionales probablemente combinarán los tres: activos principales deterministas, ubicaciones reales reconstruidas y variación generada dentro de límites gobernados.
12.2 Generación remota y transmisión foveada
El renderizado puede dividirse entre dispositivo, borde y nube según la latencia, la privacidad y la calidad. Las técnicas foveadas asignan la calidad donde el usuario mira, reduciendo la demanda de transporte y renderizado [R26]. Sin embargo, la mirada es una señal sensible. Los sistemas deben utilizarla para la eficiencia de entrega sin convertirla silenciosamente en perfilamiento conductual, intención de compra o inferencia emocional.
12.3 Interoperabilidad y portabilidad de activos
OpenXR y normas espaciales relacionadas proporcionan interfaces comunes para dispositivos y entidades [R27], pero la portabilidad narrativa también requiere convenciones semánticas y de comportamiento. Una puerta debe ser reconocible como un objeto con reglas, no solo como una malla. Un personaje necesita metadatos de identidad y derechos, no solo animación.
La interoperabilidad debe cubrir, por lo tanto, estado, eventos, autorización y procedencia, además de la geometría.
TABLA 12 · MARCO ANALÍTICO DEL CAPÍTULO
| Ruta | Ventaja | Limitación | Mejor uso |
|---|---|---|---|
| 3D preconfigurado | Determinista | Alto costo de activos | Activos heroicos / marcas |
| Reconstrucción | Captura rápida en el mundo real | Complejidad de edición / derechos | Ubicaciones reales |
| Generación de mundo | Variación ilimitada | Consistencia / seguridad | Fondo / interacción |
| Híbrido | Equilibrio calidad-precio | Complejidad del sistema | Productos profesionales |
CONTENIDO Y AUDIENCIAS
Cómo los espectadores se convierten en participantes
PROPUESTA DE PARTE: El contenido pasa de una entrega puntual a una relación continua, mientras que la audiencia gana agencia significativa dentro de la obra.
13 Del derecho a ver al derecho a actuar · 14 Nuevos modelos de interacción · 15 Los límites de la experiencia audiovisual personalizada · 16 Narrativa y arte en la era de la IA
13Del derecho a ver al derecho a actuar
FIGURA 13 · La escalera de derechos de la audiencia
13.1 Cuatro niveles de derechos de la audiencia
Ver incluye iniciar, pausar, detener y acceder a la obra. Elegir significa navegar por ramas declaradas. Actuar significa cambiar el estado persistente mediante voz, movimiento u otra entrada. La co-gobernanza permite a los participantes crear activos, proponer reglas o compartir en valor. Los productos deben indicar qué nivel ofrecen y qué decisiones permanecen bajo control editorial u operacional.
13.2 Visualización por defecto y fatiga de elección
El cine puede mantenerse inmersivo porque los espectadores no están obligados a gestionar cada momento. El diseño AI-native debe preservar una experiencia por defecto sólida e invitar a la acción solo cuando esta añade significado. El sistema puede inferir que una persona está desenganchada, pero no debe convertir señales pasivas en cambios irreversibles de la historia o decisiones comerciales. El usuario debe poder volver a una experiencia coherente después de no hacer nada.
13.3 Reconstrucción de la experiencia colectiva
Las experiencias compartidas requieren reglas para intenciones conflictivas. Un grupo puede votar, delegar, turnarse o seguir roles. El diseño debe revelar cómo se asigna la influencia y proteger a las minorías del acoso o la exclusión sistemática. La agencia colectiva no es meramente un canal de entrada más grande; es un pequeño sistema de gobernanza dentro de la obra.
TABLA 13 · MARCO ANALÍTICO DEL CAPÍTULO
| Derecha | Capacidad del público | Deber del sistema |
|---|---|---|
| Ver | Iniciar / Pausar | Presentación clara |
| Elegir | Navegar ramas | Explicar consecuencia |
| Actuar | Cambiar el estado del mundo | Memoria y retroalimentación |
| Co-gobernar | Crear reglas / activos | Proceso justo / participación en el valor |
14Nuevos modelos de interacción
FIGURA 14 · Interacción multimodal y autorización
14.1 Un mapa de interacción multimodal
La voz es efectiva para la intención explícita, pero no debe conservarse por defecto. La mirada es útil para la referencia y la renderización de prioridad, pero no para el consentimiento. La gestualidad respalda la manipulación espacial, pero las gestualidades de alto riesgo requieren confirmación. La ubicación habilita el contexto, pero no debe exponer los movimientos de una persona. Los datos fisiológicos deben limitarse a funciones de accesibilidad o seguridad necesarias, a menos que se acepte claramente un propósito separado y revocable.
14.2 Lenguaje natural para instrucciones y restricciones
Los usuarios pueden pedir al mundo que se vuelva más silencioso, revele otra perspectiva o permitan a un personaje explicar un evento pasado.
El sistema debe traducir el lenguaje abierto en un plan de acción acotado gobernado por la historia, la seguridad y los derechos.
También debe explicar cuándo una solicitud entra en conflicto con las reglas de la obra. El lenguaje natural es una interfaz conveniente; no es un canal de instrucciones ilimitado.
14.3 Retroalimentación, latencia y confianza
Un sistema interactivo debe reconocer la entrada rápidamente, distinguir el procesamiento de la finalización y mostrar cuándo una acción no está disponible. Si la latencia es alta, puede proporcionar una respuesta preliminar segura en lugar de ignorar silenciosamente al usuario. La confianza disminuye cuando el mundo cambia sin una causa visible, cuando el sistema finge entender o cuando una intención inferida no pueda corregirse.
TABLA 14 · MARCO ANALÍTICO DEL CAPÍTULO
| Entrada | Uso adecuado | Nunca asumir |
|---|---|---|
| Voz | Expresar intención | Retención permanente |
| Mirada | Referencia / atención | Compra / consentimiento |
| Gesto | Control espacial | Autorización de alto riesgo |
| Ubicación | Disparador contextual | Historial de movimiento público |
| Fisiología | Accesibilidad necesaria | Manipulación emocional |
15Los límites de la experiencia audiovisual personalizada
FIGURA 15 · Valor y riesgo en la personalización
15.1 Cuatro objetos de personalización
La presentación incluye subtítulos, volumen, idioma, ritmo y accesibilidad. El contenido altera escenas, explicaciones o dificultad. La relación adapta la memoria del personaje y la interacción a lo largo del tiempo. La personalización de valor cambia la persuasión, la ideología, el precio o la presión emocional aplicada al usuario. Los valores predeterminados pueden ser apropiados en la capa de presentación, mientras que las capas más profundas requieren explicación, consentimiento y controles accesibles.
15.2 Memoria del personaje a largo plazo y minimización de datos
La memoria del personaje a largo plazo puede hacer que un mundo sea significativo, pero el sistema debe almacenar solo lo que sirva a un propósito declarado. Los usuarios necesitan inspeccionar, corregir, eliminar y exportar memorias importantes. La memoria de sesión, la memoria entre obras y el perfil comercial deben ser separados. Un personaje ficticio no debe retener información sensible del mundo real simplemente porque hace que el diálogo sea más convincente.
15.3 Prevención de la discriminación por precio emocional y persuasión oculta
Un sistema que infiera urgencia, soledad o susceptibilidad no debe utilizar esa inferencia para aumentar el precio, incrementar la presión publicitaria o hacer más difícil la retirada. Los modelos de personalización no deben convertirse en agentes de negociación invisibles que actúen en contra del usuario. La adaptación de alto riesgo requiere política, registro, revisión independiente y una ruta no personalizada.
TABLA 15 · MARCO ANALÍTICO DEL CAPÍTULO
| Capa | Valoración por defecto razonable | Divulgación / consentimiento |
|---|---|---|
| Presentación | Subtítulos / volumen / accesibilidad | Preferencia de dispositivo |
| Contenido | Ritmo de bajo riesgo | Cambio de trama |
| Relación | Memoria de sesión | Memoria transversal a largo plazo |
| Valores | Sin predeterminado | Posición / precio / persuasión |
16Narrativa y arte en la era de la IA
FIGURA 16 · De la constitución de la historia a cada experiencia
16.1 De guion a constitución de la historia
Una constitución de historia preserva lo que debe permanecer verdadero mientras permite que la experiencia varíe. Define el tema, el canon, los compromisos de los personajes, los límites causales, las reglas de contenido sensible y el rango de finales válidos.
La generación ocurre dentro de este espacio autoral. La constitución no reemplaza escenas ni diálogo; proporciona una estructura de orden superior que mantiene que miles de escenas posibles sean reconociblemente parte de la misma obra.
16.2 Nuevas unidades artísticas
La unidad de composición puede convertirse en una regla, una relación, un encuentro, una memoria o una transición diseñada entre estados del mundo. El ritmo puede emerger a través de sesiones en lugar de minutos. El rendimiento de un personaje puede evaluarse mediante la consistencia ante una entrada imprevista. Por lo tanto, los críticos y jurados necesitan métodos que consideren la experiencia realizada y el sistema de posibilidades detrás de ella.
16.3 Preservación de obras que no pueden reproducirse exactamente
La preservación debe capturar el modelo y la versión liberados, el conjunto de activos, la constitución de la historia, la política, los estados importantes, sesiones representativas y la documentación del entorno de ejecución. Una grabación por sí sola muestra un solo rendimiento, pero no el espacio de posibilidades de la obra. Las instituciones de preservación necesitarán emulación, reproducción controlada y archivos de eventos junto con los masters convencionales.
TABLA 16 · MARCO ANALÍTICO DEL CAPÍTULO
| Dimensión | Pregunta crítica |
|---|---|
| Idea | ¿Qué pregunta irremplazable plantea la obra? |
| Forma | ¿La generación crea una nueva gramática? |
| Reglas | ¿Es significativo el espacio de variación? |
| Relación | ¿Cambia la acción del espectador la comprensión? |
| Responsabilidad | ¿Comprende el creador las consecuencias del sistema? |
RESTRUCTURACIÓN DE LA INDUSTRIA
La convergencia del cine, los videojuegos, los medios en vivo y los mundos sociales
PROPUESTA DE PARTE: Los activos mundiales compartidos pueden renderizarse a través de múltiples medios, haciendo que las operaciones mundiales sean más importantes que el formato de archivo final.
17 Convergencia entre cine y videojuegos como producción de mundos compartidos · 18 Eventos en vivo, competiciones y cine en tiempo real · 19 Una nueva cadena de valor y nuevas profesiones · 20 Transformación del mercado y los modelos de negocio · 21 El panorama emergente de la industria global
17Convergencia Cine–Videojuego como Producción de Mundos Compartidos
FIGURA 17 · Un Mundo, Múltiples Medios
17.1 De IP compartida a estado compartido
Las adaptaciones tradicionales comparten nombres, imágenes y leyenda mientras reconstruyen activos de producción y lógica. Un enfoque de mundo compartido define identidad, geografía, cronología, capacidades, relaciones y procedencia en capas legibles por máquina. El cine puede interpretar un personaje dramáticamente, un juego puede ejecutar capacidades y los medios en vivo pueden responder a eventos mientras permanecen conectados a un historial de versiones común. La reutilización se vuelve semántica y operativa, no meramente visual.
17.2 El estudio del mundo
Un estudio del mundo combina un departamento de historia y arte con arquitectura de estado, sistemas de activos, ingeniería de continuidad, operaciones en vivo y gobernanza. Distingue el estado canónico del estado de sesión temporal y las ramas creadas por la comunidad. El modelo operativo se asemeja tanto a un estudio como a una organización de servicios de larga duración: publica obras, mantiene el mundo, resuelve conflictos y planifica cómo el valor retorna a los contribuyentes.
17.3 Riesgos de convergencia
Un mundo compartido puede volverse creativamente rígido si cada medio debe obedecer una base de datos central. También puede producir vigilancia, explotación laboral, canon inaccesible o dependencia indefinida de una sola plataforma.
La gobernanza debe preservar la interpretación específica de cada medio, versiones forjables, atribución de contribuyentes y límites claros sobre lo que un operador comercial puede cambiar retrospectivamente.
TABLA 17 · MARCO ANALÍTICO DEL CAPÍTULO
| Capa compartida | Película | Juego / interacción | Gobernanza |
|---|---|---|---|
| Identidad del personaje | Rendimiento y arco | Capacidad y estado | Consentimiento / versión |
| Semántica del mundo | Escena y tema | Mapa y reglas | Origen / derechos |
| Línea de tiempo | Orden narrativo | Cuestión y ramificación | Canon / bifurcación |
| Comportamiento | Elección de actuación | Acción ejecutable | Límite de seguridad |
18Eventos en vivo, competiciones y cine en tiempo real
FIGURA 18 · Bucle de operaciones generativas en tiempo real
18.1 Tres familias de productos en tiempo real
La primera familia es un programa generado programado con participación controlada. La segunda es una capa de eventos que responde al deporte, noticias, actuación o actividad comunitaria. La tercera es un mundo persistente que continúa entre eventos principales. Cada uno requiere políticas de latencia, moderación y continuidad diferentes. Un espectáculo programado puede utilizar extensas alternativas preaprobadas; un mundo persistente debe gestionar consecuencias duraderas e identidad del participante.
18.2 Entrada de la audiencia y latencia de gobernanza
La revisión de seguridad no siempre puede realizarse después de la generación, ya que el contenido dañino puede experimentarse inmediatamente. El sistema debe clasificar la entrada, restringir el espacio de acciones, seleccionar modelos aprobados y monitorear el resultado generado. La latencia de gobernanza forma parte del presupuesto de extremo a extremo. Cuando la confianza es baja, el mundo debe reducir la autonomía, retrasar la publicación o cambiar a una respuesta conocida como segura.
18.3 Métricas comerciales y operativas
Las métricas clave incluyen la latencia de extremo a extremo, la tasa de respaldo, la interrupción sin explicación, el tiempo de recuperación de estado, la frecuencia de incidentes, el costo por minuto de sesión, la retención de participantes e integridad del estado del mundo. El crecimiento puede ocultar pérdidas estructurales si cada participante adicional aumenta el costo de generación más rápido que los ingresos. Los productos en tiempo real necesitan una economía de nivel de servicio, no solo métricas de audiencia.
TABLA 18 · MARCO ANALÍTICO DEL CAPÍTULO
| Métrica | Propósito | Línea roja |
|---|---|---|
| Latencia de extremo a extremo | Interacción natural | Incumplimiento persistente |
| Tasa de respaldo | Estabilidad del servicio | Sin respaldo seguro |
| Interrupción de seguridad | Monitoreo de riesgos | Interrupción sin explicación |
| Tiempo de recuperación del estado | Gestión de incidentes | Sin restauración |
| Costo por minuto | Economía de la unidad | El crecimiento de las pérdidas con el éxito |
19Una nueva cadena de valor y nuevas profesiones
FIGURA 19 · La nueva cadena de valor del cine de IA
19.1 Seis capas de la cadena de valor emergente
La infraestructura de base proporciona modelos, datos y computación. Los sistemas de mundo y flujo de trabajo organizan el estado y las herramientas. La producción crea obras y activos reutilizables. La distribución conecta audiencias, dispositivos y contextos. Los sistemas de transacción gestionan permisos y flujo de valor. Las operaciones mantienen la identidad, la seguridad, la continuidad y la comunidad. Las organizaciones pueden ocupar varias capas, pero los conflictos de interés y la responsabilidad deben permanecer visibles.
19.2 Nuevas combinaciones profesionales
Un productor nativo de IA combina responsabilidad creativa, presupuestaria y de sistema. Un arquitecto de mundo modela reglas y estado. Un ingeniero de continuidad gestiona la identidad y la causalidad entre generaciones. Un ingeniero de procedencia diseña registros y metadatos. Un director de seguridad generativa define rechazo, degradación y recuperación.
Estos roles no son títulos de puesto fijos; identifican brechas de capacidad que los límites convencionales de los departamentos a menudo dejan sin asignar.
19.3 Transición laboral y distribución justa
La automatización puede eliminar tareas repetitivas mientras concentra la ventaja en modelos y plataformas. Los programas de transición deben seguir el ingreso, el poder de negociación, el reconocimiento de la autoría, la requalificación y el acceso a las herramientas, no solo el porcentaje de tareas automatizadas. Los contribuyentes necesitan una atribución clara y una remuneración cuando los activos, las representaciones y los flujos de trabajo continúan creando valor a través de productos y años.
TABLA 19 · MARCO ANALÍTICO DEL CAPÍTULO
| Rol | Responsabilidad central | Capacidad |
|---|---|---|
| Productor nativo de IA | Flujo humano–IA y presupuesto | Creativo + sistemas |
| Arquitecto del mundo | Reglas y estado | Narrativa + modelado de datos |
| Ingeniero de continuidad | Identidad y causalidad | Calidad + versióning |
| Ingeniero de procedencia | Evidencia y campos | Estándares + derechos |
| Director de seguridad generativa | Rechazo y recuperación | Contenido + riesgo |
20Mercado y transformación del modelo de negocio
FIGURA 20 · Portafolio de ingresos de mundos persistentes
20.1 Ampliación de la unidad de ingresos
Una suscripción a un mundo vende acceso mantenido y estado. Una suscripción por personaje vende continuidad de la relación. Un evento interactivo vende una experiencia con límite temporal. La licencia empresarial vende entornos de marca controlados o de formación. Los servicios de activos venden identidad, flujo de trabajo o componentes de mundo. Las solicitudes de agentes apoyan la concesión de licencias o generación iniciada por máquina. Cada unidad requiere diferentes niveles de consentimiento, servicios, contabilidad y lógica de reembolso.
20.2 De presupuesto de producción a economía de unidades de servicio
La financiación tradicional concentra el costo antes del lanzamiento. Los mundos persistentes combinan el gasto de producción con inferencia, almacenamiento, moderación, seguridad, soporte al cliente y migración de estado. El modelo financiero debe clasificar la inversión fija en el mundo, el costo variable de sesión, el costo de adquisición, la retención, reservas de pasivos y obligaciones al final de la vida útil. Un producto no es sostenible si el éxito aumenta las pérdidas o hace técnicamente imposible la retirada.
20.3 Precios y distribución del valor
Los precios deben corresponder a un valor legible en lugar de una vulnerabilidad emocional inferida. Las reglas de reparto de ingresos deben abordar el uso continuado de los intérpretes, creadores de personajes, diseñadores de mundos, contribuidores comunitarios y desarrolladores de flujos de trabajo. Los contratos legibles por máquina pueden mejorar el abono, pero las excepciones y los conflictos aún requieren procesos humanos. El sistema debe indicar qué participante recibe valor cuando un activo se reutiliza.
TABLA 20 · MARCO ANALÍTICO DEL CAPÍTULO
| Modelo | Unidad de valor | Condición requerida | Principal riesgo |
|---|---|---|---|
| Suscripción al mundo | Estado persistente | Actualizaciones / retención | Alto costo operativo |
| Suscripción a personajes | Relación a largo plazo | Consentimiento / control de memoria | Dependencia / manipulación |
| Evento interactivo | Una experiencia | Fiabilidad en tiempo real | Capacidad máxima |
| Licencia empresarial | Marca / entorno | Control y procedencia | Deriva de identidad |
| Solicitud de agente | Transacción de máquina | Campos de derechos / pago | Responsabilidad de agencia |
21El paisaje emergente de la industria global
FIGURA 21 · Una red global de cine con IA multipolar
21.1 La competencia se configura mediante diferentes dotaciones
La capacidad del modelo es solo una ventaja. El acceso a talento de producción, historias locales, experiencia en juegos y animación, gobernanza de datos, capital, distribución, mercados lingüísticos y cadenas de suministro de dispositivos influyen en el campo. Una región puede liderar en activos de mundos o gobernanza incluso sin formar el modelo más grande. El mercado premiará a las instituciones que traduzcan entre estas dotaciones.
21.2 La posición estructural de Hong Kong
Hong Kong puede contribuir como mercado multilingüe y transfronterizo y como conector de normas, con una profunda cultura cinematográfica, servicios financieros y redes internacionales. Su oportunidad no es imitar un centro de modelos a gran escala. Consiste en hacer interoperables los activos, proyectos, inversiones, festivales, evaluaciones y distribución entre jurisdicciones, al tiempo que se preserva una distinción creíble entre la infraestructura industrial y las afirmaciones promocionales.
21.3 Un lenguaje mínimo para la colaboración internacional
El trabajo transfronterizo requiere definiciones compartidas del tipo de trabajo, el rol de la IA, el comportamiento de ejecución, la identidad del activo, el alcance de los permisos, el estado de procedencia y la responsabilidad. Estos campos deben apoyar las diferencias legales locales en lugar de pretender reemplazarlas. Un lenguaje común mínimo permite a creadores e instituciones comparar proyectos sin imponer las categorías legales de una jurisdicción a todos los participantes.
TABLA 21 · MARCO ANALÍTICO DEL CAPÍTULO
| Región | Fortaleza | Oportunidad | Restricción |
|---|---|---|---|
| América del Norte | Modelos / nube / distribución | Plataformas y herramientas | Concentración / derechos |
| China y Asia Oriental | Aplicaciones / cadena de suministro | Contenido a escala | Interoperabilidad transfronteriza |
| Europa | Reglas / cultura | Contenido confiable | Capital / escala |
| Japón y Corea | Personajes / animación / juegos | Activos mundiales | Mercado de idiomas |
| Hong Kong | Transfronterizo / finanzas / idiomas | Conexión entre mercado y estándares | Cómputo / escala de producción |
ACTIVOS DIGITALES Y LA
Desde la entrega de contenido hasta redes de activos colaborativos con máquinas
PROPUESTA DE VALOR: El valor no reside solo en una obra finalizada, sino también en los flujos de trabajo, personajes, estados mundiales, reglas de comportamiento y registros verificables.
22 Activos Audiovisuales con IA: Desde una Obra Finalizada hasta una Familia de Activos · 23 El Ciclo de Vida de los Activos Audiovisuales con IA · 24 Activos Legibles por Agentes y Transacciones Mediadas por Máquinas · 25 Conectando el Valor Humano e IA: Cuentas de Valor de Doble Dominio
22Activos audiovisuales con IA: De una obra terminada a una familia de activos
FIGURA 22 · La familia de activos audiovisuales con IA
22.1 Seis clases de activos
Una obra es la experiencia audiovisual liberada. Un flujo de trabajo registra herramientas, nodos y decisiones. Un personaje combina identidad, modelo, actuación y permisos. Un mundo contiene semántica, reglas y estado. Un comportamiento define una capacidad ejecutable o interacción. Un registro proporciona evidencia de procedencia, eventos y ciclo de vida. El mismo proyecto puede contener cientos de activos relacionados, cada uno con diferentes términos de acceso y comerciales.
22.2 Tres condiciones para activos utilizables
Un activo debe ser identificable: usuarios y máquinas pueden distinguirlo y su versión. Debe ser interpretable:
los campos técnicos, semánticos y de gobernanza clave son legibles. Debe ser utilizable dentro de un envoltorio de permisos conocido. Un activo visualmente impresionante que carece de procedencia, claridad de versión o alcance de permisos puede ser valioso como inspiración pero inutilizable en colaboración profesional.
22.3 Evaluación del valor del activo
El valor puede depender del rendimiento del público, fiabilidad, editabilidad, fuerza de relación, reutilización, completitud de procedencia y calidad de la licencia. Una métrica no puede comparar todas las clases de activos. Un personaje puede crear valor duradero mediante la estabilidad de la identidad; un flujo de trabajo mediante la tasa de aceptación; un mundo mediante la extensibilidad; y un registro mediante su capacidad para reducir los costos de transacción y disputa.
TABLA 22 · MARCO ANALÍTICO DEL CAPÍTULO
| Activo | Identidad mínima | Métrica de valor | Enfoque de permisos |
|---|---|---|---|
| Trabajo | Versión / lanzamiento | Público / ingresos | Exhibición / adaptación |
| Flujo de trabajo | Nodos / configuración | Aceptación / eficiencia | Ejecutar / redistribuir |
| Personaje | Identidad / modelo | Estabilidad / relación | Imagen / voz / comportamiento |
| Mundo | Reglas / estado | Extensión / reutilización | Ingresar / construir / operar |
| Comportamiento | Capacidad / interfaz | Control / seguridad | Invocar / delegar |
| Registrar | Procedencia / evento | Completitud / integridad | Inspeccionar / retener |
23El ciclo de vida de los activos audiovisuales de IA
FIGURA 23 · El ciclo de vida del activo
23.1 Desde la creación hasta la retirada
La creación produce un activo y la evidencia inicial. La declaración identifica al remitente responsable.
La identificación asigna una ID persistente y relaciones parentales. La verificación comprueba declaraciones o firmas.
La evaluación añade observaciones independientes. El descubrimiento expone metadatos permitidos. La autorización habilita el uso; la operación crea eventos; el registro de valor documenta el flujo. El cambio, el archivo y la retirada preservan el historial y determinan lo que permanece accesible.
23.2 El registro mínimo verificable
El registro debe incluir el ID del activo, el tipo, la versión, el activo padre, el contacto responsable, el resumen de procedencia, la declaración del modelo y la herramienta, el resumen de derechos, el estado de gobernanza, el formato técnico, la referencia de integridad y el estado de disputa o retirada. No todos los campos deben ser públicos. La capa pública mínima debe permitir la identificación y el contacto informado sin exponer prompts confidenciales, información personal o registros sensibles a la seguridad.
23.3 Retirada, disputas y activos huérfanos
Un titular de derechos puede retirar la autorización; un remitente puede desaparecer; un activo puede ser disputado o técnicamente obsoleto. El sistema necesita estados para suspensión, estado en disputa, reemplazo, acceso restringido y responsabilidad huérfana. Los registros históricos no deben implicar autorización actual. Los clientes de máquina deben poder reconocer que un activo existió, pero no puede ser utilizado en la actualidad.
TABLA 23 · MARCO ANALÍTICO DEL CAPÍTULO
| Grupo de campos | Ejemplo | Capa pública |
|---|---|---|
| Identidad | ID / tipo / versión / padre | Público |
| Partes responsables | Creador / remitente / contacto | Jerarquizada |
| Procedencia | Modelo / herramienta / declaración de activo | Resumen |
| Derechos | Territorio / término / uso / estado | Resumen |
| Gobernanza | Etiqueta / disputa / retirada | Público |
| Técnica | Formato / interfaz / hash | Sobre solicitud |
24Activos legibles por agentes y transacciones mediadas por máquinas
FIGURA 24 · Capas de transacciones de activos mediadas por agentes
24.1 El envoltorio de derechos legible por máquina
Un activo puede expresar usos permitidos, usos excluidos, territorio, duración, alcance de identidad, lógica de precio, atribución, restricciones técnicas y si se requiere aprobación humana. Estos campos apoyan el descubrimiento y la negociación preliminar. No eliminan las excepciones, los derechos morales, los acuerdos colectivos ni las reglas jurisdiccionales. El envoltorio debe indicar cuándo la interpretación por máquina debe detenerse y comenzar una decisión humana.
24.2 Separar la intención probabilística de la liquidación determinista
Un modelo de lenguaje puede inferir que el usuario desea una licencia, pero la inferencia no es autoridad. Una capa de transacción debe presentar el activo exacto, los derechos, el precio, la contraparte y las condiciones de revocación, obtener una autorización aprobada y generar un registro duradero. Los protocolos emergentes de pago por agente son señales importantes de infraestructura, mientras que la responsabilidad y la protección al consumidor permanecen como preguntas de diseño abiertas [R21–R22].
24.3 De un mercado de búsqueda a un mercado de solicitud
Los usuarios humanos navegan por los catálogos; los agentes pueden expresar requisitos estructurados y solicitar al mercado que monte una solución conforme. Esto puede reducir los costos de transacción para la localización, la sustitución de activos, la música, las voces y los componentes de mundos. También puede intensificar la concentración si una plataforma controla el descubrimiento, la identidad y el pago. Por lo tanto, los formatos de solicitud abiertos y los registros exportables son infraestructura estratégica.
TABLA 24 · MARCO ANALÍTICO DEL CAPÍTULO
| Campo | Valor legible por máquina | Manejo humano |
|---|---|---|
| Uso | Vista / generación / adaptación | Uso no listado |
| Territorio / término | Código / fecha | Conflicto / excepción |
| Identidad | Personaje / alcance del intérprete | Persona sensible |
| Precio | Negociación de alto valor / nivel / cotización | Negociación de alto valor |
| Aprobación | Automático / humano | Personalidad / irreversible |
25Conexión entre el valor humano y la IA: Cuentas de valor de doble dominio
FIGURA 25 · Flujo de valor de doble dominio humano–IA
25.1 ¿Por qué el 'PIB de los mundos de la IA' no es una suma directa
Un agente puede llamar a varios modelos, comprar servicios internos y transferir un activo virtual antes de que el usuario final pague por una experiencia. Contar cada paso como nuevo valor contabilizaría la actividad intermedia varias veces. Los precios de los activos también pueden subir sin producción actual correspondiente. La medición debe distinguir entre transacciones brutas, ingresos, rentabilidad, formación de capital, uso final y valor agregado, y debe identificar el principal económico detrás de la actividad automatizada.
25.2 Cuentas de valor de doble dominio humano–IA
El dominio humano registra el trabajo creativo, la preparación de datos, el capital, la energía, los derechos y los servicios institucionales. El dominio de ejecución de la IA registra la inferencia y los servicios de agente atribuidos a un principal encargado. El dominio del mundo virtual registra el uso final, los activos mantenidos y la circulación interna. El dominio de la rentabilidad real registra los ingresos observables, salarios, licencias e impuestos. La reconciliación elimina las transferencias intermedias y muestra cómo se mueve el valor y el riesgo entre los dominios.
25.3 Una cuenta satelital audiovisual de IA nativa
Una cuenta satélite puede estimar la producción industrial, la remuneración, los insumos intermedios, la formación de activos, las importaciones, las exportaciones y el uso de energía, manteniendo las cuentas nacionales principales. Las empresas podrían comenzar con una muestra voluntaria: clasificar el gasto de proyectos, las operaciones en la nube, los activos de mundos reutilizables, la remuneración humana y la facturación final. El objetivo es una base de datos comparable, no un número titular desconectado de los límites contables.
TABLA 25 · MARCO ANALÍTICO DEL CAPÍTULO
| Cuenta | Registros | Cómo se evita el doble conteo |
|---|---|---|
| Entrada humana | Creación / datos / capital / energía | Marcar insumo intermedio |
| Ejecución de IA | Inferencia / servicio de agente | Atribuir al principal |
| Mundo virtual | Uso final / servicio de activo | Separar circulación interna |
| Retorno real | Ingresos / salario / licencia / impuesto | Contar flujo observable |
| Cuenta satélite | Valor agregado / formación de activos | Alineación con la SNA |
DERECHOS, GOBERNANZA Y
Transparencia, responsabilidad y agencia humana
PARTE PROPUESTA La confianza requiere una cadena trazable que conecte la procedencia, la autorización, el consentimiento, el historial de versiones y la liberación responsable.
26 Control creativo, derechos de autor y réplicas digitales · 27 Procedencia, etiquetado de contenido y cadena de responsabilidad · 28 Diversidad cultural, agencia humana y sostenibilidad
26Control creativo, derechos de autor y réplicas digitales
FIGURA 26 · Cuatro capas de derechos en el cine de IA
26.1 Autoría: uso de herramientas y control creativo
La Oficina de Derechos de Autor de EE. UU. y otras autoridades enfatizan la autoría humana y el control al evaluar la protegibilidad por derechos de autor [R15]. En el trabajo nativo de IA, la evidencia puede incluir la constitución de la historia del creador, la selección, la disposición, la revisión y la aprobación final. Solicitar meramente un resultado impredecible no es equivalente al control de la expresión. Las jurisdicciones diferentes pueden llegar a conclusiones diferentes, por lo que los registros del proyecto deben apoyar el análisis factual sin asumir una respuesta legal universal.
26.2 Separación del entrenamiento, entrada del proyecto y salida
Las preocupaciones sobre la autorización de entrenamiento se refieren al desarrollo de un modelo. La autorización de entrada de proyecto se refiere a los activos suministrados para una obra específica. Las preguntas sobre la salida se refieren a la similitud, elementos protegidos, términos contractuales y contribución humana. Estas capas deben revisarse independientemente [R16]. Una producción no puede remediar una incertidumbre en el entrenamiento o en la réplica simplemente colocando una etiqueta en el archivo final.
26.3 Réplicas digitales y consentimiento continuo
El consentimiento para una cara, voz o actuación debe especificar el medio, el contexto, el territorio, la duración, la autonomía, la remuneración y la retirada. Un cambio material —como permitir que una réplica hable sin guion, ingrese en una escena sensible o opere después de que el intérprete ya no esté disponible— debe desencadenar un nuevo consentimiento. El sistema también debe mantener un medio práctico para detener nuevos usos y preservar el registro de las autorizaciones previas.
TABLA 26 · MARCO ANALÍTICO
| Autorización | Contenido mínimo | Disparador de nuevo consentimiento |
|---|---|---|
| Datos | Origen / propósito / retención | Uso nuevo de entrenamiento |
| Cara y voz | Medio / contexto / territorio | Escena sensible |
| Autonomía | Puede decir / hacer / prohibido | Pasivo a agente |
| Términos y retiro | Detener / eliminar / archivar | Permanencia del modelo |
| Indemnización | Fijo / utilizar / compartir | Nuevo modelo de ingresos |
27Procedencia, etiquetado de contenido y la cadena de responsabilidad
FIGURA 27 · Tres capas de transparencia
27.1 Una arquitectura de transparencia de tres capas
La capa de procedencia registra activos, herramientas, partes responsables y referencias de integridad. La capa legible por máquina comunica el estado de generación y modificación a las plataformas y agentes. La capa perceptible informa a los usuarios en una forma adecuada al contexto. Las medidas de etiquetado de China y el trabajo de transparencia de la UE indican un movimiento hacia una divulgación explícita e implícita coordinada [R12–R14]. La implementación debe permanecer accesible sin abrumar al público.
27.2 Una cadena de responsabilidad en lugar de una nube de responsabilidad
Un proveedor de modelo controla la capacidad, las salvaguardas y la divulgación de versiones. Un creador controla las entradas y las decisiones creativas. Un productor controla el flujo de trabajo, los derechos y la aprobación. Un distribuidor controla las etiquetas, el público y la política de plataforma. Un operador de ejecución controla la política en vivo, la respuesta a incidentes y la restauración. Varias partes pueden compartir la responsabilidad, pero cada una debe preservar los registros que corresponden a su control.
27.3 La posición institucional de Index.Film™
Index.Film™ soporta la identificación, registro, búsqueda y colaboración a través de activos de obra, flujo de trabajo, personaje, mundo, comportamiento y registro. Debe publicar sus reglas de metadatos, proceso de corrección, capas de acceso y estados de disputa. La inclusión no es aval; el índice no confirma la titularidad de los derechos; y un identificador no sustituye el registro legal ni la adjudicación. Estas limitaciones son una fuente de credibilidad, no de debilidad.
TABLA 27 · MARCO ANALÍTICO DEL CAPÍTULO
| Partido | Control primario | Registro mínimo |
|---|---|---|
| Proveedor de modelo | Capacidad / seguridad / versión | Tarjeta de modelo / cambio |
| Creador | Entradas / selección / revisión | Prueba creativa |
| Productor | Flujo de trabajo / derechos / aprobación | Cronograma de entrega |
| Distribuidor | Etiqueta / audiencia / plataforma | Responsabilidad de lanzamiento |
| Operador | Política de vida / incidente | Evento y retroceso |
28Diversidad cultural, agencia humana y sostenibilidad
FIGURA 28 · Cuatro dimensiones de valor público
28.1 Diversidad cultural y concentración de datos
Los modelos grandes pueden reproducir idiomas dominantes, estéticas y suposiciones comerciales. La diversidad requiere más que traducir una interfaz. Las instituciones deben examinar de quién son los archivos, las tradiciones de representación y las estructuras narrativas que aparecen en los datos y la evaluación; apoyar a creadores locales y lenguas; y permitir que las comunidades definan usos sensibles. El trabajo de la UNESCO sobre IA y cultura subraya la necesidad de conectar la innovación con los derechos culturales y la participación plural [R18].
28.2 Agencia humana y economía del creador
Los creadores necesitan un control significativo sobre las herramientas, el crédito, los ingresos, la portabilidad y el rechazo. El público necesita la capacidad de entender, corregir y salir de sistemas adaptativos. Una plataforma puede aumentar la participación nominal mientras reduce el poder de negociación o hace a los creadores dependientes de servicios de clasificación y generación opacos.
La agencia humana es, por lo tanto, una métrica económica e institucional, no solo una aspiración ética.
28.3 Energía y generación sostenible
La evaluación debe informar el consumo energético por salida aceptada, por sesión de usuario y por mundo activo, mientras que el consumo energético total y los efectos de la red regional permanecen visibles. La eficiencia del modelo, el caché, la colocación en el borde, la programación de cargas de trabajo, el suministro renovable y la generación selectiva pueden reducir la demanda. La industria debe evitar la premisa de que la abundancia generada no tiene costos de infraestructura física [R19–R20].
TABLA 28 · MARCO ANALÍTICO DEL CAPÍTULO
| Dimensión | Métrica útil | Métrica insuficiente |
|---|---|---|
| Energía | Por segundo aceptado / minuto de sesión | Una inferencia |
| Cultura | Distribución por idioma / región / creador | Volumen total |
| Trabajo | Ingreso / transición / negociación | Ratio de automatización |
| Agencia | Control / salida / queja | Tiempo dedicado |
PREVISIONES, ESCENARIOS Y
La ventana de decisión 2026–2035
TESIS DE ESTA PARTE — Una previsión no es una promesa; es una exposición pública de los supuestos, las condiciones de adopción, la incertidumbre y los puntos de decisión.
29 A 2026–2035 Hoja de Ruta de Tecnología e Industria · 30 Cuatro Escenarios Futuros · 31 Guía de Acción para Partes Interesadas de la Industria · 32 Un Agenda de Acción Conjunta
29Una Hoja de Ruta 2026–2035 de Tecnología e Industria
FIGURA 29 · Tres Ventanas de Observación, 2026–2035
29.1 2026–2028: el periodo de infraestructura
La prioridad es generación controlable, sistemas de estado de larga forma, flujos de trabajo de audio y video nativos, procedencia, etiquetado y evaluación profesional. Las películas AI-native se vuelven más comunes, mientras que los productos de tiempo real permanecen limitados. Las organizaciones que construyen activos portátiles, registros de derechos, enrutamiento de modelos y métricas de salida aceptable crean ventajas que sobreviven a la rápida rotación de modelos.
29.2 2029–2032: el periodo de expansión de forma
Si la latencia, el coste y las puertas de dispositivo mejoran, el cine interactivo, eventos en vivo generados, mundos compartidos de película–juego y experiencias espaciales pueden pasar de demostraciones a productos repetibles. Pueden emerger nuevas fuentes de ingresos por suscripción y eventos. El cambio de gobernanza crítico es de registros a nivel de archivo a responsabilidad a nivel de evento y de permisos de contenido a permisos de agente y mundo.
29.3 2033–2035: el periodo de mundo persistente
Si la identidad, el estado multiusuario, la portabilidad, la economía y la gobernanza maduran juntos, los mundos culturales persistentes pueden convertirse en un medio significativo. No sustituirán las películas ni los juegos. Proporcionarán una capa en la que las obras, los personajes y las comunidades continúen a través de dispositivos y formatos. Los conflictos transfronterizos, el tratamiento estadístico y la custodia a largo plazo se convertirán en instituciones centrales.
TABLA 29 · MARCO ANALÍTICO DEL CAPÍTULO
| Ventana | Puerta de capacidad | Puerta de mercado | Puerta de gobernanza |
|---|---|---|---|
| 2026–2028 | Generación controlable / flujo de trabajo | Adopción profesional | Etiquetas / procedencia |
| 2029–2032 | Multiusuario / espacial / costo reducido | Suscripción / multimedia | Permiso de agente / registro de evento |
| 2033–2035 | Mundo persistente entre dispositivos | Economía de mundo estable | Responsabilidad transfronteriza / estadísticas |
30Cuatro Escenarios Futuros
FIGURA 30 · Cuatro Escenarios Futuros
30.1 Crecimiento gobernado
La capacidad y los ingresos mejoran mientras se maduran los estándares, la etiquetación y la responsabilidad. La producción profesional de IA nativa se expande, y las audiencias aceptan experiencias adaptativas porque el control es legible. La estrategia ganadora es la inversión en activos confiables, evaluación y gobernanza interoperable, en lugar de autonomía máxima.
30.2 Encerramiento de plataformas
Un pequeño número de plataformas integradas controla los modelos, la identidad, la distribución, el pago y el estado del mundo.
Las herramientas creativas son poderosas, pero la exportación es costosa y los términos pueden cambiar. Las organizaciones necesitan una arquitectura multiplataforma, derechos contractuales de salida, registros independientes y activos que puedan migrarse sin perder la identidad ni el historial de permisos.
30.3 Crisis de confianza
Daños de alto perfil, disputas de derechos, engaño sintético o incidentes de seguridad reducen la confianza de la audiencia e institucional. La regulación se endurece y los costos de seguros aumentan. La procedencia, la responsabilidad humana explícita, el alcance controlado del producto y la respuesta a incidentes ensayados se convierten en condiciones de acceso al mercado en lugar de cumplimiento opcional.
30.4 Mundos abiertos
Estándares abiertos, transacciones de agentes e identidad portables permiten que creadores y comunidades operen en múltiples mundos. La innovación y la participación plural aumentan, pero también lo hacen el abuso entre sistemas, el fraude y la complejidad de las disputas. La oportunidad depende de fuertes permisos de identidad, gobernanza contestable, evidencia interoperable y liquidación justa.
TABLA 30 · MARCO ANALÍTICO DEL CAPÍTULO
| Escenario | Señal líder | Estrategia sin arrepentimiento |
|---|---|---|
| Crecimiento gobernado | Estándares abiertos / mejor economía | Activos confiables |
| Encuadernamiento de plataformas | Alto costo de cambio / concentración | Exportación y multiplataforma |
| Crisis de confianza | Incidentes / litigios / churn | Procedencia y responsabilidad humana |
| Mundos abiertos | Interoperabilidad / comercio de agentes | Identidad, permisos y gestión de disputas |
31Guía de acción para partes interesadas de la industria
FIGURA 31 · Red de acción para seis grupos de partes interesadas
31.1 Creadores y organizaciones de producción
Cartografíe historias, personajes, mundos, flujos de trabajo y activos de evidencia. Defina la intención creativa AI-nativa antes de seleccionar herramientas. Establezca sistemas de estado y versiones, métricas de salida aceptable, revisión de derechos y aprobación final humana. Ejecute un proyecto delimitado que pueda evaluarse honestamente, en lugar de distribuir la experimentación entre todas las producciones sin aprendizaje.
31.2 Proveedores de modelos, tecnología y plataformas
Revelar capacidades y limitaciones significativas; apoyar la exportación, historial de versiones y procedencia; separar propuestas probabilísticas de transacciones; proporcionar herramientas para un funcionamiento degradado seguro y la gestión de incidentes; y publicar cambios que afecten derechos o salida. Las plataformas deben facilitar la operación responsable en lugar de soluciones opacas.
31.3 Distribución, inversión y seguros
Utilizar cronogramas de entrega con IA que identifiquen activos, modelos, permisos, etiquetas, evidencia y responsabilidad en tiempo de ejecución. Evaluar la economía de salida aceptable y pasivos de mundo persistente. Precificar el riesgo según el control y los registros, en lugar de tratar toda la participación en IA como idéntica. Exigir un plan práctico de salida y archivo.
31.4 Política, investigación y educación
Desarrollar terminología compartida, conjuntos de prueba representativos, investigación de interés público y pilotos estadísticos.
La educación debe combinar cine, interacción, sistemas, datos, derechos y operaciones. La certificación debe reconocer la capacidad demostrada y la responsabilidad profesional en lugar de una familiaridad a corto plazo con una interfaz.
TABLA 31 · MARCO ANALÍTICO DEL CAPÍTULO
| Partes interesadas | Primeros 90 días | En menos de 12 meses |
|---|---|---|
| Creadores / productores | Inventario de activos y derechos | Estado del mundo y flujo de evidencia |
| Plataformas tecnológicas | Revelar capacidades y límites | Procedencia exportable / alternativa |
| Distribución / capital | Cronograma de entrega de IA | Economías unitarias / benchmark de riesgos |
| Política / investigación | Términos y muestras | Pruebas públicas / piloto estadístico |
| Educación | Currículo interdisciplinario | Certificación de roles / transición |
32Una Agenda de Acción Conjunta
FIGURA 32 · Programa Público de Interés Conjunto
32.1 Definiciones y evaluación como infraestructura pública
El modelo P/R, las etapas G0–G5 y el lenguaje de la evidencia E1–E4 deben revisarse mediante casos y revisión por pares. Los marcadores de referencia deben probar la continuidad de larga duración, el control, la recuperación en tiempo real, la procedencia y la agencia humana, dejando la calidad artística abierta a la crítica, los jurados y el público.
32.2 Index.Film™ y colaboración de mercado
El programa inicial debe publicar los campos mínimos para seis tipos de activos, niveles de acceso, procesos de corrección y disputa, y límites de permiso legibles por máquina. Los pilotos de mercado pueden probar cómo los identificadores y los registros reducen los costos de transacción sin pretender determinar la propiedad ni el valor artístico.
32.3 Una ciudad global y red de talento
Las ciudades pueden alojar coproducciones, pruebas, educación, festivales, residencias y acceso al mercado. La participación debe basarse en proyectos concretos y beneficios recíprocos en lugar de membresía nominal. La red debe hacer visibles las culturas creativas locales mientras mejora la interoperabilidad transfronteriza.
32.4 Investigación y publicación anual
Cada edición anual debe actualizar la evidencia técnica, los desarrollos regulatorios, los datos de mercado y las señales de escenarios. Debe informar errores y cambios de juicio. Un proceso de investigación permanente puede invitar a instituciones, creadores, artistas, ingenieros y grupos de interés público a probar el marco y proponer revisiones.
TABLA 32 · MARCO ANALÍTICO DEL CAPÍTULO
| Programa público | Salida inicial | Límite de gobernanza |
|---|---|---|
| Clasificación de doble eje | Especificación anual / casos | No es una sentencia legal |
| Marcador de referencia de evaluación | Pruebas de larga duración / en tiempo real | No es un juicio artístico |
| Index.Film™ | Mínimo de campos para seis activos | La inclusión no es una aprobación |
| Red de ciudades | Proyectos conjuntos / flujo de talento | No es una alianza nominal |
| Cuenta satélite | Prueba piloto de muestra corporativa | No es el PIB oficial |
| Memoria anual | Revisión de pronósticos / revisión | Historial de versiones público |
Apéndices Los apéndices convierten los conceptos del libro blanco en términos prácticos, requisitos de evidencia, metadatos, protocolos de revisión y herramientas de acción.
Apéndice A Glosario principal
- Cine de IA nativa
- Obra audiovisual en la que la IA tiene un papel sustancial en las dimensiones creativas centrales y la obra no puede separarse completamente de su proceso habilitado por IA.
- Eje de Agencia Creativa (P0–P4)
- Una clasificación del rol sustantivo de la IA en la narrativa, la imagen, el sonido, el personaje y la interacción.
- Eje de Generación de Duración (R0–R4)
- Una clasificación de la proporción de la obra experimentada que se genera durante su uso.
- Marcador de 51%+
- Un umbral de calificación para la dirección creativa sustantiva en el eje P; no es una puntuación de calidad ni legal.
- Modelo del mundo
- Un sistema que mantiene y predice el estado dependiente de la acción, la memoria y las relaciones causales.
- Constitución de la historia
- Los temas, reglas, compromisos de personaje, límites de variación y gobernanza que definen un espacio narrativo generativo.
- Estado del mundo
- Información autoritativa sobre entidades, ubicaciones, relaciones, eventos y permisos en un momento dado.
- Familia de activos
- El conjunto conectado de activos de obra, flujo de trabajo, personaje, mundo, comportamiento y registro.
- Procedencia
- Información sobre el origen, transformación, partes responsables e integridad asociadas con un activo.
- Envoltura de derechos
- Campos legibles por máquina que describen el uso permitido y cuándo se requiere la aprobación humana.
- Cuentas de valor dual de dominio Humano–IA
- Un marco analítico que separa las entradas humanas, la ejecución de IA, el uso virtual y los retornos observables en el mundo real.
- Cuenta audiovisual nativa de IA
- Un marco estadístico para la producción y activos de la industria diseñado para conectarse con los principios de la contabilidad nacional.
Apéndice B: Clasificación P/R y Prueba Creativa
La P debe evaluarse a través de la narrativa, imagen, sonido, personaje e interacción, utilizando pesos declarados antes de la revisión. El marcador del 51%+ determina la cualificación de P3 únicamente. La R se evalúa independientemente según la generación en tiempo de ejecución.
| Grupo de pruebas | Descripción |
|---|---|
| Intención creativa | Concepto, tema, reglas y versiones aprobadas |
| Cadena de herramientas | Modelos, versiones, nodos y configuraciones |
| Proceso de generación | Prompts, referencias, candidatos y rechazo |
| Control humano | Selección, ordenación, revisión y aprobación |
| Duración | Entrada, estado, política y nivel de generación |
Anexo C Perfil de metadatos mínimos de Index.Film™
Este perfil apoya la identificación, registro, búsqueda y colaboración. No confirma derechos ni endosa un activo. Las capas públicas, restringidas y privadas deben mantenerse separadas.
| Grupo de campos | Ejemplo |
|---|---|
| Identidad | ID / tipo / versión / padre |
| Partes responsables | Creador / remitente / contacto |
| Procedencia | Modelo / herramienta / declaración de activo |
| Derechos | Territorio / término / uso / estado |
| Gobernanza | Etiqueta / disputa / retirada |
| Técnica | Formato / interfaz / hash |
Anexo D Prueba, pronóstico y revisión anual
Protocolo
- Clasificar las afirmaciones de grado E1–E4 y conservar una fuente primaria accesible o nota de prueba.
- Establecer las asunciones técnicas, económicas, de dispositivo, de gobernanza y culturales para los pronósticos.
- Reportar confirmación, retraso, degradación, retirada y error en la siguiente edición.
- Separar el rendimiento reportado por el proveedor de la validación independiente.
- Conservar el historial público de versiones para las clasificaciones, metadatos y marcos de evaluación.
Anexo E Marco de acción de 90 días, 12 meses y 36 meses
| Horizonte | Capacidad organizacional |
|---|---|
| 90 días | Inventariar activos, herramientas, derechos y costos |
| 12 meses | Construir sistemas de estado, enrutamiento y prueba |
| 36 meses | Desarrollar operaciones mundiales y capacidad de agente |
Apéndice F. Referencias y fuentes primarias
Se priorizan los documentos de investigación primaria, los organismos normalizadores, los reguladores, las organizaciones internacionales y las publicaciones oficiales de los desarrolladores de modelos. La información se verificó hasta el 16 de julio de 2026.
[R01] OpenAI. Modelos de generación de video como simuladores del mundo. 2024.
[R02] Google DeepMind. Veo 3.1 - Resumen del modelo y capacidades. 2025.
[R03] Meta AI. Movie Gen: Una Casta de Modelos de Fundamentos de Medios. 2024.
[R04] Tencent Hunyuan. HunyuanVideo: Un Marco Sistemático para Modelos Generativos de Video a Gran Escala. 2024.
[R05] Wan Team. Wan: Modelos Generativos de Video a Gran Escala Abiertos y Avanzados. 2025.
[R06] Zhang et al. Generación de IA para la creación de películas: Una revisión de avances recientes. 2025.
[R07] Google DeepMind. Genie 3 - modelo interactivo del mundo en tiempo real. 2025/2026.
[R08] Liu et al. Hacia la modelización de mundos de video interactivos: Fronteras, desafíos, benchmarks y tendencias futuras. 2026.
[R09] Wang et al.. Matrix-Game 3.0: Modelo de Mundo Interactivo en Tiempo Real y Streaming con Memoria de Horizonte Largo. 2026.
[R10] Wu et al.. Infinite-World: Escalando Modelos de Mundo Interactivos a Horizontes de 1.000 Cuadros. 2026.
[R11] C2PA. Especificación Técnica de Credenciales de Contenido 2.2 y Explicador. 2025/2026.
[R12] Administración del Ciberespacio de China et al. Medidas para la etiquetación de contenido generado por IA y contenido sintético. 2025.
[R13] Comisión Europea. Código de conducta sobre la transparencia del contenido generado por IA. 2026.
[R14] Unión Europea. Reglamento (UE) 2024/1689, artículo 50. 2024.
[R15] Oficina de Derechos de Autor de EE. UU. Derechos de autor e inteligencia artificial, parte 2: Posibilidad de protección por derechos de autor. 2025.
[R16] WIPO. IA generativa: Navegación de la propiedad intelectual. 2024.
[R17] NIST. Marco de gestión de riesgos de IA: Perfil de IA generativa (NIST AI 600-1). 2024/2026.
[R18] UNESCO. Informe del Grupo de Expertos Independientes sobre Inteligencia Artificial y Cultura. 2025.
[R19] Agencia Internacional de la Energía. Energía e IA. 2025.
[R20] Agencia Internacional de la Energía. El consumo eléctrico de los centros de datos aumentó en 2025. 2026.
[R21] Google. Protocolo de pagos de agentes (AP2). 2025.
[R22] Fondo Monetario Internacional. Cómo la IA agentic transformará los pagos. 2026.
[R23] División de Estadísticas de las Naciones Unidas. Sistema de Cuentas Nacionales 2025. 2025.
[R24] Google. Demostración y panorama general de gafas Android XR. 2025.
[R25] Meta. Presentación de Orion, prototipo de gafas de realidad aumentada. 2024/2025.
[R26] Apple Developer. Streaming focalizado para visionOS. 2026.
[R27] Grupo Khronos. Extensiones OpenXR y Spatial Entities. 2025.
Anexo G Instituciones de publicación
Alianza Internacional de Estándares de Indexación de Activos Audiovisuales de Inteligencia Artificial (IAISA): interfaces de colaboración para la identidad de activos audiovisuales, metadatos legibles por máquina, procedencia y mercado.
Asociación Internacional de Productores de Cine de Inteligencia Artificial (IFAIFPA): sistemas de producción nativos de IA, vías tecnológicas, coordinación profesional, evaluación y redes de productores.
Asociación del Festival Internacional de Cine de Inteligencia Artificial de Hong Kong (HKAIIFF): arte cinematográfico nativo de IA, ecosistemas de creadores, práctica de festivales y colaboración en ciudades internacionales.
Datos clave
- Fecha de lanzamiento
- 2026-07-17
- Editoriales
- Asociación · IFAIFPA · IAISA
- Estructura
- Cinco partes principales + capítulo del Manifiesto
- Modo de lectura
- Texto completo en línea
- Teoría de evaluación
- Teoría del Director
FAQ
¿Qué cubre el libro blanco?
La era del cine de IA, la definición de cine nativo de IA, el estándar del 51%+, la reestructuración de la cadena industrial y las direcciones futuras, además del Manifiesto del Cine Nativo de IA.
¿Quién lo publicó?
La Asociación del Festival Internacional de Cine de Inteligencia Artificial de Hong Kong, IFAIFPA y IAISA, conjuntamente el 17 de julio de 2026.
¿Puedo descargarlo?
No se proporciona descarga. El texto completo está disponible para lectura en línea en esta página. Las citas deben acreditar la fuente.
¿Cómo se define el estándar del 51%+ en el whitepaper?
No es cuota de píxeles; evalúa si los flujos de trabajo de IA tienen un papel preponderante ponderado en las decisiones creativas centrales.
Relacionado · Whitepaper Oficial de Index.Film (IAISA · Estándar IXF V6) →