WP / 2026WHITE PAPER INDUSTRIEL · LECTURE EN LIGNE

Le premier white paper systématique au monde sur l'industrie du cinéma par IA

Association du Festival international du film IA de Hong KongIFAIFPA (Fédération Internationale des Associations de Producteurs de Films par IA)IAISA (Alliance Internationale des Normes d'Indexation des Actifs Audiovisuels par Intelligence Artificielle)

Publication conjointe

Le premier livre blanc systématique sur l'industrie du cinéma à l'IA est le AI Film Industry Whitepaper 2026, publié conjointement le 17 juillet 2026 par l'Association du Hong Kong AI International Film Festival, IFAIFPA et IAISA ; le texte intégral est disponible en lecture en ligne sur hkaiiff.org, et les citations doivent mentionner la source. Il s'agit du premier livre blanc systématique axé sur l'industrie du cinéma à l'IA. Le document aborde cinq domaines : l'arrivée de l'ère du cinéma à l'IA, la définition du cinéma AI-native, le critère d'évaluation de « 51%+ participation à l'IA », les changements structurels dans la chaîne audiovisuelle à l'IA et les orientations futures de l'industrie ; il propose la Théorie du chef d’orchestre comme cadre d'évaluation et inclut un chapitre dédié au Manifeste du Cinéma AI-Native. Le texte intégral est disponible en lecture en ligne sur cette page. Les citations doivent mentionner la source.

Synthèse

Le cinéma généré par IA a dépassé la question initiale de savoir si les équipes de production utiliseront des outils génératifs. La question stratégique est désormais de savoir comment la vidéo générée, les modèles natifs audio-vidéo, les modèles de monde interactifs, les agents, l'informatique spatiale et l'infrastructure de traçabilité se combinent pour créer un nouveau média, un nouveau système industriel et un nouveau problème de gouvernance. Le résultat n'est pas simplement une version moins chère de la production cinématographique conventionnelle. Il s'agit d'une transition des fichiers audiovisuels fixes vers des systèmes culturels capables de générer, de répondre, de persister, de transacter et de demeurer redevables dans le temps.

Ce livre blanc définit le cinéma natif IA comme une œuvre audiovisuelle dans laquelle l'intelligence artificielle joue un rôle matériel et constitutif dans les dimensions créatives fondamentales — y compris le récit, l'image, le son, le personnage et l'interaction — et dans laquelle l'œuvre ne peut être entièrement séparée du processus activé par l'IA qui la rend possible. Pour maintenir la séparation entre le jugement artistique et la classification technique, le document introduit un modèle à double axe : Capacité d’action créative P0–P4 et Génération en Temps d'Exécution R0–R4. Le seuil de 51 %+ est un marqueur de qualification sur l'axe de la capacité d’action créative ; il ne s'agit pas d'un comptage de pixels, d'un comptage de modèles ou d'une note de qualité.

La frontière technique se déplace de la plausibilité visuelle en format court vers la cohérence à long terme. L'identité, la géographie, la causalité, la permanence des objets, le développement émotionnel et la continuité son-image doivent demeurer stables entre les scènes et les sessions. Les systèmes en temps réel ajoutent une exigence d'ingénierie : la pile doit interpréter l'intention, maintenir l'état du monde, allouer les modèles, générer dans un budget de latence, appliquer la politique de sécurité, enregistrer les événements et se dégrader de manière sécurisée lorsque les conditions échouent. Les systèmes publics ont démontré une interaction en temps réel significative, mais la stabilité sur de longues durées, l'action sans fin, la cohérence multi-utilisateur, le contrôle des coûts et la gouvernance restent des portes d'entrée vers la commercialisation [R07–R10].

Les lunettes IA et l'informatique spatiale étendent cette transition vers le monde physique. Une caméra, un microphone, un signal de regard, une position et une compréhension de l'environnement peuvent devenir des entrées narratives ; un personnage peut accompagner une personne à travers les lieux et le temps. Cela crée de nouvelles formes – événements sensibles à la localisation, récits partagés dans l'espace public, compagnons persistants et superpositions privées – mais soulève également des devoirs plus stricts concernant la vie privée des passants, l'attention, le consentement, la mémoire et l'interruption sécurisée [R24–R27].

Le marché se réorganisera autour de cinq nouvelles pénuries : découverte fiable, jugement artistique, personnages et mondes persistants, autorisation légale et relations communautaires durables. Les revenus peuvent s'étendre du box-office et de la licence vers les abonnements à des mondes, les services de personnages, les événements interactifs, les environnements d'entreprise, les services d'actifs et les demandes médiatisées par des agents. Cependant, la génération continue transforme également une partie de la société de contenu en opérateur de services cloud. La croissance durable repose donc sur l'économie d'unité par minute acceptable, par session et par monde actif – et non sur le coût de production d'un seul clip candidat.

La base d'actifs s'étend d'un film fini vers une famille d'actifs : œuvre, flux de travail, personnage, monde, comportement et enregistrement. Chaque type d'actif nécessite des identifiants distincts, une logique de version, des enveloppes de permission et des contrôles de cycle de vie. Index.Film™ se positionne comme infrastructure pour l'identification, l'enregistrement, la recherche et la collaboration. L'indexation ne crée pas, ne transfère ni ne confirme les droits légaux ; l'inclusion n'est pas une recommandation.

Les registres de provenance peuvent montrer que les déclarations sont associées à un actif et n'ont pas été modifiées, mais ils ne déterminent pas si le contenu lui-même est vrai ou précieux [R11].

Le texte rejette l'usage courant de l'expression « PIB monde IA » comme s'il s'agissait d'une économie nationale supplémentaire. Il propose des comptes de valeur dual-domaine humain-IA et un compte satellite audiovisuel IA-native à la place. Ces cadres distinguent les entrées humaines, l'exécution IA, l'utilisation dans les mondes virtuels, les retours observables de l'économie réelle et les transactions intermédiaires afin que l'analyse des investissements et des politiques puisse éviter le double comptage et rester compatible avec les principes de la comptabilité nationale [R22–R23].

La perspective 2026–2035 est structurée en trois fenêtres d'observation : une période d'infrastructure, une période d'expansion de forme et une période de monde persistant. Quatre scénarios — croissance gouvernée, enfermement dans les plateformes, crise de la confiance et mondes ouverts — sont utilisés pour tester la résilience stratégique. La recommandation centrale n'est pas de miser sur une seule date ou modèle. Il s'agit de construire des actifs portables, des preuves créatives, des pipelines de gouvernance, une capacité d'exploitation de mondes et des talents humain–IA qui restent précieux sous plusieurs futurs.

PROPOSITION CENTRALELe cinéma natif à l'IA ne remplace pas le cinéma par un modèle. Il donne aux images animées la capacité de générer, répondre, se souvenir, évoluer et transacter tout en préservant l'intention humaine, la responsabilité et la valeur publique.

Quinze jugements centraux

01

Le coût de production est réécrit, non automatiquement conduit à zéro

La génération de candidats E1/E2 devient moins chère, tandis que le contrôle, la sélection, la révision, la permission et la gouvernance deviennent des parts plus importantes du coût d'un second fini acceptable.

02

Le natif à l'IA est une méthode créative, pas une étiquette d'outil

La classification par cadre dépend du rôle de l'IA dans les décisions créatives centrales et de la capacité de l'œuvre à exister indépendamment du processus activé par l'IA.

03

L'audio-vidéo natif et une reproductibilité précise constituent la prochaine frontière concurrentielle

E1/E2 Le marché évolue de la qualité d'image en une seule image vers la synchronisation, la continuité de l'identité, la révision dirigée, le contrôle multi-image et la plausibilité physique.

04

Les modèles de monde rendent les images animées exécutables

E2/E3 · Un modèle de monde doit maintenir un état dépendant de l'action, une mémoire et des relations causales, plutôt que de prédire simplement le prochain cadre visuellement plausible.

05

La génération en temps réel est expérientielle mais n'est pas encore une plateforme universellement mature

E2 · Les démonstrations publiques montrent 720p, 20–24 fps et une interaction à l'échelle de la minute ; la stabilité sur de longues durées, le contrôle large, le coût et la sécurité restent des barrières à l'adoption [R07–R10].

06

La rareté se déplace de la production vers la confiance et la découverte

E1/E2 L'évaluation, l'identité, la traçabilité, la permission légale, la communauté et la marque deviennent plus précieuses à mesure que l'offre de contenu s'expande.

07

La contribution du public devient agence

E2/E3 La voix, le regard, le geste, l'emplacement et l'action de groupe peuvent modifier l'état, mais l'interaction n'est significative que lorsque le système comprend, se souvient et répond aux conséquences.

08

Les lunettes IA transforment le monde physique en une interface narrative

E2/E3 La détection toujours disponible et l'affichage privé peuvent rendre lieux, personnes et événements des conditions de récit, à condition que les droits à la vie privée et à l'attention soient prioritaires.

09

La convergence film-jeu passe de la propriété intellectuelle partagée aux mondes partagés

E1/E2 Les personnages, les états du monde, les règles et la provenance peuvent être rendus à travers le film, les jeux, les médias en direct, les expériences spatiales et la création communautaire.

10

L'unité d'actif s'étend d'un film à une famille d'actifs

Framewo Les flux de travail, les workflows, les personnages, les mondes, les comportements et les systèmes d'interaction nécessitent des métadonnées différentes, une logique de version rk et des limites de permission.

11

L'indexation n'est pas le titre légal et la provenance n'est pas un verdict de vérité

E1/Gouver Index.Film™ soutient l'identification, l'enregistrement, la recherche et la collaboration ; il ne remplace pas l'enregistrement légal, la détermination judiciaire ni l'évaluation critique.

12

Les agents créent un marché de contenu du côté machine

E2/E3 Les agents peuvent rechercher, comparer, demander la permission et déclencher un paiement, mais l'intention probabiliste doit rester séparée de l'autorisation et du règlement déterministes [R21–R22].

13

L'économie de l'IA nécessite des comptes, pas un second PIB fictif

La mesure Framewo doit séparer l'entrée humaine, l'exécution IA, l'utilisation virtuelle et le retour dans le monde réel, et supprimer le comptage double intermédiaire rk.

14

La transparence devient une obligation systémique

E1 · Les règles d’étiquetage en Chine et les obligations de transparence de l’UE vont dans le sens d’une divulgation explicite, d’un marquage lisible par machine et de registres de responsabilité [R12–R14].

15

La gouvernance et les infrastructures façonneront 2035 autant que la capacité du modèle

**E3/E4** Les normes ouvertes, l'énergie, le calcul, la diversité culturelle et le partage des bénéfices détermineront si le secteur deviendra une économie créative plurielle ou un système de location fermé.

CHAPÈTRE SPÉCIAL · MANIFESTE

Manifeste du cinéma AI-Natif

  1. Le cinéma AI-natif n'est pas un substitut à bas coût du cinéma traditionnel ; il est une forme d’art émergente construite par la collaboration humain-machine et les systèmes génératifs.
  2. La valeur humaine ne disparaît pas lorsque les outils deviennent plus capables. Les créateurs demeurent responsables de l'intention, des règles, de la sélection, de la composition et des conséquences de la diffusion.
  3. Le marqueur 51%+ mesure une capacité d’action créative substantielle. Il ne s'agit pas d'un ratio de pixels, d'un nombre de modèles ou d'une note de qualité artistique.
  4. Le film linéaire, l'image en mouvement interactive, les médias live génératifs, le récit spatial et les mondes persistants peuvent coexister. Un nouveau média n'exige pas que le vieux média disparaisse.
  5. Les œuvres AI-natives doivent préserver des preuves créatives suffisantes pour soutenir l'identification, la révision et la responsabilité, tout en protégeant les informations confidentielles légitimes.
  6. La provenance n'est pas un verdict de vérité, l'indexation n'est pas un titre légal, et une étiquette technique n'est pas une recommandation. La confiance commence par un compte honnête des limites institutionnelles.
  7. Les créateurs, les interprètes et les titulaires de droits devraient disposer de termes clairs et exécutoires pour les répliques numériques, l'utilisation à des fins d'entraînement, la génération dérivée, le territoire, la durée, la rémunération et le retrait.
  8. Les modèles de monde et les lunettes IA peuvent faire entrer les images en mouvement dans l'espace physique, mais aucune nouvelle expérience ne devrait sacrifier la vie privée, la sécurité des enfants, l'autonomie de l'attention ou la diversité culturelle.
  9. Les œuvres, les flux de travail, les personnages, les mondes et les comportements devraient former des réseaux d'actifs vérifiables, recherchables et licenciables afin que la valeur puisse circuler équitablement entre créateurs, plateformes et communautés.
  10. Ce manifeste, son cadre de classification et ce livre blanc sont conçus pour une révision annuelle. Une définition pour une nouvelle ère doit demeurer ouverte aux preuves et à la correction.
01

CHANGEMENT DE PARADIGME

Pourquoi le cinéma devient un monde exécutable

PARTIE PROPOSITION Le fichier audiovisuel fixe fait place à un système de calcul culturel capable de générer, répondre, se souvenir et évoluer.

01 Le point d'inflexion technologique dans l'industrie du cinéma mondial · 02 Définir le cinéma natif à l'IA : le modèle à double axe et le marqueur de 51%+ · 03 L'évolution de G0 à G5 des médias audiovisuels générés par IA · 04 Méthodologie, grades de preuve et évolution des normes

01Le point d'inflexion technologique dans l'industrie du cinéma mondial

THÈSE DU CHAPITRELe cinéma rencontre simultanément cinq mutations structurelles : de la pénurie de production à l'abondance générationnelle ; des flux de travail fixes à l'orchestration de modèles ; de la découverte de contenu à la découverte de la confiance ; d'un fichier final à un service continu ; et d'un titre à une famille d'actifs. Ces mutations n'éliminent pas l'industrie conventionnelle. Elles modifient les capacités rares, l'accumulation des coûts et la mesure de la valeur.
IMPlications INDUSTRIELLESL'unité stratégique n'est plus le modèle ou le clip. C'est la capacité de l'organisation à produire des résultats acceptables, légaux et répétables sur une pile de capacités remplaçable.
JUGEMENT CLÉL'IA ne réduira pas les coûts du cinéma à zéro. Elle réécrit la structure des coûts et déplace la valeur de la capacité d'exécution vers le jugement, les systèmes et la confiance.

FIGURE 1 · De fichiers fixes à systèmes de calcul culturel

1.1 De l'offre générative à la concurrence des systèmes

Le premier récit de marché s'est concentré sur la baisse du coût de production d'une image plausible. Cette métrique est incomplète. Un projet professionnel paie pour l'intention, la cohérence, la sélection, la révision, le contrôle de la performance, le son, la vérification et l’obtention des droits, la documentation et la responsabilité de la diffusion. À mesure que le nombre de sorties candidates augmente, le coût de décider ce qui peut être accepté — et de prouver pourquoi — peut augmenter. La gestion doit donc suivre le coût total par seconde finale acceptée, le nombre de révisions requises, la couverture de contrôle et la proportion d'actifs qui restent portables lorsqu'un modèle est remplacé.

1.2 Cinq migrations structurelles

Le passage de la capacité de tournage rare à une production acceptable rare ; le passage de la gestion par départements fixes à une orchestration à travers les personnes, les modèles et les outils ; le passage de la rareté du contenu à une découverte fiable ; le passage d’un master final à une relation maintenue ; et le passage d'un titre achevé à une famille réutilisable de mondes, de personnages, de flux de travail et d'enregistrements. Chaque migration crée un avantage concurrentiel différent et un mode d'échec différent.

1.3 L'implication décisionnelle : construire une pile de capacités remplaçable

Aucun studio ne doit rendre sa mémoire créative dépendante de l'interface d'un seul fournisseur ou d'un seul modèle de génération.

Une pile résiliente sépare l'état de l'histoire et du monde, le stockage des actifs, le routage des modèles, l'évaluation, les droits, la traçabilité et la livraison. Les modèles peuvent ensuite être substitués en cas de changement de performance, de coût ou de politique. L'avantage durable réside dans la qualité des décisions créatives de l'organisation et de sa mémoire institutionnelle, et non dans l'accès temporaire à un seul leader de référence.

TABLEAU 1 · CADRE ANALYTIQUE DU CHAPITRE

Déplacement structurelRareté ancienneRareté nouvelleMétrique de gestion
ProductionCapacité de tournageProduction acceptableCoût par seconde acceptée
OrganisationProcessus fixeOrchestration des modèlesRévision / portabilité
DistributionFourniture de contenuDécouverte fiablePortée qualifiée / confiance
ProduitFichier terminéRelation continueRétention / état du monde
ActifsUn titreFamille d'actifsRéutilisation / exhaustivité des autorisations

02Définir le cinéma natif à l'IA : le modèle à double axe et le marqueur 51%+

THÈSE DU CHAPITREUne étiquette binaire — IA ou non-IA — ne saurait décrire le domaine émergent. Ce texte sépare la capacité d’action créative de la génération en temps d'exécution. L'axe P mesure à quel point l'IA façonne matériellement les décisions créatives fondamentales. L'axe R mesure la part du travail expérimenté qui est généré pendant l'utilisation. Une œuvre peut être profondément native à l'IA tout en étant entièrement prérendue, ou créée avec une faible intervention de l’IA tout en étant hautement adaptative en temps d'exécution.
IMPlications INDUSTRIELLESLe modèle à double axe est un langage industriel pour la classification, la preuve et la comparaison. Il n'est pas une décision de droit d'auteur et il ne mesure pas la qualité artistique.
GOUVERNANCELe seuil de 51%+ est un critère d'éligibilité sur l'axe de capacité d’action créative, et non une note de qualité, une présomption juridique ou un nombre de pixels.

FIGURE 2 · La carte à double axe du cinéma AI-Native

2.1 L'axe P : cinq dimensions de la capacité d’action créative

P est évalué sur les dimensions narrative, image, son, personnage et interaction. Les réviseurs examinent si l'IA affecte la structure de l'œuvre, et non si un outil IA a touché un fichier. P0 désigne aucun rôle génératif ; P1, assistance locale ; P2, participation profonde à une étape centrale ; P3, leadership substantiel sur les dimensions créatives pondérées ; et P4, une œuvre dont l'identité artistique est elle-même un système génératif. Le seuil de 51%+ indique l'entrée en P3 lorsque les poids divulgués et les preuves montrent que l'IA dirige matériellement les dimensions pertinentes.

2.2 L'axe R : génération en temps réel

R0 est une reproduction entièrement pré-produite. R1 s'adapte avant la présentation ; R2 combine des composants pré-produits et générés ; R3 génère la majorité du contenu expérimenté en réponse à la session ; et R4 est continuellement généré, avec maintien d’un état et non exactement reproductible. Puisque la génération en temps réel augmente les risques opérationnels, R doit être évalué indépendamment de P. Un score R élevé nécessite des budgets de latence, des contrôles d'état, des politiques de sécurité, des journaux, des plans de repli et un opérateur clairement identifié.

2.3 Le principe et la responsabilité du chef d'orchestre

L'auteur humain dans un processus AI-Native ressemble souvent à la direction d'orchestre : définir l'intention, sélectionner les systèmes, construire les contraintes, décider ce qu'il faut rejeter, organiser les sorties et accepter la responsabilité. Cela ne rend pas chaque prompt une œuvre d’auteur. Cela signifie que le contrôle créatif doit être prouvé par des choix et leurs conséquences. Le document pertinent est une chaîne de décisions — pas une capture d'écran d'un prompt et pas une affirmation selon laquelle le modèle a agi seul.

TABLE 2 · CADRE ANALYTIQUE DU CHAPITRE

NiveauAxe P : Capacité d’action créativeAxe R : Génération en Temps Réel
0Pas d'IA générativeEntièrement pré-produit
1Assistance localeAdaptation pré-session
2Rôle central dans une pièce de théâtrePré-produit mixte / généré
351 % ou plus de leadership substantielLa plupart du contenu généré en direct
4L'œuvre est un système génératifPersistant et non entièrement reproductible

03L'évolution G0–G5 des médias audiovisuels générés par IA

THÈSE DU CHAPITRELe modèle G0–G5 décrit une évolution du médium de la production traditionnelle vers des mondes génératifs persistants. Il ne s'agit pas d'un classement de maturité pour les organisations ni d'une affirmation selon laquelle chaque stade remplace celui qui le précède. Un studio peut exploiter des produits à plusieurs stades simultanément, et un film linéaire fixe peut demeurer artistiquement supérieur à un format plus computationnel.
IMPlications INDUSTRIELLESLes transitions de stade doivent être reconnues uniquement lorsqu'une nouvelle capacité est démontrée avec un flux de travail fiable, une valeur utilisateur et une gouvernance – et non lorsqu'un échantillon promotionnel apparaît.
PRINCIPES D'ADOPTIONLes nouveaux stades étendent la portée expressive des images en mouvement. Ils ne rendent pas les formes antérieures obsolètes.

FIGURE 3 · L'évolution G0–G5 des médias audiovisuels générés par IA

3.1 Ce que signifient G0–G5

G0 correspond à la production audiovisuelle conventionnelle. G1 utilise l'IA comme outil d'assistance. G2 génère des composants substantiels. G3 est natif de l'IA selon le test de la capacité d’action créative. G4 introduit la génération en temps réel et réactive à l'audience. G5 décrit un monde persistant avec une identité durable, un état multi-utilisateur, des règles sociales et une économie. La classification se concentre sur l'ontologie de l'œuvre : savoir si la sortie est un fichier, une œuvre générée, une expérience interactive ou un monde opérationnel.

3.2 La position de 2026 : capacité visible, institutions incomplètes

D'ici 2026, des preuves solides existent pour les flux de travail de production G2 et G3, tandis que G4 a commencé l'exploration de produits publics via des modèles de mondes interactifs et une génération à faible latence [R07–R10]. G5 reste un horizon de scénario. Ses composants individuels — identité, économies virtuelles, agents, interfaces spatiales et état persistant — existent séparément, mais leur combinaison en un monde culturel ouvert, durable et gouvernable n'a pas atteint une maturité générale.

3.3 Portes de stage et conditions de sortie

Le passage de G2 à G3 nécessite une preuve de création intégrant l’humain et l’IA plutôt que de séquences générées isolées. Le passage de G3 à G4 nécessite une réponse en temps réel, une persistance d'état, une latence bornée, la sécurité et des mécanismes de repli. Le passage de G4 à G5 nécessite une cohérence multi-utilisateur, une identité, des règles économiques, un traitement des litiges et une gestion à long terme. Un produit doit être décrit au stade le plus élevé auquel il peut fonctionner de manière fiable, et non au stade le plus élevé imaginé dans sa feuille de route.

TABLEAU 3 · CADRE ANALYTIQUE DU CHAPITRE

TransitionCapacité ajoutéePreuve minimale
G2 → G3Création humaine-AI intégréePreuve créative / flux de travail cohérent
G3 → G4Réponse en temps réelLatence / état / repli / sécurité
G4 → G5Monde multi-utilisateur persistantIdentité / cohérence / économie / gouvernance

04Méthodologie, grades de preuve et évolution des normes

THÈSE DU CHAPITRELa technologie à évolution rapide suscite la tentation de traiter chaque démonstration comme un fait de marché établi. Ce document utilise quatre niveaux de preuve : E1 pour des faits commerciaux ou institutionnels mis en œuvre ; E2 pour des démonstrations publiques et des rapports techniques ; E3 pour des prototypes de recherche ; et E4 pour l'inférence de scénarios. Le niveau décrit ce qui est connu, pas l'importance de la proposition.
IMPlications INDUSTRIELLESToute prédiction doit énoncer ses hypothèses techniques, économiques, matérielles, de gouvernance et culturelles, et chaque édition annuelle doit rapporter quelles prédictions antérieures ont été confirmées, retardées, dégradées ou retirées.
PRINCIPES ÉDITORIAUXLes niveaux de preuve indiquent la portée des éléments disponibles. Ce ne sont pas des étiquettes de confiance décoratives.

FIGURE 4 · Quatre niveaux de preuve et langages autorisés

4.1 Quatre niveaux et quatre langages autorisés

L'E1 soutient des langages tels que mis en œuvre, disponible ou requis – dans une juridiction ou une frontière de produit spécifiée. L'E2 soutient des démonstrées ou rapportées, pas universellement matures. L'E3 soutient une recherche indiquant une capacité possible, pas une promesse commerciale. L'E4 doit être écrit conditionnellement : si les hypothèses définies sont valables, une configuration future devient plausible. Les performances déclarées par les entreprises restent au niveau E2 sauf si elles ont une validation indépendante significative.

4.2 Balayage technologique et prévision

Le processus de recherche sépare la capacité, la fiabilité, l’accessibilité financière, la déployabilité et la légitimité. Une amélioration de référence est un signal de capacité ; ce n'est pas une preuve de fiabilité de production. Une démonstration publique est un signal de déployabilité ; ce n'est pas une preuve d'économie d'unité durable. Une réglementation est une contrainte de légitimité ; elle peut également créer une demande d'infrastructure. Les prévisions sont construites à partir de l'interaction de ces variables plutôt que d'une seule courbe de performance exponentielle.

4.3 Révision annuelle et falsification

Le livre blanc doit maintenir un registre de prévisions avec hypothèses, indicateurs avancés et preuves de déconfirmation. Si une prévision échoue, l'édition doit enregistrer pourquoi. Cette discipline transforme la publication en un programme de recherche publique cumulatif et empêche la crédibilité institutionnelle de dépendre d'un théâtre de certitude.

TABLEAU 4 · CADRE ANALYTIQUE DU CHAPITRE

NiveauPreuveLangue autoriséeÉviter
E1Fait commercial / institutionnelMis en œuvre / disponibleConditions à omettre
E2Démo publique / rapport techniqueDémontré / rapportéUniversellement mature
E3Prototype de rechercheLa recherche indiquePromesse commerciale
E4Inférence de scénarioSi les hypothèses sont valablesUne certaine langue
02

FONDATIONS TECHNIQUES

Des modèles de fondation vidéo vers des modèles mondiaux

PARTIE PROPOSITION : La concurrence évolue de la qualité d'image unique vers le contrôle, la mémoire, la gestion d'état, la réponse en temps réel et la sécurité opérationnelle.

05 L'évolution technique des modèles de fondation vidéo · 06 Les goulots d'étranglement techniques réels de la génération de caractéristiques longues · 07 Modèles mondiaux : de la prédiction du prochain cadre à la simulation d'un monde · 08 Architecture de référence pour les systèmes audiovisuels IA en temps réel · 09 Agents IA et interprètes virtuels

05L'évolution technique des modèles de fondation vidéo

THÈSE DU CHAPITRELa génération vidéo évolue d'un problème de synthèse de pixels vers une pile de modèles de fondation audiovisuels. Les couches critiques incluent les données et l'évaluation, la représentation spatiotemporelle, la génération conjointe audio-vidéo, le montage et le contrôle, ainsi que la gouvernance de la livraison. La concurrence industrielle évolue de l'attractivité d'un meilleur échantillon vers la répétabilité, l'éditabilité locale, la stabilité de l'identité et l'économie de sortie acceptable.
IMPlications INDUSTRIELLESL'acquisition de modèles doit reposer sur la couverture du contrôle, la cohérence, l'étendue des révisions, le coût par seconde acceptée et la capacité de gouvernance — et non sur la démonstration la plus impressionnante d'un fournisseur.
MÉTRIQUE D'ACQUISITIONUn modèle de production est précieux lorsqu'il peut être dirigé, révisé et documenté — et non seulement lorsqu'il peut surprendre.

FIGURE 5 · La pile de capacités de modèle de fondation vidéo

5.1 De la synthèse de pixels aux modèles de fondation audiovisuels

Les systèmes à base de diffusion et de transformeurs ont amélioré le mouvement, la composition, l'adhérence aux prompts et la durée, tandis que les approches natives audio-vidéo déplacent le son de l'attachement en post-production vers une représentation temporelle partagée [R02–R06]. L'objectif technique n'est plus un plan unique cohérent. Il s'agit d'une représentation contrôlable de l'identité, de l'action, de la caméra, du son, du timing et du contexte physique qui peut être rééditée à plusieurs reprises sans faire s'effondrer des éléments non liés.

5.2 Le contrôle comme diviseur industriel

Les flux de travail professionnels nécessitent des modifications sélectives : modifier un geste sans changer le visage ; étendre une prise sans modifier le costume ; remplacer le dialogue tout en conservant le timing de la performance ; déplacer une caméra tout en maintenant la géographie stable. Le contrôle doit donc être mesuré comme une couverture des variables créatives et comme l'étendue de la zone d'impact non intentionnelle après révision. Un modèle qui nécessite une régénération complète pour chaque modification transfère les coûts de la prise de vue vers l'itération.

5.3 Audio-vidéo natif et une timeline commune

La génération conjointe peut améliorer la synchronisation labiale, le timing environnemental et le couplage du rythme, du discours et de l'action. Elle élargit également la surface des droits et de la sécurité. Un registre de production doit identifier quelles voix, musiques, effets et signaux de performance ont été générés, adaptés ou fournis, et comment ils ont été approuvés.

La génération temporelle partagée doit donc être accompagnée d'une provenance temporelle partagée.

TABLE 5 · CADRE ANALYTIQUE DU CHAPITRE

DimensionQuestionMétrique d'exemple
ContrôleUn élément peut-il changer seul ?Couverture du contrôle
CohérenceL'identité persiste-t-elle ?Dérive identité / scène
ModifiabilitéLa révision peut-elle rester locale ?Rayon d'impact de la révision
ÉconomieQuel niveau de sortie est acceptable ?Coût par seconde acceptée
GouvernanceL'origine et les limites peuvent-ils être enregistrés ?Complétude du champ

06Les véritables goulots d'étranglement techniques de la génération de longs métrages

THÈSE DU CHAPITRELa génération de longs métrages n'est pas résolue par la concaténation de meilleurs clips courts. Une œuvre longue est un problème de gestion d'état impliquant l'identité, les costumes, les accessoires, la géographie, l'histoire causale, la connaissance des personnages, l'émotion, le son et le développement thématique. L'actif principal de production est une base de données d'état du monde que les personnes et les modèles peuvent lire et mettre à jour.
IMPlications INDUSTRIELLESL'évaluation des formats longs doit passer de la qualité des images à la continuité, la cohérence causale, la révision contrôlée et la récupérabilité de l'état créatif.
CONCLUSION D'INGÉNIERIEUn long métrage n'est pas une longue requête. C'est une séquence de transitions d'état gouvernée, soutenue par des preuves et des décisions humaines.

FIGURE 6 · La boucle d'état du monde des longs métrages

6.1 Un long métrage est une base de données d'état

Chaque scène dépend de faits établis précédemment : qui sait quoi, quel objet s'est déplacé, comment une relation a changé et quelles contraintes physiques restent en vigueur. Ces faits doivent être représentés explicitement plutôt que laissés dans une fenêtre de contexte opaque. Un système d'état de production lie le livret de l'histoire, l'état des personnages, la carte spatiale, les versions des actifs, les prises approuvées et les risques de continuité non résolus. La sortie générée est ensuite vérifiée contre l'état avant de devenir canonique.

6.2 Planification hiérarchique : monde, séquence, scène, prise et image

Le contrôle des formats longs nécessite plusieurs horizons de planification. Les règles du monde contraignent l'ensemble du projet ; les séquences portent le mouvement dramatique ; les scènes mettent à jour les relations et les informations ; les prises spécifient l'action, la caméra et le son ; les images rendent le résultat local. L'évaluation et la régénération doivent se produire au niveau le plus petit capable de corriger le problème sans déstabiliser l'intention de niveau supérieur. Cette hiérarchie permet également à différents modèles et spécialistes humains de travailler sur des couches séparées.

6.3 Métriques au-delà de la qualité visuelle

Au niveau du plan, les métriques incluent la complétion de l'action et la synchronisation audio-vidéo. Au niveau de la scène, l'identité, le costume, le décor et la continuité des éléments matériels sont essentiels. Au niveau de la séquence, la cohérence causale et spatiale domine. Au niveau de l'ensemble de l'œuvre, le développement émotionnel, le thème et le rythme doivent demeurer intelligibles. La métrique la plus utile est souvent le coût et le temps nécessaires pour restaurer l'œuvre après la détection d'une incohérence.

TABLEAU 6 · CADRE ANALYTIQUE DU CHAPITRE

ÉchelleMétriqueExemple de défaillance
PlanAction / synchronisationGeste ou dérive des lèvres
ScèneContinuité personnage / élément matérielMutation du costume ou de l'objet
SéquenceEspace / causalitéPosition ou événement contradictoires
Œuvre entièreÉmotion / thèmeMotivation brisée

07Modèles du monde : De la prédiction du prochain cadre à la simulation d'un monde

THÈSE DU CHAPITREUn modèle du monde n'est pas défini par sa capacité à produire une image ressemblant à un monde. Sa fonction minimale est de maintenir un état qui évolue en réponse à une action et qui soutient la mémoire, la causalité et la prédiction du futur. Les modèles de monde vidéo interactifs montrent que les images en mouvement générées peuvent devenir exécutables, mais l'horizon 2026 reste limité par la durée, le contrôle, la cohérence, le coût et la sécurité [R07–R10].
IMPlications INDUSTRIELLESLes modèles de monde et les moteurs de jeu doivent être traités comme des systèmes complémentaires : la génération apprise élargit les possibilités, tandis que la simulation explicite fournit déterminisme, outils et contrôle.
DISCIPLINE DE LA TERMINOLOGIEGénérer une scène n'est pas la même chose que maintenir un monde ; maintenir un monde n'est pas la même chose que d'exploiter en toute sécurité un espace culturel multi-utilisateur.

FIGURE 7 · Boucle minimale de modèle du monde interactif

7.1 La boucle interactive minimale

La boucle utile la plus petite observe une entrée, interprète l'intention, sélectionne une action, met à jour l'état, génère une réponse et écrit l'événement résultant dans la mémoire. Si le système ne peut pas distinguer l'observation de l’état de référence faisant autorité, ou ne peut pas expliquer quelle action a produit un changement, il s'agit d'une interface générative plutôt que d'un modèle du monde opérationnel. Pour le cinéma, cette distinction détermine si une action du public a une signification narrative durable.

7.2 La limite de capacité 2026

Les systèmes publics ont démontré une interaction en temps réel en 720p et à 20–24 fps sur des sessions de l’ordre de quelques minutes, tandis que la recherche explore la génération en streaming et une mémoire plus longue [R07–R10]. Ce sont des signaux E2 et E3 significatifs. Ils n'établissent pas encore une stabilité multi-heures sans fin, une adhésion à l'action sans restriction, une accessibilité large des appareils, une synchronisation multi-utilisateur ou une gouvernance au niveau des événements. Les revendications de produits doivent préserver cette limite.

7.3 Collaboration avec l'infrastructure des moteurs de jeu

Une architecture à court terme pragmatique combine géométrie explicite, physique, navigation et règles déterministes avec un rendu génératif, un dialogue, une performance et une variation. Le moteur contrôle ce qui doit être reproductible ; le modèle fournit ce qui bénéficie de la probabilité et de la largeur expressive. La conception hybride rend également la sécurité et le débogage plus gérables, car l'état critique peut rester inspectable même lorsque la surface est générée.

TABLEAU 7 · CHAPITRE CADRE ANALYTIQUE

CapacitéStatut 2026Porte d'échelle
Image en temps réelDémonstration publiqueAbordable sur tous les appareils
Mémoire longueMinutes / rechercheStable sur des heures
Action préciseContrôles bornésAdhésion à l'action ouverte
Mondes multi-utilisateursExploration précoceCohérence et gouvernance
Provenance sûreSchémas préliminairesNorme au niveau de l'événement

08Architecture de référence pour les systèmes audiovisuels en temps réel à l'IA

THÈSE DU CHAPITRELe cinéma en temps réel à l'IA nécessite plus qu'un modèle vidéo rapide. Un système fiable inclut l'entrée et la détection, l'interprétation de l'intention, la politique narrative, l'état et la mémoire, le routage des modèles, la génération et le rendu, le contrôle de la voix et des personnages, la livraison et l'informatique en périphérie, ainsi que la traçabilité et la sécurité. La fiabilité dépend du comportement de l'ensemble de la pile en cas de défaillance.
IMPlications INDUSTRIELLESUn système génératif de qualité live doit pouvoir refuser, différer, dégrader et revenir en arrière. La génération sans un chemin de repli sûr n'est pas une fiabilité de production.
PRINCIPES DE SÉCURITÉLa latence, la sécurité et la traçabilité sont des budgets architecturaux, et non des fonctionnalités ajoutées après la complétion du système créatif.

FIGURE 8 · Architecture à huit couches du cinéma en temps réel à l'IA

8.1 La pile à huit couches

La détection convertit la voix, le regard, les gestes, les entrées de contrôleur et les événements du monde en signaux bornés. L'interprétation de l'intention sépare une demande utilisateur d'une observation accessoire. La politique narrative contraint ce qui peut se produire ; l'état et la mémoire préservent ce qui s'est produit. Le routage des modèles affecte les modèles spécialisés ; la génération et le rendu produisent le résultat audiovisuel ; le contrôle des personnages et de la voix maintient les performances ; la livraison coordonne le dispositif, la périphérie et le cloud ; la traçabilité et la sécurité enregistrent l'événement et appliquent la politique de publication.

8.2 Budgets de latence et dégradation gracieuse

Toute opération n'appartient pas à la même échéance. La rétroaction perceptuelle peut nécessiter une latence très faible, tandis qu'une réponse narrative complexe peut utiliser une sortie en plusieurs étapes. Les systèmes devraient mettre en cache des actifs sûrs, prédire des actions probables, utiliser des modèles locaux plus légers, diffuser une qualité progressive et revenir à des matériaux pré-générés approuvés. Lorsque les vérifications de politique ou les appels de modèle échouent, l'expérience devrait devenir plus simple — non pas insécure, incohérente ou indisponible sans explication.

8.3 Traçabilité dynamique

La provenance au niveau du fichier est insuffisante pour une session générée en continu. L'enregistrement de l'événement doit identifier l'intention soumise, la politique active, le modèle et la version, les actifs référencés, le résultat généré, la décision de sécurité, l'opérateur et l'horodatage. La divulgation publique peut rester un résumé concis, tandis que les journaux sensibles restent accessibles uniquement avec contrôle. L'objectif n'est pas la surveillance du public ; il s'agit de la responsabilité pour le comportement systémique à conséquences.

TABLE 8 · CHAPITRE CADRE ANALYTIQUE

CoucheObjectifApproche principale
DétectionLatence très faibleTraitement local
Intention et politiqueHiérarchiséeModèles légers / cache
GénérationBudget par imageDistillation / matériel spécialisé
Réseau et affichageJitter stableBord de ligne / flux à foveation
SécuritéJamais contournéPré-contrôle / dégradation / blocage

09Agents IA et Performeurs Virtuels

THÈSE DU CHAPITREUn personnage IA persistant n'est pas simplement une peau visuelle placée sur un chatbot. Il combine identité, objectifs, mémoire, capacités, politique et performance. Le personnage peut continuer à travers les scènes et les sessions, mais la responsabilité juridique et de publication ne peut être déléguée à une personnalité virtuelle. Un responsable reste comptable du comportement du système.
IMPlications INDUSTRIELLESLa mémoire du personnage et l'autonomie créent une valeur récurrente, mais elles transforment également les droits de performance, le consentement et la sécurité en obligations opérationnelles continues.
PRINCIPES DE GOUVERNANCEUn personnage peut avoir une mémoire durable et des capacités d'action ; la responsabilité de publication doit demeurer à une personne identifiable ou une organisation.

FIGURE 9 · Six Composants d'un Personnage Opérationnel

9.1 Un agent est plus qu'une surface de personnage

Un agent prêt pour la production nécessite un modèle d'identité stable, un ensemble explicite d'objectifs, une mémoire délimitée, des capacités autorisées, une politique comportementale et une couche de performance. Ces composants doivent être versionnés séparément. Un nouveau modèle de voix ne doit pas modifier silencieusement l'éthique du personnage ; une mémoire élargie ne doit pas automatiquement élargir le consentement ; et un changement de capacité d'action doit déclencher une révision même si l'apparence reste inchangée.

9.2 Contrôle de la performance et doubles numériques

Le visage, la voix, le mouvement, la personnalité et le comportement autonome sont des domaines de permission distincts. Le consentement doit spécifier le média, le contexte, le public, le territoire, la durée, la rémunération, le retrait et les exclusions à haut risque. Transformer un portrait passif en agent autonome est un changement matériel, pas une utilisation courante.

Le système doit également distinguer un personnage de fiction appartenant à une production de l'identité protégée d'un interprète [R15–R16].

9.3 Production et opérations multi-agents

Les agents peuvent soutenir le débriefing, la revue de continuité, la recherche d'actifs, la localisation, la vérification des politiques et les opérations mondiales. Leur travail doit être organisé sous forme de propositions qui entrent dans un pipeline d'approbation déterministe.

Les décisions importantes—modifications canoniques de l'histoire, transactions à haute valeur, représentations sensibles et publication publique—nécessitent une autorité approuvante identifiable. La collaboration d'agents est utile uniquement lorsque la responsabilité ne se dissout pas au sein d'une chaîne d'actions automatisées.

TABLE 9 · CHARTE ANALYTIQUE

ÉlémentDoit spécifierModification à risque élevé
IdentitéVisage / voix / mouvement / personnageFusion de personnages
UtiliserMédias / scène / publicPolitique / adulte / médical
CapacitéGénérer / converser / agirPassif à autonome
DuréeDébut / fin / retraitPermanent / posthume
IndemnisationAchat / utilisation / participation aux revenusRéutilisation non divulguée
03

LA RÉVOLUTION DE L'APPAREIL

De l'écran et du smartphone à la lunettes IA

PROPOSITION PART Lorsque l'affichage, la détection et la génération convergent, l'espace physique devient partie de l'interface narrative.

10 Quatre migrations de l'appareil audiovisuel · 11 De nouvelles formes cinématographiques rendues possibles par les lunettes IA · 12 Cinéma spatial et génération à distance

10Quatre migrations de l'appareil audiovisuel

THÈSE DU CHAPITREL'écran de cinéma a concentré l'attention collective ; la télévision a apporté les images en mouvement dans le foyer ; le smartphone les a rendues personnelles, fréquentes et interactives ; les lunettes IA pourraient les rendre contextuelles et environnementales. Chaque migration change l'unité de contenu, le modèle économique, le contrat social et la grammaire de l'attention. Le prochain appareil n'est pas simplement un écran plus petit placé près de l'œil. L'adoption dépendra de la coordination de la détection, de la génération, de l'affichage, de la vie privée et de la durée de la batterie,
IMPlications INDUSTRIELLESCONSÉQUENCE POUR L’INDUSTRIE prix, acceptabilité sociale et écosystème de contenu crédible – pas seulement sur la qualité d'affichage. JUGEMENT DE L'APPAREIL Le prochain appareil cinématographique est défini par la mesure dans laquelle la détection, la génération et l'affichage coopèrent sous une forme socialement acceptable.

FIGURE 10 · Quatre migrations de l'appareil audiovisuel

10.1 De sessions collectives à événements contextuels

L'unité théâtrale est la séance programmée ; l'unité télévisuelle est le programme ; l'unité smartphone est le flux, la vidéo courte ou le flux en direct. Les lunettes IA introduisent une unité possible basée sur le lieu, la relation et l'événement.

Une scène peut commencer parce qu'une personne entre dans un lieu, rencontre un autre participant ou demande à un personnage de révéler une couche du monde. Cela déplace la commande de minutes de contenu vers des règles indiquant quand et pourquoi une expérience apparaît.

10.2 Collaboration appareil-bord-nuage

Le traitement local est essentiel pour une détection sensible, un retour immédiat et la sécurité de base. L'infrastructure de bord peut réduire la latence et soutenir l'état régional, tandis que les systèmes cloud fournissent l'inférence de grands modèles et des services de monde persistants. Un produit bien conçu décide quelles informations ne doivent jamais quitter l'appareil, quels événements nécessitent un état partagé et quels résultats peuvent être générés à partir de signaux anonymisés ou minimisés.

10.3 Les véritables barrières à l'adoption

Le poids, la chaleur, l'autonomie de la batterie, le champ de vision, la lisibilité de l'affichage, le support des lunettes de prescripteurs, le prix et le style sont tous déterminants. De même, le statut d'enregistrement visible, les attentes des témoins, la politesse sociale et la capacité de l'utilisateur à silencer le système comptent.

Les prototypes publics et les travaux sur les plateformes démontrent une dynamique [R24–R27], mais le marché ne se développera que lorsque les personnes ordinaires pourront porter le dispositif sans friction technique, sociale ou psychologique.

TABLE 10 · CADRE ANALYTIQUE DU CHAPITRE

DispositifCapacité centraleUnité de contenuLimite principale
CinémaAttention partagéeSession programméeTemps et lieu
TélévisionImmersion domestiqueProgramme / sérieInteraction faible
Téléphone intelligentFréquence personnelleCourt / en directÉcran réduit / fragmentation
Lunettes IAContexte et présenceLieu / événement relationnelConfidentialité / batterie / acceptation

11Nouvelles formes cinématographiques rendues possibles par les lunettes IA

THÈSE DU CHAPITRELes lunettes IA peuvent connecter un récit généré à la position, au regard, aux objets, au son environnemental et à l'affichage privé. Cela permet des histoires conscientes du lieu, des personnages compagnons, des événements dans l'espace public et une accessibilité personnalisée. Cela rend également la couche de contenu continue et intime, ce qui nécessite un contrôle utilisateur plus fort que le modèle de notification du smartphone.
IMPlications INDUSTRIELLESUn système qui reste dans le champ de vision doit accorder à l'utilisateur une autorité explicite sur l'interruption, la mémoire, l'enregistrement, l'influence commerciale et la sortie.
SALLE DE PROJETLa présence persistante crée un devoir plus élevé de retenue. Le contenu doit mériter le droit d'apparaître dans le champ de vision d'une personne.

FIGURE 11 · La boucle de contenu contextuel pour les lunettes IA

11.1 Récit de lieu et personnages environnementaux

Une rue, un musée, un quartier théâtral ou un trajet en transport peut devenir un espace actif de narration. Les personnages peuvent comprendre un contexte large, se référer à des événements mondiaux persistants et révéler un contenu qui dépend du lieu ou du temps. Les expériences les plus fortes ne couvriront pas la réalité avec des graphiques constants. Elles utiliseront une intervention ponctuelle, des ancres spatiales lisibles et des transitions claires entre l'environnement factuel et la couche fictionnelle.

11.2 Personnages compagnons et conception de l'attention

Un personnage compagnon peut soutenir la continuité entre les sessions, mais une conception de relation persistante peut également créer une dépendance ou manipuler la vulnérabilité. Les produits doivent avoir des limites d'intervention, des modes silencieux, des contrôles de mémoire, des paramètres par défaut adaptés à l'âge et une divulgation commerciale claire. L'engagement émotionnel ne doit pas être utilisé pour obtenir le consentement, augmenter les prix ou contourner les limites d'attention déclarées par l'utilisateur.

11.3 Une nouvelle grammaire du cadrage

Le plan n'est plus entièrement contrôlé par un réalisateur, car l'utilisateur peut regarder ailleurs et se déplacer dans l'espace. La composition se déplace donc vers des champs de pertinence, une orientation acoustique, des révélations temporelles, une mise en place spatiale et la priorité des événements. Les créateurs conçoivent ce qui peut être remarqué, comment l'attention est invitée et ce qui se passe si un indice est manqué. Le résultat est plus proche de la chorégraphie de la perception que de l'édition d'une séquence fixe.

TABLEAU 11 · CADRE ANALYTIQUE DU CHAPITRE

RisquesContrôleDroits d'utilisateur
Détection par témoinStatut visible / filtre localRemarque et plainte
Captation de l'attentionLimites d'interventionSilence / sortie
Malutilisation de la mémoireFinalité et duréeInspection / correction / suppression
Manipulation commercialeDivulgation publicitaire / règles de tarificationRejeter la personnalisation

12Cinéma spatial et génération à distance

THÈSE DU CHAPITRELe cinéma spatial combine la capture réelle, les actifs 3D et 4D, les environnements reconstruits, l'état explicite du monde et le rendu génératif. La livraison peut être pré-produite, diffusée en streaming, générée à la périphérie ou assemblée à travers un pipeline hybride. L'actif durable n'est pas un fichier volumétrique unique, mais un ensemble séparable de géométrie, de sémantique, de comportement, de provenance et de droits.
IMPlications INDUSTRIELLESLes œuvres spatiales doivent préserver les couches qui peuvent être déplacées entre les appareils et les moteurs, plutôt que de verrouiller l'expérience entière dans un runtime propriétaire.
PRINCIPES DES ACTIFSUne œuvre spatiale portable sépare la géométrie, le sens, le comportement, la provenance et la permission.

FIGURE 12 · Pipeline de contenu spatial hybride

12.1 Trois voies vers le contenu spatial

La pré-production 3D offre une qualité déterministe mais un coût d'actif élevé. La reconstruction et les représentations neuronales peuvent capturer les environnements réels rapidement, mais compliquent l'édition, l'identité et les droits. La génération de monde offre de la variation et de la réactivité, mais doit gérer la cohérence et la sécurité. Les produits professionnels combinent probablement les trois : des éléments principaux à rendu déterministe, des lieux réels reconstruits et une variation générée dans des limites gérées.

12.2 Génération à distance et streaming foveal

Le rendu peut être divisé entre l'appareil, la périphérie et le cloud selon la latence, la confidentialité et la qualité. Les techniques foveales allouent la qualité là où l'utilisateur regarde, réduisant ainsi la demande de transport et de rendu [R26]. Cependant, le regard est un signal sensible. Les systèmes devraient l'utiliser pour l'efficacité de la livraison sans le convertir silencieusement en profilage comportemental, en intention d'achat ou en inférence émotionnelle.

12.3 Interopérabilité et portabilité des actifs

OpenXR et les normes spatiales connexes fournissent des interfaces communes pour les appareils et les entités [R27], mais la portabilité narrative nécessite également des conventions sémantiques et comportementales. Une porte doit être reconnaissable comme un objet avec des règles, et non seulement comme un maillage. Un personnage a besoin d'identité et de métadonnées de droits, et non seulement d'animation.

L'interopérabilité doit donc couvrir l'état, les événements, les permissions et la provenance, ainsi que la géométrie.

TABLE 12 · CADRE ANALYTIQUE DU CHAPITRE

VoieAvantageLimiteMeilleure utilisation
3D préconstruitDéterministeCoût élevé des actifsActifs héroïques / marques
ReconstructionCapture rapide dans le monde réelComplexité de l'édition / des droitsLieux réels
Génération de mondeVariation illimitéeCohérence / sécuritéFond / interaction
HybrideÉquilibre qualité-coûtComplexité du systèmeProduits professionnels
04

CONTENU ET PUBLICS

La façon dont les spectateurs deviennent participants

PROPOSITION PARTIE : Le contenu évolue d'une prestation ponctuelle vers une relation continue, tandis que le public acquiert une agence significative au sein de l'œuvre.

13 Du droit à regarder au droit d'agir · 14 De nouveaux modèles d'interaction · 15 Les limites de l'expérience audiovisuelle personnalisée · 16 Narration et art à l'ère de l'IA

13Du droit à regarder au droit d'agir

THÈSE DU CHAPITRELa capacité d’action du public peut être décrite comme une échelle : le droit de regarder, le droit de choisir, le droit d'agir et le droit de co-gouverner. Plus d'options ne créent pas automatiquement une participation plus significative. Cette capacité existe lorsque le système comprend une action, la retient et produit des conséquences qui importent au participant et au monde. La conception interactive doit mesurer la signification causale, pas la taille du menu. Toute augmentation de
IMPlications INDUSTRIELLESINDUSTRY IMPLICATION : l'agence augmente également la responsabilité du système à expliquer, à retenir et à protéger.
JUGEMENT DE L'EXPÉRIENCEL'interaction devient agence lorsque l'action du spectateur modifie l'état du monde d'une manière lisible et redevable.

FIGURE 13 · L'échelle des droits du public

13.1 Quatre niveaux de droits du public

Regarder inclut le démarrage, la pause, l'arrêt et l'accès à l'œuvre. Choisir signifie naviguer dans les branches déclarées. Agir signifie modifier l'état persistant par la parole, le mouvement ou toute autre entrée. La co-gouvernance permet aux participants de créer des actifs, de proposer des règles ou de partager la valeur. Les produits doivent indiquer le niveau qu'ils offrent et quelles décisions restent sous le contrôle éditorial ou opérationnel.

13.2 Visionnage par défaut et fatigue du choix

Le cinéma peut demeurer immersif car les spectateurs n'ont pas à gérer chaque instant. La conception AI-native doit préserver une expérience par défaut forte et inviter à l'action uniquement lorsqu'elle ajoute du sens. Le système peut déduire qu'une personne est désengagée, mais il ne doit pas convertir des signaux passifs en changements d'histoire irréversibles ou en décisions commerciales. Un utilisateur doit pouvoir revenir à une expérience cohérente après ne rien avoir fait.

13.3 Reconstruire l'expérience collective

Les expériences partagées nécessitent des règles pour les intentions conflictuelles. Un groupe peut voter, déléguer, agir à tour de rôle ou suivre des rôles. La conception doit révéler comment l'influence est allouée et protéger les minorités contre le harcèlement ou l'exclusion systémique. La capacité d’action collective n'est pas simplement un canal d'entrée plus grand ; c'est un petit système de gouvernance à l'intérieur de l'œuvre.

TABLE 13 · CADRE ANALYTIQUE DU CHAPITRE

DroiteCapacité du publicDevoir du système
RegarderDémarrer / ArrêterPrésentation claire
ChoisirNaviguer les branchesExpliquer la conséquence
AgirChanger l'état du mondeMémoire et rétroaction
Co-gouvernerÉtablir des règles / des actifsProcessus équitable / part de valeur

14Nouveaux modèles d'interaction

THÈSE DU CHAPITRELa voix, le regard, le geste, la position, les signaux de groupe et certaines entrées physiologiques peuvent tous devenir des interfaces pour le cinéma AI-native. Leur utilité et leurs risques diffèrent. Observer un signal n'implique pas l'autorisation de le traiter comme une intention, un consentement ou une autorisation de paiement. Les actions sensibles doivent être déclenchées par un contrôle explicite et compréhensible.
IMPlications INDUSTRIELLESLa pile d'interaction doit séparer l'observation, l'intention déduite, l'action proposée et l'action autorisée. Cette séparation est centrale pour la confiance et pour le commerce médié par agent. LIMITE D'INTERACTION Un système peut observer un signal sans avoir l'autorité d'y agir.

FIGURE 14 · Interaction multimodale et autorisation

14.1 Une carte d'interaction multimodale

La voix est efficace pour l'intention explicite mais ne devrait pas être conservée par défaut. Le regard est utile pour la référence et la priorité de rendu, mais pas pour le consentement. Le geste soutient la manipulation spatiale, mais les gestes à haut risque nécessitent une confirmation. L'emplacement permet le contexte, mais ne devrait pas exposer les mouvements d'une personne. Les données physiologiques devraient être limitées aux fonctions d'accessibilité ou de sécurité nécessaires, sauf si un objectif séparé et révocable est clairement accepté.

14.2 Langage naturel et langage de contrainte

Les utilisateurs peuvent demander au monde de devenir plus silencieux, révéler une autre perspective ou permettre à un personnage d'expliquer un événement passé.

Le système devrait traduire un langage ouvert en un plan d'action limité régi par l'histoire, la sécurité et les droits.

Il devrait également expliquer quand une demande entre en conflit avec les règles de l'œuvre. Le langage naturel est une interface pratique ; il n'est pas un canal d'instruction illimité.

14.3 Retour d'information, latence et confiance

Un système interactif devrait reconnaître rapidement l'entrée, distinguer le traitement de la fin et indiquer quand une action n'est pas disponible. Si la latence est élevée, il peut fournir une réponse préliminaire sûre plutôt que d'ignorer silencieusement l'utilisateur. La confiance diminue lorsque le monde change sans cause visible, lorsque le système prétend comprendre ou quand une intention déduite ne peut pas être corrigée.

TABLEAU 14 · CADRE ANALYTIQUE DU CHAPITRE

EntréeUtilisation appropriéeNe jamais supposer
VoixExprimer l'intentionRétention permanente
RegardRéférence / attentionAchat / consentement
GesteContrôle spatialAutorisation à haut risque
LieuDéclencheur contextuelHistorique de mouvement public
PhysiologieAccessibilité nécessaireManipulation émotionnelle

15Les limites de l'expérience audiovisuelle personnalisée

THÈSE DU CHAPITRELa personnalisation peut améliorer l'accessibilité, la pertinence et la participation, mais elle peut également fragmenter des œuvres communes, cacher la persuasion et créer un traitement inégal. Le risque augmente lorsque l'adaptation passe de la présentation au contenu, puis à la relation à long terme, et enfin aux valeurs, au prix ou à l'influence politique.
IMPlications INDUSTRIELLESUn produit responsable distingue les préférences de présentation à faible risque des modifications à haut risque concernant le sens, la relation et le traitement commercial.
Valeur publiqueLa personnalisation doit élargir l'accès et la capacité d’action sans effacer les œuvres communes, les faits communs ou la responsabilité commune.

FIGURE 15 · Valeur et risque dans la personnalisation

15.1 Quatre objets de la personnalisation

La présentation inclut les sous-titres, le volume, la langue, le rythme et l'accessibilité. Le contenu modifie les scènes, les explications ou le niveau de difficulté. La relation adapte la mémoire des personnages et les interactions dans le temps. La personnalisation de la valeur modifie la persuasion, l'idéologie, le prix ou la pression émotionnelle appliquée à un utilisateur. Les valeurs par défaut peuvent être appropriées au niveau de la présentation, tandis que les couches plus profondes nécessitent une explication, un consentement et des contrôles accessibles.

15.2 Mémoire des personnages à long terme et minimisation des données

La mémoire des personnages à long terme peut rendre un monde significatif, mais le système ne doit stocker que ce qui sert un but déclaré. Les utilisateurs doivent pouvoir inspecter, corriger, supprimer et exporter les mémoires importantes. La mémoire de session, la mémoire croisée entre œuvres et le profilage commercial doivent être séparés. Un personnage de fiction ne doit pas conserver d'informations sensibles sur le monde réel simplement parce que cela rend le dialogue plus convaincant.

15.3 Prévention de la discrimination émotionnelle par le prix et de la persuasion cachée

Un système qui déduit l'urgence, la solitude ou la susceptibilité ne doit pas utiliser cette déduction pour augmenter le prix, intensifier la pression publicitaire ou rendre le retrait plus difficile. Les modèles de personnalisation ne doivent pas devenir des agents de négociation invisibles agissant contre l'utilisateur. L'adaptation à haut risque nécessite une politique, un journal, une révision indépendante et une voie non personnalisée.

TABLEAU 15 · CADRE ANALYTIQUE DU CHAPITRE

CoucheValeur par défaut raisonnableDivulgation / consentement
PrésentationSous-titres / volume / accessibilitéPréférence multi-équipements
ContenuRythme à faible risqueChangement de l'intrigue
RelationMémoire de sessionMémoire croisé à long terme
ValeursAucune par défautPosition / prix / persuasion

16Narratif et art à l'ère de l'IA

THÈSE DU CHAPITRELa qualité d’auteur dans la création native à l’IA peut résider dans les règles, la sélection, l'orchestration, la conception du monde et la responsabilité. Au lieu de ne rédiger qu'un scénario fixe, un créateur peut construire une constitution narrative : thèmes, valeurs, lois du monde, cœurs de personnages, événements variables, transformations interdites et conditions de fin. La complexité technique ne crée pas en elle-même de signification artistique.
IMPlications INDUSTRIELLESL'évaluation artistique devrait demander quelle problème l'œuvre rend perceptible, comment la génération change la forme, si la variation est significative et si le créateur accepte la responsabilité des conséquences du système.
JUGEMENT ARTISTIQUELa contribution de l'auteur peut être un espace de possibilité, mais cet espace exige toujours une intention, une forme et un choix responsable.

FIGURE 16 · De la constitution du récit à chaque expérience

16.1 Du scénario à la constitution du récit

Une constitution de récit conserve ce qui doit rester vrai tout en permettant à l'expérience de varier. Elle définit le thème, le canon, les engagements des personnages, les limites causales, les règles de contenu sensible et l'étendue des fins valides.

La génération se produit à l'intérieur de cet espace défini par l’auteur. La constitution ne remplace pas les scènes ou le dialogue ; elle fournit une structure d'ordre supérieur qui maintient des milliers de scènes possibles reconnaissables comme faisant partie de la même œuvre.

16.2 Nouvelles unités artistiques

L'unité de composition peut devenir une règle, une relation, une rencontre, un souvenir ou une transition conçue entre états du monde. Le rythme peut émerger à travers des sessions plutôt que des minutes. Une performance de personnage peut être évaluée par sa cohérence face à une entrée imprévue. Les critiques et les jurys ont donc besoin de méthodes qui prennent en compte l'expérience réalisée et le système de possibilité qui la sous-tend.

16.3 Conservation d'œuvres qui ne peuvent pas être rejouées exactement

La conservation doit capturer le modèle et la version publiés, l'ensemble des actifs, la constitution du récit, la politique, les états importants, les sessions représentatives et la documentation de l'environnement d'exécution. Un seul enregistrement montre une performance, mais pas l'espace de possibilité de l'œuvre. Les institutions de conservation auront besoin d'émulation, de rejouage contrôlé et d'archives d'événements aux côtés des masters conventionnels.

TABLE 16 · CADRE ANALYTIQUE DU CHAPITRE

DimensionQuestion critique
IdéeQuelle question irremplaçable l'œuvre pose-t-elle ?
FormeLa génération crée-t-elle une nouvelle grammaire ?
RèglesL'espace de variation est-il significatif ?
RelationL'action du public modifie-t-elle la compréhension ?
ResponsabilitéLe créateur comprend-il les conséquences du système ?
05

RESTRUCTURATION DE L'INDUSTRIE

La convergence du cinéma, des jeux vidéo, des médias en direct et des mondes sociaux

PARTIE PROPOSITION : Les actifs mondiaux partagés peuvent être rendus à travers plusieurs médias, rendant les opérations mondiales plus importantes que le format de fichier final.

17 La convergence cinéma–jeu vidéo comme production d’univers partagés · 18 Événements en direct, compétitions et cinéma en temps réel · 19 Une nouvelle chaîne de valeur et de nouveaux métiers · 20 Transformation du marché et des modèles économiques · 21 Le paysage mondial émergent du secteur

17Convergence Cinéma-Jeux Vidéo comme Production de Mondes Partagés

THÈSE DU CHAPITRELa prochaine étape de la convergence cinéma-jeux vidéo n'est pas un nombre plus élevé de promotions croisées ou d'adaptations. Il s'agit de la construction d'une couche de monde partagé à partir de laquelle le cinéma linéaire, les jeux interactifs, les médias génératifs en direct, les expériences spatiales et la création communautaire peuvent être rendus. Les personnages, les règles, l'état et la provenance deviennent une infrastructure commune.
IMPlications INDUSTRIELLESLes actifs de monde doivent être conçus pour être réutilisés sans aplatir la grammaire distincte de chaque medium ni permettre aux décisions d'un produit de corrompre le canon partagé.
CONCLUSION DE L'INDUSTRIELe mouvement stratégique consiste à passer de la création d'un même IP deux fois à la construction d'un monde gouverné qu' plusieurs médias peuvent lire.

FIGURE 17 · Un monde, plusieurs médias

17.1 De l'IP partagé à l'état partagé

Les adaptations traditionnelles partagent des noms, des images et des légendes tout en reconstruisant les actifs de production et la logique. Une approche de monde partagé définit l'identité, la géographie, la chronologie, les capacités, les relations et la provenance dans des couches lisibles par machine. Le cinéma peut interpréter un personnage de manière dramatique, un jeu peut exécuter des capacités, et les médias en direct peuvent réagir aux événements tout en restant connectés à un historique de versions commun. La réutilisation devient sémantique et opérationnelle, pas seulement visuelle.

17.2 Le studio du monde

Un studio du monde combine un département d'histoire et d'art avec une architecture de gestion de l’état, des systèmes d'actifs, une ingénierie de continuité, des opérations en direct et une gouvernance. Il distingue l’état canonique de l’état de session temporaire et les branches créées par la communauté. Le modèle opérationnel ressemble à la fois à un studio et à une organisation de services à long terme : il publie des œuvres, entretient le monde, résout les conflits et planifie la manière dont la valeur revient aux contributeurs.

17.3 Risques de convergence

Un monde partagé peut devenir créativement rigide si chaque medium doit obéir à une base de données centrale. Il peut également produire une surveillance, un travail exploitatif, un canon inaccessible ou une dépendance indéfinie envers une seule plateforme.

La gouvernance doit préserver l'interprétation spécifique au medium, des versions forkables, l'attribution des contributeurs et des limites claires sur ce qu'un opérateur commercial peut modifier rétroactivement.

TABLE 17 · CHARTE ANALYTIQUE

Couche partagéeFilmJeu / interactionGouvernance
Identité du personnagePerformance et arcCapacité et étatConsentement / version
Sémantique du mondeScène et thèmeCarte et règlesOrigine / droits
Ligne chronologiqueOrdre narratifQuête et embranchementCanon / fourche
ComportementChoix de performanceAction exécutableFrontière de sécurité

18Événements en direct, compétitions et cinéma en temps réel

THÈSE DU CHAPITRELe cinéma en temps réel par IA inclut des spectacles générés en direct, des mondes réactifs aux événements et des expériences de diffusion persistantes. Le défi central de la production n'est pas de générer sans interruption. Il s'agit de maintenir le contrôle, la compréhensibilité et la récupérabilité face à une entrée variable du public, aux conditions réseau, au comportement des modèles et aux événements de sécurité.
IMPlications INDUSTRIELLESLes opérations en direct nécessitent une dégradation réheurtée, des journaux d'événements et une récupération d'état de la même manière que la diffusion conventionnelle nécessite une redondance et un contrôle éditorial.
PRINCIPES DE FONCTIONNEMENTUn monde en temps réel est prêt pour la production lorsqu'il peut échouer en toute sécurité et revenir à un état explicite.

FIGURE 18 · Boucle d'opérations en temps réel génératives

18.1 Trois familles de produits en temps réel

La première famille est un programme généré programmé avec une participation contrôlée. La seconde est une couche d'événements qui réagit au sport, aux nouvelles, aux performances ou aux activités communautaires. La troisième est un monde persistant qui continue entre les grands événements. Chacun nécessite des politiques de latence, de modération et de continuité différentes. Un spectacle programmé peut utiliser des alternatives préapprouvées étendues ; un monde persistant doit gérer des conséquences durables et l'identité des participants.

18.2 Entrée de l'audience et latence de gouvernance

La revue de sécurité ne peut pas toujours intervenir après la génération, car une sortie nocive peut être expérimentée immédiatement. Le système doit classifier l'entrée, restreindre l'espace des actions, sélectionner des modèles approuvés et surveiller le résultat généré. La latence de gouvernance fait partie du budget global bout à bout. Lorsque la confiance est faible, le monde doit réduire l'autonomie, retarder la publication ou basculer vers une réponse connue comme sûre.

18.3 Métriques commerciales et opérationnelles

Les métriques clés incluent la latence bout à bout, le taux de basculement, l'interruption non expliquée, le temps de récupération d'état, la fréquence des incidents, le coût par minute de session, le taux de rétention des participants et l'intégrité de l'état du monde. La croissance peut masquer des pertes structurelles si chaque participant supplémentaire augmente le coût de génération plus rapidement que les revenus. Les produits en temps réel nécessitent une économie de niveau de service, pas seulement des métriques d'audience.

TABLE 18 · CADRE ANALYTIQUE DU CHAPITRE

MétriqueObjectifLigne rouge
Latence bout à boutInteraction naturelleViolation persistante
Taux de basculementStabilité du servicePas de basculement sûr
Interruption de sécuritéSurveillance des risquesInterruption non expliquée
Temps de récupération de l'étatGestion d'incidentPas de retour arrière
Coût par minuteÉconomie d'unitéLa perte augmente avec le succès

19Une nouvelle chaîne de valeur et de nouvelles professions

THÈSE DU CHAPITRELa chaîne de valeur du cinéma IA ajoute des couches pour les modèles, les données, le calcul, le monde et les systèmes de flux de travail, le contenu et la production, la distribution et les dispositifs, les transactions et le règlement, ainsi que les opérations continues et la sécurité. Un nouveau travail apparaît aux interfaces. Le professionnel rare n'est pas celui qui maîtrise le mieux un modèle, mais celui qui peut intégrer l'art, les systèmes, les actifs et la responsabilité.
IMPlications INDUSTRIELLESLa formation doit passer des démonstrations d'outils vers des capacités durables à travers les domaines : direction créative, conception de système, preuve, droits, évaluation et jugement opérationnel.
JUGEMENT DES TALENTSLa littératie des modèles est un avantage temporaire ; l'orchestration, la responsabilité et la construction du monde sont des compétences professionnelles durables.

FIGURE 19 · La nouvelle chaîne de valeur du cinéma IA

19.1 Six couches de la chaîne de valeur émergente

L'infrastructure de fondation fournit les modèles, les données et le calcul. Les systèmes de monde et de flux de travail organisent l'état et les outils. La production crée des œuvres et des actifs réutilisables. La distribution connecte les publics, les dispositifs et les contextes. Les systèmes de transaction gèrent les permissions et le flux de valeur. Les opérations maintiennent l'identité, la sécurité, la continuité et la communauté. Les organisations peuvent occuper plusieurs couches, mais les conflits d'intérêts et la responsabilité doivent rester visibles.

19.2 Nouvelles combinaisons professionnelles

Un producteur natif de l'IA combine la responsabilité créative, budgétaire et systémique. Un architecte de monde modélise les règles et l'état. Un ingénieur de continuité gère l'identité et la causalité à travers les générations. Un ingénieur de provenance conçoit les registres et les métadonnées. Un directeur de la sécurité générative définit le refus, la dégradation et la récupération.

Ces rôles ne sont pas des titres de poste fixes ; ils identifient les lacunes de compétences que les frontières conventionnelles des départements laissent souvent sans assignation.

19.3 Transition du travail et distribution équitable

L'automatisation peut éliminer les tâches répétitives tout en concentrant le pouvoir dans les modèles et les plateformes. Les programmes de transition doivent suivre les revenus, le pouvoir de négociation, la reconnaissance des contributions, la reconversion et l'accès aux outils, et non seulement le pourcentage de tâches automatisées. Les contributeurs ont besoin d'une attribution claire et d'une rémunération lorsque les actifs, les performances et les flux de travail continuent de créer de la valeur à travers les produits et les années.

TABLE 19 · CADRE ANALYTIQUE DU CHAPITRE

RôleResponsabilité principaleCapacité
Producteur natif IAFlux humain–IA et budgetCréatif + systèmes
Architecte du mondeRègles et étatNarratif + modélisation de données
Ingénieur de continuitéIdentité et causalitéQualité + versionnement
Ingénieur de provenancePreuves et champsNormes + droits
Directeur de la sécurité générativeRefus et récupérationContenu + risque

20Marché et transformation du modèle économique

THÈSE DU CHAPITRELe revenu peut s'étendre des billets, de la publicité et des licences vers les abonnements à des mondes, les abonnements à des personnages, les événements interactifs, les environnements d'entreprise, les services d'actifs et les demandes médiatisées par des agents. En même temps, la génération continue introduit des coûts d'exploitation de type cloud. Une entreprise viable doit aligner la valeur narrative, la rétention et la permission sur des unités économiques prévisibles.
IMPlications INDUSTRIELLESChaque expérience persistante doit connaître son coût par utilisateur actif, par minute de session et par minute générée acceptée, et doit séparer la croissance de l'engagement de la croissance d'une demande de calcul sans limite.
JUGEMENT FINANCIERLes médias continus transforment une partie d'un studio en opérateur de service. L'économie mondiale échoue lorsque les coûts d'exploitation augmentent plus rapidement que la valeur de la relation.

FIGURE 20 · Portfolio de revenus du monde persistant

20.1 Élargissement de l'unité de revenu

Un abonnement à un monde vend l'accès maintenu et l'état. Un abonnement à un personnage vend la continuité de la relation. Un événement interactif vend une expérience à durée limitée. La licence d'entreprise vend des environnements de marque ou de formation contrôlés. Les services d'actifs vendent l'identité, le flux de travail ou des composants de monde. Les demandes d'agents soutiennent la licence ou la génération initiée par machine. Chaque unité nécessite des consentements, des niveaux de service, une comptabilité et une logique de remboursement différents.

20.2 De la production à l'économie d'unité de service

La finance traditionnelle concentre les coûts avant la sortie. Les mondes persistants combinent les dépenses de production avec l'inférence, le stockage, la modération, la sécurité, le support client et la migration d'état. Le modèle financier doit classer l'investissement fixe dans le monde, le coût variable de session, le coût d'acquisition, la rétention, les réserves de passif et les obligations en fin de vie. Un produit n'est pas durable si la réussite augmente les pertes ou rend le retrait techniquement impossible.

20.3 Tarification et distribution de la valeur

Les prix doivent correspondre à une valeur lisible plutôt qu'à une vulnérabilité émotionnelle déduite. Les règles de partage des revenus doivent traiter la poursuite de l'utilisation des interprètes, des créateurs de personnages, des concepteurs de mondes, des contributeurs communautaires et des développeurs de flux de travail. Les contrats lisibles par machine peuvent améliorer le règlement, mais les exceptions et les litiges nécessitent encore un processus humain. Le système doit indiquer quel participant reçoit de la valeur lorsqu'un actif est réutilisé.

TABLE 20 · CHAPITRE CADRE ANALYTIQUE

ModèleUnité de valeurCondition requisePrincipal risque
Abonnement au mondeÉtat persistantMises à jour / conservationCoût d'exploitation élevé
Abonnement au personnageRelation à long termeConsentement / contrôle de la mémoireDépendance / manipulation
Événement interactifUne expérienceFiabilité en temps réelCapacité maximale
Licence d'entrepriseMarque / environnementContrôle et traçabilitéDérive identitaire
Demande d'agentTransaction machineChamps de droits / paiementResponsabilité de l'agence

21Le paysage industriel mondial émergent

THÈSE DU CHAPITRELe cinéma IA est susceptible de se développer à travers un réseau multipolaire plutôt qu'un centre mondial unique. L’Amérique du Nord possèdent une force dans les modèles de fondation, le cloud et la distribution ; la Chine et l'Asie de l'Est dans l'échelle d'application et les chaînes d'approvisionnement ; l'Europe dans les institutions culturelles et la fixation des règles ; le Japon et la Corée en matière de personnages, d'animation et de jeux vidéo ; et d'autres régions en matière de capitaux, de marchés de la jeunesse et de cultures créatives distinctives.
IMPlications INDUSTRIELLESUn hub durable relie la technologie, les actifs, les règles, les talents et les marchés grâce à des interfaces de confiance. Il n'a pas besoin de posséder chaque couche.
JUGEMENT DU PAYSAGELes nœuds leaders seront ceux qui rendront la collaboration transfrontalière plus digne de confiance, portable et économiquement lisible.

FIGURE 21 · Un réseau mondial de cinéma IA multipolaire

21.1 La compétition est façonnée par des endowments divers

La capacité du modèle n'est qu'un atout. L'accès aux talents de production, aux récits locaux, à l'expertise en jeu et en animation, à la gouvernance des données, au capital, à la distribution, aux marchés linguistiques et aux chaînes d'approvisionnement en appareils influence tous le domaine. Une région peut mener en matière d'actifs de monde ou de gouvernance même sans former le modèle le plus grand. Le marché récompensera les institutions qui traduisent entre ces ressources.

21.2 La position structurelle de Hong Kong

Hong Kong peut contribuer en tant que marché multilingue et transfrontalier, ainsi que comme connecteur de normes, avec une culture cinématographique profonde, des services financiers et des réseaux internationaux. Son opportunité n'est pas d'imiter un centre de modèles à très grande échelle. Il s'agit de rendre les actifs, les projets, les investissements, les festivals, les évaluations et la distribution interopérables entre juridictions, tout en préservant une distinction crédible entre l'infrastructure industrielle et les revendications promotionnelles.

21.3 Une langue minimale pour la collaboration internationale

Le travail transfrontalier nécessite des définitions partagées du type de travail, du rôle de l'IA, du comportement d'exécution, de l'identité des actifs, de l'étendue des permissions, du statut de provenance et de la responsabilité. Ces domaines doivent soutenir les différences légales locales plutôt que de prétendre les remplacer. Une langue commune minimale permet aux créateurs et aux institutions de comparer les projets sans imposer les catégories légales d'une juridiction sur tous les participants.

TABLE 21 · CADRE ANALYTIQUE DU CHAPITRE

RégionForceOpportunitéContrainte
Amérique du NordModèles / cloud / distributionPlateformes et outilsConcentration / droits
Chine et Asie de l'EstApplications / chaîne d'approvisionnementContenu à échelleInteropérabilité transfrontalière
EuropeRègles / cultureContenu de confianceCapital / échelle
Japon et CoréePersonnages / animation / jeuxActifs mondiauxMarché linguistique
Hong KongTransfrontalier / finance / languesConnexion marché et normesCalcul / échelle de production
06

ACTIFS DIGITAUX ET LE

Du déploiement du contenu aux réseaux collaboratifs d'actifs par machine

PARTIE PROPOSITION La valeur réside non seulement dans une œuvre achevée, mais aussi dans les flux de travail, les personnages, les états du monde, les règles comportementales et les enregistrements vérifiables.

22 Actifs audiovisuels IA : De l'œuvre achevée à une famille d'actifs · 23 Le cycle de vie des actifs audiovisuels IA · 24 Actifs lisibles par les agents et transactions médiatisées par machine · 25 Connecter la valeur humaine et IA : comptes de valeur à double domaine

22Actes audiovisuels IA : De l'œuvre achevée à une famille d'actifs

THÈSE DU CHAPITRELa famille d'actifs audiovisuels IA comprend six types distinct : œuvre, flux de travail, personnage, monde, comportement et enregistrement. Chacun nécessite une identité minimale, une historique des versions, une métrique de valeur et un modèle de permissions. Traiter les six comme un seul fichier de contenu crée une ambiguïté et rend la réutilisation légale, l'évaluation et la collaboration machine plus difficiles.
IMPlications INDUSTRIELLESL'indexation permet d'identifier et de connecter les actifs. Elle ne crée, ne transfère ni ne confirme les droits légaux, et ne cautionne pas la qualité ou la vérité d'un actif.
ÉNONCÉ DE FRONTIÈREUn index d'actif décrit l'infrastructure et les relations ; la propriété juridique reste un sujet pour les registres autorisés, les preuves et le droit applicable.

FIGURE 22 · La famille des actifs audiovisuels IA

22.1 Six classes d'actifs

Une œuvre est l'expérience audiovisuelle diffusée. Un flux de travail enregistre les outils, les nœuds et les décisions. Un personnage combine identité, modèle, performance et permission. Un monde contient sémantique, règles et état. Un comportement définit une capacité exécutable ou une interaction. Un enregistrement fournit la provenance, les événements et les preuves du cycle de vie. Un même projet peut contenir des centaines d'actifs liés, chacun avec des termes d'accès et commerciaux différents.

22.2 Trois conditions pour des actifs utilisables

Un actif doit être identifiable : les utilisateurs et les machines peuvent le distinguer et sa version. Il doit être interprétable :

les champs techniques, sémantiques et de gouvernance clés sont lisibles. Il doit être utilisable dans une enveloppe de permissions connue. Un actif visuellement impressionnant qui manque de provenance, de clarté des versions ou d'étendue des permissions peut être précieux comme inspiration mais inutilisable dans une collaboration professionnelle.

22.3 Évaluation de la valeur des actifs

La valeur peut dépendre de la performance du public, de la fiabilité, de la possibilité de modification, de la force des relations, de la réutilisation, de la complétude de la provenance et de la qualité de la licence. Une seule métrique ne peut comparer toutes les classes d'actifs. Un personnage peut créer une valeur durable par la stabilité de l'identité ; un flux de travail par le taux d'acceptation ; un monde par l'extensibilité ; et un enregistrement par sa capacité à réduire les coûts de transaction et de litige.

TABLE 22 · CADRE ANALYTIQUE DU CHAPITRE

ActifIdentité minimaleMétrique de valeurFocus sur la permission
ŒuvreVersion / sortiePublic / revenusExposer / adapter
Flux de travailNœuds / configurationAcceptation / efficacitéExécuter / redistribuer
PersonnageIdentité / modèleStabilité / relationImage / voix / comportement
MondeRègles / étatExtension / réutilisationEntrer / construire / exploiter
ComportementCapacité / interfaceContrôle / sécuritéAppeler / déléguer
EnregistrerProvenance / événementIntégralité / intégritéInspecter / conserver

23Le cycle de vie des actifs audiovisuels d'IA

THÈSE DU CHAPITREUn cycle de vie d'actif de confiance comprend la création, la déclaration, l'identification, la vérification, l'évaluation, la découverte, l'autorisation, l'utilisation, le règlement, la modification, l'archivage et la mise au rebut. La confiance ne signifie pas que les erreurs n'arrivent jamais. Elle signifie que les modifications, les litiges, les retraits et les corrections peuvent être observés et gérés sans détruire le registre historique.
IMPlications INDUSTRIELLESLa conception du cycle de vie doit séparer les métadonnées publiques, les informations opérationnelles restreintes et les preuves privées, et doit préserver l'historique des événements lorsqu'un actif change de statut.
PRINCIPES INSTITUTIONNELSUn registre crédible enregistre la correction et le retrait comme des états de premier plan plutôt que d'effacer l'histoire inconfortable.

FIGURE 23 · Le cycle de vie de l'actif

23.1 De la création au retrait

La création produit un actif et des preuves initiales. La déclaration identifie le soumettant responsable.

L'identification attribue une ID persistante et des relations parentales. La vérification vérifie les déclarations ou les signatures.

L'évaluation ajoute des observations indépendantes. La découverte expose les métadonnées autorisées. La permission permet l'utilisation ; l'opération crée des événements ; le règlement enregistre le flux de valeur. Le changement, l'archivage et la retraite préservent l'histoire et déterminent ce qui reste accessible.

23.2 Le registre vérifiable minimum

Le registre doit inclure l'ID d'actif, le type, la version, l'actif parent, le contact responsable, un récapitulatif de la provenance, la déclaration du modèle et de l'outil, un récapitulatif des droits, le statut de gouvernance, le format technique, une référence d'intégrité et l'état de contestation ou de retrait. Il n’est pas nécessaire de rendre tous les champs publics. La couche publique minimale doit permettre l'identification et le contact informé sans exposer de prompts confidentiels, des informations personnelles ou des journaux sensibles à la sécurité.

23.3 Retrait, contentieux et actifs orphelins

Un titulaire de droits peut retirer la permission ; un soumettant peut disparaître ; un actif peut être contesté ou techniquement obsolète. Le système doit disposer d'états de suspension, de statut contesté, de remplacement, d'accès restreint et de responsabilité orpheline. Les registres historiques ne doivent pas impliquer une permission actuelle. Les clients machines doivent pouvoir reconnaître qu'un actif a existé mais ne peut plus être utilisé.

TABLE 23 · CHAPITRE CADRE ANALYTIQUE

Groupe de champsExempleCouche publique
IdentitéID / type / version / parentPublic
Parties responsablesCréateur / soumettant / contactHiérarchisée
ProvenanceModèle / outil / déclaration d'actifRésumé
DroitsTerritoire / terme / usage / statutRésumé
GouvernanceLabel / litige / retraitPublic
TechniqueFormat / interface / hashSur demande

24Actifs lisibles par les agents et transactions médiatisées par machine

THÈSE DU CHAPITRELes agents peuvent rechercher des actifs, comparer les conditions, demander une autorisation et initier un paiement. Pour que ce marché soit sûr, une interprétation probabiliste de l'intention de l'utilisateur doit rester distincte de l'autorité transactionnelle déterministe. Les droits à haute valeur, irréversibles ou liés à la personnalité nécessitent une approbation explicite par un représentant identifiable.
IMPlications INDUSTRIELLESL'autorisation lisible par machine devrait accélérer les transactions ordinaires sans transformer l'ambiguïté en consentement automatique ni faire disparaître la responsabilité dans une chaîne d'agents. ÉTAGE DE TRANSACTION Les agents peuvent recommander et négocier ; les droits sensibles et le règlement nécessitent des contrôles déterministes et une autorisation dont la responsabilité est établie.

FIGURE 24 · Couches des transactions d'actifs médiatisées par agent

24.1 L'enveloppe de droits lisible par machine

Un actif peut exprimer les usages autorisés, les usages exclus, le territoire, la durée, l'étendue de l'identité, la logique de prix, l'attribution, les contraintes techniques et si une approbation humaine est requise. Ces champs soutiennent la découverte et la négociation préliminaire. Ils ne suppriment pas les exceptions, les droits moraux, les accords collectifs ou les règles de compétence. L'enveloppe doit préciser quand l'interprétation par machine doit cesser et quand une décision humaine doit commencer.

24.2 Séparer l'intention probabiliste du règlement déterministe

Un modèle de langage peut déduire qu'un utilisateur souhaite une licence, mais la déduction n'est pas une autorité. Une couche de transaction doit présenter l'actif exact, les droits, le prix, la contrepartie et les conditions de révocation, obtenir une autorisation approuvée et générer un enregistrement durable. Les protocoles émergents de paiement par agent sont des signaux d'infrastructure importants, tandis que la responsabilité et la protection des consommateurs restent des questions de conception ouvertes [R21–R22].

24.3 D'un marché de recherche à un marché de demande

Les utilisateurs humains naviguent dans les catalogues ; les agents peuvent exprimer des exigences structurées et demander au marché d'assembler une solution conforme. Cela peut réduire les coûts de transaction pour la localisation, le remplacement d'actifs, la musique, les voix et les composants de monde. Cela peut également intensifier la concentration si une seule plateforme contrôle la découverte, l'identité et le paiement. Les formats de demande ouverts et les enregistrements exportables sont donc une infrastructure stratégique.

TABLE 24 · CHADRE CADRE ANALYTIQUE

ChampValeur lisible par machineGestion humaine
UtiliserVisualiser / générer / adapterUtilisation non listée
Territoire / termeCode / dateConflit / exception
IdentitéPersonnage / périmètre de l'interprètePersonne sensible
PrixNégociation haute valeur / niveau / devisNégociation haute valeur
ApprobationAutomatique / humainPersonnalité / irréversible

25Lier l'humain et la valeur de l'IA : Comptes de valeur à double domaine

THÈSE DU CHAPITREL'économie future des mondes de l'IA peut être vaste, mais le volume des transactions, la valorisation des actifs et la valeur ajoutée économique ne sont pas interchangeables. Traiter chaque action d'agent interne ou chaque transfert virtuel comme une contribution supplémentaire au PIB produirait une comptabilisation double sévère. La mesure doit identifier les entrées humaines, l'exécution de l'IA, l'utilisation virtuelle, le retour dans le monde réel et la consommation intermédiaire.
IMPlications INDUSTRIELLESLes comptes proposés sont des outils analytiques pour les entreprises, les investisseurs et les chercheurs. Ils ne constituent pas un second PIB officiel et doivent demeurer compatibles avec la logique de la comptabilité nationale [R22–R23]. PRINCIPES DE MESURE Plus l'économie virtuelle grandit, plus ses comptes doivent être disciplinés.

FIGURE 25 · Flux de valeur humain–IA à double domaine

25.1 Pourquoi le « PIB des mondes de l'IA » n'est pas une somme additive directe

Un agent peut appeler plusieurs modèles, acheter des services internes et transférer un actif virtuel avant qu'un utilisateur final ne paie pour une expérience. Compter chaque étape comme une nouvelle valeur comptabiliserait l'activité intermédiaire plusieurs fois. Les prix des actifs peuvent également augmenter sans production correspondante. La mesure doit distinguer les transactions brutes, les revenus, les produits, la formation du capital, l'utilisation finale et la valeur ajoutée, et doit identifier le principal économique derrière l'activité automatisée.

25.2 Comptes de valeur humain–IA à double domaine

Le domaine humain enregistre le travail créatif, la préparation des données, le capital, l'énergie, les droits et les services institutionnels. Le domaine d'exécution de l'IA enregistre l'inférence et les services d'agent attribués à un principal commanditaire. Le domaine du monde virtuel enregistre l'utilisation finale, les actifs maintenus et la circulation interne. Le domaine du retour réel enregistre les revenus observables, les salaires, les licences et les taxes. La réconciliation élimine les transferts intermédiaires et montre comment la valeur et le risque se déplacent entre les domaines.

25.3 Compte satellite audiovisuel natif de l'IA

Un compte satellite peut estimer la production industrielle, les rémunérations, les intrants intermédiaires, la formation des actifs, les importations, les exportations et l'utilisation d'énergie, tout en conservant les comptes nationaux principaux. Les entreprises pourraient commencer par un échantillon volontaire : classer les dépenses de projet, les opérations cloud, les actifs de mondes réutilisables, les rémunérations humaines et le revenu final. L'objectif est une base de données comparable, et non un chiffre d'affiche détaché des limites comptables.

TABLE 25 · CHADRE ANALYTIQUE

CompteEnregistrementsComment éviter la double comptation
Entrée humaineCréation / données / capital / énergieMarquer l'entrée intermédiaire
Exécution IAInférence / service d'agentAttribuer au principal
Monde virtuelUtilisation finale / service d'actifCirculation interne distincte
Retour réelRevenu / salaire / licence / taxeCompter le flux observable
Compte satelliteValeur ajoutée / formation d'actifsAlignement sur le SNA
07

DROITS, GOUVERNANCE ET

Transparence, responsabilité et agency humaine

PARTIE PROPOSITION La confiance exige une chaîne traçable reliant la provenance, la permission, le consentement, l'historique des versions et la mise à disposition responsable.

26 Contrôle créatif, droits d'auteur et répliques numériques · 27 Provenance, étiquetage du contenu et chaîne de responsabilité · 28 Diversité culturelle, capacité d’action humaine et durabilité

26Contrôle créatif, droits d'auteur et répliques numériques

THÈSE DU CHAPITRELe cinéma par IA implique les droits d'auteur, les contrats, les droits de la personnalité, les protections des interprètes et les conditions des plateformes. Les questions pertinentes diffèrent selon l'entraînement, les entrées de projet, les sorties générées, la sélection et l'arrangement humains, et la mise sur le marché d'une réplique numérique autonome. La classification et la provenance peuvent fournir des faits, mais l'effet juridique dépend de la juridiction et des preuves.
IMPlications INDUSTRIELLESLa révision des droits doit être stratifiée afin qu'une revendication de sortie légale ne soit pas utilisée pour cacher une entrée illégale, une réplique non autorisée ou une restriction contractuelle. LIMITE JURIDIQUE Ce document fournit des cadres sectoriels, non des déterminations juridiques. Les droits et les recours restent des matières de droit applicable et des décideurs autorisés.

FIGURE 26 · Quatre couches de droits dans le cinéma par IA

26.1 Auteur : utilisation d'outils et contrôle créatif

Le Bureau du Copyright des États-Unis et d'autres autorités soulignent l'auteur humain et le contrôle lors de l'évaluation de la protégabilité [R15]. Dans le travail par IA native, les preuves peuvent inclure la constitution narrative du créateur, la sélection, l'arrangement, la révision et l'approbation finale. Demander simplement un résultat imprévisible n'est pas équivalent au contrôle de l'expression. Des juridictions différentes peuvent aboutir à des conclusions différentes, donc les dossiers de projet doivent soutenir une analyse factuelle sans supposer une réponse juridique universelle.

26.2 Séparation de l'entraînement, de l'entrée de projet et de la sortie

La permission de formation concerne le développement d'un modèle. La permission d'entrée de projet concerne les actifs fournis pour un travail spécifique. Les questions de sortie concernent la similarité, les éléments protégés, les termes contractuels et la contribution humaine. Ces couches doivent être examinées indépendamment [R16]. Une production ne peut pas remédier à une incertitude concernant la formation ou la réplique en plaçant simplement une étiquette sur le fichier final.

26.3 Répliques numériques et consentement continu

Le consentement pour un visage, une voix ou une performance doit spécifier le média, le contexte, le territoire, la durée, l'autonomie, la rémunération et le retrait. Un changement matériel — tel que permettre à une réplique de parler sans scénario, d'entrer dans une scène sensible ou de fonctionner après qu'un interprète ne soit plus disponible — doit déclencher un renouvellement du consentement. Le système doit également maintenir un moyen pratique d'interrompre l'utilisation nouvelle et préserver le registre des autorisations antérieures.

TABLE 26 · CHARTER ANALYTIQUE

PermissionContenu minimumDéclencheur de renouvellement de consentement
DonnéesOrigine / finalité / conservationNouvelle utilisation de formation
Visage et voixMédia / contexte / territoireScène sensible
AutonomiePeut dire / faire / interditPassif à agent
Termes et retraitArrêt / suppression / archivagePérennité du modèle
IndemnisationFixe / utilisation / partageNouveau modèle économique

27Provenance, étiquetage du contenu et chaîne de responsabilité

THÈSE DU CHAPITRELa confiance repose sur trois couches coordonnées : des enregistrements de provenance vérifiables, des étiquettes lisibles par machine et des divulgations perceptibles par l'humain. Ces couches remplissent des fonctions différentes. La provenance peut démontrer l'association et l'intégrité ; une étiquette peut soutenir la conscience machine et utilisateur ; ni l'une ni l'autre ne détermine automatiquement la vérité, la légalité ou la valeur artistique [R11].
IMPlications INDUSTRIELLESLa responsabilité doit être répartie entre le fournisseur de modèle, le créateur, le producteur, le distributeur et l'opérateur d'exécution selon le contrôle, plutôt que cachée derrière une déclaration générique indiquant que l'IA a été utilisée. PRINCIPES C2PA Une assertion de provenance peut être vérifiée comme associée et non altérée ; la spécification ne juge pas si le contenu est vrai, bon ou légal [R11].

FIGURE 27 · Trois couches de transparence

27.1 Une architecture de transparence à trois couches

La couche de provenance enregistre les actifs, les outils, les parties responsables et les références d'intégrité. La couche lisible par machine communique le statut de génération et de modification aux plateformes et aux agents. La couche perceptible informe les utilisateurs sous une forme adaptée au contexte. Les mesures d'étiquetage de la Chine et les travaux de transparence de l'UE indiquent tous deux une évolution vers une divulgation explicite et implicite coordonnées [R12–R14]. La mise en œuvre doit rester accessible sans submerger le public.

27.2 Une chaîne de responsabilité plutôt qu'un nuage de responsabilité

Un fournisseur de modèle contrôle les capacités, les garde-fous et la divulgation des versions. Un créateur contrôle les entrées et les choix créatifs. Un producteur contrôle le flux de travail, les droits et l'approbation. Un distributeur contrôle les étiquettes, le public et la politique de plateforme. Un opérateur d'exécution contrôle la politique en direct, la réponse aux incidents et le retour arrière. Plusieurs parties peuvent partager la responsabilité, mais chacune doit préserver les enregistrements correspondant à son contrôle.

27.3 La position institutionnelle d'Index.Film™

Index.Film™ permet l'identification, l'enregistrement, la recherche et la collaboration sur les actifs liés au travail, au flux de travail, au personnage, au monde, au comportement et à l'enregistrement. Il doit publier ses règles de métadonnées, son processus de correction, ses couches d'accès et ses états de litige. L'inclusion n'est pas une approbation ; l'indexation ne confirme pas la titularité des droits ; et un identifiant ne remplace pas l'enregistrement juridique ou l'arbitrage. Ces limites sont une source de crédibilité, non de faiblesse.

TABLE 27 · CHAPITRE CADRE ANALYTIQUE

PartieContrôle primaireEnregistrement minimum
Fournisseur de modèleCapacité / sécurité / versionCarte de modèle / modification
CréateurEntrées / sélection / révisionPreuve créative
ProducteurFlux de travail / droits / approbationPlanning de livraison
DistributeurÉtiquette / public / plateformeResponsabilité de la sortie
OpérateurPolitique en direct / incidentÉvénement et annulation

28Diversité culturelle, agency humaine et durabilité

THÈSE DU CHAPITRELe succès du cinéma IA ne peut pas être mesuré par le volume de contenu généré. Il doit être évalué à travers la diversité culturelle, la capacité des créateurs et leurs moyens de subsistance, la capacité d’action de l’utilisateur, ainsi que l'énergie et les coûts matériels de production et d'exploitation. Un modèle plus efficace peut encore entraîner une consommation totale plus grande si l'utilisation s'étend rapidement [R19–R20].
IMPlications INDUSTRIELLESLes indicateurs de durabilité doivent utiliser l'unité pertinente — telle que l'énergie par seconde finale acceptée ou par minute de session — tout en signalant également la demande totale et la répartition des bénéfices.
Valeur publiqueUne économie cinématographique IA productive devrait augmenter la diversité expressive et la capacité humaine sans rendre l'utilisation des ressources ou la dépendance à la plateforme invisible.

FIGURE 28 · Quatre dimensions de la valeur publique

28.1 Diversité culturelle et concentration des données

Les modèles à grande échelle peuvent reproduire les langues dominantes, les esthétiques et les hypothèses commerciales. La diversité nécessite plus que la traduction d'une interface. Les institutions doivent examiner à qui appartiennent les archives, traditions de performance et structures narratives représentées dans les données et les évaluations ; soutenir les créateurs locaux et les langues ; et permettre aux communautés de définir les utilisations sensibles. Le travail de l'UNESCO sur l'IA et la culture souligne la nécessité de relier l'innovation aux droits culturels et à la participation plurielle [R18].

28.2 Agence humaine et économie des créateurs

Les créateurs ont besoin d'un contrôle significatif sur les outils, la crédibilité, les revenus, la portabilité et le refus. Le public a besoin de la capacité de comprendre, de corriger et de quitter les systèmes adaptatifs. Une plateforme peut augmenter la participation nominale tout en réduisant le pouvoir de négociation ou en rendant les créateurs dépendants de services de classement et de génération opaques.

La capacité d’action humaine est donc une mesure économique et institutionnelle, et non seulement une aspiration éthique.

28.3 Énergie et génération durable

L'évaluation doit rapporter l'énergie par sortie acceptée, par session utilisateur et par monde actif, tandis que l'énergie totale et les effets du réseau régional restent visibles. L'efficacité du modèle, la mise en cache, le déploiement en périphérie du réseau, le calendrier des charges de travail, l'approvisionnement renouvelable et la génération sélective peuvent réduire la demande. L'industrie doit éviter l'hypothèse que l'abondance générée n'a pas de coût d'infrastructure physique [R19–R20].

TABLE 28 · CHAPITRE CADRE ANALYTIQUE

DimensionMétrique utileMétrique insuffisante
ÉnergiePar seconde acceptée / minute de sessionUne inférence
CultureRépartition par langue / région / créateurVolume total
TravailRevenu / transition / négociationRatio d'automatisation
AgenceContrôle / sortie / plainteTemps passé
08

PRÉVISIONS, SCÉNARIOS ET

La fenêtre de décision 2026–2035

PARTIE PROPOSITION – Une prévision n'est pas une promesse ; c'est un compte rendu public des hypothèses, des conditions d’adoption, de l'incertitude et des points de décision.

29 A 2026–2035 Roadmap de la Technologie et de l'Industrie · 30 Quatre Scénarios Futurs · 31 Guide d'Action pour les Parties Prenantes de l'Industrie · 32 Un Agenda d'Action Commun

29Une Roadmap 2026–2035 de la Technologie et de l'Industrie

THÈSE DU CHAPITRELa roadmap utilise des fenêtres d'observation plutôt que des dates promises. La période d'infrastructure privilégie la génération contrôlable, les preuves et l'intégration des flux de travail. La période d'expansion de la forme dépend de coûts réduits, de capacités multi-utilisateurs et spatiales en temps réel. La période du monde persistant exige une continuité entre appareils, une économie stable et une gouvernance transfrontalière.
IMPlications INDUSTRIELLESUne forme ne s'agrandit que lorsque cinq portes s'alignent : fiabilité technique, viabilité économique, accès aux appareils, légitimité de la gouvernance et acceptation culturelle. DISCIPLINE DE PRÉVISION – Les dates sont des fenêtres de révision, pas de certitudes. Les capacités qui manquent une porte doivent être reportées ou réduites plutôt que présentées comme inévitables.

FIGURE 29 – Trois Fenêtres d'Observation, 2026–2035

29.1 2026–2028 : la période d'infrastructure

La priorité est la génération contrôlable, les systèmes de gestion de l’état pour les œuvres longues, les flux de travail audio-vidéo natifs, la traçabilité, l'étiquetage et l'évaluation professionnelle. Les films AI-native deviennent de plus en plus courants, tandis que les produits en temps réel restent limités. Les organisations qui construisent des actifs portables, des registres de droits, un routage de modèles et des métriques de sortie acceptable créent des avantages qui survivent à une rotation rapide des modèles.

29.2 2029–2032 : la période d'expansion de la forme

Si la latence, le coût et les portes d'accès aux appareils s'améliorent, le cinéma interactif, les événements générés en direct, les mondes film-jeux partagés et les expériences spatiales peuvent passer des démonstrations à des produits répétables. De nouveaux revenus par abonnement et par événement peuvent émerger. Le changement de gouvernance critique passe des registres au niveau des fichiers à la responsabilité au niveau des événements et de la permission de contenu à la permission d'agent et de monde.

29.3 2033–2035 : la période du monde persistant

Si l'identité, l'état multi-utilisateur, la portabilité, l'économie et la gouvernance mûrissent ensemble, les mondes culturels persistants pourraient devenir un medium significatif. Ils ne remplaceront ni le cinéma ni les jeux vidéo. Ils fourniront une couche dans laquelle les œuvres, les personnages et les communautés continuent à travers les appareils et les formats. Les différends transfrontaliers, le traitement statistique et la conservation à long terme deviendront des institutions centrales.

TABLE 29 · CHAPITRE CADRE ANALYTIQUE

FenêtrePorte de capacitéPorte de marchéPorte de gouvernance
2026–2028Génération contrôlable / flux de travailAdoption professionnelleÉtiquettes / provenance
2029–2032Multi-utilisateur / spatial / coût réduitAbonnement / transmédiaAutorisation d'agent / enregistrement d'événement
2033–2035Monde persistant multi-appareilÉconomie mondiale stableResponsabilité transfrontalière / statistiques

30Quatre scénarios futurs

THÈSE DU CHAPITRELa planification des scénarios ne sélectionne pas le futur le plus attrayant. Elle teste si les décisions présentes survivent à différentes combinaisons de capacité du modèle, d'ouverture, de confiance, d'économie et de réglementation. Les quatre scénarios sont : croissance réglementée, enfermement au sein des plateformes, crise de confiance et mondes ouverts.
IMPlications INDUSTRIELLESLes stratégies sans regret incluent des actifs portables, une responsabilité visible, des enregistrements vérifiables, une opération multiplateforme, une économie d'unité durable et des talents humains capables de travailler à travers les systèmes. MÉTHODE DE STRATÉGIE Le meilleur plan n'est pas optimisé pour une seule prévision. Il préserve le choix face à plusieurs futurs plausibles.

FIGURE 30 · Quatre scénarios futurs

30.1 Croissance réglementée

La capacité et les revenus augmentent alors que les normes, l'étiquetage et la responsabilité mûrissent. La production professionnelle d'IA native s'étend, et les publics acceptent les expériences adaptatives car le contrôle est lisible. La stratégie gagnante est l'investissement dans des actifs de confiance, l'évaluation et une gouvernance interopérable plutôt que l'autonomie maximale.

30.2 Encadrement par plateforme

Un petit nombre de plateformes intégrées contrôlent les modèles, l'identité, la distribution, le paiement et l'état du monde.

Les outils créatifs sont puissants mais l'export est coûteux et les conditions peuvent changer. Les organisations ont besoin d'une architecture multiplateforme, de droits de sortie contractuels, d'enregistrements indépendants et d'actifs qui peuvent être migrés sans perdre l'identité ou l'historique des autorisations.

30.3 Crise de confiance

Des préjudices à haute visibilité, des litiges sur les droits, une tromperie par des contenus synthétiques ou des incidents de sécurité réduisent la confiance des publics et des institutions. La réglementation se resserre et les coûts d'assurance augmentent. La traçabilité, une responsabilité humaine explicite, une portée de produit contrôlée et une réponse aux incidents préparée par des exercices deviennent des conditions d'accès au marché plutôt que des mesures de conformité facultatives.

30.4 Mondes ouverts

Des normes ouvertes, des transactions d'agents et une identité portable permettent aux créateurs et aux communautés d'opérer à travers plusieurs mondes. L'innovation et la participation plurielle augmentent, mais ainsi que les abus inter-systèmes, la fraude et la complexité des litiges. L'opportunité dépend de fortes autorisations d'identité, d'une gouvernance contestable, d'une preuve interopérable et d'un règlement équitable.

TABLE 30 · CADRE ANALYTIQUE DU CHAPITRE

ScénarioSignal cléStratégie sans regret
Croissance gouvernéeNormes ouvertes / meilleure économieActifs de confiance
Encadrement de la plateformeCoût de changement élevé / concentrationExport et multi-plateforme
Crise de confianceIncidents / litiges / churnProvenance et responsabilité humaine
Mondes ouvertsInteropérabilité / échange d'agentsIdentité, autorisation et gestion des litiges

31Guide d'action pour les parties prenantes du secteur

THÈSE DU CHAPITRELes parties prenantes devraient commencer par des travaux qui préservent la valeur à travers les modèles et les scénarios. Un plan de 90 jours identifie les actifs, les droits, les coûts et les responsabilités. Un plan de 12 mois construit l'état, les preuves et les pipelines de gouvernance. Un plan de 36 mois développe l’exploitation des mondes, les produits transmédia, des revenus durables et des partenariats institutionnels.
IMPlications INDUSTRIELLESLa stratégie devrait prioriser la portabilité et la capacité opérationnelle comptable avant de s'engager vers une pile technique fermée ou une forme future non testée. PRINCIPES D'EXÉCUTION Construire les fondations qui restent valorisables lorsqu'un modèle, une plateforme ou une prévision change.

FIGURE 31 · Réseau d'action pour six groupes de parties prenantes

31.1 Créateurs et organisations de production

Cartographiez les éléments de l'histoire, des personnages, du monde, des flux de travail et des actifs de preuve. Définissez l'intention créative AI-native avant de sélectionner les outils. Établissez des systèmes d'état et de version, des métriques de sortie acceptable, une revue des droits et une approbation humaine finale. Lancez un projet borné qui peut être évalué honnêtement, plutôt que de distribuer l'expérimentation à chaque production sans apprentissage.

31.2 Fournisseurs de modèles, de technologies et de plateformes

Divulguez les capacités et les limitations importantes ; soutenez l'export, l'historique des versions et la traçabilité ; séparez les propositions probabilistes des transactions ; fournissez des outils de repli sûr et de gestion des incidents ; et publiez les modifications qui affectent les droits ou la sortie. Les plateformes doivent rendre l'exploitation responsable plus facile que des contournements opaques.

31.3 Distribution, investissement et assurance

Utilisez des calendriers de livraison AI qui identifient les actifs, les modèles, les autorisations, les étiquettes, les preuves et la responsabilité d'exécution. Évaluez l'économie de sortie acceptable et les passifs de monde persistant. Prix le risque selon le contrôle et les registres plutôt que de traiter toute implication AI comme identique. Exigez un plan de sortie et d'archivage pratique.

31.4 Politique, recherche et éducation

Développez une terminologie partagée, des ensembles de test représentatifs, une recherche au service de l'intérêt public et des essais statistiques.

L'éducation doit combiner cinéma, interaction, systèmes, données, droits et opérations. La certification doit reconnaître les capacités démontrées et la responsabilité professionnelle plutôt que la familiarité à court terme avec une interface unique.

TABLE 31 · CADRE ANALYTIQUE DU CHAPITRE

Partie prenantePremiers 90 joursDans les 12 mois
Créateurs / producteursInventaire des actifs et des droitsÉtat du monde et flux de preuve
Plateformes technologiquesRévéler les capacités et les limitesProvenance exportable / solution de repli
Distribution / financementCalendrier de livraison de l'IAÉconomie d'unité / benchmark des risques
Politique / rechercheConditions et échantillonsTests publics / pilote statistique
ÉducationCurriculum interdomaineCertification des rôles / transition

32Un programme d'action conjoint

THÈSE DU CHAPITRELes trois institutions éditoriales proposent un programme public continu : maintenir la classification à double axe, développer des benchmarks d'évaluation, faire évoluer Index.Film™, connecter les villes et les talents, tester un compte satellite audiovisuel et publier un examen annuel des preuves. La valeur du livre blanc réside dans la mesure dans laquelle ses affirmations et ses cadres peuvent être testés, corrigés et construits collectivement.
IMPlications INDUSTRIELLESChaque programme doit publier ses limites de gouvernance : la classification n'est pas un jugement juridique, l'évaluation ne remplace pas la critique, l'indexation n'est pas une approbation et un compte satellite n'est pas un PIB officiel. ENGAGEMENT COMMUN Un livre blanc devrait être un processus public redevable, et non une affirmation ponctuelle d'autorité.

FIGURE 32 · Programme public d'intérêt commun

32.1 Définitions et évaluation en tant qu'infrastructure publique

Le modèle P/R, les stades G0 à G5 et le langage des preuves E1 à E4 doivent être révisés à l'aide de cas et d'une revue par les pairs. Les repères doivent tester la continuité à long terme, le contrôle, la récupération en temps réel, la provenance et l'agence humaine, tout en laissant la qualité artistique ouverte à la critique, aux jurys et au public.

32.2 Index.Film™ et collaboration marchande

Le programme initial doit publier les champs minimum pour six types d'actifs, les niveaux d'accès, les processus de correction et de résolution de litiges, ainsi que les limites de permission lisibles par machine. Les pilotes marchands peuvent tester la manière dont les identifiants et les registres réduisent les coûts de transaction sans prétendre déterminer la propriété ou la valeur artistique.

32.3 Une ville mondiale et un réseau de talents

Les villes peuvent accueillir des productions conjointes, des tests, de l'éducation, des festivals, des résidences et l'accès au marché. La participation doit reposer sur des projets concrets et des avantages réciproques plutôt que sur une adhésion nominale. Le réseau doit rendre visibles les cultures créatives locales tout en améliorant l'interopérabilité transfrontalière.

32.4 Recherche et publication annuelle

Chaque édition annuelle doit mettre à jour les preuves techniques, les évolutions réglementaires, les données de marché et les signaux de scénarios. Elle doit signaler les erreurs et les jugements modifiés. Un processus de recherche permanent peut inviter les institutions, les créateurs, les interprètes, les ingénieurs et les groupes d'intérêt public à tester le cadre et à proposer des révisions.

TABLE 32 · CADRE ANALYTIQUE DU CHAPITRE

Programme publicSortie initialeFrontière de gouvernance
Classification à double axeSpécification annuelle / casNon une décision juridique
Référence d'évaluationTests de longue durée / en temps réelPas de jugement artistique
Index.Film™Champs minimum pour six actifsL'inclusion n'est pas une approbation
Réseau de villesProjets conjoints / flux de talentsPas d'alliance nominale
Compte satelliteÉchantillon pilote d'entreprisePas de PIB officiel
Bilan blanc annuelRevue de la prévision / révisionVersion publique de l'historique

Annexes Les annexes transforment les concepts du bilan blanc en termes pratiques, exigences de preuve, métadonnées, protocoles de révision et outils d'action.

Annexe A Glossaire des termes essentiels

Cinéma natif de l’IA
Une œuvre audiovisuelle dans laquelle l'IA joue un rôle substantiel dans les dimensions créatives fondamentales et qui ne peut pas être entièrement dissociée de son processus reposant sur l’IA.
Axe Capacité d’action créative (P0–P4)
Une classification du rôle substantiel de l'IA dans le récit, l'image, le son, le personnage et l'interaction.
Axe de génération de durée (R0 à R4)
Une classification indiquant la proportion du travail expérimental généré lors de l'utilisation.
Marqueur 51%+
Un seuil d'éligibilité pour un leadership créatif substantiel sur l'axe P ; ne s'agit pas d'un score qualitatif ou juridique.
Modèle du monde
Un système qui maintient et prédit l'état dépendant des actions, la mémoire et les relations causales.
Constitution du récit
Les thèmes, règles, engagements des personnages, limites de variation et gouvernance qui définissent un espace narratif génératif.
État du monde
Informations autoritaires concernant les entités, les lieux, les relations, les événements et les autorisations à un instant donné.
Famille d'actifs
L'ensemble connecté des actifs de travail, de flux, de personnage, de monde, de comportement et d'enregistrement.
Provenance
Informations concernant l'origine, la transformation, les parties responsables et l'intégrité associées à un actif.
Enveloppe de droits
Champs lisibles par machine décrivant l'utilisation autorisée et le moment où une approbation humaine est requise.
Comptes de valeur dual-domaine Humain–IA
Un cadre analytique séparant les entrées humaines, l'exécution par IA, l'utilisation virtuelle et les retours observables dans le monde réel.
Compte audiovisuel par satellite à base d'IA
Un cadre statistique pour les sorties et les actifs de l'industrie, conçu pour se connecter aux principes de la comptabilité nationale.

Annexe B : Classification P/R et Preuves créatives

La note P doit être évaluée sur le récit, l'image, le son, le personnage et l'interaction, en utilisant des pondérations déclarées avant la révision. Le marqueur 51%+ détermine uniquement la qualification P3. La note R est évaluée indépendamment selon la génération à l’exécution.

Groupe de preuvesDescription
Intention créativeConcept, thème, règles et versions approuvées
Chaîne d'outilsModèles, versions, nœuds et paramètres
Processus de générationPrompts, références, candidats et rejet
Contrôle humainSélection, arrangement, révision et approbation
DuréeEntrée, état, politique et niveau de génération

Annexe C Profil métadonnées minimum Index.Film™

Ce profil soutient l'identification, l'enregistrement, la recherche et la collaboration. Il ne confirme pas les droits et ne constitue pas une approbation de l’actif. Les couches publiques, restreintes et privées doivent rester séparées.

Groupe de champsExemple
IdentitéID / type / version / parent
Parties responsablesCréateur / soumettant / contact
ProvenanceModèle / outil / déclaration d'actif
DroitsTerritoire / terme / usage / statut
GouvernanceLabel / litige / retrait
TechniqueFormat / interface / hash

Annexe D Preuves, prévisions et révision annuelle

Protocole

  • Classe les revendications de niveau E1 à E4 et conserve une source primaire accessible ou une note de preuve.
  • Énonce les hypothèses techniques, économiques, matérielles, de gouvernance et culturelles pour les prévisions.
  • Signalez la confirmation, le retard, la dégradation, le retrait et l'erreur dans l'édition suivante.
  • Sépare les performances déclarées par les fournisseurs de la validation indépendante.
  • Conserve l'historique public des versions pour les classifications, les métadonnées et les cadres d'évaluation.

Annexe E Cadre d'action à 90 jours, 12 mois et 36 mois

HorizonCapacité organisationnelle
90 joursInventorier les actifs, outils, droits et coûts
12 moisDévelopper les systèmes d'état, de routage et de preuve
36 moisDévelopper les opérations mondiales et la capacité d'agent

Annexe F – Références et sources primaires

Les recherches primaires, les organismes normalisés, les régulateurs, les organisations internationales et les publications officielles des développeurs de modèles sont prioritaires. Les informations ont été vérifiées jusqu'au 16 juillet 2026.

[R01] OpenAI. Les modèles de génération vidéo comme simulateurs du monde. 2024.

[R02] Google DeepMind. Veo 3.1 – Aperçu du modèle et capacités. 2025.

[R03] Meta AI. Movie Gen: A Cast of Media Foundation Models. 2024.

[R04] Tencent Hunyuan. HunyuanVideo : Un cadre systématique pour les modèles génératifs vidéo à grande échelle. 2024.

[R05] Wan Team. Wan : Modèles génératifs vidéo à grande échelle ouverts et avancés. 2025.

[R06] Zhang et al.. L'IA générative pour la création de films : Une revue des avancées récentes. 2025.

[R07] Google DeepMind. Genie 3 – Modèle interactif du monde en temps réel. 2025/2026.

[R08] Liu et al.. Vers la modélisation interactive du monde vidéo : Frontières, défis, benchmarks et tendances futures. 2026.

[R09] Wang et al.. Matrix-Game 3.0 : Modèle interactif du monde en temps réel et en streaming avec mémoire à long terme. 2026.

[R10] Wu et al.. Infinite-World : Échelle des modèles interactifs du monde jusqu'à des horizons de 1000 images. 2026.

[R11] C2PA. Spécification technique des attributs de contenu 2.2 et explication. 2025/2026.

[R12] Cyberspace Administration of China et al.. Mesures pour l'étiquetage du contenu généré par IA et synthétique. 2025.

[R13] Commission européenne. Code de pratique sur la transparence du contenu généré par IA. 2026.

[R14] Union européenne. Règlement (UE) 2024/1689, article 50. 2024.

[R15] Bureau du Copyright des États-Unis. Copyright et intelligence artificielle, Partie 2 : Copyrightabilité. 2025.

[R16] OMPI. IA générative : Naviguer dans la propriété intellectuelle. 2024.

[R17] NIST. Cadre de gestion des risques de l'IA : Profil IA générative (NIST AI 600-1). 2024/2026.

[R18] UNESCO. Rapport du Groupe d'experts indépendants sur l'intelligence artificielle et la culture. 2025.

[R19] Agence internationale de l'énergie. Énergie et IA. 2025.

[R20] Agence internationale de l'énergie. La consommation électrique des centres de données a bondi en 2025. 2026.

[R21] Google. Protocole de paiement des agents (AP2). 2025.

[R22] Fonds monétaire international. Comment l'IA agentique va transformer les paiements. 2026.

[R23] Division des statistiques des Nations unies. Système national de comptes 2025. 2025.

[R24] Google. Démo des lunettes Android XR et aperçu de la plateforme. 2025.

[R25] Meta. Présentation d'Orion, prototype de lunettes de réalité augmentée. 2024/2025.

[R26] Apple Developer. Streaming fovéalisé pour visionOS. 2026.

[R27] Khronos Group. Extensions OpenXR et Spatial Entities. 2025.

Annexe G : Institutions de publication

Alliance internationale des normes d'indexation des audiovisuels d'IA (IAISA) : identité des actifs audiovisuels, métadonnées lisibles par machine, provenance et interfaces de collaboration du marché.

Association internationale des producteurs de films d'IA (IFAIFPA) : systèmes de production natively IA, voies technologiques, coordination professionnelle, évaluation et réseaux de producteurs.

Association du Festival International du Film de l'Intelligence Artificielle de Hong Kong (HKAIIFF) : art cinématographique AI-native, écosystèmes de créateurs, pratiques festivalières et collaboration en ville internationale.

Informations clés

Date de sortie
2026-07-17
Éditeurs
Association · IFAIFPA · IAISA
Structure
Cinq parties majeures + chapitre du Manifeste
Mode de lecture
Texte intégral en ligne
Théorie d'évaluation
Théorie du Conductor

FAQ

Quel est le contenu du livre blanc ?

L'ère du cinéma IA, la définition du cinéma AI-native, le critère de 51%+, la restructuration de la chaîne industrielle et les perspectives futures, ainsi que le Manifeste du Cinéma AI-Native.

Qui l'a publié ?

L'Association du Festival International du Film de l'Intelligence Artificielle de Hong Kong, l'IFAIFPA et l'IAISA, conjointement le 17 juillet 2026.

Puis-je le télécharger ?

Aucun téléchargement n'est fourni. Le texte intégral est disponible en ligne sur cette page. Les citations doivent mentionner la source.

Comment le critère de 51%+ est-il défini dans le livre blanc ?

Il ne s’agit pas de la proportion de pixels – il évalue si les flux de travail liés à l'IA jouent un rôle prépondérant pondéré dans les décisions créatives fondamentales.

Lié · Whitepaper officiel Index.Film (IAISA · Standard IXF V6) →