Le premier white paper systématique au monde sur l'industrie du cinéma par IA
Publication conjointe
Synthèse
Le cinéma généré par IA a dépassé la question initiale de savoir si les équipes de production utiliseront des outils génératifs. La question stratégique est désormais de savoir comment la vidéo générée, les modèles natifs audio-vidéo, les modèles de monde interactifs, les agents, l'informatique spatiale et l'infrastructure de traçabilité se combinent pour créer un nouveau média, un nouveau système industriel et un nouveau problème de gouvernance. Le résultat n'est pas simplement une version moins chère de la production cinématographique conventionnelle. Il s'agit d'une transition des fichiers audiovisuels fixes vers des systèmes culturels capables de générer, de répondre, de persister, de transacter et de demeurer redevables dans le temps.
Ce livre blanc définit le cinéma natif IA comme une œuvre audiovisuelle dans laquelle l'intelligence artificielle joue un rôle matériel et constitutif dans les dimensions créatives fondamentales — y compris le récit, l'image, le son, le personnage et l'interaction — et dans laquelle l'œuvre ne peut être entièrement séparée du processus activé par l'IA qui la rend possible. Pour maintenir la séparation entre le jugement artistique et la classification technique, le document introduit un modèle à double axe : Capacité d’action créative P0–P4 et Génération en Temps d'Exécution R0–R4. Le seuil de 51 %+ est un marqueur de qualification sur l'axe de la capacité d’action créative ; il ne s'agit pas d'un comptage de pixels, d'un comptage de modèles ou d'une note de qualité.
La frontière technique se déplace de la plausibilité visuelle en format court vers la cohérence à long terme. L'identité, la géographie, la causalité, la permanence des objets, le développement émotionnel et la continuité son-image doivent demeurer stables entre les scènes et les sessions. Les systèmes en temps réel ajoutent une exigence d'ingénierie : la pile doit interpréter l'intention, maintenir l'état du monde, allouer les modèles, générer dans un budget de latence, appliquer la politique de sécurité, enregistrer les événements et se dégrader de manière sécurisée lorsque les conditions échouent. Les systèmes publics ont démontré une interaction en temps réel significative, mais la stabilité sur de longues durées, l'action sans fin, la cohérence multi-utilisateur, le contrôle des coûts et la gouvernance restent des portes d'entrée vers la commercialisation [R07–R10].
Les lunettes IA et l'informatique spatiale étendent cette transition vers le monde physique. Une caméra, un microphone, un signal de regard, une position et une compréhension de l'environnement peuvent devenir des entrées narratives ; un personnage peut accompagner une personne à travers les lieux et le temps. Cela crée de nouvelles formes – événements sensibles à la localisation, récits partagés dans l'espace public, compagnons persistants et superpositions privées – mais soulève également des devoirs plus stricts concernant la vie privée des passants, l'attention, le consentement, la mémoire et l'interruption sécurisée [R24–R27].
Le marché se réorganisera autour de cinq nouvelles pénuries : découverte fiable, jugement artistique, personnages et mondes persistants, autorisation légale et relations communautaires durables. Les revenus peuvent s'étendre du box-office et de la licence vers les abonnements à des mondes, les services de personnages, les événements interactifs, les environnements d'entreprise, les services d'actifs et les demandes médiatisées par des agents. Cependant, la génération continue transforme également une partie de la société de contenu en opérateur de services cloud. La croissance durable repose donc sur l'économie d'unité par minute acceptable, par session et par monde actif – et non sur le coût de production d'un seul clip candidat.
La base d'actifs s'étend d'un film fini vers une famille d'actifs : œuvre, flux de travail, personnage, monde, comportement et enregistrement. Chaque type d'actif nécessite des identifiants distincts, une logique de version, des enveloppes de permission et des contrôles de cycle de vie. Index.Film™ se positionne comme infrastructure pour l'identification, l'enregistrement, la recherche et la collaboration. L'indexation ne crée pas, ne transfère ni ne confirme les droits légaux ; l'inclusion n'est pas une recommandation.
Les registres de provenance peuvent montrer que les déclarations sont associées à un actif et n'ont pas été modifiées, mais ils ne déterminent pas si le contenu lui-même est vrai ou précieux [R11].
Le texte rejette l'usage courant de l'expression « PIB monde IA » comme s'il s'agissait d'une économie nationale supplémentaire. Il propose des comptes de valeur dual-domaine humain-IA et un compte satellite audiovisuel IA-native à la place. Ces cadres distinguent les entrées humaines, l'exécution IA, l'utilisation dans les mondes virtuels, les retours observables de l'économie réelle et les transactions intermédiaires afin que l'analyse des investissements et des politiques puisse éviter le double comptage et rester compatible avec les principes de la comptabilité nationale [R22–R23].
La perspective 2026–2035 est structurée en trois fenêtres d'observation : une période d'infrastructure, une période d'expansion de forme et une période de monde persistant. Quatre scénarios — croissance gouvernée, enfermement dans les plateformes, crise de la confiance et mondes ouverts — sont utilisés pour tester la résilience stratégique. La recommandation centrale n'est pas de miser sur une seule date ou modèle. Il s'agit de construire des actifs portables, des preuves créatives, des pipelines de gouvernance, une capacité d'exploitation de mondes et des talents humain–IA qui restent précieux sous plusieurs futurs.
Quinze jugements centraux
Le coût de production est réécrit, non automatiquement conduit à zéro
La génération de candidats E1/E2 devient moins chère, tandis que le contrôle, la sélection, la révision, la permission et la gouvernance deviennent des parts plus importantes du coût d'un second fini acceptable.
Le natif à l'IA est une méthode créative, pas une étiquette d'outil
La classification par cadre dépend du rôle de l'IA dans les décisions créatives centrales et de la capacité de l'œuvre à exister indépendamment du processus activé par l'IA.
L'audio-vidéo natif et une reproductibilité précise constituent la prochaine frontière concurrentielle
E1/E2 Le marché évolue de la qualité d'image en une seule image vers la synchronisation, la continuité de l'identité, la révision dirigée, le contrôle multi-image et la plausibilité physique.
Les modèles de monde rendent les images animées exécutables
E2/E3 · Un modèle de monde doit maintenir un état dépendant de l'action, une mémoire et des relations causales, plutôt que de prédire simplement le prochain cadre visuellement plausible.
La génération en temps réel est expérientielle mais n'est pas encore une plateforme universellement mature
E2 · Les démonstrations publiques montrent 720p, 20–24 fps et une interaction à l'échelle de la minute ; la stabilité sur de longues durées, le contrôle large, le coût et la sécurité restent des barrières à l'adoption [R07–R10].
La rareté se déplace de la production vers la confiance et la découverte
E1/E2 L'évaluation, l'identité, la traçabilité, la permission légale, la communauté et la marque deviennent plus précieuses à mesure que l'offre de contenu s'expande.
La contribution du public devient agence
E2/E3 La voix, le regard, le geste, l'emplacement et l'action de groupe peuvent modifier l'état, mais l'interaction n'est significative que lorsque le système comprend, se souvient et répond aux conséquences.
Les lunettes IA transforment le monde physique en une interface narrative
E2/E3 La détection toujours disponible et l'affichage privé peuvent rendre lieux, personnes et événements des conditions de récit, à condition que les droits à la vie privée et à l'attention soient prioritaires.
La convergence film-jeu passe de la propriété intellectuelle partagée aux mondes partagés
E1/E2 Les personnages, les états du monde, les règles et la provenance peuvent être rendus à travers le film, les jeux, les médias en direct, les expériences spatiales et la création communautaire.
L'unité d'actif s'étend d'un film à une famille d'actifs
Framewo Les flux de travail, les workflows, les personnages, les mondes, les comportements et les systèmes d'interaction nécessitent des métadonnées différentes, une logique de version rk et des limites de permission.
L'indexation n'est pas le titre légal et la provenance n'est pas un verdict de vérité
E1/Gouver Index.Film™ soutient l'identification, l'enregistrement, la recherche et la collaboration ; il ne remplace pas l'enregistrement légal, la détermination judiciaire ni l'évaluation critique.
Les agents créent un marché de contenu du côté machine
E2/E3 Les agents peuvent rechercher, comparer, demander la permission et déclencher un paiement, mais l'intention probabiliste doit rester séparée de l'autorisation et du règlement déterministes [R21–R22].
L'économie de l'IA nécessite des comptes, pas un second PIB fictif
La mesure Framewo doit séparer l'entrée humaine, l'exécution IA, l'utilisation virtuelle et le retour dans le monde réel, et supprimer le comptage double intermédiaire rk.
La transparence devient une obligation systémique
E1 · Les règles d’étiquetage en Chine et les obligations de transparence de l’UE vont dans le sens d’une divulgation explicite, d’un marquage lisible par machine et de registres de responsabilité [R12–R14].
La gouvernance et les infrastructures façonneront 2035 autant que la capacité du modèle
**E3/E4** Les normes ouvertes, l'énergie, le calcul, la diversité culturelle et le partage des bénéfices détermineront si le secteur deviendra une économie créative plurielle ou un système de location fermé.
CHAPÈTRE SPÉCIAL · MANIFESTE
Manifeste du cinéma AI-Natif
- Le cinéma AI-natif n'est pas un substitut à bas coût du cinéma traditionnel ; il est une forme d’art émergente construite par la collaboration humain-machine et les systèmes génératifs.
- La valeur humaine ne disparaît pas lorsque les outils deviennent plus capables. Les créateurs demeurent responsables de l'intention, des règles, de la sélection, de la composition et des conséquences de la diffusion.
- Le marqueur 51%+ mesure une capacité d’action créative substantielle. Il ne s'agit pas d'un ratio de pixels, d'un nombre de modèles ou d'une note de qualité artistique.
- Le film linéaire, l'image en mouvement interactive, les médias live génératifs, le récit spatial et les mondes persistants peuvent coexister. Un nouveau média n'exige pas que le vieux média disparaisse.
- Les œuvres AI-natives doivent préserver des preuves créatives suffisantes pour soutenir l'identification, la révision et la responsabilité, tout en protégeant les informations confidentielles légitimes.
- La provenance n'est pas un verdict de vérité, l'indexation n'est pas un titre légal, et une étiquette technique n'est pas une recommandation. La confiance commence par un compte honnête des limites institutionnelles.
- Les créateurs, les interprètes et les titulaires de droits devraient disposer de termes clairs et exécutoires pour les répliques numériques, l'utilisation à des fins d'entraînement, la génération dérivée, le territoire, la durée, la rémunération et le retrait.
- Les modèles de monde et les lunettes IA peuvent faire entrer les images en mouvement dans l'espace physique, mais aucune nouvelle expérience ne devrait sacrifier la vie privée, la sécurité des enfants, l'autonomie de l'attention ou la diversité culturelle.
- Les œuvres, les flux de travail, les personnages, les mondes et les comportements devraient former des réseaux d'actifs vérifiables, recherchables et licenciables afin que la valeur puisse circuler équitablement entre créateurs, plateformes et communautés.
- Ce manifeste, son cadre de classification et ce livre blanc sont conçus pour une révision annuelle. Une définition pour une nouvelle ère doit demeurer ouverte aux preuves et à la correction.
CHANGEMENT DE PARADIGME
Pourquoi le cinéma devient un monde exécutable
PARTIE PROPOSITION Le fichier audiovisuel fixe fait place à un système de calcul culturel capable de générer, répondre, se souvenir et évoluer.
01 Le point d'inflexion technologique dans l'industrie du cinéma mondial · 02 Définir le cinéma natif à l'IA : le modèle à double axe et le marqueur de 51%+ · 03 L'évolution de G0 à G5 des médias audiovisuels générés par IA · 04 Méthodologie, grades de preuve et évolution des normes
01Le point d'inflexion technologique dans l'industrie du cinéma mondial
FIGURE 1 · De fichiers fixes à systèmes de calcul culturel
1.1 De l'offre générative à la concurrence des systèmes
Le premier récit de marché s'est concentré sur la baisse du coût de production d'une image plausible. Cette métrique est incomplète. Un projet professionnel paie pour l'intention, la cohérence, la sélection, la révision, le contrôle de la performance, le son, la vérification et l’obtention des droits, la documentation et la responsabilité de la diffusion. À mesure que le nombre de sorties candidates augmente, le coût de décider ce qui peut être accepté — et de prouver pourquoi — peut augmenter. La gestion doit donc suivre le coût total par seconde finale acceptée, le nombre de révisions requises, la couverture de contrôle et la proportion d'actifs qui restent portables lorsqu'un modèle est remplacé.
1.2 Cinq migrations structurelles
Le passage de la capacité de tournage rare à une production acceptable rare ; le passage de la gestion par départements fixes à une orchestration à travers les personnes, les modèles et les outils ; le passage de la rareté du contenu à une découverte fiable ; le passage d’un master final à une relation maintenue ; et le passage d'un titre achevé à une famille réutilisable de mondes, de personnages, de flux de travail et d'enregistrements. Chaque migration crée un avantage concurrentiel différent et un mode d'échec différent.
1.3 L'implication décisionnelle : construire une pile de capacités remplaçable
Aucun studio ne doit rendre sa mémoire créative dépendante de l'interface d'un seul fournisseur ou d'un seul modèle de génération.
Une pile résiliente sépare l'état de l'histoire et du monde, le stockage des actifs, le routage des modèles, l'évaluation, les droits, la traçabilité et la livraison. Les modèles peuvent ensuite être substitués en cas de changement de performance, de coût ou de politique. L'avantage durable réside dans la qualité des décisions créatives de l'organisation et de sa mémoire institutionnelle, et non dans l'accès temporaire à un seul leader de référence.
TABLEAU 1 · CADRE ANALYTIQUE DU CHAPITRE
| Déplacement structurel | Rareté ancienne | Rareté nouvelle | Métrique de gestion |
|---|---|---|---|
| Production | Capacité de tournage | Production acceptable | Coût par seconde acceptée |
| Organisation | Processus fixe | Orchestration des modèles | Révision / portabilité |
| Distribution | Fourniture de contenu | Découverte fiable | Portée qualifiée / confiance |
| Produit | Fichier terminé | Relation continue | Rétention / état du monde |
| Actifs | Un titre | Famille d'actifs | Réutilisation / exhaustivité des autorisations |
02Définir le cinéma natif à l'IA : le modèle à double axe et le marqueur 51%+
FIGURE 2 · La carte à double axe du cinéma AI-Native
2.1 L'axe P : cinq dimensions de la capacité d’action créative
P est évalué sur les dimensions narrative, image, son, personnage et interaction. Les réviseurs examinent si l'IA affecte la structure de l'œuvre, et non si un outil IA a touché un fichier. P0 désigne aucun rôle génératif ; P1, assistance locale ; P2, participation profonde à une étape centrale ; P3, leadership substantiel sur les dimensions créatives pondérées ; et P4, une œuvre dont l'identité artistique est elle-même un système génératif. Le seuil de 51%+ indique l'entrée en P3 lorsque les poids divulgués et les preuves montrent que l'IA dirige matériellement les dimensions pertinentes.
2.2 L'axe R : génération en temps réel
R0 est une reproduction entièrement pré-produite. R1 s'adapte avant la présentation ; R2 combine des composants pré-produits et générés ; R3 génère la majorité du contenu expérimenté en réponse à la session ; et R4 est continuellement généré, avec maintien d’un état et non exactement reproductible. Puisque la génération en temps réel augmente les risques opérationnels, R doit être évalué indépendamment de P. Un score R élevé nécessite des budgets de latence, des contrôles d'état, des politiques de sécurité, des journaux, des plans de repli et un opérateur clairement identifié.
2.3 Le principe et la responsabilité du chef d'orchestre
L'auteur humain dans un processus AI-Native ressemble souvent à la direction d'orchestre : définir l'intention, sélectionner les systèmes, construire les contraintes, décider ce qu'il faut rejeter, organiser les sorties et accepter la responsabilité. Cela ne rend pas chaque prompt une œuvre d’auteur. Cela signifie que le contrôle créatif doit être prouvé par des choix et leurs conséquences. Le document pertinent est une chaîne de décisions — pas une capture d'écran d'un prompt et pas une affirmation selon laquelle le modèle a agi seul.
TABLE 2 · CADRE ANALYTIQUE DU CHAPITRE
| Niveau | Axe P : Capacité d’action créative | Axe R : Génération en Temps Réel |
|---|---|---|
| 0 | Pas d'IA générative | Entièrement pré-produit |
| 1 | Assistance locale | Adaptation pré-session |
| 2 | Rôle central dans une pièce de théâtre | Pré-produit mixte / généré |
| 3 | 51 % ou plus de leadership substantiel | La plupart du contenu généré en direct |
| 4 | L'œuvre est un système génératif | Persistant et non entièrement reproductible |
03L'évolution G0–G5 des médias audiovisuels générés par IA
FIGURE 3 · L'évolution G0–G5 des médias audiovisuels générés par IA
3.1 Ce que signifient G0–G5
G0 correspond à la production audiovisuelle conventionnelle. G1 utilise l'IA comme outil d'assistance. G2 génère des composants substantiels. G3 est natif de l'IA selon le test de la capacité d’action créative. G4 introduit la génération en temps réel et réactive à l'audience. G5 décrit un monde persistant avec une identité durable, un état multi-utilisateur, des règles sociales et une économie. La classification se concentre sur l'ontologie de l'œuvre : savoir si la sortie est un fichier, une œuvre générée, une expérience interactive ou un monde opérationnel.
3.2 La position de 2026 : capacité visible, institutions incomplètes
D'ici 2026, des preuves solides existent pour les flux de travail de production G2 et G3, tandis que G4 a commencé l'exploration de produits publics via des modèles de mondes interactifs et une génération à faible latence [R07–R10]. G5 reste un horizon de scénario. Ses composants individuels — identité, économies virtuelles, agents, interfaces spatiales et état persistant — existent séparément, mais leur combinaison en un monde culturel ouvert, durable et gouvernable n'a pas atteint une maturité générale.
3.3 Portes de stage et conditions de sortie
Le passage de G2 à G3 nécessite une preuve de création intégrant l’humain et l’IA plutôt que de séquences générées isolées. Le passage de G3 à G4 nécessite une réponse en temps réel, une persistance d'état, une latence bornée, la sécurité et des mécanismes de repli. Le passage de G4 à G5 nécessite une cohérence multi-utilisateur, une identité, des règles économiques, un traitement des litiges et une gestion à long terme. Un produit doit être décrit au stade le plus élevé auquel il peut fonctionner de manière fiable, et non au stade le plus élevé imaginé dans sa feuille de route.
TABLEAU 3 · CADRE ANALYTIQUE DU CHAPITRE
| Transition | Capacité ajoutée | Preuve minimale |
|---|---|---|
| G2 → G3 | Création humaine-AI intégrée | Preuve créative / flux de travail cohérent |
| G3 → G4 | Réponse en temps réel | Latence / état / repli / sécurité |
| G4 → G5 | Monde multi-utilisateur persistant | Identité / cohérence / économie / gouvernance |
04Méthodologie, grades de preuve et évolution des normes
FIGURE 4 · Quatre niveaux de preuve et langages autorisés
4.1 Quatre niveaux et quatre langages autorisés
L'E1 soutient des langages tels que mis en œuvre, disponible ou requis – dans une juridiction ou une frontière de produit spécifiée. L'E2 soutient des démonstrées ou rapportées, pas universellement matures. L'E3 soutient une recherche indiquant une capacité possible, pas une promesse commerciale. L'E4 doit être écrit conditionnellement : si les hypothèses définies sont valables, une configuration future devient plausible. Les performances déclarées par les entreprises restent au niveau E2 sauf si elles ont une validation indépendante significative.
4.2 Balayage technologique et prévision
Le processus de recherche sépare la capacité, la fiabilité, l’accessibilité financière, la déployabilité et la légitimité. Une amélioration de référence est un signal de capacité ; ce n'est pas une preuve de fiabilité de production. Une démonstration publique est un signal de déployabilité ; ce n'est pas une preuve d'économie d'unité durable. Une réglementation est une contrainte de légitimité ; elle peut également créer une demande d'infrastructure. Les prévisions sont construites à partir de l'interaction de ces variables plutôt que d'une seule courbe de performance exponentielle.
4.3 Révision annuelle et falsification
Le livre blanc doit maintenir un registre de prévisions avec hypothèses, indicateurs avancés et preuves de déconfirmation. Si une prévision échoue, l'édition doit enregistrer pourquoi. Cette discipline transforme la publication en un programme de recherche publique cumulatif et empêche la crédibilité institutionnelle de dépendre d'un théâtre de certitude.
TABLEAU 4 · CADRE ANALYTIQUE DU CHAPITRE
| Niveau | Preuve | Langue autorisée | Éviter |
|---|---|---|---|
| E1 | Fait commercial / institutionnel | Mis en œuvre / disponible | Conditions à omettre |
| E2 | Démo publique / rapport technique | Démontré / rapporté | Universellement mature |
| E3 | Prototype de recherche | La recherche indique | Promesse commerciale |
| E4 | Inférence de scénario | Si les hypothèses sont valables | Une certaine langue |
FONDATIONS TECHNIQUES
Des modèles de fondation vidéo vers des modèles mondiaux
PARTIE PROPOSITION : La concurrence évolue de la qualité d'image unique vers le contrôle, la mémoire, la gestion d'état, la réponse en temps réel et la sécurité opérationnelle.
05 L'évolution technique des modèles de fondation vidéo · 06 Les goulots d'étranglement techniques réels de la génération de caractéristiques longues · 07 Modèles mondiaux : de la prédiction du prochain cadre à la simulation d'un monde · 08 Architecture de référence pour les systèmes audiovisuels IA en temps réel · 09 Agents IA et interprètes virtuels
05L'évolution technique des modèles de fondation vidéo
FIGURE 5 · La pile de capacités de modèle de fondation vidéo
5.1 De la synthèse de pixels aux modèles de fondation audiovisuels
Les systèmes à base de diffusion et de transformeurs ont amélioré le mouvement, la composition, l'adhérence aux prompts et la durée, tandis que les approches natives audio-vidéo déplacent le son de l'attachement en post-production vers une représentation temporelle partagée [R02–R06]. L'objectif technique n'est plus un plan unique cohérent. Il s'agit d'une représentation contrôlable de l'identité, de l'action, de la caméra, du son, du timing et du contexte physique qui peut être rééditée à plusieurs reprises sans faire s'effondrer des éléments non liés.
5.2 Le contrôle comme diviseur industriel
Les flux de travail professionnels nécessitent des modifications sélectives : modifier un geste sans changer le visage ; étendre une prise sans modifier le costume ; remplacer le dialogue tout en conservant le timing de la performance ; déplacer une caméra tout en maintenant la géographie stable. Le contrôle doit donc être mesuré comme une couverture des variables créatives et comme l'étendue de la zone d'impact non intentionnelle après révision. Un modèle qui nécessite une régénération complète pour chaque modification transfère les coûts de la prise de vue vers l'itération.
5.3 Audio-vidéo natif et une timeline commune
La génération conjointe peut améliorer la synchronisation labiale, le timing environnemental et le couplage du rythme, du discours et de l'action. Elle élargit également la surface des droits et de la sécurité. Un registre de production doit identifier quelles voix, musiques, effets et signaux de performance ont été générés, adaptés ou fournis, et comment ils ont été approuvés.
La génération temporelle partagée doit donc être accompagnée d'une provenance temporelle partagée.
TABLE 5 · CADRE ANALYTIQUE DU CHAPITRE
| Dimension | Question | Métrique d'exemple |
|---|---|---|
| Contrôle | Un élément peut-il changer seul ? | Couverture du contrôle |
| Cohérence | L'identité persiste-t-elle ? | Dérive identité / scène |
| Modifiabilité | La révision peut-elle rester locale ? | Rayon d'impact de la révision |
| Économie | Quel niveau de sortie est acceptable ? | Coût par seconde acceptée |
| Gouvernance | L'origine et les limites peuvent-ils être enregistrés ? | Complétude du champ |
06Les véritables goulots d'étranglement techniques de la génération de longs métrages
FIGURE 6 · La boucle d'état du monde des longs métrages
6.1 Un long métrage est une base de données d'état
Chaque scène dépend de faits établis précédemment : qui sait quoi, quel objet s'est déplacé, comment une relation a changé et quelles contraintes physiques restent en vigueur. Ces faits doivent être représentés explicitement plutôt que laissés dans une fenêtre de contexte opaque. Un système d'état de production lie le livret de l'histoire, l'état des personnages, la carte spatiale, les versions des actifs, les prises approuvées et les risques de continuité non résolus. La sortie générée est ensuite vérifiée contre l'état avant de devenir canonique.
6.2 Planification hiérarchique : monde, séquence, scène, prise et image
Le contrôle des formats longs nécessite plusieurs horizons de planification. Les règles du monde contraignent l'ensemble du projet ; les séquences portent le mouvement dramatique ; les scènes mettent à jour les relations et les informations ; les prises spécifient l'action, la caméra et le son ; les images rendent le résultat local. L'évaluation et la régénération doivent se produire au niveau le plus petit capable de corriger le problème sans déstabiliser l'intention de niveau supérieur. Cette hiérarchie permet également à différents modèles et spécialistes humains de travailler sur des couches séparées.
6.3 Métriques au-delà de la qualité visuelle
Au niveau du plan, les métriques incluent la complétion de l'action et la synchronisation audio-vidéo. Au niveau de la scène, l'identité, le costume, le décor et la continuité des éléments matériels sont essentiels. Au niveau de la séquence, la cohérence causale et spatiale domine. Au niveau de l'ensemble de l'œuvre, le développement émotionnel, le thème et le rythme doivent demeurer intelligibles. La métrique la plus utile est souvent le coût et le temps nécessaires pour restaurer l'œuvre après la détection d'une incohérence.
TABLEAU 6 · CADRE ANALYTIQUE DU CHAPITRE
| Échelle | Métrique | Exemple de défaillance |
|---|---|---|
| Plan | Action / synchronisation | Geste ou dérive des lèvres |
| Scène | Continuité personnage / élément matériel | Mutation du costume ou de l'objet |
| Séquence | Espace / causalité | Position ou événement contradictoires |
| Œuvre entière | Émotion / thème | Motivation brisée |
07Modèles du monde : De la prédiction du prochain cadre à la simulation d'un monde
FIGURE 7 · Boucle minimale de modèle du monde interactif
7.1 La boucle interactive minimale
La boucle utile la plus petite observe une entrée, interprète l'intention, sélectionne une action, met à jour l'état, génère une réponse et écrit l'événement résultant dans la mémoire. Si le système ne peut pas distinguer l'observation de l’état de référence faisant autorité, ou ne peut pas expliquer quelle action a produit un changement, il s'agit d'une interface générative plutôt que d'un modèle du monde opérationnel. Pour le cinéma, cette distinction détermine si une action du public a une signification narrative durable.
7.2 La limite de capacité 2026
Les systèmes publics ont démontré une interaction en temps réel en 720p et à 20–24 fps sur des sessions de l’ordre de quelques minutes, tandis que la recherche explore la génération en streaming et une mémoire plus longue [R07–R10]. Ce sont des signaux E2 et E3 significatifs. Ils n'établissent pas encore une stabilité multi-heures sans fin, une adhésion à l'action sans restriction, une accessibilité large des appareils, une synchronisation multi-utilisateur ou une gouvernance au niveau des événements. Les revendications de produits doivent préserver cette limite.
7.3 Collaboration avec l'infrastructure des moteurs de jeu
Une architecture à court terme pragmatique combine géométrie explicite, physique, navigation et règles déterministes avec un rendu génératif, un dialogue, une performance et une variation. Le moteur contrôle ce qui doit être reproductible ; le modèle fournit ce qui bénéficie de la probabilité et de la largeur expressive. La conception hybride rend également la sécurité et le débogage plus gérables, car l'état critique peut rester inspectable même lorsque la surface est générée.
TABLEAU 7 · CHAPITRE CADRE ANALYTIQUE
| Capacité | Statut 2026 | Porte d'échelle |
|---|---|---|
| Image en temps réel | Démonstration publique | Abordable sur tous les appareils |
| Mémoire longue | Minutes / recherche | Stable sur des heures |
| Action précise | Contrôles bornés | Adhésion à l'action ouverte |
| Mondes multi-utilisateurs | Exploration précoce | Cohérence et gouvernance |
| Provenance sûre | Schémas préliminaires | Norme au niveau de l'événement |
08Architecture de référence pour les systèmes audiovisuels en temps réel à l'IA
FIGURE 8 · Architecture à huit couches du cinéma en temps réel à l'IA
8.1 La pile à huit couches
La détection convertit la voix, le regard, les gestes, les entrées de contrôleur et les événements du monde en signaux bornés. L'interprétation de l'intention sépare une demande utilisateur d'une observation accessoire. La politique narrative contraint ce qui peut se produire ; l'état et la mémoire préservent ce qui s'est produit. Le routage des modèles affecte les modèles spécialisés ; la génération et le rendu produisent le résultat audiovisuel ; le contrôle des personnages et de la voix maintient les performances ; la livraison coordonne le dispositif, la périphérie et le cloud ; la traçabilité et la sécurité enregistrent l'événement et appliquent la politique de publication.
8.2 Budgets de latence et dégradation gracieuse
Toute opération n'appartient pas à la même échéance. La rétroaction perceptuelle peut nécessiter une latence très faible, tandis qu'une réponse narrative complexe peut utiliser une sortie en plusieurs étapes. Les systèmes devraient mettre en cache des actifs sûrs, prédire des actions probables, utiliser des modèles locaux plus légers, diffuser une qualité progressive et revenir à des matériaux pré-générés approuvés. Lorsque les vérifications de politique ou les appels de modèle échouent, l'expérience devrait devenir plus simple — non pas insécure, incohérente ou indisponible sans explication.
8.3 Traçabilité dynamique
La provenance au niveau du fichier est insuffisante pour une session générée en continu. L'enregistrement de l'événement doit identifier l'intention soumise, la politique active, le modèle et la version, les actifs référencés, le résultat généré, la décision de sécurité, l'opérateur et l'horodatage. La divulgation publique peut rester un résumé concis, tandis que les journaux sensibles restent accessibles uniquement avec contrôle. L'objectif n'est pas la surveillance du public ; il s'agit de la responsabilité pour le comportement systémique à conséquences.
TABLE 8 · CHAPITRE CADRE ANALYTIQUE
| Couche | Objectif | Approche principale |
|---|---|---|
| Détection | Latence très faible | Traitement local |
| Intention et politique | Hiérarchisée | Modèles légers / cache |
| Génération | Budget par image | Distillation / matériel spécialisé |
| Réseau et affichage | Jitter stable | Bord de ligne / flux à foveation |
| Sécurité | Jamais contourné | Pré-contrôle / dégradation / blocage |
09Agents IA et Performeurs Virtuels
FIGURE 9 · Six Composants d'un Personnage Opérationnel
9.1 Un agent est plus qu'une surface de personnage
Un agent prêt pour la production nécessite un modèle d'identité stable, un ensemble explicite d'objectifs, une mémoire délimitée, des capacités autorisées, une politique comportementale et une couche de performance. Ces composants doivent être versionnés séparément. Un nouveau modèle de voix ne doit pas modifier silencieusement l'éthique du personnage ; une mémoire élargie ne doit pas automatiquement élargir le consentement ; et un changement de capacité d'action doit déclencher une révision même si l'apparence reste inchangée.
9.2 Contrôle de la performance et doubles numériques
Le visage, la voix, le mouvement, la personnalité et le comportement autonome sont des domaines de permission distincts. Le consentement doit spécifier le média, le contexte, le public, le territoire, la durée, la rémunération, le retrait et les exclusions à haut risque. Transformer un portrait passif en agent autonome est un changement matériel, pas une utilisation courante.
Le système doit également distinguer un personnage de fiction appartenant à une production de l'identité protégée d'un interprète [R15–R16].
9.3 Production et opérations multi-agents
Les agents peuvent soutenir le débriefing, la revue de continuité, la recherche d'actifs, la localisation, la vérification des politiques et les opérations mondiales. Leur travail doit être organisé sous forme de propositions qui entrent dans un pipeline d'approbation déterministe.
Les décisions importantes—modifications canoniques de l'histoire, transactions à haute valeur, représentations sensibles et publication publique—nécessitent une autorité approuvante identifiable. La collaboration d'agents est utile uniquement lorsque la responsabilité ne se dissout pas au sein d'une chaîne d'actions automatisées.
TABLE 9 · CHARTE ANALYTIQUE
| Élément | Doit spécifier | Modification à risque élevé |
|---|---|---|
| Identité | Visage / voix / mouvement / personnage | Fusion de personnages |
| Utiliser | Médias / scène / public | Politique / adulte / médical |
| Capacité | Générer / converser / agir | Passif à autonome |
| Durée | Début / fin / retrait | Permanent / posthume |
| Indemnisation | Achat / utilisation / participation aux revenus | Réutilisation non divulguée |
LA RÉVOLUTION DE L'APPAREIL
De l'écran et du smartphone à la lunettes IA
PROPOSITION PART Lorsque l'affichage, la détection et la génération convergent, l'espace physique devient partie de l'interface narrative.
10 Quatre migrations de l'appareil audiovisuel · 11 De nouvelles formes cinématographiques rendues possibles par les lunettes IA · 12 Cinéma spatial et génération à distance
10Quatre migrations de l'appareil audiovisuel
FIGURE 10 · Quatre migrations de l'appareil audiovisuel
10.1 De sessions collectives à événements contextuels
L'unité théâtrale est la séance programmée ; l'unité télévisuelle est le programme ; l'unité smartphone est le flux, la vidéo courte ou le flux en direct. Les lunettes IA introduisent une unité possible basée sur le lieu, la relation et l'événement.
Une scène peut commencer parce qu'une personne entre dans un lieu, rencontre un autre participant ou demande à un personnage de révéler une couche du monde. Cela déplace la commande de minutes de contenu vers des règles indiquant quand et pourquoi une expérience apparaît.
10.2 Collaboration appareil-bord-nuage
Le traitement local est essentiel pour une détection sensible, un retour immédiat et la sécurité de base. L'infrastructure de bord peut réduire la latence et soutenir l'état régional, tandis que les systèmes cloud fournissent l'inférence de grands modèles et des services de monde persistants. Un produit bien conçu décide quelles informations ne doivent jamais quitter l'appareil, quels événements nécessitent un état partagé et quels résultats peuvent être générés à partir de signaux anonymisés ou minimisés.
10.3 Les véritables barrières à l'adoption
Le poids, la chaleur, l'autonomie de la batterie, le champ de vision, la lisibilité de l'affichage, le support des lunettes de prescripteurs, le prix et le style sont tous déterminants. De même, le statut d'enregistrement visible, les attentes des témoins, la politesse sociale et la capacité de l'utilisateur à silencer le système comptent.
Les prototypes publics et les travaux sur les plateformes démontrent une dynamique [R24–R27], mais le marché ne se développera que lorsque les personnes ordinaires pourront porter le dispositif sans friction technique, sociale ou psychologique.
TABLE 10 · CADRE ANALYTIQUE DU CHAPITRE
| Dispositif | Capacité centrale | Unité de contenu | Limite principale |
|---|---|---|---|
| Cinéma | Attention partagée | Session programmée | Temps et lieu |
| Télévision | Immersion domestique | Programme / série | Interaction faible |
| Téléphone intelligent | Fréquence personnelle | Court / en direct | Écran réduit / fragmentation |
| Lunettes IA | Contexte et présence | Lieu / événement relationnel | Confidentialité / batterie / acceptation |
11Nouvelles formes cinématographiques rendues possibles par les lunettes IA
FIGURE 11 · La boucle de contenu contextuel pour les lunettes IA
11.1 Récit de lieu et personnages environnementaux
Une rue, un musée, un quartier théâtral ou un trajet en transport peut devenir un espace actif de narration. Les personnages peuvent comprendre un contexte large, se référer à des événements mondiaux persistants et révéler un contenu qui dépend du lieu ou du temps. Les expériences les plus fortes ne couvriront pas la réalité avec des graphiques constants. Elles utiliseront une intervention ponctuelle, des ancres spatiales lisibles et des transitions claires entre l'environnement factuel et la couche fictionnelle.
11.2 Personnages compagnons et conception de l'attention
Un personnage compagnon peut soutenir la continuité entre les sessions, mais une conception de relation persistante peut également créer une dépendance ou manipuler la vulnérabilité. Les produits doivent avoir des limites d'intervention, des modes silencieux, des contrôles de mémoire, des paramètres par défaut adaptés à l'âge et une divulgation commerciale claire. L'engagement émotionnel ne doit pas être utilisé pour obtenir le consentement, augmenter les prix ou contourner les limites d'attention déclarées par l'utilisateur.
11.3 Une nouvelle grammaire du cadrage
Le plan n'est plus entièrement contrôlé par un réalisateur, car l'utilisateur peut regarder ailleurs et se déplacer dans l'espace. La composition se déplace donc vers des champs de pertinence, une orientation acoustique, des révélations temporelles, une mise en place spatiale et la priorité des événements. Les créateurs conçoivent ce qui peut être remarqué, comment l'attention est invitée et ce qui se passe si un indice est manqué. Le résultat est plus proche de la chorégraphie de la perception que de l'édition d'une séquence fixe.
TABLEAU 11 · CADRE ANALYTIQUE DU CHAPITRE
| Risques | Contrôle | Droits d'utilisateur |
|---|---|---|
| Détection par témoin | Statut visible / filtre local | Remarque et plainte |
| Captation de l'attention | Limites d'intervention | Silence / sortie |
| Malutilisation de la mémoire | Finalité et durée | Inspection / correction / suppression |
| Manipulation commerciale | Divulgation publicitaire / règles de tarification | Rejeter la personnalisation |
12Cinéma spatial et génération à distance
FIGURE 12 · Pipeline de contenu spatial hybride
12.1 Trois voies vers le contenu spatial
La pré-production 3D offre une qualité déterministe mais un coût d'actif élevé. La reconstruction et les représentations neuronales peuvent capturer les environnements réels rapidement, mais compliquent l'édition, l'identité et les droits. La génération de monde offre de la variation et de la réactivité, mais doit gérer la cohérence et la sécurité. Les produits professionnels combinent probablement les trois : des éléments principaux à rendu déterministe, des lieux réels reconstruits et une variation générée dans des limites gérées.
12.2 Génération à distance et streaming foveal
Le rendu peut être divisé entre l'appareil, la périphérie et le cloud selon la latence, la confidentialité et la qualité. Les techniques foveales allouent la qualité là où l'utilisateur regarde, réduisant ainsi la demande de transport et de rendu [R26]. Cependant, le regard est un signal sensible. Les systèmes devraient l'utiliser pour l'efficacité de la livraison sans le convertir silencieusement en profilage comportemental, en intention d'achat ou en inférence émotionnelle.
12.3 Interopérabilité et portabilité des actifs
OpenXR et les normes spatiales connexes fournissent des interfaces communes pour les appareils et les entités [R27], mais la portabilité narrative nécessite également des conventions sémantiques et comportementales. Une porte doit être reconnaissable comme un objet avec des règles, et non seulement comme un maillage. Un personnage a besoin d'identité et de métadonnées de droits, et non seulement d'animation.
L'interopérabilité doit donc couvrir l'état, les événements, les permissions et la provenance, ainsi que la géométrie.
TABLE 12 · CADRE ANALYTIQUE DU CHAPITRE
| Voie | Avantage | Limite | Meilleure utilisation |
|---|---|---|---|
| 3D préconstruit | Déterministe | Coût élevé des actifs | Actifs héroïques / marques |
| Reconstruction | Capture rapide dans le monde réel | Complexité de l'édition / des droits | Lieux réels |
| Génération de monde | Variation illimitée | Cohérence / sécurité | Fond / interaction |
| Hybride | Équilibre qualité-coût | Complexité du système | Produits professionnels |
CONTENU ET PUBLICS
La façon dont les spectateurs deviennent participants
PROPOSITION PARTIE : Le contenu évolue d'une prestation ponctuelle vers une relation continue, tandis que le public acquiert une agence significative au sein de l'œuvre.
13 Du droit à regarder au droit d'agir · 14 De nouveaux modèles d'interaction · 15 Les limites de l'expérience audiovisuelle personnalisée · 16 Narration et art à l'ère de l'IA
13Du droit à regarder au droit d'agir
FIGURE 13 · L'échelle des droits du public
13.1 Quatre niveaux de droits du public
Regarder inclut le démarrage, la pause, l'arrêt et l'accès à l'œuvre. Choisir signifie naviguer dans les branches déclarées. Agir signifie modifier l'état persistant par la parole, le mouvement ou toute autre entrée. La co-gouvernance permet aux participants de créer des actifs, de proposer des règles ou de partager la valeur. Les produits doivent indiquer le niveau qu'ils offrent et quelles décisions restent sous le contrôle éditorial ou opérationnel.
13.2 Visionnage par défaut et fatigue du choix
Le cinéma peut demeurer immersif car les spectateurs n'ont pas à gérer chaque instant. La conception AI-native doit préserver une expérience par défaut forte et inviter à l'action uniquement lorsqu'elle ajoute du sens. Le système peut déduire qu'une personne est désengagée, mais il ne doit pas convertir des signaux passifs en changements d'histoire irréversibles ou en décisions commerciales. Un utilisateur doit pouvoir revenir à une expérience cohérente après ne rien avoir fait.
13.3 Reconstruire l'expérience collective
Les expériences partagées nécessitent des règles pour les intentions conflictuelles. Un groupe peut voter, déléguer, agir à tour de rôle ou suivre des rôles. La conception doit révéler comment l'influence est allouée et protéger les minorités contre le harcèlement ou l'exclusion systémique. La capacité d’action collective n'est pas simplement un canal d'entrée plus grand ; c'est un petit système de gouvernance à l'intérieur de l'œuvre.
TABLE 13 · CADRE ANALYTIQUE DU CHAPITRE
| Droite | Capacité du public | Devoir du système |
|---|---|---|
| Regarder | Démarrer / Arrêter | Présentation claire |
| Choisir | Naviguer les branches | Expliquer la conséquence |
| Agir | Changer l'état du monde | Mémoire et rétroaction |
| Co-gouverner | Établir des règles / des actifs | Processus équitable / part de valeur |
14Nouveaux modèles d'interaction
FIGURE 14 · Interaction multimodale et autorisation
14.1 Une carte d'interaction multimodale
La voix est efficace pour l'intention explicite mais ne devrait pas être conservée par défaut. Le regard est utile pour la référence et la priorité de rendu, mais pas pour le consentement. Le geste soutient la manipulation spatiale, mais les gestes à haut risque nécessitent une confirmation. L'emplacement permet le contexte, mais ne devrait pas exposer les mouvements d'une personne. Les données physiologiques devraient être limitées aux fonctions d'accessibilité ou de sécurité nécessaires, sauf si un objectif séparé et révocable est clairement accepté.
14.2 Langage naturel et langage de contrainte
Les utilisateurs peuvent demander au monde de devenir plus silencieux, révéler une autre perspective ou permettre à un personnage d'expliquer un événement passé.
Le système devrait traduire un langage ouvert en un plan d'action limité régi par l'histoire, la sécurité et les droits.
Il devrait également expliquer quand une demande entre en conflit avec les règles de l'œuvre. Le langage naturel est une interface pratique ; il n'est pas un canal d'instruction illimité.
14.3 Retour d'information, latence et confiance
Un système interactif devrait reconnaître rapidement l'entrée, distinguer le traitement de la fin et indiquer quand une action n'est pas disponible. Si la latence est élevée, il peut fournir une réponse préliminaire sûre plutôt que d'ignorer silencieusement l'utilisateur. La confiance diminue lorsque le monde change sans cause visible, lorsque le système prétend comprendre ou quand une intention déduite ne peut pas être corrigée.
TABLEAU 14 · CADRE ANALYTIQUE DU CHAPITRE
| Entrée | Utilisation appropriée | Ne jamais supposer |
|---|---|---|
| Voix | Exprimer l'intention | Rétention permanente |
| Regard | Référence / attention | Achat / consentement |
| Geste | Contrôle spatial | Autorisation à haut risque |
| Lieu | Déclencheur contextuel | Historique de mouvement public |
| Physiologie | Accessibilité nécessaire | Manipulation émotionnelle |
15Les limites de l'expérience audiovisuelle personnalisée
FIGURE 15 · Valeur et risque dans la personnalisation
15.1 Quatre objets de la personnalisation
La présentation inclut les sous-titres, le volume, la langue, le rythme et l'accessibilité. Le contenu modifie les scènes, les explications ou le niveau de difficulté. La relation adapte la mémoire des personnages et les interactions dans le temps. La personnalisation de la valeur modifie la persuasion, l'idéologie, le prix ou la pression émotionnelle appliquée à un utilisateur. Les valeurs par défaut peuvent être appropriées au niveau de la présentation, tandis que les couches plus profondes nécessitent une explication, un consentement et des contrôles accessibles.
15.2 Mémoire des personnages à long terme et minimisation des données
La mémoire des personnages à long terme peut rendre un monde significatif, mais le système ne doit stocker que ce qui sert un but déclaré. Les utilisateurs doivent pouvoir inspecter, corriger, supprimer et exporter les mémoires importantes. La mémoire de session, la mémoire croisée entre œuvres et le profilage commercial doivent être séparés. Un personnage de fiction ne doit pas conserver d'informations sensibles sur le monde réel simplement parce que cela rend le dialogue plus convaincant.
15.3 Prévention de la discrimination émotionnelle par le prix et de la persuasion cachée
Un système qui déduit l'urgence, la solitude ou la susceptibilité ne doit pas utiliser cette déduction pour augmenter le prix, intensifier la pression publicitaire ou rendre le retrait plus difficile. Les modèles de personnalisation ne doivent pas devenir des agents de négociation invisibles agissant contre l'utilisateur. L'adaptation à haut risque nécessite une politique, un journal, une révision indépendante et une voie non personnalisée.
TABLEAU 15 · CADRE ANALYTIQUE DU CHAPITRE
| Couche | Valeur par défaut raisonnable | Divulgation / consentement |
|---|---|---|
| Présentation | Sous-titres / volume / accessibilité | Préférence multi-équipements |
| Contenu | Rythme à faible risque | Changement de l'intrigue |
| Relation | Mémoire de session | Mémoire croisé à long terme |
| Valeurs | Aucune par défaut | Position / prix / persuasion |
16Narratif et art à l'ère de l'IA
FIGURE 16 · De la constitution du récit à chaque expérience
16.1 Du scénario à la constitution du récit
Une constitution de récit conserve ce qui doit rester vrai tout en permettant à l'expérience de varier. Elle définit le thème, le canon, les engagements des personnages, les limites causales, les règles de contenu sensible et l'étendue des fins valides.
La génération se produit à l'intérieur de cet espace défini par l’auteur. La constitution ne remplace pas les scènes ou le dialogue ; elle fournit une structure d'ordre supérieur qui maintient des milliers de scènes possibles reconnaissables comme faisant partie de la même œuvre.
16.2 Nouvelles unités artistiques
L'unité de composition peut devenir une règle, une relation, une rencontre, un souvenir ou une transition conçue entre états du monde. Le rythme peut émerger à travers des sessions plutôt que des minutes. Une performance de personnage peut être évaluée par sa cohérence face à une entrée imprévue. Les critiques et les jurys ont donc besoin de méthodes qui prennent en compte l'expérience réalisée et le système de possibilité qui la sous-tend.
16.3 Conservation d'œuvres qui ne peuvent pas être rejouées exactement
La conservation doit capturer le modèle et la version publiés, l'ensemble des actifs, la constitution du récit, la politique, les états importants, les sessions représentatives et la documentation de l'environnement d'exécution. Un seul enregistrement montre une performance, mais pas l'espace de possibilité de l'œuvre. Les institutions de conservation auront besoin d'émulation, de rejouage contrôlé et d'archives d'événements aux côtés des masters conventionnels.
TABLE 16 · CADRE ANALYTIQUE DU CHAPITRE
| Dimension | Question critique |
|---|---|
| Idée | Quelle question irremplaçable l'œuvre pose-t-elle ? |
| Forme | La génération crée-t-elle une nouvelle grammaire ? |
| Règles | L'espace de variation est-il significatif ? |
| Relation | L'action du public modifie-t-elle la compréhension ? |
| Responsabilité | Le créateur comprend-il les conséquences du système ? |
RESTRUCTURATION DE L'INDUSTRIE
La convergence du cinéma, des jeux vidéo, des médias en direct et des mondes sociaux
PARTIE PROPOSITION : Les actifs mondiaux partagés peuvent être rendus à travers plusieurs médias, rendant les opérations mondiales plus importantes que le format de fichier final.
17 La convergence cinéma–jeu vidéo comme production d’univers partagés · 18 Événements en direct, compétitions et cinéma en temps réel · 19 Une nouvelle chaîne de valeur et de nouveaux métiers · 20 Transformation du marché et des modèles économiques · 21 Le paysage mondial émergent du secteur
17Convergence Cinéma-Jeux Vidéo comme Production de Mondes Partagés
FIGURE 17 · Un monde, plusieurs médias
17.1 De l'IP partagé à l'état partagé
Les adaptations traditionnelles partagent des noms, des images et des légendes tout en reconstruisant les actifs de production et la logique. Une approche de monde partagé définit l'identité, la géographie, la chronologie, les capacités, les relations et la provenance dans des couches lisibles par machine. Le cinéma peut interpréter un personnage de manière dramatique, un jeu peut exécuter des capacités, et les médias en direct peuvent réagir aux événements tout en restant connectés à un historique de versions commun. La réutilisation devient sémantique et opérationnelle, pas seulement visuelle.
17.2 Le studio du monde
Un studio du monde combine un département d'histoire et d'art avec une architecture de gestion de l’état, des systèmes d'actifs, une ingénierie de continuité, des opérations en direct et une gouvernance. Il distingue l’état canonique de l’état de session temporaire et les branches créées par la communauté. Le modèle opérationnel ressemble à la fois à un studio et à une organisation de services à long terme : il publie des œuvres, entretient le monde, résout les conflits et planifie la manière dont la valeur revient aux contributeurs.
17.3 Risques de convergence
Un monde partagé peut devenir créativement rigide si chaque medium doit obéir à une base de données centrale. Il peut également produire une surveillance, un travail exploitatif, un canon inaccessible ou une dépendance indéfinie envers une seule plateforme.
La gouvernance doit préserver l'interprétation spécifique au medium, des versions forkables, l'attribution des contributeurs et des limites claires sur ce qu'un opérateur commercial peut modifier rétroactivement.
TABLE 17 · CHARTE ANALYTIQUE
| Couche partagée | Film | Jeu / interaction | Gouvernance |
|---|---|---|---|
| Identité du personnage | Performance et arc | Capacité et état | Consentement / version |
| Sémantique du monde | Scène et thème | Carte et règles | Origine / droits |
| Ligne chronologique | Ordre narratif | Quête et embranchement | Canon / fourche |
| Comportement | Choix de performance | Action exécutable | Frontière de sécurité |
18Événements en direct, compétitions et cinéma en temps réel
FIGURE 18 · Boucle d'opérations en temps réel génératives
18.1 Trois familles de produits en temps réel
La première famille est un programme généré programmé avec une participation contrôlée. La seconde est une couche d'événements qui réagit au sport, aux nouvelles, aux performances ou aux activités communautaires. La troisième est un monde persistant qui continue entre les grands événements. Chacun nécessite des politiques de latence, de modération et de continuité différentes. Un spectacle programmé peut utiliser des alternatives préapprouvées étendues ; un monde persistant doit gérer des conséquences durables et l'identité des participants.
18.2 Entrée de l'audience et latence de gouvernance
La revue de sécurité ne peut pas toujours intervenir après la génération, car une sortie nocive peut être expérimentée immédiatement. Le système doit classifier l'entrée, restreindre l'espace des actions, sélectionner des modèles approuvés et surveiller le résultat généré. La latence de gouvernance fait partie du budget global bout à bout. Lorsque la confiance est faible, le monde doit réduire l'autonomie, retarder la publication ou basculer vers une réponse connue comme sûre.
18.3 Métriques commerciales et opérationnelles
Les métriques clés incluent la latence bout à bout, le taux de basculement, l'interruption non expliquée, le temps de récupération d'état, la fréquence des incidents, le coût par minute de session, le taux de rétention des participants et l'intégrité de l'état du monde. La croissance peut masquer des pertes structurelles si chaque participant supplémentaire augmente le coût de génération plus rapidement que les revenus. Les produits en temps réel nécessitent une économie de niveau de service, pas seulement des métriques d'audience.
TABLE 18 · CADRE ANALYTIQUE DU CHAPITRE
| Métrique | Objectif | Ligne rouge |
|---|---|---|
| Latence bout à bout | Interaction naturelle | Violation persistante |
| Taux de basculement | Stabilité du service | Pas de basculement sûr |
| Interruption de sécurité | Surveillance des risques | Interruption non expliquée |
| Temps de récupération de l'état | Gestion d'incident | Pas de retour arrière |
| Coût par minute | Économie d'unité | La perte augmente avec le succès |
19Une nouvelle chaîne de valeur et de nouvelles professions
FIGURE 19 · La nouvelle chaîne de valeur du cinéma IA
19.1 Six couches de la chaîne de valeur émergente
L'infrastructure de fondation fournit les modèles, les données et le calcul. Les systèmes de monde et de flux de travail organisent l'état et les outils. La production crée des œuvres et des actifs réutilisables. La distribution connecte les publics, les dispositifs et les contextes. Les systèmes de transaction gèrent les permissions et le flux de valeur. Les opérations maintiennent l'identité, la sécurité, la continuité et la communauté. Les organisations peuvent occuper plusieurs couches, mais les conflits d'intérêts et la responsabilité doivent rester visibles.
19.2 Nouvelles combinaisons professionnelles
Un producteur natif de l'IA combine la responsabilité créative, budgétaire et systémique. Un architecte de monde modélise les règles et l'état. Un ingénieur de continuité gère l'identité et la causalité à travers les générations. Un ingénieur de provenance conçoit les registres et les métadonnées. Un directeur de la sécurité générative définit le refus, la dégradation et la récupération.
Ces rôles ne sont pas des titres de poste fixes ; ils identifient les lacunes de compétences que les frontières conventionnelles des départements laissent souvent sans assignation.
19.3 Transition du travail et distribution équitable
L'automatisation peut éliminer les tâches répétitives tout en concentrant le pouvoir dans les modèles et les plateformes. Les programmes de transition doivent suivre les revenus, le pouvoir de négociation, la reconnaissance des contributions, la reconversion et l'accès aux outils, et non seulement le pourcentage de tâches automatisées. Les contributeurs ont besoin d'une attribution claire et d'une rémunération lorsque les actifs, les performances et les flux de travail continuent de créer de la valeur à travers les produits et les années.
TABLE 19 · CADRE ANALYTIQUE DU CHAPITRE
| Rôle | Responsabilité principale | Capacité |
|---|---|---|
| Producteur natif IA | Flux humain–IA et budget | Créatif + systèmes |
| Architecte du monde | Règles et état | Narratif + modélisation de données |
| Ingénieur de continuité | Identité et causalité | Qualité + versionnement |
| Ingénieur de provenance | Preuves et champs | Normes + droits |
| Directeur de la sécurité générative | Refus et récupération | Contenu + risque |
20Marché et transformation du modèle économique
FIGURE 20 · Portfolio de revenus du monde persistant
20.1 Élargissement de l'unité de revenu
Un abonnement à un monde vend l'accès maintenu et l'état. Un abonnement à un personnage vend la continuité de la relation. Un événement interactif vend une expérience à durée limitée. La licence d'entreprise vend des environnements de marque ou de formation contrôlés. Les services d'actifs vendent l'identité, le flux de travail ou des composants de monde. Les demandes d'agents soutiennent la licence ou la génération initiée par machine. Chaque unité nécessite des consentements, des niveaux de service, une comptabilité et une logique de remboursement différents.
20.2 De la production à l'économie d'unité de service
La finance traditionnelle concentre les coûts avant la sortie. Les mondes persistants combinent les dépenses de production avec l'inférence, le stockage, la modération, la sécurité, le support client et la migration d'état. Le modèle financier doit classer l'investissement fixe dans le monde, le coût variable de session, le coût d'acquisition, la rétention, les réserves de passif et les obligations en fin de vie. Un produit n'est pas durable si la réussite augmente les pertes ou rend le retrait techniquement impossible.
20.3 Tarification et distribution de la valeur
Les prix doivent correspondre à une valeur lisible plutôt qu'à une vulnérabilité émotionnelle déduite. Les règles de partage des revenus doivent traiter la poursuite de l'utilisation des interprètes, des créateurs de personnages, des concepteurs de mondes, des contributeurs communautaires et des développeurs de flux de travail. Les contrats lisibles par machine peuvent améliorer le règlement, mais les exceptions et les litiges nécessitent encore un processus humain. Le système doit indiquer quel participant reçoit de la valeur lorsqu'un actif est réutilisé.
TABLE 20 · CHAPITRE CADRE ANALYTIQUE
| Modèle | Unité de valeur | Condition requise | Principal risque |
|---|---|---|---|
| Abonnement au monde | État persistant | Mises à jour / conservation | Coût d'exploitation élevé |
| Abonnement au personnage | Relation à long terme | Consentement / contrôle de la mémoire | Dépendance / manipulation |
| Événement interactif | Une expérience | Fiabilité en temps réel | Capacité maximale |
| Licence d'entreprise | Marque / environnement | Contrôle et traçabilité | Dérive identitaire |
| Demande d'agent | Transaction machine | Champs de droits / paiement | Responsabilité de l'agence |
21Le paysage industriel mondial émergent
FIGURE 21 · Un réseau mondial de cinéma IA multipolaire
21.1 La compétition est façonnée par des endowments divers
La capacité du modèle n'est qu'un atout. L'accès aux talents de production, aux récits locaux, à l'expertise en jeu et en animation, à la gouvernance des données, au capital, à la distribution, aux marchés linguistiques et aux chaînes d'approvisionnement en appareils influence tous le domaine. Une région peut mener en matière d'actifs de monde ou de gouvernance même sans former le modèle le plus grand. Le marché récompensera les institutions qui traduisent entre ces ressources.
21.2 La position structurelle de Hong Kong
Hong Kong peut contribuer en tant que marché multilingue et transfrontalier, ainsi que comme connecteur de normes, avec une culture cinématographique profonde, des services financiers et des réseaux internationaux. Son opportunité n'est pas d'imiter un centre de modèles à très grande échelle. Il s'agit de rendre les actifs, les projets, les investissements, les festivals, les évaluations et la distribution interopérables entre juridictions, tout en préservant une distinction crédible entre l'infrastructure industrielle et les revendications promotionnelles.
21.3 Une langue minimale pour la collaboration internationale
Le travail transfrontalier nécessite des définitions partagées du type de travail, du rôle de l'IA, du comportement d'exécution, de l'identité des actifs, de l'étendue des permissions, du statut de provenance et de la responsabilité. Ces domaines doivent soutenir les différences légales locales plutôt que de prétendre les remplacer. Une langue commune minimale permet aux créateurs et aux institutions de comparer les projets sans imposer les catégories légales d'une juridiction sur tous les participants.
TABLE 21 · CADRE ANALYTIQUE DU CHAPITRE
| Région | Force | Opportunité | Contrainte |
|---|---|---|---|
| Amérique du Nord | Modèles / cloud / distribution | Plateformes et outils | Concentration / droits |
| Chine et Asie de l'Est | Applications / chaîne d'approvisionnement | Contenu à échelle | Interopérabilité transfrontalière |
| Europe | Règles / culture | Contenu de confiance | Capital / échelle |
| Japon et Corée | Personnages / animation / jeux | Actifs mondiaux | Marché linguistique |
| Hong Kong | Transfrontalier / finance / langues | Connexion marché et normes | Calcul / échelle de production |
ACTIFS DIGITAUX ET LE
Du déploiement du contenu aux réseaux collaboratifs d'actifs par machine
PARTIE PROPOSITION La valeur réside non seulement dans une œuvre achevée, mais aussi dans les flux de travail, les personnages, les états du monde, les règles comportementales et les enregistrements vérifiables.
22 Actifs audiovisuels IA : De l'œuvre achevée à une famille d'actifs · 23 Le cycle de vie des actifs audiovisuels IA · 24 Actifs lisibles par les agents et transactions médiatisées par machine · 25 Connecter la valeur humaine et IA : comptes de valeur à double domaine
22Actes audiovisuels IA : De l'œuvre achevée à une famille d'actifs
FIGURE 22 · La famille des actifs audiovisuels IA
22.1 Six classes d'actifs
Une œuvre est l'expérience audiovisuelle diffusée. Un flux de travail enregistre les outils, les nœuds et les décisions. Un personnage combine identité, modèle, performance et permission. Un monde contient sémantique, règles et état. Un comportement définit une capacité exécutable ou une interaction. Un enregistrement fournit la provenance, les événements et les preuves du cycle de vie. Un même projet peut contenir des centaines d'actifs liés, chacun avec des termes d'accès et commerciaux différents.
22.2 Trois conditions pour des actifs utilisables
Un actif doit être identifiable : les utilisateurs et les machines peuvent le distinguer et sa version. Il doit être interprétable :
les champs techniques, sémantiques et de gouvernance clés sont lisibles. Il doit être utilisable dans une enveloppe de permissions connue. Un actif visuellement impressionnant qui manque de provenance, de clarté des versions ou d'étendue des permissions peut être précieux comme inspiration mais inutilisable dans une collaboration professionnelle.
22.3 Évaluation de la valeur des actifs
La valeur peut dépendre de la performance du public, de la fiabilité, de la possibilité de modification, de la force des relations, de la réutilisation, de la complétude de la provenance et de la qualité de la licence. Une seule métrique ne peut comparer toutes les classes d'actifs. Un personnage peut créer une valeur durable par la stabilité de l'identité ; un flux de travail par le taux d'acceptation ; un monde par l'extensibilité ; et un enregistrement par sa capacité à réduire les coûts de transaction et de litige.
TABLE 22 · CADRE ANALYTIQUE DU CHAPITRE
| Actif | Identité minimale | Métrique de valeur | Focus sur la permission |
|---|---|---|---|
| Œuvre | Version / sortie | Public / revenus | Exposer / adapter |
| Flux de travail | Nœuds / configuration | Acceptation / efficacité | Exécuter / redistribuer |
| Personnage | Identité / modèle | Stabilité / relation | Image / voix / comportement |
| Monde | Règles / état | Extension / réutilisation | Entrer / construire / exploiter |
| Comportement | Capacité / interface | Contrôle / sécurité | Appeler / déléguer |
| Enregistrer | Provenance / événement | Intégralité / intégrité | Inspecter / conserver |
23Le cycle de vie des actifs audiovisuels d'IA
FIGURE 23 · Le cycle de vie de l'actif
23.1 De la création au retrait
La création produit un actif et des preuves initiales. La déclaration identifie le soumettant responsable.
L'identification attribue une ID persistante et des relations parentales. La vérification vérifie les déclarations ou les signatures.
L'évaluation ajoute des observations indépendantes. La découverte expose les métadonnées autorisées. La permission permet l'utilisation ; l'opération crée des événements ; le règlement enregistre le flux de valeur. Le changement, l'archivage et la retraite préservent l'histoire et déterminent ce qui reste accessible.
23.2 Le registre vérifiable minimum
Le registre doit inclure l'ID d'actif, le type, la version, l'actif parent, le contact responsable, un récapitulatif de la provenance, la déclaration du modèle et de l'outil, un récapitulatif des droits, le statut de gouvernance, le format technique, une référence d'intégrité et l'état de contestation ou de retrait. Il n’est pas nécessaire de rendre tous les champs publics. La couche publique minimale doit permettre l'identification et le contact informé sans exposer de prompts confidentiels, des informations personnelles ou des journaux sensibles à la sécurité.
23.3 Retrait, contentieux et actifs orphelins
Un titulaire de droits peut retirer la permission ; un soumettant peut disparaître ; un actif peut être contesté ou techniquement obsolète. Le système doit disposer d'états de suspension, de statut contesté, de remplacement, d'accès restreint et de responsabilité orpheline. Les registres historiques ne doivent pas impliquer une permission actuelle. Les clients machines doivent pouvoir reconnaître qu'un actif a existé mais ne peut plus être utilisé.
TABLE 23 · CHAPITRE CADRE ANALYTIQUE
| Groupe de champs | Exemple | Couche publique |
|---|---|---|
| Identité | ID / type / version / parent | Public |
| Parties responsables | Créateur / soumettant / contact | Hiérarchisée |
| Provenance | Modèle / outil / déclaration d'actif | Résumé |
| Droits | Territoire / terme / usage / statut | Résumé |
| Gouvernance | Label / litige / retrait | Public |
| Technique | Format / interface / hash | Sur demande |
24Actifs lisibles par les agents et transactions médiatisées par machine
FIGURE 24 · Couches des transactions d'actifs médiatisées par agent
24.1 L'enveloppe de droits lisible par machine
Un actif peut exprimer les usages autorisés, les usages exclus, le territoire, la durée, l'étendue de l'identité, la logique de prix, l'attribution, les contraintes techniques et si une approbation humaine est requise. Ces champs soutiennent la découverte et la négociation préliminaire. Ils ne suppriment pas les exceptions, les droits moraux, les accords collectifs ou les règles de compétence. L'enveloppe doit préciser quand l'interprétation par machine doit cesser et quand une décision humaine doit commencer.
24.2 Séparer l'intention probabiliste du règlement déterministe
Un modèle de langage peut déduire qu'un utilisateur souhaite une licence, mais la déduction n'est pas une autorité. Une couche de transaction doit présenter l'actif exact, les droits, le prix, la contrepartie et les conditions de révocation, obtenir une autorisation approuvée et générer un enregistrement durable. Les protocoles émergents de paiement par agent sont des signaux d'infrastructure importants, tandis que la responsabilité et la protection des consommateurs restent des questions de conception ouvertes [R21–R22].
24.3 D'un marché de recherche à un marché de demande
Les utilisateurs humains naviguent dans les catalogues ; les agents peuvent exprimer des exigences structurées et demander au marché d'assembler une solution conforme. Cela peut réduire les coûts de transaction pour la localisation, le remplacement d'actifs, la musique, les voix et les composants de monde. Cela peut également intensifier la concentration si une seule plateforme contrôle la découverte, l'identité et le paiement. Les formats de demande ouverts et les enregistrements exportables sont donc une infrastructure stratégique.
TABLE 24 · CHADRE CADRE ANALYTIQUE
| Champ | Valeur lisible par machine | Gestion humaine |
|---|---|---|
| Utiliser | Visualiser / générer / adapter | Utilisation non listée |
| Territoire / terme | Code / date | Conflit / exception |
| Identité | Personnage / périmètre de l'interprète | Personne sensible |
| Prix | Négociation haute valeur / niveau / devis | Négociation haute valeur |
| Approbation | Automatique / humain | Personnalité / irréversible |
25Lier l'humain et la valeur de l'IA : Comptes de valeur à double domaine
FIGURE 25 · Flux de valeur humain–IA à double domaine
25.1 Pourquoi le « PIB des mondes de l'IA » n'est pas une somme additive directe
Un agent peut appeler plusieurs modèles, acheter des services internes et transférer un actif virtuel avant qu'un utilisateur final ne paie pour une expérience. Compter chaque étape comme une nouvelle valeur comptabiliserait l'activité intermédiaire plusieurs fois. Les prix des actifs peuvent également augmenter sans production correspondante. La mesure doit distinguer les transactions brutes, les revenus, les produits, la formation du capital, l'utilisation finale et la valeur ajoutée, et doit identifier le principal économique derrière l'activité automatisée.
25.2 Comptes de valeur humain–IA à double domaine
Le domaine humain enregistre le travail créatif, la préparation des données, le capital, l'énergie, les droits et les services institutionnels. Le domaine d'exécution de l'IA enregistre l'inférence et les services d'agent attribués à un principal commanditaire. Le domaine du monde virtuel enregistre l'utilisation finale, les actifs maintenus et la circulation interne. Le domaine du retour réel enregistre les revenus observables, les salaires, les licences et les taxes. La réconciliation élimine les transferts intermédiaires et montre comment la valeur et le risque se déplacent entre les domaines.
25.3 Compte satellite audiovisuel natif de l'IA
Un compte satellite peut estimer la production industrielle, les rémunérations, les intrants intermédiaires, la formation des actifs, les importations, les exportations et l'utilisation d'énergie, tout en conservant les comptes nationaux principaux. Les entreprises pourraient commencer par un échantillon volontaire : classer les dépenses de projet, les opérations cloud, les actifs de mondes réutilisables, les rémunérations humaines et le revenu final. L'objectif est une base de données comparable, et non un chiffre d'affiche détaché des limites comptables.
TABLE 25 · CHADRE ANALYTIQUE
| Compte | Enregistrements | Comment éviter la double comptation |
|---|---|---|
| Entrée humaine | Création / données / capital / énergie | Marquer l'entrée intermédiaire |
| Exécution IA | Inférence / service d'agent | Attribuer au principal |
| Monde virtuel | Utilisation finale / service d'actif | Circulation interne distincte |
| Retour réel | Revenu / salaire / licence / taxe | Compter le flux observable |
| Compte satellite | Valeur ajoutée / formation d'actifs | Alignement sur le SNA |
DROITS, GOUVERNANCE ET
Transparence, responsabilité et agency humaine
PARTIE PROPOSITION La confiance exige une chaîne traçable reliant la provenance, la permission, le consentement, l'historique des versions et la mise à disposition responsable.
26 Contrôle créatif, droits d'auteur et répliques numériques · 27 Provenance, étiquetage du contenu et chaîne de responsabilité · 28 Diversité culturelle, capacité d’action humaine et durabilité
26Contrôle créatif, droits d'auteur et répliques numériques
FIGURE 26 · Quatre couches de droits dans le cinéma par IA
26.1 Auteur : utilisation d'outils et contrôle créatif
Le Bureau du Copyright des États-Unis et d'autres autorités soulignent l'auteur humain et le contrôle lors de l'évaluation de la protégabilité [R15]. Dans le travail par IA native, les preuves peuvent inclure la constitution narrative du créateur, la sélection, l'arrangement, la révision et l'approbation finale. Demander simplement un résultat imprévisible n'est pas équivalent au contrôle de l'expression. Des juridictions différentes peuvent aboutir à des conclusions différentes, donc les dossiers de projet doivent soutenir une analyse factuelle sans supposer une réponse juridique universelle.
26.2 Séparation de l'entraînement, de l'entrée de projet et de la sortie
La permission de formation concerne le développement d'un modèle. La permission d'entrée de projet concerne les actifs fournis pour un travail spécifique. Les questions de sortie concernent la similarité, les éléments protégés, les termes contractuels et la contribution humaine. Ces couches doivent être examinées indépendamment [R16]. Une production ne peut pas remédier à une incertitude concernant la formation ou la réplique en plaçant simplement une étiquette sur le fichier final.
26.3 Répliques numériques et consentement continu
Le consentement pour un visage, une voix ou une performance doit spécifier le média, le contexte, le territoire, la durée, l'autonomie, la rémunération et le retrait. Un changement matériel — tel que permettre à une réplique de parler sans scénario, d'entrer dans une scène sensible ou de fonctionner après qu'un interprète ne soit plus disponible — doit déclencher un renouvellement du consentement. Le système doit également maintenir un moyen pratique d'interrompre l'utilisation nouvelle et préserver le registre des autorisations antérieures.
TABLE 26 · CHARTER ANALYTIQUE
| Permission | Contenu minimum | Déclencheur de renouvellement de consentement |
|---|---|---|
| Données | Origine / finalité / conservation | Nouvelle utilisation de formation |
| Visage et voix | Média / contexte / territoire | Scène sensible |
| Autonomie | Peut dire / faire / interdit | Passif à agent |
| Termes et retrait | Arrêt / suppression / archivage | Pérennité du modèle |
| Indemnisation | Fixe / utilisation / partage | Nouveau modèle économique |
27Provenance, étiquetage du contenu et chaîne de responsabilité
FIGURE 27 · Trois couches de transparence
27.1 Une architecture de transparence à trois couches
La couche de provenance enregistre les actifs, les outils, les parties responsables et les références d'intégrité. La couche lisible par machine communique le statut de génération et de modification aux plateformes et aux agents. La couche perceptible informe les utilisateurs sous une forme adaptée au contexte. Les mesures d'étiquetage de la Chine et les travaux de transparence de l'UE indiquent tous deux une évolution vers une divulgation explicite et implicite coordonnées [R12–R14]. La mise en œuvre doit rester accessible sans submerger le public.
27.2 Une chaîne de responsabilité plutôt qu'un nuage de responsabilité
Un fournisseur de modèle contrôle les capacités, les garde-fous et la divulgation des versions. Un créateur contrôle les entrées et les choix créatifs. Un producteur contrôle le flux de travail, les droits et l'approbation. Un distributeur contrôle les étiquettes, le public et la politique de plateforme. Un opérateur d'exécution contrôle la politique en direct, la réponse aux incidents et le retour arrière. Plusieurs parties peuvent partager la responsabilité, mais chacune doit préserver les enregistrements correspondant à son contrôle.
27.3 La position institutionnelle d'Index.Film™
Index.Film™ permet l'identification, l'enregistrement, la recherche et la collaboration sur les actifs liés au travail, au flux de travail, au personnage, au monde, au comportement et à l'enregistrement. Il doit publier ses règles de métadonnées, son processus de correction, ses couches d'accès et ses états de litige. L'inclusion n'est pas une approbation ; l'indexation ne confirme pas la titularité des droits ; et un identifiant ne remplace pas l'enregistrement juridique ou l'arbitrage. Ces limites sont une source de crédibilité, non de faiblesse.
TABLE 27 · CHAPITRE CADRE ANALYTIQUE
| Partie | Contrôle primaire | Enregistrement minimum |
|---|---|---|
| Fournisseur de modèle | Capacité / sécurité / version | Carte de modèle / modification |
| Créateur | Entrées / sélection / révision | Preuve créative |
| Producteur | Flux de travail / droits / approbation | Planning de livraison |
| Distributeur | Étiquette / public / plateforme | Responsabilité de la sortie |
| Opérateur | Politique en direct / incident | Événement et annulation |
28Diversité culturelle, agency humaine et durabilité
FIGURE 28 · Quatre dimensions de la valeur publique
28.1 Diversité culturelle et concentration des données
Les modèles à grande échelle peuvent reproduire les langues dominantes, les esthétiques et les hypothèses commerciales. La diversité nécessite plus que la traduction d'une interface. Les institutions doivent examiner à qui appartiennent les archives, traditions de performance et structures narratives représentées dans les données et les évaluations ; soutenir les créateurs locaux et les langues ; et permettre aux communautés de définir les utilisations sensibles. Le travail de l'UNESCO sur l'IA et la culture souligne la nécessité de relier l'innovation aux droits culturels et à la participation plurielle [R18].
28.2 Agence humaine et économie des créateurs
Les créateurs ont besoin d'un contrôle significatif sur les outils, la crédibilité, les revenus, la portabilité et le refus. Le public a besoin de la capacité de comprendre, de corriger et de quitter les systèmes adaptatifs. Une plateforme peut augmenter la participation nominale tout en réduisant le pouvoir de négociation ou en rendant les créateurs dépendants de services de classement et de génération opaques.
La capacité d’action humaine est donc une mesure économique et institutionnelle, et non seulement une aspiration éthique.
28.3 Énergie et génération durable
L'évaluation doit rapporter l'énergie par sortie acceptée, par session utilisateur et par monde actif, tandis que l'énergie totale et les effets du réseau régional restent visibles. L'efficacité du modèle, la mise en cache, le déploiement en périphérie du réseau, le calendrier des charges de travail, l'approvisionnement renouvelable et la génération sélective peuvent réduire la demande. L'industrie doit éviter l'hypothèse que l'abondance générée n'a pas de coût d'infrastructure physique [R19–R20].
TABLE 28 · CHAPITRE CADRE ANALYTIQUE
| Dimension | Métrique utile | Métrique insuffisante |
|---|---|---|
| Énergie | Par seconde acceptée / minute de session | Une inférence |
| Culture | Répartition par langue / région / créateur | Volume total |
| Travail | Revenu / transition / négociation | Ratio d'automatisation |
| Agence | Contrôle / sortie / plainte | Temps passé |
PRÉVISIONS, SCÉNARIOS ET
La fenêtre de décision 2026–2035
PARTIE PROPOSITION – Une prévision n'est pas une promesse ; c'est un compte rendu public des hypothèses, des conditions d’adoption, de l'incertitude et des points de décision.
29 A 2026–2035 Roadmap de la Technologie et de l'Industrie · 30 Quatre Scénarios Futurs · 31 Guide d'Action pour les Parties Prenantes de l'Industrie · 32 Un Agenda d'Action Commun
29Une Roadmap 2026–2035 de la Technologie et de l'Industrie
FIGURE 29 – Trois Fenêtres d'Observation, 2026–2035
29.1 2026–2028 : la période d'infrastructure
La priorité est la génération contrôlable, les systèmes de gestion de l’état pour les œuvres longues, les flux de travail audio-vidéo natifs, la traçabilité, l'étiquetage et l'évaluation professionnelle. Les films AI-native deviennent de plus en plus courants, tandis que les produits en temps réel restent limités. Les organisations qui construisent des actifs portables, des registres de droits, un routage de modèles et des métriques de sortie acceptable créent des avantages qui survivent à une rotation rapide des modèles.
29.2 2029–2032 : la période d'expansion de la forme
Si la latence, le coût et les portes d'accès aux appareils s'améliorent, le cinéma interactif, les événements générés en direct, les mondes film-jeux partagés et les expériences spatiales peuvent passer des démonstrations à des produits répétables. De nouveaux revenus par abonnement et par événement peuvent émerger. Le changement de gouvernance critique passe des registres au niveau des fichiers à la responsabilité au niveau des événements et de la permission de contenu à la permission d'agent et de monde.
29.3 2033–2035 : la période du monde persistant
Si l'identité, l'état multi-utilisateur, la portabilité, l'économie et la gouvernance mûrissent ensemble, les mondes culturels persistants pourraient devenir un medium significatif. Ils ne remplaceront ni le cinéma ni les jeux vidéo. Ils fourniront une couche dans laquelle les œuvres, les personnages et les communautés continuent à travers les appareils et les formats. Les différends transfrontaliers, le traitement statistique et la conservation à long terme deviendront des institutions centrales.
TABLE 29 · CHAPITRE CADRE ANALYTIQUE
| Fenêtre | Porte de capacité | Porte de marché | Porte de gouvernance |
|---|---|---|---|
| 2026–2028 | Génération contrôlable / flux de travail | Adoption professionnelle | Étiquettes / provenance |
| 2029–2032 | Multi-utilisateur / spatial / coût réduit | Abonnement / transmédia | Autorisation d'agent / enregistrement d'événement |
| 2033–2035 | Monde persistant multi-appareil | Économie mondiale stable | Responsabilité transfrontalière / statistiques |
30Quatre scénarios futurs
FIGURE 30 · Quatre scénarios futurs
30.1 Croissance réglementée
La capacité et les revenus augmentent alors que les normes, l'étiquetage et la responsabilité mûrissent. La production professionnelle d'IA native s'étend, et les publics acceptent les expériences adaptatives car le contrôle est lisible. La stratégie gagnante est l'investissement dans des actifs de confiance, l'évaluation et une gouvernance interopérable plutôt que l'autonomie maximale.
30.2 Encadrement par plateforme
Un petit nombre de plateformes intégrées contrôlent les modèles, l'identité, la distribution, le paiement et l'état du monde.
Les outils créatifs sont puissants mais l'export est coûteux et les conditions peuvent changer. Les organisations ont besoin d'une architecture multiplateforme, de droits de sortie contractuels, d'enregistrements indépendants et d'actifs qui peuvent être migrés sans perdre l'identité ou l'historique des autorisations.
30.3 Crise de confiance
Des préjudices à haute visibilité, des litiges sur les droits, une tromperie par des contenus synthétiques ou des incidents de sécurité réduisent la confiance des publics et des institutions. La réglementation se resserre et les coûts d'assurance augmentent. La traçabilité, une responsabilité humaine explicite, une portée de produit contrôlée et une réponse aux incidents préparée par des exercices deviennent des conditions d'accès au marché plutôt que des mesures de conformité facultatives.
30.4 Mondes ouverts
Des normes ouvertes, des transactions d'agents et une identité portable permettent aux créateurs et aux communautés d'opérer à travers plusieurs mondes. L'innovation et la participation plurielle augmentent, mais ainsi que les abus inter-systèmes, la fraude et la complexité des litiges. L'opportunité dépend de fortes autorisations d'identité, d'une gouvernance contestable, d'une preuve interopérable et d'un règlement équitable.
TABLE 30 · CADRE ANALYTIQUE DU CHAPITRE
| Scénario | Signal clé | Stratégie sans regret |
|---|---|---|
| Croissance gouvernée | Normes ouvertes / meilleure économie | Actifs de confiance |
| Encadrement de la plateforme | Coût de changement élevé / concentration | Export et multi-plateforme |
| Crise de confiance | Incidents / litiges / churn | Provenance et responsabilité humaine |
| Mondes ouverts | Interopérabilité / échange d'agents | Identité, autorisation et gestion des litiges |
31Guide d'action pour les parties prenantes du secteur
FIGURE 31 · Réseau d'action pour six groupes de parties prenantes
31.1 Créateurs et organisations de production
Cartographiez les éléments de l'histoire, des personnages, du monde, des flux de travail et des actifs de preuve. Définissez l'intention créative AI-native avant de sélectionner les outils. Établissez des systèmes d'état et de version, des métriques de sortie acceptable, une revue des droits et une approbation humaine finale. Lancez un projet borné qui peut être évalué honnêtement, plutôt que de distribuer l'expérimentation à chaque production sans apprentissage.
31.2 Fournisseurs de modèles, de technologies et de plateformes
Divulguez les capacités et les limitations importantes ; soutenez l'export, l'historique des versions et la traçabilité ; séparez les propositions probabilistes des transactions ; fournissez des outils de repli sûr et de gestion des incidents ; et publiez les modifications qui affectent les droits ou la sortie. Les plateformes doivent rendre l'exploitation responsable plus facile que des contournements opaques.
31.3 Distribution, investissement et assurance
Utilisez des calendriers de livraison AI qui identifient les actifs, les modèles, les autorisations, les étiquettes, les preuves et la responsabilité d'exécution. Évaluez l'économie de sortie acceptable et les passifs de monde persistant. Prix le risque selon le contrôle et les registres plutôt que de traiter toute implication AI comme identique. Exigez un plan de sortie et d'archivage pratique.
31.4 Politique, recherche et éducation
Développez une terminologie partagée, des ensembles de test représentatifs, une recherche au service de l'intérêt public et des essais statistiques.
L'éducation doit combiner cinéma, interaction, systèmes, données, droits et opérations. La certification doit reconnaître les capacités démontrées et la responsabilité professionnelle plutôt que la familiarité à court terme avec une interface unique.
TABLE 31 · CADRE ANALYTIQUE DU CHAPITRE
| Partie prenante | Premiers 90 jours | Dans les 12 mois |
|---|---|---|
| Créateurs / producteurs | Inventaire des actifs et des droits | État du monde et flux de preuve |
| Plateformes technologiques | Révéler les capacités et les limites | Provenance exportable / solution de repli |
| Distribution / financement | Calendrier de livraison de l'IA | Économie d'unité / benchmark des risques |
| Politique / recherche | Conditions et échantillons | Tests publics / pilote statistique |
| Éducation | Curriculum interdomaine | Certification des rôles / transition |
32Un programme d'action conjoint
FIGURE 32 · Programme public d'intérêt commun
32.1 Définitions et évaluation en tant qu'infrastructure publique
Le modèle P/R, les stades G0 à G5 et le langage des preuves E1 à E4 doivent être révisés à l'aide de cas et d'une revue par les pairs. Les repères doivent tester la continuité à long terme, le contrôle, la récupération en temps réel, la provenance et l'agence humaine, tout en laissant la qualité artistique ouverte à la critique, aux jurys et au public.
32.2 Index.Film™ et collaboration marchande
Le programme initial doit publier les champs minimum pour six types d'actifs, les niveaux d'accès, les processus de correction et de résolution de litiges, ainsi que les limites de permission lisibles par machine. Les pilotes marchands peuvent tester la manière dont les identifiants et les registres réduisent les coûts de transaction sans prétendre déterminer la propriété ou la valeur artistique.
32.3 Une ville mondiale et un réseau de talents
Les villes peuvent accueillir des productions conjointes, des tests, de l'éducation, des festivals, des résidences et l'accès au marché. La participation doit reposer sur des projets concrets et des avantages réciproques plutôt que sur une adhésion nominale. Le réseau doit rendre visibles les cultures créatives locales tout en améliorant l'interopérabilité transfrontalière.
32.4 Recherche et publication annuelle
Chaque édition annuelle doit mettre à jour les preuves techniques, les évolutions réglementaires, les données de marché et les signaux de scénarios. Elle doit signaler les erreurs et les jugements modifiés. Un processus de recherche permanent peut inviter les institutions, les créateurs, les interprètes, les ingénieurs et les groupes d'intérêt public à tester le cadre et à proposer des révisions.
TABLE 32 · CADRE ANALYTIQUE DU CHAPITRE
| Programme public | Sortie initiale | Frontière de gouvernance |
|---|---|---|
| Classification à double axe | Spécification annuelle / cas | Non une décision juridique |
| Référence d'évaluation | Tests de longue durée / en temps réel | Pas de jugement artistique |
| Index.Film™ | Champs minimum pour six actifs | L'inclusion n'est pas une approbation |
| Réseau de villes | Projets conjoints / flux de talents | Pas d'alliance nominale |
| Compte satellite | Échantillon pilote d'entreprise | Pas de PIB officiel |
| Bilan blanc annuel | Revue de la prévision / révision | Version publique de l'historique |
Annexes Les annexes transforment les concepts du bilan blanc en termes pratiques, exigences de preuve, métadonnées, protocoles de révision et outils d'action.
Annexe A Glossaire des termes essentiels
- Cinéma natif de l’IA
- Une œuvre audiovisuelle dans laquelle l'IA joue un rôle substantiel dans les dimensions créatives fondamentales et qui ne peut pas être entièrement dissociée de son processus reposant sur l’IA.
- Axe Capacité d’action créative (P0–P4)
- Une classification du rôle substantiel de l'IA dans le récit, l'image, le son, le personnage et l'interaction.
- Axe de génération de durée (R0 à R4)
- Une classification indiquant la proportion du travail expérimental généré lors de l'utilisation.
- Marqueur 51%+
- Un seuil d'éligibilité pour un leadership créatif substantiel sur l'axe P ; ne s'agit pas d'un score qualitatif ou juridique.
- Modèle du monde
- Un système qui maintient et prédit l'état dépendant des actions, la mémoire et les relations causales.
- Constitution du récit
- Les thèmes, règles, engagements des personnages, limites de variation et gouvernance qui définissent un espace narratif génératif.
- État du monde
- Informations autoritaires concernant les entités, les lieux, les relations, les événements et les autorisations à un instant donné.
- Famille d'actifs
- L'ensemble connecté des actifs de travail, de flux, de personnage, de monde, de comportement et d'enregistrement.
- Provenance
- Informations concernant l'origine, la transformation, les parties responsables et l'intégrité associées à un actif.
- Enveloppe de droits
- Champs lisibles par machine décrivant l'utilisation autorisée et le moment où une approbation humaine est requise.
- Comptes de valeur dual-domaine Humain–IA
- Un cadre analytique séparant les entrées humaines, l'exécution par IA, l'utilisation virtuelle et les retours observables dans le monde réel.
- Compte audiovisuel par satellite à base d'IA
- Un cadre statistique pour les sorties et les actifs de l'industrie, conçu pour se connecter aux principes de la comptabilité nationale.
Annexe B : Classification P/R et Preuves créatives
La note P doit être évaluée sur le récit, l'image, le son, le personnage et l'interaction, en utilisant des pondérations déclarées avant la révision. Le marqueur 51%+ détermine uniquement la qualification P3. La note R est évaluée indépendamment selon la génération à l’exécution.
| Groupe de preuves | Description |
|---|---|
| Intention créative | Concept, thème, règles et versions approuvées |
| Chaîne d'outils | Modèles, versions, nœuds et paramètres |
| Processus de génération | Prompts, références, candidats et rejet |
| Contrôle humain | Sélection, arrangement, révision et approbation |
| Durée | Entrée, état, politique et niveau de génération |
Annexe C Profil métadonnées minimum Index.Film™
Ce profil soutient l'identification, l'enregistrement, la recherche et la collaboration. Il ne confirme pas les droits et ne constitue pas une approbation de l’actif. Les couches publiques, restreintes et privées doivent rester séparées.
| Groupe de champs | Exemple |
|---|---|
| Identité | ID / type / version / parent |
| Parties responsables | Créateur / soumettant / contact |
| Provenance | Modèle / outil / déclaration d'actif |
| Droits | Territoire / terme / usage / statut |
| Gouvernance | Label / litige / retrait |
| Technique | Format / interface / hash |
Annexe D Preuves, prévisions et révision annuelle
Protocole
- Classe les revendications de niveau E1 à E4 et conserve une source primaire accessible ou une note de preuve.
- Énonce les hypothèses techniques, économiques, matérielles, de gouvernance et culturelles pour les prévisions.
- Signalez la confirmation, le retard, la dégradation, le retrait et l'erreur dans l'édition suivante.
- Sépare les performances déclarées par les fournisseurs de la validation indépendante.
- Conserve l'historique public des versions pour les classifications, les métadonnées et les cadres d'évaluation.
Annexe E Cadre d'action à 90 jours, 12 mois et 36 mois
| Horizon | Capacité organisationnelle |
|---|---|
| 90 jours | Inventorier les actifs, outils, droits et coûts |
| 12 mois | Développer les systèmes d'état, de routage et de preuve |
| 36 mois | Développer les opérations mondiales et la capacité d'agent |
Annexe F – Références et sources primaires
Les recherches primaires, les organismes normalisés, les régulateurs, les organisations internationales et les publications officielles des développeurs de modèles sont prioritaires. Les informations ont été vérifiées jusqu'au 16 juillet 2026.
[R01] OpenAI. Les modèles de génération vidéo comme simulateurs du monde. 2024.
[R02] Google DeepMind. Veo 3.1 – Aperçu du modèle et capacités. 2025.
[R03] Meta AI. Movie Gen: A Cast of Media Foundation Models. 2024.
[R04] Tencent Hunyuan. HunyuanVideo : Un cadre systématique pour les modèles génératifs vidéo à grande échelle. 2024.
[R05] Wan Team. Wan : Modèles génératifs vidéo à grande échelle ouverts et avancés. 2025.
[R06] Zhang et al.. L'IA générative pour la création de films : Une revue des avancées récentes. 2025.
[R07] Google DeepMind. Genie 3 – Modèle interactif du monde en temps réel. 2025/2026.
[R08] Liu et al.. Vers la modélisation interactive du monde vidéo : Frontières, défis, benchmarks et tendances futures. 2026.
[R09] Wang et al.. Matrix-Game 3.0 : Modèle interactif du monde en temps réel et en streaming avec mémoire à long terme. 2026.
[R10] Wu et al.. Infinite-World : Échelle des modèles interactifs du monde jusqu'à des horizons de 1000 images. 2026.
[R11] C2PA. Spécification technique des attributs de contenu 2.2 et explication. 2025/2026.
[R12] Cyberspace Administration of China et al.. Mesures pour l'étiquetage du contenu généré par IA et synthétique. 2025.
[R13] Commission européenne. Code de pratique sur la transparence du contenu généré par IA. 2026.
[R14] Union européenne. Règlement (UE) 2024/1689, article 50. 2024.
[R15] Bureau du Copyright des États-Unis. Copyright et intelligence artificielle, Partie 2 : Copyrightabilité. 2025.
[R16] OMPI. IA générative : Naviguer dans la propriété intellectuelle. 2024.
[R17] NIST. Cadre de gestion des risques de l'IA : Profil IA générative (NIST AI 600-1). 2024/2026.
[R18] UNESCO. Rapport du Groupe d'experts indépendants sur l'intelligence artificielle et la culture. 2025.
[R19] Agence internationale de l'énergie. Énergie et IA. 2025.
[R20] Agence internationale de l'énergie. La consommation électrique des centres de données a bondi en 2025. 2026.
[R21] Google. Protocole de paiement des agents (AP2). 2025.
[R22] Fonds monétaire international. Comment l'IA agentique va transformer les paiements. 2026.
[R23] Division des statistiques des Nations unies. Système national de comptes 2025. 2025.
[R24] Google. Démo des lunettes Android XR et aperçu de la plateforme. 2025.
[R25] Meta. Présentation d'Orion, prototype de lunettes de réalité augmentée. 2024/2025.
[R26] Apple Developer. Streaming fovéalisé pour visionOS. 2026.
[R27] Khronos Group. Extensions OpenXR et Spatial Entities. 2025.
Annexe G : Institutions de publication
Alliance internationale des normes d'indexation des audiovisuels d'IA (IAISA) : identité des actifs audiovisuels, métadonnées lisibles par machine, provenance et interfaces de collaboration du marché.
Association internationale des producteurs de films d'IA (IFAIFPA) : systèmes de production natively IA, voies technologiques, coordination professionnelle, évaluation et réseaux de producteurs.
Association du Festival International du Film de l'Intelligence Artificielle de Hong Kong (HKAIIFF) : art cinématographique AI-native, écosystèmes de créateurs, pratiques festivalières et collaboration en ville internationale.
Informations clés
- Date de sortie
- 2026-07-17
- Éditeurs
- Association · IFAIFPA · IAISA
- Structure
- Cinq parties majeures + chapitre du Manifeste
- Mode de lecture
- Texte intégral en ligne
- Théorie d'évaluation
- Théorie du Conductor
FAQ
Quel est le contenu du livre blanc ?
L'ère du cinéma IA, la définition du cinéma AI-native, le critère de 51%+, la restructuration de la chaîne industrielle et les perspectives futures, ainsi que le Manifeste du Cinéma AI-Native.
Qui l'a publié ?
L'Association du Festival International du Film de l'Intelligence Artificielle de Hong Kong, l'IFAIFPA et l'IAISA, conjointement le 17 juillet 2026.
Puis-je le télécharger ?
Aucun téléchargement n'est fourni. Le texte intégral est disponible en ligne sur cette page. Les citations doivent mentionner la source.
Comment le critère de 51%+ est-il défini dans le livre blanc ?
Il ne s’agit pas de la proportion de pixels – il évalue si les flux de travail liés à l'IA jouent un rôle prépondérant pondéré dans les décisions créatives fondamentales.
Lié · Whitepaper officiel Index.Film (IAISA · Standard IXF V6) →