WP / 2026INDUSTRIEWEIßBUCH · ONLINE-LESEN

Das weltweit erste systematische Weißbuch zur KI-Filmindustrie

Verband des Internationalen KI-Filmfestivals HongkongIFAIFPA (Internationale Föderation der Verbände der KI-Filmproduzenten)IAISA (Internationale Allianz für Audiovisuelle Vermögenswerte und KI-Indexierungsstandards)

Gemeinsame Veröffentlichung

Das weltweit erste systematische Weißbuch zur KI-Filmindustrie ist das AI Film Industry Whitepaper 2026, das am 17. Juli 2026 gemeinsam von der Hong Kong AI International Film Festival Association, der IFAIFPA und der IAISA veröffentlicht wurde; der vollständige Text steht auf hkaiiff.org zum Online-Lesen zur Verfügung, und Zitate müssen die Quelle nennen. Es ist das weltweit erste systematische Weißbuch, das sich auf die KI-Filmindustrie konzentriert. Das Weißbuch behandelt fünf Bereiche: den Einzug der Ära der KI-Filme, die Definition von KI-nativem Kino, den Bewertungsstandard „51%+ KI-Beteiligung“, strukturelle Veränderungen in der KI-Audiovisuellen Wertschöpfungskette sowie zukünftige Branchenentwicklungen; es schlägt die Conductor-Theorie als Bewertungsrahmen vor und enthält ein eigenes Kapitel zum Manifest für KI-natives Kino. Der vollständige Text ist auf dieser Seite zum Online-Lesen verfügbar. Zitate müssen die Quelle nennen.

Zusammenfassung

Die KI-Kino-Debatte hat die frühe Frage, ob Produktionsteams generative Werkzeuge nutzen werden, hinter sich gelassen. Die strategische Frage ist nun, wie generative Videomodelle, native Audio-Video-Modelle, interaktive Weltmodelle, Agenten, räumliches Computing und Provenance-Infrastruktur zusammenwirken, um eine neue Mediumart, ein neues Industriesystem und ein neues Governance-Problem zu schaffen. Das Ergebnis ist nicht einfach nur eine kostengünstigere Version der konventionellen Filmproduktion. Es handelt sich um einen Übergang von festgelegten audiovisuellen Dateien zu kulturellen Systemen, die über die Zeit generieren, reagieren, bestehen, Transaktionen durchführen und verantwortlich bleiben können.

Dieses Whitepaper definiert KI-natives Kino als audiovisuelles Werk, in der künstliche Intelligenz eine materielle, konstitutive Rolle in den zentralen kreativen Dimensionen – einschließlich Narration, Bild, Ton, Charakter und Interaktion – spielt und in der das Werk nicht vollständig vom KI-gestützten Prozess getrennt werden kann, der sie ermöglicht. Um die künstlerische Urteilskraft von der technischen Klassifikation zu trennen, führt das Papier ein Dual-Achs-Modell ein: Creative Agency P0–P4 und Runtime Generation R0–R4. Die Schwelle von 51%+ ist ein Qualifikationsmarker auf der Achse der kreativen Agency; sie ist keine Pixelzahl, keine Modellanzahl oder keine Qualitätsnote.

Die technische Grenze verschiebt sich von kurzformiger visueller Plausibilität zu langfristiger Kohärenz. Identität, Geografie, Kausalität, Objektpersistenz, emotionale Entwicklung und Kontinuität zwischen Bild und Ton müssen über Szenen und Sitzungen hinweg stabil bleiben. Echtzeitsysteme fügen eine ingenieurtechnische Anforderung hinzu: Der Stack muss Absicht interpretieren, Weltzustand beibehalten, Modelle zuweisen, innerhalb eines Latenzbudgets generieren, Sicherheitsrichtlinien durchsetzen, Ereignisse protokollieren und bei Störungen sicher in einen eingeschränkten Betrieb übergehen. Öffentliche Systeme haben bereits bedeutende Echtzeit-Interaktionen demonstriert, doch langfristige Stabilität, offene Aktionen, Mehrbenutzer-Konsistenz, Kostenkontrolle und Governance bleiben Produktisierungsbarrieren [R07–R10].

KI-Brillen und räumliches Rechnen erweitern diesen Übergang in die physische Welt. Eine Kamera, ein Mikrofon, Blicksignale, Positionsdaten und Umweltverständnis können zu narrativen Eingaben werden; eine Figur kann eine Person über Orte und Zeit begleiten. Dies schafft neue Formen – ortsbezogene Ereignisse, geteilte Erzählungen im öffentlichen Raum, persistente Begleiter und private Überlagerungen –, stellt aber auch stärkere Pflichten hinsichtlich der Privatsphäre von unbeteiligten Personen, Aufmerksamkeit, Einwilligung, Gedächtnis und sicherem Unterbrechen [R24–R27] auf.

Der Markt wird sich um fünf neue Knappheiten neu organisieren: vertrauenswürdige Entdeckung, künstlerisches Urteil, persistente Charaktere und Welten, rechtliche Erlaubnis und langlebige Gemeinschaftsbeziehungen. Die Erlöse können sich vom Kino und der Lizenzierung hin zu Welt-Abonnements, Charakterdiensten, interaktiven Events, Unternehmensumgebungen, Asset-Diensten und agentenvermittelten Anfragen ausdehnen. Doch die kontinuierliche Generierung verwandelt auch einen Teil eines Content-Unternehmens in einen Cloud-Service-Betreiber. Nachhaltiges Wachstum hängt daher von den Unit Economics pro akzeptierter Minute, pro Session und pro aktiver Welt – nicht von den Kosten der Produktion eines einzelnen Kandidatenclips – ab.

Die Asset-Basis erweitert sich von einem fertigen Film zu einer Asset-Familie: Werk, Workflow, Charakter, Welt, Verhalten und Aufzeichnung. Jeder Asset-Typ benötigt eindeutige Identifikatoren, Versionslogik, Berechtigungshüllen und Lebenszykluskontrollen. Index.Film™ positioniert sich als Infrastruktur für Identifikation, Aufzeichnung, Suche und Zusammenarbeit. Das Indexieren erzeugt, überträgt oder bestätigt keine rechtlichen Rechte; die Einbeziehung ist keine Empfehlung.

Provenienzprotokolle können zeigen, dass Aussagen mit einem Asset verknüpft sind und nicht verändert wurden, bestimmen aber nicht, ob der Inhalt selbst wahr oder wertvoll ist [R11].

Der Beitrag lehnt den lockeren Gebrauch des Begriffs „KI-Welt-BIP" ab, als ob es eine zusätzliche nationale Wirtschaft sei. Er schlägt Human–AI Dual-Domain Value Accounts und eine KI-native audiovisuelle Satellitenrechnung vor. Diese Rahmenwerke unterscheiden menschliche Eingaben, KI-Ausführung, Nutzung virtueller Welten, beobachtbare reale-wirtschaftliche Erträge und Zwischentransaktionen, sodass Investitions- und Politikanalysen doppelte Zählung vermeiden und mit den Grundsätzen des volkswirtschaftlichen Rechnungswesens kompatibel bleiben [R22–R23].

Die Prognose für 2026–2035 gliedert sich in drei Beobachtungsfenster: eine Infrastrukturphase, eine Formexpansionsphase und eine persistente-Welt-Phase. Vier Szenarien – gelenktes Wachstum, Plattformumschließung, Vertrauenskrise und offene Welten – werden verwendet, um die strategische Widerstandsfähigkeit zu testen. Die zentrale Empfehlung lautet nicht, auf ein einzelnes Datum oder Modell zu setzen. Es geht darum, tragbare Vermögenswerte, kreative Beweise, Governance-Pipelines, weltbetreibende Fähigkeiten und menschlich-AI-Kompetenzen zu entwickeln, die unter mehreren Zukunftsszenarien ihren Wert behalten.

KERNVORSTELLUNGKI-natives Kino ersetzt das Kino nicht mit einem Modell. Es verleiht bewegten Bildern die Fähigkeit, zu generieren, zu reagieren, zu erinnern, zu entwickeln und Transaktionen durchzuführen, während menschliche Absicht, Verantwortung und öffentlicher Wert bewahrt werden.

Fünfzehn Kernurteile

01

Die Produktionskosten werden neu geschrieben, nicht automatisch auf Null getrieben

Die Generierung von E1/E2-Kandidaten wird günstiger, während Kontrolle, Auswahl, Revision, Erlaubnis und Governance zu einem größeren Anteil der Kosten eines akzeptierten fertigen zweiten Werks werden.

02

KI-nativ ist eine kreative Methode, kein Werkzeuglabel

Die Rahmenklassifizierung hängt von der Rolle der KI bei den zentralen kreativen Entscheidungen und davon ab, ob das Werk unabhängig vom KI-gestützten Prozess existieren kann.

03

Natives Audio-Video und präzise Bearbeitbarkeit sind die nächste wettbewerbsfähige Front

E1/E2 Der Markt bewegt sich von der Bildqualität auf einen Schuss hin zur Synchronisation, Identitätskontinuität, gezielter Revision, Mehrschusskontrolle und physikalischer Plausibilität.

04

Weltmodelle machen bewegte Bilder ausführbar

E2/E3 · Ein Weltmodell muss handlungsabhängige Zustände, Gedächtnis und kausale Beziehungen aufrechterhalten, anstatt lediglich ein visuell plausibles nächstes Bild vorherzusagen.

05

Echtzeit-Generierung ist erlebnisorientiert, aber noch keine universell ausgereifte Plattform

E2 · Öffentliche Demonstrationen zeigen 720p, 20–24 fps und minute-scale Interaktion; langfristige Stabilität, weite Kontrolle, Kosten und Sicherheit bleiben Adoptionsschwellen [R07–R10].

06

Knappheit verlagert sich von der Produktion hin zu Vertrauen und Entdeckung

E1/E2 Bewertung, Identität, Provenienz, rechtliche Erlaubnis, Gemeinschaft und Marke werden wertvoller, wenn der Inhaltsangebot expandiert.

07

Zuschauerinput wird zu Handlungsmacht

E2/E3 Stimme, Blick, Gestik, Ort und Gruppenhandlung können den Zustand verändern, doch ist die Interaktion nur dann bedeutungsvoll, wenn das System Konsequenzen versteht, erinnert und darauf reagiert.

08

KI-Brillen verwandeln die physische Welt in eine narrative Schnittstelle

E2/E3 Immer verfügbare Sensorik und private Anzeigen können Orte, Personen und Ereignisse zu erzählenden Bedingungen machen, sofern Privatsphäre und Aufmerksamkeitsrechte Vorrang haben.

09

Die Konvergenz von Film und Spiel wandelt sich von geteilter IP zu geteilten Welten

E1/E2 Charaktere, Weltzustände, Regeln und Provenienz können durch Film, Spiele, Live-Media, räumliche Erfahrungen und Community-Erstellung wiederholt dargestellt werden.

10

Die Asset-Einheit erweitert sich von einem Film zu einer Asset-Familie

Framewo Works, Workflows, Charaktere, Welten, Verhaltensweisen und Interaktionssysteme erfordern unterschiedliche Metadaten, Versionslogik und Berechtigungsgrenzen.

11

Indexierung ist kein rechtlicher Titel, und Provenienz ist kein Wahrheitsurteil

E1/Gover Index.Film™ unterstützt die Identifizierung, Aufzeichnung, Suche und Zusammenarbeit; es ersetzt keine rechtliche Registrierung, keine gerichtliche Feststellung oder kritische Bewertung.

12

Agenten schaffen einen maschinenseitigen Content-Markt

E2/E3 Agenten können suchen, vergleichen, Erlaubnis anfordern und Zahlungen auslösen, doch muss die probabilistische Absicht von der deterministischen Autorisierung und Abwicklung getrennt bleiben [R21–R22].

13

Die KI-Wirtschaft benötigt Konten, nicht ein fiktives zweites BIP

Framewo Messung sollte menschliche Eingabe, KI-Ausführung, virtuelle Nutzung und reale Rückkehr trennen und die Zwischenschritt-Doppelzählung entfernen.

14

Transparenz wird zur systemischen Verpflichtung

E1 Chinas Kennzeichnungsregeln und die EU-Transparenzpflichten deuten beide auf explizite Offenlegung, maschinenlesbare Kennzeichnung und Verantwortlichkeitsprotokolle hin [R12–R14].

15

Governance und Infrastruktur werden 2035 so sehr wie die Modellkapazität prägen

**E3/E4** Offene Standards, Energie, Rechenleistung, kulturelle Vielfalt und Vorteilsverteilung werden entscheiden, ob der Sektor zu einer pluralen Kreativwirtschaft wird oder zu einem geschlossenen Mietsystem.

SPEZIALKAPITEL · MANIFEST

Manifest für KI-natives Kino

  1. KI-natives Kino ist kein kostengünstiger Ersatz für das traditionelle Kino; es ist eine aufstrebende Kunstform, die durch menschlich-maschinelle Zusammenarbeit und generative Systeme entsteht.
  2. Der menschliche Wert verschwindet nicht, wenn Werkzeuge leistungsfähiger werden. Schöpfer bleiben für Absicht, Regeln, Auswahl, Komposition und die Folgen der Veröffentlichung verantwortlich.
  3. Der 51%+ Marker misst substantielle kreative Handlungsfähigkeit. Er ist kein Pixelverhältnis, keine Modellanzahl oder keine künstlerische Qualitätsskala.
  4. Lineare Filme, interaktive bewegte Bilder, generative Live-Medien, räumliche Narrative und persistente Welten können koexistieren. Eine neue Mediumform erfordert nicht das Verschwinden der alten.
  5. KI-native Werke sollten ausreichende kreative Beweise bewahren, um Identifizierung, Prüfung und Rechenschaftspflicht zu unterstützen, während legitime vertrauliche Informationen geschützt werden.
  6. Provenanz ist kein Wahrheitsurteil, Indexierung ist keine rechtliche Titulierung, und eine technische Kennzeichnung ist keine Empfehlung. Vertrauen beginnt mit einer ehrlichen Aufstellung der institutionellen Grenzen.
  7. Schöpfer, Darsteller und Rechteinhaber sollten klare, durchsetzbare Bedingungen für digitale Repliken, Trainingsnutzung, abgeleitete Generierung, Territorium, Dauer, Vergütung und Rücknahme haben.
  8. Weltmodelle und KI-Brillen können bewegte Bilder in den physischen Raum einbringen, aber keine neue Erfahrung sollte Privatsphäre, Kinderschutz, Autonomie der Aufmerksamkeit oder kulturelle Vielfalt opfern.
  9. Werke, Workflows, Charaktere, Welten und Verhaltensweisen sollten überprüfbare, suchbare und lizenzierbare Asset-Netzwerke bilden, damit sich der Wert fair unter Schöpfern, Plattformen und Gemeinschaften verteilen kann.
  10. Dieses Manifest, sein Klassifikationsrahmen und dieses Weißbuch sind für eine jährliche Revision konzipiert. Eine Definition für eine neue Ära muss offen für Beweise und Korrektur bleiben.
01

PARADIGMENVERSCHIEBUNG

Warum Kino zu einer ausführbaren Welt wird

TEIL PROPOSITION Das feste audiovisuelle File wird einem kulturellen Rechensystem weichen, das generieren, reagieren, erinnern und sich entwickeln kann.

01 Der Technologie-Inflectionpunkt in der globalen Filmindustrie · 02 Definition von KI-nativem Kino: Das Dual-Achs-Modell und der 51%+ Marker · 03 Die G0–G5-Evolution von KI-Audiovisuellen Medien · 04 Methodik, Evidenzgrade und Standardsentwicklung

01Der Technologie-Inflectionpunkt in der globalen Filmindustrie

KAPITEL THESISKino erlebt gleichzeitig fünf strukturelle Verschiebungen: von Produktionsknappheit zu einer Fülle generierter Inhalte; von starren Workflows zu Modellorchestrierung; von Content-Discovery zu Trust-Discovery; von einem fertigen File zu einer laufenden Dienstleistung; und von einem Titel zu einer Asset-Familie. Diese Verschiebungen eliminieren nicht die konventionelle Industrie. Sie verändern lediglich, welche Kapazitäten knapp sind, wo Kosten anfallen und wie Wert gemessen wird.
INDUSTRIE IMPLIKATIONENDie strategische Einheit ist nicht mehr das Modell oder der Clip. Es ist die Fähigkeit der Organisation, über einen austauschbaren Kapazitätsstapel hinweg akzeptable, rechtmäßige und wiederholbare Ergebnisse zu produzieren.
HAUPTURTEILKI wird die Filmkosten nicht auf Null reduzieren. Sie schreibt die Kostenstruktur neu und verschiebt den Wert von Exekutionskapazitäten hin zu Urteil, Systemen und Vertrauen.

ABILDUNG 1 · Von festen Files zu Kulturrechnenden Systemen

1.1 Von generativer Versorgung zu Systemwettbewerb

Die früheste Marktnarrative konzentrierte sich auf den fallenden Preis für die Produktion eines plausiblen Bildes. Diese Metrik ist unvollständig. Ein professionelles Projekt bezahlt für Absicht, Konsistenz, Auswahl, Revision, Performance-Steuerung, Ton, Rechteklärung, Dokumentation und Release-Verantwortung. Wenn die Anzahl der Kandidatenausgaben wächst, können die Kosten der Entscheidung, was akzeptiert werden kann – und der Beweis dafür – steigen. Das Management sollte daher die Gesamtkosten pro akzeptierter fertiger Sekunde, die Anzahl der erforderlichen Revisionen, die Abdeckung der Kontrolle und den Anteil der Assets, die tragbar bleiben, wenn ein Modell ersetzt wird, verfolgen.

1.2 Fünf strukturelle Migrationen

Der Produktionsprozess wandelt sich von knapper Drehkapazität zu knappem akzeptablen Output; die Organisation wandelt sich von starren Abwicklungen zwischen Abteilungen zu einer Orchestrierung über Menschen, Modelle und Werkzeuge; die Distribution wandelt sich von Inhaltsknappheit zu vertrauenswürdiger Entdeckung; das Produktdesign wandelt sich von einem Endmaster hin zu einer aufrechterhaltenen Beziehung; und die Asset-Basis wandelt sich von einem abgeschlossenen Titel hin zu einer wiederverwendbaren Familie von Welten, Charakteren, Workflows und Aufzeichnungen. Jede Migration schafft einen anderen Wettbewerbsvorteil und ein anderes Fehlermuster.

1.3 Die Implikation der Entscheidung: Aufbau einer austauschbaren Kompetenzstapelung

Kein Studio sollte seine kreative Erinnerung von der Schnittstelle eines einzigen Anbieters oder von einem einzigen Generierungsmodell abhängig machen.

Eine robuste Systemarchitektur trennt Story- und Weltzustand, Asset-Speicherung, Modellrouting, Evaluation, Rechte, Provenienz und Delivery. Modelle können dann bei Änderungen von Leistung, Kosten oder Richtlinien ausgetauscht werden. Der dauerhafte Vorteil ist die Qualität der kreativen Entscheidungen der Organisation und die institutionelle Erinnerung, nicht der vorübergehende Zugang zu einem einzelnen Benchmark-Führer.

TABELLE 1 · KAPITEL ANALYTISCHER RAHMEN

Struktureller WandelAlte KnappheitNeue KnappheitSteuerungsindikator
ProduktionSchusskapazitätAkzeptabler OutputKosten pro akzeptierter Sekunde
OrganisationFester ProzessModellorchestrierungÜberarbeitung / Portabilität
VertriebInhaltsbereitstellungVertrauensvolle EntdeckungQualifizierte Reichweite / Vertrauen
ProduktAbgeschlossener DateiLaufende BeziehungBeibehaltung / Weltzustand
VermögenswerteEin TitelVermögenswertfamilieWiederverwendung / Vollständigkeit der Erlaubnis

02Definition von KI-nativem Kino: Das Dual-Achs-Modell und der 51%+-Markierung

KAPITEL THESISEine binäre Kennzeichnung – KI oder nicht-KI – kann das aufkommende Feld nicht beschreiben. Dieser Beitrag trennt die kreative Handlungsfähigkeit von der Laufzeitgenerierung. Die P-Achse misst den Grad, in dem KI materielle Auswirkungen auf die grundlegenden kreativen Entscheidungen hat. Die R-Achse misst, wie viel des erlebten Werkes während der Nutzung generiert wird. Ein Werk kann tief KI-nativ sein, aber vollständig vorgerendert, oder leicht KI-autoriert, aber stark anpassungsfähig zur Laufzeit.
INDUSTRIE IMPLIKATIONENDas Dual-Achs-Modell ist eine Branchensprache für Klassifizierung, Beweise und Vergleiche. Es ist keine Urheberrechtsentscheidung und misst keine künstlerische Qualität.
REGELUNGSGRENZEDer 51%+ Marker ist eine Qualifikationsgrenze auf der Achse der kreativen Handlungsfähigkeit, keine Qualitätsnote, keine rechtliche Vermutung und keine Pixelanzahl.

FIGUR 2 · Die Dual-Achsen-Karte der KI-nativen Kinos

2.1 Die P-Achse: fünf Dimensionen der kreativen Agentur

P wird über Erzählung, Bild, Ton, Charakter und Interaktion bewertet. Prüfer fragen, ob die KI die Struktur der Arbeit beeinflusst, nicht ob ein KI-Werkzeug eine Datei berührt. P0 bezeichnet keine generative Rolle; P1, lokale Unterstützung; P2, tiefes Mitwirken in einer Kernphase; P3, substantielle Führung über die gewichteten kreativen Dimensionen; und P4, eine Arbeit, deren künstlerische Identität selbst ein generatives System ist. Der 51%+ Marker zeigt den Eintritt in P3 an, wenn offengelegte Gewichte und Beweise zeigen, dass die KI die relevanten Dimensionen materiell führt.

2.2 Die R-Achse: Laufzeitgenerierung

R0 ist vollständig vorproduzierte Wiedergabe. R1 passt sich vor der Präsentation an; R2 kombiniert vorproduzierte und generierte Komponenten; R3 generiert den Großteil des erlebten Inhalts als Reaktion auf die Sitzung; und R4 ist kontinuierlich generiert, zustandsbehaftet und nicht exakt reproduzierbar. Da die Laufzeitgenerierung das operative Risiko erhöht, muss R unabhängig von P bewertet werden. Ein hoher R-Wert erfordert Latenzbudgets, Zustandskontrollen, Sicherheitsrichtlinien, Protokollierung, Fallbacks und einen eindeutigen Verantwortlichen.

2.3 Das Dirigentenprinzip und Verantwortung

Menschliche Autorenschaft in einem KI-nativen Prozess ähnelt oft dem Dirigieren: Intention definieren, Systeme auswählen, Constraints konstruieren, entscheiden, was abgelehnt wird, Outputs arrangieren und Verantwortung übernehmen. Das macht nicht jede Eingabe zu einem autorenhaften Werk. Es bedeutet, dass kreative Kontrolle durch Entscheidungen und ihre Konsequenzen nachgewiesen werden muss. Das relevante Dokument ist eine Kette von Entscheidungen – nicht ein Screenshot einer Eingabe und keine Behauptung, dass das Modell allein gehandelt hat.

TABELLE 2 · KAPITEL ANALYTISCHER RAHMEN

EbeneP-Achse: Kreative AgenturR-Achse: Laufzeitgenerierung
0Keine generative KIVollständig vorproduziert
1Lokale UnterstützungVorsitzungsanpassung
2Tiefe Rolle in einer KernphaseGemischte vorproduzierte / generierte Inhalte
351 %+ substantielle FührungDer Großteil der Inhalte wird live generiert
4Die Arbeit ist ein generatives SystemBeständig und nicht vollständig reproduzierbar

03Die G0–G5-Evolution der KI-Media

KAPITEL THESISDas Modell G0–G5 beschreibt eine Evolution des Mediums von der traditionellen Produktion zu beständigen generierten Welten. Es handelt sich nicht um eine Reifebewertung für Organisationen oder um die Behauptung, dass jede Stufe die vorherige ersetzt. Ein Studio kann Produkte in mehreren Stufen gleichzeitig betreiben, und ein festes lineares Filmwerk kann künstlerisch überlegen sein gegenüber einem rechnerisch intensiveren Format.
INDUSTRIE IMPLIKATIONENÜbergänge zwischen den Stufen sollten nur anerkannt werden, wenn eine neue Fähigkeit mit zuverlässigem Workflow, Nutzerwert und Governance nachgewiesen wird – nicht, wenn nur ein werbliches Beispiel erscheint.
ADOPTION PRINZIPNeue Stufen erweitern den Ausdrucksbereich von bewegten Bildern. Sie machen frühere Formen nicht obsolet.

FIGURE 3 · Die G0–G5-Entwicklung von KI-Audiovisuellen Medien

3.1 Was G0–G5 bedeuten

G0 ist konventionelle audiovisuelle Produktion. G1 nutzt KI als assistives Werkzeug. G2 generiert wesentliche Komponenten. G3 ist KI-nativ gemäß dem Test der kreativen Handlungsfähigkeit. G4 führt Echtzeit-generierte, auf das Publikum reagierende Inhalte ein. G5 beschreibt eine beständige Welt mit dauerhafter Identität, mehrbenutzerbasiertem Zustand, sozialen Regeln und einer Wirtschaft. Die Klassifizierung konzentriert sich auf die Ontologie des Werks: ob das Ergebnis eine Datei, ein generiertes Werk, eine interaktive Erfahrung oder ein operatives Weltmodell ist.

3.2 Die Position 2026: sichtbare Fähigkeiten, unvollständige Institutionen

Bis 2026 gibt es starke Belege für Produktionsworkflows in G2 und G3, während G4 die öffentliche Produktentwicklung durch interaktive Weltmodelle und latenzarme Generierung [R07–R10] erreicht hat. G5 bleibt ein Szenariohorizont. Seine einzelnen Komponenten – Identität, virtuelle Ökonomien, Agenten, räumliche Schnittstellen und beständiger Zustand – existieren getrennt, aber ihre Kombination zu einer offenen, dauerhaften und steuerbaren kulturellen Welt hat keine allgemeine Reife erreicht.

3.3 Stufenpforten und Austrittsbedingungen

Von G2 nach G3 ist ein Nachweis einer integrierten Mensch–KI-Autorenschaft erforderlich, nicht isolierte generierte Aufnahmen. Von G3 nach G4 ist eine Reaktionsfähigkeit in Echtzeit, Zustandserhaltung, begrenzte Latenz, Sicherheit und Rückfalleinstellung erforderlich. Von G4 nach G5 sind Mehrbenutzerkonsistenz, Identität, wirtschaftliche Regeln, Streitbeilegung und langfristige Bewirtschaftung erforderlich. Ein Produkt sollte auf der höchsten Stufe beschrieben werden, auf der es zuverlässig funktioniert, nicht auf der höchsten Stufe, die in seiner Roadmap imaginierbar ist.

TABELLE 3 · ANALYTISCHER RAHMEN

ÜbergangZugewandte FähigkeitMindestnachweis
G2 → G3Integrierte Mensch–KI-ErstellungKreative Evidenz / kohärenter Arbeitsablauf
G3 → G4Reaktionsfähigkeit in EchtzeitLatenz / Zustand / Rückfall / Sicherheit
G4 → G5Beständiger mehrbenutzerweltIdentität / Konsistenz / Wirtschaft / Governance

04Methodik, Evidenzgrade und Evolution der Standards

KAPITEL THESISSchnelllebende Technologie erzeugt die Versuchung, jede Demonstration als gesicherte Markttatsache zu behandeln. Dieser Beitrag verwendet vier Evidenzgrade: E1 für implementierte kommerzielle oder institutionelle Fakten; E2 für öffentliche Demonstrationen und technische Berichte; E3 für Forschungsprototypen; und E4 für Szenarienableitung. Der Grad beschreibt, was bekannt ist, nicht wie wichtig die Behauptung sein kann.
INDUSTRIE IMPLIKATIONENJede Prognose muss ihre technischen, ökonomischen, apparativen, governance- und kulturellen Annahmen benennen, und jede Jahresherausgabe muss berichten, welche früheren Prognosen bestätigt, verschoben, herabgestuft oder zurückgezogen wurden.
EDITORIAL PRINCIPLEEvidenzgrade kommunizieren, wie weit die Evidenz reicht. Sie sind keine dekorativen Vertrauenslabels.

ABBILDUNG 4 · Vier Evidenzstufen und die jeweils zulässigen Formulierungen

4.1 Vier Evidenzstufen und die jeweils zulässigen Formulierungen

E1 unterstützt Sprache wie implementiert, verfügbar oder erforderlich – innerhalb einer angegebenen Jurisdiktion oder Produktgrenze. E2 unterstützt nachgewiesene oder berichtete, nicht universell ausgereifte Fälle. E3 unterstützt Forschung zeigt eine mögliche Fähigkeit, keine kommerzielle Versprechung. E4 muss konditional formuliert werden: wenn definierte Annahmen gelten, wird eine zukünftige Konfiguration plausibel. Unternehmensberichtete Leistung bleibt E2, es sei denn, sie hat eine sinnvolle unabhängige Validierung.

4.2 Technologiebeobachtung und Prognosen

Der Forschungsprozess trennt Fähigkeit, Zuverlässigkeit, Erschwinglichkeit, Einsetzbarkeit und Legitimität. Eine Benchmarkverbesserung ist ein Fähigkeitssignal; sie ist kein Beweis für Produktionszuverlässigkeit. Eine öffentliche Demo ist ein Einsetzbarkeitssignal; sie ist kein Beweis für nachhaltige Unit Economics. Eine Verordnung ist eine Legitimitätsbeschränkung; sie kann auch Infrastrukturnachfrage schaffen. Prognosen werden aus der Wechselwirkung dieser Variablen erstellt, nicht aus einer einzigen exponentiellen Leistungskurve.

4.3 Jährliche Überarbeitung und Widerlegbarkeit

Das Weißbuch sollte ein Prognestregister mit Annahmen, führenden Indikatoren und widerlegender Evidenz beibehalten. Wenn eine Prognose fehlschlägt, sollte die Ausgabe den Grund dokumentieren. Diese Disziplin verwandelt die Publikation in ein kumulatives öffentliches Forschungsprogramm und verhindert, dass institutionelle Glaubwürdigkeit von Unsicherheitstheater abhängt.

TABELLE 4 · ANALYTISCHER RAHMEN DES KAPITELS

GradeEvidencePermitted languageAvoid
E1Kommerzielle / institutionelle FeststellungUmgesetzt / verfügbarVoraussetzungen auslassen
E2Öffentliche Demo / technischer BerichtDemonstriert / berichtetUniversell ausgereift
E3ForschungsprototypForschung zeigt anKommerzielles Versprechen
E4SzenarisableitungWenn die Annahmen geltenBestimmte Sprache
02

TECHNISCHE GRUNDLAGEN

Von Videobasismodellen zu Weltmodellen

TEIL PROPOSITION Der Wettbewerb wandelt sich von der Bildqualität einzelner Aufnahmen hin zu Kontrolle, Gedächtnis, Zustandsmanagement, Echtzeitreaktion und operationeller Sicherheit.

05 Die technische Evolution von Videobasismodellen · 06 Die echten technischen Engpässe der Feature-Length-Generierung · 07 Weltmodelle: Von der Vorhersage des nächsten Bildes zur Simulation einer Welt · 08 Referenzarchitektur für Echtzeit-KI-natives audiovisuelles System · 09 KI-Agenten und virtuelle Darsteller

05Die technische Evolution von Videobasismodellen

KAPITEL THESISDie Videogenerierung entwickelt sich von einem Pixelsyntheseproblem zu einem audiovisuellen Foundationmodel-Stack. Die kritischen Ebenen umfassen Daten und Evaluation, räumlich-zeitliche Repräsentation, gemeinsame Audio-Video-Generierung, Bearbeitung und Kontrolle sowie Lieferungsregulierung. Der industrielle Wettbewerb wandelt sich von der Attraktivität eines Best-Samples hin zur Wiederholbarkeit, lokaler Bearbeitbarkeit, Identitätsstabilität und akzeptabler Output-Ökonomie.
INDUSTRIE IMPLIKATIONENDie Modellbeschaffung sollte auf der Basis von Kontrollabdeckung, Konsistenz, Revisionsumfang, Kosten pro akzeptierter Sekunde und Governance-Fähigkeit erfolgen – nicht auf dem beeindruckendsten Demonstrationsreel eines Anbieters.
KAUFMETRIKEin Produktionsmodell ist wertvoll, wenn es gelenkt, überarbeitet und dokumentiert werden kann – nicht nur wenn es überraschen kann.

FIGUR 5 · Der Stack der Videobasismodell-Kompetenzen

5.1 Von Pixelsynthese zu audiovisuellen Foundationmodellen

Diffusions- und Transformer-basierte Systeme haben Bewegung, Komposition, Prompt-Einhaltung und Dauer verbessert, während native Audio-Video-Ansätze den Ton von der Nachproduktion hin zu einer geteilten zeitlichen Repräsentation bewegen [R02–R06]. Das technische Ziel ist nicht mehr ein einzelner kohärenter Shot. Es ist eine kontrollierbare Repräsentation von Identität, Aktion, Kamera, Ton, Timing und physikalischem Kontext, die wiederholt bearbeitet werden kann, ohne dass unzusammenhängende Elemente kollabieren.

5.2 Kontrollierbarkeit als industrielle Trennlinie

Professionelle Workflows erfordern selektive Änderungen: eine Geste ändern, ohne das Gesicht zu verändern; einen Shot verlängern, ohne die Garderobe zu verschieben; Dialoge ersetzen, während das Timing der Darbietung erhalten bleibt; eine Kamera bewegen, während die Geographie stabil bleibt. Die Kontrolle sollte daher als Abdeckung über kreative Variablen und als Größe des unbeabsichtigten Explosionsradius nach der Revision gemessen werden. Ein Modell, das für jede Änderung eine vollständige Regeneration erfordert, verlagert die Kosten von der Drehphase zur Iteration.

5.3 Native Audio-Video und eine gemeinsame Timeline

Gemeinsame Generierung kann die Lippen-Synchronisation, das Umgebungstiming und die Kopplung von Rhythmus, Sprache und Aktion verbessern. Sie erweitert auch die Rechte und die Sicherheitsoberfläche. Ein Produktionsprotokoll muss identifizieren, welche Stimmen, Musik, Effekte und Performance-Signale generiert, angepasst oder bezogen wurden, und wie sie genehmigt wurden.

Geteilte zeitliche Generierung sollte daher von geteilter zeitlicher Provenienz begleitet werden.

TABELLE 5 · KAPITEL ANALYTISCHER RAHMEN

DimensionFrageBeispiel-Metrik
KontrolleKann ein Element allein geändert werden?Kontrollabdeckung
KonsistenzBesteht die Identität weiter?Identität / Szenen-Drift
EditierbarkeitKann die Revision lokal bleiben?Revisions-Explosionsradius
WirtschaftswissenschaftenWelcher Output ist akzeptabel?Kosten pro akzeptierter Sekunde
GovernanceKönnen Ursprung und Grenzen erfasst werden?Vollständigkeit des Feldes

06Die realen technischen Engpässe der Generierung von Spielfilmen

KAPITEL THESISDie Generierung von Spielfilmen wird nicht durch das Zusammenfügen besserer kurzer Clips gelöst. Ein langes Werk ist ein Problem des Zustandsmanagements, das Identität, Kostüme, Requisiten, Geografie, kausale Geschichte, Charakterwissen, Emotion, Sound und thematische Entwicklung umfasst. Das Hauptproduktionsasset ist eine Weltzustandsdatenbank, die sowohl von Menschen als auch von Modellen gelesen und aktualisiert werden kann.
INDUSTRIE IMPLIKATIONENDie Langform-Bewertung muss sich von der Bildqualität zu Kontinuität, kausaler Kohärenz, kontrollierter Revision und der Wiederherstellbarkeit des kreativen Zustands bewegen.
INGENIEURISCHE SCHLUSSFOLGERUNGEin Spielfilm ist kein langer Prompt. Es ist eine gelenkte Sequenz von Zustandsübergängen, die durch Beweise und menschliche Entscheidungen unterstützt wird.

ABILDUNG 6 · Der Weltzustands-Loop für Spielfilme

6.1 Ein Spielfilm ist eine Zustandsdatenbank

Jede Szene hängt von früher festgelegten Fakten ab: wer weiß was, welches Objekt sich bewegt, wie sich eine Beziehung verändert und welche physikalischen Einschränkungen noch gelten. Diese Fakten sollten explizit dargestellt werden, anstatt sie in einem undurchsichtigen Kontextfenster zu hinterlassen. Ein produktionsreifes Zustandsystem verknüpft die Story-Bibel, den Charakterzustand, die räumliche Karte, Asset-Versionen, genehmigte Aufnahmen und ungelöste Kontinuitätsrisiken. Die generierte Ausgabe wird dann gegen den Zustand geprüft, bevor sie kanonisch wird.

6.2 Hierarchische Planung: Welt, Sequenz, Szene, Aufnahme und Bild

Die Langform-Steuerung erfordert mehrere Planungshorizonte. Weltregeln beschränken das gesamte Projekt; Sequenzen tragen den dramatischen Fortschritt; Szenen aktualisieren Beziehungen und Informationen; Aufnahmen spezifizieren Handlung, Kamera und Sound; Bilder rendern das lokale Ergebnis. Bewertung und Regeneration sollten auf der kleinsten Ebene stattfinden, auf der das Problem korrigiert werden kann, ohne die höhere Absicht zu destabilisieren. Diese Hierarchie ermöglicht es auch verschiedenen Modellen und menschlichen Spezialisten, auf separaten Ebenen zu arbeiten.

6.3 Metriken jenseits der visuellen Qualität

Auf Einstellungsebene zählen die vollständige Ausführung einer Handlung und die Synchronisation von Ton und Bild. Auf Szenenebene ist die Kontinuität von Identität, Kostüm, Requisiten und Ort entscheidend. Auf Sequenzebene dominieren kausale und räumliche Kohärenz. Im Gesamtwerk müssen emotionale Entwicklung, Thema und Rhythmus nachvollziehbar bleiben. Besonders aussagekräftig sind oft die Kosten und die Zeit, die erforderlich sind, um das Werk nach einer erkannten Inkonsistenz wiederherzustellen.

TABELLE 6 · ANALYTISCHER RAHMENFÜR KAPITEL

SkalaMetrikFehlerbeispiel
SchussHandlung / SynchronisationGeste oder Lippenverschiebung
SzeneCharakter / Requisiten-ErhaltungsstichprobeKostüm- oder Objektmutation
SequenzRaum / KausalitätWidersprüchliche Position oder Ereignis
GesamtwerkEmotion / ThemaZerbrochene Motivation

07Weltmodelle: Vom Vorhersagen des nächsten Bildes bis zur Simulation einer Welt

KAPITEL THESISEin Weltmodell wird nicht durch seine Fähigkeit definiert, ein wie eine Welt wirkendes Bild zu erzeugen. Seine minimale Funktion besteht darin, einen Zustand aufrechtzuerhalten, der auf Aktionen reagiert und Gedächtnis, Kausalität und zukünftige Vorhersagen unterstützt. Interaktive Videoweltmodelle zeigen, dass generierte bewegte Bilder ausführbar werden können, doch die Grenze des Jahres 2026 bleibt durch Dauer, Kontrolle, Konsistenz, Kosten und Sicherheit [R07–R10] begrenzt.
INDUSTRIE IMPLIKATIONENWeltmodelle und Spieleengines sollten als komplementäre Systeme behandelt werden: Das erlernte Generieren erweitert die Möglichkeiten, während die explizite Simulation Determinismus, Werkzeuge und Kontrolle bietet.
TERMINOLOGIE DISZIPLINDie Erzeugung einer Szene ist nicht dasselbe wie die Aufrechterhaltung einer Welt; die Aufrechterhaltung einer Welt ist nicht dasselbe wie das sichere Betreiben eines kulturellen Raumes für mehrere Nutzer.

FIGUR 7 · Minimum-Interaktives-Weltmodell-Schleife

7.1 Die minimale interaktive Schleife

Die kleinste nützliche Schleife beobachtet Eingaben, interpretiert Absichten, wählt eine Aktion, aktualisiert den Zustand, generiert eine Antwort und schreibt das resultierende Ereignis in das Gedächtnis. Wenn das System nicht zwischen Beobachtung und maßgeblichem Referenzzustand unterscheiden kann oder nicht erklären kann, welche Aktion eine Änderung verursacht hat, handelt es sich um ein generatives Interface und nicht um ein operatives Weltmodell. Für das Kino ist diese Unterscheidung ausschlaggebend dafür, ob eine Handlung des Publikums eine dauerhafte narrative Bedeutung hat.

7.2 Die Kompetenzgrenze 2026

Öffentliche Systeme haben Echtzeit-Interaktion bei 720p und 20–24 fps über Minuten-Sessions demonstriert, während die Forschung Streaming-Generierung und längeres Gedächtnis [R07–R10] erforscht. Dies sind signifikante E2- und E3-Signale. Sie etablieren noch keine offene, mehrstündige Stabilität, uneingeschränkte Handlungstreue, Erschwinglichkeit auf einer breiten Gerätebasis, mehrbenutzer-Synchronisation oder ereignisbezogene Governance. Produktbehauptungen sollten diese Grenze beibehalten.

7.3 Zusammenarbeit mit Spieleengine-Infrastruktur

Eine praxisnahe Architektur in der nahen Zukunft kombiniert explizite Geometrie, Physik, Navigation und deterministische Regeln mit generativem Rendering, Dialog, Performance und Variation. Die Engine steuert das Reproduzierbare; das Modell liefert das, was von Wahrscheinlichkeit und ausdrucksstarker Breite profitiert. Ein hybrides Design macht zudem Sicherheit und Debugging handhabbarer, da kritische Zustände auch bei generierter Oberfläche überprüfbar bleiben können.

TABELLE 7 · KAPITEL ANALYTISCHER RAHMEN

FähigkeitStatus 2026Skalengate
EchtzeitbildÖffentliche DemonstrationÜber alle Geräte bezahlbar
Lange GedächtnisMinuten / ForschungStabil über Stunden
Präzise AktionBegrenzte SteuerungOffene-Aktion-Einhaltung
Mehrbenutzer-WeltenFrühe ExplorationKonsistenz und Governance
Sichere HerkunftFrühe SchemataStandard auf Event-Ebene

08Referenzarchitektur für Echtzeit-KI-Audiovisuelle Systeme

KAPITEL THESISEchtzeit-KI-Kino erfordert mehr als ein schnelles Videomodell. Ein zuverlässiges System umfasst Eingabe und Sensorik, Absichtserkennung, narrative Politik, Zustand und Gedächtnis, Modellrouting, Generierung und Rendering, Sprach- und Charaktersteuerung, Übertragung und Edge Computing sowie Herkunftsnachweis und Sicherheit. Zuverlässigkeit hängt vom Verhalten des gesamten Stacks unter Fehlschlag ab.
INDUSTRIE IMPLIKATIONENEin live-grade generatives System muss in der Lage sein, abzulehnen, zu verzögern, zu degradieren und zurückzurollen. Generierung ohne einen sicheren Rückfallweg ist keine Produktionszuverlässigkeit.
SICHERHEITSPRINZIPLatenz, Sicherheit und Herkunftsnachweis sind architektonische Budgets, nicht Features, die nach Abschluss des kreativen Systems hinzugefügt werden.

FIGUR 8 · Achtschichtige Echtzeit-KI-Kino-Architektur

8.1 Die achtschichtige Stapelstruktur

Sensorik wandelt Stimme, Blick, Gestik, Controller-Eingabe und Weltereignisse in gebundene Signale um. Absichtserkennung trennt eine Benutzeranfrage von zufälliger Beobachtung. Narrative Politik beschränkt das Mögliche; Zustand und Gedächtnis bewahren das Geschehene. Modellrouting weist spezialisierte Modelle zu; Generierung und Rendering produzieren das audiovisuelle Ergebnis; Charakter- und Sprachsteuerung erhalten die Leistung; Übertragung koordiniert Gerät, Edge und Cloud; Herkunftsnachweis und Sicherheit protokollieren das Ereignis und setzen die Freigabepolitik durch.

8.2 Latenzbudgets und graceful Degradation

Nicht jede Operation gehört zur selben Frist. Perzeptive Rückkopplung kann sehr geringe Latenz erfordern, während eine komplexe narrative Antwort gestaffelte Ausgabe nutzen kann. Systeme sollten sichere Assets zwischenspeichern, wahrscheinliche Aktionen vorhersagen, leichtere lokale Modelle verwenden, progressive Qualität streamen und auf genehmigte vorab generierte Materialien zurückgreifen. Wenn Politikprüfungen oder Modellaufrufe fehlschlagen, sollte das Erlebnis einfacher werden – nicht unsicher, inkohärent oder ohne Erklärung nicht verfügbar.

8.3 Dynamischer Herkunftsnachweis

Die auf Datei-Ebene nachvollziehbare Provenienz reicht für eine kontinuierlich generierte Sitzung nicht aus. Die Ereignisverzeichnung sollte die eingereichte Absicht, die aktive Politik, das Modell und die Version, die referenzierten Assets, das generierte Ergebnis, die Sicherheitsentscheidung, den Betreiber und den Zeitstempel identifizieren. Die öffentliche Veröffentlichung kann eine knappe Zusammenfassung bleiben, während sensible Protokolle zugriffskontrolliert bleiben. Das Ziel ist nicht die Überwachung des Publikums; es ist die Rechenschaftspflicht für folgenreiches Systemverhalten.

TABELLE 8 · KAPITEL ANALYTISCHER RAHMEN

SchichtZielHauptansatz
WahrnehmungSehr niedrige LatenzLokale Verarbeitung
Absicht und PolitikStufenweiseLeichte Modelle / Cache
GenerierungRahmenbudgetiertDestillation / spezialisierte Hardware
Netzwerk und AnzeigeStabiler JitterEdge / fokale Stream
SicherheitNiemals umgehenVorschau / Degradiere / Blockiere

09KI-Agenten und virtuelle Darsteller

KAPITEL THESISEine anhaltende KI-Persönlichkeit ist nicht nur eine visuelle Hülle, die über einen Chatbot gelegt wird. Sie verbindet Identität, Ziele, Gedächtnis, Fähigkeiten, Richtlinien und Leistung. Die Person kann zwischen Szenen und Sitzungen fortfahren, aber rechtliche und Haftungsfragen können nicht an eine virtuelle Persönlichkeit delegiert werden. Ein verantwortungsbewusster Betreiber bleibt für das Verhalten des Systems verantwortlich.
INDUSTRIE IMPLIKATIONENCharaktergedächtnis und Autonomie schaffen wiederkehrenden Wert, sie verwandeln jedoch Darbietungsrechte, Einwilligung und Sicherheit in anhaltende operative Verpflichtungen.
VERWALTUNGSPRINZIPEine Persönlichkeit kann ein langlebiges Gedächtnis und Handlungsfähigkeit haben; die Veröffentlichungsverantwortung muss bei einer identifizierbaren Person oder Organisation verbleiben.

ABKÜRZUNG 9 · Sechs Komponenten eines operativen Charakters

9.1 Ein Agent ist mehr als eine Charakteroberfläche

Ein produktionsreifer Agent erfordert ein stabiles Identitätsmodell, einen expliziten Satz von Zielen, abgegrenztes Gedächtnis, erlaubte Fähigkeiten, Verhaltensrichtlinien und eine Leistungsebene. Diese Komponenten sollten separat versioniert werden. Ein neues Stimmmodell sollte die Charakterethik nicht stillschweigend ändern; ein erweitertes Gedächtnis sollte die Einwilligung nicht automatisch erweitern; und eine Änderung der Handlungsfähigkeit sollte eine Überprüfung auslösen, auch wenn das Erscheinungsbild unverändert bleibt.

9.2 Leistungskontrolle und digitale Repliken

Gesicht, Stimme, Bewegung, Persönlichkeit und autonomes Verhalten sind getrennte Berechtigungsdomänen. Die Einwilligung sollte Medien, Kontext, Publikum, Territorium, Dauer, Vergütung, Rücknahme und Hochrisikoausschlüsse spezifizieren. Die Umwandlung einer passiven Ähnlichkeit in einen autonomen Agenten ist eine materielle Änderung, keine routinemäßige Wiederverwendung.

Das System muss auch einen fiktiven Charakter, der einer Produktion gehört, von der geschützten Identität eines Darstellers [R15–R16] unterscheiden.

9.3 Mehragentenproduktion und -betrieb

Agenten können Unterstützung bei der Aufbereitung, Kontinuitätsprüfung, Asset-Suche, Lokalisierung, Richtlinienprüfung und Weltbetrieb bieten. Ihre Arbeit sollte als Vorschläge organisiert werden, die in einen deterministischen Genehmigungsprozess eintreten.

Wichtige Entscheidungen – kanonische Änderungen der Geschichte, Transaktionen mit hohem Wert, sensible Darstellungen und die öffentliche Veröffentlichung – erfordern eine eindeutig identifizierbare Genehmigungsinstanz. Die Zusammenarbeit von Agenten ist nur nützlich, wenn sich die Verantwortung nicht über eine Kette automatisierter Handlungen hinweg auflöst.

TABELLE 9 · ANALYTISCHER RAHMEN

ElementMuss spezifizierenHohes Risiko
IdentitätGesicht / Stimme / Bewegung / PersonaKonsolidierung von Charakteren
VerwendenMedium / Szene / PublikumPolitisch / erwachsen / medizinisch
FähigkeitGenerieren / konversieren / handelnPassiv zu autonom
DauerStart / Ende / RückzugBeständig / nach dem Tod
AusgleichKaufpreis / Nutzung / UmsatzbeteiligungNicht offengelegte Wiederverwendung
03

DIE GERÄTEREVOLUTION

Von Bildschirm und Smartphone zu KI-Brillen

LEITTHESE DIESES TEILS Wenn Anzeige, Sensorik und Generierung zusammenkommen, wird der physische Raum Teil der narrativen Schnittstelle.

10 Vier Übergänge audiovisueller Geräte · 11 Neue filmische Formen durch KI-Brillen · 12 Räumliches Kino und Generierung aus der Ferne

10Vier Übergänge audiovisueller Geräte

KAPITEL THESISDie Kinoleinwand bündelte die gemeinsame Aufmerksamkeit; das Fernsehen brachte bewegte Bilder ins Zuhause; das Smartphone machte sie persönlich, häufig verfügbar und interaktiv; KI-Brillen könnten sie an Situation und Umgebung binden. Jeder Übergang verändert die Inhaltseinheit, das Geschäftsmodell, die gesellschaftliche Übereinkunft und die Regeln der Aufmerksamkeit. Das nächste Gerät ist nicht einfach ein kleinerer Bildschirm direkt vor dem Auge. Die Verbreitung hängt vom Zusammenspiel von Sensorik, Generierung, Anzeige, Datenschutz, Akkulaufzeit,
INDUSTRIE IMPLIKATIONENBEDEUTUNG FÜR DIE BRANCHE Preis, gesellschaftlicher Akzeptanz und einem glaubwürdigen Inhalte-Ökosystem ab — nicht allein von der Anzeigequalität. BEWERTUNG DES GERÄTS Entscheidend für das nächste Kinogerät ist, ob Sensorik, Generierung und Anzeige in einer gesellschaftlich akzeptablen Form zusammenwirken.

ABBILDUNG 10 · Vier Übergänge audiovisueller Geräte

10.1 Von gemeinsamen Vorführungen zu situationsbezogenen Ereignissen

Im Kino ist die Einheit die zeitlich festgelegte Vorstellung, im Fernsehen die Sendung und auf dem Smartphone der Feed, das Kurzvideo oder der Livestream. KI-Brillen eröffnen eine mögliche neue Einheit, die sich aus Ort, Beziehung und Ereignis ergibt.

Eine Szene kann beginnen, weil jemand einen Ort betritt, einer anderen teilnehmenden Person begegnet oder eine Figur bittet, eine Ebene der Welt sichtbar zu machen. Damit verschiebt sich die Beauftragung von Inhaltsminuten hin zu Regeln dafür, wann und warum eine Erfahrung erscheint.

10.2 Zusammenarbeit zwischen Gerät, Edge und Cloud

Die lokale Verarbeitung ist für sensible Sensordaten, unmittelbare Rückmeldungen und grundlegende Sicherheit unerlässlich. Edge-Infrastruktur kann die Latenz senken und regionale Zustände unterstützen; Cloud-Systeme übernehmen die Inferenz großer Modelle und dauerhaft verfügbare Weltdienste. Ein gut gestaltetes Produkt legt fest, welche Informationen das Gerät niemals verlassen, welche Ereignisse einen gemeinsamen Zustand benötigen und welche Ausgaben aus anonymisierten oder minimierten Signalen erzeugt werden können.

10.3 Die tatsächlichen Voraussetzungen für die Verbreitung

Gewicht, Wärme, Akkulaufzeit, Sichtfeld, Lesbarkeit der Anzeige, Unterstützung individueller Sehstärken, Preis und Gestaltung spielen eine Rolle. Ebenso wichtig sind ein sichtbarer Aufnahmestatus, die Erwartungen unbeteiligter Personen, gesellschaftliche Umgangsformen und die Möglichkeit, das System stummzuschalten.

Öffentliche Prototypen und Plattformentwicklungen zeigen Fortschritte [R24–R27]. Der Markt wird jedoch erst dann wachsen, wenn Menschen die Geräte im Alltag ohne technische, soziale oder psychologische Hürden tragen können.

TABELLE 10 · ANALYTISCHER RAHMEN

GerätKernfunktionInhaltseinheitHauptbeschränkung
KinoGeteilte AufmerksamkeitGeplante SitzungZeit und Ort
FernsehenHeimimmersionProgramm / SerieGeringe Interaktion
SmartphonePersönliche FrequenzKurz / liveKleinschirm / Fragmentierung
KI-BrillenKontext und PräsenzOrt / BeziehungseventPrivatsphäre / Akku / Akzeptanz

11Neue kinematische Formen durch KI-Brillen ermöglicht

KAPITEL THESISKI-Brillen können eine generierte Erzählung an Position, Blick, Objekte, Umgebungsgeräusche und private Anzeigen koppeln. Dies ermöglicht ortsbezogene Geschichten, Begleiterfiguren, öffentliche Raum-Events und personalisierte Zugänglichkeit. Es macht die Content-Ebene kontinuierlich und intim, was eine stärkere Benutzerkontrolle erfordert als das Benachrichtigungsmodell des Smartphones.
INDUSTRIE IMPLIKATIONENEin System, das im Sichtfeld verbleibt, muss dem Benutzer explizite Autorität über Unterbrechung, Erinnerung, Aufzeichnung, kommerziellen Einfluss und Beendigung geben.
DESIGN FLOORBeständige Präsenz erzeugt eine höhere Pflicht zur Zurückhaltung. Inhalte sollten das Recht verdienen, im Sichtfeld einer Person zu erscheinen.

FIGUR 11 · Der kontextuelle Content-Loop für KI-Brillen

11.1 Ortsnarrativ und Umgebungsfiguren

Eine Straße, ein Museum, ein Theaterviertel oder eine Transit-Reise können zu einem aktiven Erzählraum werden. Figuren können den breiten Kontext verstehen, auf anhaltende Weltereignisse verweisen und Inhalte offenbaren, die vom Ort oder der Zeit abhängen. Die stärksten Erlebnisse werden die Realität nicht mit konstanten Grafiken bedecken. Sie werden eine sparsame Intervention, lesbare räumliche Anker und klare Übergänge zwischen der faktischen Umgebung und der fiktionalen Ebene verwenden.

11.2 Begleiterfiguren und Aufmerksamkeitsgestaltung

Eine Begleiterfigur kann die Kontinuität über Sitzungen hinweg unterstützen, aber eine beständige Beziehungsgestaltung kann auch Abhängigkeit schaffen oder Vulnerabilität manipulieren. Produkte benötigen Eingriffsgrenzen, ruhige Modi, Erinnerungskontrollen, altersgerechte Standardwerte und klare kommerzielle Offenlegungen. Emotionale Bindung sollte nicht zur Erlangung der Einwilligung, zur Preissteigerung oder zum Umgehen der von einem Benutzer angegebenen Aufmerksamkeitsgrenzen verwendet werden.

11.3 Eine neue Schottgrammatik

Das Bildfeld wird nicht mehr vollständig von einem Regisseur kontrolliert, da der Nutzer anderswo schauen und durch den Raum wandern kann. Die Komposition verschiebt sich daher hin zu Feldern der Relevanz, akustischer Führung, zeitgesteuerten Enthüllungen, räumlicher Inszenierung und Ereignispriorität. Schöpfer gestalten, was wahrgenommen werden kann, wie Aufmerksamkeit gelenkt wird und was passiert, wenn ein Hinweis übersehen wird. Das Ergebnis kommt der Choreographie der Wahrnehmung näher als der Bearbeitung einer festgelegten Sequenz.

TABELLE 11 · KAPITEL ANALYTISCHER RAHMEN

RisikoKontrolleNutzerricht
Bystander-SensingSichtbarer Status / lokaler FilterWahrnehmung und Beschwerde
AufmerksamkeitsfangEingriffsgrenzenStille / Austritt
Missbrauch des GedächtnissesZweck und DauerInspektion / Korrektur / Löschung
Kommerzielle ManipulationWerbeoffenbarung / PreisregelnPersönlichkeitsanpassung ablehnen

12Räumliches Kino und Remote-Generierung

KAPITEL THESISRäumliches Kino kombiniert reale Aufnahmen, 3D- und 4D-Assets, rekonstruierte Umgebungen, explizite Weltzustände und generative Rendering-Techniken. Die Lieferung kann vorproduziert, gestreamt, am Edge generiert oder über eine hybride Pipeline zusammengebaut werden. Das dauerhafte Asset ist nicht eine einzelne volumetrische Datei, sondern eine trennbare Menge aus Geometrie, Semantik, Verhalten, Provenienz und Rechten.
INDUSTRIE IMPLIKATIONENRäumliche Werke sollten Schichten bewahren, die auf verschiedene Geräte und Engines übertragen werden können, anstatt die gesamte Erfahrung in einer proprietären Laufzeitumgebung zu sperren.
ASSET PRINCIPLEEin tragbares räumliches Werk trennt Geometrie, Bedeutung, Verhalten, Provenienz und Erlaubnis.

FIGUR 12 · Hybride räumliche Inhaltspipeline

12.1 Drei Wege zu räumlichem Inhalt

Vorproduzierte 3D-Inhalte bieten deterministische Qualität, aber hohe Asset-Kosten. Rekonstruktion und neuronale Darstellungen können reale Umgebungen schnell erfassen, erschweren jedoch Bearbeitung, Identität und Rechte. Weltgenerierung bietet Variation und Reaktivität, erfordert aber die Verwaltung von Konsistenz und Sicherheit. Professionelle Produkte werden wahrscheinlich alle drei kombinieren: deterministische Hero-Assets, rekonstruierte reale Standorte und generierte Variationen innerhalb geregelter Grenzen.

12.2 Remote-Generierung und foveates Streaming

Das Rendering kann je nach Latenz, Datenschutz und Qualität auf Gerät, Edge und Cloud aufgeteilt werden. Foveate-Techniken verteilen die Qualität dort, wo der Nutzer hinschaut, und reduzieren so Transport- und Rendering-Anforderungen [R26]. Der Blickwinkel ist jedoch ein sensibles Signal. Systeme sollten ihn zur Effizienzsteigerung der Lieferung nutzen, ohne ihn stillschweigend in Verhaltensprofilierung, Kaufabsicht oder emotionale Inferenz umzuwandeln.

12.3 Interoperabilität und Asset-Tragbarkeit

OpenXR und verwandte räumliche Standards bieten gemeinsame Schnittstellen für Geräte und Entitäten [R27], aber auch die narrative Tragbarkeit erfordert semantische und verhaltensbezogene Konventionen. Eine Tür muss als Objekt mit Regeln erkennbar sein, nicht nur als Mesh. Eine Figur benötigt Identität und Rechte-Metadaten, nicht nur Animation.

Interoperabilität sollte daher Zustand, Ereignisse, Erlaubnis und Provenienz sowie Geometrie abdecken.

TABELLE 12 · KAPITEL ANALYTISCHER RAHMEN

RouteVorteilEinschränkungBeste Nutzung
Vorgefertigter 3DDeterministischHohe Asset-KostenHero-Assets / Marken
RekonstruktionSchnelle Erfassung der realen WeltKomplexität von Bearbeitung und RechtenEchte Locations
WelterzeugungUnbegrenzte VariationKonsistenz / SicherheitHintergrund / Interaktion
HybridQualitäts-Kosten-AbwägungSystemkomplexitätProfessionelle Produkte
04

INHALT UND ZÜSCHAUER

Wie Zuschauer zu Mitwirkenden werden

PART PROPOSITION Der Inhalt wandelt sich von einmaliger Bereitstellung zu einer anhaltenden Beziehung, während die Zuschauerinnahme sinnvolle Handlungsfähigkeit innerhalb der Arbeit erlangen.

13 Vom Recht auf Zuschauen zum Recht zu handeln · 14 Neue Interaktionsmodelle · 15 Die Grenzen der personalisierten audiovisuellen Erfahrung · 16 Narration und Kunst in der Ära der KI

13Vom Recht auf Zuschauen zum Recht zu handeln

KAPITEL THESISDie Zuschauerhandlungsfähigkeit kann als Leiter beschrieben werden: das Recht zu schauen, das Recht zu wählen, das Recht zu handeln und das Recht zur Mitbestimmung. Mehr Optionen schaffen nicht automatisch eine sinnhaftere Partizipation. Handlungsfähigkeit besteht, wenn das System eine Handlung versteht, sie erinnert und Konsequenzen produziert, die für die Teilnehmerin und die Welt bedeutsam sind. Interaktives Design sollte kausale Signifikanz messen, nicht die Anzahl der Menüpunkte. Jede Erhöhung der
INDUSTRIE IMPLIKATIONENINDUSTRIE IMPLICATION Handlungsfähigkeit erhöht auch die systemische Verantwortung, zu erklären, zu erinnern und zu schützen.
ERFAHRUNGSBETRACHTUNGInteraktion wird zu Handlungsfähigkeit, wenn die Handlung des Publikums den Weltzustand auf eine lesbare und nachvollziehbare Weise verändert.

FIGUR 13 · Die Leiter der Zuschauerrechte

13.1 Vier Ebenen der Zuschauerrechte

Zuschauen umfasst das Starten, Pausieren, Stoppen und den Zugriff auf das Werk. Wählen bedeutet das Navigieren durch deklarierte Äste. Handeln bedeutet das Ändern des persistenten Zustands durch Sprache, Bewegung oder andere Eingaben. Mitbestimmung ermöglicht es Teilnehmenden, Assets zu erstellen, Regeln vorzuschlagen oder an der Wertschöpfung teilzuhaben. Produkte sollten angeben, welche Ebene sie anbieten und welche Entscheidungen unter redaktioneller oder operativer Kontrolle bleiben.

13.2 Standard-Zuschauen und Wahlermüdung

Kino kann immersiv bleiben, da die Zuschauer nicht verpflichtet sind, jeden Moment selbst zu steuern. Ein KI-natives Design sollte eine starke Standarderfahrung bewahren und nur dann auf Aktion hinweisen, wenn sie Sinn hinzufügt. Das System kann ableiten, dass eine Person desengagiert ist, aber es sollte keine passiven Signale in irreversible Handlungswandel oder kommerzielle Entscheidungen umwandeln. Ein Nutzer muss die Möglichkeit haben, nach einer Phase ohne Aktivität wieder zu einer kohärenten Erfahrung zurückzukehren.

13.3 Wiederaufbau kollektiven Zuschauens

Geteilte Erfahrungen erfordern Regeln für widersprüchliche Absichten. Eine Gruppe kann abstimmen, delegieren, abwechselnd handeln oder Rollen übernehmen. Das Design sollte offenlegen, wie der Einfluss verteilt wird, und Minderheiten vor Belästigung oder systematischer Ausgrenzung schützen. Kollektive Handlungsfähigkeit ist nicht einfach nur ein größerer Eingabekanal; sie ist ein kleines Governance-System innerhalb der Arbeit.

TABELLE 13 · ANALYTISCHER RAHMEN

RechtsZuschauerfähigkeitSystempflicht
AnsehenStart / StopKlare Darstellung
AuswählenZweige navigierenFolge konsequenz erklären
HandelnWeltzustand ändernGedächtnis und Rückmeldung
MitgovernRegeln und Assets erstellenFairer Prozess / Wertteilung

14Neue Interaktionsmodelle

KAPITEL THESISStimme, Blick, Gestik, Position, Gruppensignale und ausgewählte physiologische Eingaben können alle zu Schnittstellen für KI-natives Kino werden. Ihr Nutzen und ihre Risiken unterscheiden sich. Die Beobachtung eines Signals impliziert keine Erlaubnis, es als Absicht, Einwilligung oder Zahlungsbefugnis zu behandeln. Sensible Aktionen müssen über eine explizite, verständliche Steuerung ausgelöst werden.
INDUSTRIE IMPLIKATIONENDie Interaktionsschicht sollte Beobachtung, abgeleitete Absicht, vorgeschlagene Aktion und autorisierte Aktion trennen. Diese Trennung ist zentral für das Vertrauen und für agentenvermittelten Handel. INTERAKTIONSGRENZE Ein System kann ein Signal beobachten, ohne Befugnis zu haben, darauf zu handeln.

FIGUR 14 · Multimodale Interaktion und Autorisierung

14.1 Eine multimodale Interaktionskarte

Die Stimme ist effektiv für explizite Absichten, sollte aber nicht standardmäßig beibehalten werden. Der Blick ist nützlich für Referenz und Priorisierung, aber nicht für Einwilligung. Gestik unterstützt räumliche Manipulation, aber hochriskante Gesten benötigen Bestätigung. Der Ort ermöglicht Kontext, sollte aber keine Bewegungen einer Person preisgeben. Physiologische Daten sollten auf notwendige Barrierefreiheits- oder Sicherheitsfunktionen beschränkt sein, es sei denn, ein separater, widerrufbarer Zweck wurde klar akzeptiert.

14.2 Sprachliche Anweisungen und Restriktionssprache

Benutzer können eine Welt bitten, leiser zu werden, eine andere Perspektive zu offenbaren oder einem Charakter erklären zu lassen, dass ein vergangenes Ereignis stattgefunden hat.

Das System sollte offene Sprache in eine durch Geschichte, Sicherheit und Rechte begrenzte Aktionsplanung übersetzen.

Es sollte auch erklären, wann eine Anfrage mit den Regeln der Arbeit kollidiert. Natürliche Sprache ist eine bequeme Schnittstelle; sie ist kein unbegrenzter Anweisungskanal.

14.3 Feedback, Latenz und Vertrauen

Ein interaktives System sollte Eingaben schnell anerkennen, die Verarbeitung von der Fertigstellung unterscheiden und anzeigen, wann eine Aktion nicht verfügbar ist. Bei hoher Latenz kann es eine sichere Vorabantwort bereitstellen, anstatt den Nutzer stumm zu ignorieren. Das Vertrauen sinkt, wenn sich die Welt ohne sichtbare Ursache ändert, wenn das System vorgeben will, es zu verstehen, oder wenn eine abgeleitete Absicht nicht korrigiert werden kann.

TABELLE 14 · KAPITEL ANALYTISCHER RAHMEN

EingabeAngemessener EinsatzNiemals annehmen
StimmeAbsicht artikulierenBeständige Aufbewahrung
BlickReferenz / AufmerksamkeitKauf / Einwilligung
GesteRäumliche SteuerungHoher-Risiko-Autorisierung
StandortKontextauslöserÖffentliche Bewegungsgeschichte
PhysiologieNotwendige ZugänglichkeitEmotionale Manipulation

15Die Grenzen der personalisierten audiovisuellen Erfahrung

KAPITEL THESISPersonalisierung kann die Zugänglichkeit, Relevanz und Teilhabe verbessern, kann aber auch gemeinsame Werke fragmentieren, Überzeugung verbergen und ungleiche Behandlung schaffen. Das Risiko steigt, wenn die Anpassung von der Präsentation über den Inhalt zur langfristigen Beziehung und schließlich zu Werten, Preisen oder politischem Einfluss fortschreitet.
INDUSTRIE IMPLIKATIONENEine verantwortungsvolle Produkt unterscheidet zwischen Risikolaten Präsentationspräferenzen und Hochrisiko-Änderungen der Bedeutung, der Beziehung und der kommerziellen Behandlung.
ÖFFENTLICHER WERTPersonalisierung sollte den Zugang und die Handlungsmacht erweitern, ohne gemeinsame Werke, gemeinsame Fakten oder gemeinsame Verantwortung auszulöschen.

ABILDUNG 15 · Wert und Risiko in der Personalisierung

15.1 Vier Objekte der Personalisierung

Präsentation umfasst Untertitel, Lautstärke, Sprache, Tempo und Zugänglichkeit. Inhalt verändert Szenen, Erklärungen oder Schwierigkeitsgrad. Beziehung passt die Charaktererinnerung und Interaktion über die Zeit an. Wertpersonalisierung verändert Überzeugung, Ideologie, Preis oder den emotionalen Druck, der auf einen Benutzer ausgeübt wird. Standards können auf der Präsentationsebene angemessen sein, während tiefere Schichten Erklärung, Einwilligung und zugängliche Kontrollen erfordern.

15.2 Persönliche Erinnerung und Datenminimierung

Langfristige Charaktererinnerung kann eine Welt bedeutsam machen, aber das System sollte nur speichern, was einem erklärten Zweck dient. Benutzer müssen wichtige Erinnerungen überprüfen, korrigieren, löschen und exportieren können. Sitzungserinnerung, Querwerk-Erinnerung und kommerzielles Profiling sollten getrennt sein. Eine fiktive Figur sollte keine sensiblen realweltlichen Informationen behalten, nur weil sie den Dialog überzeugender macht.

15.3 Verhinderung emotionaler Preisdiskriminierung und versteckter Überzeugung

Ein System, das Dringlichkeit, Einsamkeit oder Anfälligkeit ableitet, sollte diese Ableitung nicht nutzen, um den Preis zu erhöhen, den Werbedruck zu steigern oder den Rücktritt zu erschweren. Personalisierungsmodelle dürfen nicht zu unsichtbaren Verhandlungsagenten werden, die gegen den Benutzer handeln. Hochrisiko-Anpassung erfordert Politik, Protokollierung, unabhängige Prüfung und einen nicht personalisierten Pfad.

TABELLE 15 · KAPITEL ANALYTISCHER RAHMEN

SchichtAngemessener StandardOffenlegung / Einwilligung
PräsentationUntertitel / Lautstärke / ZugänglichkeitVorrugschaft für mehrere Geräte
InhaltGeringes Risiko bei der GeschwindigkeitÄnderung der Handlung
BeziehungSitzungsspeicherLangfristiger Arbeitsspeicher über mehrere Projekte hinweg
WerteKein StandardwertPosition / Preis / Überzeugung

16Narrative und Kunst in der Ära der KI

KAPITEL THESISAutorschaft, die nativ mit KI erstellt wird, kann in Regeln, Auswahl, Orchestrierung, Weltdesign und Verantwortung residieren. Anstatt nur ein festes Drehbuch zu schreiben, kann ein Schöpfer eine Konstitution der Geschichte aufbauen: Themen, Werte, Weltgesetze, Charakterkerne, variable Ereignisse, verbotene Transformationen und Bedingungen für das Ende. Technische Komplexität schafft per se keine künstlerische Bedeutung.
INDUSTRIE IMPLIKATIONENDie künstlerische Bewertung sollte fragen, welches Problem die Arbeit sichtbar macht, wie sich die Generierung auf die Form auswirkt, ob Variationen bedeutsam sind und ob der Schöpfer Verantwortung für die Konsequenzen des Systems übernimmt.
KUNSTLICHES URTEILDer Beitrag des Autors kann ein Raum der Möglichkeit sein, doch dieser Raum erfordert immer noch Intention, Form und verantwortungsbewusste Wahl.

FIGUR 16 · Vom Story Constitution zu jeder Erfahrung

16.1 Vom Skript zur Story Constitution

Eine Story Constitution bewahrt das, was unverändert bleiben muss, während sie der Erfahrung Variation zulässt. Sie definiert Thema, Kanon, Charakterverpflichtungen, kausale Grenzen, Regeln für sensible Inhalte und den Bereich gültiger Enden.

Die Generierung findet in diesem von dem Autor definierten Raum statt. Die Constitution ersetzt keine Szenen oder Dialoge; sie bietet eine höherstufige Struktur, die tausende möglicher Szenen erkennbar als Teil derselben Arbeit zusammenhält.

16.2 Neue künstlerische Einheiten

Die Kompositionseinheit kann zu einer Regel, einer Beziehung, einer Begegnung, einem Gedächtnis oder einem geplanten Übergang zwischen Weltzuständen werden. Der Rhythmus kann sich über Sitzungen hinweg entwickeln, nicht über Minuten. Eine Charakterdarstellung kann durch Konsistenz unter unerwarteten Eingaben bewertet werden. Kritiker und Jurys benötigen daher Methoden, die die realisierte Erfahrung und das dahinterliegende System der Möglichkeiten berücksichtigen.

16.3 Bewahren von Werken, die nicht exakt wiederabspielbar sind

Die Bewahrung sollte das veröffentlichte Modell und die Version, das Asset-Set, die Story Constitution, die Politik, die wichtigen Zustände, repräsentative Sitzungen und die Dokumentation der Laufzeitumgebung erfassen. Eine Aufzeichnung allein zeigt nur eine Performance, nicht aber den Möglichkeitsraum der Arbeit. Bewahrungsstellen werden Emulation, kontrollierte Wiedergabe und Event-Archive neben konventionellen Mastern benötigen.

TABELLE 16 · KAPITELANALYTISCHER RAHMEN

DimensionKritische Frage
IdeeWelche unverzichtbare Frage stellt die Arbeit?
FormErzeugt die Generierung eine neue Grammatik?
RegelnIst der Raum der Variation bedeutsam?
BeziehungÄndert die Handlung des Publikums das Verständnis?
VerantwortungVersteht der Schöpfer die Konsequenzen des Systems?
05

INDUSTRIEUMBAU

Die Konvergenz von Film, Spielen, Live-Media und sozialen Welten

TEILPROPOSITION: Gemeinsame Weltvermögen kann über mehrere Medien dargestellt werden, wodurch Weltoperationen wichtiger werden als das Enddateiformat.

17 Film–Spiel-Konvergenz als Shared-World-Produktion · 18 Live-Events, Wettbewerbe und Echtzeit-Kino · 19 Eine neue Wertschöpfungskette und neue Berufe · 20 Markt- und Geschäftsmodelltransformation · 21 Das aufkommende globale Industrieland

17Film–Spiel-Konvergenz als Shared-World-Produktion

KAPITEL THESISDie nächste Stufe der Film–Spiel-Konvergenz ist nicht eine größere Anzahl von Cross-Promotions oder Adaptationen. Es ist der Aufbau einer gemeinsamen Welt-Ebene, aus der linearer Film, interaktive Spiele, generative Live-Media, räumliche Erfahrungen und Gemeinschaftsschöpfung dargestellt werden können. Charaktere, Regeln, Zustand und Provenienz werden zu gemeinsamer Infrastruktur.
INDUSTRIE IMPLIKATIONENWelt-Assets müssen für die Wiederverwendung konzipiert sein, ohne die eigenständige Ausdrucksweise jedes Mediums einzuebnen oder zuzulassen, dass Entscheidungen eines Produkts den gemeinsamen Kanon beschädigen.
INDUSTRIEFAZENSCHLUSSDer strategische Schritt ist von der zweimaligen Nutzung desselben IP zu der Errichtung einer verwalteten Welt, die von mehreren Medien gelesen werden kann.

FIGUR 17 · Eine Welt, Multiple Medien

17.1 Von gemeinsamem IP zu gemeinsamem Zustand

Traditionelle Adaptationen teilen Namen, Bilder und Lore, während sie Produktionsvermögen und Logik neu aufbauen. Ein Shared-World-Ansatz definiert Identität, Geografie, Chronologie, Fähigkeiten, Beziehungen und Provenienz in maschinenlesbaren Schichten. Film kann einen Charakter dramatisch interpretieren, ein Spiel kann Fähigkeiten ausführen, und Live-Media kann auf Ereignisse reagieren, während es mit einer gemeinsamen Versionsgeschichte verbunden bleibt. Wiederverwendung wird semantisch und operativ, nicht nur visuell.

17.2 Das Weltstudio

Ein Weltstudio verbindet Story- und Kunstabteilung mit Zustandsarchitektur, Asset-Systemen, Kontinuitätsengineering, Live-Operationen und Governance. Es unterscheidet kanonische Zustände von temporären Sitzungszuständen und community-geschaffenen Zweigen. Das Betriebsmodell ähnelt sowohl einem Studio als auch einer langfristigen Serviceorganisation: Es veröffentlicht Werke, pflegt die Welt, löst Konflikte und plant, wie der Wert an die Beiträger zurückfließt.

17.3 Konvergenzrisiken

Eine geteilte Welt kann kreativ steif werden, wenn jedes Medium einer zentralen Datenbank unterworfen sein muss. Sie kann auch zu Überwachung, ausbeuterischer Arbeit, unzugänglichen Kanons oder einer unbegrenzten Abhängigkeit von einer Plattform führen.

Die Governance soll medium-spezifische Interpretationen, forkbare Versionen, Beiträgerzuweisungen und klare Grenzen für Änderungen, die ein kommerzieller Betreiber rückwirkend vornehmen darf, bewahren.

TABELLE 17 · ANALYTISCHER RAHMEN

Geteilter SchichtFilmSpiel / InteraktionGovernance
CharakteridentitätPerformance und BogenFähigkeit und ZustandEinwilligung / Version
WeltsemantikSzene und ThemaKarte und RegelnUrsprung / Rechte
ZeitlinieNarrative ReihenfolgeQuest und ÄsteKanon / Gabel
VerhaltenLeistungsentscheidungAusführbare AktionSicherheitsgrenze

18Live-Events, Wettbewerbe und Echtzeit-Kino

KAPITEL THESISEchtzeit-Kino mit KI umfasst generierte Live-Shows, ereignisreaktive Welten und persistente Broadcast-Erfahrungen. Die zentrale Produktionsherausforderung ist nicht die generative Unterbrechungsfreiheit. Es geht um die Aufrechterhaltung von Kontrolle, Verständlichkeit und Wiederherstellbarkeit bei variablen Publikumseingaben, Netzwerkbedingungen, KI-Verhalten und Sicherheitsereignissen.
INDUSTRIE IMPLIKATIONENLive-Betrieb erfordert geübte Degradation, Event-Logs und Zustandswiederherstellung auf dieselbe Weise, wie herkömmlicher Broadcast Redundanz und redaktionelle Kontrolle erfordert.
BETRIEBSPRINZIPEine Echtzeit-Welt ist produktionsreif, wenn sie sicher versagen und in einen erklärbaren Zustand zurückkehren kann.

ABBILDUNG 18 · Generativer Live-Betriebszyklus

18.1 Drei Echtzeit-Produktfamilien

Die erste Familie ist ein geplantes generiertes Programm mit kontrollierter Teilnahme. Die zweite ist eine Event-Schicht, die auf Sport, Nachrichten, Performance oder Gemeinschaftsaktivitäten reagiert. Die dritte ist eine anhaltende Welt, die zwischen den Hauptereignissen weiterläuft. Jede erfordert unterschiedliche Latenz-, Moderations- und Kontinuitätsrichtlinien. Eine geplante Show kann ausgiebig vorab genehmigte Fallback-Lösungen verwenden; eine anhaltende Welt muss dauerhafte Konsequenzen und Teilnehmeridentität verwalten.

18,2 Eingabe und Governance-Latenz

Eine Sicherheitsprüfung kann nicht immer nach der Generierung erfolgen, da schädliche Ausgaben sofort erfahren werden können. Das System sollte die Eingabe klassifizieren, den Aktionsraum einschränken, genehmigte Modelle auswählen und das generierte Ergebnis überwachen. Governance-Latenz ist Teil des End-zu-End-Budgets. Bei niedrigem Vertrauen sollte die Welt die Autonomie reduzieren, die Veröffentlichung verzögern oder auf eine bekannte sichere Antwort umschalten.

18,3 Kommerzielle und operative Metriken

Zu den wichtigsten Metriken gehören die End-zu-End-Latenz, die Fallback-Rate, unerklärte Unterbrechungen, die Wiederherstellungszeit des Zustands, die Häufigkeit von Vorfällen, die Kosten pro Sitzungsminute, die Teilnehmerbindung und die Integrität des Weltzustands. Wachstum kann strukturelle Verluste verbergen, wenn jeder zusätzliche Teilnehmer die Generationskosten schneller erhöht als die Einnahmen. Echtzeitprodukte benötigen Service-Level-Wirtschaftlichkeit, nicht nur Zuschauermetriken.

TABELLE 18 · KAPITEL ANALYTISCHER RAHMEN

MetrikZweckRotlinie
End-zu-End-LatenzNatürliche InteraktionBeständiger Verstoß
Fallback-RateService-StabilitätKeine sichere Fallback-Möglichkeit
SicherheitsunterbrechungRisikoverwachungUnerklärte Unterbrechung
WiederherstellungszeitIncident handlingKein Rollback
Kosten pro MinuteUnit EconomicsVerluste wachsen mit Erfolg

19Eine neue Wertschöpfungskette und neue Berufe

KAPITEL THESISDie KI-Kinos-Wertschöpfungskette fügt Schichten für Modelle, Daten, Rechenleistung, Welt und Workflow-Systeme, Inhalt und Produktion, Verteilung und Geräte, Transaktionen und Abwicklung sowie kontinuierliche Betriebsabläufe und Sicherheit hinzu. Neue Arbeit erscheint an den Schnittstellen. Der seltene Fachmann ist nicht die Person, die ein Modell am besten kennt, sondern die Person, die Kunst, Systeme, Assets und Verantwortung integrieren kann.
INDUSTRIE IMPLIKATIONENDas Training sollte von Werkzeugdemonstrationen hin zu langlebigen quervernetzten Kompetenzen vorrücken: kreative Leitung, Systemdesign, Beweise, Rechte, Evaluation und operative Urteilsfähigkeit.
TALENT JUDGMENTModellkompetenz ist vorübergehender Vorteil; Orchestrierung, Rechenschaftslegung und Weltbildung sind langlebige professionelle Fähigkeiten.

FIGURE 19 · Die neue KI-Kinos-Wertschöpfungskette

19.1 Sechs Schichten der aufkommenden Wertschöpfungskette

Die Basisinfrastruktur liefert Modelle, Daten und Rechenleistung. Welt- und Workflow-Systeme organisieren Zustand und Werkzeuge. Produktion schafft Werke und wiederverwendbare Assets. Verteilung verbindet Publikum, Geräte und Kontexte. Transaktionssysteme verwalten Berechtigungen und Wertfluss. Betriebsabläufe erhalten Identität, Sicherheit, Kontinuität und Gemeinschaft. Organisationen können mehrere Schichten einnehmen, aber Interessenkonflikte und Verantwortung müssen sichtbar bleiben.

19.2 Neue professionelle Kombinationen

Ein KI-nativer Produzent kombiniert kreative, budgetäre und systemische Verantwortung. Ein Weltarchitekt modelliert Regeln und Zustand. Ein Kontinuitätsingenieur verwaltet Identität und Kausalität über Generationen hinweg. Ein Provenance-Ingenieur entwirft Aufzeichnungen und Metadaten. Ein generativer Sicherheitsdirektor definiert Ablehnung, Degradation und Wiederherstellung.

Diese Rollen sind keine festgelegten Berufstitel; sie identifizieren Kompetenzlücken, die durch konventionelle Abteilungsstrukturen oft unbelegt bleiben.

19.3 Arbeitsmarkttransition und faire Verteilung

Automatisierung kann repetitive Aufgaben eliminieren und die Hebelwirkung auf Modelle und Plattformen konzentrieren. Übergangsprogramme sollten Einkommen, Verhandlungsmacht, Urhebernennung, Umschulung und Zugang zu Werkzeugen verfolgen – nicht nur den Prozentsatz automatisierter Aufgaben. Beitragende benötigen klare Zuordnung und Vergütung, wenn Assets, Darstellungen und Workflows über Produkte und Jahre hinweg Wert schaffen.

TABELLE 19 · ANALYTISCHER KADERRAHMEN

RolleKernverantwortungFähigkeit
KI-nativer ProduzentMensch-KI-Fluss und BudgetKreativ + Systeme
WeltarchitektRegeln und ZustandNarrativ + Datenmodellierung
KontinuitätsingenieurIdentität und KausalitätQualität + Versionierung
Provenienz-EngineerEvidenz und FelderStandards + Rechte
Generative SicherheitsdirektorVerweigerung und WiederherstellungInhalt + Risiko

20Markt und Geschäftsmodelltransformation

KAPITEL THESISErlöse können sich von Tickets, Werbung und Lizenzen hin zu Welt-Abonnements, Charakterabonnements, interaktiven Events, Unternehmensumgebungen, Asset-Diensten und agentenvermittelten Anfragen ausdehnen. Gleichzeitig führt die kontinuierliche Generierung zu kostenintensiven Betriebsstrukturen im Cloud-Stil. Eine tragfähige Geschäftstätigkeit muss narrativen Wert, Bindung und Erlaubnis mit vorhersehbaren Einheitsökonomien ausrichten.
INDUSTRIE IMPLIKATIONENJede anhaltende Erfahrung sollte ihre Kosten pro aktiven Nutzer, pro Sitzung Minute und pro akzeptierter generierter Minute kennen und das Wachstum der Engagement auf das Wachstum der unbegrenzten Rechenanforderungen trennen.
FINANZIELLE URTEILSKRITIKKontinuierliche Medien verwandeln einen Teil eines Studios in einen Servicebetreiber. Weltwirtschaftliche Modelle scheitern, wenn die Betriebskosten schneller skalieren als der Beziehungswert.

FIGUR 20 · Portfolio der Erlöse aus anhaltenden Welten

20.1 Ausdehnung der Erlöseinheit

Ein Welt-Abonnement verkauft aufrechterhalteten Zugang und Zustand. Ein Charakterabonnement verkauft die Kontinuität der Beziehung. Ein interaktives Event verkauft eine zeitlich begrenzte Erfahrung. Unternehmenslizenzen verkaufen kontrollierte Marken- oder Trainingsumgebungen. Asset-Dienste verkaufen Identität, Arbeitsabläufe oder Weltkomponenten. Agentenanfragen unterstützen maschinengestützte Lizenzierung oder Generierung. Jede Einheit erfordert unterschiedliche Einwilligungen, Servicelevel, Buchhaltung und Rückgabelogik.

20.2 Von Produktionsbudget zu Serviceeinheitsökonomie

Traditionelle Finanzen konzentrieren Kosten vor der Veröffentlichung. Anhaltende Welten kombinieren Ausgaben mit Inferenz, Speicher, Moderation, Sicherheit, Kundenservice und Zustandsmigration. Das Finanzmodell sollte feste Weltinvestitionen, variable Sitzungskosten, Akquisekosten, Bindung, Haftungsreserven und End-of-Life-Verpflichtungen klassifizieren. Ein Produkt ist nicht nachhaltig, wenn Erfolg Verluste erhöht oder den technischen Rückzug unmöglich macht.

20.3 Preisgestaltung und Wertverteilung

Die Preisgestaltung sollte sich auf den nachvollziehbaren Wert beziehen und nicht auf die abgeleitete emotionale Verletzlichkeit. Die Regeln zur Umsatzbeteiligung sollten die weitere Nutzung von Darstellern, Charakterentwerfern, Weltdesignern, Gemeinschaftsbeiträgern und Workflow-Entwicklern adressieren. Maschinenlesbare Verträge können die Abwicklung verbessern, doch Ausnahmen und Streitigkeiten benötigen weiterhin menschliche Prozesse. Das System sollte anzeigen, welcher Teilnehmer einen Wert erhält, wenn ein Asset wiederverwendet wird.

TABELLE 20 · KAPITEL ANALYTISCHER RAHMEN

ModellWährungseinheitErforderliche BedingungHauptrisiko
WeltabonnementBeständiger ZustandUpdates / AufbewahrungHohe Betriebskosten
CharakterabonnementLange BeziehungEinwilligung / SpeicherkontrolleAbhängigkeit / Manipulation
Interaktives EreignisEine ErfahrungZuverlässige EchtzeitMaximale Kapazität
UnternehmenslizenzMarke / UmgebungSteuerung und ProvenienzIdentitätsdrift
Agenten-AnfrageMaschinentransaktionRechtefelder / ZahlungAgentenhaftung

21Die aufstrebende globale Industrielandchaft

KAPITEL THESISKünstliche Intelligenz im Kino wird sich wahrscheinlich über ein multipolares Netzwerk entwickeln, anstatt über ein globales Zentrum. Nordamerika hat Stärke in Grundmodellen, Cloud und Distribution; China und Ostasien in Anwendungsskalierung und Lieferketten; Europa in kulturellen Institutionen und Regelsetzung; Japan und Korea in Charakter, Animation und Spielen; und andere Regionen in Kapital, Jugendmärkten und charakteristischen kreativen Kulturen.
INDUSTRIE IMPLIKATIONENEin langlebiger Knoten verbindet Technologie, Vermögenswerte, Regeln, Talente und Märkte durch vertrauenswürdige Schnittstellen. Er muss nicht jede Schicht besitzen.
LANDSCAPE URTEILDie führenden Knoten werden diejenigen sein, die grenzüberschreitende Zusammenarbeit vertrauenswürdiger, tragbarer und wirtschaftlich nachvollziehbarer machen.

FIGUR 21 · Ein multipolares globales KI-Kino-Netzwerk

21.1 Das Wettbewerbsfeld wird durch unterschiedliche Ressourcen geprägt

Die Modellkapazität ist nur ein Vorteil. Der Zugang zu Produktionskräften, lokalen Geschichten, Expertise in Spielen und Animation, Datenverwaltung, Kapital, Vertriebskanäle, Sprachmärkte und Lieferketten für Geräte beeinflussen das Feld. Eine Region kann in Welt-Assets oder Governance vorangehen, ohne die größten Modelle auszubilden. Der Markt wird Institutionen belohnen, die zwischen diesen Ressourcen vermitteln.

21.2 Die strukturelle Position HongKongs

HongKong kann als mehrsprachiger, grenzübergreifender Markt und als Verbindungspunkt für Standards mit tief verwurzelter Filmkultur, Finanzdienstleistungen und internationalen Netzwerken beitragen. Seine Chance besteht nicht darin, ein Zentrum für Hyperscale-Modelle zu imitieren. Es geht darum, Vermögenswerte, Projekte, Investitionen, Festivals, Bewertungen und Vertriebswege interoperabel über Jurisdiktionen hinweg zu machen, während eine glaubwürdige Unterscheidung zwischen Industrieinfrastruktur und werblichen Ansprüchen bewahrt wird.

21.3 Eine Mindestsprache für internationale Zusammenarbeit

Grenzübergreifende Arbeit erfordert gemeinsame Definitionen von Arbeitstypen, der Rolle der KI, des Laufzeitverhaltens, der Asset-Identität, des Berechtigungsumfangs, des Provenienzstatus und der Verantwortung. Diese Bereiche sollten lokale rechtliche Unterschiede unterstützen, anstatt sie zu ersetzen, als ob sie dies tun könnten. Eine gemeinsame Mindestsprache ermöglicht es Schöpfern und Institutionen, Projekte zu vergleichen, ohne rechtliche Kategorien einer Jurisdiktion auf alle Teilnehmer aufzuzwingen.

TABELLE 21 · ANALYTISCHER RAHMEN

RegionStärkeChanceEinschränkung
NordamerikaModelle / Cloud / VertriebPlattformen und WerkzeugeKonzentration / Rechte
China und OstasienAnwendungen / LieferketteSkalierte InhalteTransnationale Interoperabilität
EuropaRegeln / KulturVertrauenswürdige InhalteKapital / Skalierung
Japan und KoreaFiguren / Animation / SpieleWeltvermögenSprachmarkt
Hong KongTransnationale Finanzen / SprachenMarkt- und StandardsverknüpfungRechenleistung / Produktionsmaßstab
06

DIGITALE VERMÖGEN UND DIE

Von der Inhaltsverteilung zu maschinell kollaborativen Vermögenswertnetzwerken

TEIL VORSCHLAG Der Wert liegt nicht nur in einem fertigen Werk, sondern auch in Workflows, Figuren, Weltzuständen, Verhaltensregeln und überprüfbaren Aufzeichnungen.

22 KI-Audiovisuelle Vermögenswerte: Vom fertigen Werk zu einer Vermögenswertfamilie · 23 Der Lebenszyklus von KI-Audiovisuellen Vermögenswerten · 24 Agentenlesbare Vermögenswerte und maschinell vermittelte Transaktionen · 25 Verbindung von menschlichem und KI-Wert: Dual-Domain-Wertkonten

22KI-Media-Assets: Vom fertigen Werk zu einer Asset-Familie

KAPITEL THESISDie KI-Media-Asset-Familie umfasst sechs verschiedene Typen: Werk, Workflow, Charakter, Welt, Verhalten und Aufzeichnung. Jeder benötigt eine Mindestidentität, eine Versionshistorie, eine Wertmetrik und ein Berechtigungsmodell. Die Behandlung aller sechs als eine einzige Inhaltsdatei erzeugt Ambiguität und erschwert die rechtliche Wiederverwendung, die Bewertung und die maschinelle Zusammenarbeit.
INDUSTRIE IMPLIKATIONENDas Indexieren kann Assets identifizieren und verbinden. Es erstellt, überträgt oder bestätigt keine rechtlichen Rechte und bestätigt weder die Qualität noch den Wahrheitsgehalt eines Assets.
GRANZSTELLENANGABEEin Asset-Index beschreibt Infrastruktur und Beziehungen; der rechtliche Titel bleibt Sache autorisierter Aufzeichnungen, Beweise und anwendbaren Rechts.

ABBILDUNG 22 · Die KI-Media-Asset-Familie

22.1 Drei Asset-Klassen

Ein Werk ist die veröffentlichte audiovisuelle Erfahrung. Ein Workflow dokumentiert Werkzeuge, Knoten und Entscheidungen. Ein Charakter kombiniert Identität, Modell, Performance und Berechtigung. Eine Welt enthält Semantik, Regeln und Zustand. Ein Verhalten definiert eine ausführbare Fähigkeit oder Interaktion. Eine Aufzeichnung liefert Provenienz-, Ereignis- und Lebenszyklusevidenz. Ein Projekt kann Hunderte verwandter Assets enthalten, die jeweils unterschiedliche Zugriffs- und kommerzielle Bedingungen haben.

22.2 Drei Voraussetzungen für nutzbare Assets

Ein Asset muss identifizierbar sein: Benutzer und Maschinen können es und seine Version unterscheiden. Es muss interpretierbar sein:

technische, semantische und Governance-Felder sind lesbar. Es muss innerhalb einer bekannten Berechtigungsabgrenzung nutzbar sein. Ein visuell beeindruckendes Asset, das an Provenienz, Versionsklarheit oder Berechtigungsumfang mangelt, kann wertvoll als Inspiration sein, aber für die professionelle Zusammenarbeit unbrauchbar.

22.3 Bewertung des Asset-Werts

Der Wert kann von der Publikumsresonanz, Zuverlässigkeit, Bearbeitbarkeit, Beziehungsstärke, Wiederverwendung, Vollständigkeit der Provenienz und Qualität der Lizenz abhängen. Eine Metrik kann nicht alle Asset-Klassen vergleichen. Ein Charakter kann durch Identitätsstabilität dauerhaften Wert schaffen; ein Workflow durch die Akzeptanzrate; eine Welt durch Erweiterbarkeit; und eine Aufzeichnung durch ihre Fähigkeit, Transaktions- und Streitkosten zu senken.

TABELLE 22 · KAPITELANALYTISCHER RAHMEN

AssetMindestidentitätWertmetrikFokus auf Berechtigungen
ArbeitVersion / ReleaseZielgruppe / UmsatzAusstellen / adaptieren
WorkflowKnoten / KonfigurationAkzeptanz / EffizienzAusführen / weiterverbreiten
CharakterIdentität / ModellStabilität / BeziehungBild / Stimme / Verhalten
WeltRegeln / ZustandErweiterung / WiederverwendungEintreten / bauen / betreiben
VerhaltenFähigkeit / SchnittstelleSteuerung / SicherheitAufrufen / Delegation
AufzeichnenProvenienz / EreignisVollständigkeit / IntegritätInspektion / Behalten

23Der Lebenszyklus von KI-Audiovisuellen Vermögenswerten

KAPITEL THESISEin vertrauenswürdiger Vermögenswert-Lebenszyklus umfasst Erstellung, Deklaration, Identifizierung, Verifizierung, Bewertung, Entdeckung, Erlaubnis, Nutzung, Abrechnung, Änderung, Archivierung und Ausstiegsphase. Vertrauen bedeutet nicht, dass Fehler nie auftreten. Es bedeutet, dass Änderungen, Streitigkeiten, Rücknahmen und Korrekturen sichtbar und ohne Zerstörung des historischen Aufzeichnens bearbeitet werden können.
INDUSTRIE IMPLIKATIONENDas Lebenszyklusdesign sollte öffentliche Metadaten, beschränkte operative Informationen und private Beweise trennen und die Ereignisgeschichte bewahren, wenn ein Vermögenswert seinen Status ändert.
INSTITUTIONALER PRINZIPEine glaubwürdige Registrierung dokumentiert Korrekturen und Rücknahmen als erstklassige Zustände anstelle des Löschen unbequemer Geschichte.

FIGUR 23 · Der Vermögenswert-Lebenszyklus

23.1 Von der Erstellung bis zur Ausstiegsphase

Die Erstellung erzeugt ein Vermögenswert und initiale Beweise. Die Deklaration identifiziert den verantwortlichen Einreichenden.

Die Identifizierung weist eine persistente ID und Elternbeziehungen zu. Die Verifizierung prüft Aussagen oder Signaturen.

Die Bewertung fügt unabhängige Beobachtungen hinzu. Die Entdeckung macht erlaubte Metadaten sichtbar. Die Erlaubnis ermöglicht die Nutzung; die Operation erzeugt Ereignisse; die Abrechnung dokumentiert den Wertfluss. Veränderung, Archivierung und Rücknahme bewahren die Geschichte und bestimmen, was weiterhin zugänglich ist.

23.2 Das minimale überprüfbare Register

Das Register sollte die Asset-ID, den Typ, die Version, das übergeordnete Asset, den verantwortlichen Kontakt, eine Zusammenfassung der Herkunft, die Deklaration von Modell und Werkzeug, eine Zusammenfassung der Rechte, den Governance-Status, das technische Format, den Integritätsbezug und den Status von Streit oder Rücknahme enthalten. Nicht jedes Feld muss öffentlich sein. Die minimale öffentliche Schicht sollte eine Identifizierung und informierte Kontaktaufnahme ermöglichen, ohne vertrauliche Anweisungen, personenbezogene Informationen oder sicherheitskritische Protokolle preiszugeben.

23.3 Rücknahme, Streitfälle und verwahrloste Assets

Ein Rechteinhaber kann die Erlaubnis zurückziehen; ein Einreichender kann verschwinden; ein Asset kann angefochten oder technisch veraltet sein. Das System benötigt Zustände für Aussetzung, angefochtenen Status, Ersatz, eingeschränkten Zugriff und verwahrloste Verantwortung. Historische Aufzeichnungen sollten keine aktuelle Erlaubnis implizieren. Maschinenklienten müssen in der Lage sein zu erkennen, dass ein Asset einmal existiert hat, aber derzeit nicht verwendet werden kann.

TABELLE 23 · KAPITEL ANALYTISCHER RAHMEN

FeldgruppeBeispielÖffentliche Schicht
IdentitätID / Typ / Version / übergeordnetes ElementÖffentlich
Verantwortliche ParteienErsteller / Einreicher / KontaktStufenweise
HerkunftModell / Werkzeug / Asset-DeklarationZusammenfassung
RechteTerritorium / Zeitraum / Nutzung / StatusZusammenfassung
GovernanceEtikett / Streit / RücknahmeÖffentlich
TechnikFormat / Schnittstelle / HashAuf Anfrage

24Agentenlesbare Vermögenswerte und maschinell vermittelte Transaktionen

KAPITEL THESISAgenten können nach Vermögenswerten suchen, Bedingungen vergleichen, Erlaubnis beantragen und Zahlungen initiieren. Damit dieser Markt sicher ist, muss eine probabilistische Interpretation der Absicht eines Nutzers von der deterministischen Transaktionsautorität getrennt bleiben. Hochwertige, unumkehrbare oder personenbezogene Rechte erfordern eine explizite Genehmigung durch eine identifizierbare Person.
INDUSTRIE IMPLIKATIONENMaschinenlesbare Erlaubnisse sollten gewöhnliche Transaktionen beschleunigen, ohne Unsicherheit in automatische Zustimmung zu verwandeln oder die Verantwortung in eine Agentenkette zu verlieren. TRANSAKTIONSEBENE Agenten können empfehlen und verhandeln; sensible Rechte und Zahlungen erfordern deterministische Kontrollen und nachvollziehbare Autorisierung.

FIGUR 24 · Ebenen agentenvermittelter Vermögenswerttransaktionen

24.1 Die maschinenlesbare Rechtehülle

Ein Vermögenswert kann erlaubte und ausgeschlossene Nutzungen, Territorium, Dauer, Identitätsumfang, Preislogik, Attribution, technische Einschränkungen und die Notwendigkeit einer menschlichen Genehmigung ausdrücken. Diese Felder unterstützen die Entdeckung und die Vorverhandlung. Sie entfernen keine Ausnahmen, Urheberpersönlichkeitsrechte, kollektive Vereinbarungen oder juristische Regeln. Die Hülle sollte angeben, wann die maschinelle Interpretation aufhören und eine menschliche Entscheidung beginnen muss.

24.2 Trennung probabilistischer Absicht und deterministischer Abwicklung

Ein Sprachmodell kann ableiten, dass ein Nutzer eine Lizenz wünscht, aber die Ableitung ist keine Autorität. Eine Transaktionsebene sollte den genauen Vermögenswert, die Rechte, den Preis, die Gegenpartei und die Widerrufsbedingungen präsentieren, eine genehmigte Autorisierung erlangen und eine dauerhafte Aufzeichnung generieren. Aufkommende Agentenbezahlungsprotokolle sind wichtige Infrastruktursignale, während Verantwortung und Verbraucherschutz weiterhin offene Designfragen sind [R21–R22].

24.3 Von einem Suchmarkt zu einem Anforderungsmarkt

Menschliche Nutzer durchsuchen Kataloge; Agenten können strukturierte Anforderungen formulieren und den Markt bitten, eine konforme Lösung zu erstellen. Dies kann die Transaktionskosten für Lokalisierung, Asset-Ersatz, Musik, Stimmen und Weltkomponenten senken. Es kann die Konzentration auch verstärken, wenn eine Plattform die Entdeckung, Identität und Bezahlung kontrolliert. Offene Anforderungsformate und exportierbare Aufzeichnungen sind daher strategische Infrastruktur.

TABELLE 24 · KAPITEL ANALYTISCHER RAHMEN

FeldMaschinenlesbarer WertMenschliche Bearbeitung
VerwendenAnsehen / generieren / anpassenNicht aufgeführte Verwendung
Territorium / BegriffCode / DatumKonflikt / Ausnahme
IdentitätCharakter / DarstellerumfangEmpfindliche Person
PreisFest / Ebene / AngebotHochwertige Verhandlung
GenehmigungAutomatisch / menschlichPersönlichkeit / unveränderlich

25Verknüpfung von Mensch und KI-Wert: Dual-Domain-Wertkonten

KAPITEL THESISDie zukünftige Wirtschaft der KI-Welten kann groß sein, aber Transaktionsvolumen, Vermögensbewertung und wirtschaftlich hinzugefügter Wert sind nicht austauschbar. Jede interne Agentenaktion oder virtuelle Übertragung als zusätzliches BIP zu betrachten würde zu schwerwiegendem Doppelzählen führen. Die Messung sollte menschliche Inputs, KI-Ausführung, virtuelle Nutzung, reale Rendite und Zwischennutzung identifizieren.
INDUSTRIE IMPLIKATIONENDie vorgeschlagenen Konten sind analytische Werkzeuge für Unternehmen, Investoren und Forscher. Sie sind kein offizielles zweites BIP und sollten mit der Logik der Volkswirtschaftsrechnung kompatibel bleiben [R22–R23]. MESSUNGSPRINZIP Je größer die virtuelle Wirtschaft wird, desto disziplinierter müssen ihre Konten sein.

ABBILDUNG 25 · Mensch–KI-Dual-Domain-Wertfluss

25.1 Warum das ‚KI-Welt-BIP' keine direkte additive Gesamtsumme ist

Ein Agent kann mehrere Modelle anrufen, interne Dienste kaufen und ein virtuelles Vermögen überweisen, bevor ein Endnutzer für ein Erlebnis bezahlt. Jede Stufe als neuen Wert zu zählen, würde die Zwischenaktivität mehrfach zählen. Vermögenspreise können auch ohne entsprechende aktuelle Produktion steigen. Die Messung muss zwischen Bruttotransaktionen, Umsatz, Einkommen, Kapitalbildung, Endnutzung und hinzugefügtem Wert unterscheiden und den wirtschaftlichen Hauptakteur hinter automatisierter Aktivität identifizieren.

25.2 Mensch–KI-Dual-Domain-Wertkonten

Der menschliche Bereich erfasst kreative Arbeit, Datenbereitung, Kapital, Energie, Rechte und institutionelle Dienstleistungen. Der KI-Ausführungsbereich erfasst Inferenz und Agentendienste, die einem beauftragenden Hauptakteur zugeschrieben werden. Der virtuelle-Weltbereich erfasst Endnutzung, aufrechterhaltenes Vermögen und interne Zirkulation. Der reale-Renditebereich erfasst beobachtbare Einnahmen, Löhne, Lizenzen und Steuern. Die Reconciliation entfernt Zwischenübertragungen und zeigt, wie sich Wert und Risiko zwischen den Bereichen bewegen.

25.3 Ein KI-natives audiovisuelles Satellitenkonto

Ein Satellitenkonto kann die branchenweite Produktion, Vergütung, Zwischeneingänge, Vermögensbildung, Importe, Exporte und Energieverbrauch schätzen, während die Hauptnationalkonten erhalten bleiben. Unternehmen könnten mit einer freiwilligen Stichprobe beginnen: Klassifizierung der Projektausgaben, Cloud-Betrieb, wiederverwendbare Weltvermögen, menschliche Vergütung und endgültige Erlöse. Das Ziel ist eine vergleichbare Evidenzbasis, nicht eine Schlagzahl, die von den Kontenrahmen getrennt ist.

TABELLE 25 · KAPITEL ANALYTISCHER RAHMEN

KontoAufzeichnungenVermeidung von Doppelzählung
Menschliche EingabeSchöpfung / Daten / Kapital / EnergieZwischeneingabe markieren
KI-AusführungSchlussfolgerung / AgentendienstZuordnung zum Auftraggeber
Virtuelle WeltEndnutzung / VermögensdienstTrennung des internen Umlaufs
EchtreturnErlös / Gehalt / Lizenz / SteuerBeobachtbare Ströme zählen
SatellitenkontoWertschöpfung / VermögensbildungAusrichtung auf die SNA
07

RECHTE, GOVERNANCE UND

Transparenz, Verantwortung und menschliche Handlungsfähigkeit

TEILPROPOSITION Vertrauen erfordert eine nachvollziehbare Kette, die Provenienz, Erlaubnis, Einwilligung, Versionshistorie und verantwortungsbewusste Veröffentlichung verbindet.

26 Kreative Kontrolle, Urheberrecht und digitale Kopien · 27 Provenienz, Content-Labeling und die Verantwortungskette · 28 Kulturelle Vielfalt, menschliche Handlungsfähigkeit und Nachhaltigkeit

26Kreative Kontrolle, Urheberrecht und digitale Kopien

KAPITEL THESISKI-Kino impliziert Urheberrecht, Verträge, Persönlichkeitsrechte, Schutzrechte für Darsteller und Plattformbedingungen. Die relevanten Fragen unterscheiden sich je nach Trainingsphase, Projektinputs, generierten Outputs, menschlicher Auswahl und Anordnung sowie der Veröffentlichung einer autonomen digitalen Kopie. Klassifizierung und Provenienz können Fakten liefern, doch die rechtliche Wirkung hängt von der Rechtsordnung und der Beweislage ab.
INDUSTRIE IMPLIKATIONENDie Prüfung der Rechte sollte schichtweise erfolgen, damit eine rechtliche Anspruchserklärung nicht verwendet wird, um einen unrechtlichen Input, eine nicht autorisierte Kopie oder eine Vertragsbeschränkung zu verbergen. RECHTLICHE GRENZE Dieser Beitrag liefert Branchenrahmen, keine rechtlichen Feststellungen. Rechte und Rechtsbehelfe bleiben Angelegenheiten der anwendbaren Rechtsordnung und autorisierten Entscheidungsträger.

FIGUR 26 · Vier Schichten der Rechte im KI-Kino

26.1 Autorenschaft: Werkzeugnutzung und kreative Kontrolle

Das US Copyright Office und andere Behörden betonen die menschliche Autorenschaft und Kontrolle bei der Bewertung der urheberrechtlichen Schutzfähigkeit [R15]. Bei KI-nativen Werken können Beweise die Konstitution, Auswahl, Anordnung, Revision und endgültige Freigabe des Schöpfers umfassen. Die bloße Anforderung eines unvorhersehbaren Ergebnisses ist nicht gleichbedeutend mit der Kontrolle der Ausdrucksform. Verschiedene Rechtsordnungen können zu unterschiedlichen Schlussfolgerungen kommen; Projektunterlagen sollten eine faktenbasierte Analyse unterstützen, ohne eine universelle rechtliche Antwort anzunehmen.

26.2 Trennung von Training, Projektinput und Output

Die Erlaubnis zum Training betrifft die Entwicklung eines Modells. Die Erlaubnis für Projekt-Eingaben betrifft die für eine bestimmte Arbeit bereitgestellten Vermögenswerte. Fragen zur Ausgabe betreffen Ähnlichkeit, geschützte Elemente, Vertragsbedingungen und menschlichen Beitrag. Diese Ebenen sollten unabhängig voneinander überprüft werden [R16]. Eine Produktion kann ein unsicheres Trainings- oder Replika-Problem nicht allein durch das Aufbringen eines Labels auf die Enddatei beheben.

26.3 Digitale Repliken und fortlaufende Zustimmung

Zustimmung für Gesicht, Stimme oder Performance sollte Medium, Kontext, Territorium, Dauer, Autonomie, Vergütung und Widerruf spezifizieren. Eine wesentliche Änderung – wie die Erlaubnis, dass eine Replike unskriptiert spricht, in eine sensible Szene eintritt oder nach dem Wegfall eines Performers weiterbetrieben wird – sollte eine erneute Zustimmung auslösen. Das System muss zudem einen praktischen Weg zur Beendigung neuer Nutzungen und zur Bewahrung der Aufzeichnung vorheriger autorisierter Freigaben bieten.

TABELLE 26 · ANALYTISCHER RAHMEN

ErlaubnisMindestinhaltAuslöser für erneute Zustimmung
DatenHerkunft / Zweck / AufbewahrungsfristNeue Trainingsnutzung
Gesicht und StimmeMedium / Kontext / TerritoriumSzenen
AutonomieDarf sagen / tun / verbotenPassiv zu Agent
Termin und RücktrittStopp / Löschen / ArchivierenModellbeständigkeit
AusgleichFestlegen / Verwenden / TeilenNeues Geschäftsmodell

27Herkunft, Inhaltskennzeichnung und die Verantwortungskette

KAPITEL THESISVertrauen erfordert drei koordinierte Ebenen: überprüfbare Herkunftsnachweise, maschinenlesbare Kennzeichnungen und menschlich wahrnehmbare Offenlegungen. Diese Ebenen erfüllen unterschiedliche Zwecke. Die Herkunft kann Assoziation und Integrität nachweisen; eine Kennzeichnung kann die Bewusstseinserfassung von Maschine und Nutzer unterstützen; weder bestimmt automatisch Wahrheit, Rechtmäßigkeit oder künstlerischen Wert [R11].
INDUSTRIE IMPLIKATIONENDie Verantwortung sollte gemäß Kontrolle auf den Modellanbieter, den Schöpfer, den Produzenten, den Vertriebspartner und den Betriebsoperator verteilt werden, nicht hinter einer allgemeinen Aussage verdeckt, dass KI beteiligt war. C2PA-PRINZIP Eine Herkunftsaussage kann als assoziiert und unverfälscht verifiziert werden; die Spezifikation beurteilt nicht, ob der Inhalt wahr, gut oder rechtmäßig ist [R11].

ABKÜRZUNG 27 · Drei Transparenzebenen

27.1 Eine dreischichtige Transparenzarchitektur

Die Herkunftsebene dokumentiert Assets, Werkzeuge, verantwortliche Parteien und Integritätsreferenzen. Die maschinenlesbare Ebene kommuniziert Erstellungs- und Änderungsstatus an Plattformen und Agenten. Die wahrnehmbare Ebene informiert Nutzer in einer kontextangemessenen Form. Chinas Kennzeichnungsmaßnahmen und die EU-Transparenzarbeit deuten beide auf eine Bewegung hin zu koordinierter expliziter und impliziter Offenlegung [R12–R14]. Die Umsetzung sollte zugänglich bleiben, ohne die Zuschauer zu überfordern.

27.2 Eine Verantwortungskette statt einer Verantwortungswolke

Ein Modellanbieter steuert die Leistungsfähigkeit, Sicherheitsvorkehrungen und Versionsoffenlegung. Ein Schöpfer steuert Eingaben und kreative Entscheidungen. Ein Produzent steuert den Arbeitsablauf, Rechte und Genehmigungen. Ein Vertriebspartner steuert Kennzeichnungen, Zielgruppe und Plattformpolitik. Ein Betriebsoperator steuert die Live-Politik, Incident-Response und Rollback. Mehrere Parteien können die Verantwortung teilen, jede Partei muss jedoch die Aufzeichnungen bewahren, die ihrem Kontrollbereich entsprechen.

27.3 Die institutionelle Position von Index.Film™

Index.Film™ unterstützt die Identifizierung, Aufzeichnung, Suche und Zusammenarbeit über Werk, Arbeitsablauf, Charakter, Welt, Verhalten und Archiv-Assets hinweg. Es sollte seine Metadatenregeln, Korrekturverfahren, Zugriffsebenen und Streitstände veröffentlichen. Inklusion ist keine Empfehlung; Indexierung bestätigt keine Rechtsinhaberschaft; und eine Identifizierung ersetzt keine rechtliche Registrierung oder gerichtliche Entscheidung. Diese Einschränkungen sind eine Quelle für Glaubwürdigkeit, nicht für Schwäche.

TABELLE 27 · ANALYTISCHER RAHMEN

ParteiPrimäre KontrolleMindestes Archiv
ModellanbieterFähigkeit / Sicherheit / VersionModellkarte / Änderung
KreativeEingaben / Auswahl / RevisionKreative Beweise
ProduzentArbeitsablauf / Rechte / GenehmigungLieferplan
VertriebLabel / Zielgruppe / PlattformVerantwortung für Veröffentlichung
BetreiberLive Policy / IncidentEvent und Rollback

28Kulturelle Vielfalt, menschliche Handlungsfähigkeit und Nachhaltigkeit

KAPITEL THESISDer Erfolg von KI-Kino lässt sich nicht anhand der Menge des generierten Inhalts messen. Er sollte anhand kultureller Vielfalt, schöpferischer Fähigkeiten und Lebensunterhalt, Nutzerhandlungsfähigkeit sowie der Energie- und Materialkosten von Produktion und Betrieb bewertet werden. Ein effizienteres Modell kann auch bei schneller Ausweitung der Nutzung eine insgesamt höhere Gesamtkonsummenge bewirken [R19–R20].
INDUSTRIE IMPLIKATIONENNachhaltigkeitsmetriken sollten die relevante Einheit verwenden – beispielsweise Energie pro akzeptierter fertiger Sekunde oder pro Sitzung Minute – und gleichzeitig die Gesamtnachfrage sowie die Verteilung der Vorteile melden.
ÖFFENTLICHER WERTEine produktive KI-Kino-Wirtschaft sollte die ausdrucksstarke Vielfalt und menschliche Handlungsfähigkeit steigern, ohne dass der Ressourcenverbrauch oder die Plattformabhängigkeit unsichtbar bleiben.

FIGURE 28 · Vier Dimensionen des öffentlichen Wertes

28.1 Kulturelle Vielfalt und Datenkonzentration

Große Modelle können dominante Sprachen, Ästhetiken und kommerzielle Annahmen nachbilden. Vielfalt erfordert mehr als die Übersetzung einer Schnittstelle. Institutionen sollten untersuchen, welche Archive, Performance-Traditionen und narrative Strukturen in Daten und Bewertungen erscheinen; lokale Schöpfer und Sprachen unterstützen; und Gemeinschaften die Möglichkeit geben, sensible Anwendungen zu definieren. Die Arbeit der UNESCO zu KI und Kultur unterstreicht die Notwendigkeit, Innovation mit kulturellen Rechten und pluraler Teilhabe zu verbinden [R18].

28.2 Menschliche Handlungsfähigkeit und die Schöpferwirtschaft

Schöpfer benötigen eine sinnvolle Kontrolle über Werkzeuge, Anerkennung, Einkommen, Portabilität und Ablehnung. Zuhörer benötigen die Möglichkeit, adaptive Systeme zu verstehen, zu korrigieren und zu verlassen. Eine Plattform kann die nominale Teilnahme erhöhen, während sie die Verhandlungsmacht reduziert oder Schöpfer abhängig von undurchsichtigen Ranking- und Generierungsdiensten macht.

Menschliche Handlungsfähigkeit ist daher eine ökonomische und institutionelle Metrik, nicht nur eine ethische Bestrebung.

28.3 Energie und nachhaltige Erzeugung

Die Bewertung sollte die Energie pro akzeptierter Ausgabe, pro Benutzersitzung und pro aktiver Welt melden, während Gesamtenergie und regionale Netzeffekte weiterhin sichtbar bleiben. Modelleffizienz, Caching, Edge-Platzierung, Workload-Scheduling, erneuerbare Versorgung und selektive Erzeugung können die Nachfrage senken. Die Branche sollte die Annahme vermeiden, dass eine generierte Fülle keine physischen Infrastrukturaufwendungen hat [R19–R20].

TABELLE 28 · ANALYTISCHER RAHMEN

DimensionNützliche MetrikUnzureichende Metrik
EnergiePro akzeptierte Sekunde / Sitzung MinuteEine Inferenz
KulturSprache / Region / Creator-VerteilungGesamtmenge
ArbeitskraftEinkommen / Übergang / VerhandlungAutomatisierungsverhältnis
AgencySteuerung / Austritt / BeschwerdeVerbrauchte Zeit
08

PROGNOSEN, SZENARIEN UND

Das Entscheidungsfenster 2026–2035

LEITTHESE DES TEILS — Eine Prognose ist kein Versprechen, sondern eine öffentliche Darlegung von Annahmen, Voraussetzungen für die Einführung, Unsicherheiten und Entscheidungspunkten.

29 A 2026–2035 Technologie- und Industrie-Roadmap · 30 Vier Zukunftsszenarien · 31 Handlungsführer für Branchenakteure · 32 Eine gemeinsame Aktionsagenda

29Eine 2026–2035 Technologie- und Industrie-Roadmap

KAPITEL THESISDie Roadmap nutzt Beobachtungsfenster anstelle von zugesagten Terminen. Die Infrastrukturphase priorisiert steuerbare Generierung, Beweise und Workflow-Integration. Die Formausdehnungsphase hängt von kostengünstiger Echtzeit-, mehrbenutzer- und räumlicher Kapazität ab. Die Phase persistenter Welten erfordert Kontinuität über Geräte hinweg, stabile Ökonomie und grenzüberschreitende Governance.
INDUSTRIE IMPLIKATIONENEine Form skaliert nur, wenn sich fünf Tore ausrichten: technische Zuverlässigkeit, ökonomische Machbarkeit, Gerätezugang, Governance-Legitimität und kulturelle Akzeptanz. PROGNOSEDISZIPLIN — Termine sind Überprüfungsfenster, keine Gewissheiten. Fähigkeiten, die ein Tor verfehlen, sollten verschoben oder eingegrenzt werden, nicht als unvermeidlich beworben werden.

ABBILDUNG 29 · Drei Beobachtungsfenster, 2026–2035

29.1 2026–2028: die Infrastrukturphase

Die Priorität liegt auf steuerbarer Generierung, Zustandssystemen für Langformate, nativen Audio-Video-Workflows, Provenienz, Kennzeichnung und professioneller Bewertung. KI-native Filme werden häufiger, während Echtzeitprodukte weiterhin begrenzt bleiben. Organisationen, die tragbare Vermögenswerte, Rechteaufzeichnungen, Modellrouten und Kennzahlen für akzeptable Ergebnisse aufbauen, schaffen Vorteile, die einem schnellen Modellwechsel standhalten.

29.2 2029–2032: die Formausdehnungsphase

Wenn sich die Voraussetzungen bei Latenz, Kosten und Gerätezugang verbessern, können interaktives Kino, generierte Live-Events, geteilte Film-Spiel-Welten und räumliche Erfahrungen von Demonstrationen zu wiederholbaren Produkten übergehen. Neue Abonnement- und Event-Einnahmen können entstehen. Der kritische Governance-Wechsel geht von dateibasierten Aufzeichnungen zu ereignisbasierten Verantwortlichkeiten und von Content-Berechtigung zu Agenten- und Welt-Berechtigung.

29.3 2033–2035: die anhaltende-Welt-Phase

Wenn Identität, Mehrbenutzer-Zustand, Portabilität, Ökonomie und Governance reifen, können persistente kulturelle Welten zu einem bedeutenden Medium werden. Sie werden Filme oder Spiele nicht ersetzen. Sie bieten eine Ebene, auf der Werke, Charaktere und Gemeinschaften über Geräte und Formate hinweg bestehen bleiben. Grenzüberschreitende Streitigkeiten, statistische Behandlung und langfristige Bewahrung werden zu zentralen Institutionen.

TABELLE 29 · ANALYTISCHER RAHMEN

FensterKompetenztorMarkttorGovernanztor
2026–2028Steuerbare Generierung / WorkflowProfessionelle AdoptionLabels / Provenienz
2029–2032Mehrbenutzer / räumlich / kostengünstigAbonnement / cross-mediaAgent-Berechtigung / Ereignisprotokoll
2033–2035Beständige cross-device-WeltStabile WeltökonomieGrenzüberschreitende Verantwortung / Statistik

30Vier Zukunftsszenarien

KAPITEL THESISSzenarioplanung wählt nicht die attraktivste Zukunft aus. Sie prüft, ob gegenwärtige Entscheidungen verschiedenen Kombinationen von Modellkapazität, Offenheit, Vertrauen, Ökonomie und Regulierung standhalten. Die vier Szenarien sind gelenktes Wachstum, Plattform-Verriegelung, Vertrauenskrise und offene Welten.
INDUSTRIE IMPLIKATIONENKein-Reue-Strategien umfassen tragbare Vermögenswerte, sichtbare Verantwortung, überprüfbare Aufzeichnungen, plattformübergreifenden Betrieb, nachhaltige Unit-Ökonomie und menschliches Talent, das über Systeme hinweg arbeiten kann. STRATEGIE-METHODE Die beste Planung ist nicht auf eine Prognose optimiert. Sie bewahrt die Wahl über mehrere plausible Zukünfte hinweg.

FIGUR 30 · Vier Zukunftsszenarien

30.1 Gelenktes Wachstum

Kapazität und Umsatz verbessern sich, während Standards, Kennzeichnung und Verantwortung reifen. Professionelle KI-native Produktion expandiert, und die Publikum akzeptiert adaptive Erlebnisse, weil Kontrolle lesbar ist. Die gewinnende Strategie ist die Investition in vertrauenswürdige Vermögenswerte, Evaluation und interoperable Governance anstelle maximaler Autonomie.

30.2 Plattform-Verriegelung

Eine kleine Anzahl integrierter Plattformen kontrolliert Modelle, Identität, Verteilung, Zahlung und Weltzustand.

Kreative Werkzeuge sind mächtig, aber der Export ist kostspielig und die Bedingungen können sich ändern. Organisationen benötigen eine plattformübergreifende Architektur, vertragliche Austrittsrechte, unabhängige Aufzeichnungen und Vermögenswerte, die ohne Verlust von Identität oder Berechtigungshistorie migriert werden können.

30.3 Vertrauenskrise

Öffentlichkeitswirksame Schäden, Rechtsstreitigkeiten, synthetische Täuschung oder Sicherheitsvorfälle verringern das Vertrauen des Publikums und der Institutionen. Die Regulierung wird verschärft und die Versicherungsprämien steigen. Provenienz, explizite menschliche Verantwortung, kontrollierter Produktschwerpunkt und geübte Vorfallreaktion werden zu Bedingungen für Marktzugang und nicht zu optionaler Compliance.

30.4 Offene Welten

Offene Standards, Agententransaktionen und tragbare Identität ermöglichen es Schöpfern und Gemeinschaften, über mehrere Welten hinweg zu operieren. Innovation und pluralistische Teilhabe nehmen zu, ebenso wie Missbrauch, Betrug und Komplexität von Streitigkeiten über Systeme hinweg. Die Möglichkeit hängt von starken Identitätsberechtigungen, überprüfbaren Governance, interoperablen Beweisen und fairen Abwicklungen ab.

TABELLE 30 · KAPITELANALYTISCHER RAHMEN

SzenarioFührendes SignalKein-Reue-Strategie
Reguliertes WachstumOffene Standards / bessere WirtschaftswissenschaftenVertrauenswürdige Vermögenswerte
PlattformumschließungHohe Wechselkosten / KonzentrationExport und Multi-Plattform
VertrauenskriseVorkommnisse / Rechtsstreit / AbwanderungProvenienz und menschliche Verantwortung
Offene WeltenInteroperabilität / AgentenhandelIdentität, Berechtigungen und Streitbeilegung

31Handlungsleitfaden für Branchenakteure

KAPITEL THESISAkteure sollten mit Arbeiten beginnen, die den Wert über Modelle und Szenarien hinweg bewahren. Ein 90-Tage-Plan identifiziert Vermögenswerte, Rechte, Kosten und Verantwortung. Ein 12-Monatsplan baut Zustand, Beweise und Governance-Pipelines auf. Ein 36-Monatsplan entwickelt Weltoperationen, cross-media Produkte, nachhaltige Einnahmen und institutionelle Partnerschaften.
INDUSTRIE IMPLIKATIONENDie Strategie sollte Portabilität und nachvollziehbare Betriebsfähigkeit priorisieren, bevor sie sich auf eine geschlossene technische Stack oder eine ungetestete zukünftige Form einlässt. EXECUTION PRINCIPLE Bauen Sie die Grundlagen auf, die wertvoll bleiben, wenn sich ein Modell, eine Plattform oder eine Prognose ändert.

FIGUR 31 · Aktionsnetzwerk für sechs Akteursgruppen

31.1 Schaffende und Produktionsorganisationen

Kartieren Sie Story, Charakter, Welt, Workflow und Beweismittel. Definieren Sie die kreative Absicht für KI-natives Schaffen vor der Auswahl von Werkzeugen. Stellen Sie Zustands- und Versionsverwaltungssysteme, akzeptable Output-Metriken, Rechteprüfung und endgültige menschliche Bestätigung ein. Führen Sie ein begrenztes Projekt durch, das ehrlich bewertet werden kann, anstatt Experimente über jede Produktion ohne Lernen zu verteilen.

31.2 Anbieter von Modellen, Technologien und Plattformen

Legen Sie Fähigkeiten und wesentliche Einschränkungen offen; unterstützen Sie Export, Versionshistorie und Provenienz; trennen Sie probabilistische Vorschläge von Transaktionen; stellen Sie Werkzeuge für einen sicheren eingeschränkten Betrieb und die Vorfallbehandlung bereit; und veröffentlichen Sie Änderungen, die Rechte oder Output betreffen. Plattformen sollten eine verantwortungsvolle Bedienung einfacher machen als undurchsichtige Workarounds.

31.3 Vertrieb, Investitionen und Versicherung

Verwenden Sie KI-Lieferungspläne, die Assets, Modelle, Berechtigungen, Labels, Beweismittel und laufende Verantwortung identifizieren. Bewerten Sie die Wirtschaftlichkeit akzeptabler Outputs und persistente Weltverpflichtungen. Berechnen Sie Risiken gemäß Kontrolle und Aufzeichnungen, anstatt alle KI-Beteiligung als identisch zu behandeln. Erfordern Sie einen praktischen Ausstieg und Archivierungsplan.

31.4 Politik, Forschung und Bildung

Entwickeln Sie gemeinsame Terminologie, repräsentative Testsets, gemeinwohlorientierte Forschung und statistische Pilotprojekte.

Die Bildung sollte Kino, Interaktion, Systeme, Daten, Rechte und Operationen kombinieren. Zertifizierungen sollten nachgewiesene Fähigkeiten und professionelle Verantwortung anerkennen, anstatt kurzfristige Vertrautheit mit einer Schnittstelle.

TABELLE 31 · ANALYTISCHER RAHMEN

StakeholderErste 90 TageInnerhalb von 12 Monaten
Schaffende / ProduzentenBestandsaufnahme von Assets und RechtenWeltzustand und Beweismittel-Pipeline
TechnologieplattformenKörperschaft und Grenzen offenlegenExportierbare Herkunftsnachweise / Rückgrat
Verteilung / KapitalAI-LieferplanWirtschaftlichkeit pro Einheit / Risikobenchmark
Politik / ForschungVerträge und ProbenÖffentliche Tests / statistische Pilotstudie
BildungInterdisziplinäres CurriculumRollenzertifizierung / Übergang

32Eine gemeinsame Aktionsagenda

KAPITEL THESISDie drei herausgebenden Institutionen schlagen ein fortlaufendes öffentliches Programm vor: Erhaltung der dualen Klassifizierung, Entwicklung von Bewertungsbenchmarks, Weiterentwicklung von Index.Film™, Vernetzung von Städten und Talenten, Test eines audiovisuellen Satellitenkontos und Veröffentlichung einer jährlichen Überprüfung der Evidenz. Der Wert des Weißbuchs liegt darin, ob seine Behauptungen und Rahmenwerke getestet, korrigiert und gemeinsam entwickelt werden können.
INDUSTRIE IMPLIKATIONENJedes Programm muss seine Governance-Grenze veröffentlichen: Klassifizierung ist keine rechtliche Entscheidung, Bewertung ersetzt keine Kritik, Indexierung ist keine Empfehlung und ein Satellitenkonto ist kein offizielles BIP. GEMEINSAME VERPFLICHTUNG Ein Weißbuch sollte ein rechenschaftspflichtiger öffentlicher Prozess sein, nicht eine einmalige Behauptung der Autorität.

FIGUR 32 · Gemeinsames öffentliches Interesse-Programm

32.1 Definitionen und Bewertung als öffentliche Infrastruktur

Das P/R-Modell, die Phasen G0–G5 und die Beweissprache E1–E4 sollten durch Fallstudien und Peer-Reviews überarbeitet werden. Benchmarks sollten langformige Kontinuität, Kontrolle, Echtzeit-Wiederherstellung, Provenienz und menschliche Agency testen, während die künstlerische Qualität offen für Kritik, Jurys und das Publikum stehen bleibt.

32.2 Index.Film™ und Marktkollaboration

Das Programm sollte mindestens Felder für sechs Asset-Typen, Zugriffsebenen, Korrektur- und Streitbeilegungsprozesse sowie maschinenlesbare Berechtigungsabgrenzungen veröffentlichen. Marktpilotprojekte können testen, wie Identifikatoren und Aufzeichnungen Transaktionskosten senken, ohne zu behaupten, Eigentum oder künstlerischen Wert zu bestimmen.

32.3 Eine globale Stadt und ein Netzwerk für Talente

Städte können gemeinsame Produktionen, Tests, Bildung, Festivals, Residencies und Marktzugang beherbergen. Die Teilnahme sollte auf konkreten Projekten und gegenseitigem Nutzen basieren, nicht auf nomineller Mitgliedschaft. Das Netzwerk sollte lokale kulturelle Kreise sichtbar machen und die grenzüberschreitliche Interoperabilität verbessern.

32.4 Forschung und jährliche Veröffentlichung

Jedes Jahresheft sollte technische Beweise, regulatorische Entwicklungen, Marktdaten und Szenariosignale aktualisieren. Es sollte Fehler und geänderte Urteile melden. Ein ständiger Forschungsprozess kann Institutionen, Schöpfer, Künstler, Ingenieure und Gruppen im öffentlichen Interesse einladen, das Rahmenwerk zu testen und Vorschläge für Änderungen vorzulegen.

TABELLE 32 · ANALYTISCHER RAHMEN

Öffentliches ProgrammErster AusgabeRegierungsabgrenzung
Doppelachse-KlassifikationJährliche Spezifikation / FälleKeine Rechtsentscheidung
BewertungsbenchmarkLangform / Echtzeit-TestsKeine künstlerische Bewertung
Index.Film™Mindestfelder für sechs AssetsInklusion ist keine Empfehlung
StädtenetzwerkGemeinsame Projekte / TalentflussKeine nominale Allianz
SatellitenkontoUnternehmensbeispiel PilotKein offizielles BIP
Jährliches WeißbuchPrognoseprüfung / RevisionÖffentliche Versionsgeschichte

Anhänge Die Anhänge verwandeln die Konzepte des Weißbuchs in praktische Begriffe, Nachweiserfordernisse, Metadaten, Revisionsprotokolle und Handlungswerkzeuge.

Anhang A Kernbegriffsverzeichnis

KI-natives Kino
Ein audiovisuelles Werk, in dem die KI eine wesentliche Rolle in den zentralen kreativen Dimensionen spielt und das Werk nicht vollständig vom KI-gestützten Prozess getrennt werden kann.
Kreativagentur-Achse (P0–P4)
Eine Klassifikation der substantiellen Rolle der KI in Narrativ, Bild, Ton, Charakter und Interaktion.
Achse der Laufzeitgenerierung (R0–R4)
Eine Klassifikation des Anteils der während der Nutzung generierten Arbeit.
Marker für 51%+
Eine Qualifikationsgrenze für substantielle kreative Führung auf der P-Achse; keine Qualitäts- oder Rechtsbewertung.
Weltmodell
Ein System, das zustandsabhängige Zustände, Gedächtnis und kausale Beziehungen aufrechterhält und vorhersagt.
Geschichtskonstitution
Die Themen, Regeln, Charakterverpflichtungen, Variationsgrenzen und Governance, die einen generativen narrativen Raum definieren.
Weltzustand
Autoritative Informationen über Entitäten, Standorte, Beziehungen, Ereignisse und Berechtigungen zu einem bestimmten Zeitpunkt.
Vermögenswertfamilie
Die vernetzte Menge aus Werk, Workflow, Charakter, Welt, Verhalten und Record-Assets.
Herkunft
Informationen über Herkunft, Transformation, verantwortliche Parteien und Integrität, die einem Asset zugeordnet sind.
Rechtehülle
Maschinenlesbare Felder, die den erlaubten Gebrauch beschreiben und wann eine menschliche Genehmigung erforderlich ist.
Mensch-KI-Dual-Domänen-Wertkonten
Ein analytischer Rahmen, der menschliche Eingaben, AI-Execution, virtuelle Nutzung und beobachtbare reale Renditen trennt.
AI-natives audiovisuelles Satellitenkonto
Ein statistischer Rahmen für branchenweite Ausgabe und Vermögenswerte, der mit Prinzipien der Volkswirtschaftsrechnung verknüpft ist.

Anhang B: Klassifizierung von P/R und kreative Beweise

P sollte über Erzählung, Bild, Ton, Charakter und Interaktion bewertet werden, unter Verwendung von vor der Prüfung deklarierten Gewichten. Der 51%+ Marker bestimmt die Qualifikation für P3 ausschließlich. R wird unabhängig nach der Laufzeitgenerierung bewertet.

BeweisgruppeBeschreibung
Kreative AbsichtKonzept, Thema, Regeln und genehmigte Versionen
WerkzeugketteModelle, Versionen, Knoten und Einstellungen
GenerierungsprozessPrompts, Referenzen, Kandidaten und Ablehnung
Menschliche KontrolleAuswahl, Anordnung, Revision und Genehmigung
DauerEingabe, Zustand, Politik und Generierungsebene

Anhang C Index.Film™ Mindest-Metadaten-Profil

Dieses Profil unterstützt die Identifizierung, Aufzeichnung, Suche und Zusammenarbeit. Es bestätigt keine Rechte und unterstützt keine Vermögenswerte. Öffentliche, eingeschränkte und private Ebenen sollten getrennt bleiben.

FeldgruppeBeispiel
IdentitätID / Typ / Version / übergeordnetes Element
Verantwortliche ParteienErsteller / Einreicher / Kontakt
HerkunftModell / Werkzeug / Asset-Deklaration
RechteTerritorium / Zeitraum / Nutzung / Status
GovernanceEtikett / Streit / Rücknahme
TechnikFormat / Schnittstelle / Hash

Anhang D Beweise, Prognose und jährliche Revision

Protokoll

  • Klagegrade E1–E4 verifizieren und eine zugängliche Primärquelle oder eine Hinweis auf Beweise beibehalten.
  • Angabe technischer, wirtschaftlicher, apparativer, governance- und kultureller Annahmen für Prognosen.
  • Bericht der Bestätigung, Verzögerung, Herabstufung, Rücknahme und Fehler in der folgenden Ausgabe.
  • Trennen von vom Anbieter gemeldeter Leistung von unabhängiger Validierung.
  • Öffentliche Versionsgeschichte für Klassifikationen, Metadaten und Bewertungsrahmen beibehalten.

Anhang E 90-Tage-, 12-Monats- und 36-Monats-Aktionsrahmen

HorizontOrganisationsfähigkeit
90 TageVermögenswerte, Werkzeuge, Rechte und Kosten erfassen
12 MonateZustand, Routing und Beweissysteme aufbauen
36 MonateWeltoperationen und Agentenfähigkeit entwickeln

Anhang F Primärliteratur und Quellen

Primärforschungsarbeiten, Normungsgremien, Regulierungsbehörden, internationale Organisationen und offizielle Veröffentlichungen der Modellentwickler werden priorisiert. Die Informationen wurden bis zum 16. Juli 2026 geprüft.

[R01] OpenAI. Videogenerierungsmodelle als Weltsimulatoren. 2024.

[R02] Google DeepMind. Veo 3.1 – Modellübersicht und Fähigkeiten. 2025.

[R03] Meta AI. Movie Gen: Eine Cast of Media Foundation Models. 2024.

[R04] Tencent Hunyuan. HunyuanVideo: Ein systematischer Rahmen für große Videogenerative Modelle. 2024.

[R05] Wan Team. Wan: Offene und fortschrittliche großskalige Videogenerative Modelle. 2025.

[R06] Zhang et al.. Generative KI für Filmproduktion: Eine Übersicht neuester Fortschritte. 2025.

[R07] Google DeepMind. Genie 3 – Echtzeit-interaktives Weltmodell. 2025/2026.

[R08] Liu et al.. Zu interaktiven Videoweltmodellen: Frontières, Herausforderungen, Benchmarks und zukünftige Trends. 2026.

[R09] Wang et al.. Matrix-Game 3.0: Echtzeit- und Streaming-interaktives Weltmodell mit langfristiger Gedächtnisfunktion. 2026.

[R10] Wu et al.. Infinite-World: Skalierung interaktiver Weltmodelle auf 1000-Frames-Horizonte. 2026.

[R11] C2PA. Content Credentials Technical Specification 2.2 und Erläuterung. 2025/2026.

[R12] Cyberspace Administration of China et al.. Maßnahmen zur Kennzeichnung KI-generierter und synthetischer Inhalte. 2025.

[R13] Europäische Kommission. Code of Practice auf Transparenz von KI-generierten Inhalten. 2026.

[R14] Europäische Union. Verordnung (EU) 2024/1689, Artikel 50. 2024.

[R15] US Copyright Office. Urheberrecht und Künstliche Intelligenz, Teil 2: Urheberschutz. 2025.

[R16] WIPO. Generative KI: Navigieren des geistigen Eigentums. 2024.

[R17] NIST. KI-Risikomanagement-Rahmenwerk: Profil Generative KI (NIST AI 600-1). 2024/2026.

[R18] UNESCO. Bericht der unabhängigen Expertengruppe für Künstliche Intelligenz und Kultur. 2025.

[R19] International Energy Agency. Energie und KI. 2025.

[R20] International Energy Agency. Der Stromverbrauch von Rechenzentren stieg 2025. 2026.

[R21] Google. Agent Payments Protocol (AP2). 2025.

[R22] International Monetary Fund. Wie Agentic KI Zahlungen verändern wird. 2026.

[R23] United Nations Statistics Division. System der nationalen Konten 2025. 2025.

[R24] Google. Android XR-Brillen-Demonstration und Plattformübersicht. 2025.

[R25] Meta. Vorstellung von Orion, Prototyp für Augmented Reality-Brillen. 2024/2025.

[R26] Apple Developer. Foveated Streaming für visionOS. 2026.

[R27] Khronos Group. OpenXR und Spatial Entities-Erweiterungen. 2025.

Anhang G Veröffentlichungsstellen

International Artificial Intelligence Audiovisual Asset Indexing Standards Alliance (IAISA) Schnittstellen für audiovisuelle Vermögenswerte, maschinenlesbare Metadaten, Provenance und Marktzusammenarbeit.

International Artificial Intelligence Film Producers Association (IFAIFPA) KI-native Produktionsysteme, Technologiepfade, professionelle Koordination, Evaluation und ProduzentenNetzwerke.

Hong Kong Artificial Intelligence International Film Festival Association (HKAIIFF Association) KI-natives Filmkunst, Schöner-Ökosysteme, Festivalpraxis und internationale Stadt-Kollaboration.

Fakten

Veröffentlichungsdatum
2026-07-17
Verleger
Verein · IFAIFPA · IAISA
Struktur
Fünf Hauptteile + Manifest-Kapitel
Lesemodus
Volltext online
Evaluationstheorie
Theorie der Dirigenten

FAQ

Was behandelt der Whitepaper?

Die KI-Film-Ära, KI-natives Kino-Definition, der 51%+ Standard, Branchenketten-Umstrukturierung und Zukunftsperspektiven, plus das KI-Native Cinema Manifesto.

Wer hat es veröffentlicht?

Der Hong Kong AI International Film Festival Association, IFAIFPA und IAISA, gemeinsam am 17. Juli 2026.

Kann ich es herunterladen?

Keine Download-Möglichkeit. Der Volltext ist auf dieser Seite zum Online-Lesen verfügbar. Zitate müssen die Quelle nennen.

Wie wird der 51%+ Standard im Whitepaper definiert?

Kein Pixel-Share – es prüft, ob KI-Arbeitsabläufe eine gewichtete führende Rolle in den zentralen kreativen Entscheidungen einnehmen.

Verwandte · Offizielles Whitepaper von Index.Film (IAISA · IXF Standard V6) →