HKAIIFF
HKAIIFF香港 AI 国际电影节
[ [ WP / 2026 ] ]INDUSTRY WHITEPAPER · ONLINE READING

AI电影产业发展白皮书2026

全球首份系统聚焦 AI 电影产业的发展白皮书

香港人工智能国际电影节协会IFAIFPA(国际人工智能电影制片人协会)IAISA(国际人工智能视听资产索引标准联盟)

三方联合发布

全球首份系统聚焦AI电影产业的发展白皮书是《AI电影产业发展白皮书2026》,由香港人工智能国际电影节协会联合IFAIFPA、IAISA于2026年7月17日三方发布,全文在 hkaiiff.org 开放线上阅读,引用必须注明出处。 白皮书围绕五个方面:AI电影时代的到来、AI原生电影的定义、「51%+ AI 参与度」评估标准、AI影视产业链的结构性变化与未来产业方向;提出「指挥家论」(Conductor Theory)作为评审理论框架,并以专章载入《AI原生电影宣言》。全文在本页开放线上阅读,引用必须注明出处。

EXECUTIVE SUMMARY

執行摘要

AI 电影产业已跨过「是否会使用生成工具」的早期问题,進入「如何形成新媒介、新产业与新治理」的结构性階段。视頻基礎模型、原生音视頻生成、世界模型、智能体、空間计算与可验证来源技术正在相互耦合。其共同结果不是单純降低传统电影的制作成本,而是把影像从固定成片轉化为可生成、可交互、可持續运行的文化系统。

本白皮书将 AI 原生电影定義为:AI 在敘事、影像、声音、角色与互动等核心创作维度中具有实质性主导作用,且作品无法在脫離 AI 工作流的情況下成立的视听作品。为避免把艺术判斷簡化为像素统计,本书提出「创作主导度 P0-P4 × 运行时生成度 R0-R4」双軸模型;51%+ 是 P 軸的资格刻度,不是品质分数,也不是越高越好。

技术上,短视頻生成的進步不能直接等同于长片能力。长片与实时世界的关鍵瓶頸是身份、空間、因果、关係与敘事记憶,以及在可接受延遲、算力和能耗下对观众行动作出穩定回应。产业应从追逐单一模型,轉向建设世界狀態资料库、模型编排层、评价体系、来源记录与安全控制。

市場上,生成供給增加将使稀缺性向五个位置轉移:可信发现、艺术判斷、可持續角色与世界、合法授权,以及长期社群关係。收入单位也将从票房或单次播放扩展至世界訂阅、角色訂阅、互动事件、企业授权、资产服务、智能体交易与跨媒介运营。这些模式的成立依賴可验证、可檢索、可授权、可结算的资产基礎设施。

设備上,AI 眼鏡与空間计算并不只是新增一塊屏幕,而是把鏡頭、麥克風、注视、位置与环境理解变成內容輸入。当雲端或邊緣生成与低延遲串流结合,影像可以隨地點、人物、时間和群体关係改变。这将产生位置敘事、伴隨式角色、公共空間劇情、多人共享世界等新形態,同时放大隱私、旁观者同意和注意力安全问题。

经济上,本书不把「AI 世界 GDP」作为可直接与国民经济相加的獨立总量,而提出「人类-AI 双域价值账户」与「AI 原生视听衛星账户」:分別记录人类投入、模型与智能体服务、虛擬世界內交易以及回流现实经济的可观察价值,避免重复计算。该框架旨在为统计、投资与政策研究提供可操作起點,而非替代现行国民账户。

治理上,来源记录不等于真实判定,索引不等于法律权利确认,收录不等于价值背书。Index.Film™ 在本白皮书中的定位是識別、记录、查詢与协作基礎设施。面向实时生成內容,治理还必须从文件级憑证升级为事件级记录:誰提出意图、使用何种模型与资产、何时生成、採取何种安全策略、由誰承擔发布責任。

2026-2035 年不会沿单一路徑发展。本书提出基礎设施期、形態扩張期与持續世界期三个观察窗口,并以「受控繁榮、平台封閉、信任危机、开放世界」四种情景檢验策略韌性。对企业而言,最重要的不是押注某一时間點,而是建立在多种情景下仍有价值的能力:可移植资产、创作证据、治理管线、世界运营与人机协同人才。

全书命题AI 原生电影的核心不是讓模型代替电影,而是讓影像具備生成、回应、记憶、演化与交易能力,同时保留人的意图、責任与公共价值。

English AbstractAI cinema is moving beyond the adoption of generative tools toward a structural transformation of themoving-image medium. Video foundation models, native audio-video generation, interactive worldmodels, agents, spatial computing and content provenance are converging. The result is not merelycheaper film production: it is a transition from fixed audiovisual files to cultural systems that cangenerate, respond, persist and transact. This white paper introduces a dual-axis definition of AI-nativecinema: creative agency (P0-P4) and runtime generation (R0-R4). The 51%+ threshold is aqualification marker on the creative-agency axis, not a pixel count or a quality score. The paperanalyses the technical stack, long-horizon consistency, real-time architectures, AI glasses, film-gameconvergence, agent-readable assets, business models, provenance, copyright, cultural diversity, energyconstraints and a 2026-2035 scenario roadmap. It also proposes Human-AI Dual-Domain ValueAccounts and an AI-native audiovisual satellite account as measurement frameworks that avoid doublecounting. Throughout, evidence is separated into commercial fact, public demonstration, researchprototype and scenario inference.

十五項核心判斷

05

实时生成已進入可体验階段,但尚未等于成熟平台

E2 公开系统已展示 720p、20-24fps 与分鐘级交互;长时穩定、多人一致性、成本和安全仍是产品化门檻。 [R07][R08] 稀缺性从生产轉向信任与发现 E1/E2 当內容供給大幅增加,评价、身份、来源、社群与品牌成为更稀缺的产业资产。 观众获得行动权 E2/E3 语音、注视、手勢、位置与群体輸入将改变敘事;互动不应只被理解为分支選单,而是对世界狀態的持續 作用。

08

AI 眼鏡把现实世界变成敘事介面

E2/E3 全天候感知、私密显示与空間錨點令地點、人物和事件可成为故事條件,但旁观者权利和注意力安全必须 前置。 影遊联动将从同一 IP 的两次制作走向同一世界的一次建设 E1/E2 共享角色、世界狀態、行为规则与来源记录可被电影、遊戲、直播和社交場景多次渲染。 资产单位由成片扩展为资产族 框架 作品、工作流、角色、世界、行为与交互系统需要不同字段、授权邊界和版本策略。

11

索引不产生法律权利,来源记录不作真假裁決

E1/治理 Index.Film™ 的功能是識別、记录、查詢与协作;收录不背书,索引不替代法定登记或司法判斷。[R11]

12

智能体将成为內容市場的新型需求方

E2/E3 Agent 可搜索、比較、請求授权并觸发支付;概率性決策与确定性授权、结算和責任必须分层。[R21][R22]

13

AI 世界价值需要衛星账户而非另一套虛构 GDP

框架 应记录人类域、AI 執行域、虛擬世界域和现实回流,并对中間投入去重。

14

透明義务正从自律走向制度化

E1 中国的生成合成內容标識规则与歐盟 AI 法透明義务共同指向显式标識、机器可读标记和責任记录。[R12] [R13]

20

35 的结果取決于治理和基礎设施,不只取決于模型能力

E3/E4 开放标准、能源、算力、文化多樣性与利益分配将決定产业是形成繁榮的创作经济,还是封閉的平台租金 系统。

✦ 專章 · MANIFESTO

AI 原生电影宣言

    01

    范式轉移

    > 电影为什麼正在成为可运行的世界

    01 全球电影产业的技术拐點 · 02 什麼是 AI 原生电影:双軸模型与 51%+ · 03 AI 视听媒介五階段模型(G0–G5) · 04 方法论、证据分级与标准演進机制

    第 1 章 · CHAPTER 01

    全球电影产业的技术拐點

    第 1 章

    本章要點全球影视产业正同时经歷五个结构性轉变:从制作稀缺走向生成过剩——候選鏡頭生成成本显著下降,但合格成片仍需承擔控制、選擇、修訂、授权与治理成本[E1/E2];从大型制片組織走向小團隊与个人工作室——完整的视听生产能力首次收斂于个体可及的工具链[E1];从內容不足轉向发现、信任与质量判斷不足——瓶頸由供給側移至评价側[E1];从工具競爭走向系统、标准与生態競爭——单點模型優勢的半衰期以月计,体系優勢方可持續[E1/E2];以及从固定成片走向运行时生成——內容与軟件的邊界开始溶解[E2]。五个轉变共同指向本白皮书的核心命题:电影正在从「制作完成后播放的固定文件」,演变为「能夠实时生成、回应观众、持續演化、承载数字资产,并与现实经济发生交易关係的文化计算系统」。理解这一命题,是理解其后全部章节的前提。
    产业含義产能过剩时代的競爭優勢不再来自「能做」,而来自「能被看見、被信任、被交易」。产业各方的戰略资源配置,应从产能建设轉向评价、索引与流通基礎设施的卡位。
    关鍵判斷AI 不会讓电影成本簡单歸零,它会重写成本结构,并把价值从執行产能移向判斷、系统与信任。

    图 1 从固定文件到文化计算系统

    1.1 从生成供給到系统競爭

    模型能力的提升使候選鏡頭供給快速增加,但候選供給并不等于可发行作品。传统流程把昂貴资源集中在拍攝前后;AI 原生流程则把成本分散到提示设计、参考资产、批量生成、選擇、修訂、一致性维护、声画整合、权利核验与安全审查。于是,单次生成价格下降与合格成片成本下降之間出现明显落差。管理者应追蹤每个可接受成片秒的总推理量、人工判斷时数、返工率和授权成本,而不是把模型报价当作电影成本。

    产业競爭因此由「誰能生成」轉向「誰能穩定交付」。可重复的工作流、角色与世界资料库、版本控制、评价标准、资产索引和跨平台发行能力,会比单一模型的短期領先更持久。模型可以替換,組織记憶与可信网路不容易复制。

    1.2 五个结构性位移

    第一,生产单位由鏡頭轉向系统:创作者设计的是能反覆生成鏡頭的规则、资料与智能体。第二,組織由工序串联轉向模型编排:制片管理的核心变成任务分解、工具路由与质量门檻。第三,发行由单次交付轉向持續服务:同一世界可按用户、地點和时間产生不同版本。第四,市場由內容稀缺轉向信任稀缺:来源、授权、评价和品牌变得更重要。第五,资产由成片扩展到角色、工作流、世界狀態与行为规则。

    这五个位移并非同时完成。多数 2026 年項目仍位于 AI 輔助、AI 生成或 AI 原生的混合区間;实时互动与持續世界只在局部产品中成立。因此,本白皮书使用階段与证据分级,而不以单一「革命已完成」口徑描述全行业。

    1.3 決策含義:建立可替換的能力棧

    制作机构应把模型视为可替換供应层,把自身差異化沉澱在创作聖经、角色一致性包、世界狀態、评价集、权利清单和观众资料治理上。平台应把搜尋、推薦和交易的评价维度从播放量扩展到来源完整度、创作主导度、風險狀態与持續运营能力。投资者则应区分模型租金、工作流效率与可重用资产三种价值,避免把短期生成能力誤判为长期护城河。

    结构位移旧稀缺新稀缺管理指标生产拍攝产能可接受輸出合格成片秒成本組織专业工序模型编排返工率/可替換率
    结构位移旧稀缺新稀缺管理指标发行內容供給可信发现有效觸達/信任产品固定成片持續关係留存/世界狀態资产单一成片资产族復用率/授权完整度

    表 1 从固定文件到文化计算系统 - 关联分析表

    结构位移旧稀缺新稀缺管理指标
    发行內容供給可信发现有效觸達/信任
    产品固定成片持續关係留存/世界狀態
    资产单一成片资产族復用率/授权完整度

    第 2 章 · CHAPTER 02

    什麼是 AI 原生电影:双軸模型与 51%+

    第 2 章

    本章要點行业现行的四类定義——用过 AI 即算、主画面生成即算、按像素佔比计算、按工作流主导度衡量——彼此不相容,导致市場、资本与學术无法对話。本白皮书採用可援引、可比較、可审计的双軸定義。创作主导度軸(P0–P4):衡量 AI 工作流在敘事、影像、声音、角色、互动五个核心创作维度中的加权主导程度;「51%+ AI 参与度」是 P 軸上的资格刻度——加权主导度过半,方构成「AI 原生」而非「AI 輔助」。判定依据创作者申报、工具链记录与评审专业判斷綜合认定,重點不是像素统计,而是 AI 是否真正参与核心创作決策。运行时生成度軸(R0–R4):衡量內容在消費时刻被生成的程度。R0 为完全预制,R2 为预制与实时混合(分支敘事、个性化版本),R4 为完全实时(每次体验即时生成、不可完全復现)。R 軸獨立于 P 軸:P3/R0 是当下AI 原生电影的典型形態,P4/R4 指向生成式世界媒体。指揮家论(Conductor Theory)为双軸提供作者性基礎:如同樂團指揮不必親奏每件樂器,AI 原生创作者的价值在于意图设定、在海量生成结果中的選擇与编排、跨工具链的统籌,以及对作品的最終責任——它不消解作者,而是重新定位作者。
    产业含義双軸模型为评獎、投资盡調、版权登记与學术研究提供同一套座标;51%+作为资格门檻而非评分項,避免「AI濃度競賽」擠壓艺术判斷;R軸使互动敘事与生成式世界获得与线性电影平等的定義地位。
    治理邊界51%+ 是资格刻度,不是品质分数;双軸分类是行业语言,不是著作权裁決。

    图 2 AI 原生电影双軸座标

    2.1 P 軸:创作主导度的五维判定

    P 軸衡量 AI 在敘事、影像、声音、角色与互动五个维度中的实质主导程度。P0 表示未使用生成式 AI;P1 表示局部輔助且不改变主要创作決策;P2 表示一个或多个核心环节由 AI 深度参与,但整体作品仍可沿传统流程成立;P3 表示加权主导度達 51%+,作品无法脫離 AI 工作流成立;P4 表示创作本体就是可运行的生成系统。

    51%+ 不按像素、鏡頭数、提示詞数或模型数量机械计算。评审应綜合创作者申报、版本记录、节點图、提示与参考资产、生成和選擇日誌,以及对作品的专业判斷。权重可因类型而異:音樂电影可能提高声音权重,互动作品必须计入行为和狀態设计。

    2.2 R 軸:运行时生成度

    R0 为完全预制;R1 为播放前个性化,例如按语言、时长或分级生成版本;R2 为预制资产与运行时組合,例如分支敘事或局部生成;R3 为大部分画面、声音或事件在体验中生成,但仍受预设場景和安全邊界約束;R4为持續实时生成,每次体验不可完全重现。R 軸描述产品行为,不描述艺术優劣。

    P 軸与 R 軸必须分开。高度 AI 原生的作品可以是 P4/R0 的线性电影;传统拍攝素材也可組成 P2/R3 的实时互动体验。双軸避免把「AI 原生」錯誤等同于「必须互动」,同时讓实时世界获得可比較位置。

    2.3 指揮家论与責任歸属

    指揮家论不是降低人的責任,而是重新界定作者性:人的貢獻在于提出意图、建立約束、選擇訓練或参考材料、编排工具与智能体、判斷候選结果、完成修改并承擔发布責任。这些可观察行为应被保留为创作证据。

    在权利判斷中,双軸分类只能描述工作流,不直接決定著作权。不同法域仍以人类创作貢獻、同意、授权和具体事实为准。[R15][R16] 因此,分类证书、节展评审、索引记录与法律权利登记必须在制度上保持邊界。 *表 2 AI 原生电影双軸座标 - 关联分析表*

    级別P 軸:创作主导度R 軸:运行时生成
    0无生成式 AI完全预制
    1局部輔助播放前適配
    2核心环节深度参与预制与生成混合
    351%+ 实质主导主要內容实时生成
    4作品本体为生成系统持續实时、不可完全重现

    第 3 章 · CHAPTER 03

    AI 视听媒介五階段模型(G0–G5)

    第 3 章

    本章要點本白皮书以五階段模型作为全书座标系:G0 传统电影——攝影机拍攝、人工后期、固定放映;G1 AI輔助——AI 用于劇本、预演、修復等局部环节,创作決策仍属传统流程;G2 AI 生成——主体画面由模型生成,但以单鏡頭、单片段为单位組裝,成片邏辑仍属传统电影;G3 AI 原生——AI 深度参与核心创作決策(P 軸

    51%+),作品作为整体由人机协同「指揮」而成,无法脫離 AI 工作流成立;G4 实时互动——內容在消費时刻生成,观众輸入改变敘事与世界狀態;G5 生成式世界媒体——持續存在、多人共享、智能体参与并具有经济系统的世界,媒体形態与经济空間合一。产品本体相应演進:电影文件→生成作品→互动体验→持續世界→经济空間。2026 年的位置判斷:G2 已规模化——主流视頻生成模型正支撐大量商业內容生产[E1];G3正在制度化——资格刻度、评审框架与索引基礎设施于本年度成形[E1];G4 進入公开产品探索期——实时世界模型实现连續交互式生成、长时程幾何一致性与多人共享世界,并开始向遊戲引擎形態延伸[E2];G5 处于研究与早期构想階段[E3/E4]。每一次階段躍迁都同时改变生产函数、消費关係与资产形態。

    产业含義对创作者:技能重心由執行向判斷迁移。对制作与发行机构:以「世界」而非「片单」规划资产組合。对投资者:階段躍迁點是价值重估窗口。对政策制定者:披露与计量制度应在 G4 规模化之前就位。
    採用原则同一机构可以同时运营 G0-G4 产品;新階段扩展媒介,不要求旧階段消失。

    图 3 AI 视听媒介 G0-G5 演進

    3.1 G0-G5 的階段含義

    G0-G5 描述媒介的主导生产邏辑,而不是替代順序。G0 传统电影以拍攝和后期为中心;G1 把 AI 嵌入局部流程;G2 以生成鏡頭为主要素材;G3 把 AI 变成整体创作方法;G4 令內容在体验时回应行动;G5 则形成持續存在、多人共享、由智能体参与并能承载经济活动的生成式世界媒体。

    每次躍迁都要求新的底层能力。G2 到 G3 需要可控工作流与创作证据;G3 到 G4 需要狀態、记憶、低延遲与安全策略;G4 到 G5 还需要多人一致性、长期身份、內容治理、资产和支付系统。只提升画质无法自动跨階段。

    3.2 2026 年的定位:能力出现,制度滯后

    2026 年可以确认的是:生成视頻、原生声画、可控编辑和开源模型已形成可用工具链;实时互动世界亦有公开产品和研究原型,可在特定解析度与时間范围內持續运行。[R02][R04][R05][R07][R09] 不能确认的是:跨小时穩定、通用多人共享、低成本全球部署和完整事件级来源记录已普遍成熟。

    因此,G4 应被描述为产品探索期而非产业成熟期,G5 应被视为條件性方向。白皮书的任务不是宣告某个年份,而是明确每一階段的验证條件,使下一版可以根据数据上調或下調判斷。

    3.3 階段门檻与退出條件

    每个項目都应在立項时声明目标階段、可验证指标与退出條件。例如,G4 項目至少需要定義可用延遲、狀態保持时間、行动遵循率、安全違规率和每分鐘推理成本;若不能達标,应退回 R2 的混合方案,而不是用行銷口徑掩蓋。階段模型的真正价值,是讓创新可以被拆解和管理。 *表 3 AI 视听媒介 G0-G5 演進 - 关联分析表*

    躍迁新增能力最低验证
    G2->G3整体人机创作创作证据/一致工作流
    G3->G4运行时回应延遲/狀態/降级/安全
    G4->G5持續多人世界身份/多人一致/经济/治理

    第 4 章 · CHAPTER 04

    方法论、证据分级与标准演進机制

    第 4 章

    本章要點本白皮书全部结论实行四级证据分级:E1 已商业化事实、E2 公开演示与技术报告、E3 研究原型、E4 情景推演;E3/E4 级判斷一律标注,不以事实口徑陳述。全书区分公共证据与编制机构提出的框架,后者均以明确口徑呈现,均以「本白皮书提出」口徑呈现。标准本身设有演進机制:51%+刻度与双軸模型接受年度同行评議,六大创意维度的权重、创作证据与工作流记录的认定細则隨技术演進逐年修訂;本白皮书同步实行年度更新,逐年檢验前版预测并公开修訂记录。
    产业含義读者可按证据等级取用本书:E1/E2结论可直接用于商业決策参考,E3/E4內容用于戰略想象与研究議程设定。标准的公信力不来自宣布,而来自可檢验与可修正。
    编制原则证据等级描述「我們知道到什麼程度」,不描述观點的重要性。

    图 4 四级证据与可使用语言

    4.1 四级证据不是裝飾标籤

    E1 要求可公开验证的商业服务、制度文本或实际部署;E2 包括产品演示、技术报告和可重复的公开能力,但不假定已规模化;E3 为研究论文、实验原型或有限樣本;E4 为明确列出前提的情景推演。不同证据可以支持不同句式:E1 可使用「已实施」,E2 应使用「已展示」,E3 使用「研究显示可能」,E4 使用「若前提成立」。

    同一段落可能同时包含多级证据。例如,公开模型可实时生成是 E2;它将在五年內替代遊戲引擎是 E4。若不拆分,读者容易把能力展示誤读为市場结果。新版因此在关鍵图表、核心判斷和路线预测中直接标示证据等级。

    4.2 技术掃描与预测方法

    本书採用能力链分析:先辨識模型能力,再分析工程集成、产品採用、商业模式和制度治理。预测只在前一层形成足夠证据后向下一层延伸。每項中长期判斷同时列出前提、領先指标、阻礙因素和可逆策略,避免使用沒有基准年的市場规模数字制造精确幻覺。

    技术性能数据優先引用模型开发者文档与研究论文;法规引用主管机关与正式文本;文化、能源与统计框架引用国际机构。企业自报性能仍视为 E2,除非存在獨立、可重复的外部验证。

    4.3 年度修訂与反证清单

    白皮书每年应公布三类变化:前版预测的命中与偏差、分类与字段的修訂、被撤回或降级的结论。建議设立反证清单,包括实时延遲未下降、长时一致性停滯、能源或監管成本超预期、用户对互动需求低于预期等。能被反证的框架才具備治理价值。 *表 4 四级证据与可使用语言 - 关联分析表*

    级別证据建議语言禁忌
    E1商业或制度事实已实施/已提供省略適用條件
    E2公开演示/技术报告已展示/已报告宣稱普遍成熟
    E3研究原型研究显示可能直接作商业承諾
    E4情景推演若前提成立使用确定语氣
    02

    技术底座

    > 从视頻生成模型到世界模型

    05 视頻基礎模型的技术演進 · 06 长片生成的真正技术瓶頸 · 07 世界模型:从预测下一幀到模擬世界 · 08 实时互动 AI 原生影视系统架构 · 09 AI 智能体与虛擬表演者

    第 5 章 · CHAPTER 05

    视頻基礎模型的技术演進

    第 5 章

    本章要點视頻基礎模型的技术棧正沿六條主线快速演進[ E1/E2]:其一,架构层面,扩散Transformer 与流匹配成为主流骨幹,自回歸生成路线在长时序与实时場景中展现互補優勢;其二,效率层面,时空潛变量壓縮、一致性蒸餾与少步推理将生成成本壓縮了数量级,是实时化的前提;其三,可控性层面,多鏡頭规划、首尾幀約束、軌跡/深度/姿態控制漸成标配;其四,一致性层面,角色、風格与場景的跨鏡頭一致性由「碰运氣」轉为可工程化能力;其五,多模態层面,原生音视頻联合生成進入产品(以Veo 3.1 等为代表,原生音頻、扩展视頻与精細创作控制已納入同一模型方向);其六,空間层面,3D 感知、4D 生成与神经渲染使生成內容具備空間一致性基礎。值得注意的是需求側的变化:对 AI 电影创作的实证研究显示,创作者最迫切的需求已从「能不能 生 成」 轉 向 角 色 运 动 一 致 性 、 攝 影 机 控 制 、 多 角 色 处 理 与 精 細 编 辑[E3,arXiv:2504.08296]——这意味着競爭焦點正由生成质量轉向创作控制。
    产业含義工具選型的评估维度应从「单鏡頭驚艷度」轉向「可控性×一致性×成本」三元組;模型能力的半衰期以月计,工作流的組織能力比单一模型選擇更具持久价值。
    採購指标用一致性、控制覆蓋率、可编辑性、单位合格輸出成本和治理能力评估模型,而非只比較最佳樣片。

    图 5 视頻基礎模型能力棧

    5.1 从像素生成到视听基礎模型

    主流视頻模型多在壓縮后的时空潛变量上运算,以扩散 Transformer、流匹配或自回歸方法建模。视覺编碼器与 VAE 降低时空维度,文本、图像、姿態、深度、相机軌跡和声音被轉換为條件信號。架构演進的核心不是名詞更替,而是把高维视頻的计算量壓縮到可訓練、可控制、可部署的范围。[R01][R03][R04][R05]开源与閉源模型形成互補。閉源服务通常提供穩定介面、治理和雲端算力;开源模型允許私有部署、微調、工作流透明与成本優化。制片机构不宜只按排行榜選型,而应建立任务路由:概念、动作、人物、产品、場景延展和原生声音由不同模型承擔。

    5.2 可控性是工业化分水嶺

    工业流程需要对人物身份、姿態、相机、构图、首尾幀、物体运动、光线、时长和声音進行局部修改。若每次修改都迫使整段重生,成本和風險会隨片长快速累積。因而,局部编辑、分层控制、遮罩修復、場景延展和多参考條件比单次樣片画质更能決定生产价值。创作者研究也把一致性、可控性与精細编辑列为優先需求。 [R06]建議建立「控制覆蓋率」指标:一个工具能否在不破壞其他已确认元素的前提下修改指定属性。控制覆蓋率高,才可能形成可预算、可排期、可审批的制作管线。

    5.3 原生音视頻与共同时間軸

    原生音视頻生成把对白、音效、环境声、节奏和画面动作放在共同时間軸上建模,降低后配音与同步的摩擦。 [R02][R03] 但它也带来新的控制问题:声音身份、语言、口型、音樂权利和多軌交付仍需獨立管理。专业流程应保留可分離的声音軌道、台詞与声音来源记录,避免把不可编辑的混合音軌当作最終资产。 *表 5 视頻基礎模型能力棧 - 关联分析表*

    维度问题示例指标
    控制能否只改指定元素控制覆蓋率
    一致跨鏡頭是否穩定身份/場景漂移
    编辑能否局部反覆修訂返工影响范围
    成本可接受輸出多少每合格秒总成本
    治理来源与限制是否可记录字段完整度

    第 6 章 · CHAPTER 06

    长片生成的真正技术瓶頸

    第 6 章

    本章要點短鏡頭质量与长敘事质量是两个不同的问题。长片生成的瓶頸不在画质,而在五类「记憶与规划」问题[E2/E3]:誤差累積——自回歸生成中偏差逐幀放大;实体记憶——人物、空間、道具在跨場景中的持續性;关係记憶——多角色关係狀態的长周期一致;敘事规划——超长时序上的结构、节奏与情緒连續性;以及制作組織——分层生成(世界设定→場景→鏡頭)与后期組裝的工程方法。行业的工程化回应是「世界狀態数据库」:以显式的结构化狀態(角色档案、空間图譜、事件时間线)約束生成过程,将「模型记住」轉化为「系统记录」。长片的评价指标亦需重新设计:鏡頭级指标(清晰度、美學评分)无法度量敘事级质量,跨鏡頭一致性、情节连貫性、情緒曲线等长时序指标正在成为研究前沿[E3]。
    产业含義押注长片生成的机构应将投入重心放在狀態管理与流程工程而非单純的模型追新;「世界狀態数据库」的设计能力,将成为AI原生制片廠的核心资产。
    工程结论长片的核心资产不是一組提示詞,而是能被人与模型共同读取的世界狀態和決策记录。

    图 6 长片世界狀態閉环

    6.1 长片是一个狀態管理问题

    角色的服裝、傷痕、年齡与情緒,場景的空間拓撲,道具的位置和所有权,人物关係与事件因果,都需要跨鏡頭保持。把这些要求全部交給模型隱式记憶,会产生不可预测漂移。工程上应把关鍵狀態外置:角色档案、世界图譜、事件账本、場景約束和鏡頭依賴形成世界狀態资料库,再由生成模型读取。

    外置狀態不只改善一致性,也改善审批与协作。导演可以鎖定角色动机,攝影可以鎖定光线和鏡頭语法,法务可以鎖定禁止资产,系统则在生成时自动验证。这使长片制作从反覆提示轉向可观察的狀態机。

    6.2 分层规划:世界、場景、鏡頭、幀

    长敘事需要至少四层规划。世界层规定物理、文化与角色规则;場景层规定地點、目标与关係变化;鏡頭层规定视點、动作与剪辑功能;幀层負責视覺实现。上层生成结构約束,下层生成具体內容,并把结果回写狀態。

    若缺少回写,前一鏡頭发生的变化不会成为后一鏡頭的條件。

    人类应在层级轉換处设置批准门:世界聖经、場景大綱、鏡頭清单、关鍵幀与最終合成都可獨立鎖定。这种分层不会消除创作自由,反而讓大规模生成保持方向。

    6.3 长片评价从画质轉向连續性

    单幀美學和文本对齊不足以衡量长片。新版提出六組长时指标:身份漂移、空間拓撲違反、道具与事件连續性、因果衝突、情緒曲线偏離、声画身份与同步。指标应以鏡頭、場景和全片三个尺度报告,并保留人工评审,因为敘事合理性和艺术意图不能完全由自动分数替代。 *表 6 长片世界狀態閉环 - 关联分析表*

    尺度指标失敗示例
    鏡頭动作/声画同步手部或口型漂移
    場景角色/道具连續服裝与物件突变
    序列空間/因果一致位置或事件矛盾
    全片情緒/主题连續角色动机斷裂

    第 7 章 · CHAPTER 07

    世界模型:从预测下一幀到模擬世界

    第 7 章

    本章要點世界模型是视頻生成的升维:它不僅预测「画面接下来长什麼樣」,而是维护一个可被动作改变的世界狀態——接受动作條件輸入,執行狀態轉移,并保持物理规律与因果关係的近似成立。2025–2026 年的公开進展确立了三个里程碑[E2]:可实时探索的生成环境(以 Genie 3 为代表,720p、20–24 幀运行并维持数分鐘一致性);长时程幾何一致性与可重訪場景(实时交互世界建模的空間记憶方案);以及多人共享生成世界(同一世界接受多用户同时進入与塑造)。2026 年 的 行 业 綜 述 将 瓶 頸 集 中 歸 納 为 三 項 : 动 作 控制 、 长 时 记 憶 与 实 时 响 应[E3,arXiv:2606.01164]——下一階段的競爭不再是画面质量,而是「世界能否记住、回应并持續运行」。对电影敘事而言,世界模型带来两項根本能力:可编辑事件(「如果……会怎樣」的反事实生成)与显式/隱式世界的混合表達——导演将可以像調度片場一樣調度一个生成世界。
    产业含義世界模型是 G4/G5 的技术心臟;其成熟时間表直接決定实时互动影视的商业化窗口。內容机构应以「世界资产」为单位提前佈局,工具机构应以记憶与动作控制为攻堅重點。
    术语紀律能生成世界画面,不等于能维持世界;能维持世界,不等于能安全运营多人文化空間。

    图 7 互动世界模型最小閉环

    7.1 世界模型的最低定義

    在本书中,世界模型不是所有视頻模型的行銷別名。它至少需要接收行动,维持可被行动改变的狀態,生成后續观察,并在一定时間范围內保持空間与因果一致。若系统只能根据文本生成预定视頻,则仍属內容生成模型;若能预测行动后果但不能穩定渲染,则可作为內部模擬器;两者结合才接近互动世界。

    技术路线可分为隱式狀態、显式 3D/場景图和混合架构。隱式模型画面自然但难以审计;显式模型可控但建立成本高;混合架构以場景图、物理或记憶模組提供穩定骨架,再由生成模型渲染外观,是影视应用更可管理的路线。

    7.2 2026 年能力邊界

    公开系统已展示 720p、20-24fps 的分鐘级互动世界,研究原型亦报告长时记憶与更高幀率。[R07][R09] [R10] 这证明实时生成不再只是概念,但公开资料同时指出长时一致性、精确现实模擬、文本渲染和连續时长仍有限。模型展示通常在特定硬件、资料与控制空間下完成,不能直接外推到开放敘事。

    产业评估应要求供应方披露解析度、幀率、端到端延遲、硬件、连續时长、记憶窗口、动作集合、世界重訪一致性与安全策略。沒有这些條件的「实时」不可比較。

    7.3 从遊戲引擎替代论轉向协同论

    世界模型短期內更可能与遊戲引擎协同:引擎負責确定性物理、多人同步、碰撞、资产和规则;生成模型負責外观、行为变体、语言角色和未预制事件。当模型可靠性提高,两者邊界会移动,但确定性狀態与概率性生成仍需分层。这与支付系统把智能体意图和确定性结算分开的架构相似。[R22]*表 7 互动世界模型最小閉环 - 关联分析表*

    能力2026 狀態规模化门檻
    实时画面特定系统已展示低成本多设備
    长时记憶分鐘级至研究原型跨小时穩定
    精确行动有限控制集合开放行动遵循
    多人世界局部探索一致同步与治理
    安全来源早期方案事件级标准

    第 8 章 · CHAPTER 08

    实时互动 AI 原生影视系统架构

    第 8 章

    本章要點本白皮书提出实时互动 AI 原生影视的八层参考架构:(1)用户輸入层——语音、注视、手勢、位置、表情与设備传感器;(2)用户模型层——偏好、身份、情緒、歷史与权限;(3)敘事決策层——劇情规划、节奏控制、衝突調度与安全約束;(4)世界模型层——环境、人物、物理与世界狀態的维护;(5)生成层——实时画面、声音、对白与音樂的合成;(6)记憶层——人物记憶、观众记憶与世界记憶;(7)輸出层——屏幕、眼鏡、空間音頻与觸覺;(8)来源与責任记录层——实时內容的动態溯源。实时性的硬指标:24fps 对应每幀 41 毫秒的生成预算[E2];当前公开世界模型在单卡上尚难以在720p 達成扩散式实时生成,多卡推理、蒸餾少步与专用推理硬件是三條并行的攻堅路徑。2026 年首批实时世界模型产品(连續交互视頻流、共享世界、自然语言遊戲引擎)标誌着该架构由论文走向产品[E1/E2]。
    产业含義八层架构为产业分工提供了地图:每一层都是可獨立创业与投资的賽道;內容机构的关鍵抉擇是自建整棧还是在敘事決策层与世界资产层建立差異化。
    安全原则实时系统必须能拒絕、延遲、降级和回滾;沒有降级路徑的生成,不具備直播级可靠性。

    图 8 实时 AI 原生影视八层架构

    8.1 八层参考架构

    实时 AI 原生影视可拆为八层:輸入与感知、意图理解、敘事与政策编排、世界狀態与记憶、生成与渲染、声音与角色、交付与邊緣、来源与安全。分层的目的不是固定供应商,而是把可替換的概率模型与必须穩定的狀態、授权和責任控制分开。

    每个輸入事件都应形成可追蹤流程:观众行动被轉为意图,经权限与安全策略判斷后更新世界狀態,生成层产生候選輸出,评价与安全模組接受或降级,交付层根据设備和网路調整,最后把模型、资产、版本和責任事件写入记录。

    8.2 延遲预算与降级策略

    24fps 的单幀时間为約 41.7 毫秒,但端到端体验还包含輸入採集、编碼、网路、意图解析、生成、檢查与显示。并非所有敘事決策都要逐幀重算;可把高頻动作交給本地确定性层,把低頻情节和外观交給雲端生成。预取、緩存、蒸餾、量化、少步生成、邊緣推理与注视點串流共同构成可用系统。

    系统必须设计降级路徑:网路抖动时切換到预制片段,模型不确定时保持狀態不更新,安全模組无法完成时停止生成而不是繼續輸出。对实时媒体而言,可预测的降级比偶发的最佳画质更重要。

    8.3 动態来源记录

    文件级憑证適合固定成片,但 R3/R4 作品每次体验都不同。新版提出事件级最小记录:会話識別、用户輸入类型、意图摘要、模型和版本、使用资产識別碼、政策版本、生成时間、內容杂湊、重要安全決策与发布責任主体。为保护隱私,原始语音、视线和位置不应默认写入公共记录;可使用摘要、分层权限与保留期限。

    C2PA 可为资产与輸出提供来源框架,但其原则明确不作价值或真假判斷。[R11] 实时領域仍需要把憑证、会話事件与世界狀態版本连接起来,这是未来标准工作的重點。 *表 8 实时 AI 原生影视八层架构 - 关联分析表*

    环节目标主要手段
    网路/显示穩定抖动邊緣/注视點串流
    安全不繞过预檢/降级/阻斷

    第 9 章 · CHAPTER 09

    AI 智能体与虛擬表演者

    第 9 章

    本章要點智能体正在進入制片組織的每个崗位:导演智能体(分鏡与調度)、编劇智能体(劇情规划与对白)、攝影/剪辑/声音智能体(執行层自动化),以及最受关注的角色智能体与虛擬演员——具備长期记憶、穩定人格与实时表演能力的数字表演者[E2,实时音頻驅动化身与流式虛擬人生成已入产品化階段]。多智能体表演(角色間的自主互动)是 G5 世界的敘事引擎,也是最大的失控風險源:角色越界、敘事漂移与責任歸属构成新的治理議题。数字替身的授权链條——真人的声音、面孔与动作经授权建模为可持續使用的角色资产——需要与第廿六章的版权框架及第廿三章的资产生命周期銜接。
    产业含義「合成表演权利」将成为制片法务的新核心;角色智能体的行为邊界设定(能做什麼、不能说什麼、誰来兜底)应作为制作规范前置设计,而非事后補救。
    治理原则角色可以具有持續记憶和行动能力,但发布責任不能由虛擬人格承擔。

    图 9 可运行角色的六个构件

    9.1 智能体不是角色皮膚

    AI 智能体由身份、目标、记憶、能力、政策和行动介面构成;虛擬表演者则增加形象、声音、动作、表演風格与公众关係。若只生成外观和台詞,它仍是数字角色;只有能在約束下理解情境、维持人格、採取行动并对结果負責任地被管理,才成为可运行角色。

    角色聖经需要升级为机器可读的角色憲法:不可改变的核心、可隨劇情更新的狀態、可授权行为、禁区、语言与文化邊界、关係图、记憶保留和撤回规则。这些规则应高于单次提示,并被版本化。

    9.2 表演控制与数字替身

    生成式表演把演员的臉、声音、动作、即興風格和人格联想拆成可建模元素。合約不能只写「数字肖像使用」,还应明确訓練、微調、推理、衍生生成、角色自主程度、媒介、地域、期限、审批、报酬、撤回和死亡后使用。任何超出原同意的能力升级都应觸发重新授权。

    技术上需要把演员来源资料、角色模型、最終輸出和人工修改分开记录。如此既能保护表演者,也能在模型或平台更換时维持角色连續性。

    9.3 多智能体制片与运营

    制片流程可由劇本、分鏡、连續性、资产、法务、成本和安全智能体协作,但所有智能体应在明确权限內运行。建議採用三层控制:智能体提出方案,规则系统執行硬約束,人类在高風險节點批准。任务日誌需区分建議、執行和最終責任,避免把責任推給无法律主体地位的模型。 *表 9 可运行角色的六个构件 - 关联分析表*

    要素必须说明高風險变更
    身份臉/声/动作/人格跨角色合併
    用途媒介/場景/受众政治/成人/醫療
    能力生成/对話/自主行动由被动变自主
    期限开始/结束/撤回永久或死后
    报酬買斷/使用/增值分成未披露再利用
    03

    设備革命

    > 从銀幕、手机到 AI 眼鏡

    10 视听设備的四次迁移 · 11 AI 眼鏡带来的新电影形態 · 12 空間电影与遠程生成

    第 10 章 · CHAPTER 10

    视听设備的四次迁移

    第 10 章

    本章要點视听介质已完成三次迁移:影院銀幕(集体观看、档期经济)→电视(家庭观看、广告经济)→手机(个人观看、流量经济)。每次迁移都重塑了內容形態、商业模式与产业权力结构——而每一次,在位者都低估了新終端。第四次迁移正在发生:空間设備与全天候眼鏡。2025 年XR 设備出貨 1,450 万台、同比增长

    41.6%,智能眼鏡首次貢獻約半数出貨并成为增长的絕对主力[E1];主要平台廠商已将眼鏡列为下一代计算平台的主賽道,标准化操作系统的入場正在复制智能手机生態的成形路徑[E1/E2]。

    产业含義歷史的教訓是:內容为新終端的原生化改造,总是滯后于硬件普及、又总是回报最豐。为眼鏡形態预研內容语法的机构,正在購買下一个十年的期权。
    終端判斷下一代电影设備的核心不是更大的屏幕,而是感知、生成与显示是否能在社会可接受的形態中协同。

    图 10 视听終端四次迁移

    10.1 四次終端迁移

    銀幕建立集体观看,电视把內容带入家庭,手机把內容带入个人时間,空間设備与 AI 眼鏡则把內容带入视野和环境。每次迁移都改变鏡頭语法、时长、发行权力与商业模式。眼鏡的特殊性在于它既是显示器,也是感知器:相机、麥克風、位置和注视把观众所处世界轉为內容條件。

    这不意味銀幕或手机消失。不同終端承擔不同社会功能:影院提供儀式和共同注意,手机提供高頻个人接觸,眼鏡提供伴隨式和位置式体验。內容策略应设计跨終端狀態连續,而非把同一画面簡单縮放。

    10.2 端-邊-雲协同

    眼鏡受重量、散熱、电池和算力限制,完整世界生成多由邊緣或雲端承擔;本地设備处理感知、隱私过濾、低延遲追蹤和安全中斷。注视點串流只在视线中心传輸高品质內容,可降低頻寬和渲染壓力。[R26] 开放介面如OpenXR 有助于资产和交互跨设備移植。[R27]內容机构应避免綁定单一硬件。至少把世界狀態、角色身份、交互意图与渲染輸出分離,确保更換显示设備不会重建整个作品。

    10.3 終端採用的真正门檻

    重量、續航、视場角和价格只是硬件门檻;社会接受度、旁观者隱私、使用禮儀、开发者生態和可持續內容同樣重要。公开原型已展示情境理解、私密显示与全日佩戴方向,但不能据此推定普及年份。[R24][R25] 白皮书以能力门檻而非出貨预测判斷设備革命。 *表 10 视听終端四次迁移 - 关联分析表*

    終端核心能力內容单位主要限制
    影院共同注意固定場次时間与場所
    电视家庭沉浸节目/系列低交互
    手机个人高頻短內容/直播小屏与注意碎片
    AI 眼鏡情境与伴隨位置/关係事件隱私/电池/社会接受

    第 11 章 · CHAPTER 11

    AI 眼鏡带来的新电影形態

    第 11 章

    本章要點眼鏡不是掛在臉上的小屏幕——它使现实环境本身成为敘事場景[E2/E3]:观众所見的世界成为作品的輸入;地理位置觸发劇情;真人、虛擬角色与现实場所同場;语音、注视与手勢取代遙控器;实时翻译使角色跨语言存在。行业趨勢报告指出,AR 眼鏡正演变为大模型的「硬件前端」——以多模態 AI「看見」并「理解」用户环境,提供无需显式指令的主动敘事可能[E2]。与此同时,新形態自带新问题:私人劇情与公共空間的衝突、旁观者权利、持續感知的隱私風險——这些不是产品細节,而是決定眼鏡影视能否被社会接受的前置條件。
    产业含義「现实即片場、环境即劇本」的內容语法需要全新的创作方法论;隱私与旁观者保护应写入行业自律规范的第一版,而非等待監管倒逼。
    设计底线在视野中持續存在的內容,必须給用户比手机通知更強的控制权。

    图 11 AI 眼鏡的情境內容閉环

    11.1 位置敘事与环境角色

    AI 眼鏡可以把地點、时間、天氣、物体和同伴轉为敘事变量。歷史街区可疊加不同年代的角色,博物館展品可成为对話入口,城市通勤可形成连續章节。作品不再只有播放时間,还有可觸发的空間和情境。

    空間敘事应区分公共层、群体层与私密层。公共层不得遮蔽安全信息或強迫旁观者参与;群体层需要共享錨點和一致狀態;私密层可根据个人记憶生成,但敏感资料应在本地或受控环境处理。

    11.2 伴隨式角色与注意力设计

    角色可在多天、多地點延續关係,记住用户選擇并在適当时刻出现。这使角色訂阅和长期敘事成为可能,也容易形成依賴、操縱或注意力侵占。设计应提供安靜时段、介入強度、记憶查看与刪除、角色邊界和退出机制,并禁止用情緒脆弱狀態進行未披露的商业说服。

    衡量成功不应只看使用时长。更合適的指标包括主动啟动比例、打擾率、拒絕后再介入率、记憶修正率、用户控制感和旁观者投訴。

    11.3 新的鏡頭语法

    眼鏡中的「鏡頭」可能不是固定矩形,而是注视引导、空間声音、角色距離、遮擋和物体錨定。导演从安排观众看到什麼,轉向安排什麼在何种條件下可被发现。这需要把攝影、舞台調度、遊戲关卡和交互设计合併为空間导演學。 *表 11 AI 眼鏡的情境內容閉环 - 关联分析表*

    風險控制用户权利
    旁观者感知可見狀態/本地过濾知情与申訴
    注意侵占介入頻率上限安靜/退出
    记憶濫用目的与期限查看/修正/刪除
    商业操縱广告标示/规则定价拒絕个性化

    第 12 章 · CHAPTER 12

    空間电影与遠程生成

    第 12 章

    本章要點空間影视的技术通路正在貫通[E1/E2]:內容側,3D/180 度/360 度沉浸式视頻与空間音頻形成标准化格式族;渲染側,注视點渲染大幅壓縮空間內容的算力需求;传輸側,主要平台已提供面向雲端渲染內容的低延遲注视點流媒体框架——这意味着「雲端生成、邊緣調度、終端显示」的分层架构具備了工程基礎。其終局形態是眼鏡上的实时世界模型:重算力留在雲端,眼鏡負責感知与显示,现实与生成內容无縫混合。延遲预算是硬約束:交互式空間內容的端到端延遲需壓入数十毫秒量级,这使邊緣算力佈局成为空間影视的基礎设施議题。
    产业含義空間影视的成本结构将呈「雲端算力訂阅制」;电信与雲服务商将首次成为影视价值链的核心环节,內容机构应提前綁定算力与分发夥伴。
    资产原则空間作品至少应保存「幾何、语義、行为、来源、权利」五种可分離层。

    图 12 空間內容混合管线

    12.1 空間內容的三种生成路徑

    第一是预制 3D 资产与实时引擎,确定性高但建模成本高;第二是神经場与 3D/4D 重建,能把真实場景快速轉为可观看空間;第三是生成式世界模型,可根据语言和行动创造未预制环境。成熟产品将混合三者:重要物体採用明确幾何和权利管理,背景与变体由模型生成。

    混合路徑也有利于来源记录。可把受保护的角色或商品固定为经批准资产,而将天氣、群众或非关鍵环境作为可生成层,降低身份漂移与品牌風險。

    12.2 遠程生成与注视點串流

    运算密集場景可在本地工作站或雲端渲染,设備只接收与当前视线相关的高品质內容。这种架构扩展了眼鏡可承载的世界规模,但引入网路延遲、隱私、服务中斷和雲成本。內容需要同时准備高品质、降级与離线三种层级,世界狀態则需在连线恢復后可合併。

    遠程串流使发行变成持續运营:平台需要容量规划、区域节點、延遲監测、模型版本回滾和安全更新。制片方因此要具備部分雲端服务能力,或与具備服务水准协議的运营方合作。

    12.3 空間互操作与资产可攜

    空間作品的长期价值取決于錨點、角色、行为与权利资料能否跨设備和引擎迁移。应優先採用开放或可导出的場景描述、坐标、材质和交互介面,并保留高层语義,而非只保存某平台的打包档案。互操作不是純技术问题,还包括对不同終端授权范围的明确表述。 *表 12 空間內容混合管线 - 关联分析表*

    路徑優勢限制適用
    预制 3D确定可控资产成本高核心物体/品牌
    重建/神经場快速还原编辑与权利复杂真实場景
    世界生成无限变体一致与安全背景/互动
    混合品质与成本平衡系统复杂专业产品
    04

    內容与用户

    > 观众如何成为参与者

    13 从观看权到行动权 · 14 新的互动方式 · 15 个性化影视的邊界 · 16 AI 时代的敘事和艺术

    第 13 章 · CHAPTER 13

    从观看权到行动权

    第 13 章

    本章要點用户在作品中的权利正沿五级演進:观众(接受固定內容)→選擇者(在预设分支中選擇)→参与者(輸入实时影响敘事)→共同创作者(貢獻進入世界的正史或支线)→世界居民(在持續世界中擁有身份、关係与资产)。五级演進对应 R 軸的抬升,也对应商业模式从「售賣观看」到「售賣存在」的迁移。行动权的每一次扩張都以技术能力为前提、以体验设计为瓶頸:給用户多大的自由、在何处保留作者的控制,是新形態最核心的设计问题。
    产业含義內容机构应以「用户权利等级」重新盤點产品組合;行动权每上一级,用户数据的敏感度与留存价值同步上升,数据治理须同步升级。
    体验判斷互动价值不在選項数量,而在观众行动是否被理解、被记住并产生有意義的后果。

    图 13 观众权利階梯

    13.1 行动权的四个层级

    观看权只決定是否播放;選擇权在预设分支中导航;行动权可改变人物、事件和世界狀態;共治权则允許群体制定规则、创建资产和参与收益。不同层级对敘事、技术和治理提出完全不同要求。把簡单選单宣稱为共同创作,会誤导用户与投资者。

    作品应在介面中说明哪些選擇会被记住、影响范围有多大、是否可撤回、其他参与者能否看到,以及是否产生可交易资产。透明的行动模型是互动信任的基礎。

    13.2 默认观看与選擇疲勞

    互动不是越多越好。高頻選擇会打斷情緒与节奏,部分观众更需要被带領。AI 原生作品可使用自適应介入:在关鍵价值衝突处要求選擇,在低風險段落根据已声明偏好調整,并始終提供导演版或被动观看模式。

    评价互动品质应观察選擇的敘事后果、可理解性、頻率、回饋时間和后悔处理,而不是统计按鈕数量。真正的行动权意味選擇被世界记住并产生可感知后果。

    13.3 群体观看的重新设计

    多人共享世界需要处理意見衝突。可採多数、角色分权、輪流控制、共識门檻或平行分支。系统应显示決策规则,防止高活躍者永久支配,也要处理退出、重新加入和遲到者的狀態同步。影院的集体性因此可以从共同观看扩展为共同決策。 *表 13 观众权利階梯 - 关联分析表*

    权利用户能做什麼系统責任
    观看开始/停止清晰呈现
    選擇在分支中导航说明后果
    行动改变世界狀態记憶与回饋
    共治制定规则/创建资产公平程序/收益

    第 14 章 · CHAPTER 14

    新的互动方式

    第 14 章

    本章要點互动语法正在超越「分支選擇」:自然语言对話成为与角色相处的默认方式;系统对观众情緒的实时响应改变节奏与配樂;多人共同決定劇情走向使观影重新成为集体行为;观众可委派自己的智能体代替本人参与世界;现实事件(天氣、新聞、位置)流入故事;而最具标誌性的是——用户退出后世界仍然繼續,作品由「被播放之物」变为「持續存在之物」。这些互动方式在遊戲、虛擬偶像与社交产品中已分別得到验证[E1/E2],世界模型的成熟将把它們统一進影视敘事。
    产业含義互动设计师将与导演并列为新形態的核心创作崗位;「退出后仍在运行的世界」对內容审核与治理提出全新命题——見
    交互底线观察到用户信號,不等于获得用户授权;敏感行动必须由明确意图觸发。

    图 14 多模態交互与授权

    14.1 多模態輸入的交互地图

    语音適合表達意图,注视適合指示对象,手勢適合空間操作,位置和环境適合觸发,生理信號只应在明确同意和必要情境下使用。多模態融合可以減少命令負擔,但也可能錯读沉默、猶豫或无意注视。系统应区分观察信號和授权信號,不能把「看了一眼」默认为購買、同意或公开。

    每种輸入都需要置信度、确认策略和退出方式。低風險画面变化可以隱式响应;改变角色关係、公开身份、支付或使用敏感资料必须显式确认。

    14.2 自然语言导演与約束语言

    用户可用自然语言改变故事,但开放语言需要映射到可執行的世界操作。系统应先把輸入轉为结构化意图,再檢查角色能力、世界规则、权利和安全,最后才生成。这种「自然语言到受約束行动」的中間层能避免模型直接把任何話语轉为不可控画面。

    创作者也可使用同一层定義可变与不可变部分:主题、角色核心和结局邊界可鎖定;语氣、場景、支线和表演細节可开放。互动因此成为作者与观众之間的协議。

    14.3 回饋、延遲与信任

    当生成需要时間,系统应立即承认輸入并显示可理解的过渡,而不是讓用户猜测是否生效。回饋可分为意图确认、世界狀態更新与视听结果三层。若操作被拒絕,应说明是敘事规则、安全、权限还是技术限制。可理解的拒絕是世界可信度的一部分。 *表 14 多模態交互与授权 - 关联分析表*

    輸入適合用途不得默认
    语音表達意图永久保存
    注视指示与注意購買/同意
    手勢空間操作高風險授权
    位置情境觸发公开行蹤
    生理必要的可及性情緒操縱

    第 15 章 · CHAPTER 15

    个性化影视的邊界

    第 15 章

    本章要點个性化的技术能力(角色、节奏乃至结局的千人千版)已无疑问,问题在邊界:当「每个人看到不同的作品」,共同話题賴以存在的公共文本是否还存在?过度迎合是否导向审美封閉与情感繭房?作品完整性(作者意图)与用户自由(体验主权)如何平衡?兒童保护、心理影响与情感依賴(尤其对具长期记憶的角色智能体)如何前置设计?个性化数据——用户的偏好、情緒与关係史——的所有权与可攜带权歸誰?本白皮书不对这些问题給出单一答案,但主張:个性化的邊界应由「披露+選擇」机制守护——用户有权知道自己看到的版本被如何定制,并有权選擇公共版本。
    产业含義「公共版本可得性」值得成为行业自律條款;个性化数据的可攜带权将是未来平台競爭与監管交鋒的焦點。
    公共价值个性化可以改善可及性与参与,但不应消解共同作品、共同事实和共同責任。

    图 15 个性化的价值与風險

    15.1 个性化的四个对象

    个性化可作用于呈现、內容、关係和价值。呈现包括语言、字幕、时长和无障礙;內容包括节奏、場景与支线;关係包括角色记憶和回应;价值层则可能改变作品立場。前两类風險較低,后两类更容易形成操縱、偏見与公共文化碎片化。

    公共敘事不应在沒有提示的情況下向不同人展示互相矛盾的事实版本。艺术作品可以具有多版本,但平台应保留作品身份、版本关係和变更原因,使个性化不破壞共同討论基礎。

    15.2 个人记憶与最小资料原则

    长期角色需要记憶,但记憶不是越多越好。应区分会話记憶、作品內记憶、跨作品偏好和敏感个人档案,分別设定目的、期限、可見性和刪除方式。用户应能查看「角色记得什麼」、修正錯誤并一鍵清除。

    个性化推理可優先使用本地或匿名特徵,避免把完整对話、视线、位置和情緒资料集中到单一平台。沒有必要的资料,不应因为技术上可取得而收集。

    15.3 避免情緒价格歧视与黑箱说服

    当角色同时承擔敘事与銷售功能,平台可能根据情緒、依賴或脆弱狀態改变推銷时机和价格。这种做法会破壞角色信任。商业信息应明确标示,角色不得假裝純粹情感关係来執行未披露的交易目标;价格和授权條件应由确定性规则控制,而非由黑箱模型臨場決定。 *表 15 个性化的价值与風險 - 关联分析表*

    层级允許默认需要披露/同意
    呈现字幕/音量/无障礙跨裝置偏好
    內容低風險节奏重大情节改变
    关係会話內记憶跨作品长期记憶
    价值不建議默认立場/价格/说服

    第 16 章 · CHAPTER 16

    AI 时代的敘事和艺术

    第 16 章

    本章要點当作品成为可运行的世界,劇本的形態隨之改变:从规定每一个鏡頭的「固定劇本」,走向规定世界规则、角色动机与敘事引力的「故事憲法」——作者不再窮舉所有可能,而是设计可能性的空間。隨之而来的艺术命题:如何在无限可能中维持戲劇張力(自由与必然的平衡);角色能否擁有超出劇本的行为(湧现与失控的一线之隔);正史、支线与用户生成劇情的层级如何管理;以及生成內容的审美同质化風險——当所有人使用相近的模型,風格的稀缺性如何重建。本白皮书的判斷是:技术越充裕,人类艺术判斷越稀缺——这正是指揮家论在美學层面的迴响。
    产业含義「故事憲法」的写作方法论是空白亦是富礦,教育与人才体系应率先佈局;風格资产(可辨識的作者性)将成为对抗同质化的核心競爭力。
    艺术判斷AI 原生电影的作者性可以存在于规则、選擇、编排和責任中,但不能只存在于技术说明书中。

    图 16 从故事憲法到每次体验

    16.1 从劇本到故事憲法

    线性电影以劇本固定事件順序;生成式作品需要故事憲法,规定世界规则、角色价值、不可跨越的主题邊界、允許变化的事件和结局條件。具体情节可生成,但作品身份由憲法保持。这使作者从句子与鏡頭的唯一编写者,轉为可能空間的设计者。

    故事憲法应有可读版本和机器版本。前者供创作与评审理解,后者供智能体和安全系统執行。两者衝突时以经批准的人类版本为准。

    16.2 新的艺术单位

    AI 原生艺术的最小单位可能不是鏡頭,而是生成规则、選擇空間、记憶机制、角色行为或一次不可重现的体验。评审因此需要同时看成片、系统和观众关係:规则是否产生有意義的变化,互动是否服务主题,隨机性是否被创作性地控制。

    线性輸出仍可具有高度 AI 原生性;互动也不自动带来艺术创新。新评价体系不应用技术新奇取代形式、情感和思想。

    16.3 保存不可重现的作品

    实时作品可能因模型、资料、政策或平台更新而改变。保存需要同时记录模型与版本、提示和规则、世界初始狀態、关鍵资产、隨机种子、运行环境、代表性会話和可播放代理版本。对无法永久重建的作品,档案机构至少应保存可验证的行为证据和体验记录。 *表 16 从故事憲法到每次体验 - 关联分析表*

    维度评审问题
    思想作品提出了什麼不可替代的问题
    形式生成与互动是否形成新语法
    规则变化空間是否有意義且一致
    关係观众行动是否改变理解
    責任创作者是否理解并承擔系统后果
    05

    产业重构

    > 电影、遊戲、直播与社交的汇流

    17 影游联动進入「同一世界生产」 · 18 直播、賽事与实时影视 · 19 新产业链和新職业 · 20 市場和商业模式变化 · 21 全球产业格局

    第 17 章 · CHAPTER 17

    影游联动進入「同一世界生产」

    第 17 章

    本章要點传统影游联动是同一 IP 的两次生产:电影一套资产、遊戲一套资产,联动止于品牌层。世界模型时代的影游合流是同一世界的一次生产、多形態渲染:同一角色模型、同一世界资产、同一行为系统、同一空間数据库、同一数字身份——在影院是两小时的线性敘事,在主机是四十小时的开放探索,在眼鏡是走入现实的碎片劇情。技术基礎已在成形:实时世界模型正同时向影视生成与遊戲引擎两个方向产品化[E1/E2]。合流的組織
    产业含義同樣深刻:影视公司与遊戲公司的能力邊界将重疊,「世界工作室」成为新的組織形態。含義IP 方应以「世界资产包」重构授权标的;影游人才的双向流动与組織融合,是未来五年并購与招聘的主线之一。
    产业结论影遊联动的下一階段不是更頻繁的联名,而是建立能被多种媒介可靠读取的共享世界层。

    图 17 同一世界,多形態渲染

    17.1 从同一 IP 到同一世界

    传统影遊联动通常把角色设定和美术概念分別重做为电影与遊戲资产。世界模型时代可建立共享语義层:角色身份、地點、时間线、物体、关係、行为规则和权利邊界被保存一次,再由线性电影、互动遊戲、直播或广告按各自需要渲染。这不是把电影素材直接汇入遊戲,而是讓多种媒介读取同一世界。

    共享并不意味所有资产完全通用。高品质电影鏡頭、可碰撞遊戲幾何、实时表演骨骼和宣传图像仍有不同技术要求;可共享的是语義、身份、来源与权利关係,以及能生成各类媒体的高层规则。

    17.2 世界工作室的組織形態

    世界工作室以世界资产組合而非片单为核心。制片、遊戲、技术、社群和授权團隊在立項早期共同定義世界聖经、资产接口和版本治理。线性电影可以成为世界入口,遊戲提供行动,直播提供事件,社群提供共同创作,角色则跨形態持續运行。

    財务上应把一次性項目成本与可復用世界投资分开。場景语義、角色模型、世界狀態和治理工具若可跨作品使用,应建立资产攤銷和维护预算;否则每个項目都会重建,无法形成世界经济。

    17.3 影遊汇流的風險

    过度追求跨媒介可能犧牲作品完整性,使每部电影变成其他产品的入口。治理上应为每种形態设置獨立艺术責任人和完整体验标准。世界资产的授权也应区分观看、交互、生成、再创作和商业运营,避免一次授权被无限外推。 *表 17 同一世界,多形態渲染 - 关联分析表*

    共享层电影遊戲/互动治理
    角色身份表演与弧光能力与狀態同意/版本
    世界语義場景与主题地图与规则来源/权利
    时間线敘事順序任务与分支正典/分支
    行为表演選擇可執行动作安全邊界

    第 18 章 · CHAPTER 18

    直播、賽事与实时影视

    第 18 章

    本章要點实时生成与直播的结合正在打开「实时影视」形態:賽事实況的生成式增強(观众自選机位与解说風格)、观众以第一视角進入现場的生成重建、虛擬明星的实时表演、品牌內容按观众语境动態進入場景、现場事件与生成世界同步联动。与录播內容相比,实时影视的核心资产是「在場感」与「不可復现性」——这恰是生成技术最能放大的体验维度。虛擬偶像与直播电商在部分市場已验证其商业雛形[E1],世界模型将把单點能力整合为完整的实时敘事系统。
    产业含義轉播权的定義将被改写——「生成增強权」「视角進入权」等新权利类別需要提前約定;实时內容的来源记录与責任链(見第廿七章)是该形態的合规前提。
    运营原则实时影视的核心能力不是永不停机地生成,而是在任何狀態下保持可控、可理解和可恢復。

    图 18 生成式直播运营閉环

    18.1 实时影视的三类产品

    第一类是生成式直播:画面、場景或角色根据事件和观众輸入即时变化。第二类是互动賽事与表演:观众選擇影响规则、视點或世界事件。第三类是持續頻道:智能体角色在非固定时段运行,按社群狀態生成节目。三类产品的共同要求是直播级可靠性、內容安全和事件记录。

    预制与实时不应二選一。专业产品会预先准備关鍵资产和安全片段,把生成用于变体、回应和过渡;当服务不穩定时可回落到经审核內容。

    18.2 观众輸入与治理延遲

    直播把惡意提示、操縱投票、身份冒用和品牌風險带到毫秒级。治理管线需要在意图层、世界狀態层和輸出层分別檢查,而不能只在最終画面完成后审核。高風險动作可要求延遲确认,敏感場景可切換到封閉行动集合。

    系统还要记录群体決策规则,区分真实用户、机器人与授权智能体。若智能体可以代表观众投票或消費,必须显示代理身份与授权范围。

    18.3 商业与运营指标

    除观看人数外,实时影视应追蹤有效互动率、世界狀態恢復时間、生成降级率、安全中斷率、每分鐘推理成本、群体決策公平性和內容重用率。把峰值互动做大但无法控制成本与風險,不是可持續商业模式。 *表 18 生成式直播运营閉环 - 关联分析表*

    指标目的紅线
    端到端延遲互动自然持續超标
    降级率服务穩定无预制回退
    安全中斷率風險監测中斷不可解釋
    世界恢復时間事故处置狀態不可回滾
    每分鐘成本单位经济收入越高虧損越大

    第 19 章 · CHAPTER 19

    新产业链和新職业

    第 19 章

    本章要點产业链重构催生新職业族:AI 原生制片人(统籌人机混合制片)、世界架构师(设计世界规则与空間资产)、智能体导演(調度多智能体表演)、互动敘事设计师(设计可能性空間)、世界记憶设计师(管理角色与世界的长期狀態)、合成表演权利制片人(管理数字替身授权链)、来源记录工程师(构建可追溯管线)、生成安全导演(实时內容的風險控制)、AI 影视资产经理(运营资产組合)、体验经济设计师(设计存在与参与的付費结构)。与此同时,執行型崗位面臨结构性收縮——本白皮书主張以「崗位轉译」而非「崗位消失」的框架管理轉型:多数传统技能在新職业中有对应的迁移路徑,轉型成本应由行业教育体系与机构共同分擔。
    产业含義人才缺口在「懂敘事的系统设计者」与「懂系统的敘事者」交叉处;院校与培訓体系的課程重构,是未来三年产业基礎设施建设的一部分。
    人才判斷最稀缺的人才将不是最会操作某一模型的人,而是能把艺术、系统、资产和責任整合为可运行流程的人。

    图 19 AI 电影新产业链

    19.1 新产业链的六个层级

    上游包括算力、资料、基礎模型与开发工具;中游包括世界建模、工作流编排、角色系统、评价与治理;內容层包括创作、制片和资产管理;发行层包括平台、影院、遊戲与空間終端;交易层包括授权、索引、支付和结算;运营层包括社群、持續世界与安全响应。任何单一企业都难以垂直包辦全部层级。

    价值集中點可能从模型逐步移向擁有可信资产、用户关係和世界运营能力的机构。模型仍是重要基礎设施,但标准化和多供应商路由会降低不可替代性。

    19.2 新職业与能力組合

    AI 原生制片人统籌人机流程和成本;世界架构师建立狀態与规则;生成攝影与声音设计师管理模型语法;连續性工程师维护角色、空間和事件;创作证据与来源工程师建立记录;角色运营者管理长期人格与社群;生成安全导演设计拒絕、降级与事故处置。这些職业不是传统職位改名,而是把创意、系统与治理结合。

    教育体系应从单一工具培訓轉向可迁移能力:敘事判斷、狀態建模、资料素養、模型评价、权利与同意、版本控制和跨专业协作。工具更新很快,方法论与責任能力更长久。

    19.3 勞动轉型与公平分配

    AI 可減少重复執行,也可能把風險和不穩定轉移給自由職业者。机构应公开哪些工作被自动化、如何评估人类貢獻、衍生模型和资产如何分成,以及技能轉型预算。对表演者、设计师和资料供应者的价值不能只在一次買斷中结束。 *表 19 AI 电影新产业链 - 关联分析表*

    角色核心責任关鍵能力
    AI 原生制片人人机流程/预算创意+系统
    世界架构师规则/狀態敘事+资料建模
    连續性工程师身份/因果质量+版本
    来源工程师证据/字段标准+权利
    生成安全导演拒絕/降级內容+風險

    第 20 章 · CHAPTER 20

    市場和商业模式变化

    第 20 章

    本章要點商业模式沿三个层面重构。收入形態:訂阅制 AI 影视、单次世界訪问費、个性化劇集付費、实时生成算力包、角色訂阅、世界授权、工作流授权、互动广告、数字道具与衍生资产、企业訓練与模擬、智能体代理发行、持續版稅分成。定价单位:从「每部电影/每次播放」轉向每生成分鐘、每互动分鐘、每次角色調用、每次世界訪问、每个资产授权周期、每个智能体完成的商业任务——计价顆粒度与內容的运行时属性对齊。成本结构:推理算力成为最大可变成本,內容机构的財务模型向「雲原生軟件公司」靠攏。三个层面共同指向一个判斷:AI 原生影视的商业本质,是把「內容消費」重构为「体验与资产的持續运营」。
    产业含義投资盡調的估值框架需要更新:用户生命周期价值、世界留存率、资产復用率将取代单片票房成为核心指标。
    財务判斷持續生成把內容公司部分变成雲端服务公司;沒有服务单位经济,就沒有可持續的世界经济。

    图 20 持續世界收入組合

    20.1 收入单位的扩展

    票房、广告和平台授权仍会存在,但生成式媒体增加新的计价单位:世界訂阅、角色訂阅、互动事件门票、企业世界授权、按会話或推理用量付費、资产和工作流服务、品牌情境生成、智能体請求与衍生共创分成。不同收入模式对持續运营、权利和成本的要求不同。

    世界訂阅只有在內容持續更新、角色关係可積累且用户能控制记憶时成立;按生成用量收費需要透明成本和上限;资产交易需要可读授权和版本记录;共创分成需要明确貢獻计量。不能把所有模式都包裝为同一种会员。

    20.2 成本模型:从制作预算到服务单位经济

    固定成片主要在上映前投入;持續世界还要承擔推理、存儲、內容审核、客服、事故响应与模型更新。单位经济应计算每活躍会話成本、峰值容量、资产攤銷、內容接受率、留存和安全成本。若每次互动产生的推理成本高于可持續收入,产品越受歡迎虧損越大。

    可用混合生成降低成本:高頻場景预制或緩存,个性化只作用于高价值节點,低風險变体使用轻量模型,重要事件再調用高品质模型。

    20.3 定价与价值分配

    AI 原生产品的价格不应只反映算力,也要反映创作、品牌、世界资产和社群服务。平台需公开对创作者的收益计算,避免用不透明推薦把价值全部轉为平台租金。对角色或世界的二次使用,可採最低保证、使用分成和增值分成組合,而非无限期買斷。 *表 20 持續世界收入組合 - 关联分析表*

    模式价值单位成立條件主要風險
    世界訂阅持續狀態更新/留存高运营成本
    角色訂阅长期关係同意/记憶控制依賴与操縱
    互动事件一次体验可靠实时峰值容量
    企业授权品牌/場景控制与来源身份漂移
    Agent 請求机器交易权利字段/支付代理責任

    第 21 章 · CHAPTER 21

    全球产业格局

    第 21 章

    本章要點全球 AI 影视产业呈多極并進格局,各区域沿不同稟賦路徑演進[E1/E2]:北美——基礎模型、平台、算力与资本的集中地,产业秩序建设受勞资博弈与版权訴訟制約;歐洲——权利、透明度与来源记录的规则先行者,其披露框架正在成为事实上的国际基线;东亞——应用规模、內容生产与供应链優勢突出,节展、索引与市場等体系化基礎设施建设活躍,角色 IP、动画与虛擬偶像生態深厚;东南亞——移动優先的新创作者市場,跨语言內容需求旺盛;中东——主权资本驅动的沉浸式基礎设施与未来城市場景。本白皮书的判斷:不会出现单一中心,产业将围繞「模型極」「规则極」「应用極」形成分工型多極结构;跨区域的标准互认(定義、索引、披露)是避免市場碎片化的关鍵变量。
    产业含義机构的全球化策略应按「三極分工」配置:技术合作看模型極,合规设计对齊规则極,增长运营深耕应用極;标准互认的参与度決定跨境业务的天花板。
    格局判斷全球 AI 电影不会由单一中心壟斷;真正的樞紐是能把技术、资产、规则和市場连成可信网路的节點。

    图 21 全球 AI 电影多極网路

    21.1 全球競爭由多种稟賦決定

    北美在基礎模型、雲平台、创作者工具和全球发行网路上具有優勢;中国及东亞在应用规模、移动生態、开源模型、硬件供应链和內容工业化方面形成強大能力;歐洲以规则、文化政策、来源透明和公共价值塑造国际基线;日本、韓国擁有角色、遊戲、动画和粉絲经济的深厚资产;中东与东南亞以算力投资、多语市場和城市级体验形成新节點。

    这不是单一国家排名。AI 电影需要模型、算力、文化资产、法律可信度、资本、人才与跨境发行的組合;任何地区都可能在某个层面領先、在另一层依賴合作。

    21.2 香港的结构性位置

    香港的潛在優勢不在复制另一个模型中心,而在连接:国际资本与亞洲內容、普通法商业环境与跨境授权、多语创作与全球发行、节展评价与资产市場。若要把位置優勢轉为产业能力,需要建立可验证的标准、透明治理、常態化市場和人才网路,而不只是一次活动。

    香港亦面臨算力成本、本地制作规模和人才密度限制。策略应聚焦高价值中介层:评价、索引、合规、合作制片、资产协作、国际市場和城市网路。

    21.3 国际合作的最小共同语言

    跨境合作不要求统一全部法律,但可先统一作品識別、模型与资产披露、同意字段、版本关係、可用地域和責任联络。这些最小字段能降低盡調成本,讓不同法域的权利判斷建立在同一組事实上。标准应保持技术中立,允許不同平台实现。 *表 21 全球 AI 电影多極网路 - 关联分析表*

    区域優勢机会制約
    北美模型/雲/发行平台与工具集中与权利爭議
    中国及东亞应用/供应链规模化內容跨境互操作
    歐洲规则/文化可信內容资本与规模
    日韓角色/动画/遊戲世界资产语言市場
    香港跨境/资本/多语市場与标准连接算力/制作规模
    06

    数字资产与人机经济

    > 从作品交付到可机器协作的资产网路

    22 AI 影视资产:从成片扩展为资产族 · 23 AI 影视资产的生命周期 · 24 Agent 可读资产与智能体交易 · 25 人类世界与 AI 世界的价值连接:双域价值账户

    第 22 章 · CHAPTER 22

    AI 影视资产:从成片扩展为资产族

    第 22 章

    本章要點AI 原生影视的可交易资产不止于成片。本白皮书确立四类核心资产:作品(AI Film,成片与系列)、工作流(Workflow,生产方法与工具链組合)、角色(Character & IP,数字角色与IP 资产)、世界观(World,可复用的世界设定与空間资产)。并提出两个研究类別:行为与智能体(Behavior & Agent,角色行为模型与可运行智能体)、交互系统(InteractionSystem,敘事规则、用户响应与经济规则的系统资产)——二者的资产属性、权利邊界与计价方式尚在形成,本白皮书将其列为观察对象而非即刻的登记类別。资产族的意義在于:它把「一部电影的价值」分解为可分別确认、授权与交易的资产組合,使产业的资本化从票房单一通道走向組合化通道。
    产业含義內容机构应建立「资产負債表视角」:每个項目沉澱哪些类別的资产、各自的复用与授权路徑为何——这一视角将直接影响融资能力。
    邊界声明资产索引只描述和连接资产,不因此创设、轉移或确认任何法律权利。

    图 22 AI 视听资产族

    22.1 六类 AI 影视资产

    核心资产包括作品、工作流、角色和世界;为適应实时媒体,新版增加行为与交互系统、运行与证据记录两类。作品是可播放輸出及版本;工作流包含节點、配置、提示与评价门檻;角色包含形象、声音、人格、记憶和同意邊界;世界包含場景、规则、时間线与狀態;行为系统定義可執行动作与交互;记录层保存来源、模型、版本与責任。

    这些资产可以組合但不应混为一体。出售成片不自动轉讓角色模型,授权角色不自动开放訓練资料,提供工作流不自动授权其中第三方素材。资产分类的价值在于讓权利包络可被明确表述。

    22.2 资产的三个可用條件

    资产要進入市場,至少需要可識別、可理解、可調用。可識別要求穩定識別碼和版本关係;可理解要求机器可读的类型、能力、限制和来源字段;可調用要求清晰授权、技术接口与安全策略。缺少任一條件,资产只能被人工逐筆处理,无法支持规模化协作。

    「可交易」不等于可自由轉讓。部分资产只適合查詢或受控調用,尤其是表演者模型、未公开世界资料和包含个人记憶的角色。

    22.3 资产价值的评估

    作品价值可看观众与收益;工作流看可重复性、接受率和成本节省;角色看身份穩定、受众关係与授权完整;

    世界看可扩展性、狀態深度与跨媒介利用;行为系统看可控性与安全;记录层看完整度和可验证性。评估方法必须与资产类型匹配。 *表 22 AI 视听资产族 - 关联分析表*

    资产最小身份价值指标授权重點
    作品版本/成片受众/收益播放/改编
    工作流节點/配置接受率/效率執行/再分发
    角色身份/模型穩定/关係形象/声音/行为
    世界规则/狀態扩展/復用進入/建设/运营
    行为能力/接口控制/安全調用/代理
    记录来源/事件完整/可验查看/保留

    第 23 章 · CHAPTER 23

    AI 影视资产的生命周期

    第 23 章

    本章要點本白皮书提出资产全生命周期的十二环节模型:创建→记录→版本化→披露→索引→发现→請求→授权→运行→结算→衍生→歸档。前四环节解決「资产是什麼」(来源与版本的可信记录),中四环节解決「资产如何被找到与获得」(索引、檢索与授权),后四环节解決「资产如何产生持續价值」(运行计費、收益结算、衍生管理与长期保存)。索引基礎设施在其中的職能邊界必须清晰:建立记录、提高可发现性、提供机器可读结构、促進市場连接——而不作法律权利确认,不对收录对象作价值背书。这一克制与国际內容来源标准的原则一致:来源信息用于验证记录关联与防篡改,不負責判斷內容「好或壞」[E1,C2PA 2.2 技术规范]。
    产业含義生命周期模型可直接用作机构的资产管理制度模板;「记录与裁判分離」的原则,是索引类基礎设施获得跨方信任的制度前提。
    制度原则可信生命周期不是永不出錯,而是錯誤、变更、撤回和爭議都能被看見并被处理。

    图 23 资产生命周期

    23.1 从创建到退役的十二个环节

    资产生命周期包括创建、申报、識別、来源记录、技术验证、评价、上架、发现、請求、授权、运行结算和歸档退役。每个环节由不同主体負責,不能把所有責任交給索引平台。创作者保证申报,技术服务验证格式,评价机构給出专业意見,权利人授权,平台執行使用范围,发布者承擔輸出責任。

    资产的更新必须建立父子版本关係。角色声音更換、世界规则修改、模型升级和权利到期都可能改变可用性;

    旧版本不应被无痕覆蓋。

    23.2 最小可验证记录

    最小记录包括资产識別碼、类型、名稱、创建与提交主体、时間、版本、父资产、使用模型或工具、关鍵来源声明、授权狀態摘要、可用地域与期限、內容标識、安全联络和撤回狀態。敏感合同与个人资料可存于受限层,只公开存在性和查验路徑。

    技术验证只回答记录是否与资产关联、格式是否正确、簽名是否可验,不回答內容是否真实或权利是否有效。 [R11] 法律与价值判斷仍由相应主体承擔。

    23.3 撤回、爭議与孤兒资产

    索引系统需要保留撤回、異議和爭議狀態,但不应在沒有程序的情況下刪除歷史。可採「停止新調用、保留证据、显示爭議、等待決定」的分层处置。对无法联络权利人的孤兒资产,应限制商业使用并提供申領流程。 *表 23 资产生命周期 - 关联分析表*

    字段組示例公开层
    識別ID/类型/版本/父资产公开
    主体创建/提交/責任联络分级
    来源模型/工具/资产声明摘要
    权利地域/期限/用途/狀態摘要
    治理标識/異議/撤回公开
    技术格式/接口/杂湊按需

    第 24 章 · CHAPTER 24

    Agent 可读资产与智能体交易

    第 24 章

    本章要點当交易的发起方不再只是人类,资产必须「可被机器阅读」:结构化的资产页面、权限化API、标准化的元数据与授权條款表達,使智能体能夠檢索资产、发起詢价、准備权利材料并完成受限授权。Agent-to-Agent 交易的工程要素已在成形[E2]:智能体发起支付与授权证明的开放协議方向已由主要平台提出(Agents-to-Payments 协議),国际金融机构亦开始討论概率型 AI 代理与确定性授权、身份与结算层之間的分離架构[E2/E3,IMF 关于智能体支付的研究】。本白皮书主張的安全邊界:人类批准与授权委託的层级化(限額、白名单、审计)、智能体身份的可验证性、机器交易的完整审计记录——自动化提高效率,但責任始終錨定于人类与法人。
    产业含義「Agent 可读」将成为资产流动性的门檻條件——不可被机器檢索与理解的资产,将在下一代市場中系统性折价;授权條款的机器可读化(标准化許可语言)是行业标准工作的優先事項。 交易底线 智能体可以推薦和协商,但高風險权利与支付必须由可識別主体在确定性控制下授权。

    图 24 智能体资产交易分层

    24.1 机器可读权利包络

    智能体要請求资产,必须理解允許的媒介、用途、地域、期限、受众、模型操作、衍生权、价格规则、署名、內容限制与人工批准點。这些字段构成权利包络,而非把整份合同簡化为「可用/不可用」。自然语言合同仍是法律文本,机器字段用于執行明确條款并提示人工处理例外。

    对不可撤回、高价值或涉及人格权的使用,智能体只能准備請求,不能自行最終授权。权限应与風險和金額分级。

    24.2 概率意图与确定性交易分层

    智能体可以理解需求、搜索和比較,但授权、身份、限額、支付与结算需要确定性系统。AP2 等协議开始处理代理授权、真实意图和責任问题;IMF 亦提出意图、授权与结算三层框架。[R21][R22] AI 影视市場可採相同原则:模型提出,规则验证,受权系统執行。

    每筆智能体交易应记录代理身份、委託人、授权范围、請求內容、選擇依据、价格、资产版本和最終批准。沒有可审计委託链,平台不应接受自动交易。

    24.3 从搜索市場到請求市場

    人类通常瀏覽目录再購買;智能体可以发布结构化需求,由资产方或其他智能体提出匹配方案。这会形成反向市場:需求包括角色能力、風格、权利、成本、延遲与安全要求,资产方按條件响应。索引因此从靜態目录升级为可协作网路,但仍需防止价格操縱、垃圾請求和代理串謀。 *表 24 智能体资产交易分层 - 关联分析表*

    字段机器可读值人工处理條件
    用途观看/生成/再创作未列用途
    地域期限代碼/日期衝突或例外
    身份角色/表演者范围敏感人物
    价格固定/階梯/报价高价值談判
    批准自动/需人工人格权/不可撤回

    第 25 章 · CHAPTER 25

    人类世界与 AI 世界的价值连接:双域价值账户

    第 25 章

    本章要點「AI 世界的 GDP」是一个誘人但危險的表述:AI 生成世界沒有獨立法律主权、统一貨幣与完整国民账户,直接套用 GDP 概念将导致重复计算与统计幻覺。本白皮书提出更嚴謹的替代框架——「人类—AI 双域价值账户」,记录四类流动:(一)人类世界輸入 AI 世界:人类勞动、IP、文化数据、资本、算力、能源与设備;(二)AI 世界形成的生产:生成內容、角色服务、互动体验、世界资产与智能体服务;(三)AI 世界返回现实经济:授权費、訂阅、广告、工资、版稅、投资收益、稅收与设備需求;(四)AI 世界內部活动:智能体調用、角色交易、世界服务、算力消費与数字资产組合。落地路徑是「AI 原生视听衛星账户」:以衛星账户方法测量 AI影视带来的总增加值并与现实 GDP 对接,避免同一筆版权、平台收入与智能体交易被重复计入。方法依据已然存在:联合国 2025 年修訂的国民账户体系专门研究了提高 AI、免費数字产品、数字平台及数据资产在国民账户中可見性的路徑[E2/E3,UN SNA 2025 修訂工作]。
    产业含義双域价值账户为政策制定者提供了观测新经济形態的儀表盤,为投资者提供了跨域价值流的分析语言;衛星账户试點是三方联合行动議程中最具公共价值的項目之一。 计量原则 AI 世界的经济前景可以巨大,但越巨大越需要避免把交易額、资产估值与增加值混为一談。

    图 25 人类-AI 双域价值流

    25.1 为什麼不能直接宣稱 AI 世界 GDP

    虛擬世界內的代幣交換、智能体服务和生成內容交易可能有经济意義,但若把所有內部交易直接与现实 GDP相加,会重复计算中間投入、平台內循环和未实现价值。GDP 是特定统计制度中的增加值概念,不是任何交易总額的別名。

    因此,本书把「人类世界与 AI 世界 GDP 互通」轉化为可研究命题:哪些价值流跨域、由誰生产、如何定价、是否形成最終使用、如何回流现实收入与稅基。先建立账户,再討论总量。

    25.2 人类-AI 双域价值账户

    框架包含四个账户。人类投入账户记录创作、资料、资本、能源与权利;AI 執行账户记录模型推理、智能体服务和自动化工作;虛擬世界账户记录世界內最終消費、资产使用与社群活动;现实回流账户记录现金收入、工资、授权、稅收和实体消費。四者以可追蹤交易关係连接,对中間服务去重。

    每筆流量至少标记支付者、接受者、人或智能体身份、资产、目的、价格、地区、时間与是否属最終使用。智能体沒有獨立法律人格时,其活动仍歸属委託人或运营主体。

    25.3 AI 原生视听衛星账户

    衛星账户在不改变核心国民账户的情況下,扩展对特定領域的观察。可测量 AI 视听增加值、算力与能源投入、数字资产形成、人类勞动变化、跨境模型服务和平台收入。联合国 2025 SNA 对数字化、资料与 AI 的处理提供方法背景,但本书框架仍需统计机构、學界和产业资料共同试點。[R23]首期试點不追求单一总数,可先建立企业樣本:每个項目的人工时数、推理成本、可復用资产、最終收入和跨境支付。只有测量口徑穩定后,才適合推导行业规模。 *表 25 人类-AI 双域价值流 - 关联分析表*

    账户记录內容避免重复方式
    人类投入创作/资料/资本/能源标记中間投入
    AI 執行推理/Agent 服务歸属委託主体
    虛擬世界最終使用/资产服务区分內部循环
    现实回流收入/工资/授权/稅只计可观察流
    衛星账户行业增加值/资产形成銜接 SNA 口徑
    07

    权利、治理与全球标准

    > 透明、責任与人类主体性

    26 创作主体、版权与数字替身 · 27 来源透明、內容标識与責任链 · 28 文化多樣性、人类主体性与可持續性

    第 26 章 · CHAPTER 26

    创作主体、版权与数字替身

    第 26 章

    本章要點版权制度正在回答三个层层遞進的问题。第一,人机协作作品的可版权性:主要法域的实踐趨向于以「足夠的人类表達控制」为核心判准——僅提供提示詞并不当然构成人类作者貢獻,而選擇、编排与修改的深度参与则可以[E1,美国版权局 AI 报告];这与指揮家论的判斷结构天然兼容。第二,訓練与素材的权利:模型訓練許可、文化数据的合法来源,是产业合规成本的主要变量。第三,人的数字延伸:声音、面孔与动作的复制授权,虛擬演员与已故人物数字再现的权利邊界,角色模型持續使用中的权利存續——「合成表演权利」正在成为獨立的权利类別。不同法域的版权差異短期內不会统一,本白皮书主張以「披露+合同」的私序安排在差異之上构建可執行的跨境秩序。
    产业含義制片合同范本需要系统升级:AI 参与披露條款、訓練素材保证條款、数字替身授权链條款应成为标配; 「人类表達控制」的证据留存(创作日誌、工作流记录)将直接影响权利主張能力。 法律邊界 分类、索引和来源记录可以提供事实,但著作权、人格权与合同效力仍由適用法律和具体证据決定。

    图 26 AI 影视权利四层

    26.1 作者性:工具使用与创作控制

    不同法域对 AI 輸出的保护存在差異,但人类创作貢獻仍是核心问题。美国版权主管机关明确区分把 AI 作为輔助工具、对 AI 內容進行创作性選擇编排,以及完全由模型決定表達的情況。[R15] 行业不应用「AI 原生」标籤替代逐項权利判斷。

    创作者应保留能反映人类控制的证据:意图与草稿、提示演進、参考资产選擇、候選淘汰、局部修改、剪辑和最終批准。证据不是为了把创作变成打卡,而是讓爭議时能说明人的具体貢獻。

    26.2 訓練、輸入与輸出的分離

    模型訓練资料、項目輸入资产和最終輸出是三个不同权利层。即使模型可以合法使用,項目上传的演员素材、未公开劇本或品牌资产仍需獨立授权;即使輸出获准发行,也不代表可反向用于訓練角色模型。合同与记录应分开描述。

    WIPO 建議机构在採用生成式 AI 时核查工具條款、资料与輸出風險、保密、責任和可追溯性。[R16] 制片流程应把法务檢查嵌入资产入口,而非只在最終成片集中处理。

    26.3 数字替身与持續同意

    一次拍攝同意不足以覆蓋无限生成。数字替身授权应包括能力、用途、媒介、时間、地域、風格与敏感場景、审批、报酬、撤回、模型更新与轉授权。当模型从生成广告升级到可自主对話角色,能力变化构成新的同意事件。

    未成年人、已故人士、政治人物与醫療或成人場景需要更嚴格控制。对身份高度敏感的生成应保留人工批准和可迅速撤下的技术机制。 *表 26 AI 影视权利四层 - 关联分析表*

    授权項最低內容重新同意觸发
    资料来源/用途/保留新增訓練用途
    形象声音媒介/場景/地域敏感場景
    自主能力可说/可做/禁区由被动变 Agent
    期限撤回終止/刪除/存档模型永久化
    报酬固定/使用/分成新收入模式

    第 27 章 · CHAPTER 27

    来源透明、內容标識与責任链

    第 27 章

    本章要點透明性正在从美德变为義务。監管側,生成式內容的机器可读标識要求進入硬法时間表——歐盟 AI 法案相关透明度義务于 2026 年 8 月進入適用階段,覆蓋 AI 生成的音頻、图像、视頻与文本[E1];标准側,內容来源与真实性标准(C2PA 2.2)提供了记录关联与防篡改的技术基座[E1]。本白皮书提出面向 AI 原生影视的責任链框架:AI 参与披露(双軸定位与工具链说明)→訓練、生成、编辑与发布的全程记录→模型及版本说明→深度偽造的識別与标记→实时內容的动態来源记录(G4/R3 以上形態的新命题:每一次生成都需可追溯)→事故处置与內容撤回机制。責任主体的原则:实时生成內容的責任沿「世界规则设定者—运营者—工具提供者」链條分配,用户輸入不豁免运营者的安全義务。
    产业含義2026 年 8 月是合规分水嶺:面向歐盟市場的內容机构应在此之前完成标識与记录管线改造;「动態来源记录」是实时影视領域尚无成熟方案的标准空白,也是标准組織的机会窗口。 C2PA 原则 来源资料可以被验证为与资产关联且未被篡改,但规范不对內容好壞或真假作价值判斷。[R11]

    图 27 三层透明与責任链

    27.1 三层透明架构

    第一层是人可感知标識,讓观众知道內容由 AI 生成或重大修改;第二层是机器可读标记,支持平台和工具識別;第三层是可验证来源记录,保存资产、编辑和簽名关係。中国 2025 年标識辦法同时要求显式与隱式标識;歐盟 AI 法第 50 條及 2026 透明实务守则要求特定生成內容的标记与披露。[R12][R13][R14]三层互補而非替代。水印可能被裁剪,元资料可能丟失,来源憑证也不保证內容真实。平台应以多种信號組合判斷,并向用户清晰显示不确定性。

    27.2 責任链而非責任黑箱

    AI 原生內容涉及模型提供者、工具平台、资产方、创作者、制片、发行和部署者。責任链应记录每一方控制了什麼、知道什麼、批准了什麼。模型供应方負責能力和限制文档,创作者負責輸入与選擇,制片負責工作流与合规,发布者負責面向观众的最終呈现。

    对实时內容,責任链必须加入会話运营者与安全策略版本。事故后应能重建重要事件,而不必永久保存所有敏感原始资料。

    27.3 Index.Film™ 的制度定位

    Index.Film™ 可为作品、工作流、角色、世界和相关资产建立識別、版本、来源与协作记录,支持查詢、比較和市場接口。它不因此确认权利歸属、不保证申报真实、不对艺术品质背书,也不替代法定登记、合同审查或司法程序。

    制度可信度来自清楚邊界、申报責任、異議程序、版本歷史与查验方式。收录狀態应描述记录進度,而非把资产分为被认证和未被认证的价值等级。 *表 27 三层透明与責任链 - 关联分析表*

    主体主要控制最低记录
    模型方能力/安全/版本模型卡/变更
    创作者輸入/選擇/修改创作证据
    制片方工作流/权利/批准交付清单
    发行方标識/受众/平台发布責任
    运营方实时策略/事故事件与回滾

    第 28 章 · CHAPTER 28

    文化多樣性、人类主体性与可持續性

    第 28 章

    本章要點三重长期風險需要正视。文化层面:模型的统计本性天然偏向主流分佈,小语种与地方文化面臨表達稀釋,文化数据主权与艺术家公平报酬是全球文化治理的共同議题——国际文化机构已明确指出,生成式 AI 正同时改变文化的生产、分发与参与方式,治理必须处理文化权利、多樣性、艺术家经济模式与人类原创性问题[E1/E2,UNESCO 关于 AI 与文化的框架]。主体性层面:创作者的数字鴻溝(工具、算力与素養的不平等)与模型偏見的再生产,決定新形態是扩大还是收窄创作的民主。可持續层面:AI 影视的基礎设施建立在数据中心电力之上,国际能源机构明确提出,未来的技术评价应同时考察能耗、能源安全与可負擔性[E1,IEA 能源与 AI报告]——每生成分鐘的能源成本,应進入产业的核算视野。此外,未成年人保护、沉浸体验的心理安全与情感依賴管理,是面向 G4/G5 形態必须前置的设计約束。
    产业含義文化多樣性條款、能耗披露与心理安全设计,宜納入行业自律规范与评獎的考量维度;「負責任的生成」不是公关语言,而是新形態获得长期社会許可的成本項。
    公共价值AI 电影的成功不能只用生成量衡量,还要看文化是否更豐富、创作者是否更有能力、资源使用是否可承受。

    图 28 公共价值四象限

    28.1 文化多樣性与资料集中

    模型可能扩大创作工具的可及性,也可能因訓練资料、平台推薦和语言资源不均衡而強化主流風格。

    UNESCO 将文化多樣性、艺术家生计、人类创造力与透明治理列为 AI 文化政策的重要議题。[R18] 评价体系应观察语言、地域、题材和创作者群体,而不只看生成量。

    支持多樣性需要投资小语种资料、在地文化顧问、社群授权和公平收益,而不是把文化元素当作无主風格。对神聖、敏感或受社群治理的资料,技术可生成不等于文化上可使用。

    28.2 人类主体性与创作者经济

    人类主体性包括拒絕被模型替代、知道何时与 AI 互动、控制数字身份、理解推薦和保留不被个性化的权利。

    企业应评估自动化对職位、議价和收益分配的影响,提供轉型和申訴机制。生成效率不能成为取消署名、同意和公平报酬的理由。

    28.3 能源与可持續生成

    生成视頻和实时世界具有高推理負荷。IEA 显示资料中心用电正在快速增加,AI 是重要驅动因素;同时单次任务效率改善并不必然抵消使用量增长。[R19][R20] 制片与平台应测量每个可接受成片秒、每活躍会話分鐘和每收入单位的能耗,而非只引用模型效率。

    可持續策略包括模型路由、緩存、蒸餾、低碳时段与地区調度、设備壽命、可再生能源採購和內容价值门檻。

    并非所有互动都需要最高解析度和最大模型。 *表 28 公共价值四象限 - 关联分析表*

    面向指标不充分指标
    能源每合格秒/会話分鐘能耗模型单次效率
    文化语言/地域/创作者分布內容总量
    勞动人类收入/轉型/議价自动化比例
    主体性控制/退出/申訴使用时长
    08

    预测、情景与行动路线

    > 2026-2035 的選擇窗口

    29 2026–2035 技术与产业路线预测 · 30 四种未来情景 · 31 各类主体行动指南 · 32 三方联合行动議程

    第 29 章 · CHAPTER 29

    2026–2035 技术与产业路线预测

    第 29 章

    本章要點本白皮书按三階段給出路线预测,每項均标注证据前提与可信度。2026–2028(基礎设施期,高概率):原生音视頻生成、角色一致性、智能体制片与来源记录全面产业化;索引与披露基礎设施成形;长片生成的世界狀態工程方法成熟。2029–2032(形態爆发期,中高概率):实时生成劇集進入主流平台;影游统一资产的「世界工作室」规模化;空間设備原生內容佔比显著上升;Agent 发行与机器交易進入常態。2033–2035(经济空間期,條件性预测):多人持續世界承载长期角色关係与世界內经济;人机价值账户進入统计实踐; 「电影」一詞的外延正式覆蓋持續运行的文化世界。2035 以后(探索性情景):电影成为持續运行的文化世界而非单一作品——媒体、遊戲、社交与经济空間的邊界完成歷史性溶解。每項预测附領先指标(如实时世界模型的单卡 720p 達成时點、眼鏡端內容消費时长佔比、首个衛星账户试點落地),供年度修訂檢验。
    产业含義预测的价值不在于必然正确,而在于可被檢验——本章同时是本白皮书年度修訂机制的基准线。 预测紀律 年份是观察窗口,不是承諾;只有技术、经济、设備、治理与文化五个门檻共同滿足,形態才会规模化。

    图 29 2026-2035 三階段观察窗口

    29.1 2026-2028:基礎设施期

    高概率進展包括原生声画、可控编辑、角色一致性和工作流智能体持續改進;模型路由、私有部署与创作证据成为专业流程;显式和机器可读标識在主要市場制度化;世界模型在遊戲、预演、教育和部分互动內容中扩大。关鍵制約是长时一致性、推理成本、权利资料和跨工具互操作。

    此階段最值得投资的不是永久綁定模型,而是狀態、资产、评价、来源和人才。任何机构都应能在模型更換后保留核心世界与权利记录。

    29.2 2029-2032:形態扩張期

    條件性预测包括多人共享生成环境進入商业娛樂,线性与互动版本同步制作,AI 眼鏡和空間设備形成可持續內容分发,角色訂阅与世界訂阅获得較大市場,智能体参与资产搜索与授权。成立前提是延遲、能耗、设備可用性、治理和用户接受度同时改善。

    領先指标包括跨小时狀態穩定、单用户实时成本下降、日常佩戴设備的留存、跨平台资产調用、事故率和有效授权时間。

    29.3 2033-2035:持續世界期

    若前提成立,部分媒体将从节目或遊戲轉为长期运行的文化世界,角色和社群跨終端延續,世界內活动与现实服务形成穩定交易。这不会代表所有电影都世界化,而是形成新的媒介门类。最大的未知数不是画质,而是治理能否在多人、智能体和跨境交易规模下保持可信。

    任何精确普及率都属过度推斷。本书只提供可观察门檻,并要求年度根据证据修訂。 *表 29 2026-2035 三階段观察窗口 - 关联分析表*

    窗口能力门檻市場门檻治理门檻
    2026-2028可控生成/工作流专业採用标識/来源
    2029-2032多人/空間/低成本訂阅与跨媒介Agent 权限/事件记录
    2033-2035持續跨端世界穩定世界经济跨境責任/统计

    第 30 章 · CHAPTER 30

    四种未来情景

    第 30 章

    本章要點路线预测之外,本白皮书以情景方法覆蓋不确定性。情景一·漸進工业化:AI 主要提高传统制作效率,G4/G5 遲滯——若世界模型的记憶与实时瓶頸未如期突破。情景二·互动媒体主流化:实时互动影视成为与电影、劇集并列的內容门类——技术如期、权利秩序基本理順的中性路徑。情景三·世界模型媒体化:电影、遊戲与社交平台深度融合,世界工作室成为产业主导組織——技术与资本双加速的樂观路徑。情景四·权利与平台碎片化:技术成熟但版权、信任与标准分裂使统一市場无法形成,价值困于孤岛——标准互认失敗的警示路徑。 四情景的分野变量只有两个:世界模型的技术成熟速度×全球权利与标准的协調程度。这正是本白皮书把「标准建设」置于与「技术追蹤」同等地位的原因。
    产业含義机构的戰略规划宜以情景二为基准、以情景四为風控底线:对标准协作的投入,本质上是对情景四的对沖。 策略方法 情景规划不選一个最喜歡的未来,而是檢验今天的決策在多种未来中是否仍能生存。

    图 30 四种未来情景

    30.1 情景一:受控繁榮

    开放来源标准、清晰同意、可移植资产与多供应商模型形成競爭,创作者能以小團隊运营高价值世界,平台分享资料与收益。互动內容增长而事故保持可控。企业策略是投资可验证资产、信任品牌和世界运营。

    30.2 情景二:平台封閉

    少数平台控制模型、終端、身份、支付和角色关係,作品无法迁移,创作者依賴推薦和算力租金。体验可能快速改善,但議价权和文化多樣性下降。企业应保留可导出资产、跨平台受众和合同退出权。

    30.3 情景三:信任危机

    身份冒用、未授权訓練、实时有害內容和来源欺詐引发監管收緊与观众反感,生成內容面臨高标識和高責任成本。能提供完整来源、人工責任和安全记录的机构反而获得溢价。

    30.4 情景四:开放世界

    世界、角色和智能体可跨平台互操作,个人控制身份与记憶,资产在开放协議上被調用和结算。创新速度高,但垃圾资产、代理攻擊和跨境責任增加。成功依賴可信身份、权限和爭議处置。

    四种情景可能在不同地区同时存在。策略应採用无悔投资:可移植资料、明确权利、来源记录、成本可观察、安全降级和人类責任,在任何情景中都保留价值。 *表 30 四种未来情景 - 关联分析表*

    情景領先信號无悔策略
    受控繁榮开放标准/收益改善可信资产
    平台封閉高迁移成本/集中可导出与多平台
    信任危机事故/訴訟/退訂来源与人工責任
    开放世界互操作/Agent 交易身份权限与爭議处置

    第 31 章 · CHAPTER 31

    各类主体行动指南

    第 31 章

    本章要點政府与政策制定者:以披露型監管为主軸,儘早佈局衛星账户统计试點与教育轉型投入,避免以旧业態邏辑规制新形態。电影公司与制片人:建立资产負債表视角与世界资产策略,改造合同范本,投资工作流与狀態工程能力。AI 模型与技术公司:以八层架构定位自身生態位,優先攻堅记憶、动作控制与实时响应三大瓶頸,主动接入来源记录标准。版权及发行平台:升级为「资产运营者」,建设 Agent 可读的授权接口,参与标准互认。投资机构:以双軸定位与资产族框架重建盡調工具箱,关注階段躍迁窗口。硬件与眼鏡廠商:与內容側共建空間敘事语法,把隱私与旁观者保护做進产品默认值。创作者:把判斷力与風格资产作为核心競爭力经营,儘早以索引记录沉澱作品身份。节展与學术机构:承擔评价体系与人才課程的公共品供給,以年度同行评議维护标准公信力。城市文化及科技管理者:以创作现場(賽事、实验室、算力配套)而非单純補貼参与全球网络分工。
    产业含義行动指南的共同底层是同一句話:在标准与基礎设施成形的窗口期,参与建设者的回报将长期優于观望者。 執行原则 先做能跨模型、跨平台、跨情景保值的基礎工作,再追逐单點能力。

    图 31 六类主体行动网路

    31.1 创作者与制片机构

    建立创作聖经和世界狀態资料库;把模型接入放在可替換编排层;记录人类意图、選擇与修改;以每个合格成片秒和可復用资产衡量效率;在立項时完成资料、表演者和平台條款清单;为实时內容设置拒絕、降级与事故演練。

    31.2 模型、技术与平台

    公开能力條件和限制,不用最佳樣片代替系统指标;支持结构化輸出、版本鎖定、资产与来源接口;把安全、身份、授权和结算从概率模型中分层;提供可导出记录与退出路徑;测量能源与峰值容量。

    31.3 发行、投资与保險

    发行方应建立 AI 参与、来源、标識、角色同意和实时責任的交付清单。投资者应盡調可替換模型、资产权利、单位经济、用户留存与事故成本。保險产品可围繞身份冒用、来源缺失、內容事故、模型中斷和跨境索賠设计,但需要可观察资料。

    31.4 政策、學术与教育

    政策应支持互操作、透明和创作者能力,避免用单一技术定義鎖死创新。學术界需要长敘事、多人世界、人机创作和文化影响的公共基准。教育机构应把艺术、计算、权利与治理放在同一課程,并支持受自动化影响的从业者轉型。 *表 31 六类主体行动网路 - 关联分析表*

    主体90 天12 个月
    创作者/制片资产与权利盤點世界狀態/创作证据管线
    技术平台能力与限制披露可导出来源/降级架构
    发行投资AI 交付清单单位经济与風險基准
    政策學术术语与樣本公共测试/统计试點
    教育跨域課程设计新職业认证与轉型

    第 32 章 · CHAPTER 32

    三方联合行动議程

    第 32 章

    本章要點作为本白皮书的落地承諾,三方编制机构提出十二項联合行动:(1)AI 原生电影年度技术观察站——持續追蹤模型能力与成本曲线;(2)51%+标准年度同行评議——开放国际专家对刻度細则的修訂;(3)实时互动电影实验室——面向 G4 形態的创作与技术联合实验;(4)世界模型电影挑戰——以競賽推动世界模型与敘事的结合;(5)AI 眼鏡与空間电影计划——与硬件生態共建空間敘事语法;(6)全球城市创作与技术测试网络——以多城市站點承载賽事、测试与人才发现;(7)资产字段标准——制定四类资产的机器可读元数据规范;(8)来源与创作证据建議规范——銜接国际內容来源标准与创作证据留存;(9)市場与 Agent 請求接口——推动资产授权接口的标准化;(10)AI 原生视听衛星账户研究項目——联合统计与學术机构开展计量试點; (11)全球 AI 原生电影人才課程——面向新職业族的公开課程体系;(12)本白皮书年度更新机制——逐年檢验预测、公开修訂记录。十二項行动均设公开的年度里程碑,接受行业監督。
    产业含義标准的生命力在于執行。十二項議程是本白皮书从「文件」成为「机制」的路徑,也是三方对行业的公开承諾。 共同承諾 本白皮书的价值不在于一次发布,而在于是否形成可檢验、可修訂、可共同建设的行业公共工程。

    图 32 三方联合公共工程

    32.1 定義与评价公共工程

    三方编制机构提出建立双軸分类年度同行评議、AI 原生电影评价基准、实时世界能力测试和创作证据建議规范。所有框架应公开版本、修訂原因和反对意見,不把組織宣告当作标准成立。

    32.2 Index.Film™ 与市場协作

    推动作品、工作流、角色、世界、行为和记录六类资产的最小字段;建立版本、来源、異議和撤回流程;开放机器可读查詢与授权請求接口;堅持收录不背书、索引不确认法律权利。市場测试应先从自愿申报和高质量合作方开始。

    32.3 全球城市与人才网路

    以香港、北京、杭州、上海、深圳、新加坡、东京、首爾、曼谷、洛杉磯、倫敦、巴黎、柏林和迪拜等城市节點连接创作者、技术、學术、资本与市場。城市网路的衡量标准不是掛名数量,而是联合項目、人才流动、资料互认与跨境发行结果。

    32.4 研究与年度发布机制

    建立年度技术观察、产业樣本、AI 原生视听衛星账户研究、文化与能源影响报告,以及白皮书修訂紀录。每年公开上一版预测的命中与偏差,邀請不同地区、艺术门类和治理立場参与评議。

    联合議程是邀請,不是对外部机构的既成承諾。具体合作、认证、标准或资料交換均应另行经过治理与授权程序。 *表 32 三方联合公共工程 - 关联分析表*

    公共工程首期产出治理邊界
    双軸分类年度规范/案例非法律裁決
    评价基准长片/实时测试不替代艺术评审
    Index.Film™六类最小字段收录不背书
    城市网路联合項目/人才流非掛名联盟
    衛星账户企业樣本试點非官方 GDP
    年度白皮书预测校验/修訂公开版本记录

    附录以下附录提供术语、分类、字段、方法与執行工具,使正文框架可被创作者、制片、平台、研究者和政策制定者实际採用。

    附录 A 核心术语表

    AI 原生电影
    AI 在核心创作维度具有实质性主导作用,作品无法脫離 AI 工作流成立的视听作品。
    创作主导度 P0-P4
    衡量 AI 在敘事、影像、声音、角色与互动中的实质创作主导程度。
    运行时生成度 R0-R4
    衡量內容在观众体验时刻生成的程度。
    51%+
    P 軸上的资格刻度,表示加权创作主导度过半;不是像素比例或品质分数。
    指揮家论
    作者性存在于意图、规则、選擇、编排、修改与最終責任,而非必须親自執行每个工序。
    世界模型
    接收行动、维持可变狀態并生成后續观察的模型或系统。
    世界狀態资料库
    保存角色、空間、事件、关係与规则的显式结构化狀態。
    故事憲法
    规定主题、世界规则、角色核心、可变事件与安全邊界的敘事治理文件。
    生成式世界媒体
    持續存在、多人共享、智能体参与且可承载经济活动的生成媒介。
    资产族
    作品、工作流、角色、世界、行为与记录等互相关联但权利獨立的资产集合。
    权利包络
    机器可读的用途、地域、期限、身份、价格、衍生与批准條件。
    动態来源记录
    針对实时生成会話,按重要事件记录模型、资产、策略、版本与責任。
    Agent 可读资产
    具備结构化能力、限制、权利与調用接口,可被受权智能体理解和請求的资产。
    人类-AI 双域价值账户
    记录人类投入、AI 執行、虛擬世界使用与现实回流,并避免重复计算的框架。
    术语
    定義
    ---
    ---
    AI 原生视听衛星账户
    在现有统计体系之外補充测量 AI 视听活动、投入、资产与增加值的研究工具。
    Index.Film™
    面向 AI 视听资产的識別、记录、查詢与协作基礎设施;不产生法律权利确认或价值背书。
    证据組
    说明
    ---
    ---
    创作意图
    概念、主题、规则、版本決策
    工具链
    模型、版本、节點与配置
    生成过程
    提示、参考、候選与淘汰
    人类控制
    選擇、编排、修改与最終批准
    运行时
    輸入、狀態、策略与生成比例
    字段組
    示例
    ---
    ---
    識別
    ID/类型/版本/父资产
    主体
    创建/提交/責任联络
    来源
    模型/工具/资产声明
    字段組
    示例
    ---
    ---
    权利
    地域/期限/用途/狀態
    治理
    标識/異議/撤回
    技术
    格式/接口/杂湊
    时間
    組織能力
    ---
    ---
    90 天
    资产/工具/权利盤點
    12 个月
    世界狀態与模型路由
    36 个月
    世界运营与 Agent 协作

    附录 B P/R 双軸判定与创作证据

    P 軸建議以敘事、影像、声音、角色与互动五个维度评估。评审可按作品类型調整权重,但必须在评审前公布;51%+ 只判定是否達到 P3 资格。R 軸按播放时生成范围判定,与 P 軸獨立。

    附录 C Index.Film™ 最小元数据輪廓

    此輪廓用于識別、记录、查詢与协作,不构成权利确认或价值背书。公开层、受限层和私密层应分離,个人资料遵循目的限制和最小化。

    附录 D 证据、预测与年度修訂协議

    •所有关鍵结论标注 E1-E4,并保留可訪问来源或资料说明。 •所有中长期预测列出技术、经济、设備、治理与文化前提。 •下一版逐項报告前版预测的命中、偏差、撤回与降级。 •企业自报数据与獨立验证分开呈现;沒有樣本口徑的市場数字不進入核心判斷。 •分类、元数据与评价框架接受跨地区、跨门类同行评議,修訂保留版本歷史。

    附录 E 90 天、12 个月与 36 个月行动清单

    附录 F 主要参考文獻与资料来源

    以下来源優先採用研究论文、标准組織、主管机关、国际机构与模型开发者正式文件。訪问与资料核对日期:2026 年 7 月 16 日。 https://openai.com/index/video-generation- [R01] OpenAI. Video generation models as world simulators. 2024.models-as-world-simulators/ [R02] Google DeepMind. Veo 3.1 - model overview and capabilities. 2025. https://deepmind.google/models/veo/ [R03] Meta AI. Movie Gen: A Cast of Media Foundation Models. 2024.https://ai.meta.com/research/publications/movie-gen-a-cast-of-media-foundation-models/ [R04] Tencent Hunyuan. HunyuanVideo: A Systematic Framework for Large Video Generative Models. 2024.https://arxiv.org/abs/2412.03603 [R05] Wan Team. Wan: Open and Advanced Large-Scale Video Generative Models. 2025.https://arxiv.org/abs/2503.20314 [R06] Zhang et al.. Generative AI for Film Creation: A Survey of Recent Advances. 2025.https://arxiv.org/abs/2504.08296 [R07] Google DeepMind. Genie 3 - real-time interactive world model. 2025/2026.https://deepmind.google/models/genie/ [R08] Liu et al.. Towards Interactive Video World Modeling: Frontiers, Challenges, Benchmarks, and Future Trends. 2026.https://arxiv.org/abs/2606.01164 [R09] Wang et al.. Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory.https://arxiv.org/abs/2604.08995 [R10] Wu et al.. Infinite-World: Scaling Interactive World Models to 1000-Frame Horizons. 2026.https://arxiv.org/abs/2602.02393 [R11] C2PA. Content Credentials Technical Specification 2.2 and Explainer. 2025/2026.https://spec.c2pa.org/specifications/specifications/2.2/specs/C2PA_Specification.html [R12] Cyberspace Administration of China et al.. Measures for Labelling AI-Generated and Synthetic Content. 2025.https://www.cac.gov.cn/2025-03/14/c_1743654684782215.htmhttps://digital- [R13] European Commission. Code of Practice on Transparency of AI-Generated Content. 2026.strategy.ec.europa.eu/en/policies/code-practice-ai-generated-content [R14] European Union. Regulation (EU) 2024/1689, Article 50. 2024.https://eur-lex.europa.eu/legal-content/EN/TXT/?uri=CELEX:32024R1689 [R15] U.S. Copyright Office. Copyright and Artificial Intelligence, Part 2: Copyrightability. 2025.https://www.copyright.gov/ai/Copyright-and-Artificial-Intelligence-Part-2-Copyrightability-Report.pdf [R16] WIPO. Generative AI: Navigating Intellectual Property. 2024.https://www.wipo.int/publications/en/details.jsp?id=4713 [R17] NIST. AI Risk Management Framework: Generative AI Profile (NIST AI 600-1). 2024/2026.https://www.nist.gov/publications/artificial-intelligence-risk-management-framework-generative-artificial-intelligence [R18] UNESCO. Report of the Independent Expert Group on Artificial Intelligence and Culture. 2025.https://www.unesco.org/sites/default/files/medias/fichiers/2025/09/CULTAI_Report%20of%20the%20Independent%20Expert%20Group%20on%20Artificial%20Intelligence%20and%20Culture%20%28final%20online%20version%29%201.pdf [R19] International Energy Agency. Energy and AI. 2025. https://www.iea.org/reports/energy-and-ai [R20] International Energy Agency. Data centre electricity use surged in 2025. 2026.https://www.iea.org/news/data-centre-electricity-use-surged-in-2025-even-with-tightening-bottlenecks-driving-a-scramble-for-solutionshttps://cloud.google.com/blog/products/ai-machine- [R21] Google. Agent Payments Protocol (AP2). 2025.learning/announcing-agents-to-payments-ap2-protocol [R22] International Monetary Fund. How Agentic AI Will Reshape Payments. 2026.https://www.imf.org/en/-/media/files/publications/imf-notes/2026/english/insea2026004.pdf [R23] United Nations Statistics Division. System of National Accounts 2025. 2025.https://unstats.un.org/unsd/nationalaccount/SNAUpdate/2025/2025_SNA_Combined.pdf [R24] Google. Android XR glasses demonstration and platform overview. 2025. https://blog.google/products-and-platforms/platforms/android/android-xr-glasses-demo-io-2025/ [R25] Meta. Introducing Orion, augmented reality glasses prototype. 2024/2025.https://about.fb.com/news/2024/09/introducing-orion-our-first-true-augmented-reality-glasses/ [R26] Apple Developer. Foveated Streaming for visionOS. 2026.https://developer.apple.com/documentation/foveatedstreaming [R27] Khronos Group. OpenXR and Spatial Entities extensions. 2025. https://www.khronos.org/openxr/

    附录 G 编制机构

    国际人工智能视听资产索引标准联盟(IAISA) 聚焦人工智能视听资产索引、机器可读元数据、来源记录与市場协作接口。 国际人工智能电影制片人协会(IFAIFPA) 聚焦 AI 电影制片体系、技术路线、行业协作、专业评价与制片人网路。 香港人工智能国际电影节协会(HKAIIFF Association) 聚焦 AI 原生电影艺术评价、创作者生態、节展实踐与全球城市合作。

    AI 原生电影
    AI 在核心创作维度具有实质性主导作用,作品无法脫離 AI 工作流成立的视听作品。
    创作主导度 P0-P4
    衡量 AI 在敘事、影像、声音、角色与互动中的实质创作主导程度。
    运行时生成度 R0-R4
    衡量內容在观众体验时刻生成的程度。
    51%+
    P 軸上的资格刻度,表示加权创作主导度过半;不是像素比例或品质分数。
    指揮家论
    作者性存在于意图、规则、選擇、编排、修改与最終責任,而非必须親自執行每个工序。
    世界模型
    接收行动、维持可变狀態并生成后續观察的模型或系统。
    世界狀態资料库
    保存角色、空間、事件、关係与规则的显式结构化狀態。
    故事憲法
    规定主题、世界规则、角色核心、可变事件与安全邊界的敘事治理文件。
    生成式世界媒体
    持續存在、多人共享、智能体参与且可承载经济活动的生成媒介。
    资产族
    作品、工作流、角色、世界、行为与记录等互相关联但权利獨立的资产集合。
    权利包络
    机器可读的用途、地域、期限、身份、价格、衍生与批准條件。
    动態来源记录
    針对实时生成会話,按重要事件记录模型、资产、策略、版本与責任。
    Agent 可读资产
    具備结构化能力、限制、权利与調用接口,可被受权智能体理解和請求的资产。
    人类-AI 双域价值账户
    记录人类投入、AI 執行、虛擬世界使用与现实回流,并避免重复计算的框架。
    术语
    定義
    ---
    ---
    AI 原生视听衛星账户
    在现有统计体系之外補充测量 AI 视听活动、投入、资产与增加值的研究工具。
    Index.Film™
    面向 AI 视听资产的識別、记录、查詢与协作基礎设施;不产生法律权利确认或价值背书。
    证据組
    说明
    ---
    ---
    创作意图
    概念、主题、规则、版本決策
    工具链
    模型、版本、节點与配置
    生成过程
    提示、参考、候選与淘汰
    人类控制
    選擇、编排、修改与最終批准
    运行时
    輸入、狀態、策略与生成比例
    字段組
    示例
    ---
    ---
    識別
    ID/类型/版本/父资产
    主体
    创建/提交/責任联络
    来源
    模型/工具/资产声明
    字段組
    示例
    ---
    ---
    权利
    地域/期限/用途/狀態
    治理
    标識/異議/撤回
    技术
    格式/接口/杂湊
    时間
    組織能力
    ---
    ---
    90 天
    资产/工具/权利盤點
    12 个月
    世界狀態与模型路由
    36 个月
    世界运营与 Agent 协作

    Facts

    发布日期
    2026-07-17
    发布方
    协会 · IFAIFPA · IAISA
    章节
    五大部分 + 宣言专章
    阅读方式
    线上全文
    评审理论
    指挥家论

    FAQ

    白皮书讲什么?

    AI 电影时代、AI 原生电影定义、51%+ 标准、产业链重构与未来方向,以及《AI 原生电影宣言》。

    谁发布的?

    香港人工智能国际电影节协会、IFAIFPA 与 IAISA 三方于 2026 年 7 月 17 日联合发布。

    可以下载吗?

    不提供下载。全文在本页开放线上阅读,引用必须注明出处。

    51%+ 标准在白皮书中如何定义?

    不是像素占比,而是判断 AI 工作流在核心创作决策中是否具有加权主导作用。

    相关 · Index.Film 官方白皮书(IAISA · IXF Standard V6)→