打开网易新闻 查看精彩图片

打开网易新闻 查看精彩图片

本期导读

打开网易新闻 查看精彩图片

打开网易新闻 查看精彩图片

编者按

生成式人工智能(GAI)、大模型、空间计算等现代智能科技正全方位重构提质影视创作生产体系,推动影视行业实现全流程、系统性的产业变革。当前,影视创作生产正向智能化、高精度、沉浸式、协同化发展迭代,加快从传统化、经验化创作生产模式向数据化、模型化、智能化创作生产模式转型。在前期视觉开发层面,引入多模态视觉分析与区域注意力机制,可为分镜与概念图制作中多区域协同编辑的结构稳定性与语义独立性提供系统化解决路径;在虚拟摄制层面,以三维高斯泼溅(3DGS)为核心建模方案、OpenUSD为数字资产格式的标准化管线,是实现影视内容“一次制作、多项目复用”工业化目标的关键基础;面向电影行业应用开展的AI大模型技术测评,可为技术选型、场景落地、效能优化及行业标准制定提供科学参考和有力支撑。本期特设“现代智能科技提质影视创作生产范式专题”,聚焦影视前期视觉开发、影视虚拟摄制高保真数字资产管线、AI大模型行业技术评测等核心议题,同时遴选空间计算驱动下XR沉浸式叙事的技术重构、智能时代动画电影人机协同修复路径、多模态理解与生成统一模型在影视制作中的应用等文章,旨在促进理论成果与产业实践深度融合,为影视行业智能化、高质量发展提供理论支撑和实践参考。

——本期责编

打开网易新闻 查看精彩图片

专家点评

打开网易新闻 查看精彩图片

当前,我国电影科技与产业发展正加速推进全面智能化,以可控生成为代表的生成式人工智能(GAI)技术正在成为驱动行业提质增效、培育发展新质生产力的重要力量。在电影前期视觉开发中,GAI正推动工艺流程从单点式图像生成转向面向分镜迭代、美术资产管理和创意决策的流程化应用,该领域的关键问题也正从“能否生成高质量画面”转向“能否按照创作意图精准稳定修改画面”。电影美术创作通常需要围绕角色造型、道具样式、场景氛围和镜头构图进行多轮调整优化,其核心要求是在保持画面风格、叙事逻辑和资产一致性的前提下,实现人物、道具、环境与光影等局部元素的可控修改。未来,相关技术需要进一步打通导演意图、美术资产、分镜画面与模型生成结果之间的对应关系,并将多模态理解、区域控制、提示词生成和标准作业程序(SOP)融入影视创作生产流程,使人工智能(AI)从辅助出图工具转向支撑分镜推演、美术方案生成和创意比选的流程化技术能力。这一发展方向不仅有助于降低复杂模型的使用门槛,也将推动AI技术与电影语言、电影工业流程的深度融合。《面向电影前期视觉开发的图像智能生成框架研究》一文正是围绕上述需求展开研究。文章提出面向电影分镜迭代的ReMAP图像智能生成框架,通过区域掩码与对应提示词的显式绑定,实现多区域资产的精准控制和非编辑区域稳定保持;引入多模态SOP提示生成机制,降低复杂场景下的提示词编写成本。实验表明,该方法在多区域语义隔离、资产结构一致性和非编辑区域稳定性方面具有良好表现。本文兼具技术方法探索实践与影视生产流程应用价值,对于推动人工智能生成内容(AIGC)技术服务电影前期视觉开发具有较高的参考价值。

——徐涛

正高级工程师

中国电影科学技术研究所(中央宣传部电影技术质量检测所)副所长

影视虚拟摄制技术从“技术可行”到“工业可用”,其核心瓶颈是数字资产的供给效率与流通复用能力。传统影视数字资产制作生产模式受限于传统建模技术的低效与跨平台流转的格式壁垒,其已成为制约行业规模化应用的发展堵点。未来几年,影视数字资产制作生产将向以下三个方面发展:一是重建技术须兼顾写实精度与渲染速度,三维高斯波溅(3DGS)因其高保真效果与实时性能优势,有望成为工业化建模的主流路径,而四维高斯波溅(4DGS)将为动态三维数字资产提供最优解决方案;二是数字资产格式须打破各自为战的乱局,OpenUSD凭借分层组合与跨工具兼容性,正成为行业通用格式;三是人工智能(AI)驱动的语义检索与数字资产复用将彻底改变资产组织方式,使“一次制作、多项目复用”从工作设想转变为可量化的效益指标。在上述背景下,构建一套能够兼顾视觉真实感、生产效率与跨系统兼容性的数字资产管线,不仅是技术问题,更是我国影视工业自主化演进与智能化升级的战略问题。《面向影视虚拟摄制的高保真数字资产管线研究》一文以上影制作为业务依托,在昊浦基地构建了从多源融合采集、3DGS建模与质量评估到OpenUSD资产管理平台的全链路方案,并验证了AI检索与复用机制的有效性。论文逻辑清晰,数据翔实,为影视数字资产生产的自主工具链研发提供了技术示范,对影视数字资产库的标准化建设具有直接指导意义。

——陈军

研究员

北京电影学院智能影像工程学院院长

当前,人工智能大模型技术正向电影全产业链加速渗透,成为推动影视生产效率革新与创作形态升级的核心驱动力。然而,当前大模型产品技术路线各异、能力参差不齐,现有主流评测体系多聚焦通用语言与基础多模态能力,难以适配电影行业对艺术表现力、专业技术参数、版权合规性与内容安全性的高标准要求,导致行业缺乏统一的专业化标尺,无法精准评估大模型在影视场景下的实际应用效能,也给影视制作机构的技术选型、产业落地带来了参考依据缺失的现实难题。《面向电影行业应用的人工智能大模型技术评测研究》一文针对这一行业痛点,构建了一套系统完整的面向电影行业的AI大模型技术评测方案。研究聚焦剧本生成、图像生成、视频生成三大影视核心生产任务,结合电影创作的专业需求设计了多维度评测指标体系,构建了提示词库,确定了评测指标计算方法等,为电影行业AI大模型技术评测提供了可落地、可复用的标准化评测方案。在此基础上,论文选取国内外十余款主流大模型开展技术评测,验证了当前大模型在影视创意辅助上的应用价值与技术进展,也指出了大模型在高级语义理解、复杂人物结构生成、物理规律模拟、专业影视格式支持与版权风险规避等方面的共性短板。整体而言,该研究填补了电影行业大模型专项评测的研究空白,可为影视机构的技术选型、大模型厂商的场景化定制优化以及行业评测技术标准的制定提供技术支撑与实践参考。

——史萍

教授

中国传媒大学信息与通信工程学院博士生导师

打开网易新闻 查看精彩图片

本期目录

打开网易新闻 查看精彩图片

现代智能科技提质影视创作生产范式专题

◎ 面向电影前期视觉开发的图像智能生成框架研究

—— 黄东晋 张诗雨 曲建涛 王 倩

◎ 面向影视虚拟摄制的高保真数字资产管线研究

—— 朱 君

◎ 面向电影行业应用的人工智能大模型技术评测研究

—— 王 健 刘知一

产业发展

◎ 空间计算驱动下扩展现实(XR)沉浸式叙事的技术重构与实现路径——以第82届威尼斯电影节Venice Immersive单元为例

—— 高尔东 刘 犇

◎ 智能时代动画电影修复路径探究与人机协同思考——以国产经典动画电影《铁扇公主》为例

—— 王 瑶

视听科技教研

◎ 多模态理解与生成统一模型在影视制作中的应用研究

—— 冯大蕗 陈姿涵 陈 军

技术应用

◎ 人工智能(AI)技术在电影歌曲创作中的应用研究

—— 司 若 田 鑫

◎ 面向VR交互叙事创作的眼动追踪应用研究

—— 苏子易 韩菲琳 贾云鹏

◎ LED电影放映系统色彩显示能力分析与探讨

—— 柏 龄

打开网易新闻 查看精彩图片

文章概要

打开网易新闻 查看精彩图片

面向电影前期视觉开发的图像智能生成框架研究

【摘要】 在电影开发中,分镜、概念图与美术资产往往需要围绕角色造型、道具样式、场景氛围和镜头构图进行多轮迭代,现有全局语义编辑与掩码重绘方法在多区域协同编辑时,仍难以兼顾结构稳定性与语义独立性。为此,本文面向电影前期视觉开发,构建了一种图像智能生成框架ReMAP。该方法将复杂分镜解构为独立的语义资产区域,通过建立区域空间掩码与对应提示词的显式约束映射,实现电影美术资产的局部精准控制与非编辑区域的稳定保持,有效支持多区域协同重绘与多变体创意比选。同时,为缓解复杂场景下的提示词工程成本,本文构建了一种多模态标准作业程序提示自动生成机制,能够从参考资产与原始分镜中自适应提取视觉语义特征,自动生成涵盖全局风格与区域约束的复用型场景描述模板。实验结果表明,在统一Flux2⁃Klein底座下,相较于Prompt⁃to⁃Prompt全局语义编辑与DiffEdit局部掩码编辑等基线,ReMAP在多区域语义隔离、资产结构一致性与非编辑区域稳定性方面表现更优,为电影美术设定与分镜制作提供了低成本、高交互的智能化技术支撑。

面向影视虚拟摄制的高保真数字资产管线研究

【摘要】基于影视虚拟摄制对高保真、低延迟、可复用数字资产的迫切需求,针对传统建模方案在生产效率与跨平台流转方面的固有局限,本文以上影制作为业务主体、旗下上影昊浦智慧产业社区为工程实践平台,系统阐述了以三维高斯泼溅(3DGS)为核心建模方案、以OpenUSD为资产标准格式的影视数字资产生产与管理管线;解析了多源采集工作流设计、3DGS建模参数优化策略、基于OpenUSD的资产管理平台架构及AI驱动资产检索机制,并重点论证了“一次制作、多项目复用”策略的可行性。本文提出并初步验证了该管线在确保高保真渲染质量的前提下,可显著缩短资产生产周期并提升跨项目复用率,可为国内影视虚拟摄制的数字资产自主化、标准化生产提供可复制的实践路径。

面向电影行业应用的人工智能大模型技术评测研究

【摘要】随着人工智能(AI)大模型和人工智能生成内容(AIGC)技术在电影行业持续深入应用,面向电影行业应用的AI大模型技术评测也成为重要研究内容。为评测AI大模型在电影行业的应用效能,本文从评测任务确定、评测指标设计、评测提示词构建、模型推理结果获取、评测指标计算等方面提出电影行业AI大模型技术评测方案,并对国内外主流AI大模型开展实际评测。本文提出的评测方案覆盖 AI大模型在电影行业的典型应用场景,能够满足电影行业对大模型综合能力的评测需求,可为电影行业大模型技术选型、大模型创新应用、大模型标准制定提供技术支撑与实践参考。

空间计算驱动下扩展现实(XR)沉浸式叙事的技术重构与实现路径——以第82届威尼斯电影节Venice Immersive单元为例

【摘要】 本文围绕空间计算条件下扩展现实(XR)沉浸式叙事展开研究,剖析其技术机制、多元案例形态与工程化路径,选取第 82 届威尼斯电影节 Venice Immersive 单元为研究对象,结合技术路径分析、案例分析和媒介理论阐释,探究即时定位与地图构建(SLAM)、六自由度(6DoF)、三维高斯泼溅(3DGS)、眼动追踪、手势识别和生理反馈等环节在空间生成、视点组织与交互调度中的作用。研究发现,XR沉浸式作品的迭代发展并非沉浸效果的线性增强,而是观看位置、叙事场域、交互接口和作品边界的同步重组。其中,Face Jumping、Alien Perspective与Best of Worlds分别呈现出凝视触发、数字遗产空间化和平台化虚拟世界三种典型路径。研究表明,XR沉浸式叙事并非单纯提升沉浸效果,需将低延迟渲染、空间脚本、注意力引导、平台兼容和数字保存纳入统一制作体系,从而推进由前沿展示转向可持续演进的电影技术形态。

智能时代动画电影修复路径探究与人机协同思考——以国产经典动画电影《铁扇公主》为例

【摘要】为探讨智能时代动画电影修复的技术路径与人机协同模式,本文以《铁扇公主》修复实践为研究对象,结合影片材料状态、动画制作工艺、光学录音条件及数字修复流程,对动画痕迹识别、材料损伤判定、声画修复及历史复现等关键环节进行分析。在区分材料损伤与原始动画、技术痕迹的基础上,提出以历史证据为依据、以动画痕迹辨析为核心、以真实性保护为原则的动画电影修复路径。研究表明,人工智能(AI)能够提升损伤识别、声画处理和资料分析效率,但无法替代历史考证与修复决策,其应用应建立在材料证据、制作工艺和历史语境综合判断的基础上,为中国经典动画电影数字化修复提供参考。

多模态理解与生成统一模型在影视制作中的应用研究

【摘要】多模态理解与生成统一模型是指采用单一模型结构,能够理解文本、图像、音频、视频等多种形式数据中的语义信息,并在此基础上完成理解与生成任务的人工智能(AI)模型,其核心原理在于跨模态语义信息的对齐与整合。近年来,随着大规模预训练方法、大语言模型(LLM)与扩散模型(Diffusion Model)的发展,多模态理解与生成统一模型的性能取得较大提升,并在影视行业中展现出一定的应用前景。基于上述现状,本文对多模态理解与生成统一模型在影视制作领域的应用进行研究,介绍此类模型的核心原理与数据集,结合影视制作流程梳理代表性工作,并分析其在应用中面临的技术挑战与伦理问题。研究表明,此类模型可作为生产工具,提升影视内容制作的效率,也能作为未来影视工业化研究的基础。

人工智能(AI)技术在电影歌曲创作中的应用研究

【摘要】为探讨人工智能(AI)技术在电影歌曲创作中的具体应用方式及其现实影响,本文以电影歌曲创作流程为基础,对AI技术在旋律动机生成、虚拟演唱、智能编曲及音频后期处理等环节中的应用进行具体分析。研究表明,AI能够在一定程度上提升电影歌曲创作效率,降低部分技术门槛,拓展创作者的方案选择空间。但AI生成内容仍存在情感表达深度不足、结果稳定性有限、版权归属与AI歌手声音授权风险突出等问题。本文认为,未来AI将在电影歌曲创作中持续发挥辅助作用,但创作者的审美判断、艺术经验与情感把控仍不可替代。

面向VR交互叙事创作的眼动追踪应用研究

【摘要】在国家政策支持、内容题材拓展与技术迭代的共同推动下,虚拟现实(VR)沉浸式内容实现快速发展。为打破传统影视的“第四堵墙”、推动体验者由旁观向亲历的视角转变,VR交互叙事创作追求实现更自然的交互方式,不断提升沉浸感和用户体验,而眼动追踪技术的发展为其带来新的机遇。本文梳理了当前眼动追踪技术在VR交互叙事中的应用,基于VR眼动交互设计策略,实现了控制方向、切换、连接和拖拽四种眼动交互功能。通过VR影片制作实践以及用户测试与分析,验证了方案的有效性。研究表明,在主题适配的情况下,眼动交互作为一种相对自然的输入方式,其形式具备多样性,能够有效提升叙事沉浸感,为VR内容创作者提供交互叙事设计参考与优化方向。

LED电影放映系统色彩显示能力分析与探讨

【摘要】随着数字影院放映技术的不断发展,影院放映正从传统投影显示方式向LED屏显示方式演进,观众观影体验随之发生显著变化。本文针对LED电影放映过程中观众普遍感知色彩更加鲜艳、画面层次更加丰富的现象,探讨了LED电影放映带来更佳视觉体验的原因与机理。结合人眼视觉感知机制,从色域、亮度、对比度以及高动态范围(HDR)等显示性能指标出发,分析了各因素对色彩感知及电影画面呈现效果的影响,并进一步比较了LED电影放映系统与传统数字投影系统在视觉表现上的差异。结果表明,同样采用DCI⁃P3色域标准,LED电影放映系统凭借高亮度、高对比度以及HDR显示能力等性能优势,能有效提升画面的色彩表现、层次感和视觉冲击力,从而提升观众的整体观影体验。这说明在相同色域条件下,观众获得更佳视觉体验并非仅由色域决定,而是显示系统多项性能综合作用于人眼视觉感知的结果。研究结果可为未来电影内容制作和放映标准的制定与优化提供参考。

文章全文详见《现代电影技术》期刊

2026年第7期

期刊导读| 《现代电影技术》2026年第6期

期刊导读| 《现代电影技术》2026年第5期

期刊导读| 《现代电影技术》2026年第4期

打开网易新闻 查看精彩图片