Skip to content

Gen AI 用于电影业

生成式人工智能在现代电影制作中的应用

Section titled “生成式人工智能在现代电影制作中的应用”

生成式人工智能(Generative AI)工具正越来越多地应用于电影制作的各个方面,包括剧本创作、概念艺术、故事板、预可视化、视频编辑、视觉效果(VFX),甚至合成媒体生成。这些技术可以提高制作效率,激发创作灵感,自动化耗时任务,并为讲故事开辟新的可能性。

本指南将介绍一些对电影专业人士影响最大的AI工具,概述它们的优势、主要应用以及示例提示或场景,帮助您开始将其融入您的工作流程。

ChatGPT及其他大型语言模型(LLMs):用于剧本创作、故事开发和制作规划的AI

Section titled “ChatGPT及其他大型语言模型(LLMs):用于剧本创作、故事开发和制作规划的AI”

大型语言模型(LLMs),如ChatGPT (GPT-4)、Claude和Gemini,可以协助编剧、制片人和导演生成剧本创意、开发角色弧线、撰写对话、创建剧情梗概(loglines)、总结剧本,甚至规划制作日程。它们非常适合头脑风暴、克服写作瓶颈或完善叙事元素和制作文档。

  • 快速生成情节、场景、角色和剧情转折的创意。
  • 支持角色开发,包括背景故事和动机。
  • 协助进行剧本格式化、对话编写和场景描述。
  • 能够概述完整的故事结构、梗概(treatments)或节拍表(beat sheets)。
  • 可以帮助起草制作相关文档,如通告单(call sheets)或预算大纲(需仔细审查)。

使用LLMs创建独特的情节创意、故事弧线、角色概念或简洁的剧情梗概(loglines)。

Prompt: Suggest three unique loglines for a science fiction movie set in a dystopian future where memories can be bought and sold. Each logline should hint at the central conflict and protagonist's goal.

根据角色的个性和场景背景生成人物之间的对话草稿,或获取场景描述的帮助。

Prompt: Write a 1-page scene. INT. DETECTIVE'S OFFICE - NIGHT. DETECTIVE MILLER (40s, weary) interrogates ANNA (20s, nervous but defiant) about a missing artifact. Anna tries to mislead Miller, but Miller sees through her. The dialogue should be tense and reveal a clue about the artifact's location.

Runway (Gen-2, Gen-3) 和 Pika:用于视频生成、视觉效果和编辑的AI

Section titled “Runway (Gen-2, Gen-3) 和 Pika:用于视频生成、视觉效果和编辑的AI”

像Runway(及其Gen-2和即将推出的Gen-3模型)和Pika这样的平台处于AI驱动视频生成(text-to-video, image-to-video)和高级视频编辑的前沿。它们提供根据提示创建短视频剪辑、应用复杂视觉效果、背景移除/替换(inpainting/outpainting)、对象跟踪和风格迁移的工具。

  • 减少某些后期制作任务和视觉效果(VFX)的手动工作和成本。
  • 有助于快速创建视觉概念原型和短动画序列。
  • 无需广泛的专业软件即可实现复杂的视觉效果(例如,风格迁移、运动跟踪)。
  • 提供自动场景分割、内容填充(inpainting,对象移除)和生成式视频内容的工具。

设想一个视频编辑界面,电影制作者输入“一架无人机在日落时分飞越未来城市上空”,Runway Gen-2就会生成符合此描述的短视频剪辑。或者,用户上传视频剪辑并使用AI工具从所有帧中无缝移除不需要的对象。

根据文本或图像提示生成短视频剪辑,或在现有素材中移除/替换背景,无需绿幕(green screen)。

Prompt (for Runway Gen-2 or Pika): Generate a 5-second video clip of a lone astronaut walking on a desolate Mars-like planet, with two moons in the sky. Cinematic, wide angle.

调整色彩校正(color grading)、灯光,应用风格迁移,或使用AI执行抠像(rotoscoping)或运动跟踪(motion tracking)等任务。

Instruction (within Runway or similar AI video tool): For this video clip of an actor, use the 'inpainting' feature to remove the microphone visible in the shot. Then, apply a 'film noir' style transfer to the entire clip.

Descript 和 Adobe Podcast:用于基于文本的音频/视频编辑和增强的AI

Section titled “Descript 和 Adobe Podcast:用于基于文本的音频/视频编辑和增强的AI”

Descript是一款一体化编辑工具,利用AI进行基于文本的音频和视频编辑。Adobe Podcast提供AI驱动的音频录制和编辑功能,尤其擅长人声增强。这些工具对于对话编辑、画外音调整、自动对话替换(ADR)准备以及音频与视频同步非常宝贵。

  • 允许用户通过编辑转录文本轻松编辑音频和视频。
  • 自动同步画外音和旁白;可以创建AI声音(Descript中的Overdub)。
  • 使用AI增强音质(例如,降噪、均衡),(Descript中的Studio Sound,Adobe Podcast中的Enhance Speech)。
  • 协助准确转录和生成隐藏式字幕(closed captions)/副标题(subtitles)。

想象一个编辑工具,其中对话的原始音频录音被自动转录。编辑人员只需单击一下即可移除填充词(如’嗯’, ‘啊’),使用AI声音克隆纠正说错的词语,并将整体音质提升到听起来像是在录音棚中录制的那样。

只需编辑文本转录即可对对话或画外音内容进行编辑,与传统的波形编辑相比,节省大量时间。

Instruction (in Descript): Upload the raw audio from our interview. Transcribe it. Use the 'Remove Filler Words' function. Then, for any stumbles, use 'Overdub' to re-record the correct phrasing with the speaker's AI voice clone. Finally, apply 'Studio Sound' to enhance clarity.

从现场音频生成清晰的转录文本和带时间码的脚本,为ADR(自动对话替换)会话做准备。AI声音克隆也可用于临时的ADR音轨。

Instruction: Transcribe the production audio for Scene 12. Identify lines that need ADR due to noise. Use the transcript to guide the actor during the ADR session. Optionally, create a temporary guide track using AI voice cloning for pacing.

Midjourney, DALL·E 3, Stable Diffusion:用于概念艺术、故事板和视觉规划的AI

Section titled “Midjourney, DALL·E 3, Stable Diffusion:用于概念艺术、故事板和视觉规划的AI”

像Midjourney、DALL·E 3和Stable Diffusion这样的AI图像生成工具在创建概念艺术、角色设计、环境视觉效果甚至单个故事板帧方面非常强大。它们帮助导演、摄影指导、制作设计师和故事板艺术家在拍摄前可视化场景、氛围和镜头序列,促进前期制作规划。

  • 根据文本提示快速生成多样化的视觉概念,加速前期制作。
  • 有助于可视化复杂的场景、角色美学和布景设计。
  • 促进制作团队内部视觉想法的更清晰沟通。
  • 可以生成占位符故事板面板或用于特定镜头的灵感艺术。

想象一位制作设计师在Midjourney中输入:“一个赛博朋克市场场景的概念艺术,霓虹灯闪烁,雨水湿滑的街道,挤满了各种各样的角色,刀锋战士(Blade Runner)美学风格。” AI随后生成几个符合此愿景的详细图像,这些图像可用于情绪板(mood boards)或进一步细化。

为关键场景、环境、道具或角色生成艺术作品,以确立电影的视觉风格。

Prompt (for Midjourney or DALL·E 3): A moody interior shot of a detective's office in a 1940s film noir style. Venetian blinds casting shadows, a cluttered desk, a single lamp illuminating the scene. Photorealistic.

生成单个视觉面板或故事板序列的灵感,以规划镜头推进。虽然专业的AI故事板工具正在出现(例如 Krock.io, Plot AI),但通用的图像生成器可以为手动或数字故事板工具(如 Storyboarder 或 Boords)创建素材。

Prompt (for an image generator, to create a panel): Storyboard panel: Close-up shot of a character's determined eyes, looking off-screen. Simple line art style, black and white. (这些图像随后可以导入故事板应用程序中使用)。

ElevenLabs, Resemble AI, DeepBrain AI:用于语音合成、角色配音和配音的AI

Section titled “ElevenLabs, Resemble AI, DeepBrain AI:用于语音合成、角色配音和配音的AI”

像ElevenLabs、Resemble AI和DeepBrain AI这样的AI语音合成平台提供高度逼真的文本转语音(TTS)和声音克隆功能。电影制作者可以使用这些工具创建独特的角色声音,为动画分镜(animatics)或粗剪(rough cuts)提供临时画外音,进行自动化旁白,甚至探索AI辅助的多种语言配音。

  • 合成逼真且富有情感的角色或旁白声音。
  • 节省用于预可视化或临时音轨(scratch tracks)的画外音时间和成本。
  • 提供多语言选项,便于探索国际配音。
  • 允许在选择人类演员配音之前或ADR期间快速迭代语音表演。

设想一个平台,导演输入角色的对话,选择声音特征(例如,“年长、睿智、略带沙哑的男声”),并调整情感基调。AI随后生成自然流畅的音频,可在动画分镜(animatic)中使用,以测试场景节奏和对话。

在预可视化期间使用AI生成的声音(例如,用于带音频的动画分镜或故事板),以测试对话与视觉效果的配合以及优化时间安排。

Instruction (using ElevenLabs or Resemble AI): Generate audio for the following lines of dialogue for our animated short's animatic. Character A (young, energetic female): "We have to get there before sunset!" Character B (calm, older male): "Patience, child. The journey itself holds the lessons." Use distinct voices for each.

在选择配音演员之前,尝试不同的角色声音风格,或生成各种语言的配音样本,以评估市场潜力。

Instruction: Create a voice prototype for a villain character in a fantasy film: deep, resonant male voice with a subtle, unidentifiable European accent, conveying menace and intelligence. Use this line: "Your efforts are futile. Destiny cannot be unwritten."

电影专业人士可以通过集成生成式AI工具,如用于写作的LLMs、用于视频生成的Runway、用于音频/视频编辑的Descript、用于视觉效果的AI图像生成器以及AI语音合成平台,显著增强他们的创意和制作流程。这些工具可以加速制作进度,开启创新的叙事方式,降低某些任务的成本,并改善协作。随着AI技术的快速发展,其应用使得电影制作方法更加敏捷、高效和富有创意,同时仍然需要人工监督、创造力和伦理考量来维护艺术完整性。