跳到正文

全部动态

今日 12 条
9月15日周二
  1. Luma · 创作产品与实践48

    Google Flow 替代方案:2026 年场景式 AI 电影制作的 7 款工具

    Google Flow 的 7 款替代工具分别侧重叙事规划、角色动作、后期编辑、头像视频和制作交付,服务场景式 AI 电影制作的不同阶段。Luma Ray 3.2 面向制作流程,支持原生 16-bit HDR 与 EXR 导出,Draft Mode 可先以 540p 预览。Luma Layers 可在保留已批准画面的同时修改单个元素,适合产品替换、文案变更和本地化营销素材。

  2. Luma · 创作产品与实践57

    Luma 的 AI B-Roll 提示词指南:25 个值得生成的补充镜头

    Luma 发布一份 AI B-Roll 提示词指南,按场景整理 25 个可直接复制的补充镜头提示词。指南建议在提示词中明确主体、动作、场景、相机和视觉风格,并针对不同镜头设置时长与画幅,同时用负面提示词减少手部变形和不可读文字等问题。文中还介绍了使用 Luma Layers 修改局部元素,以及用 Ray 3.2 进行多关键帧编排、HDR 工作流和相机控制。

  3. Luma · 创作产品与实践55

    Storyboarder.ai 评测:故事板之后,制作流程还缺什么?

    Storyboarder.ai 可将剧本快速转换为视觉分镜,30页剧本约10分钟生成120个镜头,部分套餐支持无限图像生成,角色一致性覆盖120多个镜头的项目。文章认为其更适合提案和前期可视化,平台虽可输出基础 animatics,却不具备生产级视频生成能力,也没有与剪辑或项目管理软件的原生集成,后续交接和多市场修改仍需手动完成。

  4. Luma · 创作产品与实践41

    AI-first 制作团队的 7 个 StudioBinder 替代方案

    面向 AI-first 制作团队,7 个 StudioBinder 替代方案覆盖素材生成、编辑、审片协作与传统拍摄规划。Luma Agents 可从创意到交付持续保留视频、图像、音频和文案的创作上下文,适合产品发布、社交内容及无实体拍摄的广告变体。AI-first 工具可在几天内实施并立即开始创作,还能在保留其他内容的同时修改单一元素。

  5. Luma · 创作产品与实践45

    AI Lip Sync:如何提示出与嘴型匹配的对白

    AI Lip Sync 提示词应包含清晰音频、正面或四分之三侧脸、角色语气与情绪,并使用短句和恰当标点,以提升对白与嘴型的同步效果。系统通过分析 phonemes、映射 visemes,再逐帧生成口型动画,现已覆盖 30+ languages。集成式工作流可将本地化和客户修改变成修订任务,避免每次从头重建视频。

  6. Luma · 创作产品与实践69

    Sora 2026 年定价:API 每秒 $0.10-$0.70,将于 9 月 24 日停用

    Sora 在 2026 年仅剩 API 访问,按模型和分辨率每生成 1 秒收费 $0.10-$0.70,API 计划于 9 月 24 日停用。1080p 每 10 秒的原始生成费用为 $7,Batch API 对非紧急生成提供 50% 折扣。文章估算,考虑 3-7 次迭代后,每个可用视频的实际成本会达到单次生成价格的 3-7 倍。

    推荐理由:文章将 Sora 的单秒定价、迭代成本与 API 终止时间放在同一预算框架中,便于创作团队评估批量生成和迁移安排。

  7. Luma · 创作产品与实践44

    Luma:AI 视频转场提示词——剪切、擦除与匹配剪辑

    AI 视频转场提示词通过结构化描述连接不同场景,帮助剪切、擦除与匹配剪辑形成连贯叙事。文章建议采用“镜头运动+主体+动作+环境+光照+风格/情绪”公式,并在关键帧转场中匹配镜头角度、色温和主体位置。匹配剪辑需在生成前规划视觉相似性,AI 转场也可减少广告制作中的重复修改。

  8. Luma · 创作产品与实践52

    LTX Studio 评测:故事板优先工作流是否值得投入

    LTX Studio采用故事板优先流程,先将脚本拆分为镜头并通过Elements管理角色、物体和场景,再生成视频,以提升多镜头项目的一致性并减少无效生成。原文指出,该平台的学习成本较高、与外部剪辑软件缺少原生连接,LTX-2.3比Kling 3.0 Pro、Seedance 2.0和Veo 3.1更节省资源。

  9. Luma · 创作产品与实践52

    Luma Scenes 与 Google Flow SceneBuilder 对比:哪种 AI 分镜方式更适合故事板制作?

    文章比较 Luma Scenes 和 Google Flow SceneBuilder 的 AI 分镜流程:Luma Scenes 先生成完整故事板并在渲染前审核,Google Flow SceneBuilder 则先生成视频片段,再通过时间线剪辑组装。文中还对比了关键帧级修改与片段级控制、跨镜头视觉一致性,以及 Google Flow 基于 Veo 3.1 models 的原生音频生成。

  10. Luma · 创作产品与实践49

    2026年最佳创意自动化平台:用于规模化制作广告变体的10款工具

    创意自动化平台可将一个获批的主设计在数小时内转化为数百个本地化、调整尺寸和个性化广告变体,生产时间减少50%或更多。指南覆盖 Luma Ray、Celtra、Adobe GenStudio 等工具,面向企业、区域团队和小团队的不同制作需求。Celtra支持100+市场的全球活动治理,Adobe GenStudio通过Firefly AI提供20+生成与创意操作。

9月10日周四
  1. Hugging Face Blog66

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111,Workflow1111 含 73 个节点

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张工作流画布,由 11 条媒体流水线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。

    推荐理由:用 73 个节点复刻 A1111 全部功能并暴露 REST 与 MCP 接口,可据此判断节点式创作工作流的搭建与复用方式。

  2. ElevenLabs · 音频创作62

    ElevenLabs 与环球音乐达成多年战略协议,将推出授权音乐创作平台

    ElevenLabs 与环球音乐集团(UMG)宣布达成多年授权协议和战略合作,这是 ElevenLabs 首次与主流唱片公司签约,涵盖音乐授权与产品开发。双方将共同为艺人和词曲作者开发 AI 音频产品,并推出一个面向粉丝的 AI 音乐创作平台,支持对参与艺人的曲目进行混音、串烧、新演绎和个性化人声体验。

    推荐理由:ElevenLabs 与 UMG 的授权合作给出了 AI 音乐平台在版权与分成上的落地路径,可供判断音乐生成产品的合规边界。

  3. OpenAI News62

    OpenAI 在 API 中上线 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,为开发者带来自然的全双工语音对话能力。该模型在指令遵循上更强,并支持自定义音色与电话(telephony)接入。

    推荐理由:OpenAI 把全双工语音对话能力开放到 API,读者可据此判断语音类应用的接入门槛与能力边界。

9月9日周三
  1. OpenAI News62

    OpenAI 发布 GPT-6 Astra,面向企业工作场景

    OpenAI 发布 GPT-6 Astra,称其是面向企业场景能力最强的模型,具备更强的推理、computer use 以及写作与设计判断能力。目前官方仅给出这一简要介绍,未披露版本细节、开放方式与可用范围。

    推荐理由:OpenAI 官方给出 GPT-6 Astra 的定位与能力方向,可用于判断企业级模型选型与智能体落地的下一步。

9月8日周二
  1. OpenAI News60

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,官方称生成结果能更好地体现用户的想法。

    推荐理由:官方给出 ChatGPT Images 2.5 的输入类型与生成定位,可据此判断参考图生图能力在创作流程中的位置。

9月7日周一
  1. Luma · 创作产品与实践59

    InVideo AI 2026:功能与局限

    Luma评测 InVideo AI 2026,指出它能从单条提示词完成脚本、素材、配音、字幕、音乐和剪辑,适合高频社媒与 YouTube 内容生产。文章称其整合 200+ AI models,并接入 Sora 2 和 VEO 3.1,但精确修改常需手动调整或重新生成。免费层每周提供 2–10 AI minutes 和 4 次带水印导出,且生成失败仍消耗 credits。