跳到正文

全部动态

今日 1 条
9月29日周二
  1. Luma · 创作产品与实践53

    Luma 2026 年护肤与美妆品牌 AI 提示词指南

    Luma 发布了一份护肤与美妆品牌 AI 提示词指南,提供 15 组覆盖产品图像、社交内容、邮件、广告和视频的提示词结构。指南强调七部分美妆产品图像提示词框架,以及针对 Instagram、TikTok 等平台调整格式和叙事方式。它还介绍了用 Layers 保留既有构图进行局部修改,并提到 Luma Agents、Skills 和 Ray 3.2 在连续创作流程中的应用。

  2. Luma · 创作产品与实践40

    AI Avatar 提示词:打造个人头像与品牌角色

    结构化 AI Avatar 提示词通过角色、外貌、场景和输出风格等细节,帮助生成适用于 LinkedIn、企业网站及品牌材料的统一头像与角色。案例中,团队用四天完成 43 张头像,并通过 Seed 值、negative prompts 和多轮迭代保持身份与视觉一致性。Google 研究显示,高质量提示词平均约 21 个词。

9月28日周一
  1. Hugging Face Blog62

    H 公司发布 Holo4 系列通用电脑操作智能体模型

    H 公司发布 Holo4 系列智能体模型,含 27B dense 与 35B-A3B MoE 两个版本,并推出基于 Nemotron 3 Nano Omni 的 Holotron4 Nano,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 在 Hugging Face 开放。

    推荐理由:Holo4 给出跨 GUI、代码、MCP 与 API 的统一智能体方案,并公开轨迹与权重,便于评估开源电脑操作智能体的成本与能力边界。

  2. ElevenLabs · 音频创作75

    ElevenLabs 发布 Eleven v4 与 Eleven v4 Turbo 语音模型

    ElevenLabs 发布情感表现更强的文本转语音模型 Eleven v4 及低延迟版本 Eleven v4 Turbo,两者支持 90 多种语言,已在 ElevenAgents、ElevenCreative 和 ElevenAPI 上线。

    推荐理由:官方给出 Eleven v4 与 Turbo 的延迟、盲测偏好和音频标签控制细节,可用于语音智能体与配音选型参考。

  3. 可灵 · 模型与创作实践52

    Kling VIDEO 3.0 Omni 如何为音乐表演替换背景

    Kling VIDEO 3.0 Omni支持基于已有音乐表演视频替换背景,并通过上传素材、描述或引用新场景、生成后复检三步完成编辑。教程还介绍了使用Kling VIDEO 3.0从文本或图片生成全新表演场景,以及通过Native Audio生成音乐、环境音和对白的方法。发布前需检查歌曲、录音、视频和参考素材的版权许可。

  4. 可灵 · 模型与创作实践50

    如何为篮球联赛标志创建醒目的提示词:Kling IMAGE 3.0 实践指南

    为篮球联赛标志创建提示词应明确联赛身份、篮球元素、风格、构图、颜色和背景,再用 Kling IMAGE 3.0 将文字概念转成视觉标志方向。文中提供 professional、modern、youth、retro、minimal 和 street 6 种示例,并支持通过 Text to Image 或参考图生成、评审和调整方案。

  5. 可灵 · 模型与创作实践56

    Kling IMAGE 3.0 如何从文字或照片创建 AI 图像

    可灵发布教程,介绍如何用 Kling IMAGE 3.0 从文字描述或照片创建 AI 图像,并通过提示词和自然语言指令持续修正结果。教程涵盖参考图上传、主体与构图描述、画面比例选择及生成后的审片;IMAGE 3.0 支持最多 10 张参考图,用于保持角色、商品、构图或视觉风格等细节的一致性。

  6. 可灵 · 模型与创作实践63

    Kling AI 如何通过提示词让 AI 图片更真实

    Kling AI 介绍了通过光线、材质、比例、透视和镜头感等具体视觉细节提升 AI 图片真实感的方法。文章给出“主体、场景、光线、构图、材质细节、相机感、关键约束”的提示词结构,并说明 Kling IMAGE 3.0 支持文本生成、参考图生成和自然语言图像编辑。实践中应先定位最明显的不自然之处,再逐项调整并检查皮肤纹理、接触阴影、材质反光和商品轮廓。

    推荐理由:文章将光线、材质、透视和镜头感拆成可操作的提示词要素,并结合 Kling IMAGE 3.0 的参考图与局部修复流程,适合用于提升图像真实感和商品细节控制。

  7. World Labs · 空间智能与世界模型68

    World Labs 签署协议加入 AMD,李飞飞将出任 AMD 执行副总裁兼首席科学家

    World Labs 已签署最终协议加入 AMD,交易预计在 2026 年底前完成,尚待监管批准及其他惯例交割条件。李飞飞将出任 AMD 执行副总裁兼首席科学家,直接与 CEO 苏姿丰共事;Justin Johnson 和 Ben Mildenhall 将与李飞飞继续领导 World Labs 团队,并入 AMD 后组建前沿研究组织。

    推荐理由:World Labs 被 AMD 收购并给出团队去向与开放生态目标,可据此判断空间智能赛道的硬件整合走向。

9月24日周四
  1. 可灵 · 模型与创作实践54

    6 款水印移除工具对比:Kling AI 如何处理复杂图像修复

    Kling AI 发布一份指南,对比 6 款水印移除工具及其适用场景,并重点介绍 Kling IMAGE 3.0 与 IMAGE 3.0 Omni 的图像修复流程。指南指出,纯色背景更易处理,头发、纹理、细节主体和重复图案需要更谨慎的局部编辑与全尺寸复检;IMAGE 3.0 Omni 支持继续修复并输出原生 2K/4K 图像。

  2. 可灵 · 模型与创作实践65

    当前 AI 视频生成技术的 6 项局限与应对方法:Kling VIDEO 3.0 系列如何提升创作控制

    Kling 发布的创作实践文章梳理了当前 AI 视频生成的 6 项局限,并给出参考图、分镜、分步提示和后期处理等应对方法。文章指出,角色与商品跨镜头不一致、运动和物理表现异常、长视频连贯性不足、文字细节失真及提示词控制有限,仍是常见问题。

    推荐理由:文章把一致性、物理运动、长视频、文字细节和提示词控制等问题对应到具体工作流,便于判断何时使用参考图、分镜或后期处理。

  3. Black Forest Labs · 图像与视频84

    Black Forest Labs 发布 FLUX 3 Action,开放 7B 机器人动作策略权重

    Black Forest Labs 发布 FLUX 3 Action(F3A)机器人动作策略模型及其开放权重,采用 WAM 联合预测未来视频与动作。报告称,其单步 7B checkpoint 在 RoboLab 达到 38.3%,高于 Cosmos 3 Nano 的 36.8%;guidance-distilled checkpoint 达到 42.2%。

    推荐理由:报告同时给出 RoboLab、真实机器人和推理效率数据,可用于比较 WAM 与 VLA 在成功率、速度和部署成本上的取舍。

9月23日周三
  1. ComfyUI · 工作流与实践75

    Comfy 发布 Comfy Router,用一个 API 调用前沿图像视频模型

    Comfy 在 Comfy Developer Platform 上线 Comfy Router,开发者只需集成一次即可调用前沿图像、视频、3D 和音频模型,并按任务选择供应商。

    推荐理由:Comfy Router 把多家供应商的前沿图像视频模型收进一个 API,读者可据此判断多供应商切换与排队重试对现有生成流程的改动。

9月22日周二
  1. Luma · 创作产品与实践55

    Luma 文本生视频提示词指南:如何描述模型能理解的镜头

    Luma 发布一份文本生视频提示词指南,提出以主体、动作、场景、镜头和风格组成五要素结构,并强调将核心动作放在开头。指南建议提示词控制在50-80词、每次只使用一个主要镜头运动,并通过参考图、逐变量修复和模板复用提升角色、商品与多资产的一致性。文中还介绍 Ray 3.2 的 multi-keyframe sequencing、native 1080p、HDR 和 EXR export 能力。

  2. Luma · 创作产品与实践52

    Luma 的 2026 年房地产房源与虚拟布置 AI 照片提示词指南

    Luma 介绍了面向房地产房源和虚拟布置的六部分 AI 照片提示词结构,涵盖房间类型、风格、材质、色彩、光线和氛围。文章还给出客厅、厨房、卧室、外景、物体移除和天空替换示例,并讨论建筑结构保留、MLS 对 AI 图像的披露要求,以及 Luma Agents、Uni-1、Layers、Ray 3.2 和 Skills 在房源营销工作流中的应用。

  3. Luma · 创作产品与实践67

    Luma 调查 2026 年创意团队如何整合 AI

    Luma 对760名创意专业人士的调查显示,81%已经发布过 AI 制作内容,但团队在培训、工作流整合和审批机制上仍存在明显缺口。团队过去一年平均评估6.1个 AI 工具、采用4.3个并弃用2.9个;AI Leaders 发布 AI 占多数的视频比例为78%,AI Laggards为11%。

    推荐理由:调查将 AI 采用与工作流整合拆开衡量,并用团队分层、工具流失和案例数据,为创意团队制定培训与审批流程提供了具体参照。

  4. Luma · 创作产品与实践44

    营销团队的 AI 提示词:30 个可直接用于营销活动的示例

    营销团队可用 30 个面向营销活动的 AI 提示词示例,覆盖策略、内容创作、分发和优化四个工作流阶段,并以角色、上下文、任务、语气、约束、格式、质量七部分构建可复用提示词。结构化提示词可将 persona 创建从每月 40 小时降至 5 小时,团队每天节省 2.5 小时;加入行为上下文的个性化邮件内容可带来 82% 更高转化率。

  5. Luma · 创作产品与实践58

    Luma 发布按音乐类型整理的 20 个 AI 音乐视频提示词示例

    Luma 发布一份 AI 音乐视频提示词指南,按流行、嘻哈、电子、摇滚等类型提供 20 个示例,并将歌曲段落、主体动作、场景、镜头运动、灯光色彩和连续性列为提示词的六个要素。指南还介绍了从生成、审片、调整到多平台素材延展的流程,并提到 Ray 3.2、Luma Agents 和由 Uni-1 驱动的 Layers。

  6. Luma · 创作产品与实践46

    Luma 的品牌视觉识别、语调与一致性 AI 提示词指南

    Luma 提供一套用于品牌视觉识别、品牌语调和跨格式一致性的 AI 提示词工作流,涵盖品牌基础、语调校准、活动变体与本地化创意。流程建议上传 5-10 份多样内容样本,视觉识别设置需 15-30 分钟;团队报告内容创作可节省 50-70% 时间。视频与图像可在同一创作工作区产出,减少从概念到交付的交接。

  7. Luma · 创作产品与实践54

    Luma 时尚摄影提示词指南:15 组模板覆盖系列画册与营销活动

    Luma 发布时尚摄影提示词指南,提供 15 组覆盖人像、产品特写、季节活动和包容性呈现的模板。指南称,AI 工作流可将传统 6-8 周的系列画册制作压缩至 3-5 天,完整流程通常需要 12-22 小时,并强调统一虚拟模特、定向编辑和 AI 加传统拍摄的混合工作流。

9月21日周一