跳到正文

全部动态

今日 1 条
9月8日周二
  1. OpenAI News60

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,官方称生成结果能更好地体现用户的想法。

    推荐理由:官方给出 ChatGPT Images 2.5 的输入类型与生成定位,可据此判断参考图生图能力在创作流程中的位置。

9月7日周一
  1. Luma · 创作产品与实践59

    InVideo AI 2026:功能与局限

    Luma评测 InVideo AI 2026,指出它能从单条提示词完成脚本、素材、配音、字幕、音乐和剪辑,适合高频社媒与 YouTube 内容生产。文章称其整合 200+ AI models,并接入 Sora 2 和 VEO 3.1,但精确修改常需手动调整或重新生成。免费层每周提供 2–10 AI minutes 和 4 次带水印导出,且生成失败仍消耗 credits。

  2. Luma · 创作产品与实践79

    Sora 关停后,创意团队如何评估视频工作流替代方案

    OpenAI 已于 2026 年 4 月 26 日关闭 Sora 网页和应用,API 将于 2026 年 9 月 24 日停止,用户需在期限前导出数据。文章建议团队从工作流整合、关键帧控制、精准修改和专业导出格式等方面评估替代方案,并介绍 Luma Ray 3.2 的 16-keyframe 控制以及 HDR、EXR 导出能力。

    推荐理由:文章以 Sora 关停为背景,提醒创意团队从数据迁移、版本修订和最终交付等完整流程评估视频工具。

9月6日周日
  1. Luma · 创作产品与实践45

    Luma:20 个 AI 图片编辑提示词:修图、重塑风格并转换任意图片

    Luma 整理 20 个 AI 图片编辑提示词,帮助创意团队在保留已批准布局、光线和阴影的同时替换产品、更新文案与背景,快速生成不同市场和平台的营销变体。提示词应明确主体、修改动作、需保留内容和风格;Uni-1 可分析布局、对象、文本及视觉关系,让编辑保持上下文一致,并缩短传统拍摄、修图和变体制作流程。

  2. Luma · 创作产品与实践54

    Luma 总结 18 个更接近真实摄影的 AI 图像提示词

    Luma 总结了18个面向写实 AI 图像的提示词示例,强调在描述主体之外,还要明确光线、镜头特征、环境细节、材质反射和自然瑕疵。文章将图像生成定位为起点,建议通过 Layers 进行局部编辑,并由 Luma Agents 在概念、修改、变体生成和最终交付之间保持创作上下文。

  3. Luma · 创作产品与实践51

    Luma提供20组平面设计AI提示词,覆盖海报、图标与社交媒体图形

    Luma发布一份平面设计指南,提供20组可直接复用的AI提示词,覆盖海报、图标和社交媒体图形。指南总结了由主体、格式、风格、品牌线索、尺寸、情绪和文字组成的七要素公式,并给出A3、300 DPI、1080x1080和1080x1920等规格示例。文章还强调将生成素材作为可编辑的初稿,通过局部元素修改、品牌模板和多市场本地化完成后续制作。

9月5日周六
  1. ComfyUI · 工作流与实践22

    ComfyUI 推出 Forward Deployed Creatives 企业服务

    ComfyUI 推出 Forward Deployed Creatives(FDCT)企业服务,由 Comfy 专家嵌入企业团队,在客户自己的 Comfy Enterprise 环境中构建工作流,并按 Validate、Build、Enable、Own 四个阶段交付。该服务强调赋能而非代做,以团队能否自行修改工作流作为衡量标准,最终工作流归企业所有。

9月4日周五
9月3日周四
  1. Hugging Face Blog66

    用 TRL 和 OpenEnv 训练编码模型画水彩

    作者用 TRL 和 OpenEnv 复现了 Surya Narreddi 让语言模型通过 p5.brush 写 JavaScript 画水彩的思路,参考池、RL 环境、训练脚本和训练好的模型全部开源,整条流程跑在 Hugging Face 上。

    推荐理由:完整公开了一套用 RL 训练模型写代码作画的流程与全部产物,可借鉴其奖励设计与环境搭建思路。

  2. Canva · 创作产品75

    Canva Visual Suite 推出 100 多项更新,覆盖 Docs、Sheets、Whiteboards、Presentations 和 Websites

    Canva宣布 Visual Suite 自年初推出 100 多项更新,覆盖 Docs、Sheets、Whiteboards、Presentations 和 Websites,并已向全球所有 Canva 用户陆续开放。

    推荐理由:材料展示了 Canva 如何把白板、文档、表格、演示和网站串成连续项目流程,可用于评估一站式创作与协作工具的迁移价值。

9月2日周三
9月1日周二
  1. World Labs · 空间智能与世界模型85

    World Labs 发布世界模型 Atlas,原生支持文本、图像、视频与 3D

    World Labs 发布下一代世界模型 Atlas,这是一个从零预训练的多模态自回归扩散 Transformer,原生处理文本、图像、视频和 3D,所有输入被组合进共享的空间上下文。

    推荐理由:Atlas 把相机位姿与 3D 深度作为原生输入,读者可据此判断世界模型在可控生成与稀疏重建上的路线差异。

8月28日周五
  1. ComfyUI · 工作流与实践66

    Gemini Omni 1.1 Flash 接入 ComfyUI:支持视频生成、编辑与 4K 输出

    Gemini Omni 1.1 Flash 通过 Partner Nodes 在 ComfyUI 上线,封装在 Gemini Video Omni 节点中,可从模型下拉菜单选择 Omni Flash 1.1,在单个节点内完成文生视频、图生视频、参考生视频、视频编辑和场景延展。

    推荐理由:ComfyUI 接入 Gemini Omni 1.1 Flash 的节点参数与提示词写法,可供视频生成与编辑工作流选型参考。

  2. Hugging Face Blog62

    Open ASR Leaderboard 新增首个全球南方语言:印地语与印度英语评测集

    Voice Arena 与 Hugging Face 合作,在 Open ASR Leaderboard 上新增 Monsoon en-IN 和 Monsoon hi-IN 两个评测集,印地语成为该多语言标签页上的首个印度语言。

    推荐理由:公开 ASR 榜单首次纳入印地语与印度英语,并公开说话人元数据与格参考,可用于判断语音模型的地域偏差。

  3. ComfyUI · 工作流与实践80

    Comfy 成为 MiniMax H3 商业许可证首个官方转售商

    Comfy 宣布成为 MiniMax H3 商业使用许可证的首个官方转售商,面向在自有硬件本地运行 H3 的商业创作场景。许可证覆盖生成内容的商业权利、微调与 LoRA 训练,以及客户和下游项目;但不包含运营向他人出售 H3 访问权限的推理平台或市场。

    推荐理由:这项授权安排明确了 H3 本地商业使用、LoRA 微调和客户项目的许可边界,也提示平台化售卖访问权限不在覆盖范围内。

8月27日周四
8月26日周三
8月25日周二
  1. ComfyUI · 工作流与实践87

    Wan 3.0 接入 ComfyUI,支持原生 30 秒视频与 Omni-Reference 控制

    Alibaba 的 Wan 3.0 已接入 ComfyUI,支持原生生成最长 30 秒的视频,并提供 Omni-Reference 控制。模型支持 480p、720p 和 1080p,可使用最多 10 张图片、5 个视频和 5 段音频等参考素材,还支持视频编辑与扩展。使用这些功能需将 ComfyUI 更新至 v0.33.4,或访问 Comfy Cloud。

    推荐理由:原文同时给出时长、参考素材和分辨率选项,便于评估 Wan 3.0 在长镜头、多素材控制与低成本草稿中的工作流价值。

  2. Hugging Face Blog71

    Hugging Face 在 Gradio 中推出 gr.Workflow,把 AI 管线变成可拖拽画布与 REST API

    Hugging Face 在 Gradio 中推出 gr.Workflow,把多步 AI 管线描述为带类型端口的节点图,Gradio 直接提供可拖拽画布,每个节点可运行、每个中间结果可见,同一张图同时是 REST API 并可一键部署到 Hugging Face Spaces。

    推荐理由:原文给出 gr.Workflow 的节点类型与多端点 API 用法,可据此判断多步生成管线如何一次搭好并直接调用。

8月24日周一
8月21日周五
  1. Google DeepMind62

    Google DeepMind 与 Fenris Creations 合作,用 EVE 宇宙推进通用游戏智能体研究

    Google DeepMind 宣布与 EVE 宇宙开发商 Fenris Creations 建立研究合作,把 EVE Online、EVE Vanguard 和 EVE Frontier 作为研究持续学习、记忆、长时程规划和复杂多智能体动态的环境。

    推荐理由:DeepMind 公开了游戏智能体从离线沙盒到持久世界的推进路径,可据此判断通用游戏 Agent 的落地节奏与安全边界。

  2. Black Forest Labs · 图像与视频71

    Black Forest Labs 发布 FLUX Video Upscale,支持最高原生 4K

    Black Forest Labs 推出 FLUX Video Upscale,作为独立的 FLUX Tool 和 endpoint,可将 480p 起的视频重新生成到最高原生 4K,并原生理解 FLUX 3 的输出,修复通用放大器容易遗漏的模糊人脸、水面和草地纹理网格伪影。

    推荐理由:官方给出两种模式的价格与倍率差异,便于按交付分辨率在成本与修复细节之间取舍。