跳到正文

全部动态

今日 2 条
今天10月3日周六
10月2日周五
  1. NVIDIA Blog72

    NVIDIA DGX Spark 推出 64GB 配置,支持双机集群扩展本地 AI

    NVIDIA DGX Spark 将推出 64GB 统一内存配置,支持在设备上运行最多 100B 参数模型,起售价为 $4,999。两台设备可通过 NVIDIA Sync Cluster Assistant 组建 128GB 集群,将模型支持范围扩展至最多 200B 参数;NVIDIA 在 Qwen 3.8 27B 测试中称,双机性能最高达到单机的 1.7x。

    推荐理由:64GB 配置提供了从单机本地智能体到双机集群的渐进路径,适合评估本地推理、长上下文和多智能体工作流的硬件需求。

  2. Luma · 创作产品与实践50

    2026 年建筑师最佳 AI 渲染工具

    2026 年建筑师的 AI 渲染工具选择正从试验转向工作流决策,重点比较建筑信息建模集成、画质与设计修改能力;44% 的建筑师已用 AI 制作概念图,74% 计划增加使用。Luma 以 Ray 3.2、图层编辑、场景变换和可重复工作流覆盖从概念图到动画制作;Veras 可直接连接 Revit、SketchUp、Rhino 等六个平台,Enscape 则提供实时渲染与虚拟现实漫游。

  3. ComfyUI · 工作流与实践86

    ComfyUI 发布 Comfy Agent,现已登陆 Comfy Cloud

    ComfyUI 发布 Comfy Agent,现已向所有 Comfy Cloud 用户开放,并计划在几周后进入 Comfy Desktop。它可在画布中根据描述构建、运行和迭代工作流,支持比较模型、解释工作流、批量处理 20 张图片,并允许最多 5 个并行聊天。Comfy Agent 目前处于 beta 阶段,可领取免费初始聊天次数,并使用已有的 Comfy Credits。

    推荐理由:Comfy Agent 将工作流搭建、运行、迭代与错误处理放进对话协作,呈现了智能体介入 ComfyUI 创作流程的具体方式。

10月1日周四
  1. ComfyUI · 工作流与实践70

    ComfyUI 发起 Comfy Developer Platform Challenge,征集开源付费功能工作流

    ComfyUI 发起 Comfy Developer Platform Challenge,邀请开发者在两周内将一个付费功能开源为可运行的工作流。参赛作品需使用 Comfy Developer Platform、Comfy Cloud 或 Comfy SDK,附带开源许可和可复现的部署说明,提交截止时间为 10/19 9am PT。

    推荐理由:活动将付费创作功能拆解为可复用的开源工作流,并明确部署、复现和评审要求,适合参考开放式创作工具的落地路径。

  2. Luma · 创作产品与实践81

    Luma 上线 Variants,支持静态广告多尺寸多语言生成

    Luma 上线 Variants,用户上传一份已批准的静态广告后,可生成不同版式和语言的广告版本。产品提供 Story 9:16、Portrait 4:5、Square 1:1、Medium Rectangle 6:5 和 Widescreen 16:9 五种标准版式,并返回每种尺寸与语言组合。用户可预览各版本、重新生成不合适的版本,下载成品或导出到 Luma Canvas 审核。

    推荐理由:Luma Variants把已批准静态广告的尺寸适配、文案翻译和交付整合到同一流程,适合参考多市场广告批量制作。

  3. TechCrunch · AI82

    OpenAI 在 Dev Day 推出 ChatGPT 应用分发、身份登录与企业应用市场功能

    OpenAI 在 Dev Day 宣布让 ChatGPT 承担应用发现、启动和使用,并推出“Sign in with ChatGPT”、企业应用市场及 Dots 智能体。ChatGPT 将根据对话推荐应用,支持交互式扩展面板;Dots 可连接超过 4,000 个应用,企业市场首批有 30 多家合作方。OpenAI 尚未公布类似传统应用商店的计费或收入分成机制。

    推荐理由:原文把 ChatGPT 的应用分发、身份层、企业市场与 Dots 串成一套路径,可用于判断 AI 入口如何改变软件发现和调用方式。

  4. TechCrunch · AI54

    OpenAI披露 Decisions API 有限预览,可用于预设选项决策

    OpenAI在Dev Day上披露了Decisions API有限预览,可让模型在预设选项中快速作出决策,并支持图像理解、广泛语言和安全能力。该API被认为与TypeSafe AI面向软件自动化的Jev相似,后者可低成本、高速输出选项概率。QueryStory的演示显示,用Jev监控每次智能体行动的成本为$2.94,而使用frontier LLM为$372。

  5. The Decoder77

    Google 在 Gemini 聊天中推出 Skills,取代 Gems

    Google 正在全球 Gemini 聊天中推出 Skills,用于保存和调用特定任务的详细提示词,并取代 Gems。用户可输入“/”加 Skill 名称调用,Gemini 还能从历史对话生成 Skills,并在检测到匹配提示时自动运行;Skills 支持文本文档、PDF 和图片作为参考材料。

    推荐理由:这次迁移展示了 Google 如何把可复用提示词、自动触发和多份参考材料组织进 Gemini 的智能体工作流,便于比较不同厂商的 Skills 方向。

  6. ComfyUI · 工作流与实践86

    Comfy API 上线,将 ComfyUI 工作流部署为生产 API

    Comfy API 面向付费 Comfy plan 用户上线,可将 ComfyUI 工作流及其 custom nodes、LoRAs、models 和 Python dependencies 打包为可自动扩缩的 API endpoint。

    推荐理由:它把 ComfyUI 工作流的环境封装、版本固定与弹性部署合并进同一流程,适合评估从本地创作到产品化 API 的迁移成本。

9月30日周三
  1. 宝玉62

    OpenAI 在开发者大会上发布 Decisions API,开发者写好问题和备选答案后,模型直接从选项里挑一个返回,不生成多余内容。它基于 GPT-6 家族最小最便宜的 Luna 特化版本,OpenAI 称一次判断约 150 毫秒,同样任务走普通 Luna 接口约 1.6 秒。

    引用OpenAI Developers@OpenAIDevs

    Give your app real-time decision-making with Decisions API, powered by GPT-6 Luna. Define questions and possible answers to classify content, route requests, or choose an agent’s next action. Available in limited preview.

9月29日周二
  1. Canva · 创作产品77

    Canva 为 Meta 的 Muse 接入 AI 连接器,支持对话生成设计

    Canva 宣布为 Meta 的个人 AI 智能体 Muse 接入 Canva 连接器,用户可在对话中创建设计,并使用品牌字体、颜色和素材。连接器还支持搜索设计库、导出文件,生成的 Canva 设计可继续编辑;该功能面向美国和加拿大用户开放。

    推荐理由:这项连接把对话式规划与品牌素材、设计库搜索和可编辑设计串起来,可参考其在智能体创作工作流中的分工方式。

9月23日周三
  1. ComfyUI · 工作流与实践75

    Comfy 发布 Comfy Router,用一个 API 调用前沿图像视频模型

    Comfy 在 Comfy Developer Platform 上线 Comfy Router,开发者只需集成一次即可调用前沿图像、视频、3D 和音频模型,并按任务选择供应商。

    推荐理由:Comfy Router 把多家供应商的前沿图像视频模型收进一个 API,读者可据此判断多供应商切换与排队重试对现有生成流程的改动。

9月22日周二
9月21日周一
  1. Luma · 创作产品与实践42

    2026 年 DTC 品牌最佳 AI UGC 视频生成器

    面向 DTC 品牌的 AI UGC 视频生成器指南,评估从创意、生成到交付的工具,重点考察生成、精修、品牌一致性与本地化能力。Luma 将视频、图像、音频和创意规划整合在一个工作区,Ray 3.2 支持 4K HDR 输出,Uni-1 维护布局、对象、文本与视觉识别一致性,Layers 提供可编辑图层。

9月17日周四
9月16日周三
9月15日周二
  1. Luma · 创作产品与实践48

    Google Flow 替代方案:2026 年场景式 AI 电影制作的 7 款工具

    Google Flow 的 7 款替代工具分别侧重叙事规划、角色动作、后期编辑、头像视频和制作交付,服务场景式 AI 电影制作的不同阶段。Luma Ray 3.2 面向制作流程,支持原生 16-bit HDR 与 EXR 导出,Draft Mode 可先以 540p 预览。Luma Layers 可在保留已批准画面的同时修改单个元素,适合产品替换、文案变更和本地化营销素材。

  2. Luma · 创作产品与实践41

    AI-first 制作团队的 7 个 StudioBinder 替代方案

    面向 AI-first 制作团队,7 个 StudioBinder 替代方案覆盖素材生成、编辑、审片协作与传统拍摄规划。Luma Agents 可从创意到交付持续保留视频、图像、音频和文案的创作上下文,适合产品发布、社交内容及无实体拍摄的广告变体。AI-first 工具可在几天内实施并立即开始创作,还能在保留其他内容的同时修改单一元素。

  3. Luma · 创作产品与实践69

    Sora 2026 年定价:API 每秒 $0.10-$0.70,将于 9 月 24 日停用

    Sora 在 2026 年仅剩 API 访问,按模型和分辨率每生成 1 秒收费 $0.10-$0.70,API 计划于 9 月 24 日停用。1080p 每 10 秒的原始生成费用为 $7,Batch API 对非紧急生成提供 50% 折扣。文章估算,考虑 3-7 次迭代后,每个可用视频的实际成本会达到单次生成价格的 3-7 倍。

    推荐理由:文章将 Sora 的单秒定价、迭代成本与 API 终止时间放在同一预算框架中,便于创作团队评估批量生成和迁移安排。

  4. Luma · 创作产品与实践52

    Luma Scenes 与 Google Flow SceneBuilder 对比:哪种 AI 分镜方式更适合故事板制作?

    文章比较 Luma Scenes 和 Google Flow SceneBuilder 的 AI 分镜流程:Luma Scenes 先生成完整故事板并在渲染前审核,Google Flow SceneBuilder 则先生成视频片段,再通过时间线剪辑组装。文中还对比了关键帧级修改与片段级控制、跨镜头视觉一致性,以及 Google Flow 基于 Veo 3.1 models 的原生音频生成。

  5. Luma · 创作产品与实践49

    2026年最佳创意自动化平台:用于规模化制作广告变体的10款工具

    创意自动化平台可将一个获批的主设计在数小时内转化为数百个本地化、调整尺寸和个性化广告变体,生产时间减少50%或更多。指南覆盖 Luma Ray、Celtra、Adobe GenStudio 等工具,面向企业、区域团队和小团队的不同制作需求。Celtra支持100+市场的全球活动治理,Adobe GenStudio通过Firefly AI提供20+生成与创意操作。