跳到正文

#成本/效率

今日 0 条
10月2日周五
  1. NVIDIA Blog72

    NVIDIA DGX Spark 推出 64GB 配置,支持双机集群扩展本地 AI

    NVIDIA DGX Spark 将推出 64GB 统一内存配置,支持在设备上运行最多 100B 参数模型,起售价为 $4,999。两台设备可通过 NVIDIA Sync Cluster Assistant 组建 128GB 集群,将模型支持范围扩展至最多 200B 参数;NVIDIA 在 Qwen 3.8 27B 测试中称,双机性能最高达到单机的 1.7x。

    推荐理由:64GB 配置提供了从单机本地智能体到双机集群的渐进路径,适合评估本地推理、长上下文和多智能体工作流的硬件需求。

  2. NVIDIA Blog36

    NVIDIA AI 工厂如何通过高效、耐用与通用性最大化投资回报

    NVIDIA通过高效、耐用和通用的AI工厂平台提升吞吐、延长硬件收益期,并扩大可承载的AI与非AI工作负载,以最大化投资回报。每兆瓦工厂成本约为$60 million,Vera Rubin NVL72较GB300 NVL72吞吐量提升超过30x,在DeepSeek V4 Pro上每百万tokens成本最高降低45x。A100自2020年出货后仍持续商用,CUDA跨代运行可避免既有硬件闲置。

10月1日周四
  1. ComfyUI · 工作流与实践86

    Comfy API 上线,将 ComfyUI 工作流部署为生产 API

    Comfy API 面向付费 Comfy plan 用户上线,可将 ComfyUI 工作流及其 custom nodes、LoRAs、models 和 Python dependencies 打包为可自动扩缩的 API endpoint。

    推荐理由:它把 ComfyUI 工作流的环境封装、版本固定与弹性部署合并进同一流程,适合评估从本地创作到产品化 API 的迁移成本。

9月28日周一
  1. Hugging Face Blog62

    H 公司发布 Holo4 系列通用电脑操作智能体模型

    H 公司发布 Holo4 系列智能体模型,含 27B dense 与 35B-A3B MoE 两个版本,并推出基于 Nemotron 3 Nano Omni 的 Holotron4 Nano,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 在 Hugging Face 开放。

    推荐理由:Holo4 给出跨 GUI、代码、MCP 与 API 的统一智能体方案,并公开轨迹与权重,便于评估开源电脑操作智能体的成本与能力边界。

9月24日周四
9月23日周三
  1. ComfyUI · 工作流与实践75

    Comfy 发布 Comfy Router,用一个 API 调用前沿图像视频模型

    Comfy 在 Comfy Developer Platform 上线 Comfy Router,开发者只需集成一次即可调用前沿图像、视频、3D 和音频模型,并按任务选择供应商。

    推荐理由:Comfy Router 把多家供应商的前沿图像视频模型收进一个 API,读者可据此判断多供应商切换与排队重试对现有生成流程的改动。

9月22日周二
  1. Luma · 创作产品与实践67

    Luma 调查 2026 年创意团队如何整合 AI

    Luma 对760名创意专业人士的调查显示,81%已经发布过 AI 制作内容,但团队在培训、工作流整合和审批机制上仍存在明显缺口。团队过去一年平均评估6.1个 AI 工具、采用4.3个并弃用2.9个;AI Leaders 发布 AI 占多数的视频比例为78%,AI Laggards为11%。

    推荐理由:调查将 AI 采用与工作流整合拆开衡量,并用团队分层、工具流失和案例数据,为创意团队制定培训与审批流程提供了具体参照。

  2. Luma · 创作产品与实践44

    营销团队的 AI 提示词:30 个可直接用于营销活动的示例

    营销团队可用 30 个面向营销活动的 AI 提示词示例,覆盖策略、内容创作、分发和优化四个工作流阶段,并以角色、上下文、任务、语气、约束、格式、质量七部分构建可复用提示词。结构化提示词可将 persona 创建从每月 40 小时降至 5 小时,团队每天节省 2.5 小时;加入行为上下文的个性化邮件内容可带来 82% 更高转化率。

9月21日周一
9月15日周二
  1. Luma · 创作产品与实践69

    Sora 2026 年定价:API 每秒 $0.10-$0.70,将于 9 月 24 日停用

    Sora 在 2026 年仅剩 API 访问,按模型和分辨率每生成 1 秒收费 $0.10-$0.70,API 计划于 9 月 24 日停用。1080p 每 10 秒的原始生成费用为 $7,Batch API 对非紧急生成提供 50% 折扣。文章估算,考虑 3-7 次迭代后,每个可用视频的实际成本会达到单次生成价格的 3-7 倍。

    推荐理由:文章将 Sora 的单秒定价、迭代成本与 API 终止时间放在同一预算框架中,便于创作团队评估批量生成和迁移安排。

9月8日周二
9月7日周一
  1. Luma · 创作产品与实践59

    InVideo AI 2026:功能与局限

    Luma评测 InVideo AI 2026,指出它能从单条提示词完成脚本、素材、配音、字幕、音乐和剪辑,适合高频社媒与 YouTube 内容生产。文章称其整合 200+ AI models,并接入 Sora 2 和 VEO 3.1,但精确修改常需手动调整或重新生成。免费层每周提供 2–10 AI minutes 和 4 次带水印导出,且生成失败仍消耗 credits。

9月3日周四
9月2日周三
8月21日周五
  1. Black Forest Labs · 图像与视频71

    Black Forest Labs 发布 FLUX Video Upscale,支持最高原生 4K

    Black Forest Labs 推出 FLUX Video Upscale,作为独立的 FLUX Tool 和 endpoint,可将 480p 起的视频重新生成到最高原生 4K,并原生理解 FLUX 3 的输出,修复通用放大器容易遗漏的模糊人脸、水面和草地纹理网格伪影。

    推荐理由:官方给出两种模式的价格与倍率差异,便于按交付分辨率在成本与修复细节之间取舍。

7月24日周五
  1. ComfyUI · 工作流与实践60

    ComfyUI 推出 Comfy Team 团队版,共享工作区与积分池

    ComfyUI 发布 Comfy Team 团队版,把整个团队放进一个共享工作区,共用同一积分池和同一账单,管理员可管理计费、充值、邮件邀请成员并随时移除权限。

    推荐理由:ComfyUI 团队版把席位制改成共享积分池,做团队协作和成本核算的可以据此判断是否迁移。

7月23日周四
7月21日周二
7月1日周三
6月17日周三
  1. Black Forest Labs · 图像与视频73

    Envato 如何基于 FLUX 构建创意 AI 引擎

    Envato 基于 FLUX 将参考图变体、纯图像生成和多参考图像编辑整合进统一创作体验。FLUX 已贡献平台约 25% 的图像生成量,累计生成超过 51 million 张图片;其中 Stock riffing 可在 8 秒内生成 5 个变体。Black Forest Labs 称,FLUX.2 在写实、电影感和产品图场景中较可比模型高约 10%,下载率高于平台平均值 16%。

    推荐理由:案例展示了创意平台如何按任务路由模型,将参考图变体、纯文生图和多参考编辑整合进统一工作流,并以延迟与生成量衡量落地效果。

5月29日周五
  1. Black Forest Labs · 图像与视频82

    FLUX VTO 公开发布,面向大规模商品目录的虚拟试衣模型

    FLUX VTO 公开发布,主打面向大规模商品目录的虚拟试衣,单次生成耗时低于 4 秒。模型可保留人物身份以及服装的 logo、印花、缝线和五金细节,支持一次应用最多四件衣物并进行叠穿。精准的身体和服装尺码仍在演进,输出更适合用于视觉造型参考;默认政策不支持泳装和内衣。

    推荐理由:原文同时给出速度、商品细节保真和多件叠穿能力,可帮助评估虚拟试衣在商品目录与交互购物中的落地条件。

2月18日周三
9月23日周二
  1. Replicate · 模型与制作实践68

    Replicate 对多款图像编辑模型的对比评测:如何选择合适模型

    Replicate 对多款图像编辑模型进行了对象移除、视角转换、背景编辑、文字编辑和风格迁移测试,并比较了价格与推理时间。

    推荐理由:这份按对象移除、视角转换、背景编辑、文字编辑和风格迁移展开的对比,可为图像编辑模型的任务选型提供具体参照。

9月8日周一
  1. Replicate · 模型与制作实践73

    Replicate 为 torch.compile 编译产物增加缓存,模型冷启动提速 2–3 倍

    Replicate 开始缓存 PyTorch 模型的 torch.compile 编译产物,以减少模型容器启动时的编译开销,black-forest-labs/flux-kontext-dev、prunaai/flux-schnell 和 prunaai/flux.1-dev-lora 的启动速度提升 2–3 倍。

    推荐理由:Replicate的缓存机制针对torch.compile首次编译开销,给出了多个模型冷启动时间变化,可用于评估部署优化收益。

7月31日周四
  1. Replicate · 模型与制作实践75

    Replicate 联合 Pruna AI 发布优化版 Wan 2.2 视频模型

    Replicate 与 Pruna AI 合作发布优化版 Wan 2.2,FAST 文生视频和图生视频 480p 每条 0.05 美元、720p 每条 0.10 美元,推理时间约 30 秒。未优化的图生视频 480p 每条 0.40 美元、720p 每条 1.00 美元,可通过 Replicate API 调用。Replicate 称未来几天将发布更多与 Pruna 的优化版本。

    推荐理由:Replicate 与 Pruna AI 优化的 Wan 2.2 给出了按条计费的视频生成价格与推理耗时,可据此评估低成本视频试错方案。