Trellis.2 与 Pixal3D 原生接入 ComfyUI
ComfyUI 将 Trellis.2 和 Pixal3D 两个 3D 生成模型做进核心节点,无需自定义节点、编译 CUDA 扩展或降级 PyTorch,并移除了原流程中限制商用的 nvdiffrast 与 nvdiffrec 依赖。
推荐理由:ComfyUI 原生接入两个开源 3D 生成模型并重建网格后处理与 PBR 贴图链路,可据此判断本地 3D 资产生产流程的可行边界。
ComfyUI 将 Trellis.2 和 Pixal3D 两个 3D 生成模型做进核心节点,无需自定义节点、编译 CUDA 扩展或降级 PyTorch,并移除了原流程中限制商用的 nvdiffrast 与 nvdiffrec 依赖。
推荐理由:ComfyUI 原生接入两个开源 3D 生成模型并重建网格后处理与 PBR 贴图链路,可据此判断本地 3D 资产生产流程的可行边界。
Hugging Face 的 Diffusers 发布 0.36.0,新增多条图像与视频管线,包括 Black Forest Labs 的 Flux2、6B 参数的 Z-Image、支持多图参考的 QwenImage Edit Plus、Bria FIBO、Kandinsky 5.0 Image Lite 和把图像编辑重构为视频生成任务的 ChronoEdit。
推荐理由:Diffusers 0.36.0 一次性接入 Flux2、Z-Image、HunyuanVideo 1.5 等新管线并新增缓存与注意力后端,可据此判断生成工作流的升级路径。
Replicate 发布创作案例汇总,介绍 ShieldGemma 2、Hunyuan3D 2Mini、CSM-1B、Orpheus-3B、Luma 和 Kling v1.6 Pro 等模型与社区实验。
Replicate 已将 Musubi Tuner 适配到平台,支持用户用自有视觉内容微调 HunyuanVideo 视频模型。文章提供从视频切片与字幕生成、LoRA 训练到浏览器或 API 调用的流程,默认训练通常需要约 5-10 分钟。
推荐理由:文章把视频微调拆成数据准备、训练和调用四步,并给出训练时长与参数调节建议,适合评估自定义视觉风格和运动效果的落地路径。
Diffusers 发布 v0.32.2 补丁版本,修复了 Flux 加载 Comfy UI 格式单文件 checkpoint 的回归问题,并支持将 LoRA 加载进 bitsandbytes 4bit 量化的 Flux 模型。