Lights, Camera, Carbon: Architectural Scaling Laws for Video Generation Energy Consumption
📄 Lights, Camera, Carbon: Architectural Scaling Laws for Video Generation Energy Consumption #音视频生成 #扩散模型 6.9/10 | 创新 1.4/2 | 严谨 1.3/1.5 | 实验 1.3/1.5 | 清晰 0.8/1 | 影响 0.4/1.5 | 开源 0.2/1.5 | 复现 0.3/0.5 | 工程 1.2/1.5 ✅ 6.9/10 | 前50% | #音视频生成 | #扩散模型 | arxiv 👥 作者与机构 第一作者:Nidhal Jegham(University of Rhode Island, Sustainable AI Group) 通讯作者:未说明 作者列表:Nidhal Jegham(University of Rhode Island, Sustainable AI Group)、Boris Gamazaychikov(Sustainable AI Group, Paris, France)、Sasha Luccioni(Sustainable AI Group, Montreal, Canada) 💡 毒舌点评 该论文从架构第一性原理出发推导了一套视频生成能耗缩放律,在多模型、多GPU上实现了低于3% MAPE的预测精度,工程框架设计扎实。然而,其核心贡献完全面向视频生成领域,与语音、音乐、音频社区的关联极弱——即便涉及音视频联合生成,分析也仅将音频视为CFG引入的额外视频前向pass开销,未探讨音频模态本身的任何特性。对音频领域读者而言,其直接价值微乎其微。 ...