“O”:视频输出。2023年,我们看到了文字到视频合成的浪潮:WALT(谷歌)、EmuVideo(Meta)、Align Your Latents(英伟达)、Pika等等,数不胜数。然而,大多数生成的片段仍然很短。我将它们视为AI视频的“系统1”——“无意识”的局部像素运动。
2023年9月,以79元眉笔事件为始,鸿星尔克、蜂花、精心等携一众国货品牌掀起国货商战,其中,洗护品牌活力28的抖音官方账号“活力28衣物清洁旗舰店”1个月涨粉超450万,带货超5000万元,目前粉丝数721万。
以椰树为代表,品牌们正变得越来越会玩,也开始获得不输达人的流量。
- 令人惊讶的是,在创建测试方面表现相当不错。
除了可以从文字生成音乐外,它还支持图像、视频和音频生成音乐,并且还可以编辑已有的音乐。该项目利用了MERT等编码器进行音乐理解,ViT进行图像理解,ViViT进行视频理解,并使用MusicGen/AudioLDM2模型作为音乐生成模型(音乐解码器)。用户可以轻松移除或替换特定乐器,调整音乐的节奏和速度。这使得用户能够创造出符合其独特创意的音乐作品。